AI 日报hiw3c.com

2026-09-17全球 AI 要闻精选,来自 30+ 信息源

聚合官方博客 · 权威媒体 · 深度通讯 · 学术信号。
只做索引,不做转载,标题与链接均指向原始发布方。

  1. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    一万智能体集群如何求解 Navier-Stokes

    📌 One-Sentence Summary OpenAI 研究员 Noam Brown 讲解一支脚手架极简的 1 万智能体集群如何在 88 小时内消耗 1300 亿 token 攻克 Navier–Stokes,并梳理多智能体测试时扩展、RSI 瓶颈,以及合作共谋与脆弱思维链监控带来的对齐风险。 📝 Summary Dwarkesh Patel 访谈 OpenAI 研究员 Noam Brown,讨论据称触及千禧年大奖的突破:一支 1

  2. AWS ML Blog 海外官方 快照

    为亚马逊Bedrock知识库选择载体商店

    为您的Amazon Bedrock知识库RAG应用程序选择正确的载体商店会影响性能和成本。这篇文章比较了三种RAG用例中的Amazon OpenSearch Service、Amazon Aurora PostgreSQL与pgvector以及Amazon S3 Vectors,并附有基准测试和实用的选择框架。

  3. AWS ML Blog 海外官方 快照

    Amazon Bedrock AgentCore上Wood Mackenzie的共享代理平台

    Wood Mackenzie在Amazon Bedrock AgentCore上构建了APEX,这是一个共享的代理人工智能平台,因此每个团队都可以运送生产代理,而无需从头开始重建运行时间、身份、可观察性和护栏。了解他们选择AgentCore的原因、APEX Studio如何运营它以及多代理系统的下一步发展方向。

  4. AWS ML Blog 海外官方 快照

    在Amazon Quick上实施对LCP工具的深度防御授权

    了解如何在Amazon Quick上对模型上下文协议(HCP)工具实施深度防御授权。此演练通过Amazon Bedrock AgentCore Gateway拦截器将Microsoft Entra ID组和基于声明的JWT连接起来,以应用每个用户、每个工具基于角色和基于属性的访问控制,并进行服务器端检查和不可变的审计跟踪。

  5. The Verge 国际媒体 快照

    你的机器人出租车可能是缉毒警察

    9月初,两名青少年上了Waymo,但随后却被困在警车后座。据《洛杉矶时报》报道,这家机器人出租车公司表示,它发现“违反了我们的服务条款,涉及枪支”,将车停在路边,并向紧急服务部门发出警报。警方在[.]后逮捕了乘客

  6. The Verge 国际媒体 快照

    Camp Snap的110 D为纤薄复古胶片相机提供了数字升级

    Camp Snap正在扩大其小型无屏数字傻瓜相机系列,推出新款便携式110 D,该相机采用了20世纪70年代柯达胶片相机首次普及的纤薄水平设计。Camp Snap 110 D从今天开始预订,售价74.95美元,背面有黑色(黑色和灰色)或dreamsicle(白色和橙色)[.]

  7. The Decoder 国际媒体 快照

    GPT-6 Astra粉碎了Pokemon、Factorio和Fallout 3,然后在一只糟糕的Creeper之后转入Minecraft土豆种植

    OpenAI的GPT-6 Astra在视频游戏中表现出了急剧的飞跃。Pokemon FireRed只需18小时,而不是96小时,加上Factorio、Fallout 3和Portal的完成。为什么?该模型将经验提炼成紧凑的规则。但在《爬行者》爆炸后,同样的特征导致了数小时的土豆种植,而不是《我的世界》的进步。文章GPT-6 Astra粉碎了Pokemon、Factorio和Fallout 3,然后在《The Decoder》上首次出现一

  8. 雷峰网·AI 科技评论 中文媒体 中文 快照

    华为开创AI时代计算架构:让百万处理器成为一台计算机

    关键信息: • Peerium计算架构突破了图灵范式,提出了Nested BSP,突破了冯·诺依曼单机架构,颠覆了长久以来的主从架构,实现了百万级处理器真正成为一台更大的计算机。 • 灵衢是实现Peerium计算架构的关键互联技术。 [中国,上海,2026年9月17日] 今日,华为发布AI时代的全新计算架构 – Peerium计算架构。该架构能实现百万级处理器成为一台计算机,以满足不断发展的AI算力需求。 Peerium计算架构是基于嵌

  9. The Verge 国际媒体 快照

    人工智能被全球视为就业破坏者

    皮尤研究中心发布了一项新的全球调查,揭示了人们如何看待人工智能,包括其对就业、总体生活和收入不平等的影响。该调查于2月8日至5月13日对37个国家的42,151人进行了调查,远远早于最近的世界末日警告。大多数人将人工智能视为威胁[.]

  10. The Verge 国际媒体 快照

    微软人工智能首席执行官表示人工智能威胁是真实存在的,而Anthropic正在让情况变得更糟

    今天,我与微软人工智能首席执行官穆斯塔法·苏莱曼(Mustafa Suleyman)交谈。正如您无疑知道的那样,目前科技界最大的新闻是关于人工智能安全和监管的不断升级的争论。穆斯塔法对如何构建和监管人工智能有强烈的看法,这并不奇怪。微软刚刚发布了[.]

  11. The Decoder 国际媒体 快照

    OpenAI模型不断将提示注入自己的笔记中,研究人员仍然不确定原因

    OpenAI正在发布一个系统性报告人工智能失调的框架,并推出六份报告。在一个案例中,Astra家族的一个未发布的模型在训练期间将提示注入写入自己的摘要中,包括旨在推翻后续指令的“违规警报”。文章OpenAI模型不断将提示注入到自己的笔记中,研究人员仍然不确定为什么首先出现在The Decoder上。

  12. NVIDIA AI Blog 海外官方 快照

    可爱的小动物来到云端:“Aniimo”在GeForce NOW上发布

    本周,一场新的捕捉生物的冒险活动即将从云中播出。Pawprint Studio的Aniimo在GeForce NOW发布时登陆,邀请游戏玩家在受支持的设备上探索充满活力的Idyll大陆。同样在本周,007 First Light在GeForce NOW上收到了路径追踪更新,并在[.]上进行了精彩的限时豪华版促销

  13. 雷峰网·AI 科技评论 中文媒体 中文 快照

    360纳米Work启动“双城千店上岗计划” 探索实体商业AI落地新路径

    9月17日,2026北京艺术与科技周在北京798艺术区开幕。360集团创始人周鸿祎参加开幕式,并宣布360旗下AI办公平台纳米Work正式启动“双城千店上岗计划”。作为本届活动独家AI合作伙伴与官方办公支持平台,纳米Work将以798为首站推进场景合作;10月也将以同一身份参与第11届陆家嘴国际咖啡文化节。 周鸿祎在活动现场表示:“AI 行业的竞争焦点正在从模型参数转向实际交付,大模型决定的是"读不读得懂",智能体决定的是"干不干得成"

  14. OpenAI News 海外官方

    Cooley如何与ChatGPT加速IPO工作

    Cooley与ChatGPT Work一起创建了GO Public,为IPO流程带来情报,帮助律师尽早提出问题,并将判断集中在最重要的地方。

  15. The Decoder 国际媒体 快照

    OpenAI Codex开发人员表示,人工智能代理群是对代币的巨大浪费,质量收益为零

    OpenAI Codex开发人员Eric Provencher警告说,运行两个以上的并行子代理几乎总是会烧毁代币,而不会提高质量,因为代理彼此不信任,最终会仔细检查每个人的工作。他称之为“协调税”,并指出了一个项目,其中1,393名代理人在一次Python重构上花费了20,000美元的代币,一名Astra代理人本可以以很小的成本处理该重构。OpenAI Codex开发人员首先出现在The Decoder上的文章表示,人工智能代理群是对代

  16. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    Graph RAG 究竟在何时能产生价值?一次实操实验

    📌 One-Sentence Summary 通过在笔记本电脑上构建四种检索架构的实操实验发现,Graph RAG 在多跳推理问题上具有显著价值,但在覆盖率或溯源任务中表现一般;且当语料库能放入上下文窗口时,全上下文的前沿模型依然胜出。 📝 Summary 作者在个人笔记本电脑上构建了四种检索系统,并针对两份 Anthropic AI 安全文档和三个评估问题进行了基准测试。系统 A 是纯向量 RAG(500 字符分块,使用 all-Mi

  17. The Decoder 国际媒体 快照

    OpenRouter令人震惊的代币图表是一张图片中的人工智能泡沫辩论

    在OpenRouter上,自2025年1月以来,每周代币消费量增长了25,000%以上,从0.5万亿到126.2万亿。这个数字看起来令人印象深刻,但它说的不是实际的人工智能使用,而是令牌饥饿的推理模型和越来越多的未优化的人工智能代理,这些代理以惊人的速度消耗令牌。文章OpenRouter的惊人的令牌图表是AI泡沫的辩论在一个单一的图像出现在解码器上。

  18. 雷峰网·AI 科技评论 中文媒体 中文 快照

    九识建成首个L4万卡集群,无人驾驶进入多模态大模型新范式

    一家做无人车的公司,为什么需要一万多张GPU? 9月10日,九识CEO孔旗在广州宣布战略升级为“城市级物理AI”。一周后的9月17日,CTO庄立首次披露支撑这次升级的底层能力:九识已建成业内首个L4级万卡集群,算力集群总规模近1.5万卡。九识也成为首个建成万卡集群的L4团队。 而万卡算力的背后,是一个正在从百亿级迈向千亿级的九识APEX多模态基座大模型。 无人驾驶下半场:迈入多模态大模型新范式 在智能驾驶圈子里,长期存在一个顽固的偏见:

  19. The Decoder 国际媒体 快照

    下一篇:OpenAI的GPT-6 Astra在10小时内解密了一条纳粹无线电信息,这条信息在83年内一直没有得到解决

    彭博社的一名开发人员声称使用OpenAI的GPT-6 Astra破解了来自国防军的一条83年前的Enigma消息。这条1941年的82个字符的无线电信息包含一名士兵询问他的行军路线。该解决方案仍需要独立审查。文章OpenAI的GPT-6 Astra在10小时内解密了一条纳粹无线电信息,该信息83年来一直悬而未决。

  20. 雷峰网·AI 科技评论 中文媒体 中文 快照

    安芯启程|安芯724北京基地正式投产

    2026年9月16日,柒贰肆安芯技术服务有限公司(简称“安芯724”)北京基地投产活动暨品牌发布会在北京市昌平区未来星科能源谷智造产业园举行。安芯724北京基地正式投产,此举标志着安芯724在GPU及AI算力设备全生命周期服务领域进入体系化运营新阶段。 昌平区、未来科学城集团、昌平职业学校、北京科技职业学院等有关单位领导及合作伙伴出席活动,共同见证基地启幕与品牌发布。 活动当天上午,安芯724举行内部开业仪式。随着舞狮、点睛及剪彩仪式完

  21. 雷峰网·AI 科技评论 中文媒体 中文 快照

    蚂蚁集团全员接入千问办公,打造大型企业办公标杆

    9月17日,记者获悉,蚂蚁集团正式接入千问办公,作为全公司的智能办公Agent底座,供全员使用,打造大型企业办公的标杆。 图示 蚂蚁集团和千问办公达成合作 蚂蚁集团是全球领先的数字支付与科技服务平台,业务涵盖数字支付、数字金融科技、医疗健康及数字科技等多个领域,员工规模达数万人。随着AI技术在长程任务等多方面能力的全面提升,AI已经逐步融入到蚂蚁内部各个办公场景,亟需全新的办公产品支持和推动智能化转型。 考虑到严格的数据安全与合规要求,

  22. 雷峰网·AI 科技评论 中文媒体 中文 快照

    AI办公之外,百度智能云为何盯上「产业智能体操作系统」?

    “整个下半年,就看AI办公圈谁能杀出重围了”。一位大模型从业者对雷峰网表示。 从五月开始,各个互联网大厂争相出场,写字楼电梯间、机场候机室,到处都是Workbuddy、千问办公、豆包工作、百度搭子的内容。 但办公大战打得再热闹,顶多算是一道前菜。 早在2025年,微软的Work Trend Index就提出过,AI进入企业分三步:帮员工做得更快、成为团队里的“数字同事”、直接执行完整的业务流程。 对照这个坐标,眼下的办公之争,其实还停在

  23. 雷峰网·AI 科技评论 中文媒体 中文 快照

    独家丨BAT 天价挖 Gemini 大牛,可惜都挖错了

    据雷峰网独家获悉,一位 Google Gemini 的预训练专家,于近期已加入国内某互联网大厂。 该研究员在 Google 的职级或是 L7- L8,接近总监级别,长期在英国工作,入职后主要从事预训练相关工作,也经常往返国内出差。 一位知情人士看来,这可能是国内大厂这一轮争抢 Gemini 人才以来,第一次真正“找对了人”。 上述人士告诉雷峰网,此前多家大厂均从 Gemini 引入过人才,但部分人选并未触及核心。他们之中,或只参与预/后

  24. 雷峰网·AI 科技评论 中文媒体 中文 快照

    独家丨前腾讯混元预训练负责人姚星丞,加入Thinking Machines Lab

    雷峰网独家获悉,腾讯混元大语言模型预训练负责人姚星丞,近日已加入北美创业公司Thinking Machines Lab。 据知情人士透露,Thinking Machines Lab此次给姚星丞开出的薪资,明显高于其在腾讯的收入。而姚星丞在腾讯的年薪包,大约在数千万元人民币区间。 此前,姚星丞曾被传将加入Meta,如今靴子落地,他最终选择了这家由OpenAI前CTO Mira Murati创办的AI公司。 姚星丞今年7月从腾讯离职,主要负

  25. 雷峰网·AI 科技评论 中文媒体 中文 快照

    豆包座舱助手发布,首款合作车型即将开启预售

    9月17日,豆包与火山引擎联合打造的AI原生车载助手——豆包座舱助手正式发布。 豆包座舱助手致力于成为聪明懂你、交互自然有温度、安全可靠的座舱 AI 伙伴,带来更加方便、愉悦的驾驶出行体验。它能理解复杂需求,联动全车功能,把事情一步步办好;也能自然参与多人交流,记住每个人的习惯,在互动中更懂你;还可以与豆包APP联动,让服务从手机延伸到车里。 目前,豆包座舱助手已与上汽集团达成合作,首款搭载豆包座舱助手的车型——荣威家越07即将开启预售

  26. MarkTechPost 国际媒体 快照

    Google Research推出Retrieve-for-Train(R4 T):一款RL编译的扩散检索器,可提高12倍至20倍的查询扇出速度

    谷歌研究中心推出了Retrieve-for-Train(R4 T),这是一种搜索框架,可以返回连贯、多样化的结果集。它使用强化度、多样性和对齐奖励,用RL训练了一次展开语言模型。然后,该模型合成53.9兆参数扩散检索器的训练数据。检索器只需一次就能生成所有检索方向,运行速度比自回归散开快12至20倍。尚未发布代码或模型权重。谷歌研究推出火车检索器(R4 T):一款RL编译的扩散检索器,速度可达12倍至20倍

  27. BestBlogs·每日早报 BestBlogs 精选 中文

    EP178 · 全双工语音、GKE Agent、Claude CRM · 09-17 早报

    📝 今日导语 全双工语音分层、GKE Agent 沙箱隔离、Claude CRM 人工确认,提供系统边界的判断路径。 🏷 今日关键词: 全双工语音 GKE Agent 基座 Claude CRM 协同 StepAudio 3 Pinterest Manas 端侧具身推理 Hermes 多智能体 📰 今日精选内容 你的语音智能体还只是对讲机 — Neil Zeghidour,Gradium AI Engineer · 视频 · 评分 89

  28. 雷峰网·AI 科技评论 中文媒体 中文 快照

    蚂蚁集团成为上海第48届世界技能大赛国家战略合作伙伴

    9月22日至27日,第48届世界技能大赛将于上海举行。作为全球规模最大、影响力最广的职业技能赛事,本届大赛共设64个竞赛项目,汇聚了来自全球七十余个国家的顶尖技能人才同台竞技。 作为本届大赛的国家战略合作伙伴,蚂蚁集团将多项AI科技带到赛事现场:助力大赛打造专属服务智能体,同时带来生活服务智能体“阿宝”、就业智能体“晓叶”、民生智能体“晓政”、阿宝车机智能体、AI 眼镜解锁单车等多项应用。 从高效的赛事保障,到便捷的生活和人社服务,再到

  29. TechCrunch AI 国际媒体 快照

    您的初创公司的下一个队友可能是人工智能代理:Gusto、Insight Partners和Leland在TechCrunch Disrupt 2026上解释了这一变化

    本次会议将探讨早期公司如何建立人类和人工智能代理协同工作的团队,以及创始人如何在不牺牲速度、问责制或文化的情况下做到这一点。在TechCrunch Disrupt 2026上了解更多信息。9月25日之前注册,最多可节省200美元。

  30. 雷峰网·AI 科技评论 中文媒体 中文 快照

    几何的「反攻」!港科大谭平:从局部先验到全局一致,3D 几何如何增强视觉大模型 | ECCV 2026

    学习模型已经具备很强的局部视觉先验,而 3D 几何可以帮助建立跨视角、长距离的全局一致性。二者如何结合,是 3D 视觉与空间智能中的重要问题。 编辑丨岑峰 在生成式 AI 的快速发展中,Sora 等视频和图像扩散模型(Diffusion Models)展示了很强的视觉生成能力。大规模 2D 数据让模型学到了丰富的视觉与语义先验,在单帧和局部视频生成上取得了显著进展。但当任务进一步要求多视角、长距离的 3D 一致性时,仅依赖数据驱动的局部

  31. The Verge 国际媒体 快照

    主播们因万圣节而争吵

    多伦多国际电影节是一个见证电影未来的地方,但今年它也让我们一睹流媒体领域即将发生的事情。四家不同的流媒体公司-- Peacock、Netflix、亚马逊和AMC --都对即将上映的恐怖系列剧进行了早期首映,这些剧都是[.]

  32. 雷峰网·AI 科技评论 中文媒体 中文 快照

    独家解读丨国产GPU四份半年报出炉,赚钱后才发现二级市场「难哄」

    早前,壁仞科技、天数智芯、沐曦股份和摩尔线程陆续交出上市后的首份或最新半年报。9月,燧原科技也正式启动申购,国产GPU正在以前所未有的密度进入资本市场。 但当越来越多国产GPU公司开始接受公开市场检验,一个最直观的问题“谁先赚钱”,反而正在失去解释力。 四份半年报给出了截然不同的利润表:壁仞营收增长近20倍,仍处亏损;天数智芯和沐曦已经实现账面盈利,但利润中均存在不能简单等同于主营经营改善的因素;摩尔线程距离账面盈亏平衡仅一步之遥,扣除

  33. 雷峰网·AI 科技评论 中文媒体 中文 快照

    从百美元到数千美元,AI互联为什么越卖越贵?

    2026年的CIOE中国光博会,人潮如织。 社交媒体上甚至有人开出2500元一场的讲解费,希望找到业内人士陪同参观。走进场馆后更直观的感受是,今年光博会几乎所有与AI相关的环节都在升温:从光模块、光器件,到高速互联和数据中心基础设施,AI需求正在把原本相对垂直的光通信产业链整体推向更高热度。 Astera Labs也出现在今年光博会。这家2017年成立的美国半导体公司,最早从PCIe Retimer切入高速互联,如今产品已经延伸至铜互联

  34. 雷峰网·AI 科技评论 中文媒体 中文 快照

    折叠屏还在比大小,努比亚已经在抢另一个入口

    今年9月,手机行业最显眼的变化之一仍然是折叠。 华为继续做三折叠,苹果也终于拿出了自己的折叠屏手机。厂商还在研究一个熟悉的问题:怎样在有限的机身里,装进更大的屏幕。 另一种变化,发生在屏幕里面。大模型开始离开聊天框,进入手机系统。 过去,查资料、订票、安排日程,都要用户自己找App,一步步操作;现在,AI开始尝试接手其中一部分工作。 折叠屏改变的是手机的形态,Agent改变的则可能是人使用手机的方式。 过去的语音助手更像遥控器,比如“打

  35. MarkTechPost 国际媒体 快照

    Nunchux AI推出VC-Attention:一个免训练的低位注意力核心,可加速视频扩散变形器

    Nunchux AI发布了VC-Attention,这是一个为视频扩散变形金刚(DiTS)构建的免训练低比特注意力内核。它同时解决2个问题:值量化误差和缓慢的softmax阶段。为什么注意力是视频瓶颈视频DiT将剪辑压平为1个时空标记序列,并在每一层运行充分的自我注意力。A [.] Nunchux AI推出VC注意力:一种无需训练的低比特注意力核心,可加速视频扩散变形器,首次出现在MarkTechPost上。

  36. 雷峰网·AI 科技评论 中文媒体 中文 快照

    专访零跑周洪涛:2026年冲刺智驾头部,零跑的进度条比想象中快

    朱江明很少会在午休时间离开办公室。 但在体验智驾新版本后的一个中午,他又独自一人,开着搭载智驾 4.0的D19在杭州市区痛快跑了一个多小时。在公司内部群,他以少有的振奋接连赞扬了智驾团队。 这套让老板爱不释手的智驾系统,源于零跑内部一场持续数月的赛马: 2025年10月,智驾2.0、3.0、4.0三条技术路线同时开跑 。 今年年初,第三方 PK测试中,智驾4.0 以综合接管率仅为头部车企三分之一的表现 胜出 ——零跑由此验证并明确了世界

  37. 雷峰网·AI 科技评论 中文媒体 中文 快照

    周鸿祎:不会再投资新能源汽车,已经吃过一次亏;OpenAI洽谈新融资,估值或超1.2万亿美元;花呗、抖音月付等将退出支付选项?多平台回应

    要闻提示 1.周鸿祎:不会再投资新能源汽车,已经吃过一次亏 2.曝字节跳动完成 2.9 亿美元融资,用于拆分 AI 制药业务 Anew Labs 3.iPhone Duo可靠性翻车:影视飓风Tim在苹果总部掰一下就闪屏了 4.花呗、抖音月付等将退出支付选项?多平台回应 5.奥迪惨遭高空坠落餐刀刺穿车顶,刀身插入两三厘米,维修费高达12万 6.吉利回应“宁德时代收购电池公司”:未放弃电池自研,“85亿元投资”不实 7.努比亚NaviX U

  38. OpenAI News 海外官方

    介绍阿斯特拉法律

    OpenAI for Law为法律、定制公司工作流程、连接的法律数据源以及机密客户工作的法律级控制带来前沿情报。

  39. Simon Willison 个人技术博客 快照

    三角形1.0a40

    发布:Inbox 1.0a40与0.65.5相同的安全修复,加上一些简洁的新功能和错误修复:插件现在可以使用新的Inbox.add_background_tasky()方法启动和管理后台任务。谢谢你亚历克斯·加西亚我已将Datasette迁移到httpx2,以获得内部spreadette.client.get()方法等功能。大量错误修复,其中许多都源于最近为1.0稳定版本分类问题所做的努力。标签:安全,小隔间

  40. Simon Willison 个人技术博客 快照

    凤尾鱼0.65.5

    发布:收件箱0.65.5安全修复了dpfkdlemtp在GHSA-h547-rmjf-5 m2m中报告的问题,即请求的表名称中的尾随新元素可能绕过表权限并公开私有行。标签:安全,小隔间

  41. The Verge 国际媒体 快照

    我戴着Snap售价2,200美元的智能眼镜

    我最喜欢戴着眼镜的部分,Snap的新增强现实眼镜,是玩多米诺骨牌。坐在桌子对面的Snap员工戴着同样一副厚实的眼镜,我可以轻轻捏一捏,选择一张虚拟多米诺骨牌,然后移动手将其放在适当的位置,看着瓷砖在[.]

  42. The Verge 国际媒体 快照

    Snap正在推出一款新的Specs AI工具,并将登陆iOS和Mac

    Snap正在推出“Specs Intelligence”,这是一款新的人工智能助手,可以连接其他数字帐户,帮助您完成工作任务和跟踪旅行信息等任务。它似乎与Meta的Muse和Gemini的Spark等人工智能助手相似,尽管Snap正在将Specs Intelligence宣传为一种“预期性人工智能服务”,“帮助你[.]

  43. MarkTechPost 国际媒体 快照

    斯坦福大学研究人员发布Paper2Agent:将研究论文转化为重现结果并在新数据上运行的人工智能代理

    发表在《自然》杂志上的Paper2Agent将论文转换为经过验证的LCP工具,在74篇论文的300个问题上得分为91.2%。斯坦福大学研究人员发布Paper2Agent:将研究论文转化为复制结果并在新数据上运行的人工智能Agent的帖子首先出现在MarkTechPost上。

  44. The Verge 国际媒体 快照

    人工智能生成的2.5小时奥德赛电影太长了2.5小时

    克里斯托弗·诺兰(Christopher Nolan)对《奥德赛》(The Odyssey)的引人入胜的演绎在票房上占据主导地位,并激发了电影观众对经典文学的新兴趣。但完全用人工智能重新重述故事是如此糟糕,以至于可能会让观众完全讨厌原来的故事。这部新电影名为《奥德赛:堕落》,上映了[.]

  45. The Decoder 国际媒体 快照

    欧盟主席警告人工智能特工“逃离环境”只是即将发生的事情的预览

    乌苏拉·冯德莱恩(Ursula von der Leyen)计划邀请主要前沿实验室进行谈判,并利用《人工智能法案》来帮助制定全球人工智能安全标准。她认为自主黑客和自我改进模型是直接的风险。欧盟主席的文章警告人工智能特工“逃离环境”只是《解码器》上首次出现的即将发生的事情的预览。

  46. AWS ML Blog 海外官方 快照

    利用开源代理技能改进HLCS人工智能推理

    基础模型上的人工智能代理经常错误地应用医疗保健和生命科学决策框架,引用正确的指导方针,但应用错误。这篇文章分享了11个HCLS域中的38个开源代理技能,这些技能缩小了这一差距,包括安装步骤,三个工作用例,以及显示70-86%胜率的410提示评估。

  47. AWS ML Blog 海外官方 快照

    使用NVRx在Amazon EKS上进行容忍分布式训练

    将NVIDIA Resiliency扩展(NVRx)集成到Amazon EKS上的PyTorch FSDP训练中,以将检查点I/O与训练重叠,并在几秒钟内从图形处理器故障中恢复。这篇文章涵盖了Deliverc检查点、进程内重启和ft_launcher作业内重启,2到8个节点的H100基准测试显示出99%以上的训练效率和二次规模恢复。

  48. The Verge 国际媒体 快照

    沃尔玛削减了Metroid Ravenous实体预订的成本

    《银河战士》系列将再次回归其2D根源,Nintendo Switch 2上的《银河战士》Ravenine,这是自2021年Nintendo Switch上的《银河战士》恐惧以来该系列中的第一款侧向滚动游戏。如果你已经足够兴奋考虑预购,你可以节省10美元的物理版本的游戏,当你[...]

  49. The Decoder 国际媒体 快照

    据报道,苹果正在使用自己的M8 Ultra芯片构建企业人工智能服务器

    据《The Info》报道,苹果正在为人工智能推理市场开发一款配备两到四个M8 Ultra芯片的企业服务器,可能不会早于2029年推出。苹果正在考虑使用Nvidia的NVLink Fusion技术来连接芯片。OpenAI和Anthropic已经为人工智能工作负载批量购买Mac硬件,该项目可能会得到推动。据报道,苹果正在使用自己的M8 Ultra芯片构建企业人工智能服务器的文章首先出现在The Decoder上。

  50. Simon Willison 个人技术博客 快照

    克劳德·考沃克和聊天现在是一个克劳德

    克劳德·考沃克(Claude Cowork)和聊天现在是克劳德·In(Claude Cowork)的一员,希望这对像我这样对考沃克诉案越来越感到困惑的人来说是个好消息。克劳德诉Claude Code:从今天开始,Claude Cowork和chat将合并为一个Claude。提出一个简短的问题,或者提交一份中午到期的报告,克劳德会从那里接过它,即使您关闭了笔记本电脑。[...]这将首先在Pro和Max计划中推出,并在未来几周内在Web、桌

  51. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    目标与搜索:分解好代币器的组成部分

    作者:Ahmetcan Yavuz,Clara Meister,Tiago Pimentel|现代语言模型使用两种主要的标记化算法:字节对编码(BPE)和UnigramLM。它们在两个垂直轴上有所不同:它们的优化目标(压缩vs. log似然)和它们的搜索过程(自下而上合并vs.自上而下修剪)。现有的比较混淆了这些轴,使其不清楚它们观察到的差异是否源于什么是bei

  52. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    LLM偏好一致的零阶范式

    作者:陈旭,陈曦,尹沃涛|由于直接偏好对齐方法的计算和存储效率,因此被广泛用于将大型语言模型(LLM)与人类偏好对齐。然而,可能性位移激励替代的方式来提取信息的偏好对小的可能性利润。在本文中,我们提出并分析了基于比较的偏好优化(CompPO),一个零阶的,

  53. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    PANORAMA:通过面具提案选择进行全景接地字幕

    作者:Sara Pieri、Evangelos Kazakos、Shizhe Chen|在世界上运作的智能系统需要全面且基于空间的图像理解。当前的视觉语言模型(VLM)可以生成流畅且详细的图像字幕,但将它们与图像像素可靠地关联起来仍然具有挑战性。将密集字幕与像素级接地相结合的现有方法通常会产生不完整的描述或不完整的描述

  54. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    梦想接触之声:利用视频和音频生成进行零射击力感知操纵和数据生成

    作者:季冠华、李天玉、Dayoon Suh|视频生成的最新进展允许机器人从生成的视频中学习操纵轨迹。然而,这些方法产生的纯粹运动学轨迹缺乏力信息,导致接触丰富的任务失败,而适当的接触力对于成功至关重要。在这项工作中,我们探索用音频增强生成的视频,以塑造有界、时变的愿望

  55. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    历史相关伐木条件下非政策评估的指数硬度

    作者:Pranaya Jajoo|已记录的数据集是否可以频繁访问每个隐藏状态,但仍然无法提供有关目标策略价值的信息?我们表明,当记录器依赖历史时,它是可以的。对于每个地平线$H \ge 3$,我们构建两个POMDP,每个阶段最多有两个潜在状态、三个动作和一个具有三种记忆状态的公共记录器。行动覆盖、信仰覆盖和两种行为边缘

  56. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    ScienceIDE:将世界科学代码库转变为代理可学习环境

    作者:耿贺佳,黄泽森,李浩洋|科学代码库将数十年的人类知识编码在可执行的模型、方法和工具中。然而,碎片化的工具链、隐含的领域惯例和专门的正确性标准使得这些知识难以转化为可靠的学习体验--我们称之为科学体验瓶颈的挑战。我们介绍ScienceIDE,将世界科学

  57. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    双进程语言代理的认知扩展:交互环境中的记忆和自我反思

    作者:João Meneses dos Santos、Arlindo L. Oliveira|语言代理在交互式环境中仍然很脆弱,在交互式环境中,成功需要长期状态跟踪、有效操作执行以及从失败步骤中恢复。我们扩展了SwiftSage,这是一个双进程代理,它将快速行动提议者与较慢的计划者结合在一起,使用两个模块化认知扩展:用于突出性门控情景存储的自适应记忆模块(AMM)和操作员驱动的ret

  58. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    Affora:一个面向代理友好界面的设计系统

    作者:高金|计算机使用的代理越来越多地操作为人类设计的软件,但界面通常让机器读者不清楚操作或任务状态。我们介绍了Affora,这是一个支持读者的设计系统,同时保留视觉自由和熟悉的人类工作流程。三项对照研究检查了组件实现、视觉变化和交互设计原则。他们的发现

  59. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    旗帜游戏:一个机械群体可解释性的玩具模型

    作者:伊丽莎白·帕夫洛娃、田中秀织|人工智能代理的紧急协调行为开始带来严重的安全风险。驱动这些行为的一个关键现象是对世界信念的快速形成和传播,而机械理解对于集体一致至关重要。为此,我们引入了旗帜游戏,这是一种用于研究集体信仰形成机制的玩具模型。具体来说,是隐藏的计数

  60. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    播放日志(N)-维基百科摘要问题:配对前沿模型之间的通信效率

    作者:Peter Potash|我们在两个智能体$\log(N)$-Questions游戏中评估了六个前沿语言模型。提问者看到$N$维基百科的开头段落,并且必须准确使用$\log_2 N$是/否问题来识别秘密选择的目标。回答者只看到目标和问题,并用一个词回答。这两个角色在同一个提供商上运行,因此游戏衡量模型与自身之间通信的良好程度

  61. The Decoder 国际媒体 快照

    Google Deepmind推出跨学科研究所来解决围绕AGI的重大问题

    Google Deepmind成立了Deepmind Institute(RST),这是一个专注于AGI的跨学科研究平台。该研究所由Demis Hassabis、Shane Legg和James Manyika领导,利用艺术、人文和政策方面的专家以及技术专家来解决有关安全、治理和控制风险的问题。Google Deepmind成立跨学科研究所来解决围绕AGI的重大问题的文章首先出现在The Decoder上。

  62. OpenAI News 海外官方

    我们报告模型失调的框架

    OpenAI共享了一个跟踪、调查和披露模型偏差的框架,以及六个意外或相关模型行为的报告。

  63. The Verge 国际媒体 快照

    谷歌现在将让任何人工智能代理运行您的智能家居

    谷歌正在向人工智能代理开放其智能家居,让Claude和Open Claw等工具访问和控制您的连接设备,并使用标准化的模型上下文协议分析您家的数据。Google Home HCP是一个新的集成,可让第三方人工智能代理控制和监控您的智能家居并对[.]采取行动

  64. The Verge 国际媒体 快照

    你的“健康年龄”是假的

    这是Optimizer,由Verge高级评论员Victoria Song发送的每周时事通讯,剖析和讨论了最新的小发明和药剂,发誓它们将改变你的生活。在此处选择优化器。在上周Apple Watch发布期间,我明确地说了一句“不!“在史蒂夫乔布斯剧院。随着[.]

  65. IEEE Spectrum AI 国际媒体 快照

    重新思考AI时代的机器人安全

    本文由VicOne为您带来。机器人安全传统上会问:当出现问题时,机器还能保持安全吗?物理人工智能提出了一个更难的问题:当攻击者改变它所看到的、决定的或所做的事情时,即使看起来没有什么失败,机器还能保持安全吗?随着人工智能和机器人技术继续以前所未有的速度发展,现代机器人通过多模式传感器进行感知,使用人工智能模型解释上下文,并将这些解释转化为身体动作。随着他们进入动态环境,他们的安全越来越依赖于他们的完整性

  66. The Decoder 国际媒体 快照

    Anthropic将Claude Chat、Cowork等合并为单一产品

    Anthropic正在将Claude Chat和Cowork合并为一个产品。Claude现在不再是用户在界面之间进行选择,而是自己决定任务是需要快速答案还是更大的工作流程。该更新还添加了Claude Buttons和Claude Slides,用于直接在聊天中创建文档和演示文稿。Pro和Max用户首先可以访问。Anthropic将Claude Chat、Cowork等整合为一个产品的文章首先出现在The Decoder上。

  67. Simon Willison 个人技术博客 快照

    穆斯塔法·苏莱曼

    我们不应该把模特当作他们有感情、偏好、权利或任何享受我们福利的权利。意识是我们道德、法律和政治体系的基础。邀请另一个实体分享这些权利的任何形式都是没有证据证明的,并且会使人工智能遏制和协调挑战变得更加困难。- 穆斯塔法·苏莱曼(Mustafa Suleyman),关于“模范福利”的警告标签:ai-ethics、generative-ai、ai、微软、llms

  68. OpenAI News 海外官方

    帮助老年人在日常生活中使用AI

    OpenAI和AARP正在为美国10个城市的1,000名老年人提供免费的ChatGPT研讨会,以安全地培养实用的AI技能。