AI 日报hiw3c.com

2026-10-08全球 AI 要闻精选,来自 30+ 信息源

聚合官方博客 · 权威媒体 · 深度通讯 · 学术信号。
只做索引,不做转载,标题与链接均指向原始发布方。

  1. BestBlogs·每日早报 BestBlogs 精选 中文

    EP199 · GPT-6 生成界面、ASML CEO 谈工业 AI、LlamaIndex 拆解检索

    📝 今日导语 GPT-6 生成界面,ASML CEO 谈工业数据,LlamaIndex 拆解检索:把产品体验与数据方法一起看。 🏷 今日关键词: GPT-6 智能 UI ASML 工业数据 LlamaIndex 检索 OpenClaw 协作 AI 成本优化 📰 今日精选内容 GPT-6 与面向所有人的智能 UI OpenAI News · 文章 · 评分 90 对话 ASML CEO Christophe Fouquet:EUV、供应链

  2. MarkTechPost 国际媒体 快照

    Perplexity AI发布pplx-embed-v2-late:0.6B Edge模型和9 B模型MADQA评分92.4%

    Perplexity的pplx-embed-v2-late有2种尺寸:为在边缘设备上运行而构建的0.6B型号,以及用于构建高质量索引的9 B型号。MADQA上的最高分为92.4%,ViDoRe v3 Markdown上的最低分为61.2%。两者均获得麻省理工学院许可,并准备好自行托管。Perplexity AI发布pplx-embed-v2-late:MADQA评分为92.4%的0.6B Edge模型和9 B模型首次出现在MarkTec

  3. 雷峰网·AI 科技评论 中文媒体 中文 快照

    从「工具」到「智能体」:CARES 4.0在港发布,刘宏斌谈医疗AI如何走进临床

    近日,由中国科学院香港创新研究院人工智能与机器人创新中心(CAIR)主办、香港科技园公司协办的第四届香港具身智能医疗科技论坛(The 4th Hong Kong Clinical-driven Robotics and Embodied AI TEchnology Symposium,CREATE Symposium),于香港科学园高锟会议中心隆重举办。 作为衔接临床医学与前沿科技的重要国际交流平台,本届论坛以 “医疗 AI 商业化之路

  4. 雷峰网·AI 科技评论 中文媒体 中文 快照

    IROS 2026大奖揭晓:长期记忆拿下最佳论文,人形机器人打网球、端托盘双双获奖

    在机器人领域,一个更大的模型并不能自动解决所有问题。 作者丨马晓宁 编辑丨岑 峰 当地时间 9 月 30 日,IROS 2026 主会在美国匹兹堡落下帷幕,本届大会的主要奖项也在最后一天正式揭晓。 AI科技评论在现场获悉,今年的 Best Paper Award 最终颁给了一项关于机器人“长期记忆”的研究。Yumin Lee、Hyoseok Ju 和 Giseop Kim 凭借《LT-Mem: Volatility-Aware Spat

  5. 雷峰网·AI 科技评论 中文媒体 中文 快照

    研究了1933篇 IROS 论文,我们看到了机器人学的六项新变化

    大模型并没有“吃掉”机器人学。 作者丨 马晓宁 编辑丨岑 峰 9月27日,IROS 2026 将在匹兹堡开幕。重隔31年后,IROS 重回这座钢铁之城。 作为全球规模最大的机器人学术会议之一,今年进入正式议程的论文达到 1933 篇。把这近两千篇论文铺开来看,它更像是一张 2026 年机器人研究的横截面:从强化学习、模仿学习,到路径规划、视觉感知、运动控制、灵巧操作,再到人形机器人、触觉和大模型,过去几年机器人领域几乎所有重要技术路线,

  6. 雷峰网·AI 科技评论 中文媒体 中文 快照

    银河通用&清华 LATENT:用「不完美人类数据」让机器人学会网球对打 | IROS 2026

    5小时动作碎片,最后变成了机器人的身体直觉。 作者丨 吴思梦 编辑丨 岑 峰 马晓宁 如果你玩过《Mario Tennis》或者《TopSpin》,大概不会觉得打网球是一件特别复杂的事。 球飞过来,移动人物,判断落点,在合适的时机按下击球键。 尤其在《Mario Tennis Aces》里,游戏甚至把网球进一步拆成了一套很直观的动作语言:正手、反手、上旋、切削、吊高球,甚至还有需要精确卡点才能完成的特殊击球。 Mario Ten nis

  7. 雷峰网·AI 科技评论 中文媒体 中文 快照

    吴佳俊 IROS 2026 演讲:结构化表征不是答案, 是机器人学会推理的脚手架 | IROS 2026

    从结构化表征到无演示学习之路。 作者丨 吴思梦 编辑丨岑 峰 一个盘子,一只水龙头,一小团蓝色的洗洁精。 吴佳俊用这样一个几乎没有技术含量的厨房场景,开始了他在 IROS 2026 的演讲。 一个学生挤了洗洁精,打开水龙头,洗了一半,临时离开。现在,换成机器人接手。第一眼看过去,任务直接明确:把盘子洗干净,再放回去。但机器人真正需要处理的,并不是“洗盘子”这三个字。 它得先知道,眼前哪个东西是盘子;得知道这个盘子到底脏不脏;得注意到盘子

  8. 雷峰网·AI 科技评论 中文媒体 中文 快照

    对话如祺出行COO韩锋:世界模型越强,真实数据才是真壁垒

    过去一年,“物理AI”几乎成了自动驾驶、车企共同争夺的下一张船票。 世界模型、具身大模型、机器人数据……众多公司从不同切入口布局物理AI,试图成为新风口之下的主角,相比之下,如祺出行选择了一条不那么显眼的路径,不自己训练大模型,而是尝试成为模型背后的数据基础设施。 实际上,如祺出行在2023年就开始思考,除了提供包括Robotaxi等出行服务,一家出行平台还能在AI产业里扮演什么角色。随后两年,如祺出行逐步完成数据闭环,一端连接驾驶员、

  9. 雷峰网·AI 科技评论 中文媒体 中文 快照

    「无驾驶舱」重卡上路,卡尔动力押注无人货运规模化

    从鄂尔多斯市区一路向西抵达边陲小镇棋盘井,车窗外,密集的商业住宅渐渐被平原和山体取代,路上的乘用车越来越少,拖着长车厢的重卡却越来越多。 煤矿、电厂、工业园区之间,重卡拖着大量货物沿着固定路线流动。这里,也是卡尔动力验证无人货运的主要场景之一。卡尔动力五年前来到内蒙古,尝试编队无人驾驶。如今,它已经拥有百台量级的无人运输车队,业务从内蒙古延伸至新疆、甘肃、陕西、山西等能源运输区域,并开始测试没有驾驶舱的运输机器人。 9月22日,卡尔动力

  10. MarkTechPost 国际媒体 快照

    当可信模型回购发生变化时会发生什么?Unsloth Studio在卸载前重新检查

    Unsloth 10月6日的安全概述解释了Studio如何在运行任何内容之前检查代码、重量、包和工具。自定义型号代码会被扫描,并将批准绑定到其指纹上。标记的权重文件在加载路径中被阻止,包内容发现失败CI,并且工具在探测的操作系统沙箱中运行。以下是每个检查站的决定以及不涵盖的内容。当可信模型回购发生变化时会发生什么?Unsloth工作室重新检查之前,它重新出现在MarkTechPost。

  11. Simon Willison 个人技术博客 快照

    引用本·阿弗莱克的话

    我从小就对电脑很着迷。当电影开始从模拟电影转变为数字电影时,我对这方面更感兴趣。多年来,视觉效果的工作流程包括机器学习。所以我可以写一些非常糟糕的Python脚本之类的东西,因为有了卷积神经网络,它是Transformer可以做的事情的先驱,它只是同时进行更多的计算,你可以做一些事情,比如看所谓的张量,它只是数字中视觉图像的数值转换。

  12. The Verge 国际媒体 快照

    宝马iX 4 SUV是抵御中国电动汽车收购的428英里防御武器

    当中国吞噬所有客户时,汽车界的大部分公司都惊呆了,但宝马继续推出做工精良、技术先进的电动汽车,在驾驶质量和价格上都给人留下深刻印象。最新款是BMW iX 4,这是一款轿跑车形状的SUV,为该汽车制造商的iX 3增添了更运动的气息。iX 4是[.]

  13. The Verge 国际媒体 快照

    Teenage Engineering首席执行官表示将停止生产合成器

    Teenage Engineering创始人兼首席执行官Jesper Kouthoofd告诉Highsnobiety,该公司计划停止生产合成器。是的,这包括标志性的OP-1,它让该公司声名鹊起。TE不仅仅是一家音乐设备制造商;它还是一家广受欢迎的设计公司。它与宜家,Nothing和Playdate等合作。但几乎一切[.]

  14. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    别再为智能多花钱:如何优化每项成功任务的 AI 成本 | DevDay 2026

    📌 One-Sentence Summary OpenAI 部署工程师建议以成功完成任务的成本为目标,通过代表性评测选择模型配置,再用缓存、程序化工具调用、推理控制和延迟处理减少工作量。 📝 Summary OpenAI 部署工程师 Mandeep 和 Sapto 解释,token 标价无法完整反映 AI 应用成本。便宜模型可能消耗更多 token、无法完成任务,或需要人工介入,因此应关注在达到准确率要求、延迟可接受时,成功完成一项任务

  15. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    ClawLabs:共同建设开源项目 | DevDay 2026

    📌 One-Sentence Summary ClawLabs 演示多人共享的持久智能体工作流,并介绍结合协作、维护循环与可执行部署边界的开源控制平面 OpenClaw Enterprise。 📝 Summary ClawLabs 介绍团队如何从终端编码会话迁移到 Codex Desktop、分布式测试机器,最终转向共享的持久智能体服务器。更多算力并未消除由人替同事和智能体传话的瓶颈;团队可见的会话让代码变更背后的意图得以共享,也让贡献

  16. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Qodo:最后一次人工代码评审 | DevDay 2026

    📌 One-Sentence Summary Qodo CEO Itamar Friedman 认为,AI 代码评审需要组织经验、有证据支撑的智能体群、事故学习,以及超越单个 PR 的任务级治理。 📝 Summary Qodo CEO Itamar Friedman 将公司描述为编码智能体周围的上下文与治理层:收集工程团队的隐性知识,既指导代码生成,也用于审核变更。他区分智能与基于经验的智慧:局部看似合理的代码,仍可能因忽略数据库行为或

  17. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    用 Codex 从单人模式走向团队协作 | DevDay 2026

    📌 One-Sentence Summary OpenAI 的 Jason 主张用持久智能体、共享上下文、页面指令和可复用插件扩展团队协作,减少个人逐项协调工作的负担。 📝 Summary OpenAI 开发者体验团队的 Jason 描述了从个人 AI 辅助,走向让同事和智能体共同推进工作的系统的变化。工具和并行任务增多后,他起初仍要协调每次上下文传递、跟进和自动化。他以一场假设的用量限制问题调查为例,把解决方法分为收集上下文、组织和推

  18. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    OpenAI 如何在内部用 ChatGPT 开展工作 | DevDay 2026

    📌 One-Sentence Summary OpenAI 展示三个内部 ChatGPT 工作流,通过插件、Spaces 和持续运行的 Dots 委托监测、重复研究与知识服务,同时保留人工审核。 📝 Summary OpenAI 开发者体验团队介绍了三位内部重度用户如何把 ChatGPT 从一次性助手变成持续协作的队友。Dani 委托 Dot 监测产品发布:收集社交帖子与互动数据,维护报告站点和内容表格,并提醒她关注紧急 Slack 对

  19. Simon Willison 个人技术博客 快照

    克劳德俳句5.5

    正如之前承诺的那样,这是Anthropic全新的快速、低成本模型:介绍Claude Haiku 5.5。之前的俳句4.5已经很明显地显示了它的年龄。它大约一年前问世,定价为1美元/百万投入和5美元/百万产出--即使在当时也相对昂贵,是上个月发布的OpenAI GPT-6 Luna价格的整整10倍。新俳句与GPT-6 Luna的价格完全匹配-0.10美元/0.50美元-最多100,000个代币。超过100,000个代币,价格上涨5倍至0.

  20. The Decoder 国际媒体 快照

    带有GPT-6的ChatGPT放弃了带有图表、按钮和迷你应用程序的交互式UI的主要文本输出

    OpenAI正在推出带有“智能UI”的GPT-6,该功能可以将答案转化为具有图表、按钮和表格的交互式界面。该模型现在可以在思考的同时做出反应,将等待时间缩短了44%。付费客户可获得GPT-6 Sol,免费用户可获得GPT-6 Luna。带有GPT-6的ChatGPT文章主要放弃了带有图表、按钮和迷你应用程序的交互式UI的文本输出,首先出现在The Decoder上。

  21. AWS ML Blog 海外官方 快照

    在AWS上介绍Claude Haiku 5.5

    Claude Haiku 5.5现已在Amazon Bedrock和AWS上的Claude Platform上提供。根据Anthropic的说法,它是Claude 5.5家族中最快,最高效的模型,专为子代理和大批量,成本敏感的工作而构建,并且在大多数任务中,成本比Claude Haiku 4.5低75%左右。这篇文章介绍了它的改进以及如何开始。

  22. The Decoder 国际媒体 快照

    Claude Haiku 5.5大幅降价,证明人工智能定价军备竞赛远未结束

    Anthropic的新克劳德·Haiku 5.5在基准测试中击败了它的前身,在OSWorld计算机使用测试中从15.7%跃升至72.4%。代币价格下降高达90%,尽管一个新的代币化器通过每个任务消耗更多的代币来消耗这些节省。Claude Haiku 5.5的大规模降价证明了AI定价军备竞赛还远未结束,这篇文章首先出现在The Decoder上。

  23. The Verge 国际媒体 快照

    看来.Agent和.agi即将成为热门新域名

    多年来,互联网名称和号码管理公司(更广为人知的是ICANN)首次接受新顶级域名的申请。这些是所有URL末尾的后缀,您可能会将它们称为.com、.org和. pizza等。ICANN刚刚公布了1,615份申请[.]

  24. NVIDIA AI Blog 海外官方 快照

    英伟达、微软借助RTX Spark和AI代理开启Windows PC的新起点

    周三,在旧金山举行的微软活动上,英伟达创始人兼首席执行官Jensen Huang和微软首席执行官Satya Nadella概述了英伟达和微软如何共同开发人工智能代理在Windows PC上运行的硬件和软件。黄说,英伟达是因为Windows而成立的。现在人工智能代理正在登陆Windows。“如果你[.]

  25. The Verge 国际媒体 快照

    微软Surface Laptop Ultra活动上宣布的一切

    微软刚刚在旧金山结束了一场以Windows和Surface为重点的大型主题演讲。最大的公告可以说是Surface Laptop Ultra的发布细节,这是一款由Nvidia RTX Spark Arm芯片提供支持的新型笔记本电脑。该机器的起价为2,599美元,配置8核中央处理器、24 GB RAM和512 GB [.]

  26. MarkTechPost 国际媒体 快照

    Liquid AI发布开放重量d1-3B和d1-omni-600 M:零输出代币的多模式决策模型

    Liquid AI发布了Open d1,这是其d1决策模型家族中的两个开权多模式模型。d1-3B读取文本和图像。d1-omni-600 M读取带有图像的文本或带有音频的文本。两个模型都不写文本。每个都在一次向前传递中返回经过校准、输入的答案,输出令牌为零。目标是[.]上的实时决策帖子Liquid AI发布Open-Weight d1-3B和d1-omni-600 M:零输出令牌的多模式决策模型首次出现在MarkTechPost上。

  27. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    GPT-6 与智能界面正式登陆 ChatGPT

    📌 One-Sentence Summary OpenAI 宣布在 ChatGPT 中全面推出 GPT-6 及「智能界面」(Intelligent UI),重点优化视觉化回答与交互工具体验。 📝 Summary OpenAI 已开始向所有 ChatGPT 用户推送 GPT-6,并同步上线名为「智能界面」的新功能。此次更新旨在为日常问题提供更快速、更具视觉感的响应,并通过按需出现的交互式元素简化复杂话题的理解过程。 📊 Article M

  28. The Verge 国际媒体 快照

    微软将赋予Copilot对Windows和您的文件更多控制权

    在今天的Windows和Surface活动上,微软展示了对其Copilot AI系统的升级,该系统将使其访问PC上的本地文件,并能够在整个操作系统中采取行动。这是微软称之为“混合智能”想法的一部分,其中应用程序和工具依赖于[..]的混合

  29. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    永不回头:从以自我为中心的视频中了解3D对象记忆的持久性

    作者:Shravan Chaudhari,William Paul,Suchi Saria|当我们在世界中行走并执行日常任务时,我们遇到的对象可能只有在以后才变得相关。我们能够回忆起我们把东西放在哪里或容器内的东西,即使不知道我们以后会需要它。在这里,我们研究了实体助理如何通过观察一个人的日常活动,从以自我为中心的视频中建立类似的记忆。我们介绍莱德

  30. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    RL VR中探索与优化脱钩

    作者:Saif Punjwani、Micah Goldblum|现代语言模型在已经训练的检查点之上进行具有可验证奖励(WLVR)的强化学习。WLVR的一个关键承诺是发现新的推理策略。原则上,模型可以对其之前训练数据中缺失的新颖想法进行采样。然而,在实践中,通过强大的新颖性激励来增强WLVR的成功有限,并且可能会降低模型质量。B

  31. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    EngramEdit:通过条件记忆在LLM中脱钩知识更新

    作者:蔡红如、然伟、王文杰|DeepSeek Engram等条件存储器架构使用输入n-gram来查找学习到的嵌入,以有限的额外计算扩展大型语言模型(LLM)的容量。除了模型扩展之外,该架构还展示了将事实知识存储与通用计算脱钩的潜力,为更新事实知识提供了一种有希望的途径

  32. The Decoder 国际媒体 快照

    扎克伯格的Biohub领导了一项18亿美元的推动,以建立预测细胞行为的AI模型

    由马克·扎克伯格和普里西拉·陈支持的研究组织Biohub正在协调一项价值18亿美元的计划,以训练预测细胞行为的人工智能模型。Meta、Google DeepMind、Isomorphic Labs和美国能源部正在为数据、实验室设备和计算提供资金。第一个数据集应该在大约一年内准备就绪。扎克伯格的Biohub领导了一项18亿美元的努力,以建立预测细胞行为的人工智能模型的文章首先发表在The Decoder上。

  33. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    Long-WAM:扩展世界行动模型的背景

    作者:黄伟、张博汉、刘晨志|实时机器人控制需要足够的视觉历史来推断运动和任务进度,但处理该历史可能会延迟行动。我们提出了Long-WAM,这是一个模型系统框架,用于在实时控制约束下扩展因果世界行为模型的上下文。我们的中心发现是,获取历史与使用历史不同:当视频被发现时,更长的历史会带来更大的回报

  34. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    重尾噪音下的分散式新元:最佳收敛率和梯度剪辑的作用

    作者:Aleksandar Armacki,Haoyuan Cai,Ali H. Sayed|重尾噪声在现代机器学习中被广泛观察到,这激发了梯度裁剪和归一化等方法的使用。虽然这些方法在集中式环境中得到了很好的理解,但在分散式环境中人们所知的要少得多,在分散式环境中对局部梯度应用非线性会影响优化和共识。最近关于去中心非凸优化的工作已经

  35. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    行动前重述:视觉-语言-行动模型中的语言敏感性特征和缓解

    作者:Mikey Watts、Yenson Cui|视觉语言动作模型(VGA)对指令措辞极其敏感,并且不会继承其所基于的视觉语言模型的语言稳健性。一个词的编辑可以将成功提升数十个百分点:$pi_{0.5}$在“打开炉子”时100%的时间打开LIBERO炉子,在“打开热盘”时2%的时间打开,和一个经过重新短语修饰的$pi_0$检查点a

  36. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    提炼图形几何:从GNN到MLP的知识差距

    作者:陈哲伟、朱浩、江娇|GNN到MLP的蒸馏旨在保留消息传递教师的预测准确性,同时在推理时部署无图形的MLP。现有的方法主要传输节点预测或使用基于置信度的重新加权,但它们没有指定学生应该在哪里保存教师的图形诱导几何。我们表明,这种遗漏会导致stu中的两种光谱失效模式

  37. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    为什么只遗忘的遗忘需要小型化

    作者:Luka Radić、Vikrant Singhal、Amartya Sanyal|机器取消学习要求删除算法,其输出接近于从头开始重新训练,而无需选择的忘记示例。在这项工作中,我们研究了仅遗忘取消学习,其中删除算法仅接收训练后的模型和要忘记的示例,没有保留数据或额外的训练信息。我们问只遗忘的遗忘是否总是可能的。我们首先展示

  38. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    RoboJEPA:扩展机器人潜在世界模型

    作者:Artem Zolus、Nicolas Belran-Velez、袁建浩|潜在世界模型已经显示出预测未来状态和在现实世界中进行规划的非凡能力。然而,在实践中,我们缺乏一种原则性的方法来估计他们的能力如何随着模型大小、数据和计算而扩展,这是一个悬而未决的问题,会减缓该领域的进展。在这项工作中,我们介绍了RoboJEPA,这是一个基于联合嵌入预测架构(JEPA)和traine的世界模型

  39. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    ENSO SciExam:人工智能代理可以构建气候模型吗?

    作者:张银玲、刘朗晨、秀东宾|数字模型代理人越来越多地被要求进行开放式科学研究,但他们的结果通常根据已知答案、标题或语言模型评论员进行评分,而这些都无法判断新的科学模型是否有效。厄尔尼诺-南方涛动人工智能科学考试(ENSO的SciExam)是一个基准,其中智能体构建ENSO的低级随机模型,

  40. The Decoder 国际媒体 快照

    谷歌表示,随着检测器公开,现在有1800亿张图像和视频携带SynthID水印

    谷歌的人工智能水印检测器SynthID现已公开。任何人都可以检查图像、视频或音频是否是由谷歌人工智能或OpenAI和Nvidia等合作伙伴创建的。超过1800亿条内容已经带有水印,但该工具仅识别带有SynthID标签的内容,而不是一般人工智能生成的媒体。谷歌称,随着检测器上市,1800亿张图像和视频现在携带SynthID水印,该文章首先出现在The Decoder上。

  41. Microsoft Research 海外官方 快照

    Agent Lightning v1.0:一个3,500行轻量级抽象RL框架,用于培训使用真实装备的Agent

    用强化学习训练人工智能代理可能具有挑战性,因为它们的工具、上下文和决策都是由复杂的框架管理的。Agent Lightning将现有代理与RL培训连接起来,使其更容易改进,而无需重建它们。Agent Lightning v1.0:用于训练带真实装备的代理的3,500行轻量级抽象RL框架首次出现在Microsoft Research上。