AI 日报hiw3c.com

2026-10-01全球 AI 要闻精选,来自 30+ 信息源

聚合官方博客 · 权威媒体 · 深度通讯 · 学术信号。
只做索引,不做转载,标题与链接均指向原始发布方。

  1. BestBlogs·每日早报 BestBlogs 精选 中文

    EP192 · Gemini Argon 推进长程任务、Anthropic 衡量机器人工作、Eleven v4 升级语音

    📝 今日导语 Gemini Argon 推进长程任务,Anthropic 衡量机器人工作,Eleven v4 升级语音:看懂落地取舍。 🏷 今日关键词: Gemini 4 Argon 机器人就业 Eleven v4 发布 Harness AI 研发效能 📰 今日精选内容 Gemini 4 Argon:前沿智能的新阶段 Google DeepMind · 文章 · 评分 93 我们能预测机器人将从事的工作吗? Anthropic Rese

  2. The Verge 国际媒体 快照

    The new and huger Paramount has a new co-CEO

    Paramount is appointing a new co-CEO ahead of the close of its $110 billion merger with Warner Bros. Discovery. Ynon Kreiz, previously Mattel's chairman and CEO, will be joining Paramount to lead alongside chairman and C

  3. Simon Willison 个人技术博客 快照

    He Built This City

    I visited the Museum of the City of New York today and got to see He Built This City: Joe Macken’s Model , the 50 x27 feet model of the city built over a 21 year period from balsa wood and cardboard. It exceeded my alrea

  4. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    Gemini 4 Argon:我们 frontiers 智能时代的下一章

    📌 One-Sentence Summary Google 宣布 Gemini 4 Argon,一款输出上限达 100 万 token 的 frontier 模型,在 DeepSWE、Vals Index 和 CWE-bench 上的表现居首,将首先通过 Fairwind Program 提供给值得信赖的网络安全防御者。 📝 Summary Google DeepMind 推出 Gemini 4 Argon,这是其下一代 frontie

  5. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Gemini 4 Argon 前沿模型正式发布

    📌 One-Sentence Summary Google 推出全新前沿模型 Gemini 4 Argon,首先面向网络安全防御人员开放,其推广期价格为每百万输入 token $2,每百万输出 token $10。 📝 Summary Google 推出了其最新的前沿模型 Gemini 4 Argon。该模型从今天起首先向网络安全防御者(cyber defenders)推送,并计划尽快扩大发布范围。公告中明确了推广期间的定价:输入 $2

  6. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    我们能预测机器人将从事的工作吗?

    📌 One-Sentence Summary 安踏克的机器人暴露指数发现机器人已能执行 74%的体力任务(占美国 34%的工作时间),但成本竞争力仅达到 0.3%的任务,且要达到 10%的采用率需要 40 年的时间,这表明自动化将缓慢进行,且集中在驾驶和仓库工作领域。 📝 Summary 安踏克的研究人员利用克劳弗构建了机器人暴露指数,对 7594 个体力职业任务进行了评分,采用四级细则(E0 至 E3)基于完成任务所需的环境。他们发现

  7. 雷峰网·AI 科技评论 中文媒体 中文 快照

    昉擎科技创始人被强制执行 寒武纪股权激励争议尘埃落定

    寒武纪于2026年9月30日发布《关于离职高管诉讼进展的公告》。从公告内容来看,寒武纪与原高管梁军股权激励纠纷争议基本尘埃落定,梁军连续6次提起诉讼均以败诉收场,且因拒绝配合办理回购手续该案件处于司法强制执行阶段。 公告披露内容指出,尽管梁军本次变更诉讼请求提高索赔金额,但对公司日常研发及经营不存在影响。 寒武纪表示,已聘请律师团队对梁军诉讼请求进行全面分析、论证,生效判决已经认定:梁军在激励股份限售期内离职的行为,触发了约定的股份回购

  8. 雷峰网·AI 科技评论 中文媒体 中文 快照

    AI办公进入「上下文战争」,百度如何出牌?

    上下文,正成为AI办公新的竞争变量。 “任何事情都可以成为用户的上下文。”在百度AI Day开放日接受雷峰网采访时,百度集团副总裁、个人超级智能事业群组(PSIG)总裁王颖表示, 过往的历史积累、沉淀的文件资产,以及与同事之间的对话,都是上下文的重要组成部分。 当AI办公迈入上下文竞争阶段,各家手里的优势也各不相同: 有的来自企业协作场景,消息、文档、会议天然沉淀其中;有的来自业务软件,更贴近垂直流程和行业数据;而百度的一张王牌,来自文

  9. 雷峰网·AI 科技评论 中文媒体 中文 快照

    DeepSeek 开源算子工具大礼包,联手华为昇腾,手撕 CUDA 绑定!

    一套代码能跑遍所有芯片。 作者丨 高允毅 编辑丨岑 峰 刚刚,DeepSeek做了一个开源壮举: 把给英伟达 GPU 写代码的全套工具链,原样铺到了华为昇腾 950 NPU 上。 最核心的算子开发产品 TileLang 官宣原生支持昇腾。不仅如此,连同 DeepGEMM、DeepEP、FlashMLA、TileKernels、DeepSelect 五大核心计算与通信库也同步推出昇腾版本,直接对标英伟达平台的全套工具链。 这意味着国产算力

  10. 雷峰网·AI 科技评论 中文媒体 中文 快照

    Muse爆火,dots入场:Personal Agent开始和互联网平台抢入口

    Personal Agent,正在成为这一轮 AI 产品竞争里最热的新概念之一。 9 月 29 日,OpenAI 发布了可以长期在线的个人 Agent 产品 dots,提出“always-on agents”。更早把这个词推到台前的是 Meta 发布的个人 Agent 产品 Muse,截至 9 月下旬下载量突破 300 万,一度将 ChatGPT 从美国 App Store 免费榜第一的位置上挤下。(雷峰网) Muse 运行在一台独立的

  11. 雷峰网·AI 科技评论 中文媒体 中文 快照

    2000座高速闪充站落成,比亚迪如何扛住国庆车流?

    作者丨马诗晴 编辑丨马广宇 在第2000座高速闪充站建成后,比亚迪将迎来第一场大考。 几天前 ,比亚迪宣布第2000座高速闪充站在扬州宝应服务区落成。这意味着在国庆假期,比亚迪高速闪充网络 将要面临 首次 车流 集中压力测试。 在现场演示中,比亚迪汽车从10%电量充至97%,用时约9分钟。用比亚迪闪充业务总经理王俊保的的话来说:“充电站‘有’和‘好用’是两个概念”,而从其表述来看,比亚迪是后者。 当前,节假日补能需求仍在增长。从国家能源

  12. 雷峰网·AI 科技评论 中文媒体 中文 快照

    实测 Qwen-3.8 与 GLM-5.3 的 Flash 版:谁能让我提前下班半小时?

    2026 年 8 月 26 日,同一天,Qwen 发布 Qwen3.8-Flash-Next/Qwen3.8-Flash,Z.AI 发布 GLM-5.3-Flash。从名字看,“Flash 模型”代表低价、快速、负责高频调用,更多是旗舰模型的补位产品,但这次两家官方给出的宣传重点,其实已经不再停留在 便宜聊天 上。(雷峰网) 千问云对 Qwen3.8-Flash 的定位直指 1M 长上下文、长文档、完整代码库、复杂对话、编程辅助、工作流

  13. 雷峰网·AI 科技评论 中文媒体 中文 快照

    从 Codex Harness 开源,看 AI 公司的护城河是什么?

    8 月 19 日,OpenAI 正式开源了 Codex Harness。这家公司名字里的 Open,久违地兑现了一次。(雷峰网) 长期深耕 Agent Harness 的 开发者群体 对该消息的普遍反馈是“振奋”。因为过去只有少数顶尖 Agent 产品掌握的 Harness,现在终于开始向更多开发者和企业开放了。 随着 Codex 等最佳实践的开源, Harness 正在经历从“私产”到“公器”的转化,其 本身的稀缺性,正在快速下降。

  14. 雷峰网·AI 科技评论 中文媒体 中文 快照

    全网最硬核 OpenClaw 2.0 实测:从 ToC 到 ToB 的试探,Agent 网关能重塑工作流边界吗?

    8 月 31 日,OpenClaw 2.0 正式发布(版本号: v2026.8.1 ),933 位贡献者、569 位首次贡献者、16,962 个 PR 提交。这组数字让它成为近期最受关注的开源 Agent 更新之一。(雷峰网) 在过去 230 天里,OpenClaw 曾发布 106 个版本,但在 2.0 到来前已经有近 7 周没有更新了。因此,这一次 OpenClaw 不是给 Agent 多补几个工具,而是把安装、浏览器、云会话、记忆管

  15. 雷峰网·AI 科技评论 中文媒体 中文 快照

    5500颗光引擎如何撑起4096卡超节点?华为NPO的故事还没讲完

    华为自研光引擎Hi-ONE的首个落点终于浮出水面——千卡级超节点。 不久前的CIOE上,海思已经展示这颗带宽能力高达7.2T的光引擎,并透露Hi-ONE将以NPO(Near-Packaged Optics,近封装光学)形式进入下一代超节点。华为称,这也是全球首个采用NPO的AI智算超节点。 为什么是NPO?答案藏在电信号的传输路径上。随着芯片侧高速接口速率不断提升,从电芯片到光引擎的这段电连接越长,信号越容易出现衰减和失真,对信号完整性

  16. 雷峰网·AI 科技评论 中文媒体 中文 快照

    对比 Codex,免费的 AgnesCode 也能在底层算子优化任务中打得有来有回

    AgnesCode在部分芯片上跑出更高性能,免费模型完成专业级交付。 作者丨 吴海明 曹PP 编辑丨李 娜 免费的 AI Coding Agent,能不能和付费 Codex 在真实工程任务里打得有来有回? 过去一年,我们已经习惯了让 Coding Agent 写网页、做应用、修 Bug。但这一次,我们想把它往更底层推一步: 让 AI 去优化大模型自己运行时使用的算子 。 所谓“算子”,可以简单理解为 大模型运行时 反复执行的 一小段底层

  17. 雷峰网·AI 科技评论 中文媒体 中文 快照

    从海拉鲁到现实世界:视频模型如何理解「变化」

    HiDream-O1-Video 的三场世界回应测试。 作者丨Reah 编辑丨李 娜 在《塞尔达传说:旷野之息》中,玩家点燃一片草地,火焰会沿着草叶蔓延,热空气随之升起。此时展开滑翔帆,林克便能借助上升气流离开地面。雷雨中装备金属武器可能招来闪电,降雨又会让攀爬变得困难。海拉鲁并没有追求照片级的视觉拟真,却通过一组稳定、可组合的规则,让玩家感受到一个世界正在持续运行。 这种体验的关键是无论世界里有多少种物体,系统都会回应玩家的行动,并且

  18. 雷峰网·AI 科技评论 中文媒体 中文 快照

    在三张圆明园鼠首照片里,我们看到了3D AI的Harness时刻

    3D 生成的价值正从模型本身转向模型、智能体与专业软件共同完成任务的 3D AI Harness。 作者丨 吴海明 编辑丨李娜 岑峰 成龙电影《十二生肖》里,有一段 3D 生成技术的片段,龙叔靠近圆明园十二生肖鼠首,用特制扫描手套获取文物的三维信息,再把数据加密传输到另一端,借助 3D 打印做出高仿鼠首。这套设定放在十多年前,代表的是一种典型的技术想象:要复原一个复杂实体,必须先有专用硬件、精密扫描和昂贵设备。 如果把同一个问题放到 2

  19. 雷峰网·AI 科技评论 中文媒体 中文 快照

    全球开源前二,阶跃终于回来了

    Step 5 Preview 回到全球第一梯队 作者丨吴海明 编辑丨李娜 岑峰 两年前,阶跃星辰第一次在基模圈公开亮相时,凭借 Step 1 炸了场,同年接连发布 Step 1V 和万亿参数基座模型 Step 2,彼时行业仍相信,模型越大、能力越强。谁推进 Scaling Law,谁就更接近牌桌中心。 但过去一年,它的曝光似乎更多集中在另一端:多模态模型、手机、汽车、端侧模型和 Agent。相比之下,那个需要和 Qwen、Kimi、GL

  20. 雷峰网·AI 科技评论 中文媒体 中文 快照

    越大越强,不再是 LLM 的专利:PixVerse R2 攻克实时世界模型 Scaling 难题

    AI 视频的下一战:谁能让世界保持运行 作者丨Reah 编辑丨李娜 岑峰 大语言模型已经用 Scaling 证明模型、数据和算力可以持续换来更强能力,必须一边生成、一边回应用户的实时世界模型,能不能也走上这样一条路? 2026 年 1 月,爱诗科技提出“通用实时世界模型”这 一产品方向,并推出 R1。 目前,PixVerse R2 已全量上线 用户可以直接进入网页端体验动作指令和互动影游的相关交互 01 实时世界模型, 能走上 LLM

  21. 雷峰网·AI 科技评论 中文媒体 中文 快照

    世界制造业大会丨国轩高科重磅发布低空飞行高功率电池等三大创新成果

    9月21日,2026世界制造业大会国轩高科专场发布会在合肥举行。立足AI快速发展背景,国轩高科聚焦低空经济、跨境绿色物流、零碳数字能源三大前沿赛道,重磅发布低空飞行高功率星晨电池、中欧非新能源物流运输一体化解决方案、国轩零碳数字云平台三大创新应用成果;同期,国轩高科展区以覆盖海陆空的全场景解决方案亮相新一代信息技术和新能源展区,充分展现公司AI能源底座的技术实力和产业化水平。 高比能、高功率、高安全、快速补能 国轩高科发布“三高一快”

  22. 雷峰网·AI 科技评论 中文媒体 中文 快照

    GPT-6 Astra 上手体验:花了一周,它真在电脑里建了座曼哈顿!

    网友实测GPT-6 Astra:神操作很多,长任务翻车也很快。 作者丨李娜 编辑丨岑峰 北京时间9月4日凌晨,OpenAI正式发布了新一代旗舰模型 GPT-6 Astra。 你敢相信吗?GPT-6只用了一周时间,就在虚幻引擎里一条街一条街搭出了一座曼哈顿。 更夸张的是,在另一次测试里,Matt Shumer让Astra创建一个虚拟世界,并让其中的人都成为独立Agent。任务启动后他去睡觉,第二天甚至在客厅里听到了这些虚拟人的对话声。 一

  23. 雷峰网·AI 科技评论 中文媒体 中文 快照

    Kimi 和 DeepSeek,为什么出现在同一张模型架构图里?

    大模型 Attention 路线变迁:从分流到重组。 作者丨李娜 编辑丨岑峰 一张大模型架构图里,同时出现了 Kimi 和 DeepSeek 的影子。 GLM-5.3-Flash项目配置文件:45层架构中,34层采用Kimi路线的KDA线性注意力,另外11层采用DeepSeek路线的KPool-DSA稀疏注意力 今年以来,大模型架构里出现了一条越来越清晰的变化:一些混合注意力架构中原本由全局Attention承担的角色,开始被Spars

  24. 雷峰网·AI 科技评论 中文媒体 中文 快照

    我们让 GPT‑6 Astra、Fable 5.1 和 Sol 控制同一台机器人:谁真的把活干完了?

    真实云台实测:三个模型都让机器转起来,但“完成”的标准天差地别。 作者丨 Rhea 编辑丨李娜 岑峰 云台机械臂是一个能上下左右转动的摄像头底座/支架,我用GPT‑6 Astra、Claude Fable 5.1 和 GPT‑5.6 Sol这三个顶级模型都让机器人转了起来,三个模型均完成了任务,但执行路径、验证标准和成本差异明显。 这次 GPT-6 Astra 出来之后,网上已经有很多优秀的测评案例了。如果读者已经能在其他地方看到这些,

  25. 雷峰网·AI 科技评论 中文媒体 中文 快照

    拆解 WorkBuddy、千问办公和豆包工作,它们其实不是同一种产品

    活是 AI 干的,锅是人背的。 作者丨Reah 编辑丨李娜 岑峰 我们以职场牛马的身份,把同一份脏活同时交给了三家办公 Agent:WorkBuddy、千问办公和豆包工作。本来想试试能不能为自己省出半天时间,结果半天没省出来,先被三个总额问住了。 这份脏活是一张销售流水表,混着不同日期格式、退款、跨季度订单、部门缺失和异常金额,平时谁看了都头疼。 同一份 脏销售流水 和同一句提示词,交给 WorkBuddy、千问办公、豆包工作。 三家都

  26. 雷峰网·AI 科技评论 中文媒体 中文 快照

    实测 Seedance 2.5 vs 可灵 3.0,谁能让我们无痛当上视频导演?

    差距不只在画质,而在工作流。 作者丨 吴海明 编辑丨李娜 岑峰 《牛来》大概是今年国产电影里最意外的一次出圈,并不是因为一部低成本动画突然被推到台前,而是因为它把一个老问题重新摆到了创作者面前:当影像生产的门槛越来越低,真正决定一条视频能不能成立的,究竟是画质、预算,还是把想法稳定变成成片的能力?(雷峰网) AI 视频模型也走到了类似的节点。 过去,大家更关心模型能不能生成一段“像真的视频”;现在,问题正在变得更具体:模型能不能听懂一个

  27. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    AI 时代漏洞发现与利用趋势

    📌 One-Sentence Summary Google 威胁情报集团的数据显示,AI 正在使漏洞披露和利用率翻倍,并将发现方向转向高风险的远程代码执行(RCE)漏洞,迫使防御方从大规模修补转向基于威胁情报的分类处理和智能体化修复。 📝 Summary Google 威胁情报集团(GTIG)分析了自 2025 年 1 月至 2026 年 8 月的漏洞披露和利用数据,以评估 AI 对威胁景面的影响。月度 CVE 披露量自 2026 年