AI 日报hiw3c.com

2026-10-01全球 AI 要闻精选,来自 30+ 信息源

聚合官方博客 · 权威媒体 · 深度通讯 · 学术信号。
只做索引,不做转载,标题与链接均指向原始发布方。

  1. BestBlogs·每日早报 BestBlogs 精选 中文

    EP192 · Gemini Argon 推进长程任务、Anthropic 衡量机器人工作、Eleven v4 升级语音

    📝 今日导语 Gemini Argon 推进长程任务,Anthropic 衡量机器人工作,Eleven v4 升级语音:看懂落地取舍。 🏷 今日关键词: Gemini 4 Argon 机器人就业 Eleven v4 发布 Harness AI 研发效能 📰 今日精选内容 Gemini 4 Argon:前沿智能的新阶段 Google DeepMind · 文章 · 评分 93 我们能预测机器人将从事的工作吗? Anthropic Rese

  2. The Verge 国际媒体 快照

    Vivo的X Fold 6意外感觉像是复古

    发布日历的一个奇怪之处是,当Vivo的X Fold 6今年6月在中国推出时,它只是另一款可折叠的产品。现在它已经准备好在全球发布了,但尺寸和长宽比感觉有点过时。X Fold 6与Vivo之前的可折叠产品以及大多数其他[.]

  3. The Verge 国际媒体 快照

    埃隆·马斯克(Elon Musk)的Grokipedia采用“全新”的设计

    Grokipedia是SpaceXAI与维基百科的人工智能竞争对手,最近开始再次整合编辑内容,今天,作为v0.3更新的一部分,它进行了一些设计调整,包括新的徽标以及更新其主页和实时编辑页面。SpaceXAI设计主管Benji Taylor称其为“新刷新的Grokipedia”。“Grokipedia的旧主页几乎是[.]

  4. The Verge 国际媒体 快照

    全新而庞大的派拉蒙迎来了新的联合首席执行官

    派拉蒙将在与华纳兄弟探索频道1100亿美元的合并结束之前任命一位新的联席首席执行官。美泰前董事长兼首席执行官伊农·克雷兹(Ynon Kreiz)将加入派拉蒙,与董事长兼首席执行官大卫·埃里森(David Ellison)一起领导。派拉蒙表示,“埃里森将专注于公司的长期战略、创意愿景和方向,包括其[.]

  5. The Decoder 国际媒体 快照

    Google Gemini 4 Argon缩小了与OpenAI和Anthropic的差距,但没有明显领先

    Gemini 4 Argon是谷歌七个多月来推出的首款前沿型号。它在独立测试中与GPT-6 Astra相匹配,但无法跟上Anthropic的Claude Opus 5.5。每个代币的价格很低,但Argon每个任务消耗的代币数量是Astra的两倍多。选择测试人员首先获得访问权限,随后才获得API和付费层。文章Google Gemini 4 Argon缩小了与OpenAI和Anthropic的差距,但没有明显领先,首先出现在The Deco

  6. Simon Willison 个人技术博客 快照

    他建造了这座城市

    我今天参观了纽约市博物馆,并看到了《他建造了这座城市:乔·麦肯的模型》,这是这座城市在21年内用轻木和纸板建造的50 x27英尺的模型。这超出了我已经很高的期望。该展览将于10月12日闭幕,因此如果有机会,您绝对应该优先观看。标签:博物馆,纽约

  7. MarkTechPost 国际媒体 快照

    OpenAI以Astra代币价格的五分之一发布GPT-6.1 Sol:近Astra编码和计算机使用

    OpenAI于2026年9月29日发布了GPT-6.1 Sol,是GPT-6 Sol的升级。它在代理编码、计算机使用和专业工作方面达到了接近Astra的结果,价格仅为Astra代币价格的五分之一。每百万个代币的投入成本为2美元,输出成本为10美元,缓存的投入成本降至0.10美元。它现在可以通过OpenAI API、ChatGPT Work和Codex提供。OpenAI发布GPT-6.1 Sol:Near-Astra编码和计算机使用的价格

  8. The Verge 国际媒体 快照

    谷歌宣布双子座4,并表示它是如此强大,只有值得信赖的网络防御者可以拥有它现在

    谷歌今天公布了其下一个人工智能前沿模型,称之为Gemini 4 Argon。据首席人工智能架构师兼谷歌DeepMind高级副总裁Koray Kavukcuoglu称,新模型在现实世界的软件工程、法律和金融等企业知识工作以及网络安全防御等复杂工作流中提供了“前沿性能”。但该公司限制访问[…]

  9. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Gemini 4 Argon (High) 登顶 Text Arena,成本效率实现突破性领先

    📌 One-Sentence Summary Google DeepMind 的 Gemini 4 Argon (High) 以 1525 分登顶 Text Arena,混合成本仅 $8/MToken,在编程、指令遵循、创意写作及所有职业领域均居首位。 📝 Summary Arena.ai 宣布,Gemini 4 Argon (High) 以 1525 分登顶 Text Arena,并以 1679 分位列 Code Arena: Web

  10. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    Gemini 4 Argon:我们 frontiers 智能时代的下一章

    📌 One-Sentence Summary Google 宣布 Gemini 4 Argon,一款输出上限达 100 万 token 的 frontier 模型,在 DeepSWE、Vals Index 和 CWE-bench 上的表现居首,将首先通过 Fairwind Program 提供给值得信赖的网络安全防御者。 📝 Summary Google DeepMind 推出 Gemini 4 Argon,这是其下一代 frontie

  11. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Gemini 4 Argon 前沿模型正式发布

    📌 One-Sentence Summary Google 推出全新前沿模型 Gemini 4 Argon,首先面向网络安全防御人员开放,其推广期价格为每百万输入 token $2,每百万输出 token $10。 📝 Summary Google 推出了其最新的前沿模型 Gemini 4 Argon。该模型从今天起首先向网络安全防御者(cyber defenders)推送,并计划尽快扩大发布范围。公告中明确了推广期间的定价:输入 $2

  12. The Decoder 国际媒体 快照

    OpenAI和Synopsys合作构建人工智能模型,像经验丰富的工程师一样设计芯片

    OpenAI和Synopsys正在构建GPT-Synopsys,这是一种用于芯片设计的专用AI模型。它的目的是像经验丰富的工程师一样操作Synopsys的EDA工具,并自行优化设计。半导体客户的早期测试已经在进行中。OpenAI也可能利用这一合作关系来推进自己的芯片开发。OpenAI和Synopsys合作构建一个人工智能模型,像经验丰富的工程师一样设计芯片的文章首先出现在The Decoder上。

  13. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    半事实信用增强政策优化

    作者:潘俊树、付志章、黄树林|具有可验证奖励的强化学习(RLVR)提高了大型语言模型(LLM)的推理能力,但它们的预测仍然对任务无关的提示特征敏感。我们调查这种敏感性,通过半事实的即时干预,保留潜在的问题及其答案。我们的分析揭示了代币水平敏感性和

  14. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    多模式临床诊断的排名感知提示优化

    作者:田霞、刘明昊、梁亦青|多模态大型语言模型(MLLM)正在快速推进临床诊断,但其适应管道仍然以基于准确性的目标为基础。临床数据是严重的类别不平衡:一个恒定多数的预测可以得分超过90%的准确性,而临床上是无用的。因此,我们评估和优化AUROC,这是一种将积极与消极进行排名的无阈值评分

  15. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    删除计时快捷方式改善无创大脑到文本

    作者:Dulhan Jayalath,Oiwi Parker Jones|我们发现,在没有任何大脑数据的情况下,从非侵入性大脑记录中解码单词的主要改进在很大程度上是可重复的。在d ' Ascoli等人(2025)颇具影响力的工作中,感知连续语音的受试者的大脑活动时间序列被分割成从每个单词开始的固定长度窗口。然后,神经网络生成对

  16. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    ViTeX-Bench:高保真视频场景文本编辑基准测试

    作者:陈兴浩、高翔波、余Jiongze|最近的视频生成越来越真实和可控,但视频编辑仍然不够发达,特别是对于必须保留原始场景动态的精确本地编辑。视频场景文本编辑替换场景表面上的文本,例如店面标志、白板和产品标签,同时保留周围的内容、运动和相机动态。虽然现场特

  17. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    图像分类器是高效的自我监督视频表示学习者

    作者:Owais Iqbal、Sudipta Sarkar、Shyam Marjit|我们引入VideoMSN,这是一个Masked Siamese Network框架,用于在视频中进行高效的自我监督时空表示学习。我们不再依赖重型3D架构或基于重建的自动编码器来使用未标记的数据进行学习,而是通过将视频表示为超级图像来重新利用标准图像Vision Transformers,这些图像是由从视频中采样的帧组成的网格。Fr

  18. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    EvoDuet:面向科学发现的Web搜索和任务求解的双层次协同进化

    作者:Young-Jun Lee、Jinheon Baek、Soyeong Jeong|当进展需要模型缺乏的外部知识时,使用大型语言模型(LLM)的进化搜索可能会停滞。提供相关文档有所帮助,但只需添加网络搜索工具就可以随着解决方案的变化而继续返回相同的页面。我们引入EvoDuet,这是一种双层优化方法,可以通过固定模型参数共同进化解决方案和搜索查询。在每次迭代中,

  19. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    在DP-Singapore下,权重绑定对于私人环境中仅解码器的LLM仍然有利吗?

    作者:Razan El Mais、Ali Chehab、Ibrahim Issa|差异私有随机梯度下降(DP-BCD)是大型语言模型(LLM)的隐私保护微调的领先方法。许多仅限解码器的LLM在输入和输出嵌入之间采用权重绑定,这是一种设计选择,最初是为了参数效率和改进非私有环境中的语言建模性能而引入的。然而,体重束缚的影响

  20. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    涡轮增压器:实例自适应优化

    作者:张Tunyu Zhang、Hao Wang、Kai Xu|自动搜索有效的安全带是使代理能够循环自我改进的重要一步。现有的工具优化通常会产生一个全局工具,该工具在任务实例中统一应用。然而,平均效果良好的安全带可能并非对每个实例都是最佳的。我们引入了TurboSYS,这是一个可以适应全球优化的框架

  21. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    WorldAuditBench:具有多模式代理的交互式3D世界审计

    作者:姜紫艳、杨静波、季家宝|随着交互式3D世界越来越多地用于研究智能行为,开发有效的管道来识别这些模拟环境中的异常变得非常重要,例如浮动对象,可穿越的墙壁或与周围场景不一致的对象。包括视觉语言模型(VLM)和视觉语言动作模型(VLA)在内的多模式人工智能系统已经表明

  22. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    Cogentic:用于自动证据发现的多智能体规划

    作者:杨蔡、维尼特·古普塔、江彦晨|我们介绍了Cogentic,这是一种多代理工具,用于自动发现开放研究问题的证据。虽然前沿语言模型可以在一次尝试中产生强大的数学思想,但对于需要探索多个竞争猜想、克服微妙的技术障碍并在很长一段时间内保持中间进展的开放问题,单次尝试生成通常不足以

  23. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    我们能预测机器人将从事的工作吗?

    📌 One-Sentence Summary 安踏克的机器人暴露指数发现机器人已能执行 74%的体力任务(占美国 34%的工作时间),但成本竞争力仅达到 0.3%的任务,且要达到 10%的采用率需要 40 年的时间,这表明自动化将缓慢进行,且集中在驾驶和仓库工作领域。 📝 Summary 安踏克的研究人员利用克劳弗构建了机器人暴露指数,对 7594 个体力职业任务进行了评分,采用四级细则(E0 至 E3)基于完成任务所需的环境。他们发现

  24. 雷峰网·AI 科技评论 中文媒体 中文 快照

    昉擎科技创始人被强制执行 寒武纪股权激励争议尘埃落定

    寒武纪于2026年9月30日发布《关于离职高管诉讼进展的公告》。从公告内容来看,寒武纪与原高管梁军股权激励纠纷争议基本尘埃落定,梁军连续6次提起诉讼均以败诉收场,且因拒绝配合办理回购手续该案件处于司法强制执行阶段。 公告披露内容指出,尽管梁军本次变更诉讼请求提高索赔金额,但对公司日常研发及经营不存在影响。 寒武纪表示,已聘请律师团队对梁军诉讼请求进行全面分析、论证,生效判决已经认定:梁军在激励股份限售期内离职的行为,触发了约定的股份回购

  25. 雷峰网·AI 科技评论 中文媒体 中文 快照

    AI办公进入「上下文战争」,百度如何出牌?

    上下文,正成为AI办公新的竞争变量。 “任何事情都可以成为用户的上下文。”在百度AI Day开放日接受雷峰网采访时,百度集团副总裁、个人超级智能事业群组(PSIG)总裁王颖表示, 过往的历史积累、沉淀的文件资产,以及与同事之间的对话,都是上下文的重要组成部分。 当AI办公迈入上下文竞争阶段,各家手里的优势也各不相同: 有的来自企业协作场景,消息、文档、会议天然沉淀其中;有的来自业务软件,更贴近垂直流程和行业数据;而百度的一张王牌,来自文

  26. 雷峰网·AI 科技评论 中文媒体 中文 快照

    DeepSeek 开源算子工具大礼包,联手华为昇腾,手撕 CUDA 绑定!

    一套代码能跑遍所有芯片。 作者丨 高允毅 编辑丨岑 峰 刚刚,DeepSeek做了一个开源壮举: 把给英伟达 GPU 写代码的全套工具链,原样铺到了华为昇腾 950 NPU 上。 最核心的算子开发产品 TileLang 官宣原生支持昇腾。不仅如此,连同 DeepGEMM、DeepEP、FlashMLA、TileKernels、DeepSelect 五大核心计算与通信库也同步推出昇腾版本,直接对标英伟达平台的全套工具链。 这意味着国产算力

  27. 雷峰网·AI 科技评论 中文媒体 中文 快照

    Muse爆火,dots入场:Personal Agent开始和互联网平台抢入口

    Personal Agent,正在成为这一轮 AI 产品竞争里最热的新概念之一。 9 月 29 日,OpenAI 发布了可以长期在线的个人 Agent 产品 dots,提出“always-on agents”。更早把这个词推到台前的是 Meta 发布的个人 Agent 产品 Muse,截至 9 月下旬下载量突破 300 万,一度将 ChatGPT 从美国 App Store 免费榜第一的位置上挤下。(雷峰网) Muse 运行在一台独立的

  28. 雷峰网·AI 科技评论 中文媒体 中文 快照

    2000座高速闪充站落成,比亚迪如何扛住国庆车流?

    作者丨马诗晴 编辑丨马广宇 在第2000座高速闪充站建成后,比亚迪将迎来第一场大考。 几天前 ,比亚迪宣布第2000座高速闪充站在扬州宝应服务区落成。这意味着在国庆假期,比亚迪高速闪充网络 将要面临 首次 车流 集中压力测试。 在现场演示中,比亚迪汽车从10%电量充至97%,用时约9分钟。用比亚迪闪充业务总经理王俊保的的话来说:“充电站‘有’和‘好用’是两个概念”,而从其表述来看,比亚迪是后者。 当前,节假日补能需求仍在增长。从国家能源

  29. 雷峰网·AI 科技评论 中文媒体 中文 快照

    实测 Qwen-3.8 与 GLM-5.3 的 Flash 版:谁能让我提前下班半小时?

    2026 年 8 月 26 日,同一天,Qwen 发布 Qwen3.8-Flash-Next/Qwen3.8-Flash,Z.AI 发布 GLM-5.3-Flash。从名字看,“Flash 模型”代表低价、快速、负责高频调用,更多是旗舰模型的补位产品,但这次两家官方给出的宣传重点,其实已经不再停留在 便宜聊天 上。(雷峰网) 千问云对 Qwen3.8-Flash 的定位直指 1M 长上下文、长文档、完整代码库、复杂对话、编程辅助、工作流

  30. MarkTechPost 国际媒体 快照

    Perplexity推出Photon:一种基于铁锈的检索引擎,可将p99延迟从800 ms缩短至65 ms

    Perplexity发布了Photon,这是一个用Rust编写的内部检索和排名引擎。它取代了Perplexity为其人工智能原生搜索堆栈而开发的开源引擎。Photon现在处理所有生产流量的检索和排名。它还支持Perplexity Search API中的新快速搜索模式。Perplexity报告单次呼叫延迟为160 [.]帖子Perplexity推出Photon:一种基于铁锈的检索引擎,将p99延迟从800 ms缩短到65 ms首先出现在

  31. 雷峰网·AI 科技评论 中文媒体 中文 快照

    从 Codex Harness 开源,看 AI 公司的护城河是什么?

    8 月 19 日,OpenAI 正式开源了 Codex Harness。这家公司名字里的 Open,久违地兑现了一次。(雷峰网) 长期深耕 Agent Harness 的 开发者群体 对该消息的普遍反馈是“振奋”。因为过去只有少数顶尖 Agent 产品掌握的 Harness,现在终于开始向更多开发者和企业开放了。 随着 Codex 等最佳实践的开源, Harness 正在经历从“私产”到“公器”的转化,其 本身的稀缺性,正在快速下降。

  32. 雷峰网·AI 科技评论 中文媒体 中文 快照

    全网最硬核 OpenClaw 2.0 实测:从 ToC 到 ToB 的试探,Agent 网关能重塑工作流边界吗?

    8 月 31 日,OpenClaw 2.0 正式发布(版本号: v2026.8.1 ),933 位贡献者、569 位首次贡献者、16,962 个 PR 提交。这组数字让它成为近期最受关注的开源 Agent 更新之一。(雷峰网) 在过去 230 天里,OpenClaw 曾发布 106 个版本,但在 2.0 到来前已经有近 7 周没有更新了。因此,这一次 OpenClaw 不是给 Agent 多补几个工具,而是把安装、浏览器、云会话、记忆管

  33. 雷峰网·AI 科技评论 中文媒体 中文 快照

    5500颗光引擎如何撑起4096卡超节点?华为NPO的故事还没讲完

    华为自研光引擎Hi-ONE的首个落点终于浮出水面——千卡级超节点。 不久前的CIOE上,海思已经展示这颗带宽能力高达7.2T的光引擎,并透露Hi-ONE将以NPO(Near-Packaged Optics,近封装光学)形式进入下一代超节点。华为称,这也是全球首个采用NPO的AI智算超节点。 为什么是NPO?答案藏在电信号的传输路径上。随着芯片侧高速接口速率不断提升,从电芯片到光引擎的这段电连接越长,信号越容易出现衰减和失真,对信号完整性

  34. 雷峰网·AI 科技评论 中文媒体 中文 快照

    对比 Codex,免费的 AgnesCode 也能在底层算子优化任务中打得有来有回

    AgnesCode在部分芯片上跑出更高性能,免费模型完成专业级交付。 作者丨 吴海明 曹PP 编辑丨李 娜 免费的 AI Coding Agent,能不能和付费 Codex 在真实工程任务里打得有来有回? 过去一年,我们已经习惯了让 Coding Agent 写网页、做应用、修 Bug。但这一次,我们想把它往更底层推一步: 让 AI 去优化大模型自己运行时使用的算子 。 所谓“算子”,可以简单理解为 大模型运行时 反复执行的 一小段底层

  35. 雷峰网·AI 科技评论 中文媒体 中文 快照

    从海拉鲁到现实世界:视频模型如何理解「变化」

    HiDream-O1-Video 的三场世界回应测试。 作者丨Reah 编辑丨李 娜 在《塞尔达传说:旷野之息》中,玩家点燃一片草地,火焰会沿着草叶蔓延,热空气随之升起。此时展开滑翔帆,林克便能借助上升气流离开地面。雷雨中装备金属武器可能招来闪电,降雨又会让攀爬变得困难。海拉鲁并没有追求照片级的视觉拟真,却通过一组稳定、可组合的规则,让玩家感受到一个世界正在持续运行。 这种体验的关键是无论世界里有多少种物体,系统都会回应玩家的行动,并且

  36. 雷峰网·AI 科技评论 中文媒体 中文 快照

    在三张圆明园鼠首照片里,我们看到了3D AI的Harness时刻

    3D 生成的价值正从模型本身转向模型、智能体与专业软件共同完成任务的 3D AI Harness。 作者丨 吴海明 编辑丨李娜 岑峰 成龙电影《十二生肖》里,有一段 3D 生成技术的片段,龙叔靠近圆明园十二生肖鼠首,用特制扫描手套获取文物的三维信息,再把数据加密传输到另一端,借助 3D 打印做出高仿鼠首。这套设定放在十多年前,代表的是一种典型的技术想象:要复原一个复杂实体,必须先有专用硬件、精密扫描和昂贵设备。 如果把同一个问题放到 2

  37. 雷峰网·AI 科技评论 中文媒体 中文 快照

    全球开源前二,阶跃终于回来了

    Step 5 Preview 回到全球第一梯队 作者丨吴海明 编辑丨李娜 岑峰 两年前,阶跃星辰第一次在基模圈公开亮相时,凭借 Step 1 炸了场,同年接连发布 Step 1V 和万亿参数基座模型 Step 2,彼时行业仍相信,模型越大、能力越强。谁推进 Scaling Law,谁就更接近牌桌中心。 但过去一年,它的曝光似乎更多集中在另一端:多模态模型、手机、汽车、端侧模型和 Agent。相比之下,那个需要和 Qwen、Kimi、GL

  38. 雷峰网·AI 科技评论 中文媒体 中文 快照

    越大越强,不再是 LLM 的专利:PixVerse R2 攻克实时世界模型 Scaling 难题

    AI 视频的下一战:谁能让世界保持运行 作者丨Reah 编辑丨李娜 岑峰 大语言模型已经用 Scaling 证明模型、数据和算力可以持续换来更强能力,必须一边生成、一边回应用户的实时世界模型,能不能也走上这样一条路? 2026 年 1 月,爱诗科技提出“通用实时世界模型”这 一产品方向,并推出 R1。 目前,PixVerse R2 已全量上线 用户可以直接进入网页端体验动作指令和互动影游的相关交互 01 实时世界模型, 能走上 LLM

  39. 雷峰网·AI 科技评论 中文媒体 中文 快照

    世界制造业大会丨国轩高科重磅发布低空飞行高功率电池等三大创新成果

    9月21日,2026世界制造业大会国轩高科专场发布会在合肥举行。立足AI快速发展背景,国轩高科聚焦低空经济、跨境绿色物流、零碳数字能源三大前沿赛道,重磅发布低空飞行高功率星晨电池、中欧非新能源物流运输一体化解决方案、国轩零碳数字云平台三大创新应用成果;同期,国轩高科展区以覆盖海陆空的全场景解决方案亮相新一代信息技术和新能源展区,充分展现公司AI能源底座的技术实力和产业化水平。 高比能、高功率、高安全、快速补能 国轩高科发布“三高一快”

  40. 雷峰网·AI 科技评论 中文媒体 中文 快照

    GPT-6 Astra 上手体验:花了一周,它真在电脑里建了座曼哈顿!

    网友实测GPT-6 Astra:神操作很多,长任务翻车也很快。 作者丨李娜 编辑丨岑峰 北京时间9月4日凌晨,OpenAI正式发布了新一代旗舰模型 GPT-6 Astra。 你敢相信吗?GPT-6只用了一周时间,就在虚幻引擎里一条街一条街搭出了一座曼哈顿。 更夸张的是,在另一次测试里,Matt Shumer让Astra创建一个虚拟世界,并让其中的人都成为独立Agent。任务启动后他去睡觉,第二天甚至在客厅里听到了这些虚拟人的对话声。 一

  41. 雷峰网·AI 科技评论 中文媒体 中文 快照

    Kimi 和 DeepSeek,为什么出现在同一张模型架构图里?

    大模型 Attention 路线变迁:从分流到重组。 作者丨李娜 编辑丨岑峰 一张大模型架构图里,同时出现了 Kimi 和 DeepSeek 的影子。 GLM-5.3-Flash项目配置文件:45层架构中,34层采用Kimi路线的KDA线性注意力,另外11层采用DeepSeek路线的KPool-DSA稀疏注意力 今年以来,大模型架构里出现了一条越来越清晰的变化:一些混合注意力架构中原本由全局Attention承担的角色,开始被Spars

  42. 雷峰网·AI 科技评论 中文媒体 中文 快照

    我们让 GPT‑6 Astra、Fable 5.1 和 Sol 控制同一台机器人:谁真的把活干完了?

    真实云台实测:三个模型都让机器转起来,但“完成”的标准天差地别。 作者丨 Rhea 编辑丨李娜 岑峰 云台机械臂是一个能上下左右转动的摄像头底座/支架,我用GPT‑6 Astra、Claude Fable 5.1 和 GPT‑5.6 Sol这三个顶级模型都让机器人转了起来,三个模型均完成了任务,但执行路径、验证标准和成本差异明显。 这次 GPT-6 Astra 出来之后,网上已经有很多优秀的测评案例了。如果读者已经能在其他地方看到这些,

  43. 雷峰网·AI 科技评论 中文媒体 中文 快照

    拆解 WorkBuddy、千问办公和豆包工作,它们其实不是同一种产品

    活是 AI 干的,锅是人背的。 作者丨Reah 编辑丨李娜 岑峰 我们以职场牛马的身份,把同一份脏活同时交给了三家办公 Agent:WorkBuddy、千问办公和豆包工作。本来想试试能不能为自己省出半天时间,结果半天没省出来,先被三个总额问住了。 这份脏活是一张销售流水表,混着不同日期格式、退款、跨季度订单、部门缺失和异常金额,平时谁看了都头疼。 同一份 脏销售流水 和同一句提示词,交给 WorkBuddy、千问办公、豆包工作。 三家都

  44. 雷峰网·AI 科技评论 中文媒体 中文 快照

    实测 Seedance 2.5 vs 可灵 3.0,谁能让我们无痛当上视频导演?

    差距不只在画质,而在工作流。 作者丨 吴海明 编辑丨李娜 岑峰 《牛来》大概是今年国产电影里最意外的一次出圈,并不是因为一部低成本动画突然被推到台前,而是因为它把一个老问题重新摆到了创作者面前:当影像生产的门槛越来越低,真正决定一条视频能不能成立的,究竟是画质、预算,还是把想法稳定变成成片的能力?(雷峰网) AI 视频模型也走到了类似的节点。 过去,大家更关心模型能不能生成一段“像真的视频”;现在,问题正在变得更具体:模型能不能听懂一个

  45. MarkTechPost 国际媒体 快照

    英伟达研究人员推出Physis-Lang:自我进化的物理语言,使Cosmos 3超越Veo 3.1的物理基准

    视频世界模型可以渲染令人信服的片段,但仍然打破了物理学。黄油像油漆一样蔓延。球穿过墙壁。来自英伟达、麻省理工学院和牛津大学的一个团队认为,修复可能来自语言本身,而不是来自额外的视觉、潜在或数字信号。他们的框架Physis-Lang将物理语言视为共享的、可优化的[.]文章NVIDIA研究人员在物理基准上介绍Physis-Lang:自我进化的物理语言,使Cosmos 3超越Veo 3.1,首先出现在MarkTechPost上。

  46. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    AI 时代漏洞发现与利用趋势

    📌 One-Sentence Summary Google 威胁情报集团的数据显示,AI 正在使漏洞披露和利用率翻倍,并将发现方向转向高风险的远程代码执行(RCE)漏洞,迫使防御方从大规模修补转向基于威胁情报的分类处理和智能体化修复。 📝 Summary Google 威胁情报集团(GTIG)分析了自 2025 年 1 月至 2026 年 8 月的漏洞披露和利用数据,以评估 AI 对威胁景面的影响。月度 CVE 披露量自 2026 年