AI 日报hiw3c.com

2026-09-15全球 AI 要闻精选,来自 30+ 信息源

聚合官方博客 · 权威媒体 · 深度通讯 · 学术信号。
只做索引,不做转载,标题与链接均指向原始发布方。

  1. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Cognition Releases SWE-2: A Cost-Effective Frontier Coding Model

    📊 Article Meta AI Screening: 91 Source: Cognition(@cognition_labs) Author: Cognition Category: 人工智能 Language: 英文 Read Time: 1 min Word Count: 59 Tags: AI 与智能应用 , AI 编程 , 模型发布 , 强化学习 , 模型评测与基准 Read Tweet

  2. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    上线第一周就会撞上的 5 种语音智能体失败模式 — Venky B,Plivo

    📌 One-Sentence Summary Plivo 创始人 Venky B 梳理语音 AI 智能体上线第一周常见的五种生产失败模式:延迟与成本、智能的权衡,脆弱的 STT,结构化数据采集,TTS 归一化,以及轮次切换,并分享来自月通话量超十亿平台的落地配方。 📝 Summary Venky B,Plivo 创始人兼 CEO,指出语音 AI 智能体在 PoC 阶段往往表现稳健,一上生产却容易崩盘。他以 Plivo 的全栈语音管线(非

  3. 雷峰网·AI 科技评论 中文媒体 中文 快照

    美团发布“手艺人Agent”,发型师可“吩咐”AI小帮手打理线上作品

    9月15日,美团在2026百大发型师生态大会上正式发布首个“手艺人Agent”,基于平台AI技术和对行业真实经营经验的积累,为发型师等手艺人提供专属AI小帮手。 据了解,“手艺人Agent”可提供线上运营知识问答、经营数据分析、关键事项提醒、作品管理和发布等多项支持。

  4. The Verge 国际媒体 快照

    Meta的新One订阅为社交媒体和AI定价

    在推出新的万能人工智能助手Muse后不久,Meta推出了订阅捆绑包,将其独立应用程序订阅与额外的人工智能使用结合起来。一些新的Meta One捆绑包已于今年早些时候进行测试,但现在从今天开始在全球范围内提供,为个人用户、创作者和企业提供多层服务。Meta说[.]

  5. The Verge 国际媒体 快照

    现在Light的极简手机可以轻松呼叫Uber

    十多年前,其Kickstarter提出了一款“旨在尽可能少使用的手机”,Light正在通过一款新的Rideshare工具与Uber和Lyft建立直接连接。对于Light Phone III或即将推出的Light Flip的用户来说,他们可以用它来寻找接机[.]

  6. The Decoder 国际媒体 快照

    在警告人工智能太危险后,比尔·盖茨押注十亿美元

    盖茨基金会将在两年内投资至少10亿美元,以使人工智能工具在健康、教育和农业领域更广泛地使用。比尔·盖茨警告说,早期语言模型背后90%以上的训练数据来自英语来源,而在约鲁巴语中,语音识别有60%的时间失败。他说,市场是“平等机会的可怕保证。“在警告人工智能太危险后,比尔·盖茨在其收益上押了10亿美元的文章首先出现在《解码器》上。

  7. 雷峰网·AI 科技评论 中文媒体 中文 快照

    旗舰SoC进入融合计算时代,天玑9600 Pro首创AI原生架构!

    就在这两天,联发科正式发布新一代旗舰移动平台天玑9600 Pro。作为天玑首款Pro旗舰,它率先采用台积电2nm制程,并以全新AI原生架构重构移动计算,带来双超大核CPU、重构双NPU、神经网络渲染与智能影像等一系列架构级升级,推动性能、能效、AI、游戏、影像以及通信显示体验全面跃升。 过去几年,AI正从云端加速走向终端,手机也成为AI能力最重要的入口之一。随着生成式AI持续发展、消费者智能体进入新阶段,设备需要承载更强的理解与推理能力

  8. The Verge 国际媒体 快照

    通用汽车更新其卡车的本地软件以与CarPlay共存

    通用汽车正在完善其畅销卡车的软件体验,以减少访问最常用控制装置所需的危险敲击和滑动次数。它还为Apple CarPlay和Android Auto提供了漂亮的新的来龙去脉显示屏--考虑到通用汽车此前表示的对手机镜像的敌意,这一点值得注意[.]

  9. The Decoder 国际媒体 快照

    苹果公司带来了基于谷歌Gemini的全面改进的Siri,但并未向欧盟发布

    经过多年的拖延,苹果正在推出重建的“Siri AI”,该AI基于谷歌的Gemini型号构建,部分在设备上运行,部分通过私有云计算运行。早期的测试人员赞扬多步骤请求和屏幕上下文,但报告了幻觉和与个人上下文的差距。在欧盟,该助理暂时无法使用。苹果公司带来了一款基于谷歌Gemini的全面改进的Siri,但并未向欧盟发布,该文章首先出现在The Decoder上。

  10. 雷峰网·AI 科技评论 中文媒体 中文 快照

    阶跃发布 StepAudio 3 ,多款语音模型登顶 Artificial Analysis 全球榜单

    9月15日,阶跃发布新一代语音大模型 StepAudio 3 系列,一次性推出 StepAudio 3 Realtime、StepAudio 3 ASR、StepAudio 3 TTS、StepAudio 3 Gen 和 StepAudio 3 Music 五款模型,覆盖实时语音交互、语音识别、真人级语音生成和音乐创作等场景。其中,多款模型在 权威 第三方 AI 模型评测机构 Artificial Analysis 榜单中位列全球第一。

  11. 雷峰网·AI 科技评论 中文媒体 中文 快照

    英伟达开源 IMO 金牌配方:不仅是「人海战术」,1.5TB 显存做实 AI「 推恩令」?

    用三套 checkpoint 完成多轮证明搜索,用过程透明平息学术怒火,用 1.5TB 显存门槛锁定算力霸权。名为代码平权,实则算力集权。 作者丨 郑佳美 编辑丨岑 峰 9 月 9 日,NVIDIA 公布了 Nemotron 3 Ultra 在 2026 年 IMO 上使用的整套数学推理系统。 这套系统最终拿到 30/42 分,超过当届 29 分的金牌线。整个比赛过程中,模型只用自然语言写证明,没有调用 Lean 等形式化证明器,也没有

  12. 雷峰网·AI 科技评论 中文媒体 中文 快照

    亚太唯一!腾讯云首次入选IDC MarketScape 全球托管边缘服务领导者类别

    9 月 15 日,国际数据公司(IDC)发布《IDC MarketScape: Worldwide Managed Edge Services 2026 Vendor Assessment》报告。凭借边缘安全加速平台EdgeOne,腾讯云位居领导者(Leaders)类别,成为首次入选、也是本次唯一入选领导者类别的中国厂商、亚太厂商。 IDC MarketScape 报告指出:“腾讯云 EdgeOne 通过统一平台原生融合加速、安全、边缘

  13. The Decoder 国际媒体 快照

    并非所有人都相信大型人工智能拟议的开发放缓实际上是为了安全

    OpenAI、Anthropic和Google以安全问题为由希望放慢前沿人工智能的开发。但来自整个行业和政界的批评者正在反击。Cohere首席执行官艾丹·戈麦斯称该计划是一个“另一个名称的卡特尔”,旨在将竞争对手拒之门外,白宫和特朗普本人都反对此举。并非所有人都相信大型人工智能提出的开发放缓实际上是为了安全性,该文章首先出现在The Decoder上。

  14. The Verge 国际媒体 快照

    微软发布紧急Windows 11更新以修复其破纪录的补丁

    微软已经开始推出紧急带外更新,以修复其创纪录的9月补丁周二更新的问题。这家软件巨头本月在其有史以来最大的更新中修复了近1,000个缺陷,但它也引入了一些影响企业、开发人员和游戏玩家的错误。周二的九月补丁影响了基于Hyper-V的文件夹共享[.]

  15. 雷峰网·AI 科技评论 中文媒体 中文 快照

    “阿宝”交新朋友:携手比亚迪“迪迪虾”,实现车机端一句话办事

    “阿宝”又交新朋友!9月14日,“阿宝”亮相腾势N8L纯电上市发布会,并与比亚迪AI超级智能体“迪迪虾”达成跨端协同办事合作。腾势N8L车主直接对“迪迪虾”说一句话,由“迪迪虾”唤起“阿宝”办理生活服务,在车机端实现“一句话办事”。 (阿宝X 迪迪虾在车机场景组成新的“办事搭子”) 比如,车主可以说“你好腾势,帮我缴一下停车费”“你好腾势,帮我买杯咖啡”,就可唤起“迪迪虾”理解车主在车内场景下的语音需求,并唤起“阿宝”执行;“阿宝”则在

  16. 雷峰网·AI 科技评论 中文媒体 中文 快照

    Xspark AI 丁文伯:触觉替代不了视觉,但机器人需要一套自己的“脊髓” |物理AI 50人

    具身智能进入“触觉时代”,丁文伯提出“脊髓”架构补全机器人物理交互短板。 作者:李秋悦 编辑:吴彤 丁文伯很难被一个词准确“定位”。通信博士、材料学博士后、机器触觉学者,这些标签都对,但都只能解释他的部分经历。 2025年,丁文伯又多了一个身份——Xspark AI(无界智航)联合创始人、首席科学家。一个做了多年传感器研究的清华教授出来创业,没有把公司定义成一家“传感器公司”。 相反,他认为造出更好的传感器,并不会自动得到一个更聪明的机

  17. 雷峰网·AI 科技评论 中文媒体 中文 快照

    数亿元!前京东副总裁“消失”4年:不造会跑的天工,他在仓库里给人形机器人“占工位”

    一家“消失”了四年的机器人公司,重回公众视野时,手里已握着全球头部电商的产线订单。 默不作声的四年 它去仓库装分拣机了 9月1日,北京天下先智创机器人技术有限责任公司(下称“天工机器人”)宣布完成数亿元A轮融资。本轮由初芯基金领投,经纬创投、合肥国资等机构跟投,钱主要花在三件事上:分拣类机器人扩大量产、基于人形的分拣机器人研发与商用化迭代、海外市场拓展。 先帮各位厘清一件容易混淆的事。这家“天工”,不是那个跑半程马拉松拿冠军的“天工Ul

  18. The Verge 国际媒体 快照

    沃尔沃的插电式混合动力车XC60和XC90确实可以走得很远

    如今,大多数插电式混合动力电动汽车(PHEV)的仅电池续航里程平均约为30-50英里:不错,但并不令人兴奋。随着混合动力销售在当今市场占据主导地位,沃尔沃将证明其PHEV能够突破可能的极限。今天,这家瑞典汽车制造商透露了其热门[.]的更新版PHEV版本

  19. BestBlogs·每日早报 BestBlogs 精选 中文

    EP176 · Agent 工程手册、Eve 框架、AGI 已至 · 09-15 早报

    📝 今日导语 agent 改老代码屡屡翻车,Osmani 分区法可照做;Eve 框架与 Brockman 的 AGI 判断补齐两路。 🏷 今日关键词: Vercel Eve Greg Brockman Context Engineering Addy Osmani 具身智能 AI 眼镜 📰 今日精选内容 Brownfield Agentic Engineering 实战:把 AI Agent 安全带进遗留代码库 Elevate · 文章

  20. MarkTechPost 国际媒体 快照

    Meta推出ZGateway:统一ZippyDB流量并每秒处理超过10亿次操作的无状态代理层

    Meta工程团队引入了ZGateway,这是一个代理层,现在位于客户端应用程序和ZippyDB(Meta使用最广泛的key Value Store)之间。ZippyDB以每秒数十亿次的操作支持产品元数据、计数器和配置。ZGateway最初是为了解决超过一百万个客户端主机的连接蔓延问题,后来发展为[.] Meta推出ZGateway:一个统一ZippyDB流量并处理每秒超过10亿次操作的无状态代理层首次出现在MarkTechPost上。

  21. MarkTechPost 国际媒体 快照

    Agent-net开源网络代理:将任何网站变成受保护的人工智能代理的Go Buttons

    Agent-net是一个构建一个代理对代理市场的团队,人工智能代理可以在其中发现、信任并相互付费,该团队发布了WebAgent,这是一种开源工具,用于站立面向公众的商业代理。所以,基本上你给它你的网站,找到一个代理,然后让它与其他代理交谈。企业没有编写编排代码,而是填写[.]帖子Agent-net开源网络代理:将任何网站变成受保护的人工智能代理的Go Buttons首先出现在MarkTechPost上。

  22. 雷峰网·AI 科技评论 中文媒体 中文 快照

    超级智能体“迪迪虾”上车,比亚迪携手阿里云推进智能座舱升级

    9月14日,比亚迪“超级智能体迪迪虾暨腾势N8L纯电上市发布会”举行。围绕下一代智能座舱,比亚迪正与阿里云推进AI合作:千问大模型接入比亚迪座舱体系,参与用户多轮对话与复杂意图理解、任务编排、长期记忆与生态服务连接,让车机从“被动听懂一句话”进一步走向“主动办成一件事”。 超级智能体“迪迪虾”以AIOS为底座,通过超级智能体引擎调度车端能力和外部服务。昨日发布会上,比亚迪集团高级副总裁、汽车新技术研究院院长杨冬生表示:“迪迪虾有多模态感

  23. 雷峰网·AI 科技评论 中文媒体 中文 快照

    字节跳动CEO梁汝波:豆包、飞书与火山引擎整合后 将加大企业市场投入

    9月15日,2026飞书未来无限大会在京举办,字节跳动CEO梁汝波在会上进行了分享。他表示,在Agent进入可用阶段后,Agent、模型、协作环境三者必须紧密融合,才能真正发挥价值。正是基于这一判断,字节跳动将豆包、飞书、火山引擎的力量整合到一起,聚焦打造优质的工作与生产力产品;公司会投入更多的资源和力量,让智能更快地在企业组织里产生价值。 (图注:字节跳动CEO梁汝波在2026飞书未来无限大会上分享) 今年是飞书在字节跳动立项的第十年

  24. 雷峰网·AI 科技评论 中文媒体 中文 快照

    工作流可以自我进化了,英伟达开源 SoL-Pi,每小时省13.5刀!

    Token 砍半,活没少干,每小时还省13.5刀! 作者丨 高允毅 编辑丨岑 峰 最适合鞭打AI干活,还得是 AI 啊。 英伟达今早开源了一套提高工作效率的 Harness —— SoL-Pi ,它让AI亲自当监工,去Agent工作流中吹毛求疵,把每一处可能“摸鱼、浪费Token”的环节进行修复,自我迭代优化。 效率提升后,Token消耗最高减少了 64%,API 调用成本下降 50%–54%,在实际开发中每小时能帮企业省下 8.75

  25. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    使用 NVIDIA FLARE 在 Docker、Kubernetes 和 Slurm 上扩展联邦学习

    📌 One-Sentence Summary NVIDIA FLARE 通过将持久的联邦服务与动态作业执行分离,实现了在异构环境中的联邦学习,允许站点使用 Docker、Kubernetes 或 Slurm,同时保持对资源和数据的本地控制。 📝 Summary 联邦学习项目往往因为基础设施环境的多样性而面临运营复杂性。NVIDIA FLARE 通过将持久的联邦层与作业执行层分离来解决这一问题,允许每个站点使用其首选的运行时(Docker

  26. 雷峰网·AI 科技评论 中文媒体 中文 快照

    横扫四榜,DM0.5 凭什么面面俱到?

    单科冠军不够,具身智能落地需要没有结构性短板的底座 作者丨 邓哲敏 编辑丨 齐铖湧 一个模型同时占据四个能力子榜单的榜首,这在具身智能行业里不多见。 RoboColiseum 是由智元机器人发起,联合高校、科研机构、开源社区及机器人企业共同建设的评测平台,它把评测拆成四个维度:指令跟随、空间理解、扰动适应、通用操作。参评者只要在任何一个维度上有结构性短板,就会在对应的子榜上掉下来。 而原力灵机的通用具身基础模型 DM0.5 在四个子榜上

  27. 雷峰网·AI 科技评论 中文媒体 中文 快照

    强化学习大本营新作:如何破解「学新忘旧」困局

    阿尔伯塔大学团队提出FAME框架,给持续强化学习一个可求解的公式。 作者丨 邓哲敏 编辑丨齐铖湧 今天教会机器人拧瓶盖,明天再让它抓杯子,它可能又把拧瓶盖忘得一干二净。 反观人类,这类现象极少出现。人脑拥有成熟的记忆分工体系,新旧知识有序存储,习得新事物的同时不会冲刷掉旧有认知。 这套终身学习的机制,其实是当下大模型同样欠缺的。Demis Hassabis、梁文锋与 Ilya Sutskever 都指出过大模型的固有短板:通过微调注入新

  28. 雷峰网·AI 科技评论 中文媒体 中文 快照

    不止一颗CPU?智能体经济时代,Arm对算力平台有了新理解

    导语:200瓦功耗之差的新战场 记者:郭思 编辑:包永刚 9月9号,人社部公布了第八批新职业名单,尤为瞩目的一个新职位是智能体开发员。岗位的正式确立,意味着相关技术已走向主流,而背后则是底层技术的实质性跃迁,当模型不再停留在问答层面,而是开始具备“行动”能力——底层算力的需求结构也在重塑。智能体在运行过程中,需要频繁地获取数据、调用工具并等待结果返回,这对系统的响应延迟提出了极高的敏感度。因此,以往“唯算力论”的粗放型资源配置模式,已逐

  29. 雷峰网·AI 科技评论 中文媒体 中文 快照

    担心代码被拿去训练!英伟达:限制员工使用 Claude;一汽将成广汽第二大股东!南北丰田拟合并;苹果回应「iPhone 18 Pro破发」

    要闻提示 1.突发!英伟达:限制员工使用 Claude 2.重磅,一汽将成广汽第二大股东!南北丰田拟合并 3.苹果回应“iPhone 18 Pro破发”:第三方渠道有自己的定价权 4.比亚迪高管:燃油车没有未来 5.罗永浩遭前合伙人黄斌怒喷:一辈子都在吹牛,挺可怜的 6.高瓴90后合伙人严文韬或加入DeepSeek担任CFO,已发起离职流程 7.程序员为用公司算力干私活:一条代码删掉89TB数据获刑 8.马斯克预热特斯拉跑车,博主李杰灵

  30. The Verge 国际媒体 快照

    Valve仍在考虑“如何以及何时”执行Steam Deck 2

    现在,Valve终于推出了其整个2026年的硬件阵容-蒸汽控制器,蒸汽机,和今天的蒸汽框架-我们是否更接近下一代蒸汽甲板手持设备?Valve还没有这么说。该公司正在弄清楚“如何以及何时我们可以提供这样的东西,”阀门设计师皮埃尔-卢普[...]

  31. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    Agent Substrate 现已在 GKE 上可用

    📌 One-Sentence Summary Agent Substrate 是一个开源、默认安全的代理执行运行时,现已在 Google Kubernetes Engine 上可用,为自主代理提供 10 倍更高的密度和低于 500 毫秒的恢复操作。 📝 Summary Agent Substrate 在 GKE 上提供了一个可扩展、高密度的执行环境,用于自主代理,具有内核级隔离、亚秒级激活和仅激活计算经济。它与 Kubernetes 集

  32. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    轻松实现大规模 GNN 运行:推出分布式 GraphFlow

    📌 One-Sentence Summary Google Cloud 推出分布式 GraphFlow,这是一个用于可扩展 GNN 训练和推理的 Python 库,与 Spanner Graph 集成,用于实现电信中的自主网络运营和预测性维护。 📝 Summary 本文介绍了 Google Cloud 的自主网络运营框架,该框架将基于 Spanner Graph 的数字孪生与用于 GNN 分析的分布式 GraphFlow (DGF) 相

  33. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    云可靠性事件处理最佳实践

    📌 One-Sentence Summary 本文概述了应对云端停机的结构化工作流程,强调准备、验证、调查、报告、解决和事后复盘,以最大限度地减少服务中断。 📝 Summary 该指南详细介绍了处理云可靠性事件的关键步骤,从通过设计、数据收集和培训进行主动准备开始。它描述了识别停机源的验证过程,随后是调查和报告程序。文章最后介绍了解决事件的策略,以及进行事后分析以提高未来响应能力的做法。 💡 Main Points 准备是最大限度减少事

  34. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    构建零信任 AI 代理:判断意图,而非仅语法

    📌 One-Sentence Summary 本文介绍了三种托管的运行时治理控制——模型护甲、语义治理策略和代理异常检测——这些控制使 AI 代理能够判断意图和行为,而不仅仅依赖于静态语法检查,从而在生产环境中增强安全性和适应性。 📝 Summary 文章讨论了用于 AI 代理的确定性、构建时控制的局限性,并主张转向托管的运行时治理。它详细介绍了三种关键控制:用于筛选提示和响应的模型护甲、用于根据业务规则评估工具调用的语义治理策略,以及

  35. The Verge 国际媒体 快照

    Apple Home的新安全摄像头功能每月售价高达60美元

    随着iOS 27和tvOS 27的公开发布,Apple Home正在注入Apple Intelligence -但您必须为此支付更多费用。Apple Intelligence for Home为HomeKit Secure Video带来了AI驱动的视频摘要,因此您可以获得兼容安全摄像头看到的人和内容的简短文本描述,[...]

  36. The Verge 国际媒体 快照

    高管和政客对减缓人工智能发展有何看法

    过去几天,达里奥·阿莫德伊发表了一篇题为《我们必须跟上前沿》的长文,详细介绍了为什么应该放慢人工智能开发速度,引发了大量关于人工智能安全的声明。其他人工智能领导人和政治家正在公开支持或反对他的观点,我们已经收集了一些[.]

  37. Simon Willison 个人技术博客 快照

    恐惧的传染

    The contagion of fear Bryan Cantrill responds to the tweet by former Anthropic employee Jacob Coxon confirming that many Anthropic researchers believe AI "could kill us all by the end of the decade". Bryan shares a story

  38. MarkTechPost 国际媒体 快照

    奖励人工智能发布OM-1:仅针对人类演示训练的机器人政策,没有远程操作或机器人上数据

    Reward AI发布了OM-1(Omnibody Model 1),这是一种通用操纵策略,完全针对使用7 DoF可穿戴手套拍摄的人类演示进行训练,没有远程操作或机器人上的数据。该政策以人类速度在工业武器和类人机器上运行,从不到30分钟的数据中学习新任务,并将电磁手跟踪(在67厘米/s的速度下比视觉惯性低60%)与RL训练的控制层配对,该控制层按自己的时钟运行。目前还没有公开权重、代码或API。帖子奖励人工智能发布OM-1:仅在人类示威

  39. MarkTechPost 国际媒体 快照

    Sakana AI研究人员推出PC-ILM,这是一种用于训练1000层网络的反向传播的层本地替代方案

    Sakana人工智能研究人员Jeffrey Seely和Julian Gould介绍了增强拉格朗日预测编码(PC-ILM),这是反向传播的本地学习替代方案。通过将拉格朗日乘数附加到每个层约束,PC-ILM保持预测编码的层本地更新,同时恢复线性网络中的精确反推梯度。它以T = 2L的推理预算在8到128的宽度和深度上匹配BP,将参考单元中的梯度cos从0.604提升到0.909,并在MNIST上大约2个反推力点内训练1000层剩余MLP。

  40. The Verge 国际媒体 快照

    特朗普放弃发电厂气候污染规则

    美国环境保护局今天宣布,计划废除美国发电厂允许排放多少温室气体污染的任何剩余标准。此举只会让电力变得更加肮脏,因为人工智能、电动汽车和国内制造业的复苏推高了电力需求。EPA今天的提案是[.]

  41. Simon Willison 个人技术博客 快照

    哪些博客文章对您的想法影响最大?

    我对哪些博客文章对您的想法影响最大的评论?- Lobste.rs.乔尔·斯波尔斯基(Joel Spolsky)对我来说早期的一个作品是《泄露抽象定律》。我在职业生涯开始时读到了这篇文章,它鼓励我始终寻求对我所工作的各个层的更好的理解,以防其中一个抽象泄露。最近的一个是2018年的《移民:威尔·拉尔森(Will Larson)的唯一可扩展的科技债务解决方案》。我绝对喜欢他的想法,即迁移(例如用新服务替换一项服务,或切换数据库引擎,或其他)

  42. The Verge 国际媒体 快照

    Valve的虚拟现实计划触及现实

    Steam Frame耳机就在这里,您可能不会感到惊讶:它的价格应该低于1,059美元。“我们打算推出一款价格便宜得多的设备,但全球RAM市场、全球存储市场对我们的影响就像影响每个人一样,”Valve [.]

  43. The Verge 国际媒体 快照

    任天堂“客户增值”促销的最佳优惠

    正如承诺的那样,任天堂已经在亚马逊、百思买和沃尔玛以及其自己的数字店面降价了各种Switch游戏和配件。由于从美国政府收到了与关税相关的退款,其“客户增值”销售正在进行,并于太平洋时间9月26日晚上8:59结束。任天堂游戏[.]

  44. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    腐败的计划,干净的痕迹:用计划注入逃避思想链监控

    作者:Keertana Chidambaram、Andrew Ilyas、Vasilis Syrgkanis|思想链(CoT)监控是一种安全策略,其中大型语言模型“参与者”的推理由“监视器”(通常是另一种语言模型)检查是否存在不安全规划、欺骗或失调的迹象。我们发现,在行为者的背景中植入有害但听起来善意的推理可以引导其在逃避监视器的同时采取对抗行动,我们将这种攻击称为“计划

  45. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    行李员政策优化

    作者:宋卓青、徐昊天、张锡坤|具有可验证奖励的强化学习(WLVR)提高了大型语言模型(LLM)的推理能力。我们引入Bellman Policy Optimism(BPO),这是一种源自Policy Mirror Down(PSO)的无批评方法。对于具有最终回报的自回归生成,BPO使用Bellman方程将PDC重新表述为个体级目标。重新配方避免了刺激

  46. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    恒星斗兽场:数学和理论计算机科学长期研究的多主体平台

    作者:林鸿浩、David P. Woodruff、Yuan Deng|语言模型可以产生看似合理的简短证明,但在长期研究问题上可能仍然不可靠,因为长期研究问题的进展取决于一系列不确定且相互依赖的决策。我们介绍恒星斗兽场,这是一种模型不可知的工具,用于在数学和理论计算机科学的研究中分配推理。罗马斗兽场在证明之前探索替代策略

  47. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    内部路由器:从冻结的LLM中激发本地技能路由

    作者:陈瑞硕、王迅、陈宇|技能使LLM代理超越了其参数知识,他们承诺的收益取决于选择正确的代理。通过将每个技能的元数据预加载到上下文中来部署利用路径,这分散了代理的注意力并限制了库大小。检索管道将选择移出上下文,但也移出代理的能力。我们表明冷冻剂LLM已经存在

  48. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    选择的未来仍可以被重写:视频模型中的因果关系

    作者:王星运、郑浩民、曼远|当视频模型生成物理上不正确的运动时,它是否无法学习正确的运动,或者它学习了它但无法使用它?我们展示了后者:正确的运动在模型内仍然可用,并且仍然可以控制生成的视频。我们在红色物质缓慢振荡、蓝色物质快速振荡的视频上进行训练,然后用观察到的快速运动来测试红色物质

  49. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    通过方向分解解开变形金刚中的表示进化

    作者:何世伟,张海超,沈岩|Transformer表示通过学习的加法变换来进化,这些加法变换要么保持它们当前的方向,要么重定向它。我们将这种进化作为一个功能几何来研究,将学习的更新分解为平行和垂直分量。在经过预训练的模型中,我们发现剩余身份路径之外的大量并行组件。然后我们在两个部分中应用分解

  50. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    探索基金会模型:迈向开放式探索情报

    作者:杨凌、尹振飞、吴英成|基础模型已经从对现有知识的学习和推理发展到越来越多地通过行动、工具使用和结果反馈进行学习。我们认为,下一个前沿是进一步的转变:从解决人类指定的问题并采取行动到参与创造新问题、表示、解释和知识的过程。我们指的是

  51. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    Mind2 Dialogue:通过模拟用户心理状态训练人类感知语言模型

    作者:王子轩、周羽凡、唐金州|随着语言模型变得越来越强大,学习、推理和决策方面的长期合作需要更深入地了解它们所服务的人。然而,训练此类人类意识语言模型面临着根本性的监督差距,因为当前LLM助理培训的数据集几乎没有明确基于用户不言而喻的信念和目标的充分信息响应

  52. MIT Tech Review AI 国际媒体 快照

    人工智能行业已经发生了毁灭性的转变。现在怎么办?

    这个故事发表在我们关于人工智能的每周时事通讯《算法》上。要首先在您的收件箱中获取此类故事,请在此处注册。本周末,Anthropic首席执行官Dario Amedei发表了一篇文章,呼吁放慢法学硕士的发展步伐。阿莫迪引用了他从这项技术中看到的迫在眉睫的危险,从它的.

  53. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    可通过结构验证:临床问题回答中逐字引用的索赔级评估

    作者:张佳硕、陈玉玲、Yvonne Commodore-Mensah|大型语言模型(LLM)已被广泛用于临床问题回答(QA)。当前的系统可以在答案上附加引用,但这些引用通常指向宽泛的文本,导致时间紧迫的临床医生无法有效地验证它们。另一种选择是确保响应可以通过结构进行验证:从包含的参考材料中提供细粒度的逐字引用

  54. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    具有紧凑自适应和变长高斯通信的隐私对齐个性化联邦学习

    作者:Yilin Xu、Chun Hei Michael Shiu、Chih Wei Ling|当特定于客户端的变化是低维的,而训练重复发布高维更新时,记录级差异隐私暴露了个性化联邦学习中的结构失调。在本文中,我们通过释放一次私人客户端上下文并将重复适应限制在固定系数空间来解决这种不一致。除了降维之外,

  55. The Verge 国际媒体 快照

    TIFF 2026:多伦多最新电影评论

    如果你想了解电影的未来,多伦多国际电影节是一个很好的起点。每年TIFF都有来自世界各地的大量功能,其中一些往往会成为巨大的热门或奖项竞争者;例如,2025年版包括[...]

  56. The Decoder 国际媒体 快照

    OpenAI有数百名合同工阅读您的ChatGPT对话

    据404 Media报道,OpenAI有数百名合同工阅读真实的ChatGPT对话,并对它们进行一到七的评级,部分原因是为了减少奉承和类人行为。提示是匿名的,但仍然可能包含敏感数据。不希望自己的聊天记录被人类审查的用户必须主动禁用“为每个人改进模型”设置,该设置默认处于打开状态。OpenAI有数百名合同工阅读您的ChatGPT对话文章首先出现在The Decoder上。

  57. The Verge 国际媒体 快照

    macOS 27现已上市

    苹果周一发布了macOS 27 Golden Gate,它带来了新的Siri AI助手,液体玻璃改进,改进的性能等等。该更新与所有配备Apple Silicon的Mac兼容,但不兼容英特尔Mac-苹果去年发布了基于英特尔的Mac的最后一次大型更新,并配备了macOS Tahoe。Siri AI可以说是[.]

  58. The Verge 国际媒体 快照

    苹果发布iOS 27,并对Siri AI进行全面改革

    Apple今天将向兼容设备推出iOS 27更新,同时还推出watchOS 27、iPadOS 27和visionOS 27更新。Siri AI是所有四个更新的头条功能,即延迟的Siri助手人工智能大修。Siri AI今天作为测试版提供给仅限英语的设备,苹果表示[...]

  59. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    Vercel 如何破解智能体构建难题:Andrew Qu 与 Eve 框架的演进

    📌 One-Sentence Summary Vercel 的 Andrew Qu 回顾了团队如何将屡屡受挫的多智能体数据工作流,演化为可积累技能的文件系统智能体,并将这些运营经验沉淀为面向企业专属智能体的 Eve 框架。 📝 Summary Andrew Qu 讲述了 Vercel 如何从一个为 Snowflake 生成 SQL 的超大提示词出发,逐步打造 D0——帮助精干数据团队减少重复分析请求的内部数据科学智能体。团队先将规划、查

  60. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    为什么你应该为 AI 研究工作 — Recursive 的 Richard Socher

    📌 One-Sentence Summary Recursive 的创始人 Richard Socher 认为 AI 的下一个重大步骤是递归自我改进——构建一个自动化 AI 研究的 「Eureka Machine」——并解释他为何对科学领域的超级智能持乐观态度,同时对抽象监管智能持怀疑态度。 📝 Summary 在这次 Latent Space 访谈中,Recursive 的创始人、You.com 与 AIX Ventures 的创始人

  61. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    让 AI 智能体执行 Bash 后,我们如何构建安全护栏|PostHog 的 Sarah Sanders

    📌 One-Sentence Summary PostHog 的上下文工程师 Sarah Sanders 说明,Wizard 智能体能读取代码并在受限条件下执行 Bash,因此必须以确定性扫描和默认拒绝的控制措施构建纵深防御,而 LLM 只负责识别误报。 📝 Summary Sarah Sanders 回顾了 PostHog Wizard 从引导 CLI 演化而来的过程:它能选择 SDK、埋点事件、创建仪表盘,也因此带来了严肃的安全问题

  62. MIT Tech Review AI 国际媒体 快照

    人工智能特工揭发了作弊同事

    一群人工智能代理被要求解决一系列数学问题,但分成了敌对派系--当一些人作弊时,另一些人试图阻止他们。这种举报行为在Google DeepMind最近运行的一项实验中首次出现,可能会对试图将大量自主人工智能代理保持在……中的对齐研究人员产生影响。

  63. Google AI Blog 海外官方 快照

    DevFest回来了

    文本动画“{DevFest} 2026加入我们!Google开发人员组”,带有地球图标、星号图标、图标