AI 日报hiw3c.com

2026-09-16全球 AI 要闻精选,来自 30+ 信息源

聚合官方博客 · 权威媒体 · 深度通讯 · 学术信号。
只做索引,不做转载,标题与链接均指向原始发布方。

  1. The Decoder 国际媒体 快照

    近五分之一的人工智能研究人员早在2024年就已经预计人工智能会灭绝

    人类研究员雅各布·考克森(Jacob Coxon)用一条推文引发了一场关于存在性人工智能风险的激烈辩论。OpenAI研究员丹尼尔·塞尔萨姆(Daniel Selsam)警告称,这是一颗“定时炸弹”,一位前Deepmind研究员表示,人工智能可能会杀死我们所有人。在对1,500多名顶尖人工智能研究人员进行的一项调查中,灭绝情景的平均估计可能性为18%。那是在2024年。这个数字不断攀升。近五分之一的人工智能研究人员早在2024年就已经预计

  2. 雷峰网·AI 科技评论 中文媒体 中文 快照

    碧桂园服务与支付宝全面深化合作,共筑“智慧物业”数字化新标杆

    2026年9月15日,碧桂园服务与支付宝正式签署合作协议。双方宣布将围绕物业服务升级、年终缴费大促及智慧社区建设等领域开展深度合作。此次合作标志着双方合作全面升级,通过数字化技术为业主打造更具获得感的服务体验,同时为物业行业降本增效提供参考。 科技让服务“随手可得”,提升居住幸福感 为了给业主提供更有“温度”的智慧生活,碧桂园服务与支付宝将共同升级业主服务体系。碧桂园服务集团副总裁兼CTO赵晓光表示“物业行业步入存量时代,服务质量成为核

  3. 雷峰网·AI 科技评论 中文媒体 中文 快照

    基元律动与无问芯穹达成战略合作,推进高质量Token供给与应用

    2026年 9 月 15 日,AI基础设施公司基元律动(TokenRhythm)与无问芯穹(Infinigence AI)签署战略合作协议。双方将结合无问芯穹的Agentic Infra产品及服务体系与基元律动的多模型服务、智能路由能力,围绕高质量Token的供给、调度与应用展开合作,共同开拓市场。 图注:基元律动与无问芯穹战略合作签约仪式 AI基础设施服务商是基元律动商业模式中的重要伙伴。基元律动连接模型供给与业务需求,通过智能路由和

  4. 雷峰网·AI 科技评论 中文媒体 中文 快照

    清华稳准智能联合发布LimiX-2,结构化数据基础模型登顶国际评测榜单

    9月16日,稳准智能联合清华大学计算机系崔鹏教授,发布新一代数据大模型 LimiX-2,模型参数规模提升至400M。在 TabArena 、BCCO、TALENT三个国际主流结构化数据Benchmark中,LimiX-2总体Elo分数分别达到1935、1432和1506,均位于榜单第一,超过Google、SAP、Amazon等国际大厂的同类模型。 在 TabArena 、BCCO、TALENT三个国际主流结构化数据Benchmark中,

  5. 雷峰网·AI 科技评论 中文媒体 中文 快照

    大促GMV猛涨500%:激光雕刻设备靠"创意落地"出海东南亚

    在东南亚,手工创作正在成为越来越多年轻人的日常。有人把木板刻成桌面摆件,有人在皮革上刻下名字,做成定制钱包,还有人把金属牌雕刻成独一无二的礼物送给朋友。 个性化表达的需求不断升温,激光雕刻设备也因此从专业工具,逐渐走进更多普通消费者的视野。 Elliot 所在的团队,已在国内激光雕刻设备领域深耕多年。以雕刻主机为核心,团队逐步将定位、升降、旋转、排烟及材料等相关产品纳入体系,形成了较完整的产品矩阵。 随着业务逐步成熟,作为负责人的Ell

  6. 雷峰网·AI 科技评论 中文媒体 中文 快照

    AI健康走进百姓餐桌,蚂蚁阿福推出AI饮食分功能

    每天吃的健康吗?现在拍张照就能知道了。9月16日,蚂蚁阿福发布了"AI饮食分":用户拍下餐食照片,AI就能自动识别食物种类、算清营养和热量,给出一目了然的评分。同时,蚂蚁阿福还宣布,为鼓励用户认真吃饭,“科学减重一亿斤”活动推出加码奖励——将发放一亿颗鸡蛋,用户只需坚持使用AI拍饮食,即可1分钱包邮领鸡蛋。 吃饭前拍照让AI打分,男女老少都有专属营养师 据介绍,AI饮食评分参考中国营养学会"合理膳食指数",由阿福与中国营养学会专家组共同

  7. 雷峰网·AI 科技评论 中文媒体 中文 快照

    Anew Labs已完成 2.9 亿美元融资,红杉中国、高瓴、IDG、五源、高榕等参与

    9月16日,记者从相关渠道获悉,AI制药公司Anew Labs(新生实验室)日前已完成首轮独立融资,融资总额 2.9 亿美元。本轮投资方涵盖红杉中国、IDG资本、高瓴创投、五源资本、高榕资本等投资机构,同时有多家国内医药产业集团作为战略投资方参与。 今年 6 月,据媒体报道,字节跳动将 AI 制药业务线拆分独立,核心团队、算法平台及已有管线资产整体注入新主体,由原团队负责人刘凯负责,核心成员约 50 人,涵盖 AI 算法与制药领域专家。

  8. 雷峰网·AI 科技评论 中文媒体 中文 快照

    豆包 2.1 Pro模型更新,已接入豆包工作

    9月16日,据火山引擎官方消息,豆包 2.1 Pro模型在近期更新至0915版本。新模型API已在火山方舟全量上线,并接入豆包工作。用户在豆包工作内选用“豆包 2.1 Pro(0915 新版)”,即可体验到全面升级的工作任务执行能力。 据悉,豆包新模型在视频推理、3D物体图像识别等多模态理解任务上均有增强。其编程能力更是有显著提升,可处理复杂代码仓库中的跨文件、长程问题。在“看图写代码”的多模态编程场景中,豆包 2.1 Pro最新版已达

  9. BestBlogs·每日早报 BestBlogs 精选 中文

    EP177 · 可验证安全、实时语音、上线排障 · 09-16 早报

    📝 今日导语 黄仁勋把 AI 安全落到验证机制,Gemini 3.8 Live 展示实时协作,Plivo 的故障清单给出上线排障路径。 🏷 今日关键词: 黄仁勋 Gemini 3.8 Live 语音智能体排障 开放模型治理 智能体复现 📰 今日精选内容 英伟达 CEO 黄仁勋谈 AI 安全、开放模型与赢得 AI 竞赛 All-In Podcast · 视频 · 评分 92 Gemini 3.8 Live 发布:实时多模态与 Extend

  10. MarkTechPost 国际媒体 快照

    Nums AI发布Causilo:在单一模型中超越TabArena的Tabular基础模型

    Nums AI发布了Causilo,这是一个预训练的表格基础模型,用于分类和回归,具有scikit-learn接口。它在单一型号中排名第一,领先于谷歌的TabFM和LG的EXAONE Tabular。代码是Apache-2.0,而权重被授权用于非商业研究。The post Nums AI Releases Causilo:一个在单个模型中排名第一的TabArena表格基础模型appeared first on MarkTechPost

  11. 雷峰网·AI 科技评论 中文媒体 中文 快照

    奇安信斩获国家信息安全漏洞库CNNVD两项重磅荣誉

    2026年9月15日,2026年国家网络安全宣传周成都系列活动的重要组成部分——第二届基础软硬件智能化漏洞治理生态创新技术交流活动在成都成功举办。奇安信凭借在漏洞协同管理与高质量漏洞报送方面的卓越表现,一举斩获“2026年度协同软硬件漏洞管理优秀企业”、“2026年度基础软硬件漏洞报送优秀企业”两项重磅荣誉,是本次大会获奖最多的企业之一。 本次大会以“AI向善·安全有道”为主题,由国家信息安全漏洞库(CNNVD)、中国信息产业商会信息安

  12. 雷峰网·AI 科技评论 中文媒体 中文 快照

    王强宇履新百望:从发票SaaS工具,到财税垂直大模型,再到企业的Palantir

    在今天的AI行业,能谈大模型的人很多,真正把垂类大模型做出来、做进真实业务流程,并且完成从技术、产品到规模化应用闭环的人,却依然稀缺。 王强宇是卓越的实战派代表,这也是资本市场对他出任百望股份联席总经理高度关注的原因。 在加入百望股份之前,王强宇已经完整走过一次垂类大模型从0到1、再从1走向规模化应用的路径。 从连续创业,到担任钉钉副总裁,再到创办壹生检康、主导豆蔻医疗大模型及临床智能产品落地,他过去二十余年的职业经历,几乎贯穿了中国互

  13. The Verge 国际媒体 快照

    Boox Palma 3获得手写笔支持和时尚的重新设计

    Boox智能手机大小的黑白电子阅读器上一次更新近两年后,该公司宣布推出Palma 3,经过了时尚的重新设计、新功能和一些其他小型更新,这些更新可能证明其大幅提价是合理的,具体取决于您计划如何使用它。虽然Palma 2于2024年推出,售价279.99美元,但[..]

  14. 雷峰网·AI 科技评论 中文媒体 中文 快照

    510万一张!携程上架太空旅行船票:已有681人购买,还得自己买保险;娃哈哈因拖欠员工公积金被查封办公楼;华为放权!问界将由赛力斯主导

    要闻提示 1.510万一张!携程上架太空旅行船票:已有681人购买,还得自己买保险 2.娃哈哈因拖欠员工公积金被查封办公楼 3.鸿蒙智行:问界将由赛力斯主导,华为终端参与赋能 4.特斯拉Model YL后轮塌陷后续:官方修改车主手册多项车辆参数,整体缩减3-4毫米 5.苹果新系统已更新调休闹钟 6.因加大AI投入,报道称字节跳动2026上半年净利润下降 7.82%!长鑫科技利润率在全球存储芯片企业中排名第一 8.谷歌放开内部权限,允许工

  15. Simon Willison 个人技术博客 快照

    双子座现场音频

    工具:Gemini Live音频Google Gemini今天发布了3.8 Live和3.8 Live扩展思维-两种新的语音到语音模型,其形状与OpenAI的GPT-Live家族相似。我在文档中指出了GPT-6 Astra Extra High,并让它为我构建了这个Web UI以尝试新模型。您可以选择模型和语音预设,输入可选的系统提示,然后通过浏览器开始语音对话,包括在模型说话时打断模型的功能。该实现不使用库。它连接到wss:gener

  16. NVIDIA AI Blog 海外官方 快照

    “现在我们可以知道一切,做任何事情,”黄詹森在Dreamforce说道

    什么都知道做任何事情.这是英伟达创始人兼首席执行官黄延森周二在Salesforce Dreamforce上传达的信息,他与首席执行官马克·贝尼奥夫(Marc Benioff)一起登台亮相,恰逢Salesforce首个CRM推理模型Koa的发布,该模型基于英伟达Nemotron 3 Super。黄不仅仅是上台。他走进了[.]

  17. MarkTechPost 国际媒体 快照

    NVIDIA的cuDNN图形API内部:通过cuDNN Frontend进行融合、自动调整和计划重用

    了解如何利用NVIDIA的cuDNN Frontend Shape API来构建自定义内核融合、自动调整引擎配置、FP 8风格的尾声、扩展的点产品注意力、动态形状和CUDA图形捕获。这个实用教程演示了如何在框架抽象下优化深度学习计算,同时根据PyTorch验证结果。文章Inside NVIDIA的cuDNN Shape API:使用cuDNN Frontend进行融合、自动调谐和计划重用首先出现在MarkTechPost上。

  18. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Image-to-WebDev Arena Update: GPT-6 Astra (Max) and Claude Fable 5.1 Lead the Pack

    📊 Article Meta AI Screening: 90 Source: Arena.ai(@lmarena_ai) Author: Arena.ai Category: 人工智能 Language: 英文 Read Time: 4 min Word Count: 992 Tags: AI 与智能应用 , 模型评测与基准 , 多模态 AI , OpenAI , Anthropic Read Tweet

  19. MarkTechPost 国际媒体 快照

    Google发布Gemini 3.8 Live和3.8 Live Extended Thinking,用于生产级语音代理

    谷歌发布了Gemini 3.8 Live和Gemini 3.8 Live扩展思维,这是迄今为止最先进的实时对话模型。这些模型在对话保持流畅的同时在后台执行工具和API调用,处理实时视觉输入,并在对话中在97种语言之间切换。扩展思维在人工分析的语音到语音质量指数中排名第一,为82.6,在Big Bench Audio中得分97.7%。两者今天都可以在Gemini API和Google AI Studio中以0.005美元/分钟的价格提供音

  20. The Verge 国际媒体 快照

    微软宣布将于10月7日举办Windows和Surface活动

    距离上次重大Windows活动已经过去两年多了,因此微软将于下个月前往旧金山,概述Windows和Surface设备的未来。在10月7日的一次活动中,该公司表示将举办一场“关于本地人工智能将如何塑造下一章的对话”[..]

  21. The Verge 国际媒体 快照

    如果社交媒体没有伤害孩子怎么办?

    两年前,社会心理学家乔纳森·海特(Jonathan Haidt)出版了《纽约时报》畅销书《焦虑的一代》。这本书认为,自2010年以来青少年心理健康状况显着下降在很大程度上应归咎于社交媒体和智能手机使用的兴起。它很快成为社交媒体强烈反对的核心口号。海特[…]

  22. The Verge 国际媒体 快照

    起亚的电动面包车阵容越来越有趣,揭示了PV7

    您可能不知道,但小型货车正在美国卷土重来。环顾四周,您会开始注意到这些轮子上的面包盒的价格有所上涨。2025年销量增长了21%,这表明这款不起眼的小型货车正在摆脱“不酷”的耻辱,并在厌倦SUV的公众中找到了新的粉丝。我是[.]

  23. The Decoder 国际媒体 快照

    谷歌推出Gemini 3.8 Live,以极低的成本与OpenAI的GPT-Live-1较量

    Google Deepmind发布了Gemini 3.8 Live和3.8 Live扩展思维,这是针对开发人员的两种新音频模型,在人工分析语音到语音排行榜上名列前茅。谷歌每小时语音对话的价格为1.38美元,大大低于OpenAI的GPT-Live-1,由于采用了全速,GPT-Live-1听起来应该仍然更加自然。谷歌推出Gemini 3.8 Live的文章,以一小部分的成本与OpenAI的GPT-Live-1较量,该文章首先出现在The D

  24. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    大型社会需要社会规范

    作者:Tapan Chugh、Vidushi Singh、Krish Jain|代理社会是一群人工智能代理的集合,代表目标可能仅部分一致的不同委托人,跨越信任边界自主协调。我们通过实验表明,在代理社会中,即使是诚实、有能力的代理人也常常无法通过现有的工具和消息传递基元达到令人满意的结果,并且有缺陷或恶意的代理人可能会阻止代理人。

  25. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    ScienceBuddy:交互式科学代理的循环中的自我改进

    作者:薛淑汉、钟建元、南子元|我们引入并发布ScienceBuddy,这是一个交互式科学研究工作空间,将不断改进的科学代理带入研究人员的日常工作流程中。ScienceBuddy支持研究人员执行科学任务,同时将他们的请求、反馈和执行证据转化为持续学习的任务和评估指标。其核心是循环重复

  26. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    PhysStream:具有结构化场景内存和细粒度运动控制的流物理基础视频生成

    作者:陈楚浩、彼得·旺卡、王朝阳|视频生成的交互式控制正在从粗糙的提示转向对动态场景的细粒度、物理上有意义的操纵。然而,现有的可控方法要么需要在生成开始之前完成完整的控制时间表,要么使用规定对象位置而不是物理动态的像素空间信号。为了解决这些局限性,我们提出了PhysStream,一种autoregre

  27. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    LLM什么时候应该弃权?选择性风险控制的自我质疑链

    作者:Ali Kazenol|当事实支持较弱时,大型语言模型可以产生流利的答案。本文介绍了自我提问链(CoSJ),这是一个仅限预算的框架,它使回答承诺以回答问题所需信息的明确评估为条件。我们在817项TruthfulQA多项选择验证集上评估了17种条件下的三种CoSQ变体。

  28. The Decoder 国际媒体 快照

    人工智能实验室存在政策尚未解决的数据信任问题

    OpenAI和Anthropic告诉企业客户,他们的数据不会用于培训。但是,当Anthropic表示将存储其旗舰机型Fable的使用日志30天时,Palantir、Nvidia和Booz Allen Hamilton撤回了将其用于敏感工作的计划。从董事会到研究实验室,人工智能公司仍然存在数据信任问题。文章AI实验室有一个数据信任问题,他们的政策还没有解决出现在解码器上。

  29. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    智能家居的修剪会出现哪些问题以及何时出现?评估跨体系结构和任务复杂性的LLM退化

    作者:张聪静、瓦什什塔·帕蒂尔、亨宁·兰格|修剪可以降低大型语言模型(LLM)的部署成本,但其对基于上下文的工具调用的影响仍然知之甚少。我们系统地研究了跨越密集Transformer、密集混合和混合专家(MoE)架构的四个LLM的智能家居工具调用中修剪引起的降级,以及深度、宽度、混合和专家修剪方法。p之后

  30. MIT Tech Review AI 国际媒体 快照

    圆桌会议:人工智能真的能杀死我们所有人吗?

    收听会议或观看下面世界领先人工智能实验室的员工表示,先进人工智能确实有可能摧毁人类。他们说得对吗?或者这更多的是危言耸听和炒作?观看一场对话,解开人工智能灭绝的恐惧:它们来自哪里,它们是否含有水,如果有的话,.

  31. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    LACE:动态帧率编解码器的逐层压缩

    作者:Thanapat Trachu、Samuele Cornell、William Chen|神经音频编解码器是语音语言建模的关键组件。然而,它们的高帧率导致序列长度长,从而增加了计算成本。动态帧率编解码器通过使用压缩步骤将多个帧合并在一起来降低有效帧率来缓解这一问题。然而,大多数现有方法要么在单码本编解码器上操作,要么应用单压缩

  32. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    ENCP:视觉和语言导航的场景规范化保形预测

    作者:Vicky Feliren,A. Taufiq Asyhari,Chaad Risqi U.萨普特拉|视觉-语言-导航(VLN)模型的不确定性估计是一项至关重要的任务,因为它可以帮助识别模糊和不可靠的预测,使代理能够做出更安全的导航决策。作为最先进的不确定性估计框架之一,共形预测(CP)为VLN的不确定性估计提供了一种很有前途的方法。然而,鉴于VLN代理需要Sequ

  33. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    可验证的社会推理LLM助理

    作者:Amir Taubenfeld、Zorik Gekhman、Avigail Grinstein-Dabush| LLM助理被广泛用于日常社会咨询,但在这种咨询环境中评估他们的社会推理仍然具有挑战性,因为(i)它需要设置助理从主观用户叙述中了解社会情况,以及(ii)社会属性,例如其他人的意图,通常缺乏可验证的基础事实。为了应对这些挑战,我们引入了收件箱,

  34. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    FreqSpaNet:用于物理层硬件完整性检测的SPF频率和空间学习

    作者:黄晓轩、徐锦龙、王一哲|未经授权的硬件替换可能会保留无线设备的逻辑身份,同时改变其物理实现,从而对硬件完整性验证构成挑战。空间频率极化指纹(SFPF)捕获多个频率和方向上的设备相关响应,但它们的频率和空间维度表现出不同的结构依赖性。W

  35. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    LimiX-2:面向通用结构化数据智能的上下文机制网络

    作者:张兴轩、任刚、昊源|我们引入LimiX-2,这是LimiX系列中的一种新模型,通过在我们之前建立的缩放定律指导下的模型和数据缩放来开发。LimiX-2采用上下文机制网络(CMN)范式,并使用上下文条件掩蔽建模(CCMM)进行预训练。CMN将上下文学习的组织原则从以目标为中心的预测转变为以机制为导向的联合模式

  36. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    介绍 Gemini 3.8 Live 和 3.8 Live Extended Thinking

    📌 One-Sentence Summary Google 推出两款新模型,Gemini 3.8 Live 和 3.8 Live Extended Thinking,通过增强的推理、视觉接地和多步任务完成能力,提升了实时语音交互体验,服务于开发者和消费者。 📝 Summary 新的 Gemini 3.8 Live 模型代表了语音到语音 AI 的重大进步,提供了近乎实时的推理和流畅的对话。标准 3.8 Live 模型针对成本效率和可扩展性

  37. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Gemini 3.8 Live:支持 97 种语言的 SOTA 音频模型,带异步工具调用

    📌 One-Sentence Summary NVIDIA 发布 Gemini 3.8 Live,这是一款顶级的音频模型,支持 97 种语言、无缝语言切换、异步工具调用,并具备更高的性能和竞争力的价格。 📝 Summary Gemini 3.8 Live 的发布标志着音频 AI 技术的重大进步。该模型支持惊人的 97 种语言,允许在对话中动态、实时地切换语言。此外,它还具备异步工具调用功能,使模型能够在保持连续对话流程的同时,获取实时信

  38. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    介绍全新 Gemini 音频模型:实时协同与深度思考

    📌 One-Sentence Summary Google AI 发布 Gemini 3.8 Live 和 3.8 Live Extended Thinking,这两款先进模型让用户与 AI 的对话更加自然流畅,支持跨语言交流、视觉理解和复杂任务执行。 📝 Summary 该推文宣布推出两款新 AI 音频模型:Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking。这些模型旨在通过整合声音

  39. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    NVIDIA Groq 3 LPX 确定性执行如何驱动 NVIDIA Vera Rubin 上的低功耗高交互性推理

    📌 One-Sentence Summary NVIDIA Groq 3 LPX 利用确定性执行实现精确的电流需求预测,从而进行主动电压控制和时钟周期合成,显著降低功耗开销,同时保持高交互性性能。 📝 Summary NVIDIA Groq 3 LPX 加速器通过确定性执行模型实现功耗效率,该模型允许编译器创建操作和数据移动的周期精确调度。这种可预测性支持两项关键技术:先发制人功率(PEP),用于在需求激增前调整电压供应;以及时钟周期合

  40. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    NVIDIA NVLink 6 如何为 AI 工厂提供多层可靠性

    📌 One-Sentence Summary NVIDIA NVLink 6 通过结合硬件级错误校正、无损流控制和软件驱动的恢复机制,确保大规模 AI 集群的持续运行,并隔离和缓解瞬时故障。 📝 Summary 本文详细介绍了 NVIDIA NVLink 6 的全面可靠性架构,该架构旨在支持高可用性的 AI 工作负载。它涵盖了物理层使用前向错误校正和物理层重试来校正信号错误,链路层使用基于信用的流控制来防止丢包,以及应用层使用影子引擎恢

  41. AWS ML Blog 海外官方 快照

    使用Amazon Bedrock提示缓存优化成本和延迟

    当您重复向基金会模型发送相同的上下文时,Amazon Bedrock中的提示缓存可以将输入令牌成本降低高达90%。这篇文章使用Converse API介绍了六种实用的提示缓存场景:消息内容、系统提示符、工具定义、混合TLR、租户隔离和LangChain集成。

  42. The Verge 国际媒体 快照

    俄勒冈小道如何成为一代偶像

    无论您是在教室后面还是在家里的电脑上玩它,如果您是过去30年的孩子,您几乎肯定是在玩《俄勒冈小径》长大的。在《版本历史》第五季首映式上,我们无所畏惧的旅行车领袖大卫·皮尔斯(David Pierce)与游戏记者克里斯(Chris)一起加入了游戏[.]

  43. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    你的智能体出色完成了任务。它还能再来一次吗?

    📌 One-Sentence Summary 文章介绍了一套诊断与指南系统,用于衡量并将 LLM 智能体的平均准确率与单任务可靠性之间的一致性差距减半,同时不降低平均性能。 📝 Summary 文章引入了「一致性差距」这一概念,即基准测试中 Mean@k(平均通过率)与 Pass^k(全部 k 次运行均成功的任务比例)之间的差异。文章解释,这一差距源于智能体轨迹中决策点上的平坦概率分布,使得即便使用固定随机种子,智能体的行为也难以预测。

  44. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Cognition Releases SWE-2: A Cost-Effective Frontier Coding Model

    📊 Article Meta AI Screening: 91 Source: Cognition(@cognition_labs) Author: Cognition Category: 人工智能 Language: 英文 Read Time: 1 min Word Count: 59 Tags: AI 与智能应用 , AI 编程 , 模型发布 , 强化学习 , 模型评测与基准 Read Tweet

  45. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    上线第一周就会撞上的 5 种语音智能体失败模式 — Venky B,Plivo

    📌 One-Sentence Summary Plivo 创始人 Venky B 梳理语音 AI 智能体上线第一周常见的五种生产失败模式:延迟与成本、智能的权衡,脆弱的 STT,结构化数据采集,TTS 归一化,以及轮次切换,并分享来自月通话量超十亿平台的落地配方。 📝 Summary Venky B,Plivo 创始人兼 CEO,指出语音 AI 智能体在 PoC 阶段往往表现稳健,一上生产却容易崩盘。他以 Plivo 的全栈语音管线(非

  46. 雷峰网·AI 科技评论 中文媒体 中文 快照

    美团发布“手艺人Agent”,发型师可“吩咐”AI小帮手打理线上作品

    9月15日,美团在2026百大发型师生态大会上正式发布首个“手艺人Agent”,基于平台AI技术和对行业真实经营经验的积累,为发型师等手艺人提供专属AI小帮手。 据了解,“手艺人Agent”可提供线上运营知识问答、经营数据分析、关键事项提醒、作品管理和发布等多项支持。

  47. The Verge 国际媒体 快照

    Meta的新One订阅为社交媒体和AI定价

    在推出新的万能人工智能助手Muse后不久,Meta推出了订阅捆绑包,将其独立应用程序订阅与额外的人工智能使用结合起来。一些新的Meta One捆绑包已于今年早些时候进行测试,但现在从今天开始在全球范围内提供,为个人用户、创作者和企业提供多层服务。Meta说[.]

  48. The Verge 国际媒体 快照

    现在Light的极简手机可以轻松呼叫Uber

    十多年前,其Kickstarter提出了一款“旨在尽可能少使用的手机”,Light正在通过一款新的Rideshare工具与Uber和Lyft建立直接连接。对于Light Phone III或即将推出的Light Flip的用户来说,他们可以用它来寻找接机[.]

  49. The Decoder 国际媒体 快照

    在警告人工智能太危险后,比尔·盖茨押注十亿美元

    盖茨基金会将在两年内投资至少10亿美元,以使人工智能工具在健康、教育和农业领域更广泛地使用。比尔·盖茨警告说,早期语言模型背后90%以上的训练数据来自英语来源,而在约鲁巴语中,语音识别有60%的时间失败。他说,市场是“平等机会的可怕保证。“在警告人工智能太危险后,比尔·盖茨在其收益上押了10亿美元的文章首先出现在《解码器》上。

  50. 雷峰网·AI 科技评论 中文媒体 中文 快照

    旗舰SoC进入融合计算时代,天玑9600 Pro首创AI原生架构!

    就在这两天,联发科正式发布新一代旗舰移动平台天玑9600 Pro。作为天玑首款Pro旗舰,它率先采用台积电2nm制程,并以全新AI原生架构重构移动计算,带来双超大核CPU、重构双NPU、神经网络渲染与智能影像等一系列架构级升级,推动性能、能效、AI、游戏、影像以及通信显示体验全面跃升。 过去几年,AI正从云端加速走向终端,手机也成为AI能力最重要的入口之一。随着生成式AI持续发展、消费者智能体进入新阶段,设备需要承载更强的理解与推理能力

  51. 雷峰网·AI 科技评论 中文媒体 中文 快照

    阶跃发布 StepAudio 3 ,多款语音模型登顶 Artificial Analysis 全球榜单

    9月15日,阶跃发布新一代语音大模型 StepAudio 3 系列,一次性推出 StepAudio 3 Realtime、StepAudio 3 ASR、StepAudio 3 TTS、StepAudio 3 Gen 和 StepAudio 3 Music 五款模型,覆盖实时语音交互、语音识别、真人级语音生成和音乐创作等场景。其中,多款模型在 权威 第三方 AI 模型评测机构 Artificial Analysis 榜单中位列全球第一。

  52. 雷峰网·AI 科技评论 中文媒体 中文 快照

    英伟达开源 IMO 金牌配方:不仅是「人海战术」,1.5TB 显存做实 AI「 推恩令」?

    用三套 checkpoint 完成多轮证明搜索,用过程透明平息学术怒火,用 1.5TB 显存门槛锁定算力霸权。名为代码平权,实则算力集权。 作者丨 郑佳美 编辑丨岑 峰 9 月 9 日,NVIDIA 公布了 Nemotron 3 Ultra 在 2026 年 IMO 上使用的整套数学推理系统。 这套系统最终拿到 30/42 分,超过当届 29 分的金牌线。整个比赛过程中,模型只用自然语言写证明,没有调用 Lean 等形式化证明器,也没有

  53. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    使用 NVIDIA FLARE 在 Docker、Kubernetes 和 Slurm 上扩展联邦学习

    📌 One-Sentence Summary NVIDIA FLARE 通过将持久的联邦服务与动态作业执行分离,实现了在异构环境中的联邦学习,允许站点使用 Docker、Kubernetes 或 Slurm,同时保持对资源和数据的本地控制。 📝 Summary 联邦学习项目往往因为基础设施环境的多样性而面临运营复杂性。NVIDIA FLARE 通过将持久的联邦层与作业执行层分离来解决这一问题,允许每个站点使用其首选的运行时(Docker

  54. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    Agent Substrate 现已在 GKE 上可用

    📌 One-Sentence Summary Agent Substrate 是一个开源、默认安全的代理执行运行时,现已在 Google Kubernetes Engine 上可用,为自主代理提供 10 倍更高的密度和低于 500 毫秒的恢复操作。 📝 Summary Agent Substrate 在 GKE 上提供了一个可扩展、高密度的执行环境,用于自主代理,具有内核级隔离、亚秒级激活和仅激活计算经济。它与 Kubernetes 集

  55. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    轻松实现大规模 GNN 运行:推出分布式 GraphFlow

    📌 One-Sentence Summary Google Cloud 推出分布式 GraphFlow,这是一个用于可扩展 GNN 训练和推理的 Python 库,与 Spanner Graph 集成,用于实现电信中的自主网络运营和预测性维护。 📝 Summary 本文介绍了 Google Cloud 的自主网络运营框架,该框架将基于 Spanner Graph 的数字孪生与用于 GNN 分析的分布式 GraphFlow (DGF) 相

  56. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    云可靠性事件处理最佳实践

    📌 One-Sentence Summary 本文概述了应对云端停机的结构化工作流程,强调准备、验证、调查、报告、解决和事后复盘,以最大限度地减少服务中断。 📝 Summary 该指南详细介绍了处理云可靠性事件的关键步骤,从通过设计、数据收集和培训进行主动准备开始。它描述了识别停机源的验证过程,随后是调查和报告程序。文章最后介绍了解决事件的策略,以及进行事后分析以提高未来响应能力的做法。 💡 Main Points 准备是最大限度减少事

  57. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    构建零信任 AI 代理:判断意图,而非仅语法

    📌 One-Sentence Summary 本文介绍了三种托管的运行时治理控制——模型护甲、语义治理策略和代理异常检测——这些控制使 AI 代理能够判断意图和行为,而不仅仅依赖于静态语法检查,从而在生产环境中增强安全性和适应性。 📝 Summary 文章讨论了用于 AI 代理的确定性、构建时控制的局限性,并主张转向托管的运行时治理。它详细介绍了三种关键控制:用于筛选提示和响应的模型护甲、用于根据业务规则评估工具调用的语义治理策略,以及