AI 日报hiw3c.com

2026-09-16全球 AI 要闻精选,来自 30+ 信息源

聚合官方博客 · 权威媒体 · 深度通讯 · 学术信号。
只做索引,不做转载,标题与链接均指向原始发布方。

  1. AWS ML Blog 海外官方 快照

    优化代理系统提示Amazon Bedrock AgentCore

    AgentCore优化将生产跟踪转化为建议的配置更改,然后在升级之前对其进行验证。该发布帖子的这份技术伴侣解释了系统提示优化器的反射器引擎如何工作,并分享了单代理和子代理反射器的基准结果。

  2. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Unlocking Advanced Search in Music Streaming with Milvus

    📊 Article Meta AI Screening: 92 Source: Milvus(@milvusio) Author: Milvus Category: 人工智能 Language: 英文 Read Time: 6 min Word Count: 1428 Tags: AI 与智能应用 , 向量数据库 , 音乐文化 Read Tweet

  3. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Technical Deep Dive: Milvus's Role in Music Streaming Search

    📊 Article Meta AI Screening: 91 Source: Milvus(@milvusio) Author: Milvus Category: 人工智能 Language: 英文 Tags: AI 与智能应用 , 向量数据库 , 音乐文化 Read Tweet

  4. The Decoder 国际媒体 快照

    前OpenAI研究员构建了一个人工智能模型,可以判断选项而不是编写文本

    TypSafe AI由前OpenAI研究员Diogo Almeida创立,正在发布一种故意不生成文本的模型。“Jev”不是聊天响应,而是为软件提供纯粹的分类,响应时间从70毫秒开始,代币价格极低。不过,这种方法并不能防止错误。系统仅保证严格遵守预设选项。前OpenAI研究员构建了一个人工智能模型,可以判断选项,而不是编写文本,这篇文章首先出现在The Decoder上。

  5. NVIDIA AI Blog 海外官方 快照

    NVIDIA Vera Rubin NVL72在MLPerf Inference v6.1中提供领先的性能

    系统性能、高效的基础设施扩展和持续的软件优化是决定人工智能推理经济性的关键杠杆。更高的系统性能意味着生成更多的代币,从而带来更高的收入。高效的扩展意味着吞吐量随着硬件的添加而成比例增长,大规模为用户提供服务所需的资源更少。持续优化意味着从基础设施投资中产生更多价值。[…]

  6. The Decoder 国际媒体 快照

    政治对立者在华盛顿联合起来控制人工智能

    从伯尼·桑德斯到史蒂夫·班农,华盛顿的政治对立者都在共同要求对人工智能进行严格刹车。桑德斯希望冻结数据中心的建设,而OpenAI则首次支持《前线法案》及其强制性外部安全审计。尽管特朗普持怀疑态度,但两党要求约束人工智能规则的压力仍在不断增大。《华盛顿政治对立者联合起来遏制人工智能》这篇文章首先出现在The Decoder上。

  7. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Union Alpha AI 的数据隐私政策

    📌 One-Sentence Summary 提供商明确表示,他们不会使用用户的提示或完成结果来进行模型训练,从而在提供免费服务的同时优先保护用户隐私。 📝 Summary 这条后续消息确认了 Union Alpha 服务的免费性质,并详细说明了数据隐私政策,确保用户与模型的一切交互都不会被用于进一步训练或商业用途。 📊 Article Meta AI Screening: 93 Source: OpenRouter(@OpenRout

  8. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Union Alpha Multimodal AI Model Launch on OpenRouter

    📊 Article Meta AI Screening: 90 Source: OpenRouter(@OpenRouterAI) Author: OpenRouter Category: 人工智能 Language: 英文 Read Time: 2 min Word Count: 265 Tags: AI 与智能应用 , 模型发布 , 多模态 AI , AI 编程 , AI Agent Read Tweet

  9. Hacker News Top 信号源(脚本内置抓取)

    DeepMind研究所

    HN ð131· 43 评论

  10. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Altman 是否误解了 AI 的数学能力?

    📌 One-Sentence Summary Gary Marcus 认为 Sam Altman 关于 AI 超过顶级数学家的说法具有误导性,因为当前的模型依赖于暴力计算和符号验证,而不是生成新的数学洞察或理解。 📝 Summary 这条推特是对 Sam Altman 提出 GPT-6 Astra 能够解决人类专家无法理解的数学问题这一说法的反驳。Marcus 强调,该模型并没有产生任何新的数学定理或洞察;它只不过是在现有计算工具的帮助

  11. NVIDIA AI Blog 海外官方 快照

    Emerald AI、谷歌和英伟达成立联盟,推进灵活的人工智能数据中心

    人工智能工厂是智能时代的基础设施。负责任地扩展它们将不仅取决于整个电网的创新,也取决于数据中心内部的创新。今天,Emerald AI、谷歌和英伟达宣布成立人工智能能源管理联盟(AEMA),这是一个首创的联盟,致力于推进数据中心的发展,使其能够动态管理其电力使用[.]

  12. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    Pinecone 2.0:为企业 AI 智能体构建持久知识层

    📌 One-Sentence Summary Pinecone 创始人 Edo Liberty 将 Nexus 定义为企业 AI 智能体的持久知识层,组织通用知识、专有知识和部落知识,让智能体基于最新上下文、工具与可执行代码工作。 📝 Summary Edo Liberty 认为,企业 AI 缺少的不是另一个模型或检索索引,而是持久的知识层。演讲区分了通用知识、私有的具体知识,以及关于流程、文化、责任和决策原则的部落知识。Pinecon

  13. OpenAI News 海外官方

    用AI重塑广告

    探索OpenAI新的人工智能广告体验,包括Sponsored Agents、营销人员工具以及与HubSpot和Shopify的集成。

  14. MIT Tech Review AI 国际媒体 快照

    为人工智能奠定材料基础

    人工智能热潮正在成为一项材料挑战。随着人工智能将计算推向新领域,基础设施背后的材料变得与其上运行的算法一样重要。半导体和数据中心正在接近性能、热管理、电气效率和可靠性方面的物理极限,对能够实现的材料产生了新的需求.

  15. 雷峰网·AI 科技评论 中文媒体 中文 快照

    芯片从业者拆解OpenAI造芯,还能再快3个月?

    量产一代、研发一代、预研一代,这一芯片公司习以为常的战略节奏,如今正被大模型公司压得更紧。 按照OpenAI今年8月公布的进展,尽管第一代自研芯片Jalapeño(下以“小辣椒”代称)计划于年底前开始部署,但第二代已进行深入开发,第三代也开始成形。 更吸引眼球的是OpenAI的官方说法——第一代“小辣椒”从初始设计到流片只花了9个月。据前端设计验证工程师穆洋估算,这比没有AI辅助的设计快了约半年。 然而,9个月只覆盖了芯片设计全流程的部

  16. 雷峰网·AI 科技评论 中文媒体 中文 快照

    被AI放大的光学「戏份」,让「配角」舜宇的生意越做越大

    作者 | 陈悦琳 编辑 | 郭思 几乎同时迎来“量产元年”的人形机器人和智能眼镜,正在放大光学的“戏份”。 据Counterpoint统计,今年上半年全球人形机器人出货量突破2.2万台,同比激增近300%。与此同时,智能眼镜市场也迎来爆发,IDC数据显示,今年一季度全球智能眼镜出货量达356.6万台,同比增长130.1%。 尽管产品形态各异,两者对光学系统提出了共同诉求——“更清晰”和“更轻便”。人形机器人需精准感知障碍物与距离以规划动

  17. The Decoder 国际媒体 快照

    近五分之一的人工智能研究人员早在2024年就已经预计人工智能会灭绝

    人类研究员雅各布·考克森(Jacob Coxon)用一条推文引发了一场关于存在性人工智能风险的激烈辩论。OpenAI研究员丹尼尔·塞尔萨姆(Daniel Selsam)警告称,这是一颗“定时炸弹”,一位前Deepmind研究员表示,人工智能可能会杀死我们所有人。在对1,500多名顶尖人工智能研究人员进行的一项调查中,灭绝情景的平均估计可能性为18%。那是在2024年。这个数字不断攀升。近五分之一的人工智能研究人员早在2024年就已经预计

  18. 雷峰网·AI 科技评论 中文媒体 中文 快照

    2nm天玑9600 Pro,把旗舰SoC竞争推向「融合计算」

    智能体让旗舰SoC从拼核心,转向拼系统。 过去数年,旗舰手机芯片的升级路径非常清晰,制程更先进、CPU主频更高、GPU、ISP更强,再加上算力不断增长的NPU。 这套方法在生成式AI进入手机后依旧奏效,却很难完整回答智能体带来的新问题。因为AI不再只在用户点开应用后运行几十秒,而要持续感知声音、画面和环境,在后台理解需求,甚至提前执行任务。 一颗核心能跑多快,仍然重要。但当CPU、GPU、NPU、内存和存储需要频繁交换数据,决定体验的已

  19. 雷峰网·AI 科技评论 中文媒体 中文 快照

    华为坤灵升级“4+10+N”场景化方案,发布“经纬计划”和50个样板点

    [中国,上海,2026年9月16日] 今日,华为坤灵新品发布会2026在上海举行。华为常务董事、ICT BG CEO杨超 斌宣布,华为坤灵全面升级 “4+10+N” 一站式场景化方案,发布20款新品,并面向中国分销伙伴发布“经纬计划”和50个样板点,让智能世界触手可及。 华为常务董事、ICT BG CEO杨超斌发表主题演讲 围绕四大特质,升级“ 4+10+N” 场景化方案 在企业加速智能化转型的过程中,网络、存储、安全成为高效释放AI算

  20. OpenAI News 海外官方

    工人如何开启新的工作方式

    新的OpenAI经济研究展示了工人如何在传统角色之外使用人工智能,以及哪些新活动成为他们工作中重复出现的部分。

  21. 雷峰网·AI 科技评论 中文媒体 中文 快照

    碧桂园服务与支付宝全面深化合作,共筑“智慧物业”数字化新标杆

    2026年9月15日,碧桂园服务与支付宝正式签署合作协议。双方宣布将围绕物业服务升级、年终缴费大促及智慧社区建设等领域开展深度合作。此次合作标志着双方合作全面升级,通过数字化技术为业主打造更具获得感的服务体验,同时为物业行业降本增效提供参考。 科技让服务“随手可得”,提升居住幸福感 为了给业主提供更有“温度”的智慧生活,碧桂园服务与支付宝将共同升级业主服务体系。碧桂园服务集团副总裁兼CTO赵晓光表示“物业行业步入存量时代,服务质量成为核

  22. 雷峰网·AI 科技评论 中文媒体 中文 快照

    基元律动与无问芯穹达成战略合作,推进高质量Token供给与应用

    2026年 9 月 15 日,AI基础设施公司基元律动(TokenRhythm)与无问芯穹(Infinigence AI)签署战略合作协议。双方将结合无问芯穹的Agentic Infra产品及服务体系与基元律动的多模型服务、智能路由能力,围绕高质量Token的供给、调度与应用展开合作,共同开拓市场。 图注:基元律动与无问芯穹战略合作签约仪式 AI基础设施服务商是基元律动商业模式中的重要伙伴。基元律动连接模型供给与业务需求,通过智能路由和

  23. 雷峰网·AI 科技评论 中文媒体 中文 快照

    清华稳准智能联合发布LimiX-2,结构化数据基础模型登顶国际评测榜单

    9月16日,稳准智能联合清华大学计算机系崔鹏教授,发布新一代数据大模型 LimiX-2,模型参数规模提升至400M。在 TabArena 、BCCO、TALENT三个国际主流结构化数据Benchmark中,LimiX-2总体Elo分数分别达到1935、1432和1506,均位于榜单第一,超过Google、SAP、Amazon等国际大厂的同类模型。 在 TabArena 、BCCO、TALENT三个国际主流结构化数据Benchmark中,

  24. 雷峰网·AI 科技评论 中文媒体 中文 快照

    大促GMV猛涨500%:激光雕刻设备靠"创意落地"出海东南亚

    在东南亚,手工创作正在成为越来越多年轻人的日常。有人把木板刻成桌面摆件,有人在皮革上刻下名字,做成定制钱包,还有人把金属牌雕刻成独一无二的礼物送给朋友。 个性化表达的需求不断升温,激光雕刻设备也因此从专业工具,逐渐走进更多普通消费者的视野。 Elliot 所在的团队,已在国内激光雕刻设备领域深耕多年。以雕刻主机为核心,团队逐步将定位、升降、旋转、排烟及材料等相关产品纳入体系,形成了较完整的产品矩阵。 随着业务逐步成熟,作为负责人的Ell

  25. 雷峰网·AI 科技评论 中文媒体 中文 快照

    AI健康走进百姓餐桌,蚂蚁阿福推出AI饮食分功能

    每天吃的健康吗?现在拍张照就能知道了。9月16日,蚂蚁阿福发布了"AI饮食分":用户拍下餐食照片,AI就能自动识别食物种类、算清营养和热量,给出一目了然的评分。同时,蚂蚁阿福还宣布,为鼓励用户认真吃饭,“科学减重一亿斤”活动推出加码奖励——将发放一亿颗鸡蛋,用户只需坚持使用AI拍饮食,即可1分钱包邮领鸡蛋。 吃饭前拍照让AI打分,男女老少都有专属营养师 据介绍,AI饮食评分参考中国营养学会"合理膳食指数",由阿福与中国营养学会专家组共同

  26. 雷峰网·AI 科技评论 中文媒体 中文 快照

    Anew Labs已完成 2.9 亿美元融资,红杉中国、高瓴、IDG、五源、高榕等参与

    9月16日,记者从相关渠道获悉,AI制药公司Anew Labs(新生实验室)日前已完成首轮独立融资,融资总额 2.9 亿美元。本轮投资方涵盖红杉中国、IDG资本、高瓴创投、五源资本、高榕资本等投资机构,同时有多家国内医药产业集团作为战略投资方参与。 今年 6 月,据媒体报道,字节跳动将 AI 制药业务线拆分独立,核心团队、算法平台及已有管线资产整体注入新主体,由原团队负责人刘凯负责,核心成员约 50 人,涵盖 AI 算法与制药领域专家。

  27. 雷峰网·AI 科技评论 中文媒体 中文 快照

    豆包 2.1 Pro模型更新,已接入豆包工作

    9月16日,据火山引擎官方消息,豆包 2.1 Pro模型在近期更新至0915版本。新模型API已在火山方舟全量上线,并接入豆包工作。用户在豆包工作内选用“豆包 2.1 Pro(0915 新版)”,即可体验到全面升级的工作任务执行能力。 据悉,豆包新模型在视频推理、3D物体图像识别等多模态理解任务上均有增强。其编程能力更是有显著提升,可处理复杂代码仓库中的跨文件、长程问题。在“看图写代码”的多模态编程场景中,豆包 2.1 Pro最新版已达

  28. BestBlogs·每日早报 BestBlogs 精选 中文

    EP177 · 可验证安全、实时语音、上线排障 · 09-16 早报

    📝 今日导语 黄仁勋把 AI 安全落到验证机制,Gemini 3.8 Live 展示实时协作,Plivo 的故障清单给出上线排障路径。 🏷 今日关键词: 黄仁勋 Gemini 3.8 Live 语音智能体排障 开放模型治理 智能体复现 📰 今日精选内容 英伟达 CEO 黄仁勋谈 AI 安全、开放模型与赢得 AI 竞赛 All-In Podcast · 视频 · 评分 92 Gemini 3.8 Live 发布:实时多模态与 Extend

  29. MarkTechPost 国际媒体 快照

    Nums AI发布Causilo:在单一模型中超越TabArena的Tabular基础模型

    Nums AI发布了Causilo,这是一个预训练的表格基础模型,用于分类和回归,具有scikit-learn接口。它在单一型号中排名第一,领先于谷歌的TabFM和LG的EXAONE Tabular。代码是Apache-2.0,而权重被授权用于非商业研究。The post Nums AI Releases Causilo:一个在单个模型中排名第一的TabArena表格基础模型appeared first on MarkTechPost

  30. 雷峰网·AI 科技评论 中文媒体 中文 快照

    奇安信斩获国家信息安全漏洞库CNNVD两项重磅荣誉

    2026年9月15日,2026年国家网络安全宣传周成都系列活动的重要组成部分——第二届基础软硬件智能化漏洞治理生态创新技术交流活动在成都成功举办。奇安信凭借在漏洞协同管理与高质量漏洞报送方面的卓越表现,一举斩获“2026年度协同软硬件漏洞管理优秀企业”、“2026年度基础软硬件漏洞报送优秀企业”两项重磅荣誉,是本次大会获奖最多的企业之一。 本次大会以“AI向善·安全有道”为主题,由国家信息安全漏洞库(CNNVD)、中国信息产业商会信息安

  31. 雷峰网·AI 科技评论 中文媒体 中文 快照

    王强宇履新百望:从发票SaaS工具,到财税垂直大模型,再到企业的Palantir

    在今天的AI行业,能谈大模型的人很多,真正把垂类大模型做出来、做进真实业务流程,并且完成从技术、产品到规模化应用闭环的人,却依然稀缺。 王强宇是卓越的实战派代表,这也是资本市场对他出任百望股份联席总经理高度关注的原因。 在加入百望股份之前,王强宇已经完整走过一次垂类大模型从0到1、再从1走向规模化应用的路径。 从连续创业,到担任钉钉副总裁,再到创办壹生检康、主导豆蔻医疗大模型及临床智能产品落地,他过去二十余年的职业经历,几乎贯穿了中国互

  32. The Verge 国际媒体 快照

    Boox Palma 3获得手写笔支持和时尚的重新设计

    Boox智能手机大小的黑白电子阅读器上一次更新近两年后,该公司宣布推出Palma 3,经过了时尚的重新设计、新功能和一些其他小型更新,这些更新可能证明其大幅提价是合理的,具体取决于您计划如何使用它。虽然Palma 2于2024年推出,售价279.99美元,但[..]

  33. 雷峰网·AI 科技评论 中文媒体 中文 快照

    510万一张!携程上架太空旅行船票:已有681人购买,还得自己买保险;娃哈哈因拖欠员工公积金被查封办公楼;华为放权!问界将由赛力斯主导

    要闻提示 1.510万一张!携程上架太空旅行船票:已有681人购买,还得自己买保险 2.娃哈哈因拖欠员工公积金被查封办公楼 3.鸿蒙智行:问界将由赛力斯主导,华为终端参与赋能 4.特斯拉Model YL后轮塌陷后续:官方修改车主手册多项车辆参数,整体缩减3-4毫米 5.苹果新系统已更新调休闹钟 6.因加大AI投入,报道称字节跳动2026上半年净利润下降 7.82%!长鑫科技利润率在全球存储芯片企业中排名第一 8.谷歌放开内部权限,允许工

  34. Simon Willison 个人技术博客 快照

    双子座现场音频

    工具:Gemini Live音频Google Gemini今天发布了3.8 Live和3.8 Live扩展思维-两种新的语音到语音模型,其形状与OpenAI的GPT-Live家族相似。我在文档中指出了GPT-6 Astra Extra High,并让它为我构建了这个Web UI以尝试新模型。您可以选择模型和语音预设,输入可选的系统提示,然后通过浏览器开始语音对话,包括在模型说话时打断模型的功能。该实现不使用库。它连接到wss:gener

  35. NVIDIA AI Blog 海外官方 快照

    “现在我们可以知道一切,做任何事情,”黄詹森在Dreamforce说道

    什么都知道做任何事情.这是英伟达创始人兼首席执行官黄延森周二在Salesforce Dreamforce上传达的信息,他与首席执行官马克·贝尼奥夫(Marc Benioff)一起登台亮相,恰逢Salesforce首个CRM推理模型Koa的发布,该模型基于英伟达Nemotron 3 Super。黄不仅仅是上台。他走进了[.]

  36. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    GitLost:我们如何诱骗 GitHub 的 AI 智能体泄露私有仓库

    📌 One-Sentence Summary Noma Labs 发现,GitHub 的智能体工作流可被公开 issue 中的纯英文提示词注入劫持,导致智能体将私有仓库内容以公开评论的形式泄露出去。 📝 Summary Noma Labs 披露了 GitLost,这是 GitHub 智能体工作流中的一个严重间接提示词注入漏洞。该工作流将 GitHub Actions 与 AI 智能体(Claude 或 Copilot)结合,智能体会读取

  37. MarkTechPost 国际媒体 快照

    NVIDIA的cuDNN图形API内部:通过cuDNN Frontend进行融合、自动调整和计划重用

    了解如何利用NVIDIA的cuDNN Frontend Shape API来构建自定义内核融合、自动调整引擎配置、FP 8风格的尾声、扩展的点产品注意力、动态形状和CUDA图形捕获。这个实用教程演示了如何在框架抽象下优化深度学习计算,同时根据PyTorch验证结果。文章Inside NVIDIA的cuDNN Shape API:使用cuDNN Frontend进行融合、自动调谐和计划重用首先出现在MarkTechPost上。

  38. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Image-to-WebDev Arena Update: GPT-6 Astra (Max) and Claude Fable 5.1 Lead the Pack

    📊 Article Meta AI Screening: 90 Source: Arena.ai(@lmarena_ai) Author: Arena.ai Category: 人工智能 Language: 英文 Read Time: 4 min Word Count: 992 Tags: AI 与智能应用 , 模型评测与基准 , 多模态 AI , OpenAI , Anthropic Read Tweet

  39. MarkTechPost 国际媒体 快照

    Google发布Gemini 3.8 Live和3.8 Live Extended Thinking,用于生产级语音代理

    谷歌发布了Gemini 3.8 Live和Gemini 3.8 Live扩展思维,这是迄今为止最先进的实时对话模型。这些模型在对话保持流畅的同时在后台执行工具和API调用,处理实时视觉输入,并在对话中在97种语言之间切换。扩展思维在人工分析的语音到语音质量指数中排名第一,为82.6,在Big Bench Audio中得分97.7%。两者今天都可以在Gemini API和Google AI Studio中以0.005美元/分钟的价格提供音

  40. The Verge 国际媒体 快照

    微软宣布将于10月7日举办Windows和Surface活动

    距离上次重大Windows活动已经过去两年多了,因此微软将于下个月前往旧金山,概述Windows和Surface设备的未来。在10月7日的一次活动中,该公司表示将举办一场“关于本地人工智能将如何塑造下一章的对话”[..]

  41. The Verge 国际媒体 快照

    如果社交媒体没有伤害孩子怎么办?

    两年前,社会心理学家乔纳森·海特(Jonathan Haidt)出版了《纽约时报》畅销书《焦虑的一代》。这本书认为,自2010年以来青少年心理健康状况显着下降在很大程度上应归咎于社交媒体和智能手机使用的兴起。它很快成为社交媒体强烈反对的核心口号。海特[…]

  42. The Verge 国际媒体 快照

    起亚的电动面包车阵容越来越有趣,揭示了PV7

    您可能不知道,但小型货车正在美国卷土重来。环顾四周,您会开始注意到这些轮子上的面包盒的价格有所上涨。2025年销量增长了21%,这表明这款不起眼的小型货车正在摆脱“不酷”的耻辱,并在厌倦SUV的公众中找到了新的粉丝。我是[.]

  43. The Decoder 国际媒体 快照

    谷歌推出Gemini 3.8 Live,以极低的成本与OpenAI的GPT-Live-1较量

    Google Deepmind发布了Gemini 3.8 Live和3.8 Live扩展思维,这是针对开发人员的两种新音频模型,在人工分析语音到语音排行榜上名列前茅。谷歌每小时语音对话的价格为1.38美元,大大低于OpenAI的GPT-Live-1,由于采用了全速,GPT-Live-1听起来应该仍然更加自然。谷歌推出Gemini 3.8 Live的文章,以一小部分的成本与OpenAI的GPT-Live-1较量,该文章首先出现在The D

  44. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    大型社会需要社会规范

    作者:Tapan Chugh、Vidushi Singh、Krish Jain|代理社会是一群人工智能代理的集合,代表目标可能仅部分一致的不同委托人,跨越信任边界自主协调。我们通过实验表明,在代理社会中,即使是诚实、有能力的代理人也常常无法通过现有的工具和消息传递基元达到令人满意的结果,并且有缺陷或恶意的代理人可能会阻止代理人。

  45. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    ScienceBuddy:交互式科学代理的循环中的自我改进

    作者:薛淑汉、钟建元、南子元|我们引入并发布ScienceBuddy,这是一个交互式科学研究工作空间,将不断改进的科学代理带入研究人员的日常工作流程中。ScienceBuddy支持研究人员执行科学任务,同时将他们的请求、反馈和执行证据转化为持续学习的任务和评估指标。其核心是循环重复

  46. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    PhysStream:具有结构化场景内存和细粒度运动控制的流物理基础视频生成

    作者:陈楚浩、彼得·旺卡、王朝阳|视频生成的交互式控制正在从粗糙的提示转向对动态场景的细粒度、物理上有意义的操纵。然而,现有的可控方法要么需要在生成开始之前完成完整的控制时间表,要么使用规定对象位置而不是物理动态的像素空间信号。为了解决这些局限性,我们提出了PhysStream,一种autoregre

  47. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    LLM什么时候应该弃权?选择性风险控制的自我质疑链

    作者:Ali Kazenol|当事实支持较弱时,大型语言模型可以产生流利的答案。本文介绍了自我提问链(CoSJ),这是一个仅限预算的框架,它使回答承诺以回答问题所需信息的明确评估为条件。我们在817项TruthfulQA多项选择验证集上评估了17种条件下的三种CoSQ变体。

  48. The Decoder 国际媒体 快照

    人工智能实验室存在政策尚未解决的数据信任问题

    OpenAI和Anthropic告诉企业客户,他们的数据不会用于培训。但是,当Anthropic表示将存储其旗舰机型Fable的使用日志30天时,Palantir、Nvidia和Booz Allen Hamilton撤回了将其用于敏感工作的计划。从董事会到研究实验室,人工智能公司仍然存在数据信任问题。文章AI实验室有一个数据信任问题,他们的政策还没有解决出现在解码器上。

  49. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    智能家居的修剪会出现哪些问题以及何时出现?评估跨体系结构和任务复杂性的LLM退化

    作者:张聪静、瓦什什塔·帕蒂尔、亨宁·兰格|修剪可以降低大型语言模型(LLM)的部署成本,但其对基于上下文的工具调用的影响仍然知之甚少。我们系统地研究了跨越密集Transformer、密集混合和混合专家(MoE)架构的四个LLM的智能家居工具调用中修剪引起的降级,以及深度、宽度、混合和专家修剪方法。p之后

  50. MIT Tech Review AI 国际媒体 快照

    圆桌会议:人工智能真的能杀死我们所有人吗?

    收听会议或观看下面世界领先人工智能实验室的员工表示,先进人工智能确实有可能摧毁人类。他们说得对吗?或者这更多的是危言耸听和炒作?观看一场对话,解开人工智能灭绝的恐惧:它们来自哪里,它们是否含有水,如果有的话,.

  51. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    LACE:动态帧率编解码器的逐层压缩

    作者:Thanapat Trachu、Samuele Cornell、William Chen|神经音频编解码器是语音语言建模的关键组件。然而,它们的高帧率导致序列长度长,从而增加了计算成本。动态帧率编解码器通过使用压缩步骤将多个帧合并在一起来降低有效帧率来缓解这一问题。然而,大多数现有方法要么在单码本编解码器上操作,要么应用单压缩

  52. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    ENCP:视觉和语言导航的场景规范化保形预测

    作者:Vicky Feliren,A. Taufiq Asyhari,Chaad Risqi U.萨普特拉|视觉-语言-导航(VLN)模型的不确定性估计是一项至关重要的任务,因为它可以帮助识别模糊和不可靠的预测,使代理能够做出更安全的导航决策。作为最先进的不确定性估计框架之一,共形预测(CP)为VLN的不确定性估计提供了一种很有前途的方法。然而,鉴于VLN代理需要Sequ

  53. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    可验证的社会推理LLM助理

    作者:Amir Taubenfeld、Zorik Gekhman、Avigail Grinstein-Dabush| LLM助理被广泛用于日常社会咨询,但在这种咨询环境中评估他们的社会推理仍然具有挑战性,因为(i)它需要设置助理从主观用户叙述中了解社会情况,以及(ii)社会属性,例如其他人的意图,通常缺乏可验证的基础事实。为了应对这些挑战,我们引入了收件箱,

  54. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    FreqSpaNet:用于物理层硬件完整性检测的SPF频率和空间学习

    作者:黄晓轩、徐锦龙、王一哲|未经授权的硬件替换可能会保留无线设备的逻辑身份,同时改变其物理实现,从而对硬件完整性验证构成挑战。空间频率极化指纹(SFPF)捕获多个频率和方向上的设备相关响应,但它们的频率和空间维度表现出不同的结构依赖性。W

  55. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    LimiX-2:面向通用结构化数据智能的上下文机制网络

    作者:张兴轩、任刚、昊源|我们引入LimiX-2,这是LimiX系列中的一种新模型,通过在我们之前建立的缩放定律指导下的模型和数据缩放来开发。LimiX-2采用上下文机制网络(CMN)范式,并使用上下文条件掩蔽建模(CCMM)进行预训练。CMN将上下文学习的组织原则从以目标为中心的预测转变为以机制为导向的联合模式

  56. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    介绍 Gemini 3.8 Live 和 3.8 Live Extended Thinking

    📌 One-Sentence Summary Google 推出两款新模型,Gemini 3.8 Live 和 3.8 Live Extended Thinking,通过增强的推理、视觉接地和多步任务完成能力,提升了实时语音交互体验,服务于开发者和消费者。 📝 Summary 新的 Gemini 3.8 Live 模型代表了语音到语音 AI 的重大进步,提供了近乎实时的推理和流畅的对话。标准 3.8 Live 模型针对成本效率和可扩展性

  57. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Gemini 3.8 Live:支持 97 种语言的 SOTA 音频模型,带异步工具调用

    📌 One-Sentence Summary NVIDIA 发布 Gemini 3.8 Live,这是一款顶级的音频模型,支持 97 种语言、无缝语言切换、异步工具调用,并具备更高的性能和竞争力的价格。 📝 Summary Gemini 3.8 Live 的发布标志着音频 AI 技术的重大进步。该模型支持惊人的 97 种语言,允许在对话中动态、实时地切换语言。此外,它还具备异步工具调用功能,使模型能够在保持连续对话流程的同时,获取实时信

  58. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    介绍全新 Gemini 音频模型:实时协同与深度思考

    📌 One-Sentence Summary Google AI 发布 Gemini 3.8 Live 和 3.8 Live Extended Thinking,这两款先进模型让用户与 AI 的对话更加自然流畅,支持跨语言交流、视觉理解和复杂任务执行。 📝 Summary 该推文宣布推出两款新 AI 音频模型:Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking。这些模型旨在通过整合声音

  59. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    NVIDIA Groq 3 LPX 确定性执行如何驱动 NVIDIA Vera Rubin 上的低功耗高交互性推理

    📌 One-Sentence Summary NVIDIA Groq 3 LPX 利用确定性执行实现精确的电流需求预测,从而进行主动电压控制和时钟周期合成,显著降低功耗开销,同时保持高交互性性能。 📝 Summary NVIDIA Groq 3 LPX 加速器通过确定性执行模型实现功耗效率,该模型允许编译器创建操作和数据移动的周期精确调度。这种可预测性支持两项关键技术:先发制人功率(PEP),用于在需求激增前调整电压供应;以及时钟周期合

  60. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    NVIDIA NVLink 6 如何为 AI 工厂提供多层可靠性

    📌 One-Sentence Summary NVIDIA NVLink 6 通过结合硬件级错误校正、无损流控制和软件驱动的恢复机制,确保大规模 AI 集群的持续运行,并隔离和缓解瞬时故障。 📝 Summary 本文详细介绍了 NVIDIA NVLink 6 的全面可靠性架构,该架构旨在支持高可用性的 AI 工作负载。它涵盖了物理层使用前向错误校正和物理层重试来校正信号错误,链路层使用基于信用的流控制来防止丢包,以及应用层使用影子引擎恢

  61. AWS ML Blog 海外官方 快照

    使用Amazon Bedrock提示缓存优化成本和延迟

    当您重复向基金会模型发送相同的上下文时,Amazon Bedrock中的提示缓存可以将输入令牌成本降低高达90%。这篇文章使用Converse API介绍了六种实用的提示缓存场景:消息内容、系统提示符、工具定义、混合TLR、租户隔离和LangChain集成。

  62. The Verge 国际媒体 快照

    俄勒冈小道如何成为一代偶像

    无论您是在教室后面还是在家里的电脑上玩它,如果您是过去30年的孩子,您几乎肯定是在玩《俄勒冈小径》长大的。在《版本历史》第五季首映式上,我们无所畏惧的旅行车领袖大卫·皮尔斯(David Pierce)与游戏记者克里斯(Chris)一起加入了游戏[.]

  63. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    你的智能体出色完成了任务。它还能再来一次吗?

    📌 One-Sentence Summary 文章介绍了一套诊断与指南系统,用于衡量并将 LLM 智能体的平均准确率与单任务可靠性之间的一致性差距减半,同时不降低平均性能。 📝 Summary 文章引入了「一致性差距」这一概念,即基准测试中 Mean@k(平均通过率)与 Pass^k(全部 k 次运行均成功的任务比例)之间的差异。文章解释,这一差距源于智能体轨迹中决策点上的平坦概率分布,使得即便使用固定随机种子,智能体的行为也难以预测。