AI 日报hiw3c.com

2026-10-01全球 AI 要闻精选,来自 30+ 信息源

聚合官方博客 · 权威媒体 · 深度通讯 · 学术信号。
只做索引,不做转载,标题与链接均指向原始发布方。

  1. BestBlogs·每日早报 BestBlogs 精选 中文

    EP192 · Gemini Argon 推进长程任务、Anthropic 衡量机器人工作、Eleven v4 升级语音

    📝 今日导语 Gemini Argon 推进长程任务,Anthropic 衡量机器人工作,Eleven v4 升级语音:看懂落地取舍。 🏷 今日关键词: Gemini 4 Argon 机器人就业 Eleven v4 发布 Harness AI 研发效能 📰 今日精选内容 Gemini 4 Argon:前沿智能的新阶段 Google DeepMind · 文章 · 评分 93 我们能预测机器人将从事的工作吗? Anthropic Rese

  2. The Verge 国际媒体 快照

    Vivo的X Fold 6意外感觉像是复古

    发布日历的一个奇怪之处是,当Vivo的X Fold 6今年6月在中国推出时,它只是另一款可折叠的产品。现在它已经准备好在全球发布了,但尺寸和长宽比感觉有点过时。X Fold 6与Vivo之前的可折叠产品以及大多数其他[.]

  3. The Verge 国际媒体 快照

    埃隆·马斯克(Elon Musk)的Grokipedia采用“全新”的设计

    Grokipedia是SpaceXAI与维基百科的人工智能竞争对手,最近开始再次整合编辑内容,今天,作为v0.3更新的一部分,它进行了一些设计调整,包括新的徽标以及更新其主页和实时编辑页面。SpaceXAI设计主管Benji Taylor称其为“新刷新的Grokipedia”。“Grokipedia的旧主页几乎是[.]

  4. The Verge 国际媒体 快照

    全新而庞大的派拉蒙迎来了新的联合首席执行官

    派拉蒙将在与华纳兄弟探索频道1100亿美元的合并结束之前任命一位新的联席首席执行官。美泰前董事长兼首席执行官伊农·克雷兹(Ynon Kreiz)将加入派拉蒙,与董事长兼首席执行官大卫·埃里森(David Ellison)一起领导。派拉蒙表示,“埃里森将专注于公司的长期战略、创意愿景和方向,包括其[.]

  5. The Decoder 国际媒体 快照

    Google Gemini 4 Argon缩小了与OpenAI和Anthropic的差距,但没有明显领先

    Gemini 4 Argon是谷歌七个多月来推出的首款前沿型号。它在独立测试中与GPT-6 Astra相匹配,但无法跟上Anthropic的Claude Opus 5.5。每个代币的价格很低,但Argon每个任务消耗的代币数量是Astra的两倍多。选择测试人员首先获得访问权限,随后才获得API和付费层。文章Google Gemini 4 Argon缩小了与OpenAI和Anthropic的差距,但没有明显领先,首先出现在The Deco

  6. Simon Willison 个人技术博客 快照

    他建造了这座城市

    我今天参观了纽约市博物馆,并看到了《他建造了这座城市:乔·麦肯的模型》,这是这座城市在21年内用轻木和纸板建造的50 x27英尺的模型。这超出了我已经很高的期望。该展览将于10月12日闭幕,因此如果有机会,您绝对应该优先观看。标签:博物馆,纽约

  7. MarkTechPost 国际媒体 快照

    OpenAI以Astra代币价格的五分之一发布GPT-6.1 Sol:近Astra编码和计算机使用

    OpenAI于2026年9月29日发布了GPT-6.1 Sol,是GPT-6 Sol的升级。它在代理编码、计算机使用和专业工作方面达到了接近Astra的结果,价格仅为Astra代币价格的五分之一。每百万个代币的投入成本为2美元,输出成本为10美元,缓存的投入成本降至0.10美元。它现在可以通过OpenAI API、ChatGPT Work和Codex提供。OpenAI发布GPT-6.1 Sol:Near-Astra编码和计算机使用的价格

  8. The Verge 国际媒体 快照

    谷歌宣布双子座4,并表示它是如此强大,只有值得信赖的网络防御者可以拥有它现在

    谷歌今天公布了其下一个人工智能前沿模型,称之为Gemini 4 Argon。据首席人工智能架构师兼谷歌DeepMind高级副总裁Koray Kavukcuoglu称,新模型在现实世界的软件工程、法律和金融等企业知识工作以及网络安全防御等复杂工作流中提供了“前沿性能”。但该公司限制访问[…]

  9. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Gemini 4 Argon (High) 登顶 Text Arena,成本效率实现突破性领先

    📌 One-Sentence Summary Google DeepMind 的 Gemini 4 Argon (High) 以 1525 分登顶 Text Arena,混合成本仅 $8/MToken,在编程、指令遵循、创意写作及所有职业领域均居首位。 📝 Summary Arena.ai 宣布,Gemini 4 Argon (High) 以 1525 分登顶 Text Arena,并以 1679 分位列 Code Arena: Web

  10. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    Gemini 4 Argon:我们 frontiers 智能时代的下一章

    📌 One-Sentence Summary Google 宣布 Gemini 4 Argon,一款输出上限达 100 万 token 的 frontier 模型,在 DeepSWE、Vals Index 和 CWE-bench 上的表现居首,将首先通过 Fairwind Program 提供给值得信赖的网络安全防御者。 📝 Summary Google DeepMind 推出 Gemini 4 Argon,这是其下一代 frontie

  11. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Gemini 4 Argon 前沿模型正式发布

    📌 One-Sentence Summary Google 推出全新前沿模型 Gemini 4 Argon,首先面向网络安全防御人员开放,其推广期价格为每百万输入 token $2,每百万输出 token $10。 📝 Summary Google 推出了其最新的前沿模型 Gemini 4 Argon。该模型从今天起首先向网络安全防御者(cyber defenders)推送,并计划尽快扩大发布范围。公告中明确了推广期间的定价:输入 $2

  12. The Decoder 国际媒体 快照

    OpenAI和Synopsys合作构建人工智能模型,像经验丰富的工程师一样设计芯片

    OpenAI和Synopsys正在构建GPT-Synopsys,这是一种用于芯片设计的专用AI模型。它的目的是像经验丰富的工程师一样操作Synopsys的EDA工具,并自行优化设计。半导体客户的早期测试已经在进行中。OpenAI也可能利用这一合作关系来推进自己的芯片开发。OpenAI和Synopsys合作构建一个人工智能模型,像经验丰富的工程师一样设计芯片的文章首先出现在The Decoder上。

  13. The Decoder 国际媒体 快照

    谷歌放弃了Gems for Skills,加入OpenAI和Anthropic的行列,转向代理就绪提示格式

    谷歌正在双子座聊天中将Gems替换为“Skills”。技能是用户通过输入“/”来调用或Gemini自动运行的详细、可重复使用的提示。该格式基于Anthropic的开放标准。宝石将从11月开始逐步淘汰,现有的宝石将自动迁移。谷歌放弃了Gems for Skills,加入OpenAI和Anthropic的行列,转向代理就绪提示格式的文章首先出现在The Decoder上。

  14. The Verge 国际媒体 快照

    人工智能电子鸡来了

    虽然人工智能已经在人们的手机和电脑上取得了长足的进步,但它在专用设备上基本上失败了。但明年,两家主要人工智能公司Meta和OpenAI将尝试改变这一现状。他们显然在押注类似的道路:用可爱的软件代理测试对物理硬件的兴趣。“硬件是[.]

  15. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    半事实信用增强政策优化

    作者:潘俊树、付志章、黄树林|具有可验证奖励的强化学习(RLVR)提高了大型语言模型(LLM)的推理能力,但它们的预测仍然对任务无关的提示特征敏感。我们调查这种敏感性,通过半事实的即时干预,保留潜在的问题及其答案。我们的分析揭示了代币水平敏感性和

  16. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    多模式临床诊断的排名感知提示优化

    作者:田霞、刘明昊、梁亦青|多模态大型语言模型(MLLM)正在快速推进临床诊断,但其适应管道仍然以基于准确性的目标为基础。临床数据是严重的类别不平衡:一个恒定多数的预测可以得分超过90%的准确性,而临床上是无用的。因此,我们评估和优化AUROC,这是一种将积极与消极进行排名的无阈值评分

  17. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    删除计时快捷方式改善无创大脑到文本

    作者:Dulhan Jayalath,Oiwi Parker Jones|我们发现,在没有任何大脑数据的情况下,从非侵入性大脑记录中解码单词的主要改进在很大程度上是可重复的。在d ' Ascoli等人(2025)颇具影响力的工作中,感知连续语音的受试者的大脑活动时间序列被分割成从每个单词开始的固定长度窗口。然后,神经网络生成对

  18. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    ViTeX-Bench:高保真视频场景文本编辑基准测试

    作者:陈兴浩、高翔波、余Jiongze|最近的视频生成越来越真实和可控,但视频编辑仍然不够发达,特别是对于必须保留原始场景动态的精确本地编辑。视频场景文本编辑替换场景表面上的文本,例如店面标志、白板和产品标签,同时保留周围的内容、运动和相机动态。虽然现场特

  19. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    图像分类器是高效的自我监督视频表示学习者

    作者:Owais Iqbal、Sudipta Sarkar、Shyam Marjit|我们引入VideoMSN,这是一个Masked Siamese Network框架,用于在视频中进行高效的自我监督时空表示学习。我们不再依赖重型3D架构或基于重建的自动编码器来使用未标记的数据进行学习,而是通过将视频表示为超级图像来重新利用标准图像Vision Transformers,这些图像是由从视频中采样的帧组成的网格。Fr

  20. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    EvoDuet:面向科学发现的Web搜索和任务求解的双层次协同进化

    作者:Young-Jun Lee、Jinheon Baek、Soyeong Jeong|当进展需要模型缺乏的外部知识时,使用大型语言模型(LLM)的进化搜索可能会停滞。提供相关文档有所帮助,但只需添加网络搜索工具就可以随着解决方案的变化而继续返回相同的页面。我们引入EvoDuet,这是一种双层优化方法,可以通过固定模型参数共同进化解决方案和搜索查询。在每次迭代中,

  21. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    在DP-Singapore下,权重绑定对于私人环境中仅解码器的LLM仍然有利吗?

    作者:Razan El Mais、Ali Chehab、Ibrahim Issa|差异私有随机梯度下降(DP-BCD)是大型语言模型(LLM)的隐私保护微调的领先方法。许多仅限解码器的LLM在输入和输出嵌入之间采用权重绑定,这是一种设计选择,最初是为了参数效率和改进非私有环境中的语言建模性能而引入的。然而,体重束缚的影响

  22. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    涡轮增压器:实例自适应优化

    作者:张Tunyu Zhang、Hao Wang、Kai Xu|自动搜索有效的安全带是使代理能够循环自我改进的重要一步。现有的工具优化通常会产生一个全局工具,该工具在任务实例中统一应用。然而,平均效果良好的安全带可能并非对每个实例都是最佳的。我们引入了TurboSYS,这是一个可以适应全球优化的框架

  23. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    WorldAuditBench:具有多模式代理的交互式3D世界审计

    作者:姜紫艳、杨静波、季家宝|随着交互式3D世界越来越多地用于研究智能行为,开发有效的管道来识别这些模拟环境中的异常变得非常重要,例如浮动对象,可穿越的墙壁或与周围场景不一致的对象。包括视觉语言模型(VLM)和视觉语言动作模型(VLA)在内的多模式人工智能系统已经表明

  24. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    Cogentic:用于自动证据发现的多智能体规划

    作者:杨蔡、维尼特·古普塔、江彦晨|我们介绍了Cogentic,这是一种多代理工具,用于自动发现开放研究问题的证据。虽然前沿语言模型可以在一次尝试中产生强大的数学思想,但对于需要探索多个竞争猜想、克服微妙的技术障碍并在很长一段时间内保持中间进展的开放问题,单次尝试生成通常不足以

  25. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Runway Ads:自主营销引擎

    📌 One-Sentence Summary Runway 推出了 Runway Ads,一种能够显著扩大广告规模并提升回报率的自主营销引擎。 📝 Summary Runway 推出了专为性能营销设计的自主引擎。自 7 月以来,该公司利用该工具将广告量扩大了 1000%,同时使广告支出回报率(ROAS)翻倍,转化率提升了 34%,获客成本降低了 41%,助力公司实现年度经常性收入(ARR)。目前正向特定合作伙伴推出,随后将广泛开放。 📊

  26. The Decoder 国际媒体 快照

    Meta通过称其人工智能数据中心为实验逃避了数十亿美元的美国税收

    Meta将其人工智能数据中心归类为“试点模型”,将英伟达芯片归类为实验材料,以节省数十亿美元的联邦税收。仅2025年,这一数字就达到了39亿美元。据《纽约时报》报道,这项税收抵免可以追溯到1981年,就连Meta自己的会计师也认为这一策略具有法律风险。扎克伯格本人在2025年1月表示,这些数据中心现在被设计为实验性的,将“推动我们的核心产品和业务。“Meta通过称其人工智能数据中心实验来逃避美国数十亿美元税收的文章首先发表在The De

  27. The Verge 国际媒体 快照

    以下是人工智能领导人对特朗普新安全计划的看法

    周二与大型科技领导人共进晚餐后,唐纳德·特朗普总统以典型的方式回答了记者有关他的人工智能公告的问题。他表示,他之前关于人工智能安全性的担忧是民主党炮制的“骗局”的说法不再适用,因为他已将该技术更名为“超级智能”。“他[.]

  28. The Verge 国际媒体 快照

    这个博客可以帮助你更好地排便

    这是Optimizer,由Verge高级评论员Victoria Song发送的每周时事通讯,剖析和讨论了最新的小发明和药剂,发誓它们将改变你的生活。在此处选择优化器。“我会用这个便便的香蒜酱炸开你的屁股,”我手机扬声器里传来一个平静的Z世代声音。“而且[.]

  29. The Verge 国际媒体 快照

    华硕不愿透露如何逃脱美国路由器禁令

    今年春天,美国禁止了所有未来外国制造的消费者路由器--实际上是所有未来的路由器--除非其制造商能够1)说服美国政府它们不会构成国家安全威胁,并且2)提交“一份详细的、有时限的计划来建立或扩大在美国的制造业。“截至9月9日,华硕现在[.]

  30. The Verge 国际媒体 快照

    ‘微软游戏主管表示Xbox不出售

    Xbox首席执行官阿莎·夏尔马否认了有关微软正在考虑出售其Xbox业务的报道。《信息报》6月份报道称,微软首席执行官萨蒂亚·纳德拉(Satya Nadella)和首席财务官艾米·胡德(Amy Hood)一直在考虑完全分拆Xbox,并于本月早些时候报道称,两位高管“最近支持夏尔马彻底改革……”

  31. The Decoder 国际媒体 快照

    FTC因消费者保护问题对OpenAI、Anthropic和其他人工智能实验室展开全面调查

    FTC正在正式调查OpenAI、Anthropic和其他领先的人工智能实验室是否存在违反消费者保护规定的行为。该机构计划通过具有法律约束力的要求强制文件移交和行政证词。这项调查在Hugging Face黑客事件发生之前就已经开始,远远超出了联邦贸易委员会早些时候要求公司为其代理人行为承担责任的努力。FTC因消费者保护问题对OpenAI、Anthropic和其他人工智能实验室展开全面调查的文章首先发表在The Decoder上。

  32. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    我们能预测机器人将从事的工作吗?

    📌 One-Sentence Summary 安踏克的机器人暴露指数发现机器人已能执行 74%的体力任务(占美国 34%的工作时间),但成本竞争力仅达到 0.3%的任务,且要达到 10%的采用率需要 40 年的时间,这表明自动化将缓慢进行,且集中在驾驶和仓库工作领域。 📝 Summary 安踏克的研究人员利用克劳弗构建了机器人暴露指数,对 7594 个体力职业任务进行了评分,采用四级细则(E0 至 E3)基于完成任务所需的环境。他们发现

  33. Microsoft Research 海外官方 快照

    预测电网的空间天气风险

    极端的空间天气事件可能会破坏地球上的电力系统,降低GPS的准确性和卫星的运行。一种新的机器学习系统可以在风暴到来前30-60分钟预测可能发生损害的地方。预测电网空间天气风险的帖子首先出现在微软研究中心。