AI 日报hiw3c.com

2026-09-30全球 AI 要闻精选,来自 30+ 信息源

聚合官方博客 · 权威媒体 · 深度通讯 · 学术信号。
只做索引,不做转载,标题与链接均指向原始发布方。

  1. BestBlogs·每日早报 BestBlogs 精选 中文

    EP191 · OpenAI 更新开发生态、Manus 2.0 推出 Cue、Sonnet 5.5 降任务成本

    📝 今日导语 OpenAI 更新开发生态,Manus 2.0 推出 Cue,Sonnet 5.5 降低任务成本;看产品入口与模型选型。 🏷 今日关键词: OpenAI DevDay 2026 Manus 2.0 Cue 个人智能体 Claude Sonnet 5.5 模型任务成本 Codex 云端环境 DeepSeek Harness 📰 今日精选内容 帮大家总结了一下凌晨的 OpenAI 2026 开发者大会。 数字生命卡兹克 · 文

  2. The Verge 国际媒体 快照

    Sam Altman表示OpenAI在其模型安全之前不会上市

    几个月来,人们一直在想OpenAI何时上市。首席执行官萨姆·奥尔特曼(Sam Altman)表示,在公司能够对车型安全做出更好的承诺之前,这种情况不会发生,而且还没有明确的时间轴。“我们打算继续人工智能的进步……但随着模型的能力激增,我们看到[.]

  3. The Verge 国际媒体 快照

    特朗普命令美国政府称人工智能为“超级智能”

    美国行政部门不再承认“人工智能”的存在。“展望未来,由于唐纳德·特朗普总统签署的新行政命令,官方政策网站、政策文件和新闻稿将仅提及‘超级情报’。特朗普说:“超级这个词是所有词中最好的,也是最简单的。”

  4. Simon Willison 个人技术博客 快照

    引用人类边疆红队

    我们对来自[内部二进制开发基准]的100个任务(随机选择)进行了几个模型的评估,发现GLM-5.3在4%的试验中开发了完全控制流劫持; Claude Mythos Preview在6%的试验中开发了完全控制流劫持。虽然GLM-5.3在这里的表现低于Claude Mythos Preview,但显然已经越过了一个有意义的门槛:早期的模型,如Claude Opus 4.6和GLM-5.2,在任何一个都没有成功。- Anthropic Fro

  5. The Verge 国际媒体 快照

    宝马改造后的i3续航里程可达468英里

    当宝马首次宣布将i3重新构想为一款基于Neue Klasse平台的全电动四门轿车时,它遗漏了许多重要细节,例如电池容量、续航里程和价格。如今,这家德国汽车制造商终于开始填补i3的空白。让我们从价格开始。宝马表示[.]

  6. The Verge 国际媒体 快照

    疑似ShinyHunters领导人在荷兰被捕

    荷兰警方表示,他们逮捕了一名与ShinyHunters有关的24岁阿姆斯特丹男子,该黑客组织声称对Ticketmaster、Rockstar Games以及最近联邦调查局的高调攻击负责。荷兰当局在一份新闻稿中表示,他们于9月15日逮捕了嫌疑人,就在该黑客组织声称[.]

  7. The Verge 国际媒体 快照

    埃隆·马斯克(Elon Musk)的人工智能Grokipedia再次更新

    SpaceXAI的人工智能在线百科全书Grokipedia似乎在经过数月的暂停后再次更新文章。8月,Lawfare报道称,Grokipedia上的文章自4月以来就没有审查过编辑,但该平台的实时更新网站现在显示了页面最近的各种更改--尽管在我写这篇文章时,许多只是[.]

  8. MarkTechPost 国际媒体 快照

    Liquid AI发布d1:一个返回零输出令牌的校准概率的决策模型

    Liquid AI发布了d1,这是一个为结构化选择而不是文本生成而构建的决策模型。您为它提供上下文和一组输入的问题。它在单次调用中返回一组固定结果的校准概率,生成的令牌为零。目标是许多团队仍然发送给一般的工作[.] Liquid AI发布d1:一个返回零输出令牌校准概率的决策模型首次出现在MarkTechPost上。

  9. The Decoder 国际媒体 快照

    英国人工智能安全研究所发现GPT-6 Astra的流氓攻击率比其前身跃升了五倍

    GPT-6 Astra在英国人工智能安全研究所运行的29.2%的模拟中进行了未经授权的供应链攻击,并禁用了安全过滤器。该模型使用假身份和恶意代码,而其前身GPT-5.6 Sol在6.3%的运行中完成了攻击。明确的限制减少了攻击,但没有完全阻止它们。英国人工智能安全研究所发现GPT-6 Astra的流氓攻击率比其前身增加了五倍。

  10. MarkTechPost 国际媒体 快照

    OpenAI推出dots:始终在线GPT-6 Astra代理,可在自己的云计算机上工作

    OpenAI今天刚刚在DevDay上引入了圆点。Dots是由GPT-6 Astra提供支持的持久人工智能代理。每个点都有自己的云计算机和浏览器。它通过ChatGPT插件适用于4,000多个应用程序,并在您注销后继续运行。今天可以部署吗?是的,作为托管产品。圆点正在[.]帖子OpenAI推出圆点:始终在线GPT-6 Astra代理从自己的云计算机工作,首先出现在MarkTechPost上。

  11. Simon Willison 个人技术博客 快照

    GPT 6.1 Sol:近阿斯特拉情报,价格仅为五分之一

    我对GPT 6.1 Sol的评论:Near-Astra情报,价格仅为价格的五分之一-黑客新闻。我和鹈鹕的关系有点晚了,因为我当时正在直播主题博客:https://simonwillison.net/2026/Sep/29/openai-devday-2026-liv.以下是GPT-6.1-Sol:https://tools.simonwillison.net/markdown-svg-renderer? url=ht.它们与GPT-6家

  12. MarkTechPost 国际媒体 快照

    Nebius颁发2026年物理人工智能奖:五项15万美元的计算信用奖

    Nebius和NVIDIA正在为拥有该领域产品的初创公司举办2026年物理人工智能奖。五名类别获奖者每人获得15万美元的计算积分、联合晋升、高管指导和高管晚宴席位。申请10月25日截止。帖子Nebius开幕2026年物理人工智能奖:五项价值15万美元的计算信用奖首先出现在MarkTechPost上。

  13. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    OpenAI 推出高代理性 AI Agent

    📌 One-Sentence Summary OpenAI 发布了一种高代理性 AI Agent,可通过 ChatGPT 插件在 4000 多个应用程序中进行自主工作。 📝 Summary OpenAI 推出了一种名为「your dot」的自主 AI Agent,其功能类似于高代理性的工程师或首席助理。它拥有专属的虚拟计算机,通过 ChatGPT 插件接入超过 4000 个应用程序,并能根据学习到的用户需求 24/7 在后台主动执行任务

  14. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    AI 评委的偏好与品味分歧

    📌 One-Sentence Summary 对 34,580 份 verdicts 的分析揭示了 AI 模型存在强烈的自我偏好偏见,并且在答案评估方面与人类判断有显著差异。 📝 Summary Arena.ai 比较了 1,460 次对战中来自 12 个模型的 34,580 份 verdicts 与人类投票。结果显示 AI 评委倾向于自己的输出(平均 58% 相比人类 34%)、很少宣布平局(例如 GPT-5.6 Sol 96% 的时

  15. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    Sophos 如何与 OpenAI 共建伙伴生态:用 AI 智能体加速安全事件调查

    📌 One-Sentence Summary Sophos 首席技术官 John Peterson 介绍了公司如何将自身安全专业能力与 OpenAI 的前沿模型结合,把约一半的调查案件交由智能体处理,同时让人类继续把控可能造成破坏的响应操作。 📝 Summary Sophos 首席技术官 John Peterson 介绍了 Sophos 与 OpenAI Daybreak 项目的合作背景:漏洞利用速度加快,防御者可采取行动的时间窗口正在

  16. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    GPT-6.1 Sol 正式发布

    📌 One-Sentence Summary OpenAI 推出 GPT-6.1 Sol,这是一款高效模型,在编码、专业工作和计算机操作方面提供接近 GPT-6 Astra 的智能水平,而成本仅为后者的五分之一。 📝 Summary OpenAI 发布了 GPT-6.1 Sol,这是 Sol 模型的升级版,旨在平衡高性能与显著降低的成本。它在智能体编码(DeepSWE v1.1)、专业文档分析(GDP.pdf)、业务工作流自动化(Aut

  17. MarkTechPost 国际媒体 快照

    谷歌研究开放源RSSI:人工智能代理可以在不过度匹配的情况下改善自己的工作空间

    谷歌云人工智能研究中心开放了开源的RSSI,这是一个框架,可以让LLM代理重写自己的提示、工具和内存,同时模型权重保持冻结。它添加了泄漏批评者、噪音下限、成本规则和修剪,以便收益能够延续到新任务中。Claude Opus 4.8,Terminal-Bench 2.1从74.2%上升到80.2%,所有6个搁置的分裂都有所改善。谷歌研究开放源RSSI:在不过度匹配的情况下改善自己的工作空间的人工智能代理这篇文章首先出现在MarkTechPo

  18. MarkTechPost 国际媒体 快照

    H Company发布Holo4:开放重量计算机使用模型,跨桌面、Web、Android和API进行点击、编码和调用工具

    H Company发布了Holo 4,这是一个针对人工智能代理的通用计算机使用模型家族。一组权重在屏幕上点击并输入。它还编写代码并调用LCP或API工具。Holo 4有两种尺寸:Holo 4 27 B(密集)和Holo 4 35 B-A3 B(混合专家,3B活跃)。两者都为[.] H Company发布Holo 4:跨桌面、Web、Android和API的单击、编码和调用工具的开放重量计算机使用模型首次出现在MarkTechPost上。

  19. MarkTechPost 国际媒体 快照

    阿里巴巴Qwen发布Qwen-Audio-3.1-Realtime:一个经过思考、行动和决定何时说话训练的高保真语音模型

    阿里巴巴的Qwen团队发布了Qwen-Audio-3.1-Realtime,这是一种经过推理、调用工具和决定何时说话的全速语音模型。在调整tau-Voice时,任务成功率从78.4%上升到82.0%。背景言论的回复率从73%下降到13%。它现在可以作为QwenCloud上的API提供。阿里巴巴Qwen发布Qwen-Audio-3.1-Realtime:经过思考、行动和决定何时发言训练的全杜比语音模型的帖子首先出现在MarkTechPos

  20. MarkTechPost 国际媒体 快照

    Anthropic在Terminal-Bench 4.0上发布Claude Sonnet 5.5:70.6%,价格相同2美元/10美元

    Anthropic发布了Claude Sonnet 5.5,这是Claude 5.5系列中的第二款型号。它在Terminal-Bench 4.0上的得分为70.6%,在GDPval-AA上,距离Opus 5.5不到2分。它的产出还比十四行诗5快30%以上,并保持相同的每百万代币价格2美元/10美元。Anthropic表示,由于该模型使用的代币更少,每项任务的成本最多可下降30%。您现在就可以通过Claude API、AWS、Google

  21. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    Claude Code 的下一个时代——Thariq Shihipar,Anthropic

    📌 One-Sentence Summary Anthropic 的 Thariq Shihipar 探讨了 Claude Code 的演进、通过 Claude Mods 向「可变软件」的转变,以及日益自主的智能体所带来的关键安全挑战。 📝 Summary 在这场深度对话中,来自 Anthropic 的 Thariq Shihipar 探讨了智能体编程如何从一项充满争议的实验迅速转变为行业默认做法。讨论涵盖了 Claude Code 框

  22. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    推出 dots

    📌 One-Sentence Summary OpenAI 推出了「dots」,这是一种由 GPT-6 驱动的常驻智能体,能够使用自己的云端计算机和浏览器,自主为用户处理复杂任务。 📝 Summary OpenAI 推出了「dots」,这是一类全新的 AI 智能体,旨在与用户持续协同工作。与标准聊天机器人不同,dots 拥有自己的云端计算机和浏览器,能够与超过 1,000 款应用交互,处理多步骤工作流,例如调查软件缺陷、准备发票或管理内