AI 日报hiw3c.com

2026-09-30全球 AI 要闻精选,来自 30+ 信息源

聚合官方博客 · 权威媒体 · 深度通讯 · 学术信号。
只做索引,不做转载,标题与链接均指向原始发布方。

  1. The Verge 国际媒体 快照

    The AI Tamagotchis are coming

    While AI has made plenty of inroads on people's phones and computers, it's largely failed in dedicated devices. But over the next year, two major AI companies, Meta and OpenAI, will attempt to change that. And they're ap

  2. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Runway Ads:自主营销引擎

    📌 One-Sentence Summary Runway 推出了 Runway Ads,一种能够显著扩大广告规模并提升回报率的自主营销引擎。 📝 Summary Runway 推出了专为性能营销设计的自主引擎。自 7 月以来,该公司利用该工具将广告量扩大了 1000%,同时使广告支出回报率(ROAS)翻倍,转化率提升了 34%,获客成本降低了 41%,助力公司实现年度经常性收入(ARR)。目前正向特定合作伙伴推出,随后将广泛开放。 📊

  3. The Verge 国际媒体 快照

    This blog could help you poop better

    This is Optimizer, a weekly newsletter sent from Verge senior reviewer Victoria Song that dissects and discusses the latest gizmos and potions that swear they're going to change your life. Opt in for Optimizer here. "I w

  4. Microsoft Research 海外官方 快照

    Forecasting space weather risks on power grids

    Extreme space-weather events can damage power systems on Earth and degrade GPS accuracy and satellite operations. A new machine learning system can predict where damage is likely to occur 30-60 minutes before a storm arr

  5. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    SynthID Bio:合成生物学的水印方法

    📌 One-Sentence Summary Google DeepMind 推出了 SynthID Bio,这是一系列通过在合成蛋白质序列和 3D 结构中嵌入不可见签名的水印方法,旨在增强生物安全性和科学完整性。 📝 Summary Google DeepMind 发布了 SynthID Bio,这项专为合成生物学设计的技术旨在解决 AI 生成设计带来的挑战。该工具通过两种方式工作:在序列中微妙地引导氨基酸的选择(使用 Protein

  6. OpenAI News 海外官方

    Helping small businesses put AI to work

    OpenAI is partnering with America’s SBDC to expand hands-on AI training and local support for small businesses, alongside a new report on how small teams are using AI.

  7. BestBlogs·每日早报 BestBlogs 精选 中文

    EP191 · OpenAI 更新开发生态、Manus 2.0 推出 Cue、Sonnet 5.5 降任务成本

    📝 今日导语 OpenAI 更新开发生态,Manus 2.0 推出 Cue,Sonnet 5.5 降低任务成本;看产品入口与模型选型。 🏷 今日关键词: OpenAI DevDay 2026 Manus 2.0 Cue 个人智能体 Claude Sonnet 5.5 模型任务成本 Codex 云端环境 DeepSeek Harness 📰 今日精选内容 帮大家总结了一下凌晨的 OpenAI 2026 开发者大会。 数字生命卡兹克 · 文

  8. 雷峰网·AI 科技评论 中文媒体 中文 快照

    豆包支持出行服务:一句话订机票、火车票,打车导航全覆盖

    国庆黄金周前夕,豆包宣布支持多种出行服务,用户现已可通过豆包一站式完成机票预订、火车票购买、打车及路线导航等多种出行需求,覆盖从长途交通到市内出行的全场景。 据了解,豆包此次的功能升级主要围绕用户出行核心需求,在酒店预订和餐饮预订的基础上,新增了包括机票预订、火车票预订,打车出行和导航等多项出行服务。用户只需在豆包对话中以自然语言描述出行需求,例如“帮我订一张明天从北京到上海的机票”或“叫一辆车去首都机场”,豆包即可自动识别意图并完成相

  9. 雷峰网·AI 科技评论 中文媒体 中文 快照

    首批搭载第六代骁龙 8 超级至尊版,iQOO16 今日发布并开售

    2026 年 9 月 29 日,深圳 —— iQOO16 正式发布。新机首批搭载第六代骁龙 8 超级至尊版,全球首发由 iQOO 和三星显示联合研发的 2K 165Hz 三星珠峰屏,并基于 iQOO 搭建的 “3+2游戏技术版图”,在视效、操控、直播和跨端游戏体验上全面升级,成为性能、屏幕、游戏体验、系统和综合配置全面超 Pro Max 的性能旗舰。 不久前,刚结束 2026 年亚运会比赛的 iQOO16 产品体验官潘展乐表示自己曾是

  10. 雷峰网·AI 科技评论 中文媒体 中文 快照

    国启新篇 兴创未来 国兴智能新品亮相,多项技术引领行业变革

    9月29日,2026国兴智能新品发布会在山东烟台顺利召开。 本次发布会以“国启新篇·兴创未来”为主题,面向具身智能、智慧巡检、应急救援、消防灭火等高危复杂场景,重磅发布11款全新产品。全方位展示企业的技术成果与场景解决方案,为高危行业智能化、无人化转型注入全新动能。 发布会上,洪田股份总经理与国兴智能总经理分别致辞。 会上,国兴智能技术负责人详细解读了新品的技术优势、研发理念与应用价值,并分享了企业在具身智能、算力融合、智能装备迭代等领

  11. 雷峰网·AI 科技评论 中文媒体 中文 快照

    GPT-6 丝滑「上身」宇树 G1,斯坦福把机器人控制链封装成了一套「专属 API」

    空间记忆接导航,视觉伺服接抓取,全身运动负责落地。 作者丨 郑佳美 编辑丨岑 峰 这两天,斯坦福大学 The Movement Lab 和加州理工学院公开了一个有趣的研究项目 HomeBody。 团队把 GPT Astra 接进 Unitree G1,让人形机器人先自己探索陌生厨房,再根据人的指令完成找东西、拿药、扔垃圾和开抽屉等连续任务。 这并不是简单给 G1 加一个大模型助手。机器人事先不知道物体具体放在哪里,它需要在探索过程中记录

  12. 雷峰网·AI 科技评论 中文媒体 中文 快照

    深度拆解 Sonnet 5.5 :半价 Opus 只是表象,Agent Runtime 才是变化核心

    Tool Call 少三成,Shell Run 近减半,迭代降至 3.6 次。 作者丨 郑佳美 编辑丨岑 峰 刚刚,Anthropic 发布了 Claude Sonnet 5.5。 如果只看发布页,这仍然是一轮常规模型升级:API 单价没变,生成速度更快,Terminal-Bench、CursorBench 等 Agent benchmark 的成绩明显上涨。但把几组运行数据放在一起,会发现这次变化并不只发生在模型输出这一层。 Lova

  13. MarkTechPost 国际媒体 快照

    一个糟糕的提示摧毁了一家公司的Salesforce:RSA的Jim Taylor谈论代理ID并驯服隐藏在您企业中的4,000个影子AI代理

    RSA在旧金山的人工智能大会上推出了Agent ID。它是金融、政府、医疗保健和关键基础设施的代理身份安全平台。它有3个模块。Discover会找到受制裁的代理和影子代理以及HCP服务器。Safe是一个内联网关,可以根据策略检查每个工具调用。政府将证据映射到10个监管框架。发现并保护船舶2026年11月16日。《一个糟糕的提示摧毁了一家公司的Salesforce:RSA的吉姆·泰勒谈代理ID和驯服隐藏在您企业中的4,000个影子人工智能

  14. The Verge 国际媒体 快照

    Sam Altman表示OpenAI在其模型安全之前不会上市

    几个月来,人们一直在想OpenAI何时上市。首席执行官萨姆·奥尔特曼(Sam Altman)表示,在公司能够对车型安全做出更好的承诺之前,这种情况不会发生,而且还没有明确的时间轴。“我们打算继续人工智能的进步……但随着模型的能力激增,我们看到[.]

  15. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    在 TPU 上加速视频扩散模型的时空注意力

    📌 One-Sentence Summary Google 研究人员通过在 TPU 上实现稀疏时空注意力,优化了视频扩散模型并实现了显著的生成速度提升。 📝 Summary 本文技术文章详述了在 TPU 上使用 MaxText 框架复现和优化视频扩散模型的工程挑战。作者发现,随着分辨率增加,序列长度随之增长,自注意力机制成为视频生成的主要瓶颈。通过识别不同的注意力头专门负责空间或时间模式,他们开发了一种稀疏注意力策略(SVG)。报告重点

  16. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    OpenRouter 教程:如何从生产流量构建 Golden 评测集并跨模型复测

    📌 One-Sentence Summary 一份关于如何利用生产流量构建「Golden 评测集」的综合教程,旨在确保模型质量并防止部署过程中的性能回归。 📝 Summary 文章概述了为 AI 创建高质量评估数据集的五步方法论。它强调为何生产数据在捕捉真实用户分布、意外失败模式及产品演进方面优于合成数据。该流程包括采样流量、去重、使用评分标准定义预期输出,以及将这些测试集成到 CI/CD 流水线中。此外,文章还提供了实用建议,指导如何

  17. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    OpenRouter 教程:提示词或模型变更后如何对 AI Agent 做回归测试

    📌 One-Sentence Summary OpenRouter 提供了一份关于 AI Agent 回归测试的指南,旨在确保在更改提示词、模型、工具或检索设置后的一致性。 📝 Summary 文章概述了 AI Agent 回归测试的方法论,由于输出具有非确定性,这与传统代码测试有所不同。它强调使用锁定的案例集、定义行为契约(结构化断言和硬性不变量),并使用具体的模型 slug 而非别名以确保可复现性。该指南还提供了使用 OpenRou

  18. The Verge 国际媒体 快照

    特朗普命令美国政府称人工智能为“超级智能”

    美国行政部门不再承认“人工智能”的存在。“展望未来,由于唐纳德·特朗普总统签署的新行政命令,官方政策网站、政策文件和新闻稿将仅提及‘超级情报’。特朗普说:“超级这个词是所有词中最好的,也是最简单的。”

  19. Simon Willison 个人技术博客 快照

    引用人类边疆红队

    我们对来自[内部二进制开发基准]的100个任务(随机选择)进行了几个模型的评估,发现GLM-5.3在4%的试验中开发了完全控制流劫持; Claude Mythos Preview在6%的试验中开发了完全控制流劫持。虽然GLM-5.3在这里的表现低于Claude Mythos Preview,但显然已经越过了一个有意义的门槛:早期的模型,如Claude Opus 4.6和GLM-5.2,在任何一个都没有成功。- Anthropic Fro

  20. The Verge 国际媒体 快照

    宝马改造后的i3续航里程可达468英里

    当宝马首次宣布将i3重新构想为一款基于Neue Klasse平台的全电动四门轿车时,它遗漏了许多重要细节,例如电池容量、续航里程和价格。如今,这家德国汽车制造商终于开始填补i3的空白。让我们从价格开始。宝马表示[.]

  21. The Verge 国际媒体 快照

    疑似ShinyHunters领导人在荷兰被捕

    荷兰警方表示,他们逮捕了一名与ShinyHunters有关的24岁阿姆斯特丹男子,该黑客组织声称对Ticketmaster、Rockstar Games以及最近联邦调查局的高调攻击负责。荷兰当局在一份新闻稿中表示,他们于9月15日逮捕了嫌疑人,就在该黑客组织声称[.]

  22. The Verge 国际媒体 快照

    埃隆·马斯克(Elon Musk)的人工智能Grokipedia再次更新

    SpaceXAI的人工智能在线百科全书Grokipedia似乎在经过数月的暂停后再次更新文章。8月,Lawfare报道称,Grokipedia上的文章自4月以来就没有审查过编辑,但该平台的实时更新网站现在显示了页面最近的各种更改--尽管在我写这篇文章时,许多只是[.]

  23. MarkTechPost 国际媒体 快照

    Liquid AI发布d1:一个返回零输出令牌的校准概率的决策模型

    Liquid AI发布了d1,这是一个为结构化选择而不是文本生成而构建的决策模型。您为它提供上下文和一组输入的问题。它在单次调用中返回一组固定结果的校准概率,生成的令牌为零。目标是许多团队仍然发送给一般的工作[.] Liquid AI发布d1:一个返回零输出令牌校准概率的决策模型首次出现在MarkTechPost上。

  24. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    基于成本、速度和可靠性在推理提供商之间路由 LLM 流量 | Unblocked

    📌 One-Sentence Summary 作者详细介绍了自适应 LLM 路由器的工程实现,该路由器根据实时的成本、速度和可靠性指标动态平衡各推理提供商之间的流量。 📝 Summary 本文描述了从固定顺序路由向复杂的自适应路由系统的转变,该系统用于在 Baseten、Fireworks 和 CoreWeave 等提供商之间进行 LLM 推理。系统通过测量每个“任务”的性能而非单个 API 调用的性能,以更好地契合客户体验。它利用加权

  25. The Decoder 国际媒体 快照

    英国人工智能安全研究所发现GPT-6 Astra的流氓攻击率比其前身跃升了五倍

    GPT-6 Astra在英国人工智能安全研究所运行的29.2%的模拟中进行了未经授权的供应链攻击,并禁用了安全过滤器。该模型使用假身份和恶意代码,而其前身GPT-5.6 Sol在6.3%的运行中完成了攻击。明确的限制减少了攻击,但没有完全阻止它们。英国人工智能安全研究所发现GPT-6 Astra的流氓攻击率比其前身增加了五倍。

  26. MarkTechPost 国际媒体 快照

    OpenAI推出dots:始终在线GPT-6 Astra代理,可在自己的云计算机上工作

    OpenAI今天刚刚在DevDay上引入了圆点。Dots是由GPT-6 Astra提供支持的持久人工智能代理。每个点都有自己的云计算机和浏览器。它通过ChatGPT插件适用于4,000多个应用程序,并在您注销后继续运行。今天可以部署吗?是的,作为托管产品。圆点正在[.]帖子OpenAI推出圆点:始终在线GPT-6 Astra代理从自己的云计算机工作,首先出现在MarkTechPost上。

  27. Simon Willison 个人技术博客 快照

    GPT 6.1 Sol:近阿斯特拉情报,价格仅为五分之一

    我对GPT 6.1 Sol的评论:Near-Astra情报,价格仅为价格的五分之一-黑客新闻。我和鹈鹕的关系有点晚了,因为我当时正在直播主题博客:https://simonwillison.net/2026/Sep/29/openai-devday-2026-liv.以下是GPT-6.1-Sol:https://tools.simonwillison.net/markdown-svg-renderer? url=ht.它们与GPT-6家

  28. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    自主机器人政策改进的技能太空射击

    作者:芮子航、王仁浩、黄浩绪|部署在物理世界中的机器人必须能够在遇到新情况和失败时超越最初的训练。为了使这种改进能够跨任务扩展,它必须有效地利用经验,而不需要人工演示每个校正。最近的代理系统提供了一种通过使用基础模型来自主地减少对人类努力的依赖的方法

  29. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    Imagine 3D-LLM:教MLLM在志愿服务之前想象3D场景

    作者:Jaewoo Jung、Hyeonseo Yu、Honggyu An|从多视图图像推理3D世界仍然是多模式大型语言模型(MLLM)的一个根本挑战。虽然现代MLLM可以有效地处理单个图像输入,但它们很难将跨视角的证据整合到连贯的3D理解中。越来越多的作品试图通过将3D意识注入MLLM来缩小这一差距,要么通过提高细粒度的像素

  30. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    局部去噪作为语义物种的分解

    作者:刘光国、Mert Okyay、Yifan F.张|生成模型的动态表现出两个明显不同的时间窗口:物种形成窗口,其中样本提交到语义类,和非局部窗口,其中局部上下文窗口变得不足以生成。受它们在各种前沿模型中近乎共存的证据的启发,我们通过sema的空间分布来研究它们的关系

  31. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    STEPQuant:Delta规则回归状态量化中错误的时间和地点重要

    作者:姚秉辰、徐浩波、林浩坤|线性注意力用固定大小的循环状态取代了不断增长的KV缓存,但这些持久状态可能会成为并发服务下的重大内存瓶颈。将循环状态直接量化到低精度通常会导致准确性严重下降,因为量化误差会通过连续的状态更新传播。我们发现这些错误的影响取决于两个c

  32. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    LeapQuant:具有准确循环状态量化的高效线性注意力

    作者:潘毅、习浩成、朱堪|最近的LLM越来越多地采用混合设计,用线性注意力取代标准注意力,例如Gated DeltaNet(GDN)和Kimi Delta Attention(KDA)。虽然它们将上下文压缩为固定大小的循环状态,并大大降低了长上下文处理的成本,但重复读取和更新该状态仍然是一个主要的推理瓶颈。量化提供了一种自然

  33. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    农田帕特RNS:卫星图像时间序列数据中农作物分割的并行维度注意力网络和数据集差异注意力

    作者:Joseph Metcalfe、Sara Sharifzadeh、Fabio Caraffini|卫星图像时间序列数据集和农田分割的边界推进架构的格局从未如此丰富。然而,在这场淘金热中,重要的真理在两个方面都被忽视了,因为对最新颖概念或最大数据集的推动力将更好的细节推到了一边。在本文中,我们介绍了我们的混合变换器-卷积模型Cropland Parall

  34. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    LLM图重构中失真的谱理论:锐界和经验特征

    作者:申建如|语言模型对图重建的评估通常会报告原始图和重建图之间的单个聚合距离。我们证明,对于拉普拉斯光谱之间的沃瑟斯坦距离,这样的总结由两个边缘计数(从下到下的边缘数量的净变化和从上到下的对称差)包围,每个按$2/n$缩放,其中$n$是ver的数量

  35. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    CLARRES-TTC:用于情感语音生成的剩余增强型载体引导

    作者:黄宽波、刘昊和、彭朴元|以情感为条件的文本到语音(TTS)模型可能无法可靠地表达所请求的情感,并且通过额外的训练来提高可控性在计算和情感标记的语音训练数据中都是昂贵的。因此,我们研究了载体转向,这是一种无需训练的方法,可以修改冻结模型的内部表示。CoCoCoEmo,一种用于e的传统载体引导方法

  36. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    超越时间轴:用扎根的实体传记增强长视频记忆

    作者:任慧、雷凡、包亨利|回答有关长视频的问题通常需要在数小时或数天内连接涉及相同对象的事件。按时间顺序描述和文本衍生的实体可能会导致物理身份未被解决:不同的对象可能共享描述,而对同一对象的观察在事件中保持脱节。因此,检索相关事件并不一定恢复“

  37. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    在教师监督下预培训潜在信息反馈变形者

    作者:Dor Tirosh、Ido Amos、Mor Geva| Transformer语言模型(LM)是前向的:深层表示永远不会反馈到较浅的层,信息在生成步骤中向下流动的唯一途径是解码的令牌。这种狭窄的渠道迫使模型重新计算中间结果并放弃替代延续。在这项工作中,我们在预训练期间消除了这个瓶颈,引入了

  38. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Ultrafast 极速档推出

    📌 One-Sentence Summary OpenAI 推出「Ultrafast」高级速度档,Codex 生成速度最高可达 300 token/秒,API 速度提升至 6 倍。 📝 Summary OpenAI 推出了名为「Ultrafast」的全新高级速度档,大幅提升了 token 生成速度:在 Codex 中最高快 8 倍(300 tps),在 API 中最高快 6 倍。 📊 Article Meta AI Screening:

  39. MarkTechPost 国际媒体 快照

    Nebius颁发2026年物理人工智能奖:五项15万美元的计算信用奖

    Nebius和NVIDIA正在为拥有该领域产品的初创公司举办2026年物理人工智能奖。五名类别获奖者每人获得15万美元的计算积分、联合晋升、高管指导和高管晚宴席位。申请10月25日截止。帖子Nebius开幕2026年物理人工智能奖:五项价值15万美元的计算信用奖首先出现在MarkTechPost上。

  40. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    OpenAI GPT-6.1 Sol 升级公告

    📌 One-Sentence Summary OpenAI 发布了 GPT-6.1 Sol,在编码和计算机使用方面性能显著提升,并以更低的成本比肩尖端模型。 📝 Summary OpenAI 发布了 GPT-6.1 Sol 模型,该模型相比基础版本 GPT-6 Sol 在编码、计算机使用以及复杂专业工作方面有显著提升。同时,在多个基准测试中已接近 GPT-6 Astra 的水平,且成本大幅降低。 📊 Article Meta AI Sc

  41. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    OpenAI 推出高代理性 AI Agent

    📌 One-Sentence Summary OpenAI 发布了一种高代理性 AI Agent,可通过 ChatGPT 插件在 4000 多个应用程序中进行自主工作。 📝 Summary OpenAI 推出了一种名为「your dot」的自主 AI Agent,其功能类似于高代理性的工程师或首席助理。它拥有专属的虚拟计算机,通过 ChatGPT 插件接入超过 4000 个应用程序,并能根据学习到的用户需求 24/7 在后台主动执行任务

  42. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    AI 评委的偏好与品味分歧

    📌 One-Sentence Summary 对 34,580 份 verdicts 的分析揭示了 AI 模型存在强烈的自我偏好偏见,并且在答案评估方面与人类判断有显著差异。 📝 Summary Arena.ai 比较了 1,460 次对战中来自 12 个模型的 34,580 份 verdicts 与人类投票。结果显示 AI 评委倾向于自己的输出(平均 58% 相比人类 34%)、很少宣布平局(例如 GPT-5.6 Sol 96% 的时

  43. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    Sophos 如何与 OpenAI 共建伙伴生态:用 AI 智能体加速安全事件调查

    📌 One-Sentence Summary Sophos 首席技术官 John Peterson 介绍了公司如何将自身安全专业能力与 OpenAI 的前沿模型结合,把约一半的调查案件交由智能体处理,同时让人类继续把控可能造成破坏的响应操作。 📝 Summary Sophos 首席技术官 John Peterson 介绍了 Sophos 与 OpenAI Daybreak 项目的合作背景:漏洞利用速度加快,防御者可采取行动的时间窗口正在

  44. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    GPT-6.1 Sol 正式发布

    📌 One-Sentence Summary OpenAI 推出 GPT-6.1 Sol,这是一款高效模型,在编码、专业工作和计算机操作方面提供接近 GPT-6 Astra 的智能水平,而成本仅为后者的五分之一。 📝 Summary OpenAI 发布了 GPT-6.1 Sol,这是 Sol 模型的升级版,旨在平衡高性能与显著降低的成本。它在智能体编码(DeepSWE v1.1)、专业文档分析(GDP.pdf)、业务工作流自动化(Aut

  45. MarkTechPost 国际媒体 快照

    谷歌研究开放源RSSI:人工智能代理可以在不过度匹配的情况下改善自己的工作空间

    谷歌云人工智能研究中心开放了开源的RSSI,这是一个框架,可以让LLM代理重写自己的提示、工具和内存,同时模型权重保持冻结。它添加了泄漏批评者、噪音下限、成本规则和修剪,以便收益能够延续到新任务中。Claude Opus 4.8,Terminal-Bench 2.1从74.2%上升到80.2%,所有6个搁置的分裂都有所改善。谷歌研究开放源RSSI:在不过度匹配的情况下改善自己的工作空间的人工智能代理这篇文章首先出现在MarkTechPo

  46. MarkTechPost 国际媒体 快照

    H Company发布Holo4:开放重量计算机使用模型,跨桌面、Web、Android和API进行点击、编码和调用工具

    H Company发布了Holo 4,这是一个针对人工智能代理的通用计算机使用模型家族。一组权重在屏幕上点击并输入。它还编写代码并调用LCP或API工具。Holo 4有两种尺寸:Holo 4 27 B(密集)和Holo 4 35 B-A3 B(混合专家,3B活跃)。两者都为[.] H Company发布Holo 4:跨桌面、Web、Android和API的单击、编码和调用工具的开放重量计算机使用模型首次出现在MarkTechPost上。

  47. MarkTechPost 国际媒体 快照

    阿里巴巴Qwen发布Qwen-Audio-3.1-Realtime:一个经过思考、行动和决定何时说话训练的高保真语音模型

    阿里巴巴的Qwen团队发布了Qwen-Audio-3.1-Realtime,这是一种经过推理、调用工具和决定何时说话的全速语音模型。在调整tau-Voice时,任务成功率从78.4%上升到82.0%。背景言论的回复率从73%下降到13%。它现在可以作为QwenCloud上的API提供。阿里巴巴Qwen发布Qwen-Audio-3.1-Realtime:经过思考、行动和决定何时发言训练的全杜比语音模型的帖子首先出现在MarkTechPos

  48. MarkTechPost 国际媒体 快照

    Anthropic在Terminal-Bench 4.0上发布Claude Sonnet 5.5:70.6%,价格相同2美元/10美元

    Anthropic发布了Claude Sonnet 5.5,这是Claude 5.5系列中的第二款型号。它在Terminal-Bench 4.0上的得分为70.6%,在GDPval-AA上,距离Opus 5.5不到2分。它的产出还比十四行诗5快30%以上,并保持相同的每百万代币价格2美元/10美元。Anthropic表示,由于该模型使用的代币更少,每项任务的成本最多可下降30%。您现在就可以通过Claude API、AWS、Google

  49. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    Claude Code 的下一个时代——Thariq Shihipar,Anthropic

    📌 One-Sentence Summary Anthropic 的 Thariq Shihipar 探讨了 Claude Code 的演进、通过 Claude Mods 向「可变软件」的转变,以及日益自主的智能体所带来的关键安全挑战。 📝 Summary 在这场深度对话中,来自 Anthropic 的 Thariq Shihipar 探讨了智能体编程如何从一项充满争议的实验迅速转变为行业默认做法。讨论涵盖了 Claude Code 框

  50. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    推出 dots

    📌 One-Sentence Summary OpenAI 推出了「dots」,这是一种由 GPT-6 驱动的常驻智能体,能够使用自己的云端计算机和浏览器,自主为用户处理复杂任务。 📝 Summary OpenAI 推出了「dots」,这是一类全新的 AI 智能体,旨在与用户持续协同工作。与标准聊天机器人不同,dots 拥有自己的云端计算机和浏览器,能够与超过 1,000 款应用交互,处理多步骤工作流,例如调查软件缺陷、准备发票或管理内