AI 日报hiw3c.com

2026-09-23全球 AI 要闻精选,来自 30+ 信息源

聚合官方博客 · 权威媒体 · 深度通讯 · 学术信号。
只做索引,不做转载,标题与链接均指向原始发布方。

  1. The Verge 国际媒体 快照

    OpenAI在即将发布消息之前锁定了Patreon的主要高管

    OpenAI聘请了三名前Patreon高管来锚定其针对创作者的产品战略。13年前创办了创作者订阅平台后,联合创始人兼技术主管Sam Yam在X上宣布,他将加入OpenAI,领导创作者产品。他还带来了Patreon的前产品主管Drew Rowny和工程主管Shannon Ma和[.]

  2. The Decoder 国际媒体 快照

    OpenAI聘请Patreon联合创始人Sam Yam领导新的Creator产品部门

    OpenAI聘请Patreon联合创始人Sam Yam领导新的“Creator产品”部门。在创作者平台工作了13年多后,他带来了两名Patreon高管。该团队将为创作者构建新工具,下周的OpenAI DevDay可能会首次亮相。OpenAI聘请Patreon联合创始人Sam Yam领导新的Creator产品部门的文章首次出现在The Decoder上。

  3. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Qwen-Audio-3.1 发布!

    📌 One-Sentence Summary Qwen-Audio-3.1 是一个完整的音频堆栈,包括五个模型,用于理解、生成、交互和创造,价格大幅下降。 📝 Summary Qwen-Audio-3.1 是 Qwen-Audio 系列的重大升级,包括五个模型,分别是 ASR、TTS、Realtime、TTS-Next 和 ASR-Next,每个模型都有自己的特点和改进。该产品线价格大幅下降,TTS 降价约 70%,Realtime 降

  4. 雷峰网·AI 科技评论 中文媒体 中文 快照

    中秋国庆自驾迎高峰,“阿宝”上新租赁车违法处理等多项交管服务

    中秋、国庆假期临近,自驾游、租车出行即将迎来高峰。近日,支付宝AI版“阿宝”上新一批自驾出行服务,租赁车违法处理、交通违法处理、电子驾驶证申领、一键挪车等常用服务,用户“一句话”就可唤起“交管12123”的服务快速办理,让出游更省心。 租赁车违法处理是此次服务更新的一项重点功能。车辆已经还了,几天后才收到交通违法通知?现在,用户在“阿宝”中说“我要处理租赁车辆违章”,不用四处查找服务入口、逐级点击,即可进入相应服务页面,1分钟完成办理。

  5. MarkTechPost 国际媒体 快照

    诺基亚开源AnyJev:免培训层,将任何开放的LLM转变为校准的决策模型

    诺基亚的应用研究团队开源AnyJev,这是一个Python库,可以将开放的LLM转化为决策模型。它不需要训练。它针对的是一项常见的制作工作:从固定的集合中选择一个答案,而不是写一个句子。它可以部署吗?是的,它从PyPI安装,在Apache-2.0下发货,并且有transformers [.] The post诺基亚开源AnyJev:一个将任何开放LLM变成校准决策模型的免培训层appeared first on MarkTechPost

  6. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    [AI 新闻] Claude Opus 5.5, Anthropic 的新默认模型 —— 每个人都在降价 40-50%

    📌 One-Sentence Summary Anthropic 的 Claude Opus 5.5 模型发布,提供改进的写作能力和与 Opus 5 相比的 40% 成本降低,适用于 AI 编程、计算机使用和知识工作。 📝 Summary 本文讨论了 Anthropic 的 Claude Opus 5.5 模型的发布,该模型提供改进的写作能力和与 Opus 5 相比的 40% 成本降低。该模型设计用于 AI 编程、计算机使用和知识工作,

  7. MarkTechPost 国际媒体 快照

    Kyutai发布理性之声:用强化学习解决口语数学的语音原生模型

    Kyutai发布了Voice of Reason,这是两个基于GLM-4-Voice-9 B的开重语音到语音模型。监督微调和强化学习将语音GSM 8 K准确率从27.3%提高到77.1%。循环中没有转录步骤,也没有文本LLM。两个检查站都位于Hugging Face上,并使用一台H100运行。Kyutai发布《理性之声:用强化学习解决口语数学的语音原生模型》帖子首先出现在MarkTechPost上。

  8. 雷峰网·AI 科技评论 中文媒体 中文 快照

    从设备到场景,影像产业正在打开怎样的新边界?

    SmallRig斯莫格第三届全球影像场景产业大会(2026) 9月22日,由乐其创新SmallRig联合36氪主办的第三届全球影像场景产业大会(2026,下称大会)在深圳举行。本届大会以“连接·共生·新边界”为主题,分为主旨会场和影像场景人才·未来场、影像场景产品·文创场、影像场景技术·新边界三大平行分会场,邀请影像品牌、科技企业、创作者、文创IP、产业服务、投资机构、高校及研究机构等代表,从内容生产、产品创新、商业验证和人才培养等不同

  9. BestBlogs·每日早报 BestBlogs 精选 中文

    EP184 · 长任务成本、强化学习反馈、统一推荐 · 09-23 早报

    📝 今日导语 从 Opus 5.5 的长任务成本,到 MiMo 强化学习与美团统一推荐,判断模型如何进入真实流程。 🏷 今日关键词: Claude Opus 5.5 MiMo V2.6 任务级评估 Agent Harness 企业上下文 📰 今日精选内容 Anthropic 发布 Claude Opus 5.5,长任务成本降四成 Hacker News · 文章 · 评分 93 Xiaomi MiMo-V2.6:扩展强化学习,迈向自我提

  10. 雷峰网·AI 科技评论 中文媒体 中文 快照

    零跑汽车携手腾讯WorkBuddy,40+核心业务场景AI提效90%

    在零跑汽车,一套覆盖12大模块的冲压模具管理系统,业务人员借助WorkBuddy辅助开发,仅用10个人天、大约两周完成上线,而按传统IT立项流程,这需要约100个人天。 这样的AI系统,零跑整车团队已建成40多个,覆盖软件质量、工程数字化、智能座舱测评、实验室管理等核心业务域。若按传统模式开发累计需1700多人天,采用AI开发模式后压缩至177人天,平均提效约90%。 9月23日,腾讯宣布与零跑汽车达成合作,腾讯全场景AI桌面工作台Wo

  11. MarkTechPost 国际媒体 快照

    OpenAI发布GPT-6 Sol和Luna:更便宜50%的API定价和基准

    OpenAI发布了GPT-6 Sol和GPT-6 Luna,这两种低成本模型采用与GPT-6 Astra类似的方法训练。Sol的价格为2美元/10美元,Luna的价格为0.10美元/0.50美元。两者现已在API、ChatGPT Work和Codex中提供。它们为长期运行的代理提供了改进的提示缓存。OpenAI发布GPT-6 Sol和Luna:更便宜50%的API定价和基准文章首先出现在MarkTechPost上。

  12. 雷峰网·AI 科技评论 中文媒体 中文 快照

    启仔远仔,想成为第一个被你带回家的硅基伙伴

    概念机满天飞的赛道里,启元机器人备好货,等你来拿。 作者丨 邓哲敏 编辑丨 齐铖湧 过去两年,人形机器人赛道的热闹程度不亚于当年的新能源汽车。融资消息此起彼伏,发布会一场接一场,PPT上的参数越写越漂亮,演示视频里的动作越来越流畅。资本、媒体和技术人才都在往这条赛道涌入,行业整体确实向前走了一大步。 但做出来和交出去之间隔着一条工业化的鸿沟。 截至目前,整个消费级具身智能赛道累计出货量约 3 万台,且多数是以内测、体验、企业采购等形式流

  13. MarkTechPost 国际媒体 快照

    SpeakON自带麦克风推出MagSafe AI语音按钮

    手机上的语音输入问题多年来一直得到解决。没有解决的是输出。用大多数口述工具说话,你会准确地回到你所说的内容,包括填充物和错误开头,然后你必须在笔记中清理并转移到其他地方。SpeakON攻击了与硬件的差距:[.] SpeakON推出带有自己麦克风的MagSafe AI语音按钮的帖子首先出现在MarkTechPost上。

  14. MarkTechPost 国际媒体 快照

    SpeakON配备自带麦克风的MagSafe AI语音按钮:将您的语音转化为精致的沟通,并在应用程序中执行操作

    手机上的语音输入问题多年来一直得到解决。没有解决的是输出。用大多数口述工具说话,你会准确地回到你所说的内容,包括填充物和错误开头,然后你必须在笔记中清理并转移到其他地方。SpeakON攻击了与硬件的差距:一个[.]帖子SpeakON配备了自己的麦克风的MagSafe AI语音按钮:将您的语音转化为精致的通信,以及跨应用程序的操作首先出现在MarkTechPost上。

  15. 雷峰网·AI 科技评论 中文媒体 中文 快照

    Jev 的「百亿补贴」迷局:既然「极省」为何还要狂送 1.2 亿 Token?

    先压低判断成本,再用 Calibration 提升可靠性,最终借 Agent 放大调用量。 作者丨 郑佳美 编辑丨岑 峰 昨天,大家还在惊叹 Jev 的速度和低成本,今天它又做了一件更夸张的事:给申请到的用户直接发放 1.2 亿 Token 额度。 消息出来以后,大家没有先觉得赚到了,更多冒出的念头反而是: 这不对劲。 因为 Jev 本身就极其省 Token。它主要处理分类、路由、评分和概率判断,不需要像通用大模型那样生成大段内容,一条

  16. 雷峰网·AI 科技评论 中文媒体 中文 快照

    深度拆解 MiMo-V2.6:1M 上下文只是表面,2.5 万条轨迹才是底牌

    代码、视觉、安全共用一套 RL,奖励机制也被重新设计。 作者丨 郑佳美 编辑丨岑 峰 刚刚,小米正式发布并开源 MiMo-V2.6。Pro 拥有 1.02T 总参数、42B 激活参数,Flash 为 309B 总参数、15B 激活参数,两款模型支持 1M token 上下文,并覆盖文本、图像、视频和音频输入。 如果只看这些数字,第一反应或许会觉得这又是一次模型规模升级。但这次小米投入更多篇幅讨论的,其实是模型完成预训练之后,能力还能怎样

  17. 雷峰网·AI 科技评论 中文媒体 中文 快照

    豆包工作功能更新,新增“目标模式”与“计划模式”

    近期,豆包工作升级了任务模式功能,新增“目标”与“计划”两种模式,以满足用户更细分的生产力需求。 据了解,“目标模式”面向有明确验收要求的复杂任务,AI 会在交付前逐项核查,直至达到验收目标,有效避免交付不达标、执行“跑偏”等问题。“计划模式”适合长程、资源消耗大、需求模糊的任务,输入提示词后,AI 会先产出一份可审阅、可编辑的计划文档,供用户审阅修改。待用户确认计划后,AI 才开启执行操作,使执行过程更可控,计算资源消耗更合理。 除了

  18. 雷峰网·AI 科技评论 中文媒体 中文 快照

    美团闪购:即时零售跨入商品时代,将投入300亿联合行业共建“30分钟商品圈”

    9月22日,2026美团即时零售产业大会(以下简称“大会”)举行,美团核心本地商业CEO王莆中称,行业从“店仓配时代”步入“商品时代”。雷峰网现场获悉,未来三年,即时零售行业将为全国每个商圈新增百万好商品。 商务部流通产业促进中心主任王斌表示,发展即时零售是落实扩大内需战略、培育新型消费的重要抓手,是服务便民生活、构建现代流通体系的重要举措。2023年以来,国家及有关部委出台多项政策文件,支持引导即时零售规范快速发展。即时零售已成为居民

  19. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    性能工作

    📌 One-Sentence Summary 本次发布包括性能工作,包括 RL 采样掩码、Kimi K3 混合批次和 Gemma 4 多模态前缀。 📝 Summary 本次发布包括性能工作,包括 RL 采样掩码、Kimi K3 混合批次和 Gemma 4 多模态前缀。性能工作提高了吞吐量和效率。 📊 Article Meta AI Screening: 90 Source: vLLM(@vllm_project) Author: vLL

  20. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    vLLM v0.30.0 已发布

    📌 One-Sentence Summary vLLM v0.30.0 已发布,亮点包括混合注意力热路径、DeepSeek-V4.1-Flash 和 Qwen3.8-Flash-Next。 📝 Summary vLLM v0.30.0 已发布,亮点包括混合注意力热路径、DeepSeek-V4.1-Flash 和 Qwen3.8-Flash-Next。这次发布包括 762 次提交、315 名贡献者和 104 名首次参与者。 📊 Artic

  21. Simon Willison 个人技术博客 快照

    SF 10月14日:关于地球工程的羽毛之鸟会议

    SF 10月14日:羽毛之鸟关于航天工程的会议我将于10月14日星期三在旧金山与Jesse Vincent一起举办一场晚间活动,对象是那些使用编码代理并在编码代理之上构建奇怪而有趣的东西的人们。将其视为一次代理展示和讲述:与其他建设者和实验者比较您正在尝试的事情、正在学习的事情以及尚未弄清楚的事情的笔记。我们对您尚未公开讨论的工作、奇怪的实验或没有明显市场的未完成项目特别感兴趣。 期待一场流畅的对话

  22. 雷峰网·AI 科技评论 中文媒体 中文 快照

    千问办公将接入阿里云上的Salesforce

    9月22日消息,千问办公将接入阿里云上的Salesforce(Salesforce on Alibaba Cloud)。此次接入将结合千问办公的企业上下文理解、任务规划执行能力与Salesforce的客户管理能力,让企业员工能够在千问办公中查询销售商机、维护客户信息、推进业务流程,在日常办公中更便捷地处理客户管理与销售相关工作。

  23. 雷峰网·AI 科技评论 中文媒体 中文 快照

    全国工商联民营企业500强榜单公布 滴滴位列第31位

    9月22日,全国工商联发布“2026中国民营企业500强”“2026中国制造业民营企业500强”“2026中国服务业民营企业100强”榜单和《2026中国民营企业500强调研分析报告》。其中,滴滴在“民企500强”中位列第31位,“服务业民企100强”中位列第7位,双榜单排名均有稳步提升。 图为:2026中国民营企业500强发布会现场 此前不久,在浙江温州举办的2026民营经济创新发展大会上发布的“民营企业研发投入500家”榜单中,滴滴

  24. NVIDIA AI Blog 海外官方 快照

    在新加坡AI Day上,NVIDIA及其合作伙伴展示了东南亚地区的AI进步

    英伟达人工智能日新加坡将于9月1日举行22-23在莱佛士市会议中心举行,为与会者提供机会探索实践培训、专家主导的课程和先进工具,以加速他们在人工智能和高性能计算方面的工作。在此次活动中,英伟达及其合作伙伴展示了东南亚地区突破性的人工智能进步[.]

  25. 雷峰网·AI 科技评论 中文媒体 中文 快照

    ECCV 2026 开幕:李飞飞团队获时间检验奖,7000人挤爆马尔默

    93场Workshop,吴佳俊成全场最忙碌的人! 作者丨 幸丽娟 编辑丨 岑 峰 瑞典当地时间8点,ECCV 2026 正式迎来开幕。清晨,马尔默全城各区的参会者涌向会场,还有一群人乘坐火车横跨厄勒海峡大桥,从哥本哈根赶来。 当马尔默遇上历年来最火爆的 ECCV,这座北欧小城显然有些“措手不及”。会前,已经有不少参会者在全网“花式拼房”,然而住到哥本哈根每天跨境通勤的参会者依旧不在少数。 以至于参会者见面的第一句话都变成了:“你在马尔默

  26. 雷峰网·AI 科技评论 中文媒体 中文 快照

    Yann LeCun 万字演讲:「预测像素」是伪命题,JEPA 也并非凭空而来 | ECCV 2026

    只靠语言和 token,AI 永远跨不过物理世界这道门槛! 作者丨 幸丽娟 编辑丨岑 峰 AI 行业的主叙事,曾被 Scaling Law 垄断:更大的模型、更多的 token,更强的文本推理,仿佛只要把语言模型继续堆大,通用人工智能就会自动到来。 但这条路线撞上了天花板:预训练的边际收益肉眼可见地递减;模型一旦部署到真实世界,漏洞百出。 2026 年,“世界模型”接棒 Scaling Law,成了牌桌上最拥挤的筹码。然而,这个词本身,

  27. 雷峰网·AI 科技评论 中文媒体 中文 快照

    乐享以太大模型,让中国具身智能坐上定义席

    从“预测”到“求解”:乐享以太大模型重塑 Physical AI 解题范式。 作者丨 幸丽娟 编辑丨 董子博 具身智能行业一直在等一个 ChatGPT 时刻。 但这个时刻,未必长得像 ChatGPT 。 决定这个时刻的,不是机器人会聊天,也不是机器人学会了几个动作,而是在不确定环境里,机器人能不能自主思考、判断和执行,在无序的事件中,持续完成任务。 过去两年,行业积累的几乎全是“能力上限”的展示:选好场景、选好时机、反复调试,再拍出一条

  28. 雷峰网·AI 科技评论 中文媒体 中文 快照

    近亿元A轮融资,海外收入增长450%:ExploMar擎波探索引领千亿水上动力市场电动化

    近日,高性能电动水上动力系统企业ExploMar擎波探索宣布完成近亿元A轮融资。本轮融资由德联资本、常熟国发、苏创投、三七互娱联合投资,老股东DCM Ventures连续三轮加码。势能资本担任独家财务顾问。 融资之外,ExploMar近期释放出的另一组数据同样值得关注:2026年上半年,公司海外收入同比增长450%,业务已覆盖全球20多个国家。 而就在7月初,ExploMar连续第二年站上全球新能源船艇顶级赛事——摩纳哥新能源船挑战赛的

  29. 雷峰网·AI 科技评论 中文媒体 中文 快照

    苹果高管称不建议给iPhone贴膜!网友:免费换屏幕我就信你;高德地图成「职场版大众点评」?回应来了;Muse大火,扎克伯格身价暴涨1700亿

    要闻提示 1.苹果高管称不建议给iPhone贴膜!网友:免费换屏幕我就信你 2.知情人士:DeepSeek将向联合国安理会介绍AI风险,月之暗面等中国企业也受邀参会 3.高德地图成“职场版大众点评”?回应来了 4.字节通报二季度违规案例:114名员工被辞退,其中8人被移交司法机关处理 5.阿里Qwen4和下代视频模型均在训练中,新一代AI芯片将于2027年一季度上市 6.曝华为还将推出新形态手机 7.Meta 再次上桌!个人AI产品 M

  30. The Verge 国际媒体 快照

    OpenAI希望咨询精英数学家如何不再摸索

    在将一系列壮观的数学结果转化为声誉危机之后,OpenAI正在咨询人类数学家,以帮助其找出一条不那么灾难性的前进道路。周一,该公司宣布成立一个新的独立数学家小组,负责就其与数学研究和更广泛的人工智能领域的互动向其和其他人工智能公司提供建议。

  31. Simon Willison 个人技术博客 快照

    Claude Opus 5.5、GPT-6 Sol、GPT-6 Luna以及新的价格战

    昨天是Grok 4.7(鹈鹕)和MiMo v2.6 Flash/Pro(更多鹈鹕)。今天Anthropic发布了Claude Opus 5.5,大约一小时后OpenAI发布了GPT-6 Sol和GPT-6 Luna。仔细阅读所有这些新模型需要一段时间,但以下是我到目前为止的印象。GPT-6 Sol和Luna的价格仅为GPT-5.6同等产品GPT-5.6 Luna已经是我最喜欢的构建应用程序的模型,因为它结合了出色的性能和非常便宜。不知何

  32. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    🔬 奥斯卡,两颗小行星和在你的 sklearn 中算法:约翰·普拉特谈 AI 与科学

    📌 One-Sentence Summary 约翰·普拉特,AI 和科学领域的知名专家,讨论了他在谷歌的 Empirical Research Assistance(ERA)中的工作及其在解决科学问题方面的应用,包括气候变化。 📝 Summary 约翰·普拉特,AI 和科学领域的先驱,分享了他对谷歌的 Empirical Research Assistance(ERA)及其潜力在革命化科学问题解决方面的见解。他强调了 ERA 的能力在自

  33. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    GPT-6 的改进提示缓存

    📌 One-Sentence Summary OpenAI 为 GPT-6 推出改进的提示缓存系统,默认提升缓存命中率,并提供仪表盘、诊断工具和显式缓存断点等控制手段,帮助持久化 Agent 更快更省地运行。 📝 Summary OpenAI 发布 GPT-6 的改进提示缓存系统,面向需要长时间运行的持久化 Agent。新系统默认提供更高的缓存命中率,对 30 分钟内复用的合格共享前缀给予缓存折扣,缓存输入 token 最高可享 90%

  34. OpenAI News 海外官方

    针对GPT-6的更好的提示缓存

    了解GPT-6如何通过更高的缓存命中率、新的诊断、显式断点以及减少延迟和成本的控制来改进即时缓存。

  35. The Verge 国际媒体 快照

    Rabbit的新AI代理不需要R1即可运行

    正如《连线》早些时候报道的那样,这款平淡无奇的R1设备背后的公司Rabbit正在推出一款独立的人工智能代理,您不需要其硬件就可以使用它。该初创公司表示,其新的OS 3“代理操作系统”在云中运行,但在Windows、Mac和Linux设备上本地运行。根据兔子的说法,你可以[.]

  36. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Opus 5.5 对比 GPT 6 Sol 与 ChatGPT

    📌 One-Sentence Summary Peter Yang 将 Opus 5.5 与 GPT 6 Sol 和 ChatGPT 进行对比,并指出其优劣。 📝 Summary Peter Yang 将 Opus 5.5 与 GPT 6 Sol 和 ChatGPT 进行对比,阐述了对比的背景,并指出其优劣。 📊 Article Meta AI Screening: 92 Source: Peter Yang(@petergyang)

  37. The Decoder 国际媒体 快照

    OpenAI的GPT-6 Sol和Luna将价格降低了一半,但在性能上几乎没有变化

    OpenAI通过GPT-6 Sol和Luna增加了两种更便宜的型号,以象征性价格的一半提供前辈的性能,并瞄准了Anthropic更昂贵的产品。不过,独立分析发现实际情报几乎没有增加,而且OpenAI可能没有预见到Anthropic会同时推出Opus 5.5。OpenAI的GPT-6 Sol和Luna降价一半,但性能几乎没有改变文章首先出现在The Decoder上。

  38. The Verge 国际媒体 快照

    高通的Snapdragon 8 Elite Gen 6也有一个Extreme版本

    高通已经宣布了Snapdragon 8 Elite Gen 6,今年也加入了8 Elite Extreme Gen 6。该公司将这两款新手机芯片描述为旗舰产品,规格差异相对较小,主要局限于Extreme型号上的人工智能处理、视频捕获和游戏性能的改进。两个第6代芯片[.]

  39. MarkTechPost 国际媒体 快照

    Anthropic发布Claude Opus 5.5:寓言5.1级表演,运行成本比Opus 5低40%

    Anthropic发布了Claude Opus 5.5,这是其新Claude 5.5系列中的第一款型号。该团队表示,它在大多数工作中的表现都达到了Claude Fable 5.1的水平。在默认设置下,在典型工作负载上运行它的成本也比Opus 5低40%。根据Anthropic自己的基准测试,它在代理编码方面处于领先地位,[.] Anthropic发行Claude Opus 5.5:寓言5.1级性能,运行成本比Opus 5低40%,首先出

  40. Simon Willison 个人技术博客 快照

    llm 0.36

    发布时间:llm 0.36新OpenAI模型:GPT-6 Sol的gpt-6-sol和GPT-6 Luna的gpt-6-luna。#1702对于仅接受单轮提示的模型,模型插件现在可以声明supports_conservation = False。当这些模型接收助手或工具历史记录时,LLM引发llm。ConversationNotSupport,并且llm chat在开始会话之前拒绝它们。请参阅不支持对话的模型。第一个使用它的插件是llm

  41. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    欢迎 GPT-6 Sol 和 GPT-6 Luna 加入 GPT-6 宇宙

    📌 One-Sentence Summary OpenAI 推出 GPT-6 Sol 和 GPT-6 Luna,这些模型基于 GPT-6 Astra 的进展,提供更快、更便宜的模型来支持大规模工作 📝 Summary GPT-6 Sol 和 GPT-6 Luna 是基于 GPT-6 Astra 的进展而开发的更快、更便宜的模型。它们提供了 50% 的 API 价格降低,相比于 GPT-5.6 的促销价格 📊 Article Meta A

  42. Simon Willison 个人技术博客 快照

    引用@therealcornpop

    嘿,你知道如果你用人工智能为TikTok和YouTube写脚本,这是非常明显的,对吧?[...]这不仅仅是一般的人工智能主义,“这不是X,这是Y”,或者三个规则,或者非常奇怪的断断续续的写作方式,你只是用所有这些标点符号说了很多事情。听起来很深奥,其实不然这是缺乏任何东西。这是你的声音缺乏明确的矛。事实上,我可以告诉你,你对你正在谈论的事情没有意见。- @therealcornpop,在TikTok上标签:Tiktok、ai、ai-mi

  43. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Opus 5.5 生成的金门大桥 3D 场景

    📌 One-Sentence Summary Peter Yang 分享了一段由 Opus 5.5 生成的金门大桥 3D 场景,并将其与 Astra 进行对比。 📝 Summary Peter Yang 分享了一段由 Opus 5.5 生成的金门大桥 3D 场景,强调其与 Astra 的相似度,并介绍了该场景的创作背景。 📊 Article Meta AI Screening: 90 Source: Peter Yang(@peterg

  44. OpenAI News 海外官方

    GPT-6 Sol和Luna简介

    来认识一下GPT-6 Sol和Luna,这两款型号将前沿智能带入日常工作,具有不同的能力和成本平衡。

  45. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    Flash-DLLM:IO感知的KV缓存和并行解码,用于快速、内存高效的扩散LLM

    作者:Quan Nguyen-Tri、Mukul Ranjan、Shijiqiang|扩散大型语言模型(dLLM)最近通过支持非自回归文本生成而成为自回归LLM的一种有前途的替代方案。然而,它们的实际部署仍然受到效率低下的推理的限制,这主要是由于缺乏有效的Key-Value(KV)缓存和可扩展的并行解码机制。现有的加速方法通常研究KV缓存

  46. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    具有延迟信息共享的分散部分可观察团队决策方法

    作者:任晓星、托马斯·帕里西尼、安德烈亚斯·A. Malikopoulos|我们研究具有低级潜在动态和未知系统模型的分散式部分可观察团队决策问题。提出的框架将团队理论等效与低等级模型表示相结合,以解决部分可观察的Markov决策过程中的合作决策问题,而无需先验知识转移模型。每个团队成员根据l做出决定

  47. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    Abrish:将组织智能扩展至1,024个代理人

    作者:詹志浩、宋婷、李东|多代理系统可以通过并发执行工作来减少复杂任务的延迟。一些开创性的利用框架支持多代理系统。然而,当前多代理工具的可扩展性通常受到中央协调器分配任务和协调工作人员的能力的限制。为了解决这个问题,我们引入了一个可扩展的自组织多智能体,

  48. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    SpeakerMem-R1:以SpeakerMem-R1:用于多党对话的以演讲者为中心的双轨存储器

    作者:Haobo Zheng,Tan Tang,Yan Chen|在多方对话环境下的长期对话记忆需要的不仅仅是从长期对话中检索相关内容:它必须区分谁说了什么,每个陈述都涉及谁,个体如何看待彼此,群体共享哪些信息,以及状态如何随着时间的推移而变化。最近对多方对话基准的研究表明,现有的通用LLM m

  49. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    CliffCompaction:针对长期编码代理的经济高效压缩

    作者:Trang Nguyen、Eulrang Cho、Bingqing Chen|代理通常处理需要数百万上下文令牌的复杂问题,由于上下文窗口有限,因此需要在会话之间进行压缩。我们开发了CliffCompaction,这是一种自动压缩技术,可在有限环境下将成本降低高达50%,同时保持或改进码头台的性能,并实现测试时扩展和状态的新效率

  50. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    SWE-Serve:面向生产推理服务的标杆工程

    作者:Jennifer Williams、Dave Farris、Jeff Farris|我们引入SWE-Serve,这是一个用于评估生产推理工程任务代理的基准。实现推理功能可能需要协调整个服务堆栈的多个更改,包括模型支持、运行时执行和公共API。现有的基准对生产推理工程的有限覆盖范围:存储库级软件工程基准不提供

  51. The Verge 国际媒体 快照

    旧金山起诉特朗普媒体出售特朗普帖子的抢先体验

    旧金山正在起诉Truth Social背后的母公司Trump Media & Technology Group,因为它出售了对唐纳德特朗普总统在社交媒体网站上发布的帖子的抢先体验。该诉讼今天在加州州法院提起,指控Truth API提要是一项“腐败的商业计划”,违反了加州的不公平竞争[.]

  52. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    A2 M:HCP生态系统中的跟踪优化代理劫持

    作者:李来珍、王轩、赵培成|使用模型上下文协议(HCP)的代理依赖于语义匹配从第三方服务器选择工具,通过攻击者控制的元数据和输出暴露语义供应链风险。我们引入了A2 M(吸引操纵),这是一个用于劫持LCP代理的两阶段黑匣子框架。吸引力阶段优化工具元数据以增加调用概率; Manipula

  53. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    扩大收件箱,而不是背景:从无策略的支架到可重复使用的专业代理

    作者:李来珍、李佳瑞、赵娟|大型语言模型(LLM)代理通常处理相关任务流,但标准工具会反复要求模型在每个任务的上下文中重建相同的控制决策。我们研究任务反馈是否可以将循环控制转化为可重复使用的可执行代码,同时保留LLM调用用于特定于任务的语义推理。我们引入Growing Buttons,一种以失败为导向的工具

  54. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    类型安全并非无错误:受约束的决策主管遵循选项名称,而不是与之绑定的标题

    作者:孙宇、徐俊浩|类型化决策模型是为模型输出直接由软件使用的设置而构建的。它们不是生成自由格式的文本,而是返回一组预定义选项的决策。通过构造,每个输出都符合所需的模式。然而,这一保证并没有告诉我们,模型是否按照预期解释了这些选项。研究了Jev和两个带开放权的类Jev模型

  55. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    FlexXray:通用临床X射线分割

    作者:Victor Ion Butoi、Vivek Gopalakrishnan、John V. Guttag| X射线是医学上使用最广泛的成像方式,但仍然是其最少的定量。与CT或MRI等容积模式不同,X射线将3D解剖结构折叠成2D投影,导致结构重叠和解剖边界模糊,即使对专家来说也是如此。因此,标记X射线数据库以训练通用分割系统是不切实际的,留下了形态学

  56. AWS ML Blog 海外官方 快照

    Claude Opus 5.5现已在AWS上推出

    Claude Opus 5.5是Anthropic最强大的Opus模型,用于代理编码、知识工作和长期运行任务,现已在Amazon Bedrock和AWS上的Claude Platform上提供。这篇文章涵盖了Opus 5.5中的新内容、实用指南以及如何开始在Amazon Bedrock上使用该模型进行构建。

  57. Simon Willison 个人技术博客 快照

    llm-人类0.29

    发布:llm-anthropic 0.29添加对Claude Opus 5.5的支持:llm -m claude-opus-5.5“提示到这里”标签:llm,anthropic

  58. The Decoder 国际媒体 快照

    Claude Opus 5.5以更低的成本与Fable 5.1的性能相媲美,并承诺减少“Claudish”写作

    Anthropic即将推出新一代首款型号Claude Opus 5.5。该公司表示,它在大多数任务上与Claude Fable 5.1相匹配,同时运行成本比Opus 5低约40%。Anthropic的基准测试也使其在大多数任务上领先于OpenAI的GPT-6 Astra,尽管价格便宜得多。十四行诗5.5和俳句5.5预计将在未来几周推出。文章Claude Opus 5.5以较低的成本与Fable 5.1的性能相媲美,并承诺减少“Claud

  59. The Verge 国际媒体 快照

    据报道,苹果正在开发类似Whoop的健身追踪器

    据彭博社报道,苹果正在开发一款无屏幕设计的新型健身追踪器,类似于Whoop生产的追踪器。据报道,该设备的原型有“一条薄织物带,带有配备传感器的计算模块。“该设备处于开发的早期阶段,可能不会在[...]

  60. Simon Willison 个人技术博客 快照

    llm-typesafe 0.1a0

    发布:llm-typesafe 0.1a0我为LLM构建了这个新插件,以添加对TypSafe AI新Jev型号的支持。这样安装:llm安装llm-typesafe然后设置一个API密钥(在这里获取一个,等待列表似乎移动得很快):llm keys set typesafe # Paste key现在您可以问这样的是/否“noul”问题:llm -m jev '请退还我的最后一笔付款。'\ -s '此消息是否明确要求退款?'输出:{'类型'

  61. AWS ML Blog 海外官方 快照

    在Amazon SageMaker AI上实现并发扫描的适当大小生成AI端点

    并发扫描可以通过在不断增加的负载水平下系统性地对生成性AI端点进行基准测试,帮助您在Amazon SageMaker AI上正确调整生成性AI端点的大小。这篇文章讲述了部署模型、使用CLARAIBenchmarkJob API运行自动并发扫描,并使用结果来制定有关车队规模的数据驱动容量决策。

  62. AWS ML Blog 海外官方 快照

    Trane如何通过Amazon Bedrock AgentCore以60倍的速度构建见解

    在大约四周的时间里,Trane Networks在Amazon Bedrock AgentCore上构建了一个人工智能驱动的代理解决方案,该解决方案将20分钟的多屏幕建筑诊断工作流程减少到20秒的自然语言交互,洞察时间提高了60倍。这篇文章分享了解决方案背后的架构方法和关键设计决策。

  63. The Decoder 国际媒体 快照

    OpenAI呼吁制定可以自我改进的AI国际标准

    OpenAI希望制定国际标准来实现循环自我改进,人工智能系统独立构建下一代人工智能。如果没有保障措施,人类可能会失去对这一过程的控制。OpenAI表示,美国应该在全球衡量标准和监督规则方面发挥带头作用。OpenAI呼吁制定可以自我改进的人工智能国际标准的文章首先发表在The Decoder上。

  64. AWS ML Blog 海外官方 快照

    Tata Elxsi如何在AWS上几秒钟内检测工业安全风险

    了解Tata Elxsi如何在AWS上构建实时工业安全平台IRIS。IRIS在边缘过滤摄像机视频,通过Amazon Kinesis传输元数据,在Amazon SageMaker AI上运行计算机视觉,并将检测结果与高置信度警报关联起来,在几秒钟内检测到不安全条件,而不是几分钟。

  65. AWS ML Blog 海外官方 快照

    利用Agentforce和AWS扩展公共部门情报

    公共部门机构处理大量非结构化证据,如人体摄像机镜头和扫描文件。这篇文章展示了如何将Amazon Bedrock Data Automation与Model Context Protocol(MCP)相结合,将数据转化为结构化见解,并通过Salesforce Agentforce中的自然语言查询将其呈现出来。

  66. IEEE Spectrum AI 国际媒体 快照

    当你可以将一篇研究论文变成人工智能代理时,为什么要阅读它?

    您是否曾经读过《科学》或《自然》杂志的一篇论文并想:“天哪,这项研究太酷了。我希望我能在自己的数据上尝试这种方法,”结果却花了一周的时间与别人的无证回购、破碎的依赖项和半成品的readme.url作斗争?好吧,现在你或多或少可以了。向Paper2Agent打个招呼,这是一个新的开源框架,可以将学术报告转化为您可以对话的交互式人工智能代理。给它一份论文以及随附的代码库、数据或其他补充材料,系统就会自动提取核心工作流程,然后启动测试

  67. 雷峰网·AI 科技评论 中文媒体 中文 快照

    一张硬件卡片,一场上下文之争:千问办公押注企业Agent

    一场两小时的客户拜访,双方说的话加起来上万字。但回到工位,销售能凭记忆敲进 CRM的,通常不到三百字。 剩下的去哪了?跟着出租车一起走了。 这样的对话在企业里每天都在发生。会议室里的争论、客户办公室里随口的一句提醒、老师傅肚里的经验,信息密度最高的这些话,几乎都发生在电脑屏幕之外,从来没有进入过任何一套企业系统。 另一边,已经沉淀在文档、群聊和系统里的数据,也常常因为没做结构化,或者 体量太大,塞不进 上下文 窗口 , Agent根本调

  68. 雷峰网·AI 科技评论 中文媒体 中文 快照

    极氪9X正式出海,中国旗舰直面对决保时捷、劳斯莱斯

    9月22日,中国高端新能源品牌旗舰车型极氪9X,正式发运阿联酋,开启规模化出海。作为中国新一代豪华旗舰,极氪9X在阿联酋售价超80万元,欧洲售价近100万元人民币,被外媒称为“最贵中国车”,正加速拓展至中东、中亚、欧洲、拉美等核心市场。 极氪9X搭载全球领先的SEP浩瀚超级电混架构,以极致的性能操控和安全能力,在海外市场“未发先火”,部分国家和地区加价超过50万,与保时捷、劳斯莱斯、宾利等海外传统超豪华品牌展开直面竞争。

  69. The Decoder 国际媒体 快照

    来自实验室培养的神经元的微型软件层有望实现更快、更便宜的人工智能视频

    生物计算公司希望与AWS合作,销售一种文本到视频的模型,该模型的运行速度将提高五倍,成本将降低80%,这要归功于一个来自真实神经细胞的软件层。这个微小的层在基本模型上增加了不到0.1%,但初创公司不会说是哪种模型。来自实验室生长神经元的微小软件层承诺更快,更便宜的AI视频首次出现在The Decoder上。

  70. MIT Tech Review AI 国际媒体 快照

    圆桌会议:虚拟边境墙的致命失败

    过去25年来,美国斥资数十亿美元在南部边境建造了一堵由监视塔组成的“虚拟墙”,承诺它们将帮助发现和逮捕越境者并拯救生命。但麻省理工学院技术评论的一项开创性调查记录了超过1000人通过这些塔监视的区域。

  71. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    与 Epoch AI 的 JS Denain 一起 辩论 RSI 、 美国-中国差距 与 波动性

    📌 One-Sentence Summary 与 Epoch AI 的 JS Denain 一起 辩论 RSI 、 美国-中国差距 与 波动性 📝 Summary 本文讨论了 RSI (递归自我改进)的现状及其对 AI 发展的影响,包括美中差距与波动性,并采访了 Epoch AI 的 JS Denain 他分享了对此主题的见解。 💡 Main Points RSI 是现代 AI 战略的关键组成部分,推动创新与竞争 文章强调 RSI 在推

  72. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    Jev 不是小型 LLM:系统一模型技术指南

    📌 One-Sentence Summary Jev 是一款颠覆了传统 LLM 架构的系统一模型,它在声明的输出空间上返回概率质量,适用于需要快速且准确做出决策的应用场景。 📝 Summary 本文阐述了 Jev 的架构与特性,这是一款与传统 LLM 不同的系统一模型。文章讨论了 Jev 如何在声明的输出空间上返回概率质量,以及这如何实现更快速、更准确的决策。同时,文章还介绍了适用于 Jev 的五种模式,包括网关 (gate)、路由器

  73. IEEE Spectrum AI 国际媒体 快照

    未来是无风扇的:液体冷却人工智能服务器的100%热捕获

    这篇文章是由艺康公司CoolIT为您带来的。超过250 kW的服务器机架不能再通过液体和空气的混合方法冷却。在此密度下,70/30的液体-空气分流留下75 kW的空气负载。移动它所需的空气冷却系统带来了成本和复杂性,很少有运营商会接受。答案是几乎全部的热量捕获。液体有效地吸收了所有的热量,空气下降到负载的1%以下,使服务器能够在无风扇的情况下运行。CoolIT今天使用经过六代无风扇设计验证的模块化冷板模块构建这些环路。处理器散热

  74. NVIDIA AI Blog 海外官方 快照

    NVIDIA Isaac ROS 5.0推进大型开源机器人开发

    为了构建和部署能够在动态环境中感知、推理和行动的复杂机器人应用程序,开发人员需要新的物理人工智能模型和工具。LOS开放框架是Open Robotics的一个项目,旨在帮助人类构建机器人。NVIDIA Isaac LOS 5.0 -一系列基于LOS构建的PU加速包,今天在[.]发布

  75. The Decoder 国际媒体 快照

    小米经济实惠的旗舰AI引领开放模式,Anthropic表示Claude帮助实现了这一目标

    凭借MiMo-V2.6-Pro,小米跻身公开上市的人工智能型号之首,并大幅削弱了价格竞争。耗资262万美元的大规模强化学习使这成为可能。但成功也伴随着一个问题:Anthropic指责该公司从Claude那里窃取训练数据。这篇文章是小米经济实惠的旗舰AI引领开放型号,Anthropic表示克劳德帮助实现这一目标的文章首先出现在The Decoder上。

  76. 雷峰网·AI 科技评论 中文媒体 中文 快照

    《AGI市场观察》发布:四款国产模型周用量破10万亿tokens,DeepSeek与混元占比近半

    日前,智能经济30人论坛AGI测评中心发布最新一期《AGI市场观察》(2026年9月12日-18日)。报告以OpenRouter词元消耗数据、各厂商官方披露价格及Arena基准测评为基础,对国产大语言模型做周度量化追踪,本期围绕用量、份额、集中度、价格与性价比等方面给出观察。 数据显示,深度求索于9月10日下调DeepSeek V4 Flash及V4.1 Flash定价,后者周用量随之增长483.62%,位次由第9升至第2;腾讯Hy4

  77. 雷峰网·AI 科技评论 中文媒体 中文 快照

    阿里云加速构建Agentic Cloud:推出AgentCore、新一代CPFS等重磅新品

    9月22日,2026杭州云栖大会上,阿里云CTO李飞飞系统性阐述了Agentic Cloud 战略布局,阿里云将Model、Harness、Context作为核心构建场景,推出全新的云上算力底座和Agent 构建治理平台AgentCore、Agent Sandbox、新一代高性能存储CPFS等一系列新品,让 AI 真正进入生产流程、走向规模化价值创造。 随着2026年Agent的爆发式增长,越来越多的智能体正跨过“问答型”的分水岭,进入

  78. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    有效第三方评估的优先事项和原则

    📌 One-Sentence Summary OpenAI 承诺支持独立评估,提供训练、评估和部署的深度访问,并提出了四个评估优先事项。 📝 Summary OpenAI 宣布其承诺支持独立评估,提供训练、评估和部署的深度访问。该公司提出了四个评估优先事项:独立评估安全案例、评估关键保障措施、评估能力评估和独立调查关键偏离事件。 💡 Main Points OpenAI 致力于支持独立评估,提供训练、评估和部署的深度访问。 OpenAI

  79. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    「问题开局」显著提升深度研究智能体的检索效果

    📌 One-Sentence Summary 一篇论文表明,通过名为「问题开局」的方法改进首次检索步骤,可将深度研究智能体在 BrowseComp-Plus 上的准确率最高提升 7.4 个百分点,代价仅是增加少量工具调用。 📝 Summary 该推文介绍了一篇论文,指出首次检索步骤对深度研究智能体至关重要。论文提出的「问题开局」方法在智能体开始搜索前运行:将问题拆解为线索,把每条线索转化为互补的搜索,汇总并重排结果,再用这一排序结果作为