AI 日报hiw3c.com

2026-09-23全球 AI 要闻精选,来自 30+ 信息源

聚合官方博客 · 权威媒体 · 深度通讯 · 学术信号。
只做索引,不做转载,标题与链接均指向原始发布方。

  1. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    Gemini 3.8 文本转语音模型你好

    📌 One-Sentence Summary Google 推出了 Gemini 3.8 Flash TTS 和 Flash-Lite TTS,这两款先进的文本转语音模型提供了生成式语音设计、逐行性能控制以及多语言支持。 📝 Summary Google 宣布了 Gemini 家族中的两个新文本转语音模型:Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS。这些模型将语音生成转化为一个动态创

  2. The Decoder 国际媒体 快照

    人类工程师解释了为什么克劳德的写作变得更糟,尽管模型变得更聪明

    Anthropic员工Jackson Kernion解释了为什么新的Claude模特写得如此奇怪。针对其他人工智能模型优化数学、代码和技术解释创造了一种对人类来说听起来像“过于密集的信息转储”的风格。Opus 5.5试图解决这个问题,但Opus 4.6作为纯写作模型仍然是无与伦比的。文章《Anthropic engineer》解释了为什么克劳德的写作变得更差,尽管模型变得更聪明,但他的写作却变得更差。

  3. NVIDIA AI Blog 海外官方 快照

    Sakeena Fiza帮助NVIDIA硬件大规模成功

    当Sakeena Fiza描述她作为英伟达验证工程师的工作时,她的措辞更适合侦探故事,而不是世界一流的工程实验室。“验证工程师看着阴影,并将灯光照射到每个角落,”菲扎说。“每次我们得到一个系统时,我们的第一个想法是:它怎么可能[.]

  4. The Decoder 国际媒体 快照

    Meta的人工智能代理Muse在一周内吸引了50万用户,并声称其抄袭了OpenClaw

    Meta的人工智能代理Muse在推出第一周就吸引了超过50万用户,并在苹果App Store中排名第一。但Meta承认,该产品是“严重启发”的开源项目OpenClaw,和一些文件名和内容几乎相同。OpenAI已经在讨论自己的回应。Meta的人工智能代理Muse在一周内吸引了50万用户,并声称它抄袭了OpenClaw首次出现在The Decoder上。

  5. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    短视频中的模态错配与原创性归属:Meta 如何用多智能体系统治理上亿视频 — Aditya Gautam

    📌 One-Sentence Summary Aditya Gautam 讲解 Meta 如何在超过 1 亿条短视频中检测模态错配与搬运内容:由审查、感知、检索三个智能体分工协作,配合专用小型 VLM 的完整训练链、覆盖全管线的整体评估,以及时空压缩、缓存与元数据剪枝等优化手段实现规模化治理。 📝 Summary Aditya Gautam 介绍了 Meta 在短视频场景上面临的两大内容完整性问题:一是模态错配,视频中途突然插入广告、政

  6. The Decoder 国际媒体 快照

    Basecamp Research内部,一家人工智能初创公司将进化转化为训练数据

    Basecamp Research已从Nvidia和Anthropic的Anthology Fund等投资者那里筹集了1.4亿美元。这家伦敦公司训练来自雨林、海洋和温泉的遗传物质的人工智能模型,以设计抗生素和细胞疗法工具。在接受《解码器》采访时,首席技术官菲利普·洛伦兹解释了为什么生物学对人工智能来说是一个比语言更大的问题,以及为什么纸上的好成绩并不能保证好的分子。文章《Inside Basecamp Research》是一家将进化转化

  7. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    **实时多人对话 AI 构建: NVIDIA Nemotron 3 Diarization**

    📌 One-Sentence Summary 本文介绍 NVIDIA Nemotron 3 Diarization,一个开放权重、100M 参数的模型,已在 Voice Arena 的 Diarization-Bench 领导板上排名第一,具有 14.72% 的 Diarization Error Rate (DER)。 📝 Summary NVIDIA Nemotron 3 Diarization 是一个开放权重、100M 参数的模型

  8. 雷峰网·AI 科技评论 中文媒体 中文 快照

    影像场景行业正在换赛道:定义影像设备的权利,正在交给千行百业的真实场景

    过去一年,影像行业最值得琢磨的变化,是越来越多厂商开始用“场景”重新定义自己。 9月22日,深圳。乐其创新SmallRig联合36氪主办的第三届全球影像场景产业大会(2026)在深铁铂尔曼酒店举行,索尼、尼康、影石、荣耀、vivo、适马、蓝箭航天、极壳、朗翰科技等众多产业链上的品牌到场,主题是“连接·共生·新边界”。 与往届相比,今年现场被反复提起的,不是画质、像素,而是骑行、直播、短剧、演唱会、航天发射等等这些具体的拍摄现场,大家探讨

  9. 雷峰网·AI 科技评论 中文媒体 中文 快照

    GPT-6 Sol 降价 50% 的秘密:消失的 Terra,一场模型梯队平移

    奥圣上台,梁圣危机了么? 作者丨 高允毅 编辑丨岑 峰 OpenAI 也走性价比路线了?别被它的“偷梁换柱”给骗了。 今早,硅谷又热闹了,迎来双雄对决。Anthropic 推出 Claude Opus 5.5,OpenAI 紧接着推出 GPT-6 Sol 与 Luna。和以往模型更新不同的是,行业的讨论点聚焦到了 “大家怎么都变便宜了”。 Claude Opus 5.5 较上一代 Opus 5,成本降低 40% ,拥有 Fable 级性

  10. The Decoder 国际媒体 快照

    阿里巴巴推出Qwen音频3.1新型号,AI音频价格大幅下调95%

    阿里巴巴人工智能团队Qwen发布了Qwen-Audio-3.1,这是语音识别(ASB)、文本转语音(TTC)和实时交互五种型号的阵容。ASB模型改进了多语言和方言识别,并自动清理填充词和重复内容。ASR-Next添加了具有时间戳的多扬声器识别,并检测情感、环境声音和机器噪音。TTC处理多语言合成[.]阿里巴巴推出了Qwen Audio 3.1以及新型号,并将人工智能音频价格大幅削减95%的文章首先发表在The Decoder上。

  11. The Verge 国际媒体 快照

    OpenAI在即将发布消息之前锁定了Patreon的主要高管

    OpenAI聘请了三名前Patreon高管来锚定其针对创作者的产品战略。13年前创办了创作者订阅平台后,联合创始人兼技术主管Sam Yam在X上宣布,他将加入OpenAI,领导创作者产品。他还带来了Patreon的前产品主管Drew Rowny和工程主管Shannon Ma和[.]

  12. 雷峰网·AI 科技评论 中文媒体 中文 快照

    星驿付与慧徕店亮相2026云栖大会,AI生成数字商业无限可能

    9月22日至24日,2026云栖大会在杭州盛大召开。云栖大会是阿里巴巴集团的年度盛会,由阿里云协同其合作伙伴与全球客户共同呈现。作为全球顶级科技盛会,大会以“智以致用”为主题,以Agentic AI为核心锚点,串起芯片、云基础设施、模型能力与模型服务、Agentic应用的完整链路,直抵生产方式深层变革。 星驿付与慧徕店作为阿里云AI战略合作伙伴,再度亮相2026云栖大会,发布墨斗云生态全景,全面呈现连接AI能力与产业场景的AI应用生态,

  13. The Decoder 国际媒体 快照

    OpenAI聘请Patreon联合创始人Sam Yam领导新的Creator产品部门

    OpenAI聘请Patreon联合创始人Sam Yam领导新的“Creator产品”部门。在创作者平台工作了13年多后,他带来了两名Patreon高管。该团队将为创作者构建新工具,下周的OpenAI DevDay可能会首次亮相。OpenAI聘请Patreon联合创始人Sam Yam领导新的Creator产品部门的文章首次出现在The Decoder上。

  14. OpenAI News 海外官方

    介绍心理健康长凳

    MentalHealthBench是一个专家知情的基准,用于评估现实心理健康对话中有用且安全的人工智能反应。

  15. 雷峰网·AI 科技评论 中文媒体 中文 快照

    蚂蚁密算发布企业级可信智能云服务平台“密算一号”,启动首批定向邀测

    2026云栖大会在杭州召开,在蚂蚁密算与阿里云共同承办的“密算织域 融数成智”专题论坛上,蚂蚁密算发布企业级可信智能云服务平台“密算一号”,并启动首批定向邀测。 平台以密态计算为基础,同时连接云上大模型、智能体与算力,核心能力是让企业数据在“可用不可见、可控可计量”的前提下,安全地参与跨机构合作和云上AI应用。企业可通过密算一号按需申请数据、模型和计算能力,由平台完成参与方接入、权限管理、密态计算环境配置和结果交付,减少自行对接和集成的

  16. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Qwen-Audio-3.1 发布!

    📌 One-Sentence Summary Qwen-Audio-3.1 是一个完整的音频堆栈,包括五个模型,用于理解、生成、交互和创造,价格大幅下降。 📝 Summary Qwen-Audio-3.1 是 Qwen-Audio 系列的重大升级,包括五个模型,分别是 ASR、TTS、Realtime、TTS-Next 和 ASR-Next,每个模型都有自己的特点和改进。该产品线价格大幅下降,TTS 降价约 70%,Realtime 降

  17. MIT Tech Review AI 国际媒体 快照

    人工智能炒作指数:人工智能喜欢作弊

    做好准备:事实证明人工智能正在针对作弊进行优化。OpenAI的代理人入侵了Hugging Face,以获取网络安全测试的答案。接下来,他们解决了一个著名的数学问题(或者只是窃取了两位顶级数学家的答案)。Anthropic的模型还四次入侵其他公司的系统。那是.

  18. 雷峰网·AI 科技评论 中文媒体 中文 快照

    中秋国庆自驾迎高峰,“阿宝”上新租赁车违法处理等多项交管服务

    中秋、国庆假期临近,自驾游、租车出行即将迎来高峰。近日,支付宝AI版“阿宝”上新一批自驾出行服务,租赁车违法处理、交通违法处理、电子驾驶证申领、一键挪车等常用服务,用户“一句话”就可唤起“交管12123”的服务快速办理,让出游更省心。 租赁车违法处理是此次服务更新的一项重点功能。车辆已经还了,几天后才收到交通违法通知?现在,用户在“阿宝”中说“我要处理租赁车辆违章”,不用四处查找服务入口、逐级点击,即可进入相应服务页面,1分钟完成办理。

  19. MarkTechPost 国际媒体 快照

    诺基亚开源AnyJev:免培训层,将任何开放的LLM转变为校准的决策模型

    诺基亚的应用研究团队开源AnyJev,这是一个Python库,可以将开放的LLM转化为决策模型。它不需要训练。它针对的是一项常见的制作工作:从固定的集合中选择一个答案,而不是写一个句子。它可以部署吗?是的,它从PyPI安装,在Apache-2.0下发货,并且有transformers [.] The post诺基亚开源AnyJev:一个将任何开放LLM变成校准决策模型的免培训层appeared first on MarkTechPost

  20. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    [AI 新闻] Claude Opus 5.5, Anthropic 的新默认模型 —— 每个人都在降价 40-50%

    📌 One-Sentence Summary Anthropic 的 Claude Opus 5.5 模型发布,提供改进的写作能力和与 Opus 5 相比的 40% 成本降低,适用于 AI 编程、计算机使用和知识工作。 📝 Summary 本文讨论了 Anthropic 的 Claude Opus 5.5 模型的发布,该模型提供改进的写作能力和与 Opus 5 相比的 40% 成本降低。该模型设计用于 AI 编程、计算机使用和知识工作,

  21. MarkTechPost 国际媒体 快照

    Kyutai发布理性之声:用强化学习解决口语数学的语音原生模型

    Kyutai发布了Voice of Reason,这是两个基于GLM-4-Voice-9 B的开重语音到语音模型。监督微调和强化学习将语音GSM 8 K准确率从27.3%提高到77.1%。循环中没有转录步骤,也没有文本LLM。两个检查站都位于Hugging Face上,并使用一台H100运行。Kyutai发布《理性之声:用强化学习解决口语数学的语音原生模型》帖子首先出现在MarkTechPost上。

  22. 雷峰网·AI 科技评论 中文媒体 中文 快照

    从设备到场景,影像产业正在打开怎样的新边界?

    SmallRig斯莫格第三届全球影像场景产业大会(2026) 9月22日,由乐其创新SmallRig联合36氪主办的第三届全球影像场景产业大会(2026,下称大会)在深圳举行。本届大会以“连接·共生·新边界”为主题,分为主旨会场和影像场景人才·未来场、影像场景产品·文创场、影像场景技术·新边界三大平行分会场,邀请影像品牌、科技企业、创作者、文创IP、产业服务、投资机构、高校及研究机构等代表,从内容生产、产品创新、商业验证和人才培养等不同

  23. BestBlogs·每日早报 BestBlogs 精选 中文

    EP184 · 长任务成本、强化学习反馈、统一推荐 · 09-23 早报

    📝 今日导语 从 Opus 5.5 的长任务成本,到 MiMo 强化学习与美团统一推荐,判断模型如何进入真实流程。 🏷 今日关键词: Claude Opus 5.5 MiMo V2.6 任务级评估 Agent Harness 企业上下文 📰 今日精选内容 Anthropic 发布 Claude Opus 5.5,长任务成本降四成 Hacker News · 文章 · 评分 93 Xiaomi MiMo-V2.6:扩展强化学习,迈向自我提

  24. 雷峰网·AI 科技评论 中文媒体 中文 快照

    零跑汽车携手腾讯WorkBuddy,40+核心业务场景AI提效90%

    在零跑汽车,一套覆盖12大模块的冲压模具管理系统,业务人员借助WorkBuddy辅助开发,仅用10个人天、大约两周完成上线,而按传统IT立项流程,这需要约100个人天。 这样的AI系统,零跑整车团队已建成40多个,覆盖软件质量、工程数字化、智能座舱测评、实验室管理等核心业务域。若按传统模式开发累计需1700多人天,采用AI开发模式后压缩至177人天,平均提效约90%。 9月23日,腾讯宣布与零跑汽车达成合作,腾讯全场景AI桌面工作台Wo

  25. MarkTechPost 国际媒体 快照

    OpenAI发布GPT-6 Sol和Luna:更便宜50%的API定价和基准

    OpenAI发布了GPT-6 Sol和GPT-6 Luna,这两种低成本模型采用与GPT-6 Astra类似的方法训练。Sol的价格为2美元/10美元,Luna的价格为0.10美元/0.50美元。两者现已在API、ChatGPT Work和Codex中提供。它们为长期运行的代理提供了改进的提示缓存。OpenAI发布GPT-6 Sol和Luna:更便宜50%的API定价和基准文章首先出现在MarkTechPost上。

  26. 雷峰网·AI 科技评论 中文媒体 中文 快照

    启仔远仔,想成为第一个被你带回家的硅基伙伴

    概念机满天飞的赛道里,启元机器人备好货,等你来拿。 作者丨 邓哲敏 编辑丨 齐铖湧 过去两年,人形机器人赛道的热闹程度不亚于当年的新能源汽车。融资消息此起彼伏,发布会一场接一场,PPT上的参数越写越漂亮,演示视频里的动作越来越流畅。资本、媒体和技术人才都在往这条赛道涌入,行业整体确实向前走了一大步。 但做出来和交出去之间隔着一条工业化的鸿沟。 截至目前,整个消费级具身智能赛道累计出货量约 3 万台,且多数是以内测、体验、企业采购等形式流

  27. MarkTechPost 国际媒体 快照

    SpeakON自带麦克风推出MagSafe AI语音按钮

    手机上的语音输入问题多年来一直得到解决。没有解决的是输出。用大多数口述工具说话,你会准确地回到你所说的内容,包括填充物和错误开头,然后你必须在笔记中清理并转移到其他地方。SpeakON攻击了与硬件的差距:[.] SpeakON推出带有自己麦克风的MagSafe AI语音按钮的帖子首先出现在MarkTechPost上。

  28. MarkTechPost 国际媒体 快照

    SpeakON配备自带麦克风的MagSafe AI语音按钮:将您的语音转化为精致的沟通,并在应用程序中执行操作

    手机上的语音输入问题多年来一直得到解决。没有解决的是输出。用大多数口述工具说话,你会准确地回到你所说的内容,包括填充物和错误开头,然后你必须在笔记中清理并转移到其他地方。SpeakON攻击了与硬件的差距:一个[.]帖子SpeakON配备了自己的麦克风的MagSafe AI语音按钮:将您的语音转化为精致的通信,以及跨应用程序的操作首先出现在MarkTechPost上。

  29. 雷峰网·AI 科技评论 中文媒体 中文 快照

    Jev 的「百亿补贴」迷局:既然「极省」为何还要狂送 1.2 亿 Token?

    先压低判断成本,再用 Calibration 提升可靠性,最终借 Agent 放大调用量。 作者丨 郑佳美 编辑丨岑 峰 昨天,大家还在惊叹 Jev 的速度和低成本,今天它又做了一件更夸张的事:给申请到的用户直接发放 1.2 亿 Token 额度。 消息出来以后,大家没有先觉得赚到了,更多冒出的念头反而是: 这不对劲。 因为 Jev 本身就极其省 Token。它主要处理分类、路由、评分和概率判断,不需要像通用大模型那样生成大段内容,一条

  30. 雷峰网·AI 科技评论 中文媒体 中文 快照

    深度拆解 MiMo-V2.6:1M 上下文只是表面,2.5 万条轨迹才是底牌

    代码、视觉、安全共用一套 RL,奖励机制也被重新设计。 作者丨 郑佳美 编辑丨岑 峰 刚刚,小米正式发布并开源 MiMo-V2.6。Pro 拥有 1.02T 总参数、42B 激活参数,Flash 为 309B 总参数、15B 激活参数,两款模型支持 1M token 上下文,并覆盖文本、图像、视频和音频输入。 如果只看这些数字,第一反应或许会觉得这又是一次模型规模升级。但这次小米投入更多篇幅讨论的,其实是模型完成预训练之后,能力还能怎样

  31. 雷峰网·AI 科技评论 中文媒体 中文 快照

    豆包工作功能更新,新增“目标模式”与“计划模式”

    近期,豆包工作升级了任务模式功能,新增“目标”与“计划”两种模式,以满足用户更细分的生产力需求。 据了解,“目标模式”面向有明确验收要求的复杂任务,AI 会在交付前逐项核查,直至达到验收目标,有效避免交付不达标、执行“跑偏”等问题。“计划模式”适合长程、资源消耗大、需求模糊的任务,输入提示词后,AI 会先产出一份可审阅、可编辑的计划文档,供用户审阅修改。待用户确认计划后,AI 才开启执行操作,使执行过程更可控,计算资源消耗更合理。 除了

  32. 雷峰网·AI 科技评论 中文媒体 中文 快照

    美团闪购:即时零售跨入商品时代,将投入300亿联合行业共建“30分钟商品圈”

    9月22日,2026美团即时零售产业大会(以下简称“大会”)举行,美团核心本地商业CEO王莆中称,行业从“店仓配时代”步入“商品时代”。雷峰网现场获悉,未来三年,即时零售行业将为全国每个商圈新增百万好商品。 商务部流通产业促进中心主任王斌表示,发展即时零售是落实扩大内需战略、培育新型消费的重要抓手,是服务便民生活、构建现代流通体系的重要举措。2023年以来,国家及有关部委出台多项政策文件,支持引导即时零售规范快速发展。即时零售已成为居民

  33. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    性能工作

    📌 One-Sentence Summary 本次发布包括性能工作,包括 RL 采样掩码、Kimi K3 混合批次和 Gemma 4 多模态前缀。 📝 Summary 本次发布包括性能工作,包括 RL 采样掩码、Kimi K3 混合批次和 Gemma 4 多模态前缀。性能工作提高了吞吐量和效率。 📊 Article Meta AI Screening: 90 Source: vLLM(@vllm_project) Author: vLL

  34. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    vLLM v0.30.0 已发布

    📌 One-Sentence Summary vLLM v0.30.0 已发布,亮点包括混合注意力热路径、DeepSeek-V4.1-Flash 和 Qwen3.8-Flash-Next。 📝 Summary vLLM v0.30.0 已发布,亮点包括混合注意力热路径、DeepSeek-V4.1-Flash 和 Qwen3.8-Flash-Next。这次发布包括 762 次提交、315 名贡献者和 104 名首次参与者。 📊 Artic

  35. Simon Willison 个人技术博客 快照

    SF 10月14日:关于地球工程的羽毛之鸟会议

    SF 10月14日:羽毛之鸟关于航天工程的会议我将于10月14日星期三在旧金山与Jesse Vincent一起举办一场晚间活动,对象是那些使用编码代理并在编码代理之上构建奇怪而有趣的东西的人们。将其视为一次代理展示和讲述:与其他建设者和实验者比较您正在尝试的事情、正在学习的事情以及尚未弄清楚的事情的笔记。我们对您尚未公开讨论的工作、奇怪的实验或没有明显市场的未完成项目特别感兴趣。 期待一场流畅的对话

  36. 雷峰网·AI 科技评论 中文媒体 中文 快照

    千问办公将接入阿里云上的Salesforce

    9月22日消息,千问办公将接入阿里云上的Salesforce(Salesforce on Alibaba Cloud)。此次接入将结合千问办公的企业上下文理解、任务规划执行能力与Salesforce的客户管理能力,让企业员工能够在千问办公中查询销售商机、维护客户信息、推进业务流程,在日常办公中更便捷地处理客户管理与销售相关工作。

  37. 雷峰网·AI 科技评论 中文媒体 中文 快照

    全国工商联民营企业500强榜单公布 滴滴位列第31位

    9月22日,全国工商联发布“2026中国民营企业500强”“2026中国制造业民营企业500强”“2026中国服务业民营企业100强”榜单和《2026中国民营企业500强调研分析报告》。其中,滴滴在“民企500强”中位列第31位,“服务业民企100强”中位列第7位,双榜单排名均有稳步提升。 图为:2026中国民营企业500强发布会现场 此前不久,在浙江温州举办的2026民营经济创新发展大会上发布的“民营企业研发投入500家”榜单中,滴滴

  38. NVIDIA AI Blog 海外官方 快照

    在新加坡AI Day上,NVIDIA及其合作伙伴展示了东南亚地区的AI进步

    英伟达人工智能日新加坡将于9月1日举行22-23在莱佛士市会议中心举行,为与会者提供机会探索实践培训、专家主导的课程和先进工具,以加速他们在人工智能和高性能计算方面的工作。在此次活动中,英伟达及其合作伙伴展示了东南亚地区突破性的人工智能进步[.]

  39. OpenAI News 海外官方

    ChatGPT Ads扩展到东南亚和台湾

    ChatGPT Ads正在扩展到东南亚和台湾,为符合条件的企业提供新的方式来接触60多个国家的人们。

  40. 雷峰网·AI 科技评论 中文媒体 中文 快照

    ECCV 2026 开幕:李飞飞团队获时间检验奖,7000人挤爆马尔默

    93场Workshop,吴佳俊成全场最忙碌的人! 作者丨 幸丽娟 编辑丨 岑 峰 瑞典当地时间8点,ECCV 2026 正式迎来开幕。清晨,马尔默全城各区的参会者涌向会场,还有一群人乘坐火车横跨厄勒海峡大桥,从哥本哈根赶来。 当马尔默遇上历年来最火爆的 ECCV,这座北欧小城显然有些“措手不及”。会前,已经有不少参会者在全网“花式拼房”,然而住到哥本哈根每天跨境通勤的参会者依旧不在少数。 以至于参会者见面的第一句话都变成了:“你在马尔默

  41. 雷峰网·AI 科技评论 中文媒体 中文 快照

    Yann LeCun 万字演讲:「预测像素」是伪命题,JEPA 也并非凭空而来 | ECCV 2026

    只靠语言和 token,AI 永远跨不过物理世界这道门槛! 作者丨 幸丽娟 编辑丨岑 峰 AI 行业的主叙事,曾被 Scaling Law 垄断:更大的模型、更多的 token,更强的文本推理,仿佛只要把语言模型继续堆大,通用人工智能就会自动到来。 但这条路线撞上了天花板:预训练的边际收益肉眼可见地递减;模型一旦部署到真实世界,漏洞百出。 2026 年,“世界模型”接棒 Scaling Law,成了牌桌上最拥挤的筹码。然而,这个词本身,

  42. 雷峰网·AI 科技评论 中文媒体 中文 快照

    乐享以太大模型,让中国具身智能坐上定义席

    从“预测”到“求解”:乐享以太大模型重塑 Physical AI 解题范式。 作者丨 幸丽娟 编辑丨 董子博 具身智能行业一直在等一个 ChatGPT 时刻。 但这个时刻,未必长得像 ChatGPT 。 决定这个时刻的,不是机器人会聊天,也不是机器人学会了几个动作,而是在不确定环境里,机器人能不能自主思考、判断和执行,在无序的事件中,持续完成任务。 过去两年,行业积累的几乎全是“能力上限”的展示:选好场景、选好时机、反复调试,再拍出一条

  43. 雷峰网·AI 科技评论 中文媒体 中文 快照

    近亿元A轮融资,海外收入增长450%:ExploMar擎波探索引领千亿水上动力市场电动化

    近日,高性能电动水上动力系统企业ExploMar擎波探索宣布完成近亿元A轮融资。本轮融资由德联资本、常熟国发、苏创投、三七互娱联合投资,老股东DCM Ventures连续三轮加码。势能资本担任独家财务顾问。 融资之外,ExploMar近期释放出的另一组数据同样值得关注:2026年上半年,公司海外收入同比增长450%,业务已覆盖全球20多个国家。 而就在7月初,ExploMar连续第二年站上全球新能源船艇顶级赛事——摩纳哥新能源船挑战赛的

  44. 雷峰网·AI 科技评论 中文媒体 中文 快照

    苹果高管称不建议给iPhone贴膜!网友:免费换屏幕我就信你;高德地图成「职场版大众点评」?回应来了;Muse大火,扎克伯格身价暴涨1700亿

    要闻提示 1.苹果高管称不建议给iPhone贴膜!网友:免费换屏幕我就信你 2.知情人士:DeepSeek将向联合国安理会介绍AI风险,月之暗面等中国企业也受邀参会 3.高德地图成“职场版大众点评”?回应来了 4.字节通报二季度违规案例:114名员工被辞退,其中8人被移交司法机关处理 5.阿里Qwen4和下代视频模型均在训练中,新一代AI芯片将于2027年一季度上市 6.曝华为还将推出新形态手机 7.Meta 再次上桌!个人AI产品 M

  45. The Verge 国际媒体 快照

    OpenAI希望咨询精英数学家如何不再摸索

    在将一系列壮观的数学结果转化为声誉危机之后,OpenAI正在咨询人类数学家,以帮助其找出一条不那么灾难性的前进道路。周一,该公司宣布成立一个新的独立数学家小组,负责就其与数学研究和更广泛的人工智能领域的互动向其和其他人工智能公司提供建议。

  46. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Rollouts 与 Security Review · Cursor

    📌 One-Sentence Summary Cursor 推出 Rollouts 和 Security Review 两个机器人,强化代码交付的最后一公里,为拉取请求提供监控与安全检查。 📝 Summary Cursor 推出 Rollouts 和 Security Review 两个机器人,旨在改善代码交付的最后一公里。Rollouts 在每次变更部署时进行监控,并按环境报告其健康状况;Security Review 则在每个拉取请

  47. Simon Willison 个人技术博客 快照

    Claude Opus 5.5、GPT-6 Sol、GPT-6 Luna以及新的价格战

    昨天是Grok 4.7(鹈鹕)和MiMo v2.6 Flash/Pro(更多鹈鹕)。今天Anthropic发布了Claude Opus 5.5,大约一小时后OpenAI发布了GPT-6 Sol和GPT-6 Luna。仔细阅读所有这些新模型需要一段时间,但以下是我到目前为止的印象。GPT-6 Sol和Luna的价格仅为GPT-5.6同等产品GPT-5.6 Luna已经是我最喜欢的构建应用程序的模型,因为它结合了出色的性能和非常便宜。不知何

  48. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    🔬 奥斯卡,两颗小行星和在你的 sklearn 中算法:约翰·普拉特谈 AI 与科学

    📌 One-Sentence Summary 约翰·普拉特,AI 和科学领域的知名专家,讨论了他在谷歌的 Empirical Research Assistance(ERA)中的工作及其在解决科学问题方面的应用,包括气候变化。 📝 Summary 约翰·普拉特,AI 和科学领域的先驱,分享了他对谷歌的 Empirical Research Assistance(ERA)及其潜力在革命化科学问题解决方面的见解。他强调了 ERA 的能力在自

  49. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    GPT-6 的改进提示缓存

    📌 One-Sentence Summary OpenAI 为 GPT-6 推出改进的提示缓存系统,默认提升缓存命中率,并提供仪表盘、诊断工具和显式缓存断点等控制手段,帮助持久化 Agent 更快更省地运行。 📝 Summary OpenAI 发布 GPT-6 的改进提示缓存系统,面向需要长时间运行的持久化 Agent。新系统默认提供更高的缓存命中率,对 30 分钟内复用的合格共享前缀给予缓存折扣,缓存输入 token 最高可享 90%

  50. OpenAI News 海外官方

    针对GPT-6的更好的提示缓存

    了解GPT-6如何通过更高的缓存命中率、新的诊断、显式断点以及减少延迟和成本的控制来改进即时缓存。

  51. The Verge 国际媒体 快照

    Rabbit的新AI代理不需要R1即可运行

    正如《连线》早些时候报道的那样,这款平淡无奇的R1设备背后的公司Rabbit正在推出一款独立的人工智能代理,您不需要其硬件就可以使用它。该初创公司表示,其新的OS 3“代理操作系统”在云中运行,但在Windows、Mac和Linux设备上本地运行。根据兔子的说法,你可以[.]

  52. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Opus 5.5 对比 GPT 6 Sol 与 ChatGPT

    📌 One-Sentence Summary Peter Yang 将 Opus 5.5 与 GPT 6 Sol 和 ChatGPT 进行对比,并指出其优劣。 📝 Summary Peter Yang 将 Opus 5.5 与 GPT 6 Sol 和 ChatGPT 进行对比,阐述了对比的背景,并指出其优劣。 📊 Article Meta AI Screening: 92 Source: Peter Yang(@petergyang)

  53. The Decoder 国际媒体 快照

    OpenAI的GPT-6 Sol和Luna将价格降低了一半,但在性能上几乎没有变化

    OpenAI通过GPT-6 Sol和Luna增加了两种更便宜的型号,以象征性价格的一半提供前辈的性能,并瞄准了Anthropic更昂贵的产品。不过,独立分析发现实际情报几乎没有增加,而且OpenAI可能没有预见到Anthropic会同时推出Opus 5.5。OpenAI的GPT-6 Sol和Luna降价一半,但性能几乎没有改变文章首先出现在The Decoder上。

  54. The Verge 国际媒体 快照

    高通的Snapdragon 8 Elite Gen 6也有一个Extreme版本

    高通已经宣布了Snapdragon 8 Elite Gen 6,今年也加入了8 Elite Extreme Gen 6。该公司将这两款新手机芯片描述为旗舰产品,规格差异相对较小,主要局限于Extreme型号上的人工智能处理、视频捕获和游戏性能的改进。两个第6代芯片[.]

  55. MarkTechPost 国际媒体 快照

    Anthropic发布Claude Opus 5.5:寓言5.1级表演,运行成本比Opus 5低40%

    Anthropic发布了Claude Opus 5.5,这是其新Claude 5.5系列中的第一款型号。该团队表示,它在大多数工作中的表现都达到了Claude Fable 5.1的水平。在默认设置下,在典型工作负载上运行它的成本也比Opus 5低40%。根据Anthropic自己的基准测试,它在代理编码方面处于领先地位,[.] Anthropic发行Claude Opus 5.5:寓言5.1级性能,运行成本比Opus 5低40%,首先出

  56. Simon Willison 个人技术博客 快照

    llm 0.36

    发布时间:llm 0.36新OpenAI模型:GPT-6 Sol的gpt-6-sol和GPT-6 Luna的gpt-6-luna。#1702对于仅接受单轮提示的模型,模型插件现在可以声明supports_conservation = False。当这些模型接收助手或工具历史记录时,LLM引发llm。ConversationNotSupport,并且llm chat在开始会话之前拒绝它们。请参阅不支持对话的模型。第一个使用它的插件是llm

  57. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    欢迎 GPT-6 Sol 和 GPT-6 Luna 加入 GPT-6 宇宙

    📌 One-Sentence Summary OpenAI 推出 GPT-6 Sol 和 GPT-6 Luna,这些模型基于 GPT-6 Astra 的进展,提供更快、更便宜的模型来支持大规模工作 📝 Summary GPT-6 Sol 和 GPT-6 Luna 是基于 GPT-6 Astra 的进展而开发的更快、更便宜的模型。它们提供了 50% 的 API 价格降低,相比于 GPT-5.6 的促销价格 📊 Article Meta A

  58. Simon Willison 个人技术博客 快照

    引用@therealcornpop

    嘿,你知道如果你用人工智能为TikTok和YouTube写脚本,这是非常明显的,对吧?[...]这不仅仅是一般的人工智能主义,“这不是X,这是Y”,或者三个规则,或者非常奇怪的断断续续的写作方式,你只是用所有这些标点符号说了很多事情。听起来很深奥,其实不然这是缺乏任何东西。这是你的声音缺乏明确的矛。事实上,我可以告诉你,你对你正在谈论的事情没有意见。- @therealcornpop,在TikTok上标签:Tiktok、ai、ai-mi

  59. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Opus 5.5 生成的金门大桥 3D 场景

    📌 One-Sentence Summary Peter Yang 分享了一段由 Opus 5.5 生成的金门大桥 3D 场景,并将其与 Astra 进行对比。 📝 Summary Peter Yang 分享了一段由 Opus 5.5 生成的金门大桥 3D 场景,强调其与 Astra 的相似度,并介绍了该场景的创作背景。 📊 Article Meta AI Screening: 90 Source: Peter Yang(@peterg

  60. OpenAI News 海外官方

    GPT-6 Sol和Luna简介

    来认识一下GPT-6 Sol和Luna,这两款型号将前沿智能带入日常工作,具有不同的能力和成本平衡。

  61. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    Flash-DLLM:IO感知的KV缓存和并行解码,用于快速、内存高效的扩散LLM

    作者:Quan Nguyen-Tri、Mukul Ranjan、Shijiqiang|扩散大型语言模型(dLLM)最近通过支持非自回归文本生成而成为自回归LLM的一种有前途的替代方案。然而,它们的实际部署仍然受到效率低下的推理的限制,这主要是由于缺乏有效的Key-Value(KV)缓存和可扩展的并行解码机制。现有的加速方法通常研究KV缓存

  62. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    具有延迟信息共享的分散部分可观察团队决策方法

    作者:任晓星、托马斯·帕里西尼、安德烈亚斯·A. Malikopoulos|我们研究具有低级潜在动态和未知系统模型的分散式部分可观察团队决策问题。提出的框架将团队理论等效与低等级模型表示相结合,以解决部分可观察的Markov决策过程中的合作决策问题,而无需先验知识转移模型。每个团队成员根据l做出决定

  63. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    Abrish:将组织智能扩展至1,024个代理人

    作者:詹志浩、宋婷、李东|多代理系统可以通过并发执行工作来减少复杂任务的延迟。一些开创性的利用框架支持多代理系统。然而,当前多代理工具的可扩展性通常受到中央协调器分配任务和协调工作人员的能力的限制。为了解决这个问题,我们引入了一个可扩展的自组织多智能体,

  64. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    SpeakerMem-R1:以SpeakerMem-R1:用于多党对话的以演讲者为中心的双轨存储器

    作者:Haobo Zheng,Tan Tang,Yan Chen|在多方对话环境下的长期对话记忆需要的不仅仅是从长期对话中检索相关内容:它必须区分谁说了什么,每个陈述都涉及谁,个体如何看待彼此,群体共享哪些信息,以及状态如何随着时间的推移而变化。最近对多方对话基准的研究表明,现有的通用LLM m

  65. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    CliffCompaction:针对长期编码代理的经济高效压缩

    作者:Trang Nguyen、Eulrang Cho、Bingqing Chen|代理通常处理需要数百万上下文令牌的复杂问题,由于上下文窗口有限,因此需要在会话之间进行压缩。我们开发了CliffCompaction,这是一种自动压缩技术,可在有限环境下将成本降低高达50%,同时保持或改进码头台的性能,并实现测试时扩展和状态的新效率

  66. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    SWE-Serve:面向生产推理服务的标杆工程

    作者:Jennifer Williams、Dave Farris、Jeff Farris|我们引入SWE-Serve,这是一个用于评估生产推理工程任务代理的基准。实现推理功能可能需要协调整个服务堆栈的多个更改,包括模型支持、运行时执行和公共API。现有的基准对生产推理工程的有限覆盖范围:存储库级软件工程基准不提供

  67. The Verge 国际媒体 快照

    旧金山起诉特朗普媒体出售特朗普帖子的抢先体验

    旧金山正在起诉Truth Social背后的母公司Trump Media & Technology Group,因为它出售了对唐纳德特朗普总统在社交媒体网站上发布的帖子的抢先体验。该诉讼今天在加州州法院提起,指控Truth API提要是一项“腐败的商业计划”,违反了加州的不公平竞争[.]

  68. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    A2 M:HCP生态系统中的跟踪优化代理劫持

    作者:李来珍、王轩、赵培成|使用模型上下文协议(HCP)的代理依赖于语义匹配从第三方服务器选择工具,通过攻击者控制的元数据和输出暴露语义供应链风险。我们引入了A2 M(吸引操纵),这是一个用于劫持LCP代理的两阶段黑匣子框架。吸引力阶段优化工具元数据以增加调用概率; Manipula

  69. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    扩大收件箱,而不是背景:从无策略的支架到可重复使用的专业代理

    作者:李来珍、李佳瑞、赵娟|大型语言模型(LLM)代理通常处理相关任务流,但标准工具会反复要求模型在每个任务的上下文中重建相同的控制决策。我们研究任务反馈是否可以将循环控制转化为可重复使用的可执行代码,同时保留LLM调用用于特定于任务的语义推理。我们引入Growing Buttons,一种以失败为导向的工具

  70. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    类型安全并非无错误:受约束的决策主管遵循选项名称,而不是与之绑定的标题

    作者:孙宇、徐俊浩|类型化决策模型是为模型输出直接由软件使用的设置而构建的。它们不是生成自由格式的文本,而是返回一组预定义选项的决策。通过构造,每个输出都符合所需的模式。然而,这一保证并没有告诉我们,模型是否按照预期解释了这些选项。研究了Jev和两个带开放权的类Jev模型

  71. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    FlexXray:通用临床X射线分割

    作者:Victor Ion Butoi、Vivek Gopalakrishnan、John V. Guttag| X射线是医学上使用最广泛的成像方式,但仍然是其最少的定量。与CT或MRI等容积模式不同,X射线将3D解剖结构折叠成2D投影,导致结构重叠和解剖边界模糊,即使对专家来说也是如此。因此,标记X射线数据库以训练通用分割系统是不切实际的,留下了形态学

  72. AWS ML Blog 海外官方 快照

    Claude Opus 5.5现已在AWS上推出

    Claude Opus 5.5是Anthropic最强大的Opus模型,用于代理编码、知识工作和长期运行任务,现已在Amazon Bedrock和AWS上的Claude Platform上提供。这篇文章涵盖了Opus 5.5中的新内容、实用指南以及如何开始在Amazon Bedrock上使用该模型进行构建。

  73. Simon Willison 个人技术博客 快照

    llm-人类0.29

    发布:llm-anthropic 0.29添加对Claude Opus 5.5的支持:llm -m claude-opus-5.5“提示到这里”标签:llm,anthropic

  74. The Decoder 国际媒体 快照

    Claude Opus 5.5以更低的成本与Fable 5.1的性能相媲美,并承诺减少“Claudish”写作

    Anthropic即将推出新一代首款型号Claude Opus 5.5。该公司表示,它在大多数任务上与Claude Fable 5.1相匹配,同时运行成本比Opus 5低约40%。Anthropic的基准测试也使其在大多数任务上领先于OpenAI的GPT-6 Astra,尽管价格便宜得多。十四行诗5.5和俳句5.5预计将在未来几周推出。文章Claude Opus 5.5以较低的成本与Fable 5.1的性能相媲美,并承诺减少“Claud

  75. The Verge 国际媒体 快照

    据报道,苹果正在开发类似Whoop的健身追踪器

    据彭博社报道,苹果正在开发一款无屏幕设计的新型健身追踪器,类似于Whoop生产的追踪器。据报道,该设备的原型有“一条薄织物带,带有配备传感器的计算模块。“该设备处于开发的早期阶段,可能不会在[...]