AI 日报hiw3c.com

2026-09-23全球 AI 要闻精选,来自 30+ 信息源

聚合官方博客 · 权威媒体 · 深度通讯 · 学术信号。
只做索引,不做转载,标题与链接均指向原始发布方。

  1. BestBlogs·每日早报 BestBlogs 精选 中文

    EP184 · 长任务成本、强化学习反馈、统一推荐 · 09-23 早报

    📝 今日导语 从 Opus 5.5 的长任务成本,到 MiMo 强化学习与美团统一推荐,判断模型如何进入真实流程。 🏷 今日关键词: Claude Opus 5.5 MiMo V2.6 任务级评估 Agent Harness 企业上下文 📰 今日精选内容 Anthropic 发布 Claude Opus 5.5,长任务成本降四成 Hacker News · 文章 · 评分 93 Xiaomi MiMo-V2.6:扩展强化学习,迈向自我提

  2. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    🔬 奥斯卡,两颗小行星和在你的 sklearn 中算法:约翰·普拉特谈 AI 与科学

    📌 One-Sentence Summary 约翰·普拉特,AI 和科学领域的知名专家,讨论了他在谷歌的 Empirical Research Assistance(ERA)中的工作及其在解决科学问题方面的应用,包括气候变化。 📝 Summary 约翰·普拉特,AI 和科学领域的先驱,分享了他对谷歌的 Empirical Research Assistance(ERA)及其潜力在革命化科学问题解决方面的见解。他强调了 ERA 的能力在自

  3. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    GPT-6 的改进提示缓存

    📌 One-Sentence Summary OpenAI 为 GPT-6 推出改进的提示缓存系统,默认提升缓存命中率,并提供仪表盘、诊断工具和显式缓存断点等控制手段,帮助持久化 Agent 更快更省地运行。 📝 Summary OpenAI 发布 GPT-6 的改进提示缓存系统,面向需要长时间运行的持久化 Agent。新系统默认提供更高的缓存命中率,对 30 分钟内复用的合格共享前缀给予缓存折扣,缓存输入 token 最高可享 90%

  4. OpenAI News 海外官方

    针对GPT-6的更好的提示缓存

    了解GPT-6如何通过更高的缓存命中率、新的诊断、显式断点以及减少延迟和成本的控制来改进即时缓存。

  5. The Verge 国际媒体 快照

    Rabbit的新AI代理不需要R1即可运行

    正如《连线》早些时候报道的那样,这款平淡无奇的R1设备背后的公司Rabbit正在推出一款独立的人工智能代理,您不需要其硬件就可以使用它。该初创公司表示,其新的OS 3“代理操作系统”在云中运行,但在Windows、Mac和Linux设备上本地运行。根据兔子的说法,你可以[.]

  6. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Opus 5.5 对比 GPT 6 Sol 与 ChatGPT

    📌 One-Sentence Summary Peter Yang 将 Opus 5.5 与 GPT 6 Sol 和 ChatGPT 进行对比,并指出其优劣。 📝 Summary Peter Yang 将 Opus 5.5 与 GPT 6 Sol 和 ChatGPT 进行对比,阐述了对比的背景,并指出其优劣。 📊 Article Meta AI Screening: 92 Source: Peter Yang(@petergyang)

  7. The Decoder 国际媒体 快照

    OpenAI的GPT-6 Sol和Luna将价格降低了一半,但在性能上几乎没有变化

    OpenAI通过GPT-6 Sol和Luna增加了两种更便宜的型号,以象征性价格的一半提供前辈的性能,并瞄准了Anthropic更昂贵的产品。不过,独立分析发现实际情报几乎没有增加,而且OpenAI可能没有预见到Anthropic会同时推出Opus 5.5。OpenAI的GPT-6 Sol和Luna降价一半,但性能几乎没有改变文章首先出现在The Decoder上。

  8. The Verge 国际媒体 快照

    高通的Snapdragon 8 Elite Gen 6也有一个Extreme版本

    高通已经宣布了Snapdragon 8 Elite Gen 6,今年也加入了8 Elite Extreme Gen 6。该公司将这两款新手机芯片描述为旗舰产品,规格差异相对较小,主要局限于Extreme型号上的人工智能处理、视频捕获和游戏性能的改进。两个第6代芯片[.]

  9. MarkTechPost 国际媒体 快照

    Anthropic发布Claude Opus 5.5:寓言5.1级表演,运行成本比Opus 5低40%

    Anthropic发布了Claude Opus 5.5,这是其新Claude 5.5系列中的第一款型号。该团队表示,它在大多数工作中的表现都达到了Claude Fable 5.1的水平。在默认设置下,在典型工作负载上运行它的成本也比Opus 5低40%。根据Anthropic自己的基准测试,它在代理编码方面处于领先地位,[.] Anthropic发行Claude Opus 5.5:寓言5.1级性能,运行成本比Opus 5低40%,首先出

  10. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    欢迎 GPT-6 Sol 和 GPT-6 Luna 加入 GPT-6 宇宙

    📌 One-Sentence Summary OpenAI 推出 GPT-6 Sol 和 GPT-6 Luna,这些模型基于 GPT-6 Astra 的进展,提供更快、更便宜的模型来支持大规模工作 📝 Summary GPT-6 Sol 和 GPT-6 Luna 是基于 GPT-6 Astra 的进展而开发的更快、更便宜的模型。它们提供了 50% 的 API 价格降低,相比于 GPT-5.6 的促销价格 📊 Article Meta A

  11. Simon Willison 个人技术博客 快照

    引用@therealcornpop

    嘿,你知道如果你用人工智能为TikTok和YouTube写脚本,这是非常明显的,对吧?[...]这不仅仅是一般的人工智能主义,“这不是X,这是Y”,或者三个规则,或者非常奇怪的断断续续的写作方式,你只是用所有这些标点符号说了很多事情。听起来很深奥,其实不然这是缺乏任何东西。这是你的声音缺乏明确的矛。事实上,我可以告诉你,你对你正在谈论的事情没有意见。- @therealcornpop,在TikTok上标签:Tiktok、ai、ai-mi

  12. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Opus 5.5 生成的金门大桥 3D 场景

    📌 One-Sentence Summary Peter Yang 分享了一段由 Opus 5.5 生成的金门大桥 3D 场景,并将其与 Astra 进行对比。 📝 Summary Peter Yang 分享了一段由 Opus 5.5 生成的金门大桥 3D 场景,强调其与 Astra 的相似度,并介绍了该场景的创作背景。 📊 Article Meta AI Screening: 90 Source: Peter Yang(@peterg

  13. OpenAI News 海外官方

    GPT-6 Sol和Luna简介

    来认识一下GPT-6 Sol和Luna,这两款型号将前沿智能带入日常工作,具有不同的能力和成本平衡。

  14. The Verge 国际媒体 快照

    旧金山起诉特朗普媒体出售特朗普帖子的抢先体验

    旧金山正在起诉Truth Social背后的母公司Trump Media & Technology Group,因为它出售了对唐纳德特朗普总统在社交媒体网站上发布的帖子的抢先体验。该诉讼今天在加州州法院提起,指控Truth API提要是一项“腐败的商业计划”,违反了加州的不公平竞争[.]

  15. AWS ML Blog 海外官方 快照

    Claude Opus 5.5现已在AWS上推出

    Claude Opus 5.5是Anthropic最强大的Opus模型,用于代理编码、知识工作和长期运行任务,现已在Amazon Bedrock和AWS上的Claude Platform上提供。这篇文章涵盖了Opus 5.5中的新内容、实用指南以及如何开始在Amazon Bedrock上使用该模型进行构建。

  16. The Decoder 国际媒体 快照

    Claude Opus 5.5以更低的成本与Fable 5.1的性能相媲美,并承诺减少“Claudish”写作

    Anthropic即将推出新一代首款型号Claude Opus 5.5。该公司表示,它在大多数任务上与Claude Fable 5.1相匹配,同时运行成本比Opus 5低约40%。Anthropic的基准测试也使其在大多数任务上领先于OpenAI的GPT-6 Astra,尽管价格便宜得多。十四行诗5.5和俳句5.5预计将在未来几周推出。文章Claude Opus 5.5以较低的成本与Fable 5.1的性能相媲美,并承诺减少“Claud

  17. The Verge 国际媒体 快照

    据报道,苹果正在开发类似Whoop的健身追踪器

    据彭博社报道,苹果正在开发一款无屏幕设计的新型健身追踪器,类似于Whoop生产的追踪器。据报道,该设备的原型有“一条薄织物带,带有配备传感器的计算模块。“该设备处于开发的早期阶段,可能不会在[...]

  18. Simon Willison 个人技术博客 快照

    llm-typesafe 0.1a0

    发布:llm-typesafe 0.1a0我为LLM构建了这个新插件,以添加对TypSafe AI新Jev型号的支持。这样安装:llm安装llm-typesafe然后设置一个API密钥(在这里获取一个,等待列表似乎移动得很快):llm keys set typesafe # Paste key现在您可以问这样的是/否“noul”问题:llm -m jev '请退还我的最后一笔付款。'\ -s '此消息是否明确要求退款?'输出:{'类型'

  19. AWS ML Blog 海外官方 快照

    在Amazon SageMaker AI上实现并发扫描的适当大小生成AI端点

    并发扫描可以通过在不断增加的负载水平下系统性地对生成性AI端点进行基准测试,帮助您在Amazon SageMaker AI上正确调整生成性AI端点的大小。这篇文章讲述了部署模型、使用CLARAIBenchmarkJob API运行自动并发扫描,并使用结果来制定有关车队规模的数据驱动容量决策。

  20. AWS ML Blog 海外官方 快照

    Trane如何通过Amazon Bedrock AgentCore以60倍的速度构建见解

    在大约四周的时间里,Trane Networks在Amazon Bedrock AgentCore上构建了一个人工智能驱动的代理解决方案,该解决方案将20分钟的多屏幕建筑诊断工作流程减少到20秒的自然语言交互,洞察时间提高了60倍。这篇文章分享了解决方案背后的架构方法和关键设计决策。

  21. The Decoder 国际媒体 快照

    OpenAI呼吁制定可以自我改进的AI国际标准

    OpenAI希望制定国际标准来实现循环自我改进,人工智能系统独立构建下一代人工智能。如果没有保障措施,人类可能会失去对这一过程的控制。OpenAI表示,美国应该在全球衡量标准和监督规则方面发挥带头作用。OpenAI呼吁制定可以自我改进的人工智能国际标准的文章首先发表在The Decoder上。

  22. AWS ML Blog 海外官方 快照

    Tata Elxsi如何在AWS上几秒钟内检测工业安全风险

    了解Tata Elxsi如何在AWS上构建实时工业安全平台IRIS。IRIS在边缘过滤摄像机视频,通过Amazon Kinesis传输元数据,在Amazon SageMaker AI上运行计算机视觉,并将检测结果与高置信度警报关联起来,在几秒钟内检测到不安全条件,而不是几分钟。

  23. AWS ML Blog 海外官方 快照

    利用Agentforce和AWS扩展公共部门情报

    公共部门机构处理大量非结构化证据,如人体摄像机镜头和扫描文件。这篇文章展示了如何将Amazon Bedrock Data Automation与Model Context Protocol(MCP)相结合,将数据转化为结构化见解,并通过Salesforce Agentforce中的自然语言查询将其呈现出来。

  24. IEEE Spectrum AI 国际媒体 快照

    当你可以将一篇研究论文变成人工智能代理时,为什么要阅读它?

    您是否曾经读过《科学》或《自然》杂志的一篇论文并想:“天哪,这项研究太酷了。我希望我能在自己的数据上尝试这种方法,”结果却花了一周的时间与别人的无证回购、破碎的依赖项和半成品的readme.url作斗争?好吧,现在你或多或少可以了。向Paper2Agent打个招呼,这是一个新的开源框架,可以将学术报告转化为您可以对话的交互式人工智能代理。给它一份论文以及随附的代码库、数据或其他补充材料,系统就会自动提取核心工作流程,然后启动测试

  25. 雷峰网·AI 科技评论 中文媒体 中文 快照

    一张硬件卡片,一场上下文之争:千问办公押注企业Agent

    一场两小时的客户拜访,双方说的话加起来上万字。但回到工位,销售能凭记忆敲进 CRM的,通常不到三百字。 剩下的去哪了?跟着出租车一起走了。 这样的对话在企业里每天都在发生。会议室里的争论、客户办公室里随口的一句提醒、老师傅肚里的经验,信息密度最高的这些话,几乎都发生在电脑屏幕之外,从来没有进入过任何一套企业系统。 另一边,已经沉淀在文档、群聊和系统里的数据,也常常因为没做结构化,或者 体量太大,塞不进 上下文 窗口 , Agent根本调

  26. 雷峰网·AI 科技评论 中文媒体 中文 快照

    极氪9X正式出海,中国旗舰直面对决保时捷、劳斯莱斯

    9月22日,中国高端新能源品牌旗舰车型极氪9X,正式发运阿联酋,开启规模化出海。作为中国新一代豪华旗舰,极氪9X在阿联酋售价超80万元,欧洲售价近100万元人民币,被外媒称为“最贵中国车”,正加速拓展至中东、中亚、欧洲、拉美等核心市场。 极氪9X搭载全球领先的SEP浩瀚超级电混架构,以极致的性能操控和安全能力,在海外市场“未发先火”,部分国家和地区加价超过50万,与保时捷、劳斯莱斯、宾利等海外传统超豪华品牌展开直面竞争。

  27. The Decoder 国际媒体 快照

    来自实验室培养的神经元的微型软件层有望实现更快、更便宜的人工智能视频

    生物计算公司希望与AWS合作,销售一种文本到视频的模型,该模型的运行速度将提高五倍,成本将降低80%,这要归功于一个来自真实神经细胞的软件层。这个微小的层在基本模型上增加了不到0.1%,但初创公司不会说是哪种模型。来自实验室生长神经元的微小软件层承诺更快,更便宜的AI视频首次出现在The Decoder上。

  28. MIT Tech Review AI 国际媒体 快照

    圆桌会议:虚拟边境墙的致命失败

    过去25年来,美国斥资数十亿美元在南部边境建造了一堵由监视塔组成的“虚拟墙”,承诺它们将帮助发现和逮捕越境者并拯救生命。但麻省理工学院技术评论的一项开创性调查记录了超过1000人通过这些塔监视的区域。

  29. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    与 Epoch AI 的 JS Denain 一起 辩论 RSI 、 美国-中国差距 与 波动性

    📌 One-Sentence Summary 与 Epoch AI 的 JS Denain 一起 辩论 RSI 、 美国-中国差距 与 波动性 📝 Summary 本文讨论了 RSI (递归自我改进)的现状及其对 AI 发展的影响,包括美中差距与波动性,并采访了 Epoch AI 的 JS Denain 他分享了对此主题的见解。 💡 Main Points RSI 是现代 AI 战略的关键组成部分,推动创新与竞争 文章强调 RSI 在推

  30. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    Jev 不是小型 LLM:系统一模型技术指南

    📌 One-Sentence Summary Jev 是一款颠覆了传统 LLM 架构的系统一模型,它在声明的输出空间上返回概率质量,适用于需要快速且准确做出决策的应用场景。 📝 Summary 本文阐述了 Jev 的架构与特性,这是一款与传统 LLM 不同的系统一模型。文章讨论了 Jev 如何在声明的输出空间上返回概率质量,以及这如何实现更快速、更准确的决策。同时,文章还介绍了适用于 Jev 的五种模式,包括网关 (gate)、路由器

  31. IEEE Spectrum AI 国际媒体 快照

    未来是无风扇的:液体冷却人工智能服务器的100%热捕获

    这篇文章是由艺康公司CoolIT为您带来的。超过250 kW的服务器机架不能再通过液体和空气的混合方法冷却。在此密度下,70/30的液体-空气分流留下75 kW的空气负载。移动它所需的空气冷却系统带来了成本和复杂性,很少有运营商会接受。答案是几乎全部的热量捕获。液体有效地吸收了所有的热量,空气下降到负载的1%以下,使服务器能够在无风扇的情况下运行。CoolIT今天使用经过六代无风扇设计验证的模块化冷板模块构建这些环路。处理器散热

  32. NVIDIA AI Blog 海外官方 快照

    NVIDIA Isaac ROS 5.0推进大型开源机器人开发

    为了构建和部署能够在动态环境中感知、推理和行动的复杂机器人应用程序,开发人员需要新的物理人工智能模型和工具。LOS开放框架是Open Robotics的一个项目,旨在帮助人类构建机器人。NVIDIA Isaac LOS 5.0 -一系列基于LOS构建的PU加速包,今天在[.]发布

  33. The Decoder 国际媒体 快照

    小米经济实惠的旗舰AI引领开放模式,Anthropic表示Claude帮助实现了这一目标

    凭借MiMo-V2.6-Pro,小米跻身公开上市的人工智能型号之首,并大幅削弱了价格竞争。耗资262万美元的大规模强化学习使这成为可能。但成功也伴随着一个问题:Anthropic指责该公司从Claude那里窃取训练数据。这篇文章是小米经济实惠的旗舰AI引领开放型号,Anthropic表示克劳德帮助实现这一目标的文章首先出现在The Decoder上。

  34. 雷峰网·AI 科技评论 中文媒体 中文 快照

    《AGI市场观察》发布:四款国产模型周用量破10万亿tokens,DeepSeek与混元占比近半

    日前,智能经济30人论坛AGI测评中心发布最新一期《AGI市场观察》(2026年9月12日-18日)。报告以OpenRouter词元消耗数据、各厂商官方披露价格及Arena基准测评为基础,对国产大语言模型做周度量化追踪,本期围绕用量、份额、集中度、价格与性价比等方面给出观察。 数据显示,深度求索于9月10日下调DeepSeek V4 Flash及V4.1 Flash定价,后者周用量随之增长483.62%,位次由第9升至第2;腾讯Hy4

  35. 雷峰网·AI 科技评论 中文媒体 中文 快照

    阿里云加速构建Agentic Cloud:推出AgentCore、新一代CPFS等重磅新品

    9月22日,2026杭州云栖大会上,阿里云CTO李飞飞系统性阐述了Agentic Cloud 战略布局,阿里云将Model、Harness、Context作为核心构建场景,推出全新的云上算力底座和Agent 构建治理平台AgentCore、Agent Sandbox、新一代高性能存储CPFS等一系列新品,让 AI 真正进入生产流程、走向规模化价值创造。 随着2026年Agent的爆发式增长,越来越多的智能体正跨过“问答型”的分水岭,进入

  36. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    有效第三方评估的优先事项和原则

    📌 One-Sentence Summary OpenAI 承诺支持独立评估,提供训练、评估和部署的深度访问,并提出了四个评估优先事项。 📝 Summary OpenAI 宣布其承诺支持独立评估,提供训练、评估和部署的深度访问。该公司提出了四个评估优先事项:独立评估安全案例、评估关键保障措施、评估能力评估和独立调查关键偏离事件。 💡 Main Points OpenAI 致力于支持独立评估,提供训练、评估和部署的深度访问。 OpenAI

  37. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    「问题开局」显著提升深度研究智能体的检索效果

    📌 One-Sentence Summary 一篇论文表明,通过名为「问题开局」的方法改进首次检索步骤,可将深度研究智能体在 BrowseComp-Plus 上的准确率最高提升 7.4 个百分点,代价仅是增加少量工具调用。 📝 Summary 该推文介绍了一篇论文,指出首次检索步骤对深度研究智能体至关重要。论文提出的「问题开局」方法在智能体开始搜索前运行:将问题拆解为线索,把每条线索转化为互补的搜索,汇总并重排结果,再用这一排序结果作为