AI 日报hiw3c.com

2026-09-23全球 AI 要闻精选,来自 30+ 信息源

聚合官方博客 · 权威媒体 · 深度通讯 · 学术信号。
只做索引,不做转载,标题与链接均指向原始发布方。

  1. BestBlogs·每日早报 BestBlogs 精选 中文

    EP184 · 长任务成本、强化学习反馈、统一推荐 · 09-23 早报

    📝 今日导语 从 Opus 5.5 的长任务成本,到 MiMo 强化学习与美团统一推荐,判断模型如何进入真实流程。 🏷 今日关键词: Claude Opus 5.5 MiMo V2.6 任务级评估 Agent Harness 企业上下文 📰 今日精选内容 Anthropic 发布 Claude Opus 5.5,长任务成本降四成 Hacker News · 文章 · 评分 93 Xiaomi MiMo-V2.6:扩展强化学习,迈向自我提

  2. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    🔬 奥斯卡,两颗小行星和在你的 sklearn 中算法:约翰·普拉特谈 AI 与科学

    📌 One-Sentence Summary 约翰·普拉特,AI 和科学领域的知名专家,讨论了他在谷歌的 Empirical Research Assistance(ERA)中的工作及其在解决科学问题方面的应用,包括气候变化。 📝 Summary 约翰·普拉特,AI 和科学领域的先驱,分享了他对谷歌的 Empirical Research Assistance(ERA)及其潜力在革命化科学问题解决方面的见解。他强调了 ERA 的能力在自

  3. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    GPT-6 的改进提示缓存

    📌 One-Sentence Summary OpenAI 为 GPT-6 推出改进的提示缓存系统,默认提升缓存命中率,并提供仪表盘、诊断工具和显式缓存断点等控制手段,帮助持久化 Agent 更快更省地运行。 📝 Summary OpenAI 发布 GPT-6 的改进提示缓存系统,面向需要长时间运行的持久化 Agent。新系统默认提供更高的缓存命中率,对 30 分钟内复用的合格共享前缀给予缓存折扣,缓存输入 token 最高可享 90%

  4. OpenAI News 海外官方

    Better prompt caching for GPT-6

    Learn how GPT-6 improves prompt caching with higher cache hit rates, new diagnostics, explicit breakpoints, and controls that reduce latency and costs.

  5. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Opus 5.5 对比 GPT 6 Sol 与 ChatGPT

    📌 One-Sentence Summary Peter Yang 将 Opus 5.5 与 GPT 6 Sol 和 ChatGPT 进行对比,并指出其优劣。 📝 Summary Peter Yang 将 Opus 5.5 与 GPT 6 Sol 和 ChatGPT 进行对比,阐述了对比的背景,并指出其优劣。 📊 Article Meta AI Screening: 92 Source: Peter Yang(@petergyang)

  6. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    欢迎 GPT-6 Sol 和 GPT-6 Luna 加入 GPT-6 宇宙

    📌 One-Sentence Summary OpenAI 推出 GPT-6 Sol 和 GPT-6 Luna,这些模型基于 GPT-6 Astra 的进展,提供更快、更便宜的模型来支持大规模工作 📝 Summary GPT-6 Sol 和 GPT-6 Luna 是基于 GPT-6 Astra 的进展而开发的更快、更便宜的模型。它们提供了 50% 的 API 价格降低,相比于 GPT-5.6 的促销价格 📊 Article Meta A

  7. Simon Willison 个人技术博客 快照

    Quoting @therealcornpop

    Hey, you know it's like super obvious if you're using AI to write your scripts for TikTok and YouTube, right? [...] It's not just the general AI-isms of "it's not X, it's Y", or the rule of three, or the really weird bro

  8. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Opus 5.5 生成的金门大桥 3D 场景

    📌 One-Sentence Summary Peter Yang 分享了一段由 Opus 5.5 生成的金门大桥 3D 场景,并将其与 Astra 进行对比。 📝 Summary Peter Yang 分享了一段由 Opus 5.5 生成的金门大桥 3D 场景,强调其与 Astra 的相似度,并介绍了该场景的创作背景。 📊 Article Meta AI Screening: 90 Source: Peter Yang(@peterg

  9. OpenAI News 海外官方

    Introducing GPT-6 Sol and Luna

    Meet GPT-6 Sol and Luna, two models that bring frontier intelligence to everyday work with different balances of capability and cost.

  10. AWS ML Blog 海外官方 快照

    Claude Opus 5.5 is now available on AWS

    Claude Opus 5.5, Anthropic's most capable Opus model for agentic coding, knowledge work, and long-running tasks, is now available on Amazon Bedrock and Claude Platform on AWS. This post covers what's new in Opus 5.5, pra

  11. Simon Willison 个人技术博客 快照

    llm-typesafe 0.1a0

    Release: llm-typesafe 0.1a0 I built this new plugin for LLM to add support for TypeSafe AI's new Jev model . Install it like this: llm install llm-typesafe Then set an API key ( get one here , the waitlist seems to move

  12. 雷峰网·AI 科技评论 中文媒体 中文 快照

    一张硬件卡片,一场上下文之争:千问办公押注企业Agent

    一场两小时的客户拜访,双方说的话加起来上万字。但回到工位,销售能凭记忆敲进 CRM的,通常不到三百字。 剩下的去哪了?跟着出租车一起走了。 这样的对话在企业里每天都在发生。会议室里的争论、客户办公室里随口的一句提醒、老师傅肚里的经验,信息密度最高的这些话,几乎都发生在电脑屏幕之外,从来没有进入过任何一套企业系统。 另一边,已经沉淀在文档、群聊和系统里的数据,也常常因为没做结构化,或者 体量太大,塞不进 上下文 窗口 , Agent根本调

  13. 雷峰网·AI 科技评论 中文媒体 中文 快照

    极氪9X正式出海,中国旗舰直面对决保时捷、劳斯莱斯

    9月22日,中国高端新能源品牌旗舰车型极氪9X,正式发运阿联酋,开启规模化出海。作为中国新一代豪华旗舰,极氪9X在阿联酋售价超80万元,欧洲售价近100万元人民币,被外媒称为“最贵中国车”,正加速拓展至中东、中亚、欧洲、拉美等核心市场。 极氪9X搭载全球领先的SEP浩瀚超级电混架构,以极致的性能操控和安全能力,在海外市场“未发先火”,部分国家和地区加价超过50万,与保时捷、劳斯莱斯、宾利等海外传统超豪华品牌展开直面竞争。

  14. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    与 Epoch AI 的 JS Denain 一起 辩论 RSI 、 美国-中国差距 与 波动性

    📌 One-Sentence Summary 与 Epoch AI 的 JS Denain 一起 辩论 RSI 、 美国-中国差距 与 波动性 📝 Summary 本文讨论了 RSI (递归自我改进)的现状及其对 AI 发展的影响,包括美中差距与波动性,并采访了 Epoch AI 的 JS Denain 他分享了对此主题的见解。 💡 Main Points RSI 是现代 AI 战略的关键组成部分,推动创新与竞争 文章强调 RSI 在推

  15. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    Jev 不是小型 LLM:系统一模型技术指南

    📌 One-Sentence Summary Jev 是一款颠覆了传统 LLM 架构的系统一模型,它在声明的输出空间上返回概率质量,适用于需要快速且准确做出决策的应用场景。 📝 Summary 本文阐述了 Jev 的架构与特性,这是一款与传统 LLM 不同的系统一模型。文章讨论了 Jev 如何在声明的输出空间上返回概率质量,以及这如何实现更快速、更准确的决策。同时,文章还介绍了适用于 Jev 的五种模式,包括网关 (gate)、路由器

  16. 雷峰网·AI 科技评论 中文媒体 中文 快照

    《AGI市场观察》发布:四款国产模型周用量破10万亿tokens,DeepSeek与混元占比近半

    日前,智能经济30人论坛AGI测评中心发布最新一期《AGI市场观察》(2026年9月12日-18日)。报告以OpenRouter词元消耗数据、各厂商官方披露价格及Arena基准测评为基础,对国产大语言模型做周度量化追踪,本期围绕用量、份额、集中度、价格与性价比等方面给出观察。 数据显示,深度求索于9月10日下调DeepSeek V4 Flash及V4.1 Flash定价,后者周用量随之增长483.62%,位次由第9升至第2;腾讯Hy4

  17. 雷峰网·AI 科技评论 中文媒体 中文 快照

    阿里云加速构建Agentic Cloud:推出AgentCore、新一代CPFS等重磅新品

    9月22日,2026杭州云栖大会上,阿里云CTO李飞飞系统性阐述了Agentic Cloud 战略布局,阿里云将Model、Harness、Context作为核心构建场景,推出全新的云上算力底座和Agent 构建治理平台AgentCore、Agent Sandbox、新一代高性能存储CPFS等一系列新品,让 AI 真正进入生产流程、走向规模化价值创造。 随着2026年Agent的爆发式增长,越来越多的智能体正跨过“问答型”的分水岭,进入

  18. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    有效第三方评估的优先事项和原则

    📌 One-Sentence Summary OpenAI 承诺支持独立评估,提供训练、评估和部署的深度访问,并提出了四个评估优先事项。 📝 Summary OpenAI 宣布其承诺支持独立评估,提供训练、评估和部署的深度访问。该公司提出了四个评估优先事项:独立评估安全案例、评估关键保障措施、评估能力评估和独立调查关键偏离事件。 💡 Main Points OpenAI 致力于支持独立评估,提供训练、评估和部署的深度访问。 OpenAI

  19. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    「问题开局」显著提升深度研究智能体的检索效果

    📌 One-Sentence Summary 一篇论文表明,通过名为「问题开局」的方法改进首次检索步骤,可将深度研究智能体在 BrowseComp-Plus 上的准确率最高提升 7.4 个百分点,代价仅是增加少量工具调用。 📝 Summary 该推文介绍了一篇论文,指出首次检索步骤对深度研究智能体至关重要。论文提出的「问题开局」方法在智能体开始搜索前运行:将问题拆解为线索,把每条线索转化为互补的搜索,汇总并重排结果,再用这一排序结果作为