AI 日报hiw3c.com

2026-10-02全球 AI 要闻精选,来自 30+ 信息源

聚合官方博客 · 权威媒体 · 深度通讯 · 学术信号。
只做索引,不做转载,标题与链接均指向原始发布方。

  1. The Decoder 国际媒体 快照

    Cloudflare表示,其新的Clef模型意味着人类不再需要参与AI代理的循环

    借助Clef和Clef-Flash,Cloudflare正在挑战TypSafe AI的Jev决策模型。Clef-Flash在大约39毫秒内提供分类,比Jev快十倍多。这两个模型都是基于Qwen构建的,在Apache 2.0下获得许可,旨在让人工智能代理在不生成文本的情况下做出结构化决策。文章Cloudflare表示,其新的Clef模型意味着人类不再需要参与其中,因为人工智能代理首先出现在The Decoder上。

  2. MarkTechPost 国际媒体 快照

    NVIDIA宣布推出DGX Spark 64GB:用于本地AI代理、微调和推理的1 PetaFLOP Grace Blackwell台式机

    英伟达宣布推出新的64 GB配置DGX Spark -来自宏碁、华硕、戴尔、字节、惠普和微星--其基于GB 10的桌面人工智能系统。它为开发人员提供了一种从本地模型和代理的一个系统开始的方法,然后在整个集群中集群集群两个64 GB单元以获得128 GB内存和更多计算时[..]发布后,NVIDIA宣布DGX Spark 64 GB:用于本地AI代理、微调和推理的1-PetaFLOP Grace Blackwell桌面首次出现在MarkTe

  3. TechCrunch AI 国际媒体 快照

    称其为人工智能,称其为超级智能,只有2%的消费者购买它

    本周,白宫几乎所有主要科技公司首席执行官--扎克伯格、贝佐斯、马斯克和Anthropic的达里奥·阿莫迪等--都聚集在一个房间里,签署了唐纳德·特朗普总统称之为“道德约束力”的人工智能安全承诺。特朗普还签署了一项行政命令,正式将人工智能更名为“超级智能”,与此同时,Meta和OpenAI正在为其人工智能产品贴上更友好的面孔,即使是最大的钱[.]

  4. TechCrunch AI 国际媒体 快照

    它不再是人工智能,而是“超级智能”(据白宫称)

    本周,白宫几乎所有主要科技公司首席执行官--扎克伯格、贝佐斯、马斯克和Anthropic的达里奥·阿莫迪等--都聚集在一个房间里,签署了唐纳德·特朗普总统称之为“道德约束力”的人工智能安全承诺。特朗普还签署了一项行政命令,正式将人工智能更名为“超级智能”,与此同时,Meta和OpenAI正在为其人工智能产品贴上更友好的面孔,即使是最大的钱[.]

  5. The Verge 国际媒体 快照

    分手(与埃隆·马斯克)很难

    在一部回归MySpace风格的网络剧中,希冯·齐利斯(Shivon Zilis)宣布她和四个孩子的父亲埃隆·马斯克(Elon Musk)在X上分手。为此,她引用了“Big Tech Alert”的一篇帖子,该帐户除其他外,还监控哪些帐户相互关注和取消关注。该帖子指出[.]

  6. The Verge 国际媒体 快照

    Beehiiv创作者对新的价格上涨感到兴奋

    Beehiiv是一个创作者平台,作为Substack的替代品,它越来越受欢迎,它正在提高价格,许多用户对此并不满意。Beehiiv联合创始人兼首席执行官Tyler Denk在一篇解释这一增长的帖子中表示,这将使该公司能够“继续投资于我们的核心平台体验。“作为变化的一部分,[.]

  7. The Verge 国际媒体 快照

    Nacon的新PS5控制器可以混合手机和游戏机的音频

    Nacon宣布,该公司声称这是世界上第一个正式授权的PlayStation 5控制器,该控制器具有内置屏幕,可调整操纵杆灵敏度或重新映射游戏手柄上的按钮等设置。Revolution 5 Unlimited的屏幕还可用于混合来自多个来源的音频,因此在使用一副耳机时[.]

  8. OpenAI News 海外官方

    GPT-6系列型号指南

    了解初创公司如何选择GPT-6模型、调整推理工作、改进提示和技能、协调工具以及准备生产工作流程。

  9. MIT Tech Review AI 国际媒体 快照

    用自主人工智能重新定义企业智能

    企业人工智能不再是未来的野心。它正在全面运行。模型能力的发展速度超出了大多数组织的吸收速度,而性能成本则持续下降。从全球来看,2026年人工智能投资将达到2.5万亿美元,比上年增长44%。对于许多企业来说,这笔投资已经.

  10. The Verge 国际媒体 快照

    缪斯的生意中出现了点

    OpenAI对Muse的回应于本周发布,它看起来很像穿着西装打着领带的Muse。Dots是一款商业优先的产品--至少目前是这样--每月至少花费100美元。当然,你可以制作一个可爱的小Dot角色,就像你可以制作[.]

  11. AWS ML Blog 海外官方 快照

    在Amazon SageMaker AI上微调具有多回合RL的搜索代理

    微调向小型搜索代理传授您的工具和环境,以较低的延迟和成本赋予其前沿模型的可靠性。在这篇文章中,我们在Amazon SageMaker AI上通过多轮强化学习(MTRL)对LLM驱动的搜索代理进行了微调,并分享了我们在检索质量和可靠性方面测量的收益。

  12. The Verge 国际媒体 快照

    Keurig的新机器使用无塑料压缩咖啡包

    Keurig的新款单杯咖啡机提供了与普及其电器相同的便利性,但不使用塑料和铝制可回收咖啡包。该公司两年前首次展示了其Keurig Alta机器,同时推出了名为AltaRounds的圆盘状豆荚替代品,该替代品将压制的咖啡渣包裹在植物性涂层中[.]

  13. The Verge 国际媒体 快照

    派拉蒙的华纳兄弟超级合并游戏将更名为Skydance

    派拉蒙Skydance首席执行官大卫·埃里森(David Ellison)宣布,下周与华纳兄弟探索频道(Warner Bros. Discovery)完成1100亿美元的合并后,该公司将更名为Skydance。埃里森在X上的一篇文章中写道,“我们想要一个名字,让合并后的公司有自己的身份,同时允许派拉蒙和[.]

  14. The Verge 国际媒体 快照

    特斯拉的复苏遭遇减速带

    特斯拉第三季度的汽车销量比一年前要少,当时消费者纷纷从即将到期的电动汽车购买联邦税收抵免中获利。但该公司仍超出了华尔街的预期,这表明其复苏仍在正轨上。特斯拉表示,其共生产了464,391辆[.]

  15. The Decoder 国际媒体 快照

    人工智能在速度和准确性上击败了执业会计师,但在没有监督的情况下仍然无法结账

    根据Mercor的一项研究,当前的人工智能模型在结构化会计任务方面的速度和准确性都优于获得许可的注册会计师。十八个月前,他们还远远落后。然而,在要求更高的APEX基准上,没有一个模型能够完全完成所有任务。如果没有人类的监督,人工智能仍然无法自行结账。文章人工智能在速度和准确性上击败了执业会计师,但在没有监督的情况下仍然无法结账,首先出现在The Decoder上。

  16. MIT Tech Review AI 国际媒体 快照

    不要被愚弄--LLM不会推理

    2016年3月的一个下午,在首尔,我观看了我帮助制作的一个程序,在棋盘的第五行上放了一块石头,看起来就像是送给人类对手的礼物。这场五场比赛的第二场比赛中的第37步看起来如此荒谬,以至于一些评论员认为这是.

  17. The Decoder 国际媒体 快照

    黑森林实验室推出Flux 3 Image,具有多步编辑功能,无需使用图片的其余部分

    黑森林实验室发布了Flux 3 Image,这是其Flux 3型号系列的图像侧。它支持多步骤编辑,而无需更改图像的其他部分,允许用户使用边界框和最多十个参考图像组成场景,并输出最高4K。开放式举重将在未来几周内举行。文章Black Forest Labs推出Flux 3 Image,具有多步编辑功能,无需使用您的照片的其余部分,首先出现在The Decoder上。

  18. MarkTechPost 国际媒体 快照

    AWS Strands Labs发布Strands Decider 2B:一个开源决策模型,可在大约115 ms内选择选项

    AWS的Strands Agents团队发布了Strands Decider 2B,这是一个基于Qwen3.5-2B-Base构建的Apache-2.0决策模型。它返回选择,是/否概率和分数与校准的信心在一个向前传递,从来没有文本。它在RTX 3090上运行的中值为115 ms,在JevBench公共集上的得分为0.723,这使其成为AI代理中路由,工具选择和护栏的快速本地选项。AWS Strands Labs发布Strands Dec

  19. BestBlogs·每日早报 BestBlogs 精选 中文

    EP193 · Claude 拓展科研方法|DHH 宣布告别手写代码|Tessl 核算软件工厂成本 · 10-02 早报

    📝 今日导语 Claude 辅助科研、DHH 告别手写代码、Tessl 核算成本:理解 AI 协作的验证与收益。 🏷 今日关键词: 科研协作 DHH 手写代码 软件工厂 模型路由 AI 网关 检索模型 📰 今日精选内容 Claude 时代的科学 Anthropic Research · 文章 · 评分 91 每日脉动:RoR 作者再次引发‘手写代码终结论’辩论 The Pragmatic Engineer · 文章 · 评分 90 60

  20. 雷峰网·AI 科技评论 中文媒体 中文 快照

    连败6场遭强制执行 寒武纪前高管无端再提天价索赔 谁最受伤?

    寒武纪9月30日晚间发布公告称,在2025年11月、2026年8月,北京市海淀区人民法院、北京市第一中级人民法院分别做出一审、二审(终审)判决,梁军均败诉。案件走向也进入司法强制执行阶段。 不止如此,在双方的股权诉讼纠纷中,梁军已经接连输掉6起诉讼。多起案件共同指向其诉求的核心事实与法律定性,已有司法定论,寒武纪及其相关方的合法权益获得法律支持。 梁军方面并不愿正视既定司法结果。就在近期,梁军修改其诉讼请求,调整诉讼金额,企图以劳动纠纷

  21. MarkTechPost 国际媒体 快照

    Cloudflare发布Clef和Clef-Flash:开放权重决策模型,返回类型概率而不是文本

    Cloudflare发布了Clef(27 B)和Clef-Flash(9 B),这是开放权重决策模型,可以返回输入概率而不是文本。它们与Jev-API兼容,接受图像,并在Workers AI上以209.3 ms和38.8 ms的平均延迟运行。Cloudflare发布Clef和Clef-Flash:返回类型概率而不是文本的开放权重决策模型首次出现在MarkTechPost上。

  22. MarkTechPost 国际媒体 快照

    Google Research的Kauldron编码指南:纯数据配置、字符串连接的组件以及您可以端到端阅读的JAX训练器

    在这本全面的编码指南中,我们探讨了Google Research的Kauldron--一个针对研究速度和模块化进行了优化的JAX训练库。了解konfig如何将实验转化为纯词典、kontext通过字符串路径连接组件以及ktyping强制执行运行时形状检查。Google Research的Kauldron编码指南:纯数据的配置、通过字符串连接的组件以及您可以端到端阅读的JAX训练器的帖子首先出现在MarkTechPost上。

  23. NVIDIA AI Blog 海外官方 快照

    NVIDIA图形处理器如何帮助加速OpenAI的GPT-6 Astra Ultrafast

    GPT-6 Astra Ultrafast在NVIDIA Blackwell图形处理器上运行,现已在OpenAI API中提供,并向符合资格的ChatGPT Work和Codex用户提供。Ultrafast通过利用NVIDIA Blackwell架构功能的OpenAI模型进行推理优化来加速,提供的代币生成速度比Astra标准模式快8倍。对于开发人员来说,[.]

  24. AWS ML Blog 海外官方 快照

    利用Amazon Quick在人工智能构建的应用程序中提供实时受监管的数据

    通过Amazon Quick中的应用程序中的实时数据,人工智能构建的应用程序可以实时查询您所管理的Quick Sight数据集,而不是静态的构建时快照。每个查询都以查看应用程序的人的身份运行,因此行级和列级安全性适用于每个读者。了解如何使用自然语言构建、发布和共享实时数据应用程序。

  25. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    Claude 时代的科学

    📌 One-Sentence Summary Matthew Schwartz 教授介绍了 'BootLoops',该工具包旨在利用 LLM 解决「Claude 形状」问题——即 AI 在跨学科的编码和数学合成方面表现优异的定量科学任务。 📝 Summary Matthew Schwartz 教授讨论了 AI 加速科学研究方法的转变,从将 LLM 视为通用研究助手转变为将其视为合作者。通过识别「Claude 形状」问题——即那些与 AI

  26. The Decoder 国际媒体 快照

    近一半的测试对象在一分钟通话中将Tavus的AI视频化身误认为是真人

    Tavus推出了Griffin,该公司称之为第一个“人类互动模型”。“人工智能实时进行视频通话,处理面部表情、语气和手势。在Tavus的一项研究中,48%的参与者在打了一分钟电话后相信格里芬是一个真实的人。之前的系统最大值为2%。文章近一半的测试对象在一分钟通话中将塔沃斯的人工智能视频化身误认为是真人,该文章首先出现在The Decoder上。

  27. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    一个动画化的基础:实时化身的高斯混合形状蒸馏

    作者:Ramazan Fazylov、Stamatis Lefkimmiatis、Ivan Laptev| 3D高斯化身支持快速渲染,然而,它们的实时动画经常受到昂贵的神经推理的挑战。我们解决了这个瓶颈,并表明预训练的化身模型的动画可以通过与身份无关的混合形状的线性组合来接近。在这一发现的基础上,我们引入了GALA(通过线性逼近的高斯动画),这是一个

  28. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    KaliBench:在Kali Linux上使用网络安全工具的细粒度基准,具有免运行时可验证奖励

    作者:李小鹏、Naufal Suryanto、张思成|LLM越来越多地应用于网络安全工作流程,预计它们将分析师的意图转化为工具调用。然而,现有的评估侧重于基于知识的评估或端到端代理任务,并且不直接衡量LLM为现实世界的网络安全工具生成可执行命令的能力。这一差距至关重要,因为网络安全运营依赖

  29. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    重建、实践、现实:有指导的自我完善

    作者:王艳珍、江浩哲、邓淑英|在不同任务中建立可靠的机器人能力需要大量的人力努力来开发和维护技能、设计奖励以及集成感知与控制。我们提出了重建、实践、真实(RPG),这是一个用于在不更新模型权重的情况下自主改进机器人执行系统的框架。RPG识别离线数据集中的操纵能力并卸载

  30. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    嵌入预测有助于图像生成

    作者:徐思瀚、谢继、王紫林|在扩散变换器中,类标签或文本提示被嵌入一次,并且在每个去噪步骤中重复使用相同的条件。我们问预测嵌入是否可以作为这个条件。下一个嵌入预测自回归(NEPA)训练Transformer预测序列中的下一个连续嵌入。在生成中,干净的图像跟随有噪的图像,因此其嵌入

  31. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    Scholar催化剂:检索有助于新研究的论文的基准

    作者:Sohyeon Kim、Yoonho Lee、Bo Liu|是什么让伟大的科学家变得伟大?即使人工智能系统开始在开放问题上取得进展,科学家们在感知埋藏在不断增长的研究档案中的哪一个先前想法方面仍然远远领先于他们。为了研究这项技能,我们聘请了第一手了解哪些早期工作推进了他们已完成的项目的研究人员,论文可以作为其中想法的指针。美国

  32. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    SILSA:用于拓扑保持高分辨率3D生成的滑动窗口切片潜伏期

    作者:余天娇、李新卓、申一帆|高分辨率3D生成越来越依赖于体素潜伏和多阶段管道,这些管道首先预测活动结构,然后合成局部几何形状。虽然有效,但这种设计将连续的表面分裂成许多局部标记,增加了生成成本,并且通常削弱了薄或高度连接形状的拓扑一致性。我们引入SILSA,这是一款具有布局感知的3D一代

  33. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    VISTA:互动世界中推理的视觉收件箱

    作者:韩秋实,胡克亚,邱林璐|我们表明,多模式模型具有强大的推理能力,适当的工具可以释放它们在不同交互环境中解决任务的潜力。我们引入了VISTA,这是一种视觉工具,可以提供通用多模式模型的长期视野。VISTA允许模型通过视觉观察直接感知环境,并保持无损的视觉效果。

  34. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    TACO:用于LLM微调的三进制绝对最大列单稀疏优化器

    作者:Jichao Jiichao Jiang、Cristian McGee、El Houcine Bergou|大型语言模型(LLM)的全参数微调会产生大量的优化器状态内存负担,从而限制了适合现代图形处理器的模型大小。现有的方法要么压缩优化器状态、放弃一阶梯度,要么在保留密集状态的同时更改更新几何形状。最近推出的Muon优化器通过矩阵值更新减少优化器内存。S

  35. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    FERPO:前向熵正规化政策优化

    作者:Sebastian Sanokowski、Alireza Sarmadi、Majid Khadiv|持续控制中的在线强化学习的几种最先进方法使用有学识的批评者的动作梯度来改进策略。然而,批评者通常接受过预测回报的训练,准确的价值预测不一定会产生准确的行动衍生品,这可能会导致不可靠的政策更新。我们提出前向熵正规化政策优化

  36. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    图表上成本增加的薛定汉桥完全可以解决:费曼-卡ac倾斜取代习得控制

    作者:Akshay Balsubramani|图表上的广义薛定汉桥在两个分布之间移动质量,同时对访问的州收取成本。它是通过学习受控连续时间马尔科夫链的速率来实现的,并具有恢复成本的时间差异惩罚。州成本作为费曼-卡茨倾斜纳入参考过程。成本增加的桥梁是一座普通的桥梁,

  37. AWS ML Blog 海外官方 快照

    使用NVIDIA NeMo Agent Tools和Amazon S3 Vectors构建代理内存

    了解如何使用Amazon S3 Vectors作为部署在Amazon Elastic Kubernetes Service(Amazon EKS)上的NVIDIA NeMo Agent Tools(RAT)中的持久内存层。这篇文章展示了纳特的内存子系统如何工作,以及如何使用多代理投资研究用例将Amazon S3 Vectors实施为自定义内存提供商。

  38. The Decoder 国际媒体 快照

    Ideogram表示,其新模型可以编辑图像的一部分,而不会弄乱其余部分

    Ideogram的新模型Ideogram 4.5承诺只编辑你想要的区域,同时保持图像的其余部分不变。它具有原生2K分辨率,每张图像起价为0.8美分,Runway,Pika和Leonardo AI等合作伙伴已经加入。一个开放的重量释放计划。Ideogram的文章说,它的新模型可以编辑图像的一部分,而不会弄乱其余部分。

  39. MarkTechPost 国际媒体 快照

    Kohere发布Embed 5:与Voyage 4 Large、Gemini Embeding 2和OpenAI相比

    Kohere发布了Embed 5,这是一个新的嵌入模型家族。它针对企业搜索、RAG和代理检索。型号系列分2层发货。Embed 5 Pro的目标是最高的检索质量。Embed 5 Fast针对实时查询路径上的延迟和成本。两者都接受文本、图像以及融合文本加图像输入。[.]《Kohere发布的嵌入5:如何与Voyage 4 Large、Gemini Embeding 2和OpenAI进行比较》的帖子首先出现在MarkTechPost上。

  40. OpenAI News 海外官方

    永恒的补充

    先进的人工智能对于突破性想法背后的日常工作可能最重要。探索为什么执行可以塑造下一个经济和进步的步伐。

  41. AWS ML Blog 海外官方 快照

    在AWS上实现Claude平台的多环境访问

    了解如何从单个订阅配置对AWS上的Claude Platform的安全、多环境访问:用于AWS工作负载的跨帐户SigV4、用于开发人员的工作空间范围API密钥以及用于外部环境的OIDC联合,并在专用AI服务帐户中进行工作空间级隔离。