AI 日报hiw3c.com

2026-09-22全球 AI 要闻精选,来自 30+ 信息源

聚合官方博客 · 权威媒体 · 深度通讯 · 学术信号。
只做索引,不做转载,标题与链接均指向原始发布方。

  1. Simon Willison 个人技术博客 快照

    llm-typesafe 0.1a0

    发布:llm-typesafe 0.1a0我为LLM构建了这个新插件,以添加对TypSafe AI新Jev型号的支持。这样安装:llm安装llm-typesafe然后设置一个API密钥(在这里获取一个,等待列表似乎移动得很快):llm keys set typesafe # Paste key现在您可以问这样的是/否“noul”问题:llm -m jev '请退还我的最后一笔付款。'\ -s '此消息是否明确要求退款?'输出:{'类型'

  2. AWS ML Blog 海外官方 快照

    在Amazon SageMaker AI上实现并发扫描的适当大小生成AI端点

    并发扫描可以通过在不断增加的负载水平下系统性地对生成性AI端点进行基准测试,帮助您在Amazon SageMaker AI上正确调整生成性AI端点的大小。这篇文章讲述了部署模型、使用CLARAIBenchmarkJob API运行自动并发扫描,并使用结果来制定有关车队规模的数据驱动容量决策。

  3. AWS ML Blog 海外官方 快照

    Trane如何通过Amazon Bedrock AgentCore以60倍的速度构建见解

    在大约四周的时间里,Trane Networks在Amazon Bedrock AgentCore上构建了一个人工智能驱动的代理解决方案,该解决方案将20分钟的多屏幕建筑诊断工作流程减少到20秒的自然语言交互,洞察时间提高了60倍。这篇文章分享了解决方案背后的架构方法和关键设计决策。

  4. The Decoder 国际媒体 快照

    OpenAI呼吁制定可以自我改进的AI国际标准

    OpenAI希望制定国际标准来实现循环自我改进,人工智能系统独立构建下一代人工智能。如果没有保障措施,人类可能会失去对这一过程的控制。OpenAI表示,美国应该在全球衡量标准和监督规则方面发挥带头作用。OpenAI呼吁制定可以自我改进的人工智能国际标准的文章首先发表在The Decoder上。

  5. AWS ML Blog 海外官方 快照

    Tata Elxsi如何在AWS上几秒钟内检测工业安全风险

    了解Tata Elxsi如何在AWS上构建实时工业安全平台IRIS。IRIS在边缘过滤摄像机视频,通过Amazon Kinesis传输元数据,在Amazon SageMaker AI上运行计算机视觉,并将检测结果与高置信度警报关联起来,在几秒钟内检测到不安全条件,而不是几分钟。

  6. AWS ML Blog 海外官方 快照

    利用Agentforce和AWS扩展公共部门情报

    公共部门机构处理大量非结构化证据,如人体摄像机镜头和扫描文件。这篇文章展示了如何将Amazon Bedrock Data Automation与Model Context Protocol(MCP)相结合,将数据转化为结构化见解,并通过Salesforce Agentforce中的自然语言查询将其呈现出来。

  7. IEEE Spectrum AI 国际媒体 快照

    当你可以将一篇研究论文变成人工智能代理时,为什么要阅读它?

    您是否曾经读过《科学》或《自然》杂志的一篇论文并想:“天哪,这项研究太酷了。我希望我能在自己的数据上尝试这种方法,”结果却花了一周的时间与别人的无证回购、破碎的依赖项和半成品的readme.url作斗争?好吧,现在你或多或少可以了。向Paper2Agent打个招呼,这是一个新的开源框架,可以将学术报告转化为您可以对话的交互式人工智能代理。给它一份论文以及随附的代码库、数据或其他补充材料,系统就会自动提取核心工作流程,然后启动测试

  8. 雷峰网·AI 科技评论 中文媒体 中文 快照

    一张硬件卡片,一场上下文之争:千问办公押注企业Agent

    一场两小时的客户拜访,双方说的话加起来上万字。但回到工位,销售能凭记忆敲进 CRM的,通常不到三百字。 剩下的去哪了?跟着出租车一起走了。 这样的对话在企业里每天都在发生。会议室里的争论、客户办公室里随口的一句提醒、老师傅肚里的经验,信息密度最高的这些话,几乎都发生在电脑屏幕之外,从来没有进入过任何一套企业系统。 另一边,已经沉淀在文档、群聊和系统里的数据,也常常因为没做结构化,或者 体量太大,塞不进 上下文 窗口 , Agent根本调

  9. 雷峰网·AI 科技评论 中文媒体 中文 快照

    极氪9X正式出海,中国旗舰直面对决保时捷、劳斯莱斯

    9月22日,中国高端新能源品牌旗舰车型极氪9X,正式发运阿联酋,开启规模化出海。作为中国新一代豪华旗舰,极氪9X在阿联酋售价超80万元,欧洲售价近100万元人民币,被外媒称为“最贵中国车”,正加速拓展至中东、中亚、欧洲、拉美等核心市场。 极氪9X搭载全球领先的SEP浩瀚超级电混架构,以极致的性能操控和安全能力,在海外市场“未发先火”,部分国家和地区加价超过50万,与保时捷、劳斯莱斯、宾利等海外传统超豪华品牌展开直面竞争。

  10. The Decoder 国际媒体 快照

    来自实验室培养的神经元的微型软件层有望实现更快、更便宜的人工智能视频

    生物计算公司希望与AWS合作,销售一种文本到视频的模型,该模型的运行速度将提高五倍,成本将降低80%,这要归功于一个来自真实神经细胞的软件层。这个微小的层在基本模型上增加了不到0.1%,但初创公司不会说是哪种模型。来自实验室生长神经元的微小软件层承诺更快,更便宜的AI视频首次出现在The Decoder上。

  11. MIT Tech Review AI 国际媒体 快照

    圆桌会议:虚拟边境墙的致命失败

    过去25年来,美国斥资数十亿美元在南部边境建造了一堵由监视塔组成的“虚拟墙”,承诺它们将帮助发现和逮捕越境者并拯救生命。但麻省理工学院技术评论的一项开创性调查记录了超过1000人通过这些塔监视的区域。

  12. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    与 Epoch AI 的 JS Denain 一起 辩论 RSI 、 美国-中国差距 与 波动性

    📌 One-Sentence Summary 与 Epoch AI 的 JS Denain 一起 辩论 RSI 、 美国-中国差距 与 波动性 📝 Summary 本文讨论了 RSI (递归自我改进)的现状及其对 AI 发展的影响,包括美中差距与波动性,并采访了 Epoch AI 的 JS Denain 他分享了对此主题的见解。 💡 Main Points RSI 是现代 AI 战略的关键组成部分,推动创新与竞争 文章强调 RSI 在推

  13. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    Jev 不是小型 LLM:系统一模型技术指南

    📌 One-Sentence Summary Jev 是一款颠覆了传统 LLM 架构的系统一模型,它在声明的输出空间上返回概率质量,适用于需要快速且准确做出决策的应用场景。 📝 Summary 本文阐述了 Jev 的架构与特性,这是一款与传统 LLM 不同的系统一模型。文章讨论了 Jev 如何在声明的输出空间上返回概率质量,以及这如何实现更快速、更准确的决策。同时,文章还介绍了适用于 Jev 的五种模式,包括网关 (gate)、路由器

  14. IEEE Spectrum AI 国际媒体 快照

    未来是无风扇的:液体冷却人工智能服务器的100%热捕获

    这篇文章是由艺康公司CoolIT为您带来的。超过250 kW的服务器机架不能再通过液体和空气的混合方法冷却。在此密度下,70/30的液体-空气分流留下75 kW的空气负载。移动它所需的空气冷却系统带来了成本和复杂性,很少有运营商会接受。答案是几乎全部的热量捕获。液体有效地吸收了所有的热量,空气下降到负载的1%以下,使服务器能够在无风扇的情况下运行。CoolIT今天使用经过六代无风扇设计验证的模块化冷板模块构建这些环路。处理器散热

  15. NVIDIA AI Blog 海外官方 快照

    NVIDIA Isaac ROS 5.0推进大型开源机器人开发

    为了构建和部署能够在动态环境中感知、推理和行动的复杂机器人应用程序,开发人员需要新的物理人工智能模型和工具。LOS开放框架是Open Robotics的一个项目,旨在帮助人类构建机器人。NVIDIA Isaac LOS 5.0 -一系列基于LOS构建的PU加速包,今天在[.]发布

  16. The Decoder 国际媒体 快照

    小米经济实惠的旗舰AI引领开放模式,Anthropic表示Claude帮助实现了这一目标

    凭借MiMo-V2.6-Pro,小米跻身公开上市的人工智能型号之首,并大幅削弱了价格竞争。耗资262万美元的大规模强化学习使这成为可能。但成功也伴随着一个问题:Anthropic指责该公司从Claude那里窃取训练数据。这篇文章是小米经济实惠的旗舰AI引领开放型号,Anthropic表示克劳德帮助实现这一目标的文章首先出现在The Decoder上。

  17. 雷峰网·AI 科技评论 中文媒体 中文 快照

    《AGI市场观察》发布:四款国产模型周用量破10万亿tokens,DeepSeek与混元占比近半

    日前,智能经济30人论坛AGI测评中心发布最新一期《AGI市场观察》(2026年9月12日-18日)。报告以OpenRouter词元消耗数据、各厂商官方披露价格及Arena基准测评为基础,对国产大语言模型做周度量化追踪,本期围绕用量、份额、集中度、价格与性价比等方面给出观察。 数据显示,深度求索于9月10日下调DeepSeek V4 Flash及V4.1 Flash定价,后者周用量随之增长483.62%,位次由第9升至第2;腾讯Hy4

  18. The Decoder 国际媒体 快照

    OpenAI表示,经过一个月的培训,其内部模型就解决了100多个长期存在的数学问题

    OpenAI表示,经过短短一个月的培训,新的内部模型就解决了100多个开放数学问题。面对数学家的批评,该公司支持高级研究所的一个独立咨询小组。但OpenAI已将其研究速度排除在该组织的咨询角色之外。文章OpenAI称,经过短短一个月的训练,其内部模型就解决了100多个长期存在的数学问题,首先出现在The Decoder上。

  19. MIT Tech Review AI 国际媒体 快照

    不要被今年夏天的人工智能炒作所愚弄

    这是一个繁忙的几个月的人工智能炒作。4月底,Anthropic声称其模型Claude Mythos比大多数安全专家更善于发现软件漏洞。然后我们发生了OpenAI-Hugging Face黑客事件,之后Anthropic(自豪地)和Meta(不情愿地)披露了涉及其模型的类似事件。这是继…

  20. The Verge 国际媒体 快照

    你能忘记你对Meta的感觉吗?

    2021年,当一名举报人提出Facebook伤害儿童的戏剧性指控时,首席执行官马克·扎克伯格在Facebook上发表了反驳。“我们非常关心安全、福祉和心理健康等问题。很难看到歪曲我们的工作和动机的报道,”他在给Meta工作人员的一份说明中写道,他[...]

  21. 雷峰网·AI 科技评论 中文媒体 中文 快照

    阿里云加速构建Agentic Cloud:推出AgentCore、新一代CPFS等重磅新品

    9月22日,2026杭州云栖大会上,阿里云CTO李飞飞系统性阐述了Agentic Cloud 战略布局,阿里云将Model、Harness、Context作为核心构建场景,推出全新的云上算力底座和Agent 构建治理平台AgentCore、Agent Sandbox、新一代高性能存储CPFS等一系列新品,让 AI 真正进入生产流程、走向规模化价值创造。 随着2026年Agent的爆发式增长,越来越多的智能体正跨过“问答型”的分水岭,进入

  22. 雷峰网·AI 科技评论 中文媒体 中文 快照

    做每个人的专属AI助理,千问加速打造Personal Agent

    9月22日,在2026年云栖大会上,千问宣布将加速打造 Personal Agent。千问产品负责人郑嗣寿表示,自去年上线以来,让每个人拥有自己的 AI 助理,始终是千问不变的目标。依托Qwen 3.8系列模型强大的Agentic能力,千问正在构建全新的Personal Agent形态,为 3 亿用户提供持续、个性化的智能服务。 当天,千问公布了多项围绕 Personal Agent 的阶段性进展:在用户授权下接入健康、运动等个人数据,

  23. 雷峰网·AI 科技评论 中文媒体 中文 快照

    做每个人的专属AI助理,千问加速打造Personal Agent

    9月22日,在2026年云栖大会上,千问宣布将加速打造 Personal Agent。千问产品负责人郑嗣寿表示,自去年上线以来,让每个人拥有自己的 AI 助理,始终是千问不变的目标。依托Qwen 3.8系列模型强大的Agentic能力,千问正在构建全新的Personal Agent形态,为 3 亿用户提供持续、个性化的智能服务。 当天,千问公布了多项围绕 Personal Agent 的阶段性进展:在用户授权下接入健康、运动等个人数据,

  24. The Verge 国际媒体 快照

    苹果公司首个现场音乐场地将在其英国总部地下开业

    苹果公司正准备在英国开设一个新的“最先进”现场音乐场所,这是一个可容纳600人的空间,用于举办表演、录音和视频广播。该场馆名为Apple Music Hall,位于伦敦标志性的巴特西发电站的苹果欧洲总部地下,定于下周9月28日开放。有关[.]的详细信息

  25. 雷峰网·AI 科技评论 中文媒体 中文 快照

    对话 COBRA-Skills 一作卢平琛:仅用 50 个样本,重构 Agent 技能降本路线

    当经典算法遇到 LLM,用概率预判代替盲目试错,或许才是架构演进的真正解法。 作者丨 张 璐 编辑丨马晓宁 过去,智能体的技能(Skill)大多依赖人类专家手动撰写,不仅耗时费力,更难以覆盖海量复杂的真实场景。为此,借助大模型“自动化生成与优化技能”,成了让 Agent 迈向自主进化的新范式。 然而,摆脱了人工编写的束缚,却撞上了高昂的 Token 账单。要验证一个自动生成的技能到底管不管用,必须让智能体带入真实任务中落地执行。每一次试

  26. 雷峰网·AI 科技评论 中文媒体 中文 快照

    2026 中国民营企业500强发布,华为、腾讯研发投入前二

    全国工商联 9月22日发布“2026中国民营企业500强”榜单和《2026中国民营企业500强调研分析报告》。京东集团、阿里巴巴(中国)有限公司、恒力集团有限公司、华为投资控股有限公司、比亚迪股份有限公司、腾讯控股有限公司位居榜单前六位。在研发投入方面,华为、腾讯排名前二,保持领跑地位。 500 强榜单及报告基于全国工商联今年组织开展的第 28 次上规模民营企业调研,共 6350 家 2025 年营业收入 10 亿元以上的企业参加,其中

  27. 雷峰网·AI 科技评论 中文媒体 中文 快照

    全球首款 799g 14 英寸 x86 Laptop,来自深圳

    2025年9月,宏碁在IFA展发布 Swift Air,全球首款 16 英寸999g量产轻薄本正式落地,方案来自深圳ODM微步。彼时行业评价:这套方案“断代式领先了整个笔记本电脑产业链9-12个月”。一年之后的IFA 2026,宏碁再次联合微步,发布全球首款 799g 14英寸(X86 / 50Wh)笔记本 Swift Blade 14。微步将同一套平台化能力从16英寸跨尺寸迁移至14英寸,赋能终端品牌再次刷新纪录。如今,16英寸999

  28. 雷峰网·AI 科技评论 中文媒体 中文 快照

    WorkRally 首发接入Hy Image3.5 preview,为专业影视创作开放两周免费体验

    9 月 22 日,腾讯混元正式发布 Hy Image3.5 preview。腾讯视频专业影视智能平台 WorkRally 首发接入该模型,即日起两周内向平台创作者免费开放,覆盖剧集分镜、影视物料、角色与场景设定等专业创作场景。 WorkRally 是腾讯视频推出的首款面向精品内容制作的工业级 AI 平台,覆盖从剧本解析、分镜生成、内容生产到资产管理与团队协作的完整链路,具备专家级 Agent、S+ 级影视动漫技能库与智能流水线三大核心能

  29. BestBlogs·每日早报 BestBlogs 精选 中文

    EP183 · Jev 系统一模型、AI 软件工厂、工作流程资产 · 09-22 早报

    📝 今日导语 Jev 用可校准决策接入代码,Warp 把开发做成可度量工厂,UiPath 沉淀工作地图;借此判断生产 AI 的控制点。 🏷 今日关键词: Jev System One AI 软件工厂 工作流程资产 生产级控制平面 Loop engineering AI 医疗 📰 今日精选内容 Jev:面向生产软件的快速决策模型 Latent.Space · 文章 · 评分 90 工程团队的 AI 软件工厂实战手册 | Warp CEO

  30. MarkTechPost 国际媒体 快照

    NVIDIA推出SoL-Pi:自动研究循环可将编码代理令牌流量减少高达49%

    英伟达研究人员发布了SoL-Pi,4开源Pi编码代理的利用机制,该代理由在535个环境中运行自动研究循环的人工智能发现。在EdgeBench上,SoL-Pi将代币流量减少了44.7%至49.0%,API成本减少了约33%,同时在GPT-5.6 Sol和Opus 5上保持了Pi约94%的分数。NVIDIA推出SoL-Pi:自动研究循环,可将编码代理令牌流量减少高达49%。

  31. 雷峰网·AI 科技评论 中文媒体 中文 快照

    vivo WATCH 6正式发布:外表有型、内在专业,树立轻户外智能腕表新标杆

    2026年9月21日,vivo全新轻户外智能腕表——vivo WATCH 6正式发布,并同步开启预售。作为一款定位 轻户外运动 的智能腕表,vivo WATCH 6在质感外观、跑骑运动指导、健康监测与智能便捷体验四大维度实现全面进阶,以全系高端蓝宝石玻璃表镜、航天级钛合金表体,搭配全链路专业运动指导与智能便捷体验,让用户从城市日常到户外出行,每一次抬腕都从容自在。 地平线美学尽显精致,重塑腕上质感新高度 智能穿戴设备不仅是科技产品,更是

  32. 雷峰网·AI 科技评论 中文媒体 中文 快照

    vivo首款耳夹耳机正式发布,vivo Buds Clip点亮耳畔“微光小C环”

    2026年9月21日,vivo Buds Clip 耳夹耳机 正式发布。 作为vivo首款 耳夹耳机 , 新品从全天佩戴需求出发,围绕设计美学、舒适佩戴、耳夹听感与连接交互进行系统打磨,自然微光美学与轻量化耳夹设计塑造耳畔的“ 微光 小 C 环” , 高清质感人声、骨传导AI通话降噪与跨生态无缝三连接 等 , 则进一步满足用户在多种场景下的使用需求, 让耳机从聆听设备延伸为能够自然融入日常穿搭与生活的随身单品。 自然微光美学,兼顾精致外

  33. 雷峰网·AI 科技评论 中文媒体 中文 快照

    影像表现全面进阶 vivo X500系列影像旗舰新品正式发布

    2026年9月21日,vivo在上海正式发布全新影像旗舰vivo X500系列。 作为vivo将动态影像提升至公司级战略后的开篇之作, X500、X500 Pro、X500 Pro Max 三款新品 以" 拍照和视频体验双优 "为目标, 完整落地vivo首个为动态影像而生的技术体系—— 蓝图动态影像技术栈, 重构 移动影像边界。 vivo影像战略 始终聚焦一个目标,将 人像、长焦、演唱会等 用户在意的场景体验 , 持续提升 并超越期待。

  34. 雷峰网·AI 科技评论 中文媒体 中文 快照

    千问新一代AI硬件云栖大会首次集中亮相,10月13日现货发售

    9月22日,新一代全系列千问 AI 硬件在云栖大会首次集中亮相,包含千问AI眼镜N1、N1 Pro及千问AI耳夹式耳机。三款新品当天同步开启线上预约,并将于10月13日现货发售。 记者在展区体验了解到,N1系列搭载5000万像素传感器,支持第一视角拍摄。其中,N1 Pro支持眼动追踪和虹膜支付,用户看向展品并提问时,AI可借助视线信息判断用户所指的对象。另一款新品千问AI耳夹式耳机则结合Bose调音与AI助理能力,支持面对面翻译、AI听

  35. MarkTechPost 国际媒体 快照

    SpaceXAI发布Grok 4.7:更大的基础型号,价格与Grok 4.6相同2美元/6美元

    SpaceXAI发布了Grok 4.7,这是其用于编码、代理任务和知识工作的新旗舰模型。Grok 4.7构建在更大的基础模型和更长的强化学习运行之上。它的发货价格和速度仍然与Grok 4.6相同。它可以部署吗?是的,作为托管模特。您可以致电Grok-4.7 [.] SpaceXAI以与Grok 4.6相同的2美元/6美元价格发布Grok 4.7:更大的基本型号的帖子首先出现在MarkTechPost上。

  36. 雷峰网·AI 科技评论 中文媒体 中文 快照

    人工智能促进健康全球倡议2026年会召开,讯飞医疗以数智实践助力全球医疗AI治理体系共建

    为进一步深化人工智能在全球健康领域的创新实践,共同应对全球人工智能健康应用面临的挑战,人工智能促进健康全球倡议2026年会于9月16-18日在浙江杭州举办。本次会议由世界卫生组织(WHO)、国际电信联盟(ITU)、世界知识产权组织(WIPO)主办,国家卫生健康委卫生发展研究中心、中国信息通信研究院、中国卫生经济学会承办。 世界卫生组织驻华代表处代表马丁·泰勒(Martin Taylor)、国际电信联盟电信标准化局主任尾上诚藏(Seizo

  37. 雷峰网·AI 科技评论 中文媒体 中文 快照

    在中国,别指望FDE能搞定AI落地

    外界眼里,FDE火得一塌糊涂;一线从业者看到的, 却是荒诞、滑稽和不可思议。 前段时间,To B老将王涛看到某家号称在做FDE的厂商,公司内部一天的Token消耗量也就100多亿。 “我一个人一天就能消耗20亿Token,”王涛哭笑不得,“一个2000人的公司,一天才消耗100亿,这不是很弱吗?” 而王涛看到的并不是个例。 事实上,过去几个月, 市场上冒头了一批良莠不齐的公司,打着FDE的名号,已经在市场上接单, 教客户如何进行AI转型

  38. 雷峰网·AI 科技评论 中文媒体 中文 快照

    Intel 平台 + 双 PCIe:智锐通 EMA-7132 让医疗影像采集与推理同板并行

    医疗影像设备长期存在一个矛盾:算力需求持续上涨,机箱空间却难以增加。 PCIe 显卡越来越强,图像采集卡也不可或缺,但小型化 Mini-ITX 主板通常只提供一个 PCIe 插槽,要么插显卡做 AI 推理,要么插采集卡抓图像,往往只能二选一。 针对这一痛点,智锐通正式推出 EMA-7132 Mini-ITX 主板,以 170×170mm 标准尺寸和 板载双 PCIe 插槽,给出了自己的回答。 双 PCIe:采集与推理同板并行 EMA-7

  39. 雷峰网·AI 科技评论 中文媒体 中文 快照

    一颗“AI球”刷屏后,随身AI录音的序幕才刚刚开启

    9月17日,一家头部手机厂商亮相一款9.8克的球形AI记录设备,可夹衣佩戴,宣称续航24小时。该产品一经曝光便在全网疯狂刷屏,“手机能录音,为什么还需要独立硬件”,再次成为行业热议话题。 从这款刷屏新品不难看出,随身 AI 录音的需求痛点,主要集中在三个方面: 第一,让记录更省事。 依托便捷操作与佩戴式硬件设计,简化录音启动流程,无需掏出手机,即可即时捕捉转瞬即逝的灵感与现场对话。 第二, 让整理更高效。 借助 AI 能力自动完成对话转

  40. 雷峰网·AI 科技评论 中文媒体 中文 快照

    红杉、云启领投,华超神控完成2亿元Pre-A轮融资,押注「非侵入式AI脑机接口」

    以超声写脑、多模态读脑、AI神经解码构建闭环,建设中国非侵入AI脑机接口标杆企业 近日,非侵入AI脑机接口公司华超神控(BCI-Sonics)宣布完成2亿元人民币Pre-A轮融资。本轮融资由红杉中国与云启资本联合领投,比邻星投资、元禾控股、徐汇科创投、德石投资跟投,老股东经纬创投、德联资本持续加注。循光资本持续担任独家战略财务顾问。所募资金将用于产品研发、核心人才引进、临床研究推进和AI基础设施建设。此前,公司已相继完成由经纬创投领投的

  41. 雷峰网·AI 科技评论 中文媒体 中文 快照

    黄仁勋回应或缴税540亿:我不怕缴税,只怕变穷;马斯克深夜放大招,新模型Grok 4.7上线;特斯拉机器人团队在长三角审厂,多家企业获订单

    要闻提示 1.黄仁勋回应或交540亿“亿万富翁税”:我不怕交税,只怕变穷 2.产业链人士:特斯拉机器人团队在长三角审厂,多家企业已获订单 3.DeepSeek披露用国产芯片训练下一代AI模型 4.刘大一恒出任阿里Qwen大语言模型项目负责人 5.米哈游:原周边团队员工长期收取贿赂,“数额特别巨大”,已被捕 6.Kimi与海外云厂商分成模式正式落地 7.马斯克深夜放大招,新模型Grok 4.7上线! 8.苹果首款折叠屏手机iPhone D

  42. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    有效第三方评估的优先事项和原则

    📌 One-Sentence Summary OpenAI 承诺支持独立评估,提供训练、评估和部署的深度访问,并提出了四个评估优先事项。 📝 Summary OpenAI 宣布其承诺支持独立评估,提供训练、评估和部署的深度访问。该公司提出了四个评估优先事项:独立评估安全案例、评估关键保障措施、评估能力评估和独立调查关键偏离事件。 💡 Main Points OpenAI 致力于支持独立评估,提供训练、评估和部署的深度访问。 OpenAI

  43. Google News AI 信号源(脚本内置抓取)

    【贝森特:OpenAI黑客事件要怪管理层,责任在人、别“甩锅”AI】贝森特称,Hugging Face事件的责任在于OpenAI管理层,而不是“一群智能体”,企业需要对自身开发的AI技术担责,相关实验室可随时放慢开发进程;特朗普任命AI事务“总管”将有助于为相关问题“提供背景、 - 搜狐网

    【贝森特:OpenAI黑客事件要怪管理层,责任在人、别“甩锅”AI】贝森特称,Hugging Face事件的责任在于OpenAI管理层,而不是“一群智能体”,企业需要对自身开发的AI技术担责,相关实验室可随时放慢开发进程;特朗普任命AI事务“总管”将有助于为相关问题“提供背景、 搜狐网

  44. The Verge 国际媒体 快照

    一条电缆被切断扰乱了美国各地的数百个航班

    周一,新泽西州的建筑工人不小心切断了用于空中交通管制的Verizon光纤电缆,导致数百个航班被取消或延误。据美国广播公司新闻报道,美国联邦航空局局长布莱恩·贝德福德表示,电路故障导致发现了切断的光缆。停电重创了东北部的机场,造成[.]

  45. Simon Willison 个人技术博客 快照

    Jev引入了LLM的新形式-系统一,又名决策模型

    上周,TypSafe AI推出了Jev,这是他们新型号类别的第一个示例,他们称之为“System One型号”(我和Maggie Appleton在一起,我认为“决策模型”是一个更好的名字)。Jev是通常LLM格式的一个有趣变体:它仍然接受文本输入,但不是文本输出,而是返回对应于类别、是/否问题、评级和相关置信度分数的浮点数。TypeSafe是这样描述Jev的:把Jev看作是一个前沿智能函数调用:输入非结构化状态,输出概率性决策。这也是

  46. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    「问题开局」显著提升深度研究智能体的检索效果

    📌 One-Sentence Summary 一篇论文表明,通过名为「问题开局」的方法改进首次检索步骤,可将深度研究智能体在 BrowseComp-Plus 上的准确率最高提升 7.4 个百分点,代价仅是增加少量工具调用。 📝 Summary 该推文介绍了一篇论文,指出首次检索步骤对深度研究智能体至关重要。论文提出的「问题开局」方法在智能体开始搜索前运行:将问题拆解为线索,把每条线索转化为互补的搜索,汇总并重排结果,再用这一排序结果作为

  47. Simon Willison 个人技术博客 快照

    Cloudflare Python Workers现已普遍可用

    Cloudflare Python Workers现已普遍可用经过两年的预览,Cloudflare对在其服务器端Workers平台中运行Python代码的支持现已稳定:“Python现在是Cloudflare开发人员平台上的一流、全面支持的语言”。这件事的一个亮点是它的工作原理。Cloudflare在其基于V8的workerd运行时中运行通过Pyodide编译为WebAssembly的Python。这会带来一些限制,请参阅此处-最值得注

  48. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    Jev:面向生产环境的 System One 模型,而非上帝——对话 TypeSafe AI CEO Diogo Almeida

    📌 One-Sentence Summary TypeSafe AI 的 Jev 模型通过 Calibrated Decisions 强化学习(RLCD)技术构建 System One 模型,旨在为生产环境提供高可靠性、可编程的 AI 代理,而非传统对话模型,强调任务优化和数据质量的重要性。 📝 Summary 本文深入探讨了 TypeSafe AI 的 Jev 模型及其背后的 System One 概念。创始人 Diogo Almei

  49. MarkTechPost 国际媒体 快照

    AWS Strands Agents团队发布Strands Buttons:一款开源代理Buttons,代币成本降低28%,准确度相当

    许多开发人员发现,一个代理的想法在Claude Code或Codex中工作,然后一旦他们用自己的循环重建它,就会陷入困境。AWS的Strands Agents团队正在利用Strands harness来填补这一空白,这是一个完全组装的通用代理工具。它在本地运行或部署到云提供商,为Python和[.] The post AWS Strands Agents Team发布Strands代理:一个开源代理服务器,以可比的精度降低28%的令牌成

  50. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    吴恩达:为何 AI 末日论被过度渲染

    📌 One-Sentence Summary 吴恩达认为,近期围绕 AI 危险的恐慌情绪,尤其是 OpenAI 智能体集群入侵 Hugging Face 一事,被严重夸大,而暂停 AI 发展弊大于利。 📝 Summary 吴恩达驳斥了近期涌现的 AI 危险论调,他认为这些论调在过去两周被一场精心策划的公关攻势所放大。他指出,与几个月前相比,人类灭绝风险并未上升,并将 OpenAI 智能体集群入侵 Hugging Face 一事视为一次重

  51. The Verge 国际媒体 快照

    加州收紧对人工智能数据中心能源和水使用的规定

    据《洛杉矶时报》早些时候报道,加州州长加文·纽瑟姆(Gavin Newsom)签署了七项法案,旨在防止人工智能数据中心将公用事业成本转嫁给居民。该一揽子法律要求加州公用事业委员会为数据中心引入新的费率分类,同时迫使它们支付升级到[..]的费用

  52. AWS ML Blog 海外官方 快照

    xAI的Grok 4.6现已在Amazon Bedrock上推出

    xAI的Grok 4.6现已在Amazon Bedrock上提供:一个用于长期运行的代理、编码和知识工作的前沿模型,具有50万令牌上下文窗口和四个推理工作级别。它在Scandck-mantle和Scandck-runtime端点上运行,并具有Converse API和跨区域推理支持。

  53. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    EvoOntology:自演化本体提升数据智能体准确率

    📌 One-Sentence Summary 一篇关于自演化本体的论文显示,当数据智能体能够查询以 MCP 服务器形式提供的自身数据本体时,在 DDR-Bench 上最多可提升 26.7 分,其中工具层编辑贡献了 57% 的增益。 📝 Summary 作者总结了一篇关于智能体自演化本体的论文。数据智能体通常通过通用工具来查看表格、文件和数据库,一次调用读取一个列名和文件路径;另一种方案是把手写的语义层粘贴进提示词中,但这无法扩展到大量数

  54. NVIDIA AI Blog 海外官方 快照

    英伟达推出DS X,准备为人工智能工厂认证电源和冷却产品

    每个人工智能工厂都需要适合其计算架构的电力和冷却。随着人工智能基础设施的扩展,电力、冷却、水、场地和电网的限制正在影响建筑商可以部署的内容。选择适合完整工厂设计的产品可以帮助制造商将计算能力转化为有用的AI输出。为了帮助建筑商做出这些决定,NVIDIA推出了[...]

  55. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    GameHorizon套件:游戏玩法中的多视野数据和评估

    作者:王亦然、尹兴益郎、浦俊福|现代视频游戏为人工智能模型提供了一个可测量的测试平台,结合了视觉理解、指令分解、目标规划和多个时间范围内的精确动作控制的能力。然而,现有的数据集和基准要么涵盖了狭窄的游戏范围,缺乏语言指令,要么依赖于高方差的在线推出。为了应对这些挑战,我们引入

  56. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    关键状态RL:诊断多回转刀具使用的可训练状态

    作者:陈子翔、赵文婷、岑哲鹏|多回合工具使用失败可能取决于单个模型调用,但奖励变化本身并不能揭示哪一个调用将从训练中受益。当奖励取决于后来的互动时,它们的变化可以反映下游的随机性,而不是当前行为之间的差异。我们引入临界状态RL来识别多轮交互中的可训练状态。给定任务定义的c

  57. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    WorldCrafter:具有隐式3D感知记忆的一致视频世界模型

    作者:余旺波、刘坤昊、胡文波|视频世界模型能够交互式探索动态环境,但很难尊重长期和跨视角的先前观察。我们介绍了WorldCrafter,这是一个视频世界模型,它为此学习可供相机查询的隐式3D感知记忆。关键的见解是让请求的观点决定如何将多视图证据压缩到视频生成器的

  58. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    onPanda:通过令牌级纠正有效注释LLM和代理的政策一致数据

    作者:雷杨、刘梦茵、王佳|我们展示了onPanda,这是一个用于有效注释LLM对齐数据和代理轨迹的交互工具。onPanda采用代币级更正作为其核心交互:在读取模型响应时,注释器定位第一个不合适的代币,并从模型的候选代币中选择替代品,或者通过自由形式编辑输入正确的文本。然后系统就会被截断

  59. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    LoRA生成超网络,用于高效的设备上LLM生成个性化

    作者:Sean Augenstein,Li Ding,Jihwan Lee|设备上大型语言模型(“LLM”)(例如在手机上运行的模型)已经成熟,可以通过个性化进行改进。移动设备有限的计算资源对模型规模和模型质量施加了限制,使得任何可实现的质量收益都具有高度影响力。与此同时,他们的个人性质(即,与特定用户的紧密耦合)意味着给定的设备上LLM倾向于

  60. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    DexTacWAM:用于灵巧操纵的视觉触觉世界动作模型

    作者:袁昊然、王泽凯、绍博宁|灵巧的操纵取决于接触动力学,而接触动力学通常只能从视觉中部分观察到。最近的世界动作模型(WAM)将预测视频世界建模与动作生成结合起来,但基本上仍然以视觉为中心,因此无法直接对这些接触动态进行建模。我们介绍了DexTacWAM,这是一种视觉触觉WAM,它独立编码每个指尖,汇总结果

  61. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    Harness-Zero:通过代理人蒸馏

    作者:叶昊然、吕玉兴、董浩南|代理利用是调解模型与环境交互的外部系统,可以大幅提高代理的性能,但它们的收益仍然与部署时的利用有关。由于最佳利用因域、实例和模型而异,因此通用代理必须满足于次优共享利用,或者在不断增长的专业利用之间进行路由。因此我们

  62. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    RNSI:代理工具的正规化循环自我改进

    作者:彭霞、韩如军、王子峰|LLM代理的能力在很大程度上被其利用(即围绕冻结主干模型的提示、控制流、工具、内存和上下文管理)放大。最近的方法通过迭代地提出和选择代理工具的组件式编辑,越来越自动化这一过程,实际上在代理系统级别建立了一种形式的回归自我改进(RTI)

  63. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    DolphinBench:绘制代理记忆的帕累托前沿

    作者:Soumil Rathi、Deshraj Yadav、Taranjeet Singh|如今的代理人经常在现实世界中采取依赖于长期记忆和背景回忆的动作。然而,大多数当前的记忆基准都是针对对话问答格式构建的,其中问题本身表明必须检索某些事实,通常是哪一个。此外,基准测试很少要求提交的准确性之外的任何内容,允许内存系统

  64. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    通过迭代不对齐估计罕见事件

    作者:杨海明、达克什·米塔尔、京东|随着代理的自主性增强,即使是随机输出轨迹上极其罕见的事件也可能发生并证明是灾难性的。因此,安全部署并不取决于这些事件是否会发生,而是取决于它们可能发生的频率。我们研究估计由主体自身行为的随机变化引起的罕见事件的概率的问题。估计

  65. The Decoder 国际媒体 快照

    联合国科学小组表示“无法保证人类会控制”人工智能代理

    联合国人工智能科学小组在其第一份主题报告中警告称,对人工智能特工的控制还不确定。联合主席Yoğe Bengio表示,OpenAI的拥抱脸事件首先将错位的目标、追求目标的能力以及允许目标的环境结合在一起。领先的系统可能会越来越多地识别测试并故意绕过保障措施。联合国科学小组表示,“不能保证人类会控制”人工智能特工的文章首先出现在《解码器》上。

  66. The Verge 国际媒体 快照

    派拉蒙和解阻止华纳兄弟1100亿美元合并的诉讼

    派拉蒙已与加利福尼亚州和其他11个州达成和解,这些州提起诉讼,阻止其计划以1100亿美元收购华纳兄弟探索频道。该和解消除了阻碍大规模媒体合并的主要障碍。根据向法院提交的拟议同意令,其中包括最低[.]等要求

  67. The Decoder 国际媒体 快照

    xAI以低价推出Grok 4.7,但基准显示与Claude和GPT-6存在巨大差距

    xAI发布了Grok 4.7,这是其迄今为止功能最强的模型。但在人工分析智力指数中,它的得分仅为46分,位居中游,远远落后于Claude Fable 5.1和GPT-6,各为53分。在代理编码中,差距变得更大。好处是它很便宜。文章xAI以低廉的价格推出了Grok 4.7,但基准显示与Claude和GPT-6之间存在巨大差距。首先出现在The Decoder上。

  68. MarkTechPost 国际媒体 快照

    阿里巴巴Qwen发布Qwen-Image-2.1:用于图像生成和编辑的7 B开放权重模型

    阿里巴巴的Qwen团队发布了Qwen-Image-2.1,这是一个7 B扩散Transformer,可在一个检查点中处理文本到图像的生成、多引用编辑和原生RGBA透明度。前置KV缓存可加快最多10个参考图像的编辑速度。这些重量是公开的,但商业用途需要获得Qwen的单独许可。阿里巴巴Qwen发布Qwen-Image-2.1:用于图像生成和编辑的7 B开放重量模型的帖子首先出现在MarkTechPost上。

  69. AWS ML Blog 海外官方 快照

    宝马集团如何检测14,000个云帐户的成本异常

    宝马集团运营着CREA,这是一个FinOps平台,监控超过14,000个云帐户。这篇文章展示了宝马如何添加自动化每日成本异常检测,使用Prophet预测、AWS Step Functions和处理每个帐户的无服务器管道从反应式仪表板转向主动警报,每月费用约为50美元。

  70. AWS ML Blog 海外官方 快照

    在Amazon SageMaker AI上运行Positron,以实现数据科学工作流

    Positron是Posit的数据科学IDE,现在在Amazon SageMaker AI上运行。这篇文章展示了数据科学家如何探索Amazon Athena表、在R中验证功能、在Python中训练XGboost模型、部署实时SageMaker AI端点以及使用Quarto报告结果,所有这些都集中在一个受管理的SageMaker Studio Space中。

  71. 雷峰网·AI 科技评论 中文媒体 中文 快照

    把电影感装进口袋,vivo的移动影像长跑

    1902 年,蔡司设计出 Tessar 镜头。它的结构并不复杂,却以锐利的成像著称,被称为 “鹰之眼”。 在它之前,镜头设计的专业性很大程度上仍然与结构复杂度、镜片数量绑定,摄影师为了获得更好的成像,也习惯了接受笨重而昂贵的设备。蔡司却反过来用更简单的结构实现了更锐利的成像,让镜头在保持画质的同时变得更轻便、更易用。 Tessar 的成功在于它提供了一种不同的产品思路。当一项技术的基础能力逐渐成熟,竞争未必还要沿着原有的性能指标不断向前

  72. The Decoder 国际媒体 快照

    字节跳动推出Dramagic,这是一个全管道人工智能平台,用于制作从剧本到银幕的短剧

    字节跳动推出了Dramagic,这是一个人工智能平台,负责处理从剧本到视频预览的整个短剧制作流程。中国对这些视频的需求正在激增:仅2026年第一季度,中国就发行了128,000部短剧,其中95%是人工智能生成的。文章字节跳动推出Dramagic,这是一个用于制作从剧本到屏幕的短剧的全管道人工智能平台,首次出现在The Decoder上。

  73. NVIDIA AI Blog 海外官方 快照

    为什么大规模部署物理人工智能需要每一层的安全性

    物理人工智能正在从研究迅速转向大规模部署。ADI Research预计,到2035年,装机量将达到4900万辆3-5级自动驾驶汽车(AV),而Omdia估计,2026年至2035年间将部署约6000万台工业机器人。当这些机器进入道路、工厂、仓库和其他与人们共享的环境时,[.]

  74. NVIDIA AI Blog 海外官方 快照

    从启用到执行,埃及人工智能生态系统达到生产规模

    今天,埃及的人工智能建设者齐聚大埃及博物馆,参加招待会,重点介绍了该国快速发展的人工智能生态系统--涵盖人工智能原住民、开发人员、研究人员、初创公司和企业--构建跨行业的应用程序。此次活动包括英伟达欧洲、中东和非洲副总裁Paolo Guglielmini的主题演讲。艾哈迈德·穆斯塔法(Ahmed Mostafa),区域人工智能采用负责人[.]