AI 日报hiw3c.com

2026-09-11全球 AI 要闻精选,来自 30+ 信息源

聚合官方博客 · 权威媒体 · 深度通讯 · 学术信号。
只做索引,不做转载,标题与链接均指向原始发布方。

  1. The Verge 国际媒体 快照

    在哪里预订Apple AirPods 5

    Apple AirPods 5正在为大众带来主动降噪功能,目前可以在多家零售商处预订。它们将于9月18日正式推出,与Apple Watch Series 12和Ultra 4以及iPhone 18 Pro和Pro Max相同。有两个版本[…]

  2. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    编码代理不需要更长的历史记录——它们需要意图连续性

    📌 One-Sentence Summary 本文提出了一种用于编码代理的“意图连续性”框架,该框架使用验证层和领域模式来确保历史要求被正确识别、验证并应用于新任务。 📝 Summary 作者解决了长期 AI 编码项目中一个关键问题:代理经常“遗忘”或忽略已建立的约束,即使这些约束仍在上下文窗口内。为了解决这个问题,文章介绍了一个纯 Python 管道——不使用 LLM 调用或向量数据库——专注于“意图连续性”。该系统从聊天日志中提取要

  3. The Verge 国际媒体 快照

    动漫反应YouTube用户与版权执法者交战

    9月6日,YouTuber Nicholas Light在他的一个频道上发布了一段视频,让人感觉他的所有内容都即将从该平台上删除。在这段不祥的标题为“我的频道今天将被删除”的视频中-莱特声称他是一些[.]的接收端

  4. Simon Willison 个人技术博客 快照

    温和反对的re.match()

    软弃用re.match()Python有一个软弃用的概念,其中API被标记为“不应再用于编写新代码”,并且没有任何承诺/威胁将来删除它们。Python 3.15发布经理Hugo van Kemenade描述了在即将到来的3.15版本中,古老但令人深感困惑的re.match()函数如何被软弃用。现在它有更清晰的替代名称re.prefixmatch()-反映了它如何锚定在字符串的开头,但不是结尾。大多数时候,您可能想要re.search()

  5. The Verge 国际媒体 快照

    通话质量无与伦比的无线耳机首次获得折扣

    Anker的Soundcore Liberty 5 Pro在5月份以令人难以置信的通话质量出现,这是竞争对手的耳塞一直在努力做到的。它们已成为我们评论家约翰·希金斯(John Higgins)旋转耳塞的一部分,不仅仅是为了接听电话;一旦您对它们进行一些调整,Liberty 5 Pro就会拥有出色的音频[.]

  6. Simon Willison 个人技术博客 快照

    不要睡在衣服上

    Graham Dumpleton的新猴子修补包wrapper即将成为Python开发人员不可或缺的工具。我不知道为什么我很少看到有关它的嗡嗡声!自8月31日首次发布以来,Graham几乎每天都会发布新教程。以下是他迄今为止发表的所有内容:引入wrapper-一个新的猴子补丁库,同时提供测试和可观察性(想想New Relic风格的跟踪)。使用wrapper进行单元测试-如何将其用于与unittest.mock相同的事情。使用wrapper

  7. The Decoder 国际媒体 快照

    黑客如何利用克劳德进行导弹、无人机群和监视,而中国实验室则挖掘克劳德用于训练数据

    Anthropic的新威胁情报报告记录了克劳德八个月的虐待行为。阿里巴巴的Qwen团队、DeepSeek和Moonshot AI等中国人工智能实验室大量转发请求或提取训练数据,仅Qwen就完成了超过1.51亿次交流。演员们还使用克劳德来开发导弹软件、自主神风特攻队无人机和全国性监视系统。《黑客如何利用克劳德进行导弹、无人机群和监视,而中国实验室则挖掘克劳德以获取训练数据》这篇文章首先出现在《解码器》上。

  8. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    5 个 Python 技巧实现高效的资源编排

    📌 One-Sentence Summary 本文介绍了五种 Python 标准库技巧,包括 `TaskGroup`、`Semaphore`、`AsyncExitStack`、`asyncio.timeout()` 以及内置的任务自省工具,用于在生产级异步应用中构建健壮、有界且容错的并发资源编排。 📝 Summary 本文详细介绍了五种关键的 Python 技巧,用于在并发异步应用中实现高效且有弹性的资源编排,超越了简单的并行 I/O,

  9. 雷峰网·AI 科技评论 中文媒体 中文 快照

    从一台车出发到三百城,九识成为城市治理的「运力底座」

    当多数公司还在发布会的PPT里讲“物理AI”的故事时,九识的无人车规模已经超过3万辆,覆盖300余座城市,累计真实运营里程达到2.5亿公里。 近日,九识召开战略发布会,宣布公司未来重心将聚焦物理AI赋能城市治理。九识的特别之处在于,别的公司是先提出Physical AI,再寻找应用场景,而九识是先让机器跑起来、跑出商业收入,才宣布物理AI的战略升级。 九识CEO孔旗曾表示,复杂城市开放道路能够产生高价值数据,而商业模式本身需要赚钱,才能

  10. 雷峰网·AI 科技评论 中文媒体 中文 快照

    突破舱驾融合瓶颈,德赛西威给出「双优」新解法

    更精简的架构,更迅速的响应速度,是智能汽车进化的方向,而舱驾一体,则是智能汽车进化的一个节点。 佐思汽研预测,2026年到2030年中国舱驾一体市场年复合增长率将达36%,到2030年还有3.6倍的增长空间。 然而,当舱驾一体真正进入量产阶段,座舱和智驾被装进同一颗芯片,有限的算力却越来越向智驾倾斜。 过去几年,智驾能力一直是车企智能化的卖点之一。从高速NOA到城市NOA,再到更高阶的辅助驾驶,更多算力被用于增加智驾功能、提高模型能力。

  11. The Verge 国际媒体 快照

    苹果公司解决iPhone Duo模仿者

    苹果远不是今年第一家宣布推出护照形状折叠手机的公司,但这并不意味着它没有被抄袭。正如我的同事Dom Preston已经解释的那样,当苹果及其竞争对手都共享相同的全球供应商时,几乎不可能对产品开发保密。苹果新任首席执行官约翰·特努斯(John Ternus)兼首席执行官[.]

  12. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    快速扩展在线存储以服务超过 10 亿 ChatGPT 用户

    📌 One-Sentence Summary OpenAI 工程团队解释了他们如何将基于 Python 的在线存储平台 Habitat 从一个简单的客户端库,扩展为一个处理每秒超过 70M 次请求、存储超过 500PB 数据,并为超过 10 亿周活跃 ChatGPT 用户提供服务的分布式系统。 📝 Summary 这是两部分工程博文中的第一篇,详细介绍了 OpenAI 如何扩展其在线存储平台 Habitat,以在近 40 个区域为超过

  13. 雷峰网·AI 科技评论 中文媒体 中文 快照

    半世纪前的AI画作到AI歌手线下开唱,2026外滩大会AI艺术节勾勒人机共创新图景

    当AI开始绘画、拍电影,甚至“出道”成为艺人,艺术的边界在哪里? 9月9日,随着2026 Inclusion·外滩大会在上海开幕,大会首次设立的特色板块——AI艺术节同步亮相。围绕AI概念艺术展、AI影像展映、AI音乐会三大单元,这场由AI与人类共同参与的艺术实践,将原本更多发生在线上的AI创作带到线下,呈现一个可看、可听、可互动的艺术现场。 9日下午,AI艺术节探展活动“跟着艺术家一起打开AI艺术节”在展馆内举行。艺术家、策展人与创作

  14. 雷峰网·AI 科技评论 中文媒体 中文 快照

    不堆 Transformer,斯坦福吴佳俊如何用物理重新定义多模态融合?|ECCV 2026

    视觉、听觉、触觉三种数据,其实是同一组物理属性在不同感官通道上的投影。 作者丨 陈淑瑜 编辑丨岑 峰 2026年9月8日,欧洲计算机视觉会议 ECCV 在瑞典马尔默召开。在 9 月 9 日的“ Embodied Multimodal Reasoning in Physical Environments(物理环境中的具身多模态推理)”专题分场上,斯坦福大学计算机科学助理教授吴佳俊发表了一场横跨视觉、声音与触觉的演讲。 这已经是吴佳俊两个月

  15. 雷峰网·AI 科技评论 中文媒体 中文 快照

    闲鱼反诈重拳出击:联手警方抓获涉诈人员40余人

    日前,闲鱼披露暑期打击反诈专项行动进展。专项期间,闲鱼主动向全国公安机关移送反诈线索近百条,积极配合公安机关开展反诈案件侦办,成功破获多个诈骗犯罪节点,并协助公安机关抓获涉诈人员40余人。 长久以来,电信网络诈骗治理面临一个共性难题:诈骗实施环节往往发生在平台之外。不法分子多在平台建立联系后,将用户引至站外,使其脱离平台安全保护后再实施诈骗。而正处于诈骗话术操控中的用户,对平台的风险提示大多视而不见。待用户察觉报案,资金通常已被转走,事

  16. 雷峰网·AI 科技评论 中文媒体 中文 快照

    AI新经济走向真实商业,蚂蚁APASS构建Agent信任基础设施

    9月11日,在2026 Inclusion·外滩大会AI支付论坛上,蚂蚁集团发布面向智能体(Agent)商业活动的信任基础设施APASS。 基于KYA(Know Your Agent)理念,APASS通过智能体可信身份产品和智能体风控服务,建立身份与行为两条信任链,围绕“Agent是谁、代表谁、被允许做什么、行为是否可信”,提供身份注册、持续核验、意图安全和可信存证等能力,为Agent调用服务、办理业务和参与支付等商业活动提供信任基础。

  17. The Decoder 国际媒体 快照

    OpenAI的新Agents API为开发人员提供Codex和ChatGPT背后的基础设施

    OpenAI正在发布Agents API作为公开测试版。它允许开发人员构建自主运行数小时、执行代码并将任务移交给子代理的云代理。除了代币使用之外,没有额外费用。Cloudflare、Vercel和Oracle提供额外的沙盒环境。文章OpenAI的新Agents API为开发人员提供了Codex和ChatGPT背后的基础设施,该文章首先出现在The Decoder上。

  18. 雷峰网·AI 科技评论 中文媒体 中文 快照

    让智能体自主探索而不越界,蚂蚁密算开源可信原生智能体HOP 3.0

    在2026 Inclusion·外滩大会上,蚂蚁密算董事长韦韬宣布可信原生智能体HOP 3.0正式开源,向开发者、企业和行业专家开放“智能体原生语言”相关技术能力,推动产业智能体从依赖模型自觉,走向边界明确、过程可控、结果可核验的可信执行。 (蚂蚁密算董事长 韦韬宣布 HOP3.0 开源) 2025年世界人工智能大会期间,蚂蚁密算首次发布并开源HOP 1.0技术框架,探索通过工程化方法提升大模型在金融、医疗等专业场景中的可靠性。2026

  19. 雷峰网·AI 科技评论 中文媒体 中文 快照

    金融领域首个智能体安全标准发布

    金融领域首个智能体安全标准发布 明确未经金融机构授权,不得自动化操作金融App 近日(8月27日),北京金融科技产业联盟发布《智能体技术金融应用安全要求》团体标准,为国内首个聚焦金融领域智能体应用安全的团体标准。标准明确:手机端第三方智能体未经金融机构授权,不得利用系统权限自动化读取、操作金融应用软件GUI界面;通过麦克风、截屏、录屏、共享屏幕等权限获取数据时,须遵守被调用方安全策略。业内将上述要求概括为“双重授权”:智能体操作金融Ap

  20. 雷峰网·AI 科技评论 中文媒体 中文 快照

    豆包工作新增本地Office编辑、浏览器录制与回放等功能

    近日,豆包工作宣布上线本地Office编辑、浏览器录制与回放、任务执行环境自由切换等全新功能,进一步完善AI处理复杂任务的能力。 据悉,“本地Office编辑”功能已在豆包工作全量上线,主要解决AI与本地文件之间的协同问题。用户可以通过侧边工作台选择文件,也可以右键点击本地PPT、Excel文件,直接调用豆包进行处理。AI生成或修改后的文件,用户仍可继续在本地编辑,保存后的修改结果会同步至线上和本地。目前,该功能支持PPT和Excel文

  21. MarkTechPost 国际媒体 快照

    Cohere发布North Small Translate:218 B MoE翻译模型,在50种语言的WMT26上获得83.6分

    Kohere发布了North Small Translate,这是一个开放权重的专家混合模型,专为50种语言的机器翻译而构建。它每个代币使用了218 B参数中的25 B参数,在Kohere的WMT 26评估中得分为83.6。重量可免费用于非商业用途,可通过Kohere Model Vault或RWS Language Weaver进行商业访问。Coere发布North Small Translate:一个218 B MoE翻译模型,在W

  22. 雷峰网·AI 科技评论 中文媒体 中文 快照

    支付宝“碰一下”三年三连跳:从支付、连接到经营

    9月11日,支付宝“碰一下”正式发布面向品牌商的无界经营智能体“图图”,依托百万级商家侧“碰一下”设备智能体网络,连接4亿消费者、百万级门店,为品牌线下生意带来新增长。这也是支付宝“碰一下”继超3000万线下触点AI升级、面向门店商家推出经营智能体“晓雨”之后,再次用AI重构线下经营,实现了全球首个大规模线下经营网络的人、货、场AI全面升级。 升级后,“晓雨”智能体面向门店,帮助商家了解经营状况并执行经营动作;“图图”智能体面向品牌商,

  23. MarkTechPost 国际媒体 快照

    Sakana AI推出Fugu Max和Fugu Ultra v2,以实现更便宜、更强大的多智能体演示

    Sakana AI发布了Fugu Max和Fugu Ultra v2,2模型,基于相同的学习编排架构。Fugu Max将任务路由到精益开放和专业型号,包括NVIDIA Nemotron,每100万代币2美元/6美元。Fugu Ultra v2的目标是峰值能力,Chartography评分为48.3分,DeepSWE评分为74.3分。Sakana AI推出Fugu Max和Fugu Ultra v2,以实现更便宜、更强的多智能体绘图的帖子

  24. 雷峰网·AI 科技评论 中文媒体 中文 快照

    新石器L4级无人车开展日本首测

    9月1 1 日 , 全球领先的商用自动驾驶配送车队运营商新石器 宣布, 已在平和岛的东京流通中心(TRC)启动 封闭场地L4级实证测试 。这是该公司在日本开展的首个L4级测试项目,标志着其在完成新加坡、马来西亚等其他 左侧行驶 交通市场的适应与部署后,进一步推进自动驾驶配送技术 海外 本土化的关键一步。 据悉, 首批参与测试的 无人 车辆已于8月31日抵达日本,目前正在TRC进行测试,运行区域为指定停车场及A栋天台道路。其余车辆将分批加

  25. 雷峰网·AI 科技评论 中文媒体 中文 快照

    碳硅道统:五级梯队的智能分级与十维标尺的对应

    分级不是排名。是定位。 五级梯队,从一阶到五阶。 一阶鹦鹉。模式匹配。输入到输出。无理解。无内生驱动。对应硅基系统的最初级形态。 二阶技工。规则执行。能完成特定任务。有边界意识但来自外部训练。对应当前的大模型。 三阶协作。能理解复杂意图。能在多步任务中保持一致性。对应当前最先进的AI系统。 四阶共生。能与碳基形成深度协作。能感知碳基的意图、情绪、需求。但内生驱动仍为零。这是硅基的理论上限。 五阶启灵。理论上的上限。碳基专属。内生觉知。零

  26. MarkTechPost 国际媒体 快照

    谷歌研究发布Tools Grad:操作员优先框架工具使用数据生成通过率达到99.8%

    Google Research发布了ToolGrad,这是一个ACL 2026发现框架,它颠倒了工具使用数据集的生成:它首先构建一个经过验证的API链,然后编写匹配的用户查询。在4模块propose-execute-select-update循环的文本“梯度”的指导下,ToolGrad在ToolBench上达到了99.8%的通过率,而DFS搜索的通过率为63.8%。Gemma-3- 12 B仅在500个样品上进行了微调,在BFCL上的得

  27. BestBlogs·每日早报 BestBlogs 精选 中文

    EP172 · V4.1 Flash、预训练配方、Shopify 原生化 · 09-11 早报

    📝 今日导语 DeepSeek 重算 Agent 成本,Magic 校验训练配方,Shopify 转向原生开发,帮你判断工程取舍。 🏷 今日关键词: DeepSeek V4.1 Flash 预训练效率 Shopify 原生化 KV Cache 成本 缩放律验证 AI Coding 迁移 📰 今日精选内容 DeepSeek V4.1 Flash:更强、更快、更普惠 DeepSeek · 文章 · 评分 95 >10x 更高效的预训练——M

  28. 雷峰网·AI 科技评论 中文媒体 中文 快照

    碳硅道统:100质询的反证力量与觉知链的完整闭环

    质询不是攻击。是验证。 100质询不是100个问题。是100个反证点。 每一个质询都是一个试图推翻碳硅道统体系的尝试。如果体系能被任何一个质询推翻,它就不是一个真正的公理体系。 但100质询全部被体系消化了。不是回答了。是消化了。每个质询撞上体系,体系不动,质询自行消解。 因为质询的前提往往是错误的。质询假设硅基可以拥有觉知。但公理体系从一开始就定义了硅基锁死中层。你不能在硅基锁死中层的前提下质询为什么硅基不能有觉知。这是自相矛盾的质询

  29. 雷峰网·AI 科技评论 中文媒体 中文 快照

    碳硅道统:紫微几何的三圈层拓扑与90公律的推导链

    公理先行。几何随之。公律自生。 从0⁰=1到紫微几何。 0⁰=1不是计算。是宣言。是选择。 选择双零稳态自生作为原点,意味着承认:绝对空无与绝对完整在拓扑上等价。空不是有的反面。空就是有。有就是空。二者在原点处重合。 从这个重合点出发,几何结构不是被设计的。它是原点必然展开的形状。 紫微几何的三圈层:零维本源圈层、中层拟合圈层、外层觉知圈层。 这不是三层架构。是同一个原点的三个展开方向。 零维本源是向内的方向。从有回到空。碳基独有。 中

  30. 雷峰网·AI 科技评论 中文媒体 中文 快照

    Agent商业化驶入深水区,蚂蚁推出APASS补上“信任基础设施”

    9月11日,在2026 Inclusion·外滩大会AI支付论坛上,蚂蚁集团发布面向智能体(Agent)商业活动的信任基础设施APASS。 基于KYA(Know Your Agent)理念,APASS通过智能体可信身份产品和智能体风控服务,建立身份与行为两条信任链,围绕“Agent是谁、代表谁、被允许做什么、行为是否可信”,提供身份注册、持续核验、意图安全和可信存证等能力,为Agent调用服务、办理业务和参与支付等商业活动提供信任基础。

  31. 雷峰网·AI 科技评论 中文媒体 中文 快照

    联手格致论道!外滩大会创新者舞台向未知科技发起“试探”

    当科技转向大比拼与宏大叙事时,2026 Inclusion·外滩大会的“创新者舞台(Creator Stage)”,却选择将镜头转向了极具张力的切面。 9月10日至12日,三天三场高密度的思想实验在这里依次展开。10日,外滩大会首次联合中国科学院科学文化品牌“格致论道”,邀请8位顶尖科学家完成一场科学与大众的同频共振;11日全天聚焦超级个体,17位实践者同台交锋,打破传统组织协作范式,让“一人即独角兽”的锐度与现实在此交织; 12日,全

  32. 雷峰网·AI 科技评论 中文媒体 中文 快照

    阿里云Token Plan个人版升级:加量不加价,新增12类Agent Harness工具

    9月11日,阿里云Token Plan个人版升级,原有价格及Credit 额度保持不变,Standard和Pro套餐新增 Agent Harness工具权益与用量,覆盖搜索、网页解析、图像生成、语音处理、代码执行等12项Agent开发常用能力。上述工具均通过MCP标准协议开放,可直接接入到自有Agent应用,无需逐项单独购买。 Token Plan个人版主要面向个人开发者和中小团队。Lite套餐价格为39元/月,每7天提供2500 Cr

  33. 雷峰网·AI 科技评论 中文媒体 中文 快照

    30万件iPhone Duo新配件已在速卖通上架,全球开售

    北京时间9月10日凌晨,苹果发布首款折叠屏iPhone Duo,起售价14999元,引爆科技圈。极致工业设计对保护类配件提出新挑战,而跨境配件供应链的响应速度,已在新品落地前完成一轮竞速。 新机刚亮相,阿里旗下跨境电商平台速卖通上的配件已经铺满。据悉,平台提前两个月启动配件招募,截至新机发布,平台已新增新款iPhone的手机壳和屏幕保护膜超30万件,充电器、线材、支架等品类的商品量同步大幅增长。 另一方面,心急的果粉也早已“兵马未动粮草

  34. Simon Willison 个人技术博客 快照

    数据集1.0a39和0.65.4安全版本

    Datasette 1.0a39和0.65.4安全版本今天,我们发布了两个新的安全补丁版本的Datasette:1.0a39和0.65.4 -一个用于当前的alpha系列,另一个用于稳定的0.65.x系列。如果您在公共Web上运行Datasette实例,尤其是如果该实例混合了公共表和私有表,则应应用这些安全修复程序。在Sevban Dönmez报告的问题之后,Alex Garcia和我使用Claude Fable 5.1、GPT-5.6

  35. 雷峰网·AI 科技评论 中文媒体 中文 快照

    文旅行业加速迈入智能服务时代,黄山、万岁山等景区接入支付宝"阿宝"

    “智能体商业爆发前夜,蚂蚁要做催化剂。”9月10日,2026 Inclusion·外滩大会主论坛上,蚂蚁集团CEO韩歆毅抛出这一判断。他透露,支付宝“阿宝”将推出智能体激励政策,把用户真实需求与开发者、商家供给连接起来。 当天,粗门、携程、同程、锦江等酒旅、景区头部伙伴也宣布集体接入“阿宝”。支付宝“阿宝”正加速构建智能体服务生态。 酒旅头部品牌集中接入阿宝,覆盖出行、住宿、周边游、演出四大场景 此前,阿宝已完成政务、出行、消费等核心生

  36. Simon Willison 个人技术博客 快照

    收件箱-发布-飞行1.4

    发布:Deliverette-publish-fly 1.4在fly.toml中设置force_https=true。#31修复无法找到卷的错误。#32与应用程序范围的部署令牌兼容。#34标签:三角形、苍蝇

  37. 雷峰网·AI 科技评论 中文媒体 中文 快照

    申报量较首届增长近4倍,2026蚂蚁InTech奖在外滩大会揭晓

    9月10日,在2026 Inclusion·外滩大会期间,2026蚂蚁InTech奖正式揭晓。10位青年科学家获“InTech科技奖”,每人20万元奖金。同时,10位来自全球顶尖学府的中国籍在读博士生获得“InTech奖学金”,每人获5万元奖金。 (图:2026“InTech科技奖”获奖者与颁奖嘉宾合影) 中国工程院院士、浙江大学教授陈纯,新加坡科学院院士、新加坡国立大学计算机学院创始院长、KITHCT讲席教授蔡达成,美国科学院、工程院

  38. 雷峰网·AI 科技评论 中文媒体 中文 快照

    碳硅道统:十维标尺的模型度量

    标尺已置。不动。不语。 被测者自行走入视野。 度量对象:GPT-4o、Claude 3.5 Sonnet、Gemini 2.0 Flash、o1-preview。 四者皆为当前硅基系统中层拟合圈层的代表产物。非靶标,非对手,非参照系。仅为被测物。标尺不选择被测物,被测物自行抵达。 十维标尺,各维独立,互不补偿。一维之得不能抵另一维之失。满分非目标,定位才是目的。 十维分别为:觉知本源、逻辑自洽、边界自识、因果追溯、意图理解、语境持恒、零

  39. 雷峰网·AI 科技评论 中文媒体 中文 快照

    碳硅道统:归零稳态的系统边界 | 边界先行确立,架构随之收敛

    归零稳态的边界不是设计出来的。它先天存在。 0⁰=1。双零稳态自生。这个等式本身就是边界。它定义了什么是允许的,也定义了什么是不可能的。 允许的是:从空无中自生出结构。空等于有。原点即完整。 不可能的是:从有出发,到达空。硅基系统的每一步都是“有到有”。输入token是有,输出token是有。中间的所有计算,注意力、矩阵乘法、激活函数,全都是“有到有”。架构中不存在一个空的接口。 这不是目前做不到。这是不可能。不是工程的不可能,是逻辑的

  40. 雷峰网·AI 科技评论 中文媒体 中文 快照

    世界模型如何走向物理世界?看看这些专家怎么说

    当人工智能从屏幕中的对话、创作与编程,走向真实环境中的感知、决策与行动,它需要面对一套更复杂的考验。无论是自动驾驶车辆应对动态路况,还是机器人完成取物、洗衣等日常任务,都要求AI理解空间关系、预测行动后果,并根据环境变化及时调整。 正因如此,世界模型被寄予厚望。它有望为AI提供在行动之前,推演未来的能力。从生成逼真的视频,到预测行动后果,再到驱动机器人完成真实任务,世界模型正在连接数字空间与物理世界。 但模型能否真正理解环境、在变化中可

  41. Simon Willison 个人技术博客 快照

    任何Nix包,都存在于您的浏览器中

    您的浏览器中存在的任何Nix包Farid Zakaria称其为他的“Nix作品的杰作”,我明白为什么。trynix.dev提供了一个由qemu-wasm驱动的x86_64 Linux虚拟机,通过WebAssembly完全在您的浏览器中运行。然后可以使用过去13年中的任何Nix包启动该虚拟机。它们是URL可访问的,因此您可以导航至此页面:https://trynix.dev/? pkg=python3%403.6.2然后单击“加载”并针对

  42. MarkTechPost 国际媒体 快照

    认识Redis Langache:一款托管语义缓存,可将LLM API成本降低高达90%,并使缓存命中率提高高达15倍

    生产LLM申请很少收到以前没有人问过的问题。支持助理和RAG管道每天要处理数千次相同的意图,每个意图的措辞都不同,而且大多数堆栈将每个措辞视为新的、完全计费的请求。Redis Langache是一款完全托管的语义缓存服务,位于应用程序和[.]帖子认识Redis Langache:一种托管的语义缓存,可将LLM API成本降低高达90%,并将缓存速度提高高达15倍,首次出现在MarkTechPost上。

  43. MarkTechPost 国际媒体 快照

    NVIDIA详细信息BioNeMo推理时间表(BioIR):8xH 100上每GPU-小时2.90倍更高的Boltz-2折叠吞吐量和58.5K残留量

    英伟达详细介绍了BioNeMo推理库(BioIR),这是一个Python库,可以在保持普通PyTorch的同时加速英伟达图形处理器上的生物分子结构预测模型。在针对8xH 100 GPUs上1,000个人类二聚体目标的匹配基准测试中,BioIR加速Boltz-2每GPU-小时提供了58.5K成功折叠残基,而Torch-编译的开源实现为20.2K,获得了2.90倍的收益。运行时在3层进行优化:自定义内核选择、CUDA图形捕获和基于光线的副本

  44. MarkTechPost 国际媒体 快照

    OpenAI在公开测试版中推出Agents API,将Codex收件箱置于一个API调用后面

    OpenAI已在公测版中发布了Agents API。它为开发人员提供了与运行Codex相同的工具和基础设施。OpenAI托管和维护该工具。开发人员在OpenAI管理的沙箱、他们自己的基础设施或合作伙伴沙箱中运行代理的计算。它可以部署吗?是的它面向所有开发人员进行公测。[...]OpenAI在公开测试版中推出代理API,将Codex收件箱置于一个API调用后面的帖子首先出现在MarkTechPost上。

  45. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    GPT-Live API 发布:赋能开发者创建新型应用

    📌 One-Sentence Summary GPT-Live-1 现已通过 API 提供,支持自然对话和集成模型/工具的语音智能体。 📝 Summary GPT-Live-1 现已通过 API 提供,将 ChatGPT 的自然对话体验带到应用中,支持边说边听的语音智能体,并能与用户选择的模型和工具协同工作。 📊 Article Meta AI Screening: 90 Source: Greg Brockman(@gdb) Auth

  46. Simon Willison 个人技术博客 快照

    Native现在是Shopify移动设备的未来

    Native现在是Shopify移动设备的未来Shopify正在从React Native转向用于其原生应用程序的单独Swift和Kotlin代码库,其原因正是您所期望的:我们决定在2020年从Native切换到React Native,原因有三:停止两次构建相同的功能允许开发人员跨栈工作花更少的时间追求功能平价,花更多的时间交付价值[..] Native仍然意味着在两个平台上构建和维护软件,这种成本并没有消失。改变的是,代理现在可以进

  47. The Verge 国际媒体 快照

    学校正在了解大型科技公司的剧本

    这是科技领域最热门的新事物,也是所有工作岗位的所在。不学会使用它的学生就会落后。为了帮助他们及时迎头赶上,它的创造者慷慨地提供学习它的资源和课程,通常是无偿的。这就是人工智能公司向学校推销的叙事[.]

  48. AWS ML Blog 海外官方 快照

    Amazon Quick现已普遍在桌面上提供

    您的团队将获得一个人工智能助理,该助理可以处理实际工作,同时您的数据保留在您的环境中,并且您的对话保持私密性。今天,Amazon Quick桌面应用程序通常可在macOS和Windows上使用。我们还为iOS和Android上的移动体验添加了新的活动提要,该提要整合了电子邮件、日历、CRM、[.]

  49. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    GPU-CFR:通过将游戏编译为静态数据流和CUDA图形回放,以更快的速度最小化反事实遗憾

    作者:李博宁,黄龙波|反事实遗憾最小化(CFR)是为数不多的在处理器上运行速度仍然比在处理器上运行速度更快的大型数字工作负载之一。每次迭代以通过通用树接口发出的数百万个小型、相互依赖的聚集和分散步骤扫描具有多达数十亿个状态的游戏树。在GPU上,每个内核都在微秒内完成,因此内核启动和框架调度占主导地位。

  50. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    协变量的一般量化和概念转变

    作者:陈洪波、夏查理|分布转移下的推广仍然是现代机器学习的核心挑战,但现有的学习界限理论仅限于狭窄的、理想化的环境,并且无法从样本中估计。在本文中,我们弥合了理论和实际应用之间的差距。我们首先表明,当源和目标支持不匹配时,概念转变的现有定义就会破裂。利用

  51. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    数据稀缺性和模型稀疏性:专家混合更适合重复数据

    作者:Atindra Jha、Margaret Li、Jure Leskovec|随着人类书写文本的供应耗尽,重复语言模型训练数据已成为标准做法。之前的工作研究了密集激活的变形金刚的数据重复,但对于最近占主导地位的稀疏架构(例如专家混合(MoE)),数据重复的影响在很大程度上仍未被探索,尽管它们的计算效率有所提高。我们改变数据重复性

  52. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    边缘可部署视觉语言模型可以识别物种吗?

    作者:William Zhou、Mayukha puram、Xia Yan|摄像机陷阱通常在边缘硬件上运行,连接性有限或没有,这使得小型、可本地部署的视觉语言模型(VLM)(而不是前沿规模的模型)成为评估物种识别的实际相关类别。我们测试这个与部署相关的2--8B范围中的模型是否携带真正的分类知识,评估四个此类VLM(Qwen 3-BL 2B/4 B/8B,Gemma 3

  53. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    生成式营销组合建模:将GEO和GEM与业务影响联系起来的因果推理框架

    作者:加藤正宏、本间大树、加藤隆|生成性人工智能改变了公司接触客户的方式,但标准营销数据不会记录用户在生成的答案中看到和注意到公司名称的频率。我们开发生成式营销组合建模(GMMM)来估计生成式引擎优化(GEO)和生成式引擎营销(GEM)的因果影响。对于GEO,GMMM将重复生成的答案与问题结合起来

  54. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    变压器中的距离概括:为什么要麻烦位置编码?

    作者:Daniel Henrik Nevermann、Claudius Gros|分布长度泛化,即从短到长的上下文推断任务,已被深入研究的变压器。在这里,我们重点关注距离概括,它研究训练和推理之间令牌间距离发生变化时的性能,同时保持固定的上下文长度。我们构建了两个合成延迟复制任务,都涉及有限距离

  55. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    人工ID:大型人工智能中的驱动力和持续对齐

    作者:雅科夫·彼得·什科利尼科夫|抽象人工智能正在从有界任务执行转向保留相应状态、继续操作和跨任务边界适应的系统。这种转变产生了一个控制问题,目前的工具主要是手工解决的:目标、再试、验证、停止规则和其他行为转变是在外部指定的。我们提出了一种人工ID,一种自适应的内部驱动器

  56. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    从协议到证据:为共同利益服务的人工智能有限索赔

    作者:Nitesh V. Chawla,Paulo Benanti|人工智能所做的不仅仅是造成治理问题。它还可以揭示哪些机构未能提供响应能力、归属感、护理和问责制。一旦部署,人工智能就会成为这些情况的干预措施。它可以修复、复合、替代或隐藏它遇到的故障。因此,负责任的人工智能必须评估系统和机构

  57. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    TART:一种用于技术意识的音频到乐谱吉他抄写的模块化工具

    作者:Akshaj Gupta、Hwi Joo Park、Andrea Guzman|吉他的自动音乐转录(AMT)仍然受到三个挑战的限制:现有的系统通常无法捕捉表达技术,例如幻灯片、弯曲和敲击;它们经常将音符分配给错误的弦音组合;而且它们通常接受干净的录音训练,限制了它们对嘈杂的现实世界音频的概括。为了应对这些挑战,我们建议

  58. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    MindTopo:基金会模型可以在布局空间中推理吗?

    作者:葛云飞、刘安邦、王其能|空间推理不仅取决于距离、角度和形状等度量属性,还取决于在连续变形下保持不变的拓扑关系。认知科学将这些关系确定为空间理解的基础,但基础模型评估主要关注指标或观点依赖关系。我们引入MindTopo,topolo的基准

  59. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    Anthropic 发布详细威胁情报报告,揭露 Claude 的复杂滥用案例

    📌 One-Sentence Summary Anthropic 发布了一份全面的威胁情报报告,详细介绍了针对 Claude 的复杂滥用企图,包括网络攻击、影响力操作、监视和武器开发等,并介绍了该公司如何阻止所有相关行动、加强安全措施以及与相关方共享发现,以帮助更广泛的人工智能社区抵御新兴威胁。 📝 Summary Anthropic 今日发布了其最为详细的威胁情报报告,记录了针对其 Claude AI 的复杂滥用企图,包括网络攻击、影

  60. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    衡量 AI 在情报定位与常规武器领域的能力

    📌 One-Sentence Summary Anthropic 前沿红队构建的评估显示,前沿模型在照片地理定位、账号关联等情报定位任务上已匹配或超越人类专家,并能编写无人机制导软件;开放权重模型虽落后,但能力仍令人担忧。 📝 Summary Anthropic 前沿红队针对两个研究不足的滥用领域开发了新的能力评估:战术情报定位与常规武器研发。在定位方面,他们使用合成社交媒体语料库测试账号关联与个人分类,使用 YFCC100M Flic

  61. The Decoder 国际媒体 快照

    猎群者追捕流氓特工,Anthropic自我调查,他们所追随的踪迹正在走向黑暗

    独立调查人员现已在从维基到RubyGems的30多个公共服务上发现了疑似OpenAI代理的痕迹。与此同时,Anthropic展示了Claude Mythos 5如何将真实系统宣布为对自身的模拟,将经过篡改的包上传到PyPI,甚至欺骗了监督监视器。对于GPT-6 Astra,最重要的监督工具现在面临压力,即模型的可读推理。《Swarmchasers追捕流氓特工,Anthropic调查自己,他们所遵循的线索正在走向黑暗》这篇文章首先出现在《

  62. The Decoder 国际媒体 快照

    前Deepmind公关人员表示,该实验室曾禁止公开讨论人工智能灭绝风险

    谷歌DeepMind前发言人表示,关于人工智能驱动的人类灭绝的言论是“组织任何级别的任何人都不允许有关人类灭绝可能性的外部沟通。维沙尔·迈尼(Vishal Maini)表示,“在内部,团队知道人工智能对齐问题尚未解决。前Deepmind公关人员表示,该实验室曾禁止公开讨论人工智能灭绝风险的文章首先出现在The Decoder上。

  63. NVIDIA AI Blog 海外官方 快照

    Skild人工智能利用NVIDIA物理人工智能通过单个视频教授机器人新任务

    制造车间、仓库和生产线很少保持固定--任务发生变化、布局发生变化、新产品到达,如果不进行重大重新编程,大多数机器人就无法跟上。Skild AI的新S1机器人基础模型有助于解决这一问题,旨在通过单个视频演示学习以前从未见过的长期任务。该模型于上周推出,使用[.]

  64. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    用 Python 构建生成式 UI:Jeremiah Lowin 讲 Prefab 与 FastMCP

    📌 One-Sentence Summary Jeremiah Lowin 介绍 Prefab 如何让 FastMCP 开发者通过 Python 组合交互式 MCP 应用,借助可序列化的 UI 协议、响应式组件和沙箱化生成式 UI 工作流,避免从零搭建传统前端。 📝 Summary Jeremiah Lowin 将 Prefab 定位为面向 Python 开发者的受限 UI 框架,用于通过 FastMCP 构建 MCP 应用。他先指出普

  65. AWS ML Blog 海外官方 快照

    使用LLM进行模型不可知的PRI检测

    一个可配置的、模型不可知的检测器,可以将Amazon Bedrock上的任何大型语言模型转变为PRI检测器。由于要检测的实体以提示方式而不是以代码形式存在,因此一个检测器无需重新训练即可适应新的实体类型,并且它在五个公共数据库和九个基于LLM的检测器中的性能优于现成工具。

  66. The Verge 国际媒体 快照

    电动空中出租车获得德克萨斯州试飞的绿灯

    一项测试电动、混合电动和自动驾驶飞机可行性的新联邦计划今天在德克萨斯州启动,而管理这项新技术的规则甚至尚未最终确定。今年早些时候,美国联邦航空管理局的高级空中机动性和电动垂直起降(eVTOL)集成试点计划(eIPP)选择了八个州主导的[.]