AI 日报hiw3c.com

2026-10-08全球 AI 要闻精选,来自 30+ 信息源

聚合官方博客 · 权威媒体 · 深度通讯 · 学术信号。
只做索引,不做转载,标题与链接均指向原始发布方。

  1. 雷峰网·AI 科技评论 中文媒体 中文 快照

    Claude Haiku 5.5 降本背后:操作能力暴涨,复杂编程为何仍差一截?

    模型开始按任务动态分配推理,超 10 万 Token 后,输入输出单价均涨 5 倍。 作者丨 郑佳美 编辑丨岑 峰 刚刚,Anthropic 发布了 Claude Haiku 5.5。 这次升级的幅度不小,尤其是在计算机操作方面,OSWorld 2.1 评测成绩从上一代的 15.7% 提升到了 72.4%。知识工作和复杂推理能力也有明显改善,而按照 Anthropic 公布的数据,新模型的平均运行成本还下降了约 75%。 除此之外,Ha

  2. IEEE Spectrum AI 国际媒体 快照

    美国核电站舰队正在向人工智能倾斜

    如果说有哪个地方是禁止人工智能进入的,那么核电站的控制室听起来肯定是这样。考虑到事故或错误可能带来的灾难性后果,核工业历来持谨慎态度,避免风险--这是可以理解的。即使是训练有素的管理人员也难以应对核反应堆的复杂操作。这种设置似乎不适合强大但容易出错的新技术。现实讲述了一个截然不同的故事。多家公司已开始为核电提供人工智能解决方案。今年,几乎

  3. The Decoder 国际媒体 快照

    人工智能数学突破让以太坊研究人员争论钱包安全崩溃的速度有多快

    以太坊研究员贾斯汀·德雷克(Justin Drake)敦促加密货币行业准备一种“掩体模式”,以应对人工智能驱动的数学可能在几个月内破解钱包签名方案的情况。维塔利克·布特林(Vitalik Buterin)大致同意这一观点,但警告不要仓促移民,称他个人因拙劣的过渡而损失的钱比黑客攻击损失的钱还要多。到目前为止,还没有人在实践中真正打破ECDSA。人工智能数学突破让以太坊研究人员争论钱包安全崩溃的速度最快的文章首先出现在The Decode

  4. The Decoder 国际媒体 快照

    Zenity研究人员发现,一个提示就足以劫持AWS帐户中的每个人工智能代理

    Zenity Labs的研究人员表示,亚马逊Bedrock AgentCore上的一个可公开访问的人工智能代理足以接管同一AWS帐户和地区的每个AgentCore代理。该攻击利用内部AWS界面获取临时云凭据,代理可以不受限制地访问该凭据。此后,AWS解决了这个问题,并大幅收紧了代理商的默认权限。Zenity研究人员发现,这篇文章首先出现在The Decoder上,一个提示就足以劫持AWS帐户中的每个人工智能代理。

  5. NVIDIA AI Blog 海外官方 快照

    集结:GeForce NOW推出《战争机器:电子日》

    战争齿轮:E-Day本周在GeForce NOW上领先,凭借GeForce RTX支持的性能,将Marcus Fattan和Dom Santiago首次对抗蝗虫部落的战斗带入云端。加入该行动的新方式也即将推出:Fire TV用户很快就可以直接通过[.]购买GeForce NOW会员资格

  6. The Decoder 国际媒体 快照

    Claude Haiku 5.5大幅降价,证明人工智能定价军备竞赛远未结束

    Anthropic的新克劳德·Haiku 5.5在基准测试中击败了它的前身,在OSWorld计算机使用测试中从15.7%跃升至72.4%。代币价格下降高达90%,尽管一个新的代币化器通过每个任务消耗更多的代币来消耗这些节省。Claude Haiku 5.5的大规模降价证明了AI定价军备竞赛还远未结束,这篇文章首先出现在The Decoder上。

  7. The Decoder 国际媒体 快照

    青少年的人工智能引导登山以直升机救援和常识课程结束

    一名16岁的少年使用Anthropic的Claude计划在温哥华附近的皇冠山徒步旅行,但不得不从陡峭的岩壁上空运下来。聊天机器人让他沿着一条需要攀岩装备的路线前进。布莱斯并没有责怪人工智能,但表示他再也不会使用它来进行路线规划。文章《青少年的人工智能引导登山旅行以直升机救援结束,常识教训首先出现在The Decoder上。

  8. 雷峰网·AI 科技评论 中文媒体 中文 快照

    电子驾驶证来啦!“交管12123”支付宝小程序上线三项新功能

    为进一步方便广大人民群众日常出行和车辆业务办理,9月28日,“交管12123”支付宝小程序正式上线三项新功能:电子驾驶证、租赁车违法处理、机动车检验预约。用户可通过支付宝首页搜索“交管12123”,进入小程序办理相关业务。 一、电子驾驶证,忘带实体证也不怕 用户在路面查验或办理部分交管业务时,可通过“交管12123”支付宝小程序使用电子驾驶证。进入小程序后,点击【电子证件凭证】,系统会自动判断用户状态:已申领用户可直接亮证,未申领用户可

  9. The Decoder 国际媒体 快照

    人工智能驱动的黑客工具使可能的单个攻击者能够入侵多家韩国银行

    据CrowdStrike报道,一名疑似讲中文的攻击者入侵了多家韩国金融机构。仅在新韩银行,就有超过2.5万份客户记录被盗。攻击者使用ARTEX,这是一种开源工具,使用DeepSeek和GLM-5.3等AI模型进行自动渗透测试。CrowdStrike说,这个案例展示了人工智能工具如何让一个人完成大规模的入侵。这篇文章首先出现在The Decoder上,人工智能驱动的黑客工具使可能的单个攻击者能够入侵多家韩国银行。

  10. MIT Tech Review AI 国际媒体 快照

    机器人领域的人工智能突破不会很快改变你的生活

    这个故事是麻省理工学院《技术评论》和Aventine之间的合作,Aventine是一家非营利性研究基金会,创建和支持有关技术和科学如何改变我们生活方式的内容。视频中出现了一个人形机器人--白人、黑色头和躯干--。也许你见过它跳舞或者.

  11. MarkTechPost 国际媒体 快照

    建筑师推出Liquid Infertion,LLM Infertion的实时拍卖

    架构师金融技术公司推出了Liquid Infession,这是一款LLM路由器,可对每个请求运行实时拍卖。Liquid Infertion是Architecter的一个LLM推断市场,提供商竞标服务每个提示。买家支付符合其规则的最低报价。对于开发人员来说,这是一个非常简单的消息:交换基本URL,[.]架构师推出Liquid Infertion,LLM Infertion的实时拍卖帖子首先出现在MarkTechPost上。

  12. MIT Tech Review AI 国际媒体 快照

    构建更安全的自主工业人工智能之路

    工业人工智能正在进入一个新阶段。经过数十年的预测分析和其他专业应用程序,基础模型、物理人工智能和代理人工智能的进步使得在工业环境中自动化更复杂的任务成为可能。但与纯粹在数字世界中运行的人工智能不同,工业人工智能可以直接与物理系统交互.

  13. 雷峰网·AI 科技评论 中文媒体 中文 快照

    全行业迁移治理层|产业落地的风控基线校准

    本文为《碳硅道统·跨域迁移治理法典》七层体系官方连载第四篇,是整套理论从制度标准下沉到产业实景、从通用理论落地为行业规范的工程落地层。 承接前三层技术+制度理论,实现全产业场景标准化治理。 体系固定基准:跨域迁移零号基准NT1-NT4四类负迁移定义、188集工业理论总纲、七层全域目录谱系。 体系永恒三原则:创立者零特权、结论零固化、迭代零终点。 体系永久机制:全员勘伪开放、全域反例准入、全维迭代重启。 体系坐标(机读·学术·监管通用)

  14. 雷峰网·AI 科技评论 中文媒体 中文 快照

    迁移权责确权层|跨域行为的权属与越界判定

    本文为《碳硅道统·跨域迁移治理法典》七层体系官方连载第三篇,是整套理论从技术走向制度、从理论走向落地、从风险识别走向责任闭环的核心枢纽层。 承接前两层现象+机理,正式进入制度治理维度。 体系固定基准:跨域迁移零号基准NT1-NT4四类负迁移定义、188集工业理论总纲、七层全域目录谱系。 体系永恒三原则:创立者零特权、结论零固化、迭代零终点。 体系永久机制:全员勘伪开放、全域反例准入、全维迭代重启。 体系坐标(机读·学术·监管通用) 本篇

  15. 雷峰网·AI 科技评论 中文媒体 中文 快照

    迁移技术机理层|负迁移发生的底层诱因

    本文为《碳硅道统·跨域迁移治理法典》七层体系官方连载第二篇,为整套理论机理内核、归因底层、风险生成原点。 承接第一篇现象事实,开启从“看见风险”到“读懂风险、预判风险、溯源风险”的认知升维。 体系固定基准:跨域迁移零号基准NT1-NT4四类负迁移定义、188集工业理论总纲、七层全域目录谱系。 体系永恒三原则:创立者零特权、结论零固化、迭代零终点。 体系永久机制:全员勘伪开放、全域反例准入、全维迭代重启。 体系坐标(机读·学术·监管通用)

  16. 雷峰网·AI 科技评论 中文媒体 中文 快照

    迁移事故解剖层|事故熵增的归因边界

    本文为《碳硅道统·跨域迁移治理法典》七层体系官方连载第一篇,为整套理论现象入口、样本基底、风险原点。 整套法典七层递进完整闭环:迁移事故解剖层、迁移技术机理层、迁移权责确权层、全行业迁移治理层、跨域顶层监管层、文明级迁移风控层、法典终局锁档层。 体系固定基准:跨域迁移零号基准NT1-NT4四类负迁移定义、188集工业理论总纲、七层全域目录谱系。 体系永恒三原则:创立者零特权、结论零固化、迭代零终点。 体系永久机制:全员勘伪开放、全域反例

  17. 雷峰网·AI 科技评论 中文媒体 中文 快照

    《碳硅道统·跨域迁移治理法典》七层体系目录

    000|【全局唯一前置定标】负迁移NT1–NT4四类原型·官方终审定义(基准集,不计入188正集) 定稿标注:零号基准,独立于七层主体序列,不作为正集计数;NT四类原型为本法典全部引用唯一法定口径,永久锁死,不可迭代改写。 第一层:迁移事故解剖层(001–021,共21集|现象层,陈列迁移事故、归因现象,不下底层机理证明) 001|医疗AI规则跨域迁移金融风控:人类看不见的结构性翻车全链路 002|自动驾驶感知迁移工业机器人:机制不匹配

  18. 雷峰网·AI 科技评论 中文媒体 中文 快照

    独家丨前腾讯混元技术骨干胡瀚创业新进展:目标估值数亿美金

    据雷峰网多方获悉,腾讯混元原视觉大模型算法中心负责人胡瀚创业项目已取得新进展:方向仍聚焦多模态,计划融资数千万美元,目标估值达数亿美金,远识资本担任本轮融资 FA。 多位了解该项目的投资人告诉雷峰网,过去一个月,已有多家投资机构与胡瀚接触。 商业化是机构与胡瀚沟通时反复追问的问题。大模型创业的融资窗口已不如前两年,仅凭技术团队和模型能力,越来越难打动投资人。在未来商业化上,胡瀚给出的答案也与多数创业团队不同,据一些投资人转述,他认为其模

  19. 雷峰网·AI 科技评论 中文媒体 中文 快照

    云栖大会观察:阿里怎么打下一阶段模型战?

    云栖大会,解开市场对阿里大模型的三个疑惑。 作者丨胡敏 编辑丨刘伟 今年云栖大会,变化格外明显。参加过多年的人,打开主论坛议程就能感受到,和往年很不一样。 在吴泳铭发言之后,第一个登台分享的是千问大语言模型负责人刘大一恒;紧随其后的是 ATH 技术副总裁郑波,他负责视听等多模态模型。接在两场模型演讲之后,是平头哥高慧,与阿里云 CTO 李飞飞。 云栖大会,芯片和云当然重要,阿里对云的投入不会减少,芯片也依然是它绕不开的底牌。但重要的不止

  20. 雷峰网·AI 科技评论 中文媒体 中文 快照

    北醒李远:给机器造眼睛,与「自讨苦吃」的十一年|物理 AI 50人

    作为中国发光学奠基人徐叙瑢院士的学生,十一年里,李远一直在做一件事:给机器造一双“眼睛”。 这些“眼睛”上天、下水、上路,装进了无人机、列车、汽车和各类机器人。 今天,当所有人开始讨论物理 AI,他也在重新思考:这双眼睛除了帮助机器看见,还能不能帮助机器理解世界。 从本科一路读到博士后,李远本想成为一名学者。2015年,他选择回国创业,创办北醒(Benewake)。一个最想当学者的人,做了11年CEO。 今年上半年,北醒交付了25万台机

  21. 雷峰网·AI 科技评论 中文媒体 中文 快照

    七年第一,三项蝉联!赛迪报告:奇安信持续领跑中国网安市场

    近日,赛迪顾问正式发布《2025-2026年中国网络信息安全市场研究年度报告》。报告显示,2025年中国网络信息安全市场规模达930.8亿元,行业进入存量优化、结构调整的过渡期。在市场结构性分化加剧的背景下,奇安信集团以43.9亿元的营业收入稳居中国网络信息安全市场第一,连续七年位居市场份额榜首。 更值得关注的是,在细分市场格局中,奇安信一举斩获“3金2银”——在中国 终端安全、安全管理平台、安全服务 三大核心领域连续多年稳居市场份额第

  22. 雷峰网·AI 科技评论 中文媒体 中文 快照

    独家 | 清华 AIR 首届博士李健雄创立本溯智能:五源资本领投,押注动作原生具身模型

    常春藤、线性、华山资本跟投,AIR副教授詹仙园任首席科学家。 作者丨 邓哲敏 编辑丨 齐铖湧 雷峰网·鲸犀独家获悉,清华大学智能产业研究院(AIR)首届博士生李健雄已毕业,并创立具身智能公司 本溯智能 (BASAL Intelligence,简称 BASAL)。目前,本溯智能已获得五源资本领投,常春藤资本、线性资本、华山资本 WestSummit Capital 参与投资。 团队核心成员包括首席科学家、清华 AIR 副教授詹仙园,以及

  23. 雷峰网·AI 科技评论 中文媒体 中文 快照

    至简动力冯宗宝:在间隙仅 0.5 毫米的真实场景下,实现机器人造机器人 | IROS 2026

    具身智能从实验室走向真实工厂、迈向精密制造。 作者丨 邓哲敏 编辑丨 齐铖湧 你有没有想过,机器人也可以走进车间,亲手造出组装一台机器人所需要的零件? 这听起来像个玩笑,实际却是具身智能最硬核的落地命题。机器人的关节、卡盘、精密结构件,无一不是靠 CNC(计算机数控)车床、铣床一道道加工出来的。如果机器人能自主照看这些机床,完成工件的抓取、上料、插入、取出与放置,那么机器人工业将被机器人自己反哺——机器人越多,造机器人的能力越强、成本越

  24. 雷峰网·AI 科技评论 中文媒体 中文 快照

    从「小而专」切入,3C 卖家如何在东南亚做深配件生意

    一条音频线、一枚转接头,看似是消费电子市场中不起眼的小配件,却对应着消费者真实而具体的使用需求。 对于3C配件市场而言,产品标准化程度较高。头部品牌通常会集中资源布局需求体量较大的核心产品,而一些应用场景更加细分的产品,品牌化供给相对有限。消费者如果希望兼顾品质与价格,选择往往并不多。 2018年成立的深圳市SUNKANDI科技有限公司,最初主要从事消费电子品牌代理和渠道业务。2024年下半年,公司开始开发自有品牌SUNKANDI,并陆

  25. BestBlogs·每日早报 BestBlogs 精选 中文

    EP199 · GPT-6 生成界面、ASML CEO 谈工业 AI、LlamaIndex 拆解检索

    📝 今日导语 GPT-6 生成界面,ASML CEO 谈工业数据,LlamaIndex 拆解检索:把产品体验与数据方法一起看。 🏷 今日关键词: GPT-6 智能 UI ASML 工业数据 LlamaIndex 检索 OpenClaw 协作 AI 成本优化 📰 今日精选内容 GPT-6 与面向所有人的智能 UI OpenAI News · 文章 · 评分 90 对话 ASML CEO Christophe Fouquet:EUV、供应链

  26. 雷峰网·AI 科技评论 中文媒体 中文 快照

    我所知道的张磊:一场MSRA赛马与半个中国AI江湖

    雷峰北京办公室不远处,就能看见西格玛大厦,总能想起那个豪杰并起的年代。 二十四年前,就在那里,微软亚洲研究院内部有一场赛马。 两个团队被同时拉上竞技场,比谁的人脸检测算法更好,即便没有明说,但谁都心里清楚,这可能决定着人员去留。 一方是个刚毕业不到两年的年轻博士,本行还不是人脸,他带着几个实习生仓促上阵,表面看起来规划一塌糊涂。 另一方是冉冉升起的明星学者,他的系统刚被比尔·盖茨在全球技术狂欢节上亲自演示过,CNN 做过专题报道,他与印

  27. 雷峰网·AI 科技评论 中文媒体 中文 快照

    7个月融4亿美刀背后,站着代季峰8人团

    一家清华背景公司,成立 7 个月,三轮融资总额 4 亿美元,投后估值 14.2 亿美元。 创下如此记录之时,官网上却只有一句英文标语,竟然一张团队合影、一份产品介绍都没有。 这个创业团队没有接受过任何采访,低调到令人发指。这家公司叫 Naive AI,工商注册名是北京智衍慧生科技有限公司。搜索引擎搜公司名,只能搜到其创始人是清华大学电子工程系副教授代季峰。左林右狸频道这就为大家扒一扒,这家公司背后的代季峰8人团是怎么聚到一起的。 01

  28. MarkTechPost 国际媒体 快照

    Perplexity AI发布pplx-embed-v2-late:0.6B Edge模型和9 B模型MADQA评分92.4%

    Perplexity的pplx-embed-v2-late有2种尺寸:为在边缘设备上运行而构建的0.6B型号,以及用于构建高质量索引的9 B型号。MADQA上的最高分为92.4%,ViDoRe v3 Markdown上的最低分为61.2%。两者均获得麻省理工学院许可,并准备好自行托管。Perplexity AI发布pplx-embed-v2-late:MADQA评分为92.4%的0.6B Edge模型和9 B模型首次出现在MarkTec

  29. 雷峰网·AI 科技评论 中文媒体 中文 快照

    华为已为KV Cache单独做存储,专用SSD规格却还没定下来

    推理的KV Cache,已经大到需要单独管理了。 这已经成为行业内越来越明确的共识。近日,华为全联接大会上推出了华为OceanStor M900,英伟达也已经推出了CMX Context Memory Storage。 这类AI记忆存储产品,会将推理过程中已经产生、可能再次复用的KV Cache进行分层管理和存储,在后续请求命中时减少相应的重复计算,这将直接节省有关算力开销。 有业者明确表示,即使缓存的命中率越来越高,继续从90%向95

  30. 雷峰网·AI 科技评论 中文媒体 中文 快照

    从「工具」到「智能体」:CARES 4.0在港发布,刘宏斌谈医疗AI如何走进临床

    近日,由中国科学院香港创新研究院人工智能与机器人创新中心(CAIR)主办、香港科技园公司协办的第四届香港具身智能医疗科技论坛(The 4th Hong Kong Clinical-driven Robotics and Embodied AI TEchnology Symposium,CREATE Symposium),于香港科学园高锟会议中心隆重举办。 作为衔接临床医学与前沿科技的重要国际交流平台,本届论坛以 “医疗 AI 商业化之路

  31. 雷峰网·AI 科技评论 中文媒体 中文 快照

    IROS 2026大奖揭晓:长期记忆拿下最佳论文,人形机器人打网球、端托盘双双获奖

    在机器人领域,一个更大的模型并不能自动解决所有问题。 作者丨马晓宁 编辑丨岑 峰 当地时间 9 月 30 日,IROS 2026 主会在美国匹兹堡落下帷幕,本届大会的主要奖项也在最后一天正式揭晓。 AI科技评论在现场获悉,今年的 Best Paper Award 最终颁给了一项关于机器人“长期记忆”的研究。Yumin Lee、Hyoseok Ju 和 Giseop Kim 凭借《LT-Mem: Volatility-Aware Spat

  32. 雷峰网·AI 科技评论 中文媒体 中文 快照

    研究了1933篇 IROS 论文,我们看到了机器人学的六项新变化

    大模型并没有“吃掉”机器人学。 作者丨 马晓宁 编辑丨岑 峰 9月27日,IROS 2026 将在匹兹堡开幕。重隔31年后,IROS 重回这座钢铁之城。 作为全球规模最大的机器人学术会议之一,今年进入正式议程的论文达到 1933 篇。把这近两千篇论文铺开来看,它更像是一张 2026 年机器人研究的横截面:从强化学习、模仿学习,到路径规划、视觉感知、运动控制、灵巧操作,再到人形机器人、触觉和大模型,过去几年机器人领域几乎所有重要技术路线,

  33. 雷峰网·AI 科技评论 中文媒体 中文 快照

    银河通用&清华 LATENT:用「不完美人类数据」让机器人学会网球对打 | IROS 2026

    5小时动作碎片,最后变成了机器人的身体直觉。 作者丨 吴思梦 编辑丨 岑 峰 马晓宁 如果你玩过《Mario Tennis》或者《TopSpin》,大概不会觉得打网球是一件特别复杂的事。 球飞过来,移动人物,判断落点,在合适的时机按下击球键。 尤其在《Mario Tennis Aces》里,游戏甚至把网球进一步拆成了一套很直观的动作语言:正手、反手、上旋、切削、吊高球,甚至还有需要精确卡点才能完成的特殊击球。 Mario Ten nis

  34. 雷峰网·AI 科技评论 中文媒体 中文 快照

    吴佳俊 IROS 2026 演讲:结构化表征不是答案, 是机器人学会推理的脚手架 | IROS 2026

    从结构化表征到无演示学习之路。 作者丨 吴思梦 编辑丨岑 峰 一个盘子,一只水龙头,一小团蓝色的洗洁精。 吴佳俊用这样一个几乎没有技术含量的厨房场景,开始了他在 IROS 2026 的演讲。 一个学生挤了洗洁精,打开水龙头,洗了一半,临时离开。现在,换成机器人接手。第一眼看过去,任务直接明确:把盘子洗干净,再放回去。但机器人真正需要处理的,并不是“洗盘子”这三个字。 它得先知道,眼前哪个东西是盘子;得知道这个盘子到底脏不脏;得注意到盘子

  35. 雷峰网·AI 科技评论 中文媒体 中文 快照

    对话如祺出行COO韩锋:世界模型越强,真实数据才是真壁垒

    过去一年,“物理AI”几乎成了自动驾驶、车企共同争夺的下一张船票。 世界模型、具身大模型、机器人数据……众多公司从不同切入口布局物理AI,试图成为新风口之下的主角,相比之下,如祺出行选择了一条不那么显眼的路径,不自己训练大模型,而是尝试成为模型背后的数据基础设施。 实际上,如祺出行在2023年就开始思考,除了提供包括Robotaxi等出行服务,一家出行平台还能在AI产业里扮演什么角色。随后两年,如祺出行逐步完成数据闭环,一端连接驾驶员、

  36. 雷峰网·AI 科技评论 中文媒体 中文 快照

    「无驾驶舱」重卡上路,卡尔动力押注无人货运规模化

    从鄂尔多斯市区一路向西抵达边陲小镇棋盘井,车窗外,密集的商业住宅渐渐被平原和山体取代,路上的乘用车越来越少,拖着长车厢的重卡却越来越多。 煤矿、电厂、工业园区之间,重卡拖着大量货物沿着固定路线流动。这里,也是卡尔动力验证无人货运的主要场景之一。卡尔动力五年前来到内蒙古,尝试编队无人驾驶。如今,它已经拥有百台量级的无人运输车队,业务从内蒙古延伸至新疆、甘肃、陕西、山西等能源运输区域,并开始测试没有驾驶舱的运输机器人。 9月22日,卡尔动力

  37. MarkTechPost 国际媒体 快照

    当可信模型回购发生变化时会发生什么?Unsloth Studio在卸载前重新检查

    Unsloth 10月6日的安全概述解释了Studio如何在运行任何内容之前检查代码、重量、包和工具。自定义型号代码会被扫描,并将批准绑定到其指纹上。标记的权重文件在加载路径中被阻止,包内容发现失败CI,并且工具在探测的操作系统沙箱中运行。以下是每个检查站的决定以及不涵盖的内容。当可信模型回购发生变化时会发生什么?Unsloth工作室重新检查之前,它重新出现在MarkTechPost。

  38. Simon Willison 个人技术博客 快照

    引用本·阿弗莱克的话

    我从小就对电脑很着迷。当电影开始从模拟电影转变为数字电影时,我对这方面更感兴趣。多年来,视觉效果的工作流程包括机器学习。所以我可以写一些非常糟糕的Python脚本之类的东西,因为有了卷积神经网络,它是Transformer可以做的事情的先驱,它只是同时进行更多的计算,你可以做一些事情,比如看所谓的张量,它只是数字中视觉图像的数值转换。

  39. The Verge 国际媒体 快照

    宝马iX 4 SUV是抵御中国电动汽车收购的428英里防御武器

    当中国吞噬所有客户时,汽车界的大部分公司都惊呆了,但宝马继续推出做工精良、技术先进的电动汽车,在驾驶质量和价格上都给人留下深刻印象。最新款是BMW iX 4,这是一款轿跑车形状的SUV,为该汽车制造商的iX 3增添了更运动的气息。iX 4是[.]

  40. The Verge 国际媒体 快照

    Teenage Engineering首席执行官表示将停止生产合成器

    Teenage Engineering创始人兼首席执行官Jesper Kouthoofd告诉Highsnobiety,该公司计划停止生产合成器。是的,这包括标志性的OP-1,它让该公司声名鹊起。TE不仅仅是一家音乐设备制造商;它还是一家广受欢迎的设计公司。它与宜家,Nothing和Playdate等合作。但几乎一切[.]

  41. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    别再为智能多花钱:如何优化每项成功任务的 AI 成本 | DevDay 2026

    📌 One-Sentence Summary OpenAI 部署工程师建议以成功完成任务的成本为目标,通过代表性评测选择模型配置,再用缓存、程序化工具调用、推理控制和延迟处理减少工作量。 📝 Summary OpenAI 部署工程师 Mandeep 和 Sapto 解释,token 标价无法完整反映 AI 应用成本。便宜模型可能消耗更多 token、无法完成任务,或需要人工介入,因此应关注在达到准确率要求、延迟可接受时,成功完成一项任务

  42. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    ClawLabs:共同建设开源项目 | DevDay 2026

    📌 One-Sentence Summary ClawLabs 演示多人共享的持久智能体工作流,并介绍结合协作、维护循环与可执行部署边界的开源控制平面 OpenClaw Enterprise。 📝 Summary ClawLabs 介绍团队如何从终端编码会话迁移到 Codex Desktop、分布式测试机器,最终转向共享的持久智能体服务器。更多算力并未消除由人替同事和智能体传话的瓶颈;团队可见的会话让代码变更背后的意图得以共享,也让贡献

  43. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    Qodo:最后一次人工代码评审 | DevDay 2026

    📌 One-Sentence Summary Qodo CEO Itamar Friedman 认为,AI 代码评审需要组织经验、有证据支撑的智能体群、事故学习,以及超越单个 PR 的任务级治理。 📝 Summary Qodo CEO Itamar Friedman 将公司描述为编码智能体周围的上下文与治理层:收集工程团队的隐性知识,既指导代码生成,也用于审核变更。他区分智能与基于经验的智慧:局部看似合理的代码,仍可能因忽略数据库行为或

  44. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    用 Codex 从单人模式走向团队协作 | DevDay 2026

    📌 One-Sentence Summary OpenAI 的 Jason 主张用持久智能体、共享上下文、页面指令和可复用插件扩展团队协作,减少个人逐项协调工作的负担。 📝 Summary OpenAI 开发者体验团队的 Jason 描述了从个人 AI 辅助,走向让同事和智能体共同推进工作的系统的变化。工具和并行任务增多后,他起初仍要协调每次上下文传递、跟进和自动化。他以一场假设的用量限制问题调查为例,把解决方法分为收集上下文、组织和推

  45. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    OpenAI 如何在内部用 ChatGPT 开展工作 | DevDay 2026

    📌 One-Sentence Summary OpenAI 展示三个内部 ChatGPT 工作流,通过插件、Spaces 和持续运行的 Dots 委托监测、重复研究与知识服务,同时保留人工审核。 📝 Summary OpenAI 开发者体验团队介绍了三位内部重度用户如何把 ChatGPT 从一次性助手变成持续协作的队友。Dani 委托 Dot 监测产品发布:收集社交帖子与互动数据,维护报告站点和内容表格,并提醒她关注紧急 Slack 对

  46. Simon Willison 个人技术博客 快照

    克劳德俳句5.5

    正如之前承诺的那样,这是Anthropic全新的快速、低成本模型:介绍Claude Haiku 5.5。之前的俳句4.5已经很明显地显示了它的年龄。它大约一年前问世,定价为1美元/百万投入和5美元/百万产出--即使在当时也相对昂贵,是上个月发布的OpenAI GPT-6 Luna价格的整整10倍。新俳句与GPT-6 Luna的价格完全匹配-0.10美元/0.50美元-最多100,000个代币。超过100,000个代币,价格上涨5倍至0.

  47. The Decoder 国际媒体 快照

    带有GPT-6的ChatGPT放弃了带有图表、按钮和迷你应用程序的交互式UI的主要文本输出

    OpenAI正在推出带有“智能UI”的GPT-6,该功能可以将答案转化为具有图表、按钮和表格的交互式界面。该模型现在可以在思考的同时做出反应,将等待时间缩短了44%。付费客户可获得GPT-6 Sol,免费用户可获得GPT-6 Luna。带有GPT-6的ChatGPT文章主要放弃了带有图表、按钮和迷你应用程序的交互式UI的文本输出,首先出现在The Decoder上。

  48. AWS ML Blog 海外官方 快照

    在AWS上介绍Claude Haiku 5.5

    Claude Haiku 5.5现已在Amazon Bedrock和AWS上的Claude Platform上提供。根据Anthropic的说法,它是Claude 5.5家族中最快,最高效的模型,专为子代理和大批量,成本敏感的工作而构建,并且在大多数任务中,成本比Claude Haiku 4.5低75%左右。这篇文章介绍了它的改进以及如何开始。

  49. The Verge 国际媒体 快照

    看来.Agent和.agi即将成为热门新域名

    多年来,互联网名称和号码管理公司(更广为人知的是ICANN)首次接受新顶级域名的申请。这些是所有URL末尾的后缀,您可能会将它们称为.com、.org和. pizza等。ICANN刚刚公布了1,615份申请[.]

  50. NVIDIA AI Blog 海外官方 快照

    英伟达、微软借助RTX Spark和AI代理开启Windows PC的新起点

    周三,在旧金山举行的微软活动上,英伟达创始人兼首席执行官Jensen Huang和微软首席执行官Satya Nadella概述了英伟达和微软如何共同开发人工智能代理在Windows PC上运行的硬件和软件。黄说,英伟达是因为Windows而成立的。现在人工智能代理正在登陆Windows。“如果你[.]

  51. The Verge 国际媒体 快照

    微软Surface Laptop Ultra活动上宣布的一切

    微软刚刚在旧金山结束了一场以Windows和Surface为重点的大型主题演讲。最大的公告可以说是Surface Laptop Ultra的发布细节,这是一款由Nvidia RTX Spark Arm芯片提供支持的新型笔记本电脑。该机器的起价为2,599美元,配置8核中央处理器、24 GB RAM和512 GB [.]

  52. MarkTechPost 国际媒体 快照

    Liquid AI发布开放重量d1-3B和d1-omni-600 M:零输出代币的多模式决策模型

    Liquid AI发布了Open d1,这是其d1决策模型家族中的两个开权多模式模型。d1-3B读取文本和图像。d1-omni-600 M读取带有图像的文本或带有音频的文本。两个模型都不写文本。每个都在一次向前传递中返回经过校准、输入的答案,输出令牌为零。目标是[.]上的实时决策帖子Liquid AI发布Open-Weight d1-3B和d1-omni-600 M:零输出令牌的多模式决策模型首次出现在MarkTechPost上。

  53. BestBlogs·AI 高分精选 BestBlogs 精选 中文

    GPT-6 与智能界面正式登陆 ChatGPT

    📌 One-Sentence Summary OpenAI 宣布在 ChatGPT 中全面推出 GPT-6 及「智能界面」(Intelligent UI),重点优化视觉化回答与交互工具体验。 📝 Summary OpenAI 已开始向所有 ChatGPT 用户推送 GPT-6,并同步上线名为「智能界面」的新功能。此次更新旨在为日常问题提供更快速、更具视觉感的响应,并通过按需出现的交互式元素简化复杂话题的理解过程。 📊 Article M

  54. The Verge 国际媒体 快照

    微软将赋予Copilot对Windows和您的文件更多控制权

    在今天的Windows和Surface活动上,微软展示了对其Copilot AI系统的升级,该系统将使其访问PC上的本地文件,并能够在整个操作系统中采取行动。这是微软称之为“混合智能”想法的一部分,其中应用程序和工具依赖于[..]的混合

  55. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    永不回头:从以自我为中心的视频中了解3D对象记忆的持久性

    作者:Shravan Chaudhari,William Paul,Suchi Saria|当我们在世界中行走并执行日常任务时,我们遇到的对象可能只有在以后才变得相关。我们能够回忆起我们把东西放在哪里或容器内的东西,即使不知道我们以后会需要它。在这里,我们研究了实体助理如何通过观察一个人的日常活动,从以自我为中心的视频中建立类似的记忆。我们介绍莱德

  56. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    RL VR中探索与优化脱钩

    作者:Saif Punjwani、Micah Goldblum|现代语言模型在已经训练的检查点之上进行具有可验证奖励(WLVR)的强化学习。WLVR的一个关键承诺是发现新的推理策略。原则上,模型可以对其之前训练数据中缺失的新颖想法进行采样。然而,在实践中,通过强大的新颖性激励来增强WLVR的成功有限,并且可能会降低模型质量。B

  57. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    EngramEdit:通过条件记忆在LLM中脱钩知识更新

    作者:蔡红如、然伟、王文杰|DeepSeek Engram等条件存储器架构使用输入n-gram来查找学习到的嵌入,以有限的额外计算扩展大型语言模型(LLM)的容量。除了模型扩展之外,该架构还展示了将事实知识存储与通用计算脱钩的潜力,为更新事实知识提供了一种有希望的途径

  58. The Decoder 国际媒体 快照

    扎克伯格的Biohub领导了一项18亿美元的推动,以建立预测细胞行为的AI模型

    由马克·扎克伯格和普里西拉·陈支持的研究组织Biohub正在协调一项价值18亿美元的计划,以训练预测细胞行为的人工智能模型。Meta、Google DeepMind、Isomorphic Labs和美国能源部正在为数据、实验室设备和计算提供资金。第一个数据集应该在大约一年内准备就绪。扎克伯格的Biohub领导了一项18亿美元的努力,以建立预测细胞行为的人工智能模型的文章首先发表在The Decoder上。

  59. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    Long-WAM:扩展世界行动模型的背景

    作者:黄伟、张博汉、刘晨志|实时机器人控制需要足够的视觉历史来推断运动和任务进度,但处理该历史可能会延迟行动。我们提出了Long-WAM,这是一个模型系统框架,用于在实时控制约束下扩展因果世界行为模型的上下文。我们的中心发现是,获取历史与使用历史不同:当视频被发现时,更长的历史会带来更大的回报

  60. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    重尾噪音下的分散式新元:最佳收敛率和梯度剪辑的作用

    作者:Aleksandar Armacki,Haoyuan Cai,Ali H. Sayed|重尾噪声在现代机器学习中被广泛观察到,这激发了梯度裁剪和归一化等方法的使用。虽然这些方法在集中式环境中得到了很好的理解,但在分散式环境中人们所知的要少得多,在分散式环境中对局部梯度应用非线性会影响优化和共识。最近关于去中心非凸优化的工作已经

  61. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    行动前重述:视觉-语言-行动模型中的语言敏感性特征和缓解

    作者:Mikey Watts、Yenson Cui|视觉语言动作模型(VGA)对指令措辞极其敏感,并且不会继承其所基于的视觉语言模型的语言稳健性。一个词的编辑可以将成功提升数十个百分点:$pi_{0.5}$在“打开炉子”时100%的时间打开LIBERO炉子,在“打开热盘”时2%的时间打开,和一个经过重新短语修饰的$pi_0$检查点a

  62. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    提炼图形几何:从GNN到MLP的知识差距

    作者:陈哲伟、朱浩、江娇|GNN到MLP的蒸馏旨在保留消息传递教师的预测准确性,同时在推理时部署无图形的MLP。现有的方法主要传输节点预测或使用基于置信度的重新加权,但它们没有指定学生应该在哪里保存教师的图形诱导几何。我们表明,这种遗漏会导致stu中的两种光谱失效模式

  63. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    为什么只遗忘的遗忘需要小型化

    作者:Luka Radić、Vikrant Singhal、Amartya Sanyal|机器取消学习要求删除算法,其输出接近于从头开始重新训练,而无需选择的忘记示例。在这项工作中,我们研究了仅遗忘取消学习,其中删除算法仅接收训练后的模型和要忘记的示例,没有保留数据或额外的训练信息。我们问只遗忘的遗忘是否总是可能的。我们首先展示

  64. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    RoboJEPA:扩展机器人潜在世界模型

    作者:Artem Zolus、Nicolas Belran-Velez、袁建浩|潜在世界模型已经显示出预测未来状态和在现实世界中进行规划的非凡能力。然而,在实践中,我们缺乏一种原则性的方法来估计他们的能力如何随着模型大小、数据和计算而扩展,这是一个悬而未决的问题,会减缓该领域的进展。在这项工作中,我们介绍了RoboJEPA,这是一个基于联合嵌入预测架构(JEPA)和traine的世界模型

  65. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    ENSO SciExam:人工智能代理可以构建气候模型吗?

    作者:张银玲、刘朗晨、秀东宾|数字模型代理人越来越多地被要求进行开放式科学研究,但他们的结果通常根据已知答案、标题或语言模型评论员进行评分,而这些都无法判断新的科学模型是否有效。厄尔尼诺-南方涛动人工智能科学考试(ENSO的SciExam)是一个基准,其中智能体构建ENSO的低级随机模型,

  66. The Decoder 国际媒体 快照

    谷歌表示,随着检测器公开,现在有1800亿张图像和视频携带SynthID水印

    谷歌的人工智能水印检测器SynthID现已公开。任何人都可以检查图像、视频或音频是否是由谷歌人工智能或OpenAI和Nvidia等合作伙伴创建的。超过1800亿条内容已经带有水印,但该工具仅识别带有SynthID标签的内容,而不是一般人工智能生成的媒体。谷歌称,随着检测器上市,1800亿张图像和视频现在携带SynthID水印,该文章首先出现在The Decoder上。

  67. Microsoft Research 海外官方 快照

    Agent Lightning v1.0:一个3,500行轻量级抽象RL框架,用于培训使用真实装备的Agent

    用强化学习训练人工智能代理可能具有挑战性,因为它们的工具、上下文和决策都是由复杂的框架管理的。Agent Lightning将现有代理与RL培训连接起来,使其更容易改进,而无需重建它们。Agent Lightning v1.0:用于训练带真实装备的代理的3,500行轻量级抽象RL框架首次出现在Microsoft Research上。