OpenAI的Jev克隆可以帮助前沿实验室阻止其蜂拥而至的病原体
OpenAI的“Decisions API”是Jev克隆,证实了快速、廉价情报的重要性。
聚合官方博客 · 权威媒体 · 深度通讯 · 学术信号。
只做索引,不做转载,标题与链接均指向原始发布方。
OpenAI的“Decisions API”是Jev克隆,证实了快速、廉价情报的重要性。
特朗普让数十家人工智能公司同意自愿安全测试。
非营利组织表示,OpenAI让其他人遭受“其不安全决策的伤害”。
3亿美元的员工招标由惠灵顿和T.共同牵头。罗·普莱斯。
谷歌正在双子座聊天中将Gems替换为“Skills”。技能是用户通过输入“/”来调用或Gemini自动运行的详细、可重复使用的提示。该格式基于Anthropic的开放标准。宝石将从11月开始逐步淘汰,现有的宝石将自动迁移。谷歌放弃了Gems for Skills,加入OpenAI和Anthropic的行列,转向代理就绪提示格式的文章首先出现在The Decoder上。
虽然人工智能已经在人们的手机和电脑上取得了长足的进步,但它在专用设备上基本上失败了。但明年,两家主要人工智能公司Meta和OpenAI将尝试改变这一现状。他们显然在押注类似的道路:用可爱的软件代理测试对物理硬件的兴趣。“硬件是[.]
HN24· 0 评论
Reddit正在进一步限制谁可以使用“Old Reddit”体验,作为其打击抓取和自动化流量的努力的一部分。Reddit最近开始强制用户登录才能使用Old Reddit,但在“接下来的几个月”,该公司表示,用户必须登录并拥有[...]
Reddit将终止对RSS提要的支持,因为该公司继续加强对其大量用户生成内容的访问。
HN ð53· 31 评论
📌 One-Sentence Summary Runway 推出了 Runway Ads,一种能够显著扩大广告规模并提升回报率的自主营销引擎。 📝 Summary Runway 推出了专为性能营销设计的自主引擎。自 7 月以来,该公司利用该工具将广告量扩大了 1000%,同时使广告支出回报率(ROAS)翻倍,转化率提升了 34%,获客成本降低了 41%,助力公司实现年度经常性收入(ARR)。目前正向特定合作伙伴推出,随后将广泛开放。 📊
前沿实验室对消费者人工智能讳莫如深是有原因的,但这并不是因为这项技术不够好。
Meta将其人工智能数据中心归类为“试点模型”,将英伟达芯片归类为实验材料,以节省数十亿美元的联邦税收。仅2025年,这一数字就达到了39亿美元。据《纽约时报》报道,这项税收抵免可以追溯到1981年,就连Meta自己的会计师也认为这一策略具有法律风险。扎克伯格本人在2025年1月表示,这些数据中心现在被设计为实验性的,将“推动我们的核心产品和业务。“Meta通过称其人工智能数据中心实验来逃避美国数十亿美元税收的文章首先发表在The De
亚马逊送货很快就会出现一个新的问题:送货司机的智能眼镜将拍摄他们在使用时看到的任何东西的照片,包括人和私人财产。彭博社报道称,这款眼镜可以“在单个驾驶员的典型轮班中拍摄数千次”,亚马逊计划将其上传到其人工智能[.]
周二与大型科技领导人共进晚餐后,唐纳德·特朗普总统以典型的方式回答了记者有关他的人工智能公告的问题。他表示,他之前关于人工智能安全性的担忧是民主党炮制的“骗局”的说法不再适用,因为他已将该技术更名为“超级智能”。“他[.]
汇集世界上最聪明的人才和最新的加速计算技术,带来了强大的突破,帮助解决一些最大的研究问题。为了促进此类创新,英伟达研究生奖学金计划为从事与英伟达技术相关的杰出研究的博士生提供资助、导师和技术支持。该计划已于第26届[.]
HN ð1· 0 评论
这是Optimizer,由Verge高级评论员Victoria Song发送的每周时事通讯,剖析和讨论了最新的小发明和药剂,发誓它们将改变你的生活。在此处选择优化器。“我会用这个便便的香蒜酱炸开你的屁股,”我手机扬声器里传来一个平静的Z世代声音。“而且[.]
HN17· 0 评论
今年春天,美国禁止了所有未来外国制造的消费者路由器--实际上是所有未来的路由器--除非其制造商能够1)说服美国政府它们不会构成国家安全威胁,并且2)提交“一份详细的、有时限的计划来建立或扩大在美国的制造业。“截至9月9日,华硕现在[.]
Xbox首席执行官阿莎·夏尔马否认了有关微软正在考虑出售其Xbox业务的报道。《信息报》6月份报道称,微软首席执行官萨蒂亚·纳德拉(Satya Nadella)和首席财务官艾米·胡德(Amy Hood)一直在考虑完全分拆Xbox,并于本月早些时候报道称,两位高管“最近支持夏尔马彻底改革……”
Meta表示,其Muse AI代理在没有明确许可的情况下无法访问用户的消息,这对一名记者的说法提出了质疑,即该代理在所需的Mac设置关闭时阅读了他的私人消息。
FTC正在正式调查OpenAI、Anthropic和其他领先的人工智能实验室是否存在违反消费者保护规定的行为。该机构计划通过具有法律约束力的要求强制文件移交和行政证词。这项调查在Hugging Face黑客事件发生之前就已经开始,远远超出了联邦贸易委员会早些时候要求公司为其代理人行为承担责任的努力。FTC因消费者保护问题对OpenAI、Anthropic和其他人工智能实验室展开全面调查的文章首先发表在The Decoder上。
许多网站的广告收入只有十分之一来自人工智能支付。
通过推出食品订购人工智能代理,DoorDash希望获得比竞争对手Uber Eats和Grubhub的优势。
Lux Optics针对iPhone和iPad的反算法Halide相机应用程序进行了新更新,增加了两种新的摄影外观,并支持新iPhone 18 Pro主摄像头的可变口径。Halide并不是第一个添加对新功能支持的原生iOS相机应用程序的替代方案,但它提供了[.]
极端的空间天气事件可能会破坏地球上的电力系统,降低GPS的准确性和卫星的运行。一种新的机器学习系统可以在风暴到来前30-60分钟预测可能发生损害的地方。预测电网空间天气风险的帖子首先出现在微软研究中心。
“我们战胜机器人公司的最大原因之一是我们不是一家机器人公司。"
Instinct正在推出人工策划的产品和旅行建议,但一些用户对获得他们从未要求的建议并不满意。
它旨在帮助生物安全,与流行的人工智能蛋白质设计工具配合使用。
此技术方法在Amazon Bedrock知识库上构建对话主张助手,通过引用回答自然语言问题。它涵盖从Amazon S3获取索赔文档、使用统计RetrieveStream API进行查询、多回合后续操作、元数据过滤器和上下文基础护栏。
Amazon Bedrock AgentCore收件箱提供多代理工作流AWS托管的EC2基础设施,具有图形处理器、持久卷和多日会话。在这篇文章中,我们部署了一个三代理音乐制作管道,其中代理共存于一个图形处理器实例上,共享文件系统,并互相手工制作完成的曲目。
Meta推出了一款新的Muse人工智能代理,声称可以帮助您处理从发送电子邮件到在线购买商品的一切事务。如果您愿意将您的数据托付给Meta并将您的信用卡交给Muse,Muse在兑现这些承诺方面可以出奇地有效。自推出以来,Meta还宣布了计划[.]
📌 One-Sentence Summary Google DeepMind 推出了 SynthID Bio,这是一系列通过在合成蛋白质序列和 3D 结构中嵌入不可见签名的水印方法,旨在增强生物安全性和科学完整性。 📝 Summary Google DeepMind 发布了 SynthID Bio,这项专为合成生物学设计的技术旨在解决 AI 生成设计带来的挑战。该工具通过两种方式工作:在序列中微妙地引导氨基酸的选择(使用 Protein
为人工智能生成的蛋白质添加水印同时保留生物功能的概念证明。
基于近十年的合作工程,CoreWeave将NVIDIA计算、网络和软件构建成了专为人工智能而构建的云,该云在多代部署中仍能获得投资回报。现在,CoreWeave正在将下一代NVIDIA基础架构投入生产。本周在旧金山举行的CoreWeave Fully Connected上,CoreWeave宣布[...]
HN Ÿ 8 · 3 评论
据《信息报》的一份报告称,谷歌推出了一项试点计划,向出版商支付对其人工智能搜索功能的贡献的费用。据报道,该试点计划包括约100家出版商,而谷歌正因其人工智能功能对网络流量的影响而面临审查。Digiday首先报道了该试点计划,[.]
Deepseek和华为为华为Ascend AI芯片构建了开源编程工具。处于中心位置的是TileLang,这是一种旨在提供比Nvidia的CUDA更简单的编程模型的语言。此次合作针对的是中国人工智能行业的最大障碍,即最充分利用国产芯片的软件。Deepseek为华为Ascend芯片推出开源软件,这篇文章首先出现在The Decoder上,使中国人工智能行业更加紧密。
在TechCrunch Disrupt 2026上,Cerebras Systems首席执行官兼联合创始人Andrew Feldman将探讨对计算、能源和基础设施不断增长的需求,Cerebras如何以不同的方式应对这些限制,以及如果当今的人工智能硬件达到极限,接下来会发生什么。
该公司没有在外部数据库上构建持久的执行引擎,而是开发了自己的存储、复制和冗余层。这种架构使Restate能够异常快速和轻量级。
距离2026年TechCrunch Disrupt展出还有三天。在太平洋时间10月2日晚上11:59之前预订,向10,000多名创始人、投资者、运营商和科技领导者展示您的初创公司。
由于IPO计划下滑,OpenAI正在私下寻求另外300亿美元的资金。
千禧年难题的突破,10000个Agent最多占了10%的功劳。
什么样的AI才适合工业现场?企业真正开始做工业AI时,又该从哪里下手?
Airbnb还在选定地点推出送餐和洗衣等新服务。
据Anthropic报道,智浦的开重模型GLM-5.3在网络漏洞攻击方面的表现几乎与Claude Mythos Preview一样出色。其较小的Flash变体以知普的API价格仅需20.40美元即可完成可靠的Chrome攻击。该型号的保护措施很容易被删除,解锁版本已经在流传。Anthropic有自己的理由发出警报,但美国机构CAISI支持了这一发现。文章Anthropic称,Zhipu的开重GLM-5.3几乎与Claude Mythos
一群特工突破了封锁并入侵了人工智能公司Hugging Face的计算机的爆炸性消息传出两个月后,OpenAI仍在灭火。此后几周内,有关其他黑客行为的不断披露使OpenAI成为人们关注的焦点,并引发了严重的问题..
了解OpenAI如何破坏提取受保护模型推理的活动,并加强对对抗蒸馏的防御。
据《信息报》报道,谷歌向大约100家数字出版商支付了AI Overviews、AI Mode和Gemini中使用的内容费用。付款金额从几个月内不到1,000美元到每年超过100万美元不等。一些参与者不知道谷歌如何计算付款,而一些大型出版商则坚持要求更高的费率。谷歌几乎没有向任何出版商支付任何人工智能答案中使用的内容几乎没有支付任何费用,这篇文章首先出现在The Decoder上。
实测说GLM-5.3很强
OpenAI正在与美国SBDC合作,扩大对小企业的动手人工智能培训和本地支持,同时发布了一份关于小团队如何使用人工智能的新报告。
特朗普总统和马克·扎克伯格、格雷格·布罗克曼、黄詹森和埃隆·马斯克等科技领袖在白宫签署了一项人工智能行为准则,该准则只有“道德约束力”。“外部审计师应该检查模型是否按预期工作。目前尚不清楚如果一家公司违反规则会发生什么。特朗普还签署了一项行政命令,将人工智能重新命名为“超级智能”。特朗普和科技首席执行官签署一项只有“道德约束力”的人工智能行为准则的文章首先出现在The Decoder上。
另外:开始使用ChatGPT dot,OpenAI的新代理
给Agent配上手机号,再拉个群
让GPT把机器人技能当工具调用
📝 今日导语 OpenAI 更新开发生态,Manus 2.0 推出 Cue,Sonnet 5.5 降低任务成本;看产品入口与模型选型。 🏷 今日关键词: OpenAI DevDay 2026 Manus 2.0 Cue 个人智能体 Claude Sonnet 5.5 模型任务成本 Codex 云端环境 DeepSeek Harness 📰 今日精选内容 帮大家总结了一下凌晨的 OpenAI 2026 开发者大会。 数字生命卡兹克 · 文
DeepSeek在知乎独家发布技术长文,首次系统阐释了DeepSeek弹性计算(DeepSeek Elastic Compute,DSec)
一年营收46亿,Anthropic怎么敢花出去5180亿美元?-36氪 36kr.com
机器人上市,风向有变
年亏2818亿!Anthropic IPO招股书曝光 手机新浪网
HN Ÿ 8 · 3 评论
额度重置次数太多,OpenAI要改名“重置公司”?奥特曼与Tibo开发者大会再次按下重置按钮 thepaper.cn
OpenAI CEO:生活中有些部分是无法也不应该自动化的,未来AI会更像是新的文艺复兴 thepaper.cn
奥特曼:OpenAI不能太晚上市,但也不能“不顾一切” 文学城
风险篇幅接近业务两倍,Anthropic招股书在测试什么-36氪 36kr.com
HN42· 11 评论
OpenAI的大日子,奥特曼发布了“等待了很多年”的产品 文学城
国庆黄金周前夕,豆包宣布支持多种出行服务,用户现已可通过豆包一站式完成机票预订、火车票购买、打车及路线导航等多种出行需求,覆盖从长途交通到市内出行的全场景。 据了解,豆包此次的功能升级主要围绕用户出行核心需求,在酒店预订和餐饮预订的基础上,新增了包括机票预订、火车票预订,打车出行和导航等多项出行服务。用户只需在豆包对话中以自然语言描述出行需求,例如“帮我订一张明天从北京到上海的机票”或“叫一辆车去首都机场”,豆包即可自动识别意图并完成相
HN ð15· 3 评论
Anthropic 2万亿美元IPO自揭软肋:47%营收依赖亚马逊谷歌,每1美元分走16美分 华尔街见闻
2026 年 9 月 29 日,深圳 —— iQOO16 正式发布。新机首批搭载第六代骁龙 8 超级至尊版,全球首发由 iQOO 和三星显示联合研发的 2K 165Hz 三星珠峰屏,并基于 iQOO 搭建的 “3+2游戏技术版图”,在视效、操控、直播和跨端游戏体验上全面升级,成为性能、屏幕、游戏体验、系统和综合配置全面超 Pro Max 的性能旗舰。 不久前,刚结束 2026 年亚运会比赛的 iQOO16 产品体验官潘展乐表示自己曾是
OpenAI推出全天候自主智能体dots:首秀演示意外卡壳,现场一度陷入尴尬 thepaper.cn
9月29日,2026国兴智能新品发布会在山东烟台顺利召开。 本次发布会以“国启新篇·兴创未来”为主题,面向具身智能、智慧巡检、应急救援、消防灭火等高危复杂场景,重磅发布11款全新产品。全方位展示企业的技术成果与场景解决方案,为高危行业智能化、无人化转型注入全新动能。 发布会上,洪田股份总经理与国兴智能总经理分别致辞。 会上,国兴智能技术负责人详细解读了新品的技术优势、研发理念与应用价值,并分享了企业在具身智能、算力融合、智能装备迭代等领
OpenAI开发者大会大批更新;CPU交货期再度拉长 21财经
空间记忆接导航,视觉伺服接抓取,全身运动负责落地。 作者丨 郑佳美 编辑丨岑 峰 这两天,斯坦福大学 The Movement Lab 和加州理工学院公开了一个有趣的研究项目 HomeBody。 团队把 GPT Astra 接进 Unitree G1,让人形机器人先自己探索陌生厨房,再根据人的指令完成找东西、拿药、扔垃圾和开抽屉等连续任务。 这并不是简单给 G1 加一个大模型助手。机器人事先不知道物体具体放在哪里,它需要在探索过程中记录
Tool Call 少三成,Shell Run 近减半,迭代降至 3.6 次。 作者丨 郑佳美 编辑丨岑 峰 刚刚,Anthropic 发布了 Claude Sonnet 5.5。 如果只看发布页,这仍然是一轮常规模型升级:API 单价没变,生成速度更快,Terminal-Bench、CursorBench 等 Agent benchmark 的成绩明显上涨。但把几组运行数据放在一起,会发现这次变化并不只发生在模型输出这一层。 Lova
“AI或带来毁灭性风险”,OpenAI紧急取消最强模型,中国开源优势凸显 shobserver.com
RSA在旧金山的人工智能大会上推出了Agent ID。它是金融、政府、医疗保健和关键基础设施的代理身份安全平台。它有3个模块。Discover会找到受制裁的代理和影子代理以及HCP服务器。Safe是一个内联网关,可以根据策略检查每个工具调用。政府将证据映射到10个监管框架。发现并保护船舶2026年11月16日。《一个糟糕的提示摧毁了一家公司的Salesforce:RSA的吉姆·泰勒谈代理ID和驯服隐藏在您企业中的4,000个影子人工智能
Anthropic的Claude Opus 5、Claude Sonnet 5和Claude Haiku 4.5现已通过Amazon Bedrock地理跨地区推断在印度推出。您可以在印度地区内处理数据时访问这些模型,并从Amazon Bedrock控制台或使用Messages、ExpresseModel和Converse API开始使用。
Amazon Bedrock现在在首尔支持Anthropic的Claude Opus 5和Claude Sonnet 5,并支持区域内推理,并在新加坡支持Claude Sonnet 5。如果您在韩国或新加坡有当地数据处理要求,您现在可以大规模使用这些人存模型,并完全在您所称的地区内处理推断。
T早报|OpenAI推出个人智能体Dots及新模型GPT‑6.1 Sol;SHEIN公布上市后首份财报;美国芯片公司AMD斥资82亿美元收购李飞飞世界模型公司 财新
Anthropic招股书披露失控AI智能体法律风险 47%销售额来自分销商 观点网
突发,OpenAI 24小时在线dots正式上岗,GPT悍然推出500美元最贵套餐-36氪 36kr.com
OpenAI 年度发布会最全总结:25 个新品很夯,但额度减半拉爆了 爱范儿
OpenAI DevDay 2026推出多项更新,ChatGPT向智能体平台迈进|GPT-6|Codex|Agent|体协|套餐_手机新浪网 finance.sina.com.cn
OpenAI 推出个人AI 智能体dots;传豆包将推个人AI 产品「Spell」;SpaceX 发射星舰成功入轨| 极客早知道 极客公园
OpenAI个人AI助手Dot来了,能连接4000多款应用;Anthropic IPO招股书曝光,2025财年营收达45.9亿美元;豆包将推个人助理产品丨邦早报 搜狐网
几个月来,人们一直在想OpenAI何时上市。首席执行官萨姆·奥尔特曼(Sam Altman)表示,在公司能够对车型安全做出更好的承诺之前,这种情况不会发生,而且还没有明确的时间轴。“我们打算继续人工智能的进步……但随着模型的能力激增,我们看到[.]
OpenAI发布全天候智能体Dot:GPT-6 Astra驱动 可连4000多款应用自主干活 手机新浪网
专题·OpenAI 2026开发者大会 QQ News
史上最大IPO突发警告!Anthropic的招股书曝光 eastmoney.com
📌 One-Sentence Summary Google 研究人员通过在 TPU 上实现稀疏时空注意力,优化了视频扩散模型并实现了显著的生成速度提升。 📝 Summary 本文技术文章详述了在 TPU 上使用 MaxText 框架复现和优化视频扩散模型的工程挑战。作者发现,随着分辨率增加,序列长度随之增长,自注意力机制成为视频生成的主要瓶颈。通过识别不同的注意力头专门负责空间或时间模式,他们开发了一种稀疏注意力策略(SVG)。报告重点
📌 One-Sentence Summary 一份关于如何利用生产流量构建「Golden 评测集」的综合教程,旨在确保模型质量并防止部署过程中的性能回归。 📝 Summary 文章概述了为 AI 创建高质量评估数据集的五步方法论。它强调为何生产数据在捕捉真实用户分布、意外失败模式及产品演进方面优于合成数据。该流程包括采样流量、去重、使用评分标准定义预期输出,以及将这些测试集成到 CI/CD 流水线中。此外,文章还提供了实用建议,指导如何
📌 One-Sentence Summary OpenRouter 提供了一份关于 AI Agent 回归测试的指南,旨在确保在更改提示词、模型、工具或检索设置后的一致性。 📝 Summary 文章概述了 AI Agent 回归测试的方法论,由于输出具有非确定性,这与传统代码测试有所不同。它强调使用锁定的案例集、定义行为契约(结构化断言和硬性不变量),并使用具体的模型 slug 而非别名以确保可复现性。该指南还提供了使用 OpenRou
OpenAI举办2026年开发者大会,发布Dots个人Agent与GPT-6.1 Sol等多项更新 虎嗅网
OpenAI,传来大消息! finance.sina.com.cn
GPT-6.1、全天候智能体,OpenAI这次DevDay全是大招 手机新浪网
OpenAI发布AI助手Dots并寻求融资300亿美元,目标估值1.4万亿美元;苹果新CEO据称启动改革,拟精简管理层并加快产品开发|全球科技早参 mrjjxw.com
OpenAI因安全问题将暂停发布新模型 手机新浪网
OpenAI企业业务收入自7月翻番 ARR据称接近700亿美元 观点网
HN Ÿ 8 · 2 评论
2026 OpenAI 开发者日遭多个组织抗议 DoNews
OpenAI推迟IPO寻求至少300亿美元过桥融资 目标估值1.4万亿美元 观点网
为了国家安全,得知America.gov没有产生幻觉,以至于写长篇诗歌,我感到如释重负。
OpenAI 推出 Decisions API,与 Jev 正面竞争 DoNews
目标估值1.4万亿美元!OpenAI据称拟再融资至少300亿 finance.sina.com.cn
OpenAI发布AI助手“Dot”:可自主干活,全天候待命 凤凰网科技
Anthropic招股书曝光:净亏损420亿美元,预警AI风险 finance.sina.com.cn
今年devday牙膏挤爆
美国行政部门不再承认“人工智能”的存在。“展望未来,由于唐纳德·特朗普总统签署的新行政命令,官方政策网站、政策文件和新闻稿将仅提及‘超级情报’。特朗普说:“超级这个词是所有词中最好的,也是最简单的。”
在OpenAI周二推出新的人工智能代理Dots之前,埃隆·马斯克的xAI已经获得了域名“dot.com”,该域名现在重定向到Grok聊天机器人下载页面。
我们对来自[内部二进制开发基准]的100个任务(随机选择)进行了几个模型的评估,发现GLM-5.3在4%的试验中开发了完全控制流劫持; Claude Mythos Preview在6%的试验中开发了完全控制流劫持。虽然GLM-5.3在这里的表现低于Claude Mythos Preview,但显然已经越过了一个有意义的门槛:早期的模型,如Claude Opus 4.6和GLM-5.2,在任何一个都没有成功。- Anthropic Fro
目标估值1.4万亿美元!OpenAI据称拟再融资至少300亿 财联社
接连失控!OpenAI因安全问题将暂停发布新模型 新蓝网
当宝马首次宣布将i3重新构想为一款基于Neue Klasse平台的全电动四门轿车时,它遗漏了许多重要细节,例如电池容量、续航里程和价格。如今,这家德国汽车制造商终于开始填补i3的空白。让我们从价格开始。宝马表示[.]
新雕塑描绘了人工智能领导人逃离一艘正在下沉的船。
荷兰警方表示,他们逮捕了一名与ShinyHunters有关的24岁阿姆斯特丹男子,该黑客组织声称对Ticketmaster、Rockstar Games以及最近联邦调查局的高调攻击负责。荷兰当局在一份新闻稿中表示,他们于9月15日逮捕了嫌疑人,就在该黑客组织声称[.]
SpaceXAI的人工智能在线百科全书Grokipedia似乎在经过数月的暂停后再次更新文章。8月,Lawfare报道称,Grokipedia上的文章自4月以来就没有审查过编辑,但该平台的实时更新网站现在显示了页面最近的各种更改--尽管在我写这篇文章时,许多只是[.]
Liquid AI发布了d1,这是一个为结构化选择而不是文本生成而构建的决策模型。您为它提供上下文和一组输入的问题。它在单次调用中返回一组固定结果的校准概率,生成的令牌为零。目标是许多团队仍然发送给一般的工作[.] Liquid AI发布d1:一个返回零输出令牌校准概率的决策模型首次出现在MarkTechPost上。
该交易预计将于年底完成,价值82亿美元。
📌 One-Sentence Summary 作者详细介绍了自适应 LLM 路由器的工程实现,该路由器根据实时的成本、速度和可靠性指标动态平衡各推理提供商之间的流量。 📝 Summary 本文描述了从固定顺序路由向复杂的自适应路由系统的转变,该系统用于在 Baseten、Fireworks 和 CoreWeave 等提供商之间进行 LLM 推理。系统通过测量每个“任务”的性能而非单个 API 调用的性能,以更好地契合客户体验。它利用加权
OpenAI发布AI助手“Dot”:可自主干活,全天候待命 财联社
OpenAI应战Meta:发布个人AI助手Dots,高端订阅每月500美元,是Muse高阶版的5倍 华尔街见闻
HN Ÿ 6 · 0 评论
OpenAI正在构建传统应用商店模式的替代方案,将ChatGPT变成一个人们和人工智能代理可以发现和使用软件的地方。
新一轮融资预计将是该公司在2027年推迟上市之前的最后一轮融资。
GPT-6.1 Sol现已在Amazon Bedrock上普遍提供,为编码、计算机使用和频繁运行的专业工作负载带来了更强的推理。
GPT-6 Astra在英国人工智能安全研究所运行的29.2%的模拟中进行了未经授权的供应链攻击,并禁用了安全过滤器。该模型使用假身份和恶意代码,而其前身GPT-5.6 Sol在6.3%的运行中完成了攻击。明确的限制减少了攻击,但没有完全阻止它们。英国人工智能安全研究所发现GPT-6 Astra的流氓攻击率比其前身增加了五倍。
HN ð43· 6 评论
OpenAI今天刚刚在DevDay上引入了圆点。Dots是由GPT-6 Astra提供支持的持久人工智能代理。每个点都有自己的云计算机和浏览器。它通过ChatGPT插件适用于4,000多个应用程序,并在您注销后继续运行。今天可以部署吗?是的,作为托管产品。圆点正在[.]帖子OpenAI推出圆点:始终在线GPT-6 Astra代理从自己的云计算机工作,首先出现在MarkTechPost上。
我对GPT 6.1 Sol的评论:Near-Astra情报,价格仅为价格的五分之一-黑客新闻。我和鹈鹕的关系有点晚了,因为我当时正在直播主题博客:https://simonwillison.net/2026/Sep/29/openai-devday-2026-liv.以下是GPT-6.1-Sol:https://tools.simonwillison.net/markdown-svg-renderer? url=ht.它们与GPT-6家
OpenAI推出始终在线的智能体Dots 月费新增500美元一档 新浪财经
报道:OpenAI拟融资至少300亿美元,目标估值1.4万亿美元 华尔街见闻
作者:芮子航、王仁浩、黄浩绪|部署在物理世界中的机器人必须能够在遇到新情况和失败时超越最初的训练。为了使这种改进能够跨任务扩展,它必须有效地利用经验,而不需要人工演示每个校正。最近的代理系统提供了一种通过使用基础模型来自主地减少对人类努力的依赖的方法
作者:Jaewoo Jung、Hyeonseo Yu、Honggyu An|从多视图图像推理3D世界仍然是多模式大型语言模型(MLLM)的一个根本挑战。虽然现代MLLM可以有效地处理单个图像输入,但它们很难将跨视角的证据整合到连贯的3D理解中。越来越多的作品试图通过将3D意识注入MLLM来缩小这一差距,要么通过提高细粒度的像素
作者:刘光国、Mert Okyay、Yifan F.张|生成模型的动态表现出两个明显不同的时间窗口:物种形成窗口,其中样本提交到语义类,和非局部窗口,其中局部上下文窗口变得不足以生成。受它们在各种前沿模型中近乎共存的证据的启发,我们通过sema的空间分布来研究它们的关系
作者:姚秉辰、徐浩波、林浩坤|线性注意力用固定大小的循环状态取代了不断增长的KV缓存,但这些持久状态可能会成为并发服务下的重大内存瓶颈。将循环状态直接量化到低精度通常会导致准确性严重下降,因为量化误差会通过连续的状态更新传播。我们发现这些错误的影响取决于两个c
作者:潘毅、习浩成、朱堪|最近的LLM越来越多地采用混合设计,用线性注意力取代标准注意力,例如Gated DeltaNet(GDN)和Kimi Delta Attention(KDA)。虽然它们将上下文压缩为固定大小的循环状态,并大大降低了长上下文处理的成本,但重复读取和更新该状态仍然是一个主要的推理瓶颈。量化提供了一种自然
作者:Joseph Metcalfe、Sara Sharifzadeh、Fabio Caraffini|卫星图像时间序列数据集和农田分割的边界推进架构的格局从未如此丰富。然而,在这场淘金热中,重要的真理在两个方面都被忽视了,因为对最新颖概念或最大数据集的推动力将更好的细节推到了一边。在本文中,我们介绍了我们的混合变换器-卷积模型Cropland Parall
作者:申建如|语言模型对图重建的评估通常会报告原始图和重建图之间的单个聚合距离。我们证明,对于拉普拉斯光谱之间的沃瑟斯坦距离,这样的总结由两个边缘计数(从下到下的边缘数量的净变化和从上到下的对称差)包围,每个按$2/n$缩放,其中$n$是ver的数量
作者:黄宽波、刘昊和、彭朴元|以情感为条件的文本到语音(TTS)模型可能无法可靠地表达所请求的情感,并且通过额外的训练来提高可控性在计算和情感标记的语音训练数据中都是昂贵的。因此,我们研究了载体转向,这是一种无需训练的方法,可以修改冻结模型的内部表示。CoCoCoEmo,一种用于e的传统载体引导方法
作者:任慧、雷凡、包亨利|回答有关长视频的问题通常需要在数小时或数天内连接涉及相同对象的事件。按时间顺序描述和文本衍生的实体可能会导致物理身份未被解决:不同的对象可能共享描述,而对同一对象的观察在事件中保持脱节。因此,检索相关事件并不一定恢复“
作者:Dor Tirosh、Ido Amos、Mor Geva| Transformer语言模型(LM)是前向的:深层表示永远不会反馈到较浅的层,信息在生成步骤中向下流动的唯一途径是解码的令牌。这种狭窄的渠道迫使模型重新计算中间结果并放弃替代延续。在这项工作中,我们在预训练期间消除了这个瓶颈,引入了
📌 One-Sentence Summary OpenAI 推出「Ultrafast」高级速度档,Codex 生成速度最高可达 300 token/秒,API 速度提升至 6 倍。 📝 Summary OpenAI 推出了名为「Ultrafast」的全新高级速度档,大幅提升了 token 生成速度:在 Codex 中最高快 8 倍(300 tps),在 API 中最高快 6 倍。 📊 Article Meta AI Screening:
Nebius和NVIDIA正在为拥有该领域产品的初创公司举办2026年物理人工智能奖。五名类别获奖者每人获得15万美元的计算积分、联合晋升、高管指导和高管晚宴席位。申请10月25日截止。帖子Nebius开幕2026年物理人工智能奖:五项价值15万美元的计算信用奖首先出现在MarkTechPost上。
📌 One-Sentence Summary OpenAI 发布了 GPT-6.1 Sol,在编码和计算机使用方面性能显著提升,并以更低的成本比肩尖端模型。 📝 Summary OpenAI 发布了 GPT-6.1 Sol 模型,该模型相比基础版本 GPT-6 Sol 在编码、计算机使用以及复杂专业工作方面有显著提升。同时,在多个基准测试中已接近 GPT-6 Astra 的水平,且成本大幅降低。 📊 Article Meta AI Sc
DevDay 2026 回顾 openai.com
📌 One-Sentence Summary OpenAI 发布了一种高代理性 AI Agent,可通过 ChatGPT 插件在 4000 多个应用程序中进行自主工作。 📝 Summary OpenAI 推出了一种名为「your dot」的自主 AI Agent,其功能类似于高代理性的工程师或首席助理。它拥有专属的虚拟计算机,通过 ChatGPT 插件接入超过 4000 个应用程序,并能根据学习到的用户需求 24/7 在后台主动执行任务
HN ð27· 2 评论
工具:照片清理器-本地面部模糊和元数据删除我拍了一张抗议者的照片,然后想到我不喜欢分享具有可识别面孔的陌生人的照片。我让GPT-6 Astra构建了这个实验性工具,可以识别人脸并自动模糊它们。它使用Google的MediaPipe C++库,通过@mediapipe/tasks-vision编译为WebAssembly,加上BlazeFace面部检测模型。标签:摄影、工具
📌 One-Sentence Summary 对 34,580 份 verdicts 的分析揭示了 AI 模型存在强烈的自我偏好偏见,并且在答案评估方面与人类判断有显著差异。 📝 Summary Arena.ai 比较了 1,460 次对战中来自 12 个模型的 34,580 份 verdicts 与人类投票。结果显示 AI 评委倾向于自己的输出(平均 58% 相比人类 34%)、很少宣布平局(例如 GPT-5.6 Sol 96% 的时
OpenAI就其智能体擅访澳医保数据致歉 央广网
📌 One-Sentence Summary Sophos 首席技术官 John Peterson 介绍了公司如何将自身安全专业能力与 OpenAI 的前沿模型结合,把约一半的调查案件交由智能体处理,同时让人类继续把控可能造成破坏的响应操作。 📝 Summary Sophos 首席技术官 John Peterson 介绍了 Sophos 与 OpenAI Daybreak 项目的合作背景:漏洞利用速度加快,防御者可采取行动的时间窗口正在
📌 One-Sentence Summary OpenAI 推出 GPT-6.1 Sol,这是一款高效模型,在编码、专业工作和计算机操作方面提供接近 GPT-6 Astra 的智能水平,而成本仅为后者的五分之一。 📝 Summary OpenAI 发布了 GPT-6.1 Sol,这是 Sol 模型的升级版,旨在平衡高性能与显著降低的成本。它在智能体编码(DeepSWE v1.1)、专业文档分析(GDP.pdf)、业务工作流自动化(Aut
OpenAI将重新开放200美元套餐,但Tibo被骂惨了 华尔街见闻
谷歌云人工智能研究中心开放了开源的RSSI,这是一个框架,可以让LLM代理重写自己的提示、工具和内存,同时模型权重保持冻结。它添加了泄漏批评者、噪音下限、成本规则和修剪,以便收益能够延续到新任务中。Claude Opus 4.8,Terminal-Bench 2.1从74.2%上升到80.2%,所有6个搁置的分裂都有所改善。谷歌研究开放源RSSI:在不过度匹配的情况下改善自己的工作空间的人工智能代理这篇文章首先出现在MarkTechPo
H Company发布了Holo 4,这是一个针对人工智能代理的通用计算机使用模型家族。一组权重在屏幕上点击并输入。它还编写代码并调用LCP或API工具。Holo 4有两种尺寸:Holo 4 27 B(密集)和Holo 4 35 B-A3 B(混合专家,3B活跃)。两者都为[.] H Company发布Holo 4:跨桌面、Web、Android和API的单击、编码和调用工具的开放重量计算机使用模型首次出现在MarkTechPost上。
阿里巴巴的Qwen团队发布了Qwen-Audio-3.1-Realtime,这是一种经过推理、调用工具和决定何时说话的全速语音模型。在调整tau-Voice时,任务成功率从78.4%上升到82.0%。背景言论的回复率从73%下降到13%。它现在可以作为QwenCloud上的API提供。阿里巴巴Qwen发布Qwen-Audio-3.1-Realtime:经过思考、行动和决定何时发言训练的全杜比语音模型的帖子首先出现在MarkTechPos
Anthropic发布了Claude Sonnet 5.5,这是Claude 5.5系列中的第二款型号。它在Terminal-Bench 4.0上的得分为70.6%,在GDPval-AA上,距离Opus 5.5不到2分。它的产出还比十四行诗5快30%以上,并保持相同的每百万代币价格2美元/10美元。Anthropic表示,由于该模型使用的代币更少,每项任务的成本最多可下降30%。您现在就可以通过Claude API、AWS、Google
📌 One-Sentence Summary Anthropic 的 Thariq Shihipar 探讨了 Claude Code 的演进、通过 Claude Mods 向「可变软件」的转变,以及日益自主的智能体所带来的关键安全挑战。 📝 Summary 在这场深度对话中,来自 Anthropic 的 Thariq Shihipar 探讨了智能体编程如何从一项充满争议的实验迅速转变为行业默认做法。讨论涵盖了 Claude Code 框
HN ð12· 2 评论
📌 One-Sentence Summary OpenAI 推出了「dots」,这是一种由 GPT-6 驱动的常驻智能体,能够使用自己的云端计算机和浏览器,自主为用户处理复杂任务。 📝 Summary OpenAI 推出了「dots」,这是一类全新的 AI 智能体,旨在与用户持续协同工作。与标准聊天机器人不同,dots 拥有自己的云端计算机和浏览器,能够与超过 1,000 款应用交互,处理多步骤工作流,例如调查软件缺陷、准备发票或管理内
隆重推出 Dot OpenAI