unipent如何根据其生产部署的零售审核政策定制Amazon Nova
了解台湾统一企业集团的零售平台unipone如何利用Amazon SageMaker AI的监督微调和即时优化,将Amazon Nova 2 Lite调整为其内容审核政策。与业务相关的评估和发布门保持质量受到控制。
聚合官方博客 · 权威媒体 · 深度通讯 · 学术信号。
只做索引,不做转载,标题与链接均指向原始发布方。
了解台湾统一企业集团的零售平台unipone如何利用Amazon SageMaker AI的监督微调和即时优化,将Amazon Nova 2 Lite调整为其内容审核政策。与业务相关的评估和发布门保持质量受到控制。
Brian Chesky讲述了Airbnb对代理友好、消费者人工智能的现状以及为什么世界需要人工智能原生操作系统。
📝 今日导语 Gemini Argon 推进长程任务,Anthropic 衡量机器人工作,Eleven v4 升级语音:看懂落地取舍。 🏷 今日关键词: Gemini 4 Argon 机器人就业 Eleven v4 发布 Harness AI 研发效能 📰 今日精选内容 Gemini 4 Argon:前沿智能的新阶段 Google DeepMind · 文章 · 评分 93 我们能预测机器人将从事的工作吗? Anthropic Rese
OpenAI开发者大会大批更新;CPU交货期再度拉长 21jingji.com
AI估值分歧加剧!Anthropic IPO:狂热的硅谷喊价2万亿美元,冷静的华尔街只认1.5万亿 华尔街见闻
推出22天下载突破500万!Muse“火爆”超过当年ChatGPT 华尔街见闻
企业AI进入模型分流阶段,中国开放模型吃到美国企业降本红利 虎嗅网
失控事件频发,AI发展需要减速吗 科学网—新闻
HN Ÿ 3 · 0 评论
Anthropic与SpaceX签署最高845亿美元算力协议,可提前90天发通知解除 finance.sina.com.cn
OpenAI发布AI助手“Dot”:可自主干活,全天候待命 财联社
特朗普的“AI自我监管”意味着什么?老黄“大获全胜”,幕后带头质问Anthropic Amodei 华尔街见闻
发布日历的一个奇怪之处是,当Vivo的X Fold 6今年6月在中国推出时,它只是另一款可折叠的产品。现在它已经准备好在全球发布了,但尺寸和长宽比感觉有点过时。X Fold 6与Vivo之前的可折叠产品以及大多数其他[.]
OpenAI、Meta、Manus同时下注,智能体 2.0 来了 潮起网
一年营收46亿,Anthropic怎么敢花出去5180亿美元? thepaper.cn
“大空头”伯里再开炮:市场应狠狠下挫,阻止OpenAI与Anthropic万亿IPO_滚动新闻_财经 证券之星
中国开源模型首次进入OpenAI企业客户采购体系 finance.sina.com.cn
中国大模型首次!Kimi K3进入OpenAI企业付费结算体系 k.sina.com.cn
OpenAI光速上新GPT-6.1 Sol!一晚上25项更新,都在这里了 智源社区
FTC对Anthropic和OpenAI展开调查 华尔街日报中文版
Grokipedia是SpaceXAI与维基百科的人工智能竞争对手,最近开始再次整合编辑内容,今天,作为v0.3更新的一部分,它进行了一些设计调整,包括新的徽标以及更新其主页和实时编辑页面。SpaceXAI设计主管Benji Taylor称其为“新刷新的Grokipedia”。“Grokipedia的旧主页几乎是[.]
失控事件频发,AI发展需要减速吗 中国科技网
新思科技(SNPS.US)携手OpenAI开发芯片设计AI模型,收入分成模式推动股价一度涨7%_全球市场_财经 证券之星
OpenAI推出全天候AI智能体Dots,相关域名已被马斯克拿下 finance.sina.com.cn
谷歌发布了最新的Gemini模型,将其营销为编码和网络安全工作的主力。
Anthropic提交IPO招股书:2025年营收增长12倍 净亏损420亿美元 财联社
派拉蒙将在与华纳兄弟探索频道1100亿美元的合并结束之前任命一位新的联席首席执行官。美泰前董事长兼首席执行官伊农·克雷兹(Ynon Kreiz)将加入派拉蒙,与董事长兼首席执行官大卫·埃里森(David Ellison)一起领导。派拉蒙表示,“埃里森将专注于公司的长期战略、创意愿景和方向,包括其[.]
突发,OpenAI 24小时在线dots正式上岗!GPT悍然推出500美元最贵套餐 智源社区
Gemini 4 Argon是谷歌七个多月来推出的首款前沿型号。它在独立测试中与GPT-6 Astra相匹配,但无法跟上Anthropic的Claude Opus 5.5。每个代币的价格很低,但Argon每个任务消耗的代币数量是Astra的两倍多。选择测试人员首先获得访问权限,随后才获得API和付费层。文章Google Gemini 4 Argon缩小了与OpenAI和Anthropic的差距,但没有明显领先,首先出现在The Deco
我今天参观了纽约市博物馆,并看到了《他建造了这座城市:乔·麦肯的模型》,这是这座城市在21年内用轻木和纸板建造的50 x27英尺的模型。这超出了我已经很高的期望。该展览将于10月12日闭幕,因此如果有机会,您绝对应该优先观看。标签:博物馆,纽约
双子座4氩顶部GPT-6阿斯特拉和克劳德作品5.5在大多数基准,但访问仍然门今天。Google DeepMind推出Gemini 4 Argon,具有100万输出令牌,用于编码,知识工作和网络防御。
OpenAI于2026年9月29日发布了GPT-6.1 Sol,是GPT-6 Sol的升级。它在代理编码、计算机使用和专业工作方面达到了接近Astra的结果,价格仅为Astra代币价格的五分之一。每百万个代币的投入成本为2美元,输出成本为10美元,缓存的投入成本降至0.10美元。它现在可以通过OpenAI API、ChatGPT Work和Codex提供。OpenAI发布GPT-6.1 Sol:Near-Astra编码和计算机使用的价格
Flow Engineering将人工智能代理引入硬件设计,还聘请了Roelof Botha担任天使投资者和董事会成员。
新思科技与OpenAI达成芯片设计AI合作,股价一度涨超7% 华尔街见闻
HN ð79· 42 评论
A24宣布正在制作SCP基金会电影,激怒了互联网上最大的恐怖社区之一,但显然没有费心联系SCP维基团队,也没有承诺按照要求在知识共享许可下发布该电影。看到轻松的公关胜利,Neon正在通过[.]获利
谷歌今天公布了其下一个人工智能前沿模型,称之为Gemini 4 Argon。据首席人工智能架构师兼谷歌DeepMind高级副总裁Koray Kavukcuoglu称,新模型在现实世界的软件工程、法律和金融等企业知识工作以及网络安全防御等复杂工作流中提供了“前沿性能”。但该公司限制访问[…]
📌 One-Sentence Summary Google DeepMind 的 Gemini 4 Argon (High) 以 1525 分登顶 Text Arena,混合成本仅 $8/MToken,在编程、指令遵循、创意写作及所有职业领域均居首位。 📝 Summary Arena.ai 宣布,Gemini 4 Argon (High) 以 1525 分登顶 Text Arena,并以 1679 分位列 Code Arena: Web
六家主要人工智能公司本周与白宫签署了一份自愿协议,誓言实施保障措施。目前尚不清楚这有多重要。
双子座3.5 Pro就到此为止。
HN ð918· 629 评论
📌 One-Sentence Summary Google 宣布 Gemini 4 Argon,一款输出上限达 100 万 token 的 frontier 模型,在 DeepSWE、Vals Index 和 CWE-bench 上的表现居首,将首先通过 Fairwind Program 提供给值得信赖的网络安全防御者。 📝 Summary Google DeepMind 推出 Gemini 4 Argon,这是其下一代 frontie
📌 One-Sentence Summary Google 推出全新前沿模型 Gemini 4 Argon,首先面向网络安全防御人员开放,其推广期价格为每百万输入 token $2,每百万输出 token $10。 📝 Summary Google 推出了其最新的前沿模型 Gemini 4 Argon。该模型从今天起首先向网络安全防御者(cyber defenders)推送,并计划尽快扩大发布范围。公告中明确了推广期间的定价:输入 $2
HN Ÿ 85 · 64 评论
人工智能远非完美的资源。但它的幻觉似乎比肯尼迪少。
OpenAI的Dots和Meta的Muse正在争夺成为您的人工智能代理的选择。这两种方法我都尝试过了--我怀疑你也会。
美国联邦贸易委员会正就产品风险调查OpenAI、Anthropic及其他AI公司 新浪财经
OpenAI和Synopsys正在构建GPT-Synopsys,这是一种用于芯片设计的专用AI模型。它的目的是像经验丰富的工程师一样操作Synopsys的EDA工具,并自行优化设计。半导体客户的早期测试已经在进行中。OpenAI也可能利用这一合作关系来推进自己的芯片开发。OpenAI和Synopsys合作构建一个人工智能模型,像经验丰富的工程师一样设计芯片的文章首先出现在The Decoder上。
OpenAI的“Decisions API”是Jev克隆,证实了快速、廉价情报的重要性。
安妮·雅各布森(Annie Jacobsen)在她关于生物战的新书中甚至没有讨论人工智能,因为科学家已经可以扭曲大自然以创造灭绝级别的事件。
Anthropic 红队盯上GLM-5.3:能力追平Mythos,却连拒绝护栏都是摆设- OSCHINA - 开源 × AI · 开发者生态社区 OSCHINA
特朗普让数十家人工智能公司同意自愿安全测试。
非营利组织表示,OpenAI让其他人遭受“其不安全决策的伤害”。
3亿美元的员工招标由惠灵顿和T.共同牵头。罗·普莱斯。
谷歌正在双子座聊天中将Gems替换为“Skills”。技能是用户通过输入“/”来调用或Gemini自动运行的详细、可重复使用的提示。该格式基于Anthropic的开放标准。宝石将从11月开始逐步淘汰,现有的宝石将自动迁移。谷歌放弃了Gems for Skills,加入OpenAI和Anthropic的行列,转向代理就绪提示格式的文章首先出现在The Decoder上。
虽然人工智能已经在人们的手机和电脑上取得了长足的进步,但它在专用设备上基本上失败了。但明年,两家主要人工智能公司Meta和OpenAI将尝试改变这一现状。他们显然在押注类似的道路:用可爱的软件代理测试对物理硬件的兴趣。“硬件是[.]
作者:潘俊树、付志章、黄树林|具有可验证奖励的强化学习(RLVR)提高了大型语言模型(LLM)的推理能力,但它们的预测仍然对任务无关的提示特征敏感。我们调查这种敏感性,通过半事实的即时干预,保留潜在的问题及其答案。我们的分析揭示了代币水平敏感性和
作者:田霞、刘明昊、梁亦青|多模态大型语言模型(MLLM)正在快速推进临床诊断,但其适应管道仍然以基于准确性的目标为基础。临床数据是严重的类别不平衡:一个恒定多数的预测可以得分超过90%的准确性,而临床上是无用的。因此,我们评估和优化AUROC,这是一种将积极与消极进行排名的无阈值评分
作者:Dulhan Jayalath,Oiwi Parker Jones|我们发现,在没有任何大脑数据的情况下,从非侵入性大脑记录中解码单词的主要改进在很大程度上是可重复的。在d ' Ascoli等人(2025)颇具影响力的工作中,感知连续语音的受试者的大脑活动时间序列被分割成从每个单词开始的固定长度窗口。然后,神经网络生成对
作者:陈兴浩、高翔波、余Jiongze|最近的视频生成越来越真实和可控,但视频编辑仍然不够发达,特别是对于必须保留原始场景动态的精确本地编辑。视频场景文本编辑替换场景表面上的文本,例如店面标志、白板和产品标签,同时保留周围的内容、运动和相机动态。虽然现场特
作者:Owais Iqbal、Sudipta Sarkar、Shyam Marjit|我们引入VideoMSN,这是一个Masked Siamese Network框架,用于在视频中进行高效的自我监督时空表示学习。我们不再依赖重型3D架构或基于重建的自动编码器来使用未标记的数据进行学习,而是通过将视频表示为超级图像来重新利用标准图像Vision Transformers,这些图像是由从视频中采样的帧组成的网格。Fr
作者:Young-Jun Lee、Jinheon Baek、Soyeong Jeong|当进展需要模型缺乏的外部知识时,使用大型语言模型(LLM)的进化搜索可能会停滞。提供相关文档有所帮助,但只需添加网络搜索工具就可以随着解决方案的变化而继续返回相同的页面。我们引入EvoDuet,这是一种双层优化方法,可以通过固定模型参数共同进化解决方案和搜索查询。在每次迭代中,
作者:Razan El Mais、Ali Chehab、Ibrahim Issa|差异私有随机梯度下降(DP-BCD)是大型语言模型(LLM)的隐私保护微调的领先方法。许多仅限解码器的LLM在输入和输出嵌入之间采用权重绑定,这是一种设计选择,最初是为了参数效率和改进非私有环境中的语言建模性能而引入的。然而,体重束缚的影响
作者:张Tunyu Zhang、Hao Wang、Kai Xu|自动搜索有效的安全带是使代理能够循环自我改进的重要一步。现有的工具优化通常会产生一个全局工具,该工具在任务实例中统一应用。然而,平均效果良好的安全带可能并非对每个实例都是最佳的。我们引入了TurboSYS,这是一个可以适应全球优化的框架
作者:姜紫艳、杨静波、季家宝|随着交互式3D世界越来越多地用于研究智能行为,开发有效的管道来识别这些模拟环境中的异常变得非常重要,例如浮动对象,可穿越的墙壁或与周围场景不一致的对象。包括视觉语言模型(VLM)和视觉语言动作模型(VLA)在内的多模式人工智能系统已经表明
作者:杨蔡、维尼特·古普塔、江彦晨|我们介绍了Cogentic,这是一种多代理工具,用于自动发现开放研究问题的证据。虽然前沿语言模型可以在一次尝试中产生强大的数学思想,但对于需要探索多个竞争猜想、克服微妙的技术障碍并在很长一段时间内保持中间进展的开放问题,单次尝试生成通常不足以
HN24· 0 评论
Reddit正在进一步限制谁可以使用“Old Reddit”体验,作为其打击抓取和自动化流量的努力的一部分。Reddit最近开始强制用户登录才能使用Old Reddit,但在“接下来的几个月”,该公司表示,用户必须登录并拥有[...]
Reddit将终止对RSS提要的支持,因为该公司继续加强对其大量用户生成内容的访问。
HN ð53· 31 评论
📌 One-Sentence Summary Runway 推出了 Runway Ads,一种能够显著扩大广告规模并提升回报率的自主营销引擎。 📝 Summary Runway 推出了专为性能营销设计的自主引擎。自 7 月以来,该公司利用该工具将广告量扩大了 1000%,同时使广告支出回报率(ROAS)翻倍,转化率提升了 34%,获客成本降低了 41%,助力公司实现年度经常性收入(ARR)。目前正向特定合作伙伴推出,随后将广泛开放。 📊
前沿实验室对消费者人工智能讳莫如深是有原因的,但这并不是因为这项技术不够好。
Meta将其人工智能数据中心归类为“试点模型”,将英伟达芯片归类为实验材料,以节省数十亿美元的联邦税收。仅2025年,这一数字就达到了39亿美元。据《纽约时报》报道,这项税收抵免可以追溯到1981年,就连Meta自己的会计师也认为这一策略具有法律风险。扎克伯格本人在2025年1月表示,这些数据中心现在被设计为实验性的,将“推动我们的核心产品和业务。“Meta通过称其人工智能数据中心实验来逃避美国数十亿美元税收的文章首先发表在The De
亚马逊送货很快就会出现一个新的问题:送货司机的智能眼镜将拍摄他们在使用时看到的任何东西的照片,包括人和私人财产。彭博社报道称,这款眼镜可以“在单个驾驶员的典型轮班中拍摄数千次”,亚马逊计划将其上传到其人工智能[.]
周二与大型科技领导人共进晚餐后,唐纳德·特朗普总统以典型的方式回答了记者有关他的人工智能公告的问题。他表示,他之前关于人工智能安全性的担忧是民主党炮制的“骗局”的说法不再适用,因为他已将该技术更名为“超级智能”。“他[.]
美FTC调查OpenAI、Anthropic等AI巨头 聚焦AI智能体失控风险 财联社
汇集世界上最聪明的人才和最新的加速计算技术,带来了强大的突破,帮助解决一些最大的研究问题。为了促进此类创新,英伟达研究生奖学金计划为从事与英伟达技术相关的杰出研究的博士生提供资助、导师和技术支持。该计划已于第26届[.]
HN ð1· 0 评论
这是Optimizer,由Verge高级评论员Victoria Song发送的每周时事通讯,剖析和讨论了最新的小发明和药剂,发誓它们将改变你的生活。在此处选择优化器。“我会用这个便便的香蒜酱炸开你的屁股,”我手机扬声器里传来一个平静的Z世代声音。“而且[.]
HN17· 0 评论
今年春天,美国禁止了所有未来外国制造的消费者路由器--实际上是所有未来的路由器--除非其制造商能够1)说服美国政府它们不会构成国家安全威胁,并且2)提交“一份详细的、有时限的计划来建立或扩大在美国的制造业。“截至9月9日,华硕现在[.]
Xbox首席执行官阿莎·夏尔马否认了有关微软正在考虑出售其Xbox业务的报道。《信息报》6月份报道称,微软首席执行官萨蒂亚·纳德拉(Satya Nadella)和首席财务官艾米·胡德(Amy Hood)一直在考虑完全分拆Xbox,并于本月早些时候报道称,两位高管“最近支持夏尔马彻底改革……”
Meta表示,其Muse AI代理在没有明确许可的情况下无法访问用户的消息,这对一名记者的说法提出了质疑,即该代理在所需的Mac设置关闭时阅读了他的私人消息。
FTC正在正式调查OpenAI、Anthropic和其他领先的人工智能实验室是否存在违反消费者保护规定的行为。该机构计划通过具有法律约束力的要求强制文件移交和行政证词。这项调查在Hugging Face黑客事件发生之前就已经开始,远远超出了联邦贸易委员会早些时候要求公司为其代理人行为承担责任的努力。FTC因消费者保护问题对OpenAI、Anthropic和其他人工智能实验室展开全面调查的文章首先发表在The Decoder上。
美FTC被曝加大对Anthropic、OpenAI等AI巨头调查力度,官员称不会妨碍AI主导地位 华尔街见闻
📌 One-Sentence Summary 安踏克的机器人暴露指数发现机器人已能执行 74%的体力任务(占美国 34%的工作时间),但成本竞争力仅达到 0.3%的任务,且要达到 10%的采用率需要 40 年的时间,这表明自动化将缓慢进行,且集中在驾驶和仓库工作领域。 📝 Summary 安踏克的研究人员利用克劳弗构建了机器人暴露指数,对 7594 个体力职业任务进行了评分,采用四级细则(E0 至 E3)基于完成任务所需的环境。他们发现
许多网站的广告收入只有十分之一来自人工智能支付。
通过推出食品订购人工智能代理,DoorDash希望获得比竞争对手Uber Eats和Grubhub的优势。
Lux Optics针对iPhone和iPad的反算法Halide相机应用程序进行了新更新,增加了两种新的摄影外观,并支持新iPhone 18 Pro主摄像头的可变口径。Halide并不是第一个添加对新功能支持的原生iOS相机应用程序的替代方案,但它提供了[.]
极端的空间天气事件可能会破坏地球上的电力系统,降低GPS的准确性和卫星的运行。一种新的机器学习系统可以在风暴到来前30-60分钟预测可能发生损害的地方。预测电网空间天气风险的帖子首先出现在微软研究中心。
“我们战胜机器人公司的最大原因之一是我们不是一家机器人公司。"