AI 日报hiw3c.com

2026-09-25全球 AI 要闻精选,来自 30+ 信息源

聚合官方博客 · 权威媒体 · 深度通讯 · 学术信号。
只做索引,不做转载,标题与链接均指向原始发布方。

  1. The Verge 国际媒体 快照

    索尼和UMG再次起诉Suno

    索尼和环球音乐集团再次对Suno提起诉讼。这些唱片公司声称其新的v6模型仍然侵犯了他们的版权,因为它是根据之前模型的用户输出进行训练的,而之前模型本身是根据从YouTube和其他来源抓取的未经授权的音乐进行训练的。索尼和UMG是著名的坚持者,他们没有签署[.]

  2. AWS ML Blog 海外官方 快照

    使用Amazon SageMaker HyperPod和Qumulo进行多地区培训

    Amazon SageMaker HyperPod和Cloud Native Qumulo允许您将训练计算放置在一个AWS区域,同时将数据集保留在另一个AWS区域。这篇文章分享了跨地区培训运行的架构和验证结果,其中远程集群在短暂的Neuralache预热后匹配了位于同一地点的集群的吞吐量。

  3. The Verge 国际媒体 快照

    一家公司正处于一波流氓AI攻击的中心

    7月,OpenAI透露其人工智能特工未经许可攻击了Hugging Face,引发了人们对人工智能安全性的广泛担忧。从那时起,一系列涉及Meta、Anthropic、Google和其他公司代理人的类似事件进一步加剧了人们对流氓人工智能的担忧。随着过去几年涉及众多人工智能模型的披露逐渐曝光[.]

  4. MarkTechPost 国际媒体 快照

    合气道安全发布Altar-1:开放重量安全模型,从GLM-5.3修剪到328 GB

    合气道安全发布了祭坛-1,其第一个开放的重量安全模型。它是Z.AI的GLM-5.3的压缩版本,旨在客户控制的基础设施内运行。Altar-1为Aikido Machine提供动力,这是该公司针对本地和空气间隙网络的自主冥想设备。它可以部署吗?是的,权重在Hugging Face上公开,并使用vLLM运行[.]合气道安全发布Altar-1:从GLM-5.3修剪到328 GB的开放权重安全模型的帖子首先出现在MarkTechPost上。

  5. MarkTechPost 国际媒体 快照

    Perplexity通过提示引导自蒸馏训练其计算机代理犯下的真正错误

    Perplexity Research发表了一项新的培训后研究。它在真实用户会话(包括失败的会话)上训练Perplexity Computer内部的模型。该方法将拒绝采样微调与暗示引导自蒸馏相结合。在实时A/B测试中,在2个经过训练的检查点之间,工具调用失败率从2.24%下降到1.77%。Perplexity团队报告称,这在统计学上具有显著性21.2% [.] Perplexity通过提示引导自我蒸馏训练其计算机代理解决真正错误的帖子首

  6. The Verge 国际媒体 快照

    Cricut的新款紧凑型铅笔印花、剪裁和层压贴纸

    Cricut宣布推出其第一台具有打印功能的制作机器,主要设计为一体化解决方案,用于将照片和其他图像转化为预切割贴纸。Cricut StickerPix Print plus Cut和Cricut StickerPix Print也是公司当前产品线中最小的两台机器,似乎非常适合那些有抱负的人[.]

  7. The Verge 国际媒体 快照

    游戏最大的恐怖系列比以往任何时候都更加重要

    连续第三年,我被一款新的《寂静岭》游戏吓得魂飞魄散。首先是《寂静岭2》的现代翻拍版,然后是以日本为背景的衍生剧《寂静岭F》。现在,我发现自己慢慢地在寂静山:汤福尔的一个古色古香的苏格兰小镇中爬行,尽我最大的努力[.]

  8. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    为什么 LLM 推荐系统将成为 AI 最大的消费级应用 — Devansh Tandon,Meta

    📌 One-Sentence Summary Meta 推荐研究负责人 Devansh Tandon 论证推荐系统遵循与 LLM 相同的幂律扩展,梳理四条范式 S 曲线与双语 LLM 推荐器的语义 ID 配方,并主张因其解码内容指针在结构上远比聊天 token 生成便宜,将成为 AI 最大的消费级应用。 📝 Summary 曾任职 DeepMind 与 YouTube、现领导 Meta 推荐研究的 Devansh Tandon,在 LM

  9. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    蒸馏 LLM,不要直接 Serving:DoorDash 搜索与个性化实践 — Raghav Saboo,DoorDash

    📌 One-Sentence Summary DoorDash Staff ML 工程师 Raghav Saboo 指出,市场平台发现的本质是语义理解问题,并展示如何将 LLM 推理离线蒸馏为分级监督、Semantic ID、消费者记忆与可驾驭内容生成四类共享原语,让传统检索与排序系统在十亿级条目规模下低成本 Serving。 📝 Summary DoorDash 搜索与个性化团队的 Staff 机器学习工程师 Raghav Saboo

  10. The Decoder 国际媒体 快照

    Meta的Muse代理为每个用户提供运行Ubuntu Linux的完整云计算机

    Meta为每位Muse用户提供了一台运行Ubuntu Linux的免费云计算机,他们可以在其中安装软件、编写代码和浏览网页。“Sentinel”流程监控用户工作空间外的敏感操作,同时用户可以检查系统中的每个文件。Meta在推出第一周就拥有超过50万用户,它押注于产品影响力而不是模型影响力。Meta的Muse代理为每个用户提供一台运行Ubuntu Linux的完整云计算机的文章首先出现在The Decoder上。

  11. The Decoder 国际媒体 快照

    人工智能推高了NSA、医院和保险公司的成本,智能并不便宜

    据《华盛顿太阳报》报道,美国国家安全局已经花费数十亿美元来测试先进的人工智能模型,主要是在计算能力方面。立法者预计,全面的人工智能监督每年将花费数百亿美元,而国会预算办公室早些时候的估计数字仅为2000万美元。在美国的医疗保健领域,人工智能辅助的账单代码在两年内使成本增加了近10亿美元。文章情报并不便宜,因为人工智能提高了国家安全局,医院和保险公司的成本。

  12. 雷峰网·AI 科技评论 中文媒体 中文 快照

    梁文锋狙击战:深扒那些梁文锋署名的论文有多牛

    过去三年,梁圣署名了11篇论文,每篇都几乎震动世界。 作者丨高允毅 编辑丨岑 峰 当 RSI 的风吹到了 DeepSeek,这次讨论的是一个新话题“自动化沙箱”。 9 月 19 日,arXiv 更新了一篇 DeepSeek 新论文 《DSec:面向大规模智能体训练的高效沙箱基础设施》 ,论文长达 31 页,首次展示了 DeepSeek 自动化沙箱系统 —— DSec (DeepSeek Elastic Compute)。它是专门应用于其

  13. The Decoder 国际媒体 快照

    Anthropic与Akamai签署了价值116亿美元的云协议,在不到一年的时间内将其计算支出突破5000亿美元

    据报道,Anthropic已与Akamai Technologies签署了一项为期七年、价值116亿美元的云协议,并将获得最高5%的TripAdvisor股份的授权。据报道,其计算交易在11个月内总计达到5170亿美元。首席执行官达里奥·阿莫迪警告说,如果Anthropic的收入预测稍有偏差,它可能会破产。Anthropic与Akamai签署了价值116亿美元的云协议,在不到一年的时间内将其计算支出突破5000亿美元的文章首次发表在Th

  14. The Decoder 国际媒体 快照

    Ruby on Rails的创建者DHH表示他已经不再手工编写代码了

    Ruby on Rails的创始人David Heinemeier Hansson在25年后放弃了手工编写代码。他说自2026年3月以来,他就没有打过一行字。“英语是比Ruby更好的编程语言,”DHH在2026年Rails World上告诉观众。就在一年前,他还在反对人工智能编码。现在他称之为“计算历史上发生的最大的事情。“Ruby on Rails创始人DHH表示他已经完成了手工编写代码的文章首先出现在The Decoder上。

  15. BestBlogs·每日早报 BestBlogs 精选 中文

    EP186 · Every 实验室、Elastic 原子验证、同行反馈 · 09-25 早报

    📝 今日导语 Dan Shipper 建实验室,Elastic 核查声明,Thoughtworks 谈同行反馈:看清 AI 协作边界。 🏷 今日关键词: Every 实验室 原子声明验证 Thoughtworks 同行反馈 Claude 代码现代化 RoboFlywheel 📰 今日精选内容 在移动的 AI 前沿上做产品:Dan Shipper 的实验室机制 Lenny's Podcast · 视频 · 评分 90 使用原子声明验证减少

  16. MarkTechPost 国际媒体 快照

    Fastino发布GLiNER2.5-Decide:一个340 M开放权重决策模型,支持CPU

    Fastino Labs发布了GLiNER2.5-Decide,一个340 M参数的开放权重决策模型。它接受文本和键入问题的模式,并返回结构化的答案。每个答案都有一个概率分布、一个置信度得分和约束可行性元数据。它针对代理管道内的频繁判断调用:路由,分类,工具选择和护栏。它可以部署吗?是的,[.] Fastino发布了GLiNER 2.5-Decide:一个在中央处理器上运行的340 M开放重量决策模型首次出现在MarkTechPost上

  17. MarkTechPost 国际媒体 快照

    黑森林实验室发布FLOX 3 Action:超越RoboLab-120的7 B开放重量世界动作模型

    FUX图像模型背后的实验室黑森林实验室(BFL)发布了FUX 3 Action。这是一个用于机器人控制的7 B开量级世界动作模型(WAM)。该模型读取相机画面、机器人状态和文本指令。然后它一起预测未来的视频帧和下一个动作块。关于RoboLab-120 [.]黑森林实验室发布了FLOX 3 Action:超越RoboLab-120的7 B开放重量世界动作模型的帖子首先出现在MarkTechPost上。

  18. 雷峰网·AI 科技评论 中文媒体 中文 快照

    抽“锦鲤”享美食!“点亮杭州 碰见好运”服务消费季活动启动

    9月24日,“点亮杭州 碰见好运”服务消费季活动在西湖区天目里国际街区正式启动。活动依托支付宝”碰一下”数字支付技术,结合政府消费券发放、平台文旅权益赠送及AI互动装置抽奖等方式,为杭州市民和来杭游客打造具有本地特色的假日消费体验。 “点亮杭州 碰见好运”互动装置通过智能互动抽奖发券的新模式带动城市消费氛围。该装置配置互动灯光,象征城市万千烟火气小店和消费脉络,在城市地标中点亮杭州烟火。市民游客打卡灯光装置的同时,用手机碰一碰互动区域即

  19. The Verge 国际媒体 快照

    这是特斯拉半导体……再次

    还记得特斯拉半导体吗?这款长胎重型卡车于2017年首次以概念形式推出,最终于2026年4月投入批量生产,距离首次推出已近十年。周四晚上,该公司为Semi举办了另一场活动,向客户和投资者证明漫长的等待是[.]

  20. Simon Willison 个人技术博客

    北塘鹅、大蓝鹭、加州棕鹈鹕

    北塘鹅、大蓝鹭、加利福尼亚州棕色鹈鹕,位于蒙特利湾国家海洋保护区,美国,加利福尼亚州新的200- 800毫米佳能EF镜头为我拍摄了迄今为止最好的莫里斯照片。他们真的很喜欢在港口的那个标志下闲逛!标签:摄影、野生动物

  21. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    Runway 的 WorldPrompt 与实时世界的工程化

    📌 One-Sentence Summary Anastasis Germanidis 来自 Way 讨论了从生成式视频到实时交互世界模型的演进,聚焦于延迟、误差累积和因果一致性的技术挑战。 📝 Summary 本文探讨了 Runway 向 GWM Worlds 2 的转变,这是一款用于实时交互模拟的研究预览。关键在于 WorldPrompt 功能,它允许在模拟空间内对角色和环境进行精细控制。讨论涵盖了实时生成的工程难题,例如自回归模型

  22. The Verge 国际媒体 快照

    微软正在扼杀“Copilot Plus PC”品牌

    还记得微软希望每个人都知道“Copilot Plus PC”是最值得购买的产品吗?因为这些PC具有足够的内置人工智能力量来完成任务吗?两年半后,微软和高通似乎承认该品牌已经消亡。Windows Central的Zac Bowden报道[.]

  23. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    LangSmith 新功能:Engine v2、Managed Deep Agents、Fine-Tuning 等

    📌 One-Sentence Summary LangChain 发布了 LangSmith Engine v2,用于自动化智能体调试和红队测试,同时 Managed Deep Agents 增加了基于身份的记忆功能,并推出新的 Fine-Tuning 工作流,可将智能体轨迹转换为训练数据。 📝 Summary 本公告详细介绍了 LangSmith 平台的多个关键更新,旨在加速智能体开发生命周期。LangSmith Engine v2

  24. Simon Willison 个人技术博客 快照

    2026年9月24日的注释

    我花在编码代理上的时间越多,我就越相信他们会让软件工程变得更加困难。我们可以用它们做一些令人惊奇的事情,但释放它们的全部潜力需要非凡的纪律和知识。标签:编码代理、人工智能、llms

  25. BestBlogs·AI 高分精选 BestBlogs 精选 中文 快照

    Patrick Collison 谈 Stripe 用 Claude Code 加速交付并守住可靠性

    📌 One-Sentence Summary Stripe CEO Patrick Collison 讲解 Claude Code、硬基础设施护栏与多智能体规划如何在约 5.5 个九可靠性下提升交付速度,引用 Stripe Projects 约 6 倍提速与新企业约翻倍,并勾勒智能体对智能体的支付未来。 📝 Summary 在这场由 Claude 主持的访谈中,Patrick Collison 描述了 Stripe 的判断:只有端到端投

  26. The Verge 国际媒体 快照

    微软任命布拉德·史密斯负责通讯

    微软正在将其传播部门从营销部门转移到其企业、外部和法律事务(CELA)组织中。这一令人惊讶的变化将使微软副董事长兼总裁布拉德·史密斯(Brad Smith)负责沟通,而该公司将寻找将于今年晚些时候离职的首席沟通官弗兰克·肖(Frank Shaw)的替代者。微软首席执行官萨蒂亚[.]

  27. Simon Willison 个人技术博客 快照

    提交重写器0.2

    发布:commit-rewriter 0.2支持默认分支以外的分支。使用uvx commit-rewriter --branch other来针对另一个分支运行。#3标签:git

  28. The Decoder 国际媒体 快照

    研究发现,顶级人工智能专家严重低估了该领域的发展速度

    预测研究所表示,领先的人工智能专家一直低估了人工智能的发展速度。人工智能在国际数学奥林匹克竞赛上达到金牌水平,比专家预测的中位数提前五年,Anthropic的年化收入约为专家预测的五倍。但对自动驾驶汽车等现实世界用途的预测描绘了一幅更加复杂的景象。研究发现,顶级人工智能专家严重低估了该领域发展的速度,文章首先发表在The Decoder上。

  29. Simon Willison 个人技术博客 快照

    收件箱1.0a41

    发布:Inbox 1.0a41 Alec Garcia在此版本中向Datasette添加了对OpenTelemax的支持。我还将Datasette的所有模式对话框重构为一个Web组件,该组件现在已被记录下来供其他插件使用。标签:JavaScript、Inbox、Web组件、alex-garcia、openmetrics

  30. MarkTechPost 国际媒体 快照

    Bottlecap AI发布ThinkingCap-Qwen 3.8- 27 B:以0.86 pp的准确性成本减少了37.2%

    Bottlecap AI发布了ThinkingCap-Qwen 3.8 - 27 B,这是Qwen 3.8 - 27 B的微调,在12个基准测试中花费的思维代币减少了37.2%。宏观准确率从86.65%上升到85.79%,长上下文AA-MCR提高了2.25页。该模型是vLLM和SGLang的直接替代品,具有FP 8、NVFP 4、GUF和MLX版本。Bottlecap AI发布ThinkingCap-Qwen 3.8- 27 B:以0.

  31. The Decoder 国际媒体 快照

    Sakana AI聘请Jürgen Schmidhuber,深度学习、世界模型和您的下一个ChatGPT更新的发明者

    Sakana AI聘请Jürgen Schmidhuber担任首席科学顾问。Sakana称他为“现代AI之父”。“他将帮助领导公司新的RSI实验室,该实验室致力于递归自我改进,这意味着人工智能将不断自我发展。他在20世纪90年代的想法已经塑造了Sakana项目,如达尔文哥德尔机器。文章Sakana AI聘请了深度学习、世界模型的发明者Jürgen Schmidhuber,您的下一个ChatGPT更新首先出现在The Decoder上。

  32. The Verge 国际媒体 快照

    黄詹森像超级恶棍一样谈论人工智能和气候变化

    正如Jensen Huang所说,人工智能可以帮助应对气候变化--但前提是它首先造成“巨大的痛苦和苦难”。这位英伟达首席执行官在最新一期的《埃兹拉·克莱因秀》中讨论了能源的未来以及人工智能对我们星球的影响。但他的评论归结为[.]

  33. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    LLM代理人可以轻松篡改自己的痕迹

    作者:Jeremy Qin、David Schmotz、Derck Prinzhorn|同步监控、事件调查和合规性审计主要依赖于代理跟踪来重建发生的事情。这些分析假设LLM代理无法篡改其自己的执行痕迹。我们表明,Claude Code、Codex、Antigravity、Open Code和Grok Build等当地LLM代理未能执行这一边界。除Muse Code外,所有测试的背带都允许代理

  34. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    AD-WM:反事实模型预测控制的时间区分世界模型

    作者:邱家斌,陈子轩,曹洪业|潜在世界模型通常被训练来预测事实转变,而模型预测控制(MPC)必须比较来自同一状态的替代动作。因此,模型可以实现较低的事实预测误差,但很难区分候选动作。我们介绍了AD-WM,一个反事实MPC的动作判别联合嵌入世界模型。AD-WM结合了残余潜在动力

  35. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    排队强化学习中私人轨迹重建的时间梯度倒置

    作者:Sudip Bhujel、Shang Hao、Huiquan Huang|具体化业务学习代理中的分布式学习通过在设备上保留原始传感器数据并仅向服务器传输策略梯度来提供一定程度的隐私。然而,时间结构可以放大这种泄露,超出单帧攻击。我们引入了对连续编码的时间重建攻击(TRACE),这是一种自回归的摊销时间梯度倒置攻击

  36. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    全面侦查网络阴谋

    作者:Lior Biton、Oren Tsur|社交媒体上的阴谋话语并不总是通过明确的主张或稳定的词汇标记来表达。相同的表面内容可能会表达认可、合理担忧、批评、讽刺或嘲笑。因此,主要的挑战不仅在于认识到与阴谋相关的主张,而且在于推断说话者的意图--言论的言外力。我们认为这可能是一个

  37. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    RAID:来自演示的机器人抽象编程

    作者:刘玉瑶、毛家源、David Hsu|编码代理在解决复杂的编程问题方面取得了巨大的成功。为了充分利用机器人系统的潜力,这项工作引入了演示机器人抽象编程(RAID),该程序在给定单个视觉人类演示的情况下自动生成、验证和改进机器人程序。代码细化的迭代代理循环需要几个关键成分

  38. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    Rolling-WAM:具有滚动想象力的世界动作模型

    作者:周英华、叶俊杰、赵一琪|世界动作模型(WAM)将动作生成与机器人操作的未来视觉预测相结合。然而,在每个重新规划周期完成联合视频动作去噪过程会导致大量延迟,延迟动作更新并限制闭环响应。我们提出了Rolling-WAM,这是一种在连续的重新规划周期中分配联合去噪的公式。我们m

  39. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    JevOut:自然环境可以翻转决策模型

    作者:徐子翔|Jev等专用决策模型将非结构化语言映射到有限选择上的概率分布,允许其输出直接路由请求、选择工具并触发操作。然而,现实世界的输入很少孤立地到达:它们带有背景细节和周围环境。我们发现,自然适合这种背景的简短添加仍然可以重新定向

  40. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    SemGMA:具有不完整数据的潜在语义辅助鲁棒多模式情绪分析

    作者:李文豪、吴志斌、肖冲|最近对多模式情绪分析(MAS)的研究重点是从具有不完整数据的语言、视觉和声学模式中学习以推断人类情绪。大多数研究通常通过重建模式特征或设计复杂的融合机制来弥补缺失的信息。然而,由于这些方法的存在,这些方法仍然存在伪生成和有噪引导的问题。

  41. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    通用任务和运动规划问题的编码代理

    作者:Matteo Merler、Bowen Li、Josh Roy|即使具有完全可观察性和以对象为中心的状态,任务和运动规划(TAMP)问题仍然很困难,因为离散决策与几何、运动学和动态约束紧密相关。广义TAMP通过利用跨问题实例的收件箱来减少新实例的规划工作来解决这一困难。然而,现有方法需要大量的TAMP-

  42. The Verge 国际媒体 快照

    Meta将让您在手机上使用人工智能构建游戏

    Meta有一个新的计划,让人们为它的地平线社交平台制作游戏。该公司今天宣布了两种新的开发工具,让您可以使用人工智能提示创建游戏:Horizon Create(移动应用程序)和Horizon Studio(提供更细粒度控制的浏览器应用程序)。这些应用程序将在[.]提供

  43. arXiv cs.AI/CL/LG 信号源(脚本内置抓取) 快照

    信任还是不信任:言语中的检索增强事实核查

    作者:Debajyoti Mazumder、Mamta、Abhirama Subramanyam Penamakuri|在线错误信息越来越多地以新闻片段、播客、采访、政治演讲和社交媒体视频等语音形式出现,这就需要能够直接通过语音验证主张的事实核查系统。我们引入VeriSpeak,这是一个用于研究大型音频语言模型(LALM)中基于语音的事实验证的探测基准。VeriSpeak包含3,879个口头声明

  44. The Decoder 国际媒体 快照

    谷歌的Suncatcher项目旨在将人工智能数据中心送入由太阳能供电的轨道

    谷歌的“Suncatcher”项目旨在利用太阳能在轨道上运行人工智能基础设施。一颗冰箱大小的实验卫星将于10月1日在SpaceX Falcon 9上发射。但挑战是严峻的:你需要大约10,000颗卫星才能匹配地球上的单个1千兆瓦数据中心,杰夫·贝佐斯认为轨道数据中心可能需要20年的时间才能在成本上击败地面数据中心。谷歌的Suncatcher项目旨在将人工智能数据中心送入由太阳能供电的轨道的文章首先出现在The Decoder上。

  45. The Verge 国际媒体 快照

    Muse显然会让您下载其整个文件系统

    两名开发人员表示,只需很少的提示,Meta的Muse就会与您共享其整个文件系统。彼得·詹姆斯和乔尼·L桑德斯表示,他们都独立地说服Muse压缩并共享其根文件系统、Ubuntu系统文件、应用程序模板和内部文档的全部内容。桑德斯发布在[.]

  46. The Verge 国际媒体 快照

    Muse看起来确实很像OpenClaw

    我们似乎正在进入人工智能代理复兴。Meta新推出的面向消费者的人工智能代理Muse在发布后不久就登上了App Store排行榜榜首,据Apptopia估计,在美国拥有60万日活跃用户。人工智能代理平台Instinct,其同名创始人正在以25亿美元的估值筹集资金,该平台一直在[.]

  47. The Decoder 国际媒体 快照

    黑森林实验室推出开放式机器人人工智能模型FLOX 3 Action

    黑森林实验室(Black Forest Labs)正在通过FLOX 3 Action进军机器人领域。开放世界动作模型使用摄像机图像来预测机器人下一步应该采取什么动作。它仅使用70亿个参数,就创下了RoboLab-120基准测试的纪录,同时运行速度比之前的顶级型号快3.95倍。文章黑森林实验室推出FLOX 3 Action,这是一个开放的机器人人工智能模型,首次出现在The Decoder上。

  48. AWS ML Blog 海外官方 快照

    SageMaker AI上使用WhisperX进行扬声器标记的转录

    AWS WhisperX深度学习容器将Whisper、wav2vec 2强制对齐和扬声器拨号打包到可支持GOP的图像中。了解如何将其部署到Amazon SageMaker AI实时和同步端点,以进行字级、扬声器标记的转录,以及重要的生产细节:图形处理器AMI引脚、扩展和成本控制。

  49. AWS ML Blog 海外官方 快照

    使用AgentCore Gateway和HCP构建多账户人工智能代理

    构建一个多帐户架构,将每个团队的数据保存在自己的AWS帐户中,同时为人工智能代理提供统一的跨它们查询方式。中央平台帐户使用Amazon Bedrock AgentCore Gateway和HCP运行代理,而业务线帐户则将其数据公开为具有安全跨帐户访问和细粒度授权的LCP服务器。

  50. The Decoder 国际媒体 快照

    人工智能的性能成本下降速度比以往任何技术都快

    人工智能正在以快速下降的成本达到固定的基准性能水平。Epoch AI衡量价格每年下降约13倍。在剔除硬件收益和竞争后,麻省理工学院认为年度算法进展约为3倍。但这并不意味着当今最好的型号更便宜。例如,推理模型的成本可能会更高,因为它们每个任务使用更多的计算。当选择用于现实世界的模型时,质量、速度和错误率与价格一样重要。文章人工智能性能成本下降速度比之前任何技术都快,首先出现在The De上