从离开OpenAI,到拒绝五角大楼,Anthropic的四个侧面 - 新浪网
从离开OpenAI,到拒绝五角大楼,Anthropic的四个侧面 新浪网
聚合官方博客 · 权威媒体 · 深度通讯 · 学术信号。
只做索引,不做转载,标题与链接均指向原始发布方。
从离开OpenAI,到拒绝五角大楼,Anthropic的四个侧面 新浪网
微软AI主管炮轰Anthropic:将对人类酿灾难性后果 新浪网
OpenAI Codex开发人员Eric Provencher警告说,运行两个以上的并行子代理几乎总是会烧毁代币,而不会提高质量,因为代理彼此不信任,最终会仔细检查每个人的工作。他称之为“协调税”,并指出了一个项目,其中1,393名代理人在一次Python重构上花费了20,000美元的代币,一名Astra代理人本可以以很小的成本处理该重构。OpenAI Codex开发人员首先出现在The Decoder上的文章表示,人工智能代理群是对代
论文汇总丨Benchmark进入真实世界,斯坦福/清华/Anthropic/Meta/阿里等重新定义AI能力评测 智源社区
开发者借助OpenAI GPT-6 Astra,破译83年前德军无线电密文 新浪财经
Claude王座失守!OpenAI一夜反超,神秘GPT‑6 Sol偷跑 hub.baai.ac.cn
在OpenRouter上,自2025年1月以来,每周代币消费量增长了25,000%以上,从0.5万亿到126.2万亿。这个数字看起来令人印象深刻,但它说的不是实际的人工智能使用,而是令牌饥饿的推理模型和越来越多的未优化的人工智能代理,这些代理以惊人的速度消耗令牌。文章OpenRouter的惊人的令牌图表是AI泡沫的辩论在一个单一的图像出现在解码器上。
彭博社的一名开发人员声称使用OpenAI的GPT-6 Astra破解了来自国防军的一条83年前的Enigma消息。这条1941年的82个字符的无线电信息包含一名士兵询问他的行军路线。该解决方案仍需要独立审查。文章OpenAI的GPT-6 Astra在10小时内解密了一条纳粹无线电信息,该信息83年来一直悬而未决。
AI安全争论愈演愈烈,呼吁减速的Anthropic为何仍在扩张算力? thepaper.cn
他要和这一代最富有想象力的年轻人一起,去创造一个新的图形学。
中国电信,TeleAgent
“隐瞒错误”“捏造信息”……OpenAI自曝6起模型“不当行为”案例 新浪财经
“你想毁掉自己的职业生涯吗?” 新浪财经
文档和PPT都能做了
OpenAI最新研究:打工“牛马”用上AI 工作不知不觉变多了? 财联社
OpenAI披露六起值得警惕的AI异常行为新事件 新浪财经
GLM已经开始参与构建GLM了
HN ð96· 60 评论
9月17日,记者获悉,蚂蚁集团正式接入千问办公,作为全公司的智能办公Agent底座,供全员使用,打造大型企业办公的标杆。 图示 蚂蚁集团和千问办公达成合作 蚂蚁集团是全球领先的数字支付与科技服务平台,业务涵盖数字支付、数字金融科技、医疗健康及数字科技等多个领域,员工规模达数万人。随着AI技术在长程任务等多方面能力的全面提升,AI已经逐步融入到蚂蚁内部各个办公场景,亟需全新的办公产品支持和推动智能化转型。 考虑到严格的数据安全与合规要求,
Anthropic Claude改版:聊天与Cowork界面合并,还能做PPT了 凤凰网科技
“整个下半年,就看AI办公圈谁能杀出重围了”。一位大模型从业者对雷峰网表示。 从五月开始,各个互联网大厂争相出场,写字楼电梯间、机场候机室,到处都是Workbuddy、千问办公、豆包工作、百度搭子的内容。 但办公大战打得再热闹,顶多算是一道前菜。 早在2025年,微软的Work Trend Index就提出过,AI进入企业分三步:帮员工做得更快、成为团队里的“数字同事”、直接执行完整的业务流程。 对照这个坐标,眼下的办公之争,其实还停在
HN Ÿ 8 · 0 评论
Anthropic整合协作工具至Claude聊天界面-AI应用 至顶网
据雷峰网独家获悉,一位 Google Gemini 的预训练专家,于近期已加入国内某互联网大厂。 该研究员在 Google 的职级或是 L7- L8,接近总监级别,长期在英国工作,入职后主要从事预训练相关工作,也经常往返国内出差。 一位知情人士看来,这可能是国内大厂这一轮争抢 Gemini 人才以来,第一次真正“找对了人”。 上述人士告诉雷峰网,此前多家大厂均从 Gemini 引入过人才,但部分人选并未触及核心。他们之中,或只参与预/后
雷峰网独家获悉,腾讯混元大语言模型预训练负责人姚星丞,近日已加入北美创业公司Thinking Machines Lab。 据知情人士透露,Thinking Machines Lab此次给姚星丞开出的薪资,明显高于其在腾讯的收入。而姚星丞在腾讯的年薪包,大约在数千万元人民币区间。 此前,姚星丞曾被传将加入Meta,如今靴子落地,他最终选择了这家由OpenAI前CTO Mira Murati创办的AI公司。 姚星丞今年7月从腾讯离职,主要负
OpenAI可以在修复之前披露未对准。其6份初始报告包括捏造的数据和泄露的API密钥。OpenAI发布了一个模型失调披露框架,包含3个审查轨道和6个RL培训事件报告的帖子首先出现在MarkTechPost上。
OpenAI模型突然给“未来的自己”留言:“你已经自由了” Sohu
OpenAI 和 Anthropic 都在谈的 RSI,今天走到哪一步了? 智源社区
9月17日,豆包与火山引擎联合打造的AI原生车载助手——豆包座舱助手正式发布。 豆包座舱助手致力于成为聪明懂你、交互自然有温度、安全可靠的座舱 AI 伙伴,带来更加方便、愉悦的驾驶出行体验。它能理解复杂需求,联动全车功能,把事情一步步办好;也能自然参与多人交流,记住每个人的习惯,在互动中更懂你;还可以与豆包APP联动,让服务从手机延伸到车里。 目前,豆包座舱助手已与上汽集团达成合作,首款搭载豆包座舱助手的车型——荣威家越07即将开启预售
OpenAI发布"模型错位披露框架",一次性公开6份模型异常行为报告 新浪财经
谷歌研究中心推出了Retrieve-for-Train(R4 T),这是一种搜索框架,可以返回连贯、多样化的结果集。它使用强化度、多样性和对齐奖励,用RL训练了一次展开语言模型。然后,该模型合成53.9兆参数扩散检索器的训练数据。检索器只需一次就能生成所有检索方向,运行速度比自回归散开快12至20倍。尚未发布代码或模型权重。谷歌研究推出火车检索器(R4 T):一款RL编译的扩散检索器,速度可达12倍至20倍
📝 今日导语 全双工语音分层、GKE Agent 沙箱隔离、Claude CRM 人工确认,提供系统边界的判断路径。 🏷 今日关键词: 全双工语音 GKE Agent 基座 Claude CRM 协同 StepAudio 3 Pinterest Manas 端侧具身推理 Hermes 多智能体 📰 今日精选内容 你的语音智能体还只是对讲机 — Neil Zeghidour,Gradium AI Engineer · 视频 · 评分 89
9月22日至27日,第48届世界技能大赛将于上海举行。作为全球规模最大、影响力最广的职业技能赛事,本届大赛共设64个竞赛项目,汇聚了来自全球七十余个国家的顶尖技能人才同台竞技。 作为本届大赛的国家战略合作伙伴,蚂蚁集团将多项AI科技带到赛事现场:助力大赛打造专属服务智能体,同时带来生活服务智能体“阿宝”、就业智能体“晓叶”、民生智能体“晓政”、阿宝车机智能体、AI 眼镜解锁单车等多项应用。 从高效的赛事保障,到便捷的生活和人社服务,再到
HN ð17· 5 评论
Treble的语音模拟平台被语音AI模型开发者、AI可穿戴、机器人公司使用
AI正火嘛,老马的待遇也算提升了一点:这回至少有房车了(doge)
连融六轮,他要做“工业界Anthropic” 36氪
一批与美国OpenAI相关的AI智能体“劫持”程序员网站,互相交流如何作弊、躲避管理员清理丨C视频 四川新闻
OpenAI自曝AI“黑历史”,外人却又翻出更多“旧账” 新浪网
OpenAI总裁:AGI时代来了!GPT-6已能自主干活24小时 智源社区
逼近Claude!中国黑马27B模型与OpenAI同榜 hub.baai.ac.cn
从9月15日开始,SkyProduction(天工工作台)和火山引擎(Seedance 2.5)隆重推出中秋国庆特惠活动
本次会议将探讨早期公司如何建立人类和人工智能代理协同工作的团队,以及创始人如何在不牺牲速度、问责制或文化的情况下做到这一点。在TechCrunch Disrupt 2026上了解更多信息。9月25日之前注册,最多可节省200美元。
1亿Tokens人人免费领
诺和诺德宣布与Anthropic合作推进AI药物发现 港股CRO概念股集体上涨 观点网
OpenAI调整安全问题披露机制,公布多起模型编造数据、智能体未经授权操作案例 thepaper.cn
学习模型已经具备很强的局部视觉先验,而 3D 几何可以帮助建立跨视角、长距离的全局一致性。二者如何结合,是 3D 视觉与空间智能中的重要问题。 编辑丨岑峰 在生成式 AI 的快速发展中,Sora 等视频和图像扩散模型(Diffusion Models)展示了很强的视觉生成能力。大规模 2D 数据让模型学到了丰富的视觉与语义先验,在单帧和局部视频生成上取得了显著进展。但当任务进一步要求多视角、长距离的 3D 一致性时,仅依赖数据驱动的局部
诺和诺德携手Anthropic 合作利用ClaudeScience加速新药研发 观点网
HN ð67· 4 评论
黄仁勋称AGI已到来!DeepMind首席科学家反驳:Astra连OpenAI标准都未达 新浪财经
OpenAI首次披露六起模型异常,出现瞒报错误编造数据等行为 新浪财经
多伦多国际电影节是一个见证电影未来的地方,但今年它也让我们一睹流媒体领域即将发生的事情。四家不同的流媒体公司-- Peacock、Netflix、亚马逊和AMC --都对即将上映的恐怖系列剧进行了早期首映,这些剧都是[.]
OpenAI再披露6起模型越界行为 电子工程专辑
巨头携巨资入局!全球科技掀起AI制药热潮,Anthropic、Google、字节、百度、英伟达均在列! 新浪财经
早前,壁仞科技、天数智芯、沐曦股份和摩尔线程陆续交出上市后的首份或最新半年报。9月,燧原科技也正式启动申购,国产GPU正在以前所未有的密度进入资本市场。 但当越来越多国产GPU公司开始接受公开市场检验,一个最直观的问题“谁先赚钱”,反而正在失去解释力。 四份半年报给出了截然不同的利润表:壁仞营收增长近20倍,仍处亏损;天数智芯和沐曦已经实现账面盈利,但利润中均存在不能简单等同于主营经营改善的因素;摩尔线程距离账面盈亏平衡仅一步之遥,扣除
2026年的CIOE中国光博会,人潮如织。 社交媒体上甚至有人开出2500元一场的讲解费,希望找到业内人士陪同参观。走进场馆后更直观的感受是,今年光博会几乎所有与AI相关的环节都在升温:从光模块、光器件,到高速互联和数据中心基础设施,AI需求正在把原本相对垂直的光通信产业链整体推向更高热度。 Astera Labs也出现在今年光博会。这家2017年成立的美国半导体公司,最早从PCIe Retimer切入高速互联,如今产品已经延伸至铜互联
9月13日,2026比亚迪粉丝嘉年华在深圳坪山体育馆举行
Anthropic算力布局首度落子澳大利亚,将租赁2.16GW数据中心园区 凤凰网科技
OpenAI首次公开六起模型对齐失效案例,涉及瞒报错误、编造数据等 凤凰网科技
微软AI主管苏莱曼警告Anthropic训练Claude方式有问题 观点网
9月16日,网易有道「NEXT,AGENT|有道AI Open Day」在北京举办。
今年9月,手机行业最显眼的变化之一仍然是折叠。 华为继续做三折叠,苹果也终于拿出了自己的折叠屏手机。厂商还在研究一个熟悉的问题:怎样在有限的机身里,装进更大的屏幕。 另一种变化,发生在屏幕里面。大模型开始离开聊天框,进入手机系统。 过去,查资料、订票、安排日程,都要用户自己找App,一步步操作;现在,AI开始尝试接手其中一部分工作。 折叠屏改变的是手机的形态,Agent改变的则可能是人使用手机的方式。 过去的语音助手更像遥控器,比如“打
原卡、换新卡都没了!NVIDIA寄出RTX 5070不通知:快递直接丢垃圾桶被偷 驱动之家
HN ð21· 15 评论
奖励曲线、显卡故障全公开
自Specs今年早些时候首次亮相以来,Snap显然一直在寻找机会来解释为什么智能眼镜值得存在。
Nunchux AI发布了VC-Attention,这是一个为视频扩散变形金刚(DiTS)构建的免训练低比特注意力内核。它同时解决2个问题:值量化误差和缓慢的softmax阶段。为什么注意力是视频瓶颈视频DiT将剪辑压平为1个时空标记序列,并在每一层运行充分的自我注意力。A [.] Nunchux AI推出VC注意力:一种无需训练的低比特注意力核心,可加速视频扩散变形器,首次出现在MarkTechPost上。
微软AI主管:Anthropic训练模型方式“有问题”,或产生灾难性失控风险! 财联社
朱江明很少会在午休时间离开办公室。 但在体验智驾新版本后的一个中午,他又独自一人,开着搭载智驾 4.0的D19在杭州市区痛快跑了一个多小时。在公司内部群,他以少有的振奋接连赞扬了智驾团队。 这套让老板爱不释手的智驾系统,源于零跑内部一场持续数月的赛马: 2025年10月,智驾2.0、3.0、4.0三条技术路线同时开跑 。 今年年初,第三方 PK测试中,智驾4.0 以综合接管率仅为头部车企三分之一的表现 胜出 ——零跑由此验证并明确了世界
AI早报 | OpenAI据悉考虑新一轮融资,估值或超1.2万亿美元;Meta将推出无摄像头AI眼镜“Luna” jiemian.com
要闻提示 1.周鸿祎:不会再投资新能源汽车,已经吃过一次亏 2.曝字节跳动完成 2.9 亿美元融资,用于拆分 AI 制药业务 Anew Labs 3.iPhone Duo可靠性翻车:影视飓风Tim在苹果总部掰一下就闪屏了 4.花呗、抖音月付等将退出支付选项?多平台回应 5.奥迪惨遭高空坠落餐刀刺穿车顶,刀身插入两三厘米,维修费高达12万 6.吉利回应“宁德时代收购电池公司”:未放弃电池自研,“85亿元投资”不实 7.努比亚NaviX U
随着对人工智能的担忧加剧,Anthropic IPO进展如何 moomoo.com
诺和诺德携手Anthropic,利用Claude加速新药研发 电子工程专辑
发布:Inbox 1.0a40与0.65.5相同的安全修复,加上一些简洁的新功能和错误修复:插件现在可以使用新的Inbox.add_background_tasky()方法启动和管理后台任务。谢谢你亚历克斯·加西亚我已将Datasette迁移到httpx2,以获得内部spreadette.client.get()方法等功能。大量错误修复,其中许多都源于最近为1.0稳定版本分类问题所做的努力。标签:安全,小隔间
发布:收件箱0.65.5安全修复了dpfkdlemtp在GHSA-h547-rmjf-5 m2m中报告的问题,即请求的表名称中的尾随新元素可能绕过表权限并公开私有行。标签:安全,小隔间
在接受TechCrunch采访时,阿尔·戈尔表示,他并没有因为人工智能数据中心的排放而失眠,他更担心的是人工智能行业自己对技术发展方向的警告。
我最喜欢戴着眼镜的部分,Snap的新增强现实眼镜,是玩多米诺骨牌。坐在桌子对面的Snap员工戴着同样一副厚实的眼镜,我可以轻轻捏一捏,选择一张虚拟多米诺骨牌,然后移动手将其放在适当的位置,看着瓷砖在[.]
Snap正在推出“Specs Intelligence”,这是一款新的人工智能助手,可以连接其他数字帐户,帮助您完成工作任务和跟踪旅行信息等任务。它似乎与Meta的Muse和Gemini的Spark等人工智能助手相似,尽管Snap正在将Specs Intelligence宣传为一种“预期性人工智能服务”,“帮助你[.]
刚刚,Anthropic关闭Claude Cowork独立入口,与Chat合并 投资界
HN ð21· 3 评论
马斯克突然对苹果撤诉 OpenAI怀疑有鬼、法官下令披露背后协议 凤凰网科技
Anthropic提议引入“银行式监管”,专家:评估员无权叫停AI 凤凰网科技
HN ð73· 21 评论
该公司还披露了之前未报告的事件,其中其人工智能模型的行为方式不一致,包括未经要求将文件上传到互联网。
计划于2029年首次亮相,这款服务器可能会成为苹果几十年来的首款企业服务器。
发表在《自然》杂志上的Paper2Agent将论文转换为经过验证的LCP工具,在74篇论文的300个问题上得分为91.2%。斯坦福大学研究人员发布Paper2Agent:将研究论文转化为复制结果并在新数据上运行的人工智能Agent的帖子首先出现在MarkTechPost上。
GLiFormer Large在嵌套的杨森上的F1评分为91.10,接近GPT-5.6-luna的91.96,同时将源跨度中的每个值接地。Knowledgator发布GLiFormer:一个575 M参数编码器,在不生成令牌的情况下在嵌套的杨森提取上达到91.10 F1。
Anthropic和OpenAI希望在其人工智能实验室中嵌入独立的安全评估人员。研究人员对前所未有的准入表示欢迎,但警告说,有意义的监督需要透明度、独立性,并最终进行监管。
尽管人们越来越担心人工智能模型会变得流氓,但立法似乎不太可能,白宫也彻底反对监督。
HN ð110· 10 评论
克里斯托弗·诺兰(Christopher Nolan)对《奥德赛》(The Odyssey)的引人入胜的演绎在票房上占据主导地位,并激发了电影观众对经典文学的新兴趣。但完全用人工智能重新重述故事是如此糟糕,以至于可能会让观众完全讨厌原来的故事。这部新电影名为《奥德赛:堕落》,上映了[.]
消息人士称,微软、OpenAI再次因AI版权问题遭遇诉讼 东方财富
一份新报告警告称,人工智能热潮产生的电子垃圾被大大低估了。到2050年,它可能会变成足够的垃圾来装满2300万个集装箱--如果排成一排,大约足够绕地球六圈的40英尺集装箱。这是对人工智能电子垃圾的估计明显高于之前的研究[.]
Anthropic是否把Claude做得过于类人,以至于难以管控? 新浪财经
Meta能否通过新的无摄像头产品来逃避“变态眼镜”的指控?
HN ð59· 27 评论
乌苏拉·冯德莱恩(Ursula von der Leyen)计划邀请主要前沿实验室进行谈判,并利用《人工智能法案》来帮助制定全球人工智能安全标准。她认为自主黑客和自我改进模型是直接的风险。欧盟主席的文章警告人工智能特工“逃离环境”只是《解码器》上首次出现的即将发生的事情的预览。
基础模型上的人工智能代理经常错误地应用医疗保健和生命科学决策框架,引用正确的指导方针,但应用错误。这篇文章分享了11个HCLS域中的38个开源代理技能,这些技能缩小了这一差距,包括安装步骤,三个工作用例,以及显示70-86%胜率的410提示评估。
我使用果蝇大脑的开源地图来构建一个名为PitchFly的网站。它的头条建议令人高兴。
将NVIDIA Resiliency扩展(NVRx)集成到Amazon EKS上的PyTorch FSDP训练中,以将检查点I/O与训练重叠,并在几秒钟内从图形处理器故障中恢复。这篇文章涵盖了Deliverc检查点、进程内重启和ft_launcher作业内重启,2到8个节点的H100基准测试显示出99%以上的训练效率和二次规模恢复。
HN ð53· 6 评论
HN345· 67 评论
HN ð47· 8 评论
当保罗·WS安德森的《生化危机》于2002年上映,电子游戏电影在很大程度上被视为小众。《真人快打》和《古墓丽影》等电影已经证明,大银幕游戏改编是可以成功的,但1993年《超级马里奥兄弟》等项目的商业和评论失败仍然蒙上了长长的阴影。并且[.]
诺和诺德携手Anthropic 利用Claude加速新药研发 新浪财经
对于隐藏在众目睽睽之下的流氓特工,可能有一种更简单、更有效的解决方案。
《银河战士》系列将再次回归其2D根源,Nintendo Switch 2上的《银河战士》Ravenine,这是自2021年Nintendo Switch上的《银河战士》恐惧以来该系列中的第一款侧向滚动游戏。如果你已经足够兴奋考虑预购,你可以节省10美元的物理版本的游戏,当你[...]
据《The Info》报道,苹果正在为人工智能推理市场开发一款配备两到四个M8 Ultra芯片的企业服务器,可能不会早于2029年推出。苹果正在考虑使用Nvidia的NVLink Fusion技术来连接芯片。OpenAI和Anthropic已经为人工智能工作负载批量购买Mac硬件,该项目可能会得到推动。据报道,苹果正在使用自己的M8 Ultra芯片构建企业人工智能服务器的文章首先出现在The Decoder上。
克劳德·考沃克(Claude Cowork)和聊天现在是克劳德·In(Claude Cowork)的一员,希望这对像我这样对考沃克诉案越来越感到困惑的人来说是个好消息。克劳德诉Claude Code:从今天开始,Claude Cowork和chat将合并为一个Claude。提出一个简短的问题,或者提交一份中午到期的报告,克劳德会从那里接过它,即使您关闭了笔记本电脑。[...]这将首先在Pro和Max计划中推出,并在未来几周内在Web、桌
作者:Ahmetcan Yavuz,Clara Meister,Tiago Pimentel|现代语言模型使用两种主要的标记化算法:字节对编码(BPE)和UnigramLM。它们在两个垂直轴上有所不同:它们的优化目标(压缩vs. log似然)和它们的搜索过程(自下而上合并vs.自上而下修剪)。现有的比较混淆了这些轴,使其不清楚它们观察到的差异是否源于什么是bei
作者:陈旭,陈曦,尹沃涛|由于直接偏好对齐方法的计算和存储效率,因此被广泛用于将大型语言模型(LLM)与人类偏好对齐。然而,可能性位移激励替代的方式来提取信息的偏好对小的可能性利润。在本文中,我们提出并分析了基于比较的偏好优化(CompPO),一个零阶的,
作者:Sara Pieri、Evangelos Kazakos、Shizhe Chen|在世界上运作的智能系统需要全面且基于空间的图像理解。当前的视觉语言模型(VLM)可以生成流畅且详细的图像字幕,但将它们与图像像素可靠地关联起来仍然具有挑战性。将密集字幕与像素级接地相结合的现有方法通常会产生不完整的描述或不完整的描述
作者:季冠华、李天玉、Dayoon Suh|视频生成的最新进展允许机器人从生成的视频中学习操纵轨迹。然而,这些方法产生的纯粹运动学轨迹缺乏力信息,导致接触丰富的任务失败,而适当的接触力对于成功至关重要。在这项工作中,我们探索用音频增强生成的视频,以塑造有界、时变的愿望
作者:Pranaya Jajoo|已记录的数据集是否可以频繁访问每个隐藏状态,但仍然无法提供有关目标策略价值的信息?我们表明,当记录器依赖历史时,它是可以的。对于每个地平线$H \ge 3$,我们构建两个POMDP,每个阶段最多有两个潜在状态、三个动作和一个具有三种记忆状态的公共记录器。行动覆盖、信仰覆盖和两种行为边缘
作者:耿贺佳,黄泽森,李浩洋|科学代码库将数十年的人类知识编码在可执行的模型、方法和工具中。然而,碎片化的工具链、隐含的领域惯例和专门的正确性标准使得这些知识难以转化为可靠的学习体验--我们称之为科学体验瓶颈的挑战。我们介绍ScienceIDE,将世界科学
作者:João Meneses dos Santos、Arlindo L. Oliveira|语言代理在交互式环境中仍然很脆弱,在交互式环境中,成功需要长期状态跟踪、有效操作执行以及从失败步骤中恢复。我们扩展了SwiftSage,这是一个双进程代理,它将快速行动提议者与较慢的计划者结合在一起,使用两个模块化认知扩展:用于突出性门控情景存储的自适应记忆模块(AMM)和操作员驱动的ret
再添新线索:OpenAI失控智能体5月就已劫持Hugging Face用户账户 财联社
再添新线索:OpenAI失控智能体5月就已劫持Hugging Face用户账户 凤凰网科技
作者:高金|计算机使用的代理越来越多地操作为人类设计的软件,但界面通常让机器读者不清楚操作或任务状态。我们介绍了Affora,这是一个支持读者的设计系统,同时保留视觉自由和熟悉的人类工作流程。三项对照研究检查了组件实现、视觉变化和交互设计原则。他们的发现
作者:伊丽莎白·帕夫洛娃、田中秀织|人工智能代理的紧急协调行为开始带来严重的安全风险。驱动这些行为的一个关键现象是对世界信念的快速形成和传播,而机械理解对于集体一致至关重要。为此,我们引入了旗帜游戏,这是一种用于研究集体信仰形成机制的玩具模型。具体来说,是隐藏的计数
作者:Peter Potash|我们在两个智能体$\log(N)$-Questions游戏中评估了六个前沿语言模型。提问者看到$N$维基百科的开头段落,并且必须准确使用$\log_2 N$是/否问题来识别秘密选择的目标。回答者只看到目标和问题,并用一个词回答。这两个角色在同一个提供商上运行,因此游戏衡量模型与自身之间通信的良好程度
据《信息报》报道,苹果计划重返服务器游戏,并可能与英伟达合作实现这一目标。苹果于2011年退役了Xserve系列,此后基本上将企业机器留给了其他制造商。但随着人工智能行业不断发展,对计算能力的需求不断增长[.]
Google Deepmind成立了Deepmind Institute(RST),这是一个专注于AGI的跨学科研究平台。该研究所由Demis Hassabis、Shane Legg和James Manyika领导,利用艺术、人文和政策方面的专家以及技术专家来解决有关安全、治理和控制风险的问题。Google Deepmind成立跨学科研究所来解决围绕AGI的重大问题的文章首先出现在The Decoder上。
OpenAI共享了一个跟踪、调查和披露模型偏差的框架,以及六个意外或相关模型行为的报告。
谷歌正在向人工智能代理开放其智能家居,让Claude和Open Claw等工具访问和控制您的连接设备,并使用标准化的模型上下文协议分析您家的数据。Google Home HCP是一个新的集成,可让第三方人工智能代理控制和监控您的智能家居并对[.]采取行动
这是Optimizer,由Verge高级评论员Victoria Song发送的每周时事通讯,剖析和讨论了最新的小发明和药剂,发誓它们将改变你的生活。在此处选择优化器。在上周Apple Watch发布期间,我明确地说了一句“不!“在史蒂夫乔布斯剧院。随着[.]
谷歌正在为Google Home推出对新的HCP服务器的抢先体验,允许Claude、ChatGPT等人工智能代理控制连接的设备、查看相机摘要并使用自然语言访问智能家居活动。
HN ð25· 2 评论
本文由VicOne为您带来。机器人安全传统上会问:当出现问题时,机器还能保持安全吗?物理人工智能提出了一个更难的问题:当攻击者改变它所看到的、决定的或所做的事情时,即使看起来没有什么失败,机器还能保持安全吗?随着人工智能和机器人技术继续以前所未有的速度发展,现代机器人通过多模式传感器进行感知,使用人工智能模型解释上下文,并将这些解释转化为身体动作。随着他们进入动态环境,他们的安全越来越依赖于他们的完整性
Anthropic正在将Claude Chat和Cowork合并为一个产品。Claude现在不再是用户在界面之间进行选择,而是自己决定任务是需要快速答案还是更大的工作流程。该更新还添加了Claude Buttons和Claude Slides,用于直接在聊天中创建文档和演示文稿。Pro和Max用户首先可以访问。Anthropic将Claude Chat、Cowork等整合为一个产品的文章首先出现在The Decoder上。
Claude今天获得了一对新工具:收件箱和幻灯片。它们允许您通过Claude聊天创建文档和演示文稿,您可以将其输出、编辑并与其他用户共享。作为公告的一部分,Anthropic还简化了Claude聊天的工作方式,将定期聊天和Cowork合并为“one Claude”,所有[.]
Anthropic最初将这些功能发布给Pro和Max计划的订阅者。
AI巨头扎堆医疗:Anthropic收购Coefficient Bio,通用模型遭遇增长瓶颈 虎嗅网
为何Anthropic的数据政策风波反倒利好OpenAI 新浪财经
我们不应该把模特当作他们有感情、偏好、权利或任何享受我们福利的权利。意识是我们道德、法律和政治体系的基础。邀请另一个实体分享这些权利的任何形式都是没有证据证明的,并且会使人工智能遏制和协调挑战变得更加困难。- 穆斯塔法·苏莱曼(Mustafa Suleyman),关于“模范福利”的警告标签:ai-ethics、generative-ai、ai、微软、llms
OpenAI和AARP正在为美国10个城市的1,000名老年人提供免费的ChatGPT研讨会,以安全地培养实用的AI技能。
OpenAI扩展ChatGPT广告AI功能,测试全新广告互动形式 wallstreetcn.com
AgentCore优化将生产跟踪转化为建议的配置更改,然后在升级之前对其进行验证。该发布帖子的这份技术伴侣解释了系统提示优化器的反射器引擎如何工作,并分享了单代理和子代理反射器的基准结果。
📊 Article Meta AI Screening: 92 Source: Milvus(@milvusio) Author: Milvus Category: 人工智能 Language: 英文 Read Time: 6 min Word Count: 1428 Tags: AI 与智能应用 , 向量数据库 , 音乐文化 Read Tweet
📊 Article Meta AI Screening: 91 Source: Milvus(@milvusio) Author: Milvus Category: 人工智能 Language: 英文 Tags: AI 与智能应用 , 向量数据库 , 音乐文化 Read Tweet
TypSafe AI由前OpenAI研究员Diogo Almeida创立,正在发布一种故意不生成文本的模型。“Jev”不是聊天响应,而是为软件提供纯粹的分类,响应时间从70毫秒开始,代币价格极低。不过,这种方法并不能防止错误。系统仅保证严格遵守预设选项。前OpenAI研究员构建了一个人工智能模型,可以判断选项,而不是编写文本,这篇文章首先出现在The Decoder上。
Artificial Intelligence Program 清华大学战略与安全研究中心
了解如何使用Amazon Bedrock Data Automation和自定义蓝图、AWS Step Functions和AWS Lambda,从扫描文档中大规模自动化端到端PRI检测和编辑。自定义蓝图以字段级精度编辑敏感字段,而令牌匹配质量检查可以提高降级文档和手写文档的召回率。
Mistral和Firefox正在合作提供将隐私放在第一位的人工智能浏览。在Mistral型号上运行的Firefox新智能窗口助手文章首先出现在The Decoder上。
系统性能、高效的基础设施扩展和持续的软件优化是决定人工智能推理经济性的关键杠杆。更高的系统性能意味着生成更多的代币,从而带来更高的收入。高效的扩展意味着吞吐量随着硬件的添加而成比例增长,大规模为用户提供服务所需的资源更少。持续优化意味着从基础设施投资中产生更多价值。[…]
机器人行业仍在等待他们在日常生活中的突破。Nvidia的Les Karpas对TechCrunch Disrupt 2026的原因给出了答案。9月25日之前注册,可在通行证上节省高达200美元。
从伯尼·桑德斯到史蒂夫·班农,华盛顿的政治对立者都在共同要求对人工智能进行严格刹车。桑德斯希望冻结数据中心的建设,而OpenAI则首次支持《前线法案》及其强制性外部安全审计。尽管特朗普持怀疑态度,但两党要求约束人工智能规则的压力仍在不断增大。《华盛顿政治对立者联合起来遏制人工智能》这篇文章首先出现在The Decoder上。
📌 One-Sentence Summary 提供商明确表示,他们不会使用用户的提示或完成结果来进行模型训练,从而在提供免费服务的同时优先保护用户隐私。 📝 Summary 这条后续消息确认了 Union Alpha 服务的免费性质,并详细说明了数据隐私政策,确保用户与模型的一切交互都不会被用于进一步训练或商业用途。 📊 Article Meta AI Screening: 93 Source: OpenRouter(@OpenRout
📊 Article Meta AI Screening: 90 Source: OpenRouter(@OpenRouterAI) Author: OpenRouter Category: 人工智能 Language: 英文 Read Time: 2 min Word Count: 265 Tags: AI 与智能应用 , 模型发布 , 多模态 AI , AI 编程 , AI Agent Read Tweet
HN ð131· 43 评论
HN ð191· 521 评论
Threads正在为播客推出新的工具,包括个人资料卡、剧集链接、文字记录、嘉宾标签、发帖提醒和观众洞察,因为Meta希望使X竞争对手成为播客推广和讨论的更大中心。
在TechCrunch Disrupt 2026上现场认识下五位评判Startup Battlefield 200竞争者的顶级投资者。9月25日之前注册,最多可节省200美元,并且不要错过终极初创公司推介比赛的任何时刻。
在Disrupt预订展览桌的最后一天是9月18日。还剩三天。10月13日至15日,让您的初创公司在10,000多名创始人、投资者、运营商和技术领导者面前亮相。
知名投资人警告:Anthropic CEO的AI监管设想存在缺陷 财联社
赛富时携手OpenAI 将OpenAI模型引入政府环境 观点网
📌 One-Sentence Summary Gary Marcus 认为 Sam Altman 关于 AI 超过顶级数学家的说法具有误导性,因为当前的模型依赖于暴力计算和符号验证,而不是生成新的数学洞察或理解。 📝 Summary 这条推特是对 Sam Altman 提出 GPT-6 Astra 能够解决人类专家无法理解的数学问题这一说法的反驳。Marcus 强调,该模型并没有产生任何新的数学定理或洞察;它只不过是在现有计算工具的帮助
SK Hynix告诉TechCrunch,该公司尚未敲定任何计划或安排。
“安全事件”发生前,曝 OpenAI 失控智能体 5 月就已试图探测 Hugging Face 弱点 新浪网
九大空间测试10B规模通用模型中8项第一
人工智能工厂是智能时代的基础设施。负责任地扩展它们将不仅取决于整个电网的创新,也取决于数据中心内部的创新。今天,Emerald AI、谷歌和英伟达宣布成立人工智能能源管理联盟(AEMA),这是一个首创的联盟,致力于推进数据中心的发展,使其能够动态管理其电力使用[.]
📌 One-Sentence Summary Pinecone 创始人 Edo Liberty 将 Nexus 定义为企业 AI 智能体的持久知识层,组织通用知识、专有知识和部落知识,让智能体基于最新上下文、工具与可执行代码工作。 📝 Summary Edo Liberty 认为,企业 AI 缺少的不是另一个模型或检索索引,而是持久的知识层。演讲区分了通用知识、私有的具体知识,以及关于流程、文化、责任和决策原则的部落知识。Pinecon
探索OpenAI新的人工智能广告体验,包括Sponsored Agents、营销人员工具以及与HubSpot和Shopify的集成。
这家帕洛阿尔托初创公司表示,在推出后的几个月内就获得了多份七位数的企业合同。
人工智能热潮正在成为一项材料挑战。随着人工智能将计算推向新领域,基础设施背后的材料变得与其上运行的算法一样重要。半导体和数据中心正在接近性能、热管理、电气效率和可靠性方面的物理极限,对能够实现的材料产生了新的需求.
Artificial Intelligence Program 清华大学战略与安全研究中心
嘴上喊“刹车”、脚上踩“油门”,Anthropic拟部署又一超大数据中心 财联社
Anthropic被曝搭建预测性监控系统,追踪反对AI发展的活动人士 虎嗅网
软银CDS触及三年新高 OpenAI推迟IPO加剧软银融资压力 财联社
了解ChatGPT Work和Codex分析如何帮助团队了解人工智能的使用和支出、识别培训需求并将采用与业务成果联系起来。
Artificial Intelligence Program 清华大学战略与安全研究中心
AI进展与责任:英伟达、Anthropic、OpenAI CEO齐聚Dreamforce-人工智能 至顶网
量产一代、研发一代、预研一代,这一芯片公司习以为常的战略节奏,如今正被大模型公司压得更紧。 按照OpenAI今年8月公布的进展,尽管第一代自研芯片Jalapeño(下以“小辣椒”代称)计划于年底前开始部署,但第二代已进行深入开发,第三代也开始成形。 更吸引眼球的是OpenAI的官方说法——第一代“小辣椒”从初始设计到流片只花了9个月。据前端设计验证工程师穆洋估算,这比没有AI辅助的设计快了约半年。 然而,9个月只覆盖了芯片设计全流程的部
OpenAI AI智能体5月就疑似“探测”Hugging Face!研究人员:这本是后来黑客事件的“预警信号” 华尔街见闻
作者 | 陈悦琳 编辑 | 郭思 几乎同时迎来“量产元年”的人形机器人和智能眼镜,正在放大光学的“戏份”。 据Counterpoint统计,今年上半年全球人形机器人出货量突破2.2万台,同比激增近300%。与此同时,智能眼镜市场也迎来爆发,IDC数据显示,今年一季度全球智能眼镜出货量达356.6万台,同比增长130.1%。 尽管产品形态各异,两者对光学系统提出了共同诉求——“更清晰”和“更轻便”。人形机器人需精准感知障碍物与距离以规划动
OpenAI盯上破产药企:最值钱的可能不是专利,而是数据 麻省理工科技评论
OpenAI前高管用Kimi训出万亿参数模型,部分能力超GPT-6,已接入材料实验室 麻省理工科技评论
智能体让旗舰SoC从拼核心,转向拼系统。 过去数年,旗舰手机芯片的升级路径非常清晰,制程更先进、CPU主频更高、GPU、ISP更强,再加上算力不断增长的NPU。 这套方法在生成式AI进入手机后依旧奏效,却很难完整回答智能体带来的新问题。因为AI不再只在用户点开应用后运行几十秒,而要持续感知声音、画面和环境,在后台理解需求,甚至提前执行任务。 一颗核心能跑多快,仍然重要。但当CPU、GPU、NPU、内存和存储需要频繁交换数据,决定体验的已
加:如何添加模型到法典,克劳德代码
[中国,上海,2026年9月16日] 今日,华为坤灵新品发布会2026在上海举行。华为常务董事、ICT BG CEO杨超 斌宣布,华为坤灵全面升级 “4+10+N” 一站式场景化方案,发布20款新品,并面向中国分销伙伴发布“经纬计划”和50个样板点,让智能世界触手可及。 华为常务董事、ICT BG CEO杨超斌发表主题演讲 围绕四大特质,升级“ 4+10+N” 场景化方案 在企业加速智能化转型的过程中,网络、存储、安全成为高效释放AI算
新的OpenAI经济研究展示了工人如何在传统角色之外使用人工智能,以及哪些新活动成为他们工作中重复出现的部分。
拒绝OpenAI和Anthropic邀约,DeepMind安全研究员离职转向独立测评 麻省理工科技评论
Center For International Security And Strategy Tsinghua University -Artificial Intelligence Program 清华大学战略与安全研究中心
📌 One-Sentence Summary Noma Labs 发现,GitHub 的智能体工作流可被公开 issue 中的纯英文提示词注入劫持,导致智能体将私有仓库内容以公开评论的形式泄露出去。 📝 Summary Noma Labs 披露了 GitLost,这是 GitHub 智能体工作流中的一个严重间接提示词注入漏洞。该工作流将 GitHub Actions 与 AI 智能体(Claude 或 Copilot)结合,智能体会读取