AI 日报hiw3c.com

深度解读 DeepSeek V4.1 Flash 全新架构,如何成为显存杀手

雷峰网·AI 科技评论 www.leiphone.com 网页快照

深度解读 DeepSeek V4.1 Flash 全新架构,如何成为显存杀手

CED架构:把百万上下文“读薄”,

预填充算力砍半

CED 解决 “读得慢”,

CSA2 解决 “存不下”

Full模式擅长总结,它通读全部上下文,生成完整KV和索引,筛选出Top-K重点条目;

Reindex模式,不再自己去存储庞大的缓存记忆,会直接拿Full完整模式生成的完整 KV 缓存记忆,按照自己的理解,重新筛选重点;

Reuse模式,拿到上面的编辑,直接开始干活,完全跳过复杂的索引计算。

创新架构,

重新定义大模型的竞争维度

GLM-5.3 来了:底座没换,编程暴涨 50%,还顺手揪出潜伏 40 年的世界级漏洞

DeepSeek Harness 入选项目疑似曝光,不选万星「花瓶」,死磕 Agent 基建

GPT-6 砍掉思考 Token,俄罗斯人砍掉通信 Token,Token 经济开始崩了?

「说 Harness 会被淘汰的,肯定没做过工程」,Kimi 前 CLI 负责人戳破了 AI 圈最大的误解

DeepSeek 为什么把缓存涨了 11 倍?长上下文需求暴涨,得交点「存储税」了

打穿 AI 智商测试!GPT-6 Astra 的符号世界模型,是突破还是钞能力刷分?

GPT-6 砍掉思考 Token,俄罗斯人砍掉通信 Token,Token 经济开始崩了?

流沙之上:陈冕、景鲲、倪正民和中国 AI 应用创业者的三种选择

我们拆了 1.1 万个 DeepSeek Harness 插件,发现官方几乎没有建立插件治理机制

万字长文拆解DeepSeek V4 Pro与Harness:从后训练到「代理自进化」,更大的变化在开源框架里

GLM 5.3 更强却更难用了?我们让它和 5.2 做了同一个北京城市驾驶游戏