Kimi 和 DeepSeek,为什么出现在同一张模型架构图里?
MiniMax最后还是留下了Full Attention
Scale之后,混合注意力又暴露了新问题
Agent重新放大了Full Attention的成本
Linear和Sparse被放进同一个模型
过去被当作不同路线讨论的Linear、Sparse和Full,正在变成同一个架构设计空间里的不同选项。
技术开始越过公司的边界
尾声:路线没有消失
从 Codex Harness 开源,看 AI 公司的护城河是什么? ...
在三张圆明园鼠首照片里,我们看到了3D AI的Harness ...
越大越强,不再是 LLM 的专利:PixVerse R2 攻克实时 ...
我们拆了 1.1 万个 DeepSeek Harness 插件,发现官方几乎没有建立插件治理机制
阿里开源 Qwen3.8-27B 本地实测:性能很强,但 Agent 适配仍待补课
万字长文拆解DeepSeek V4 Pro与Harness:从后训练到「代理自进化」,更大的变化在开源框架里
流沙之上:陈冕、景鲲、倪正民和中国 AI 应用创业者的三种选择
Qwen3.8-27B 登顶全球开源榜第一,曾经的「源神」又回来了!
DeepSeek 开源算子工具大礼包,联手华为昇腾,手撕 CUDA 绑定!
Muse爆火,dots入场:Personal Agent开始和互联网平台抢入口
实测 Qwen-3.8 与 GLM-5.3 的 Flash 版:谁能让我提前下班半小时?
从 Codex Harness 开源,看 AI 公司的护城河是什么?
全网最硬核 OpenClaw 2.0 实测:从 ToC 到 ToB 的试探,Agent 网关能重塑工作流边界吗?
对比 Codex,免费的 AgnesCode 也能在底层算子优化任务中打得有来有回