AI 日报hiw3c.com

Kimi 和 DeepSeek,为什么出现在同一张模型架构图里?

雷峰网·AI 科技评论 www.leiphone.com 网页快照

Kimi 和 DeepSeek,为什么出现在同一张模型架构图里?

MiniMax最后还是留下了Full Attention

Scale之后,混合注意力又暴露了新问题

Agent重新放大了Full Attention的成本

Linear和Sparse被放进同一个模型

过去被当作不同路线讨论的Linear、Sparse和Full,正在变成同一个架构设计空间里的不同选项。

技术开始越过公司的边界

尾声:路线没有消失

从 Codex Harness 开源,看 AI 公司的护城河是什么? ...

在三张圆明园鼠首照片里,我们看到了3D AI的Harness ...

越大越强,不再是 LLM 的专利:PixVerse R2 攻克实时 ...

我们拆了 1.1 万个 DeepSeek Harness 插件,发现官方几乎没有建立插件治理机制

阿里开源 Qwen3.8-27B 本地实测:性能很强,但 Agent 适配仍待补课

万字长文拆解DeepSeek V4 Pro与Harness:从后训练到「代理自进化」,更大的变化在开源框架里

流沙之上:陈冕、景鲲、倪正民和中国 AI 应用创业者的三种选择

Qwen3.8-27B 登顶全球开源榜第一,曾经的「源神」又回来了!

DeepSeek 开源算子工具大礼包,联手华为昇腾,手撕 CUDA 绑定!

Muse爆火,dots入场:Personal Agent开始和互联网平台抢入口

实测 Qwen-3.8 与 GLM-5.3 的 Flash 版:谁能让我提前下班半小时?

从 Codex Harness 开源,看 AI 公司的护城河是什么?

全网最硬核 OpenClaw 2.0 实测:从 ToC 到 ToB 的试探,Agent 网关能重塑工作流边界吗?

对比 Codex,免费的 AgnesCode 也能在底层算子优化任务中打得有来有回