// FEATURED
精选 Featured
-
ARTICLE LLM
GLM-5.2 / Kimi K3 / DeepSeek V4 三份技术报告拆解:后训练吃掉 75% 算力
逐字读完 GLM-5、Kimi K3、DeepSeek V4 三份技术报告:架构分道扬镳,训练管线殊途同归。K3 算力账本显示后训练吃掉约 75% 总算力、MFU 仅 27%——预训练已不是主战场。
-
ARTICLE Codex
Code Agent 是如何处理视频的
把视频交给 Codex,它并不会直接把 mp4 交给模型看,却仍可能把任务做完。对照 Codex、Claude Code、Pi、Grok Build 源码:四家都不会直接看视频,差在拒绝方式与生成/播放。
-
ARTICLE Claude Code
三方上下文压缩机制对比 · 附完整源码
Claude Code、Codex、Pi 三者的上下文压缩,差异不在参数,而在缓存、结构、边界三个取舍上——参数趋同只是表象。
// TOPICS