精选推文 · 中文解读

卡帕西的 X 账号(@karpathy,2009 年至今约 1 万条帖子)是这个时代 AI 话语的发源地之一。我们只做两件事:精选真正改变行业讨论的那几十条,为每条写原创中文解读(背景 + 转述 + 短引用 + 后续影响)。新爆款推文目标 48 小时内更新。

70 条精选27 条已排期解读持续更新

2026

日期主题解读
2026-05宣布加入 Anthropic 预训练团队——1 小时 300 万浏览 中文解读 · 原推
2026-02「过去两个月编程变化之大难以言表」:coding agents 从不可用到可用 中文解读 · 原推
2026-02vibe coding 一周年回顾原推
2026-01Claude coding 笔记:从 80% 手写到 80% agent 中文解读 · 原推
2026-04LLM 知识库 / idea file:分享想法,让对方的 agent 自己建跟帖

2025

日期主题解读
2025-02造词「vibe coding」——450 万浏览,年度科技词汇 中文解读 · 原推
2025-12「从没觉得自己这么落后过」——agentic 时代的技能焦虑长推 中文解读 · 原推
2025-10nanochat 发布:「$100 能买到的最好的 ChatGPT」 中文解读 · 原推
2025-10「我们在召唤幽灵,不是养动物」——回应 Sutton 中文解读 · 原推
2025-10Dwarkesh 访谈澄清帖:AGI 还有十年、march of nines 中文解读 · 原推
2025-10评 DeepSeek-OCR:像素可能优于 text tokens,tokenizer 必须消失 中文解读 · 原推
2025-06Software 3.0 / YC 演讲配套推:people spirits、autonomy slider 中文解读 · 原推
2025-06支持「context engineering」取代「prompt engineering」 中文解读 · 原推
2025-01「是智能体十年,不是智能体元年」 中文解读 · 原推
2025-07对 scaling RL 的怀疑(用吸管吸取监督信号)原推
2025-11用 LLM 三遍读书法 + reader3 工具原推
2025-11Gemini 3 评测 +「不相信现在是 2025」事件原推
2025-11llm-council:多模型互评的周末项目原推
2025-03vibe code 了整个 iOS 应用原推
2025-03睡眠追踪设备四强对比(Whoop ≥ Oura > 8Sleep ≫ Apple Watch)原推
2025-02《深入 ChatGPT 这样的 LLM》视频发布原推
2025-02Grok 3 vibe check——「vibe check」成评测流行语原推

2024

日期主题解读
2024-02长文「学习的短视频化」:学习不该是娱乐,应该像上健身房 中文解读 · 原推
2024-07造词「Jagged Intelligence」:LLM 能力的锯齿状 中文解读 · 原推
2024-08长文「RLHF is just barely RL」 中文解读 · 原推
2024-12DeepSeek V3 点评:「开玩笑一样的预算」——早于破圈一个月 中文解读 · 原推
2024-07创立 Eureka Labs:AI 原生学校 中文解读 · 原推
2024-04llm.c 发布:纯 C 训练 GPT-2 中文解读 · 原推
2024-0590 分钟 $20 复现 GPT-2——训练成本坍缩原推
2024-02二次离开 OpenAI("no drama")原推
2024-02GPT Tokenizer 课程发布:LLM 的怪行为多可追溯到分词原推

2023

日期主题解读
2023-01「最热门的新编程语言是英语」 中文解读 · 原推
2023-09LLM 不是聊天机器人,是新操作系统的 kernel 中文解读 · 原推
2023-11那张著名的 LLM OS 架构图 中文解读 · 原推
2023-12「幻觉是 LLM 唯一在做的事——它们是造梦机」 中文解读 · 原推
2023-05「希望我们能扔掉 tokenization」——长期议题的起点原推
2023-07llama2.c:周末黑客项目引爆边缘推理原推
2023-08llama.cpp 为何可行:内存带宽分析原推
2023-02重回 OpenAI原推
2023-11《一小时入门大语言模型》视频发布原推

2015–2022 · 前 ChatGPT 时代经典

另见他本人自选的 70 条最爱推文存档(karpathy.ai)→

日期主题解读
2017-11Software 2.0 博文宣发——整个 2.0/3.0 叙事的源头 中文解读 · 原推
2020-11「如何成为专家」三条清单——他最疯传的学习建议 中文解读 · 原推
2021-12AI 大一统:一切向 Transformer 收敛 中文解读 · 原推
2022-10Transformer 三性质:expressive / optimizable / efficient 中文解读 · 原推
2022-07官宣离开 Tesla——五年 Autopilot 生涯结束 中文解读 · 原推
2016-11「3e-4 是 Adam 最佳学习率」——最著名超参梗原推
2016-10RL 自嘲:本该 AI 干活,结果人在干活原推
2017-02「loss addiction」:强迫性刷实验曲线原推
2017-08梯度下降写代码比我好——Software 2.0 前奏原推
2017-09学习法:先自己预测,再吸收答案原推
2018-07神经网络最常见错误清单——《Recipe》名文前身原推
2018-08教科书比闲书更有价值原推
2019-12四岁小孩自带数百万年进化「预训练」原推
2020-07GPT 文本将污染未来训练数据——先知性预警原推
2020-10按 loss 给数据集排序能发现惊喜原推
2020-11训练前先可视化、检查数据原推
2021-01实验吞吐量决定深度学习成败原推
2021-06区块链:炒作与骗局之下有真创新原推
2022-01上生产环境改变一切原推
2022-06「AGI 是一种感觉,不是定义」原推
2022-11GPT 是新型计算机,prompt 即自然语言程序原推
2022-12竞争优势在迭代式 data engine,不在数据本身原推
2022-12「Copilot 写了我约 80% 的代码」——agentic 叙事最早数据点原推