卡帕西的 X 账号(@karpathy,2009 年至今约 1 万条帖子)是这个时代 AI 话语的发源地之一。我们只做两件事:精选真正改变行业讨论的那几十条,为每条写原创中文解读(背景 + 转述 + 短引用 + 后续影响)。新爆款推文目标 48 小时内更新。
| 日期 | 主题 | 解读 |
|---|---|---|
| 2026-05 | 宣布加入 Anthropic 预训练团队——1 小时 300 万浏览 ★ | 中文解读 · 原推 |
| 2026-02 | 「过去两个月编程变化之大难以言表」:coding agents 从不可用到可用 ★ | 中文解读 · 原推 |
| 2026-02 | vibe coding 一周年回顾 | 原推 |
| 2026-01 | Claude coding 笔记:从 80% 手写到 80% agent ★ | 中文解读 · 原推 |
| 2026-04 | LLM 知识库 / idea file:分享想法,让对方的 agent 自己建 | 跟帖 |
| 日期 | 主题 | 解读 |
|---|---|---|
| 2025-02 | 造词「vibe coding」——450 万浏览,年度科技词汇 ★ | 中文解读 · 原推 |
| 2025-12 | 「从没觉得自己这么落后过」——agentic 时代的技能焦虑长推 ★ | 中文解读 · 原推 |
| 2025-10 | nanochat 发布:「$100 能买到的最好的 ChatGPT」 ★ | 中文解读 · 原推 |
| 2025-10 | 「我们在召唤幽灵,不是养动物」——回应 Sutton ★ | 中文解读 · 原推 |
| 2025-10 | Dwarkesh 访谈澄清帖:AGI 还有十年、march of nines ★ | 中文解读 · 原推 |
| 2025-10 | 评 DeepSeek-OCR:像素可能优于 text tokens,tokenizer 必须消失 ★ | 中文解读 · 原推 |
| 2025-06 | Software 3.0 / YC 演讲配套推:people spirits、autonomy slider ★ | 中文解读 · 原推 |
| 2025-06 | 支持「context engineering」取代「prompt engineering」 ★ | 中文解读 · 原推 |
| 2025-01 | 「是智能体十年,不是智能体元年」 ★ | 中文解读 · 原推 |
| 2025-07 | 对 scaling RL 的怀疑(用吸管吸取监督信号) | 原推 |
| 2025-11 | 用 LLM 三遍读书法 + reader3 工具 | 原推 |
| 2025-11 | Gemini 3 评测 +「不相信现在是 2025」事件 | 原推 |
| 2025-11 | llm-council:多模型互评的周末项目 | 原推 |
| 2025-03 | vibe code 了整个 iOS 应用 | 原推 |
| 2025-03 | 睡眠追踪设备四强对比(Whoop ≥ Oura > 8Sleep ≫ Apple Watch) | 原推 |
| 2025-02 | 《深入 ChatGPT 这样的 LLM》视频发布 | 原推 |
| 2025-02 | Grok 3 vibe check——「vibe check」成评测流行语 | 原推 |
| 日期 | 主题 | 解读 |
|---|---|---|
| 2024-02 | 长文「学习的短视频化」:学习不该是娱乐,应该像上健身房 ★ | 中文解读 · 原推 |
| 2024-07 | 造词「Jagged Intelligence」:LLM 能力的锯齿状 ★ | 中文解读 · 原推 |
| 2024-08 | 长文「RLHF is just barely RL」 ★ | 中文解读 · 原推 |
| 2024-12 | DeepSeek V3 点评:「开玩笑一样的预算」——早于破圈一个月 ★ | 中文解读 · 原推 |
| 2024-07 | 创立 Eureka Labs:AI 原生学校 ★ | 中文解读 · 原推 |
| 2024-04 | llm.c 发布:纯 C 训练 GPT-2 ★ | 中文解读 · 原推 |
| 2024-05 | 90 分钟 $20 复现 GPT-2——训练成本坍缩 | 原推 |
| 2024-02 | 二次离开 OpenAI("no drama") | 原推 |
| 2024-02 | GPT Tokenizer 课程发布:LLM 的怪行为多可追溯到分词 | 原推 |
| 日期 | 主题 | 解读 |
|---|---|---|
| 2023-01 | 「最热门的新编程语言是英语」 ★ | 中文解读 · 原推 |
| 2023-09 | LLM 不是聊天机器人,是新操作系统的 kernel ★ | 中文解读 · 原推 |
| 2023-11 | 那张著名的 LLM OS 架构图 ★ | 中文解读 · 原推 |
| 2023-12 | 「幻觉是 LLM 唯一在做的事——它们是造梦机」 ★ | 中文解读 · 原推 |
| 2023-05 | 「希望我们能扔掉 tokenization」——长期议题的起点 | 原推 |
| 2023-07 | llama2.c:周末黑客项目引爆边缘推理 | 原推 |
| 2023-08 | llama.cpp 为何可行:内存带宽分析 | 原推 |
| 2023-02 | 重回 OpenAI | 原推 |
| 2023-11 | 《一小时入门大语言模型》视频发布 | 原推 |
另见他本人自选的 70 条最爱推文存档(karpathy.ai)→
| 日期 | 主题 | 解读 |
|---|---|---|
| 2017-11 | Software 2.0 博文宣发——整个 2.0/3.0 叙事的源头 ★ | 中文解读 · 原推 |
| 2020-11 | 「如何成为专家」三条清单——他最疯传的学习建议 ★ | 中文解读 · 原推 |
| 2021-12 | AI 大一统:一切向 Transformer 收敛 ★ | 中文解读 · 原推 |
| 2022-10 | Transformer 三性质:expressive / optimizable / efficient ★ | 中文解读 · 原推 |
| 2022-07 | 官宣离开 Tesla——五年 Autopilot 生涯结束 ★ | 中文解读 · 原推 |
| 2016-11 | 「3e-4 是 Adam 最佳学习率」——最著名超参梗 | 原推 |
| 2016-10 | RL 自嘲:本该 AI 干活,结果人在干活 | 原推 |
| 2017-02 | 「loss addiction」:强迫性刷实验曲线 | 原推 |
| 2017-08 | 梯度下降写代码比我好——Software 2.0 前奏 | 原推 |
| 2017-09 | 学习法:先自己预测,再吸收答案 | 原推 |
| 2018-07 | 神经网络最常见错误清单——《Recipe》名文前身 | 原推 |
| 2018-08 | 教科书比闲书更有价值 | 原推 |
| 2019-12 | 四岁小孩自带数百万年进化「预训练」 | 原推 |
| 2020-07 | GPT 文本将污染未来训练数据——先知性预警 | 原推 |
| 2020-10 | 按 loss 给数据集排序能发现惊喜 | 原推 |
| 2020-11 | 训练前先可视化、检查数据 | 原推 |
| 2021-01 | 实验吞吐量决定深度学习成败 | 原推 |
| 2021-06 | 区块链:炒作与骗局之下有真创新 | 原推 |
| 2022-01 | 上生产环境改变一切 | 原推 |
| 2022-06 | 「AGI 是一种感觉,不是定义」 | 原推 |
| 2022-11 | GPT 是新型计算机,prompt 即自然语言程序 | 原推 |
| 2022-12 | 竞争优势在迭代式 data engine,不在数据本身 | 原推 |
| 2022-12 | 「Copilot 写了我约 80% 的代码」——agentic 叙事最早数据点 | 原推 |