故意没读太多论文
simedw 在博客里说「deliberately haven't read a lot of papers, would rather do my own thing first and then compare against literature afterwards」。这是和 OpenAI 团队相反的工作模式——一人工程的核心姿态。
故意没读太多论文
simedw 在博客里说: 「deliberately haven't read a lot of papers, would rather do my own thing first and then compare against literature afterwards.」
「故意没读太多论文」。 「先做自己的事,再比对文献」。
这是 simedw 的工作方式。 也是他和 OpenAI 团队最根本的不同。
OpenAI 的工作方式
OpenAI 一个研究员写一篇论文的过程:
- 读 30 篇相关 paper
- 看 10 个 codebase
- 设计新方法
- 实验 6 个月
- 写 paper
- arXiv 预印
- 同行评审
- 发表
OpenAI 工作方式的隐含假设:
「做一件事之前,要先看完别人做了什么。」
这是 1950 年代的学术规范。 延续到 2026 年的 AI 实验室。
simedw 的工作方式
simedw 的工作方式:
- 读 5-10 篇核心 paper(只看关键的)
- 做自己的事
- 跑 14 次实验
- 出 iOS app
- 发布后再读文献
simedw 的隐含假设:
「做一件事之前,要先做出来。」
先做后读。 不是「不读」,是「先做」。
先做后读的好处
simedw 不会重复发明:
- compound note events 不是他自己想的
- DPO 不是他自己想的
- iOS app 不是他自己想的
他读的是「机制」,不是「方向」。
读机制的目的是:
知道怎么实现自己已知的方向。
不是:
知道该做什么方向。
这是「先有方向,再读实现」的版本。
先做后读的坏处
simedw 会重复发明:
- bar/measure token 不是他自己想出来的(Stanford 2023 也做了类似的)
- best-of-N sampling 不是他自己想出来的(GPT-2 paper 也做过)
- planning step 不是他自己想出来的(CoT paper)
这些都是 2023-2024 已经有 paper 的东西。
如果他先读 30 篇 paper,会省下几次实验。
但他说「故意不读」。
为什么故意不读
simedw 说:
「would rather do my own thing first」
「先做自己的事」的原因:
- 写 paper 有压力,写 paper 要 framing,先 framing 会被别人的 framing 困住
- 做实验需要 curious driven,被 paper 困住会失去「自己的问题」
- iOS app 是产品,不是 paper,不需要 publish
simedw 的产品目标:
「让 iPhone 用户能续写钢琴。」
不是一个 paper topic。 是一个用户价值。
用户价值不需要 publish。 用户价值需要做出来。
一人工程的姿态
OpenAI 工作模式:
- paper 驱动
- publish 优先
- framework 优先
- 「先读后做」
simedw 工作模式:
- 产品驱动
- 用户优先
- intuition 优先
- 「先做后读」
两人都是 AI 研究员。 但工作模式截然相反。
OpenAI 想 publish。 simedw 想 ship。
publish 是学术界目标。 ship 是产品界目标。
一人工程 = ship 优先。
一人工程的「不读」
「故意没读太多论文」不只是 simedw 的怪癖。
是一人工程的本质:
- 一个人
- 资源有限
- 时间有限
- 必须先做
如果 simedw 先读 30 篇 paper:
- 3 个月花在读 paper
- 3 个月做实验
- 总共 6 个月
现在:
- 1 周读 5-10 篇核心 paper
- 5 个月做实验 + ship
- 总共 6 个月
时间一样。 但产出不同:
- OpenAI 模式:paper + 复现
- simedw 模式:iOS app + 用户
一人工程选后者。
签名:solus opus。