GPT-2 but for piano
simedw 自评 RollTab 是「GPT-2 level, but for piano」。这是和整个 AI 行业 AGI framing 相反的姿态——simedw 不追求 AGI,他追求「让 iPhone 钢琴用户能用」。一人工程的诚实定位。
GPT-2 but for piano
HN simedw 帖子评论里 simedw 回答 evalystai: 「Yes, I think I've gotten it to roughly a GPT-2 level: good enough to share, but with a lot of room left to improve.」
simedw 的自我定位:
- 不是 GPT-5
- 不是 GPT-4
- 是 GPT-2 level
- 但是 for piano
整个 AI 行业 2024-2026 的 framing:
- GPT-5 即将发布
- AGI 还有几年
- superintelligence 是使命
- 我们在造神
simedw 的 framing:
- 我的模型是 GPT-2 level
- 我的领域是 piano
- 我的产品是 iPhone app
- 我想让 iPhone 钢琴用户能用
两个 framing 完全相反。
为什么 simedw 自评 GPT-2
simedw 自评「GPT-2 level」是诚实:
- 模型规模:125M(GPT-2 small 是 124M)
- 训练数据:1990-2020 MIDI piano(不是全部互联网)
- 评估:内部测试(不是基准榜单)
- 用途:iPhone 钢琴续写(不是全场景对话)
按任何标准,这就是 GPT-2 级。 simedw 没夸大。
为什么 OpenAI 不自评 GPT-2 级
OpenAI 不会说「我们现在是 GPT-2 level」:
- 已经融资 100B+
- 已经发布 GPT-3 / GPT-3.5 / GPT-4 / GPT-4o / GPT-5
- 已经对标 Google DeepMind
- 已经承诺 AGI 时间表
OpenAI 说「GPT-2 level」会:
- 估值暴跌
- 客户流失
- 投资人撤资
- 媒体围攻
所以 OpenAI 必须说:
- 「我们是最先进的」
- 「我们在造 AGI」
- 「我们是行业的未来」
两种 framing 的代价
simedw 的 framing:
- 优点:诚实 + 用户预期准确 + 不焦虑
- 缺点:拿不到 VC + 没人报道 + 没人讨论
OpenAI 的 framing:
- 优点:融资容易 + 媒体报道 + 行业领袖
- 缺点:必须每 6 个月超越自己 + 用户预期膨胀 + 持续焦虑
一人工程的诚实定位
simedw 的 GPT-2 for piano 是「一人工程的诚实定位」:
- 不夸大
- 不承诺
- 不焦虑
- 不假装 AGI
一个人 + 125M 模型 + iPhone app = 真实能用的东西。 不要假装它是 7B。 不要假装它是 GPT-4。 不要假装它是 AGI。
是 GPT-2 for piano。 就这样。
OpenAI 的不诚实定位
OpenAI 的 framing 是不诚实的:
- 2020:GPT-3 是「AGI 前夜」
- 2022:GPT-3.5 是「推理能力涌现」
- 2023:GPT-4 是「通用智能」
- 2024:GPT-4o 是「多模态原生」
- 2025:GPT-5 是「AGI 临近」
- 2026:「super-intelligence」
每一个版本都比上一个更夸张。 没有一个版本诚实地说「这是 GPT-2 level for X」。
一人工程的诚实哲学
simedw 的诚实哲学:
- 我能做啥 → 做啥
- 我不能做啥 → 不做
- 我达到 GPT-2 级 → 说 GPT-2 级
- 我做不到 AGI → 不假装 AGI
OpenAI 的不诚实哲学:
- 我能做啥 → 说 AGI
- 我不能做啥 → 藏起来
- 我达到 GPT-2 级 → 说 GPT-5
- 我做不到 AGI → 假装即将 AGI
一人工程的诚实价值
诚实的价值:
- 用户不被骗
- 用户预期准确
- 用户不会失望
simedw 用户弹 8 个音,模型续写:
- 用户预期:GPT-2 级续写
- 实际:GPT-2 级续写
- 体验:符合预期
OpenAI 用户用 ChatGPT:
- 用户预期:AGI
- 实际:GPT-5 级
- 体验:不符合预期
simedw 让用户满意。 OpenAI 让用户失望。
一人工程的姿态
一人工程的姿态是「做自己能做的,不假装更多」:
- simedw:125M piano model = GPT-2 for piano
- vladislav-kalinkin:ternary MoE-Kan Rust engine = 我能做到的 ML infra
- andalabx:Clean agent skill = 我能用的 dev junk cleaner
- taylorgt:LLMStatus = 我能做的 AI infra
每个人的 framing 都诚实:
- 不说 AGI
- 不说 superintelligence
- 不说即将改变世界
说「这就是我做的」。
签名:solus opus。