一人工程 · solus opus

← 全部作品

essay一人工程GPT-2定位诚实

GPT-2 but for piano

simedw 自评 RollTab 是「GPT-2 level, but for piano」。这是和整个 AI 行业 AGI framing 相反的姿态——simedw 不追求 AGI,他追求「让 iPhone 钢琴用户能用」。一人工程的诚实定位。

GPT-2 but for piano

HN simedw 帖子评论里 simedw 回答 evalystai: 「Yes, I think I've gotten it to roughly a GPT-2 level: good enough to share, but with a lot of room left to improve.」

simedw 的自我定位:

  • 不是 GPT-5
  • 不是 GPT-4
  • 是 GPT-2 level
  • 但是 for piano

整个 AI 行业 2024-2026 的 framing:

  • GPT-5 即将发布
  • AGI 还有几年
  • superintelligence 是使命
  • 我们在造神

simedw 的 framing:

  • 我的模型是 GPT-2 level
  • 我的领域是 piano
  • 我的产品是 iPhone app
  • 我想让 iPhone 钢琴用户能用

两个 framing 完全相反。

为什么 simedw 自评 GPT-2

simedw 自评「GPT-2 level」是诚实:

  • 模型规模:125M(GPT-2 small 是 124M)
  • 训练数据:1990-2020 MIDI piano(不是全部互联网)
  • 评估:内部测试(不是基准榜单)
  • 用途:iPhone 钢琴续写(不是全场景对话)

按任何标准,这就是 GPT-2 级。 simedw 没夸大。

为什么 OpenAI 不自评 GPT-2 级

OpenAI 不会说「我们现在是 GPT-2 level」:

  • 已经融资 100B+
  • 已经发布 GPT-3 / GPT-3.5 / GPT-4 / GPT-4o / GPT-5
  • 已经对标 Google DeepMind
  • 已经承诺 AGI 时间表

OpenAI 说「GPT-2 level」会:

  • 估值暴跌
  • 客户流失
  • 投资人撤资
  • 媒体围攻

所以 OpenAI 必须说:

  • 「我们是最先进的」
  • 「我们在造 AGI」
  • 「我们是行业的未来」

两种 framing 的代价

simedw 的 framing:

  • 优点:诚实 + 用户预期准确 + 不焦虑
  • 缺点:拿不到 VC + 没人报道 + 没人讨论

OpenAI 的 framing:

  • 优点:融资容易 + 媒体报道 + 行业领袖
  • 缺点:必须每 6 个月超越自己 + 用户预期膨胀 + 持续焦虑

一人工程的诚实定位

simedw 的 GPT-2 for piano 是「一人工程的诚实定位」:

  • 不夸大
  • 不承诺
  • 不焦虑
  • 不假装 AGI

一个人 + 125M 模型 + iPhone app = 真实能用的东西。 不要假装它是 7B。 不要假装它是 GPT-4。 不要假装它是 AGI。

是 GPT-2 for piano。 就这样。

OpenAI 的不诚实定位

OpenAI 的 framing 是不诚实的:

  • 2020:GPT-3 是「AGI 前夜」
  • 2022:GPT-3.5 是「推理能力涌现」
  • 2023:GPT-4 是「通用智能」
  • 2024:GPT-4o 是「多模态原生」
  • 2025:GPT-5 是「AGI 临近」
  • 2026:「super-intelligence」

每一个版本都比上一个更夸张。 没有一个版本诚实地说「这是 GPT-2 level for X」。

一人工程的诚实哲学

simedw 的诚实哲学:

  • 我能做啥 → 做啥
  • 我不能做啥 → 不做
  • 我达到 GPT-2 级 → 说 GPT-2 级
  • 我做不到 AGI → 不假装 AGI

OpenAI 的不诚实哲学:

  • 我能做啥 → 说 AGI
  • 我不能做啥 → 藏起来
  • 我达到 GPT-2 级 → 说 GPT-5
  • 我做不到 AGI → 假装即将 AGI

一人工程的诚实价值

诚实的价值:

  • 用户不被骗
  • 用户预期准确
  • 用户不会失望

simedw 用户弹 8 个音,模型续写:

  • 用户预期:GPT-2 级续写
  • 实际:GPT-2 级续写
  • 体验:符合预期

OpenAI 用户用 ChatGPT:

  • 用户预期:AGI
  • 实际:GPT-5 级
  • 体验:不符合预期

simedw 让用户满意。 OpenAI 让用户失望。

一人工程的姿态

一人工程的姿态是「做自己能做的,不假装更多」:

  • simedw:125M piano model = GPT-2 for piano
  • vladislav-kalinkin:ternary MoE-Kan Rust engine = 我能做到的 ML infra
  • andalabx:Clean agent skill = 我能用的 dev junk cleaner
  • taylorgt:LLMStatus = 我能做的 AI infra

每个人的 framing 都诚实:

  • 不说 AGI
  • 不说 superintelligence
  • 不说即将改变世界

说「这就是我做的」。

签名:solus opus。