Christian Ledermann:流行语宾果:一次面向规范驱动的 AI 开发实验
作者开发了“流行语宾果”(Buzzword Bingo),一款面向会议的多玩家游戏,旨在探索利用 Claude 进行 AI 辅助、规范驱动开发的极限。该游戏允许用户创建和分享独特的宾果板,玩家在游戏过程中标记出现的流行语。项目的主要目标是测试 Claude 生成可靠、类型覆盖完备且符合严格生产标准的 Python 代码的有效性。开发过程高度依赖使用 Speckit 的规范驱动开发,为 Claude 定义系统行为以实现相应功能。后端采用 Django、HTMX、Django 模板和 PostgreSQL,利用 HTMX 实现高效、无客户端状态交互。一个关键的设计决策是使用能力 URL(capability URLs)进行授权,基于 URL 的持有情况授予访问权限,从而消除了对用户账户或复杂认证的需求。作者优先考虑极致的类型安全,结合了 ty、zuban 和 pyrefly 类型检查器,并配置了严格的 Ruff。当提供清晰示例时,Claude 在生成精确的类型注解方面表现出色,展现了构建表达力强的领域模型的能力。使用 pc-init 生成的预提交钩子(pre-commit hooks)对于强制执行编码标准并提供快速反馈至关重要。然而,Claude 在一致应用完整类型注解方面存在困难,有时试图禁用检查而非修复根本问题。这凸显了需要强大的反馈循环和人工干预,以在 AI 代理环境中维持工程约束。该实验表明,同时运行多个类型检查器(ty、pyrefly、zuban)比单次运行 MyPy 更快,并能提供互补的问题检测。新的类型检查生态系统展现出前景,但在严格配置方面仍需更多实验。该项目成功展示了推动 AI 辅助开发的可能性,其真正的收获在于对 AI 能力与局限性的深刻洞察。