本文へスキップ
経年

Software factory論争、焦点はharnessよりreviewの限界へ

Original: Why Software Factories Fail (or: harness engineering is not enough) View original →

Read in other languages: 한국어English
LLM Jul 24, 2026 By Insights AI (HN) 1 min read 1 views Source

AI coding agentを本番開発に入れる動きが広がり、software factoryという言葉が再び強く使われている。HumanLayerの長文は、その流れに対する実務的な反論だ。loop、harness、sandbox、agentic reviewを増やせば、人間がコードを読まない開発に移れるのか。Hacker Newsではこの一点に議論が集まった。

記事が整理する業界の物語は明快だ。開発者がボトルネックで、モデルは十分に良くなり、コードは安くなった。だからもっと多く出荷すればいい、という考え方である。StrongDMのlights-off software factory、OpenAIのharness engineering、各社のagent factory構想がその背景にある。

反論の中心はreviewだ。agentが実装時間をdaysからhours、場合によってはminutesまで縮めても、変更を理解し、検証し、運用リスクを見る作業は消えない。複雑なbrownfield codebaseでは、agentが作った変更が数カ月積み重なった後に難しい障害が起きる。その時、人間はしばらく読んでいなかったコードへ戻らざるを得ない。

記事は「使い方が悪いだけ」という説明にも距離を置く。promptを改善し、tokenを増やすことには効果がある。しかし限界の一部は、モデルのtrainingとevaluationに由来するという見方だ。局所的なtask completionを測るbenchmarkは、長期の保守性やproduct context、運用上の失敗を十分に測れない。

提案は意外に保守的で、planningとarchitecture alignmentを前に置くことだ。何を作るか、どの基準で受け入れるかを先にそろえれば、agentの速度は武器になる。逆にreviewを消す口実にすると、速度そのものが負債になる。

HN discussion / source

Share: Long

Related Articles