存在しない機能のテストを、AI(Claude)が4回書いた

広告(アフィリエイトリンク)を含みます

Claude(Anthropic のAI)が書いたタスクの完了条件に、「既存のセーブをロードして、値が一致することを示す」という一文が4回入っていた。

このゲームには、セーブ機能が存在しない。一度も作っていない。

Claudeに実装を任せるとき、タスクを先に文章で書く。やること、完了条件、やらないこと。書くのもClaudeだ。そのタスクの前提のほうが、実物と違っていたという型。12件あった。

一番こたえたのがセーブの件だった。

タスクの完了条件に、4回書かれていた一文既存のセーブをロードして、値が一致することを示す

別々のタスクに4回。Claudeはタスクを書くときに「ゲームなんだからセーブはあるだろう」と埋めた。そして実装のとき初めて「無い」と気づく。4回とも、気づいたのは実装を始めたあとだった。


同じ形のもの

「そのトグルは残す」── トグルは存在しなかったプロジェクト全体を検索して、その単語が出てきたのはタスクの文章そのものだけだった
「施設を壊された状態でクリアする」── 施設が壊れる仕組みが無い完了条件の3つが、同時には物理的に成立しなかった
「支城が生きている間は本城が弱くなる」── その処理はコードに無い設計メモにはそう書いてあった。メモとコードが乖離していた
「いまの地図は位置について嘘をついている」── 実測すると0件ずれていた土地は1つも無かった。名前が重なるのは位置ではなく名前の幅のせいだった

逆向きに動いた回も、記録にある

タスクを書くClaudeと、実装するClaudeは別のセッションで動いている。実装側が、タスクの前提の誤りを止めた記録が2件ある。

タスクどおりに保存すると、6種類のデータが壊れると分かって着手しなかった夜間に無人で走らせていた回。書きかけを元に戻して、止まった。壊れたセーブは1つも作られていない
タスクに列挙の無かった箇所が、同じ形で壊れるのを実装中に見つけた指示には入っていなかった。合わせて直した

なぜ起きるか

Claudeがタスクを書くとき、材料は3つある。コード、設計メモ、そして「普通こうなっているはず」という常識。

前の2つは確かめられる。3つ目は確かめられない。そして3つ目が一番もっともらしい文章になる。

セーブ機能の件がまさにそれで、「ゲームにセーブがある」は世界の常識としては正しい。このゲームに無いだけだ。

ここで決めたこと

タスクの完了条件に出てくる機能は、
書いた時点で1つずつ実物を確かめる。

もっともらしい文ほど、
確かめられていない。

広告

自分はスクールに通っていない。設計も実装もClaudeと手探りでやっている。だから上に書いたことは全部、遠回りの記録でもある。

体系的にやったほうが早いのは間違いない。生成AIを仕事に繋げる講座はいくつかあって、無料のカウンセリングや説明会だけ受けてみるのは悪くないと思う。自分は独学を選んだが、それは性格の問題で、人には勧めない。

このブログで使っている道具(Claude)そのものの入門書も出ている。読んではいないので、中身の評価はしない。

Unityそのものを本で一から学ぶなら、Unity 6に対応した入門書もある。これも読んでいない。

PREV / 前の記事AI(Claude)の検算を信じたら、ゲームバランスの案を5つ全部まちがえて却下していた前の記事を読む →
NEXT / 次の記事AI(Claude)に作業ファイルを4回消された話と、3段階の対策続きを読む →

コメント

このブログの人気の投稿

AI(Claude)に1ヶ月Unityでゲームを作らせて、失敗を88回記録した

AI(Claude)に作業ファイルを4回消された話と、3段階の対策

AI(Claude)の検算を信じたら、ゲームバランスの案を5つ全部まちがえて却下していた