AI(Claude)の検算を信じたら、ゲームバランスの案を5つ全部まちがえて却下していた

広告(アフィリエイトリンク)を含みます

Claude(Anthropic のAI)が引いた線で、新しい能力の案を5つ全部却下した。

念のため、すでにゲームに入っている能力どうしを同じ線で測った。既存の能力も、全部「却下」の側に入った。

この型は15件。一番多い型と同率だった。しかも気づきにくい。数字が出てきた時点で、検算した気になってしまう。


5つの案を、間違った線で全部却下した

ゲームに「能力」が6種類ある。新しい能力を足すとき、既にあるものと中身が被っていないかを確かめたかった。Claudeに測らせた。

Claudeは相関係数を使った。2つの能力の相関が高ければ「同じもの」、低ければ「別物」。線を引いて、5つの案を全部「被ってるので却下」にした。

Claude が引いた線相関が 0.45 より下なら別の能力と見なせる

念のため、既にゲームに入っている能力同士で同じ測り方をさせた。これが対照になる。

既存の組み合わせの相関は 0.52 だった。却下した案とほぼ同じ数字。線のほうが間違っていた。

原因もはっきりした。この6能力は全部、同じ素の数値から計算で出している。だから「全体が高い人は、何もかも高い」ぶんの相関が必ず乗る。相関では分離できない構造だった。

ここで決めたこと

能力どうしが別物かを測るときは、相関ではなく
「80人から選んだときの顔ぶれの重なり」を使う。


そして、結論を実行する前に書いていた

同じ日の記録にこれがある。

記録に残っている1行シミュレーションの結論コメントを、実行する前に書いた(3回)

表と食い違う文章を、そのまま出していた。3回。

Claudeはコードを書く。そして「おそらくこうなるだろう」という解説を、実行結果を見る前に書ける。読む側からは、どちらが先に書かれたか分からない。

ここで決めたこと

検算の結論は、必ず出力を見てから書く。

それでも検算をClaudeから取り上げはしなかった。0.45の線を崩した0.52という対照の数字を出したのも、Claudeだったからだ。間違えたのも、間違いを見つけたのも同じ道具で、違ったのは「対照を測れ」と言ったかどうかだけだった。


ほかに、この型で出たもの

部隊の産出を掛け算にして、経済を壊しかけた隊長の能力 × 人数、にしていた。正しくは足し算。人が増えるほど1人あたりが跳ね上がる式になっていて、食料が無限に増えた
設定した上下限が、一度も当たらなかった「0.70〜1.35の範囲に収める」という処理を入れていた。実測したら全行動で0〜1.9%しか当たらない。あってもなくても同じだった
デバッグ用のログを、実プレイだと思って分析した成長率の修正案まで出した。ログの冒頭に【デバッグ】と書いてあった

Claudeが出した数字は、
材料のほうを先に疑う。

広告

自分はスクールに通っていない。設計も実装もClaudeと手探りでやっている。だから上に書いたことは全部、遠回りの記録でもある。

体系的にやったほうが早いのは間違いない。生成AIを仕事に繋げる講座はいくつかあって、無料のカウンセリングや説明会だけ受けてみるのは悪くないと思う。自分は独学を選んだが、それは性格の問題で、人には勧めない。

このブログで使っている道具(Claude)そのものの入門書も出ている。読んではいないので、中身の評価はしない。

ゲームの設計そのものを体系的に扱った本もある。これも読んでいない。

PREV / 前の記事AI(Claude)に1ヶ月Unityでゲームを作らせて、失敗を88回記録した前の記事を読む →
NEXT / 次の記事存在しない機能のテストを、AI(Claude)が4回書いた続きを読む →

コメント

このブログの人気の投稿

AI(Claude)に1ヶ月Unityでゲームを作らせて、失敗を88回記録した

AI(Claude)に作業ファイルを4回消された話と、3段階の対策