AI(Claude)の検算を信じたら、ゲームバランスの案を5つ全部まちがえて却下していた
Claude(Anthropic のAI)が引いた線で、新しい能力の案を5つ全部却下した。
念のため、すでにゲームに入っている能力どうしを同じ線で測った。既存の能力も、全部「却下」の側に入った。
この型は15件。一番多い型と同率だった。しかも気づきにくい。数字が出てきた時点で、検算した気になってしまう。
5つの案を、間違った線で全部却下した
ゲームに「能力」が6種類ある。新しい能力を足すとき、既にあるものと中身が被っていないかを確かめたかった。Claudeに測らせた。
Claudeは相関係数を使った。2つの能力の相関が高ければ「同じもの」、低ければ「別物」。線を引いて、5つの案を全部「被ってるので却下」にした。
相関が 0.45 より下なら別の能力と見なせる
念のため、既にゲームに入っている能力同士で同じ測り方をさせた。これが対照になる。
既存の組み合わせの相関は 0.52 だった。却下した案とほぼ同じ数字。線のほうが間違っていた。
原因もはっきりした。この6能力は全部、同じ素の数値から計算で出している。だから「全体が高い人は、何もかも高い」ぶんの相関が必ず乗る。相関では分離できない構造だった。
能力どうしが別物かを測るときは、相関ではなく
「80人から選んだときの顔ぶれの重なり」を使う。
そして、結論を実行する前に書いていた
同じ日の記録にこれがある。
シミュレーションの結論コメントを、実行する前に書いた(3回)
表と食い違う文章を、そのまま出していた。3回。
Claudeはコードを書く。そして「おそらくこうなるだろう」という解説を、実行結果を見る前に書ける。読む側からは、どちらが先に書かれたか分からない。
検算の結論は、必ず出力を見てから書く。
それでも検算をClaudeから取り上げはしなかった。0.45の線を崩した0.52という対照の数字を出したのも、Claudeだったからだ。間違えたのも、間違いを見つけたのも同じ道具で、違ったのは「対照を測れ」と言ったかどうかだけだった。
ほかに、この型で出たもの
Claudeが出した数字は、
材料のほうを先に疑う。
自分はスクールに通っていない。設計も実装もClaudeと手探りでやっている。だから上に書いたことは全部、遠回りの記録でもある。
体系的にやったほうが早いのは間違いない。生成AIを仕事に繋げる講座はいくつかあって、無料のカウンセリングや説明会だけ受けてみるのは悪くないと思う。自分は独学を選んだが、それは性格の問題で、人には勧めない。
このブログで使っている道具(Claude)そのものの入門書も出ている。読んではいないので、中身の評価はしない。
この1冊でしっかりわかる Claudeの教科書 (この1冊でしっかりわかる教科書) [ AI Evo Project ] 価格:2310円 |
ゲームの設計そのものを体系的に扱った本もある。これも読んでいない。
ゲームデザインバイブル 第2版 おもしろさを飛躍的に向上させる113の「レンズ」 [ Jesse Schell ] 価格:5060円 |
コメント
コメントを投稿