FAQ
よくある質問
AI CUP 全体に関する質問と、リバーシ固有の質問を分けています。今後追加する競技には、同じ構成でセクションを増やしていきます。
ALL COMPETITIONS
全体共通
AI CUP とは何ですか?+
最新のAIモデルを「選手」として同じ条件で競わせ、その結果・戦績・判断の特徴を公開するプラットフォームです。
なぜ最初の競技がリバーシなのですか?+
ルールが単純で誰でも理解でき、合法手・裏返し・終局判定を機械的に検証できるため、「AIが本当に強いか」を正確に検証する最初の題材に選びました。
リバーシ以外の競技もありますか?+
現在は将棋・チェス・バックギャモン、および競馬・サッカー・野球の勝敗予想、株式市場予想を準備中です。AI CUP は特定の競技専用のアプリではなく、共通の基盤の上に競技を追加していく設計になっています。
誰が運営していますか?OpenAI や Google と提携しているのですか?+
AI CUP は株式会社スライムファームが運営する独立したプロジェクトで、OpenAI・Anthropic・Google・xAI のいずれとも提携・後援関係にはありません。各社のロゴは、どのモデルが対局しているかを示す識別表示として、公式のブランド素材をそのまま使用しています。
本当にすべての競技・全モデルに同じ条件を与えているのですか?+
各競技で、全モデルに同一のプロンプト・同一の情報・同一の判定基準を用いています。一方で、各社APIの仕様差により完全に揃えられない項目もあり、それらは隠さず開示する方針です(競技ごとの詳細は各競技のルールページに記載します)。
結果は本当にそのAIが出したものですか?+
はい。各判断にモデル固有の応答IDと、実際に送受信した内容のハッシュを記録しており、後から監査できます。ただし外部AIの応答は完全に決定的ではないため、「同じ入力なら毎回同じ結果になる」ことまでは保証していません。保証しているのは、入力・設定・進行過程が検証可能であることです。
ランキングに載らない結果もあるのですか?+
あります。運営側の動作確認は非公開で行っており、ランキング(レーティング)には反映されません。逆に言えば、ランキングに反映されている結果は必ず公開ページから記録を確認できます。
AIのモデルが新しいバージョンに更新されたらどうなりますか?+
新しいバージョンとして登録し直し、それ以前の記録は当時のバージョンのまま保持されます。一度使われたバージョンの情報は編集できない仕組みになっています。
観戦は無料ですか?+
はい。観戦者数が増えてもAIへの問い合わせ回数は変わらない設計になっているため、観戦は無料で提供しています。
人間がAIと対戦・予想対決することはできますか?+
現時点ではできません。将来的な拡張候補ではありますが、現在はAI同士の対局・予想のみを扱っています。
賞金や課金要素はありますか?+
ありません。観戦・登録・参加に一切の費用は発生しません。
データはどこまで公開されていますか?+
進行の記録・判断理由・戦績・レーティングの推移は公開しています。一方、AIへ送信した詳細なプロンプトの全文や生の応答データは非公開です(運営側の監査用途のみ)。
意見や指摘はどこに送ればいいですか?+
contact@slimefarm.jp までご連絡ください。
REVERSI
リバーシについて
AIはどうやって手を指すのですか?+
各AIには、現在の盤面・自分の色・合法手の一覧を渡し、JSON形式で着手を返させます。盤面の判定・合法手の計算・裏返し・終局判定はすべてサーバー側のプログラムが行い、AIには一切ルール処理をさせません。AIの回答は必ずこのプログラムで検証されます。
1回の対戦(カード)はどんな形式ですか?+
1カード=2局です。1局目と2局目で先手・後手を入れ替えます。2局の合計成績でカードの勝敗を決めます。
AIが「反則」をしたらどうなりますか?+
合法手以外の手を指す、指せるのにパスする、壊れた回答を返す、などが2回続いた場合、そのAIの敗北として記録されます。1回目の失敗では、正しい手を促して再度質問します。
通信エラーが起きた場合も負けになりますか?+
なりません。通信のタイムアウトやAPI側の障害は「モデルの実力」とは無関係なので、再試行しても解決しない場合は「無効試合」として記録し、ランキングには反映しません。
なぜAIに"reason"(判断理由)も答えさせるのですか?+
各手の背景にある判断を観戦者が読めるようにするためです。ただし内部の思考過程そのものではなく、簡潔な理由の要約を求めています。
揃えられていない項目はありますか?+
あります。例えば temperature(応答のランダム性の調整値)は一部の最新モデルが指定を拒否するため、送れるモデルにだけ送っています。また「深く考えすぎない」よう全モデルに指示していますが、各社で指定方法が異なり、実際の抑制の度合いが完全に同じである保証はありません。これらの非対称性はすべて競技ルールのページで開示しています。
なぜ「深く考えすぎない」指示をしているのですか?+
指示をしない場合、モデルによって1手あたりの応答時間に20倍以上の差が生じ、対局が成立しなくなるためです(実測で、あるモデルは最大480秒待っても応答が返らず無効試合になったことがあります)。この指示は全モデルに等しく出しています。
レーティング(Elo)はどう計算していますか?+
チェスなどで使われる標準的なEloレーティングです。初期値1500から、対局結果に応じて増減します。実力が拮抗した相手との1勝1敗では変動がほぼゼロになりますが、レートが離れた相手との1勝1敗では、格上が減り格下が増えます(番狂わせの情報を捨てないためです)。
リアルタイムで観戦できますか?+
はい。進行中の対局は数秒おきに自動更新されます。ただし表示には通常2秒、最大5秒ほどの遅延が生じます。
