DeepResearch競馬予想レポート10|大阪杯、ダービー卿チャレンジトロフィー、チャーチルダウンズカップの結果
前回は、現時点における各LLMの予想精度について検証いたしました。
今回は、大阪杯、ダービー卿チャレンジトロフィー、チャーチルダウンズカップの予想とその結果をご報告します。
Gensparkのディープリサーチ機能がアップデートされましたので、今週から改めて検証を行いたいと思います。
馬券の結果ですが、ChatGPT・Felo・Perplexityのチームで大阪杯に挑んだものの、ヨーホーレイクにハナ差で敗れてしまいました。
【予想と結果】
チャーチルダウンズカップ(GⅢ)

ダービー卿チャレンジトロフィー(GⅢ)

大阪杯(GⅠ)

【集計結果】
期間:2025/3~2025/4の重賞レース
検証数:
ChatGPT(o1): n=13
Gemini: n=16
Perplexity: n=19
Felo(o3mini): n=13
Felo(3.7sonet): n=10
Felo(R1): n=8
Grok: n=17
推奨馬4頭の3着内的中率

本命馬◎の3着内的中率

各LLMの評価とランキング
1位: Chat GPT(o1)
「3頭的中率」(15%) が唯一二桁でトップ。
「2頭的中率」(69%) もトップタイ。
「本命◎の複勝圏率」(62%) もトップ。
【評価】
複数頭的中の精度と本命馬の安定感(3着内に入る確率)が共に高く、総合的に最もバランスが取れており信頼性が高い。
2位: Felo(o3mini)
「1頭的中率」が唯一の100%。
「2頭的中率」(69%) はChat GPT(o1)と並びトップ。
「本命◎の勝率」(31%) がトップ。
「本命◎の連対率」(38%) もトップタイ。
【評価】
「最低でも1頭は当てる」「本命馬が勝ち切る」という点で非常に強い。Chat GPT(o1)と僅差。
3位: Gemini
「1頭的中率」(94%) が高い。
「本命◎の複勝圏率」(50%) もまずまず。
【評価】
大当たりはないものの、「外さない」安定感があり、堅実な予想。
4位: Grok
「3頭的中率」(6%) は2位。
「本命◎の連対率」(35%) は悪くない。
【評価】
時折高精度な的中(3頭)を見せるが、全体的な安定感ではGeminiにやや劣る。
5位: Perplexity
「2頭的中率」(53%) はそこそこ良い。
【評価】
本命◎の勝率(16%)、連対率(16%)、複勝圏率(37%)が低く、軸馬の信頼度に課題。
6位: Felo(3.7sonet)
「本命◎の複勝圏率」(50%) は悪くない。
【評価】
本命馬単体で見ると悪くないが、推奨4頭全体での的中率(特に2頭的中率30%)が低い。
7位: Felo(R1)
【評価】
ほぼ全ての指標で数値が最も低く、精度面で他のLLMに劣る。
【結論】
総合的に見ると、ChatGPT(o1)は複数頭的中の精度と本命馬の安定感を兼ね備えており、最も信頼性の高い予想精度を示しました。次点のFelo(o3mini)は、本命馬の高い勝率と「最低1頭は当てる」という確実性が際立っています。
どちらを重視するか(安定した軸馬や複数頭的中か、本命馬の単勝率や最低限の的中保証か)によって評価は多少変動する可能性がありますが、全体としてはChatGPT(o1)、Felo(o3mini)、Geminiの順で高い評価となりました。
【次回】
作成中
<検証条件>
【対象レース】
・チャーチルダウンズカップ(GⅢ)
・ダービー卿チャレンジトロフィー(GⅢ)
・大阪杯(GⅠ)
【リサーチ条件】
実行日時:2025/4/5~4/6, 開催当日の昼頃
レポート内容:
・総論(レース全体像、特徴、注目点)
・予想専門家の視点で分析と考察と各馬の採点
・注目馬4頭(◎本命、○対抗、▲単穴、★大穴)
その他:本命、対抗、単穴、大穴を定義
・本命◎: 最も勝つ可能性が高いと予想される馬。
・対抗○: 本命に次いで勝つ可能性が高いと予想される馬。
・単穴▲: 展開次第で上位に食い込む可能性がある馬。
・大穴★: 勝つ可能性は低いものの、当たれば高配当が期待できる馬。
【モデル条件】
・ChatGPT:o1,Deepresearch
・Gemini:2.0 Flash Thinking Experimental
・Grok:Grok3 ,Deepersearch
・Perplexity:ディープリサーチ, WEB検索
・Felo:o3mini/3.7sonet/R1, ディープ, WEB検索
【その他】
・基本的にはone-shotでの指示
