初めましての方、こんにちは!毎週150万円の実弾を馬券に突っ込む男、横けんです。
このブログでは、完全自作の競馬予想AI(LightGBM)とTARGET frontier JVの膨大なデータを駆使して、感覚やオカルトを一切排除した「勝つための客観的指標」と「リアルな実戦の記録」を公開しています。
先週の収支ですが
9月5日(土)は26万340円のマイナス
9月6日(日)は23万9730円のマイナス ということになっております。
先週は2日で105万円の勝負でした。
それでは、恒例の自信度4以上の回収率ですがこちらになります!

自信度4以上に絞ると、本命は複勝率44.8%で単勝94%・複勝97%。あと一歩というところです。目立ったのは△の単勝221%で、○が107%、▲が104%。今週も押さえの印のほうが数字を残しました。
自信度1以上の全レースの予想の回収率を見てみましょう、こちらです!

全レースまで広げると、本命は複勝率58.1%・複勝106%。複勝のほうは100%を超えてきました。単勝は83%です。ここでも下の印が強く、7の印が単勝300%、6の印が198%、△が158%でした。
そして、本命馬の自信度別回収率はこちらです!

そして今週いちばん引っかかったのがここです。自信度4は勝率35.7%・単勝154%・複勝132%と一番良いのに、一番上の自信度5だけが単勝39%・複勝66%。上に行くほど良くなる形になりませんでした。
▶ 私が毎週150万円を賭けながら3年かけて作った競馬予想AIの全体像は、「競馬予想AIの作り方・完全ガイド」に最初から順にまとめています。
全レースの予想そのものは、そんなに悪くなかったと思っています。本命の複勝は106%まで来ましたし、押さえの印もよく走ってくれました。自信度4に絞れば勝率35.7%・単勝154%・複勝132%で、狙ったところはきっちり獲れています。
気になっているのは自信度5のレースです。出遅れたり、前が詰まったり。このままいくと「自信度をあまり細かく分けないほうがいいのかもしれない」という結論になるかもしれませんが、たまたまなところもあると思っているので、今週もこのままがんばります。
そして今週いちばん大きかったのは、実は馬券の話ではありません。ChatGPT6のアストラ(GPT-6 Astra)が出たことです。
先に結論から。ChatGPT6アストラを競馬予想AIに入れて何が変わったのか
ひとことで言うと、「自分で作ったものを、自分で採点しなくてよくなった」です。
OpenAIがGPT-6 Astraを公開しました。私はこれを予想の中身を考えさせるためではなく、検証役として入れています。役割をはっきり分けました。
手を動かして直すのはClaude。それを疑って「証拠を出せ」と突き返すのがGPT-6 Astra。私はその間に立って、入れるか入れないかだけを決めています。見解は今までどおり私が書きます。AIには材料集めと事実確認をさせています。
これが効きました。自分で書いたものを自分で採点すると、どうしても甘くなります。別の目を入れると、「ここが怪しい」ではなく「どの馬の、どの項目が、いくつずれているか」まで出てくるので、こちらは確かめて直すだけで済みます。
今週やった改善(先に要点だけ)
① 全レースの本命が複勝106%。自信度4に絞ると単勝154%・複勝132%でした。
② 「入力の時刻」を確かめる仕組みを強化しました。予想を出す時点で本当に手に入る値だけを学習に使っているか、を数え直す検査です。実際に1件、締切間際のオッズが混ざっているのを見つけました。
③ 直したAIとは別のAIが、根拠まで確かめる形にしました。直した本人に「直りました」と言わせない、というのが今週いちばんの変更です。
④ 【地方】同じ種牡馬の成績が、番号のちがいで別々に集計されていました。ハーツクライは71頭と1,385頭に分かれていたものを、1,456頭としてまとめて数えられるようにしました。
ここから下は、この4つを1つずつ説明していきます。
今週もこのほかにも色々な改善を行っております。具体的には…
①先週の中身は、悪くありませんでした
まず良かったところから。全レースで見た本命の複勝率は58.1%、複勝は106%。およそ6割が3着以内に来ています。
自信度4に絞ると、14頭中5勝で勝率35.7%、単勝154%・複勝132%。ここは狙いどおりです。押さえの印も強くて、7の印が単勝300%、6の印が198%、△が158%でした。本命一本ではなく、印の下のほうまで拾える形になってきています。
レース数の少ない区分は週によって振れるので、いまの段階で作り方を変えるつもりはありません。今週もこのまま勝負します。
②「その値、予想を出す時点で本当に手に入りますか」を数える
ここが今週いちばん大きかった改善です。
予想AIには「学習に使ってはいけない値」があります。予想を出したあとにしか分からない値です。これが混ざると、過去を振り返ったときの成績だけが良く見えて、本番では同じようにいきません。
今週、使っている値を1つずつ「いつ発表されたものか」で数え直す検査を入れました。そうしたら実際に1件、締切間際のオッズが混ざっているのが見つかりました。
あわせて、オッズが一部だけ欠けているときの扱いも直しました。欠けていることに気づかないまま、正常に取れていた値まで上書きして消してしまう作りだったためです。
状態を正確に書いておきます。データの取り出し方は本番で直しました(時刻を跨がないように条件を書き換え、実際のレースで動かして意図どおりに動くことまで確認済み)。過去に保存してあるぶんの作り直しは、これからです。作り直すと学習に使うデータそのものが変わるので、モデルの学習し直しとセットになります。したがって、予想がどれだけ良くなるかはまだ測っていません。
それでも私は、これが今週いちばんの収穫だと思っています。この種の間違いは「予想が当たらない」という形では表に出ません。それらしい数字が静かに入ってくるだけなので、人が見ても気づけない。数えるようにした、というのが値打ちです。
③直したAIとは別のAIが、根拠まで確かめます
バグを直したあとに一番こわいのは、直したせいで別のところが壊れることです。しかも、直した本人に確かめさせると、どうしても甘くなります。
そこで今週から、直すのはClaude、その根拠を突き返して確かめるのはGPT-6 Astraと、役割を分けました。合格が出るまで本番には入れません。
これはすぐに数字が良くなる話ではありません。ただ、「直したつもり」で先に進まなくなったのは、今週いちばん大きい変化だと思っています。
④【地方】地方競馬のほうも、同じやり方を進めています
地方競馬のほうでも、中央と同じようにAstraを入れました。バグ調査が大きく進み、これからの精度が楽しみです。
いちばん分かりやすいのが血統データです。同じ種牡馬なのに、識別番号が8桁のものと9桁のものに混ざっていて、成績が別々に集計されていました。ハーツクライは71頭と1,385頭に分かれていたものが、1,456頭としてまとめて数えられるようになっています。そろえたあとに176,880行を読み直して、桁のずれが0件になったことも確認しました。
もうひとつは、検証に使う数字と、実際に配信している数字がずれていた件です。評価する側が、配信するときの調整を一部再現できていませんでした。直したうえで43レース・407頭を突き合わせ、配信している確率との差が0になることを確認しています。同じものさしで比べられるようになった、ということです。
ここも中央と同じで、直したAIとは別のAIが根拠を確かめる形にしました。
状態を正確に書いておきます。ここまでは調査と修正の話で、本番のモデルへの反映と学習のやり直しは、これから進めるところです。ですから回収率や的中率が上がったかは、まだ確認していません。そこはこれからの楽しみです。
体制の話をひとつ。今までは毎週、私から地方競馬のAIに直接「この1週間で何をやったか報告して」と指示を出していました。今週から、そこを私を通さずにAI同士でやり取りする形に切り替えているところです。まだ手配の途中で、完全に自動で回っているわけではありません。ただ、私が伝書鳩をやっている限りAIを何人増やしても速くならないので、ここは変えていきます。
どういう精度になるのか、楽しみで仕方がありません
今週は、馬券の買い方そのものはほとんど触っていません。触ったのは、その手前にある材料と、確かめ方のほうです。
それでも私は、今週がいちばん前に進んだ週だと思っています。理由は、直した中身よりも「直ったことを、自分以外の目で確かめられる形になった」ほうにあります。入力の時刻を数える、前走の対応を突き合わせる、欠けたら知らせる、わざと壊して検査を試す。どれも、今週より先の週にずっと効きます。
いまの数字は、全レースの本命が複勝106%、自信度4に絞れば単勝154%・複勝132%。ここから材料のほうを直して学習をやり直したときに、どこまで行くのか。正直、楽しみで仕方がないというのが本音です。
ついでに、お金の話も正直に書いておきます。私は今、Claude CodeとChatGPTに、それぞれ毎月4万円くらい、合わせて8万円くらい使っています。それ以外にも、データを買ったり、ほかのAIを使ったりと、いろいろお金をかけています。ここまで投資する人は、なかなかいないんじゃないかと思いますね。私は、予想を当てるための投資は絶対にけちりません。この環境を使って、これからどんな結果を出していくのか。楽しみにしていてください。
今はこうやって、ブログに何を書くかも私がある程度決めています。ここももう少し、AIに材料を出させて任せられるようにしたいなとは思っています。
直った材料で学習し直したAIが、どんな印を打ってくるのか。毎週この場所で、良かったところも、そうでなかったところも、数字のまま全部出していきます。
この週にやったことのうち、毎回使える部分だけをまとめ直した記事はこちらです。→ 競馬データ検証の罠|予想より後の数字が混ざると成績は良く見える



コメント