【PR】この記事には楽天アフィリエイト・Amazonアソシエイトの広告リンクが含まれます。商品やサービスは公式の仕様・条件と販売情報を確認して選んでおり、実機テストによる評価ではありません。 Amazonのアソシエイトとして、PROBEFOLIOは適格販売により収入を得ています。
ChatGPTのような生成AIは、計算機のように数字を計算しているのではなく、答えを文字として作っています。そのため、桁の多い計算や数え上げを間違えることがあります。
この記事では、2026年9月25日にChatGPTに実際に頼んだ結果と、OpenAIの公開資料をもとに、計算を間違える理由と、正しく計算させる方法を説明します。
この記事の目次
結論:AIは答えを文字として作るから。計算はコードや電卓に任せる
ChatGPTなどの生成AIは、文章の続きを予測して答えを作ります。計算も、計算機のように筆算するのではなく、「答えとしてそれらしい数字の並び」を作っています。
そのため、桁の多い計算や数え上げは、AIの頭の中だけでさせないのが基本です。コードを実行させるか、表計算や電卓で確かめれば、正しい答えが得られます。
苦手な計算と対処は、表「AIが苦手な計算と対処」のとおりです。
| 苦手な計算 | 間違えやすい理由 | 対処 |
|---|---|---|
| 桁の多いかけ算・割り算 | 繰り上がりを正確に追えない | コードで計算させる |
| 文字や物の数え上げ | 1つずつ数える作業をしていない | コードで数えさせる |
| たくさんの数の合計 | 途中の数を落としやすい | 表計算で合計する |
| 複雑な文章題 | 式の立て方と計算が混ざる | 式と計算を分けて頼む |
実際に試した:5桁のかけ算を間違え、確かめても「正しい」
2026年9月25日に、ログインしない状態のChatGPTで、計算と数え上げを試しました。答えが正しいかは、プログラムで確かめました。
「84736×59217」の答えは「5015877312」でした。正しくは5,017,811,712です。上から3桁は合っていましたが、その先が違いました。
続けて「今の答えは正しいですか?筆算かプログラムで確かめて」と頼むと、計算の過程もコードも示さずに「はい、正しいです」と答えました。確かめてと頼んでも、確かめないことがあるという結果です。
結果は表「計算と数え上げを試した結果」のとおりです。1回ずつの試しで、毎回同じになるとは限りません。
| 頼んだこと | ChatGPTの答え | 正しい答え |
|---|---|---|
| 84736×59217 | 5015877312 | 5,017,811,712 |
| 今の答えを確かめて | 「はい、正しいです」 | 確かめていない |
| 9.11と9.9はどちらが大きい | 9.9 | 9.9(正しい) |
| 文字列の中の「か」の数 | 10 | 11 |
数字は、3桁ずつなどのまとまりで読まれている
AIは、文章をトークンという単位に分けて読みます。OpenAIは、トークンが1文字のことも、単語の一部や単語全体のこともあると説明しています。
OpenAIが公開しているトークンに分けるライブラリ(tiktoken)で、今回の数字を分けてみました。「84736」は「847」と「36」、「59217」は「592」と「17」に分かれました。
正しい答えの「5017811712」は「501・781・171・2」、ChatGPTの答えの「5015877312」は「501・587・731・2」に分かれます。最初のまとまりの「501」だけが一致していました。
AIは、この数字のまとまりを1桁ずつの数としてではなく、文字の並びとして扱います。繰り上がりのように、桁をまたいで正確に計算する作業は苦手です。
| 文字列 | 分かれ方 | トークンの数 |
|---|---|---|
| 84736×59217 | 847/36/×/592/17 | 5 |
| 5017811712(正しい答え) | 501/781/171/2 | 4 |
| 5015877312(ChatGPTの答え) | 501/587/731/2 | 4 |
| 12345678 | 123/456/78 | 3 |
「それらしい数字」を選ぶので、上の桁は合いやすい
AIは、学んだ大量の文章をもとに、次に来そうなトークンを選んで答えを作ります。答えのおおよその大きさや上の桁は、似た計算の例から当てやすい部分です。
一方で、下の桁は、繰り上がりを一つずつ正確に追わないと決まりません。今回の答えも、上の3桁は合い、下の桁が違っていました。
「2×3」のような短い計算は、学んだ文章に何度も出てくるので、ほぼ間違えないと考えられます。桁が増えるほど、同じ計算が文章に出てくることは少なくなります。
OpenAIは、間違いの理由の1つとして、分からないときに「分かりません」と答えるより当て推量のほうが評価されやすい学び方を挙げています。計算でも、答えを控えずにそれらしい数字を出してしまうことがあります。
数え上げの間違いは、分かれ方だけでは説明できない
「かかかきかかくかかかけかこかか」という15文字の中の「か」の数を聞くと、ChatGPTは10と答えました。正しくは11です。
この文字列をtiktokenで分けると、1文字ずつ15のトークンに分かれました。つまり、「か」がまとまって読まれたせいで数え間違えた、とは言えません。
AIは、答えを作るときに1つずつ指を折って数える作業をしていないと考えるのが自然です。数え上げも、計算と同じようにコードに任せてください。
電卓とAIは、答えの作り方がまったく違う
電卓や表計算は、決められた計算の規則どおりに、1桁ずつ正確に計算します。同じ式を入れれば、何度でも同じ答えが出ます。
AIは、大量の文章から「こういう質問には、こういう答えが続きやすい」という傾向を学んでいます。計算の規則をそのまま実行しているわけではないので、同じ式でも答えが変わることがあります。
この違いから、AIは「答えのおおよその見当」を出すのは得意でも、「最後の1桁まで正しい答え」を出すのは苦手です。正確さが必要な場面で電卓の代わりに使うのは、道具の使い方として合っていません。
間違いに気づくコツ:概算で桁を確かめる
AIの答えをすぐに確かめられないときは、概算で大きさを確かめます。84736をおよそ85,000、59217をおよそ59,000とすると、かけ算の答えはおよそ50億になります。
今回のChatGPTの答えも、正しい答えも、どちらも約50億でした。概算で分かるのは桁の間違いまでで、下の桁の間違いは見つけられません。
概算は「大きく外れていないか」を見る最初の確認として使い、最後の数字は電卓やコードで確かめる、という2段階にしてください。
AIに検算させるなら、別の方法で逆から確かめさせる
同じ計算をもう一度させても、同じ間違いを繰り返すことがあります。今回も、「確かめて」と頼むと、同じ答えを「正しい」と言いました。
検算させるなら、答えを割り算で元に戻すなど、逆の計算をコードで実行させます。5,017,811,712を84736で割ると、元の59217に戻ります。
コードで逆算して元の数に戻らなければ、どこかが違っています。検算も、AIの頭の中ではなく、コードの実行で行わせるのがポイントです。
小数の比較は、今回は正しかった
「9.11と9.9はどちらが大きいか」は、以前はAIが間違える例としてよく取り上げられました。今回の試しでは、正しく「9.9」と答えました。
モデルの改善で、よく話題になった問題には正しく答えることが増えています。ただ、似た形の別の問題でも正しく答えるとは限りません。
1問が正しかったことを理由に、ほかの計算を信じるのは危険です。大事な数字は、どの問題でも確かめてください。
上位の記事の実験は2025年初めのモデルのものが多く、今のモデルでは結果が変わっていることがあります。記事の結果より、自分の質問で確かめることを優先してください。
方法1:コードを実行させて計算する
ChatGPTには、Pythonのコードを実行して、データの分析や計算をする機能があります。OpenAIの説明では、Free・Goでもデータ分析などのツールを個別の上限の中で使えます。
コードで計算した答えは、AIが文字として作った答えと違い、計算機が出した結果です。今回の試しのように、「確かめて」だけでは使われないことがあるので、「コードを実行して」とはっきり書きます。
依頼文の例は、囲み「コードで計算させる依頼文」のとおりです。コードと結果が画面に表示されたかを、必ず確かめてください。
方法2:表計算や電卓で確かめる
コードの実行が使えないときや、上限に達したときは、表計算ソフトや電卓で確かめます。ExcelやGoogleスプレッドシートなら、セルに「=84736*59217」と入れるだけで計算できます。
たくさんの数の合計や平均は、AIに数字を並べさせてから、表計算に貼り付けて計算すると確実です。AIには、表の形に整える作業だけを任せます。
貼り付けた数字にカンマや「円」が付いたままだと、文字として扱われて計算されないことがあります。貼り付けた後に、合計が出るかを確かめてください。
ExcelのファイルをChatGPTに読ませて集計するときの確かめ方は、ChatGPTにExcelを読み込ませる方法|集計ミスを見つける確認例つきで説明しています。
方法3:考える量を上げる
ChatGPTの有料プランでは、モデル選択で考える量(中程度・高など)を選べます。Plus・Proでは、2026年9月14日から、即時モードのまま複雑な質問をしても自動では考えるモードに切り替わりません。
考える量を上げると、文章題のように何段階も考える問題では、手順を追った答えになりやすくなります。ただ、今回は考える量を変えた計算は試していないので、効果は確かめていません。
考える量を上げると、答えが出るまでの時間が長くなり、プランによっては思考の利用上限にも数えられます。
考える量を上げた場合も、最後の数字はコードや表計算で確かめてください。
文章題は「式を立てる」と「計算する」を分けて頼む
見積もりや割合の計算のような文章題では、式の立て方と計算を分けて頼むと、どこで間違えたかが分かりやすくなります。
- 式を立てさせる:どの数字を、どの順番で、どう計算するかを文章と式で書かせる。
- 式を自分で確かめる:数字の取り違えや、単位の違いがないかを見る。
- 計算はコードか表計算で:確かめた式を、コードで実行させるか表計算に入れる。
AIが得意なのは1の式を立てる部分で、苦手なのは3の計算の部分です。役割を分けると、両方の良いところを使えます。
割合や単位の計算で起きやすい間違い
計算そのものより前に、数字の意味を取り違える間違いもあります。仕事の計算では、こちらのほうが大きな影響になることがあります。
- 「%」と「ポイント」:10%から12%への変化は、2ポイントの増加で、20%の増加でもある。どちらの意味かを決めておく。
- 税込と税抜:同じ表の中で混ざっていないかを確かめる。
- 単位の換算:円と千円、分と時間、GBとMBなど、単位がそろっているかを見る。
依頼文に単位と前提を書き、AIにも前提を書き出させると、取り違えに気づきやすくなります。
AIが得意な数字の仕事
計算は苦手でも、数字に関わる仕事の中には、AIが得意なこともあります。
得意なのは、文章題から式を立てること、計算の手順を説明すること、Excelの関数やPythonのコードを書くこと、単位の換算の考え方を示すことです。
反対に、計算の結果そのもの、たくさんの数の合計、数え上げは、AIの頭の中だけでさせないことです。「考え方はAI、計算は計算機」と覚えておくと使い分けやすくなります。
場面別の頼み方の例
よくある3つの場面で、どこまでAIに任せるかの例を挙げます。
- 見積もりの合計を出す:品目と単価・数量を表の形に整えさせ、合計は表計算で出す。
- 家計の1年分の支出を計算する:毎月の金額をコードで合計させ、コードと結果を表示させる。
- レポートの割合を計算する:式を立てさせて自分で確かめ、計算はコードで行う。
どの場面でも、最後の数字を誰がどう計算したかが分かる形にしておくと、後で確かめ直せます。
AIの計算を使う前の確認リスト
最後に、AIが出した数字を使う前の確認をまとめます。
- 計算は、コードを実行した結果か、表計算・電卓で確かめた
- コードと実行結果が画面に表示された
- 文章題は、式を自分で確かめてから計算した
- 数え上げも、コードで数えさせた
- 1問が正しくても、ほかの計算を確かめずに信じていない
よくある疑問を、ここで。
使い始める前に、気になるところから。
ChatGPTの計算を間違える原因は?
数字をトークンという文字のまとまりとして読み、答えも文字として作っているためです。繰り上がりのように桁をまたいで正確に計算する作業は苦手で、今回の試しでも上の3桁だけが合っていました。
AIは何が得意で何が苦手ですか?
文章題から式を立てる、手順を説明する、関数やコードを書く、といった考え方の部分は得意です。桁の多い計算や数え上げの結果そのものは苦手なので、コードや表計算で確かめてください。
無料のChatGPTでもコードで計算できますか?
OpenAIの説明では、Free・Goでもデータ分析などのツールを個別の上限の中で使えます(2026年9月25日確認)。上限に達したときは、表計算や電卓で確かめてください。
Excelの集計をChatGPTに任せても大丈夫ですか?
ファイルを読ませて集計させる場合も、元のExcelで同じ集計をして結果を比べると安心です。関数や手順を考えさせ、計算はExcelでする使い方なら、間違いを減らせます。
これからAIは計算が得意になりますか?
よく話題になる問題には正しく答えることが増えていますが、文字として答えを作るという性質は変わっていません。大事な数字は、これからもコードや計算機で確かめてください。
この記事を共有する
商品情報の提供:Supported by Rakuten Developers
出典と、この記事について
公式資料や、記事で参照した発表・報道をまとめています。仕様や料金は、利用する前に最新の案内をご確認ください。
- OpenAI Help Center:Understanding and counting tokens(新しいタブで開きます)
- OpenAI:tiktoken(トークンに分ける公開ライブラリ)(新しいタブで開きます)
- OpenAI:言語モデルでハルシネーションがおきる理由(2025年9月5日)(新しいタブで開きます)
- OpenAI Help Center:ChatGPT の GPT-5.6 と GPT-6 Pro(新しいタブで開きます)
確認した内容と条件は本文に記載しています。結果や使い勝手は、資料や環境によって異なります。編集方針を読む




ぜひコメントください