数字だけ渡してもAIは読み違える|前提の添え方を決める

数字だけ渡してもAIは読み違える|前提の添え方を決める

「先月の数字をそのままAIに読ませたら、それらしい分析が返ってきたのですが、結論が現場の感覚と真逆でした」「同じ表を渡しているのに、聞くたびに違う結論が出てきます」——数字の読み取りをAIに任せ始めた部署から、決まってこの2つが上がってきます。どちらも、AIの読み取りの精度が足りないせいだと受け取られがちです。実際の原因は、もっと手前にあります。渡した表に、その数字が何を指しているのかを説明する行が1つも付いていないことです。数字は、それだけでは意味が決まりません。意味を決めているのは、いつ時点で、どこまでを含み、何を除いたかという前提のほうです。この記事では、自社の数字をAIに読ませるときに何を一緒に渡すのか、渡し忘れるとどこで読み違えが起きるのか、返ってきた解釈をどう検算するのかを、順に整理していきます。


カメ先生カメ先生

表を渡せば読んでくれる、と思われがちだけれど、AIが見ているのは列の名前という数文字と、そこに並ぶ数字の並びだけなんだ。「新規」という列があれば、その2文字から意味を推測して計算に使う。


カメ子カメ子

推測した中身が、うちの会社での「新規」とずれていることがあるということですか。


カメ先生カメ先生

そう。しかも、ずれていてもずれたとは書かれない。整った日本語で、筋の通った結論だけが返ってくる。読む側には、どこが推測でどこが計算かを見分ける手掛かりが残らないんだよ。


カメ子カメ子

前提を書いた1枚を毎回添えれば、その推測をさせずに済む、ということでしょうか。


この記事のポイント
  • 前提を添えないと、AIは列の名前から意味を推測して計算する。誤りは警告ではなく、整った結論の形で返ってくる
  • 2026年4月に公開された検証では、指標の意味と社内の慣習を書いた説明を1枚添えただけで正答率が17から23ポイント上がり、その差はモデルの選び方より大きかった
  • 前提は依頼のたびに書かない。1枚にして固定し、毎回変えるのは時点とその月の出来事の2つだけにする

データ分析にAIを活かす第一歩、まずは導入から始めませんか?

デボノはアカウント開設・初期設定など「そもそものAI導入」から社内定着まで伴走支援。マーケティング活用など一歩進んだご相談にも対応します。

目次

同じ表を渡しているのに、聞くたびに違う結論が返る

この相談を受けたとき、最初に見せてもらうのは、実際に渡した表そのものです。開くと、ほぼ例外なく同じ形をしています。1行目に列の名前が並び、2行目から数字が始まる。それだけです。その表がいつ時点のものか、どの部署のどの範囲を集めたものか、途中で集計の仕方が変わっていないかを説明する行は、どこにもありません。人どうしで渡すときは、手渡しの一言や、相手が同じ部署の人だということが、その説明の代わりになっています。AIに渡すときだけ、その一言が抜け落ちます。

抜け落ちたまま渡していることは、社内のデータの状態とも重なります。2026年6月に公表された「日本企業のAI業務活用実態調査」(2026年6月24日から25日に実施、従業員100名以上の企業で生成AIを業務に使う管理職・実務者548人が回答)では、社内データが整備されていないと答えた企業が50.7%ありました。内訳はあまり整備されていないが43.2%、全く整備されていないが7.5%です。重複・欠損・表記のゆれが残ったままの数字を、説明なしで渡しているのが出発点になっています。

なお、この記事で扱うのは渡し方の側だけです。外から来た資料を読ませてよいかどうか、どこまでの情報を外部の仕組みに預けてよいかという情報管理・秘密保持の線引きは、別の記事の領分なので触れません。ここで決めるのは、社内で共有してよいと判断済みの数字を、読み違えられない形にして渡すにはどうするかだけです。

前提が無いところを、AIは黙って埋める

読み違えが起きる仕組みは単純です。AIが参照できるのは、列の名前という数文字と、そこに並ぶ数字だけです。「新規」という列があれば、その2文字から意味を推測します。推測に使えるのは、世の中一般での使われ方だけです。自社で「新規」をどう決めたかは表のどこにも書かれていないので、参照しようがありません。人なら「これ、どっちの新規ですか」と聞き返せますが、聞き返す代わりに答えを出すのがこの仕組みの性質です。

埋め方は具体的です。売上の列があれば、税込か税抜かのどちらかを決めて計算します。単位の記載がなければ、桁の大きさから円か千円かを推測します。月の列が12行そろっていれば、年間の合計として扱います。実際には11月までしか確定していなくても、その事情は表に書かれていません。空白があると、そこを空白のままにはせず、最もありそうな値で埋めるのが、基本の動きです。

厄介なのは、埋めたことが結果に出ない点です。推測した箇所に印は付きませんし、自信が低いという但し書きも付きません。返ってくるのは、整った日本語で書かれた筋の通った結論です。誤りが警告の形ではなく、成果物の形で返ってくる。これが、この問題がなかなか見つからない理由です。見つかるのは、その資料を見た現場から「この数字、うちの感覚と違うのですが」と指摘が出たときになります。

前提を1枚添えると、モデルを替えるより効いた

この効き目を数字にした検証が、2026年4月に公開されています。小売のデータを収めた分析用のデータベースに対して、自然な言葉で100問を尋ね、3種類の最上位のモデルにそれぞれ2回ずつ答えさせたものです。1回目は表の構造だけを渡し、2回目は表の構造に加えて、指標の意味・社内の慣習・紛らわしい言葉の解き方を書いた4キロバイトほどの説明文書を添えました。手で書いた説明を1枚足すだけの違いです。

結果は、説明なしで45.5%から50.5%、説明ありで67.7%から68.7%でした。説明を1枚添えただけで、正答率が17から23ポイント上がっています。さらに見るべきなのは、3つのモデルの間の差が、説明ありでもなしでも統計的に区別できなかったことです。差を作っていたのは説明文書の有無であって、どのモデルを選んだかではありませんでした。論文はこれを、モデルが賢くなったのではなく、モデルに求められている仕事の中身が変わったのだと説明しています。

別の検証も同じ向きを示しています。2026年4月に公表された、分析基盤の提供元による比較では、意味の定義を整えた層を通した問い合わせは、その層が覆う範囲で正答率が100%になったのに対し、表の構造だけを渡した場合は64.5%にとどまりました。道具を替える前に、添える物を替えたほうが効くというのが、2つの検証に共通する結論です。ただし、前提を添えても7割弱という数字も同時に見ておく必要があります。3回に1回は外すという前提で、人が検算する工程を残すことになります。

読み違いは、だいたい4つの場所で起きる

1つ目は時点です。締めの日はいつか、速報値か確定値か、返品や値引きの反映は済んでいるか。同じ「10月の売上」でも、11月1日に見た数字と12月1日に見た数字は違います。時点を書かないと、同じ名前の数字が別の意味になります。前月と比べる分析を頼めば、片方が速報値でもう片方が確定値のまま比較され、伸びや落ち込みが実際より大きく出ます。

2つ目は範囲です。どの部署までか、海外の子会社を含むか、社内取引を消してあるか、テスト用の登録を除いてあるか。範囲は後から数字を見ても復元できないので、ここを書き忘れると検算そのものができなくなります。範囲は、数字を作った人しか知らないことが多い項目で、表を受け取って転記した人には説明を足せません。転記が1回入るだけで、範囲の情報は消えます。

3つ目と4つ目は単位と除外です。単位は円か千円か、税込か税抜か、率は小数か百分率か。除外は、解約済みを抜いたか、金額がゼロの行を残したか、異常値をどう扱ったか。除外した行があるのに何も書かないと、AIは全件だと見なして母数を計算します。母数がずれると、率で表したすべての数字が同じ向きにずれます。1か所の書き忘れが、表全体の読み違えに広がるのはこの型です。

列の名前だけでは、意味は伝わらない

「新規」を例にします。ある会社では初めて問い合わせた先を指し、別の会社では初めて商談になった先を指し、また別の会社では前の年度に取引の無かった先を指します。同じ2文字が、少なくとも3通りの意味で使われています。列の名前は、社内で合意した定義の見出しであって、定義そのものではありません。見出しだけを渡せば、受け取った側は自分の知っている定義を当てはめます。

ゆれる言葉は、だいたい決まっています。新規・既存・稼働・休眠・解約・有効・対象外・確度。どれも社内で何度も使われている言葉で、社内では説明なしに通じます。通じるからこそ、定義を書いた文書が残っていません。社内で一度も説明を求められたことのない言葉ほど、外に出したときに読み違えられます。分析の道具を替えても、この部分は改善しません。

手当ては1行です。列の名前の横に、その列が何を数えているかを1文で書きます。書こうとして書けない列が出たら、そこは社内でも定義が固まっていない列なので、分析に使うのを止めます。定義の無い列を分析に入れると、出てきた結論を検算する足場が無くなります。議論は数字の話ではなく、言葉の意味をめぐる話に戻ります。

途中で定義が変わった数字は、つないだ瞬間に嘘になる

計測の道具を入れ替えた月、部署を再編した期、商品のコードを統合した年。どれも社内では大きな出来事なので、当事者は覚えています。ところが表の上では、ただ数字が並んでいるだけです。切れ目の印はどこにもありません。覚えている人が会議に出ていれば口頭で補われますが、その人が異動すると、補う人がいなくなります。

AIは、つながっている前提で読みます。切れ目の前後で数字の水準が変わっていれば、その変化を出来事ではなく成果として説明します。計測の道具を替えた月に件数が2割減っていれば、施策が効かなくなったという結論が返ってきます。定義が変わった時点をまたいだ比較は、前提を添えても正しくなりません。ここは書けば直る種類の問題ではなく、比較そのものを切れ目で分けるしかありません。

実務では、表とは別に「切れ目の一覧」を持ちます。何年何月に、何が、どう変わったか。3列で足ります。この一覧は一度作れば増えるだけなので、更新の手間はほとんどかかりません。作っていないと、2年前の数字と今年の数字を並べるたびに、同じ議論を最初からやり直すことになります。過去3年分をさかのぼって作るのに、半日もかかりません。

季節と催しの山を伝えないと、増えた理由が入れ替わる

展示会に出た月、大型の案内を打った月、年度末、連休の多い月。BtoBでは、問い合わせの件数がこうした出来事に強く引っ張られます。表には月と件数しか無いので、AIは山があれば理由を探します。探す先は、同じ表の中にある他の列だけです。外で何が起きていたかは、表に書かれていない限り視野に入りません。

結果として、たまたま同じ月に増やしていた施策が原因として書かれます。季節の山を伝えないと、施策が効いたという結論に化けます。しかも、この結論は会議で通りやすい。施策を担当した人にとって都合がよく、その場に反証する材料が無いからです。次の期の予算配分が、この結論をもとに決まることまで含めて問題になります

添え方は簡単です。月ごとに、その月に起きた社外向けの出来事を1行書きます。展示会、案内の配信、値上げ、主要な競合の動き、業界の繁忙期。12行の表が1つあれば足ります。この表を添えると、AIの説明は「施策が効いた」から「展示会の月を除くと横ばい」に変わります。同じデータから出る結論が変わるのは、データではなく渡す情報が増えたからです。

件数を書かないと、率だけが一人歩きする

転換率50%という数字を渡します。分母が8件だとは書いていません。AIは率の大小だけを比べ、この経路が最も効率がよいと結論します。次の期の予算配分の提案まで書いてくれます。分母が8件だと分かっていれば、誰もそんな提案はしません。ところが表に件数の列が無ければ、分かりようがありません。

率だけを渡すと、AIは分母の小ささを知らないまま比べます。しかも率は、分母が小さいほど極端な値になります。比べる表の中で最も目立つ行が、最も分母の小さい行になるのは偶然ではなく、構造的に起きる結果です。目立つ行から順に読むという普通の読み方が、そのまま誤りにつながります

決めることは2つです。率を書く列の隣に、必ず分母の件数の列を置くこと。そして、分母が一定の件数を下回る行は判断しない、という線を先に決めて前提の1枚に書いておくことです。線の水準は業種と商材で変わるので一概には言えませんが、決めていないことのほうが問題になります。決めてあれば、同じ線をAIにも守らせられます。

集計そのものは、AIにさせない

前提を添えても、正答率は7割弱でした。残りの3割がどこで生まれるのかを、別の角度から測った検証があります。2025年5月に公開された、表の上での推論を扱った研究です。問いを3段階に分け、表の中から該当する値を1つ抜き出す問い、件数や合計や平均を出す集計、引き算や相関を含む計算、の順に難しさが上がる形で測っています。

結果ははっきり分かれました。値を1つ抜き出す問いでは一定の正答率が出るのに対し、件数を数える問いは28.79%、平均を出す問いは16.33%まで落ちます。引き算を含む問いは20.92%、相関に至っては4.90%でした。表を読むことと、表の上で計算することは、別の能力として現れます。説明の文章は自然なのに、その説明の中の数字だけが合っていない、という形で誤りが出ます。

さらに実務に効くのが、欠損と重複の影響です。同じ検証では、値の欠けた行が混ざると合計の正答率が16%から8%へ半分に落ちました。欠けていることに触れたのは44%から51%にとどまります。半分近くは、欠けている事実に触れないまま合計を出しています。重複する行が混ざった場合はさらに悪く、平均の正答率が36%から17%に落ち、重複に触れた割合は6%から27%でした。一方、列の順番を入れ替えるといった見た目の変化の影響は5から10ポイント程度で、ほとんど効いていません。

実務での結論は1つです。集計はAIにさせず、表計算の側で済ませてから渡します。渡すのは、合計と件数と平均まで出し終えた表です。AIに残すのは、その数字が何を意味するかの解釈と、説明文の下書きだけにします。あわせて、欠けている行数と重複している行数を、前提の1枚に数で書いておきます。数が書いてあれば、集計済みの数字と突き合わせたときに合わないことがすぐ分かります。

添える前提は、7つの項目に絞る

全部を書こうとすると続きません。実務で効くのは次の7項目です。表の3列目は、その項目を書き忘れたときに、どういう形で誤りが表に出てくるかを並べたものです。自分たちの表に何が足りていないかは、この症状の側から逆に引けます。

添える前提の項目具体的に書くこと書き忘れると、どういう誤りとして出るか
いつ時点か締めの日と、速報値か確定値かの別。返品や値引きの反映が済んでいるかどうか前月比の比較で速報値と確定値が並べられ、伸びや落ち込みが実際より大きく出る
どこまで含むか対象の部署・地域・子会社の範囲。社内取引を消してあるかどうか全社の数字として扱われ、一部の部署だけの傾向が全社の傾向として説明される
単位と通貨円か千円か、税込か税抜か、率は小数か百分率か桁から推測されるため、千円単位の表が円として読まれ、規模の判断が千倍ずれる
列の名前の定義新規・稼働・解約などが、社内で何を指しているかを1文で一般的な語義が当てはめられ、自社の実態とは別の集団について論じられる
除外したものテスト用の登録・解約済み・金額がゼロの行・異常値の扱いと、除外した行数全件だと見なされて母数が計算され、率の分母が実際より大きくなる
定義が変わった時点計測の道具の入れ替え・部署の再編・コードの統合が、何年何月に起きたか切れ目の前後が地続きで比較され、社内の変更が施策の成果として説明される
件数と、判断しない下限率の隣に置く分母の件数と、これを下回ったら判断しないという線分母の小さい行が最も成績のよい経路として上位に並び、予算配分の根拠にされる

7項目のうち、最も忘れられるのは5つ目の除外です。除外は作業した人の手元で終わっていて、表には痕跡が残らないためです。除外した行数だけでも書いておくと、母数が合わないことが検算の段階で分かります。逆に最も書きやすいのは1つ目の時点で、ここは表の欄外に日付を1つ足すだけで済みます。書きやすい順に埋めていくと、1回目で4項目までは埋まります。

前提は毎回書かない。1枚にして固定する

ここまでの7項目を、依頼のたびに書くことにすると続きません。経験上、2週間で誰も書かなくなります。実務で回るのは、前提を書いた1枚を先に作っておき、毎回それを添える形です。数字は毎月変わりますが、前提のほとんどは変わらないからです。毎回変わるのは、時点と、その月に起きた出来事の2つだけです。

1枚の中身は、固定の部分と毎回書き換える部分に分けます。固定は、列の定義・範囲・単位・除外の規則・判断しない下限・切れ目の一覧。書き換えるのは、時点と、その月の出来事です。前提の1枚は、読ませる文書ではなく、更新する台帳として持つと考えると、置き場所も自然に決まります。表と同じ場所に、同じ名前で置きます。別の場所に置くと、表だけが渡されます。

更新する人を決めます。数字を作っている人が書き、使う人が読んで分からなかった箇所を戻す形です。戻ってきた質問を、その場で答えて終わりにせず、1枚のほうに書き足す。この往復を3か月続けると、社内で説明なしに通じていた言葉が、ほぼ全部1枚の上に出てきます。ここまで来ると、AIに渡す用途以外でも使えるようになり、新しく入った人の説明の手間がまとめて減ります。

前提の1枚を作る5工程

一度に全部の表を対象にすると止まります。よく使う表を1つ選び、次の5段で作ってください。着手から仕上げまで2週間ほど、実働は合計で1日から2日です。

STEP1
実際に渡している表を1つ選ぶ

月次で最もよく使う表を選びます。作った人と、使っている人の両方が社内にいることを確かめてください。どちらかがいない表は定義を復元できないので、後回しにします。

STEP2
列の名前を1つずつ、1文で書けるか試す

書けない列に印を付けます。印の付いた列は、社内でも定義が固まっていない列です。この段で、印の付いた列を分析に使い続けるかどうかを決めます。

STEP3
範囲・単位・除外の規則を、作った人から聞き取る

作業している人の手元にしか無い情報です。除外した行数まで聞きます。聞いた内容はその場で1枚に書き、後でまとめて書くことにしません。後回しにすると、聞いた内容の半分が消えます。

STEP4
切れ目の一覧を3列で作る

何年何月に、何が、どう変わったか。過去3年分あれば十分です。思い出せない切れ目は、数字の水準が急に変わっている月を探すと見つかります。

STEP5
前提ありと前提なしで、同じ問いを1回ずつ投げて比べる

結論が変わった項目は効いている項目、変わらなかった項目は外してよい項目です。この結果を見てから、1枚を最終の形にします。

5段目を飛ばす例が多いので補足します。作った1枚が実際に効いているかは、同じ問いを前提ありと前提なしで1回ずつ投げて、返ってきた結論を並べれば分かります。結論が変わらない項目は、その表では効いていない項目なので、1枚から外して短くします。短い1枚のほうが、更新され続けます。網羅した1枚は、作った週にしか読まれません。

返ってきた解釈は、数字の出どころに戻して検算する

前提を添えても、正答率は7割弱でした。残りの3割をどう扱うかが、運用に乗せられるかどうかを分けます。といっても、全部をやり直すわけではありません。検算は、AIの答えを疑う作業ではなく、答えの出どころを1回たどる作業です。手順は3つで、慣れれば1件10分ほどで終わります。

1つ目は、結論に使われた数字を表の中から指させることです。どの行のどの列かまで書かせます。指せない数字が出てきたら、それは計算の途中で作られた数字なので、作り方を書かせます。2つ目は、その数字を自分で1回だけ手で計算し直すこと。3つ目は、結論と逆の読み方ができないかを1つだけ考えることです。逆が成り立つなら、判断に足りない前提がまだ残っています

  • 結論に使われた数字を、表の行と列で指させる。指せない数字は、計算の途中で作られた数字なので作り方を書かせる
  • 合計と内訳が合うかを1か所だけ手で確かめる。合わない場合は、除外した行が結論に反映されていない
  • 率が出てきたら、分母の件数を必ず聞き返す。分母が下限を下回る行は、その場で結論から外す
  • 前月比・前年比が出てきたら、比べた2つの時点が同じ締め方かを確かめる
  • 結論と逆の読み方を1つだけ考える。逆が成り立つなら、判断に足りない前提がまだある

検算にかかる時間は、月の工数に行として立ててください。空いた時間でやる作業にすると、忙しい月から順に抜けます。抜けた月に出た結論だけが検算されないまま資料に載り、その資料が翌期の方針の根拠になります。10分の作業を月に数回、年間で2時間ほどの行を立てるだけで済みます。

AIに判断させない範囲を、先に紙に書く

任せてよいのは、数字の集計、条件をそろえた比較、変化の大きい箇所の洗い出し、説明文の下書きです。どれも渡した表と前提の中だけで答えが出る仕事で、後から検算できます。任せてはいけないのは3つで、どの打ち手に予算を寄せるかの決定、数字の異常を正常と見なしてよいかの判断、そして社外に出す資料に載せる数字の最終確認です。

3つとも、判断に必要な材料が渡した表の外にあるからです。予算の配分には来期の事業計画と人の配置が要ります。異常値を正常と見なせるかには、その月に現場で何があったかが要ります。社外向けの数字には、公表してよい範囲の判断が要ります。打ち手を決める権限は、渡した材料の外にあります。材料を持っていない相手に決めさせると、根拠のある提案の形をした当て推量が返ってきます。

運用では2つ決めます。1つは、結論だけでなく、その結論の根拠に使った行と列を必ず書かせることです。根拠が書かれていない結論は、内容が良く見えても採用しない扱いにします。もう1つは、人が確認する範囲を、使い始める前に紙に書いておくことです。使い始めてから決めると、決める頃には確認する習慣のほうが先に消えています。

これをやると、前提を添えても読み違えは残る

最後に、前提の1枚を作ったのに効かなくなる進め方を5つ挙げます。どれも善意で起きますし、実際によく見ます。心当たりのあるものから1つずつ外してください。

  • 前提を書いた1枚を作らず、依頼のたびに口頭で説明を足す:説明の中身が人によって変わり、同じ表から違う結論が出る状態が残る
  • 1枚に項目を足し続け、30項目を超えても削らない:誰も全体を把握できなくなり、更新が止まって古い定義が渡され続ける
  • 定義が固まっていない列を、とりあえず分析に入れる:出てきた結論を検算する足場が無く、議論が言葉の意味の話に戻る
  • 率だけの表を渡し、分母の件数の列を付けない:分母の小さい行が最も成績のよい経路として上位に並び、予算配分の根拠にされる
  • AIが出した結論を、根拠の行と列を確かめずに会議資料へ転記する:誤りが見つかるのは、その資料を見た現場から指摘が出たときになる

2つ目は特によく見ます。1枚が30項目を超えると、読むほうも書くほうも全体を把握できなくなり、更新が止まります。止まった1枚は、古い定義を正しいものとして毎回渡し続ける仕組みに変わります。項目を足したくなったら、まず使われていない項目を1つ外してから足してください。項目数を一定に保つ役を誰か1人に置くと、この崩れ方は起きません。

まとめ

AIが数字を読み違えるのは、読み取りの力が足りないからではありません。意味を決めているのは数字ではなく前提のほうなのに、その前提だけが渡されていないからです。2026年4月に公開された検証では、指標の意味と社内の慣習を書いた説明を1枚添えただけで正答率が17から23ポイント上がり、その差はモデルの選び方よりも大きいものでした。添えるのは7項目——時点、範囲、単位、列の定義、除外、定義が変わった時点、件数と判断しない下限です。依頼のたびに書くのではなく1枚にして固定し、毎回変えるのは時点とその月の出来事だけにする。返ってきた解釈は、根拠の行と列を指させて1回だけ手で計算し直す。そして、打ち手の決定は人の側に残す。まず今週やることは1つです。いちばんよく使う表を開いて、列の名前を1つずつ1文で説明できるか試してください。説明できない列が見つかったら、前提の1枚はその列から書き始まります。

※本記事にはAIが活用されています。編集者が確認・編集し、可能な限り正確で最新の情報を提供するよう努めておりますが、情報の完全性、正確性、最新性、有用性等について保証するものではありません。本記事の内容に基づいて行動を取る場合は、読者ご自身の責任で行っていただくようお願いいたします。

データ分析にAIを活かす第一歩、まずは導入から始めませんか?

デボノはアカウント開設・初期設定など「そもそものAI導入」から社内定着まで伴走支援。マーケティング活用など一歩進んだご相談にも対応します。

運営会社:株式会社デボノ

目次