社内検索のリランキングとは?|答えの並びが変わる仕組み

社内検索のリランキングとは?|答えの並びが変わる仕組み

「社内の検索で、探している資料はちゃんと入っているのに、いつも3ページ目くらいに出てきます」「AIに答えさせるようにしたら、それらしいけれど古い資料を根拠に答えてくるようになりました」——社内の資料を検索に載せた会社から、この2つはよく一緒に出てきます。どちらも「探せていない」問題だと受け取られがちですが、実際には資料は見つかっています。見つかったあとの並べ方が決まっていないために、答えでない文書が上に来ているだけです。この工程には名前があり、リランキング、日本語で言えば並べ直しと呼ばれます。この記事では、社内検索の並べ直しという1つの工程だけを取り出して、何を材料に並びが決まるのか、どこまで自動で決めてよいのか、効果をどう測るのかを整理します。


カメ先生カメ先生

検索の精度が悪いという相談の多くは、探す側ではなく並べる側の話なんだよ。求めている資料は候補の中に入っているのに、上に出てこない。だから見つからないように見える。


カメ子カメ子

探し方を変えなくても、並べ方だけで結果が変わるということですか。


カメ先生カメ先生

変わることが多いね。1回目の検索は、広く拾うことを優先して作られている。近いものを速く集める代わりに、どれが答えかまでは見ていないんだ。


カメ子カメ子

その見ていない部分を、あとから別の工程で見る。それが並べ直しという理解でよいのでしょうか。


この記事のポイント
  • 1回の検索は広く拾う工程。近いことと答えであることは別なので、上位が外れる
  • 並べ直しに使えるのは点数だけではない。更新日・閲覧できる範囲・出どころの区分は人が決めて渡す
  • 測る数字は2つでよい。上位に正解が入る割合と、答えに使われた資料が何番目にあったか

AI活用を戦略に落とす前に、まずは導入・定着から始めませんか?

デボノはアカウント開設・初期設定など「そもそものAI導入」から社内定着まで伴走支援。マーケティング活用など一歩進んだご相談にも対応します。

目次

リランキングとは、探したあとに並べ直す1つの工程

社内検索を1本の流れとして見ると、問いを受け取る、候補を探す、並べる、答えを作る、という順に進みます。リランキングはこのうち3番目だけを担当する工程です。探す工程が集めてきた候補を受け取り、順番を付け直して、上位の数本だけを次に渡します。探す工程そのものには手を入れません。

名前が付いているのは、1回目の並びと2回目の並びで、使っている材料が違うからです。1回目は速さを優先して、あらかじめ計算しておいた数値どうしの近さで並べます。2回目は問いと文書を同時に読んで、この問いに対してこの文書はどのくらい答えているかを採点し直します。同じ候補でも、採点の仕方が変わると並びは大きく入れ替わります

この記事で扱うのは、この2番目の採点と、その前後だけです。資料をどの大きさに区切って取り込むか、読み込ませる前に資料をどう整えるか、出典をどう文中に付けるかといった話には入りません。どれも別の工程の主題で、並べ直しは、区切り方が決まったあとの世界に立っています。

順番としては、まず1回の検索だけでは上位が外れる仕組みを見て、次に並べ直しの中身、それから人が決める範囲、測り方、崩れる場所、最後に業務での効き方と実務仕様の順に進みます。

1回の検索だけでは、近いのに答えでない文書が上に来る

1回目の検索が使っている数値は、文書を丸ごと1つの数の並びに畳んだものです。畳むときに情報は圧縮されます。技術解説では、文をこの形に写す過程、特にまとめる処理のところで情報が圧縮されるため、微妙な文脈や関係性が失われると説明されています。失われるのは、否定しているのか肯定しているのか、誰についての記述なのか、いつの話なのかといった部分です。

結果として、話題が同じで結論が逆の文書、同じ製品について書かれているが対象の部署が違う文書、同じ手順を説明しているが前の版の文書が、近いという理由で上に並びます。利用者からは「関係ない資料が出てくる」ではなく「惜しい資料が出てくる」と見えます。惜しい資料が上位を埋めている状態は、探せていない状態より気づきにくいものです

では最初から丁寧に採点すればよいかというと、計算量が許しません。問いと文書を同時に読んで採点する方式は、問いが来るたびに全件と突き合わせる必要があります。技術解説で紹介されている実験では、10,000文の中から最も似たペアを見つける作業は49,995,000通りの組み合わせになり、65時間かかったと報告されています。社内検索の応答時間は数秒なので、この方式を全件に当てることはできません

だから2段に分けます。速い方式で広く拾い、遅いが正確な方式を少数にだけ当てる。この分業が、並べ直しという工程が存在する理由のすべてです。速さと正確さのどちらかを選ぶのではなく、役割を分けて両方を取る形になっています。

探し方が2通りあると、並びも2つできる

実務の社内検索は、探す側も1通りではありません。語がそのまま一致するかで数える方式と、意味の近さで探す方式を並べて動かす形が一般的です。前者は型番や規程の番号に強く、後者は言い換えに強い。どちらか一方では落ちるものがあるので、両方を走らせます。ただし2つ走らせると、並びが2つできます

この2つを1本にまとめる方式が決まっています。それぞれの並びでの順位の逆数を足し合わせるやり方です。マイクロソフトが公開している検索サービスの手引き(2026年6月付、2026年9月更新)では、1を順位と定数の和で割った値を足し合わせると説明されており、実験では定数を60のような小さい値にしたときに最も成績が良いと示されています。

点数ではなく順位を使うところが肝です。語の一致で数える方式の点数には上限が無く、意味の近さの点数は0.333から1.00の範囲に収まる、というようにそもそも物差しの単位が違うので、点数のまま足しても意味を持ちません。順位に直せば、どちらの方式でも1番目は1番目です。違う物差しを混ぜるときは、数値ではなく順番に直してから足す

そして重要なのは順序です。同じ手引きでは、並べ直しはこの合流のあとに起きると明記されています。つまり2つの並びを1本にしてから、あらためて採点し直す。合流の段階ではまだ、問いと文書を突き合わせた採点は入っていません。

並べ直しは、問いと文書をその場で突き合わせて採点する

工程の中身を4段に分けると、どこで何が決まるかが見えます。

STEP1
広く拾う

語の一致で数える方式と意味の近さで探す方式を並べて動かし、それぞれの上位を取り出します。ここでの目標は、答えを当てることではなく、答えを含んだ状態で候補を作ることです。

STEP2
2つの並びを1本にまとめる

それぞれの順位の逆数を足し合わせて、1本の並びにします。両方の並びで上位に出てくる文書が、自然に上に来ます。ここまでは問いの中身をほとんど見ていません。

STEP3
問いと文書を突き合わせて採点し直す

上位の一定件数だけを取り出し、問いの文と文書の中身を同時に読ませて、この問いにどのくらい答えているかを採点します。ここで初めて、否定か肯定か、誰についての話かが効いてきます。

STEP4
上位の数本だけを答えの材料に渡す

採点し直した順に並べ、上から数本だけを次の工程に渡します。渡す本数は多ければよいわけではなく、多いほど関係の薄い資料が混じります。

3段目の採点には目安の数値があります。マイクロソフトの手引きでは、この採点の点数は0.00から4.00の範囲で、4は質問に完全に答えている、3は関連するが詳細が足りない、2はやや関連する、1はごく一部に答えている、0は無関係という意味だと説明されています。この点数は並び替えだけでなく、足切りにも使えます

足切りに使うと、答えを作る前に止められます。上位の点数が全部1以下なら、そこから無理に答えを作らせず「該当する資料が見つかりませんでした」と返す。この一手があるかどうかで、根拠の薄い答えが出る頻度がかなり変わります。ただし同じ手引きは、点数の分布は環境やモデルの更新で多少ぶれるため、しきい値を細かくしすぎないようにとも注意しています。

採点だけでは決まらない。並びに効く4つの材料

問いとの突き合わせの点数は、並びを決める材料の1つでしかありません。社内の資料には、点数に現れない性質があります。いつ直されたか、誰が開いてよいか、正式な版かどうか。これらは文書の中身を読んでも分からない、外側から付ける情報です。

並びに効く材料何を見ているか自動で決めてよいか
問いとの突き合わせの点数問いの文と文書の中身を同時に読んで付けた点数自動でよい。ただししきい値は人が決める
更新日いつ直されたか自動でよい。何日で順位を下げるかは資料の種類ごとに人が決める
閲覧できる範囲その人が開いてよい資料かどうか自動。ただし並べ直しの前に落とす
出どころの区分正式な版か、下書きか、個人のメモか区分を付けるのは人。並びへの反映は自動
使われた実績過去にその資料が答えの材料になった回数参考どまり。これだけで上げない

表の右の列に注目してください。自動でよいと書いた行にも、必ず人が決める部分が残っています。更新日を順位に反映すること自体は機械の仕事ですが、規程は3年前のものでも現役、価格表は3か月前でも古い、という判断は資料の種類を知っている人にしかできません。日数を一律にすると、どちらかが必ず壊れます。

使われた実績を最後に置いたのは、これだけで順位を上げると偏りが固定されるからです。上に出た資料が使われ、使われたからまた上に出る、という回り方になります。参考の材料として弱く効かせるか、測るためだけに記録しておくか。並びを決める主な材料にはしないのが無難です。

なお、答えに出典を付ける方法そのものはこの記事では扱いません。ここで出どころを扱うのは、あくまで並びを決める材料としてです。区分を付けておくと、並べ直しの段階で下書きを下げられる、という一点だけを見ています。

並べ直せるのは、最初に拾えた分だけ

この工程には、はっきりした上限があります。並べ直しは、探す工程が拾ってきた候補の中でしか順番を変えられません。技術解説でも、再評価できるのは初期検索で取得した候補に限られると明記されています。1段目で落ちた資料は、2段目でどれだけ丁寧に採点しても上がってきません

件数の上限も公開されています。マイクロソフトの手引き(2026年8月付、2026年9月更新)では、並べ直しに進むのは上位50件までで、それ以上の結果があっても50件で切られると説明されています。既定では上位50件が返され、語の一致で数える側は最大1,000件で打ち切られる、といった数字も同じ手引きに出ています。

  • 並べ直しに進むのは先頭の50件まで。ここは設定で無限に増やせる部分ではありません
  • 1件あたり要約として渡せる長さにも上限があり、2024年11月の時点で最大2,048トークン、それ以前は256トークンでした。トークンは約10文字の目安です
  • 上限があるということは、並べ直しは一次検索が拾えた範囲の中でしか効かない、ということです

だから設計の順番が決まります。まず1段目が答えを含んだ候補を作れているかを確かめ、そのうえで2段目の件数を決める。1段目が外している状態で並べ直しを入れても、外れたものの順番が変わるだけです。導入して効果が出なかったという話は、かなりの割合がこの形をしています。

処理の時間も増えます。同じ技術解説では、候補を追加で評価するぶん処理時間は増加すると説明されています。渡す件数を増やすほど正確になりますが、待ち時間も伸びます。社内の問い合わせなら数秒、資料探しなら十数秒まで、といった許せる待ち時間を先に決めてから件数を決めると、後で揉めません。

どこまで自動で決めてよいか。人が並びに手を入れてよい場面

並びに人が手を入れる場面は、大きく2つに分かれます。1つは、特定の問いに対して特定の資料を必ず上に出すという指定。もう1つは、資料の種類ごとに重みを変えるという調整です。前者は狭く、後者は広く効きます。前者は増やしすぎると管理できなくなるので、条件を先に決めておきます。

手を入れてよい場面の条件は3つで足ります。1つ、その問いが繰り返し来ていること。2つ、正解の資料が1つに定まること。3つ、なぜ上に出すのかを1行で書けること。この3つが揃っていない指定は、後から誰も理由を説明できなくなります。

逆に、手を入れてはいけない場面もはっきりしています。利用者から「この資料を上に出してほしい」と個別に言われたとき、その場で指定を足すのは避けます。依頼のたびに指定を足していくと、半年後には誰も並びの理由を説明できない状態になります。依頼は台帳に貯めて、まとめて見直す形にします。

重みの調整は、問い単位ではなく資料の種類単位で行います。正式な版を上げる、下書きを下げる、部署をまたいで共有されている資料を上げる。こうした調整は数が少なく、理由が書けて、後から外せます。手を入れるなら、まずこちら側から動かしてください。

AIに「どれが正解か」を決めさせない範囲

並べ直しは機械の仕事です。ただし並べ直した結果を「これが正解です」と扱うかどうかは、別の判断になります。この2つを分けておかないと、上位に来たという事実が正しさの証拠のように扱われ始めます。

線は3か所に引けます。1つめは足切りの位置です。上位の点数が低いときに答えを作らせるかどうかは、機械ではなく運用側が決めます。マイクロソフトの手引きにもあるとおり、この採点は資料の全体に対して検索をやり直すことはできず、新しい情報や文字列を作ることもできません。点数が低いのは「この候補の中には無い」という意味であって、「世の中に無い」という意味ではありません。

2つめは、答えが1つに定まらない問いの扱いです。社内の問いには、部署によって答えが違うもの、いま移行中で新旧どちらも生きているものがあります。こうした問いで1本だけ上に出すと、機械が選択をしたことになります。答えが割れている問いでは、並べ直しに1本を選ばせず、複数を並べて出す形にします

3つめは、並びの理由を人が読める形で残すことです。なぜこの資料が上に来たのかを、点数と更新日と出どころの区分という材料の形で表示できるようにしておきます。利用者が理由を見て違うと思ったときに、その場で申し送りできる経路があれば、並びは運用の中で直っていきます。理由が見えない並びは、間違っていても誰も気づきません。

効果をどう測るか。2つの数字で足りる

並べ直しを入れたかどうかの効果は、体感では測れません。上位が変わったという印象は、たまたま自分の問いが当たっただけのことがあります。測る数字は2つで足ります。1つは上位に正解が入っている割合、もう1つは答えに使われた資料が何番目にあったかです。

1つめは、用意した問いに対して、正解の資料が上位の何本目までに入っているかを数えます。上位3本、上位5本、上位10本の3通りで数えておくと、渡す件数を決めるときにそのまま使えます。並べ直しを入れる前と後で同じ問いを流せば、差がそのまま効果になります。

2つめが実際の運用では効きます。答えを作った工程が、渡された資料のうち何番目を使ったかを記録しておきます。1番目ばかりが使われているなら渡す本数を減らせますし、5番目や6番目が頻繁に使われているなら並べ直しがまだ順番を当てられていないということです。上位に正解が入っていても、答えが下のほうの資料から作られているなら、並びはまだ効いていません

測るときに一緒に見ておくとよいのが、答えを作らずに「見つかりません」と返した割合です。この割合が極端に低いなら、足切りが緩すぎて根拠の薄い答えが出ています。高すぎるなら1段目が拾えていません。3つの数字は別々に動くので、まとめて1つのKPIにはしないでください。

測る前に、問いの台帳を作る

2つの数字を出すには、問いと正解の組が要ります。ここを飛ばして「精度が上がった気がする」で進めると、半年後に判断できなくなります。作るのは30問から50問ほどの台帳で足ります。列は、問いの文、正解の資料、その問いが来る部署、答えが1つに定まるかどうかの4つです。

問いの文は、社内で実際に使われている言い方をそのまま入れます。作った人が整えた文にすると、本番の問いと形が違うので数字がずれます。略称、社内でしか通じない呼び方、誤字を含んだ問いも、そのまま何問か混ぜておきます。

正解の資料を決められない問いが必ず出てきます。それは捨てずに、答えが1つに定まらない問いとして別に数えておきます。前のセクションで触れたとおり、こうした問いでは並べ直しに1本を選ばせません。台帳を作ると、社内の問いの何割が「正解が1つでない問い」なのかが初めて数字になります

台帳は作って終わりではありません。資料が増えれば正解の資料が変わりますし、組織が変われば問いの言い方も変わります。見直す頻度を決めておきます。半年に1回、問いを10問ほど足して、正解の資料が今も正しいかを確かめる。この作業を誰がやるかを決めていないと、台帳は半年で使えなくなります。

運用で崩れる場所は、資料が増えたときに最初に出る

入れた直後はうまく動いていたのに、半年後に評判が落ちるという形がいちばん多く見られます。原因は資料の増加です。資料が3倍になると、1段目が拾ってくる候補の質が変わります。同じ件数を拾っていても、その中に正解が入っている確率は下がります

ここで起きているのは並べ直しの問題ではありません。並べ直せるのは拾えた分だけなので、1段目の取りこぼしがそのまま最終の並びに出ます。それなのに利用者からは「並びが悪くなった」と見えるので、並べ直しの調整に時間を使ってしまいます。測る数字を2つに分けてあると、この取り違えが起きません。

対処は3つあります。拾う件数を増やす。探す方式の重みを見直す。資料の範囲を部署や種類で分けて、問いに応じて当てる範囲を狭める。3つめが効きやすいのですが、分け方を細かくしすぎると、どの範囲に当てるかを決める工程が新しい詰まりになります。範囲を分けるときは、問いの台帳の部署の列で分けられる粒度までにしておきます

資料が増えたときに、待ち時間も伸びます。1段目で拾う件数を増やせば、2段目に渡す件数も増えるからです。許せる待ち時間を先に決めてあると、ここで件数を増やすのか、範囲を狭めるのかの判断が機械的にできます。

古い資料が上に居座るときと、権限が混ざるとき

2つめの崩れ方が、古い版の居座りです。新しい版が出ても、古い版のほうが長く使われていて記述も詳しい場合、問いとの突き合わせの点数では古い版が勝つことがあります。点数だけで並べていると、新しい版と古い版が両方上位に並び、どちらが正かを利用者が判断する状態になります。

これは更新日を材料に足せば下げられますが、前に触れたとおり日数は資料の種類ごとに変えます。加えて、古い版を検索の対象から外す運用を決めておくと根本から消えます。外すのは機械ではなく人の仕事なので、誰がいつ外すかを決めます。

3つめが権限の混ざりです。閲覧できる範囲で資料を落とす処理を、並べ直しのあとに入れていると、人によって上位に残る本数が変わります。10本並べ直して、そのうち4本が見えない人には6本しか残りません。閲覧できる範囲で落とすのは、並べ直しの前に済ませるのが原則です。なお、権限をどう管理するかという仕組みの設計はこの記事では扱いません。ここで見ているのは落とす順序だけです。

  • 古い版と新しい版が両方上位に並び、どちらが正かを利用者が判断している
  • 並べ直しの点数が低いまま、いちばん上の資料でとにかく答えを作っている
  • 閲覧できない資料を並べ直したあとに落としているため、上位の本数が人によって変わる
  • 特定の資料を上に出す指定を依頼のたびに足していて、誰が何のために足したか分からない
  • 資料が増えたのに、1段目で拾う件数を最初のまま変えていない

社内の問い合わせ・資料探し・マーケ業務のどこに効くか

ここまでが工程の話です。実務でどこに効くかを3つに分けます。1つめは社内の問い合わせです。総務や情報システムに来る「この申請はどの様式か」「この経費は通るか」といった問いは、答えが1つに定まりやすく、正解の資料も規程や様式に限られます。正解が1本に定まる問いは、並べ直しがいちばん効く種類の問いです。

2つめが資料探しです。マーケの現場で言えば、過去の提案資料、事例のひな形、製品の仕様のうち公開してよい範囲、価格の考え方。ここでは正解が1本に定まらないことが多いので、上位に複数を並べて出す形が合います。出どころの区分を材料に入れておくと、正式な版が上に来て、個人のメモが下がります。

3つめが、資料を材料にして何かを書く業務です。BtoBの記事、ホワイトペーパー、ウェビナーの台本、営業への共有資料。ここで並べ直しが効くのは、渡される材料の上から数本が正しいかどうかが、書かれるものの正しさをほぼ決めてしまうからです。下のほうの資料は読まれません。

この3つ目には注意点が1つあります。材料の並びが良くなると、書かれた文章の見た目も良くなるので、確認が甘くなりがちです。並びが良いことと、書かれた内容が正しいことは別です。答えに使われた資料が何番目だったかを記録しておくと、確認する人がどこを疑えばよいかが分かります。社外に出す文章では、この記録を確認の手順に組み込んでおいてください。

実務仕様:先に決めておく8項目

並べ直しを入れるときに、設定より先に決めておくことを並べます。どれも技術の選択ではなく、運用の取り決めです。ここが空欄のまま入れると、半年後に誰も理由を説明できない並びができあがります。

  • 1段目で何件拾い、並べ直しに何件渡し、答えに何件使うか
  • 並べ直しの点数がいくつ未満なら、答えを作らずに見つからないと返すか
  • 閲覧できる範囲を、並べ直しの前に落とすか後に落とすか
  • 更新日を何日過ぎたら順位を下げるか、資料の種類ごとの日数
  • 正式な版と下書きの区分を、誰がいつ付けるか
  • 人が並びに手を入れてよい問いと、入れてはいけない問いの条件
  • 手を入れた記録を、誰がいつ何のために変えたかの形で残すか
  • 問いの台帳を、誰が何か月ごとに見直すか

この8つのうち、技術側だけで決められるのは1つめと2つめだけです。残りの6つは、資料を持っている部署と決めないと埋まりません。導入の打ち合わせを技術側だけで進めると、ここが全部あとから揉めます。

順番としては、3つめと4つめを先に決めるのが実務的です。この2つは利用者から見た挙動に直結するので、後から変えると「昨日と並びが違う」という問い合わせになります。並びの挙動を変えるときは、変えた日と変えた理由を利用者に見える場所に書いておきます

ミニ用語解説

この記事で使った言葉を、社内で説明するときの短い形にしておきます。

一次検索

1回目の探す工程のことです。語の一致で数える方式と、意味の近さで探す方式を並べて動かします。目的は答えを当てることではなく、答えを含んだ状態で候補を作ること。ここで落ちた資料は、後の工程では取り戻せません。

並べ直し(リランキング)

一次検索が集めた候補を受け取り、問いと文書を突き合わせて採点し、順番を付け直す工程です。候補を増やすことも、新しい文章を作ることもしません。できるのは順番を変えることだけで、そこが強みでもあり限界でもあります。

交差型の採点

問いの文と文書の中身を同時に読ませて点数を付ける方式です。片方ずつ数値に直しておく方式より正確ですが、問いが来るたびに計算するので遅くなります。だから候補を絞ってから当てます。

2つの並びの合流

語の一致で探した並びと、意味の近さで探した並びを1本にまとめる処理です。点数ではなく順位の逆数を足します。物差しの単位が違うものを混ぜるときの、ごく一般的なやり方です。

上位に正解が入る割合

用意した問いのうち、正解の資料が上位の何本目までに入っていたかの割合です。上位3本、5本、10本の3通りで数えておくと、答えに渡す本数を決めるときの根拠になります。

まとめ

社内検索で上位が外れるのは、探せていないからではなく、探したあとの並べ方が決まっていないからです。1回目の検索は広く速く拾うために情報を圧縮していて、近いことと答えであることを区別していません。だから2段目で、問いと文書を突き合わせて採点し直す工程を置きます。ただしこの工程が触れるのは、1段目が拾えた候補の中だけです。件数にも渡せる長さにも仕様として上限があります。並びに効く材料は採点の点数だけではなく、更新日、閲覧できる範囲、出どころの区分が入ります。このうち日数の決め方と区分の付け方は人の仕事として残り、答えが割れている問いで1本を選ばせないという線も人が引きます。測る数字は、上位に正解が入る割合と、答えに使われた資料が何番目にあったかの2つ。この2つを出すために、30問から50問の台帳を先に作ってください。台帳が1枚あると、並べ直しを入れるべきかどうかも、入れたあとに効いているかどうかも、同じ物差しで話せるようになります。

※本記事にはAIが活用されています。編集者が確認・編集し、可能な限り正確で最新の情報を提供するよう努めておりますが、情報の完全性、正確性、最新性、有用性等について保証するものではありません。本記事の内容に基づいて行動を取る場合は、読者ご自身の責任で行っていただくようお願いいたします。

AI活用を戦略に落とす前に、まずは導入・定着から始めませんか?

デボノはアカウント開設・初期設定など「そもそものAI導入」から社内定着まで伴走支援。マーケティング活用など一歩進んだご相談にも対応します。

運営会社:株式会社デボノ

目次