Media > AI活用ユースケース > 人事 > ベテラン職員の介助の動画から、新人向けの手順書の下書きを声かけと注意点付きで作る

ベテラン職員の介助の動画から、新人向けの手順書の下書きを声かけと注意点付きで作る

実装ステータス:構成例 技術的に実現可能な構成として設計したもの。自社未検証

ベテラン職員が行う移乗や入浴の介助を撮影し、その動画から新人向けの手順書の下書きを作ります。手順を時刻付きで区切り、声かけの言葉と見えている注意点を書き出すので、教育担当は下書きを直す作業から始められます。

サマリー
生成AI
ChatGPT/Claude/Gemini
連携・自動化
Google Apps Script/Make/Power Automate
対象業界
介護/医療
対象部門
人事
対象業務
書類作成/記録・議事録作成
主な課題
属人化している/引き継ぎができていない/書類作成に時間がかかる
AIで行う処理
生成
主な効果
属人化解消/工数削減/教育コスト削減
導入難易度
★★☆☆☆
実装レベル
半自動化
費用感
API連携(中)
人間の確認
条件付き
現在工数
36h/月
AI導入後
9h/月
想定削減
75%
年間削減
324h
モデル条件による試算値です。実在企業の実績ではありません。

01導入前 / 導入後の業務フロー

導入前(Before)
  1. 教育担当が、手順書を作る介助を決め、ベテラン職員と日程を合わせる
  2. ベテランの介助を横で見ながら、手順をメモし、要所で写真を撮る
  3. メモを見ながら、手順を1つずつ文章にする。声かけの言葉は、覚えている範囲で書く
  4. 分からなかった動作について、ベテランに聞き直す
  5. 写真を選び、手順の横に貼る
  6. ユニットリーダーと看護職に下書きを見てもらい、直す
  7. 共有ドライブに置き、新人研修で使う
導入後(After)
  1. 人教育担当が、手順書を作る介助と撮影の日を決める。利用者役は職員が演じる
  2. 人ベテランが声かけをしながら介助を行い、タブレットで2方向から撮影する
  3. 人撮影した動画を、共有ドライブの所定のフォルダに置く
  4. 自動フォルダへの保存をきっかけに、動画の長さ・形式・映っている範囲の確認をする
  5. 自動動画をAPIのファイル置き場に上げ、処理が終わるのを待つ
  6. 自動生成AIが、動画の映像と音声から、手順を時刻付きで区切り、声かけと見えている注意点を書き出し、映像から分からないことを質問として挙げる
  7. 自動手順ごとの時刻から静止画を切り出し、下書きの手順の横に並べる
  8. 人教育担当が、質問の一覧を持ってベテランに聞き取り、答えを下書きに書き足す
  9. 人ユニットリーダーと看護職が、手順の安全性と利用者の状態への合わせ方を確かめて直す
  10. 人確定した手順書を共有ドライブに置き、新人研修で使う
各工程の詳しい説明を読む
  1. 教育担当が、手順書を作る介助を決め、ベテラン職員と日程を合わせる
  2. ベテランの介助を横で見ながら、手順をメモし、要所で写真を撮る
  3. メモを見ながら、手順を1つずつ文章にする。声かけの言葉は、覚えている範囲で書く
  4. 分からなかった動作について、ベテランに聞き直す
  5. 写真を選び、手順の横に貼る
  6. ユニットリーダーと看護職に下書きを見てもらい、直す
  7. 共有ドライブに置き、新人研修で使う

(a)見ながらのメモが追いつかない。 移乗の介助は数分で終わります。横で見ている間に、手の位置、足の置き方、声かけの言葉を全部書き留めることはできません。 2回目、3回目を見せてもらうと、ベテランの時間と、利用者役の時間がかかります。

(b)声かけが抜ける。 動作は写真に残せますが、言葉は残りません。手順書に「声をかける」とだけ書かれ、何と言うかが抜けるのは、ここが原因です。

(c)こつが文章にならない。 ベテランに「なぜそこで一度止まるのか」を聞くと、「相手の力が入るのを待っている」と答えます。この答えは、聞かなければ出てきません。 横で見ているだけでは、止まったことにさえ気づきません。

(d)作り直しが後回しになる。 1件に半日かかるので、手順書は古いまま残ります。実際の介助と手順書が食い違ったまま、新人は現場の教え方で覚えます。

  1. 【人】 教育担当が、手順書を作る介助と撮影の日を決める。利用者役は職員が演じる
  2. 【人】 ベテランが声かけをしながら介助を行い、タブレットで2方向から撮影する
  3. 【人】 撮影した動画を、共有ドライブの所定のフォルダに置く
  4. 【自動】 フォルダへの保存をきっかけに、動画の長さ・形式・映っている範囲の確認をする
  5. 【自動】 動画をAPIのファイル置き場に上げ、処理が終わるのを待つ
  6. 【自動】 生成AIが、動画の映像と音声から、手順を時刻付きで区切り、声かけと見えている注意点を書き出し、映像から分からないことを質問として挙げる
  7. 【自動】 手順ごとの時刻から静止画を切り出し、下書きの手順の横に並べる
  8. 【人】 教育担当が、質問の一覧を持ってベテランに聞き取り、答えを下書きに書き足す
  9. 【人】 ユニットリーダーと看護職が、手順の安全性と利用者の状態への合わせ方を確かめて直す
  10. 【人】 確定した手順書を共有ドライブに置き、新人研修で使う

6番目の「質問として挙げる」が、この設計の分かれ目です。 下書きは手順を並べるだけでなく、映像を見て分からなかったことを、ベテランへの質問の形で出します。 教育担当はその質問を持って聞き取りに行けばよく、③の聞き直しが短く、深くなります。

9番目を省かないのも、意図してのことです。 ベテランのやり方が、そのまま新人に教えてよいやり方とは限りません。動画は「実際に行われたこと」の記録で、「行うべきこと」の基準ではありません。

02今回想定するシステム構成

構成図
介助の撮影(タブレット2台、職員が利用者役)
   │
   ▼【トリガー】共有ドライブの所定フォルダへの動画の保存
Google Apps Script
   ├──▶ 長さ・形式・ファイルの大きさの確認
   ▼
Gemini API(Files API で動画を上げ、ACTIVE になるまで待つ)
   │   映像と音声から
   │   ① 手順の区切りと時刻   ② 声かけの言葉   ③ 見えている注意点
   │   ④ 映像から分からないこと(ベテランへの質問)
   ▼
手順ごとの時刻から静止画を切り出し、下書きに並べる
   ▼
【教育担当が聞き取り → ユニットリーダー・看護職が確認】
   ▼
共有ドライブに確定版の手順書を置く(人が行う)
役割想定する製品代替候補
処理Gemini API(動画の映像と音声の理解、手順の書き出し)Claude API(静止画に切り出して渡す)、OpenAI API
連携Google Apps Script(フォルダの監視、APIの呼び出し、下書きの作成)Power Automate、Make
保管Google ドライブ(動画、下書き、確定版の手順書)SharePoint、OneDrive
撮影施設の業務用タブレット固定のカメラ

動画を直接理解できる生成AIを選んでいます。 Gemini API は動画を入力として受け取り、要約、質問への回答、特定の時刻への言及ができます。映像と音声をまとめて扱えるので、動作と声かけを同じ時刻で結び付けられます。 代替候補の Claude API や OpenAI API で行う場合は、動画から静止画を切り出し、音声は別に文字起こしして渡す構成になります。

動画の渡し方は2つあります。 100MB未満ならリクエストに直接埋め込めますが、100MBを超える動画や、同じ動画を何度も使う場合は Files API が推奨されています。 手順書の下書きは、指示を変えて何度か作り直すことがあるので、この構成では Files API を使います。アップロードした動画は、状態が ACTIVE になってから使います。 公式の例でも、ACTIVE になるまで待ってから生成を呼んでいます。

動画の見られ方にも決まりがあります。 既定では1秒に1コマを取り出して見ており、コマの間隔は変えられます。音声は1kbpsの単一チャンネルで処理されます。動画の中の時刻は MM:SS の形で指定・参照できます。 量の目安は、既定の低い解像度で1秒あたり約100トークン、高い解像度で約300トークンとされています。

介助の動画で効いてくるのは、1秒1コマという既定の間隔です。 移乗のなかで一度止まって相手の力を待つ瞬間は、1〜2秒のことがあります。既定の間隔では、その止まりが映像からは拾えないことがあります。 第7章で、手順の要所だけを区切って細かく見る方法を書きます。

03どうやって実装するのか

Step1

処理の起点を決める

共有ドライブの所定のフォルダに動画が保存されたことを起点にします。 撮影の後、ベテランか教育担当がタブレットから動画をフォルダに置きます。フォルダは介助の種類ごとに分け、フォルダ名を下書きの題名に使います。

1回の撮影で2本の動画が入ります。 正面と横の2方向から撮るので、同じ介助の2本を1組として扱います。 フォルダに2本がそろった時点で動かし、1本だけのときは30分待ってから、1方向だけで下書きを作ります。

処理が終わった動画は、処理済みのフォルダへ移します。 移すのは、下書きの作成に成功したときだけにします。所定のフォルダに残っている動画の数が、そのまま未処理の数になります。

撮影そのものは、月の計画に沿って行います。 月12件の手順書を作るので、週に3件ずつ撮影する日を決めておきます。 撮影の予定表を作ると、新人の配属の時期に合わせて、必要な介助から順に手順書をそろえられます。

Step2

入力データを集める

データ中身取得元
介助の動画正面と横の2方向。ベテランの声かけと、利用者役の応答が入っている共有ドライブの所定フォルダ
介助の種類移乗(ベッドから車いす)、入浴、食事、排泄、体位変換などフォルダ名
撮影の条件利用者役の想定(右片麻痺、立位が不安定など)、使った福祉用具撮影時に書く短いメモ
施設の用語集福祉用具の呼び方、施設で使う言い回し教育担当が用意する一覧
既存の手順書同じ介助の古い手順書(あれば)共有ドライブ

質を決めるのは、撮影の条件のメモです。 「右片麻痺の想定」と書かれていないと、AIは左右の手の使い分けを、どちらの利用者にも当てはまる手順として書きます。利用者役の想定が違えば、同じ動画でも手順書の意味が変わります。

既存の手順書は、比べる材料として渡します。 新しい動画のやり方と古い手順書が違うところを、「古い手順書との違い」として別の欄に出させます。 どちらが正しいかは決めさせません。

Step3

データの取得方法を決める

動画は Files API で上げます。 Apps Script でフォルダの動画を読み、APIのファイル置き場へアップロードし、返ってきたファイルの状態が ACTIVE になるまで一定の間隔で確かめます。ACTIVE になる前に生成を呼ぶと、動画を読めません。

取るものどこから何に使うか
動画の全体Files API に上げた動画手順の区切り、声かけ、注意点の書き出し
要所の区間同じ動画の開始と終了の時刻を指定した区間細かい動作の見直し
撮影の条件撮影時のメモ利用者役の想定を指示に入れる
用語集教育担当の一覧下書きの言い回しをそろえる

要所の区間は、2回目の呼び出しで細かく見ます。 1回目で手順を区切った後、立ち上がり、方向転換、着座のような要所の区間だけを、開始と終了の時刻(ミリ秒)を指定して取り出し、コマの間隔を既定より細かくして見直させます。動画全体を細かく見るより、必要なところだけを細かく見るほうが、量も抑えられます。

上げた動画は、48時間で自動的に消えます。 Files API のファイルは48時間保存され、それより前に手動で消すこともできます。元の動画は共有ドライブに残り、APIの側には一時的に置くだけです。 下書きの作成が終わったら、APIの側のファイルはすぐに消します。

Step4

AIへ渡す前に整形する

  1. 撮影の範囲の確認 … 撮影の前に、画面に映る範囲を決めます。利用者役の職員の顔が映っても、撮影の同意を取った職員に限ります
  2. 形式の確認 … MP4、MOV、WEBMなど、対応している形式かを確かめます。対応していない形式は変換します
  3. 長さの確認 … 1本の動画に複数の介助が入っていれば、介助ごとに分けます。1本は1つの介助にします
  4. 大きさの確認 … 100MBを超えるものは Files API で上げます。この構成では、大きさにかかわらず Files API を使います
  5. 音声の確認 … 声かけが聞き取れる音量かを、冒頭の数秒で確かめます。機械の音や他の職員の声が大きい場所では、撮影の場所を変えます
  6. 撮影の条件のメモの確認 … 利用者役の想定と、使った福祉用具が書かれているかを確かめます。空なら、下書きを作らずに教育担当へ知らせます
  7. ファイル名の付け替え … 介助の種類、撮影日、方向(正面/横)の順にそろえます

1番目を軽く見ないでください。 介助の撮影に実際の利用者が映ると、身体の状態や入浴の場面を記録することになります。この構成では、利用者役を職員が演じることを前提にします。 利用者本人の撮影が必要な場合は、本人と家族の同意、施設の規程、映る範囲の取り決めを先に整えてください。

Step5

AIに処理させる

させるのは、動画の映像と音声から、手順を時刻付きで区切り、手順ごとに5つの欄を書き出すことです。

欄何を書かせるか分からないときの扱い
動作職員の手の位置、足の位置、体の向きなど、映像に映っている動き映っていなければ「映像では確認できない」
声かけそのとき職員が言った言葉を、音声のとおりに聞き取れなければ「聞き取れない」。補わない
利用者役の応答利用者役が言ったこと、動いたこと無ければ「なし」
見えている注意点映像から分かる確認の動作(ブレーキの確認、足の位置の確認など)無ければ「なし」
ベテランへの質問映像から理由が分からない動作、止まった理由など必ず何か書く。無ければ「なし」

右端の列が、この構成でいちばん大事な決まりです。 聞き取れなかった声かけを、AIは介助の場面にふさわしい言葉で埋めようとします。「ゆっくり立ちましょうね」のような、ベテランが言っていない言葉が手順書に載るのが最も起きやすい失敗です。 聞き取れないものは「聞き取れない」と書かせ、ベテランへの質問に回します。

いちばん下の「ベテランへの質問」は、下書きの中でいちばん役に立つ欄です。 「01:42で手を止めて2秒ほど待っているが、理由は映像から分からない」と出れば、教育担当はその時刻の映像を見せながら聞けます。 こつは、質問されて初めて言葉になります。

させないこと理由
手順の安全性の評価看護職・リハビリ職を含む指導者が確かめる事項
動作の理由の推測映像に映っていない。理由はベテランに聞く
声かけの補完・言い換え言っていない言葉を手順書に載せない
利用者の状態への当てはめ「どの利用者にもこの手順で」と一般化しない
古い手順書との優劣の判断違いは並べるだけ。どちらが正しいかは指導者が決める

2行目がいちばん起きやすい失敗です。 手を止めた場面に「利用者の安全を確認するため」と理由を添えると、それらしく読めます。けれども、ベテランが本当は相手の膝に力が入るのを待っていたのなら、その添え書きはこつを覆い隠します。

Step6

指示内容を固定する

あなたは介護施設の教育担当として、ベテラン職員の介助の動画から、
新人向けの手順書の下書きを作る立場です。
動画に映っていること、聞こえていることだけを書いてください。推測で補わないでください。

【動画の条件】
- 介助の種類:{care_type}
- 利用者役の想定:{role_condition}
- 使った福祉用具:{equipment}
- 撮影の方向:{camera_angles}

【やること】
1. 介助を手順に区切り、各手順の開始と終了の時刻を MM:SS で書いてください
2. 手順ごとに、次の5つを書いてください
   - action ......... 職員の手・足・体の向きなど、映像に映っている動き
   - words .......... 職員が言った言葉を、音声のとおりに
   - response ....... 利用者役が言ったこと、動いたこと
   - visible_checks . 映像から分かる確認の動作
   - questions ...... 映像から理由が分からない動作、止まった理由など、ベテランに聞くべきこと

【厳守事項】
- 聞き取れない言葉は「聞き取れない」と書いてください。
  場面にふさわしい言葉で補わないでください。
- 声かけは言い換えず、聞こえたとおりに書いてください。
- 動作の理由を書かないでください。理由が分からない動作は questions に入れてください。
- 映像で見えない部分(手元が体で隠れているなど)は「映像では確認できない」と書いてください。
- 手順が安全か、正しいかを評価しないでください。
- この手順がどの利用者にも当てはまるとは書かないでください。
  利用者役の想定の範囲の手順として書いてください。
- 既存の手順書と違うところは differences に並べ、どちらが正しいかは書かないでください。
- 用語は用語集の言い方にそろえてください。

【用語集】{glossary}
【既存の手順書】{old_manual}

「聞き取れない言葉を補わない」を明記しないと、声かけが埋まります。 介助の場面の声かけは型が決まっているので、AIはもっともらしい言葉を知っています。知っていることと、その人が言ったことは違うと、指示で分けます。

「どの利用者にも当てはまるとは書かない」も、書かないと起きます。 手順書の文体で書かせると、自然と一般的な手順の書き方になります。右片麻痺の想定で撮った手順が、どの利用者にも使える手順として新人に渡るのを防ぎます。

Step7

出力形式を固定する

次の形のJSONで受け取ります。

{
  "care_type": "",
  "role_condition": "",
  "steps": [
    {
      "step_no": 1,
      "start": "00:12",
      "end": "00:31",
      "action": "",
      "words": "",
      "response": "",
      "visible_checks": [""],
      "questions": [""]
    }
  ],
  "differences": [{ "step_no": 0, "old_manual": "", "video": "" }],
  "unheard_count": 0
}

unheard_count は、words に「聞き取れない」が入った手順の数です。この数はプログラムが数え直します。

1つ目の理由は、時刻で静止画を切り出せることです。 start と end の時刻から、手順ごとに静止画を切り出して下書きの横に並べます。写真を選ぶ作業が、時刻から機械的に決まります。 教育担当は、並んだ静止画から合わないものを差し替えるだけです。

2つ目は、questions を聞き取りの一覧にできることです。 手順ごとの質問を時刻付きで一覧にすれば、ベテランへの聞き取りを、動画のその時刻を見せながら進められます。

3つ目は、下書きの様式を固定できることです。 手順書の様式の欄に、JSONの項目をそのまま対応させます。

JSONの項目手順書の欄書く人
start・end と静止画手順の写真自動(切り出し)
action動作AIの下書き → 教育担当
words声かけAIの下書き → ベテランの確認
visible_checks確認することAIの下書き → 指導者
questions の答えこつ・理由ベテランへの聞き取りで教育担当が書く
(無し)安全上の注意、利用者の状態による違い指導者が書く

要は、こつと安全の欄をAIに書かせないことです。 こつはベテランから、安全は指導者から、それぞれ人が書き足します。

Step8

システムへ連携する

つなぎ先方式内容
共有ドライブApps Script のフォルダの監視動画の保存を検知し、処理済みへ移す
Gemini APIFiles API へのアップロード、生成の呼び出し動画を上げ、下書きのJSONを受け取る
静止画の切り出し動画の編集の道具(手順ごとの時刻を指定)手順ごとの写真を作る
手順書の様式文書の作成(Google ドキュメントなど)JSONを様式に流し込み、下書きにする

確定版の手順書は、人が置きます。 下書きのフォルダと確定版のフォルダを分け、確定版のフォルダには、指導者が確認した後の手順書だけを置きます。 下書きが研修で使われないようにするためです。

APIの側のファイルは、下書きを作り終えたら消します。 元の動画は共有ドライブにあるので、APIの側に残しておく理由はありません。

Step9

人が確認する

下書きは、3人の手を通ってから確定します。

  1. 教育担当が questions を持ってベテランに聞く … 時刻付きの質問を一覧にし、動画のその時刻を見せながら聞きます。答えを「こつ・理由」の欄に書き足します
  2. ベテランが words を確かめる … 聞き取れなかった声かけと、聞き違いを直します。自分が実際に言っている言葉かどうかを確かめます
  3. ユニットリーダーと看護職が安全を確かめる … 手順が利用者役の想定に合っているか、職員の腰に負担のかかる姿勢が無いか、事故につながる動きが無いかを見ます。「安全上の注意」の欄は、ここで書きます
  4. 新人に試してもらう … 確定の前に、新人1名に手順書を読んで介助を再現してもらいます。読んで分からなかった箇所を直します

3番目を省かないでください。 ベテランのやり方でも、施設の方針や最新の考え方と合わないことがあります。動画が記録するのは実際に行われたことで、教えるべきことを決めるのは指導者です。

4番目は、外国人の職員が多い施設ほど効きます。 声かけの言葉が手順書に書かれていると、新人はその言葉を覚えることから始められます。

Step10

例外に対処する

起きること対応
動画が1方向しかない1方向で下書きを作り、映像で確認できない部分を questions に回す
声かけがほとんど聞き取れないunheard_count が多い下書きは、撮影をやり直すか、ベテランに声かけを口述してもらう
手元が体で隠れて見えない「映像では確認できない」とし、要所の区間だけ別の方向から撮り直す
1本に複数の介助が入っている介助ごとに区切って上げ直す
撮影の条件のメモが無い下書きを作らず教育担当へ知らせる
実際の利用者が映り込んだ下書きを作らず、動画の扱いを施設の規程に従って決める
対応していない形式対応する形式に変換してから上げ直す
ファイルが ACTIVE にならない一定時間待って失敗なら、動画を所定のフォルダに残して知らせる
APIが応答しない所定のフォルダに残す。処理済みへ移すのは成功時だけ

上から3行目までが大半を占めます。 どれもAIの問題ではなく、撮影の方法の問題です。 2方向から撮ること、静かな場所で撮ること、声かけをはっきり言ってもらうこと。撮影の手引きを1枚作るほうが、指示を工夫するより効きます。

6行目は、この構成の前提が崩れたときの決まりです。 利用者役を職員が演じる前提なので、実際の利用者が映り込んだ動画は、下書きの材料にしません。

Step11

記録を残す

  • 元の動画と、撮影日・撮影の条件のメモ・映っている職員(撮影の同意の有無)
  • AIに渡した指示の全文と、返ってきたJSONの全文
  • ベテランへの質問と、その答え
  • 指導者が直した箇所と、書き足した安全上の注意
  • 確定版の手順書と、どの動画から作ったかの対応
  • unheard_count と、撮影のやり直しの有無

5つ目の対応は、手順書を見直すときの材料です。 1年後に手順を変えるとき、どの動画のどの手順から書かれたかが分かれば、撮り直すべき場面が決まります。

最後の行は、撮影の手引きを直す材料になります。 特定の場所や介助で unheard_count が多いなら、そこでの撮影の方法を変えます。

04実装レベルの3段階

最小構成:動画を手で生成AIの画面に渡し、手順と声かけを書き出させる / 1本の動画の下書き
半自動化:上記+フォルダへの保存を起点にAPIで下書きを作り、静止画を切り出して様式に流し込む / 下書きの作成と写真の配置
本格構成:上記+要所の区間の見直し、古い手順書との違いの一覧、多言語の版の下書き / 手順書の改訂の準備まで

最小構成では、写真と様式が手作業で残ります。 下書きの文章はできても、静止画を選んで貼る作業が残るので、動画から手順と声かけが取れるかを確かめる段階です。 半自動化で、1件180分が45分程度になります。この段階が本記事の想定です。 見ながらのメモ、書き起こし、写真の選び出しが下書きに置き換わり、教育担当に残るのは、質問を持って聞き取る時間と、指導者の確認を回す時間です。聞き取りの時間は減らしません。 質問がそろっている分、むしろ中身が濃くなります。 本格構成は、外国人の職員向けの版や、古い手順書の改訂にまで広げる段階です。 確定版の手順書から多言語の版の下書きを作る場合も、翻訳した声かけを、その言語の話せる職員に確かめてもらう工程を必ず置きます。

05工数削減シミュレーション

前提値(モデル条件)
対象人数
3 名
月間件数
12 件
1件あたり現在時間
180 分
1件あたり導入後時間
45 分
現在  12件 × 180分 ÷ 60 = 36 時間/月
導入後 12件 × 45分 ÷ 60 = 9 時間/月
月間削減時間
27h
削減率
75%
年間削減時間
324h
年間金額換算(時間単価2,800円)
91万円
モデル条件による試算であり、実際の効果は業務内容・運用方法によって異なります。

自社条件で導入効果を整理したい方へ

このユースケースを自社に当てはめた場合の前提値と削減見込みを、業務ヒアリングをもとに整理します。

AI活用について相談する

06向いている企業・向いていない企業

向いている
  1. 毎月のように新人や外国人の職員を受け入れ、移乗・入浴・食事・排泄の介助をベテラン職員の横について覚える形になっている特別養護老人ホームや介護老人保健施設、病院の病棟。介助のこつが職員ごとの口伝えで、手順書が無いか古いままの場合。職員同士で利用者役を演じて撮影できる場合。
向いていない
  1. 手順書がすでに整っており、改訂の頻度が低い場合。撮影の場所と時間を確保できない場合。利用者本人を撮影しないと手順が分からず、本人と家族の同意を得る運用が組めない場合。なお、介助の方法が利用者の状態に合っているか、安全かの判断は、この構成では代替できません。

07最小構成で試す方法

  1. 移乗の介助を1つ選び、ベテランと職員の利用者役で、正面から1本撮影する(声かけをしながら行ってもらう)
  2. 撮影の条件(利用者役の想定、使った福祉用具)を短く書く
  3. 法人で契約している Gemini の画面に動画を渡す
  4. 「この介助を手順に区切り、各手順の時刻、動作、声かけ(聞こえたとおり)、利用者役の応答、ベテランに聞くべきことを書いてください。聞き取れない言葉は補わず、動作の理由を推測しないでください」と指示する
  5. 出てきた下書きを、ベテランと一緒に動画を見ながら確かめる

5番目は、必ずベテランと一緒に行ってください。 下書きの声かけが自分の言葉か、質問に挙がった動作の理由を言葉にできるかを、その場で確かめます。

出てきた内容判断
手順と声かけがおおむね合い、質問がこつを引き出したフォルダの監視と静止画の切り出しに進む
声かけを補ったり、理由を書き足したりした指示の書き方で直る。構成は有効
声かけが聞き取れない、手元が映っていない撮影の方法が先。 AIの問題ではない

3行目が出たら、撮影の手引きを作る合図です。 2方向で撮る、カメラを手元に近づける、静かな場所で撮る。1本目で撮影の方法が決まれば、2本目からは下書きがそのまま使えるものになります。

08実装時につまずきやすいポイント

問題対策
言っていない声かけが載る聞き取れない言葉は「聞き取れない」と書かせ、ベテランが確かめる
動作に理由が書き足される理由の推測を禁じ、分からない動作は質問に回す
短い止まりが拾えない既定は1秒1コマ。要所の区間だけ時刻を指定して細かく見直す
手元が体で隠れる2方向から撮る。隠れた部分は「映像では確認できない」
声かけが聞き取れない静かな場所で撮り、ベテランにはっきり言ってもらう
ACTIVE になる前に呼ぶ状態を確かめてから生成を呼ぶ
どの利用者にも当てはまる手順として書かれる利用者役の想定を指示に入れ、一般化を禁じる
実際の利用者が映り込む利用者役は職員が演じる。映り込んだ動画は材料にしない
下書きが研修で使われる下書きと確定版のフォルダを分ける
安全の確認が抜ける指導者の確認を経ないと確定版に置けない運用にする
APIの側に動画が残る下書きを作り終えたら消す。自動でも48時間で消える
無料の枠で試してしまう無料の枠に業務の動画を渡さない。 法人の有料の契約で使う

上の2行が、この構成の失敗のほとんどです。 どちらも、AIが介助の場面について「知っていること」で、「映っていないこと」を埋めるところから出ています。知っていることを書かせず、分からないことを質問にさせるかどうかで、手順書にベテランのこつが残るかが決まります。

下の2行も、早い時期に効いてきます。 Gemini API の利用規約では、無料のサービスに送った内容は製品の改善に使われ、人が読むこともあるとされ、機密や個人の情報を送らないよう求められています。 有料のサービスでは、内容を製品の改善に使わないとされています。

09セキュリティ・AIガバナンス上の注意点

この構成で扱うデータ: 職員の顔と声、介助の動作、利用者役の想定(麻痺の側など)、施設の中の様子です。実際の利用者が映れば、身体の状態や入浴・排泄の場面という、極めて配慮の要る情報になります。

  1. 利用者役は職員が演じる … この構成の前提です。利用者本人を撮影する場合は、本人と家族の同意、映る範囲、保存と廃棄の期間を施設の規程で先に決めてください
  2. 医療・介護のガイダンスを確認する … 個人情報保護委員会と厚生労働省が、医療・介護関係事業者向けのガイダンスを出しています。要配慮個人情報の取得には原則として本人の同意が必要とされているので、利用者が映る撮影を行う前に確認してください
  3. 撮影に協力する職員の同意を取る … 顔と声が動画に残り、外部のAIサービスに送られることを説明し、同意を取ります。同意の無い職員は映さないか、映る範囲を手元に限ります
  4. 無料の枠を使わない … Gemini API の規約では、無料のサービスに送った内容は製品の改善に使われ、人が読むことがあるとされています。業務の動画は、法人の有料の契約でだけ扱ってください
  5. APIの側に動画を残さない … Files API のファイルは48時間で消えますが、下書きを作り終えたらすぐに消します
  6. 手順の安全性をAIに任せない … 手順書に載せてよいか、利用者の状態に合っているかは、指導者が決めることです。この構成が出すのは、ベテランが行ったことを書き出した下書きだけです

誤りが起きた場合のリスクは、言っていない声かけや、根拠の無い理由が手順書に載ることと、安全の確認を経ない手順が新人に渡ることの2つです。 前者は聞き取れないものを補わせないことで、後者は確定版のフォルダを指導者の確認の後に限ることで防ぎます。どちらも、AIの下書きと、人が決める手順書を分ける設計で守ります。

10まず何から始めるか

1週目:撮影の決まりを作る

利用者役を職員が演じること、撮影に協力する職員の同意の取り方、映す範囲を決めます。あわせて、生成AIを使うのが法人の有料の契約であることを、情報システムの担当と確かめます。

2週目:移乗の介助を1本で試す

ベテランと利用者役の職員で、移乗の介助を正面から1本撮り、生成AIの画面で下書きを作らせます。ベテランと一緒に下書きを見て、言っていない声かけと、書き足された理由が無いかを最優先で見ます。

3週目:撮影の手引きを作る

1本目で分かった撮影の問題(手元が隠れる、声が小さい)から、2方向で撮る、カメラの位置、撮影の場所を1枚の手引きにします。2本目、3本目をこの手引きで撮ります。

4週目:フォルダから下書きまでをつなぐ

Apps Script で所定のフォルダを見張り、動画を Files API に上げ、下書きのJSONを様式に流し込み、静止画を並べるところまで作ります。この時点では、下書きと質問の一覧だけを出し、確定は従来どおり人が行います。

2か月目: 月12件の撮影の予定表を作り、新人の配属の時期に合わせて介助の手順書を順にそろえます。unheard_count と、ベテランへの質問の数を毎回数えます。3か月目以降: 要所の区間の見直しと、古い手順書との違いの一覧を足し、1件180分が何分になったかを実測します。新人が手順書だけを読んで介助を再現でき、指導者の確認で直す箇所が減ってきた時点で、この構成は完成です。


11関連ユースケース

12この仕組みを理解するための記事

13技術仕様の確認日・参考情報

技術仕様確認日:2026-09-29/最終更新:2026-09-29
確認した内容情報源確認日
動画を Files API(100MBを超える場合や再利用する場合に推奨)、インライン(100MB未満)、YouTube のURLで渡せること。アップロード後に状態が ACTIVE になるまで待つこと。既定で1秒1コマを取り出し、間隔を変えられること。音声が1kbpsの単一チャンネルで処理されること。時刻を MM:SS で参照できること。開始・終了の時刻(ミリ秒)で区間を指定できること。1秒あたり約100トークン(低い解像度)/約300トークン(高い解像度)であること。対応する形式(MP4、MOV、WEBM など)Gemini API: Video understanding2026-09-29
Files API のファイルが48時間保存された後に自動で消え、それより前に手動で消せること。アップロードしたファイルはAPIから取り出せないことGemini API: Files API2026-09-29
無料のサービスに送った内容と応答が製品の改善に使われ、人が読むことがあり、機密・個人の情報を送らないよう求められていること。有料のサービスでは内容を製品の改善に使わないことGemini API: Additional Terms of Service2026-09-29
医療・介護関係事業者向けのガイダンスが個人情報保護委員会と厚生労働省から出されていること。病歴や障害の事実などが要配慮個人情報にあたり、取得や第三者提供に原則として本人の同意が必要なこと。安全管理措置などの義務個人情報保護委員会: 医療・介護関係事業者における個人情報の適切な取扱いのためのガイダンス2026-09-29

介助の手順が安全か、利用者の状態に合っているかは、施設の指導者と専門職で必ず確かめてください。 本記事は上の資料で確認できた範囲だけを扱っています。

実装ステータス:構成例。 公開仕様に基づいて設計した構成であり、当社で実際に構築・検証したものではありません。工数の数値はモデル条件による試算です。

自社の業務に使えるAI活用候補を整理します

このユースケース(UC-0325)についてのご相談はこちらから。

AI活用について相談する
目次