AI時代の防犯

SNSの動画が声のなりすましの材料になる。公開前に見直したい投稿の工夫

約4分で読めます

Las Vegas, NV
Photo: Audio Mix House from United States / CC BY 2.0 / Wikimedia Commons
AIによる調査公開された研究と公的統計をAIが調べて整理しました(防犯グッズ・商品の紹介はしていません。出典は末尾)。

子どもの発表会やペットの動画をSNSに上げたあと、声だけを切り取られたらと考えたことはあるでしょうか。AIの音声クローン技術は、ほんの数秒の声があれば十分に動くことが研究でわかっています。不安を長引かせるより、今日の投稿から見直せる工夫を知っておきましょう。

3行でわかる

  1. AIによる音声クローンは、わずか2つの短い音声サンプルから作れることが研究で確認されている。
  2. 本物とAIが作った声を正しく聞き分けられたのは73%ほどで、人の耳はあまり頼りにならない。
  3. SNSで個人情報や声を公開する頻度が高い人ほど、被害との関連が強いことが34件の研究をまとめた分析でわかった。

01犯罪者側から見ると何が起きているか

公開された動画の声は、犯罪者にとって無料で手に入る「材料」であり、わざわざ盗み出す必要がない。

犯罪は「動機を持った人」「ちょうどいい的」「見張りの不在」の3つが重なったときに起きやすいとされます(ルーティン・アクティビティ理論という犯罪学の考え方)。オンラインでの「ちょうどいい的」とは、外から見えやすく、手に入れやすい情報を指します。

SNSに公開された動画の声は、まさにこの条件に当てはまります。鍵をかけていない動画、長くしゃべっているvlog、電話口で使いそうな「もしもし」「お願いします」といった言い回しまで、すべてがAI音声クローンの材料になり得ます。

2025年の研究では、市販のAI音声クローンサービスを使い、220人分の声を、それぞれわずか2つの短い音声サンプルだけから複製できたと報告されています[2]。特別な技術や機材は必要なく、誰でも使える道具になっている点が、「声は本人にしか出せない」というこれまでの前提を崩しています。

02研究と統計でわかっていること

AIが作った声を人の耳で確実に聞き分けるのは難しく、公開する声や情報が多いほど被害との関連も強まる。

73%本物とAIの声を正しく聞き分けられた割合(2023年、529人が参加)
わずか2つ音声クローンの作成に使われた音声サンプルの数(2025年の研究)
91,620人「SNSでの公開」と被害の関連を調べた34研究の合計人数(2026年の分析)
r=.27公開の「頻度」が高い人ほど強まる、被害との関連(同分析)

Mai, Bray, Davies & Griffin(2023)[1]

本物の声とAIが作った声を聞かせたところ、正しく見抜けたのはわずか73%だった。英語でも中国語でも結果は変わらなかった。

対象: 529人(英語・中国語の両言語で実施)/限界: 音声合成の技術は年々進化しており、今後はさらに聞き分けが難しくなる可能性がある。

Barrington, Cooper & Farid(2025)[2]

市販のAI音声クローンサービスを使い、220人分の声を、それぞれわずか2つの短い音声サンプルだけから複製できた。判定にあたった参加者も、本物とクローンの声を安定して区別できなかった。

対象: 話者220人分の音声、判定者604人(オンライン実験)/限界: 使用したAIサービスは1種類にとどまる。

Wang & Hu(2026)[3]

SNSなどへの個人情報の公開と、サイバー被害との関連を調べた34件の研究をまとめたところ、公開が多い人ほど被害に遭いやすいという関連が確認された。特に公開の「頻度」が高いほど、関連は強かった。

対象: 34研究・合計91,620人分のデータ/限界: 相関関係を示したもので、公開が直接の原因と証明されたわけではない。

03お金をかけずに今日からできること

声や顔がはっきり映る動画は公開範囲を見直し、家族内では声以外で本人確認できる方法を決めておく。

1

顔と声がはっきり入った動画の公開範囲を見直す

フォロワー外にも見える「全体公開」から、友達・フォロワー限定に変えられないか確認する。特に長くしゃべっている動画は優先して見直す。

所要 3分

2

電話口で使いそうな言い回しを含む動画は控えめにする

「もしもし」「お願いします」など、電話で聞いたことがある言い回しをそのまま長く話す動画は、切り取られて使われやすい。撮影時に意識するだけでよい。

所要 撮影時に意識するだけ

3

家族内で「声だけでは判断しない」ルールを決める

電話で家族の声がしても、いったん切って登録済みの本人の番号にかけ直す。合言葉を決めるなら、SNSや写真に出ていない話題にする。

所要 5分

04習慣にするコツ

投稿のたびに「これは声のデータにもなる」と考える癖をつけると、無理なく続けられる。

05よくある質問

AIが作った声は、聞けばわかりますか

研究では、本物の声とAIが作った声を正しく聞き分けられたのは73%ほどでした。練習しても大きくは変わらないため、声だけで本人と判断しないことが大切です。

鍵アカウントにすれば声は安全ですか

完全に防げるわけではありませんが、公開範囲を狭めることで、声を集められる機会は減らせます。知らない人からの申請は承認しない運用も合わせて効果があります。

家族の声で電話がかかってきて、お金の話をされたらどうすればいいですか

いったん電話を切り、登録してある本人の番号にかけ直して確認してください。お金の話が出た場合は、一人で判断せず、家族に相談するか、警察相談専用電話(#9110)に相談してください。急を要すると感じたら110番です。

出典

  1. Mai, K. T., Bray, S., Davies, T., & Griffin, L. D. (2023). Warning: Humans cannot reliably detect speech deepfakes. PLOS ONE. https://doi.org/10.1371/journal.pone.0285333
  2. Barrington, S., Cooper, E. A., & Farid, H. (2025). People are poorly equipped to detect AI-powered voice clones. Scientific Reports, 15, 11004. https://doi.org/10.1038/s41598-025-94170-3
  3. Wang, H., & Hu, J. (2026). Online Self-Disclosure of Personal Information and Interpersonal Cybervictimization: A Meta-Analysis. Trauma, Violence & Abuse. https://doi.org/10.1177/15248380261436842