上海初のAI音声侵害、控訴審判決が下る:識別可能性が基準に、プラットフォームに5万元賠償

--- title: 上海初のAI音声侵害、控訴審判決が下る:識別可能性が基準に、プラットフォームに5万元賠償 meta_title: AI音声侵害はどう判断される?上海初の控訴審が基準を示す meta_description: 上海一中院の控訴審は原判決を維持し、声優の声をAIで合成して宣伝に使用したとして、プラットフォームに5万元の賠償を命じた。裁判所は識別可能性を音声侵害の中核基準として確立した。 ---
声優の王さんは、友人に指摘されて初めて問題に気づいた。あるアプリの新規獲得キャンペーンで使われている声が自分にそっくりだと告げられたのだ。
彼女が確認したところ、その音声はおそらくAIによる合成だと判断した。その後、公証によって証拠を保全し、運営会社を提訴して30万元の賠償を求めた。訴訟は上海市第一中級人民法院まで進み、終審判決は原判決を維持した。プラットフォームは音声権侵害を構成し、5万元を賠償するというものだった。
これは、AI合成音声によって引き起こされた音声権益保護の紛争としては上海で初の事例だ。単独で取り上げる価値がある理由は賠償額とは関係ない。裁判所が、AIがある人の声を模倣した場合に、どのような条件で権利侵害となるのかという問題を明確にしたからだ。
事件における3つの重要な事実
第一に、被告は音声がAIによって生成されたことは認めたが、素材の出所を説明できなかった。
A社の答弁は次のとおりだった。本件音声が同社開発のAIによって生成されたものであることは確かだが、具体的な出所と学習に用いた素材は、元従業員の退職により確認できない。同社は王さんが声優であることも以前は知らず、彼女の声を収集・使用した事実はない。
第二に、鑑定意見は定量化された結果を示した。
王さんは司法鑑定を申請し、公証された音声とその場で採取した本人の声を比較した。28のフォルマント音響指標のうち、24の乖離度は10%未満で、そのうち16は5.36%未満だった。両者の比較的類似した部分および高度に類似した部分は90%に達した。
第三に、裁判所は立証責任を、訓練データを保有するプラットフォームに負わせた。
上海一中院は、A社が原始訓練データを掌握する管理者として、学習素材の出所の適法性、自然人の音声特徴を利用していないこと、公衆に混同・誤認を生じさせていないことなどの事実について十分に立証できなかったため、立証不能の不利益を負うべきだと判断した。
裁判所が確立したルール:技術的な出所ではなく識別可能性を見る
この事件の中核となる判旨は一言に尽きる。自然人の同意なく、自然人の声を訓練コーパスとして使用し、その自然人の音色、イントネーション、発音スタイルを模倣して、当該自然人を識別できる合成音声を生成することは、自然人の音声権益を侵害すると認定されるべきである。
ここには分けて考える価値のある2つの意味がある。
一つは、AI音声開発者によくある弁護の筋道が通用しないということだ。声はアルゴリズムによる声紋の再構成であり、原音声を直接複製するのとは異なるため権利侵害を構成しない、という主張がある。これに対する裁判所の答えは、判断の根拠は合成結果にあるというものだった。すなわち、一般社会公衆が特定の個人と結び付けられるかどうかである。
もう一つは、識別の閾値が専門家ではなく一般社会公衆のレベルに設定されていることだ。本件の鑑定結果は高度に類似しており、したがって識別可能性がある。しかしこれは、本物と見分けがつかないレベルに達して初めて該当するのではなく、類似度がこの程度に近づけばラインを越えることを意味する。
この判例は最高人民法院の文書とつながる
時間軸を長くとらえると、この事件は孤立した判決ではない。
9月7日、最高人民法院は「人工知能に関連する紛争事件を法に基づき審理することに関する意見」を公表し、第4条で2つのことを明確にした。同意なく人工知能を利用して他人の氏名、肖像を処理し、識別可能な仮想デジタル形象を生成して使用・公開することは、氏名権、肖像権などの人格権益の侵害を構成する。同意なく他人の声を訓練に使用し、その音色、イントネーション、発音スタイルを模倣して識別可能な合成音声を生成することは、音声権益の侵害を構成する。
これは、中国の国家最高裁判機関によって出されたAI関連の司法裁判規則文書としては初となる。中でも最も重要な点は、声が初めて肖像と同等の保護を得たことであり、識別可能性が侵害認定の統一的な基準となったことだ。
上海のこの事件はこの意見の後に現れ、紙の上のルールを具体的な事件に落とし込んだ。鑑定は90%の類似度を示し、裁判所はそれに基づいて識別可能性が成立すると認定し、プラットフォームは素材の適法な出所の証拠を提示できず、賠償が成立した。
これ以前にも、最高法が参考例として挙げた別の典型的事例がある。2024年、徐州のある文化メディア会社がライブコマース配信者に宣伝動画の制作を委託し、配信者は家庭教育分野の学者である李さんの公開講演の一部を使用し、彼女の声と音色、イントネーション、発音スタイルが高度に近似するAI合成音声を重ねた。北京インターネット法院は2025年7月、被告に謝罪と、経済的損失および権利保護の合理的支出として12万元の賠償を命じた。2つの事件が示す論理は同じである。無断で他人の肖像を使用し、さらに高度に一致するAI合成音声を重ねることは、肖像権と音声権益に対する二重の侵害を構成する。
市場側の反応:顔交換は締め付けが強まったが、声クローンは依然として販売中
ルールが施行された後、取引側の反応は対称的ではなかった。
報道によると、最高法の意見公表後1週間以内に、一部のECプラットフォームで検索すると、顔交換サービスの遮断は比較的強く、検索結果に関連商品は表示されなかった。しかし、声クローンを検索すると、商品は依然として大量に販売されていた。ある音声合成商品は33.88元で、700点以上販売済み。ある音声モデルの代理訓練は20元の価格が付き、中古取引プラットフォームには8.85元の声クローンサービスもあり、770点以上販売済みと表示されていた。
この非対称性自体が一つの現実を示している。声クローンの敷居は顔交換よりはるかに低く、素材の需要もより隠蔽されている。公開された吹き替え作品、1本のポッドキャスト、1本のショート動画が、十分に良質な訓練コーパスになり得る。
一方、利用者にとって、これらの事例が示すシグナルは明確である。第一に、素材の出所を説明できないからといって免責されることは期待できない。訓練データを保有する側は立証上不利な立場にある。第二に、識別可能性の判断は技術鑑定に依存する。合成結果が公衆に特定の個人と結び付けられるほど近づけば、商業利用は権利侵害を構成する。第三に、賠償額は権利者の同種許諾使用料を参照して定められる。AIで許諾を回避して節約したコストは、最終的に賠償という形で支払うことになり得る。
AI音声プロダクトを手がけるチームにとって何を意味するか
この事件の判決論理は、プロダクト側にいくつかの直接的な示唆を与える。
訓練データの出所証明は記録として残す必要がある。本件で最も致命的だった点は、A社が学習素材の出所を説明できなかったことだ。声クローン、音声合成、音声コンテンツ生成に取り組むチームにとって、コーパスの許諾チェーンには追跡可能な記録が必要であり、口頭確認に依存すべきではない。
声の特徴の模倣は、特定の個人から切り離す必要がある。プロダクトが特定の音色を生成するのであれば、許諾は事前条件であり、事後の補正ではない。逆に、汎用音色だけが欲しいのであれば、訓練データは商用利用可能で追跡可能な出所から得られていることを確保しなければならない。
識別可能性というラインは、参考値ではなくレッドラインとして扱う必要がある。鑑定結論における90%の類似度は本件の認定根拠だが、裁判所は固定の数値基準を示したわけではない。これは、特定の自然人の声の特徴に近づく生成結果はすべて、慎重に評価する必要があることを意味する。
王さんの事件では5万元の賠償だった。請求した30万元と比べれば、この数字は高くない。しかしその意味はこの事件の中にあるのではなく、その後、誰もがAI音声を手がける際のデフォルトの前提が変わったことにある。
関連記事
DeepSeek、120億ドルを調達し16万基のHuaweiチップクラスターを構築へ
今の中国AIにおける最大の単一の賭けは国産シリコンであり、オープンモデルで最も信頼されるラボが行っている。
資金はフィジカルAIへ動いている:SiMa.aiの14.5億ドル、そしてハードウェアを設計するエージェント
資金は証拠に先行して届いている。今後1年の配備が、その賭けが正しかったかどうかを示すだろう。
アリゾナ州の裁判所、AI動画が被害者の代わりに語ったため量刑を破棄
人が行ったことを再現することは一つ。その人の代わりに語ることは別であり、その間の線引きは今、法廷記録に書き込まれた。
OpenAI、EUでChatGPTテキストに電子透かしを導入へ―自社データが示す脆弱さ
日常的な言い換えで剥がせる標識は、第50条の文言は満たしても、同条が果たすために書かれた役割を果たせないかもしれない。