埋め込み動画のUrl抽出と保存法|仕組みと著作権リスクを徹底解説
埋め込み動画のUrl抽出と保存法|仕組みと著作権リスクを徹底解説を詳しくリサーチ! 知っておきたい トピックの裏側を分かりやすく展開します。
Webサイトに表示されている動画を右クリックしても保存メニューが出現しなかったり、ページのアドレスを保存支援ツールに入力しても弾かれたりする背景には、ストリーミング配信技術の進化があります。かつて主流だった単一mp4ファイルのプログレッシブダウンロード方式を採用しているWebサイトは、現在では個人ブログや一部の簡易LPを除いて激減しました。
再生プレイヤーの多くは、HLS(HTTP Live Streaming)やMPEG-DASHといったアダプティブ・ビットレート・ストリーミング技術を採用しています。これらの技術環境下では、数秒単位に細切れにされた動画断片(tsファイルやm4sファイル)と、それらを順序立てて再生するための目録ファイル(m3u8やmpd)がやり取りされています。ブラウザが見ているのは動画全体ではなく「断片の集合体」であるため、ページのURLをいくらツールに読み込ませても本体データを取得できません。
さらに現場で頻繁に遭遇するのが、ソースコード上に現れるblob:https://...という文字列です。これはBlob(Binary Large Object)URLと呼ばれ、サーバー上の静的リソースを指すアドレスではなく、ブラウザの内部メモリ上に展開されたバイナリデータを一時的に参照するための仮想ポインタに過ぎません。この仮想URLをコピーして新規タブで開いてもデータの実体は存在しないため、404エラーや真っ白な画面が返される結果となります。
くわえて、iframeタグによる別ドメインからの動画プレイヤー埋め込みが行われているケースでは、親ページのDOMツリーをいくら走査しても動画のソースアドレスは見つかりません。クロスオリジン制限(Same-Origin Policy)により親ページと動画配信ドメインが厳格に分離されているため、内部フレームのソースURLを一段階深く掘り下げる必要があります。