非可逆圧縮:原理、一般的な形式、実用上のトレードオフ
非可逆圧縮は、人間の知覚にとって重要性が低いと判断された情報を捨ててファイルサイズを削減する。画像、音声、動画で広く用いられ、保存容量、帯域幅、品質の均衡を図る。
非可逆圧縮は、元の情報の一部を恒久的に破棄することで高い縮小率を実現するデータ圧縮の一種である。完全に元のデータを復元できる可逆方式とは異なり、非可逆アルゴリズムでは、展開時に元データの近似値が生成される。ファイルを小さくする代わりに忠実度が下がるというこのトレードオフは、画像、音声、動画など、人間の感覚にとって欠点を目立ちにくくできる媒体で広く利用されている。
画像ギャラリー
1 画像非可逆圧縮の仕組み
処理は通常、冗長性がより明確になる領域への変換、精度を下げる量子化、結果を効率よく詰め込むエントロピー符号化という複数の段階を組み合わせる。圧縮ではしばしば人間の知覚に関するモデルを利用し、気付きにくい細部を捨てる。主な要素は以下のとおりである。
- 変換符号化:画素またはサンプルを、エネルギーが集中する周波数成分または基底係数へ写像する。
- 量子化:完全な正確さを犠牲にして係数の精度を下げ、必要なビット数を減らす。
- 知覚モデル:心理音響学や視覚的マスキングを用い、損失を人間の知覚閾値の下に隠す。
- エントロピー符号化:削減後のデータを可逆的にパッキングし、圧縮処理を完結させる。
一般的な形式と例
複数のよく知られた規格が、媒体ごとに非可逆方式を実装している。静止画では、広く知られるJPEG規格が離散コサイン変換と量子化を使用する。音声では、MP3が知覚符号化を適用して聞き取れない音を取り除くもので、しばしば音声ファイル用の形式と説明される。動画コーデックは空間的手法と時間的手法を組み合わせる。また、WMVのような一部の独自コンテナも非可逆である。対照的に、GIFやPNGなどの形式は、画像データをすべてのビットを保ったまま保存する可逆ストレージ向けに設計されている。
品質、アーティファクト、トレードオフ
圧縮が中程度であれば損失は知覚できないことが多いが、強い圧縮では視覚的または聴覚的なアーティファクトが生じる。画像ではブロック状の乱れ、ぼやけ、輪郭周辺のリンギングなどがあり、音声ではプリエコーから薄く金属的な音色までが生じうる。利用者またはアプリケーションは、目標サイズ、許容できる品質、計算コストなどの要因の均衡を取る必要がある。多くのコーデックには品質設定が用意されており、忠実度とファイルサイズの妥協点を調整できる。
用途、歴史、実用上の考慮点
デジタルメディアとネットワークで保存および配信のためにより小さなファイルが求められるようになると、非可逆圧縮は広く普及した。ストリーミング音声・動画を可能にし、ウェブ画像のダウンロード時間を短縮し、マルチメディア配信を高速化する。開発者やコンテンツ制作者は、ファイルサイズまたは帯域幅が主要な制約であり、ある程度の不正確さを許容できる場合に非可逆方式を選択する。正確な再現が重要となるアーカイブ、医療、法的な用途では、可逆方式または慎重に管理されたワークフローが望ましい。
参考情報と区別
圧縮技術と用語をより広く理解するには、データおよび復元に関する入門的な資料を参照するとよい。実用的なガイドでは、ウェブ公開、ストリーミング、音声配信といった一般的な作業について形式や設定を比較し、可逆方式より非可逆方式を優先すべき場合を説明している。個々のファイルについて述べる際には、慣例的な拡張子に基づく名称はコンテナまたは形式を表すことを覚えておく必要がある。たとえば単一のファイルに、非可逆符号化されたトラックが含まれる場合があり、実際に聞こえる、または見える結果は、特定のコーデックとそのパラメータによって決まる。
関連項目
著者
AlegsaOnline.com 非可逆圧縮:原理、一般的な形式、実用上のトレードオフ Leandro Alegsa
URL: https://ja.alegsaonline.com/art/59330