オーディオとビデオを始めるための基本: H.264 トピック (12) - FFmpeg ソースコードでの SPS 属性によるビデオ解像度の計算の実装

オーディオとビデオを始めるための基本: H.264 トピック (12) - FFmpeg ソースコードの SPS 属性によるビデオ解像度の計算の実装

2024-07-12

I.はじめに

前のセクションで「オーディオとビデオの基礎: H.264 トピック (11) - ビデオ解像度の計算式「」では、SPS の属性を通じて H.264 でエンコードされたビデオの解像度を計算する式を説明します。この記事では、FFmpeg ソースコードでビデオ解像度を計算する実装について説明します。

2. FFmpegソースコードでのビデオ解像度計算の実装

記事より「オーディオとビデオの基礎: H.264 トピック (10) - FFmpeg ソースコード内の SPS 属性を格納する構造と SPS をデコードする機能の解析》を見ると、FFmpeg ソースコードが ff_h264_decode_seq_parameter_set 関数を通じて SPS をデコードし、SPS の属性を取得していることがわかります。

ff_h264_decode_seq_parameter_set 関数には次のコードがあります。コードの次の部分を通じて、ビデオ解像度の計算に必要な属性が取得されます。


int ff_h264_decode_seq_parameter_set(GetBitContext *gb, AVCodecContext *avctx,
                                     H264ParamSets *ps, int ignore_truncation)
{
    //...
    
    sps->gaps_in_frame_num_allowed_flag = get_bits1(gb);
    sps->mb_width                       = get_ue_golomb(gb) + 1;
    sps->mb_height                      = get_ue_golomb(gb) + 1;
 
    sps->frame_mbs_only_flag = get_bits1(gb);
 
    if (sps->mb_height >= INT_MAX / 2U) {
        av_log(avctx, AV_LOG_ERROR, "height overflown");
        goto fail;
    }
    sps->mb_height *= 2 - sps->frame_mbs_only_flag;
 
    //...
 
    sps->crop = get_bits1(gb);
    if (sps->crop) {
        unsigned int crop_left   = get_ue_golomb(gb);
        unsigned int crop_right  = get_ue_golomb(gb);
        unsigned int crop_top    = get_ue_golomb(gb);
        unsigned int crop_bottom = get_ue_golomb(gb);
        int width  = 16 * sps->mb_width;
        int height = 16 * sps->mb_height;
 
        if (avctx->flags2 & AV_CODEC_FLAG2_IGNORE_CROP) {
            av_log(avctx, AV_LOG_DEBUG, "discarding sps cropping, original "
                                           "values are l:%d r:%d t:%d b:%dn",
                   crop_left, crop_right, crop_top, crop_bottom);
 
            sps->crop_left   =
            sps->crop_right  =
            sps->crop_top    =
            sps->crop_bottom = 0;
        } else {
            int vsub   = (sps->chroma_format_idc == 1) ? 1 : 0;
            int hsub   = (sps->chroma_format_idc == 1 ||
                          sps->chroma_format_idc == 2) ? 1 : 0;
            int step_x = 1 << hsub;
            int step_y = (2 - sps->frame_mbs_only_flag) << vsub;
 
            if (crop_left  > (unsigned)INT_MAX / 4 / step_x ||
                crop_right > (unsigned)INT_MAX / 4 / step_x ||
                crop_top   > (unsigned)INT_MAX / 4 / step_y ||
                crop_bottom> (unsigned)INT_MAX / 4 / step_y ||
                (crop_left + crop_right ) * step_x >= width ||
                (crop_top  + crop_bottom) * step_y >= height
            ) {
                av_log(avctx, AV_LOG_ERROR, "crop values invalid %d %d %d %d / %d %dn",     
                      crop_left, crop_right, crop_top, crop_bottom, width, height);
                goto fail;
            }
 
            sps->crop_left   = crop_left   * step_x;
            sps->crop_right  = crop_right  * step_x;
            sps->crop_top    = crop_top    * step_y;
            sps->crop_bottom = crop_bottom * step_y;
        }
    } else {
        sps->crop_left   =
        sps->crop_right  =
        sps->crop_top    =
        sps->crop_bottom =
        sps->crop        = 0;
    }
 
    //...
}

次に、FFmpeg ソースコードのソースファイル libavcodec/h264_parser.c の parse_nal_units 関数には、次のコードがあります。


static inline int parse_nal_units(AVCodecParserContext *s,
                                  AVCodecContext *avctx,
                                  const uint8_t * const buf, int buf_size)
{
    //...
    
    for (;;) {
        switch (nal.type) {
        case H264_NAL_SPS:
            ff_h264_decode_seq_parameter_set(&nal.gb, avctx, &p->ps, 0);
            break;
         
        //...
 
        case H264_NAL_IDR_SLICE:
        
        //...
 
        s->coded_width  = 16 * sps->mb_width;
        s->coded_height = 16 * sps->mb_height;
        s->width        = s->coded_width  - (sps->crop_right + sps->crop_left);
        s->height       = s->coded_height - (sps->crop_top   + sps->crop_bottom);
        if (s->width <= 0 || s->height <= 0) {
            s->width  = s->coded_width;
            s->height = s->coded_height;
        }
        //... 
        }
        //...
    }
}

parse_nal_units 関数では、次のステートメントによってビデオ解像度が最終的に取得されることがわかります。


s->width = s->coded_width - (sps->crop_right + sps->crop_left);
s->height = s->coded_height - (sps->crop_top + sps->crop_bottom);

ビデオ解像度の計算の実装については、FFmpeg ソースコードと記事「」で確認できます。オーディオとビデオの基礎: H.264 トピック (11) - ビデオ解像度の計算式で説明されている式は一貫しています。

技術共有

オーディオとビデオを始めるための基本: H.264 トピック (12) - FFmpeg ソースコードの SPS 属性によるビデオ解像度の計算の実装

I.はじめに

2. FFmpegソースコードでのビデオ解像度計算の実装

個人プロフィール

私の連絡先情報

技術共有

オーディオとビデオを始めるための基本: H.264 トピック (12) - FFmpeg ソース コードの SPS 属性によるビデオ解像度の計算の実装

I.はじめに

2. FFmpegソースコードでのビデオ解像度計算の実装

個人プロフィール

私の連絡先情報

オーディオとビデオを始めるための基本: H.264 トピック (12) - FFmpeg ソースコードの SPS 属性によるビデオ解像度の計算の実装