FFMpeg的解码流程

FFmpeg视频解码流程详解及demo 本文主要讲解FFmpeg的视频解码具体流程,API使用,以及相关结构体介绍。最后再以一个非常简单的demo演示将一个mp4格式的视频文件解码为原始数据yuv文件。 阅读详情

FFMpeg的解码流程

1. 从基础谈起
先给出几个概念,以在后面的分析中方便理解
Container:在音视频中的容器,一般指的是一种特定的文件格式,里面指明了所包含的
    音视频,字幕等相关信息
Stream:这个词有些微妙,很多地方都用到,比如TCP,SVR4系统等,其实在音视频,你
    可以理解为单纯的音频数据或者视频数据等
Frames:这个概念不是很好明确的表示,指的是Stream中的一个数据单元,要真正对这
    个概念有所理解,可能需要看一些音视频编码解码的理论知识
Packet:是Stream的raw数据
Codec:Coded + Decoded
其实这些概念在在FFmpeg中都有很好的体现,我们在后续分析中会慢慢看到

2.解码的基本流程
我很懒,于是还是选择了从<An ffmpeg and SDL Tutorial>中的流程概述:

10 OPEN video_stream FROM video.avi
20 READ packet FROM video_stream INTO frame
30 IF frame NOT COMPLETE GOTO 20
40 DO SOMETHING WITH frame
50 GOTO 20

这就是解码的全过程,一眼看去,是不是感觉不过如此:),不过,事情有深有浅,从浅
到深,然后从深回到浅可能才是一个有意思的过程,我们的故事,就从这里开始,展开
来讲。

3.例子代码
在<An ffmpeg and SDL Tutorial 1>中,给出了一个阳春版的解码器,我们来仔细看看
阳春后面的故事,为了方便讲述,我先贴出代码:
#include <ffmpeg/avcodec.h>
#include <ffmpeg/avformat.h>

#include <stdio.h>

void SaveFrame(AVFrame *pFrame, int width, int height, int iFrame) {
  FILE *pFile;
  char szFilename[32];
  int  y;
  
  // Open file
  sprintf(szFilename, "frame%d.ppm", iFrame);
  pFile=fopen(szFilename, "wb");
  if(pFile==NULL)
    return;
  
  // Write header
  fprintf(pFile, "P6/n%d %d/n255/n", width, height);
  
  // Write pixel data
  for(y=0; y<height; y++)
    fwrite(pFrame->data[0]+y*pFrame->linesize[0], 1, width*3, pFile);
  
  // Close file
  fclose(pFile);
}

int main(int argc, char *argv[]) {
  AVFormatContext *pFormatCtx;
  int             i, videoStream;
  AVCodecContext  *pCodecCtx;
  AVCodec         *pCodec;
  AVFrame         *pFrame; 
  AVFrame         *pFrameRGB;
  AVPacket        packet;
  int             frameFinished;
  int             numBytes;
  uint8_t         *buffer;
  
  if(argc < 2) {
    printf("Please provide a movie file/n");
    return -1;
  }
  // Register all formats and codecs
  ########################################
  [1]
  ########################################
  av_register_all();
  
  // Open video file
  ########################################
  [2]
  ########################################
  if(av_open_input_file(&pFormatCtx, argv[1], NULL, 0, NULL)!=0)
    return -1; // Couldn't open file
  
  // Retrieve stream information
  ########################################
  [3]
  ########################################
  if(av_find_stream_info(pFormatCtx)<0)
    return -1; // Couldn't find stream information
  
  // Dump information about file onto standard error
  dump_format(pFormatCtx, 0, argv[1], 0);
  
  // Find the first video stream
  videoStream=-1;
  for(i=0; i<pFormatCtx->nb_streams; i++)
    if(pFormatCtx->streams[i]->codec->codec_type==CODEC_TYPE_VIDEO) {
      videoStream=i;
      break;
    }
  if(videoStream==-1)
    return -1; // Didn't find a video stream
  
  // Get a pointer to the codec context for the video stream
  pCodecCtx=pFormatCtx->streams[videoStream]->codec;
  
  // Find the decoder for the video stream
  pCodec=avcodec_find_decoder(pCodecCtx->codec_id);
  if(pCodec==NULL) {
    fprintf(stderr, "Unsupported codec!/n");
    return -1; // Codec not found
  }
  // Open codec
  if(avcodec_open(pCodecCtx, pCodec)<0)
    return -1; // Could not open codec
  
  // Allocate video frame
  pFrame=avcodec_alloc_frame();
  
  // Allocate an AVFrame structure
  pFrameRGB=avcodec_alloc_frame();
  if(pFrameRGB==NULL)
    return -1;
    
  // Determine required buffer size and allocate buffer
  numBytes=avpicture_get_size(PIX_FMT_RGB24, pCodecCtx->width,
                  pCodecCtx->height);
  buffer=(uint8_t *)av_malloc(numBytes*sizeof(uint8_t));
  
  // Assign appropriate parts of buffer to image planes in pFrameRGB
  // Note that pFrameRGB is an AVFrame, but AVFrame is a superset
  // of AVPicture
  avpicture_fill((AVPicture *)pFrameRGB, buffer, PIX_FMT_RGB24,
         pCodecCtx->width, pCodecCtx->height);
  
  // Read frames and save first five frames to disk
  ########################################
  [4]
  ########################################
  i=0;
  while(av_read_frame(pFormatCtx, &packet)>=0) {
    // Is this a packet from the video stream?
    if(packet.stream_index==videoStream) {
      // Decode video frame
      avcodec_decode_video(pCodecCtx, pFrame, &frameFinished, 
               packet.data, packet.size);
      
      // Did we get a video frame?
      if(frameFinished) {
    // Convert the image from its native format to RGB
    img_convert((AVPicture *)pFrameRGB, PIX_FMT_RGB24, 
                    (AVPicture*)pFrame, pCodecCtx->pix_fmt, 
                    pCodecCtx->width, 
                    pCodecCtx->height);
    
    // Save the frame to disk
    if(++i<=5)
      SaveFrame(pFrameRGB, pCodecCtx->width, pCodecCtx->height, 
            i);
      }
    }
    
    // Free the packet that was allocated by av_read_frame
    av_free_packet(&packet);
  }
  
  // Free the RGB image
  av_free(buffer);
  av_free(pFrameRGB);
  
  // Free the YUV frame
  av_free(pFrame);
  
  // Close the codec
  avcodec_close(pCodecCtx);
  
  // Close the video file
  av_close_input_file(pFormatCtx);
  
  return 0;
}

代码注释得很清楚,没什么过多需要讲解的,关于其中的什么YUV420,RGB,PPM等格式
,如果不理解,麻烦还是google一下,也可以参考:http://barrypopy.cublog.cn/里面
的相关文章

其实这部分代码,很好了Demo了怎么样去抓屏功能的实现,但我们得去看看魔术师在后
台的一些手法,而不只是简单的享受其表演。

4.背后的故事
真正的难度,其实就是上面的[1],[2],[3],[4],其他部分,都是数据结构之间的转换,
如果你认真看代码的话,不难理解其他部分。

[1]:没什么太多好说的,如果不明白,看我转载的关于FFmepg框架的文章

[2]:先说说里面的AVFormatContext *pFormatCtx结构,字面意思理解AVFormatContext
就是关于AVFormat(其实就是我们上面说的Container格式)的所处的Context(场景),自
然是保存Container信息的总控结构了,后面你也可以看到,基本上所有的信息,都可
以从它出发而获取到
    
我们来看看av_open_input_file()都做了些什么:
[libavformat/utils.c]
int av_open_input_file(AVFormatContext **ic_ptr, const char *filename,
                       AVInputFormat *fmt,
                       int buf_size,
                       AVFormatParameters *ap)
{
    ......
    if (!fmt) {
        /* guess format if no file can be opened */
        fmt = av_probe_input_format(pd, 0);
    }

   ......
    err = av_open_input_stream(ic_ptr, pb, filename, fmt, ap);
   ......
}

这样看来,只是做了两件事情:
1). 侦测容器文件格式
2). 从容器文件获取Stream的信息

这两件事情,实际上就是调用特定文件的demuxer以分离Stream的过程:

具体流程如下:

av_open_input_file
    |
    +---->av_probe_input_format从first_iformat中遍历注册的所有demuxer以 
    |     调用相应的probe函数
    |
    +---->av_open_input_stream调用指定demuxer的read_header函数以获取相关
          流的信息ic->iformat->read_header

如果反过来再参考我转贴的关于ffmpeg框架的文章,是否清楚一些了呢:)

[3]:简单从AVFormatContext获取Stream的信息,没什么好多说的

[4]:先简单说一些ffmpeg方面的东西,从理论角度说过来,Packet可以包含frame的部
分数据,但ffmpeg为了实现上的方便,使得对于视频来说,每个Packet至少包含一
frame,对于音频也是相应处理,这是实现方面的考虑,而非协议要求.
因此,在上面的代码实际上是这样的:
    从文件中读取packet,从Packet中解码相应的frame;
    从帧中解码;
    if(解码帧完成)
        do something();

我们来看看如何获取Packet,又如何从Packet中解码frame的。

av_read_frame
    |
    +---->av_read_frame_internal
        |
        +---->av_parser_parse调用的是指定解码器的s->parser->parser_parse函数以从raw packet中重构frame

avcodec_decode_video
    |
    +---->avctx->codec->decode调用指定Codec的解码函数
    
因此,从上面的过程可以看到,实际上分为了两部分:

一部分是解复用(demuxer),然后是解码(decode)

使用的分别是:
av_open_input_file()            ---->解复用

av_read_frame()            |
                           |    ---->解码    
avcodec_decode_video()     |

5.后面该做些什么
结合这部分和转贴的ffmepg框架的文章,应该可以基本打通解码的流程了,后面的问题则是针对具体容器格式和具体编码解码器的分析,后面我们继续


参考:
[1]. <An ffmpeg and SDL Tutorial> 
     http://www.dranger.com/ffmpeg/tutorial01.html
     
[2]. <FFMpeg框架代码阅读>
     http://blog.csdn.net/wstarx/archive/2007/04/20/1572393.aspx 

ffmpeg解码流程 FFMPEG解码流程:   1. 注册所有容器格式和CODEC: av_register_all()   2. 打开文件: av_open_input_file()   3. 从文件中提取流信息: av_find_stream_info()   4. 穷举所有的流,查找其中种类为CODEC_TYPE_VIDEO   5. 查找对应的解码器: avcodec_find_decoder() 阅读详情

相关推荐

ffmpeg 结构和编解码流程

ffmpeg 结构以及作用: AVUtil: 核心工具库 AVFormat:提供了音视频容器格式的封装和解析以及所支持的协议文件格式和协议库 AVCodec: 编解码库 AVFilter: 音视频滤镜库 如视频加水印、音频变声 AVDevice: 输入输出设备库,提供设备数据的输入与输出,如读取摄像头数据、屏幕录制 SwrRessample: 音频重采样 SWScale: 图像格式转换的模块,yu...

三木仔 3930

FFMPEG学习【libavcodec】:编解码器:硬件加速器桥:Direct3D11

一、数据结构 struct AVD3D11VAContext{ ID3D11VideoDecoder * decoder; //D3D11解码器对象。 ID3D11VideoContext * video_context; //D3D11视频上下文 D3D11_VIDEO_DECODER_CONFIG * cfg //D3D11配置用于创建解码器。 unsi

一世豁然的专栏 6478

ffmpeg库视频硬解码使用流程

FFmpeg 的硬解码(Hardware Decoding)通过调用 GPU 或专用硬件的编解码能力实现,能显著降低 CPU 占用率。

深之JohnChen的专栏 3078

FFmpeg实战】FFMPEG硬件编解码

如果我们需要使用硬件编解码,采用avcodec_find_encoder_by_name(name)和avcodec_find_decoder_by_name(name)来指定编码器。而基于软件编码器的硬件加速是跨硬件显卡的,如Windows d3d11va硬件加速,无论底层是AMD显卡还是Intel显卡还是nvidia显卡都适用,相当于windows 系统屏蔽了硬件细节,我们只需要调用windows的API实现即可。在ffmpeg中,如果使用-vcodec xxx 指定硬件编解码器,否则使用软件编解码

C/C++Linux、音视频、DPDK 4600

音视频入门系列-FFmpeg篇(编码)

日常开发过程中,我们涉及到的主要是解码相关内容,但FFmpeg同样具有编码的能力。今天这篇文章简单介绍下FFmpeg编码的内容。 1.FFmpeg编码视频 使用FFmpeg库编码YUV,代码及调用逻辑如下(文末附代码): 2.FFmpeg编码音频 使用FFmpeg库编码PCM,代码及调用逻辑如下(文末附代码): 3.编码YUV源码如下: /* author:八小时码字员 file:encode_yuv_to_h264.cpp */ #include "enco..

fly_C_的专栏 1626

FFmpeg 开源项目分析(三)AVStream解析

FFmpeg 开源项目分析(一)FFmpeg/Openssl/x264编译FFmpeg 开源项目分析(二)AVFormatContext解析FFmpeg 开源项目分析(三)AVStream解析FFmpeg 开源项目分析(四)AVCodecParameters解析 上一章分析了AVFormatContext,其中有两个参数 unsigned int nb_streams; AVStream **streams; nb_streams是当前轨道数,就是流数量,streams是轨道.

翻肚鱼儿的博客 1475

音视频开发—FFmpeg处理流数据的基本概念详解

本文主要介绍了多媒体流的概念以及FFMpeg操作数据流的详细概念和代码实现

weixin_46999174的博客 1867

FFmpeg开发笔记(四):ffmpeg解码的基本流程详解

若该文为原创文章,未经允许不得转载 原博主博客地址:https://blog.csdn.net/qq21497936 原博主博客导航:https://blog.csdn.net/qq21497936/article/details/102478062 本文章博客地址:https://blog.csdn.net/qq21497936/article/details/108573195 各位读者,知识无穷而人力有穷,要么改需求,要么找专业人士,要么自己研究 红胖子(红模仿)的博文大全:开发技术集合(包含Qt实用

长沙红胖子 Qt・西安|省级科研团队从业背景,深耕双一流体系高精尖技术配套研发|剥离高精尖机理,沉淀高端特种行业领域 Qt 工程化落地经验|博文仅分享通用技术总结,输出公开普适工程思路。 5万+

FFmpeg】 音视频解码详细流程

FFmpeg】 音视频解码详细流程

m0_56051805的博客 5395

FFmpeg音频解码流程详解及简单demo参考

本文主要讲解FFmpeg的音频解码具体流程,API使用。最后再以一个非常简单的demo演示将一个mp3格式的视频文件解码为原始数据pcm文件。

分享音视频技术 6401

FFmpeg编程--解码流程

一、解码流程总览。

yinshipin007的博客 1177

ffmpeg 解码流程解码函数的讲解

引言 ffmpeg 是一个非常好的开源音视频项目 ,想学习它 必须从最基本的解码 开始 下面就简单介绍下他的解码流程解码函数 1.FFmpeg解码函数 av_register_all() 注册所有组件 avformat_open_input() 打开输入视频文件 avformat_find_stream_info() 获取视频文件信息 avcodec_find_decoder() 查找编码器...

安卓兼职framework和app工程师的博客 654

ffmpeg流选择

FFmpeg可以识别5种流类型:音频(audio, a),视频(video, v),字幕(subtitle, s),附加数据(attachment, t)和普通数据(data, d)。 流选择(stream selection)是从输入文件中选定某些流进行处理,流选择有两种模式,1) 使用-map选项手动指定要选择的流;2) 无-map选项时由FFmpeg根据相应规则自动选择流。 流选择自动模式...

LIEY 2809

FFMPEG详解(完整版)

FFMPEG堪称自由软件中最完备的一套多媒体支持库,它几乎实现了所有当下常见的数据封装格式、多媒体传输协议以及音视频编解码器,堪称多媒体业界的瑞士军刀。因此,对于从事多媒体技术开发的工程师来说,深入研究FFMPEG成为一门必不可少的工作,可以这样说,FFMPEG之于多媒体开发工程师的重要性正如kernel之于嵌入式系统工程师一般。几个小知识:FFMPEG项目是由法国人Fabrice Bellard发起的,此人也是著名的CPU模拟器项目QEMU的发起者,同时还是的保持者。

yinshipin007的博客 1万+

FFmpeg4入门14:Linux下摄像头捕获并编码为h264

上一篇是将H264流封装到MP4容器中,本篇介绍一个最常用的捕获原始数据的方法:从摄像头获取数据。因为本人已经放弃windows操作系统,所以使用linux来获取摄像头并编码为H264文件保存。linux下使用video4linux2作为设备来定义统一的接口,先看一下摄像头数据信息: 摄像头原始数据为YVYU422格式,而我们一般使用的是YUV420P。所以我们编码之前需要将其解码为YUV420P(当然也可以不解码,因为视频播放的时候也会解码,这里只是为了入门教学)。那么步骤就是读取摄像头YUYV422数据

qq_26056015的博客 2445

FFmpeg相关设置

一、ffmpeg 将rtsp流分段存储为MP4文件;二、ffmpeg 视频文件在采集/断网时保证视频文件的正常播放;三、ffmpeg 断线重连参数。

旡心-小小康 2850

FFmpeg之AVstream数据结构

wu

qq_44632658的博客 444
上一篇: A-V同步
下一篇: FFMpeg对MPEG2 TS流解码的流程分析--一
林伟
博客等级 码龄17年 602粉丝 249原创
评论 2
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值