百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 技术文章 > 正文

视频编解码——编码流程介绍(视频编解码是什么意思)

haoteby 2025-06-12 12:44 13 浏览

为什么需要编码?

原始视频数据很庞大,比如一个150分钟,30FPS,分辨率为720480的彩色电影需要占用280GB。无论是物理存储还是网络传输,这都是难以负担的。所以需要编码进行压缩。

编码方式

一般有两种编码方式:熵编码(entropy coding,以无损的方式将视频压缩到香农极限)和有损编码(lossy coding,删除冗余数据和不重要的数据)。熵编码的压缩率是有限的,但是得益于人类的视觉系统可以容忍细节丢失,有损压缩通常很有效。

典型的编解码码流程

下图展示了编解码的整体流程。 摄像头采集到数据,进行编码,传输或者保存编码后的数据,终端拿到数据后进行解码并显示。

下图展示了一个典型的编码流程:

一个典型的视频编码一般由三个模块组成:

预测性编码(Predictive coding)
转换编码(Transform coding)
熵编码(Entropy coding)
通常编码一个视频会产生若干完整的帧数据和增量帧数据。
完整帧只需要通过转换编码和熵编码进行压缩。本文主要考虑增量帧的编解码。

领取C++音视频开发学习资料:点击→音视频开发(资料文档+视频教程+面试题)(FFmpeg+WebRTC+RTMP+RTSP+HLS+RTP)

预测性编码

预测性编码通过利用时间(帧间预测)和空间冗余(帧内预测)来减少视频的冗余度。
通常预测性编码有两步:运动估计(Motion estimation, ME)和运动补偿(Motion compensation, MC)

运动估计为当前帧的某个区域(A)在参考帧中寻找一个合适的匹配区域(B)。(参考帧可以是之前的帧,也可以是后面的帧)

运动补偿找到区域A和区域B的不同

通过ME和MC预测性编码会产生一些运动矢量和残差。运动矢量就是某些区域针对参考帧的运动轨迹,而残差就是这些区域运动后产生的预测帧和当前帧之间的不同。举个不太恰当的例子:(不恰当的地方在于真实的编码中运动矢量涉及的区域不会这么大,比如H.264编码的最大区域为1616)
下象棋时,开局时为参考帧,炮二平五后为当前帧,如图:

这时运动矢量就是炮二的区域移动到炮五的区域,移动后产生一个预测帧。预测帧和当前帧并不完全一样,他们的区别就是残差。
此时的残差则是炮二位置的棋格,以及炮五边框的颜色变化。
预测性编码的产出就是这些运动矢量和残差,通过这个例子我们能看到这些产出数据是远远小于一个完整帧的数据量的。

转换编码(有损压缩)

转换编码模块的产出是一组系数,每个系数是标准基础图案的权重。 通过量化器之后,可获得降低精度但节省位的量化系数。
反过来标准基础图案使用这些量化系数可以得到量化前的图案。
例如,1974年开发的离散余弦变换(DCT)是一种广泛使用的变换编码技术。 H.264编码就是将残差通过转换编码转换为DCT系数。
详细流程就不赘(知)述(道)了。。
基本原理利用了傅里叶变换思想(使用一些正余弦公式表示图像)
下面的公式中,y为编码前的图案,x为标准基础图案数据,f(x)是一个公式里面会涉及一组系数k,这一组k就是转换编码的输出。
y≈f(x)=k1f1(x)+k2f2(x)+...+knfn(x)

一个1616的图案,大概需要80个系数就足够了,这时的压缩率为31.25%

熵编码(无损压缩)

将前面得到的所有数据进行压缩,包括运动矢量、残差的量化系数、还有预测性编码的一些参数。
常见的熵编码方法包括可变长度编码(VLC),算术编码和霍夫曼编码。
以大家最熟悉的霍夫曼编码为例,它根据数据出现的频率对数据进行编码,频率高的编码后的长度短,频率低的编码后的长度长。

解码

编码流程的逆序就是解码流程。

解码器拿到编码后的数据后:

根据熵编码的类型,将压缩的数据展开,得到转换编码数据(运动矢量、残差的量化系数、还有预测性编码的一些参数)
根据残差的量化系数,得到残差数据
在参考帧的基础上,实施这些运动矢量,产生预测帧
在预测帧的基础上,叠加残差数据,得到当前帧

相关推荐

谷歌开源大模型评测框架正式发布,AI模型评测难题迎刃而解

近日科技巨头谷歌正式推出其开源大模型评测框架LMEval,这一创新工具为全球AI开发者和企业提供了标准化的模型评估解决方案。LMEval的发布不仅标志着AI模型评测迈入透明化时代,更通过多项核心技术...

Android 开发中文引导-动画和图形概述

安卓系统提供了各种强大的API,用来将动画应用于界面元素和自定义2D和3D图形的绘制当中。下面的小节大概的描述了可用的API和系统功能并帮助你决定那个方案最适合你的需要。动画安卓框架提供了两种动画系统...

Qt5 C++入门教程-第12章 绘图(QPainter)

QPainter类在Qt5中进行绘图时起着重要作用。绘图操作是通过QPainter类在响应paintEvent方法时完成的。线条在第一个示例中,我们在窗口的客户区绘制了一些线条。line...

文创测评︱《如意琳琅图籍》:本土原创解谜书的胜利?

设想这样一个场景,你打开一本书,就化身为乾隆三十六年紫禁城中的画画人周本,有一天你在故纸堆中找到一本神秘的《如意琳琅图籍》,踏上寻宝旅程,历经各种离奇复杂的故事……这是故宫与奥秘之家联手打造的创意解谜...

gif动图制作攻略!快快收藏(求gif制作的动图)

有事没事斗图玩是当下人们乐此不疲的事情,手里的gif动图也渐渐成为了人们抬杠互怼的一大资本。好有趣,好炫酷,gif是怎么做出来的?我也想做。什么?你不会?没关系,我来教你!首先介绍一下制作gif动图需...

eduis未能初始化界面 无法启动 问题解决办法

1.如果edius安装后启动后出现failedtoinitializeskin中文提示无法初始化界面的错误。这说明你的电脑安装了双显卡,而edius所使用的是图形显卡。可以选择edius图标右键...

写真一周:水岛美结水着解禁、长滨祢瑠婚纱写真等

...

Flash Player模拟器更新:Rufffle(flash模拟器安卓下载高版本)

Ruffle是一个适用于WindowsPC的FlashPlayer模拟器,用Rust编写。Ruffle作为一个独立的应用程序在所有现代操作系统上原生运行,并通过使用WebAssembly在所有现代...

支持终身免费4G流量,星星充电7kW星际智能交流充电桩拆解

前言近期星星充电推出了一款星际智能交流充电桩,在正面设有灯条,可根据灯条颜色和显示直观了解充电状态,并设有屏幕显示充电状态和ui表情。充电桩支持220V/7kW充电功率,适配主流新能源车型。并支持终身...

乐动随心之fancy pop(乐动随心壶多少钱一个)

跳动飞扬的音符像是连通人与人之间心电感应的通关密码,融化陌生,拉近彼此。此次我们邀请到宅男女神江语晨,化身音乐精灵。在歌手、演员身份间游刃自如的她,为我们生动诠释了三种不同的音乐时尚风格,娴静可爱,灵...

Asus Zenflash 手机也能玩引闪,从此相机是路人

在讲解Zenflash之前,不得不提索爱的K750c,这个机器采用了氙气闪光灯,让手机的拍摄上了档次,可玩性更高,不过,说实话,当时手机的摄像头像素低,成像一般,没有掀起太大的波澜,可现在,手机的Cm...

Axure有哪些鲜为人知的使用技巧?(axure的使用教程)

阿拓带你飞:不管是想入门产品经理还是已经是PM的人对AXURE都很关注,它是制作产品原型的重要工具,但是有多少人了解AXURE的使用技巧?本文是来自“知乎问答”整理的回答,一起来看看那些不常用的使用技...

挑战黑夜 华硕ZenFlash氙气闪光灯评测

【机锋配件】说到摄影,相信许多朋友都非常喜欢,不管是外出游玩拍拍风景,还是和朋友之间聚会,都会掏出手机拍两张,在餐前拍照晒朋友圈更是成为了许多用户的日常爱好,就算不是专业的摄影爱好者,大家也都有一颗热...

WPS 演示倒计时 3 步设置!从数字动画到进度条全场景教程

做PPT时想添加倒计时却找不到入口?WPS演示自带的"动画+计时"功能就能轻松实现——无论是课堂互动的30秒答题倒计时、商务汇报的5分钟限时讲解,还是活动暖场的动...

flash动画an制作MG动画元素如何调节透明度,小白...

如何在flash动画软件里面调节mg动画元素的透明?因为flash动画软件现在已经升级为flash动画软件,所以直接用新版flash动画软件开工,基本功能都差不多,只是flash增加很多智能化、人性...