Python实现FLV视频拼接功能


Posted in Python onJanuary 21, 2020

文章摘要

本文简单说明了FLV文件的格式,以此为出发点,使用 Python 实现FLV视频的拼接。

一.FLV文件格式

关于FLV文件格式的解析网上有诸多文章,在这里就简单介绍一下需要了解的部分,以便读者更好地明白各段代码的功能。

FLV文件是由文件头(Header)和文件体(Body)按顺序拼接而成。审查FLV内容时,以二进制方式读取内容。

Header:文件头表明了文件的封装格式为FLV,存储对象为音频、视频或两者。
以下为FLV文件的Header,共 9 个字节:

b'FLV\x01\x05\x00\x00\x00\t'
前 3 个字节(FLV)说明这是一个FLV文件
第 4 个字节(\x01)为版本号,固定为 1
第 5 个字节(\x05)表明存储对象,需将其转化成二进制(00000101)查看,左、右边的 1 分别表示文件含有音频和视频
后 4 个字节(\x00\x00\x00\t)表示文件头的长度,其值固定为 9

Body:文件体由若干个 Tag 组成,除了第一个,每个 Tag 是由头部( 11 字节)、主体(不定长)和尾部( 4 字节)组成。第一个 Tag 只有尾部。

Tag 又分为 3 类,脚本(scripts)、音频(audio)和视频(video)。通常第 2 个 Tag 为脚本类型,且只有一个,后续的都是音视频类型。

以下为脚本 Tag 的部分,作为示例介绍一下:

头部:b'\x12\x00\tb\x00\x00\x00\x00\x00\x00\x00'
第 1 个字节(\x12)表示 Tag 类型,脚本类型的对应值为 18 ,音频为 8 ,视频为 9
第 2-4 个字节(\x00\tb)表示 Tag 主体的长度,此处为 2402
第 5-7 个字节(\x00\x00\x00)为时间戳,脚本类型的时间戳通常为 0
第 8 个字节(\x00)是时间戳的扩展,当前 3 个字节不够用时会用这个字节当作大端
后 3 个字节(\x00\x00\x00)是 Stream id,固定为 0

主体:脚本 Tag 的主体包含FLV视频的基本信息,如时长、大小、分辨率等,比较复杂,在此不作介绍

尾部:b'\x00\x00\tm'

固定 4 字节,表示 Tag 头部加主体的长度,即 11 + 2402 = 2413

二.FLV视频拼接

将多个FLV视频合成一个可以正常播放的视频,便足够满足大部分的需求。因此,在接下来的拼接过程中,不会对FLV进行细致入微的调整,达到基本要求即可。

设置阅读器

阅读器可以使我们很方便地读取文件内容。

class Reader():
  def __init__(self, content): # content (bytes):FLV文件的二进制内容
    self.content = content
    self.start = 0
    self.eof = False # 判断是否已读完全部内容
    self.length = len(self.content)
    
  def read(self, n=1):
    # 设置 if 语句防止过度读取内容
    if self.length > (self.start + n):
      out = self.content[self.start:self.start + n]
      self.start += n
    else:
      out = self.content[self.start:]
      self.eof = True
    return out

向新建FLV文件写入 Header 和 Tag

在这里假设要拼接的视频基本信息相似,即都含有音视频,分辨率、码率等相同或相近。

为了生成一个可以正常播放的FLV视频,Header 和 Tag 是必不可少的。我们可以选取第一个FLV的文件头写入新建FLV中,然后依次将修改过时间戳的 Tag 写入其中,便可达到拼接目的。

def add_flv(flv, target, videoTimeStamp, audioTimeStamp): # 修改并添加 Tag 的函数
  with open(flv, 'rb') as f:
    content = f.read()
  reader = Reader(content)
  header = reader.read(13)
  with open(target, 'ab') as f:
    while not reader.eof: # 一直读取直到读完,此时 reader.eof = True
      dataType = reader.read(1)
      dataSize = reader.read(3)
      timeStamp = int.from_bytes(reader.read(3), 'big') # 将 3 字节转换成整数
      headerRemained = reader.read(4)
      if dataType == b'\t': # 视频
        timeStamp += videoTimeStamp
        videoTS = timeStamp
      if dataType == b'\x08': # 音频
        timeStamp += audioTimeStamp
        audioTS = timeStamp
      timeStamp = timeStamp.to_bytes(3, 'big') # 将整数转换成 3 字节
      tagHeader = dataType + dataSize + timeStamp + headerRemained
      tagData_andSize = reader.read(int.from_bytes(dataSize, 'big') + 4)
      f.write(tagHeader)
      f.write(tagData_andSize)
  return videoTS, audioTS
def merge_flv(flvs, target): # 主函数
  videoTS = 0
  audioTS = 0
  for i, flv in enumerate(flvs):
    with open(flv, 'rb') as f:
      content = f.read()
    reader = Reader(content)
    
    header = reader.read(13) # flvHeader + tagSize0
    if i == 0: # 写入第 1 个FLV视频的文件头
      with open(target, 'wb') as f:
        f.write(header)
        
    videoTS, audioTS = add_flv(flv, target, videoTS, audioTS)

拼接

import time
since = time.time()
flvs = ['m1.flv', 'm2.flv', 'm3.flv', 'm4.flv'] # 视频大小:45MB,20MB,59MB,54MB
target = 't.flv'
merge_flv(flvs, target)
end = time.time()
print('Merging flvs takes {:.2f} s'.format(end - since))
# Merging flvs takes 0.88 s

可以看到,拼接 4 个共 178MB视频用时 0.88 秒。

总结

FLV文件格式还是比较简明的,对数据的要求也是比较宽松的,即便没有对 Scripts 里的参数作调整,拼接后的视频依然能够正常播放。

不过,拼接的视频是有不少隐形问题,如到视频末尾可能会出现音画不同步( 0.5 秒左右)的现象,以及不能够方便地分离出完整的视频和音频。

以上所述是小编给大家介绍的Python实现FLV视频拼接功能,希望对大家有所帮助,如果大家有任何疑问请给我留言,小编会及时回复大家的。在此也非常感谢大家对三水点靠木网站的支持!
如果你觉得本文对你有帮助,欢迎转载,烦请注明出处,谢谢!

Python 相关文章推荐
tensorflow 恢复指定层与不同层指定不同学习率的方法
Jul 26 Python
python 简单照相机调用系统摄像头实现方法 pygame
Aug 03 Python
python进行TCP端口扫描的实现
Dec 21 Python
Django框架HttpRequest对象用法实例分析
Nov 01 Python
在python shell中运行python文件的实现
Dec 21 Python
python实现四人制扑克牌游戏
Apr 22 Python
python3.7.3版本和django2.2.3版本是否可以兼容
Sep 01 Python
python3排序的实例方法
Oct 20 Python
VSCODE配置Markdown及Markdown基础语法详解
Jan 19 Python
python中用ggplot绘制画图实例讲解
Jan 26 Python
利用python调用摄像头的实例分析
Jun 07 Python
Python 正则模块详情
Nov 02 Python
TFRecord格式存储数据与队列读取实例
Jan 21 #Python
TensorFlow dataset.shuffle、batch、repeat的使用详解
Jan 21 #Python
使用 tf.nn.dynamic_rnn 展开时间维度方式
Jan 21 #Python
python爬取本站电子书信息并入库的实现代码
Jan 20 #Python
浅谈Tensorflow 动态双向RNN的输出问题
Jan 20 #Python
关于tf.nn.dynamic_rnn返回值详解
Jan 20 #Python
双向RNN:bidirectional_dynamic_rnn()函数的使用详解
Jan 20 #Python
You might like
PHP获取表单textarea数据中的换行问题
2010/09/10 PHP
php设计模式 Decorator(装饰模式)
2011/06/26 PHP
PHP 面向对象详解
2012/09/13 PHP
PHP循环函数使用介绍之PHP基础入门教程
2013/09/21 PHP
PHP 面向对象程序设计(oop)学习笔记 (五) - PHP 命名空间
2014/06/12 PHP
php基于双向循环队列实现历史记录的前进后退等功能
2015/08/08 PHP
yii2中添加验证码的实现方法
2016/01/09 PHP
php用正则判断是否为数字的方法
2016/03/25 PHP
PHP  实现等比压缩图片尺寸和大小实例代码
2016/10/08 PHP
jQuery中queue()方法用法实例
2014/12/29 Javascript
JavaScript中的pow()方法使用详解
2015/06/15 Javascript
javascript动态添加删除tabs标签的方法
2015/07/06 Javascript
angularjs 中$apply,$digest,$watch详解
2016/10/13 Javascript
AngularJS折叠菜单实现方法示例
2017/05/18 Javascript
基于BootStrap multiselect.js实现的下拉框联动效果
2017/07/28 Javascript
nodejs中各种加密算法的实现详解
2019/07/11 NodeJs
iview form清除校验状态的实现
2019/09/19 Javascript
微信小程序实现滑动翻页效果(完整代码)
2019/12/06 Javascript
[46:47]2014 DOTA2国际邀请赛中国区预选赛5.21 LGD-CDEC VS NE
2014/05/22 DOTA
[01:01:13]2018DOTA2亚洲邀请赛 4.5 淘汰赛 Mineski vs VG 第三场
2018/04/06 DOTA
[46:42]DOTA2-DPC中国联赛正赛 Aster vs Magma BO3 第二场 3月5日
2021/03/11 DOTA
朴素贝叶斯算法的python实现方法
2014/11/18 Python
Python的Django框架中的select_related函数对QuerySet 查询的优化
2015/04/01 Python
详解Python的Django框架中的templates设置
2015/05/11 Python
Python基于回溯法子集树模板解决数字组合问题实例
2017/09/02 Python
Python中矩阵库Numpy基本操作详解
2017/11/21 Python
python+matplotlib绘制简单的海豚(顶点和节点的操作)
2018/01/02 Python
Pycharm新手教程(只需要看这篇就够了)
2019/06/18 Python
python+django+rest框架配置创建方法
2019/08/31 Python
python有序查找算法 二分法实例解析
2020/02/18 Python
详解python变量与数据类型
2020/08/25 Python
Pycharm常用快捷键总结及配置方法
2020/11/14 Python
2015年秋季小班开学寄语
2015/05/27 职场文书
2016教师校本研修心得体会
2016/01/08 职场文书
学习党史心得体会2016
2016/01/23 职场文书
导游词之阆中古城
2019/12/23 职场文书