【问题标题】:Python OpenCV 2.4 writes half-complete PNG video framesPython OpenCV 2.4 编写半完整的 PNG 视频帧
【发布时间】:2012-05-14 11:08:36
【问题描述】:

我刚刚在 Ubuntu 12.04 上从源代码安装了 OpenCV 2.4。我正在尝试使用 Python 脚本将视频的第一帧写入 PNG 图像,但我得到了一些奇怪的结果。代码如下:

import numpy as np
import cv
import cv2
import sys

video = cv.CaptureFromFile(sys.argv[1])
frame = cv.QueryFrame(video)
proxy = cv.CreateImage(cv.GetSize(frame), 8, 1)
cv.CvtColor(frame, proxy, cv.CV_BGR2GRAY)
a = np.asarray(cv.GetMat(proxy))
cv2.imwrite('image.png', a)

问题是,图像看起来像这样:

这些是 AVI 文件,否则看起来没问题。有什么想法吗?

编辑 #1: 抱歉,这里是 ffmpeg 版本信息:

ffmpeg version 0.10.2-4:0.10.2-0ubuntu0jon1
built on Mar 18 2012 09:59:38 with gcc 4.6.3
configuration: --extra-version='4:0.10.2-0ubuntu0jon1' --arch=amd64 --prefix=/usr --libdir=/usr/lib/x86_64-linux-gnu --disable-stripping --enable-vdpau --enable-bzlib --enable-libgsm --enable-libschroedinger --enable-libspeex --enable-libtheora --enable-libvorbis --enable-pthreads --enable-zlib --enable-libvpx --enable-runtime-cpudetect --enable-libfreetype --enable-vaapi --enable-frei0r --enable-gpl --enable-postproc --enable-x11grab --enable-librtmp --enable-libvo-aacenc --enable-version3 --enable-libvo-amrwbenc --enable-version3 --enable-libdc1394 --shlibdir=/usr/lib/x86_64-linux-gnu --enable-shared --disable-static
libavutil      51. 35.100 / 51. 35.100
libavcodec     53. 61.100 / 53. 61.100
libavformat    53. 32.100 / 53. 32.100
libavdevice    53.  4.100 / 53.  4.100
libavfilter     2. 61.100 /  2. 61.100
libswscale      2.  1.100 /  2.  1.100
libswresample   0.  6.100 /  0.  6.100
libpostproc    52.  0.100 / 52.  0.100

编辑 #2: 在我自己的故障排除中,我将 ffmpeg 从默认的 12.04 ubuntu 版本升级到您在上面的编辑 #1 中看到的版本。这似乎改变了一些事情:在这个问题中生成帧的视频现在似乎工作正常,但较大的视频仍然存在损坏的下半部分(或底部三分之一或四分之一)。更大的视频实际上完全是段错误。我真的不知道该怎么做,除了 - 再次 - 错误或丢失的编解码器。它在QueryFrame 步骤上出现段错误。

编辑 #3: 我更改了代码以独占使用 cv2 接口(根据以下 cmets 之一中的链接)。现在,video.retrieve() 总是返回 False 并且没有写入图像。

编辑#4:在使用新的 cv2 接口读取视频帧之前,我在视频上运行了以下命令:

ffmpeg -sameq -i normal.avi p_normal.avi

该命令的输出看起来不错,除了 ffmpeg 初始化后的这一行及其对输入的描述:

编解码器“mpeg4”的像素格式“pal8”不兼容,自动选择 格式'yuv420p'

这是命令的完整输出:

Input #0, avi, from 'normal.avi':
  Duration: 00:01:37.60, start: 0.000000, bitrate: 1312 kb/s
    Stream #0:0: Video: rawvideo, pal8, 128x256, 5 tbr, 5 tbn, 5 tbc
Incompatible pixel format 'pal8' for codec 'mpeg4', auto-selecting format 'yuv420p'
[buffer @ 0x11a0f80] w:128 h:256 pixfmt:pal8 tb:1/1000000 sar:0/1 sws_param:
[buffersink @ 0x11a1380] auto-inserting filter 'auto-inserted scale 0' between the filter 'src' and the filter 'out'
[scale @ 0x1197da0] w:128 h:256 fmt:pal8 -> w:128 h:256 fmt:yuv420p flags:0x4
Output #0, avi, to 'p_normal.avi':
  Metadata:
    ISFT            : Lavf53.32.100
    Stream #0:0: Video: mpeg4 (FMP4 / 0x34504D46), yuv420p, 128x256, q=2-31, 200 kb/s, 5 tbn, 5 tbc
Stream mapping:
  Stream #0:0 -> #0:0 (rawvideo -> mpeg4)
Press [q] to stop, [?] for help
frame=  488 fps=  0 q=0.0 Lsize=    1497kB time=00:01:37.60 bitrate= 125.6kbits/s    
video:1480kB audio:0kB global headers:0kB muxing overhead 1.165352%

最重要的是,读取帧的 Python OpenCV 代码(使用 cv2 接口)仍然返回 False(与之前的行为相同)。

编辑 #5: 到目前为止,我已经按照说明 found here 从源代码安装 ffmpeg 及其依赖项,并且进展顺利。如果不从源代码重新安装 OpenCV,我仍然遇到与以前相同的问题,video.retrieve() 返回 False。在尝试从源代码重新编译 OpenCV 2.4 时,我在编译过程中收到以下错误:

Linking CXX shared library ../../lib/libopencv_highgui.so
/usr/bin/ld: /usr/local/lib/libavcodec.a(avpacket.o): relocation R_X86_64_32S against `av_destruct_packet' can not be used when making a shared object; recompile with -fPIC
/usr/local/lib/libavcodec.a: could not read symbols: Bad value

如果我使用 --enable-pic 标志重新编译 x264、libvpx 和 ffmpeg,OpenCV 编译仍然失败,这次分别使用 (kdbwin.o, .rodata) 而不是 (avpacket.o, av_destruct_packet)上面的sn-p。

Edit #6: 通过在 libvpx 和 ffmpeg 的配置选项中添加 --enable-shared 来修复上述错误。 OpenCV 重新编译并成功构建,ffmpeg 工作得很好。遗憾的是,在运行上一个命令 (ffmpeg -sameq -i normal.avi p_normal.avi) 后,我的脚本 仍然 无法检索任何帧;返回的标志仍然是 False。还有什么想法吗?

编辑#7:这是我正在使用的最新脚本。

import numpy as np
import cv2
import sys

video = cv2.VideoCapture(sys.argv[1])
flag, frame = video.retrieve()
if not flag:
  print 'Error'
  quit()
proxy = cv2.cvtColor(frame, cv2.COLOR_BGR2GRAY)
cv2.imwrite('image.png', proxy)

编辑#8:知道了!代码应该是这样的:

import numpy as np
import cv2
import sys

video = cv2.VideoCapture(sys.argv[1])
if video.grab():
  flag, frame = video.retrieve()
  if not flag:
    print 'Error'
    quit()
  proxy = cv2.cvtColor(frame, cv2.COLOR_BGR2GRAY)
  cv2.imwrite('image.png', proxy)

【问题讨论】:

    标签: python video opencv video-processing


    【解决方案1】:

    问题很可能出在 ffmpeg 和使用的视频编解码器上。你能分享其中一个视频吗?然后我们可以检查编解码器,看看有什么问题。此外,我们不知道您的系统上有什么 ffmpeg 版本。

    请注意,为什么要混合 cv 和 cv2 接口?如果只使用 cv2 接口,代码看起来会更好。

    编辑:我忘了说,我测试了代码,所以问题肯定不在代码中。

    编辑 2: 问题可能在于 ffmpeg 无法处理您的视频。如果不测试有问题的视频,很难说。你可以试试 cv2 接口,cv2.VideoCapture 是你应该用来从视频文件中抓取帧。

    编辑 3: 我看了视频,看来 OpenCV 使用 ffmpeg 的方式与您的视频有问题。一个快速的解决方法是在 OpenCV 打开之前使用 ffmpeg 处理您的视频。 ffmpeg -sameq -i normal.avi p_norma.avi 给你一个视频,p_norma.avi,你可以通过 OpenCV 毫无问题地处理它。对于normal.avi

    Selected video codec: [rawbgr8flip] vfm: raw (RAW BGR8)
    

    对于生成的视频p_norma.avi

    Selected video codec: [ffodivx] vfm: ffmpeg (FFmpeg MPEG-4)
    

    因此,生成的视频大约要小 10 倍。这对您来说是一个可能的解决方案吗?

    【讨论】:

    • 我很想知道如何使这个完全基于 cv2,因为 cv2 接口似乎没有像 QueryFrameCaptureFromFile 或我所有其他的方法使用代码 sn-p 中的普通 cv 接口调用。我只做cv2.cv._method_ 吗?另外,我会尽快找到视频。
    • 在找视频发给你的过程中,我有了新的发展。请参阅主要问题中的编辑#2。
    • 我更新了答案,有一个工作示例here 展示了如何使用 cv2 接口处理视频文件。
    • 漂亮,非常感谢您的链接。我将您的代码与 cv2 接口完全一起使用,现在每次调用video.retrieve()flag 返回值始终为False,因此很可能是 ffmpeg 问题。这是在帖子中创建原始图像的视频的链接:dl.dropbox.com/u/1377610/normal.avi
    • :-) 您忘记在video.retrieve() 之前致电video.grab()。那应该解决它。请告诉我进展如何。
    猜你喜欢
    • 2012-08-30
    • 1970-01-01
    • 2023-01-05
    • 2015-08-11
    • 2011-07-22
    • 2023-01-25
    • 2021-09-23
    • 1970-01-01
    • 2017-07-07
    相关资源
    最近更新 更多