初探本地DeepSeek VL + Typescript + FFMPEG:提取视频关键帧分析内容
初探本地DeepSeek VL + Typescript + FFMPEG:提取视频关键帧分析内容
前言
随着人工智能和计算机视觉技术的发展,利用图像识别来分析视频内容已经成为现实。本文的主要目标是:
- 使用 ffmpeg 从视频中提取关键帧图片;
 - 基于 DeepSeek VL 1.3B 本地大模型对视频帧进行目标检测与识别(例如特定物体或人物);
 - 实现流式传输分析结果,确保实时反馈;
 - 提供终止分析操作的机制,防止资源浪费;
 
环境要求
- Typescirpt 5+
 - Nodejs 20+
 - Python 3.8+
 - 安装FFMPEG
 - 部署DeepSeek VL本地大模型
 
项目演示(视频未加速)

使用的显卡是英伟达RTX 4070Ti-O12G
技术实现
前端部分
实现思路
- 用户在界面上传视频
 - 后端分析视频然后逐一提取视频的每一帧保存为本地图片
 - 准备好参数,发送请求给DeepSeek VL API
 - 获取DeepSeek VL API数据,返回到前端
 
视频关键帧提取
本项目中视频的关键帧提取是视频分析的基础。关键帧是指视频中能够代表某一时间段内容的图像。通过提取关键帧,可以将视频处理的复杂度降低到图像处理的层面,从而显著提高处理效率。
在我们的实现中,使用了FFmpeg库来提取视频的关键帧。
具体步骤如下:
- 视频时长获取:通过FFmpeg获取视频的总时长,确定需要提取的关键帧数量。
 - 关键帧提取:按固定时间间隔(例如每秒提取一帧)从视频中提取关键帧,并将其保存到指定路径。
 
相关代码如下:
async function getVideoDuration(videoFilePath: string): Promise<number | undefined> {
  return new Promise((resolve, reject) => {
    ffmpeg.ffprobe(videoFilePath, (error, metadata) => {
      if (error) reject(error);
      const format = metadata.format;
      resolve(format.duration);
    });
  });
}
async function getVideoKeyframeImg(params: GetVideoKeyframeImgParams): Promise<string> {
  const { videoFilePath, seek, imgOutputPath } = params;
  const imgFileOutputPath = `${imgOutputPath}/${seek}.png`;
  return new Promise((resolve, reject) => {
    ffmpeg(videoFilePath)
      .seekInput(seek)
      .output(imgFileOutputPath)
      .outputOptions(['-frames:v 1'])
      .on('end', () => resolve(imgFileOutputPath))
      .on('error', err => reject(err))
      .run();
  });
}
接口部分
使用开源深度视觉语言(VL)模型:DeepSeek-VL
DeepSeek VL 是一个支持图像分析和目标检测的深度学习模型。它能够对输入的图像进行分析,并返回检测到的目标及其位置信息。在实现中,DeepSeek VL 用于分析提取的关键帧,判断其中是否包含特定的物体或人物。
由于DeepSeek-VL没有提供API接口访问,如有需要请到DeepSeek-VL-Fork自取
- 按照DeepSeek-VL说明部署完成
 - 修改app_deepseek_rest_api.py文件图片访问路径:
filePath = "C:\\Users\\Administrator\\Code\\video-finder\\public\\images\\"
 - 运行脚本
python .\deepseek_vl\serve\app_deepseek_rest_api.py
 
实际应用场景与扩展
通过视频我们可以看到DeepSeek-VL分析图片的速度还是非常之快的,由于DeepSeek-VL暂不支持特定格式返回,所以有很多应用场景是无法做到的。比如:
- 监控视频中的异常行为检测;
 - 视频内容的自动摘要及标签提取;
 - 实时视频流的内容检索;
 - 等等
 
总结
本项目简单初探一下如何利用 ffmpeg 与 DeepSeek VL 技术,对视频文件进行关键帧提取和图片的分析。希望本文能为大家提供灵感,在实际项目中更好地应用视频分析技术。
初探本地DeepSeek VL + Typescript + FFMPEG:提取视频关键帧分析内容的更多相关文章
- 基于C#利用ffmpeg提取视频帧
		
利用ffmepg提取视频帧实际上是利用C#调用ffmepg命令行进行处理对应的视频,然后输出出视频帧 GetPicFromVideo("); static public string Get ...
 - 交叉编译多平台 FFmpeg 库并提取视频帧
		
原文地址: 交叉编译多平台 FFmpeg 库并提取视频帧 交叉编译多平台 FFmpeg 库并提取视频帧 本文档适用于 x86 平台编译 armeabi.armeabi-v7a.arm64-v8a.x8 ...
 - 交叉编译多平台 FFmpeg 库并提取视频帧(转)
		
交叉编译多平台 FFmpeg 库并提取视频帧 转 https://www.cnblogs.com/leviatan/p/11142579.html 本文档适用于 x86 平台编译 armeabi.a ...
 - FFmpeg进行视频帧提取&音频重采样-Process.waitFor()引发的阻塞超时
		
由于产品需要对视频做一系列的解析操作,利用FFmpeg命令来完成视频的音频提取.第一帧提取作为封面图片.音频重采样.字幕压缩等功能: 前一篇文章已经记录了FFmpeg在JAVA中的使用-音频提取&am ...
 - Windows下 ffmpeg + labelImg 提取视频帧 得到图片集 并 标注图片 来 构造数据集
		
构造数据集的流程 视频文件 >> ffmpeg处理 >> 图片集 >> labelImg进行标注 >> 标注好的数据集 准备ffmpeg ...
 - FFmpeg解码视频帧为jpg图片保存到本地
		
FFmpeg解码视频帧为jpg图片保存到本地 - CSDN博客 https://blog.csdn.net/qq_28284547/article/details/78151635
 - NET 2.0(C#)调用ffmpeg处理视频的方法
		
另外:ffmpeg的net封装库 http://www.intuitive.sk/fflib/ NET 2.0 调用FFMPEG,并异步读取输出信息的代码...public void ConvertV ...
 - Java使用FFmpeg处理视频文件指南
		
Java使用FFmpeg处理视频文件指南 本文主要讲述如何使用Java + FFmpeg实现对视频文件的信息提取.码率压缩.分辨率转换等功能: 之前在网上浏览了一大圈Java使用FFmpeg处理音视频 ...
 - Java使用FFmpeg处理视频文件的方法教程
		
这篇文章主要给大家介绍了关于Java使用FFmpeg处理视频文件的相关资料,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面来一起学习学习吧 前言 本文主要 ...
 - windows下使用ffmpeg进行视频转换和截图。
		
author:fanfq(xiaoban) Email:fangqing.fan#gmail.comlink:http://fanfq.iteye.com/admin/blogs/655569chan ...
 
随机推荐
- IOS多线程之NSOperation(2)
			
IOS多线程之NSOperation(2) 最大并发数 open var maxConcurrentOperationCount: Int 并发数就是同时执行的任务数.比如,同时开3个线程执行3个任务 ...
 - tailscale安装教程
			
tailscale安装失败可能是由于以下原因之一导致的: 系统兼容性问题:tailscale可能不支持你的操作系统版本或架构.请确保你的系统满足官方的最低要求,并尝试使用官方提供的正确版本进行安装. ...
 - 创建没有构造函数的NumberFormat
			
我有以下课程: import java.text.NumberFormat; public static class NF { public static NumberFormat formatSha ...
 - 关于Java的UUID
			
UUID或者UNID或者UID,是一个统一唯一标识,可以用来标记文档.数据或其它需要唯一标识的东西.Java 5.0内置UUID的实现,见java.util.UUID. 下面代码是找到的2种实现方式, ...
 - IntelliJ IDEA生成jar包运行报Error:A JNI error has occurred,please check your installation and try again
			
首先介绍一下IntelliJ IDEA生成jar包的方式: 1.打开项目,打开FIile->Project Structure...菜单.如下图: 选中Artifacts,点+号,选择JAR,再 ...
 - Qt编写地图综合应用33-雨量分布
			
一.前言 雨量分布图是在区域地图基础上,针对区域中的每个最小单位区域比如县城点位不同颜色显示,最开始做这个封装的时候,并没有提供单独设置每个点颜色的接口,后面经过几个客户的强烈建议,咬咬牙把每个点都可 ...
 - Qt音视频开发6-ffmpeg解码处理
			
一.前言 采用ffmpeg解码,是所有视频监控开发人员必备的技能,绕不过去的一个玩意,甚至可以说是所有音视频开发人员的必备技能.FFmpeg是一套可以用来记录.转换数字音频.视频,并能将其转化为流的开 ...
 - React中的 ref 及原理浅析
			
前言 对于 ref 的理解,我们一部人还停留在用 ref 获取真实 dom 元素和获取组件层面上,但实际 ref 除了这两项功能之外,在使用上还有很多小技巧.本章我们就一起深入探讨研究一下 React ...
 - UML之发现用例
			
用例是最简单的UML元素,用例图是最简单的UML图,但它也可能是UML中最有用的元素之一.尽管我们用包将工作分解为工作包.团队任务或单项任务,也就是说包是组织UML中的各种图及元素的工具.但是用例图可 ...
 - Python 安装package 问题汇总
			
1. pip 命令使用国内源安装 pip install torch==1.8.1 -i https://mirrors.aliyun.com/pypi/simple/腾讯云: https://mir ...