指框AI
540
0
0
指框AI是一款开源手势框选视频重绘工具,通过MediaPipe精准追踪双手框选区域,结合Gemini模型仅对框内画面进行AI风格化重绘,外部保持实拍原貌。支持网页在线体验与Python本地批量处理,内置强对齐约束保障人物连贯性。适用于短视频特效、影视分镜预览及AIGC创意制作。
工具标签:
直达网站

指框AI是什么?
指框AI(Finger Frame Effect AI)是一款手势框选AI视频重绘开源工具,主打真人双手框选画面,框内内容AI风格重绘 。依托MediaPipe手部跟踪+Gemini Omni Flash视频模型,精准跟随双手形成的矩形区域,仅对手指框内视频进行风格化重绘,外部画面保持原始实拍素材;支持网页在线使用、本地部署、Python命令行批量处理,适合短视频创意特效、影视分镜创作、AIGC创意短片制作。
官网:https://sophiamyang.github.io/finger-frame-effect-ai/
基础信息
| 项目 | 详情 |
|---|---|
| 工具名称 | 指框AI / Finger Frame Effect AI |
| 访问地址 | https://sophiamyang.github.io/finger-frame-effect-ai/ |
| 开源形态 | 前端网页应用,配套Python离线CLI脚本 |
| 核心模型 | MediaPipe手部关键点追踪、Gemini Omni Flash视频生成模型 |
| 推荐风格预设 | 3D动画电影、二维动画、黏土动画、水彩、自定义提示词 |
| 输入限制 | 视频文件≤15MB;推荐720p短时素材;支持mp4/mov/webm |
| 输出格式 | 浏览器优先导出MP4;不兼容浏览器输出webm,可通过ffmpeg转码 |
| 核心标签 | 手势跟踪、局部视频重绘、框内AI生成、开源网页工具、短视频特效 |
工作流程
- Track|手部跟踪定位
采用MediaPipe手部标记器逐帧识别双手关键点,计算双手合围形成的四边形选区。内置优化算法:解剖角度排序、交叉手指防渲染错乱、运动滞后平滑、瞬移过滤、丢帧补偿、选区淡入淡出,保证手指框持续稳定不抖动。 - 重新制作|AI视频风格重绘
提取手指框内区域,调用Gemini Omni Flash进行视频重绘。系统自动追加强制对齐后缀约束:锁定构图、禁止缩放裁剪、人脸坐标固定、逐帧保留表情(眨眼、嘴型、视线),保障人物动作、表情连贯性,重绘内容与选区完美匹配。 - 合成图像|图层叠加渲染
原始视频作为底层画面,AI重绘视频叠加在手指四边形区域;可视化显示虚线蚂蚁线轮廓+脉动角点,直观展示跟随手部移动的生成窗口。 - 导出|成品视频保存
浏览器直接录制导出;兼容环境输出H.264 MP4,Safari/老旧Chrome输出webm,附带ffmpeg转码指令。原始音频轨道可保留。
两种使用模式
模式1:网页在线使用
- ✅ 特点 :开箱即用,无需配置环境
- ⚠️ 前提 :自备 Gemini API密钥
模式2:本地部署方案
- 网页本地静态服务
python3 -m http.server 8124
访问 http://localhost:8124 ;支持 ?src=<文件路径> 参数加载本地视频,适合开发者调试。
- Python CLI离线批量处理
适合批量渲染、精准帧控、稳定H.264输出
# 环境初始化
python3 -m venv .venv
.venv/bin/pip install -r requirements.txt
# 设置密钥
export GEMINI_API_KEY=你的密钥
# AI风格重绘
.venv/bin/python stylize.py input.mp4 -o stylized.mp4
# 原始素材+重绘素材合成最终成片(依赖ffmpeg)
.venv/bin/python composite.py input.mp4 stylized.mp4 -o final.mp4
⚠️ composite脚本依赖ffmpeg配置环境变量,自动保留原始音频。
核心优势
- 局部可控生成 :区别于全片AI重绘,仅双手框内画面变换,外部实景不变,创意层次感极强;
- 强画面对齐约束 :内置提示词锁构图、锁面部位置、保留表情,大幅降低视频人物崩坏;
- 双端方案 :普通创作者网页即用,开发者支持离线批量脚本;
- 数据隐私友好 :用户素材默认保存在本地,仅样本素材上传测试,个人视频不会留存;
- 开源可改造 :前端代码与Python脚本均可二次修改,自定义风格、跟踪参数。
适用人群 & 场景
- 短视频创作者 :真人实拍+局部动画化特效、脑洞创意短片;
- 影视/编导 :实拍画面实时预览动画化分镜效果;
- AIGC工作室 :创意镜头测试、混合现实风格视频;
- 独立开发者 :二次开发手势交互AI生成demo。
局限与注意事项
- 需要自备Google Gemini API Key,国内直连访问存在网络障碍;
- 上传视频大小限制15MB,不支持长视频处理;
- 依赖Gemini Omni Flash视频模型,无法切换其他第三方视频生成模型;
- 手部严重遮挡、快速大幅度晃动时,选区跟踪稳定性下降。
AITOP100作为华强方特(深圳)动漫有限公司倾力打造的AI数智化聚合营销平台,同时也作为全网最全AI大赛活动举办和收录平台以及国内AI头部社区之一,平台已收录超700场AI视频、绘画、写作、算法等大赛。更有AI工具、资讯、教程、大咖直播。承办线上线下活动。快来参与或合作!
官网:https://www.aitop100.cn
想了解AITOP100平台其它版块的内容,请点击下方超链接查看
AI创作大赛 | AI活动 | AI工具集 | AI资讯专区 | AI小说
AITOP100平台官方交流社群二维码:


评论
全部评论

暂无评论
热门推荐
相关推荐

DeepSider
国内直连Sora2视频生成模型,无水印免费使用,无需邀请码,一键生成大片,人物自动配音对口型。插件内置Claude Sonnet 4.5,Nano Banana,GPT-5,Gemini 2.5 Pro等数十款AI模型,支持文档解析、表格解析。
JoyPix AI
JoyPix.ai是一家总部位于日本东京的生成式AI视频平台,以自研Motion-2 对口型模型为核心,集成全球最新视频大模型(Sora 2、Veo 3、Wan 2.6 等),提供“头像生成→语音克隆→对口型视频→多模态短片”全链路工具,目标是把“数字人创作”降到零门槛。
Movie Gen
Movie Gen是Meta在媒体制作领域推出的一款声音和视频一体化生成编辑AI工具,Meta Movie Gen是一个先进的媒体基础AI模型,用于生成沉浸式AI内容。 该技术允许用户通过简单的文本输入来生成定制视频和声音,编辑现有视频或将个人图像转换为独特的视频。
AutoClip
AutoClip是一款开源免费全流程自动化AI视频剪辑工具,其核心能力在于通过深度学习算法实现智能高光片段识别、动态内容组织和多模态内容生成。用户无需掌握专业剪辑技能,仅需输入视频链接或上传本地文件,即可在几分钟内获得结构化、可传播的视频切片合集。
可灵AI
"可灵"是快手AI团队自主研发的视频生成大模型,旨在为用户提供高质量的视频内容生成服务。该模型基于快手在视频技术领域的深厚积累,结合了先进的技术路线和多项创新技术,实现了与Sora相媲美的效果。
Unmute
Unmute是由法国AI实验室Kyutai推出的一款革命性的语音AI系统。它为文本大语言模型(LLM)赋予了强大的语音交互能力,以其高度模块化的设计、智能对话、超低延迟和个性化定制功能,正在引领语音AI技术迈向更高的灵活性和实用性,为语音AI领域注入了新的活力.
SkyReels
SkyReels-AI是昆仑万维精心打造的一款AI短剧创作平台,它深度融合了视频大模型与3D大模型,旨在为用户提供一站式的短剧创作解决方案。通过该平台,创作者无需具备专业的视频制作技能,即可轻松制作出高质量的AI短剧
PersonaTalk
PersonaTalk是由字节跳动开发的一项前沿视频口型编辑技术,它通过语音驱动来修改视频中人物的口型,实现高质量的视频编辑和数字人视频制作
0
0






