ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

如何用lanshu-create-ai-presenter-video:「数字人口播」vs「9种风格动画讲解」双路线选择指南

如何用lanshu-create-ai-presenter-video:「数字人口播」vs「9种风格动画讲解」双路线选择指南 如何用lanshu-create-ai-presenter-video「数字人口播」vs「9种风格动画讲解」双路线选择指南【免费下载链接】lanshu-create-ai-presenter-videoProvider-neutral Codex Skill for producing verified AI presenter videos from a script and an authorized presenter image.项目地址: https://gitcode.com/gh_mirrors/la/lanshu-create-ai-presenter-videolanshu-create-ai-presenter-video 是一个面向新手的开源 Agent Skill把一句话主题或一份文案交给 AI就能产出经过验收、可直接发布的讲解视频。它内置两条路线——「数字人口播」用授权人物图生成真人出镜的口播视频与「9种风格动画讲解」不用真人用动画把内容演出来。本文帮你快速看懂两条路线的差异并给出选型清单和上手步骤。一张表看懂两条路线选口播还是选动画对比维度数字人口播9种风格动画讲解成片样子真人出镜讲解字幕 关键词动效辅助无真人每一句讲解都用画面「演」出来你需要提供主题或文案 一张授权人物图主题或文案也可用你自己录好的配音付费点配音 数字人视频生成仅配音自带配音则 0 额外费用默认画幅任意默认 9:16 竖屏固定 16:9 横屏适合场景个人品牌、对镜头说话概念需要被「演」出来、无真人出镜小提示如果你还没有一张已授权的人物照片或内容是抽象概念缓存、网络、算法流程优先选动画讲解路线。9种动画讲解风格先看图再选上图是仓库自带的 KV cache 讲解片在 9 种风格里的同一时刻。九种风格共用一套接口逐字字幕、章节条、结尾金句、一帧复习图区别在于「用什么画面演内容」。完整风格菜单见 explainer/STYLES.md风格一句话画面最适合V1 留白暖白纸、墨色、一抹朱红商务、产品、严肃话题V2 信号暗色仪表盘、荧光绿数据流AI、系统、网络类V3 手帐方格纸真笔现写、便利贴一步步推导、学习笔记V4 立体书牛皮纸立体书、纸片折起讲故事、讲流程V5 波普漫画网点漫画、贴纸拍入、爆炸字观点、辟谣、快节奏V6 一镜到底3D 影棚一镜到底、有电影感大概念、重磅发布V7 图纸与注脚黑色工程图纸、引线、注脚硬核技术深挖V8 黑板报粉笔现写、结尾粉笔脑图课堂感、入门、易记忆V9 黏土小城萌系黏土小镇、比喻 术语标签用比喻讲给小白拿不准选哪个工具支持一次出 9 种草稿再对比挑选音频锁定后不产生额外付费调用。路线一数字人口播视频怎么做适合你有个人 IP、想「人对人」讲解且能提供一张清晰的成年授权人物图。准备工作一张授权人物图务必确认使用权上传前工具会二次校验主题或完整文案主题会被写成 45–75 秒文案可选声音样本需明确授权才能克隆否则自动选用库存声音。制作流程由 SKILL.md 驱动每个阶段以磁盘上的产物为证据主题/文案 授权人物图 → 锁定文案与完整配音配音成为全片时钟 → 低成本人物试片 → 生成数字人素材服务商有时长上限时按真实停顿自动分段 → 按音频时间轴剪辑字幕、关键词动效、封面、结尾 → 技术验收 画面验收 → 母版、分享版、九宫格与交付报告阶段细节参考 references/generation.md文案、配音、付费闸门与 references/editing.md时间轴、字幕、开场结尾。路线二9种风格动画讲解怎么做适合你没有真人图、或内容靠画面「演」才讲得清缓存、流程、算法、辟谣等。准备工作主题或文案一个 MiniMax API Key用于逐句配音与逐字时间戳或你自己在别处录好的配音story.py --audio直接用0 配音成本。制作流程完整文档见 references/styled-explainer.md# 1. 建任务并指定风格此处以黑板报为例 python3 $SKILL_DIR/scripts/init_job.py --job-dir . --route styled \ --explainer-style v8-chalkboard --topic 40 秒讲清楚 RAG # 2. 讲稿 → 逐句配音 逐字时间 → story.json python3 $SKILL_DIR/explainer/tools/story.py story # 3. 用风格起步模板出可完整播放的初稿再逐句演绎 bash $SKILL_DIR/explainer/tools/new_film.sh v8-chalkboard story film # 4. 验收检查、静止检测、封面→ 5. 渲染出母版/分享版/字幕 python3 $SKILL_DIR/explainer/tools/qa.py film qa/film bash $SKILL_DIR/explainer/tools/render.sh film rag outputs 关键技巧先选风格再定稿。每种风格擅长的句式、语速、复习页时长都不同讲稿要按风格来写详见 explainer/STYLES.md 的「按风格写稿」表。三步帮你定路线决策清单有没有一张已授权的清晰人物图没有 → 直接走动画讲解数字人口播没有人物图无法启动。要竖屏发抖音/小红书还是横屏发 B 站/YouTube要 9:16 竖屏 → 走数字人口播动画讲解目前固定 16:9 横屏。内容靠「人讲」还是靠「画面演」个人品牌、对镜头说话 →口播抽象概念、流程、需要可视化 →动画讲解。安装与运行环境仓库目录本身就是一个 Skill克隆到所用工具的 skills 目录即可目录名保持lanshu-create-ai-presenter-videogit clone https://gitcode.com/gh_mirrors/la/lanshu-create-ai-presenter-video \ ~/.claude/skills/lanshu-create-ai-presenter-video环境要求基础Python 3.9、FFmpeg含ffprobe、Bash、jq数字人口播任一可调用「配音 数字人视频 口型同步」的能力云 CLI、API 或本地模型均可动画讲解另需 Node.jsnpx运行 HyperFrames、rsync、带numpy的 Python以及 MiniMax API Key或用自带配音。成本与交付钱花在哪质量怎么保证付费点透明数字人口播路线首次付费前agent 会先报「上传内容 请求秒数 已知价格 试片规模 重试上限」动画路线唯一付费项是配音且逐句缓存改一句只重配那一句。证据驱动的阶段闸门任务从intake到verified共 8 个阶段状态由 scripts/check_state.py 依据磁盘产物计算得出而不是手工声明——证据不足就无法前进。交付前强校验母版与分享版先做完整解码、响度达标默认 −16 LUFS、黑帧/冻帧检查全部通过才发布避免「看起来完成」的假交付。✅延伸阅读技能入口与完整工作流SKILL.md风格菜单与效果图explainer/STYLES.md风格包接口与工具explainer/KITS.md口播路线生成与剪辑references/generation.md、references/editing.md动画路线完整流程references/styled-explainer.md验收与故障修复references/qa-recovery.md一句话总结有人物图、要竖屏、讲个人 → 数字人口播没人物图、要横屏、内容要「演」 → 9种风格动画讲解。选定路线后剩下的交给工具链一步步验收即可。【免费下载链接】lanshu-create-ai-presenter-videoProvider-neutral Codex Skill for producing verified AI presenter videos from a script and an authorized presenter image.项目地址: https://gitcode.com/gh_mirrors/la/lanshu-create-ai-presenter-video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表