近日,一项名为“视频SKILL”的开源项目在GitHub及Linux.do社区引发关注。该项目名为 `story-handdrawn-remotion`,旨在将一段中文故事文本自动转化为“手绘日记漫画风”的竖屏视频。该项目由开发者 liangdabiao 基于 gnipbao 的开源项目改造而来,完全开源并免费提供使用。
该项目在技术实现上具有鲜明的创新性,其核心方法论并非传统的“一张精美配图加文字朗读”,而是设计了一套独特的三阶段横向擦除揭示逻辑。具体而言,系统会将故事中的每一句话拆解为三个视觉阶段:首先是纯文字展示,随后逐步擦除显示为黑白线稿,最后再擦除展示为彩色插画。这种“文字→黑白画稿→彩色插画”的递进式呈现,让一句话仿佛被画笔描绘了三次,极大地增强了视频的叙事节奏感和视觉趣味性。
技术架构方面,该 Skill 基于视频流框架 Remotion 开发,能够处理包括历史故事(如王安石变法)在内的各类中文文本素材。项目方强调,该方案完全开源,无未开源部分,并已链接至认可的 LINUX DO 社区。对于内容创作者而言,这提供了一种低成本制作高质量动态漫画视频的自动化解决方案,特别适用于抖音、B站等短视频平台的内容生产。
事件分析
从技术角度看,它解决了生成式AI视频中“动态一致性”的难题,即如何让画面变化服务于文本叙事,而非单纯的画面流转。其“三阶段揭示”机制(Text -> Sketch -> Color)巧妙地将阅读过程可视化,模拟了人类在纸上构思、草绘、上画的思维过程。
从行业影响看,这标志着开源视频生成工具正从通用模型向垂直领域的“风格化模板”演进。开发者不再单纯依赖大模型的生成能力,而是通过工程化手段(如 Remotion 编程)来封装审美与逻辑,降低了普通用户使用AI进行高质量创意表达的门槛。未来,此类基于特定工作流(Workflow)的开源 Skill 可能会成为AIGC工具分发的重要形式。
💡 核心观点:AIGC视频正从“静态图朗读”向“过程化叙事”进化,该开源项目通过工程化手段精准控制视觉流,为垂直领域的自动化内容生产提供了高可用范本。
原文链接:Linux.do





