AI让铅笔边讲边画,知识点秒变手绘视频

AI让铅笔边讲边画,知识点秒变手绘视频

AI 资讯 来源:新闻/公众号 发布时间:2026-10-07 更新于 2026-10-07 预计阅读 6 分钟

给AI一个讲解主题,它就能让一支铅笔跟着配音画出整段故事。小编选了一条注碳增气平台的新闻,做成三十秒手绘视频:画面先出现带吊机和管道的平台,再引出分离设备,接着用地层剖面解释二氧化碳如何回注地下,颜色标记帮助区分封存的碳和采出的气。这类白板视频特别适配边讲边画的知识讲解场景,比如讲英语介词,用球和盒子的位置就能帮人看懂句子;讲工业设备,靠管道连接展示物质流动。

制作时只需交代主题和受众,AI就能先写出讲得清楚的稿子,并规划每个画面何时出现。制作者可先核对内容和台词,再决定哪些画面需要细化。一支短片只讲一个知识点,便于老师观看后提问或补充。

我把手绘视频自动化了,输入内容就能边讲边画

为搭建可复用流程,小编先用AI生成一段二十秒英语教学样片,主题为in、on、at,只讲解这三个介词的空间用法,方便观察画笔动画与配音的配合。输入给能读取文件、调用工具并运行脚本的agent,比如workbuddy、豆包工作,根据任务安排素材和动作,脚本按确定时刻画图,最后把配音与动画合成视频。样片选用学生熟悉的物件:球在盒子内部对应in the box,杯子在桌面对应on the table,讲到at the door时借助门口这个点位阐释含义。

样片刚生成时有个明显毛病:同一张画面好几支笔一起快速画,物体自顾自绘制,动作堆在一起,观众很难跟上配音。要修好这点,得调整每个元素何时开始画,还要把控笔尖画多长,文字、排线、上色都算进耗时,即使有些元素不显示画笔,也不能与其他绘制动作重叠。这套工具还能适配课堂交互演示:介词书写出错时,可用橡皮擦除原有文字再写正确版本,学生能直观看到修改位置;更换红笔可标记错误,钢笔、记号笔也能带来不同线条质感。

我把手绘视频自动化了,输入内容就能边讲边画

英语课堂验证了简单物件和例句的搭配效果,后面接着测试人物更多的新闻讲解短片,这支20秒片子讲特朗普、马斯克,围绕SI超级智能事件展开。绘制名人形象时,先准备插画、再提取轮廓:先在原图敲定五官、发型与服饰,再通过编译脚本提取适配手绘动画的描线路径,同时保留墨线和原色图层。画面元素变多后,试听发现新问题:旁白一句话说完了,铅笔还在继续画剩下的内容,中间空出好几秒没有配音,观众只能干等下一句。这种情况容易打断节奏,短片看着也拖沓。后续只好拿配音当时间基准,先录好完整音频、算出时长,标出关键语句时间点,再调整画面切换和手绘动作,把画画造成的空白空档去掉。

不过AI生成视频都有同一个麻烦:一旦渲染好成片,改动基本要全部重做。标题太长、标签位置不对这类细节,最好导出之前就能预览检查。成片之后才发现问题,修改起来很麻烦。于是让脚本生成可视分镜,每一幕都呈现完整静态构图,旁边列出对应的画面文字与旁白。审阅时可一起判断物体大小和文字摆放,说明某处需要调整,agent再根据这份稿子修改。每个场景、物体和配音段都有稳定标识,修改请求可以对应到具体对象。

我把手绘视频自动化了,输入内容就能边讲边画

经过这些测试,制作方法已有适合保存的部分,小编把它整理成handdrawn-explainer这个Skill,供agent下次读取。SKILL.md写的是制作时需要做出的决定:要求先确认受众和时长,新闻要核实日期与阶段限定,主要讲解对象需要有可辨认的图形;默认使用一支铅笔,绘画时序跟随配音,并在完整导出前生成审阅稿。经常重复的操作交给scripts文件夹里的代码;绘画技法等较长说明保存在references,agent需要处理对应任务时再读取。运行环境需要Python、FFmpeg和兼容Chromium的浏览器,随包的检查脚本会检查依赖。配音可导入已有录音,图片生成与语音服务需要使用环境里可用的工具。

小编又拿它放在新的agent里连续做了几轮测试。第一轮是一道高中数学题:输入题目后会先识别题干条件,再将解题步骤拆解为多个段落;遇到需要绘制辅助线的环节,线条随推导过程逐步出现;需要标注角度、边长时,再添加对应符号。最终生成的视频不会一次性展示完整解题图形,讲解到某一条件时,画面仅展示当下需要用到的信息,辅助线、公式与结论随解说依次呈现,观看体验贴近教师在黑板上边分析、边书写推导的现场授课。第二轮换成高中物理,只给一个教学概念,让它自己决定怎样讲。第三轮又让它讲一段新闻稿,关于诺贝尔生理学或医学奖公布,三位科学家因光控离子通道和光遗传学相关发现获奖。agent会先把故事里真正影响理解的节点挑出来,再决定哪些地方需要人物形象,哪些地方更适合用图像、时间、箭头或者简单场景。讲到某个人,就先把人物和当时的场景画出来,事件继续发展,再补上后面发生的变化。

连续跑完这几组测试后,这套东西才算真正有了一点可复用的感觉。手绘视频本身并不复杂,麻烦的是把内容、旁白、画面和绘制节奏全部对齐。目前handdrawn-explainer已经上传到SkillHub,有需要的也可以拿去试试。

标签: AI 资讯 AI

更多推荐阅读

OpenAI一次公开722份数学手稿

OpenAI一次公开722份数学手稿

10月7日,OpenAI在GitHub上线openai/math仓库,一次性发布722份手稿,归入372个问题家族,涵盖乘法函数、π的无理性指数、马勒猜想、黎曼zeta函数零点区域、海森堡铁磁体自发磁化、自由群因子同构等领域。仓库分三层:preprints目录放PDF和源文件,lean目录放Lean形式化证明,reasoning_traces目录放模型推理过程摘要,并公开10份推理摘要。OpenA...

2026-10-07
AI几年内或超越所有人类?Anthropic研究员预测

AI几年内或超越所有人类?Anthropic研究员预测

Anthropic强化学习技术负责人Sholto Douglas在8月录制、10月2日上线的访谈中表示,能力等于甚至超过所有人类的模型,很可能在未来几年内出现。他设想AI能完成人类在电脑上做的所有工作,把原本需要几个世纪的科技进步压缩到一二十年。他推算,2028年AI年度资本开支可能达4万亿美元,全球GDP可能在2030年代初翻倍,届时地球上每个人都能享有连今天首富也无法拥有的富足。同场研究员Ni...

2026-10-07
陶哲轩为何突然转向AI减速派?

陶哲轩为何突然转向AI减速派?

曾最爱AI、逢人就安利AI工具的陶哲轩,一夜之间转向AI数学的对立面。在SAIR最新演讲中,他公开向模型公司开火:AI公司无休止加速,却对后果一无所知,必须慢下来,完全没理由这么快。感受到危机的远不止他一人,菲尔兹奖得主Cédric Villani在看到OpenAI拿下千禧难题后直言“大受震撼,简直跟世界末日一样”,而仅3个月前他还称LLM根本没有智能、只是统计学复读机。 就在几个月前,陶哲轩还...

2026-10-07
全球最大AI影视公司如何用模型拍电影

全球最大AI影视公司如何用模型拍电影

AI 视频已能生成足够像电影的镜头,但真正的 AI 电影仍很少。一旦进入长篇制作,角色一致性、镜头衔接、表演控制和团队协作都会成为问题。国内常见的 UGC 和 ProC 路线把编剧、导演、分镜、剪辑甚至制片压到一个创作者身上,AI 提升了个人效率,却没有把专业人群组织成生产线。ProC 的上限往往是模型的上限,影视公司的上限才可能是人的上限。 在 Artificial Analysis 最新有声...

2026-10-07
DeepSeek Harness兼容Claude Code Mods,作者回应

DeepSeek Harness兼容Claude Code Mods,作者回应

10月1日,Claude Code发布Mods,插件作者可用函数钩子改写提示词、拦截工具调用、在终端绘制界面。10月3日,DeepSeek Harness(DSH)发布v0.2.1-alpha.1,更新之一是实验性的Claude Code Mods兼容层。知乎随即出现相关讨论。10月4日下午,兼容层作者、DSH组崔添翼作答,明确“一切皆插件”与开源一样,是立项之初就定下的方向,不是被迫或模仿。 ...

2026-10-07
Claude用Lean严格验证,攻克菲尔兹奖得主数年未解的渗流猜想

Claude用Lean严格验证,攻克菲尔兹奖得主数年未解的渗流猜想

2026年8月30日,菲尔兹奖得主Hugo Duminil-Copin发文感叹,他倾注数年心血、屡败屡战的渗流猜想,恐怕迟早会被AI攻克。几乎同时,同行在GitHub上发现Anthropic工程师提交的代码仓库,其中是由大语言模型Claude生成、并经Lean严格验证的完整证明——困扰人类近70年的连续相变猜想已被AI证明。没有发布会,没有官方博客,消息传出后全球数学界震动。德国数学家Benedi...

2026-10-07
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部