2026 国产 AI 自媒体实战:用 5 款免费工具做出第一条短视频

AI自媒体国产AI免费AI工具短视频制作内容创作

一套适合零预算新手的 AI 自媒体工作流:用 Kimi、DeepSeek、豆包、即梦和剪映完成选题、资料整理、口播脚本、配图、剪辑、审核与发布复盘,并通过人工闸门控制事实、版权、隐私和平台风险。

国产 AI 免费篇封面
国产 AI 免费篇封面

适合第一次接触 AI 创作、预算为零、希望先做出第一条内容的人。本文不追求“全自动”,而是先建立一条可重复、可检查、能真正完成的工作流。

导读:你缺的往往不是工具,而是一条能走到底的流程

第一次做自媒体的人,通常会把困难归结为“我不会写”“我不会剪”“我没有镜头感”。真正开始以后才会发现,更大的问题是工作被切成了很多碎片:今天找选题,明天写稿,后天做图;好不容易打开剪辑软件,又发现素材比例不统一、口播太长、标题和正文说的不是一件事。

AI 可以缓解这些问题,但前提是不要把它当成一个会自动交作业的黑箱。更稳妥的做法,是把创作拆成几个小步骤,让每个工具只承担它擅长的部分:一个工具整理资料,一个工具写稿,一个工具把语言改得更像人说话,一个工具做视觉素材,最后由剪辑工具完成装配。

本文会用一个具体案例贯穿全篇:制作一条 60~90 秒的知识类短视频《AI 为什么适合整理会议纪要》。你将得到一份选题卡、一版可直接录制的口播稿、一组画面提示词、一张镜头表,以及发布前的审核清单。

国产免费工作流
国产免费工作流
graph LR
    A[账号定位] --> B[建立选题池]
    B --> C[整理资料卡]
    C --> D[生成口播稿]
    D --> E[生成图片与镜头]
    E --> F[剪辑与字幕]
    F --> G[人工审核]
    G --> H[发布与复盘]

一、先准备最小工具组合

免费路线不需要把所有热门产品都装一遍。工具越多,切换成本越高,账号、素材和版本也越容易混乱。下面这套组合已经足以完成第一条视频。

国产免费工具分工
国产免费工具分工
环节推荐工具本文中的职责替代原则
资料整理Kimi汇总材料、提炼重点、生成问题清单能读长文本并整理结构即可
脚本写作DeepSeek生成提纲、口播稿和不同版本中文表达稳定即可
口语化改写豆包缩短句子、模拟对话、检查是否拗口任一中文对话模型均可
图片与短镜头即梦文生图、图生视频、局部调整使用账号可用的免费额度
剪辑与字幕剪映装配素材、字幕、配音、音乐和导出手机端或桌面端均可

Kimi 官方页面将其定位为可处理知识工作、文档和创作任务的 AI 助手;DeepSeek 提供对话产品和公开 API 文档;豆包官方列出的能力包括问答、写作、翻译和创作辅助;即梦支持文字绘图、文字生成视频与图片生成视频;剪映则把 AI 成片、图片设计、配音和多轨编辑放在同一套创作流程中。具体免费额度、排队速度和可用模型可能变化,因此本文只讲方法,不把某个额度写成固定承诺。

二、第一步不是追热点,而是确定账号边界

很多人打开 AI 后第一句话是:“今天有什么热点?”这个问题太宽。模型可能给出十几个看起来热闹、却与你的账号无关的主题。更好的方法是先写一张账号定位卡,限定内容范围。

错误提问与正确提问对比
错误提问与正确提问对比

把下面内容复制给任一文本模型,并替换括号中的信息:

你是我的内容策划助手。请先不要生成选题,先根据以下信息整理一张账号定位卡。

账号主题:普通人如何使用 AI 提高工作效率
主要受众:22~40 岁的职场用户
内容形式:60~90 秒竖屏口播或图文视频
表达风格:清楚、克制、少术语,不夸大效果
不做的内容:未经核实的新闻、收益承诺、复杂编程教学
更新频率:每周 3 条

请输出:
1. 一句话定位
2. 三个固定栏目
3. 每个栏目的选题边界
4. 观众看完后应获得什么
5. 容易跑偏的五类内容

一个可用的定位结果应当足够窄。例如:

用 90 秒解释一个普通人当天就能尝试的 AI 工作方法,并说明适用场景、限制和检查步骤。

这句话会成为后续所有提示词的“总约束”。以后选题再多,也先判断它是否符合这句话。

账号定位卡
账号定位卡

三、建立一个不依赖灵感的选题池

选题池不是标题仓库,而是一张持续更新的任务表。建议至少记录以下字段:

字段示例
观众问题开会内容太多,怎样快速整理?
核心结论AI 适合做初稿和分类,不适合代替事实确认
证据来源产品说明、自己的演示、公开教程
内容形式60 秒口播+界面演示
风险点不上传敏感会议内容;人名和数据要复核
状态待研究 / 写稿中 / 已发布 / 待复盘
选题池示例
选题池示例

让 AI 生成选题时,要求它围绕“问题”而不是围绕“工具名称”。用户通常不是为了某个模型而来,他们是为了解决问题而来。

基于以下账号定位,生成 20 个可长期使用的选题,不追求当天热点。

定位:用 90 秒解释一个普通人当天就能尝试的 AI 工作方法,并说明适用场景、限制和检查步骤。

要求:
- 每个选题都从一个真实问题开始
- 标明适合口播、录屏还是图文
- 给出一句核心结论
- 给出需要核实的事实
- 排除夸张收益、神化 AI 和无法演示的内容
- 按“容易制作 / 需要准备 / 暂不建议”分组

从结果中挑选“容易制作”的主题。本案例选择:AI 为什么适合整理会议纪要。它有明确问题,有可演示过程,也有需要提醒的隐私边界。

四、先做资料卡,再让 AI 写稿

直接让模型“写一篇爆款脚本”,很容易得到一段正确但空泛的文字。解决办法是先建立资料卡,把事实、观点和限制分开。

将你已有的文章、产品说明或自己的操作记录放入 Kimi,使用下面的提示词:

请只根据我提供的材料,整理一张短视频资料卡。不要补充材料外的事实。

主题:AI 为什么适合整理会议纪要

请分成六部分:
1. 观众正在遇到的问题
2. 可以确定的事实
3. 适合 AI 完成的工作
4. 必须由人检查的工作
5. 隐私与使用边界
6. 可用于演示的三个步骤

每条事实后标记它来自哪份材料;无法确认的内容放入“待核实”,不要猜测。
Kimi 资料卡整理结果(示意)
Kimi 资料卡整理结果(示意)

一张合格的资料卡可能是这样的:

  • 问题:会议信息密度高,手工回看和分类耗时。
  • 适合 AI 的部分:把文字记录按议题分类,提取行动项,生成初版摘要。
  • 必须人工检查:负责人、截止时间、数字、否定词和决策结论。
  • 隐私边界:涉及公司机密、客户信息和个人敏感信息时,应遵守组织的数据规则,不把未经许可的原始资料上传到外部服务。
  • 演示步骤:准备脱敏文本;生成摘要和行动项;逐项对照原文。

这里最重要的不是让 AI 给出更多内容,而是让它明确“哪些不能确定”。可信的知识类内容,往往来自对边界的说明。

事实、观点与待核实
事实、观点与待核实

五、用三轮写作得到自然口播稿

三轮写作流程
三轮写作流程

第一轮:只写结构

根据资料卡,为 60~90 秒短视频设计结构。

要求:
- 前 3 秒提出具体痛点,不制造焦虑
- 正文只讲一个核心结论
- 用“三步法”演示
- 必须包含一个限制提醒
- 结尾给出可执行动作,不喊空泛口号
- 先只输出结构和每段目标,不写完整文案

合理结构通常是:痛点 8 秒、结论 10 秒、三步演示 45 秒、边界提醒 12 秒、结尾 5 秒。

第二轮:扩写成口播稿

把上述结构扩写成口播稿。

写作规则:
- 每句话尽量不超过 22 个汉字
- 多用具体动词,少用“赋能、颠覆、革命性”等抽象词
- 不声称 AI 能保证准确
- 术语第一次出现时,用普通话解释
- 总字数控制在 260~330 字
- 在需要显示画面的地方,用【画面】标注
可复制的脚本提示词卡
可复制的脚本提示词卡

第三轮:用豆包做“朗读检查”

请把下面的口播稿改得更像真实的人说话。

要求:
- 保留事实和结构
- 删除重复、套话和书面连接词
- 把连续三个以上长句拆开
- 不使用夸张词
- 标出最可能读不顺的三句话,并给出替换版本

下面是一版可以直接录制的成稿示例:

开完一小时的会,最累的往往不是讨论,而是整理。谁负责什么、什么时候交、哪些只是建议,混在几十页记录里,很容易漏掉。AI 适合做的不是替你决定,而是先把杂乱信息整理成初稿。

>

第一步,准备一份已经脱敏的会议文字记录。【画面:删除姓名、客户信息和内部数据】

>

第二步,让 AI 按“结论、行动项、负责人、截止时间、待确认问题”分类。【画面:五列表格逐项出现】

>

第三步,对照原文检查。数字、人名、日期、否定词和最终决定,一项都不要跳过。【画面:原文与摘要左右对照】

>

这样做省下的是整理时间,不是判断责任。涉及敏感资料时,还要遵守公司规则。你可以先拿一段虚构记录试一次,看看 AI 的初稿能不能减少重复劳动。

这段稿件没有“震惊”“效率提升十倍”等承诺,但它给出了完整动作,也说明了限制,更容易建立长期信任。

成稿重点句
成稿重点句

六、标题与封面:只承诺正文真正交付的东西

标题的作用是让正确的人点进来,不是把所有人骗进来。让 AI 同时给出不同强度的版本,再由你选择。

围绕这篇口播稿,生成 12 个短视频标题。

分为三组:
A. 问题型:直接说观众的困难
B. 方法型:说明能学到什么
C. 反常识型:指出 AI 不应该做什么

限制:
- 不超过 20 个汉字
- 不使用“必看、封神、逆天、秒杀、稳赚”等词
- 标题承诺必须能在 90 秒正文中兑现
- 每个标题附一句适合的封面短句,封面不超过 10 个字

可选标题:

  • 《会议纪要别让 AI 直接交稿》
  • 《用 AI 整理会议,只做这三步》
  • 《AI 能写纪要,但这五项必须人查》
标题三组法
标题三组法

封面只保留一层信息,例如“纪要三步法”或“这五项必须复核”。不要把完整标题、工具 Logo、十个卖点全部塞进一张图。

封面减法示例
封面减法示例

七、把口播稿拆成 8 个镜头

图片生成的难点不是“写一个很长的提示词”,而是保持每个镜头的视觉逻辑。先让 AI 输出镜头表,再进入即梦生成素材。

镜头时长画面任务素材方式
14 秒开会结束,桌面堆满记录AI 图片或实拍
26 秒多页文字快速滚动录屏或示意动画
38 秒“AI 先整理初稿”核心结论字幕卡片
410 秒对文本做脱敏录屏演示
512 秒五列表格生成录屏演示
612 秒原文与摘要左右核对分屏画面
710 秒隐私与人工检查提醒信息卡片
86 秒三步流程总结结束卡
八镜头表
八镜头表

用于首镜头的即梦提示词示例:

现代办公室会议结束后的场景,桌面有笔记本电脑、便签纸和会议记录,人物只出现手部,不出现清晰人脸,画面干净克制,真实摄影风格,柔和自然光,蓝灰色调,竖屏 9:16,上方预留标题区域,无文字,无品牌标识
即梦生成界面(示意)
即梦生成界面(示意)

用于流程卡的提示词示例:

极简信息图,三步流程:脱敏记录、AI 分类、人工核对,白色背景,深蓝线条,统一圆角卡片,图标简洁,竖屏 9:16,留出中文排版空间,画面中不要生成文字

生成画面时,先固定五个变量:主体、场景、光线、构图、比例。风格词不要每张都换,否则同一条视频像由五个不同账号拼起来。正文中的中文字建议在剪映里后加,而不是依赖图片模型直接生成。

统一风格九宫格
统一风格九宫格

八、剪辑时只做四件事

新手最容易在剪辑软件里消耗大量时间:尝试几十种转场、频繁换字体、为每一句话加特效。知识类视频更需要清晰,而不是热闹。

  1. 先放口播或配音。 按声音确定总时长和停顿。
  2. 再放证明画面。 说到“脱敏”时就展示脱敏,说到“核对”时就展示对照。
  3. 生成字幕后逐句检查。 人名、产品名、数字和标点最容易出错。
  4. 最后才加音乐。 音乐不能盖住人声,不要让转场音效打断理解。
剪映时间线(示意)
剪映时间线(示意)

剪映官方当前将 AI 成片、AI 图片设计、AI 配音和多轨编辑作为一体化能力提供,但具体功能可能随版本、设备和账号变化。对本流程来说,最关键的仍是基础剪辑、字幕校对和稳定导出。

字幕错误修正
字幕错误修正
效率变化示意
效率变化示意

九、发布前必须过一遍“七项人工闸门”

在导出前暂停五分钟,比发布后删稿更省时间。

□ 标题是否准确反映正文?
□ 事实是否能追溯到材料或亲自演示?
□ 人名、数字、日期、否定词是否核对?
□ 是否删除了敏感信息和无授权素材?
□ 画面是否与口播同步,而不是只做装饰?
□ 是否存在夸张承诺或绝对化表达?
□ 观众看完是否知道下一步怎么做?

还可以让模型做一次反向审稿:

你现在是严格的内容审核编辑。请检查这篇脚本,不要帮我润色,只指出问题。

按以下分类输出:
1. 无法从材料证明的事实
2. 可能被误解为效果保证的句子
3. 隐私、版权或合规风险
4. 标题与正文不一致之处
5. 观众可能听不懂的术语
6. 必须由作者亲自确认的内容

每个问题都引用原句,并给出最小修改建议。

十、把发布数据变成下一条内容的输入

不要只看播放量。第一批内容更值得观察的是:前几秒是否留住人、观众在哪里退出、评论里反复追问什么、收藏是否高于点赞。评论中的真实问题,可以直接进入下一轮选题池。

发布复盘闭环
发布复盘闭环
graph LR
    A[发布] --> B[记录数据]
    B --> C[整理评论问题]
    C --> D[找出掉线位置]
    D --> E[更新标题/结构规则]
    E --> F[制作下一条]
    F --> A

建议每条内容记录四句话:

  • 这条内容最想解决什么问题?
  • 哪一句最能留住观众?
  • 哪一段最容易让人离开?
  • 下一条只改一个什么变量?

一次只改一个变量,例如只改开头,或只改封面。若标题、时长、画面、音乐和表达同时改变,就无法判断是哪项带来了结果。

十一、可直接收藏的 12 个提示词

1. 选题去重

比较以下 30 个选题,合并表达相同的问题。保留差异最大的版本,并说明它与其他版本的区别。最终只保留 10 个。

2. 事实与观点分离

把材料拆成“可验证事实、作者观点、合理推测、无法确认”四栏。不要把推测写成事实。

3. 找反例

针对我的核心结论,给出三个不适用的场景。若结论过度概括,请改成更准确的版本。

4. 三秒开头

为同一主题写 8 个三秒开头:问题型、结果型、错误示范型、场景型各 2 个。不得制造焦虑。

5. 口播压缩

在不删除关键事实和限制提醒的前提下,把稿件压缩 25%。优先删除重复和抽象套话。

6. 术语翻译

找出稿件中普通职场用户可能不懂的术语。每个术语改成一句日常语言,不能牺牲准确性。

7. 镜头表

把口播稿拆成 8~10 个镜头。每个镜头写:时长、口播句、画面目的、素材类型、屏幕文字。

8. 图片提示词

根据镜头表生成中文图片提示词。所有镜头保持同一色调、光线和构图语言,不在图片中生成文字。

9. 字幕断句

把口播稿改成字幕格式。每行 8~16 个汉字,按语义断句,不改变原意。

10. 标题兑现检查

检查标题承诺是否在正文中完整兑现。若没有,优先降低标题承诺,而不是硬塞内容。

11. 风险检查

检查稿件中的绝对化表达、效果保证、未经授权素材、敏感信息和可能误导的省略条件。

12. 评论转选题

把以下评论按“不会操作、担心风险、想看案例、质疑效果、进阶需求”分类,并生成下一批选题。

十二、新手最常见的十个问题

1. 为什么 AI 写出来一眼就像 AI?

通常不是模型能力不够,而是提示词没有真实材料,也没有限定受众。先提供资料卡、自己的观点和禁用表达,再做口语化改写。

2. 免费工具够不够?

够跑通流程,但不一定适合高频批量生产。免费额度、排队和功能会变化,所以前期重点是验证内容形式,而不是追求每天大量生成。

3. 一条视频需要多少张图?

60~90 秒的知识类视频,通常 8~12 个有效画面已经足够。有效画面是能解释当前句子的画面,不是单纯增加变化。

4. 可以完全不用真人声音吗?

可以使用工具提供的配音,但要检查读音、停顿、授权范围和平台要求。个人表达型账号通常保留自己的声音更容易形成辨识度。

5. AI 生成的内容能直接发布吗?

不建议。至少要完成事实、隐私、版权、标题兑现和字幕五项检查。

6. 为什么生成图片风格不统一?

因为每张图都更换了风格词和构图。固定色调、光线、镜头距离、比例和主体描述,再逐张微调动作。

7. 要不要同时做很多平台?

先选一个主平台跑通十条内容,再根据平台比例和用户习惯做改版。直接复制同一版本到所有平台,往往无法看清问题。

8. 要不要每天追热点?

不必。稳定账号通常需要“常青问题+少量热点”。只有热点而没有栏目,内容很难积累。

9. 怎样判断一个选题值得做?

它应同时满足:受众真的会问、你能提供具体动作、有材料可核实、能在目标时长讲清楚。

10. 多久能看到结果?

没有固定答案。前十到三十条内容更像测试期,目标是找到稳定栏目、表达方式和制作节奏,而不是依赖某一条突然获得大量播放。

十三、这套免费流程的真实成本

软件费用可以接近零,但时间不是零。第一次制作可能需要两到三小时,因为你在建立模板;当账号定位、提示词、字幕样式和素材目录固定以后,单条内容才可能压缩到几十分钟。

建议使用下面的目录保存项目:

AI-media/
├── 00-account-positioning/
├── 01-topic-pool/
├── 02-sources/
├── 03-script/
├── 04-images/
├── 05-video-clips/
├── 06-edit-project/
└── 07-published-and-review/

文件名也要统一,例如:

2026-07-20_meeting-notes_v01_source.md
2026-07-20_meeting-notes_v03_script.md
2026-07-20_meeting-notes_cover_02.png

看起来只是整理习惯,却能避免“最终版、最终版2、最终真的版”这种常见混乱。

结语:先完成第一条,再谈自动化

国产免费工具已经能覆盖资料整理、中文写作、图片、短镜头、配音和剪辑。它们最适合帮助你验证三件事:你准备讲什么、观众是否愿意看、你能否稳定完成。

第一阶段不要追求无人值守,也不要把所有工作交给同一个对话框。把流程跑通,保留人工判断,记录每次修改。等你能稳定发布,并且明确知道时间消耗在哪个环节,再进入下一篇的专业版路线:用 API、结构化数据和 n8n,把复制粘贴变成可控的自动化。

资料核对说明

本文涉及的产品能力通过以下官方页面复核。功能、免费额度和服务范围可能随账号、地区与版本调整,使用时应以实际账号页面和最新服务条款为准。