演示假设基于预设评测数据与专家规则生成,非实时模型调用
01 · 选择评测案例
视频前期演示假设
02 · 控制变量实验

固定提示词与业务上下文

唯一变量:模型

固定提示词

生成 15 秒竖屏短视频脚本,按 0–3秒、3–8秒、8–12秒、12–15秒拆分,每段包含画面、镜头、字幕、旁白和声音提示。仅使用产品事实,不得生成医疗宣称。

业务上下文

  • 敏感肌修护面霜
  • 抖音信息流
  • 前 3 秒建立换季泛红共鸣

控制变量

  • 相同产品资料、时长、平台规范和输出表格
  • 同一导演与品牌 rubric 盲评
03 · 人工评审

模型对比研究

模型任务匹配输出质量业务适配可控性效率综合分风险
Claudeclaude-4-family-demo-snapshot949694917893.3需要人工审核
Qwenqwen3-family-demo-snapshot918892929690.9需要人工审核
候选 02

Claude

93.3
任务匹配94输出质量96业务适配94可控性91效率78

优势 叙事与情绪表达

限制 个别脚本需压缩到严格时长

需要人工审核
候选 03

Qwen

90.9
任务匹配91输出质量88业务适配92可控性92效率96

优势 短视频语感与批量效率

限制 创意差异化稍弱

需要人工审核