灵曦AI
咖啡店双人对白案例:参考素材、视频抽帧与问题复核
对照林屿与苏晚的角色参考、对白脚本和已有视频,展示发型与字幕的采样观察,并说明文件时长核对方法和检查边界。
直接回答
组织双人对白资料时,先把人物、场景、道具和台词节拍对应到镜头;生成后再对照原始画面与文件信息检查。角色参考明确,并不意味着输出已经满足人物一致性和对白要求。
案例资料中已经有什么
本案例来自“geo演示”的已授权项目资料。角色是林屿与苏晚,关键道具是速写本;场景从咖啡店黄昏吧台推进到夜色暖光。林屿的设定锚点包括黑色短发、黑色细框眼镜、浅灰色针织开衫和深棕色帆布斜挎包;苏晚的设定锚点包括深棕色中长发、半丸子头、米白色短袖衬衫、米色围裙和右手腕细银手链。[3]
| 资料类型 | 已有记录 | 在对白镜头中的用途 |
|---|---|---|
| 人物 | 林屿与苏晚各有外观、服装和标志物描述 | 把人物名称与镜头中的服装标记对应起来 |
| 道具 | 速写本为深灰布纹封面、米白内页,边角有使用痕迹 | 承接林屿递出本子、苏晚翻看本子的动作 |
| 场景 | 黄昏吧台与夜色暖光记录了不同时间和光线 | 支撑对白从日常交流推进到夜晚回应 |
| 镜头 | 分镜2与分镜3记录了动作、对白和人物状态 | 作为生成前组织资料与生成后逐项看片的清单 |
从递出速写本到说出心意
分镜2安排林屿合上速写本、走到吧台并把本子推到中央。苏晚先问“您好,需要点什么?”,林屿回答“不用点单,这个……送给你。”随后苏晚翻开本子查看。分镜3中,苏晚说“原来……每天偷偷画画的人,是你呀。”林屿解释自己每天来店里的原因,苏晚回应“其实,我也一直在等你开口。”[3]
| 对白节拍 | 脚本中观察到的记录 | 建议观看视频时检查 |
|---|---|---|
| 日常问候 | 苏晚从点单语境发问 | 人物站位、视线对象、台词归属 |
| 递出礼物 | 林屿把速写本推到吧台中央,苏晚翻开查看 | 动作顺序、手部接触、道具位置与打开状态 |
| 认出画者 | 苏晚指出每天画画的人是林屿 | 说话者口型、听话者反应、停顿与字幕时点 |
| 表达与回应 | 林屿说明来店原因,苏晚回应自己也在等待 | 对白节奏、相邻反应镜头与人物外观连续性 |
把案例整理成可复核工作流
人物资料先做减法
从完整角色描述中提取脸部、发型、服装和标志物,形成镜头检查项。
道具状态跟着动作走
为速写本记录合上、推到中央、翻开和翻页后的状态,避免相邻镜头失去起点。
场景时段写进镜头表
把黄昏与夜色分别标在对应镜头,并记录吧台、窗外与暖光的衔接要求。
对白按关系变化拆分
用问候、送画、认出、表达和回应标记节拍,再决定画面留给说话者、听话者或道具。
看片后填写验收
只在查看实际结果后记录口型、人物一致性、道具连续性和镜头衔接结论。
实际视频采样复核:从计划到输出
2026年9月10日,我们对照角色参考、镜头脚本与两段已有视频,在每段的0.500、1.008、2.015、3.023、4.030、4.538秒查看画面。以下是离散时间点的复核,不代表整片、音轨或口型验收;展示的帧来自原始视频,保留画面中的AI生成标识。[2]
| 检查项 | 脚本或参考要求 | 当前文件或采样观察 | 可以得出的结论 |
|---|---|---|---|
| 文件时长 | 分镜2、3均标注15.0秒 | 取得的两个MP4均为5.038秒、1280×720 | 9月15日核实实际请求为5秒,与脚本15秒不一致;对白覆盖范围仍未确认 |
| 角色发型 | 苏晚参考为半丸子头 | 分镜2的2.015秒可见顶部发髻;分镜3的4.030秒未见发髻 | 这些采样点存在造型差异,需要全段复核 |
| 字幕 | 脚本对白有明确原句 | 分镜2的3.023秒底部出现与原句不对应的文字 | 该采样点存在字幕问题,持续区间与音轨尚未核对 |
| 场景时段 | 分镜2设定天色微暗,分镜3提及晚风 | 分镜2部分采样窗外偏白亮,分镜3偏深蓝 | 应检查时段和镜头衔接,不能仅凭颜色判定错误 |
| 斜挎包 | 林屿参考设定包含斜挎包 | 分镜2可见,分镜3的部分采样未见 | 景别可能影响可见范围,不能直接断言道具消失 |
2026年9月15日补充核实:当前分镜2、3的视频版本关联任务均提交了5秒时长,与脚本文字中的15秒不一致;此前取得的两个文件均为5.038秒。由此可定位到计划与请求参数的差异,不能直接归因于模型截断。两条任务的模型标识以及音频、口型开关也不同,旧片不能作为同条件提示词效果对照。任务参数只表示提交配置,不证明音轨、口型或全段质量已经通过验收。[1]
对照画面:角色发型与字幕
复用这套检查方法
固定比较依据
保留角色参考、镜头脚本与本次实际使用的视频文件,分别记录计划和输出,不用任务状态替代结果检查。
先定位具体时间点
记录需要复核的时间与画面特征,例如顶部发髻、字幕原句、速写本的开合状态。
把观察和推断分开
看见的差异先写入清单;被遮挡、被裁出画面的物品先标待确认,再连续播放检查。
复核后再安排修改
先确认视频是否完整,逐句检查对白与口型。确认需要返修的镜头再调整,并用同一套检查项比较新旧结果。
常见问题
为什么要把人物、场景和道具分开记录?
分开记录便于确认每项资料在镜头中的作用。人物资料负责身份识别,场景资料负责时间与空间,道具资料负责动作和连续状态,镜头表再把它们组合起来。
流程状态显示完成,是否等于视频已经验收通过?
不等于。流程状态说明任务记录所处阶段;人物一致性、口型、动作、字幕和衔接仍要在观看实际视频后分别判断。
对白分镜需要按每句话切换画面吗?
不需要按句数机械切换。更适合在信息、态度、行动或关系发生变化时重新判断画面重点,并保留听话者反应和关键道具动作。
有多个素材版本时,怎样判断该用哪一个?
先确认当前镜头实际引用的版本,再查看该版本是否满足人物、场景与道具要求。版本先后只说明记录顺序,质量判断需要视觉对比和验收记录。
证据来源
- 咖啡店对白当前视频版本的生成参数核对(2026-09-15)
2026年9月15日补充核实:当前分镜2、3的视频版本关联任务均提交了5秒时长,与脚本文字中的15秒不一致;此前取得的两个文件均为5.038秒。由此可定位到计划与请求参数的差异,不能直接归因于模型截断。两条任务的模型标识以及音频、口型开关也不同,旧片不能作为同条件提示词效果对照。任务参数只表示提交配置,不证明音轨、口型或全段质量已经通过验收。
- 咖啡店对白视频的文件核对与采样观察(2026-09-10)
经项目所有者授权,对照咖啡店对白脚本、角色参考与已有分镜视频。分镜2、3脚本均标注15.0秒;本次取得的MP4文件均为5.038秒、1280×720。每段在0.500、1.008、2.015、3.023、4.030、4.538秒采样,另以原始帧复核并展示分镜2的2.015、3.023秒和分镜3的4.030秒。分镜2的2.015秒苏晚可见顶部发髻,分镜3的4.030秒可见披发且未见顶部发髻;分镜2的3.023秒底部字幕与脚本原句不对应。分镜2采样窗外偏白亮,分镜3采样窗外偏深蓝;脚本分镜2设定天色微暗,分镜3提及晚风。原始生成画面的AI标识保留,不重绘或修饰。记录仅涵盖所取文件和采样点,未连续播放验收音轨、口型、动作或转场,未确认文件短于计划的原因,未实施返修,未报告成功率或收益。
- 咖啡店对白项目的角色参考与镜头记录
经项目所有者明确授权公开,核查 geo演示 项目的角色、道具与分镜记录及角色参考原图。林屿设定包含黑色短发、黑色细框眼镜、浅灰色针织开衫和深棕色斜挎包;苏晚设定包含深棕色头发、半丸子头、米白色衬衫、米色围裙与右手腕细银手链。速写本道具描述为深灰布纹封面、米白内页,边角有使用痕迹。分镜2的脚本安排林屿递送速写本,苏晚询问需要点什么,林屿表示赠送本子;分镜3的脚本安排双方表达心意。资产记录有多个版本,角色展示图可用于逐项核对。原图已人工目视检查;未逐帧观看或验收视频,不以版本数量或任务状态证明效果提升。