从船向海岸推进,到箱子跨过两辆行驶的卡车,我想试试:先用代码排清位置、路线和事件,再让 AI 重建外观。这篇教程整理了实际输入、生成结果,以及仍然没解决的偏差。

我最初只是想做一个十秒左右的海岛登陆镜头:军舰与登陆艇向岸边推进,飞机从上方经过,攻击岛上的目标。后来,实验扩展到递箱、追火车、太空对接和传送门。越往下做,我越发现,画面看起来漂亮,与事情发生得合理,是两项不同的要求。

这篇文章围绕一个问题展开:怎样把脑中的镜头变成明确的参考,让 AI 有空间设计外观,也能读懂必须保留的动作关系?

前半篇讲做法与检查方法,后半篇按控制难点组织十个案例,附白模、外观参考和完整提示词。逐轮重试、费用和抽样记录留在补充资料中。这里展示的是截至2026年10月11日的实验样本,包含改善,也包含尚未解决的失败。