Original post by @zhu185178 · View on X ↗
The original recipe
From the creator1,058 chars
帮我做一条 30 秒的 2D 动画分镜预演短片《雨站》,要标杆级画质。不装 HyperFrames/Remotion,全部自己写代码(Python + ffmpeg)完成。 故事(24fps,2.39:1,4K):雨夜高架站台。她穿米色风衣、撑透明伞,站在近侧站台;对面路灯下站着他,穿深灰长大衣、围围巾。 1. 0–6.4s 透明伞雨珠特写 → 后拉,焦点移到对面露出他(过肩镜头) 2. 6.4–9.4s 他的中近景:低头 → 抬头看向画左 3. 9.4–12.4s 她的正面近景:眨眼 → 认出他;远处传来鸣笛 4. 12.4–17s 远景:车头灯光先到,5 节列车驶过;第一个车厢缝隙里他还在,第二个已经空了 5. 17–18.8s 她含泪的近景,车窗光带扫过她的脸,头发被风吹起 6. 18.8–22.4s 尾灯远去,对面站台空了;他那盏灯闪几下后熄灭 7. 22.4–28.6s 她的背影,焦点从空站台拉回她;身后脚步声,一把黑伞遮到她头顶,她回头看向镜头;男声“好久不见。”,配字幕 8. 28.6–30s 黑场片名“雨站 / RAIN STATION” 做法: - 原画:用GPT Image 2.5 画远景、他、她、列车(头车/中车/尾车)。人物一律用纯绿 #00FF00 背景,自己抠像(带参考图要透明背景会得到假棋盘格)。同一角色的各个姿态放在同一个会话里,以基准图为参考连续编辑;换姿态时只合成变化的区域。 - 画质:用 Real-ESRGAN x4plus anime 6B(HF 上的 safetensors 版,自己写 RRDBNet,跑在 MPS 上)把全部原画放大 4 倍;用 Depth Anything V2 估算远景深度,做逐像素视差。 - 渲染:自己写 2.5D 合成器。各层按真实深度摆放,针孔相机按真实焦距运动;做圆形焦外光斑、焦点转移、3D 雨丝、列车运动模糊、体积光、泛光和胶片光晕、细颗粒、调色。人物用网格变形做呼吸、风吹发梢、伞抖,关键姿态按日式“一拍二”切换。4K 超采样,逐帧缓存到磁盘,分 3 个进程按时间段并行(16GB 内存)。 - 声音:Mixkit 真实音效(雨、伞面雨声、列车、鸣笛、脚步);按剧情节点写谱,用 Logic/GarageBand 自带的施坦威钢琴和弦乐采样渲染;台词用 Kokoro 中文男声;按镜头做声音远近,响度 -16 LUFS。 - 每一步都渲染预览帧、拼成图自检,修好再出片。交付 4K 母版和 1080p 分享版。
Verified: this exact prompt appears in the creator's post or reply on X.





