先说结论:让 AI 给一个物品出三视图,最土的办法,往往最灵。
那时候 AI 模型还没法直接生成多视角,电商卖家想要一张玩偶的背面图,要么重新生成撞运气,要么手动 P。我试了一圈,最后发现的办法蠢得可爱——让玩偶在视频里自己转一圈。
思路是这样的
AI 视频模型能理解「物体在旋转」这个动作。你给一张玩偶正面图,提示词写「让它在原地缓慢旋转一圈」,模型就会自己脑补出侧脸、后脑勺、屁股。
然后我做了一件更蠢的事:把视频暂停在几个关键帧上。
- 第 0 秒 —— 正面
- 第 1 秒 —— 侧面
- 第 2 秒 —— 背面
把三帧截图摆在一起,一张「AI 三视图」就成了。买家想看哪个角度,都有。
为什么这条思路值得记
因为它解决的是真问题:不是「能不能生成」,而是「生成的东西能不能商用」。
技术圈最容易犯的错,是把「新功能」当成「新价值」。模型发布会天天更新,但电商需要多视角图这个需求,从三年前到现在没变过。工具一直在换,痛点一直没换。
后来的事
现在大模型一句话就能出三视图了,我的方法也过时了。但那次实验教会我一件事:
工具会过期,思路不会。你研究的是「这个按钮怎么按」,那确实活不过半年;你研究的是「用户到底卡在哪」,那活很久。
所以我现在的习惯是:拿到一个新工具,先不想它能做什么,先想用户哪件事还做不成。工具永远在追问题,而问题是排队的。
对了,这套流程的完整演示视频放在影像栏目,想看实操的可以去翻。