
Astra+Blender+AI视频生成
拉开了AGI时代的大幕一角
自从ChatGPT-6 Astra更新,社交平台就被它调用Blender建模的测试刷屏了。
各路玩家用它搭建江南园林、做3D小游戏、生成《我的世界》,甚至操控机械臂削黄瓜皮、通关羊了个羊……
玩法花样之多,已经超越了OpenAI的官方宣传片。造个小火箭然后3D打印出来算什么?中国人能飞!

其实从官方宣传片能看出来,GPT-6把模型亮点放在语音对话功能上。大幅提高的多线程复杂信息处理能力、上下文记忆力,让每个会提问的用户都能拥有自己的贾维斯。
那为什么,国内外用户纷纷把重点放在AI建模上?大概因为,这既是Astra功能里距离普通人生活较远的专业领域,又能直观看到生成结果,每个路人都能点评一两句。
当AI能跨过专业门槛,让每个普通人张嘴说话就能做出一位3D建模师十年积累才能做到的成果,才意味着“AI普遍优于人类”的AGI时代真的到来了。
但,GPT-6 Astra真的有网上吹得这么神吗?
真正从叙事类作品应用的角度,上手实测Astra调用Blender建模、渲染,调用Seedance 2.5生成AI视频之后,我可能要先给大家泼一小盆冷水。

Astra调用Blender建模,某些基础工作效率十倍提高,但在真正商业级项目应用上,还差得很远。
首先声明,为了保证整个测试的真实性,我按照ChatGPT-6的建议,全程使用Astra中级模型、语音输入对话,显卡采用5090D,非必要不进行任何手动修改。
出于“越真实越难做”的AI标准,我想做一个影视项目里常见的写实级卧室,房间里需要包括床、地板、桌椅、电脑、衣柜、空调、窗户等基础设施。
Astra直接给我生成了一张写实卧室设计图,作为后面的建模参考。


这张图看起来挺温馨也挺写实,简直能拿到小红书发家居博主roomtour,但仔细看会发现墙面都是倾斜的。
我让Astra反复调整了几版4米*4米的房间结构俯视、侧视图,得到比较理想的一张卧室布局参考图。


就用这张图让它开始在Blender里建模,包括完整卧室、各组家具的白模与上材质,卧室不同角度的渲染图等,先不做精细光线。
我提前专门问了后期朋友,这些事情拿给一位普通基础建模师来操作,大约需要18-30小时。听完我还觉得,Astra建模再快也得3-4个小时吧,要不出门吃个饭先?
结果东西还没收完,Astra就语音喊我,说她做完了。
做完了????总用时,21分钟50秒。

每一个家具都单独制作,留存了白模与添加材质效果,严丝合缝地组成了一个标配卧室场景。
就算一位基础建模师使用Blender里已经有的家具资产摆成一个房间,调整细节、摆放位置,至少也需要两个小时。
注意,这些各个阶段的截图,也都是Astra帮我做的。
这一切,只需要跟她说一句话。


当然,仔细看就会发现,Astra用21分钟做出来这版不够精细写实。
这因为她是通过Blender插件在后台用脚本建模的,不是computer use,所以许多家具太流水线、枕头出现穿摸、床品也有种塑胶感,达不到使用标准。

接着我想到,既然真实建模师都会利用Blender已有资产,那让Astra站在前人的肩膀上、选择更具真实感的家具资产,来拼一个符合我要求的卧室建模呢?
她说她能做,只需要安装一个插件。

这样做出来的新版确实效果好多了,没有任何穿模,肉眼可见的家具材质都是准确的。
调用资产建模的速度更快,这次她只用了9分18秒,就建好了整个房间。


我仔细检查之后发现几个小问题,一个是吸顶灯资产没有替换,再一个是现在同开室内光与自然光,导致AI在Blender里渲染出来的图片出现了不合理的硬边缘光。
我还是语音输入要求Astra对应修改,她表示完全理解了我的要求。

看下面这两张完全修改后的直出渲染图,是不是已经真实到分辨不出是3D建模还是实拍效果了?
除了电脑显示屏上我没让她放东西之外,这几乎完全是某连锁租房软件的实拍展示图。


这是今天全部功能测试里最让我惊喜的部分,GPT-6真正理解了什么叫“真实感的东西”。
完全不需要我在一堆候选资产里帮她挑出来哪个更好,理解力已经从普通员工跨越到社会化程度更高的优秀员工,这才是真有点AGI时代的味道。
常做3D建模的老师傅都知道,静态建筑、道具建模不算难,给有生命物体做骨骼绑定、材质,才是技术水平的分界线。
我们FoST做测试也不纯为了蹭新模型热度,更重要是看一个新技术在叙事类项目实际应用中能起到的作用。
所以成功组建了卧室3D模型之后,我想再做一只动物小猫咪,通过猫咪的运动轨迹配合Blender的运镜功能,做一段预演视频。
Astra同样导入了一只Blender里自带骨骼绑定的写实猫咪资产,导入到前面建好的卧室场景里,看起来还挺像那么回事:

我还让她帮我调整了猫咪的眨眼效果,把原本“两只眼睛都绑在同一根头部骨骼”的模板,改成“跟随头部但各自围绕眼球中心转动”。
我手动测试了一下,新版猫咪两只眼球都能独立转动,近景更自然。


我接着让她控制猫咪做一段角色动画,先从地面转身,然后蓄力跳上床、落地走两步,最后趴在枕头边。
这段动画能充分测试Astra调用Blender建模动物的肢体可控性、物理规律。看成片:

诡异感直接拉满……可以说我想测试的目标全部失败:
实操中,猫咪先是围绕后腿做轴心运动,然后直戳戳弹射上床,进行深一脚浅一脚磕巴移动,最后两条后腿骨骼像翅膀一样包住臀部,cos小蝴蝶。
我已困惑我已呆滞,甚至想喊一声牛来。

当然,这也可能是AI仍采用脚本控制来生成动画的原因。只有实测才会发现,3D大神们真正应用层的手艺活,AI至少现在还不能替代。
没有办法,我只能上网找了段大神已经做好绑定、自带走路动画的虎斑猫Blender工程文件,扔给Astra进行替换。

她干活速度是快的,替换导入4分54秒,做成俯视视角的跟随动画v1耗时10分钟6秒,行走效果至少没那么僵硬了。

这版猫咪转身还是太假,我告诉Astra“不想要猫咪转弯时哗一下整个身体摆过去”,希望更灵活自然一点。
但她好像在动画制作理解力上格外降智,新版v2把所有猫咪转弯都处理成了慢动作😓

我再让她修改,要求猫咪转弯和平时步频保持一致,调整腿部转弯动作让它更自然。
下面是她修改后的v3⬇️ 看起来好像还不错对吧?小猫咪步频、步幅都很自然。
但你仔细看,转弯时猫咪后腿都穿模了😠

最后没有办法,只能回归原始技术,用手K修改猫咪转弯时的腿部动作。
为了规避猫咪多次转弯的后腿穿模,也是想充分展现整个AI建模的卧室空间,我手K一段用语言比较难以描述的30秒一镜到底式运镜,包括推拉摇移、跟随、环绕、低机位视角等,制作这段最终版白模运镜。

白模动画都出来了,我想进一步试试Blender这种工具使用电脑渲染出来的效果,和AI使用白模参考生成的视频效果对比。
我让Astra自己设定了渲染设置,规定一张图片渲染时长不超过2分钟,最终16个小时渲染完成了一个高精度720P的序列。
但视频噪点比较明显,我问她解决方案,她尝试了几次调整渲染参数,效果都很一般,直接扭头给我做了一个脚本用于给序列帧降噪。看看降噪前后的视频效果对比:

想要这个降噪工具的朋友们欢迎关注FoST未来叙事并留言,可以免费分享。
我把FoST的LOGO扔给Astra,让她按照已经确定的卧室建模帮我生成了几张不同角度的幻想未来赛博朋克风卧室图,与一张布偶猫资产图。

然后就完全不需要我管了,Astra自己调用即梦CLI,新建画布、导入图片素材与上面的30秒白模运镜视频、写提示词,用Seedance 2.5生成了一段1:1的30秒视频。
这个过程,只用了10分钟。

现在再来看一遍开头的三段视频对比,上方为白模视频,中间是渲染了16个小时的写实感虎斑猫视频,下方为同参考的10分钟AI生成视频。
在复杂运镜的解决方案上,Astra+Blender+AI视频生成的效率,确实已经吊打了传统制作流程。
当然,整个语音输入+3D建模的测试,token消耗非常恐怖。即便我已经使用了压缩上下文再新开对话等邪修省积分方式,GPT-6 Pro版积分额度也基本见底。
最后还剩一点额度,我很好奇,如果“一张图片转白模”功能,放在更复杂的人类角色身上呢?
我给了Astra一组真人三视图,让她转成适用于3D建模的大头Q版角色。经过简单调整,下面出来的效果还算不错。

结果导入Blender建模之后,她给我的结果是这样的…………

这是啥呀这是!!!!!
我又让她修改了一版,出来的效果仍然是:

麻了,朋友们,麻了😵
充分说明,让AI用Blender脚本生成需要雕刻的几何体,必然是不可能的。
总体测试下来的结论是:
1.GPT-6 Astra在建筑、道具等静物3D建模上有奇效,配合Blender资产库,可以帮助建模师节省大量重复性基础工作的时间;
2.但在动植物、人类等有生命物体的3D建模、动画制作中,AI暂时无法理解精细制作,远远比不上资深建模师的技术;
3.用Astra建白模+AI视频生成,或许能在世界模型问题被攻克之前,成为解决AI视频创作空间关系难题的一大有用解法。
最后说几句,不得不承认的是,随着AI技术的飞跃式发展,平面设计师、室内设计师、基础3D建模师等岗位一个个遭受冲击,职业危机比AI提效来得更快一步。
虽然我们都会说,资深专家不用担心AI冲击、AI代替不了人的审美与创意。但哪个专家是天上掉下来的呢?如果没有前期长达数年的基础工作积累,没有人能从小白变成资深。
更严峻的是现实问题,影视寒冬、项目减产、AI冲击,一位后期朋友所在公司已经五个月没发工资了,现在几乎全体员工都在和老板打官司。他说:
那些一宿一宿熬过的加班费我都不要了,就想拿回基础工资,这很过分吗?
我没办法回答这个问题,只希望技术的飞速进步能和一线打工人的付出之间,能找到一个彼此包容的平衡线吧。
文章来自于"FoST未来叙事",作者 "子路"。
【开源免费】LGM是一个AI建模的项目,它可以将你上传的平面图片,变成一个3D的模型。
项目地址:https://github.com/3DTopia/LGM?tab=readme-ov-file
在线使用:https://replicate.com/camenduru/lgm
【开源免费】LangGPT 是一个通过结构化和模板化的方法,编写高质量的AI提示词的开源项目。它可以让任何非专业的用户轻松创建高水平的提示词,进而高质量的帮助用户通过AI解决问题。
项目地址:https://github.com/langgptai/LangGPT/blob/main/README_zh.md
在线使用:https://kimi.moonshot.cn/kimiplus/conpg00t7lagbbsfqkq0