
这个月,我基本是在高强度地用 GPT-6 Astra。
我让它操作软件、写东西、跑长任务,也专门接上 Hyper3D,丢给它一个我自己完全不会做的 3D 项目,看它能不能从一句很模糊的需求开始,自己找工具、做模型、拆部件、写网页,最后把东西真正交出来。

测到后面,我越来越有一个很强烈的感觉:
如果我们过去说的 AGI,是一种能够理解目标、调用工具,并且越来越独立地把工作做完的通用智能,那 GPT-6 可能已经踩进去了。
而我第一次产生这个感觉,其实是因为前两天刷到的一个帖子。
一个叫 Viper 的 Blender 艺术家,转发了 Duncan Trussell 用 GPT-6 Astra 做的一段演示。
Duncan 让 Astra 直接操作 Blender,做了一个完整的 Backrooms 场景。

里面不只是搭几个方块。
建模、灯光、VHS 质感,甚至声音都做了。
Duncan 自己说,整个过程大概用了 5 个 prompt,制作花了 30 分钟左右,最后又用了 20 分钟导出。
然后 Viper 看到了。
他原本一直觉得,自己这些年积累下来的 Blender 技能和艺术感觉,是机器很难替代的一层东西。
结果现在,他看着 Astra 在自己最熟悉的软件里,做出了一个自己可能要花几天完成的场景。
他的第一反应不是兴奋,而是愤怒。
他直接破防了,表示:这他妈像个恶作剧。

我其实很能理解这种感觉。
这几年大家已经看过太多 AI Demo 了。
生成图片、视频、代码,隔一阵就会出现一个看起来很吓人的新东西。
看多了以后,人其实会慢慢脱敏。
但这个 Demo 有一点不一样。
Astra 没有在聊天框里告诉一个 Blender 艺术家你应该怎么做,也不是生成一张看起来像 3D 的图片。
它真的打开了 Blender,进入那个艺术家每天工作的环境,然后开始干活。
看到这里,我第一次有一种很具体的感觉:
AI 已经不再只是坐在 Blender 艺术家旁边回答问题。
它开始坐到他的工位上了。
后来我又去找了很多 GPT-6 的案例。
越看越觉得,Blender 可能只是因为视觉效果最好,所以最容易在社交网络上传播。真正发生的事情,要比 AI 会做 3D 大得多。
比如 OpenAI 拿 Astra 跑过 2023 Microsoft Excel World Championship 的任务。
它不是在聊天框里告诉你 DCF 应该怎么算,也不是生成一段 Python 代码让你自己复制进去。Astra 直接进入 Excel,在人类平时工作的那个界面里完成金融建模。

官方给出的结果是,它完成这些任务的速度大约是当时人类冠军的 4 倍。
这件事听起来没有 Blender 那么震撼,甚至有点枯燥。
但仔细想想,很多工作本来就是这样。
分析数据、调整模型、核对数字、找报表之间的差异,没有任何科幻感,却是很多人每天坐在办公室里花几个小时完成的事情。
GPT-6 开始进入的,恰恰是这些最普通的工作。
再比如音乐。
音乐人 Auggie 只给 GPT-6 Astra 一个要求,让它使用 LilyPond 完成一首巴赫风格的作品。
没有一步一步告诉它旋律怎么写,也没有替它设计后面的结构。

Astra 在 Extra High 模式下持续工作,最后交出来的不是几小节旋律,而是一份完整、可以继续使用的乐谱文件。
真正困难的地方不只是生成几个听起来像巴赫的音符,而是要在更长的过程中保持前后的结构,把主题、声部和和声组织起来,最后交出一个可以真正播放的作品。
这和过去在 ChatGPT 里说一句帮我写首歌,已经不太是一回事了。
模型开始接住的,不只是一个问题,而是一段完整的创作过程。
再往硬件那边看,就更具体了。
一个叫 GoFly 的用户,直接把一块 FPV 无人机飞控板交给了 GPT-6 Astra。
它在 KiCad 里从原理图开始,一路做到六层 PCB,自己完成元器件摆放、布线,再跑 ERC 和 DRC 检查。

最后,它还导出了 Gerber、BOM、贴装坐标这些真正会交给工厂的生产文件。
整个过程跑了三个多小时。
更有意思的是,这个东西没有停留在一张看起来像电路板的图片上。
后来这块板真的通过了嘉立创审核并成功下单。
当然,最终能不能正常点亮还要等实物验证,但它至少已经走到了实际制造流程这一步。
把这三个案例放在一起看,事情就开始变得有点不一样了。
Excel、音乐、PCB,看起来横跨三个完全没有关系的行业,但 GPT-6 做的事情其实很相似:
它不再只是站在一个专业人士旁边告诉他应该怎么做,而是开始进入那些人真正工作的环境,把其中一段工作接过去。
看到这里,我也很想自己试一次。
但我不太想再测一遍 GPT-6 会不会操作 Blender。我更好奇的是另一个问题:
如果一个任务走到某一步,碰到了 GPT-6 自己并不具备的专业能力,它会怎么办?
毕竟一个真正的通用智能,也不可能自己掌握世界上所有专业技能。它会停在那里,还是知道应该去找一个更专业的工具,把任务继续做下去?
我决定挑一个自己也几乎完全不会的领域试试。
PART.01 让一个小白起飞
我最后选了 3D。
原因很简单,我基本不会。
对 3D 软件的全部印象,大概还停留在高中微机课上摸过几次 C4D,后来基本没再碰过。
现在让我自己从头建一个模型,和零基础没什么区别。
之前我倒是用过 Hyper3D Rodin 做过几个模型,甚至拿生成出来的东西去做过 3D 打印,所以至少知道最后应该得到一个什么样的东西。
这反而很适合拿来做实验。
我不需要判断 GPT-6 的建模手法专不专业,也不打算一步一步教它应该怎么做。
我只想给它一个最后的目标,看看它能不能自己把中间缺的能力补起来。
所以这次我干脆把要求压到最简单,像一个真的什么都不懂的小白一样,只告诉 GPT-6 我最后想要什么。
我给它的原话是:
帮我做一个可以拆开维修的火星探测车 3D 网页吧。
我不懂 3D,具体怎么设计、怎么拆、网页怎么玩你自己想,3D 模型用 Hyper3D MCP 来做,最后给我一个真的能玩的成品。

开始之前只需要做一件事,就是把 Hyper3D 接进 Codex。
这个过程比我想象得简单,在 Hyper3D 官网点开 MCP,把官方给的一段配置提示词直接丢给 Codex,它会自己完成配置,然后拉起浏览器做一次 OAuth 授权。

接好以后,我就基本不管了。
这也是这次测试里我刻意保留的部分。
我没有告诉它火星车应该长什么样,没有规定要拆成几个零件,也没有设计什么维修玩法。
甚至连网页最后应该做成什么样,我都没给参考。
这些东西全让它自己补。
GPT-6 接到任务以后,先判断自己需要一套真正能放进网页里的 3D 资产,于是调用 Hyper3D Rodin 开始生成火星探测车。
整车模型出来以后,它又继续通过 Hyper3D 做拆件,把原本完整的探测车处理成可以独立操作的模块。
最后它自己整理出了控制与通信舱、太阳能板、四个驱动轮等 7 个模块。

中间它只停下来找了我一次。
因为下一步要把 Hyper3D 生成的真实模型下载下来,真正嵌进网页,工具要求我明确确认下载授权。
GPT-6 自己停下来问了一句,我点了允许,它就继续往下跑了。

真正让我觉得有意思的是后面。
我原本只说了一句做一个可以拆开维修的火星探测车网页,最后它自己把整件事设计成了一个叫 ARES 火星维修站 的小游戏。
背景是探测车刚经历了一场沙尘暴。
进入页面以后,右边直接列出了三项需要处理的任务:恢复通信链路、清理太阳能板、紧固驱动轮。
中间则是 Hyper3D 生成的探测车,可以自由旋转,也可以直接检查不同部件。

它也没有把拆件做成一个单纯好看的爆炸视图。
比如点击右前驱动轮以后,系统会先诊断出轮毂固定件松脱,对应的轮子会被高亮出来,然后要求你真的把这个部件从探测车上拆下来。

拆下来以后,还会进入一个单独的维修台。
GPT-6 自己设计了三种维修工具:除尘刷、力矩扳手和校准仪。
不同的问题要选不同的工具,驱动轮松动要重新紧固,通信异常要做信号校准,太阳能板积灰则要一点点清理。

修好之后,再把零件装回探测车,系统重新检查状态。
三个问题全部处理完以后,任务才算结束。

我把最后这个可以直接玩的网页链接也放到评论区了。
大家可以自己进去拆一遍、修一遍、再装回去,实际玩一下会比只看截图直观很多。
做到这里,我才意识到,这个实验真正有意思的地方,根本不是 GPT-6 会不会做 3D。