image-blaster:一张照片生成可漫游的 3D 世界
image-blaster 是开源的 Claude 技能包:一张照片自动产出可漫游的 3D 场景和带音效的物体模型,直接进 Unity、Blender。
项目资料
GitHub Ecosystem- 许可证
- MIT
- 主语言
- TypeScript
- 星标
- 10,334
- 核查时间
- 2026-10-08
以上快照资料以核查当日为准,可能随版本或运营策略变化。
想把一张照片变成能走进去的 3D 场景,以前得自己串好几个生成服务:环境一个、物体建模一个、音效再找一个,逐个注册对接。image-blaster 是个人开发者 neilsonnn 开源的 Claude 技能包(MIT 协议,TypeScript),把这条流水线写成一册给智能体看的工作手册:你说一句 “blast it”,它按步骤跑完照片分析、清底图、环境生成、物体建模和音效配置。公众号「极客之家」10 月 7 日撰文推荐并实测跑通了全流程;截至 2026-10-08,这个 2026 年 4 月创建的仓库已有 10,334 星。

核心功能
- 一张照片出三类资产:照片里不动的部分(墙面、地面、天空)生成
.spz高斯泼溅场景,可以自由漫游;“搬得动”的东西——椅子、桌子、箱子——单独建成.glb和.obj模型;再配一段环境循环音和每个物体的碰撞音效(.mp3)。 - 全流程由智能体执行:仓库本质是
.claude/目录下的一组 SKILL.md 加配套脚本,官方推荐装在 Claude Code 里跑,「极客之家」实测装进 Codex 也能用;可以让它每跑一步先停下来等你确认,清单里不想建模的东西直接划掉。 - 背靠四个生成模型:环境走 World Labs 的 Marble(
marble-1.1),物体建模走腾讯混元 3D,音效走 ElevenLabs,后两者经 FAL 平台调用;擦除物体的图像编辑默认用 nano-banana,可切换 gpt-image-2。 - clean plate 防残影:先按清单把物体从原图擦掉、拿到干净空景,再用空景生成环境;跳过这一步,3D 场景里会留下物体残影。这个概念借自影视后期。
- 文件编号可回溯:原图编号 0 永不覆盖,每张生成图和每次请求记录单独留存,哪一步跑废了就顺着编号重跑那一步,不用从头再花钱。
- 建模参数可调:面数默认 50,000(Hunyuan 接口范围 40,000–1,500,000),可切 LowPoly 低多边形和 Geometry 白模,三角形或四边形面可选,PBR 材质默认开启。
典型使用场景
- 游戏策划:拿一张气氛图跑一遍,几分钟后就在生成的场景里走动,比对着平面图开会直观;README 称从照片到带网格的环境不到 5 分钟。
- 影视勘景与建筑渲染:把参考照片变成可漫游的空间预览,先在里面走一圈再定镜头和动线。
- 机器人环境概念稿:快速搭一个能走的场景看效果——想拿去做仿真先看下节的提醒。
快速上手
需要自备 World Labs 和 FAL 两个平台的 API key,都按调用量计费。以下命令来自官方 README:
git clone https://github.com/neilsonnn/image-blaster
cd image-blaster
claude
把照片放进 input/ 目录,跟 Claude 说明两个 key,然后说一句 “blast it and confirm each step with me”。它会先分析照片、列出要建模的物体清单,等你确认才开始生成,之后不用你管。
小结
适合想快速“看见”一个概念场景的游戏开发者、独立开发者和 3D 爱好者,尤其是已经在用 Claude Code 的人。MIT 协议,主语言 TypeScript。动手前先想清楚这几点:
- 背面是编的:照片拍不到的地方全靠模型推测,只给房间正面一张图,屋后长什么样没有依据,生成的世界只能说接近你的房间。
- 物理没有校准:碰撞体粗糙,物体尺寸重量没有标定,「极客之家」明确说这套产物还做不了机器人仿真训练。
- 全程是收费 API:Marble、混元 3D、ElevenLabs、nano-banana 全是闭源模型,跑一次要消耗 World Labs 和 FAL 两个账户的额度,试错也是钱。
- 仓库已五个月没动:最后提交停在 2026-05-15,半年内涨到一万星但维护停了,底层模型 API 一变就得自己动手改。
- 只想给 Blender 里已有的建模流程加智能体的,之前收录的 mcp-for-blender 是另一条路:它驱动你手上的建模工具,不从照片凭空生成。