ArtCraft:用62个模型做可控的图像视频创作
给艺术家和影视创作者用的AI图像视频IDE,把提示词生成变成可编辑的2D/3D场景制作。
GitHub storytold/artcraft 更新 2026-10-09 分支 main 星标 8.0K 分叉 1.1K
Rust TypeScript 交互式AI创作 Nano Banana Pro Windows/macOS/Linux

🧭 决策指南

适合,如果你

  • 你需要在同一工作流里组合2D图层、3D网格、角色姿态和镜头位置。
    README 的“Advanced Crafting Features”列出2D Image Compositing、3D Image Compositing和Character Posing。
  • 你想在一个桌面IDE中使用Nano Banana Pro、GPT Image、Sora和Marble等模型。
    README 的“Models and Providers Supported within ArtCraft”列出这些模型及62-model catalog。
  • 你需要用Image to Video把静态图像扩展为视频,并选择视频模型。
    README 的“Quick and Easy Prompting”明确列出Image to Video和video models。

不适合,如果你

  • 你的交付依赖README中标记为†或‡的Kling、Sora、Veo或MiniMax模型。
    README说明†表示Currently disabled,‡表示Restricted model; not currently available in the desktop app。
  • 你的环境只能使用Google、Runway或Luma集成。
    README将Kling、Google、Runway和Luma integrations列为planned,而非当前支持。
  • 你的合规流程要求明确的开源许可证条款。
    项目元数据中的许可协议为Other,README仅提供License链接,未展示具体条款。

前置条件

  • Windows和macOS可下载Stable releases;Linux需要Build from source。
  • 需要从README的Build from source链接进入_docs/dev_setup.md获取源码构建信息。
  • 可用模型范围受桌面应用中的†禁用和‡受限标记影响。

要注意

  • 不要把完整62模型目录等同于桌面端全部可用,README明确标记了†和‡模型。
    README在“ArtCraft: the full 62-model catalog”下说明†为禁用、‡为受限。
  • Linux没有稳定版下载项,下载章节只把Linux列在Build from source中。
    README“Downloads”列出Windows和macOS稳定版,并单独列出including Linux的Build from source。

替代方案

  • Midjourney:只需要Midjourney图像生成,而不需要ArtCraft的2D/3D场景编排时。
    README“Models and Providers Supported within ArtCraft”

材料未说明

  • README未说明Windows、macOS和Linux的最低版本要求。
  • README未说明CPU、GPU、显存、内存或磁盘要求。
  • README未说明各模型的API密钥、账户、订阅或费用要求。
  • README未说明62个模型中哪些功能需要联网或第三方服务。
  • README未说明具体构建命令、依赖版本和编译耗时。
  • README未说明许可证Other对应的具体法律条款。
  • README未说明3名贡献者和10次近期提交对应的发布维护分工。
  • README未说明导出格式、批处理能力、团队协作和数据隐私机制。

💡 深度解析

6
不适合 我们想在商业项目中统一使用 ArtCraft 的 62 个模型目录,并混用 ArtCraft、Midjourney、Sora 和 World Labs;在确认许可证和第三方授权前,是否适合直接纳入生产管线?
适合读者: 需要把 AI 生成工具纳入商业视觉流程的创意团队,计划使用 62 个模型目录中的图像、视频、音乐、音效和 3D 能力

不适合在授权未核查前直接纳入商业生产,因为项目许可证被标记为 Other,且生成能力依赖多个外部提供方。

  • 项目数据明确显示 license 为 Other;README还单独提供 License 链接,说明授权条款需要进一步阅读,不能按常见开源许可证默认处理。
  • README列出 ArtCraft、Grok、Midjourney、Sora 和 World Labs 等多个提供方,模型目录本身并不等于这些服务的商业输出权已被 ArtCraft 统一授予。
  • 62 个模型中存在 Currently disabled 和 Restricted model; not currently available in the desktop app 的状态差异,商业流程不能按完整目录做能力承诺。
  • ArtCraft的模型类别覆盖图像、视频、音乐和音效、3D meshes 与 worlds,资产版权、隐私和跨供应商条款会同时影响交付。

它可以作为授权审查后的创作工具,但在审查完成前,不应把它当作已获得统一商业许可的模型平台。

  • 项目数据:license 为 Other
  • Documentation:License (./LICENSE.md)
  • Models and Providers Supported within ArtCraft:ArtCraft、Grok、Midjourney、Sora、World Labs
  • ArtCraft: the full 62-model catalog;注释:Currently disabled;Restricted model; not currently available in the desktop app
材料未说明:README未提供 LICENSE.md 的具体商业使用、分发和修改条款;README未说明各第三方模型输出的版权归属、隐私处理和商业使用限制;README未说明生成数据是否会上传到外部服务
适合 我希望把背景移除后的 2D 素材、Image to 3D Mesh 生成的物体,以及 World Labs 的 Gaussian splats 放进同一场景;ArtCraft 是否适合这种混合资产工作流?
适合读者: 独立创作者,使用 2D 抠图、3D mesh 和 World Labs 的 Gaussian splats,把图像、道具与空间场景组合成一套视觉素材

适合,因为 README 直接把 2D cutouts、worlds 和 3D meshes 放进同一场景作为 Mixed Asset Crafting 的目标。

  • 2D Image Compositing 支持图层和背景移除,可把主体作为 props、layers 或 backdrops 使用。
  • Image to 3D Mesh 可把图像转成能定位、旋转和精确取景的 3D 对象;3D Image Compositing 则支持在有深度的构图中叠加背景、前景和道具。
  • World Labs 提供 Marble world generation with Gaussian splats,说明 Gaussian splats 至少是 README 明确列出的外部世界生成工作流。
  • Mixed Asset Crafting 明确支持 combine image cutouts, worlds, and 3D meshes in one scene。

它适合做概念场景、视觉探索和预可视化,不应直接假设能替代完整 DCC 管线。自动生成的网格质量、材质、透明区域和导出格式,README都没有给出保证。

  • Show, Don't Tell: Advanced Crafting Features:Image to 3D Mesh;3D Image Compositing;Background Removal;Mixed Asset Crafting
  • Models and Providers Supported within ArtCraft:World Labs — Marble world generation with Gaussian splats
  • Quick and Easy Prompting:Image to Video
材料未说明:README未说明 3D mesh 和 Gaussian splats 的导入导出格式;README未说明是否支持材质编辑、骨骼、碰撞或专业 3D 软件交换
不适合 我只想用 Nano Banana Pro 或 GPT Image 根据文字快速出图,不想学习 3D 场景、角色摆姿和图层编辑;ArtCraft 是否会比直接使用单一图像生成工具更省事?
适合读者: 只熟悉提示词式图像生成、使用 Nano Banana Pro 或 GPT Image 的创作者,不希望学习 3D 场景、图层和镜头控制

不适合把 ArtCraft 当作更省事的单一生图工具,因为它的价值建立在可视化编排和多步骤精修上,而不只是提示词调用。

  • README虽然支持 Text to Image,可用文字在多种图像模型间快速探索,也列出 Nano Banana Pro 和 GPT Image 的 prompted image editing。
  • 但项目同时把 2D 图层、背景移除、drawing、masks、inpainting、3D 场景、角色姿态和摄像机设置作为主要能力;这些功能会增加工作区和学习内容。
  • README的定位是 “The IDE for artists” 和 “Turn prompting into crafting”,明确鼓励先探索,再用 canvas 和 scene tools refine,而不是只提交一次提示词。
  • 如果只需要快速文字出图,ArtCraft 的模型选择和场景功能可能超出需求;如果以后需要控制构图或局部修改,额外能力才会产生价值。

README没有说明纯提示词模式是否可以隐藏 3D 或高级工具,因此不能承诺它会像专用聊天式生图产品一样简洁。

  • Quick and Easy Prompting:Text to Image;Prompted Image Editing 使用 Nano Banana Pro 和 GPT Image
  • Show, Don't Tell: Advanced Crafting Features:2D Image Compositing;Character Posing;3D Image Compositing
  • README开头:The IDE for artists
  • README开头:Turn prompting into crafting with visual tools for precise, repeatable results
材料未说明:README未说明是否有仅显示提示词和图像预览的简化界面;README未提供不同工作流的操作步骤或预计学习时间
适合 我在 Windows 或 macOS 上做概念设计,需要先安排角色姿态、道具和镜头,再生成可重复的画面;ArtCraft 是否比单纯使用 Midjourney 更适合我的流程?
适合读者: 在 Windows 或 macOS 上工作的概念艺术家,需要同时控制角色姿态、构图和镜头位置,而不是只依赖文字生图

适合,因为它把构图和角色控制放在生成之前,而不是只提供一次性的提示词结果。

  • README列出 Character Posing,可先摆姿并设置摄像机;Character Identity Transfer 可用姿态人偶引导角色位置和姿态。
  • 2D Image Compositing 支持图层、背景移除和绘制工具,Canvas Image Editing 还支持 drawing、masks 和 inpainting,适合逐步修改局部区域。
  • README提供 Windows 和 macOS 的稳定版本,Midjourney 只是 ArtCraft 支持的一个图像提供方,模型选择不必固定在单一服务上。

不过,场景布局并不等于像传统 3D 渲染那样锁定每个像素;最终效果仍会受模型、提示词和生成随机性影响。若目标是完全确定的角色细节,README没有作此保证。

  • Show, Don't Tell: Advanced Crafting Features:Character Posing;Character Identity Transfer
  • Quick and Easy Prompting:Canvas Image Editing 支持 drawing、masks 和 inpainting
  • Downloads:Stable releases for Windows and macOS
  • Models and Providers Supported within ArtCraft:Midjourney image generation
材料未说明:README未说明角色身份迁移在连续镜头中的一致性指标;README未说明项目文件是否能导出到 Photoshop 或其他专业绘图软件
视情况 我需要为多个镜头保持同一房间、角色和摄像机关系,并把静态画面转成视频;ArtCraft 是否适合替代我在不同网站之间切换 Sora、Grok Video 和其他视频模型?
适合读者: 需要制作多镜头分镜和预可视化的影视创作者,计划在同一场景中使用 Sora、Grok Video 或 ArtCraft 视频模型

视情况:它适合集中编排场景和调用模型,但不能保证所有列出的 Sora 或视频模型当前都可用。

  • Image to Location 明确用于把虚拟演员放入一致环境,并规划同一房间中的多个镜头,符合分镜和预可视化需求。
  • README提供 Image to Video,可把图像交给用户选择的视频模型;支持的提供方包括 ArtCraft、Grok 和 Sora。
  • 目录虽然包含 25 个视频模型,但表格标注部分模型为 Currently disabled,另有模型 Restricted、not currently available in the desktop app,因此“62-model catalog”不等于全部可调用。

如果你的要求是统一界面、先搭场景再生成,项目匹配度较高;如果制作计划依赖特定的 Sora 版本或受限模型,则不能仅凭目录做上线承诺。README也没有说明镜头时间轴、批量渲染或最终剪辑能力。

  • Show, Don't Tell: Advanced Crafting Features:Image to Location
  • Quick and Easy Prompting:Image to Video
  • Models and Providers Supported within ArtCraft:Grok Video;Sora 1、Sora 2
  • 模型目录注释:Currently disabled;Restricted model; not currently available in the desktop app
材料未说明:README未说明多镜头项目的时间轴、镜头管理和批量生成能力;README未说明每个视频模型的地区、账户、价格和速率限制
视情况 我主要使用 Linux,并希望检查或扩展一个以 Rust 和 TypeScript 为主的桌面 AI 创作项目;ArtCraft 是否提供足够明确的源码开发入口?
适合读者: 需要在 Linux 上研究桌面 AI 创作工具的 Rust 与 TypeScript 开发者,准备从源码构建而不是安装 Windows 或 macOS 稳定版

视情况:项目明确提供源码构建和开发文档入口,但 README 没有展开 Linux 依赖、构建命令或扩展边界。

  • Downloads 写明可 Build from source,包括 Linux;这比只提供 Windows 和 macOS 二进制更适合 Linux 开发者。
  • README同时链接 Development setup、Developer documentation,以及 Desktop build and development scripts,说明项目有专门的开发入口。
  • 项目数据中 Rust 是主语言,代码量约 9,356,885;TypeScript 约 6,598,295,符合需要同时理解桌面底层与界面层的研究场景。
  • 但最新发布为 artcraft-v0.41.0,累计仅 5 个 release,不能据此推断构建流程已经稳定或 API 已长期兼容。

因此,若目标是阅读架构、搭建开发环境或提交改动,可以从源码路径开始;若要求 Linux 上获得与稳定桌面版等价、无需排障的安装体验,README证据不足。

  • Downloads:Build from source,包括 Linux
  • Documentation:Development setup;Developer documentation;Desktop build and development scripts
  • 项目数据:主语言 Rust;Rust 9,356,885;TypeScript 6,598,295
  • 项目数据:latest_release 为 artcraft-v0.41.0;release_count 为 5
材料未说明:README正文未提供 Linux 的系统依赖、Rust/Node 版本和实际构建命令;README未说明插件 API、模块边界和桌面运行时架构

✨ 核心亮点

  • 支持62个模型,覆盖图像、视频、音乐和3D
  • 3D Image Compositing可控制景深、道具和机位
  • 同时提供Canvas编辑、角色姿态和背景移除
  • Windows和macOS有稳定版,Linux支持源码构建

🔧 工程化

  • 用2D画布和3D场景组合图像、角色、道具与世界
  • 用Nano Banana Pro和GPT Image做提示词图像编辑
  • 支持Image to Video及多家视频模型和生成控制

⚠️ 风险

  • 许可证标为Other,README未说明具体授权条款
  • 仅3名贡献者和10次近期提交,维护规模较小
  • 部分Kling、Sora和Veo模型标记为禁用或受限
  • Google、Runway和Luma集成仍写作planned

👥 适合谁?

  • 需要控制构图、角色身份和镜头位置的艺术家
  • 使用Windows或macOS制作图像、视频和3D内容的团队
  • 希望在一个IDE里比较Nano Banana、Sora和Marble的创作者