为什么做这个项目
商品图很少能在一次提示词后真正完成。卖家通常从实拍素材开始,探索多个方向、比较结果、标记修改,最终还需要能够继续编辑的交付文件。CraftCanvas 因此把问题定义为一个持续工作的视觉空间,而不是一次性的生图表单。
工作台模型
- 无限画布同时保留源图、生成变体与它们之间的关系
- 选中单张或多张图片后,可以直接把它们作为下一轮对话的上下文
- 派生图紧邻源图落位,并通过碰撞避让和连接线保持可读性
- 图钉、引线式批注、形状与 Frame 让反馈始终靠近目标位置
- 生成批次可以快速定位、检查和下载,不会脱离周围工作上下文
四种生产工作流
CraftCanvas 支持自由创作、六视角商品图、多组件重排和一键九图。九图工作流包含商品细节、真人使用场景与参数信息图;用户填写的参数会作为事实进入提示词,系统不会主动虚构尺寸、功率、认证或其他数值。
AI 与可编辑交付
产品把 Gemini 图像模型、Gemini 素材分析与 OpenAI GPT Image 收敛到统一引擎接口,同时支持去背景、4K 放大、16:9 扩图、Touch Edit、批量编辑、分层 PSD 与 SVG 矢量导出。
应用采用 React、TypeScript、Vite 与 Tailwind CSS。画布状态、生成批次、批注与图片关系主要保存在浏览器端;线上可以通过 Vercel Node Function 代理 OpenAI Images。Gemini 与本地图像处理则根据任务选择足够完成工作的最小执行路径,而不是把所有能力都塞进同一个模型调用。
已验证状态与当前限制
当前仓库可以正常完成生产构建,项目入口提供可公开访问的在线工作台。仓库仍保持私有,因为其中包含正在使用的部署与产品实现细节。
产品能力已经较完整,但工程基础仍需继续加固:目前没有自动化测试,几个核心画布组件承担的职责过多,生产 JavaScript 包约 1 MB;如果使用服务端 OpenAI 密钥,代理接口也必须在扩大使用范围前补齐认证、配额与限流。这些是明确的下一阶段可靠性工作,而不是被隐藏的“已经全部完成”。
