OpenAI开放gpt-image-1图像生成API:新增蒙版编辑功能,Adobe等企业率先接入
OpenAI于近期正式向开发者开放了最新图像生成模型gpt-image-1的API接口。这款被业界称为"最强生图工具"的模型在上个月更新ChatGPT图像功能时已引发关注,其API开放标志着专业级图像生成能力正式进入商业应用阶段。
该模型支持文生图、图生图、局部重绘等核心功能,允许开发者通过API调用生成1024x1024分辨率的图像。在实际应用中,用户可自由调节图像质量、生成数量、背景透明度及输出格式,其中透明背景功能仅支持PNG和WebP格式。值得注意的是,模型新增的蒙版编辑功能让用户能够像使用Photoshop一样对指定区域进行精准修改,这一特性在电商产品图处理等场景具有实用价值。

在商业化布局方面,OpenAI采用了按token计费模式。具体定价为文本输入每百万token收费5美元,图像输入10美元,图像输出40美元。换算成实际使用场景,生成低、中、高质量的正方形图像单张成本分别约为0.02美元、0.07美元和0.19美元(约合人民币0.15元至1.37元)。相比MidJourney等竞品,该定价处于较高区间,但OpenAI强调其生成的图像具有更精准的细节表现和商业版权保障。
目前已有Adobe、Figma、Wix等多家知名企业将该技术集成至自家产品。例如Adobe将其整合进Firefly和Express平台辅助创意设计,Figma用户可通过文字指令直接生成设计素材,电商工具Photoroom则利用该技术实现产品图的场景化快速生成。微软Azure云服务也在OpenAI发布当天同步上线了该模型。
尽管技术能力获得认可,其定价策略在开发者社区引发讨论。有观点认为单张高质量图像1.4元人民币的成本对中小开发者不够友好,特别是需要批量生成的应用场景。对此OpenAI回应称正在优化成本结构,同时建议开发者通过调整质量参数和生成尺寸平衡预算。目前开发者可通过OpenAI Playground进行功能测试,正式接入需通过组织认证获取API密钥。
