Aioga
AI资讯 / 技巧观点
返回 AI资讯

OpenRouter 新增图像生成模型专用 API 端点

OpenRouter:Announcements(RSS)Aioga 编辑团队2026-07-27T00:00:00.000Z热度 60

OpenRouter 通过专用 `/api/v1/images` 端点提供图像生成模型服务,图像理解仍通过 `/chat/completions` 端点完成,两者共用同一 AP...

技巧观点OpenRouter:Announcements(RSS)

今日 AI 情报摘要

OpenRouter 通过专用 `/api/v1/images` 端点提供图像生成模型服务,图像理解仍通过 `/chat/completions` 端点完成,两者共用同一 API Key 和计费体系。

该平台同时公布了两种任务的完整接口合约,并修复了此前出现的"no endpoints found"错误。

中文正文 · AI 翻译

你接入一个图像生成提供商,让它正常工作,然后一周后,你需要读取一张图像。也许是对上传的收据进行 OCR,或者在保存资源之前快速进行一次对象检测,或者生成可访问性的替代文本。这是不同的工作。对于大多数提供商而言,这意味着需要第二个 SDK、第二个 API 密钥和第二个计费关系。

Image Generation Models on OpenRouter

在 OpenRouter:https://openrouter.ai/ 上,这两项工作都通过一个基础 URL 运行:https://openrouter.ai/api/v1,只需一个 API 密钥和一个账单。生成图像时,将提示 POST 到 /images。读取图像时,将其发送到 /chat/completions 上的视觉模型。

这些端点背后的模型目录:https://openrouter.ai/docs/guides/overview/models 涵盖了主要的图像实验室,并且图像调用的提供商路由和故障切换与聊天调用的方式相同。

是的,通过一个基础 URL 和一个 API 密钥。生成图像时,将提示 POST 到专用的图像 API。读取图像时,将其发送到标准聊天完成端点的视觉模型:https://openrouter.ai/docs/quickstart。

一个已经生成图像的应用可以使用相同的密钥和计费账户添加视觉功能。唯一变化的是端点和请求格式。

Diagram of one API base URL splitting into POST /api/v1/images for generating images and POST /api/v1/chat/completions for understanding images

目录中包括 Google(Gemini 图像系列)、OpenAI(GPT 图像)、Black Forest Labs(FLUX)、xAI(Grok Imagine)、字节跳动(Seedream)、微软(MAI-Image)、Recraft、Krea,以及 Sourceful(Riverflow)。具体模型名称会随每次发布而变化,因此要查看当前阵容、功能和每个模型的定价,请使用图像模型目录:https://openrouter.ai/collections/image-models。

向 /api/v1/images 发送一个带有模型和提示的 POST 请求。图像会以 base64 的形式返回在 data 数组中。

data 中的每个条目都包含以 b64_json 形式的图像,以及一个 media_type 字段(通常是 image/png;Recraft 矢量模型可以返回 image/svg+xml)。usage 字段报告 token 数量和请求成本。每次请求最多可生成 10 张图像,使用 n(并非每个提供商都支持 n > 1),并遍历 data 而不是硬编码索引 0。

请求体可直接使用图像特定字段:

在 GET /api/v1/images/models 中检查模型的 supported_parameters,以了解每个端点支持的参数。提供商还可以通过 provider.options 接受特定于提供商的选项,而 supports_streaming: true 的模型可以通过 SSE 使用 stream: true 流式传输部分图像。图像生成文档:https://openrouter.ai/docs/guides/overview/multimodal/image-generation 覆盖了完整的请求结构。

向 /chat/completions 上的视觉模型发送包含 text 部分和 image_url 部分的 messages 数组。你将收到文本完成返回。image_url 可以接受公共 URL 或 base64 数据 URL。

响应以标准文本完成返回,模型的答案在 choices[0].message.content 中。

对于 PDF,使用文件内容类型,而不是先将页面渲染成图像。OpenRouter 还支持通过相同端点的音频和视频输入,使用更换模型和内容类型的相同模式。多模态概述文档:https://openrouter.ai/docs/guides/overview/multimodal/overview 覆盖了所有输入类型。

当输出是新的视觉资产时使用 generation:原型、产品图片、插图、营销创意,任何以文本提示开始并以像素结束的内容。

当你已经有图片并需要从中获取信息时使用 understanding:对收据和表格进行 OCR、辅助功能的替代文本、生产线上的物体或缺陷检测、分类或简单描述。

你调用的端点告诉我们你正在执行哪种任务。Generation 发布到 /api/v1/images;Understanding 发布到 /chat/completions。两者都使用相同的 API 密钥,并计入相同账单。

对于需要在对话中决定何时生成图像的应用,还有第三种选择。openrouter:image_generation 服务器工具(测试版)允许聊天模型在对话中生成图像,而无需应用代码显式调用。将 { "type": "openrouter:image_generation" } 添加到请求的 tools 数组中,模型将决定何时调用。默认使用 openai/gpt-5-image。服务器工具文档:https://openrouter.ai/docs/guides/features/server-tools/image-generation 覆盖了可用参数。

是的。在 /api/v1/images 上,provider 对象接受 order、only、ignore、sort 和 allow_fallbacks。如果一个图像模型由多个提供者提供,当第一个不可用或响应缓慢时,可以在它们之间切换。

此请求会优先选择一个提供者,如果失败则回退到下一个。对 /chat/completions 的视觉调用会使用完整的聊天提供者对象:https://openrouter.ai/docs/guides/routing/provider-selection,包括 data_collection: "deny"。

您按照目录价格支付,我们不加价:https://openrouter.ai/pricing。在零完成保险(Zero Completion Insurance)下,图像调用回退但从未完成的情况下不收费。有关路由器如何选择提供者,请参阅 OpenRouter 模型路由的工作原理:https://openrouter.ai/blog/insights/model-routing/。

目前没有。免费层:https://openrouter.ai/pricing 覆盖带有 :free 后缀的模型,每天 50 次请求,20 次每分钟,无需信用卡(余额有 10 美元或以上时每天 1000 次请求),目前没有图像生成模型带有该后缀。免费池随着模型的变化而变化,因此值得重新检查 /models?output_modalities=image:https://openrouter.ai/models?output_modalities=image。

因此生成调用会消耗您的信用额度,但测试成本很低。低成本模型的每张图片定价大约从一美分起,每次响应的 usage.cost 会报告请求花费。免费模型指南:https://openrouter.ai/blog/tutorials/free-llm-apis-compared/ 介绍了文本模型免费层的机制。

此错误意味着您向不接受图像输入的模型发送了 image_url。我们会根据请求内容自动过滤可用模型:https://openrouter.ai/docs/guides/overview/multimodal/overview,因此当您命名的模型没有支持图像的可用端点时,请求会以此错误失败,而不是默默忽略图像。

类似错误如未找到支持工具使用的端点和数据策略相关变体的错误也是相同原理。错误会指出未匹配的要求;放宽要求或选择符合要求的模型和提供者组合。

从图像模型目录开始:https://openrouter.ai/collections/image-models,在聊天室测试提示,并使用上述代码片段调用接口。

是的,通过一个基础URL和一个API密钥。要生成图片,请发布模型和提示 https://openrouter.ai/api/v1/images。要阅读,可以把它作为image_url发送给 /chat/finishs 上的愿景模型。两者都在同一张法案上。

目录包括Google(Gemini图片家族)、OpenAI(GPT图片)、Black Forest Labs(FLUX)、xAI(Grok Imagine)、字节跳动(Seedream)、Microsoft(MAI-Image)、Recraft、Krea和Sourceful(Riverflow)。筛选/models?output_modalities=image:https://openrouter.ai/models?output_modalities=image,或者浏览图片模型合集:https://openrouter.ai/collections/image-models,了解当前产品线和价格。

你给一个不接受图像输入的模型发送了image_url。确认模型input_modalities包含图像,找到支持视觉的模型,使用 GET /api/v1/models?input_modalities=image,然后更新你请求中的模型字符串。

现在没有。免费版(每天50次请求,20转,不使用信用卡)涵盖带有:free 后缀的模型,目前没有图片生成模型支持,因此生成是基于你的信用余额。低价模型起价约为每张图片一美分。

是的。/api/v1/images 端点只接受 provider.order,仅接受 、 忽略、排序 和 allow_fallbacks,因此订购、成本/延迟排序和跨提供商故障切换的工作方式与聊天时相同。/chat/completions 上的 Vision 调用会使用完整的聊天提供者对象,包括data_collection:“拒绝”。

在响应的数据阵列中;每个条目都有b64_json,包含 base64 编码的图像字节和一个 media_type 字段(通常是 image/png)。每次调用时,最多请求10张带有n参数的图片,并以迭代方式处理数据,而不是硬编码索引0。

情报判断

Aioga 编辑摘要

Aioga 编辑摘要:OpenRouter 通过专用 `/api/v1/images` 端点提供图像生成模型服务,图像理解仍通过 `/chat/completions` 端点完成,两者共用同一 API Key 和计费体系。 Aioga 将其归入「技巧观点」方向,重点关注它对真实使用和行业竞争的影响。

背景分析

背景分析:模型与研究类动态需要结合能力边界、开放方式、成本、可用性和真实任务表现判断,单项指标领先不等于已经形成稳定采用。

Aioga 观点

Aioga 判断:这条动态更适合作为行业观察信号,当前信息足以建立线索,但不足以推导长期结论。

影响与后续

影响分析:对相关团队而言,短期应先核对来源、可用范围和实际成本,再判断是否值得接入或跟进。 后续观察:继续观察官方文档、实际可用性、价格变化、开发者反馈和竞品回应。

来源与版权说明

本页正文由公开来源页面提取并按原有信息整理,同时保留来源、发布时间和原文入口。版权归原作者及来源网站所有,请通过原文链接核验和阅读来源版本。

抓取通道: RSS · 原始域名: openrouter.ai

来源: OpenRouter:Announcements(RSS)

原文链接: 打开原始来源

Aioga 归档: 查看情报页

Content record: source-page · Updated: 2026-07-27T00:00:00.000Z

API 中转站
API RELAY · DEVELOPER INFRASTRUCTURE

API 中转站

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。

立即访问 api.w173.com
AIOGA SHARE POSTER

分享这篇 AI 情报

OpenRouter 通过专用 `/api/v1/images` 端点提供图像生成模型服务,图像理解仍通过 `/chat/completions` 端点完成,两者共用同一 AP...

OpenRouter:Announcements(RSS)2026-07-27T00:00:00.000Z
扫码打开文章详情扫码直达文章详情

Aioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。