跳转到内容

Model Catalog

快速比较模型能力、上下文、模态与目录价格。
Catalog 是起点,不是限制

这里展示的是 OctaFuse Gateway 当前内置、可在 Admin 中直接导入的静态预设。Gateway 仍支持创建任意自定义 Provider、Model 和兼容端点;未列出不代表不支持。

了解如何自定义配置

74 条结果

按 / 快速搜索

Alibaba Cloud

LLM

Qwen3.8 Max Preview

qwen3.8-max-preview
上下文
1M
最大输出
64K
发布日期
2026-07-19

面向复杂推理、编程与企业级 Agent 工作流的 Qwen 旗舰预览模型。

模态
文本 图片
文本

Alibaba Cloud

LLM

Qwen3.7 Plus

qwen3.7-plus
上下文
1M
最大输出
64K
发布日期
2026-06-02

兼顾成本与效果的 Qwen 多模态模型,适合通用推理、视觉理解与生产应用。兼顾文本与图像理解,并以更具成本效率的设计服务于生产级多模态推理。

模态
文本 图片 视频 文件
文本

Alibaba Cloud

LLM

Qwen3.7 Max

qwen3.7-max
上下文
1M
最大输出
64K
发布日期
2026-05-20

Qwen3.7 旗舰模型,重点优化编程、生产力任务与 Agent 工作流。其 Agent 导向设计重点覆盖编程、办公生产力和复杂多步骤任务。

模态
文本
文本

Alibaba Cloud

LLM

Qwen3.6 Plus

qwen3.6-plus
上下文
1M
最大输出
64K
发布日期
2026-04-02

兼顾推理能力与推理效率、适合长上下文任务的 Qwen 模型。通过高效线性注意力与稀疏专家路由的混合架构,提升扩展性和推理效率。

模态
文本 图片 视频 文件
文本

Alibaba Cloud

LLM

Qwen3.6 Max

qwen3.6-max
上下文
256K
最大输出
64K
发布日期
2026-04-20

面向高难度推理、编程与知识工作的高性能 Qwen 模型。

模态
文本
文本

Alibaba Cloud

LLM

Qwen3.6 flash

qwen3.6-flash
上下文
1M
最大输出
64K
发布日期
2026-04-16

具备大上下文能力的高速 Qwen 多模态模型,适合高吞吐工作负载。支持文本、图像和视频输入,并以长上下文能力面向延迟敏感的多模态应用。

模态
文本 图片 视频 文件
文本

Alibaba Cloud

LLM

Qwen3.5 Plus

qwen3.5-plus
上下文
1M
最大输出
64K
发布日期
2026-02-16

适合通用对话、推理、编程与多模态任务的均衡型 Qwen 模型。

模态
文本 图片 视频 文件
文本

Alibaba Cloud

LLM

Qwen3.5 Flash

qwen3.5-flash
上下文
1M
最大输出
64K
发布日期
2026-02-16

面向低延迟对话、信息抽取与轻量 Agent 场景的 Qwen 模型。

模态
文本 图片 视频 文件
文本

Alibaba Cloud

LLM

Qwen3-VL Plus

qwen3-vl-plus
上下文
256K
最大输出
32K
发布日期
2025-12-19

面向文档、图像、屏幕理解与视觉推理任务的视觉语言模型。

模态
文本 图片 视频
文本

Alibaba Cloud

LLM

Qwen3.5 Omni Plus

qwen3.5-omni-plus
上下文
256K
最大输出
64K
发布日期
2026-03-15

可统一理解文本、图像、音频与视频的全能力 Qwen 多模态模型。

模态
文本 图片 音频 视频
文本 音频

Alibaba Cloud

LLM

Qwen3.5 Omni Flash

qwen3.5-omni-flash
上下文
256K
最大输出
64K
发布日期
2026-03-15

面向实时多模态理解与交互的高速 Qwen Omni 模型。

模态
文本 图片 音频 视频
文本 音频

Anthropic

LLM

Claude Fable 5

claude-fable-5
上下文
1M
最大输出
128K
发布日期
2026-06-09

面向自主知识工作、编程和多模态 Agent 的 Anthropic 模型。定位于自主知识工作与编程,支持多模态输入、推理及工具驱动工作流。

模态
文本 图片 文件
文本

Anthropic

LLM

Claude Sonnet 5

claude-sonnet-5
上下文
1M
最大输出
128K
发布日期
2026-06-30

适合编程、专业工作与自适应 Agent 推理的前沿 Sonnet 模型。自适应推理等级可在前沿编程与 Agent 能力、延迟和 Token 消耗之间灵活取舍。

模态
文本 图片 文件
文本

Anthropic

LLM

Claude Opus 5

claude-opus-5
上下文
1M
最大输出
128K
发布日期
2026-07-24

Anthropic 旗舰模型,面向复杂推理、编程、视觉分析与长时间 Agent 任务。尤其擅长端到端软件任务、代码审查与缺陷定位、文档和图表分析、复杂办公交付、工具调用及并行子 Agent 协作。

模态
文本 图片 文件
文本

Anthropic

LLM

Claude Opus 4.8

claude-opus-4.8
上下文
1M
最大输出
128K
发布日期
2026-05-28

适合长上下文推理、编程与多模态分析的高性能 Opus 模型。结合多模态输入、推理能力与长上下文窗口,适合高要求的通用工作流。

模态
文本 图片 文件
文本

Anthropic

LLM

Claude Opus 4.7

claude-opus-4.7
上下文
1M
最大输出
128K
发布日期
2026-04-16

面向长时间异步 Agent 与复杂软件工作流的 Opus 模型。面向需要长时间持续执行编程与专业任务的异步 Agent。

模态
文本 图片 文件
文本

Anthropic

LLM

Claude Opus 4.6

claude-opus-4.6
上下文
1M
最大输出
128K
发布日期
2026-02-05

面向端到端编程与长时间专业工作流的高性能 Claude 模型。针对贯穿完整软件与专业工作流的 Agent 优化,而不仅是处理孤立提示词。

模态
文本 图片 文件
文本

Anthropic

LLM

Claude Sonnet 4.6

claude-sonnet-4.6
上下文
1M
最大输出
64K
发布日期
2026-02-17

适合迭代开发、Agent 与专业知识工作的均衡型前沿模型。优势包括迭代开发、复杂代码库导航,以及借助工具完成端到端项目执行。

模态
文本 图片 文件
文本

Anthropic

LLM

Claude Haiku 4.5

claude-haiku-4.5
上下文
200K
最大输出
64K
发布日期
2025-10-15

适合低延迟对话、编程和 Agent 任务的高速高效 Claude 模型。以显著更低的延迟和成本提供接近前沿水平的能力,适合高并发交互式任务。

模态
文本 图片 文件
文本

ByteDance

图片 New

Doubao Seedream 5.0 Pro

doubao-seedream-5-0-pro
计费方式
按张计费
发布日期
2026-07-08

面向高保真图片生成与专业视觉创作的 Seedream 高质量模型。

模态
文本 图片
图片

ByteDance

图片

Doubao Seedream 5.0

doubao-seedream-5-0
计费方式
按张计费
发布日期
2026-01-28

适合通用图片生成、编辑与视觉设计工作流的 Seedream 模型。

模态
文本 图片
图片

ByteDance

LLM

Doubao Seed 2.0 Mini

doubao-seed-2-0-mini-260215
上下文
256K
最大输出
128K
发布日期
2026-02-14

面向快速对话、成本敏感与轻量推理场景的紧凑型豆包模型。

模态
文本 图片
文本

ByteDance

LLM

Doubao Seed 2.0 Lite

doubao-seed-2-0-lite-260215
上下文
256K
最大输出
128K
发布日期
2026-02-14

针对高吞吐文本与视觉工作负载优化的轻量豆包模型。

模态
文本 图片 视频 音频
文本

ByteDance

LLM

Doubao Seed 2.0 Pro

doubao-seed-2-0-pro-260215
上下文
256K
最大输出
128K
发布日期
2026-02-14

适合高级推理、多模态理解与 Agent 场景的高性能豆包模型。

模态
文本 图片 视频
文本

ByteDance

LLM

Doubao Seed 2.1 Pro

doubao-seed-2-1-pro-260628
上下文
256K
最大输出
256K
发布日期
2026-06-23

面向复杂推理、编程与多模态生产应用的新一代豆包 Pro 模型。

模态
文本 图片 视频 音频
文本

ByteDance

LLM

Doubao Seed 2.1 Turbo

doubao-seed-2-1-turbo-260628
上下文
256K
最大输出
256K
发布日期
2026-06-23

面向高响应多模态应用与 Agent 的低延迟豆包模型。

模态
文本 图片 视频
文本

ByteDance

LLM

Doubao Seed Evolving

doubao-seed-evolving
上下文
256K
最大输出
256K
发布日期
2026-06-23

面向自适应推理与 Agent 实验场景的持续演进型豆包模型。

模态
文本 图片 视频
文本

DeepSeek

LLM

DeepSeek-V3.2

deepseek-v3.2
上下文
128K
最大输出
8K
发布日期
2025-12-01

兼顾推理效率、复杂推理与 Agent 工具调用能力的 DeepSeek 模型。稀疏注意力设计旨在提高长上下文推理效率,同时保持较强的工具调用表现。

模态
文本
文本

DeepSeek

LLM

DeepSeek V4 Flash

deepseek-v4-flash
上下文
1M
最大输出
384K
发布日期
2026-04-24

面向长上下文推理与编程任务的高速 DeepSeek 混合专家模型。效率优先的混合专家架构仅激活少量参数,以实现快速的长上下文推理。

模态
文本
文本

DeepSeek

LLM

DeepSeek V4 Pro

deepseek-v4-pro
上下文
1M
最大输出
384K
发布日期
2026-04-24

面向高级推理、编程与 Agent 的大型 DeepSeek 混合专家模型。大规模混合专家架构面向高级推理、编程和持续运行的 Agent 任务。

模态
文本
文本

Google

图片 New

Gemini 3.1 Flash Image

gemini-3.1-flash-image
计费方式
Token 计费
发布日期
2026-02-01

结合多模态推理能力的高速 Google 图片生成与编辑模型。亦称 Nano Banana 2,将高速生成与高级编辑和多模态视觉推理结合起来。

模态
文本 图片
图片

Google

图片 New

Gemini 3 Pro Image Preview

gemini-3-pro-image-preview
计费方式
Token 计费
发布日期
2025-11-01

Google 高级图片生成预览模型,擅长有依据的创作与精细视觉编辑。基于 Gemini 3 Pro,强调有依据的创作、更强的多模态推理和精细图像编辑。

模态
文本 图片
图片

Google

LLM

Gemini 3.6 Flash

gemini-3.6-flash
上下文
1M
最大输出
64K
发布日期
2026-07-21

面向编程、Agent、Web 与应用开发的高效率 Gemini 模型。面向 Agent 工作流中的编程与应用开发,力求以更少的无效修改产出更成熟的结果。

模态
文本 图片 音频 视频 文件
文本

Google

LLM

Gemini 3.1 Pro Preview

gemini-3.1-pro-preview
上下文
1M
最大输出
64K
发布日期
2026-02-19

面向软件工程与高可靠 Agent 工作流的前沿 Gemini 推理预览模型。该预览版在复杂工作流中强化软件工程表现、Agent 可靠性和 Token 效率。

模态
文本 图片 音频 视频 文件
文本

Google

LLM

Gemini 3 Flash Preview

gemini-3-flash-preview
上下文
1M
最大输出
64K
发布日期
2025-12-17

适合多轮对话、编程与 Agent 工作流的高速 Gemini 思考模型。以 Flash 级速度提供接近 Pro 的推理与工具调用能力,适用于多轮对话、编程和 Agent。

模态
文本 图片 音频 视频 文件
文本

Google

LLM

Gemini 3.5 Flash

gemini-3.5-flash
上下文
1M
最大输出
64K
发布日期
2026-05-19

在编程、推理与并行 Agent 场景表现出色的高效 Gemini 多模态模型。在更高效的档位提供接近 Pro 的编程和推理能力,并针对并行 Agent 执行优化。

模态
文本 图片 音频 视频 文件
文本

Google

LLM

Gemini 3.5 Flash Lite

gemini-3.5-flash-lite
上下文
1M
最大输出
64K
发布日期
2026-07-21

面向专注型子 Agent 与高流量生产任务的轻量 Gemini 模型。轻量化设计尤其适合大型多 Agent 系统中执行明确子任务的子 Agent。

模态
文本 图片 音频 视频 文件
文本

Google

LLM

Gemini 3.1 Flash Lite Preview

gemini-3.1-flash-lite-preview
上下文
1M
最大输出
64K
发布日期
2026-03-03

针对高流量、延迟敏感应用优化的高效率 Gemini 预览模型。针对高吞吐工作负载优化,同时力求接近更大型 Flash 模型的质量。

模态
文本 图片 音频 视频 文件
文本

Google

LLM

Gemini 2.5 Pro

gemini-2.5-pro
上下文
1M
最大输出
64K
发布日期
2025-06-17

适合编程、数学、科学与多模态分析的高性能 Gemini 推理模型。内置思考能力可在高级编程、数学、科学和多模态分析中给出更审慎的回答。

模态
文本 图片 音频 视频 文件
文本

Google

LLM

Gemini 2.5 Flash

gemini-2.5-flash
上下文
1M
最大输出
64K
发布日期
2025-06-17

在推理质量、速度与多模态能力之间取得平衡的 Gemini 主力模型。在编程、数学、科学和多模态生产任务中平衡内置推理能力与主力级吞吐量。

模态
文本 图片 音频 视频 文件
文本

Google

LLM

Gemini 2.5 Flash Lite

gemini-2.5-flash-lite
上下文
1M
最大输出
64K
发布日期
2025-07-22

针对高吞吐与快速生成优化的低成本 Gemini 推理模型。重点优化超低延迟、低成本、高吞吐和快速 Token 生成。

模态
文本 图片 音频 视频 文件
文本

Meituan LongCat

LLM New

LongCat 2.0

longcat-2.0
上下文
1M
最大输出
128K
发布日期
2026-06-30

美团稀疏专家模型,适合编程、代码仓库任务与长周期 Agent。稀疏专家架构面向仓库级编程、长周期问题求解和 Agent 执行。

模态
文本
文本

MiniMax

LLM

MiniMax M2.5

minimax-m2.5
上下文
196K
最大输出
128K
发布日期
2026-02-12

面向实际生产力、编程与真实数字化工作的 MiniMax 模型。通过多样化数字工作环境训练,将编程基础能力扩展到实用的端到端生产力任务。

模态
文本
文本

MiniMax

LLM

MiniMax M2.7

minimax-m2.7
上下文
196K
最大输出
128K
发布日期
2026-03-18

面向自主生产力与多 Agent 协作的 Agent 型 MiniMax 模型。强调真实工作场景中的自主生产力、多 Agent 协作和持续改进。

模态
文本
文本

MiniMax

LLM

MiniMax M3

minimax-m3
上下文
1M
最大输出
64K
发布日期
2026-06-01

适合编程、知识工作与 Agent 的长上下文 MiniMax 多模态模型。多模态基础能力面向长周期 Agent、编程和长上下文知识工作。

模态
文本 图片 视频
文本

Moonshot AI

LLM

Kimi K2.5

kimi-k2.5
上下文
256K
最大输出
256K
发布日期
2026-01-27

面向视觉编程与协同 Agent 工作流的原生多模态 Kimi 模型。将原生多模态理解、视觉编程与自主 Agent 集群范式结合起来。

模态
文本 图片 视频
文本

Moonshot AI

LLM

Kimi K2.6

kimi-k2.6
上下文
256K
最大输出
256K
发布日期
2026-04-20

面向长周期编程、UI 生成与 Agent 编排的多模态 Kimi 模型。面向长周期编程、代码驱动的 UI 生成,以及复杂项目中的多 Agent 协同执行。

模态
文本 图片 视频
文本

Moonshot AI

LLM

Kimi K2.7 Code

kimi-k2.7-code
上下文
256K
最大输出
256K
发布日期
2026-06-12

面向长上下文端到端编程任务、强调可靠性的 Kimi Code 模型。以编程为中心,旨在长上下文中可靠完成端到端开发任务。

模态
文本 图片 视频
文本

Moonshot AI

LLM

Kimi K3

kimi-k3
上下文
1M
最大输出
1M
发布日期
2026-07-16

面向复杂编程、推理与 Agent 工作的开放权重 Kimi 多模态模型。这款开放权重多模态推理模型面向复杂编程、知识工作和长时间运行的 Agent。

模态
文本 图片 视频
文本

OpenAI

图片

GPT Image 2

gpt-image-2
计费方式
Token 计费
发布日期
2026-04-01

用于专用 Images API 的 OpenAI 高保真图片生成与编辑模型。

模态
文本 图片
图片

OpenAI

LLM

GPT-5.2

gpt-5.2
上下文
400K
最大输出
128K
发布日期
2025-12-11

具备自适应推理能力、适合编程、Agent 与长上下文工作的前沿 GPT 模型。自适应推理会根据任务难度分配计算资源,以提升 Agent 与长上下文表现。

模态
文本 图片
文本

OpenAI

LLM

GPT-5.4

gpt-5.4
上下文
1M
最大输出
128K
发布日期
2026-03-05

面向高级推理、编程、多模态输入与专业工作流的旗舰 GPT 模型。统一通用 GPT 与编程能力,面向大上下文专业工作和工具驱动执行。

模态
文本 图片
文本

OpenAI

LLM

GPT-5.4 mini

gpt-5.4-mini
上下文
400K
最大输出
128K
发布日期
2026-03-17

面向高吞吐推理、编程与多模态应用的高速 GPT-5.4 变体。较小规模版本保留较强推理和编程能力,同时提高速度与吞吐量。

模态
文本 图片
文本

OpenAI

LLM

GPT-5.4 nano

gpt-5.4-nano
上下文
400K
最大输出
128K
发布日期
2026-03-17

针对低延迟、高流量与成本敏感任务优化的紧凑型 GPT 模型。针对强调速度的分类、抽取、路由及其他高并发轻量任务优化。

模态
文本 图片
文本

OpenAI

LLM

GPT-5.5

gpt-5.5
上下文
1M
最大输出
128K
发布日期
2026-04-23

面向复杂专业工作、强化推理能力与可靠性的前沿 GPT 模型。在保留长上下文能力的同时,提高困难专业任务上的可靠性和 Token 效率。

模态
文本 图片
文本

OpenAI

LLM

GPT-5.6

gpt-5.6
上下文
1.05M
最大输出
128K
发布日期
2026-07-09

面向高级推理、编程与通用 Agent 工作流的 GPT-5.6 系列模型。

模态
文本 图片
文本

OpenAI

LLM

GPT-5.6 Sol

gpt-5.6-sol
上下文
1.05M
最大输出
128K
发布日期
2026-07-09

GPT-5.6 旗舰模型,适合高难度推理、编程与多步骤 Agent 任务。旗舰档位尤其擅长命令行工作和复杂的多步骤编程流程。

模态
文本 图片
文本

OpenAI

LLM

GPT-5.6 Terra

gpt-5.6-terra
上下文
1.05M
最大输出
128K
发布日期
2026-07-09

面向日常编程、推理与 Agent 应用的均衡型 GPT-5.6 模型。平衡档位在旗舰质量与成本效率之间取舍,适合日常编程、推理和 Agent。

模态
文本 图片
文本

OpenAI

LLM

GPT-5.6 Luna

gpt-5.6-luna
上下文
1.05M
最大输出
128K
发布日期
2026-07-09

面向对话、分类与轻量 Agent 的高速高效 GPT-5.6 模型。高效档位面向高并发对话、分类和轻量 Agent 工作流,强调低延迟。

模态
文本 图片
文本

StepFun

LLM

Step 3.7 Flash

step-3.7-flash
上下文
256K
最大输出
256K
发布日期
2026-05-29

支持原生图像与视频理解的高效率阶跃星辰多模态模型。多模态混合专家设计将大型语言骨干与原生图像、视频理解结合起来。

模态
文本 图片 视频
文本

Tencent

LLM

Hy3

hy3
上下文
256K
最大输出
128K
发布日期
2026-07-06

面向可调节推理与生产级 Agent 的腾讯混合专家模型。可配置的推理强度让生产系统在 Agent 任务中灵活权衡延迟与推理深度。

模态
文本
文本

Tencent

LLM

Hy3 preview

hy3-preview
上下文
256K
最大输出
128K
发布日期
2026-04-23

面向 Agent 工作流与生产评估的高效率腾讯预览模型。预览版提供可配置推理等级,便于高效评估和部署 Agent 工作流。

模态
文本
文本

xAI (Grok)

图片 New

Grok Imagine Image Quality

grok-imagine-image-quality
计费方式
按张计费
发布日期
2026-05-04

面向快速图片生成、编辑与参考图创作的 xAI 高保真模型。

模态
文本 图片
图片

xAI (Grok)

LLM New

Grok 4.5

grok-4.5
上下文
500K
最大输出
128K
发布日期
2026-07-08

面向编程、知识工作、STEM 与复杂推理的前沿 Grok 模型。定位为 xAI 面向前沿编程、知识工作和 STEM 任务的最高能力档位。

模态
文本 图片
文本

xAI (Grok)

LLM

Grok 4.3

grok-4.3
上下文
1M
最大输出
128K
发布日期
2026-04-30

面向 Agent、指令遵循与事实型任务的 Grok 多模态推理模型。结合视觉输入与推理能力,适合注重事实性的指令遵循和 Agent 应用。

模态
文本 图片
文本

Xiaomi Mimo

LLM

MiMo V2 Omni

mimo-v2-omni
上下文
256K
最大输出
128K
发布日期
2026-03-18

面向文本、图像、音频与视频统一理解的小米 MiMo 全模态模型。

模态
文本 图片 音频 视频 文件
文本

Xiaomi Mimo

LLM

MiMo V2 Pro

mimo-v2-pro
上下文
1.05M
最大输出
128K
发布日期
2026-03-18

面向复杂推理、编程与 Agent 工作负载的小米 MiMo 高性能模型。

模态
文本 图片 音频 视频 文件
文本

Xiaomi Mimo

LLM

Mimo V2.5 Pro

mimo-v2.5-pro
上下文
1.05M
最大输出
128K
发布日期
2026-04-27

面向软件工程与长周期 Agent 任务的小米 MiMo 旗舰模型。旗舰版本重点强化通用 Agent 能力、复杂软件工程和长周期执行。

模态
文本 图片 音频 视频 文件
文本

Xiaomi Mimo

LLM

MiMo V2.5

mimo-v2.5
上下文
1.05M
最大输出
128K
发布日期
2026-04-22

兼顾成本与能力、适合 Agent 和视觉理解场景的 MiMo 全模态模型。原生全模态设计以更经济的推理成本提供接近 Pro 的 Agent 表现,并增强视觉理解。

模态
文本 图片 音频 视频 文件
文本

Zhipu AI

图片 New

GLM Image

glm-image
计费方式
按张计费
发布日期
2026-01-14

面向文本引导图片生成与通用视觉创作的智谱图像模型。

模态
文本 图片
图片

Zhipu AI

LLM

GLM-5

glm-5
上下文
200K
最大输出
128K
发布日期
2026-02-11

面向系统设计、编程与长周期 Agent 的 GLM 旗舰开放模型。开放基础模型面向复杂系统设计,以及长周期 Agent 工作流中的生产级编程。

模态
文本
文本

Zhipu AI

LLM

GLM-5 Turbo

glm-5-turbo
上下文
200K
最大输出
128K
发布日期
2026-03-15

针对真实 Agent 环境与高效推理优化的高速 GLM 模型。针对真实世界中使用工具的 Agent 环境进行深度优化,强调快速推理。

模态
文本 图片
文本

Zhipu AI

LLM

GLM-5.1

glm-5.1
上下文
200K
最大输出
128K
发布日期
2026-03-27

强化编程能力与长周期任务持续执行表现的 GLM 模型。编程能力提升重点面向远超短时交互、需要持续独立执行的任务。

模态
文本
文本

Zhipu AI

LLM

GLM-5.2

glm-5.2
上下文
1M
最大输出
128K
发布日期
2026-06-13

面向项目级软件工程与 Agent 的长上下文 GLM 推理模型。大规模推理模型面向项目级软件工程和长周期 Agent 工作流。

模态
文本
文本

目录价按 Gateway 静态预设展示;实际价格与可用性请以供应商为准。

数据与贡献

发现 Model 数据有误?

每张模型卡片都链接到对应预设文件。修正 ID、上下文、模态或目录价后,直接提交 PR。

前往 GitHub 贡献