Alibaba Cloud
LLMQwen3.8 Max Preview
qwen3.8-max-preview 面向复杂推理、编程与企业级 Agent 工作流的 Qwen 旗舰预览模型。
这里展示的是 OctaFuse Gateway 当前内置、可在 Admin 中直接导入的静态预设。Gateway 仍支持创建任意自定义 Provider、Model 和兼容端点;未列出不代表不支持。
Alibaba Cloud
LLMqwen3.8-max-preview 面向复杂推理、编程与企业级 Agent 工作流的 Qwen 旗舰预览模型。
Alibaba Cloud
LLMqwen3.7-plus 兼顾成本与效果的 Qwen 多模态模型,适合通用推理、视觉理解与生产应用。兼顾文本与图像理解,并以更具成本效率的设计服务于生产级多模态推理。
Alibaba Cloud
LLMqwen3.7-max Qwen3.7 旗舰模型,重点优化编程、生产力任务与 Agent 工作流。其 Agent 导向设计重点覆盖编程、办公生产力和复杂多步骤任务。
Alibaba Cloud
LLMqwen3.6-plus 兼顾推理能力与推理效率、适合长上下文任务的 Qwen 模型。通过高效线性注意力与稀疏专家路由的混合架构,提升扩展性和推理效率。
Alibaba Cloud
LLMqwen3.6-max 面向高难度推理、编程与知识工作的高性能 Qwen 模型。
Alibaba Cloud
LLMqwen3.6-flash 具备大上下文能力的高速 Qwen 多模态模型,适合高吞吐工作负载。支持文本、图像和视频输入,并以长上下文能力面向延迟敏感的多模态应用。
Alibaba Cloud
LLMqwen3.5-plus 适合通用对话、推理、编程与多模态任务的均衡型 Qwen 模型。
Alibaba Cloud
LLMqwen3.5-flash 面向低延迟对话、信息抽取与轻量 Agent 场景的 Qwen 模型。
Alibaba Cloud
LLMqwen3-vl-plus 面向文档、图像、屏幕理解与视觉推理任务的视觉语言模型。
Alibaba Cloud
LLMqwen3.5-omni-plus 可统一理解文本、图像、音频与视频的全能力 Qwen 多模态模型。
Alibaba Cloud
LLMqwen3.5-omni-flash 面向实时多模态理解与交互的高速 Qwen Omni 模型。
Anthropic
LLMclaude-fable-5 面向自主知识工作、编程和多模态 Agent 的 Anthropic 模型。定位于自主知识工作与编程,支持多模态输入、推理及工具驱动工作流。
Anthropic
LLMclaude-sonnet-5 适合编程、专业工作与自适应 Agent 推理的前沿 Sonnet 模型。自适应推理等级可在前沿编程与 Agent 能力、延迟和 Token 消耗之间灵活取舍。
Anthropic
LLMclaude-opus-5 Anthropic 旗舰模型,面向复杂推理、编程、视觉分析与长时间 Agent 任务。尤其擅长端到端软件任务、代码审查与缺陷定位、文档和图表分析、复杂办公交付、工具调用及并行子 Agent 协作。
Anthropic
LLMclaude-opus-4.8 适合长上下文推理、编程与多模态分析的高性能 Opus 模型。结合多模态输入、推理能力与长上下文窗口,适合高要求的通用工作流。
Anthropic
LLMclaude-opus-4.7 面向长时间异步 Agent 与复杂软件工作流的 Opus 模型。面向需要长时间持续执行编程与专业任务的异步 Agent。
Anthropic
LLMclaude-opus-4.6 面向端到端编程与长时间专业工作流的高性能 Claude 模型。针对贯穿完整软件与专业工作流的 Agent 优化,而不仅是处理孤立提示词。
Anthropic
LLMclaude-sonnet-4.6 适合迭代开发、Agent 与专业知识工作的均衡型前沿模型。优势包括迭代开发、复杂代码库导航,以及借助工具完成端到端项目执行。
Anthropic
LLMclaude-haiku-4.5 适合低延迟对话、编程和 Agent 任务的高速高效 Claude 模型。以显著更低的延迟和成本提供接近前沿水平的能力,适合高并发交互式任务。
ByteDance
图片 Newdoubao-seedream-5-0-pro 面向高保真图片生成与专业视觉创作的 Seedream 高质量模型。
ByteDance
图片doubao-seedream-5-0 适合通用图片生成、编辑与视觉设计工作流的 Seedream 模型。
ByteDance
LLMdoubao-seed-2-0-mini-260215 面向快速对话、成本敏感与轻量推理场景的紧凑型豆包模型。
ByteDance
LLMdoubao-seed-2-0-lite-260215 针对高吞吐文本与视觉工作负载优化的轻量豆包模型。
ByteDance
LLMdoubao-seed-2-0-pro-260215 适合高级推理、多模态理解与 Agent 场景的高性能豆包模型。
ByteDance
LLMdoubao-seed-2-1-pro-260628 面向复杂推理、编程与多模态生产应用的新一代豆包 Pro 模型。
ByteDance
LLMdoubao-seed-2-1-turbo-260628 面向高响应多模态应用与 Agent 的低延迟豆包模型。
ByteDance
LLMdoubao-seed-evolving 面向自适应推理与 Agent 实验场景的持续演进型豆包模型。
DeepSeek
LLMdeepseek-v3.2 兼顾推理效率、复杂推理与 Agent 工具调用能力的 DeepSeek 模型。稀疏注意力设计旨在提高长上下文推理效率,同时保持较强的工具调用表现。
DeepSeek
LLMdeepseek-v4-flash 面向长上下文推理与编程任务的高速 DeepSeek 混合专家模型。效率优先的混合专家架构仅激活少量参数,以实现快速的长上下文推理。
DeepSeek
LLMdeepseek-v4-pro 面向高级推理、编程与 Agent 的大型 DeepSeek 混合专家模型。大规模混合专家架构面向高级推理、编程和持续运行的 Agent 任务。
gemini-3.1-flash-image 结合多模态推理能力的高速 Google 图片生成与编辑模型。亦称 Nano Banana 2,将高速生成与高级编辑和多模态视觉推理结合起来。
gemini-3-pro-image-preview Google 高级图片生成预览模型,擅长有依据的创作与精细视觉编辑。基于 Gemini 3 Pro,强调有依据的创作、更强的多模态推理和精细图像编辑。
gemini-3.6-flash 面向编程、Agent、Web 与应用开发的高效率 Gemini 模型。面向 Agent 工作流中的编程与应用开发,力求以更少的无效修改产出更成熟的结果。
gemini-3.1-pro-preview 面向软件工程与高可靠 Agent 工作流的前沿 Gemini 推理预览模型。该预览版在复杂工作流中强化软件工程表现、Agent 可靠性和 Token 效率。
gemini-3-flash-preview 适合多轮对话、编程与 Agent 工作流的高速 Gemini 思考模型。以 Flash 级速度提供接近 Pro 的推理与工具调用能力,适用于多轮对话、编程和 Agent。
gemini-3.5-flash 在编程、推理与并行 Agent 场景表现出色的高效 Gemini 多模态模型。在更高效的档位提供接近 Pro 的编程和推理能力,并针对并行 Agent 执行优化。
gemini-3.5-flash-lite 面向专注型子 Agent 与高流量生产任务的轻量 Gemini 模型。轻量化设计尤其适合大型多 Agent 系统中执行明确子任务的子 Agent。
gemini-3.1-flash-lite-preview 针对高流量、延迟敏感应用优化的高效率 Gemini 预览模型。针对高吞吐工作负载优化,同时力求接近更大型 Flash 模型的质量。
gemini-2.5-pro 适合编程、数学、科学与多模态分析的高性能 Gemini 推理模型。内置思考能力可在高级编程、数学、科学和多模态分析中给出更审慎的回答。
gemini-2.5-flash 在推理质量、速度与多模态能力之间取得平衡的 Gemini 主力模型。在编程、数学、科学和多模态生产任务中平衡内置推理能力与主力级吞吐量。
gemini-2.5-flash-lite 针对高吞吐与快速生成优化的低成本 Gemini 推理模型。重点优化超低延迟、低成本、高吞吐和快速 Token 生成。
Meituan LongCat
LLM Newlongcat-2.0 美团稀疏专家模型,适合编程、代码仓库任务与长周期 Agent。稀疏专家架构面向仓库级编程、长周期问题求解和 Agent 执行。
MiniMax
LLMminimax-m2.5 面向实际生产力、编程与真实数字化工作的 MiniMax 模型。通过多样化数字工作环境训练,将编程基础能力扩展到实用的端到端生产力任务。
MiniMax
LLMminimax-m2.7 面向自主生产力与多 Agent 协作的 Agent 型 MiniMax 模型。强调真实工作场景中的自主生产力、多 Agent 协作和持续改进。
MiniMax
LLMminimax-m3 适合编程、知识工作与 Agent 的长上下文 MiniMax 多模态模型。多模态基础能力面向长周期 Agent、编程和长上下文知识工作。
Moonshot AI
LLMkimi-k2.5 面向视觉编程与协同 Agent 工作流的原生多模态 Kimi 模型。将原生多模态理解、视觉编程与自主 Agent 集群范式结合起来。
Moonshot AI
LLMkimi-k2.6 面向长周期编程、UI 生成与 Agent 编排的多模态 Kimi 模型。面向长周期编程、代码驱动的 UI 生成,以及复杂项目中的多 Agent 协同执行。
Moonshot AI
LLMkimi-k2.7-code 面向长上下文端到端编程任务、强调可靠性的 Kimi Code 模型。以编程为中心,旨在长上下文中可靠完成端到端开发任务。
Moonshot AI
LLMkimi-k3 面向复杂编程、推理与 Agent 工作的开放权重 Kimi 多模态模型。这款开放权重多模态推理模型面向复杂编程、知识工作和长时间运行的 Agent。
OpenAI
图片gpt-image-2 用于专用 Images API 的 OpenAI 高保真图片生成与编辑模型。
OpenAI
LLMgpt-5.2 具备自适应推理能力、适合编程、Agent 与长上下文工作的前沿 GPT 模型。自适应推理会根据任务难度分配计算资源,以提升 Agent 与长上下文表现。
OpenAI
LLMgpt-5.4 面向高级推理、编程、多模态输入与专业工作流的旗舰 GPT 模型。统一通用 GPT 与编程能力,面向大上下文专业工作和工具驱动执行。
OpenAI
LLMgpt-5.4-mini 面向高吞吐推理、编程与多模态应用的高速 GPT-5.4 变体。较小规模版本保留较强推理和编程能力,同时提高速度与吞吐量。
OpenAI
LLMgpt-5.4-nano 针对低延迟、高流量与成本敏感任务优化的紧凑型 GPT 模型。针对强调速度的分类、抽取、路由及其他高并发轻量任务优化。
OpenAI
LLMgpt-5.5 面向复杂专业工作、强化推理能力与可靠性的前沿 GPT 模型。在保留长上下文能力的同时,提高困难专业任务上的可靠性和 Token 效率。
OpenAI
LLMgpt-5.6 面向高级推理、编程与通用 Agent 工作流的 GPT-5.6 系列模型。
OpenAI
LLMgpt-5.6-sol GPT-5.6 旗舰模型,适合高难度推理、编程与多步骤 Agent 任务。旗舰档位尤其擅长命令行工作和复杂的多步骤编程流程。
OpenAI
LLMgpt-5.6-terra 面向日常编程、推理与 Agent 应用的均衡型 GPT-5.6 模型。平衡档位在旗舰质量与成本效率之间取舍,适合日常编程、推理和 Agent。
OpenAI
LLMgpt-5.6-luna 面向对话、分类与轻量 Agent 的高速高效 GPT-5.6 模型。高效档位面向高并发对话、分类和轻量 Agent 工作流,强调低延迟。
StepFun
LLMstep-3.7-flash 支持原生图像与视频理解的高效率阶跃星辰多模态模型。多模态混合专家设计将大型语言骨干与原生图像、视频理解结合起来。
Tencent
LLMhy3 面向可调节推理与生产级 Agent 的腾讯混合专家模型。可配置的推理强度让生产系统在 Agent 任务中灵活权衡延迟与推理深度。
Tencent
LLMhy3-preview 面向 Agent 工作流与生产评估的高效率腾讯预览模型。预览版提供可配置推理等级,便于高效评估和部署 Agent 工作流。
xAI (Grok)
图片 Newgrok-imagine-image-quality 面向快速图片生成、编辑与参考图创作的 xAI 高保真模型。
xAI (Grok)
LLM Newgrok-4.5 面向编程、知识工作、STEM 与复杂推理的前沿 Grok 模型。定位为 xAI 面向前沿编程、知识工作和 STEM 任务的最高能力档位。
xAI (Grok)
LLMgrok-4.3 面向 Agent、指令遵循与事实型任务的 Grok 多模态推理模型。结合视觉输入与推理能力,适合注重事实性的指令遵循和 Agent 应用。
Xiaomi Mimo
LLMmimo-v2-omni 面向文本、图像、音频与视频统一理解的小米 MiMo 全模态模型。
Xiaomi Mimo
LLMmimo-v2-pro 面向复杂推理、编程与 Agent 工作负载的小米 MiMo 高性能模型。
Xiaomi Mimo
LLMmimo-v2.5-pro 面向软件工程与长周期 Agent 任务的小米 MiMo 旗舰模型。旗舰版本重点强化通用 Agent 能力、复杂软件工程和长周期执行。
Xiaomi Mimo
LLMmimo-v2.5 兼顾成本与能力、适合 Agent 和视觉理解场景的 MiMo 全模态模型。原生全模态设计以更经济的推理成本提供接近 Pro 的 Agent 表现,并增强视觉理解。
Zhipu AI
图片 Newglm-image 面向文本引导图片生成与通用视觉创作的智谱图像模型。
Zhipu AI
LLMglm-5 面向系统设计、编程与长周期 Agent 的 GLM 旗舰开放模型。开放基础模型面向复杂系统设计,以及长周期 Agent 工作流中的生产级编程。
Zhipu AI
LLMglm-5-turbo 针对真实 Agent 环境与高效推理优化的高速 GLM 模型。针对真实世界中使用工具的 Agent 环境进行深度优化,强调快速推理。
Zhipu AI
LLMglm-5.1 强化编程能力与长周期任务持续执行表现的 GLM 模型。编程能力提升重点面向远超短时交互、需要持续独立执行的任务。
Zhipu AI
LLMglm-5.2 面向项目级软件工程与 Agent 的长上下文 GLM 推理模型。大规模推理模型面向项目级软件工程和长周期 Agent 工作流。
换个关键词,或清除筛选后再试。
目录价按 Gateway 静态预设展示;实际价格与可用性请以供应商为准。
数据与贡献
每张模型卡片都链接到对应预设文件。修正 ID、上下文、模态或目录价后,直接提交 PR。