模型广场

共 46 个模型,覆盖 8 家厂商。按厂商筛选或按价格、上下文排序,找到适合你任务的那一档。

共 46 个模型
OP
GPT-5.6 Sol
OpenAI
GPT-5.6 Sol 是 Sol 系列的标准版本,适合通用问答、文本处理、内容草拟、摘要生成、轻量级代码辅助和业务自动化任务。
1.1M 上下文 128K 输出 2026-07-09
输入¥35/M
输出¥210/M
TH
Hy3
Tencent Hunyuan
腾讯混元3(Hy3)是腾讯混元大语言模型,用于推理、编码、长上下文分析和智能体工作流。常被搜索为腾讯Hy3、Hunyuan 3或简称Hunyuan,它是腾讯混元模型家族的一员,与Hunyuan A13B等版本并列。在Tokiway上,开发者可以在集成到生产应用之前查看当前的腾讯混元3模型ID、API定价、上下文窗口和支持的端点。
256K Token 上下文 128K Token 输出 2026年7月6日
输入¥1/M
输出¥4/M
缓存¥0.25/M
TH
Hy4 preview
Tencent Hunyuan
Hy4 preview 是腾讯混元(Tencent Hunyuan / Tencent Hy)推出并开源的新一代混合专家旗舰大模型,面向编程、办公、科学研究、长上下文理解和复杂智能体工作流等真实生产力场景。作为混元 4(腾讯混元 Hy4)的预览版本,它拥有 7700 亿总参数、每个 token 激活 490 亿参数,并支持超过 1M token 的上下文窗口。模型重点强化了大型代码仓库与长文档理解、多步骤任务规划、工具调用、调试验证和持续任务执行能力。
1M Token 上下文 64K Token 输出 2026年8月28日
输入¥6/M
输出¥18/M
缓存¥0.3/M
MA
Kimi K2.6
Moonshot AI
Kimi K2.6 是一款多功能 AI 模型,兼具强大的推理能力与高效的日常表现。适用于对话式 AI、内容生成、分析、编程辅助和多模态应用。K2.6 在质量、速度和灵活性之间达到了可靠的平衡,适合广泛的生产场景。
262.1K Token 上下文 262.1K Token 输出 2026年4月21日
输入¥6.5/M
输出¥27/M
缓存¥1.1/M
MA
Kimi K2.7 Code
Moonshot AI
Kimi K2.7 Code 是一款面向编程的模型,专为软件工程场景优化。它帮助开发者生成、理解和改进代码,同时处理调试、代码审查、项目分析以及自动化开发工作流等任务。是编程助手、开发者智能体和 AI 驱动的编程工具的强有力选择。
262.1K Token 上下文 262.1K Token 输出 2026年6月12日
输入¥6.5/M
输出¥27/M
缓存¥1.3/M
MA
Kimi K3
Moonshot AI
Kimi K3 是 Moonshot AI 面向长上下文代码、复杂推理和知识工作的旗舰模型。Kimi K3 支持原生视觉输入与 1M token 上下文窗口,适合代码仓库分析、长文档研究、多步骤 Agent 工作流和生产级 AI 应用。你可以通过 Tokiway 查看 Kimi K3 API、Kimi K3 价格、模型能力与 benchmark 结果,再决定是否用于实际业务。
1M Token 上下文 131.1K Token 输出 2026年7月16日
输入¥20/M
输出¥100/M
缓存¥2/M
XM
MiMo V2.5
Xiaomi MiMo
小米 MiMo V2.5 是小米自研的原生多模态混合专家模型,面向生产级 AI 应用。它能理解文本、图像、视频和音频,并为聊天、编程、推理、内容生成和 Agent 工作流生成高质量文本。凭借长上下文设计和工具调用能力,MiMo V2.5 适用于文档分析、多模态助手、结构化提取,以及需要融合多种输入格式的复杂任务。你可以通过 Tokiway 调用 Xiaomi MiMo API,查看当前 MiMo V2.5 的价格、模型 ID、支持端点和模型限制,再决定是否用于生产环境。
1.1M Token 上下文 131.1K Token 输出 2026年4月23日
输入¥0.98/M
输出¥1.96/M
缓存¥0.0196/M
XM
MiMo V2.5 Pro
Xiaomi MiMo
小米 MiMo V2.5 Pro 是小米 MiMo AI 模型系列中的大语言模型(LLM),面向复杂推理、编程、软件工程和多步骤 Agent 工作流。你可以通过 Tokiway 调用 Xiaomi MiMo API,查看当前 MiMo V2.5 Pro 的价格、模型 ID、上下文与最大输出限制、支持模态、端点和基准测试结果,再评估它是否适合集成到生产环境。
1M Token 上下文 128K Token 输出 2026年4月23日
输入¥3/M
输出¥6/M
缓存¥0.025/M
MI
MiniMax M2.5
MiniMax
MiniMax M2.5 被定位为面向真实生产力场景的模型,并在复杂数字环境中训练。官方资料强调它在代码、Agentic Tool Use、搜索和办公任务上的提升,把早期代码能力扩展到 Word、Excel、PowerPoint 等工作流。它的重点不是单纯语言流畅度,而是在复杂实际流程中的执行能力。
204.8K Token 上下文 131.1K Token 输出 2026年2月12日
输入¥2.1/M
输出¥8.4/M
缓存¥0.21/M
MI
MiniMax M2.7
MiniMax
MiniMax M2.7 被介绍为面向生产力和工程任务的模型,强调自主工作流、多 Agent 协作、实时调试和文档交付。公开描述提到根因分析、财务建模,以及 Word/Excel/PowerPoint 类完整文档生成。它更适合被写成“应用型工作模型”,而不是普通聊天或写作模型。
204.8K Token 上下文 131.1K Token 输出 2026年3月18日
输入¥2.1/M
输出¥8.4/M
缓存¥0.42/M
MI
MiniMax M3
MiniMax
MiniMax M3 是 MiniMax 面向长周期 Agent 工作流、代码任务和工具调用的前沿多模态模型,支持 1M token 上下文。其 MiniMax Sparse Attention 旨在降低超长上下文工作负载的成本。你可以通过 Tokiway 调用 MiniMax API,查看当前 MiniMax M3 的价格、模型 ID、支持端点、上下文限制和基准测试结果,再评估它是否适合生产级软件任务或协作式 Agent 工作流。
512K Token 上下文 128K Token 输出 2026年6月1日
输入¥4.2/M
输出¥16.8/M
缓存¥0.84/M
QW
Qwen3.5 35B-A3B
Qwen
Qwen3.5 35B A3B 是一个原生视觉语言 MoE 模型,目标是在较小激活参数下接近更大模型的效果。模型卡强调混合线性注意力、稀疏专家,以及与更大 Qwen3.5 dense 版本相近的表现。它最适合被描述为兼顾效率、多模态推理和代码能力的轻量高效模型。
262.1K Token 上下文 65.5K Token 输出 2026年2月23日
输入¥0.4/M
输出¥3.2/M
QW
Qwen3.5 Flash
Qwen
Qwen3.5 Flash 是 Qwen3.5 原生视觉语言系列中的高效版本。阿里云模型列表将 Flash 定位为面向简单任务的快速、低成本选项,同时继承了 3.5 一代的多模态方向。它适合信息抽取、请求路由、轻量内容生成和高频调用。
262.1K Token 上下文 65.5K Token 输出 2026年2月23日
输入¥0.2/M
输出¥2/M
QW
Qwen3.5 Plus
Qwen
Qwen3.5 Plus 是 Qwen3.5 系列中的均衡版本,通常被介绍为原生视觉语言模型,并在托管服务中提供较强效率和较大上下文能力。官方和三方资料将它与图像/视频理解、通用文本任务和内置工具能力联系在一起。它处在 Flash 的速度取向和 Max 的能力取向之间。
1M Token 上下文 65.5K Token 输出 2026年2月16日
输入¥0.8/M
输出¥4.8/M
QW
Qwen3.6 35B-A3B
Qwen
Qwen3.6 35B A3B 是一个激活参数较小的 MoE 模型:相关来源描述为 35B 总参数、约 3B 激活参数,并具备可扩展到接近 1M token 的长上下文能力。官方资料还提到它在代码任务上可以与更大的 dense 模型竞争。它的核心价值是部署效率高,同时保留不错的代码和长上下文能力。
262.1K Token 上下文 65.5K Token 输出 2026年4月17日
输入¥1.8/M
输出¥10.8/M
QW
Qwen3.6 Flash
Qwen
Qwen3.6 Flash 是 Qwen3.6 系列中更强调速度的版本。相关来源提到它支持文本、图片和视频输入、Prompt Caching,以及 1M token 上下文窗口,这让它在快速模型里有较强的长上下文和多模态特征。它更适合高并发、多模态和长上下文任务中对速度与成本敏感的场景。
1M Token 上下文 65.5K Token 输出 2026年4月27日
输入¥1.2/M
输出¥7.2/M
QW
Qwen3.6 Max Preview
Qwen
Qwen3.6 Max 通常被视为 Qwen3.6 一代中更高能力的档位。可参考的三方资料强调大规模稀疏 MoE 架构、更强的 Agentic Coding,以及面向工具调用的行为。它的描述应聚焦软件工程、推理和自主工作流执行,而不是只写“更好的文本生成”。
262.1K Token 上下文 65.5K Token 输出 2026年4月20日
输入¥9/M
输出¥54/M
QW
Qwen3.6 Plus
Qwen
Qwen3.6 Plus 的介绍重点在混合线性注意力与稀疏 MoE 架构,并强调 Agentic Coding、前端开发和推理任务的提升。公开模型卡提到仓库级任务、交互式前端生成,以及 SWE 类评测表现。它的定位更接近开发者与生产力模型,而不只是普通对话助手。
1M Token 上下文 65.5K Token 输出 2026年4月2日
输入¥2/M
输出¥12/M
QW
Qwen3.7 Max
Qwen
Qwen3.7 Max 被定位为 Qwen3.7 一代的旗舰模型,官方叙事重点是面向 Agent 时代。相关模型卡强调 Agent 工作流、代码、办公/生产力任务,以及长周期自主执行能力。它不应该只被写成“更大的聊天模型”,而应该描述为面向复杂工作的高能力通用模型。
1M Token 上下文 65.5K Token 输出 2026年5月21日
输入¥12/M
输出¥36/M
缓存¥2.4/M
QW
Qwen3.7 Plus
Qwen
Qwen3.7 Plus 延续 Qwen3.7 面向 Agent 的设计方向,但更偏性价比。三方模型卡描述它支持文本和图片输入,并强化视觉语言能力,以及 GUI、移动端导航、视觉参考等混合 Agent 任务。它适合需要 Qwen3.7 新一代能力,但不一定需要 Max 档位成本的场景。
1M Token 上下文 64K Token 输出 2026年6月2日
输入¥2/M
输出¥8/M
缓存¥0.4/M
QW
Qwen3.8 Max
Qwen
Qwen3.8-Max 是通义千问一款拥有 2.4 万亿参数的 MoE 旗舰模型,面向高级推理、编程、企业生产力和 Agent 工作流。它能够处理从软件开发到专业工作流的复杂长期任务,适用于法律、金融和设计等生产场景;其原生多模态能力可理解长上下文中的文本、图像和视频,并支持复杂工作流中的规划、执行、验证和持续迭代。你可以通过 Tokiway 调用 Qwen API,查看当前 Qwen3.8 Max 的价格、模型 ID、上下文与最大输出限制、支持模态、端点和基准测试结果,再决定是否用于生产环境。
1M Token 上下文 128K Token 输出 2026年8月3日
输入¥14/M
输出¥42/M
缓存¥1.75/M
其他
Step 3.7 Flash
其他
StepFun Step 3.7 Flash 是阶跃星辰推出的高效多模态混合专家(MoE)模型,面向生产级 Agent 工作流和开发者任务。它支持原生文本与图像理解、256K 上下文窗口和灵活推理,适合编程、视觉与文档分析、工具调用、搜索增强任务及复杂的多步骤智能体工作流。其稀疏的 198B 架构每个 token 仅激活约 11B 参数,在推理与多模态性能之间兼顾了推理效率。你可以通过 Tokiway 调用 StepFun API / 阶跃星辰 API,查看当前 Step 3.7 Flash 的价格、模型 ID、支持端点和使用限制,再决定是否集成到生产环境。
256K Token 上下文 256K Token 输出 2026年5月29日
输入¥1.4/M
输出¥8.05/M
缓存¥0.28/M
‹ 1 2