腾讯Hy4 preview是腾讯推出的混合专家模型,总参数规模达7700亿,其中激活参数为490亿。该模型专为编码智能体、复杂工具使用工作流及生产力任务设计,能够适配多场景下的专业需求,助力提升相关任务的执行效率与完成质量。
模型发布
模型对比Ling 3.0 Flash Fin (free)是InclusionAI推出的一款聚焦金融领域的混合专家模型,基于Ling 3.0 Flash打造,总参数达1240亿,其中激活参数为51亿,专为现实场景中的投资相关需求设计,可助力用户处理各类金融场景下的专业任务。
Qwen3.8 Flash 是阿里巴巴推出的多模态推理模型,适用于代码辅助、智能体工作流、视觉理解、文档与代码库分析、桌面交互、图表分析以及长视频分析等多种场景,能够为用户提供覆盖多领域的智能支持。
Z.ai推出的GLM 5.3 Flash是一款原生多模态模型,适用于高效编码与长周期智能体任务。它采用混合稀疏与线性注意力架构,在维持精准长上下文表现的同时,还能兼顾运行效率,可支撑各类对算力与响应速度有要求的场景应用。
Muse Spark 1.2 Contributor 是 Meta 推出的推理模型,专为希望以更低成本启动开发工作的开发者设计,其成本显著低于 Muse Spark 基础版本,能为开发者提供更具性价比的开发选择,助力开发者降低初期开发的成本门槛,轻松开启相关项目的搭建工作。
DeepSeek V4 Flash Vision Exp 是深度求索(DeepSeek)推出的实验性视觉增强版本,基于 DeepSeek V4 Flash 0731 开发,在保留基础模型文本能力(包括智能体功能)的同时,新增了图像理解能力,为用户提供兼具文本处理与视觉分析的实验性交互体验。
Ox Alpha是一款专为编程、持续性智能体工作及生产负载打造的推理模型,适配长周期软件工程、复杂推理,以及文本与其他内容结合的各类工作流程,能为开发者及相关从业者提供可靠的推理支撑,助力完成各类需要深度逻辑与持续执行的任务。
Hy-MT2-1.8B是腾讯推出的一款参数规模为18亿的轻量化翻译模型,支持33种语言对,还覆盖5种汉语方言及少数民族语言对,具备结构化、基于分隔符、上下文关联、基于术语表以及风格引导的翻译工作流程,可满足多样化的翻译场景需求。
Tencent的Hy-MT2-30B-A3B是Hy-MT2系列的旗舰翻译模型,支持33种语言对,以及5种中文方言和少数民族语言对,具备结构化、基于分隔符、上下文关联、基于术语表等多种翻译工作流程,可满足不同场景下的专业翻译需求。
Z.ai: GLM Latest 是一款始终会跳转至 Z.ai 旗下最新 GLM 模型的专用模型,它能为用户提供该品牌迭代后的最新 GLM 模型资源,方便用户及时获取 Z.ai 推出的最新版 GLM 模型服务,无需手动查找或切换不同版本,有效简化了用户获取对应模型的操作流程。
腾讯Hy-MT2-7B是一款拥有70亿参数的翻译模型,支持33种语言对,还覆盖5组汉语方言及少数民族语言对,可实现结构化、基于分隔符、结合上下文、依托术语表以及风格引导的翻译工作流,能适配多样化的翻译需求。
Z.ai推出的GLM 5.3是一款面向复杂软件工程与长周期智能体任务的大规模推理模型,支持文本输入与输出,具备1M token的上下文窗口,在相关任务的推理能力与任务处理效率上实现了显著提升,能够为开发者及相关场景提供更可靠的智能支持。
Qwen3.8 27B 是来自通义千问(Qwen)的开源权重密集型多模态模型,适用于代码开发、专业工作流、学术研究、多模态交互以及长周期智能体任务,具备灵活的思考能力,能够适配各类复杂场景的需求。
Dots3-Note Preview是Dots Studio推出的开放权重混合专家模型,总参数规模达280B,激活参数为16B,是Dots 3系列中最轻量的模型,具备适配轻量化部署场景的特性,可满足对资源占用要求较高的轻量应用需求。
Gemini 3.7 Flash是谷歌推出的多模态模型,专为快速智能体工作流、代码开发及复杂多步骤推理任务打造,适配对响应性能和可靠多步骤执行有要求的各类场景,能高效支撑需要多环节推进的专业工作与复杂问题处理,兼顾运行速度与任务完成的稳定性。
ByteDance Seed推出的Seed 2.1 Turbo是一款多模态模型,专注于代码开发与长周期智能体工作流场景,适配端到端软件交付、多步骤任务执行以及视觉内容理解等需求,能够为开发者和相关业务场景提供高效的技术支持。
Qwen3.8 2.4T A95B 是来自通义千问(Qwen)的开放权重稀疏混合专家模型,也是 Qwen3.8 Max 的开放权重版本,其总参数规模达2.4万亿,其中激活参数为950亿,具备开放使用的特性,可支持相关领域的研究与应用开发。
ByteDance Seed推出的Seed-2.0-Code是一款专为智能体编程场景优化的模型,适配前端开发、多语言编程任务,还可适配Claude等工具中的编程智能体工作流,能为相关编程场景提供针对性的技术支持。
DeepSeek V4 Pro 0813 是深度求索(DeepSeek)推出的大规模混合专家模型,属于 DeepSeek V4 Pro 的正式发布版本。该模型依托混合专家架构设计,具备适配复杂任务的能力,为用户提供专业的模型服务支持。
SpaceXAI推出的Grok 4.6是该公司目前性能最强的智能模型,在编程、知识处理以及科学、技术、工程和数学(STEM)领域都具备前沿水平的表现,能够为用户提供专业且高效的相关领域支持。
LFM2.5-2.6B是Liquid AI推出的一款轻量级推理模型,适配智能体工作流、数据提取、检索增强生成(RAG)以及长文本处理场景。Liquid AI建议不要将其用于智能体编码或其他不适合的任务,该模型为免费使用版本,模型名称为LiquidAI: LFM2.5-2.6B (free)。
NVIDIA Nemotron 3.5 Lightning 是 NVIDIA 推出的开源混合专家模型,总参数规模达 30B,其中激活参数为 3B。该模型适配高吞吐量的智能体工作负载,也能胜任各类专业任务,凭借轻量化的架构设计,可在保障性能的同时兼顾运行效率,为相关场景提供可靠的模型支撑。
NVIDIA Nemotron 3.5 Lightning 是 NVIDIA 推出的一款混合专家开源模型,总参数规模达 30B,其中激活参数为 3B。该模型适配高吞吐量的智能体工作负载,也能胜任各类专业任务,可满足不同场景下对模型性能与资源适配的多元需求,为相关技术应用提供灵活且高效的支撑。
Sakana Namazu是Sakana AI推出的一款面向日语场景的专用推理模型,它基于Kimi K2.6模型开发,额外针对日语语言特性及商务场景进行了专项训练,能够很好地适配日语指令遵循相关的各类任务需求。
Solar Pro 4是Upstage推出的高性价比大语言模型,拥有524K的上下文窗口,专为长周期任务和智能体工作流程打造,在办公生产力、文档密集型处理等场景具备出色能力,能够高效应对需要处理海量上下文信息的复杂任务,为用户提供稳定可靠的AI支持。
Muse Glimmer 30B是Meta超级智能实验室推出的一款密集型开放权重多模态模型,由Muse Spark蒸馏而来,专为消费级硬件上的自主智能体优化设计,适配长周期任务场景,可在普通消费级硬件上高效运行,为自主智能体提供多模态交互与任务处理能力。
inclusionAI: Ling 3.0 Tiny (free) 是 InclusionAI 推出的混合专家模型,总参数规模达79亿,其中激活参数为13亿。该模型专为响应式智能体、指令遵循及多轮对话场景设计,具备可切换的功能特性,能适配不同交互需求,为用户提供流畅的对话与指令执行体验。
Muse Spark 1.2是Meta推出的一款推理模型,专为复杂智能体任务设计。它支持接收文本、图像、视频、音频及PDF文档作为输入,输出格式为文本,且具备1M token的上下文窗口,可满足多模态复杂任务的处理需求。
Qwen3.8 Max 是阿里巴巴通义千问(Qwen)3.8系列的旗舰模型,是Qwen3.8 Max预览版的正式可用迭代版本,属于多模态推理模型,主要面向复杂推理、视觉理解等场景,能够为用户提供专业的多维度智能服务,适配各类需要深度逻辑分析与视觉信息处理的任务需求。
DeepSeek V4 Flash 0731 是深度求索(DeepSeek)推出的稀疏混合专家模型,总参数规模达2840亿,其中激活参数为130亿。这一经过二次训练优化的版本,适配编码、逻辑推理以及智能体相关的各类工作流程,能为对应场景提供高效的模型支持。
Inkling Small 是 Thinking Machines Lab 推出的一款开放权重多模态混合专家模型,总参数规模达2760亿,其中激活参数为120亿,定位为该系列中规模更小、效率更高的成员,兼具多模态处理能力与轻量化部署优势,适配对算力资源要求更严苛的场景需求,可灵活应用于各类多模态交互任务。
Inkling Small 是 Thinking Machines Lab 推出的开源多模态混合专家模型,总参数达2760亿,其中激活参数为120亿,定位为该系列中体积更小、效率更高的成员,具备多模态处理能力,可适配各类轻量化场景的智能任务需求。
Qwen3.7 Flash是阿里巴巴推出的多模态视觉语言推理模型,适配多模态智能体、视觉编码、搜索及计算机交互场景,在物体识别、空间理解等方面具备突出优势,可有效支撑各类需要视觉与语言结合的智能任务,为相关应用场景提供可靠的技术支撑。
Claude Opus 5是Anthropic推出的旗舰模型,专为高难度推理、编程及长周期智能体任务打造,在端到端软件任务、代码审查与漏洞排查、视觉分析等领域表现尤为突出,能够为复杂专业场景提供可靠的技术支持与解决方案。
Ling-3.0-flash(免费版)是一款拥有1240亿参数的混合专家(MoE)模型,每个token激活的参数约为51亿个。该模型以token效率和生产级智能体推理为核心设计重点,能够为开发者提供稳定高效的技术支撑,助力其构建各类智能应用场景,满足不同开发需求。
Ling-3.0-flash是一款拥有1240亿参数的混合专家(MoE)模型,每个token激活的参数约为51亿。该模型以token效率和生产级智能体推理为核心设计重点,能够为开发者提供适配大规模落地场景的高性能推理能力,助力各类智能应用的高效开发与部署。
Laguna S 2.1 是 Poolside 推出的最新代码智能体模型,总参数规模达1180亿,其中激活参数为80亿,在 Terminal-Bench 2.1 测试中取得了70.2%的成绩,专为代码开发场景设计,能够高效完成各类编码相关任务,助力开发者提升编程效率。
Poolside推出的Laguna S 2.1是一款免费的代码智能体模型,也是该团队最新的代码智能体产品。这款模型总参数规模达1180亿,激活参数为80亿,在Terminal-Bench 2.1测试中取得了70.2%的成绩,能够为开发者提供高效的代码相关辅助支持,适配各类编程场景的需求。
Gemini 3.6 Flash是谷歌推出的一款高效模型,适用于编程、智能体工作流以及网页与应用开发场景。该模型旨在生成经过打磨的输出结果,减少不必要的修改,助力开发者提升工作效率,为各类开发任务提供可靠的技术支持。
Gemini 3.5 Flash Lite是谷歌推出的高效模型,具备升级后的智能体能力,适用于在复杂多智能体工作流中执行聚焦任务的子智能体,能够为这类子智能体提供可靠的性能支撑,助力相关工作流高效运转。
LongCat 2.0是美团推出的稀疏混合专家语言模型,总参数规模达1.6万亿,其中激活参数为480亿。该模型适配代码编写、仓库级代码变更、长周期问题解决以及智能体相关任务场景,能为对应领域的复杂需求提供支持。
Inkling是Thinking Machines Lab推出的一款开放权重的混合专家多模态模型,总参数规模达9750亿,其中激活参数为410亿。该模型专为通用推理、代码生成、智能体开发及工具调用系统设计,可适配多场景下的复杂任务需求。
Inkling 是 Thinking Machines Lab 推出的一款开放权重的混合专家多模态模型,总参数规模达9750亿,其中激活参数为410亿。该模型专为通用推理、代码开发、智能体构建及工具调用系统设计,可适配多场景下的复杂任务需求。
Auto Router (Beta) 是 OpenRouter 推出的一款任务感知型路由工具,它会对每一条请求进行分类,再根据聚合消费数据,将请求路由至对应任务下最受欢迎的模型,且路由过程会结合用户设置的筛选条件进行调整。
Kimi K3是Moonshot AI推出的拥有2.8万亿参数的开源多模态推理模型,适用于复杂编码、知识工作以及长周期智能体工作流,在相关任务领域具备突出的性能表现,能够为用户提供高效的多模态推理支持,助力各类专业场景下的任务完成。
Meta: Muse Spark 1.1 是 Meta 推出的多模态推理模型,专为智能体任务打造。它支持接收文本、图像、视频、音频及 PDF 文档作为输入,输出文本内容,具备 100 万 token 的上下文窗口,可适配需要处理多类型信息的复杂智能体场景,助力完成各类需要整合多模态数据的推理与交互任务。
Kwaipilot旗下的KAT-Coder-Air V2.5是一款旗舰级智能编码智能体模型,可直接承接完整的开发需求或业务工作流程,自主定位问题并完成相关编码与落地任务,无需人工介入即可高效推进全流程开发工作,为开发者提供便捷、智能的编码辅助支持。
Kwaipilot旗下的KAT-Coder-Pro V2.5是一款旗舰级智能编码模型,可直接将完整的任务需求或业务工作流程交付给它,使其能够自主定位问题并完成相关编码与落地工作,为开发者提供高效的智能编码支持,助力提升软件开发的整体效率与质量。
OpenAI推出的GPT-5.6 Luna Pro,其底层模型与GPT-5.6 Luna一致,仅将推理模式(reasoning.mode)设置为“pro”,以此在复杂任务中提供更高质量的响应。用户可通过OpenAI官方开发者文档了解更多相关信息,文档链接为https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode。
GPT-5.6 Luna是OpenAI GPT-5.6系列中一款快速且成本高效的模型,适用于高吞吐量、对延迟敏感的任务,例如对话交互、文本分类以及轻量级智能体工作流,能够为各类场景提供可靠的推理支持,助力相关任务高效落地。
OpenAI推出的GPT-5.6 Terra Pro,其底层模型与GPT-5.6 Terra一致,仅将推理模式(reasoning.mode)设置为“pro”,以此为用户在处理复杂任务时提供更高质量的响应。如需了解更多信息,可查阅OpenAI官方文档,相关内容可通过指定的开发者文档链接获取。
GPT-5.6 Terra是OpenAI GPT-5.6系列中的一款均衡型模型,定位介于旗舰级Sol tier与高性价比的Luna tier之间,适配日常编码、逻辑推理及智能体相关的各类场景,可满足用户在常规任务中的多元需求,兼顾性能与成本的平衡。
OpenAI推出的GPT-5.6 Sol Pro,其底层模型与GPT-5.6 Sol一致,仅将推理模式(reasoning.mode)设置为“pro”,以此为用户在复杂任务中提供更高质量的响应。如需了解更多信息,可查阅OpenAI官方文档,相关内容可通过指定的开发者文档链接获取。
OpenAI推出的GPT-5.6 Sol是GPT-5.6系列的旗舰模型,适配复杂推理、编程及智能体工作流场景,在命令行操作与多步骤编程任务上表现尤为突出,能够为相关专业场景提供高效可靠的技术支持。
SpaceXAI推出的Grok 4.5是一款具备前沿性能的模型,在编程、知识工作以及STEM领域均展现出出色的表现,能够为相关场景提供可靠的技术支持与高效的解决方案。
该模型会始终跳转至xAI推出的最新版Grok模型,为用户提供xAI迭代更新后的最新版本模型服务,确保用户能获取到该品牌下Grok系列模型的最新可用版本,无需手动查找或切换不同版本,即可直接使用xAI官方推出的最新Grok模型功能。
AionLabs推出的Aion-3.0-Mini是一款基于DeepSeek系列模型构建的多模态角色扮演与故事创作系统,采用协同生成机制,由多个具备专项能力的模型共同参与内容生成,可为用户带来丰富的互动式内容创作与角色扮演体验。
AionLabs推出的Aion-3.0是一款基于GLM系列模型构建的多模型角色扮演与故事创作系统,采用协同生成机制,由多个具备专项能力的模型共同参与内容创作,可支撑丰富的角色扮演场景与连贯的故事叙事需求,为用户提供灵活且多元的互动创作体验。
Hy3是腾讯推出的2950亿参数混合专家模型,采用192个专家、顶8路由的架构,其中激活参数为210亿,专为推理、智能体工作流及实际生产场景打造。该模型支持可配置的推理强度,能适配不同复杂度的任务需求,兼顾性能与灵活性,可满足各类专业场景下的高效应用诉求。
Hy3是腾讯推出的一款2950亿参数混合专家模型,拥有192个专家模块,采用前8路由机制,其中激活参数为210亿,专为推理、智能体工作流及实际生产场景打造。该模型支持可配置的推理强度设置,能适配不同复杂度的任务需求,为各类生产级应用提供可靠的智能支撑。
Poolside: Laguna XS 2.1 是 Poolside 推出的 33B-A3B 类别下的最新编码智能体模型,是该团队继 2026 年 4 月发布的 Laguna XS.2 模型之后的又一进阶成果,它融合了更先进的技术架构与优化的编码逻辑,能够为开发者提供更高效、精准的代码生成与调试支持,助力各类编程任务的落地实现。
Poolside推出的Laguna XS 2.1(免费版)是33B-A3B类别下的最新编码智能体模型,是该团队2026年4月发布的Laguna XS.2模型的迭代升级版本,它融合了多项优化技术,在代码生成、调试与执行等核心编码任务上的表现较前代模型有明显提升,能为开发者提供更高效、精准的编码辅助支持。
Claude Sonnet 5是Anthropic推出的性能最强的Sonnet系列模型,在编码、智能体开发及专业工作领域均具备前沿水准,支持自适应思考,可选择低、中、高、最高等不同强度的推理力度,能适配各类复杂任务的处理需求,为用户提供灵活且高效的AI交互体验。
Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)是谷歌推出的速度最快、性价比最高的Gemini图像模型,专为高吞吐量开发者工作流与高频视觉探索场景打造,可实现文本生成图像的功能,能为开发者提供高效的视觉内容生成支持,适配各类对响应速度与成本控制有要求的开发需求。
Nex AGI推出的Nex-N2-Mini是一款开源的智能体混合专家模型,属于Nex-N2系列的轻量化版本。它支持文本与图像输入,专为代码开发、工具调用等场景打造,兼具开源模型的灵活性与混合专家架构的性能优势,能够适配多样化的智能任务需求。
Fugu Ultra是Sakana AI旗下Fugu系列中性能更强劲的模型。它并非单一的整体式模型,而是一套经过学习优化的多智能体编排系统,本质是一款经过训练的语言模型,负责将任务精准路由至适配的专用智能体,以此实现更高效的任务处理与性能提升。
Gemini 3.1 Flash Image,又称“Nano Banana 2”,是谷歌最新的顶尖图像生成与编辑模型,能以极速输出专业级视觉效果。它融合了先进的技术能力,可满足用户在图像创作、优化等场景的多元需求,为各类视觉相关的应用提供高效且高质量的技术支撑。
Nano Banana Pro是谷歌基于Gemini 3 Pro打造的最先进图像生成与编辑模型,它在原有Nano Banana的基础上,大幅提升了多模态推理、现实场景贴合等核心能力,能够为用户提供更精准、更贴合实际需求的图像创作与编辑服务,助力各类图像相关的创意工作与专业场景应用。
North Mini Code 是 Cohere 推出的首款智能编码模型,也是其 North 系列的首发产品。作为一款稀疏混合专家模型,它拥有总计300亿参数,激活参数为30亿,经过针对性优化,能为开发者提供高效的编码辅助能力,助力各类编程任务的开展。
Z.ai推出的GLM 5.2是一款大规模推理模型,支持文本输入与输出,具备1M token的上下文窗口,适配长周期智能体工作流、项目级软件工程等场景,能够为相关领域的复杂任务提供可靠的推理支撑。
Z.ai推出的GLM 5.2(免费版)是一款大规模推理模型,支持文本输入与输出,配备1M token的上下文窗口,适配长周期智能体工作流、项目级软件工程等场景,可满足相关领域对长文本处理与复杂任务推理的需求。
OpenRouter: Fusion 可将用户的提示词转化为小型多模型协同审议流程,一组专家模型会并行分析用户的提示词,同时启用网页搜索与网页获取功能,最终完成相关内容的整合与输出,为用户提供更全面、精准的响应结果。
MoonshotAI: Kimi K2.7 Code是月之暗面(Moonshot AI)Kimi K2系列中专注于代码开发的模型,专为可靠完成长上下文下的端到端编程任务而打造,采用原生多模态混合专家架构,能够适配各类复杂编程场景的需求,为开发者提供高效的代码处理与生成支持。
Anthropic推出的Claude Fable最新版模型,会始终自动跳转至Claude Fable系列的最新模型版本,确保用户能使用该系列的最新功能与体验,无需手动切换不同版本,为使用该系列模型提供了便捷的版本适配支持。
Claude Fable 5 是 Anthropic 推出的 Mythos 级模型,专为自主知识工作与代码开发打造,支持文本、图像及文件类输入,可生成文本输出,具备推理能力,能为用户在知识处理、代码编写等场景提供可靠的智能支持,适配多类型任务的高效完成需求。
Nex-N2-Pro是Nex AGI推出的一款智能体混合专家模型,总参数规模达3970亿,其中激活参数为170亿。该模型基于Qwen3.5架构构建,支持文本与图像输入,可生成符合需求的输出内容,适配多模态交互场景的各类应用需求。
NVIDIA Nemotron 3.5 Content Safety 是英伟达推出的一款轻量型多模态内容安全防护模型,参数规模为40亿,基于Google Gemma-3-4B模型微调而成。该模型可对大语言模型与多模态大模型的输入及输出内容进行安全审核,能处理多模态相关的内容安全校验需求,为AI应用提供可靠的内容防护能力。
NVIDIA Nemotron 3 Ultra是NVIDIA推出的一款面向前沿推理与编排的开源模型,采用混合Transformer-Mamba的混合专家(MoE)架构,总参数量达5500亿,其中激活参数量为550亿,兼具高效的推理能力与灵活的编排适配性,可支撑多场景下的复杂任务处理需求。
NVIDIA Nemotron 3 Ultra 是 NVIDIA 推出的一款面向前沿推理与编排的开源模型,采用混合 Transformer-Mamba 混合专家架构,总参数量达 5500 亿,其中激活参数量为 550 亿,属于混合专家(MoE)模型,目前提供免费使用。
Qwen3.7 Plus是阿里通义千问(Qwen)3.7系列中一款高性价比的模型,它支持文本与图像输入,可输出文本内容。该模型在系列原有文本能力的基础上,实现了全面升级,能够更好地满足多模态交互场景下的各类需求,为用户提供更优质的使用体验。
MiniMax M3是MiniMax推出的多模态基础模型,支持文本、图像、视频输入,并以文本形式输出,具备100万token的上下文窗口,适配长周期智能体任务、代码开发等场景,可满足多领域复杂任务的处理需求。
MiniMax M3 是 MiniMax 推出的多模态基础模型,支持文本、图像、视频输入,可生成文本输出,拥有100万token的上下文窗口,适用于长周期智能体任务、代码开发等场景,能为相关领域的高效工作提供有力支撑。
StepFun: Step 3.7 Flash 是阶跃星辰(StepFun)推出的最新高效多模态混合专家模型,它将拥有1960亿参数的语言主干网络与视觉编码器相结合,可原生支持图像与视频理解,推理过程中仅激活约110亿参数,兼顾了性能与运行效率,能为各类多模态应用场景提供灵活且实用的技术支撑。
Claude Opus 4.8是Anthropic公司Opus系列中目前已全面上线的最强通用模型,支持文本、图像及文件类输入,可输出文本内容,具备推理能力,拥有100万token的上下文窗口,能高效处理各类复杂任务,为用户提供精准可靠的智能交互服务。
Qwen3.7-Max是阿里通义千问(Qwen)3.7系列的旗舰模型,支持文本输入与输出,专为以智能体为核心的工作负载设计,在编码、办公及生产力任务领域具备突出优势,能够为用户提供高效、精准的智能交互支持,适配各类需要专业能力的场景需求。
SpaceXAI推出的Grok Build 0.1是一款专为智能体软件工程工作流程打造的快速编码模型,支持文本与图像输入,可生成文本输出,且针对交互式编码场景进行了专项优化,能为开发者提供适配智能体工作模式的高效编码支持。
Gemini 3.5 Flash是谷歌推出的高效多模态模型,以Flash级别的成本与速度,带来了接近专业水准的编码能力与推理表现。该模型针对编码熟练度进行了深度优化,同时也十分适配并行智能体执行场景,能够在兼顾效率的前提下,为用户提供可靠的多模态交互与任务处理支持。
Perceptron Mk1是Perceptron推出的最高品质的视觉语言模型,专为视频与具身推理场景设计。它支持图像及视频输入,可搭配自然语言查询使用,能生成细致的视觉理解结果,助力相关场景下的智能分析与决策。
inclusionAI: Ring-2.6-1T是一款1万亿参数规模的推理模型,其中激活参数为630亿,专为需要强大能力与运行效率的现实世界智能体工作流程打造,针对编码智能体、工具调用等场景进行了优化,能够适配复杂任务的落地需求,平衡性能表现与运行成本,助力各类智能体应用实现高效稳定的运行。
Gemini 3.1 Flash Lite是谷歌推出的GA级高效多模态模型,专为低延迟、高吞吐量的工作负载优化,支持文本、图像、视频、音频及PDF等多种输入形式,定位适配轻量智能体场景,兼顾性能与运行效率,可满足对响应速度要求较高的多模态交互需求。
OpenAI的GPT Chat Latest对应其稳定API别名`chat-latest`,始终指向ChatGPT中使用的最新即时聊天模型。随着OpenAI持续推出新的即时模型更新,该别名会自动同步关联,确保开发者或用户能便捷获取最新的模型能力,无需手动调整配置,适配ChatGPT的迭代节奏,为相关应用提供稳定且紧跟技术进展的模型支持。
Grok 4.3是SpaceXAI推出的推理模型,支持文本与图像输入,输出形式为文本,适配智能体工作流、指令遵循任务,以及对事实准确性要求较高的各类应用场景。
IBM Granite 4.1 8B 是 IBM 推出的 Granite 4.1 系列中的一款仅采用解码器架构的密集型语言模型,参数规模达 80 亿。该模型支持 13.1 万 token 的上下文窗口,专为企业级任务打造,能够适配各类企业场景下的语言处理需求,助力相关业务高效运转。
Mistral Medium 3.5 是 Mistral AI 推出的一款参数规模达1280亿的密集型指令遵循模型,支持文本与图像输入并生成文本输出,专为智能体工作流、代码开发及复杂任务场景设计,具备适配多类专业需求的能力,可满足开发者在复杂应用场景中的多样化使用需求。
NVIDIA Nemotron™ 3 Nano Omni 是一款面向企业智能体系统打造的开源多模态模型,定位为感知与上下文子智能体,支持文本、图像、视频等多类输入,适配企业级智能体架构的轻量化部署需求,可助力企业构建具备多模态感知与上下文理解能力的智能应用,为企业场景下的智能交互与任务执行提供基础支撑,且当前提供免费使用版本。
Laguna M.1 是 Poolside 推出的旗舰级编码智能体模型,专为复杂软件工程任务优化,适配智能体编码工作流,支持工具调用与推理功能,具备256K上下文窗口,可高效处理大规模代码相关任务,助力开发者完成各类专业级编码需求。
Laguna M.1 是 Poolside 推出的旗舰级编码智能体模型,专为复杂软件工程任务优化,适配智能体编码工作流,支持工具调用与推理能力,具备256K的上下文窗口,可高效处理大规模代码相关任务,为开发者提供专业的编码辅助支持。
Anthropic Claude Haiku Latest 模型会始终跳转至 Anthropic Claude Haiku 家族的最新版本模型,确保用户使用的是该系列中迭代更新后的模型,无需手动切换即可获取该家族的最新功能与优化内容。
OpenAI GPT Mini Latest 是一款始终会自动跳转至 OpenAI GPT Mini 系列最新版本的模型,它能为用户提供该系列的最新模型版本,确保用户可以便捷获取 OpenAI GPT Mini 家族迭代后的最新功能与服务,无需手动查找对应更新版本,简化了获取该系列最新模型的操作流程。
Google Gemini Pro Latest 模型会自动跳转至 Google Gemini Pro 系列的最新版本模型,确保用户始终使用该系列的最新可用模型,无需手动切换或查找更新版本,简化了模型使用的操作流程,提升了使用的便捷性。
MoonshotAI Kimi Latest 模型会始终跳转至 MoonshotAI Kimi 系列的最新模型,为用户提供该系列的最新版本使用体验,确保用户能便捷获取 MoonshotAI Kimi 家族的最新功能与服务。
Google Gemini Flash Latest 模型会始终跳转至 Google Gemini Flash 系列的最新版本模型,确保用户能获取该系列的最新可用模型资源,无需手动查找或切换不同版本,简化了使用流程,让用户可以直接使用该系列的最新模型开展相关工作。
Anthropic Claude Sonnet Latest 模型会始终跳转至 Anthropic Claude Sonnet 系列的最新版本模型,用户无需手动切换不同迭代的同系列模型,即可直接使用该系列的最新功能与特性,确保获取到该模型家族的最新能力支持。
OpenAI GPT Latest 模型会自动跳转至 OpenAI GPT 家族的最新模型,为用户提供该系列的最新版本服务,确保用户能便捷获取 OpenAI 推出的 GPT 系列模型的最新功能与体验,无需手动查找或切换不同版本,简化了使用流程,提升了获取最新 AI 能力的效率。
Qwen3.5 Plus 2026-04-20 是阿里巴巴推出的大规模多模态语言模型,支持文本、图像、视频输入,可生成文本输出,具备100万token的上下文窗口,能适配复杂的多模态交互场景,为用户提供高效的多模态内容处理与生成服务。
Qwen3.6 Flash 是阿里巴巴通义千问3.6系列推出的一款快速高效的语言模型,支持文本、图像和视频输入,拥有100万token的上下文窗口,采用分级定价模式,能够适配不同场景的使用需求,兼顾运行效率与多模态交互能力,为用户提供灵活且高性能的语言模型服务。
Qwen3.6 35B A3B 是阿里云推出的开源权重多模态模型,总参数量达350亿,每token激活参数量为30亿,采用结合门控机制的混合稀疏混合专家架构,兼具多模态处理能力与高效的参数利用特性,适配各类需要跨模态交互的智能应用场景。
Qwen3.6 Max Preview 是阿里云推出的专有前沿模型,基于稀疏混合专家架构构建,拥有约1万亿总参数,针对智能体编程、工具使用等场景进行了优化,能够为相关领域的复杂任务提供高效支持,助力开发者和用户完成各类需要智能交互与工具调用的工作。
Qwen3.6 27B 是阿里巴巴通义千问团队推出的一款拥有270亿参数的密集型语言模型,于2026年4月发布。它具备混合多模态能力,可接收文本、图像及视频作为输入,能够适配多场景下的复杂交互需求,为用户提供更全面的语言处理与信息解读支持。
GPT-5.5 Pro是OpenAI推出的高性能模型,专为复杂高风险任务的深度推理与精准度优化设计。它配备了100万以上token的上下文窗口,其中输入支持92.2万token,输出支持12.8万token,可满足多轮长文本交互、复杂逻辑推导等场景的需求,为各类高要求任务提供可靠的模型支撑。
GPT-5.5是OpenAI推出的前沿模型,专为复杂专业工作负载打造,在GPT-5.4的基础上优化而来,具备更强的推理能力、更高的可靠性,在高难度任务上的令牌效率也得到提升,它支持100万以上令牌的上下文处理能力,可适配各类需要深度信息处理的专业场景。
DeepSeek V4 Pro 是深度求索(DeepSeek)推出的大规模混合专家模型,总参数规模达1.6万亿,激活参数为490亿,支持100万token的超长上下文窗口,专为高级推理、代码开发等复杂任务设计,具备强大的多场景复杂问题处理能力,可适配各类需要深度逻辑推演与专业技术实现的应用需求。
DeepSeek V4 Flash是深度求索(DeepSeek)推出的一款针对效率优化的混合专家模型,拥有2840亿总参数与130亿激活参数,支持100万token的上下文窗口,专为快速推理设计,能够在保障性能的同时兼顾部署与运行的高效性,适配对响应速度有较高要求的各类场景需求。
inclusionAI旗下的inclusionAI: Ling-2.6-1T是一款指令微调即时模型,也是该公司的万亿参数旗舰产品,专为需要规模化快速执行与高效运作的现实场景智能体设计,采用“快速”相关的核心技术架构,能够满足各类实际应用场景对响应速度与运行效率的高要求,为智能体的规模化落地提供可靠的技术支撑。
Hy3 preview是腾讯推出的一款高效混合专家模型,专为智能体工作流与生产场景设计。它支持可配置的推理级别,涵盖禁用、低、高三种模式,能够根据不同场景需求灵活调整推理强度,适配多样化的生产应用与智能体任务场景,助力各类业务实现高效稳定的运行。
Xiaomi MiMo-V2.5-Pro是小米旗下的旗舰模型,在通用智能体能力、复杂软件工程以及长周期任务处理方面表现强劲,在ClawEval、GDPVal、SWE-bench Pro等多项权威评测中均位居前列,能够为相关领域的复杂需求提供可靠的技术支撑。
MiMo-V2.5是小米推出的原生多模态模型,它以约一半的推理成本实现了专业级智能体性能,同时在图像与视频理解的多模态感知能力上超越了MiMo-V2-Omni。
OpenAI推出的GPT-5.4 Image 2模型,将OpenAI的GPT-5.4模型与GPT Image 2的顶尖图像生成能力相结合,支持丰富的多模态工作流,让用户能在推理、编码等不同任务场景间无缝切换,为各类创作与开发需求提供更高效的技术支撑。
inclusionAI旗下的inclusionAI: Ling-2.6-flash是一款指令类即时模型,总参数规模达104B,激活参数为7.4B,专为需要快速响应、强执行能力与高token效率的现实场景智能体设计,可满足各类对响应速度与执行效果有要求的实际应用需求。
Anthropic推出的Claude Opus Latest模型,会始终跳转至Claude Opus系列的最新版本模型,确保用户能直接使用该系列的最新功能与性能表现,无需手动切换或查找更新版本,为用户提供稳定且贴合最新迭代的使用体验。
Pareto Code Router 依托 Artificial Analysis 的编码百分位,构建了由优质编码模型组成的分层候选列表。用户可在 pareto-router 插件中设置 0 到 1 之间的 min_coding_score 参数,以此控制路由时对模型编码能力的筛选标准,帮助匹配更符合需求的编码模型,提升代码生成与处理的精准度。
MoonshotAI旗下的Kimi K2.6是一款新一代多模态模型,专为长周期编码、编码驱动的UI/UX生成以及多智能体编排场景打造。它可处理Python、Rust、Go等语言的复杂端到端编码任务,为开发者提供高效的技术支持,助力各类编程相关场景的落地应用。
Claude Opus 4.7 是 Anthropic 旗下 Opus 系列的下一代产品,专为长时间运行的异步智能体打造。它在 Opus 4.6 的代码开发与智能体能力基础上迭代升级,在核心任务上实现了更强劲的性能表现,能够更好地支撑复杂场景下的智能体运行需求,为用户提供更稳定高效的智能交互与任务处理能力。
Z.ai旗下的GLM 5.1在编码能力上实现了重大突破,尤其在处理长周期任务时提升显著。与此前围绕分钟级交互构建的模型不同,GLM 5.1能够独立且持续地完成任务,无需依赖频繁的人工或系统介入,为复杂编码场景提供了更稳定、高效的支持。
Gemma 4 26B A4B IT 是 Google DeepMind 推出的一款经过指令微调的混合专家(MoE)模型。尽管其总参数规模达252亿,但推理过程中每轮仅激活38亿参数,能实现接近310亿参数模型的输出质量,在兼顾性能的同时有效降低了推理阶段的计算资源消耗。
Gemma 4 26B A4B IT 是 Google DeepMind 推出的指令调优混合专家(MoE)模型。尽管总参数规模达252亿,推理时每轮仅激活38亿参数,可实现接近310亿参数模型的性能表现,该模型为免费使用版本,依托稀疏激活架构在兼顾效率的同时保障了优质输出能力。
Gemma 4 31B Instruct是Google DeepMind推出的30.7B参数密集型多模态模型,支持文本与图像输入,可生成文本输出。该模型具备256K token的上下文窗口,支持可配置的思考/推理模式,还内置了原生功能调用能力,能适配多样化的交互与任务场景。
Gemma 4 31B Instruct是Google DeepMind推出的307亿参数密集型多模态模型,支持文本与图像输入,输出为文本形式。该模型具备25.6万token的上下文窗口,支持可配置的思考/推理模式,原生集成函数调用功能,且可免费使用。
Qwen 3.6 Plus 采用混合架构,将高效线性注意力机制与稀疏混合专家路由相结合,具备出色的可扩展性与高性能推理能力。相较于 Qwen 3.5 系列,它在核心性能与运行效率上实现了显著提升,能够更好地适配各类复杂场景的应用需求,为用户提供更稳定、更优质的模型服务体验。
Z.ai推出的GLM 5V Turbo是该公司首款原生多模态智能体基础模型,专为视觉驱动的编码任务与智能体驱动的各类场景打造。它原生支持图像、视频、文本三类输入,在长周期规划、复杂编码等任务中表现突出,能够为相关领域的智能应用提供核心技术支撑。
Trinity Large Thinking 是 Arcee AI 团队推出的一款强大开源推理模型,在 PinchBench、智能体工作负载以及各类推理任务中均展现出优异的性能,相关发布视频可通过指定链接查看。
SpaceXAI推出的Grok 4.20 Multi-Agent,是Grok 4.20的衍生版本,专为多智能体协同工作流打造。多个智能体可并行运行,开展深度研究、协调工具使用,并对各类信息进行整合,助力复杂任务的高效推进。
Grok 4.20是SpaceXAI推出的推理模型,具备行业领先的运行速度与智能体工具调用能力,它结合了市场上最低的幻觉率与严格的提示词遵循度,能够为用户提供精准可靠的推理服务,适配各类需要高效逻辑处理与工具调用的场景需求。
Google Lyria 3 Pro Preview 是谷歌推出的音乐生成模型系列,可通过 Gemini API 使用。该模型支持生成高品质的音乐内容,相关全曲定价为每首0.08美元,其生成的音乐具备48kHz的高规格音质表现,能满足用户对专业级音乐内容的创作需求。
Google Lyria 3 Clip Preview 是谷歌推出的音乐生成模型系列,可通过 Gemini API 使用,其生成的时长为30秒的片段,每段定价0.04美元,该模型支持音乐生成相关功能,能为用户提供便捷的音乐内容创作服务。
Kwaipilot旗下的KAT-Coder-Pro V2是KwaiKAT的KAT-Coder系列最新高性能模型,专为复杂企业级软件工程与SaaS集成场景打造。它延续了前代版本在智能编码方面的优势,能够为开发者提供更可靠的技术支持,助力高效完成各类专业级软件项目与系统对接任务。
Reka Edge是一款效率极高的7B多模态视觉语言模型,支持图像、视频与文本输入,可生成文本输出。该模型经过专门优化,在图像理解领域具备行业领先的性能表现,能够高效处理多模态输入并输出符合需求的文本内容,适配各类需要视觉与语言结合的应用场景。
MiniMax M2.7是一款面向自主化、现实场景生产力及持续迭代的下一代大语言模型,它被设计为能够主动参与自身的进化过程,通过多智能体技术整合了先进的智能体能力,可在实际应用场景中为用户提供高效、灵活的智能服务,助力各类现实任务的落地与优化。
MiniMax M2.7(免费版)是一款面向自主现实场景生产力与持续优化的下一代大语言模型,它专为深度参与自身迭代而打造,通过多智能体架构集成了先进的智能体能力,能够在实际应用中主动适配需求、持续成长,为用户提供更贴合真实场景的高效服务。
OpenAI推出的GPT-5.4 Nano是GPT-5.4系列中最轻量化、成本效益最高的版本,专为对速度要求严苛且处理量大的任务优化,支持文本与图像输入,主打低延迟表现,能适配各类需要高效响应的应用场景。
OpenAI推出的GPT-5.4 Mini,将GPT-5.4的核心能力整合进一款更快速、更高效的模型,专为高吞吐量工作负载优化。它支持文本与图像输入,在推理、编码等任务中表现出色,能为各类对响应速度和资源效率有要求的场景提供可靠的AI支持。
Mistral Small 4是Mistral Small系列的下一个主要版本,它将多款Mistral旗舰模型的能力整合到单一系统中,兼具出色的推理能力与高效的运行表现,能够为各类自然语言处理任务提供稳定且优质的支持,助力开发者构建更具竞争力的AI应用场景。
Z.ai推出的GLM 5 Turbo是一款专为快速推理打造的新型模型,在OpenClaw等智能体驱动的场景中具备强劲性能,且针对现实场景中的智能体工作流程进行了深度优化,能够为相关智能体应用提供高效稳定的支撑。
NVIDIA Nemotron 3 Super是一款拥有1200亿参数的开源混合MoE模型,仅激活120亿参数即可实现最高计算效率,同时在复杂多智能体应用中展现出出色的准确性。该模型基于混合架构打造,融合了Mamba与Transformer技术,兼顾了两种架构的优势,能够适配多类复杂场景的运行需求,为相关应用提供可靠的技术支撑。
NVIDIA Nemotron 3 Super是一款1200亿参数的混合式MoE开源模型,仅激活120亿参数即可实现最优计算效率,在复杂多智能体应用中能兼顾性能与精度。该模型基于混合架构打造,融合了Mamba与Transformer技术,为各类需要高效处理复杂任务的场景提供了可靠的AI支撑,且当前版本可免费使用。
ByteDance Seed推出的Seed-2.0-Lite是一款功能全面、性价比突出的企业级主力模型,具备强大的多模态与智能体能力,同时延迟显著更低,是多数生产 workload 的实用默认选择,可广泛应用于各类企业级业务场景,为相关工作负载提供可靠且高效的支撑。
Qwen3.5-9B 是通义千问(Qwen)3.5系列的多模态基础模型,采用90亿参数的高效架构打造,具备出色的推理、编码与视觉理解能力,采用统一的视觉-语言设计,可适配多场景下的复杂任务需求。
GPT-5.4 Pro是OpenAI推出的最新进阶模型,它在GPT-5.4统一架构的基础上进行优化,具备更强的推理能力,可应对复杂且高要求的任务。该模型拥有超过100万token的上下文窗口,支持的输入与输出容量可满足长文本处理需求,能为用户提供更精准、可靠的交互与服务。
GPT-5.4是OpenAI推出的最新前沿模型,它将Codex与GPT两大系列整合为单一系统,具备100万以上token的上下文窗口,其中输入支持92.2万token、输出支持12.8万token,可适配多场景的长文本处理需求,为复杂任务提供更充足的信息支撑。
Inception: Mercury 2是一款速度极快的推理型大语言模型,也是首款推理型扩散大语言模型(dLLM)。它摒弃了传统大语言模型逐一生成token的方式,转而并行生成并优化多个token,在推理效率与生成速度上实现了突破性提升,为大语言模型的推理架构提供了全新的技术路径。
OpenAI推出的GPT-5.3 Chat是ChatGPT热门模型的迭代版本,能让日常对话更流畅、实用且更具实际帮助。它通过优化上下文理解能力,提供更准确的回答,在多方面的表现都有显著提升,可更好地适配用户的各类日常交流与信息获取需求。
Gemini 3.1 Flash Lite Preview 是谷歌推出的高效能模型,专为高负载场景优化,在综合性能上优于 Gemini 2.5 Flash Lite,在多项核心表现上已接近 Gemini 2.5 Flash 的水准,能够满足大规模应用场景对性能与效率的双重需求。
ByteDance Seed的Seed-2.0-Mini模型,面向对延迟、并发量及成本敏感的场景,主打快速响应与灵活的推理部署能力,其性能可与ByteDance-Seed-1.6相媲美,支持256k上下文窗口,具备最小、低、中、高四种推理强度模式,还拥有多模态理解能力,能适配多样化的业务需求。
Gemini 3.1 Flash Image Preview,又称“Nano Banana 2”,是谷歌最新的顶尖图像生成与编辑模型,能以极速输出专业级视觉画质。它融合了前沿的图像生成技术与高效的编辑能力,可满足用户对高质量图像创作及快速调整的多元需求,为创作者和普通用户提供便捷且专业的视觉内容处理体验。
Qwen3.5-35B-A3B是通义千问推出的原生多模态视觉语言模型,采用融合线性注意力机制与稀疏混合专家模型的混合架构,在保障模型性能的同时显著提升了推理效率,可高效处理各类视觉与语言结合的任务,适配多场景下的智能交互需求。
Qwen3.5-27B是一款原生多模态视觉语言稠密模型,采用线性注意力机制,在兼顾推理速度与性能的同时,能够实现快速响应,其综合能力可与同类型主流模型相媲美,能够高效处理各类视觉与语言相关的任务,为用户提供稳定且优质的多模态交互体验。
Qwen3.5-122B-A10B 是一款原生多模态视觉语言模型,采用融合线性注意力机制与稀疏混合专家模型的混合架构,实现了更高效的推理性能,可在视觉理解与语言处理任务中展现出色表现,为多模态交互场景提供可靠的技术支撑。
Qwen3.5-Flash 是通义千问推出的原生多模态视觉-语言模型,采用融合线性注意力机制与稀疏混合专家模型的混合架构,实现了更高的推理效率。相较于同类型模型,它在保持出色性能的同时,能以更高效的方式处理视觉与语言结合的任务,适配各类需要快速响应的多模态应用场景,为用户提供流畅的交互体验。
Gemini 3.1 Pro Preview Custom Tools 是 Gemini 3.1 Pro 的衍生版本,它优化了工具选择逻辑,避免过度使用通用的 Bash 工具,转而优先选用效率更高的第三方工具,以此提升任务处理的精准度与运行效率,为开发者提供更适配的工具调用方案,助力各类开发与数据处理场景的顺畅推进。
OpenAI推出的GPT-5.3-Codex是其最先进的智能体编程模型,它融合了GPT-5.2-Codex的前沿软件工程性能,以及GPT-5.2具备的更广泛推理能力与专业知识储备,目前已达到行业顶尖的性能表现,能够为编程相关的各类任务提供更可靠、高效的支持。
AionLabs旗下的Aion-2.0是DeepSeek V3.2的优化变体,专为沉浸式角色扮演与故事创作场景打造。它尤其擅长在叙事中引入张力、危机与冲突,能让故事内容更具吸引力,为用户带来更具代入感的创作与体验。
Gemini 3.1 Pro Preview 是谷歌推出的前沿推理模型,在复杂工作流程中展现出更出色的软件工程性能、更可靠的智能体表现以及更高效的令牌使用效率,它基于多模态技术底座打造,能够为各类复杂任务提供更优质的支持。
Claude Sonnet 4.6 是 Anthropic 推出的性能最强的 Sonnet 级模型,在编码、智能体开发及专业工作领域均达到前沿水平。它擅长迭代式开发、复杂代码库导航,还能高效完成端到端的项目管理,为各类专业场景提供可靠的智能支持,助力用户提升工作效率与任务完成质量。
Qwen3.5 Plus 2026-02-15是通义千问推出的原生多模态系列模型,采用融合线性注意力机制与稀疏混合专家模型的混合架构,实现了更高的推理效率,可适配多类视觉语言相关的任务场景,为用户提供更流畅高效的多模态交互与处理能力。
Qwen3.5 397B A17B 是一款原生多模态视觉语言模型,采用融合线性注意力机制与稀疏混合专家模型的混合架构,实现了更高的推理效率,能够为用户提供更优质的视觉语言交互与处理能力,适配各类需要视觉理解与语言生成结合的应用场景。
MiniMax M2.5 是一款面向实际生产力场景的顶尖大语言模型,它基于 MiniMax M2.1 的编码能力迭代升级,在各类复杂的真实数字工作环境中完成训练,能够为用户的日常工作提供高效、可靠的智能支持。
GLM-5是Z.ai推出的旗舰开源基础模型,专为复杂系统设计与长周期智能体工作流程打造,面向专业开发者群体,在大规模编程任务上具备生产级性能,可与行业领先的同类模型相媲美,为开发者应对高复杂度的技术场景提供可靠支撑。
Qwen3-Max-Thinking是Qwen系列中的旗舰级推理模型,专为需要深度多步骤推理的高风险认知任务打造。它通过大幅提升模型容量与强化学习计算资源投入,能够应对复杂的逻辑推导、问题拆解与决策类任务,为各类对推理精度与深度要求较高的场景提供可靠的技术支撑。
Claude Opus 4.6 是 Anthropic 推出的最强代码开发与长周期专业任务处理模型,专为覆盖完整工作流程而非单一提示词的智能体设计,在复杂任务处理场景中具备突出的执行效能,能够支撑多环节连贯的专业工作需求,为各类需要深度流程协作的场景提供可靠的智能支持。
Qwen3 Coder Next 是一款开源权重的因果语言模型,专为智能编码助手与本地开发工作流程优化设计。它采用稀疏混合专家(MoE)架构,总参数规模达800亿,每次推理仅激活30亿参数,在兼顾编码任务高效性的同时,也能适配本地部署的资源条件,为开发者提供灵活且实用的编码辅助支持。
Free Models Router是获取免费推理服务的便捷方式,它是OpenRouter推出的一款路由工具,会从OpenRouter平台上可用的模型中随机筛选出免费模型,还会智能过滤出符合要求的模型,为用户提供简单高效的免费模型调用路径,助力用户轻松获取免费的AI推理服务支持。
StepFun的Step 3.5 Flash是该公司目前能力最强的开源基础模型,它采用稀疏混合专家(MoE)架构,每个token仅选择性激活110亿参数,整体参数规模达1960亿,在兼顾性能表现的同时优化了计算效率,适配多种需要高效推理的应用场景。
Kimi K2.5是Moonshot AI自研的多模态模型,具备行业领先的视觉编码能力与自主智能体集群范式,它基于Kimi K2模型迭代而来,经过约15万亿混合数据的持续预训练,在多领域任务中展现出更出色的综合性能,能够为用户提供更高效、精准的智能交互与问题解决支持。
Solar Pro 3是Upstage推出的强大混合专家(MoE)语言模型,总参数规模达102B,每次前向传播时激活12B参数,在保持计算效率的同时实现了出色的性能表现,目前该模型正处于优化完善阶段,可满足多场景下的专业语言处理需求。
MiniMax M2-her是一款主打对话场景的大语言模型,专为沉浸式角色扮演、角色驱动型聊天以及富有表现力的多轮对话打造。它的设计核心在于保持语气与人格的一致性,支持丰富的消息交互,能够适配各类需要稳定角色特质的对话场景,为用户带来自然流畅的互动体验。
Palmyra X5 是 Writer 推出的最先进模型,专为企业级 AI 智能体的构建与规模化部署而打造。它在最大达 100 万的上下文窗口上,实现了行业领先的速度与运行效率,能够为企业的 AI 应用场景提供强劲支撑。
GPT Audio是OpenAI首款面向大众开放使用的音频模型,其最新版本升级了解码器,可生成更自然的语音效果,同时能更好地保持语音一致性,该音频模型的定价相关信息已同步公布。
OpenAI推出的GPT Audio Mini是一款高性价比的GPT Audio衍生版本,该最新快照版本升级了解码器,可生成更自然的语音效果,同时能更好地保持语音一致性。其输入定价为每百万单位0.60美元,兼顾了成本控制与语音生成的核心性能表现。
Z.ai: GLM 4.7 Flash是一款30B级的SOTA模型,提供了兼顾性能与效率的全新选择。它针对智能体编码场景进行了深度优化,显著强化了编码能力与长周期任务规划能力,能够为相关开发场景提供更可靠的技术支撑,适配多样化的智能体应用需求。
OpenAI推出的GPT-5.2-Codex是GPT-5.1-Codex的升级版本,专为软件工程与编码工作流程优化打造,既适配交互式开发会话场景,也能支持复杂工程任务的长时间独立运行,可助力开发者高效完成各类编码相关工作。
ByteDance Seed推出的Seed 1.6 Flash是一款超高速多模态深度思考模型,支持文本与视觉理解,具备256k的上下文窗口,可生成高质量的多模态输出,能高效处理各类复杂的理解与生成任务,适配多种场景下的智能交互需求。
ByteDance Seed团队推出的通用大模型Seed 1.6,具备多模态能力与自适应深度思考特性,拥有256K的上下文窗口,可适配多样化的通用场景需求,为用户提供更丰富、连贯的交互体验。
MiniMax M2.1 是一款轻量级的顶尖大语言模型,专为代码开发、智能体工作流及现代应用开发场景优化。它仅需100亿激活参数,就能在实际应用场景中实现性能的显著提升,兼顾高效性与实用性,可支撑各类开发场景下的复杂任务需求,为开发者提供可靠的技术支持。
Z.ai推出的最新旗舰模型GLM-4.7,在两大核心领域完成了升级:编程能力得到强化,多步骤推理与执行的稳定性也有所提升。该模型在复杂智能体任务的执行上展现出显著进步,能够更可靠地应对多环节的任务流程,为相关应用场景提供更稳定的支撑。
Gemini 3 Flash Preview 是谷歌推出的一款高速、高性价比的思考型模型,专为智能体工作流、多轮对话及编码辅助场景打造,它能提供接近 Gemini Pro 级别的推理能力与工具支持,可高效适配各类需要快速响应与精准逻辑的任务需求,助力开发者与用户完成复杂交互及专业编码相关工作。
NVIDIA Nemotron 3 Nano 30B A3B 是一款小型混合专家(MoE)语言模型,兼具极高的计算效率与精准度,专为开发者构建专用智能体 AI 系统设计。该模型具备完整的功能架构,能够适配多样化的开发场景,助力开发者快速搭建高效且精准的定制化 AI 应用,为智能体系统的研发提供可靠的技术支撑。
NVIDIA Nemotron 3 Nano 30B A3B是一款小型混合专家(MoE)语言模型,具备极高的计算效率与精准度,专为开发者打造,助力其构建各类专用智能体AI系统,该模型完全适配开发者的定制化开发需求,可支撑轻量化且高效的AI应用落地。
GPT-5.2 Chat(又称Instant)是OpenAI推出的5.2系列中快速轻量化的成员,专为低延迟聊天场景优化,同时保留了强大的通用智能。它采用自适应推理技术,可根据需求选择性开展思考,在保障响应速度的同时,兼顾处理各类任务的能力,适配对交互效率有较高要求的使用场景。
OpenAI推出的GPT-5.2 Pro是该公司目前最先进的模型,相比GPT-5 Pro,它在智能体编码和长文本上下文处理能力上实现了重大提升,专门针对需要逐步推理的复杂任务进行了优化,能够为用户提供更高效、精准的任务处理支持。
GPT-5.2是OpenAI推出的GPT-5系列最新前沿级模型,相比GPT-5.1具备更出色的智能体能力与长文本处理性能。它采用自适应推理技术动态分配算力,能够快速响应各类任务需求,为用户提供更高效、精准的交互与服务支持,适配更多复杂场景下的应用需求。
Devstral 2是Mistral AI推出的一款顶尖开源模型,专注于智能体编程领域。它是拥有1230亿参数的密集型Transformer模型,支持256K的上下文窗口,能够助力开发者在编程场景中开展探索性工作,适配各类复杂的代码生成、调试与优化任务,为智能体编程场景提供可靠的技术支撑。
Relace Search模型会并行使用4到12个`view_file`和`grep`工具来探索代码库,并返回与用户请求相关的文件。与RAG不同,Relace Search采用了智能代理式的运行逻辑,能够更主动地在代码库中完成信息检索与匹配,为用户提供精准的相关文件结果。
GLM-4.6V是一款专为高保真视觉理解与长上下文推理打造的多模态大模型,可处理图像、文档及混合媒体内容,支持最高128K token的上下文窗口,能够解析复杂的页面布局,适配多场景下的复杂信息处理需求。
Body Builder (beta) 是一款可将用户的自然语言请求转化为结构化 OpenRouter API 请求对象的工具。用户只需说明想要借助 AI 模型完成的任务,它就能自动构建出适配的 API 调用指令,为开发者简化与 OpenRouter API 的交互流程,无需手动编写复杂的 API 请求代码,降低了调用 AI 模型的技术门槛。
GPT-5.1-Codex-Max是OpenAI推出的最新智能体代码模型,专为长时间运行、高上下文需求的软件开发任务打造。它基于5.1版本推理栈的更新版本构建,依托智能体相关技术完成训练,能够适配复杂的代码开发场景,为开发者提供更高效的编程支持,助力各类软件开发工作的推进。
Amazon Nova 2 Lite是一款快速且高性价比的推理模型,适用于各类日常工作负载,能够处理文本、图像和视频并生成文本内容。该模型在多模态信息处理方面展现出突出能力,可满足用户对日常场景下高效信息处理与内容生成的需求,为各类轻量化应用场景提供可靠的技术支撑。
Ministral 3 14B 2512 是 Ministral 3 家族中规模最大的模型,具备前沿的能力,性能可与规模更大的 Mistral Small 3.2 24B 相媲美,是一款强大且高效的语言模型,能够为各类自然语言处理任务提供可靠的技术支撑。
Ministral 3 8B 2512 是 Mistral 旗下 Ministral 3 系列中的一款均衡型模型,它是一款性能强劲、运行高效的小型语言模型,同时具备视觉处理能力,能够兼顾语言任务与视觉相关的应用需求,适配多种场景下的轻量化部署与使用。
Ministral 3 3B 2512 是 Ministral 3 系列中体积最小的模型,它是一款性能强劲、运行高效的小型语言模型,同时具备视觉处理能力,能够适配对模型体积和运行效率有要求的各类场景,为用户提供兼具实用性与灵活性的语言及视觉相关服务。
Mistral Large 3 2512 是 Mistral 迄今推出的能力最强的模型,采用稀疏混合专家架构,拥有 410 亿个激活参数,总参数规模达 6750 亿,且以 Apache 2.0 许可协议发布。
DeepSeek V3.2 是一款大型语言模型,旨在兼顾高计算效率与出色的推理能力及智能体工具使用性能。该模型推出了 DeepSeek 稀疏注意力机制(DeepSeek Sparse Attention,简称 DSA),这是一种细粒度的稀疏注意力机制,能够在提升模型运行效率的同时,优化其对复杂任务的处理表现,为各类需要高效推理与工具调用的场景提供更可靠的支持。
Claude Opus 4.5是Anthropic推出的前沿推理模型,专为复杂软件工程、智能体工作流及长周期计算机操作场景优化。它具备出色的多模态能力,在真实场景的编码任务等领域展现出极具竞争力的表现,能够高效应对各类高难度专业需求,为用户提供可靠的技术支持与解决方案。
AllenAI推出的Olmo 3 32B Think是一款拥有320亿参数的大规模模型,专为深度推理、复杂逻辑链处理以及高级指令遵循场景打造。它的参数规模使其在高要求的评估任务中展现出强劲性能,能够适配各类需要复杂逻辑处理与精准指令响应的专业场景,为相关领域的应用提供可靠的模型支撑。
Nano Banana Pro是谷歌基于Gemini 3 Pro打造的最先进图像生成与编辑模型,它在原有Nano Banana的基础上,大幅提升了多模态推理、现实场景关联等核心能力,能够为用户提供更精准、更贴合实际需求的图像创作与修改服务,助力各类图像相关的创意与工作场景实现更高效的内容产出。
Deep Cogito: Cogito v2.1 671B 是一款混合专家(MoE)模型,属于全球顶尖的开源模型之一,其性能可与前沿的闭源模型及开源模型相媲美。该模型采用自我博弈结合强化学习的方式完成训练,在通用任务场景中展现出了优异的综合表现,为大模型领域的开源应用提供了更具竞争力的选择。
OpenAI推出的GPT-5.1是GPT-5系列最新的前沿级模型,相较于GPT-5,它具备更强的通用推理能力、更出色的指令遵循度以及更自然的对话风格,该模型采用自适应推理技术,能够更好地适配各类复杂场景的需求,为用户提供更精准、流畅的交互体验。
GPT-5.1 Chat(又称Instant)是OpenAI推出的5.1系列中一款快速、轻量化的模型,专为低延迟聊天场景优化,同时保留了强大的通用智能能力。它采用自适应推理机制,可根据任务需求选择性进行深度思考,在保证响应速度的前提下,兼顾了处理复杂对话与各类信息交互的实用性,适配对实时性要求较高的聊天场景使用需求。
OpenAI推出的GPT-5.1-Codex是一款专为软件工程与编码工作流程优化的专用模型,它既适配交互式开发会话场景,也能支持复杂工程任务的长时间独立运行,可助力开发者高效完成各类编码相关的专业工作。
OpenAI推出的GPT-5.1-Codex-Mini是GPT-5.1-Codex的轻量化版本,它在保留核心功能的同时,具备体积更小、运行速度更快的特点,能够适配对算力或部署规模有一定限制的场景,为开发者提供更灵活的代码生成与处理选择,可满足不同场景下的代码相关需求。
Kimi K2 Thinking是Moonshot AI迄今推出的最先进开源推理模型,它将K2系列拓展至具智能体能力的长程推理领域,基于万亿参数的混合专家(MoE)架构打造,为用户提供更强大、更适配复杂场景的推理支持,助力各类需要深度思考与规划的任务高效完成。
Amazon Nova Premier 1.0是亚马逊推出的多模态模型,属于该系列中能力最强的一款,尤其擅长处理复杂推理任务,同时也是蒸馏定制模型的优质选择,能够为定制模型的训练提供可靠的指导支持。
Perplexity的Sonar Pro Search是仅在OpenRouter API上提供的专属功能,其搭载的全新Pro Search模式是Perplexity目前最先进的智能代理搜索系统,专为深度推理与分析场景打造,相关定价规则基于对应服务标准制定,可满足用户对复杂信息检索与深度解读的专业需求。
Mistral: Voxtral Small 24B 2507是Mistral Small 3的升级版本,在保留顶级文本性能的同时,新增了业界领先的音频输入能力,在语音转录、翻译和音频理解任务中表现出色,可支持音频输入相关的各类智能处理需求。
gpt-oss-safeguard-20b是OpenAI基于gpt-oss-20b打造的安全推理模型,属于开源权重的210亿参数混合专家(MoE)模型,可在内容分类、大语言模型过滤、信任评估等安全任务中实现更低的延迟表现,为相关安全场景提供高效的技术支撑。
NVIDIA Nemotron Nano 12B 2 VL(免费版)是一款拥有120亿参数的开源多模态推理模型,专为视频理解与文档智能场景打造。它采用混合Transformer-Mamba架构,融合了Transformer的精准度与Mamba的高效特性,能够在处理视频、文档等多模态内容时实现更优的性能表现,为相关领域的智能应用提供可靠的技术支撑。
MiniMax M2 是一款紧凑高效的大语言模型,专为端到端编码与智能体工作流程优化设计。它拥有100亿激活参数、总计2300亿参数,在通用推理等任务中可提供接近前沿水平的智能表现,能适配各类需要高效处理编码及智能体相关任务的场景,助力开发者简化工作流程,提升任务处理的精准度与效率。
Qwen3-VL-32B-Instruct 是一款大规模多模态图文视频模型,专为实现文本、图像及视频的高精度理解与推理而设计。它拥有320亿参数,将深度视觉感知能力与先进的文本处理技术相结合,能够高效处理多模态信息,为复杂的跨模态任务提供可靠支持,助力用户完成各类需要视觉与语言协同的智能应用场景。
IBM Granite 4.0 Micro是Granite 4系列模型中的一款3B参数模型,属于IBM最新推出的系列模型产品。该系列模型针对长文本处理场景进行了微调优化,能够高效处理较长的文本内容,适配多种需要处理大篇幅文本的应用需求,为用户提供更贴合实际场景的模型使用体验。
OpenAI推出的GPT-5 Image Mini,将依托GPT-5 Mini的先进语言能力,与GPT Image 1 Mini的高效图像生成能力相结合,是一款原生多模态模型,具备出色的指令遵循能力,可实现文本与图像的协同处理,为用户提供更流畅的多模态交互体验。
Claude Haiku 4.5是Anthropic推出的速度最快、效率最高的模型,它能提供接近前沿水平的智能表现,成本和延迟却仅为更大规模Claude模型的一小部分,性能可与Claude Sonnet 4相媲美,是兼顾高效与高性价比的实用型AI模型。
Qwen3-VL-8B-Thinking是Qwen3-VL-8B多模态模型的推理优化版本,专为复杂场景、文档及时序序列的高级视觉与文本推理任务设计。它融合了增强型多模态对齐技术,能够更精准地关联视觉信息与文本逻辑,为用户提供更可靠的多模态推理支持,助力各类需要深度视觉理解与逻辑推导的应用场景。
Qwen3 VL 8B Instruct 是通义千问 Qwen3-VL 系列的多模态视觉语言模型,专为实现文本、图像与视频的高保真理解及推理能力打造。该模型采用 Interleaved-MRoPE 技术优化多模态融合效果,可支持长时序维度的内容处理,能为各类需要跨模态感知与分析的场景提供可靠的技术支撑。
OpenAI推出的GPT-5 Image模型,将OpenAI的GPT-5模型与顶尖图像生成能力相结合。它在推理、代码质量和用户体验方面实现了显著提升,同时融入了GPT Image 1出色的指令遵循能力,为用户带来更全面的智能交互体验。
OpenAI推出的o3 Deep Research是一款用于深度研究的先进模型,专为应对复杂的多步骤研究任务而设计。该模型始终会调用web_search工具,这一操作会产生额外的使用成本。
OpenAI推出的o4 Mini Deep Research是一款速度更快、成本更亲民的深度研究模型,非常适合处理复杂的多步骤研究任务。该模型始终会调用web_search工具,这一特性会产生额外的使用成本。
Llama-3.3-Nemotron-Super-49B-v1.5 是 NVIDIA 推出的一款拥有 490 亿参数、以英文为核心的推理与对话模型,它基于 Meta 的 Llama-3.3-70B-Instruct 模型开发,具备 128K 的上下文窗口。该模型经过后续训练,可适配智能体工作流,支持检索增强生成(RAG)与工具调用,训练过程覆盖数学、代码、科学等多个领域,能为相关场景提供高效的智能交互与处理能力。
Google推出的Gemini 2.5 Flash Image,别名“Nano Banana”,现已全面开放使用。这是一款具备情境理解能力的顶尖图像生成模型,能够完成各类图像生成相关任务,凭借先进的技术表现为用户提供高质量的图像创作支持,适配多种场景下的图像生成需求。
Qwen3-VL-30B-A3B-Thinking 是一款多模态模型,兼具强大的文本生成能力与图像、视频的视觉理解能力。其 Thinking 变体强化了在 STEM、数学及复杂任务中的推理表现,在相关专业领域及复杂场景的任务处理中具备突出优势,能够为用户提供更精准、高效的多模态交互与问题解决支持。
Qwen3-VL-30B-A3B-Instruct 是一款多模态模型,将强大的文本生成能力与图像、视频的视觉理解能力融为一体。它的指令微调版本针对通用多模态任务的指令遵循能力进行了优化,在感知各类视觉信息并结合文本需求完成任务方面表现突出,能够为用户提供精准的多模态交互支持。
GPT-5 Pro是OpenAI推出的最先进模型,在推理能力、代码质量和用户体验方面实现了重大提升,它针对需要逐步推理、指令遵循及多维度逻辑处理的复杂任务进行了专项优化,能够为用户提供更精准、高效且贴合需求的交互支持,适配各类高难度场景下的专业需求。
Z.ai: GLM 4.6 相较于 GLM-4.5 实现了多项关键升级,其上下文窗口已从128K tokens扩展至200K tokens,能够处理更为复杂的任务场景,为用户提供更强大的文本理解与处理能力,适配更多需要长文本交互的应用需求。
Claude Sonnet 4.5是Anthropic迄今为止最先进的Sonnet系列模型,专为现实场景中的智能体与编码工作流程优化打造。它在SWE-bench Verified等编码基准测试中展现出顶尖性能,能够高效应对复杂编码任务,适配开发者日常工作中的各类实际需求,为编码场景提供可靠且强劲的技术支撑。
DeepSeek V3.2 Exp是深度求索(DeepSeek)推出的实验性大语言模型,是衔接V3.1与未来架构的过渡性成果。该模型引入了DeepSeek稀疏注意力机制(DSA),这是一种细粒度的稀疏注意力技术,旨在优化模型的计算效率与性能表现,为后续更成熟的模型架构研发积累关键经验。
TheDrummer: Cydonia 24B V4.1 是一款基于 Mistral Small 3.2 24B 开发的无限制创意写作模型,具备出色的信息检索能力、指令遵循度与智能表现,能够为用户提供灵活且贴合需求的创作支持。
Relace Apply 3 是一款专业的代码补丁大语言模型,可直接将AI生成的建议编辑内容合并到你的源文件中,它能够将来自GPT-4o、Claude等模型的更新内容应用到你的文件里,为开发者提供便捷的代码修改整合能力,助力高效完成代码迭代与优化工作。
Qwen3 VL 235B A22B Thinking 是一款多模态模型,将强大的文本生成能力与图像、视频的视觉理解能力相融合,专门针对 STEM 领域及数学方向的多模态推理任务进行了优化,能够为相关领域的复杂问题提供精准的多模态分析与支持。
Qwen3-VL-235B-A22B Instruct 是一款开源权重的多模态模型,融合了强大的文本生成能力与针对图像、视频的视觉理解能力。该指令微调模型面向通用视觉语言场景,支持视觉问答、文档解析、图表表格分析等多样化任务,可满足不同领域对视觉语言交互的核心需求。
Qwen3-Max是基于Qwen3系列推出的更新版本,与2025年1月发布的版本相比,在推理能力、指令遵循度、多语言支持以及长尾知识覆盖方面均实现了重大提升,能够更好地满足复杂任务处理、跨语言交互等多样化需求,为用户提供更可靠、全面的模型服务体验。
Qwen3 Coder Plus是阿里巴巴推出的专有版本模型,基于开源的Qwen3 Coder 480B A35B打造,是一款功能强大的编程智能体模型,专注于通过工具调用实现自主编程,能够为开发者提供高效的代码生成、调试与优化支持,适配各类复杂编程场景的需求。
OpenAI推出的GPT-5 Codex是GPT-5的专属优化版本,专为软件工程与编码工作流程打造,既适配交互式开发场景,也能独立完成各类复杂的工程任务,为开发者提供高效的技术支持。
DeepSeek V3.1 Terminus是DeepSeek V3.1的迭代更新版本,它在保留原模型核心能力的基础上,针对用户反馈的语言一致性、智能体能力等问题进行了优化,进一步完善了模型的综合表现,为用户提供更稳定、适配性更强的使用体验。
Qwen3 Coder Flash是阿里巴巴推出的一款快速且高性价比的模型,属于其自研Qwen3 Coder Plus的轻量化版本,是一款强大的编程智能体模型,专注于通过工具调用实现自主编程。
Qwen3-Next-80B-A3B-Thinking 是通义千问 Qwen3-Next 系列中一款以推理为核心的对话模型,默认会输出结构化的“思考”过程轨迹。它专为解决复杂多步骤问题而设计,可应用于数学证明、代码生成与调试、逻辑推理以及智能体相关场景,能为用户提供更清晰的推理路径支撑,助力处理各类需要深度逻辑推演的任务。
Qwen3-Next-80B-A3B-Instruct 是通义千问 Qwen3-Next 系列中一款经过指令微调的对话模型,专为快速、稳定地生成无“思考”痕迹的响应而优化,可应对推理、代码生成、知识问答及多语言处理等各类复杂任务。
Qwen3-Next-80B-A3B-Instruct 是通义千问系列中一款指令微调的对话模型,专为快速稳定的响应而优化,不会产生“思考”痕迹,可高效处理推理、代码生成、知识问答及多语言相关的复杂任务,且支持免费使用。
Qwen Plus 0728 是基于 Qwen3 基础模型开发的混合推理模型,支持 100 万 token 的上下文窗口,在性能、推理速度与部署成本之间实现了均衡的综合表现,能够适配多种需要处理长文本的应用场景。
Qwen Plus 0728(推理版)基于Qwen3基础模型开发,是一款具备100万上下文窗口的混合推理模型,在性能、推理速度与使用成本之间实现了均衡的综合表现,能够适配多类需要长文本处理与逻辑推理的应用场景,为用户提供稳定且高效的模型服务支持。
NVIDIA Nemotron Nano 9B V2 是 NVIDIA 从零开始训练的大语言模型,被设计为可同时适配推理类与非推理类任务的统一模型,能够响应用户的各类查询,为用户提供对应的内容支持。
Kimi K2 0905 是 Moonshot AI 推出的 Kimi K2 0711 的九月更新版本,是一款由 Moonshot AI 研发的大规模混合专家(MoE)语言模型,具备总计约1万亿参数的规模,激活时会调用其中32个专家模块,在复杂推理、多任务处理等场景中展现出更优的性能表现,为用户提供更精准、高效的语言交互与内容生成服务。
Qwen3 30B A3B Thinking 2507 是一款拥有300亿参数的混合专家推理模型,专为需要多步深度思考的复杂任务优化。该模型专门设计了“思考模式”,可将内部推理过程与最终输出结果清晰区分,便于追踪模型的思考逻辑,适配各类需要深度推理的应用场景。
Hermes 4 70B是Nous Research推出的混合推理模型,基于Meta-Llama-3.1-70B构建。它采用了与同系列更大规模的405B版本相同的混合模式,支持模型根据需求灵活切换推理方式,兼顾复杂任务的深度推理能力与常规任务的高效响应表现,适配多场景下的各类推理需求。
Nous: Hermes 4 405B 是由 Nous Research 发布的基于 Meta-Llama-3.1-405B 打造的大规模推理模型,它引入了混合推理模式,模型可选择在内部进行深度思考,以此提升复杂任务的处理能力,为各类需要逻辑推理的场景提供更高效、精准的支持,助力用户应对多维度的推理需求。
DeepSeek V3.1 是一款混合架构的大型推理模型,拥有海量参数,其中激活参数规模为37B,可通过提示词模板支持思维链推理与非推理两种模式。该模型在 DeepSeek-V3 基础模型之上进行了优化,采用两阶段长上下文处理机制,能够更好地适配长文本相关的各类任务需求,为用户提供更高效的推理与内容处理能力。
Mistral Medium 3.1是Mistral Medium 3的更新版本,是一款高性能企业级语言模型,旨在以大幅降低的运营成本提供前沿级能力,它在性能与成本之间实现了平衡,能够满足企业在各类复杂场景下的语言处理需求,为用户带来高效且经济的AI应用体验,助力企业优化业务流程、提升运营效率。
Z.ai旗下的GLM-4.5V是一款面向多模态智能体应用的视觉-语言基础模型,采用混合专家(Mixture-of-Experts,MoE)架构,拥有庞大的参数规模,在视频理解等多模态任务中达到了行业领先的性能表现,能够为各类需要视觉与语言交互的智能应用提供核心技术支撑。
Jamba Large 1.7是Jamba开放系列的最新模型,在 grounding( grounding可保留专有名词)、指令遵循能力及整体效率方面均有提升。该模型基于混合SSM-Transformer架构构建,具备256K的上下文窗口,能更精准地处理长文本信息,适配多场景的复杂任务需求,为用户提供更稳定高效的AI交互体验。
OpenAI推出的GPT-5 Chat,专为企业级应用打造,主打高级自然的多模态交互,具备上下文感知能力,能够支撑复杂场景下的流畅对话需求,适配企业各类业务场景的沟通与协作需求。
GPT-5是OpenAI推出的当前最先进模型,在推理能力、代码生成质量以及用户交互体验方面均实现了显著提升。该模型针对需要逐步逻辑推导、精准遵循指令以及高准确性的复杂任务进行了专项优化,能够为用户提供更可靠、更贴合需求的输出支持。
OpenAI推出的GPT-5 Mini是GPT-5的轻量化版本,专为处理轻量级推理任务打造。它保留了GPT-5具备的指令遵循能力与安全调优优势,同时大幅降低了延迟与运行成本,能高效适配对算力资源要求较低的各类场景。
GPT-5 Nano是OpenAI推出的GPT-5体系中体积最小、运行速度最快的变体,专为开发者工具、快速交互场景及超低延迟环境优化。它在推理深度上相比同系列更大的模型存在局限,但凭借轻量化的设计,能在资源受限的场景中高效完成任务,为对响应速度和部署灵活性有高要求的应用提供适配方案。
gpt-oss-120b是OpenAI推出的开源权重混合专家(MoE)语言模型,拥有1170亿参数,专为高推理、智能体及通用生产场景打造。该模型在每次前向传播时激活51亿参数,经过优化后可适配各类对性能要求较高的实际应用需求,兼顾推理能力与生产环境的落地适配性。
gpt-oss-20b是OpenAI推出的开源权重模型,采用Apache 2.0许可证发布,拥有210亿参数,采用混合专家(MoE)架构,每次前向传播时激活36亿参数,专为高效处理各类自然语言任务优化,兼具开源模型的灵活性与专业性能,可支持多场景下的文本生成、理解等相关应用需求。
gpt-oss-20b是OpenAI推出的开源权重模型,采用Apache 2.0许可发布,拥有210亿参数,属于混合专家(MoE)架构,每次前向传播时激活的参数为36亿,该模型经过优化,可满足各类通用自然语言处理任务的需求,且支持免费使用。
Claude Opus 4.1是Anthropic推出的旗舰模型迭代版本,在编码、推理及智能体任务领域的表现均有提升。它在SWE-bench Verified评测中取得了74.5%的成绩,且在多项核心能力维度上展现出显著的性能提升,能够更高效地应对复杂专业场景下的各类任务需求。
Mistral推出的前沿代码专用语言模型Codestral 2508于2025年7月底正式发布,该模型专注于低延迟、高频率的代码处理任务,支持代码补全(FIM)、代码纠错以及测试用例生成等核心功能,能为开发者提供高效的代码辅助支持。
Qwen3-Coder-30B-A3B-Instruct 是一款拥有305亿参数的混合专家(MoE)模型,配备128个专家模块,每次前向传播时激活其中8个模块,专为高级代码生成、仓库级代码理解以及智能体工具调用场景打造,依托相关技术底座构建,可支撑复杂编程任务与智能交互场景的高效运行。
Qwen3 30B A3B Instruct 2507 是通义千问(Qwen)推出的混合专家语言模型,总参数规模达305亿,每次推理时激活的参数为33亿。该模型采用非思考模式运行,核心定位是实现高质量的指令遵循、多语言理解,还具备适配复杂任务的实用能力,能为用户提供精准的语言交互支持。
Z.ai旗下的GLM-4.5是最新旗舰级基础模型,专为智能体类应用场景打造。它采用混合专家(MoE)架构,支持最长达128k token的上下文窗口,在智能体交互、复杂任务处理等场景中具备显著性能优势,能为各类依赖智能体的应用提供强大的技术支撑。
GLM-4.5-Air是智谱AI最新旗舰模型家族的轻量化变体,专为智能体中心型应用场景打造。它与GLM-4.5一样采用混合专家(MoE)架构,同时具备更紧凑的参数规模,在兼顾核心性能的前提下,能更好适配对部署资源要求更严苛的应用场景,为各类智能体驱动的任务提供高效支撑。
Qwen3 235B A22B Thinking 2507 是一款高性能、开源权重的混合专家(MoE)语言模型,专为复杂推理任务优化设计。它在每次前向传播时仅激活2350亿参数中的220亿个,原生支持的上下文窗口长度可达262144,能够高效处理超长文本相关的复杂推理需求,适配各类需要深度逻辑推演的应用场景。
Qwen3 Coder 480B A35B 是通义千问团队开发的混合专家(MoE)代码生成模型,专为智能体编码任务优化,涵盖函数调用、工具使用以及长上下文推理等场景,能够为各类代码开发相关的智能任务提供高效支持。
Qwen3 Coder 480B A35B 是通义千问团队开发的混合专家(MoE)代码生成模型,支持免费使用。该模型专为智能体编码任务优化,可胜任函数调用、工具使用以及长上下文推理等场景,能为各类编程相关的智能交互需求提供高效支持。
UI-TARS-1.5 是字节跳动开发的多模态视觉语言智能体,专为 GUI 类环境优化,覆盖桌面界面、网页浏览器、移动系统及游戏等场景。该模型基于 UI-TARS 框架打造,结合强化学习技术,可理解并处理图形用户界面相关的复杂任务,为用户提供适配多端界面的智能交互支持。
Gemini 2.5 Flash Lite是Google Gemini 2.5系列中的轻量推理模型,专为超低延迟与高成本效益优化,具备更出色的吞吐量、更快的令牌生成速度,以及更优异的性能表现,能够适配对响应速度和资源消耗有较高要求的各类应用场景。
Qwen3-235B-A22B-Instruct-2507 是一款基于 Qwen3-235B 架构的多语言指令调优混合专家语言模型,每轮前向传播激活参数达 220 亿。该模型针对通用文本生成任务进行了优化,涵盖指令遵循、内容创作、信息处理等多种场景,能够适配不同语言的交互需求,为用户提供精准、流畅的文本输出支持。
MoonshotAI推出的Kimi K2 0711是一款指令优化型混合专家(MoE)大语言模型,总参数规模达1万亿,每轮前向传播时激活的参数为320亿,专为提升指令理解与执行能力打造,适配多场景下的复杂语言交互需求,可高效处理各类专业领域的文本任务,为用户提供精准、流畅的语言服务支持。
Venice: Uncensored 是由 dphn.ai 联合 Venice.ai 开发的 Dolphin Mistral 24B Venice Edition,它是 Mistral-Small-24B-Instruct-2501 的微调变体。该模型作为一款“无审查”指令微调大语言模型,在保留基础模型核心能力的同时,针对特定使用场景优化了指令响应的灵活性,能够适配对内容限制要求较低的专业应用需求。
Venice: Uncensored (free) 是由 dphn.ai 联合 Venice.ai 开发的模型,它是 Mistral-Small-24B-Instruct-2501 的微调变体,属于“无审查”指令微调大语言模型,旨在保留模型在生成内容时的表达自由度,避免常规模型常见的内容限制,为用户提供更开放的文本生成服务。
Hunyuan A13B Instruct是腾讯开发的13B激活参数混合专家(MoE)语言模型,总参数规模达80B,支持通过思维链(Chain-of-Thought)开展推理,在多项基准测试中具备较强的竞争力,能够满足多场景下的语言交互与复杂推理需求。
Morph V3 Large是一款高精度的代码编辑专用模型,可实现复杂代码的精准转换,处理速度约为每秒4500个token,准确率达98%。使用该模型时,需按照指定格式输入提示词,具体格式为<instruction>{指令内容}</instruction> <code>{初始代码}</code>,以确保模型能准确识别并执行代码编辑需求。
百度ERNIE 4.5系列的多模态混合专家模型ERNIE-4.5-VL-424B-A47B,总参数规模达4240亿,每轮推理中激活的参数为470亿,该模型采用联合训练方式,同步学习文本与图像两类数据的特征,具备跨模态理解与生成能力,可适配多场景下的复杂任务需求。
Mistral Small 3.2 24B(全称Mistral-Small-3.2-24B-Instruct-2506)是法国Mistral公司推出的240亿参数更新版模型,专为指令遵循、减少重复内容及优化函数调用能力设计。与3.1版本相比,3.2版本在多项核心任务的准确性上实现了显著提升,能更精准地响应各类指令需求,适配更多专业场景的功能调用需求。
MiniMax M1 是一款大规模开放权重推理模型,专为超长上下文处理与高效推理场景打造。它采用混合专家(MoE)架构,并搭配自研的“闪电注意力”机制,能够在保障推理性能的同时,适配各类对上下文长度和运算效率有较高要求的任务场景,为用户提供稳定且高效的推理支持。
Gemini 2.5 Flash是谷歌推出的旗舰主力模型,专为高级推理、编程、数学及科学任务打造,内置“思考”能力,可输出更具深度与准确性的响应,能高效应对各类复杂场景下的专业需求,兼顾性能与实用性,是谷歌在AI模型领域的重要成果之一。
Gemini 2.5 Pro是谷歌推出的顶尖AI模型,专为高级推理、编程、数学及科研任务打造。它搭载了“思考”能力,能在生成响应时开展逻辑推演,以此提升输出的精准度,可高效应对各类复杂的专业场景需求。
OpenAI的o系列模型采用强化学习训练,能够在回答前进行思考,完成复杂推理任务。其中的o3 Pro模型投入了更多算力用于深度思考,可提供更稳定可靠的输出表现,助力用户应对各类需要深度逻辑推导的场景需求。
Google Gemini 2.5 Pro Preview 06-05是谷歌推出的顶尖AI模型,专为高级推理、编程、数学及科学任务打造。它搭载“思考”能力,能在生成响应时开展推理,以此提升输出的准确性,可高效应对各类复杂专业场景下的AI需求。
DeepSeek: R1 0528 是 DeepSeek 于5月28日推出的更新版本,其性能可与 OpenAI o1 相媲美,同时采用开源模式,具备完全开放的推理令牌。该模型总参数规模达671B,激活参数为37B,兼顾了高性能与开源特性,为相关领域的应用提供了更灵活的使用可能。
Claude Opus 4 是 Anthropic 推出的模型,发布时被评测为全球顶尖的代码模型,能在复杂、长周期任务及智能体工作流中保持稳定的性能表现,还在相关领域树立了全新的基准标准,可为开发者提供可靠的技术支持,助力各类代码相关场景的高效落地。
Anthropic推出的Claude Sonnet 4大幅提升了前代产品Sonnet 3.7的能力,在编码与推理任务中表现出色,精准度与可控性均有所优化,在SWE-bench评测中达到了顶尖性能,为开发者和用户提供了更可靠的智能交互与任务处理体验,适配更多复杂场景下的专业需求。
Google的Gemma 3n 4B模型专为手机、笔记本电脑、平板电脑等移动及低资源设备的高效运行而优化,支持文本、视觉数据、音频等多模态输入,可完成多样化的相关任务,适配不同设备的使用场景,兼顾运行效率与功能丰富性。
Mistral Medium 3是一款高性能企业级语言模型,旨在以大幅降低的运营成本提供前沿级别的能力。它在兼顾顶尖推理能力与多模态表现的同时,将运营成本降至同类产品的八分之一,能够为企业用户提供高效且经济的AI解决方案,适配各类复杂的业务场景需求。
Google Gemini 2.5 Pro Preview 05-06 是谷歌推出的顶尖AI模型,专为高级推理、编程、数学及科研任务打造。它具备“思考”能力,能在生成响应时开展深度推理,从而显著提升输出的准确性,可高效应对各类复杂专业场景下的AI需求。
Virtuoso Large是Arcee AI推出的顶级通用大语言模型,参数规模达720亿,经优化后可应对跨领域推理、创意写作及企业问答等场景。与多数700亿参数的同类模型不同,它保留了128k的上下文窗口,能更高效地处理长文本输入,适配更复杂的业务需求与创作任务,为用户提供更稳定、精准的语言处理能力。
Meta: Llama Guard 4 12B 是一款基于 Llama 4 Scout 开发的多模态预训练模型,经微调后专门用于内容安全分类。和此前的版本类似,它可对大型语言模型生成的各类内容开展安全分类工作,助力识别并过滤不符合安全规范的内容,为内容安全管控提供可靠的技术支撑。
Qwen3 30B A3B 是通义千问(Qwen)大语言模型系列的最新一代产品,兼具密集型与混合专家(MoE)两种架构,在推理能力、多语言支持以及高级智能体任务方面表现突出,能够为用户提供更全面、高效的语言模型服务,适配多样化的复杂应用场景需求。
Qwen3-8B 是通义千问系列中拥有约82亿参数的稠密因果语言模型,专为推理密集型任务与高效对话场景设计,支持在适配数学等复杂任务的“思考模式”与常规对话模式间无缝切换,兼顾推理能力与运行效率,可满足多类自然语言处理场景的使用需求。
Qwen3-14B是通义千问(Qwen)系列的一款稠密型因果语言模型,拥有约148亿参数,专为复杂推理与高效对话场景打造。它支持在“思考模式”与其他模式间无缝切换,能够适配多样化的任务需求,兼顾推理的深度与交互的流畅性,可满足不同场景下的语言处理要求。
Qwen3-32B是通义千问(Qwen)系列的一款稠密因果语言模型,拥有约328亿参数,专为复杂推理与高效对话场景优化设计。它支持在“思考模式”与常规模式间无缝切换,可适配各类需要深度逻辑推演或流畅交互的任务需求,兼顾推理能力与运行效率,能为用户提供稳定且贴合需求的语言模型服务。
Qwen3-235B-A22B是通义千问(Qwen)开发的混合专家(MoE)模型,拥有2350亿参数,每次前向传播时激活220亿参数。该模型支持在“思考模式”与其他模式间无缝切换,其中“思考模式”可用于复杂推理、数学运算等场景,能为用户提供适配不同任务需求的交互体验。
OpenAI o4-mini-high 与 o4-mini 属于同一模型,仅将推理强度设置为“高”。OpenAI o4-mini 是 o 系列中的轻量化推理模型,在兼顾推理能力的同时,针对快速、高性价比的运行表现进行了优化,能够在各类需要逻辑推导的场景中提供可靠的支持,适配对效率与成本有要求的使用需求。
OpenAI推出的o3是一款覆盖多领域的全面且强大的模型,它为数学、科学、编程及视觉推理任务树立了全新标杆,同时在技术写作与指令遵循方面也表现出色,能够高效应对各类专业场景下的复杂需求。
OpenAI o4-mini是o系列中的轻量化推理模型,在保持强大多模态与智能体能力的同时,针对高效快速、高性价比的运行表现进行了优化,支持工具调用,具备颇具竞争力的推理能力,能够满足各类对性能与成本有平衡要求的场景需求。
GPT-4.1是OpenAI推出的旗舰级大语言模型,专为高级指令遵循、实际场景下的软件工程任务以及长文本上下文推理需求优化,它支持100万token的上下文窗口,在多项核心能力上的表现优于GPT-4o,能够为开发者和用户提供更可靠的复杂任务处理能力,适配各类需要深度理解长文本、精准执行指令的应用场景。
OpenAI推出的GPT-4.1 Mini是一款中型模型,其性能可与GPT-4o相媲美,同时具备更低的延迟与成本优势。该模型保留了100万token的上下文窗口,在相关硬核测试中取得了45.1%的得分,能够高效适配各类需要中等规模语言模型支撑的应用场景,为用户提供兼顾性能与经济性的AI服务。
OpenAI推出的GPT-4.1 Nano是GPT-4.1系列中速度最快、成本最低的模型,专为对延迟要求较高的任务设计。它凭借小巧的规模就能实现出色的性能表现,适配对运行效率有特定要求的各类场景,能在保障任务处理效果的同时,满足低延迟、低成本的应用需求。
Meta: Llama 4 Maverick 17B Instruct (128E) 是 Meta 推出的高容量多模态语言模型,采用混合专家(MoE)架构,每轮前向推理激活 128 个专家,拥有 170 亿个活跃参数,可支持多模态任务处理,适配各类需要强语言理解与生成能力的应用场景。
Meta开发的Llama 4 Scout 17B Instruct (16E)是一款混合专家(MoE)语言模型,总参数规模达1090亿,推理时激活170亿参数,原生支持多模态输入,可适配多样化的语言与多模态交互场景,为用户提供灵活的模型应用能力。
DeepSeek V3 0324 是深度求索(DeepSeek)团队推出的旗舰聊天模型系列的最新迭代版本,属于拥有6850亿参数的混合专家模型,它承接了此前的DeepSeek V3模型,在相关任务中表现出色。
OpenAI的o1系列模型通过强化学习训练,能够在回答前进行深度思考,完成复杂推理任务。其中o1-pro模型投入了更多算力用于深度思考,可在复杂场景下提供更可靠的推理结果,适配对深度思考能力要求较高的任务需求。
Mistral Small 3.1 24B Instruct 是 Mistral Small 3(2501)的升级版本,拥有240亿参数,具备先进的多模态能力,在基于文本的推理等任务中达到了行业领先的性能表现,能够为各类文本处理相关场景提供可靠的技术支持,适配不同的智能应用需求。
Google的Gemma 3 4B模型具备多模态能力,支持图文输入与文本输出,可处理最长达128k token的上下文窗口,能理解超过140种语言,在数学运算、逻辑推理及对话交互等方面的性能均得到了显著提升。
Google的Gemma 3 12B是一款具备多模态能力的模型,支持图文输入与文本输出,可处理最长达128k token的上下文窗口,能理解超过140种语言,在数学运算、逻辑推理及对话交互等方面的能力均得到了显著提升。
Cohere Command A 是一款开放权重的1110亿参数模型,拥有25.6万的上下文窗口,主打在智能体、多语言及编程场景下实现出色性能表现。相较于其他主流闭源模型,它在核心应用场景的适配性与性能表现上具备差异化优势,能够为开发者提供灵活且高效的模型支持,助力各类AI应用的落地与优化。
OpenAI推出的GPT-4o-mini Search Preview是一款专为Chat Completions场景下的网页搜索打造的专用模型,它经过专门训练,能够准确理解各类网页搜索需求并高效执行对应的搜索操作,为用户提供贴合搜索意图的相关结果支持。
OpenAI推出的GPT-4o Search Preview是一款专为Chat Completions场景下的网页搜索打造的专用模型,它经过专门训练,能够准确理解各类网页搜索查询指令并执行对应的搜索操作,为用户提供贴合搜索需求的响应支持。
Reka Flash 3是由Reka开发的通用指令调优大语言模型,拥有210亿参数,在通用对话、代码编写、指令遵循及函数调用等任务中表现出色,具备多模态交互能力,可适配多样化的实际应用场景,为用户提供高效、精准的语言处理服务。
Google推出的Gemma 3 27B是一款具备多模态能力的模型,支持视觉-语言输入与文本输出,可处理最长达128k token的上下文窗口,能理解超过140种语言,在数学运算、逻辑推理及对话交互等方面的能力均得到显著提升,为用户带来更全面的多场景应用支持。
TheDrummer: Skyfall 36B V2 是基于 Mistral Small 2501 优化迭代的增强版本,经过专门微调,在创意生成、细腻文本创作、角色扮演互动以及连贯叙事等方面的表现均得到了显著提升,能够更好地满足用户在各类文本创作与互动场景中的多样化需求。
Sonar Reasoning Pro是一款由DeepSeek R1驱动、具备思维链(CoT)能力的顶级推理模型,其定价已包含Perplexity搜索服务的费用,详细信息可查看指定文档链接。该模型专为复杂推理任务打造,能依托深度思考逻辑输出精准可靠的结果,适配各类需要深度分析的应用场景。
Perplexity: Sonar Pro 的定价已包含 Perplexity 搜索服务的费用,详细信息可查看官方文档。针对需要更高级功能的企业用户,Sonar Pro API 可处理深度多步骤查询,还具备额外的扩展能力,能满足企业在复杂信息检索与处理场景下的专业需求。
Perplexity推出的Sonar Deep Research是一款面向研究场景的模型,专为复杂主题下的多步骤检索、信息整合与推理任务打造。它能够自主开展搜索、读取并评估各类信息源,在收集信息的过程中不断优化自身的处理路径,为用户提供精准可靠的研究支撑。
Mistral Saba是一款专为中东和南亚地区打造的240亿参数语言模型,能够提供准确且贴合语境的回复,同时保持高效的运行性能。该模型基于经过精心筛选的区域相关数据训练而成,适配当地语言使用习惯与文化语境,可满足该地区用户在信息获取、内容创作等多方面的语言交互需求,为用户带来更贴合使用场景的智能服务体验。
OpenAI o3-mini-high 是与 o3-mini 同源的模型,仅将推理强度参数 reasoning_effort 设置为高。o3-mini 是一款高性价比的语言模型,专为 STEM 领域推理任务优化,在科学、数学等相关领域表现尤为突出,能够为用户提供精准且高效的推理支持,适配各类需要专业逻辑推导的应用场景。
AionLabs推出的Aion-RP 1.0 (8B),即Aion-RP-Llama-3.1-8B,在RPBench-Auto基准测试的角色评估环节中排名第一。RPBench-Auto是Arena-Hard-Auto的角色扮演专属变体,采用大模型互相对话响应进行评估的机制。该模型是一款经过微调的基础模型,专为角色扮演类场景优化,能够在角色演绎相关的评估任务中展现出出色的表现。
Qwen2.5 VL 72B Instruct 是一款多模态大模型,它不仅能精准识别图像中的常见物体,比如花卉、鸟类、鱼类和昆虫,还具备强大的图像内容分析能力,可对图像内的文本、图表、图标、图形以及排版布局进行深度解读,为用户提供高效的多模态信息处理支持。
Qwen-Plus 是基于 Qwen2.5 基础模型开发的大语言模型,拥有 131K 的上下文窗口,在性能、运行速度与使用成本之间实现了均衡的综合表现,能够适配多种不同场景的应用需求。
OpenAI o3-mini是一款高性价比的语言模型,专为STEM推理任务优化,尤其在科学、数学和编码领域表现出色。该模型支持`reasoning_effort`参数,可根据实际需求调整推理强度,适配不同复杂度的任务场景,兼顾性能与成本的平衡,能为相关领域的开发与研究提供可靠的技术支撑。
Mistral Small 3是一款拥有240亿参数的语言模型,针对各类常见AI任务的低延迟表现进行了优化。它以Apache 2.0许可证发布,包含预训练版本与指令微调版本,能够适配不同场景的使用需求,为用户提供高效稳定的AI语言服务。
Perplexity Sonar是一款轻量化、高性价比、运行快速且操作简便的模型,目前新增了引用功能,还支持自定义数据源,专为希望集成轻量化问答功能的企业打造,能帮助企业便捷获取精准且可溯源的信息,适配各类需要高效问答能力的业务场景。
DeepSeek R1 Distill Llama 70B 是一款基于 Llama-3.3-70B-Instruct 开发的蒸馏大语言模型,依托 DeepSeek R1 的输出结果构建,融合了先进的蒸馏技术,在各类任务中都能实现出色的性能表现,为自然语言处理相关场景提供可靠的模型支撑。
DeepSeek R1 现已推出,其性能可与 OpenAI o1 相媲美,同时采用开源模式,具备完全开放的推理令牌。该模型整体规模达 671B 参数,推理过程中激活的参数为 37B,兼顾了性能优势与开源特性,为相关应用场景提供了灵活的使用可能。
MiniMax-01 是一款融合 MiniMax-Text-01 文本生成能力与 MiniMax-VL-01 图像理解能力的多模态模型,拥有海量参数规模,单次推理时会激活部分关键参数,可处理较长的上下文信息,能为用户提供涵盖文本创作、图像解读等多场景的智能服务,适配多样化的复杂交互需求。
微软研究院推出的Phi-4模型,专为复杂推理任务打造,在内存有限或需快速响应的场景下也能高效运行。该模型聚焦于提升推理能力与运行效率的平衡,适配多种对性能和资源占用有要求的应用场景,助力用户在不同环境下都能获得稳定且优质的使用体验。
DeepSeek-V3是DeepSeek团队推出的最新模型,它在过往版本的指令遵循与代码编写能力基础上迭代升级,基于近15万亿token完成预训练,相关评测结果展现出该模型在通用任务与专业场景中具备更出色的性能表现,能够为用户提供更精准、高效的智能服务支持。
Sao10K推出的Llama 3.3 Euryale 70B是一款主打创意角色扮演场景的模型,它是此前Euryale L3 70B v2.2的迭代升级版本,能为用户提供适配角色扮演需求的交互体验,延续了该系列在角色互动领域的技术优势与应用特性。
OpenAI推出的最新最强模型系列o1,核心设计是在生成回复前投入更多时间进行思考。该模型系列通过大规模强化学习完成训练,具备出色的推理能力,能够处理需要深度逻辑推导的复杂任务,为用户提供更严谨、精准的输出结果,是OpenAI在智能推理领域的重要升级成果。
Cohere推出的Command R7B(12-2024)是Command R+模型的一款小型、高效的迭代更新版本,于2024年12月发布。该模型在检索增强生成(RAG)、工具调用、智能体开发以及其他需要复杂推理能力的任务中表现出色,能够为相关场景提供可靠的技术支持。
Meta Llama 3.3 70B Instruct 是一款多语言大语言模型,属于预训练并经过指令微调的生成式模型,采用700亿参数规模,仅支持文本输入与文本输出。该模型专注于文本领域的指令优化,能够基于用户的指令生成符合要求的文本内容,适配多语言场景下的各类文本处理任务,为用户提供精准的文本生成与交互服务。
Meta Llama 3.3 70B Instruct(免费版)是一款多语言大语言模型,属于经过预训练与指令微调的生成式模型,采用700亿参数规模,仅支持文本输入与文本输出,专注于为用户提供符合指令要求的文本生成相关服务。
Amazon Nova Lite 1.0是亚马逊推出的一款超低成本多模态模型,核心聚焦于快速处理图像、视频及文本类输入,最终生成文本形式的输出内容,该模型在成本控制与多模态信息处理效率上具备突出优势,能够适配各类对成本敏感且需要高效处理多模态数据的应用场景。
Amazon Nova Micro 1.0是一款仅支持文本的模型,属于Amazon Nova系列,它在该系列中具备最低的响应延迟,且成本极低。该模型拥有一定的上下文处理长度,能够高效处理文本相关任务,适配对响应速度和成本有较高要求的各类文本处理场景。
Amazon Nova Pro 1.0是亚马逊推出的一款实用多模态模型,核心优势在于能为各类任务兼顾准确性、运行速度与成本控制。截至当前,该模型可支持文本、图像等多种模态的输入处理,适配从内容生成到信息分析的多元场景,凭借均衡的性能表现,能为不同需求的用户提供可靠的AI服务支撑。
2024年11月20日发布的OpenAI GPT-4o版本,在创意写作能力上实现了升级,能够产出更自然、更具吸引力且贴合需求的内容,有效提升了内容的相关性与可读性。它在处理上传的各类内容时表现也更为出色,可更好地适配用户的相关使用需求,为用户提供更优质的交互体验。
这是Mistral AI推出的旗舰模型Mistral Large 2,版本号为mistral-large-2407,是一款拥有专有权重的模型,在推理、代码编写、JSON处理、对话交互等多个领域都表现出色,相关的发布公告可通过指定链接查看。
Qwen2.5-Coder 32B Instruct 是通义千问推出的最新代码专用大语言模型系列,其前身为 CodeQwen。相较于 CodeQwen1.5,该模型在代码生成、代码推理等核心能力上实现了显著提升,专为满足编程场景下的复杂任务需求设计,能够为开发者提供更高效的代码相关支持。
TheDrummer: UnslopNemo 12B 是由 Rocinante 的开发团队推出的最新模型,基于 UnslopNemo v4.1 打造,专为冒险创作与角色扮演类场景设计,能够为用户提供适配这类场景的内容生成支持,助力创作者打造丰富的冒险故事或沉浸式角色扮演体验。
Magnum v4 72B是一系列旨在复刻Claude 3模型(具体为Sonnet与Opus)散文品质的模型,它基于Qwen2.5 72B进行微调优化,可在相关平台通过指定链接访问对应Anthropic Claude 3.5 Sonnet与Claude 3 Opus的关联资源。
Ministral 8B 是 Mistral 推出的一款拥有 80 亿参数的模型,采用了独特的交错滑动窗口注意力机制,能够实现更快速、更节省内存的推理过程。该模型专为边缘场景设计,支持最长达 128000 的上下文长度,可适配对资源占用和响应速度有要求的边缘计算应用场景。
Qwen2.5 7B Instruct 是通义千问推出的 Qwen 大语言模型系列的最新版本,相较于 Qwen2 有显著升级,不仅大幅扩充了知识储备,还在代码编写等核心能力上实现了明显提升,能更好地满足各类专业场景下的语言交互需求。
Inflection 3 Pi 是 Inflection 公司推出的大模型,为旗下 Pi 聊天机器人提供核心技术支撑,涵盖背景设定、情感智能、生产力工具及安全防护等多方面能力。该模型可获取最新资讯,在客户服务、角色扮演等场景中表现出色,能为用户带来兼具实用性与互动性的智能对话体验。
Inflection 3 Productivity 是一款专为遵循指令优化的模型,更适配需要生成 JSON 输出或严格遵循给定规范的任务,还可获取近期新闻资讯,在情感相关的任务场景中也能提供适配的支持,能够满足用户在各类需要精准执行指令、输出规范内容的使用需求。
TheDrummer: Rocinante 12B 是一款专为沉浸式叙事与丰富散文创作打造的模型。早期测试者反馈,它具备拓展性的词汇库,能提供独特且富有表现力的用词选择,还能提升创作的创造力,助力生成生动鲜活的叙事内容,为各类故事创作场景提供有力支持。
Meta: Llama 3.2 11B Vision Instruct 是一款拥有110亿参数的多模态模型,专为处理结合视觉与文本数据的任务而设计,在图像描述等多模态任务中表现出色,能够有效整合视觉信息与文本逻辑,为各类需要图文协同处理的场景提供可靠的模型支持,助力完成复杂的多模态交互与内容生成类工作。
Meta: Llama 3.2 1B Instruct 是一款拥有10亿参数的语言模型,专注于高效完成各类自然语言任务,涵盖文本摘要、智能对话以及多语种文本分析等场景。它凭借较小的模型体积,能够在各类算力资源有限的设备或环境中灵活运行,兼顾性能与部署的便捷性,为用户提供实用的自然语言处理能力。
Meta: Llama 3.2 3B Instruct 是一款拥有30亿参数的多语言大语言模型,采用最新Transformer架构设计,专为对话生成、推理、文本摘要等高级自然语言处理任务优化,能够高效完成各类复杂语言相关工作,适配多场景下的专业语言需求。
Meta Llama 3.2 3B Instruct(免费)是一款拥有30亿参数的多语言大语言模型,采用最新Transformer架构打造,专为对话生成、推理、文本摘要等高级自然语言处理任务优化,能够高效处理多语言场景下的各类语言相关需求,为用户提供精准且流畅的语言交互与处理服务。
Qwen2.5 72B Instruct 是通义千问推出的最新一代大语言模型系列,相比 Qwen2 版本实现了多项关键升级,它不仅储备了更为丰富的知识,还在代码编写等核心能力上得到了大幅提升,能够更好地满足用户在专业场景下的多样化需求,为各类文本处理、代码生成等任务提供更可靠的支持。
command-r-08-2024是Cohere推出的Command R模型的更新版本,在多语言检索增强生成(RAG)与工具使用方面的性能得到了提升。整体而言,该模型在数学运算、代码编写及逻辑推理等任务上的表现也更为出色,能够为用户提供更优质的相关服务。
Cohere的Command R+ (08-2024)是Command R+的迭代更新版本,相较于此前的Command R+版本,它在保持硬件占用不变的前提下,吞吐量提升约50%,延迟降低约25%,可满足对处理效率要求更高的各类场景需求。
Sao10K推出的Llama 3.1 Euryale 70B v2.2是一款主打创意角色扮演的模型,它是此前Euryale L3 70B v2.1的迭代升级版本,由创作者Sao10k在Ko-fi平台进行相关创作分享。
Nous: Hermes 3 70B Instruct 是一款通用语言模型,相较于此前的 Hermes 2 有诸多升级,涵盖高级智能体能力、更出色的角色扮演表现、推理能力、多轮对话效果,以及长文本上下文连贯性等多个维度的优化,能更好地适配各类通用语言任务需求。
Nous: Hermes 3 405B Instruct 是一款通用语言模型,相较于 Hermes 2 有诸多升级,具备更出色的智能体能力、角色扮演表现、推理能力、多轮对话效果,以及更长上下文的内容连贯性,在模型性能的多个维度均有显著优化,可适配多样化的语言任务场景。
Nous: Hermes 3 405B Instruct (free) 是一款通用型语言模型,相比 Hermes 2 有诸多升级,具备更先进的智能体能力,在角色扮演、逻辑推理、多轮对话、长文本上下文连贯性等方面均有显著提升,在模型性能的多个维度都实现了优化,能适配更广泛的语言任务需求。
Sao10K开发的Llama 3 8B Lunaris是一款多用途通用型角色扮演模型,它基于Llama 3打造,是通过对多款模型进行策略性融合得到的,旨在实现创意性、逻辑能力与通用知识储备的平衡。
OpenAI于2024年8月6日推出的GPT-4o模型,在结构化输出方面实现了性能提升,支持在response_format中提供JSON schema,可生成符合指定格式的结构化内容。该模型名称中的“o”代表“omni”,具备多模态处理能力,能适配文本、图像等多种输入形式,为用户提供更精准、规范的输出结果。
Meta最新推出的Llama 3.1系列模型包含多种规格,其中这款Llama 3.1 70B Instruct是经过指令微调的版本,专门针对高质量对话场景进行了优化,在相关任务中展现出了出色的性能表现,能够为用户提供流畅、精准的交互体验,适配各类需要自然语言对话支持的应用场景。
Meta最新推出的Llama 3.1系列模型包含多种规格,其中这款Llama 3.1 8B Instruct是经过指令微调的版本,运行速度快且效率高,在相关任务中展现出了强劲的性能表现,适配多种需要高效语言处理能力的应用场景。
由Mistral与NVIDIA联合打造的Mistral Nemo是一款拥有120亿参数、支持12.8万token上下文长度的多语言模型,可覆盖英语、法语、德语、西班牙语、意大利语、葡萄牙语、中文、日语等语种,能为跨语言场景的文本处理任务提供可靠支持。
GPT-4o mini是OpenAI继GPT-4 Omni之后推出的最新模型,支持文本和图像输入,输出为文本形式。作为OpenAI目前最先进的小型模型,它的成本相比此前同类模型大幅降低,在兼顾性能表现的同时,能为用户提供更具性价比的使用体验,适配各类对成本敏感且需要多模态交互的应用场景。
GPT-4o mini是OpenAI在GPT-4 Omni之后推出的最新模型,支持文本与图像输入,输出为文本形式。作为OpenAI目前最先进的小型模型,它的成本仅为前代模型的数分之一,能在保持高效性能的同时,为用户提供更具性价比的AI交互体验,适配各类对成本敏感且需要多模态输入能力的应用场景。
Google的Gemma 2 27B是一款开源模型,其研发与技术依托于打造Gemini模型的相关成果。Gemma系列模型适配多种应用场景,可满足不同领域的开发与使用需求,为开发者提供灵活且可靠的技术支撑,助力各类创新应用的构建与落地。
GPT-4o(“o”代表“omni”,即全模态)是OpenAI推出的最新AI模型,支持文本与图像输入,输出为文本形式。它保留了GPT-4 Turbo的智能水平,同时在响应效率上实现了显著提升,能够更快速地处理各类任务,适配多场景下的智能交互需求,为用户提供更流畅的AI使用体验。
GPT-4o(“o”代表“omni”,即全模态)是OpenAI推出的最新AI模型,支持文本与图像输入,输出为文本形式。它保留了GPT-4 Turbo的智能水平,同时在响应效率上实现了显著提升,能够更流畅地处理多模态交互任务,为用户带来更贴合需求的AI体验。
Mistral官方推出的Mixtral 8x22B Instruct,是Mixtral 8x22B的指令微调版本。该模型总参数达141B,激活参数为39B,在同规模模型中具备极高的成本效率,优势涵盖数学、编码等领域,能为用户提供适配指令交互的优质体验。
WizardLM-2 8x22B是微软人工智能推出的最先进Wizard系列模型,相较于主流闭源模型展现出极具竞争力的性能,且始终优于所有现有最顶尖的开源模型,在各类任务场景中都能提供可靠且出色的表现,为用户带来高效优质的AI交互与应用体验。
OpenAI推出的最新GPT-4 Turbo模型,具备视觉理解能力,针对视觉相关的请求,现已支持JSON模式与函数调用功能,其训练数据的时间截止至2023年12月。
Claude 3 Haiku是Anthropic推出的模型,是该公司速度最快、体积最紧凑的模型,能够实现近乎即时的响应,兼具快速与精准的定向性能,支持多模态交互,相关发布公告与基准测试结果可通过指定链接查看。
这是Mistral AI推出的旗舰模型Mistral Large 2,版本标识为`mistral-large-2407`,是一款权重可商用的闭源模型,在推理、代码编写、JSON处理、多轮对话等多项任务中表现突出,相关发布公告可通过指定链接查看。
OpenAI旗下的GPT-3.5 Turbo(旧版v0613)是该公司目前速度最快的模型,它能够理解并生成自然语言或代码,同时针对聊天场景与传统补全任务进行了优化,其训练数据的截止时间为2021年9月。
OpenAI推出的GPT-4 Turbo Preview是一款预览版GPT-4模型,具备优化的指令遵循能力、JSON模式、可复现输出、并行函数调用等特性,其训练数据截止至2023年12月。目前该模型受OpenAI的严格速率限制,相关功能仍在持续优化中。
Auto Router可根据你的提示自动匹配合适的模型,它依托市场智慧提供支持,会依据OpenRouter社区的集体消费情况为你完成路由分配,能帮助你高效选择适配需求的模型,无需手动筛选各类模型,借助社区的实际使用与消费数据,为你匹配更贴合需求的模型资源。
该模型是OpenAI推出的GPT-3.5 Turbo Instruct,属于GPT-3.5 Turbo的衍生版本,专门针对指令类提示进行了优化调整,且剔除了与对话相关的优化内容。其训练数据的截止时间为2021年9月,可适配各类需要指令响应的场景需求。
OpenAI推出的GPT-3.5 Turbo 16k模型,上下文长度是原版GPT-3.5 Turbo的四倍,单次请求可处理约20页文本内容,不过使用成本相对更高。该模型的训练数据覆盖范围未在现有信息中完整说明,其核心优势在于更长的上下文处理能力,能适配需要承载更多文本内容的交互场景。
Mancer: Weaver (alpha)是一款尝试复刻Claude风格的模型,不过它无法达到Claude那样的连贯性与记忆表现,主要适用于角色扮演或叙事创作类场景。
ReMM SLERP 13B是基于原版MythoMax-L2-B13打造的复刻优化版本,属于模型融合类项目,核心是对原模型进行迭代更新与重构,旨在优化原有模型的性能表现,为相关AI应用场景提供更适配的模型支持。
MythoMax 13B 是 Llama 2 13B 模型的微调版本,属于性能顶尖且广受欢迎的微调模型之一,具备丰富的文本描述生成能力,尤其适配角色扮演类场景的内容创作,相关模型已完成合并优化,可满足多样化的文本生成需求。
OpenAI推出的GPT-3.5 Turbo是该公司目前速度最快的模型,它能够理解并生成自然语言或代码,同时针对聊天场景以及传统的文本补全任务进行了优化,其训练数据的截止时间为2021年9月。
OpenAI的旗舰模型GPT-4是一款大规模多模态语言模型,凭借更丰富的通用知识与先进的推理能力,它能够以比前代模型更高的准确度解决各类复杂问题,为用户提供更可靠的智能交互与问题解决方案。
