AI 大模型數據庫
收錄主流開源與商用大語言模型的核心性能數據、上下文限制與 API 每百萬 Token 即時定價。
透明客觀的模型選型基礎
在建立智能體與商用系統時,選擇正確的模型是性價比與效能的根本保障。
本資料庫收錄了目前全球與華人地區主流的 AI 大模型,涵蓋推理思考型、多模態型、低延遲型等各類機型。所有數據直接來自各大官網的 API 即時計費標準,並經過天智算力編輯部評測實驗室實測,協助您快速完成橫向比對,為架構設計打下扎實基礎。
已收錄的模型規格
點選下方模型卡片,即可閱讀詳細規格評測、功能支援與在台延遲表現。
GLM 4.5
GLM-4.5 是 GLM 系列的旗舰模型,拥有 3550 亿个总参数和 320 亿个活动参数。作为混合推理模型,它整合了推理、编码和代理功能,提供用于复杂推理和工具运用的思维模式,以及用于即时响应的非思维模式,可满足快速发展的代理应用日益复杂的需求。
Z-AI/GLM 5.1
GLM-5.1 在编程能力上实现了重大飞跃,尤其在处理长周期任务方面提升显著。与以往基于分钟级交互构建的模型不同,GLM-5.1 能够独立持续处理单个任务超过 8 小时,全程自主规划、执行并自我优化,最终交付完整、工程级的结果。
Claude 4.7 Opus
Opus 4.7 是 Anthropic Opus 系列的下一代模型,专为长时间运行的异步智能体而打造。它在 Opus 4.6 的编程能力和智能体优势基础上进行了升级,在处理复杂的多步骤任务时表现更出色,并能在长时间工作流中提供更可靠的智能体执行能力。它特别适用于任务随时间逐步展开的异步智能体管道场景——如大型代码库处理、多阶段调试,以及端到端的项目编排。cursor模型别名:qn-co-4.7
Moonshotai/Kimi-K2.6
Kimi K2.6 是 Kimi 最新最智能的模型,Kimi K2.6 的通用 Agent、代码、视觉理解等综合能力得到全面提升,其中在博士级难度的完整版人类最后的考试(Humanity’s Last Exam)、在考察模型真实软件工程能力的 SWE-Bench Pro、评估 Agent 深度检索能力的 DeepSearchQA 等基准测试中均取得行业领先的成绩,同时支持文本、图片与视频输入,思考与非思考模式,对话与 Agent 任务。
openai/gpt-image-2
GPT-image-2 带来了现实世界的智能、多语言理解、改进的指令遵循、增加的分辨率支持,以及一个智能路由层,为开发者提供扩展图像生成生产工作流程的工具。
DeepSeek-V4-Flash
DeepSeek V4 Flash 是 DeepSeek 推出的一款经过效率优化的混合专家(Mixture-of-Experts)模型,总参数量达 2840 亿,每次前向传播激活 130 亿参数,支持长达 100 万 token 的上下文窗口。该模型专为快速推理和高吞吐量工作负载设计,同时保持了强大的推理和编程能力。模型采用混合注意力机制以实现高效的长上下文处理,并支持可配置的推理模式。它非常适用于对响应速度和成本效益要求较高的应用场景,如编程助手、聊天系统和智能体工作流。
DeepSeek-V4-Pro
DeepSeek V4 Pro 是 DeepSeek 推出的大规模混合专家(Mixture-of-Experts)模型,总参数量达 1.6 万亿,每次前向传播激活 490 亿参数,支持长达 100 万 token 的上下文窗口。该模型专为高级推理、编程和长程智能体工作流设计,在知识、数学和软件工程基准测试中均表现出色。它基于与 DeepSeek V4 Flash 相同的架构,引入了混合注意力系统以实现高效的长上下文处理,并支持多种推理模式,可根据任务需求在速度和深度之间取得平衡。它非常适用于全代码库分析、多步骤自动化和大规模信息综合等复杂工作负载,这些场景对能力和效率都有极高要求。
Openai/GPT-5.5
GPT-5.5 是 OpenAI 专为复杂专业工作负载打造的前沿模型,它在 GPT-5.4 的基础上进一步强化了推理能力、提升了可靠性,并在高难度任务上实现了更优的 token 效率。该模型拥有超过 100 万 token 的上下文窗口(支持 92.2 万 token 输入、12.8 万 token 输出),并支持文本与图像输入,能够在单一系统中完成大规模推理、编程及多模态工作流。
Tencent/Hy3 Preview
Hy3预览版是腾讯推出的一款高效混合专家模型,专为智能体工作流和生产环境设计。它支持禁用、低、高三种可配置的推理级别,能够根据任务需求灵活平衡推理速度与深度,同时在多步骤的实际工作流中提供强大的代码生成能力与可靠的性能表现。
X-Ai/Grok 4.2 Fast Non Reasoning
Grok 4.20 是 xAI 最新的旗舰型号,具备行业领先的速度和代理工具调用能力。它结合了市场上最低的幻觉率和严格的及时遵守,始终提供准确且真实的反应。
X-Ai/Grok 4.2 Fas Reasoning
Grok 4.20 是 xAI 最新的旗舰型号,具备行业领先的速度和代理工具调用能力。它结合了市场上最低的幻觉率和严格的及时遵守,始终提供准确且真实的反应。
Gemini 3.1 Flash Lite
Gemini 3.1 Flash Lite是谷歌推出的高效模型,专为大流量应用场景优化。其整体质量优于Gemini 2.5 Flash Lite,在关键能力上接近Gemini 2.5 Flash的水平。改进涵盖了音频输入/自动语音识别、RAG片段排序、翻译、数据提取和代码补全等多个方面。该模型支持完整的思考层级(最低、低、中、高),可实现精细化的成本与性能权衡。
X-Ai/Grok 4.3
Grok-4.3 是 xAI 推出的新一代旗舰模型,主打更低幻觉率、更强的智能体工具调用能力和更稳定的指令遵循表现。 它支持文本与图像输入,拥有最高 100 万 token 的上下文窗口,适合长文档分析、复杂任务拆解、代码辅助和企业级工作流自动化等场景。
X-Ai/Grok 4.2 Non Reasoning
Grok 4.20 是 xAI 最新的旗舰型号,具备行业领先的速度和代理工具调用能力。它结合了市场上最低的幻觉率和严格的及时遵守,始终提供准确且真实的反应。
X-Ai/Grok 4.2 Reasoning
Grok 4.20 是 xAI 最新的旗舰型号,具备行业领先的速度和代理工具调用能力。它结合了市场上最低的幻觉率和严格的及时遵守,始终提供准确且真实的反应。
Gemini 3.5 Flash
Gemini 3.5 Flash旨在以高速和高效的价值提供强大的代理能力(接近专业级)。Gemini 3系列是思考型模型,能够在回答前通过思考进行推理,从而提高性能和准确性。
Qwen/Qwen3.6-27B
Qwen3.6 27B 是阿里巴巴 Qwen 团队于 2026 年 4 月发布的一款拥有 270 亿参数的混合多模态语言模型,具有 262144 大小的上下文窗口。
Qwen/Qwen3.7-Max
Qwen3.7系列中规模最大、综合能力最强的Max模型,当前开放纯文本模型能力供体验。Qwen3.7是面向智能体时代的新一代旗舰模型,核心优势在于智能体能力的广度与深度:在编程、办公与生产力、长周期自主执行方面均能出色胜任各项任务。
Claude 4.8 Opus
Claude Opus 4.8 是 Anthropic 在 Opus 系列中能力最强的通用模型。它支持文本、图像和文件输入,并生成文本输出,具备推理能力以及 100 万 token 的上下文窗口。该模型非常适合高度自主的智能体、长时间跨度的代理任务、知识型工作,以及需要长时间保持连贯性的记忆驱动型任务。 它在多步骤推理、复杂编程和端到端项目编排方面尤为出色——适用于大型代码库、多阶段调试,以及长时间运行的异步智能体流水线。除编程之外,它还能处理起草文档、制作演示文稿和数据分析等知识型工作,并在极长的输出内容中始终保持高质量。
Minimax/Minimax-M3
MiniMax-M3 是 MiniMax 推出的多模态基础模型。它支持文本、图像和视频输入,输出文本,具备 100 万 token 的上下文窗口,适用于长周期智能体工作、编程和工具使用。该模型基于 MiniMax 稀疏注意力(MSA)构建,通过 KV 块选择替代全注意力机制,从而降低长上下文场景下每 token 的计算量——在处理 100 万 token 时,其成本约为上一代模型的 1/20,同时显著提升预填充和解码速度,并在大多数任务上保持质量。作为原生多模态模型,MiniMax-M3 在交错数据上进行训练,并借助交互式用户模拟器框架进行多轮、面向生产环境的协作调优。该模型面向持续性、多步骤任务,而非单轮执行。
Deepseek-v4-Pro-202606
【原厂版】DeepSeek V4 Pro 是 DeepSeek 推出的大规模混合专家(Mixture-of-Experts)模型,总参数量达 1.6 万亿,每次前向传播激活 490 亿参数,支持长达 100 万 token 的上下文窗口。该模型专为高级推理、编程和长程智能体工作流设计,在知识、数学和软件工程基准测试中均表现出色。它基于与 DeepSeek V4 Flash 相同的架构,引入了混合注意力系统以实现高效的长上下文处理,并支持多种推理模式,可根据任务需求在速度和深度之间取得平衡。它非常适用于全代码库分析、多步骤自动化和大规模信息综合等复杂工作负载,这些场景对能力和效率都有极高要求。
Gemini 3.1 Flash Image
Gemini 3.1 Flash Image正式版,又名“Nano Banana 2”,是谷歌最新推出的顶尖图像生成与编辑模型,以 Flash 级别的速度提供专业级的视觉品质。该模型将先进的上下文理解能力与快速、高性价比的推理相结合,极大地降低了复杂图像生成和迭代式编辑的门槛。
Gemini 3.0 Pro Image
Gemini 3 Pro Image 旨在通过整合尖端推理能力,应对最具挑战性的图像生成任务。该模型是处理复杂多轮图像生成与编辑任务的最佳选择。 Gemini 3 系列模型具备思维推理能力,能够在响应前进行逻辑推演,从而显著提升准确度并优化图像质量。
Moonshotai/Kimi-K2.7-Code
MoonshotAI: Kimi K2.7 Code 是 Moonshot AI(月之暗面)旗下 Kimi K2 系列专为编程打造的模型,在长文本情境下高可靠性地完成端到端编程任务。 原生多模态混合专家架构 (MoE):支持文本和图片双重输入。 全时思考模式:模型始终以“思考模式(thinking mode)”运行,并在多轮对话中保留完整的推理内容。 超长上下文窗口:具备 256K tokens 的上下文窗口,专为长周期编程、智能体任务拆解(agentic task decomposition)及多轮对话而设计。 高效参数激活:在约 1万亿(1T)的总参数量中,每次仅激活 320亿(32B)参数,兼顾强悍性能与高效响应。
Z-AI/GLM-5.2
GLM-5.2 是面向长任务时代的旗舰模型。支持真正可用的 1M 上下文,可承载项目级工程上下文,长程任务执行更稳定、工程规范遵循更可靠,一次任务即可完成从需求到多端部署的完整开发链路。
GPT 5.5 PRO
GPT-5.5 Pro 使用更强大的计算能力进行更深入的思考,从而提供持续更好的答案。
Meituan/Longcat-Flash-Lite
LongCat-Flash-Lite 模型采用高效 MoE 架构(总参数 685亿,激活参数约 30亿),通过 N-gram 嵌入表实现参数的高效利用,并针对推理效率与特定场景深度优化。
Kimi K2
Kimi K2 是一款先进的混合专家 (MoE) 语言模型,拥有 320 亿个激活参数和 1 万亿个总参数。Kimi K2 采用 Muon 优化器进行训练,在前沿知识、推理和编码任务中表现出色,同时针对代理能力进行了精心优化。
Qwen 2.5 VL 72B Instruct
拥有约70亿参数的多模态指令遵循大语言模型,擅长处理图像与文本信息,支持跨模态应用场景。
Qwen 2.5 VL 7B Instruct
拥有约 70 亿参数的多模态指令遵循大语言模型,擅长处理图像与文本信息,支持跨模态应用场景。
Veo 3.0 Fast Generate 001
Veo 是 google 的视频生成模型,生成效果稳定逼真。
Veo 3.0 Fast Generate Preview
Veo 是 google 的视频生成模型,生成效果稳定逼真。
DeepSeek/DeepSeek-V3.1-Terminus-Thinking
此次更新在保持模型原有能力的基础上,针对用户反馈的问题进行了改进,包括: 语言一致性:缓解了中英文混杂、偶发异常字符等情况; Agent 能力:进一步优化了 Code Agent 与 Search Agent 的表现。
Z-AI/GLM 4.6
与GLM-4.5相比,这一代模型实现了多项关键提升: 更长的上下文窗口:上下文长度从128K令牌扩展至200K令牌,使模型能够处理更复杂的智能体任务。 卓越的编程性能:在代码基准测试中得分更高,并在Claude Code、Cline、Roo Code及Kilo Code等应用中展现出更优的实际表现,包括生成视觉效果精致的前端页面能力提升。 进阶推理能力:GLM-4.6在推理性能上取得显著进步,支持推理过程中的工具调用,综合能力进一步增强。 更强大的智能体:在工具调用和基于搜索的智能体任务中表现更出色,并能更高效地集成至智能体框架。 精细化写作:更贴合人类对文风与可读性的偏好,在角色扮演场景中的表现也更为自然流畅。
Kimi K2 Thinking
Kimi K2 Thinking 是 Moonshot AI 迄今为止最先进的开源推理模型,它将 K2 系列扩展到了智能体层面,实现了长时域推理。该模型基于 Kimi K2 中引入的万亿参数混合专家 (MoE) 架构构建,每次前向传播激活 320 亿个参数,并支持 256 个 k-token 上下文窗口。该模型针对持续的逐步思考、动态工具调用以及跨越数百轮的复杂推理工作流进行了优化。它将逐步推理与工具使用交错进行,从而能够实现自主研究、编码和写作,并能持续数百次连续操作而不会出现偏差。 它在 HLE、BrowseComp、SWE-Multilingual 和 LiveCodeBench 等开源基准测试中创造了新的纪录,同时在 200-300 次工具调用中保持了稳定的多智能体行为。基于采用 MuonClip 优化的大规模 MoE 架构,它兼具强大的推理深度和高推理效率,能够胜任高要求的智能体和分析任务。
Z-Ai/GLM 4.7
GLM-4.7 是智谱最新旗舰模型,GLM-4.7 面向 Agentic Coding 场景强化了编码能力、长程任务规划与工具协同,并在多个公开基准的当期榜单中取得开源模型中的领先表现。通用能力提升,回复更简洁自然,写作更具沉浸感。在执行复杂智能体任务,在工具调用时指令遵循更强,Artifacts 与 Agentic Coding 的前端美感和长程任务完成效率进一步提升。
kling-video/kling-3.0-turbo
Kling VIDEO 3.0 Turbo是Kling 3.0家族中一个速度优化的多模态视频生成模型。它专为需要更快周转时间但又不牺牲稳定运动、快速响应、多镜头一致性和视听同步的高产量生产工作流程而构建。它支持文本到视频和图像到视频的生成,特别强调改进的唇同步质量和更高效的大规模内容创作。
Minimax/Minimax-M2.1
MiniMax-M2.1是一款轻量级、前沿的大语言模型,针对编码、代理工作流程和现代应用开发进行了优化。仅激活了100亿个参数,它实现了在现实世界能力上的重大飞跃,同时保持了卓越的延迟、可扩展性和成本效率。 与前辈相比,M2.1提供了更干净、更简洁的输出和更快的感知响应时间。它在主要系统和应用语言中表现出领先的跨语言编码性能,在Multi-SWE-Bench上达到49.4%,在SWE-Bench Multilingual上达到72.5%,并作为IDE、编码工具和通用辅助的通用“大脑”使用。 为了避免降低该模型的表现,MiniMax强烈建议在回合之间保留推理。在我们的文档中了解更多关于使用reasoning_details传递推理的信息。
x-AI/Grok-Code-Fast 1
Grok Code Fast 1是一款高效经济型推理模型,专为智能编码场景打造。该模型通过响应中可见的推理轨迹,让开发者能够精准引导Grok Code实现高质量的工作流程。
Minimax/Minimax-M2.5
Minimax M2.5专为Agent场景原生设计,编程与智能体性能(Coding & Agentic)直接对标Claude Opus 4.6,尤其在Excel高阶处理、PPT生成和深度调研等Office生产力场景达到行业领先水平(SOTA)。
Z-AI/GLM 5
GLM-5 是智谱新一代的旗舰基座模型,面向 Agentic Engineering 打造,能够在复杂系统工程与长程 Agent 任务中提供可靠生产力。在 Coding 与 Agent 能力上,GLM-5 取得开源 SOTA 表现,在真实编程场景的使用体感逼近 Claude Opus 4.5,擅长复杂系统工程与长程 Agent 任务,是通用 Agent 助手的理想基座。
Moonshotai/Kimi-K2.5
Kimi K2.5 是 Kimi 迄今最智能的模型,在 Agent、代码、视觉理解及一系列通用智能任务上取得开源 SoTA 表现。同时 Kimi K2.5 也是 Kimi 迄今最全能的模型,原生的多模态架构设计,同时支持视觉与文本输入、思考与非思考模式、对话与 Agent 任务。
Deepseek/DeepSeek-V3.2
DeepSeek 发布 V3.2 正式版,显著强化了 Agent 和推理能力,在主流测试中达到 GPT-5 水平并支持思考模式下的工具调用;同时推出的 Speciale 探索版在多项国际竞赛中取得金牌级表现。模型已全面开放使用。
Doubao Seed 2.0 Lite
Doubao Seed 2.0 Lite 面向高频企业场景兼顾性能与成本的均衡型模型,综合能力超越上一代Doubao-Seed-1.8。胜任非结构化信息处理、内容创作、搜索推荐、数据分析等生产型工作,支持长上下文、多源信息融合、多步指令执行与高保真结构化输出。在保障稳定效果的同时显著优化成本。
Doubao Seed 2.0 Pro
Doubao Seed 2.0 Pro 旗舰级全能通用模型,面向 Agent 时代的复杂推理与长链路任务执行场景。强调多模态理解、长上下文推理、结构化生成与工具增强执行。复杂指令与多约束执行能力突出,可稳定应对多步复杂规划、复杂图文推理、视频内容理解与高难度分析等场景。
Doubao Seed 2.0 Code
Doubao Seed 2.0 Code 面向真实编程环境优化的 Coding 模型,能稳定调用 Claude Code 等常见 IDE 中的工具。模型特别优化了前端能力,在使用常见的前端框架时能有良好表现。模型支持使用 Skills,可以配合多种自定义技能使用。
Doubao Seed 2.0 Mini
Doubao Seed 2.0 Mini 面向低时延、高并发与成本敏感场景,强调快速响应与灵活推理部署。模型效果与Doubao-Seed-1.6相当。支持256k上下文、4档思考长度和多模态理解,适合成本和速度优先的轻量级任务。
Veo 3.1 Generate 001
Veo 3.1 Generate 001 是 Google 的最新视频生成模型,正式版,生成效果稳定逼真。
Veo 3.1 Fast Generate 001
Veo 3.1 Fast Generate 001 是 google 的最新视频生成模型,正式版,生成效果稳定逼真。
Veo 3.0 Generate Preview
Veo 是 google 的视频生成模型,生成效果稳定逼真。
x-AI/Grok-4-Fast
Grok 4 Fast是xAI推出的最新多模态模型,具备SOTA级成本效益与200万token上下文窗口。
Veo 3.1 Generate Preview
Veo 是 google 的视频生成模型,生成效果稳定逼真。
Veo 3.1 Fast Generate Preview
Veo 是 google 的视频生成模型,生成效果稳定逼真。
x-AI/Grok-4.1-Fast
Grok 4.1 Fast是xAI推出的最新多模态模型,具备SOTA级成本效益与200万token上下文窗口。
X-Ai/Grok-4-Fast-Non-Reasoning
Grok 4 Fast是xAI推出的最新多模态模型,具备SOTA级成本效益与200万token上下文窗口。
X-Ai/Grok-4-Fast-Reasoning
Grok 4 Fast是xAI推出的最新多模态模型,具备SOTA级成本效益与200万token上下文窗口。
X-Ai/Grok 4.1 Fast Reasoning
Grok 4.1 Fast是xAI推出的最新多模态模型,具备SOTA级成本效益与200万token上下文窗口。
X-Ai/Grok 4.1 Fast Non Reasoning
Grok 4 Fast是xAI推出的最新多模态模型,具备SOTA级成本效益与200万token上下文窗口。
Openai/GPT-5.3 Codex
GPT-5.3-Codex 在多项基准上刷新纪录:在 SWE-Bench Pro 上达到 56.8%,在 Terminal-Bench 2.0 上达到 77.3%,同时相比此前版本运行更快、消耗的 token 更少。该模型融合了 GPT-5.2-Codex 的前沿编码性能和 GPT-5.2 的推理及专业知识能力,速度提升了 25%。这使其能够胜任需要研究、工具使用和复杂执行的长时间任务。
OpenAI/GPT-5 Nano
GPT-5-Nano是GPT-5系统中体积最小、响应速度最快的变体版本,专为开发工具、快速交互场景及超低延迟环境优化设计。相较于大型版本,其推理深度虽有所精简,但仍完整保留了核心的指令遵循能力与安全特性。作为GPT-4.1-nano的升级迭代产品,该模型为成本敏感型应用和实时响应场景提供了轻量化的解决方案。
Openai/GPT-5.2 Chat
GPT-5.2 Chat是 5.2 系列中快速、轻量的成员,专为低延迟对话优化,同时保留强大的通用智能。它采用自适应推理机制,能够在处理复杂查询时选择性“思考”,从而在不拖慢常规对话的前提下,提升数学、编程及多步骤任务的准确性。该模型默认更热情、更具对话性,指令遵循能力更强,短时推理更稳定。GPT-5.2 畅聊版专为高吞吐量、互动性强的应用场景设计,在这些场景中,响应速度和一致性比深度思考更为关键。
Openai/GPT-5 Pro
GPT-5 Pro 是 OpenAI 最先进的模型,在推理能力、代码质量和用户体验方面实现了重大改进。该模型针对需要分步推理、指令遵循及高准确性场景的复杂任务进行了优化,在高风险应用中表现出色。它支持测试时路由功能,具备先进提示理解能力,可响应用户指定的意图(如“深入思考这个问题”)。改进包括减少幻觉和谄媚行为,同时在编程、写作和健康相关任务方面表现更佳。
Openai/GPT-5 Chat
GPT-5 Chat专为企业应用中的高级、自然、多模态和上下文感知对话而设计。
Openai/GPT-5 Mini
GPT-5 Mini 是 GPT-5 的紧凑版本,专为处理轻量级推理任务而设计。它在提供与 GPT-5 相同的指令遵循和安全调优优势的同时,降低了延迟和成本。GPT-5 Mini 是 OpenAI 的 o4-mini 模型的继任者。
Openai/GPT-5.4
GPT-5.4是OpenAI最新的前沿模型,将Codex和GPT系列统一到一个系统中。它具有超过100万个标记的上下文窗口(922K输入,128K输出),支持文本和图像输入,能够在同一工作流程中实现高上下文推理、编码和多模态分析。 该模型在编码、文档理解、工具使用和指令遵循方面提供了改进的性能。它被设计为通用任务和软件工程中的强大默认选项,能够生成生产质量的代码,跨多个来源综合信息,并通过更少的迭代和更高的标记效率执行复杂的多步骤工作流程。GPT-5.4是OpenAI用于复杂专业工作的前沿模型。
Openai/GPT-5.4 Mini
GPT-5.4 mini 将 GPT-5.4 的核心能力带入一个更快、更高效的模型,针对高吞吐量工作负载进行了优化。它支持文本和图像输入,在推理、编码和工具使用方面表现出强大的性能,同时降低大规模部署的延迟和成本。 该模型旨在满足需要能力和效率平衡的生产环境,非常适合大规模运行的聊天应用、编码助手和代理工作流程。GPT-5.4 mini 提供可靠的指令遵循、稳固的多步推理,以及在不同任务中的一致性能,同时提高了成本效率。
Openai/GPT-5.4 Pro
GPT-5.4 Pro 是OpenAI推出的最先进模型,在GPT-5.4统一架构的基础上进一步增强了推理能力,专为复杂、高风险任务设计。它拥有超过100万词元的上下文窗口(支持92.2万输入词元和12.8万输出词元),并支持文本与图像输入。该模型针对分步推理、指令遵循及高准确性进行了优化,在智能编码、长上下文工作流及多步骤问题解决方面表现卓越。
Openai/GPT-5.4 Nano
GPT-5.4 nano 是 GPT-5.4 系列中最轻量、最具成本效益的版本,专为对速度敏感和高并发的任务进行了优化。它支持文本与图像输入,专为低延迟应用场景设计,适用于分类、数据提取、排序以及子智能体执行等任务。 该模型优先考虑响应速度与运行效率,而非深度推理能力,因此非常适合需要在大规模场景下提供快速、可靠输出的流水线任务。GPT-5.4 nano 尤其适用于后台任务、实时系统以及对降低成本和延迟至关重要的分布式智能体架构。
gpt-oss-120b
gpt-oss-120b 是由 OpenAI 推出的开放权重、1170亿参数混合专家(MoE)语言模型,专为高推理能力、智能体应用及通用生产环境场景设计。该模型每次前向传播仅激活51亿参数,并通过原生 MXFP4 量化技术优化,可在单张 H100 GPU 上高效运行。该模型具备三大核心功能:可配置的推理深度、完整思维链访问机制,以及原生工具调用能力(包括函数调用、网络浏览及结构化输出生成)。
OpenAI/GPT-5
GPT-5是OpenAI最先进的闭源模型,在推理能力、代码质量和用户体验方面实现重大突破。该模型针对需要逐步推理、指令遵循和高风险应用场景精准度的复杂任务进行了优化,支持测试时路由功能和高级提示理解(包括用户指定的"深度思考"等意图)。其改进包括减少幻觉与迎合倾向,并在编程、写作及健康相关任务中表现更出色。
OpenAI/GPT-5.2
GPT-5.2作为GPT-5系列的最新旗舰模型,在智能代理能力与长上下文处理方面相较GPT-5.1实现显著提升。该模型采用自适应推理机制,可根据任务复杂度动态分配计算资源——既能快速响应简单查询,也能针对复杂问题展开深度思考。 面向广泛任务场景设计的GPT-5.2,在数学运算、代码生成、科学推理及工具调用等各类任务中均展现出稳定优势。其生成的长文本答案连贯性更强,工具调用的可靠性也获得进一步优化。
Openai/GPT-5.2 Codex
GPT-5.2-Codex 是 GPT-5.1-Codex 的升级版本,专为软件工程与编码工作流程优化设计。该模型既支持交互式开发会话,也可独立长时间执行复杂工程任务。其功能涵盖从零构建项目、功能开发、调试、大规模重构到代码审查等全流程。相比 GPT-5.1-Codex,5.2 版本具备更强的指令跟随能力,能更精准地响应开发者要求,并生成更简洁、高质量的代码输出。推理强度可通过 reasoning.effort 参数灵活调节。
Claude 4.6 Sonnet
Sonnet 4.6是Anthropic迄今为止最强大的Sonnet系列模型,在编程、智能代理和专业工作领域均达到前沿性能水平。它在以下方面表现卓越:迭代开发、复杂代码库导航、具备记忆功能的端到端项目管理、专业文档撰写,以及在网页问答和工作流自动化方面的可靠计算机操作能力。
Gemini 3.1 Pro Preview
Gemini 3.1 Pro Preview 是谷歌前沿的推理模型,在复杂工作流中实现了增强的软件工程性能、更高的代理可靠性以及更高效的令牌使用。该模型基于 Gemini 3 系列的多模态基础构建,通过百万级令牌的上下文窗口,实现了在文本、图像、视频、音频和代码之间的高精度推理。
Gemini 3.1 Flash Image Preview
Gemini 3.1 Flash Image预览版,又名“Nano Banana 2”,是谷歌最新推出的顶尖图像生成与编辑模型,以 Flash 级别的速度提供专业级的视觉品质。该模型将先进的上下文理解能力与快速、高性价比的推理相结合,极大地降低了复杂图像生成和迭代式编辑的门槛。
Gemini 3.1 Flash Lite Preview
Gemini 3.1 Flash Lite Preview是谷歌推出的高效模型,专为大流量应用场景优化。其整体质量优于Gemini 2.5 Flash Lite,在关键能力上接近Gemini 2.5 Flash的水平。改进涵盖了音频输入/自动语音识别、RAG片段排序、翻译、数据提取和代码补全等多个方面。该模型支持完整的思考层级(最低、低、中、高),可实现精细化的成本与性能权衡。
Gemini 2.5 Flash Lite
Gemini 2.5 Flash-Lite是Gemini 2.5系列中的轻量级推理模型,专为超低延迟和成本效益优化。相比早期Flash模型,它在吞吐量、令牌生成速度及常见基准测试性能方面均有提升。该模型默认禁用"多轮思考"(即多重推理)功能以优先保证响应速度,但开发者可通过Reasoning API参数启用该功能,从而根据需求在成本与智能表现之间进行灵活权衡。
Gemini 2.5 Pro
Gemini 2.5 Pro 是谷歌推出的尖端人工智能模型,专为高级推理、编程、数学及科学任务设计。该模型采用"思维"处理能力,使其能够通过逻辑推演生成响应,在准确性及复杂语境处理方面表现卓越。Gemini 2.5 Pro 在多项基准测试中斩获顶级表现,不仅占据 LMArena 排行榜首位,更展现出与人类思维高度契合的优越特性及解决复杂问题的强大能力。
Gemini 2.5 Flash Image
Gemini 2.5 Flash图像版(又名“纳米香蕉”)现已正式发布。该模型是具备情境理解能力的尖端图像生成模型,能够实现图像生成、编辑以及多轮对话功能。
Gemini 3.0 Pro Image Preview
Gemini 3 Pro Image 旨在通过整合尖端推理能力,应对最具挑战性的图像生成任务。该模型是处理复杂多轮图像生成与编辑任务的最佳选择。 Gemini 3 系列模型具备思维推理能力,能够在响应前进行逻辑推演,从而显著提升准确度并优化图像质量。
Claude 4.6 Opus
Anthropic 发布新一代 Claude Opus 4.6 模型,支持 200K 上下文窗口,最大输出 token 数提升至 128K,较前代 64K 限制翻倍。该模型引入自适应思考模式,可根据问题复杂度动态调整思考深度,并新增最高级别的 max effort 参数。 cursor模型别名:qn-co-4.6
Viduq1
Vidu Q1 是一款成本效益高的视频生成模型,专为加快生成速度并保持良好质量而优化。它非常适合快速原型制作和大量视频创作。支持以下场景使用:参考图生视频、文生视频。
Viduq2
Vidu Q2在速度与质量之间实现了良好的平衡,支持从 360p 到 1080p 的多种分辨率。其还具有更稳定的运动表现和更强的场景理解能力。支持以下场景使用:参考图生视频、文生视频。
Viduq2-Pro
Vidu Q2 Pro 能够生成专业级别的视频,具有出色的动态效果、1080p 分辨率以及增强的时序稳定性。支持以下使用场景:图生视频、首尾帧。
Viduq2-Turbo
Vidu Q2 Turbo 在优化处理的同时实现了快速的视频生成,同时还能保持高视觉质量及动作连贯性。支持以下使用场景:图生视频、首尾帧。
Viduq3-Pro
Vidu Q3 Pro 能够根据文字提示生成高品质的视听视频,具备先进的音效和语音同步功能,支持 1 到 16 秒的时长,最高可达 1080p 分辨率。
Viduq3-Turbo
Vidu Q3 Turbo 能够以优化的处理速度从文本生成快速的音频视频内容,支持 1 到 16 秒的时长,最高可达 1080p 分辨率。
Claude 4.0 Opus
Claude Opus 4 在发布时被基准测试评为全球最佳编码模型,在复杂长期任务和智能体工作流中展现出持续稳定的性能。该模型为软件工程树立了新标杆,在SWE-bench(72.5%)和Terminal-bench(43.2%)测试中均取得领先成绩。Opus 4 支持扩展的智能体工作流程,可连续数小时处理数千个任务步骤而不会出现性能衰减。 cursor模型别名:qn-co-4.0
Claude 4.0 Sonnet
Claude Sonnet 4 在 Claude Sonnet 3.7 的基础上,在多个领域进行了改进,尤其是在编码方面。它提供了适用于大多数 AI 用例的前沿性能,包括面向用户的 AI 助手和大文本任务。 cursor模型别名:qn-cs-4.0
Claude 4.1 Opus
Claude Opus 4.1 是 Anthropic 旗舰模型的最新版本,在编程、推理及智能体任务方面实现显著升级。该模型在 SWE-bench Verified 基准测试中以 74.5% 的通过率刷新记录,并在多文件代码重构、调试精度提升及细节导向推理等场景展现突破性进步。模型支持扩展至 64K token 的深度思维过程,特别针对研究分析、数据处理及工具辅助推理等任务进行专项优化。 cursor模型别名:qn-co-4.1
Claude 4.5 Sonnet
Claude Sonnet 4.5是Anthropic迄今最先进的Sonnet模型,专为现实场景智能体与编程工作流优化。该模型在SWE-bench Verified等编程基准测试中展现出顶尖性能,在系统设计、代码安全性与规范遵循方面均有提升。其设计支持长时间自主运行,能保持跨会话的任务连续性,并提供基于事实的进度追踪。 cursor模型别名:qn-cs-4.5
Claude 4.5 Haiku
Claude Haiku 4.5是Anthropic公司最快速、最高效的模型,以远低于大型Claude模型的成本和延迟提供接近前沿水平的智能。该模型在推理、编程和计算机应用任务上的表现与Claude Sonnet 4持平,以前沿级能力赋能实时高并发应用场景。 cursor模型别名:qn-ch-4.5
Claude 4.5 Opus
Claude Opus 4.5是Anthropic公司推出的前沿推理模型,专为复杂软件工程、智能体工作流及长周期计算机任务优化设计。该模型具备强大的多模态能力,在现实场景的编程与推理基准测试中展现出卓越性能,并显著提升了对提示注入攻击的防御能力。其创新设计支持开发者根据任务需求灵活调整运行强度,在响应速度、思考深度和令牌使用量之间实现精准平衡。 cursor模型别名:qn-co-4.5
Viduq3
Vidu Q3是生数科技于2026年1月30日发布的一款AI视频生成模型,可生成长度达16秒、1080P画质并包含音频的视频内容。
Qwen3-Vl 30b A3b Instruct
Qwen3-VL系列第二大MoE模型的Instruct版本,响应速度快,支持长视频长文档等超长上下文;全面升级图像/视频理解、空间感知与万物识别能力;具备视觉2D/3D定位能力,胜任复杂现实任务。
Qwen3-Vl 30b A3b Thinking
Qwen3-VL系列第二大MoE模型的Thinking版本,响应速度快,具备更强多模态理解与推理、视觉智能体、长视频长文档等超长上下文支持能力;全面升级图像/视频理解、空间感知与万物识别能力,胜任复杂现实任务。
Qwen3.5 397B A17B
Qwen3.5系列397B-A17B原生视觉语言模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。在语言理解、逻辑推理、代码生成、智能体任务、图像理解、视频理解、图形用户界面(GUI)等多种任务中,均展现出与当前顶尖前沿模型相媲美的卓越性能。具备强大的代码生成与智能体能力,对于各类智能体场景具有良好的泛化性。
Qwen2.5-Max-2025-01-25
一个大规模 MoE 模型,已在超过 20 万亿个 token 上进行了预训练,并使用精选的监督微调 (SFT) 和从人类反馈中强化学习 (RLHF) 方法进行了进一步的后训练。
Qwen-Turbo
Qwen3系列Turbo模型,实现思考模式和非思考模式的有效融合,可在对话中切换模式。推理能力以更小参数规模比肩QwQ-32B、通用能力显著超过Qwen2.5-Turbo,达到同规模业界SOTA水平。
Qwen VL-MAX-2025-01-25
在图像解析、内容识别以及视觉逻辑推导等任务中,表现出更强的准确性和细粒度分析能力。
Qwen 3 235B A22B
Qwen3 系列的旗舰模型,在编码、数学、通用能力等基准测试中,与 DeepSeek-R1、o1、o3-mini、Grok-3 和 Gemini-2.5-Pro 等其他顶级模型相比,取得了极具竞争力的成绩。
Qwen3 30B A3B
Qwen3 系列,总参数量达 300 亿,激活参数量达 30 亿,全系列针对 MCP 调用进行了针对性的优化和增强。
Qwen3 32B
Qwen3 系列,性能介于 Qwen3-235B-A22B 与 Qwen3-30B-A3B 之间,全系列针对 MCP 调用进行了针对性的优化和增强。
Qwen3 235b A22B Instruct 2507
基于Qwen3的非思考模式开源模型,相较上一版本(通义千问3-235B-A22B)主观创作能力与模型安全性均有小幅度提升。
Qwen3 235B A22B Thinking 2507
基于Qwen3的思考模式开源模型,相较上一版本(通义千问3-235B-A22B)逻辑能力、通用能力、知识增强及创作能力均有大幅提升,适用于高难度强推理场景。
Qwen3 Coder 480B A35B Instruct
Qwen3-Coder-480B-A35B-Instruct是由Qwen团队开发的混合专家(MoE)代码生成模型。该模型专为智能编码任务优化,涵盖函数调用、工具使用及代码库长上下文推理等场景。其总参数量达4800亿,每次前向传播激活350亿参数(动态激活160个专家中的8个)。
Qwen3 Max Preview
通义千问 3 系列 Max 模型 Preview 版本,相较 2.5 系列整体通用能力有大幅度提升。参数量达 1T,大幅减少知识幻觉,模型更智能。
Qwen3 Next 80B A3B Thinking
通义千问3 Next 80B A3B Thinking是Qwen3 Next系列中优先进行推理的对话模型,默认输出结构化的"思考"轨迹。该模型专为复杂多步骤问题设计,涵盖数学证明、代码合成/调试、逻辑推理和智能体规划等领域,在知识处理、推理能力、编程辅助、对齐性及多语言评估方面表现卓越。相较于先前Qwen3版本,该模型着重提升了长链思维下的稳定性与推理时的高效扩展性,并通过调优实现了对复杂指令的精准遵循,同时减少重复或偏离任务的行为。
Qwen3 Next 80B A3B Instruct
通义千问3 Next 80B A3B Instruct是Qwen3 Next系列中经过指令微调的对话模型,专为快速稳定的响应而优化,不输出"思考"轨迹。该模型面向推理、代码生成、知识问答和多语言应用等复杂任务,同时在对齐性和格式遵循方面保持稳健性能。相较于先前Qwen3指令微调版本,该模型显著提升了超长输入和多轮对话场景下的吞吐量与稳定性,特别适合需要最终答案而非显式思维链的RAG检索增强、工具调用和智能体工作流。
Qwen3 Max
通义千问3系列Max模型,相较preview版本在智能体编程与工具调用方向进行了专项升级。本次发布的正式版模型达到领域SOTA水平,适配场景更加复杂的智能体需求。
Qwen3-Max 2026 01 23
通义千问3系列Max模型,相较2025年9月23日快照,此版本实现思考模式和非思考模式的有效融合,模型整体效果得到全方位的大幅度提升。在思考模式下,同时发布Web搜索、Web信息提取和代码解释器工具能力,使得模型在慢思考的同时,能够通过引入外部工具,以更高的准确性解决更有难度的问题。此版本为2026年1月23日快照
Qwen3 30b A3b Instruct 2507
基于Qwen3的非思考模式开源模型,相较上一版本(通义千问3-30B-A3B)中英文和多语言整体通用能力有大幅提升。主观开放类任务专项优化,显著更加符合用户偏好,能够提供更有帮助性的回复。
Qwen3 30b A3b Thinking 2507
基于Qwen3的思考模式开源模型,相较上一版本(通义千问3-30B-A3B)复杂推理类任务性能优秀,包括逻辑推理、数学、科学、代码类等具有一定难度的任务场景,指令遵循、文本理解、多语言翻译等能力显著提高。
Qwen/Qwen3.5-Plus
Qwen3.5原生视觉语言系列Plus模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。在多项任务评测中,3.5系列均展现出与当前顶尖前沿模型相媲美的卓越性能,模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步。
Qwen/Qwen3.6-Plus
Qwen 3.6 Plus 是 Qwen Plus 系列的下一代演进版本,采用了先进的混合架构,在效率与可扩展性上均有提升。与 3.5 系列相比,它具有更强的推理能力和更可靠的智能体行为表现。在基准测试中,其性能达到或超越当前领先的业界顶尖模型。作为旗舰级预览版本,它在智能体编程、前端开发及复杂问题求解方面表现尤为出色。 注:该模型会收集提示词与生成结果数据,用于模型的改进。
Minimax/Minimax-M2.5 Highspeed
Minimax M2.5 高 TPS 版本。
Kling-V3
Kling-V3 是快手最新的视频生成模型,支持生成长达15秒的高清视频,具备创新的多镜头连贯生成与原生音频能力。
Kling-V3 Omni
Kling-V3-Omni 是全能多模态版本,将文/图生视频、视频编辑以及基于多参考图的角色和风格一致性控制,完美统一在了单一模型中。
Minimax/Minimax-M2.7
MiniMax-M2.7 是一款面向自主化、真实生产力与持续进化的下一代大语言模型。该模型深度参与自身演化进程,通过多智能体协同整合先进的智能体能力,能够在动态环境中完成复杂任务的规划、执行与优化。
Doubao 1.5 Thinking Pro
仅支持文本输入。在数学、编程、科学推理等专业领域及创意写作等通用任务中表现突出,在AIME 2024、Codeforces、GPQA等多项权威基准上达到或接近业界第一梯队水平。
Doubao 1.5 Vision Pro
全新升级的多模态大模型,视觉理解、分类、信息抽取等能力显著提升,并重点增强了解题、视频理解等场景的任务效果。支持 128k 上下文窗口,输出长度支持最大 16K。
Doubao-Seed 1.6
Doubao Seed 1.6全新多模态深度思考模型,同时支持auto/thinking/non-thinking三种思考模式。 non-thinking模式下,模型效果对比Doubao-1.5-pro/250115大幅提升。支持 256k 上下文窗口,输出长度支持最大 16k tokens。
Doubao-Seed 1.6 Flash
Doubao-Seed-1.6-flash 推理速度极致的多模态深度思考模型,TPOT低至10ms; 同时支持文本和视觉理解,文本理解能力超过上一代lite,视觉理解比肩友商pro系列模型。支持 256k 上下文窗口,输出长度支持最大 16k tokens。
Doubao-Seed 1.6 Thinking
Doubao-Seed-1.6-thinking 模型思考能力大幅强化, 对比 Doubao-1.5-thinking-pro,在 Coding、Math、 逻辑推理等基础能力上进一步提升, 支持视觉理解。 支持 256k 上下文窗口,
Kling-V1
由快手大模型团队自研打造的一款图片生成大模型,支持文生图、图生图-通用垫图等类型的图片生成任务。
Minimax/Minimax-M2
MiniMax-M2是一款紧凑型高效大语言模型,专为端到端编程与智能体工作流优化设计。该模型激活参数量达100亿(总参数量2300亿),在通用推理、工具使用和多步骤任务执行方面展现出接近前沿水平的智能表现,同时保持低延迟与高部署效率。
Kling-V2
由快手大模型团队自研打造的一款图片生成大模型,支持文生图、图生图-多图参考、图生图-风格转绘等类型的图片生成任务。
Kling-V1-5
由快手大模型团队自研打造的一款图片生成大模型,支持文生图、图生图-角色特征、图生图-人物长相等类型的图片生成任务。
Kling-V2-New
由快手大模型团队自研打造的图生图风格转绘大模型,生成图片分辨率与入参图相同,不支持单独设置分辨率。
kling-v2-1
由快手大模型团队自研打造的文生图大模型,支持 1:1,16:9,4:3,3:2,2:3,3:4,9:16,21:9 比例的图片生成。
Kling-Video O1
可灵O1(可灵视频 O1 模型)是可灵AI推出的全球首个统一多模态视频生成模型。模型通过创新的多模态视觉语言(MVL)架构,实现视频生成、编辑与理解的无缝融合。模型支持多模态输入,如图片、视频和文字,能进行全能创作编辑,解决视频一致性难题,提供多种创意组合。用户可通过简单对话生成精准视频内容,探索无限创作可能。
Kling-V2 5 Turbo
可灵2.5 Turbo是可灵团队推出的AI视频生成模型,在多个方面实现了显著的升级和优化。性能提升是其核心亮点之一。模型能更好地理解复杂的因果关系和时间序列指令,生成的视频动作更加流畅自然,运镜更加稳定。在风格保持上也表现出色,无论是色彩、光影还是笔触质感,能在视频生成过程中保持高度一致性。成本降低也是2.5 Turbo的一大优势,使更多用户能以更低的成本体验到高质量的AI视频生成服务。在与顶级CG作品的对比中,可灵2.5 Turbo在某些场景下已经能达到接近甚至超越CG的水平,尤其是在动态预览方面,为CG制作提供了更高效、更快速的解决方案。
Kling-V2 6
可灵视频 2.6支持「动作控制」与「音画同出」。 这是可灵首个支持音画同步生成的视频模型,不仅能一键产出匹配语音、音效(对话/唱歌/Rap)的沉浸式视频,更支持强大的动作捕捉能力,可通过参考视频精准复刻人物肢体动作与微表情,实现对视频“视、听、动”的精准掌控。
Kling-Image O1
使用强参照控制进行精确的图像编辑,在转换主题、风格和局部细节的同时保持视觉一致性。
MiniMax M1
MiniMax-M1,世界上第一个开源的大规模混合架构的推理模型。M1在面向生产力的复杂场景中能力是开源模型中的最好一档,超过国内的闭源模型,接近海外的最领先模型,同时又有业内最高的性价比。M1有一个显著的优势是支持目前业内最高的100万上下文的输入,跟闭源模型里面的 Google Gemini 2.5 Pro 一样,是 DeepSeek R1 的 8 倍,以及业内最长的8万Token的推理输出。
DeepSeek-R1-0528
DeepSeek R1 的重大升级版本,针对复杂推理、多步骤计算更准确;长文理解与生成更连贯、逻辑更清晰;数学、编程等专业性输出更可靠。
DeepSeek-R1
DeepSeek R1 是 DeepSeek 团队发布的最新开源模型,具备非常强悍的推理性能,尤其在数学、编程和推理任务上达到了与OpenAI的o1模型相当的水平
DeepSeek-V3-0324
推理速度大幅提升,位居开源模型之首,媲美顶尖闭源模型。采用负载均衡辅助策略和多标记预测训练,性能显著增强。
DeepSeek-V3
推理速度大幅提升,位居开源模型之首,媲美顶尖闭源模型。采用负载均衡辅助策略和多标记预测训练,性能显著增强。
DeepSeek-V3.1
DeepSeek V3.1 通过显式推理(Think)、动态搜索(Search)、高效工具调用(Tool) 这三驾马车,清晰地瞄准了下一代 AI 智能体的核心能力,清晰地勾勒出一条技术演进路线:一个更自主、更可靠、更能与外部世界交互的智能体(Agent)正在成型。
DeepSeek/DeepSeek-V3.1-Terminus
此次更新在保持模型原有能力的基础上,针对用户反馈的问题进行了改进,包括: 语言一致性:缓解了中英文混杂、偶发异常字符等情况; Agent 能力:进一步优化了 Code Agent 与 Search Agent 的表现。
DeepSeek/DeepSeek-V3.2-Exp
DeepSeek-V3.2-Exp 模型,是一个实验性(Experimental)的版本。作为迈向新一代架构的中间步骤,V3.2-Exp 在 V3.1-Terminus 的基础上引入了 DeepSeek Sparse Attention(一种稀疏注意力机制),针对长文本的训练和推理效率进行了探索性的优化和验证。
DeepSeek/DeepSeek-V3.2-Exp-Thinking
DeepSeek-V3.2-Exp 模型,是一个实验性(Experimental)的版本。作为迈向新一代架构的中间步骤,V3.2-Exp 在 V3.1-Terminus 的基础上引入了 DeepSeek Sparse Attention(一种稀疏注意力机制),针对长文本的训练和推理效率进行了探索性的优化和验证。
Arcee-Ai/Trinity Mini
Trinity Mini是一款拥有260亿参数(其中30亿活跃参数)的稀疏混合专家语言模型,采用128个专家模块设计,每个词元激活其中8个专家。该模型针对长文本场景下的高效推理进行了专项优化,可处理高达13.1万tokens的上下文窗口,同时支持稳健的函数调用和多步骤智能体工作流。
Healer-Alpha
Healer Alpha 是一款前沿的全模态模型,具备视觉、听觉、推理和行动能力。它将代理智能的全部力量带入现实世界:原生地感知视觉和音频输入,跨模态进行推理,并精准可靠地执行复杂的多步骤任务。 注意:此模型的所有提示词和生成内容均由提供商记录,并可能用于改进模型。
Hunter-Alpha
Hunter Alpha 是一款专为代理应用而构建的前沿智能模型,拥有超过1万亿参数和100万tokens的上下文处理能力。它擅长于长程规划、复杂推理以及持续的多步骤任务执行,并具备像OpenClaw这类框架所需的可靠性和精准指令遵循能力。 注意:此模型的所有提示词和生成内容均由提供商记录,并可能用于改进模型。