Qwen Chat 14B
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
模型索引
搜索模型名或厂商名;按真实案例、公开资料状态和场景信号筛选。缺字段保持“暂无数据 / 官方未披露”,不猜测。
当前显示 338 / 338 个模型。 快捷筛选:全部模型。 当前 116 个模型有可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Anthropic / Claude
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Anthropic / Claude
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Anthropic / Claude
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Anthropic / Claude
完整样板模型:已有官方来源、风险说明和可核验 A 类案例。
Anthropic / Claude
Anthropic 于 2024-10-22 发布的低延迟模型;官方于 2025-12-19 宣布弃用,并于 2026-02-19 正式退役,推荐迁移至 Claude Haiku 4.5。
Anthropic / Claude
完整样板模型:已有官方来源、风险说明和可核验 A 类案例。
Anthropic / Claude
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Anthropic / Claude
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Anthropic / Claude
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Anthropic / Claude
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Anthropic / Claude
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Anthropic / Claude
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
官方 Models & Pricing 页面已标示 0813 版本;可确认 1M context、384K 最大输出、Responses 与 Anthropic API 支持,尚无单独变更日志证明架构或 benchmark 变化。
Google / Gemini
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Google / Gemini
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Google / Gemini
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Google / Gemini
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Google / Gemini
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Google / Gemini
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Google / Gemini
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Google / Gemini
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Google / Gemini
完整样板模型:已有官方来源、风险说明和可核验 A 类案例。
Google / Gemini
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Google / Gemini
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Kimi / Moonshot AI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Kimi / Moonshot AI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Kimi / Moonshot AI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Kimi / Moonshot AI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Kimi / Moonshot AI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
MBZUAI IFM / K2
归档 / 暂停研究节点:保留详情入口,但不作为主动推荐。
MBZUAI IFM / K2
归档 / 暂停研究节点:保留详情入口,但不作为主动推荐。
Meta / Llama
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Meta / Llama
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Meta / Llama
完整样板模型:已有官方来源、风险说明和可核验 A 类案例。
Meta / Llama
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Meta / Llama
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
MiniMax
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
MiniMax
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
MiniMax
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
MiniMax
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
MiniMax
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
完整样板模型:已有官方来源、风险说明和可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
完整样板模型:已有官方来源、风险说明和可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Upstage
Solar Mini 初始开源版本于 2024-01-25 发布;官方确认 10.7B 参数、DUS 架构路线和多平台部署。当前 API 别名输入、输出均为 $0.15/1M tokens。
Upstage / Solar
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Upstage / Solar
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Upstage / Solar
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Xiaomi / MiMo
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Xiaomi / MiMo
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Xiaomi / MiMo
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Z AI / GLM
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Z AI / GLM
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Z AI / GLM
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Z AI / GLM
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Z AI / GLM
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
xAI / Grok
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
xAI / Grok
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
xAI / Grok
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
xAI / Grok
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
xAI / Grok
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
xAI / Grok
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
xAI / Grok
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
xAI / Grok
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
StepFun / Step
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Anthropic / Claude
完整样板模型:已有官方来源、风险说明和可核验 A 类案例。
Anthropic / Claude
完整样板模型:已有官方来源、风险说明和可核验 A 类案例。
Anthropic / Claude
完整样板模型:已有官方来源、风险说明和可核验 A 类案例。
Anthropic / Claude
来自厂商页骨架的补充模型;缺失字段以“暂无数据 / 官方未披露”展示。
ByteDance Seed
ByteDance Seed 于 2026-06-19 发布于 Arena AI Code arena 的预览模型。
ByteDance Seed
Seed2.1 Pro 专注于真实生产力场景的复杂任务执行,在通用智能体、代码工程、多模态理解和视频理解等方面达到前沿水平。
ByteDance Seed
Seed2.1 Turbo 保留了多模态和 GUI 能力,适合产品级高频调用场景。
ByteDance Seed
来自厂商页骨架的补充模型;缺失字段以“暂无数据 / 官方未披露”展示。
ByteDance Seed
来自厂商页骨架的补充模型;缺失字段以“暂无数据 / 官方未披露”展示。
ByteDance Seed
来自厂商页骨架的补充模型;缺失字段以“暂无数据 / 官方未披露”展示。
ByteDance Seed
来自厂商页骨架的补充模型;缺失字段以“暂无数据 / 官方未披露”展示。
ByteDance Seed
Seed2.0 Pro 覆盖文本、图像与视频理解,强化推理、搜索与工具调用;官方已公开 API 模型 ID,但参数、上下文、最大输出与精确定价仍未披露。
ByteDance Seed
Seed2.0 Lite 面向质量、响应速度与部署效率平衡的生产场景;2026-04-28 更新原生支持视频、图像、音频和文本统一理解。官方尚未披露参数规模、架构、上下文窗口、最大输出与具体 API 单价。
Sakana AI
Fugu Ultra 是 Sakana AI 于 2026 年 6 月发布的多智能体编排模型。它本身是一个经过训练的语言模型,能够自主协调多个顶级 LLM(包括递归调用自身)来处理复杂的多步骤任务。用户只需调用单一 OpenAI 兼容 API 端点,Fugu Ultra 会自动进行模型选择、任务委派、验证和综合。在 SWE Bench Pro(73.7)、Terminal Bench 2.1(82.1)、LiveCodeBench(93.2)等 benchmark 上超越 Opus 4.8、Gemini 3.1 Pro 和 GPT-5.5。
ByteDance Seed
Seed2.0 Mini 是 Seed2.0 系列中最小的通用 Agent 模型,优化推理吞吐和部署密度,适用于高并发和批量生成场景。支持文本+图像+视频多模态理解。编程能力突出(SWE-Bench Pro 54.4%,Vibe Coding 57.4%),但在深度推理和 Agent 能力上弱于 Pro。
Sakana AI
Fugu 是 Sakana AI 于 2026 年 6 月发布的多智能体编排模型标准版,通过动态协调多个顶级 LLM 在保持低延迟的同时实现强性能,定位为日常工作的默认选择。基于 ICLR 2026 论文 Trinity 和 Conductor 的研究成果。
Anthropic
Claude Sonnet 5 面向高频生产任务,在速度、成本与智能之间取平衡,支持图像输入、工具调用、Adaptive Thinking,并强化代理搜索、计算机使用和编程工作流。
Thinking Machines Lab
Inkling 是 Thinking Machines Lab 于 2026 年 7 月 15 日发布的开源权重多模态模型,采用 975B 总参数/41B 激活参数的 MoE 架构,支持文本、图像和音频输入,1M tokens 上下文,Apache 2.0 许可证。
Kimi / Moonshot AI
Moonshot AI于2026年7月发布的旗舰大语言模型,2.8万亿参数,1M token上下文,原生支持文本+图像+视频理解,始终开启思考模式,面向长程编程与知识工作,全球首个开源3万亿级别模型。
xAI
Grok 4.5 强调真实软件工程能力、80 tokens/s 服务速度和更高 token 效率;官方已披露数万块 NVIDIA GB300 GPU 与数十万项强化学习任务,但参数量、架构和最大输出仍未披露。
Sakana AI
Fugu-Cyber 是 Sakana AI 于 2026 年 7 月 21 日发布的面向网络安全的多智能体编排模型,在 CyberGym(86.9%)和 CTI-REALM(72.1%)基准测试中达到前沿水平。
Gemini 3.5 Flash-Lite 是 Google DeepMind 于 2026 年 7 月发布的 Gemini 3 系列 GA 模型,基于 Gemini 3.1 Flash-Lite,1M 上下文 64K 输出,输入 $0.30/1M tokens 输出 $2.50/1M tokens,支持文本/图像/视频/音频/PDF 多模态输入,定位高吞吐量低成本智能体任务。
Anthropic
Claude Haiku 4.5 提供 200K 上下文、64K 最大输出、文本与图像输入及手动 Extended Thinking,标准 API 价格为输入 $1、输出 $5 / 百万 tokens。
Gemini 3.6 Flash 提供 1M 上下文、64K 输出、多模态输入、工具调用与计算机操作预览。
Gemini 3.5 Flash Cyber 用于高频发现、验证和修复软件漏洞,目前通过 CodeMender 受限试点部署。
Meta
Muse Spark 1.1 提供 1M 上下文、工具调用、计算机操作、代码与并行子智能体能力。
OpenAI
GPT-Live-1 是 OpenAI 于 2026-07-08 发布的全双工语音模型。2026-08-03 的官方工程说明进一步披露了有状态流式推理、WebRTC 媒体快路径、动态上下文压缩、实例无缝交接和异步前沿模型委派。
Anthropic
Anthropic 后续官方模型文档已确认 Claude Opus 5 支持 1M 上下文和 128K 最大输出,知识截止及训练数据截止均为 May 2026;具体参数量、架构、注意力机制和训练硬件仍未披露。
Upstage
Solar Open 2 采用混合线性/Softmax 注意力与 321 专家 MoE,每 token 激活 15B 参数,面向工具调用、多步推理、代码和文档密集型任务。
Xiaomi
官方 Hugging Face 仓库于 2026-07-03 建立,配置包含约 310.8B 存储参数、256 个路由专家、每 token 激活 8 个专家、1,048,576 token 主模型位置长度与 FP8 权重;官方尚未提供技术报告或 benchmark。
OpenAI
ChatGPT Work 面向复杂知识工作,可跨应用收集信息、拆解长任务并生成表格、幻灯片、文档和网页应用;官方未披露独立基础模型、上下文和标准化 benchmark。
Upstage / Solar
Solar Pro 4 于 2026-08-06 发布,提供推理模式、结构化输出与工具调用,覆盖英语、韩语和日语;官方尚未披露可复核 benchmark 与架构细节。
Z AI
GLM-5V-Turbo 原生支持文本、图像、视频和文件输入,提供 200K 上下文、128K 最大输出及多模态工具调用,重点覆盖视觉到代码、GUI Agent 与长链执行。
Z AI
GLM-5-Turbo 强化工具调用、复杂指令拆解、定时与持久任务,支持 200K 上下文、128K 最大输出、Function Calling 与 MCP。官方未披露参数规模和底层架构。
Thinking Machines Lab
Inkling-Small 是 Thinking Machines Lab 于 2026-07-30 发布的开放权重原生多模态 MoE 模型,支持文本、图像和音频、最高 1M tokens 上下文与可调推理预算。
OpenAI
OpenAI 于 2026-08-10 发布 GPT-5.6-Cyber,基于 GPT-5.6 Sol,针对零日漏洞发现、漏洞利用链开发和高级授权安全测试训练,仅通过受治理的 Daybreak Red 提供。
DeepSeek
0731 正式版保持 Preview 的架构与规模,采用重新后训练,支持 1M 上下文、最高 384K 输出、Responses API、工具调用及 low/high/max 思考强度。
xAI / Grok
Grok 4.6 于 2026-08-12 发布,支持 500K 上下文、文本和图像输入、四档推理强度,并提供 Responses API 与 Chat Completions API。
SK Telecom
A.X-K2 是 SK Telecom 当前公开旗舰模型,采用 688B 总参数、33B 激活参数的 MoE 架构,并提供 Think 与 Non-Think 两种推理模式。模型卡已经核对官方技术报告;尚无满足 Model Atlas A 类标准的真实公开案例,因此保持 Hold。
LG AI Research
K-EXAONE 2.0 750B-A37B 采用 750B 总参数、37B 激活参数的 MoE 架构,支持 262K 上下文和十种语言。模型卡已经核对官方模型页及技术论文;尚无满足 Model Atlas A 类标准的真实公开案例,因此保持 Hold。
Motif Technologies
Motif-3 Beta 是 Motif Technologies 公开的预览版中间检查点,采用约 314B 总参数、13.2B 激活参数的 MoE 架构并支持 256K 上下文。官方明确它不是最终版,且默认许可限制商业使用;尚无满足 Model Atlas A 类标准的真实公开案例,因此保持 Hold。
Z AI
GLM-5.3 沿用 GLM-5.2 的基础模型,能力增量全部来自后训练;官方规格为 1M 上下文、128K 最大输出,并要求始终开启 thinking。
SK Telecom
A.X-3.1 从零训练于 2.1T tokens,原生支持 32,768 tokens,并可通过 YaRN 扩展到 131,072 tokens;Apache 2.0 许可,韩语 benchmark 表现突出。
DeepSeek
DeepSeek-V4-Pro-0813 是 DeepSeek 于2026年8月13日发布的 V4 Pro 正式版,基于1.6T总参/49B激活参数的 MoE 架构,支持100万token上下文和384K最大输出,核心升级为Agent能力大幅提升与Responses API原生支持。
Kimi / Moonshot AI
Kimi K2.7 Code 是 Moonshot AI(月之暗面)于 2026-06-12 发布的旗舰级编程模型,MoE 架构(1T 总参数 / 32B 激活参数 / 384 专家,每 token 激活 8 个 + 1 共享专家 / 61 层含 1 密集层 / MLA 注意力),256K 上下文,支持文本+图像+视频输入(MoonViT 400M 视觉编码器)。相比 K2.6 思考 Token 消耗降低约 30%,在 Kimi Code Bench v2、Program Bench、MLS Bench Lite 及 Agent 评测上显著领先 K2.6。权重以 Modified MIT 协议开源。
DeepSeek
DeepSeek 于 2026-08-21 发布的实验版多模态视觉理解 API 模型,支持 1M 上下文、384K 最大输出、图像输入、思考模式与工具调用。
Qwen / Alibaba
Qwen3.6 Flash 是阿里云百炼提供的闭源 API 模型,官方披露 1M 上下文,并支持思考模式、Function Calling、内置工具和结构化输出;当前版本等同于 2026-04-16 快照。
Qwen
0902 版本强化 Coding 与 Cowork,支持文本、图像、视频输入及长周期多工具工作流。
Qwen
Qwen3.8-27B 是 Apache-2.0 开放权重模型,具备文本、图像和视频输入,原生 262K 上下文并可通过 YaRN 扩展到 1M;默认思考并支持 reasoning_effort 控制。
Qwen
Qwen3.8-2.4T-A95B 是纯文本、强制思考的开放权重 MoE 模型,原生 262,144 tokens 上下文并可扩展至 1,010,000;百炼托管 API 提供 1M 上下文和 131,072 tokens 最大输出。
Anthropic
与 Claude Mythos 5.1 共享底层能力,并加入网络安全与生物领域的保护及回退机制。
Meta
强调编程、终端操作和代理任务;未公开参数量、上下文和独立 API 价格。
Meta
Meta 称其相较 1.2 减少约 20% 工具调用、25% token,用于多模态与 Agent 工作流。
支持 1M 输入上下文和 64K 输出,覆盖文本、图像、音频、视频与 PDF。
支持 1M 输入上下文、64K 输出与多档 Thinking,已进入 GA。
Z AI
采用混合稀疏与线性注意力并面向 Coding、Agent 与复杂推理,MIT 许可。
Anthropic
与 Claude Fable 5.1 共享底层模型,但通过受信任访问计划开放更完整的网络安全和生物研究能力。
与 Gemini 3.8 Flash 共享基础智能,针对网络安全与长周期 Agent 工作流强化,并采用更宽松的防御性安全策略。
MBZUAI Institute of Foundation Models
MBZUAI Institute of Foundation Models 的独立模型 release;AA Intelligence Index:47.276。
OpenAI
OpenAI 的独立模型 release;AA Intelligence Index:61.216。
Apodex
Apodex 的独立模型 release;AA Intelligence Index:44.000。
Qwen
Qwen 的独立模型 release;AA Intelligence Index:55.814。
Sapiens AI
Sapiens AI 的独立模型 release;AA Intelligence Index:49.095。
IBM
IBM 的独立模型 release;AA Intelligence Index:19.612。
IBM
IBM 的独立模型 release;AA Intelligence Index:14.276。
IBM
IBM 的独立模型 release;AA Intelligence Index:23.739。
AI9Stars
AI9Stars 的独立模型 release;AA Intelligence Index:34.021。
Motif Technologies
Motif Technologies 的独立模型 release;AA Intelligence Index:47.360。
LG AI Research
LG AI Research 的独立模型 release;AA Intelligence Index:30.985。
NVIDIA
NVIDIA 的独立模型 release;AA Intelligence Index:23.606。
Multiverse Computing
Multiverse Computing 的独立模型 release;AA Intelligence Index:42.986。
Meta
Meta 的独立模型 release;AA Intelligence Index:35.064。
InclusionAI
InclusionAI 的独立模型 release;AA Intelligence Index:24.518。
InclusionAI
InclusionAI 的独立模型 release;AA Intelligence Index:37.821。
Liquid AI
Liquid AI 的独立模型 release;AA Intelligence Index:10.987。
Celeris
Celeris 的独立模型 release;AA Intelligence Index:12.353。
Sapiens AI
Sapiens AI 的独立模型 release;AA Intelligence Index:39.707。
AI9Stars
AI9Stars 的独立模型 release;AA Intelligence Index:16.180。
China Mobile
China Mobile 的独立模型 release;AA Intelligence Index:39.853。
OpenAI
OpenAI 的独立模型 release;AA Intelligence Index:56.576。
OpenAI
OpenAI 的独立模型 release;AA Intelligence Index:60.930。
OpenAI
OpenAI 的独立模型 release;AA Intelligence Index:52.318。
Tencent
Tencent 的独立模型 release;AA Intelligence Index:42.213。
LongCat
LongCat 的独立模型 release;AA Intelligence Index:33.969。
OpenAI
OpenAI 的独立模型 release;AA Intelligence Index:29.233。
Google 的独立模型 release;AA Intelligence Index:13.473。
Cohere
Cohere 的独立模型 release;AA Intelligence Index:20.169。
NVIDIA
NVIDIA 的独立模型 release;AA Intelligence Index:38.319。
Nex AGI
Nex AGI 的独立模型 release;AA Intelligence Index:41.743。
Liquid AI
Liquid AI 的独立模型 release;AA Intelligence Index:8.137。
Multiverse Computing
Multiverse Computing 的独立模型 release;AA Intelligence Index:18.317。
OpenBMB
OpenBMB 的独立模型 release;AA Intelligence Index:11.918。
Cohere
Cohere 的独立模型 release;AA Intelligence Index:22.770。
China Mobile
China Mobile 的独立模型 release;AA Intelligence Index:28.977。
OpenBMB
OpenBMB 的独立模型 release;AA Intelligence Index:3.846。
InclusionAI
InclusionAI 的独立模型 release;AA Intelligence Index:31.663。
NVIDIA 的独立模型 release;AA Intelligence Index:15.007。
Mistral
Mistral 的独立模型 release;AA Intelligence Index:30.392。
IBM
IBM 的独立模型 release;AA Intelligence Index:6.421。
IBM
IBM 的独立模型 release;AA Intelligence Index:4.371。
IBM
IBM 的独立模型 release;AA Intelligence Index:8.698。
DeepSeek
DeepSeek 的独立模型 release;AA Intelligence Index:45.268。
DeepSeek
DeepSeek 的独立模型 release;AA Intelligence Index:42.116。
Xiaomi
Xiaomi 的独立模型 release;AA Intelligence Index:38.043。
China Mobile
China Mobile 的独立模型 release;AA Intelligence Index:18.754。
LG AI Research
LG AI Research 的独立模型 release;AA Intelligence Index:20.511。
Google 的独立模型 release;AA Intelligence Index:26.066。
Arcee AI
Arcee AI 的独立模型 release;AA Intelligence Index:18.658。
Qwen
Qwen 的独立模型 release;AA Intelligence Index:31.342。
Qwen
Qwen 的独立模型 release;AA Intelligence Index:19.225。
Xiaomi
Xiaomi 的独立模型 release;AA Intelligence Index:37.321。
KwaiKAT
KwaiKAT 的独立模型 release;AA Intelligence Index:33.730。
NVIDIA
NVIDIA 的独立模型 release;AA Intelligence Index:17.760。
Xiaomi
Xiaomi 的独立模型 release;AA Intelligence Index:35.866。
NVIDIA
NVIDIA 的独立模型 release;AA Intelligence Index:8.558。
Mistral
Mistral 的独立模型 release;AA Intelligence Index:19.708。
NVIDIA
NVIDIA 的独立模型 release;AA Intelligence Index:25.668。
Sarvam
Sarvam 的独立模型 release;AA Intelligence Index:6.387。
Sarvam
Sarvam 的独立模型 release;AA Intelligence Index:11.905。
Qwen
Qwen 的独立模型 release;AA Intelligence Index:21.790。
Qwen
Qwen 的独立模型 release;AA Intelligence Index:20.370。
Qwen
Qwen 的独立模型 release;AA Intelligence Index:7.426。
Qwen
Qwen 的独立模型 release;AA Intelligence Index:5.163。
Liquid AI
Liquid AI 的独立模型 release;AA Intelligence Index:4.629。
Qwen
Qwen 的独立模型 release;AA Intelligence Index:29.907。
Qwen
Qwen 的独立模型 release;AA Intelligence Index:32.847。
Inception
Inception 的独立模型 release;AA Intelligence Index:21.896。
Cohere
Cohere 的独立模型 release;AA Intelligence Index:1。
Nanbeige
Nanbeige 的独立模型 release;AA Intelligence Index:11.020。
Trillion Labs
Trillion Labs 的独立模型 release;AA Intelligence Index:12.341。
Google 的独立模型 release;AA Intelligence Index:官方未披露 / 待核验。
Qwen
Qwen 的独立模型 release;AA Intelligence Index:21.294。
LongCat
LongCat 的独立模型 release;AA Intelligence Index:17.386。
StepFun
StepFun 的独立模型 release;AA Intelligence Index:9.336。
Liquid AI
Liquid AI 的独立模型 release;AA Intelligence Index:2.341。
Allen Institute for AI
Allen Institute for AI 的独立模型 release;AA Intelligence Index:6.212。
Liquid AI
Liquid AI 的独立模型 release;AA Intelligence Index:1。
Liquid AI
Liquid AI 的独立模型 release;AA Intelligence Index:2.299。
TII UAE
TII UAE 的独立模型 release;AA Intelligence Index:9.663。
LG AI Research
LG AI Research 的独立模型 release;AA Intelligence Index:22.466。
Naver 的独立模型 release;AA Intelligence Index:17.186。
Xiaomi
Xiaomi 的独立模型 release;AA Intelligence Index:31.920。
NVIDIA 的独立模型 release;AA Intelligence Index:14.538。
Allen Institute for AI
Allen Institute for AI 的独立模型 release;AA Intelligence Index:7.897。
Allen Institute for AI
Allen Institute for AI 的独立模型 release;AA Intelligence Index:1.594。
Korea Telecom
Korea Telecom 的独立模型 release;AA Intelligence Index:16.558。
Mistral
Mistral 的独立模型 release;AA Intelligence Index:17.717。
Mistral
Mistral 的独立模型 release;AA Intelligence Index:19.242。
Motif Technologies
Motif Technologies 的独立模型 release;AA Intelligence Index:12.780。
Mistral
Mistral 的独立模型 release;AA Intelligence Index:15.919。
Mistral
Mistral 的独立模型 release;AA Intelligence Index:8.974。
Mistral
Mistral 的独立模型 release;AA Intelligence Index:7.074。
Mistral
Mistral 的独立模型 release;AA Intelligence Index:11.243。
Amazon
Amazon 的独立模型 release;AA Intelligence Index:22.116。
Prime Intellect
Prime Intellect 的独立模型 release;AA Intelligence Index:15.718。
Amazon
Amazon 的独立模型 release;AA Intelligence Index:21.264。
ServiceNow
ServiceNow 的独立模型 release;AA Intelligence Index:20.847。
Allen Institute for AI
Allen Institute for AI 的独立模型 release;AA Intelligence Index:3.618。
Allen Institute for AI
Allen Institute for AI 的独立模型 release;AA Intelligence Index:2.404。
Deep Cogito
Deep Cogito 的独立模型 release;AA Intelligence Index:官方未披露 / 待核验。
Baidu 的独立模型 release;AA Intelligence Index:22.280。
ByteDance Seed
ByteDance Seed 的独立模型 release;AA Intelligence Index:26.492。
Kimi 的独立模型 release;AA Intelligence Index:8.352。
Amazon
Amazon 的独立模型 release;AA Intelligence Index:20.800。
NVIDIA 的独立模型 release;AA Intelligence Index:8.801。
IBM 的独立模型 release;AA Intelligence Index:1。
IBM
IBM 的独立模型 release;AA Intelligence Index:2.249。
IBM
IBM 的独立模型 release;AA Intelligence Index:1。
IBM
IBM 的独立模型 release;AA Intelligence Index:1.635。
AI21 Labs
AI21 Labs 的独立模型 release;AA Intelligence Index:3.778。
Liquid AI
Liquid AI 的独立模型 release;AA Intelligence Index:1.339。
Liquid AI
Liquid AI 的独立模型 release;AA Intelligence Index:2.303。
Qwen 的独立模型 release;AA Intelligence Index:4.803。
Qwen 的独立模型 release;AA Intelligence Index:9.500。
IBM 的独立模型 release;AA Intelligence Index:1.952。
IBM 的独立模型 release;AA Intelligence Index:4.931。
InclusionAI
InclusionAI 的独立模型 release;AA Intelligence Index:7.974。
Mistral
Mistral 的独立模型 release;AA Intelligence Index:18.047。
Mistral
Mistral 的独立模型 release;AA Intelligence Index:11.461。
Qwen 的独立模型 release;AA Intelligence Index:13.754。
Qwen 的独立模型 release;AA Intelligence Index:16.867。
Swiss AI Initiative
Swiss AI Initiative 的独立模型 release;AA Intelligence Index:1。
Swiss AI Initiative
Swiss AI Initiative 的独立模型 release;AA Intelligence Index:1.979。
Nous Research
Nous Research 的独立模型 release;AA Intelligence Index:9.852。
Nous Research
Nous Research 的独立模型 release;AA Intelligence Index:8.843。
NVIDIA
NVIDIA 的独立模型 release;AA Intelligence Index:8.677。
OpenAI
OpenAI 的独立模型 release;AA Intelligence Index:15.225。
OpenAI
OpenAI 的独立模型 release;AA Intelligence Index:24.126。
NVIDIA 的独立模型 release;AA Intelligence Index:12.401。
LG AI Research
LG AI Research 的独立模型 release;AA Intelligence Index:2.505。
LG AI Research
LG AI Research 的独立模型 release;AA Intelligence Index:10.500。
AI21 Labs
AI21 Labs 的独立模型 release;AA Intelligence Index:2.327。
AI21 Labs
AI21 Labs 的独立模型 release;AA Intelligence Index:4.995。
Baidu
Baidu 的独立模型 release;AA Intelligence Index:8.867。
Amazon
Amazon 的独立模型 release;AA Intelligence Index:12.718。
NVIDIA 的独立模型 release;AA Intelligence Index:8.924。
Nous Research
Nous Research 的独立模型 release;AA Intelligence Index:5.004。
Cohere
Cohere 的独立模型 release;AA Intelligence Index:7.463。
Reka AI
Reka AI 的独立模型 release;AA Intelligence Index:3.709。
Microsoft
Microsoft 的独立模型 release;AA Intelligence Index:4.199。
Perplexity
Perplexity 的独立模型 release;AA Intelligence Index:6.049。
Nous Research
Nous Research 的独立模型 release;AA Intelligence Index:1.862。
Microsoft
Microsoft 的独立模型 release;AA Intelligence Index:4.554。
Meta 的独立模型 release;AA Intelligence Index:9.262。
Amazon
Amazon 的独立模型 release;AA Intelligence Index:4.416。
NVIDIA 的独立模型 release;AA Intelligence Index:7.425。
Allen Institute for AI
Allen Institute for AI 的独立模型 release;AA Intelligence Index:3.447。
Meta 的独立模型 release;AA Intelligence Index:5.966。
Meta 的独立模型 release;AA Intelligence Index:2.952。
Meta 的独立模型 release;AA Intelligence Index:8.323。
Microsoft
Microsoft 的独立模型 release;AA Intelligence Index:5.739。
OpenAI
GPT-5.5 Pro 是独立于普通 GPT-5.5 的商业推理模型,支持文本及图像输入、文本输出,适用于可接受高成本与异步等待的困难任务。
OpenBMB
官方2026-09-07发布,采用分级数据管理和SFT/RL/OPD后训练。
OpenBMB
官方同页提供的独立Base权重;不等同于最终模型评测结果。
OpenBMB
官方同页提供的独立Midtrain权重;不等同于最终模型评测结果。
OpenBMB
官方同页提供的独立SFT权重;不等同于最终模型评测结果。
OpenBMB
官方同页提供的独立DSpark权重;不等同于最终模型评测结果。
Claude
Claude Sonnet 4.6 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。
Meta
Llama 4 Scout 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。
Z AI
GLM-5.2 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。
Qwen
Qwen3.7 Plus 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。
Qwen
Qwen3.6 35B A3B 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。
Qwen
Qwen3.6 27B 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。
Gemini 3.5 Flash 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。
Gemma 4 31B 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。
Gemma 4 12B 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。
Gemma 4 E4B 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。
Gemma 4 E2B 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。
Gemma 3 270M 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。
MiniMax
MiniMax-M3 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。
DeepSeek
DeepSeek-V4.1-Flash 是深度求索于 2026-09-10 发布的新一代架构轻量模型,原生支持多模态视觉理解,定位为新架构家族中最小成员,兼顾高推理能力上限、更快推理速度和更高吞吐量。GPQA Diamond 90.9,Codeforces Rating 3471,支持 Thinking/Non-thinking 双模式。
矩阵
矩阵用于快速扫描高分模型,完整筛选请以上方模型索引为准。
| 模型 | Coding Agent 适配 | 长上下文 | 研究 | 开放 / 平台 | 生命周期风险 | A 类案例 |
|---|---|---|---|---|---|---|
| GPT-5.5 (xhigh) OpenAI | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 5 |
| Claude Opus 4.7 (max) Anthropic / Claude | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 5 |
| Gemini 3.1 Pro Preview Google / Gemini | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 5 |
| GPT-5.4 (xhigh) OpenAI | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 5 |
| Qwen3.7 Max Qwen / Alibaba | 通用/待核验 | 暂无数据 | 待核验 | 开放/混合信号 | 中 | 5 |
| Kimi K2.6 Kimi / Moonshot AI | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 6 |
| MiMo-V2.5-Pro Xiaomi / MiMo | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 5 |
| GPT-5.3 Codex (xhigh) OpenAI | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 5 |
| Grok 4.3 (high) xAI / Grok | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 8 |
| Claude Opus 4.6 (max) Anthropic / Claude | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 5 |
| Muse Spark Meta / Llama | 通用/待核验 | 暂无数据 | 待核验 | 开放/混合信号 | 中 | 5 |
| Qwen3.6 Max Preview Qwen / Alibaba | 通用/待核验 | 暂无数据 | 待核验 | 开放/混合信号 | 中 | 7 |
| DeepSeek V4 Pro (Max) DeepSeek | 通用/待核验 | 暂无数据 | 待核验 | 开放/混合信号 | 中 | 7 |
| GLM-5.1 Z AI / GLM | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 10 |
| GPT-5.2 (xhigh) OpenAI | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 5 |
| Muse Spark 1.1 Meta | 待核验 | 暂无数据 | 待核验 | 待核验 | 中 | 0 |
| Qwen3.6 Plus Qwen / Alibaba | 通用/待核验 | 暂无数据 | 待核验 | 开放/混合信号 | 中 | 5 |
| GLM-5 Z AI / GLM | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 5 |
| Claude Opus 4.5 Anthropic / Claude | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 5 |
| MiniMax-M2.7 MiniMax | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 5 |