DATA CUT 2026-09-28 116 活跃模型 680 A 类案例

模型索引

在 338 个模型里快速定位候选

搜索模型名或厂商名;按真实案例、公开资料状态和场景信号筛选。缺字段保持“暂无数据 / 官方未披露”,不猜测。

当前显示 338 / 338 个模型。 快捷筛选:全部模型。 当前 116 个模型有可核验 A 类案例。

Qwen Chat 14B

Qwen / Alibaba

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:7.41 5 条 A 类案例 风险:中

Qwen Chat 72B

Qwen / Alibaba

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:8.82 5 条 A 类案例 风险:中

Qwen1.5 Chat 110B

Qwen / Alibaba

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:9.55 5 条 A 类案例 风险:中

Qwen2 72B

Qwen / Alibaba

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:11.66 5 条 A 类案例 风险:中

Qwen2.5 72B

Qwen / Alibaba

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:15.56 5 条 A 类案例 风险:中

Qwen2.5 Max

Qwen / Alibaba

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:16.28 5 条 A 类案例 风险:中

QwQ-32B

Qwen / Alibaba

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:19.72 5 条 A 类案例 风险:中 Coding Agent 候选

Qwen3 235B

Qwen / Alibaba

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:7 通用/待核验
状态:已有真实案例 AA:19.79 7 条 A 类案例 风险:中 Coding Agent 候选

Qwen3 235B 2507

Qwen / Alibaba

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:24.96 5 条 A 类案例 风险:中

Qwen3 235B A22B 2507

Qwen / Alibaba

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:29.54 5 条 A 类案例 风险:中 Coding Agent 候选

Qwen3 Max

Qwen / Alibaba

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:11 通用/待核验
状态:已有真实案例 AA:31.38 11 条 A 类案例 风险:中
状态:已有真实案例 AA:32.48 6 条 A 类案例 风险:中 Coding Agent 候选

Qwen3 Max Thinking

Qwen / Alibaba

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:6 通用/待核验
状态:已有真实案例 AA:39.85 6 条 A 类案例 风险:中 Coding Agent 候选

Qwen3.5 397B A17B

Qwen / Alibaba

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:45.05 5 条 A 类案例 风险:中 Coding Agent 候选

Qwen3.6 Plus

Qwen / Alibaba

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:49.98 5 条 A 类案例 风险:中 Coding Agent 候选

Qwen3.6 Max Preview

Qwen / Alibaba

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:7 通用/待核验
状态:已有真实案例 AA:51.81 7 条 A 类案例 风险:中 Coding Agent 候选

Qwen3.7 Max

Qwen / Alibaba

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:56.58 5 条 A 类案例 风险:中 Coding Agent 候选

Claude Instant

Anthropic / Claude

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:7.41 5 条 A 类案例 风险:中

Claude 2.0

Anthropic / Claude

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:6 通用/待核验
状态:已有真实案例 AA:9.06 6 条 A 类案例 风险:中

Claude 2.1

Anthropic / Claude

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:9.32 5 条 A 类案例 风险:中

Claude 3 Opus

Anthropic / Claude

已有真实案例

完整样板模型:已有官方来源、风险说明和可核验 A 类案例。

A 类案例:6 通用/待核验
状态:已有真实案例 AA:18 6 条 A 类案例 风险:中

Claude 3.5 Haiku

Anthropic / Claude

已有真实案例

Anthropic 于 2024-10-22 发布的低延迟模型;官方于 2025-12-19 宣布弃用,并于 2026-02-19 正式退役,推荐迁移至 Claude Haiku 4.5。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:18.66 5 条 A 类案例 风险:中
状态:已有真实案例 AA:34.71 5 条 A 类案例 风险:中 Coding Agent 候选

Claude 4 Opus

Anthropic / Claude

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:39 5 条 A 类案例 风险:中 Coding Agent 候选

Claude 4.1 Opus

Anthropic / Claude

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:42 5 条 A 类案例 风险:中 Coding Agent 候选

Claude 4.5 Sonnet

Anthropic / Claude

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:6 通用/待核验
状态:已有真实案例 AA:43.03 6 条 A 类案例 风险:中 Coding Agent 候选

Claude Opus 4.5

Anthropic / Claude

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:49.73 5 条 A 类案例 风险:中 Coding Agent 候选

Claude Opus 4.6 (max)

Anthropic / Claude

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:52.95 5 条 A 类案例 风险:中 Coding Agent 候选

Claude Opus 4.7 (max)

Anthropic / Claude

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:57.28 5 条 A 类案例 风险:中 Coding Agent 候选
已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:8.37 5 条 A 类案例 风险:中

DeepSeek-V2

DeepSeek

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:9.06 5 条 A 类案例 风险:中
已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:10.61 5 条 A 类案例 风险:中

DeepSeek-V2.5

DeepSeek

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:12.33 5 条 A 类案例 风险:中
已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:12.51 5 条 A 类案例 风险:中
已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:16.46 5 条 A 类案例 风险:中
已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:18.84 5 条 A 类案例 风险:中 Coding Agent 候选

DeepSeek V3 0324

DeepSeek

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:22.28 5 条 A 类案例 风险:中

DeepSeek R1 0528

DeepSeek

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:27.07 5 条 A 类案例 风险:中 Coding Agent 候选

DeepSeek V3.1

DeepSeek

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:6 通用/待核验
状态:已有真实案例 AA:28.13 6 条 A 类案例 风险:中
状态:已有真实案例 AA:33.93 7 条 A 类案例 风险:中 Coding Agent 候选

DeepSeek V3.2

DeepSeek

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:41.71 5 条 A 类案例 风险:中 Coding Agent 候选
已有真实案例

官方 Models & Pricing 页面已标示 0813 版本;可确认 1M context、384K 最大输出、Responses 与 Anthropic API 支持,尚无单独变更日志证明架构或 benchmark 变化。

A 类案例:7 通用/待核验
状态:已有真实案例 AA:51.51 7 条 A 类案例 风险:中

PALM-2

Google / Gemini

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:8.59 5 条 A 类案例 风险:中

Gemini 1.0 Ultra

Google / Gemini

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:10.15 5 条 A 类案例 风险:中

Gemini 1.5 Flash (May)

Google / Gemini

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:7 通用/待核验
状态:已有真实案例 AA:10.46 7 条 A 类案例 风险:中

Gemini 1.5 Pro (May)

Google / Gemini

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:10 通用/待核验
状态:已有真实案例 AA:12 10 条 A 类案例 风险:中

Gemini 1.5 Pro (Sep)

Google / Gemini

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:15.99 5 条 A 类案例 风险:中

Gemini 2.0 Flash (exp)

Google / Gemini

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:16.77 5 条 A 类案例 风险:中
状态:已有真实案例 AA:19.6 5 条 A 类案例 风险:中 Coding Agent 候选

Gemini 2.5 Pro (Mar)

Google / Gemini

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:6 通用/待核验
状态:已有真实案例 AA:30.3 6 条 A 类案例 风险:中 Coding Agent 候选

Gemini 2.5 Pro

Google / Gemini

已有真实案例

完整样板模型:已有官方来源、风险说明和可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:34.63 5 条 A 类案例 风险:中 Coding Agent 候选
状态:已有真实案例 AA:48.39 5 条 A 类案例 风险:中 Coding Agent 候选

Gemini 3.1 Pro Preview

Google / Gemini

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:57.18 5 条 A 类案例 风险:中 Coding Agent 候选

Kimi K2

Kimi / Moonshot AI

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:6 通用/待核验
状态:已有真实案例 AA:26.32 6 条 A 类案例 风险:中

Kimi K2 0905

Kimi / Moonshot AI

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:30.85 5 条 A 类案例 风险:中

Kimi K2 Thinking

Kimi / Moonshot AI

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:40.89 5 条 A 类案例 风险:中 Coding Agent 候选

Kimi K2.5

Kimi / Moonshot AI

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:46.81 5 条 A 类案例 风险:中 Coding Agent 候选

Kimi K2.6

Kimi / Moonshot AI

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:6 通用/待核验
状态:已有真实案例 AA:53.9 6 条 A 类案例 风险:中 Coding Agent 候选

K2-V2 (high)

MBZUAI IFM / K2

历史归档

归档 / 暂停研究节点:保留详情入口,但不作为主动推荐。

A 类案例:0 通用/待核验
状态:历史归档 AA:20.61 暂无可核验 A 类案例 风险:高 Coding Agent 候选

K2 Think V2

MBZUAI IFM / K2

历史归档

归档 / 暂停研究节点:保留详情入口,但不作为主动推荐。

A 类案例:0 通用/待核验
状态:历史归档 AA:24.12 暂无可核验 A 类案例 风险:高 Coding Agent 候选

Llama 65B

Meta / Llama

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:7.41 5 条 A 类案例 风险:中

Llama 2 Chat 7B

Meta / Llama

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:9.74 5 条 A 类案例 风险:中
状态:已有真实案例 AA:17.38 6 条 A 类案例 风险:中

Llama 4 Maverick

Meta / Llama

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:18.36 5 条 A 类案例 风险:中

Muse Spark

Meta / Llama

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:52.15 5 条 A 类案例 风险:中 Coding Agent 候选

MiniMax M1 80k

MiniMax

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:9 通用/待核验
状态:已有真实案例 AA:24.43 9 条 A 类案例 风险:中 Coding Agent 候选

MiniMax-M2

MiniMax

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:36.09 5 条 A 类案例 风险:中 Coding Agent 候选

MiniMax-M2.1

MiniMax

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:39.42 5 条 A 类案例 风险:中 Coding Agent 候选

MiniMax-M2.5

MiniMax

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:41.93 5 条 A 类案例 风险:中 Coding Agent 候选

MiniMax-M2.7

MiniMax

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:49.62 5 条 A 类案例 风险:中 Coding Agent 候选

GPT-3.5 Turbo

OpenAI

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:8.99 5 条 A 类案例 风险:中

GPT-4

OpenAI

已有真实案例

完整样板模型:已有官方来源、风险说明和可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:12.75 5 条 A 类案例 风险:中

GPT-4 Turbo

OpenAI

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:13.72 5 条 A 类案例 风险:中

GPT-4o (May)

OpenAI

已有真实案例

完整样板模型:已有官方来源、风险说明和可核验 A 类案例。

A 类案例:6 通用/待核验
状态:已有真实案例 AA:14.5 6 条 A 类案例 风险:中

GPT-4o (Aug)

OpenAI

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:18.64 5 条 A 类案例 风险:中

o1-preview

OpenAI

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:7 通用/待核验
状态:已有真实案例 AA:23.74 7 条 A 类案例 风险:中 Coding Agent 候选

o1

OpenAI

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:7 通用/待核验
状态:已有真实案例 AA:30.75 7 条 A 类案例 风险:中 Coding Agent 候选

o3

OpenAI

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:6 通用/待核验
状态:已有真实案例 AA:38.37 6 条 A 类案例 风险:中 Coding Agent 候选

o3-pro

OpenAI

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:40.69 5 条 A 类案例 风险:中 Coding Agent 候选

GPT-5 (high)

OpenAI

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:44.63 5 条 A 类案例 风险:中 Coding Agent 候选
已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:44.63 5 条 A 类案例 风险:中 Coding Agent 候选
已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:12 通用/待核验
状态:已有真实案例 AA:47.7 12 条 A 类案例 风险:中 Coding Agent 候选
已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:51.28 5 条 A 类案例 风险:中 Coding Agent 候选
已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:53.56 5 条 A 类案例 风险:中 Coding Agent 候选
已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:56.8 5 条 A 类案例 风险:中 Coding Agent 候选
已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:60.24 5 条 A 类案例 风险:中 Coding Agent 候选

Solar Mini

Upstage

已有真实案例

Solar Mini 初始开源版本于 2024-01-25 发布;官方确认 10.7B 参数、DUS 架构路线和多平台部署。当前 API 别名输入、输出均为 $0.15/1M tokens。

A 类案例:9 通用/待核验
状态:已有真实案例 AA:11.9 9 条 A 类案例 风险:中

Solar Pro 2

Upstage / Solar

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:7 通用/待核验
状态:已有真实案例 AA:18.81 7 条 A 类案例 风险:中 Coding Agent 候选

Solar Open 100B

Upstage / Solar

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:21.67 5 条 A 类案例 风险:中 Coding Agent 候选

Solar Pro 3

Upstage / Solar

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:10 通用/待核验
状态:已有真实案例 AA:25.87 10 条 A 类案例 风险:中 Coding Agent 候选
状态:已有真实案例 AA:41.46 8 条 A 类案例 风险:中 Coding Agent 候选

MiMo-V2-Pro

Xiaomi / MiMo

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:49.2 5 条 A 类案例 风险:中 Coding Agent 候选

MiMo-V2.5-Pro

Xiaomi / MiMo

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:53.83 5 条 A 类案例 风险:中 Coding Agent 候选

GLM-4.5

Z AI / GLM

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:26.42 5 条 A 类案例 风险:中 Coding Agent 候选

GLM-4.6

Z AI / GLM

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:32.51 5 条 A 类案例 风险:中 Coding Agent 候选

GLM-4.7

Z AI / GLM

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:13 通用/待核验
状态:已有真实案例 AA:42.11 13 条 A 类案例 风险:中 Coding Agent 候选

GLM-5

Z AI / GLM

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:49.77 5 条 A 类案例 风险:中 Coding Agent 候选

GLM-5.1

Z AI / GLM

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:10 通用/待核验
状态:已有真实案例 AA:51.41 10 条 A 类案例 风险:中 Coding Agent 候选

Grok-1

xAI / Grok

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:11.69 5 条 A 类案例 风险:中

Grok Beta

xAI / Grok

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:10 通用/待核验
状态:已有真实案例 AA:13.28 10 条 A 类案例 风险:中

Grok 2

xAI / Grok

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:9 通用/待核验
状态:已有真实案例 AA:13.89 9 条 A 类案例 风险:中
状态:已有真实案例 AA:32.08 5 条 A 类案例 风险:中 Coding Agent 候选

Grok 4

xAI / Grok

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:41.52 5 条 A 类案例 风险:中 Coding Agent 候选

Grok 4.20 0309

xAI / Grok

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:48.48 5 条 A 类案例 风险:中 Coding Agent 候选

Grok 4.20 0309 v2

xAI / Grok

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:49.33 5 条 A 类案例 风险:中 Coding Agent 候选

Grok 4.3 (high)

xAI / Grok

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:8 通用/待核验
状态:已有真实案例 AA:53.2 8 条 A 类案例 风险:中 Coding Agent 候选

Step 3.7 Flash

StepFun / Step

已有真实案例

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:暂无数据 5 条 A 类案例 风险:中 Coding Agent 候选

Claude 3 Haiku

Anthropic / Claude

已有真实案例

完整样板模型:已有官方来源、风险说明和可核验 A 类案例。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:暂无数据 5 条 A 类案例 风险:中
状态:已有真实案例 AA:暂无数据 5 条 A 类案例 风险:中

Claude Fable 5

Anthropic / Claude

已有真实案例

完整样板模型:已有官方来源、风险说明和可核验 A 类案例。

A 类案例:8 通用/待核验
状态:已有真实案例 AA:暂无数据 8 条 A 类案例 风险:中 Coding Agent 候选

Claude Mythos 5

Anthropic / Claude

已有真实案例

来自厂商页骨架的补充模型;缺失字段以“暂无数据 / 官方未披露”展示。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:暂无数据 5 条 A 类案例 风险:中 Coding Agent 候选
状态:已有真实案例 AA:暂无数据 7 条 A 类案例 风险:中

Seed2.1 Pro

ByteDance Seed

已有真实案例

Seed2.1 Pro 专注于真实生产力场景的复杂任务执行,在通用智能体、代码工程、多模态理解和视频理解等方面达到前沿水平。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:暂无数据 5 条 A 类案例 风险:中

Seed2.1 Turbo

ByteDance Seed

已有真实案例

Seed2.1 Turbo 保留了多模态和 GUI 能力,适合产品级高频调用场景。

A 类案例:6 通用/待核验
状态:已有真实案例 AA:暂无数据 6 条 A 类案例 风险:中

Seedance 1.0

ByteDance Seed

已有真实案例

来自厂商页骨架的补充模型;缺失字段以“暂无数据 / 官方未披露”展示。

A 类案例:9 通用/待核验
状态:已有真实案例 AA:暂无数据 9 条 A 类案例 风险:中

Seedance 2.0

ByteDance Seed

已有真实案例

来自厂商页骨架的补充模型;缺失字段以“暂无数据 / 官方未披露”展示。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:暂无数据 5 条 A 类案例 风险:高

Seed1.5 VL

ByteDance Seed

已有真实案例

来自厂商页骨架的补充模型;缺失字段以“暂无数据 / 官方未披露”展示。

A 类案例:8 通用/待核验
状态:已有真实案例 AA:暂无数据 8 条 A 类案例 风险:高

BAGEL

ByteDance Seed

已有真实案例

来自厂商页骨架的补充模型;缺失字段以“暂无数据 / 官方未披露”展示。

A 类案例:5 通用/待核验
状态:已有真实案例 AA:暂无数据 5 条 A 类案例 风险:高

Seed2.0 Pro

ByteDance Seed

暂缓推荐

Seed2.0 Pro 覆盖文本、图像与视频理解,强化推理、搜索与工具调用;官方已公开 API 模型 ID,但参数、上下文、最大输出与精确定价仍未披露。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Seed2.0 Lite

ByteDance Seed

暂缓推荐

Seed2.0 Lite 面向质量、响应速度与部署效率平衡的生产场景;2026-04-28 更新原生支持视频、图像、音频和文本统一理解。官方尚未披露参数规模、架构、上下文窗口、最大输出与具体 API 单价。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Fugu Ultra

Sakana AI

暂缓推荐

Fugu Ultra 是 Sakana AI 于 2026 年 6 月发布的多智能体编排模型。它本身是一个经过训练的语言模型,能够自主协调多个顶级 LLM(包括递归调用自身)来处理复杂的多步骤任务。用户只需调用单一 OpenAI 兼容 API 端点,Fugu Ultra 会自动进行模型选择、任务委派、验证和综合。在 SWE Bench Pro(73.7)、Terminal Bench 2.1(82.1)、LiveCodeBench(93.2)等 benchmark 上超越 Opus 4.8、Gemini 3.1 Pro 和 GPT-5.5。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Seed2.0 Mini

ByteDance Seed

暂缓推荐

Seed2.0 Mini 是 Seed2.0 系列中最小的通用 Agent 模型,优化推理吞吐和部署密度,适用于高并发和批量生成场景。支持文本+图像+视频多模态理解。编程能力突出(SWE-Bench Pro 54.4%,Vibe Coding 57.4%),但在深度推理和 Agent 能力上弱于 Pro。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Fugu

Sakana AI

暂缓推荐

Fugu 是 Sakana AI 于 2026 年 6 月发布的多智能体编排模型标准版,通过动态协调多个顶级 LLM 在保持低延迟的同时实现强性能,定位为日常工作的默认选择。基于 ICLR 2026 论文 Trinity 和 Conductor 的研究成果。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Claude Sonnet 5

Anthropic

暂缓推荐

Claude Sonnet 5 面向高频生产任务,在速度、成本与智能之间取平衡,支持图像输入、工具调用、Adaptive Thinking,并强化代理搜索、计算机使用和编程工作流。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Inkling

Thinking Machines Lab

暂缓推荐

Inkling 是 Thinking Machines Lab 于 2026 年 7 月 15 日发布的开源权重多模态模型,采用 975B 总参数/41B 激活参数的 MoE 架构,支持文本、图像和音频输入,1M tokens 上下文,Apache 2.0 许可证。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Kimi K3

Kimi / Moonshot AI

暂缓推荐

Moonshot AI于2026年7月发布的旗舰大语言模型,2.8万亿参数,1M token上下文,原生支持文本+图像+视频理解,始终开启思考模式,面向长程编程与知识工作,全球首个开源3万亿级别模型。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中 Coding Agent 候选

Grok 4.5

xAI

暂缓推荐

Grok 4.5 强调真实软件工程能力、80 tokens/s 服务速度和更高 token 效率;官方已披露数万块 NVIDIA GB300 GPU 与数十万项强化学习任务,但参数量、架构和最大输出仍未披露。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Fugu-Cyber

Sakana AI

暂缓推荐

Fugu-Cyber 是 Sakana AI 于 2026 年 7 月 21 日发布的面向网络安全的多智能体编排模型,在 CyberGym(86.9%)和 CTI-REALM(72.1%)基准测试中达到前沿水平。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
暂缓推荐

Gemini 3.5 Flash-Lite 是 Google DeepMind 于 2026 年 7 月发布的 Gemini 3 系列 GA 模型,基于 Gemini 3.1 Flash-Lite,1M 上下文 64K 输出,输入 $0.30/1M tokens 输出 $2.50/1M tokens,支持文本/图像/视频/音频/PDF 多模态输入,定位高吞吐量低成本智能体任务。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Claude Haiku 4.5

Anthropic

暂缓推荐

Claude Haiku 4.5 提供 200K 上下文、64K 最大输出、文本与图像输入及手动 Extended Thinking,标准 API 价格为输入 $1、输出 $5 / 百万 tokens。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
暂缓推荐

Gemini 3.6 Flash 提供 1M 上下文、64K 输出、多模态输入、工具调用与计算机操作预览。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
暂缓推荐

Muse Spark 1.1 提供 1M 上下文、工具调用、计算机操作、代码与并行子智能体能力。

A 类案例:0 待核验
状态:暂缓推荐 AA:51 暂无可核验 A 类案例 风险:中

GPT-Live-1

OpenAI

暂缓推荐

GPT-Live-1 是 OpenAI 于 2026-07-08 发布的全双工语音模型。2026-08-03 的官方工程说明进一步披露了有状态流式推理、WebRTC 媒体快路径、动态上下文压缩、实例无缝交接和异步前沿模型委派。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Claude Opus 5

Anthropic

暂缓推荐

Anthropic 后续官方模型文档已确认 Claude Opus 5 支持 1M 上下文和 128K 最大输出,知识截止及训练数据截止均为 May 2026;具体参数量、架构、注意力机制和训练硬件仍未披露。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Solar Open 2

Upstage

暂缓推荐

Solar Open 2 采用混合线性/Softmax 注意力与 321 专家 MoE,每 token 激活 15B 参数,面向工具调用、多步推理、代码和文档密集型任务。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
暂缓推荐

官方 Hugging Face 仓库于 2026-07-03 建立,配置包含约 310.8B 存储参数、256 个路由专家、每 token 激活 8 个专家、1,048,576 token 主模型位置长度与 FP8 权重;官方尚未提供技术报告或 benchmark。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

ChatGPT Work

OpenAI

暂缓推荐

ChatGPT Work 面向复杂知识工作,可跨应用收集信息、拆解长任务并生成表格、幻灯片、文档和网页应用;官方未披露独立基础模型、上下文和标准化 benchmark。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Solar Pro 4

Upstage / Solar

暂缓推荐

Solar Pro 4 于 2026-08-06 发布,提供推理模式、结构化输出与工具调用,覆盖英语、韩语和日语;官方尚未披露可复核 benchmark 与架构细节。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中 Coding Agent 候选
暂缓推荐

GLM-5V-Turbo 原生支持文本、图像、视频和文件输入,提供 200K 上下文、128K 最大输出及多模态工具调用,重点覆盖视觉到代码、GUI Agent 与长链执行。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
暂缓推荐

GLM-5-Turbo 强化工具调用、复杂指令拆解、定时与持久任务,支持 200K 上下文、128K 最大输出、Function Calling 与 MCP。官方未披露参数规模和底层架构。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Inkling-Small

Thinking Machines Lab

暂缓推荐

Inkling-Small 是 Thinking Machines Lab 于 2026-07-30 发布的开放权重原生多模态 MoE 模型,支持文本、图像和音频、最高 1M tokens 上下文与可调推理预算。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

GPT-5.6-Cyber

OpenAI

暂缓推荐

OpenAI 于 2026-08-10 发布 GPT-5.6-Cyber,基于 GPT-5.6 Sol,针对零日漏洞发现、漏洞利用链开发和高级授权安全测试训练,仅通过受治理的 Daybreak Red 提供。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
暂缓推荐

0731 正式版保持 Preview 的架构与规模,采用重新后训练,支持 1M 上下文、最高 384K 输出、Responses API、工具调用及 low/high/max 思考强度。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Grok 4.6

xAI / Grok

暂缓推荐

Grok 4.6 于 2026-08-12 发布,支持 500K 上下文、文本和图像输入、四档推理强度,并提供 Responses API 与 Chat Completions API。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

A.X-K2

SK Telecom

暂缓推荐

A.X-K2 是 SK Telecom 当前公开旗舰模型,采用 688B 总参数、33B 激活参数的 MoE 架构,并提供 Think 与 Non-Think 两种推理模式。模型卡已经核对官方技术报告;尚无满足 Model Atlas A 类标准的真实公开案例,因此保持 Hold。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

K-EXAONE 2.0 750B-A37B

LG AI Research

暂缓推荐

K-EXAONE 2.0 750B-A37B 采用 750B 总参数、37B 激活参数的 MoE 架构,支持 262K 上下文和十种语言。模型卡已经核对官方模型页及技术论文;尚无满足 Model Atlas A 类标准的真实公开案例,因此保持 Hold。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Motif-3 Beta

Motif Technologies

暂缓推荐

Motif-3 Beta 是 Motif Technologies 公开的预览版中间检查点,采用约 314B 总参数、13.2B 激活参数的 MoE 架构并支持 256K 上下文。官方明确它不是最终版,且默认许可限制商业使用;尚无满足 Model Atlas A 类标准的真实公开案例,因此保持 Hold。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

GLM-5.3

Z AI

暂缓推荐

GLM-5.3 沿用 GLM-5.2 的基础模型,能力增量全部来自后训练;官方规格为 1M 上下文、128K 最大输出,并要求始终开启 thinking。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

A.X-3.1

SK Telecom

暂缓推荐

A.X-3.1 从零训练于 2.1T tokens,原生支持 32,768 tokens,并可通过 YaRN 扩展到 131,072 tokens;Apache 2.0 许可,韩语 benchmark 表现突出。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
暂缓推荐

DeepSeek-V4-Pro-0813 是 DeepSeek 于2026年8月13日发布的 V4 Pro 正式版,基于1.6T总参/49B激活参数的 MoE 架构,支持100万token上下文和384K最大输出,核心升级为Agent能力大幅提升与Responses API原生支持。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Kimi K2.7 Code

Kimi / Moonshot AI

暂缓推荐

Kimi K2.7 Code 是 Moonshot AI(月之暗面)于 2026-06-12 发布的旗舰级编程模型,MoE 架构(1T 总参数 / 32B 激活参数 / 384 专家,每 token 激活 8 个 + 1 共享专家 / 61 层含 1 密集层 / MLA 注意力),256K 上下文,支持文本+图像+视频输入(MoonViT 400M 视觉编码器)。相比 K2.6 思考 Token 消耗降低约 30%,在 Kimi Code Bench v2、Program Bench、MLS Bench Lite 及 Agent 评测上显著领先 K2.6。权重以 Modified MIT 协议开源。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中 Coding Agent 候选
暂缓推荐

DeepSeek 于 2026-08-21 发布的实验版多模态视觉理解 API 模型,支持 1M 上下文、384K 最大输出、图像输入、思考模式与工具调用。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Qwen3.6 Flash

Qwen / Alibaba

暂缓推荐

Qwen3.6 Flash 是阿里云百炼提供的闭源 API 模型,官方披露 1M 上下文,并支持思考模式、Function Calling、内置工具和结构化输出;当前版本等同于 2026-04-16 快照。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
暂缓推荐

0902 版本强化 Coding 与 Cowork,支持文本、图像、视频输入及长周期多工具工作流。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
暂缓推荐

Qwen3.8-27B 是 Apache-2.0 开放权重模型,具备文本、图像和视频输入,原生 262K 上下文并可通过 YaRN 扩展到 1M;默认思考并支持 reasoning_effort 控制。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
暂缓推荐

Qwen3.8-2.4T-A95B 是纯文本、强制思考的开放权重 MoE 模型,原生 262,144 tokens 上下文并可扩展至 1,010,000;百炼托管 API 提供 1M 上下文和 131,072 tokens 最大输出。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Claude Fable 5.1

Anthropic

暂缓推荐

与 Claude Mythos 5.1 共享底层能力,并加入网络安全与生物领域的保护及回退机制。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Claude Mythos 5.1

Anthropic

暂缓推荐

与 Claude Fable 5.1 共享底层模型,但通过受信任访问计划开放更完整的网络安全和生物研究能力。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
暂缓推荐

与 Gemini 3.8 Flash 共享基础智能,针对网络安全与长周期 Agent 工作流强化,并采用更宽松的防御性安全策略。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

K2 Horizon 375B A23B

MBZUAI Institute of Foundation Models

暂缓推荐

MBZUAI Institute of Foundation Models 的独立模型 release;AA Intelligence Index:47.276。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Motif 3

Motif Technologies

暂缓推荐

Motif Technologies 的独立模型 release;AA Intelligence Index:47.360。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Quasar 438B

Multiverse Computing

暂缓推荐

Multiverse Computing 的独立模型 release;AA Intelligence Index:42.986。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Hy3

Tencent

暂缓推荐

Tencent 的独立模型 release;AA Intelligence Index:42.213。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

JT-MINI

China Mobile

暂缓推荐

China Mobile 的独立模型 release;AA Intelligence Index:18.754。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

K-EXAONE

LG AI Research

暂缓推荐

LG AI Research 的独立模型 release;AA Intelligence Index:22.466。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Molmo2-8B

Allen Institute for AI

暂缓推荐

Allen Institute for AI 的独立模型 release;AA Intelligence Index:1.594。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Cogito v2.1

Deep Cogito

暂缓推荐

Deep Cogito 的独立模型 release;AA Intelligence Index:官方未披露 / 待核验。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

R1 1776

Perplexity

暂缓推荐

Perplexity 的独立模型 release;AA Intelligence Index:6.049。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Phi-4

Microsoft

暂缓推荐

Microsoft 的独立模型 release;AA Intelligence Index:4.554。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Molmo 7B-D

Allen Institute for AI

暂缓推荐

Allen Institute for AI 的独立模型 release;AA Intelligence Index:3.447。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

GPT-5.5 Pro

OpenAI

暂缓推荐

GPT-5.5 Pro 是独立于普通 GPT-5.5 的商业推理模型,支持文本及图像输入、文本输出,适用于可接受高成本与异步等待的困难任务。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
暂缓推荐

Claude Sonnet 4.6 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
暂缓推荐

Llama 4 Scout 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

GLM-5.2

Z AI

暂缓推荐

GLM-5.2 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
暂缓推荐

Qwen3.7 Plus 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
暂缓推荐

Qwen3.6 35B A3B 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
暂缓推荐

Qwen3.6 27B 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
暂缓推荐

Gemini 3.5 Flash 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Gemma 4 31B

Google

暂缓推荐

Gemma 4 31B 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Gemma 4 12B

Google

暂缓推荐

Gemma 4 12B 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Gemma 4 E4B

Google

暂缓推荐

Gemma 4 E4B 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Gemma 4 E2B

Google

暂缓推荐

Gemma 4 E2B 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

Gemma 3 270M

Google

暂缓推荐

Gemma 3 270M 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

MiniMax-M3

MiniMax

暂缓推荐

MiniMax-M3 的独立版本身份由当前 AA release 与已有 Wiki 模型卡对应。技术规格及实际应用证据仍需按官方资料复核。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中
暂缓推荐

DeepSeek-V4.1-Flash 是深度求索于 2026-09-10 发布的新一代架构轻量模型,原生支持多模态视觉理解,定位为新架构家族中最小成员,兼顾高推理能力上限、更快推理速度和更高吞吐量。GPQA Diamond 90.9,Codeforces Rating 3471,支持 Thinking/Non-thinking 双模式。

A 类案例:0 待核验
状态:暂缓推荐 AA:暂无数据 暂无可核验 A 类案例 风险:中

矩阵

Top 20 评分切片

矩阵用于快速扫描高分模型,完整筛选请以上方模型索引为准。

模型 Coding Agent 适配长上下文研究开放 / 平台生命周期风险 A 类案例
GPT-5.5 (xhigh)

OpenAI

通用/待核验暂无数据待核验平台/待核验中 5
Claude Opus 4.7 (max)

Anthropic / Claude

通用/待核验暂无数据待核验平台/待核验中 5
Gemini 3.1 Pro Preview

Google / Gemini

通用/待核验暂无数据待核验平台/待核验中 5
GPT-5.4 (xhigh)

OpenAI

通用/待核验暂无数据待核验平台/待核验中 5
Qwen3.7 Max

Qwen / Alibaba

通用/待核验暂无数据待核验开放/混合信号中 5
Kimi K2.6

Kimi / Moonshot AI

通用/待核验暂无数据待核验平台/待核验中 6
MiMo-V2.5-Pro

Xiaomi / MiMo

通用/待核验暂无数据待核验平台/待核验中 5
GPT-5.3 Codex (xhigh)

OpenAI

通用/待核验暂无数据待核验平台/待核验中 5
Grok 4.3 (high)

xAI / Grok

通用/待核验暂无数据待核验平台/待核验中 8
Claude Opus 4.6 (max)

Anthropic / Claude

通用/待核验暂无数据待核验平台/待核验中 5
Muse Spark

Meta / Llama

通用/待核验暂无数据待核验开放/混合信号中 5
Qwen3.6 Max Preview

Qwen / Alibaba

通用/待核验暂无数据待核验开放/混合信号中 7
DeepSeek V4 Pro (Max)

DeepSeek

通用/待核验暂无数据待核验开放/混合信号中 7
GLM-5.1

Z AI / GLM

通用/待核验暂无数据待核验平台/待核验中 10
GPT-5.2 (xhigh)

OpenAI

通用/待核验暂无数据待核验平台/待核验中 5
Muse Spark 1.1

Meta

待核验暂无数据待核验待核验中 0
Qwen3.6 Plus

Qwen / Alibaba

通用/待核验暂无数据待核验开放/混合信号中 5
GLM-5

Z AI / GLM

通用/待核验暂无数据待核验平台/待核验中 5
Claude Opus 4.5

Anthropic / Claude

通用/待核验暂无数据待核验平台/待核验中 5
MiniMax-M2.7

MiniMax

通用/待核验暂无数据待核验平台/待核验中 5
返回顶部