DATA CUT 2026-07-27 116 活跃模型 680 A 类案例

CASE EVIDENCE / A RECORD

Bondartsov 使用 Grok 4.20 0309 处理代码审查和测试生成

Bondartsov 公开的代码审查与测试案例,来源为 公开代码库,复核于 2026-06-27T10:26:24Z。

原始记录:Bondartsov 的 grok-critic-mcp 用 Grok 4.20 Multi-Agent 做代码审查、架构分析和安全审计

A

Chinese Brief

中文案例导读

Bondartsov 公开的代码审查与测试案例,来源为 公开代码库,复核于 2026-06-27T10:26:24Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。 Model Atlas 不把 benchmark、教程、发布说明或集合页包装成真实案例。

厂商xAI / Grok
模型Grok 4.20 0309
任务类型代码审查与测试
审核状态auto_approved

任务

真实任务背景

grok-critic-mcp 是公开 MCP 服务器,README 明确说明它通过 Polza.AI / Responses API 调用 xAI 的 grok-4.20-multi-agent,为 AI 编程代理提供 critic_review、architecture_review、security_audit、critic_followup、health/config/restart 等工具,并支持 4/16 agents 的 reasoning effort 映射。

代码审查与测试公开代码库A 类可核验real_case
公开产物

仓库提供可安装 Python 包、FastMCP server、配置、技能文档和测试;用户可把它接入 Kilo Code、Cursor、Claude Code 等客户端,对代码片段或文件执行深度代码审查、架构评审和安全审计,并返回带模型、agents、effort 元数据的审查结果。

模型作用

Grok 4.20 Multi-Agent 作为 MCP 服务背后的审查模型,使用多 reasoning agents 并行分析代码、架构和安全风险,再形成共识式批评与改进建议,是该工具的核心判断与生成能力来源。

风险边界

证据明确写 grok-4.20-multi-agent / x-ai/grok-4.20-multi-agent;未在仓库标题中写 0309 后缀,但可绑定到 Grok 4.20 0309 multi-agent 家族。公开仓库可访问,属于具体工具产物而非教程、benchmark 或综述。