DATA CUT 2026-07-27 116 活跃模型 680 A 类案例

CASE EVIDENCE / A RECORD

swift-innovate 使用 Grok 4.20 0309 v2 处理代码审查和测试生成

swift-innovate 公开的代码审查与测试案例,来源为 公开代码库,复核于 2026-06-27T10:28:54Z。

原始记录:swift-innovate 的 GOLEM 使用 Grok 4.20 0309 Reasoning 作为自改进 LangGraph Agent 主脑

A

Chinese Brief

中文案例导读

swift-innovate 公开的代码审查与测试案例,来源为 公开代码库,复核于 2026-06-27T10:28:54Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。 Model Atlas 不把 benchmark、教程、发布说明或集合页包装成真实案例。

厂商xAI / Grok
模型Grok 4.20 0309 v2
任务类型代码审查与测试
审核状态auto_approved

任务

真实任务背景

GOLEM 是一个基于 LangGraph 的自改进 Python Agent;项目文档说明它以 Grok 4.20 作为 primary brain,llm/grok.py 将 code_gen、code_review、self_improve、planning、reasoning 等任务路由到 grok-4.20-0309-reasoning,并配置自动 fallback。

代码审查与测试公开代码库A 类可核验real_case
公开产物

公开仓库包含可运行的 Agent 状态机、LLM 路由、预算、测试和自改进流程代码;Grok 路由模块通过 xAI OpenAI-compatible API 调用指定模型,为 Agent 的规划、代码生成、代码审查和自改进步骤提供输出。

模型作用

Grok 4.20 0309 Reasoning 被作为高强度推理与代码任务的主模型,负责 GOLEM Agent 的规划、推理、代码生成、代码审查和自改进决策。

风险边界

证据代码直接指定 grok-4.20-0309-reasoning;这是公开开源项目级使用证据,未独立验证外部生产流量或长期运行规模。