DATA CUT 2026-07-27 116 活跃模型 680 A 类案例

CASE EVIDENCE / A RECORD

frahlg 使用 GPT-5.5 (xhigh) 处理软件工程任务执行

frahlg 公开的代码代理与软件工程案例,来源为 公开代码库,复核于 2026-06-27T09:14:00Z。

原始记录:Fusion 用 GPT-5.5 xhigh 作为盲审 panelist 生成可审计答案

A

Chinese Brief

中文案例导读

frahlg 公开的代码代理与软件工程案例,来源为 公开代码库,复核于 2026-06-27T09:14:00Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。 Model Atlas 不把 benchmark、教程、发布说明或集合页包装成真实案例。

厂商OpenAI
模型GPT-5.5 (xhigh)
任务类型代码代理与软件工程
审核状态auto_approved

任务

真实任务背景

Fusion 是一个 Claude Code skill,把高风险问题并行发送给多个前沿模型,由 GPT-5.5 (xhigh) 作为其中一个 blind panelist 进行独立推理,再由 Opus 4.8 汇总裁决。

代码代理与软件工程公开代码库A 类可核验real_case
公开产物

公开仓库提供了可安装的 Fusion skill、README 流程图和 assets/fusion-demo.gif 演示,用于输出带 verdict、consensus、contradictions、blind spots 与 audit trail 的最终答案。

模型作用

GPT-5.5 (xhigh) 在 panel 阶段提供独立推理路径和候选答案,贡献多模型分歧与互证信号,帮助最终答案避免单模型盲区。

风险边界

证据来自项目 README;它说明模型在工具中的设计用途和演示产物,但不提供生产使用指标。