DATA CUT 2026-07-27 116 活跃模型 680 A 类案例

CASE EVIDENCE / A RECORD

Clerveu 使用 Qwen3.5 397B A17B 处理软件工程任务执行

Clerveu 公开的代码代理与软件工程案例,来源为 公开代码库,复核于 2026-06-27T09:36:14Z。

原始记录:Clerveu 用 Qwen3.5-397B-A17B 构建视频转文本分析流水线

A

Chinese Brief

中文案例导读

Clerveu 公开的代码代理与软件工程案例,来源为 公开代码库,复核于 2026-06-27T09:36:14Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。 Model Atlas 不把 benchmark、教程、发布说明或集合页包装成真实案例。

厂商Qwen / Alibaba
模型Qwen3.5 397B A17B
任务类型代码代理与软件工程
审核状态auto_approved

任务

真实任务背景

公开仓库 vidtest 提供一个视频转文本分析流水线:从 Source/ 选择视频,抽取/下载字幕,将视频切成 30 秒、720p、2fps 的片段,通过 OpenRouter 调用 Qwen3.5-397B-A17B vision model 为每个片段生成约 200 词视觉描述,再把字幕和视觉描述合并为带 [DIALOGUE] 与 [VISUAL DESCRIPTION] 的分析文件;配套 vlc_remote.py 支持 VLC 时间戳/截图交互。

代码代理与软件工程公开代码库A 类可核验real_case
公开产物

README 明确写明该项目使用 OpenRouter 的 Qwen3.5-397B-A17B vision model,并列出 7 步 pipeline、输出目录 descriptions/ 与 results/、OPENROUTER_MODEL = qwen/qwen3.5-397b-a17b;仓库中的 analyze.py 也公开包含 OPENROUTER_MODEL 常量、send_to_qwen() 调用和将模型描述写入结果文件的逻辑。

模型作用

Qwen3.5 397B A17B 是该流水线的核心视觉语言模型,负责读取视频片段与匹配字幕并生成结构化视觉描述;OpenRouter 提供 API 路由,项目脚本负责视频切片、字幕处理、结果合并和可选 Claude Code 后处理。

风险边界

证据来自公开 GitHub 仓库 README 与源码自述,未独立验证其实际运行规模或生产部署;但 exact model slug、使用者、任务流程和可访问 artifact 均明确。