Coding Agent 数据生产
围绕真实需求设计 Prompt、验收标准和上下文材料,采集 Agent 规划、执行、工具调用、修复与最终代码产物。
Coding Agent Data Lab
我们提供真实工程任务设计、Agent 执行轨迹采集、代码产物运行验证、多模型横评与专家质检,帮助模型团队获得可信、可追溯、可训练的高质量 Coding 数据。
agent_task.py
Services
围绕真实需求设计 Prompt、验收标准和上下文材料,采集 Agent 规划、执行、工具调用、修复与最终代码产物。
构建可复现工程环境,交付初始快照、任务元数据、模型 Session、Git Diff、Patch 与验证记录。
统一条件下进行多模型横评、代码质量评分、轨迹质量评估、Bad Case 归因和专家反馈生产。
设计 Shell、Docker、数据库、Debug、安全和系统恢复类任务,配套标准解法与自动化验收测试。
Workflow
确认语言、框架、难度、验收指标和数据格式。
准备仓库、依赖、容器、测试和准入检查。
采集模型行为、工具调用、修改过程和最终产物。
运行测试、构建、静态检查、覆盖率与重复检测。
人工复核代码质量、任务完成度、轨迹合理性和数据可用性。
Quality System
每批数据围绕来源、环境、执行、验证、审核和交付记录建立一一对应关系,支持客户进行抽检、回放和二次训练筛选。
Contact
欢迎模型公司、Agent 团队、数据平台和标注公司洽谈 Coding 数据、Agent 评测、真实工程轨迹和专家质检项目。