Release 1.1 三章验证
当前 MVP 仅支持长沙五一商圈验证项目;不会在其他项目上误触发固定样本验证。
生成任务记录
TASK-202606131336002026-06-13 13:36:00
已完成
v001
输入版本:无
AI用量:329,704 tokens
输出:v001
要求:真实失败项目回归测试 regression-20260613-130159-20260613133600:必须重新调用模型生成,不读取旧生成成果;按当前质量治理规则生成可投标水平技...
查看完整详情
生成要求:
真实失败项目回归测试 regression-20260613-130159-20260613133600:必须重新调用模型生成,不读取旧生成成果;按当前质量治理规则生成可投标水平技术标,质量下限以既有425页高分长版的信息密度、图表表格、检查表和暗标检查为最低门槛;本轮重点验证JSON修复、逐章生成、断点失败不整体失败、去重治理、Prompt残留清理、项目化图表和Word组装。
系统固定质量下限:quality_benchmark 只作为技术标深度、密度、图表和检查表完整度的最低门槛,不作为当前项目参考对象;进入质量治理模式后停止继续扩页,允许页数下降但每千字新增信息量必须提高;必须结合本项目招标文件、清单、图纸和现场资料重写,补齐项目化专项方案、网络计划、施工总平面、资源曲线、检查表、极端场景预案和暗标检查;禁止重复展开评分响应定位、项目边界复核、施工组织路径、资源投入校核、工艺流程控制、质量验收闭环、安全风险管控、环保文明约束、进度偏差纠偏、资料同步归档、暗标识别清理、极端场景预案等通用内容。
TASK-202606111654362026-06-11 16:54:36
生成失败
当前中转分组资源、模型返回质量或大模型配置不足,已停止正式技术标生成;请切换高倍率密钥、补充模型配置或稍后重试。 失败原因:gpt-5.5:The read operation timed out
输入版本:无
AI用量:—
输出:无
要求:根据已确认资料生成技术标新版本
系统固定质量下限:quality_benchmark 只作为技术标深度、密度、图表和检查表完整度的最低门槛,不作为当前项目参考对象;WPS实际页数目...
查看完整详情
生成要求:
根据已确认资料生成技术标新版本
系统固定质量下限:quality_benchmark 只作为技术标深度、密度、图表和检查表完整度的最低门槛,不作为当前项目参考对象;WPS实际页数目标不低于425页,字数目标不低于315827字;必须结合本项目招标文件、清单、图纸和现场资料重写,补齐专项方案、网络计划、施工总平面、资源曲线、检查表、极端场景预案和暗标检查。