模型版本
GLM-4V-Plus · Qwen2.5-72B
多模态 + 文本 · vLLM 双卡 · 内网隔离
今日调用量
3,847
整体采纳率
54.2%
P95 延迟
2.4s
badcase 待处理
7
场景开关与表现 每场景独立评测,可一键关闭整体降级
审片预检P0
规格合规(规则引擎)+ 质量初筛(多模态)+ 差异高亮 + 意见草稿
1,921今日调用
58%采纳率
2.2sP95
静默校准中(第 9/14 天)· 误报率 1.6%(目标 <2% ✓)
资金异常检测P0
结算环比/六来源占比/疑似重复/离群值 + 提现临界金额
86今日调用
71%核实采纳
1.1sP95
日报 / 周报P0
项目日报推项目群;管理层日报推驾驶舱/邮件/企微
38今日生成
100%自动生成占比
36s均值
排产助手P1
按能效/负载/空档/技能/驳回率推荐人选 + 工期风险提示
42今日建议
62%采纳率
0.8sP95
建议 vs 实际按时率对比回流中
智能问数P1
NL2SQL 安全域(预置语义层)+ 归因解读 + 固化卡片
57今日提问
48%固化/采纳
6.1sP95
意见聚类 · RAG · OCRP1/P2
驳回意见聚类(带教/改进)、知识库问答(附引用)、发票 OCR
1,703今日调用
52%采纳率
1.9sP95
badcase 队列(7)
标注回流 → 补充训练 / prompt 迭代模型升级
Qwen2.5-72B → 2.6-Preview
灰度 10% · golden set 通过率 94%(阈值 92%)· 预计 09-10 全量
GLM-4V-Plus(多模态)
当前稳定 · IoU 人工评测 0.68(≥0.6 ✓)