AI / RAG 运行状态
租户概况 今日调用为实时计数
一张图看懂中台:左=数据从哪来(进) / 中=中台存什么、加工什么 / 右=数据抛给谁(出)。数字为实时库内统计。
租户接入全景 已接入本中台的业务系统,实时统计;卡片上可直接操作
开关为热切换:改动即时生效;服务重启后回落到环境变量默认值。要永久固化请改部署模板(deploy/remote-provision.sh)后发版。
租户数据隔离档位 不隔离=回滚保命 / 仅记日志=灰度观察 / 严格拦截=目标档
功能开关
| 功能 | 状态 | 说明 |
|---|---|---|
| RAG 语义检索(知识库按「意思」搜) | 关闭后检索自动回退关键词,零风险 | |
| 话术提炼定时任务(每天 03:00 一轮) | 单轮一次大模型调用;手动触发在「业务知识库」页 | |
| 会话语料全量消化(仅夜间 22:00–08:00,每 5 分钟一批) | 会持续大量调用大模型——每通会话一次,用量是日常业务的几百倍。 开之前先确认 API Key 的计费方式与调用条款允许后端批量调用。跑完会自动停下 |
全量消化进度:加载中…
连续跑:未启动
只在夜间 22:00–08:00 跑(百炼夜间调用 5 折):白天定时器和「一直跑」都自动歇着,22:00 自动接着跑,不用人点(服务重启/发版后「一直跑」会失效,只剩定时器慢速跑,需要重新点一次)。
「一直跑」= 一批跑完立刻接下一批,不再等 5 分钟(每批条数与并发不变)。
下方「本轮预算」填了百分比,用完会自动停下并写明原因;
填 0(不限量)则没有任何额度闸,它会一直跑到语料全部跑完为止。
「暂停」= 当前这批跑完就停,并把上面的定时开关一起关掉;
自动停下时开关会恢复成你点「一直跑」之前的样子。
额度预算
按套餐额度的百分比控制跑批规模,改完即时生效
Credits
%
加载中…
百炼控制台当前显示已用
%
预算百分比填 0 = 不限量跑(唯一的额度闸就是这里,原来那个写死条数的上限已去掉)。
「重置本轮」对应百炼额度到点刷新(如 7 天限额重置)——不点它,额度回来了闸门仍按历史累计判死。
校准怎么用:跑一段之后,把百炼控制台上那个「已用百分比」抄进上面的框点「用它校准」, 系统会用「这期间涨了多少 ÷ 这期间跑了多少通」自己算出每通消耗,之后就准了。 没校准过时用的是保守估值,界面上会明写「未校准」——那是估的,不是实测的。
校准怎么用:跑一段之后,把百炼控制台上那个「已用百分比」抄进上面的框点「用它校准」, 系统会用「这期间涨了多少 ÷ 这期间跑了多少通」自己算出每通消耗,之后就准了。 没校准过时用的是保守估值,界面上会明写「未校准」——那是估的,不是实测的。
Python AI 服务 只读;改 LLM / 向量模型走环境变量后重启
能力默认策略:数据查询类开放、挖掘 / AI 关闭(消耗算力与大模型费用的能力需显式开通)
按风险分档
先批量清掉没风险的,把人的时间留给真正要看的那几十条
待审列表
所有数值改库即时生效(评分 / 推荐每次计算都读配置),不用发版。改完请点「保存全部」。
语料入库时按这份词典自动打标。命中判定顺序:排除词命中即整条不打 →
统计命中词出现次数 → 达到命中下限才打上。限定说话人后只在那一方的发言里找。
一条语料最多打 5 个标签。改动即时生效,不用发版。
手机号在浏览器本地转成 OneID 后再查询,明文不出本机、不上送服务端。
租户开放通道(/platform/api/v1/**)的逐条调用记录,是计费口径的数据源。
控制台账号独立于 CRM 员工账号,仅授权管理人员可登录。所有操作记入调用审计。