新资料请前往「蒸馏任务」页上传(上传后先入待蒸馏队列,蒸馏完成自动发布到这里)。
已发布文档支持:预览切块 / 隔离(防污染,隔离后不参与检索)/ 重新蒸馏 / 删除。
| ID | 文档名 | 类型 | 块数 | 状态 | 命中次数 | 蒸馏时间 | 上传时间 | 操作 |
|---|
命中记录
| 时间 | 问题 | 最高分 |
|---|
切块预览
知识库真实行业覆盖(按已发布文档内容计算,非分类规范)
各行业文档数与占比(点击行业展开文档清单)
未覆盖行业(知识库暂无资料,对外不得宣称覆盖)
拖拽文件到这里,或选择:
支持 PDF / Word / PPT / Excel / TXT / Markdown,单文件 ≤50MB;上传后进入「待蒸馏」队列
| ID | 文件名 | 大小 | 状态 | 蒸馏阶段 | 块数 | 上传时间 | 操作 |
|---|
树形展示(一级 → 二级 → 三级),数据源自《行业拆分》底表;点击行业名可编辑,✕ 为停用。
每场景最多展示 2 题给终端用户(按排序取前 2);「打法」题的选项由打法类型库按问题意图动态生成。「复制」可把该题带入新增表单快速变体。
追问「想参考哪类打法」的选项从这里按用户问题意图动态取数:只有「知识库存在」的类型才会成为选项(不虚构),意图相关类型排在首位并展开其子选项。
| 名称 | code | 关联意图 | 验证关键词 | 子选项 | 知识库存在 | 排序 | 操作 |
|---|
两类缺口自动聚合:① 知识库未命中(已兜底作答)的问题(按出现次数排序);② 被点👎的回答。
运营填写标准答案后一键入库,下次同类问题直接命中。
| 类型 | 问题 | 次数 | 最近时间 | 状态 | 标准答案与入库 |
|---|
新 Key(只完整展示这一次,请立即保存):
| ID | 名称 | Key(脱敏) | 调用 | token | 限流(每分/每日/每日token) | 状态 | 创建时间 | 操作 |
|---|
| 时间 | Key | 问题 | 结果 | 反馈 | 耗时 | token | 最高分 | 详情 |
|---|
商业化收入(充值 / 消费 / 发票)
各 Key 消费排行
| 名称 | 归属 | 调用 | token | 消费金额(¥) |
|---|
用户余额一览
| 用户 | 公司 | 余额(¥) | 累计充值(¥) | 累计消费(¥) | 预警线 |
|---|
多模态用量(图像 / 视频)
| 通道 | 模态 | 任务数 | 成本 |
|---|
模型通道分布与路由健康
| 通道 | 调用次数 | 消耗 token | 降级次数 | 成本(按命中通道单价) | 占比 |
|---|
按 API Key 调用排行
| 名称 | 调用次数 | 消耗 token | 拒答次数 | 占比 |
|---|
近 14 天命中率趋势
| 日期 | 调用 | 拒答 | 命中率 |
|---|
通道 Key 加密存储、列表永久脱敏;「自检」发极简请求,模型名失效时自动拉取平台最新可用模型修正。调用按场景路由选择通道,失败自动降级到备选。
| 通道 | 厂商 | 模型名 | 单价(入/出 元/M) | 成本档 | 默认 | 状态 | 自检 | 操作 |
|---|
按用户问题的意图自动选择通道:首选失败时自动降级到备选,再失败走默认通道(DeepSeek 兜底)。
短于 字的简单问题自动分流到低成本通道。改动即时生效。
| 场景 / 意图 | 说明 | 首选通道 | 备选通道 | 操作 |
|---|
| 类型 | 模板名 | 场景 | 语境叠加词 | 默认参数 | 状态 | 操作 |
|---|
配置状态自检
这个系统要正常工作只需要两把钥匙:① DeepSeek Key(负责"动嘴"——理解问题、组织语言生成回答);② 硅基流动 Key(负责"找资料"——把问题和文档都变成向量数字做语义检索,DeepSeek 没有向量接口,必须外接)。填好后点「立即自检」,两个都亮绿灯就能用了。
① 通用大模型:未检测
② Embedding:未检测
① 通用大模型底座(行业大模型的"大脑")
这里填的是通用大模型(如 DeepSeek)的接入信息——它负责生成回答和话术,是你行业大模型的智能底座。去 platform.deepseek.com 申请 API Key。
② Embedding 向量模型(行业大模型的"检索器")
负责把文档切成向量存入知识库,蒸馏入库和提问检索都靠它。注意:DeepSeek 没有向量接口,这里默认用硅基流动 BGE-M3(siliconflow.cn 注册有免费额度)。蒸馏和提问报"Missing credentials"就是这个 Key 没填。
③ 检索与分块参数(一般不用改)
控制知识库怎么切文档、每次取几条、多像才算"答得上"。相似度阈值:低于这个分就拒答(防止胡说),调低回答更敢答、调高更谨慎。
④ 成本估算单价(只是记账用,不是给模型定价)
这里不控制任何调用行为,只是告诉系统"你用的云端 API 多少钱",用于「用量统计」页估算每月大概花多少钱。按你实际采购价填(DeepSeek 官方价:输入约 2 元/百万 token,输出约 8 元/百万 token)。
⑤ 限流与爬库防护(保护知识库不被薅)
给调用方设上限(0=不限);爬库检测:同一 Key 在窗口期内高频提问疑似遍历知识库,自动标记风险,连续触发自动禁用。
⑥ 蒸馏调度(定时自动入库)
开启后,每天到了设定时间就自动把「待蒸馏」队列里的文件全部处理入库。false=关闭(手动点蒸馏),true=开启。
⑦ 系统提示词模板(行业大模型的"人设与红线")
定义它是零售业务专家、能干什么、不能干什么(含知识库保护红线)。不懂就别动,改坏了回答质量会下降。