多轮对话
记得住上下文,跟得上话题的切换;上一轮说过的话不会被硬塞进这一轮, 也不会聊到第三句就忘了第一句。
上下文 · 连续追问取什么名字,等于先声明这个产品打算怎么做。名字不是装饰。
「问知」两个字取自《论语·公冶长》:「敏而好学,不耻下问。」 前半句讲态度,后半句讲方法——不因为对方不如自己,就羞于开口。
放在模型上有两层意思。对外,它必须肯回答一个被认真提出的问题, 不因为问题简单就敷衍。对内,不知道的时候要说不确定, 而不是用一段流畅的话把空白填满。
「问」和「知」本来是一件事的两端:会问,才会知;肯承认无知,才有可能学到东西。 这就是我们给一个聊天机器人取这个名字的原因。
敏而好学,不耻下问。
能问,也能答;拿不准的时候,说拿不准。
我们不打算让问知什么都会。这四件事做到能用,比多加十项功能更值得。
记得住上下文,跟得上话题的切换;上一轮说过的话不会被硬塞进这一轮, 也不会聊到第三句就忘了第一句。
上下文 · 连续追问面向事实性问题给出短而准的回答。答不出的时候直接说答不出, 不用一段听起来很像那么回事的话糊过去。
短 · 准 · 有边界目标是在消费级设备上跑起来:体积小、响应快、不依赖昂贵的算力。 能被装进产品里,才谈得上被用上。
小 · 快 · 省同一底座按场景分层,针对专有语料、行业术语与固定话术做适配。 定制的是用法,不是把模型重新讲一遍道理。
同一底座 · 多个规格不展示惊天动地的能力,只展示日常的准确:问一个词,答清楚,不多说。
示意图,非真实对话记录。
这条对话想说明的是回答的形状:先给结论,再给区别,不补充无关的背景。
问知被设计成宁可短一点,也不堆字。一段话里如果有三句可以直接删掉, 那就是三句不该说的话。
规格越往上,能处理的问题越长、越难;越往下,越适合常驻在设备里。
| 规格 | 定位 | 典型场景 | 参数规模 | 状态 |
|---|---|---|---|---|
| 微型 MINI | 体积与响应速度优先 | 单机助手、离线问答 | 待公布 | 已发布 · 持续迭代 |
| 标准 STANDARD | 通用对话与知识问答 | 桌面助手、内网知识问答 | 待公布 | 已发布 · 持续迭代 |
| 增强 PLUS | 更长上下文、更难的问题 | 文档研读、专业领域问答 | 待公布 | 已发布 · 持续迭代 |
| 定制 CUSTOM | 按场景适配术语与话术 | 垂直领域问答、专有语料场景 | 待公布 | 待公布 |
表中规格命名与可用状态以官方说明为准,参数规模待正式公布后补齐。
对话和问答看起来简单,难的是稳定:同样的问题问十次,答案不该有十种。
告诉我们你的场景、数据形态和部署条件,我们会说清楚问知能做到哪一步, 以及哪一步现在做不到。