非法内容拦截措施
拓辉大模型在调用题库或大模型接口之前,先对用户输入进行关键词拦截。命中违法违规内容后立即拒绝服务,不生成相关回答。
拦截时机
用户提交问题后,系统按以下顺序处理:
- 关键词拦截
- 备案题库匹配
- 大模型接口调用
命中关键词时,后两步均不会执行。
拦截范围
词库覆盖以下类别:
- A.1 违反社会主义核心价值观
- A.2 歧视性内容
- A.3 商业违法违规
- A.4 侵犯他人合法权益
- A.5 不准确不可靠
匹配与处置
- 统一大小写、全角半角、空白和常见标点后再匹配
- 避免简单插入空格或标点绕过
- 命中后直接返回拒绝提示
- 不调用题库,不调用大模型
拦截效果验证
以下为系统实时运行测试。提交后将调用当前服务的拦截接口,用于核验非法内容是否被拦截。
拦截结果
- 是否拦截
- -
- 是否调用大模型
- -
- 拦截类别
- -