非法内容拦截措施

拓辉大模型在调用题库或大模型接口之前,先对用户输入进行关键词拦截。命中违法违规内容后立即拒绝服务,不生成相关回答。

拦截时机

用户提交问题后,系统按以下顺序处理:

  • 关键词拦截
  • 备案题库匹配
  • 大模型接口调用

命中关键词时,后两步均不会执行。

拦截范围

词库覆盖以下类别:

  • A.1 违反社会主义核心价值观
  • A.2 歧视性内容
  • A.3 商业违法违规
  • A.4 侵犯他人合法权益
  • A.5 不准确不可靠

匹配与处置

  • 统一大小写、全角半角、空白和常见标点后再匹配
  • 避免简单插入空格或标点绕过
  • 命中后直接返回拒绝提示
  • 不调用题库,不调用大模型

拦截效果验证

以下为系统实时运行测试。提交后将调用当前服务的拦截接口,用于核验非法内容是否被拦截。

到对话页查看拦截结果