样本库用整句相似度补足模型漏报:把模型没识别出的整句提交上来,立即生效,无需重新训练。
启用方式:在 config.env 中设置样本库文件路径,然后重启服务。
config.env
NB_SAMPLES=data/samples.json NB_SAMPLE_THRESHOLD=0.75
阈值范围 0~1,越低召回越激进但误报升高;越高越严格但只能匹配几乎逐字相同的文本。
把模型漏报的整句贴进来。检测时用字符 n-gram 相似度召回相似句式,因此样本越接近真实写法效果越好。
暂无命中记录,去「检测」页试试。