2作者: A5omic4 个月前原帖
我正在构建一个代理,以从大型语言模型(LLM)API调用中去除个人身份信息(PII),并意识到零宽度Unicode字符几乎会破坏所有的PII过滤器。如果你在名字中插入一个零宽度空格,比如“T om”,Presidio的命名实体识别(NER)模型就不再将其视为一个名字。社会安全号码(SSN)和电话号码在正则表达式下也是如此。因此,我构建了一个规范化层,在进行检测之前去除这些内容。 这个代理本身相当简单。你只需将你的OpenAI基础URL更改为指向Veil,它会在请求发送之前对PII进行屏蔽,然后在响应中将真实值放回。它也支持流式处理,这实际上是比较困难的部分。 <a href="https://veil-api.com" rel="nofollow">https://veil-api.com</a>,免费套餐为每月100次请求。
1作者: OdinSpecc4 个月前原帖
好奇团队在成长过程中如何处理系统集成,并开始依赖多个系统。<p>在什么时刻,这成为了你们真正的问题?<p>你们是通过内部工具、外部平台,还是其他方式来解决这个问题的?