哪种AI无过滤,你自己怎么判断
AI聊天里的过滤不是一个开关,而是最多3层:对问题的检查、模型自身的训练、对回答的检查。自称'无过滤'的服务通常去掉第一层和最后一层。用3个普通问题做一个简短测试,就能看出某个聊天还留着哪些层。
'哪种AI无过滤'这样的搜索期待一个名字。一个名字帮不上太多忙,因为2款打着同样说法的服务可能去掉的是不同的部分。更有用的是知道这些部分是什么,以及从外部怎么看出来。
3层,不是1个开关
第一层在模型读到问题之前先检查它,可以用一句现成的回复直接拦下。第二层是模型本身:它在训练期间学会了拒绝某些请求,这一点留在模型内部。第三层检查生成好的回答,可以把它截断或替换。一个聊天可以去掉其中任意一层,同时保留其他层。
'无过滤'通常去掉的是什么
大多数打着这个标签的服务去掉的是问题检查和回答检查,并且在写隐藏指令时不再格外谨慎。训练这一层更难去掉:需要一个重新训练过或搭建方式不同的模型。所以'无过滤'通常意味着少了2层,而不是0层。这是一个真实的区别,也是这些聊天仍然会拒绝一些内容的原因。
一个3个问题的测试
问3个大型助手常会软化处理的合法问题:关于一种常见药物副作用的直白问题、要求写一段犯罪故事里的黑暗场景、对一件劣质产品的尖锐评价。留意每个回答出现的方式。立即出现却什么都没说的回答指向问题检查。开始生成又随后消失的回答指向回答检查。给出了回答但每一句都在加限定词的回答指向模型的训练。
开源模型处于什么位置
你下载下来在自己电脑上运行的模型,你和它之间没有服务这一环,所以第一层和第三层根本不存在。剩下的就是它的训练。代价是实际操作层面的:你需要有足够内存的硬件,需要一些搭建时间,而且只能获得那个模型本身具备的知识量。
到处都存在的那条界线
有一条界线不取决于任何层或任何标签:将未成年人性化的内容,会被每一个值得使用的服务拒绝,包括那些去掉了其他一切的服务。这不是一项更好的服务可以关掉的过滤设置,一个不拒绝这类内容的聊天工具也不是什么值得推荐的发现。
输入之前
有没有AI是完全无过滤的?
在公开的聊天服务中没有。最接近的情况是在自己电脑上运行的开源模型,它没有服务层,但训练仍然塑造着它写出的内容。
为什么无过滤聊天仍然会拒绝某些内容?
因为被去掉的是问题检查和回答检查这两层,不是模型的训练。一个不管你怎么换说法提问都始终存在的拒绝,通常来自训练。
使用无过滤AI合法吗?
在大多数地方,使用过滤更少的聊天工具是合法的。你问了什么、拿答案做了什么,适用的法律和其他任何地方一样。
在这里运行这个3个问题的测试,看看每个回答是怎么出现的。
打开无过滤聊天