即刻App年轻人的同好社区
下载
App内打开
奕辛
25天前
最近在做一些文化类主题的研究,这个研究里面会涉及到一些古文化、如家谱;

在研究过程中必然会用到AI,但是非常高频率的相关任务会被中断;

一开始我以为是系统不稳定,任务过长,上下文超长等导致的中断;

后来屡次出现这种情况,且重新执行仍然不能成功执行,然后就仔细研究其执行过程及输出,最终发现在执行过程中会涉及到一些检索,检索到的一些内容包含一些敏感词;

因为这种历史、文化类的知识跨度很大,比如有不少20多年前发布在帖子、论坛中的内容,那个时候的审核可能没那么严格,或者那时主要是人工审,尺度会比较松;里面很正常的会出现xx时代、破四旧时期等导致祠堂毁坏、家谱丢失等(我能打出来的是现今可以过审的词语);

这些内容被检索到之后,在AI执行的过程中作为检索见过进一步加工的时候,触发了AI的安全机制,然后直接就被按死;

其实把内容扒出来看,其实从审核角度来看,并非完全属于高敏,很多内容仅客观描述,这里可能有两个原因:
1、在AI发展的初期,相应的服务提供方在内容审核层面执行较为严格,在监管之下,可能直接按照最严的水位来执行
2、当前AI服务提供方在内容安全层面的策略、能力相对比较简单、粗暴,远未达到精细化的程度,比如简单的以关键词等形式来防控,在一定程度上导致误拦截过多。
11

来自圈子

圈子图片

AI探索站

116795人已经加入