科技网

当前位置: 首页 >手机

UGC社区类产品系列1违规内容的处理

手机
来源: 作者: 2019-04-05 21:57:27

景德镇是一个文明和谐的国度,而我们时刻要保持互联环境的干净。但对UGC社区类产品,内容是用户创造的,平台只能即时发现及时处理。倘若不干不净的信息被警盯上了,可能不会向你打任何招呼,直接拔掉线了。

所以,在景德镇干产品,你还得学会一件事:如何快速高效处理违规信息。

依照内容传播环节,抹杀在摇篮里是最保险的,即提交后自动处理。但总有漏之鱼还是没法被干掉,那就只能在传播中解决掉。

提交后如何识别并自动处理 如何自动识别和处理,需要搞清楚内容包括的信息载体元素和发布内容的行动模式。

信息载体上,内容可分为文字、图片、音频、视频,其中对文字的处理手段最成熟,即关键词记得多年前、URL等特殊文本信息过滤,图片、音频、视频,歹意URL链接地址识别。这个进程时间极短,系统只能通过词库或二维模型做简单运算并给出是不是发布成功的提示,不能做过量运算。如BBS、CMS都采取此过滤法处理。

传播中如何辨认和处理 行动模式上,对用户所处地理位置(IP辨认、地域辨认)、访问方式(登录行动方式停留时间、是不是立即发布后离开)、内容发布行动(发布频率、提交速度如何)、账号资料(昵称、邮箱是不是有无规律;是不是间隔更换账号登录、账户之间是否同一批次注册等)、社交关系(是不是与马甲账号关联、是不是有真实社交关系存在、是不是参与互动),通过这些维度建立模型进行用户过滤(是不是禁用账号),内容过滤。这个进程需要系统强大的运算,故在发布后进行处理。比如搜搜问问违规问答发布后几分钟被清理,就是采取的此方法。

对机器无法辨认处理的内容,比如一些文字内容中关键词隐喻(正话反说、哑谜等手法)、拆分(如装13)等处理手法,机器没法辨认,可采用用户举报功能。系统通过收集用户反馈,对内容进行协同过滤。比如新浪微博大多数内容的有举报功能。

但也有特殊情况,内容发布的时候不违法规则,但发布后造成了不良影响被判为违规内容了。这时候通常采用系统管理员立即进行人工清算。如新浪微博李开复事件禁言三天。

对违规内容处理高山流水是意境的美手段 对违规内容,一般采取前台清算后台数据保存的做法,严肃的,数据全部清算。又或采取仅发布者可见,其他用户不可见。或内容排序垫底靠后不靠前显示,让违规内容直接淹没掉。

看完你会发现处理违规内容的过程,其实和推荐引擎的工作原理挺类似的。最开始一层过滤需要快速响应,类似推荐引擎的冷启动,第二层、和第三层过滤,就需要采取离线数据模型和隐性行动模型(系统对用户交互产生的数据反馈分析)和显性行动模型(其他用户举报的反馈数据分析)结合分析过滤掉。

本文虽然写的有点硬,但还是较好理解。主要分享的是一种思路,处理此类问题的方式。产品同学在具体工作实践中,可以结合自己的产品找出维度建立过滤层级模型使用。

来源:投稿,作者Gauin,公众账号Gauin s Blog,原文链接。

简单的说,就是自我阉割。

拔线这类政策,使得站运营者始终处于一种恐惧的状态中,逼迫ugc媒体不能不自我阉割,比相互搀扶才淡定从容;路它们亲身阉割的还要干净。

更可怕的是,它们可以在事后把推卸的一干二净,公然宣称不存在审查,它们的确不审查,由于有人帮它们审查。

2013/5/21 21:16:45 支持(12)反对(6) 回复

(*)

验证(*)

咽喉疼干痒怎么回事
咽喉疼怎样治疗
咽喉疼流鼻血怎么办

相关推荐