保存成功
订阅成功
保存失败,请重试
提交成功

当成人网站遇上机器学习

¥5会员免费看
村中少年

成人网站在国内属于灰色地带,即使在国外的一些合法的国家对于未成年人群也需要限制访问。因此无论国内外对于此类信息的识别特别重要。

成人网站包含大量的色情信息,目前对于色情信息的研究分为多个方面。有基于图像识别,来判定色情图片,色情视频等,主要应用场景是一些聊天软件中。有基于域名等关键信息过滤的来限制对此类站点的访问,主要应用场景是网络出口处,例如教育网和企业出口。本场 Chat 所阐述的是基于文本分类的方法来识别成人网站,例如有的浏览器会提示你访问的网站包含色情信息,就会用到类似的方法。

本场 Chat 主要包括以下几个方面:

  1. 分析网站哪些信息可以作为识别的语料信息;
  2. 语料信息的获取;
  3. 分词,去停用词形成词向量特征;
  4. 模型的训练识别及分析;
  5. 基于本文所述方法的扩展应用。
196 人已订阅
会员免费看
¥5 原价订阅
微信扫描登录
关注提示×
扫码关注公众号,获得 Chat 最新进展通知!
入群与作者交流×
扫码后回复关键字 入群
Chat·作者交流群
入群码
该二维码永久有效
严选标准
知道了
Chat 状态详情
开始预订
预订结果公布18.08.18

预订达标,作者开始写作

审核未达标,本场 Chat 终止

作者文章审核结果公布18.08.29

审核达标,文章发布

审核未达标,本场 Chat 终止

Chat 完结
×
已购列表