保存成功
保存失败,请重试
提交成功

当成人网站遇上机器学习

作者/分享人:村中少年
网络协议工程师,计科本硕,热爱技术,CSDN博客专家。

成人网站在国内属于灰色地带,即使在国外的一些合法的国家对于未成年人群也需要限制访问。因此无论国内外对于此类信息的识别特别重要。

成人网站包含大量的色情信息,目前对于色情信息的研究分为多个方面。有基于图像识别,来判定色情图片,色情视频等,主要应用场景是一些聊天软件中。有基于域名等关键信息过滤的来限制对此类站点的访问,主要应用场景是网络出口处,例如教育网和企业出口。本场 Chat 所阐述的是基于文本分类的方法来识别成人网站,例如有的浏览器会提示你访问的网站包含色情信息,就会用到类似的方法。

本场 Chat 主要包括以下几个方面:

  1. 分析网站哪些信息可以作为识别的语料信息;
  2. 语料信息的获取;
  3. 分词,去停用词形成词向量特征;
  4. 模型的训练识别及分析;
  5. 基于本文所述方法的扩展应用。
已有194人预订
预订达标
文章出炉
     
18.08.15
18.08.29
本场 Chat 文章已出炉,购买后即可阅读文章并获得一张村中少年的读者圈Pass
请务必添加GitChat服务号以查看活动进度及获取活动通知。
你可能还喜欢
看完这篇 HTTP,跟面试官扯皮就没问题了
cxuan
肺炎模型分析和预测,向每⼀位在疾病中奋⽃的⼈致敬! ​
飞马网
求你别再花大价钱学 Python 之爬虫实战
周勤
Linux 面试题目大全(100 题)
Lisa
GitChat 写作排版指南
🐡赵小胖
热门安全框架 Spring Securiy + JWT 精讲
九月长安
千万别让工资收入成为你唯一的收入来源
ilomilo
跟我 1+1 学设计模式
一只帅帅的猿
Spring 面试题全面解析
JavaTimo
gRPC 数据流转全过程剖析
DIU哥
MySQL-InnoDB 存储引擎的索引、锁机制与事务隔离
杜戈
Java 基于 RBAC 权限控制模型入门
程序猿
2020 年 2 月 JVM 面试的 30 个知识点
JavaTimo
认证和授权中不得不提及的 OAuth、SSO、CAS、JWT
长烟斗火枪红帽子鹿皮鞋
Vue 零基础从入门到实战教程
a_靖
微信扫描登录
关注提示×
扫码关注公众号,获得 Chat 最新进展通知!
入群与作者交流×
扫码后回复关键字 入群
Chat·作者交流群
入群码
该二维码永久有效