7000+
已知盗版站与镜像 · 定向巡扫
你睡觉的时候,盗版站不休息。对抗它的合理形态,是系统做重复劳动、人做关键判断:AI 负责扫描、聚类、分类,人负责确认权属、批准每一封函。这页讲清楚这类系统由什么组成,以及我们怎么实现。
这条分工线画在哪里,决定一套系统是工具还是隐患。
这类系统的检测核心,是把你的艺名、别名与作品名组成关键词,在已知盗版站、搜索引擎与网盘面持续检索;命中结果做聚类去重(同一份内容常以几十个镜像链接出现),再按特征分类判定。拿不准的一律标「疑似」等人裁决——我们不宣称人脸识别或内容指纹的魔法,那不是这套系统真实的工作方式。
「这是不是你的原创、有没有授权过、算不算二创」,机器判不了,§512(f) 也不允许它替你担责。所以每一封 DMCA 通知都停在审核队列,由你批准后才发出——自动化止步于按下发送之前。
下架删的是链接,不是文件。系统的价值在于把这套循环长期跑下去。
关键词组合持续巡扫已知盗版站、搜索引擎与网盘面,命中即记录证据,发函当刻冻结快照与时间戳。
几十个镜像链接归并成一件事;按特征分类,标注疑似程度,可疑的等你裁决。
确认是你的、没授权过,点批准——系统按 §512 要件生成的通知才对外递交。
追踪下架状态;内容重新冒头时自动生成新通知,再进你的队列,循环继续。