查看: 72|回覆: 0

构建多维打标签算法

[複製鏈接]

4

主題

0

回帖

0

積分

热心网友

金币
0
閲讀權限
220
精華
0
威望
0
贡献
0
在線時間
0 小時
註冊時間
2008-8-26
發表於 2025-6-23 15:43:00 | 顯示全部樓層 |閲讀模式

本文分享自天翼云开发者社区《构建多维打标签算法》,作者:石泽涛

针对各类主题,通过对用户DPI访问数据深度解析,体现数据价值,丰富云产品形态与应用范围;建立行业的标签,能够对用户访问各类APP和网站的行为和内容有深入细致的刻画,为主题运营工作提供必要的数据支撑。在获客成本越来越高的当下,围绕用户的价值创造,守住活跃用户的基本盘,促进用户一层一层向更具价值的用户转化。

构建多维打标签算法

规则库搭建

根据爬虫工具与抓包工具提取网站及App特征信息,提取正则表达式形成各类规则库

数据分发与标签收集

将规则库加载到主框架,与dpi中的HOST进行匹配,对该dpi记录进行数据处理与分发,如网站类型、平台名称、开始时间等

汇总入库

将处理后的标签结果数据入库,按月、日进行汇总处理,进行小文件合并,提高存储空间利用率与入库处理效率 

 



来源:https://www.cnblogs.com/developer-tianyiyun/p/18944489
回覆

使用道具 舉報

您需要登錄後才可以回帖 登錄 | 立即注册

本版積分規則

相关侵权、举报、投诉及建议等,请发 E-mail:qiongdian@foxmail.com

Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.

在本版发帖返回顶部