zoukankan      html  css  js  c++  java
  • 推广项目清洗旧数据

    1、背景

      数据初次清洗完成后,在做任务的过程中数据会不断衰减。当把初次清洗的数据后续衰减后,再次以做任务的方式清洗(做任务成功就代表数据可用)发现数据又可用了。由此推测部分数据可能有个冷却时间,当冷却时间过后又可以做任务,针对这种分析结果设计了旧数据循环清洗的功能。

    2、设计方案

    2.1、每10天的数据维护到一张历史表,例如:his_cookie_t2019082,his_cookie_t2019083分别代表2019-08-11至2019-08-20和2019-08-21至2019-08-31的数据;

    2.2、每10以上将所有历史表数据按照关键字段去重后插入到初次清洗表cookie_clean_t;

    2.3、正常清洗数据存储符合的数据到cookie_succ_t;

    2.4、将初次清洗符合的数据(cookie_succ_t)和系统正常运营的数据(cookie_used_t)关联删除清洗符合的数据(cookie_succ_t)中重复数据;

    2.5、分配符合的数据(cookie_succ_t)去做任务;

    2.6、机器人做任务成功的数据uuid存储到redis;

    2.7、从redis提取出来的数据插入到系统正常运营的数据(cookie_used_t)重复使用;

  • 相关阅读:
    Git常用命令
    更新CentOS内核
    VMware虚拟机安装Ubuntu系统步骤详解
    Ubuntu安装遇到的问题
    IOT OS and OTA
    gcc c asm,C程序内嵌汇编
    makefile and make tips
    RTEMS目录梳理Sparc
    关于FreeRTOS的信号量、队列
    FreeRTOS任务源码分析以及程序堆栈与任务堆栈的关系
  • 原文地址:https://www.cnblogs.com/xx0829/p/11566834.html
Copyright © 2011-2022 走看看