博客
关于我
数据分析面试题二:用户留存
阅读量:728 次
发布时间:2019-03-21

本文共 1541 字,大约阅读时间需要 5 分钟。

数据库优化方案

  • 创建数据库并指定字符集确保数据库在处理中文数据时避免乱码,在创建数据库时就指定存储格式和字符集。
  • CREATE DATABASE camera DEFAULT CHARACTER SET utf8 COLLATE utf8_general_ci;

    1. 创建用户信息表在使用数据库前,需要创建存储用户信息的表,并指定字段的存储类型和字符集。
    2. USE camera; CREATE TABLE act_use_userinfo ( uid VARCHAR(10) NOT NULL, app_name VARCHAR(20) NOT NULL, duration INT(10) NOT NULL, times INT(10) NOT NULL, dayno DATE NOT NULL );

      1. 插入用户数据将用户相关数据插入数据库表中。
      2. INSERT INTO act_use_userinfo (uid, app_name, duration, times, dayno) VALUES ('12345', '相机', 2, 3, '2021-05-18');

        1. 数据分析与报表功能开发
        2. 4.1 某日活跃用户数:某日的去重用户数

          SELECT dayno, COUNT(DISTINCT uid) AS active_users FROM act_use_userinfo WHERE app_name = '相机' GROUP BY dayno;

          4.2 次日留存:使用两表自交,利用case when找到符合相差日期为1天的id,计数,得出次日留存人数,最后用distinct去重

          实现方式一:通过增加临时字段

          可以通过在表中增加一个临时字段 is_next_day,表示是否为次日用户,用于统计留存率。以下是实现方式:

          ALTER TABLE act_use_userinfo ADD COLUMN is_next_day BOOLEAN After duration;

          UPDATE act_use_userinfo SET is_next_day = 1 WHERE dayno = DATE('2021-05-18') + interval '1 day' AND uid IN (SELECT uid FROM act_use_userinfo WHERE app_name = '相机' AND dayno = DATE('2021-05-18'));

          SELECT dayno, COUNT(DISTINCT uid) AS next_day_users FROM act_use_userinfo WHERE app_name = '相机' AND is_next_day = 1 GROUP BY dayno;

          实现方式二:不增加临时字段

          这种方法使用CTE(通用子查询)和ROW_NUMBER函数来计算次日留存人数。

          WITH cte AS ( SELECT ROWNUMBER() OVER (ORDER BY dayno, times DESC) AS row_num, uid, dayno, app_name FROM act_use_userinfo WHERE app_name = '相机' ORDER BY dayno, times )SELECT dayno, COUNT(DISTINCT uid) AS next_day_users FROM cte WHERE row_num > 1 GROUP BY dayno;

          4.3 其他需求(未详细说明)

          根据实际需求继续扩展表结构和查询逻辑,确保所有分析指标能够准确反映业务需求。

    转载地址:http://zhdgz.baihongyu.com/

    你可能感兴趣的文章
    Nginx配置限流,技能拉满!
    查看>>
    Nginx配置静态代理/静态资源映射时root与alias的区别,带前缀映射用alias
    查看>>
    Nginx面试三连问:Nginx如何工作?负载均衡策略有哪些?如何限流?
    查看>>
    nginx:/usr/src/fastdfs-nginx-module/src/common.c:21:25:致命错误:fdfs_define.h:没有那个文件或目录 #include
    查看>>
    Nginx:NginxConfig可视化配置工具安装
    查看>>
    Nginx:现代Web服务器的瑞士军刀 | 文章末尾送典藏书籍
    查看>>
    ngModelController
    查看>>
    ngrok | 内网穿透,支持 HTTPS、国内访问、静态域名
    查看>>
    ngrok内网穿透可以实现资源共享吗?快解析更加简洁
    查看>>
    ngrok内网穿透可以实现资源共享吗?快解析更加简洁
    查看>>
    NHibernate学习[1]
    查看>>
    NHibernate异常:No persister for的解决办法
    查看>>
    Nhibernate的第一个实例
    查看>>
    nid修改oracle11gR2数据库名
    查看>>
    NIFI1.21.0/NIFI1.22.0/NIFI1.24.0/NIFI1.26.0_2024-06-11最新版本安装_采用HTTP方式_搭建集群_实际操作---大数据之Nifi工作笔记0050
    查看>>
    NIFI1.21.0_java.net.SocketException:_Too many open files 打开的文件太多_实际操作---大数据之Nifi工作笔记0051
    查看>>
    NIFI1.21.0_Mysql到Mysql增量CDC同步中_日期类型_以及null数据同步处理补充---大数据之Nifi工作笔记0057
    查看>>
    NIFI1.21.0_Mysql到Mysql增量CDC同步中_补充_插入时如果目标表中已存在该数据则自动改为更新数据_Postgresql_Hbase也适用---大数据之Nifi工作笔记0058
    查看>>
    NIFI1.21.0_Mysql到Mysql增量CDC同步中_补充_更新时如果目标表中不存在记录就改为插入数据_Postgresql_Hbase也适用---大数据之Nifi工作笔记0059
    查看>>
    NIFI1.21.0_NIFI和hadoop蹦了_200G集群磁盘又满了_Jps看不到进程了_Unable to write in /tmp. Aborting----大数据之Nifi工作笔记0052
    查看>>