• ​前言 使用 Docker 官方clickhouse-server:24.3.2.23承载 Webfunny 埋点 / APM 大数据业务,接连踩中 3 类生产级故障:容器启动直接退出、Node 后端镜像版本兼容报错、UPDATE 更新长时间不生效。本文完整记录全套故障根因、可直接复制落地的修复步骤,覆盖 Docker 镜像、ZK 集群、MergeTree 线程池、Mutation 异步机制全维度优化,运维 Webfunny 埋点、ClickH
  •     作为产品经理,每天都在和转化与流失打交道。漏斗分析不是简单画一张图,而是一套可落地、可迭代、可驱动业务增长的分析框架。本文从原理、指标、搭建、诊断、优化到避坑,完整讲透漏斗分析在产品工作中的实战用法,帮你快速定位问题、输出可执行方案。 1. 漏斗分析到底是什么 漏斗分析是按业务流程拆解用户路径,量化每一步的转化与流失,找到最关键卡点的分析模型。它的核心价值: 把模糊的 “用户流失” 变成可量化、可定位
    • 6天前
  • ​ 在ClickHouse生产运维中,绝大多数团队都会遇到同一个痛点:每日全量备份体积大、耗时长、占用大量带宽和存储资源。 ClickHouse作为列式存储数据库,数据量动辄几十GB、上百GB,如果长期执行每日全量备份,不仅备份耗时长达数十分钟,远程存储成本也会持续堆积,造成资源严重浪费。 针对这个问题,最佳解决方案就是基于基准全量的增量备份策略。本文给大家分享一套生产可用、零级联风险、自带清理+告警+定时任务的 clickhouse-back
  • ​  做Web开发、日志分析、风控拦截、用户运营的开发者,大概率都踩过 User-Agent解析 的坑! 看似简单的一串UA字符串,藏着无数难题:杂乱无章的字符难以识别设备、主流爬虫伪装真实用户无法甄别、开源库识别率低、小众设备直接返回「未知」、系统版本匹配错乱…… 市面上多数通用UA解析库,要么规则老旧长期不更新,要么识别维度单一,无法适配国内海量机型、小众系统以及各类爬虫伪装场景,导致日志数据失真、风控误判、用户画像偏差、适配逻辑
  • 在数字化运营中,提升用户转化率是企业增长的核心目标。传统漏斗分析通过追踪用户从进入流程到完成目标的关键步骤,识别转化率瓶颈;而用户路径分析则深入挖掘用户在每一步的具体行为轨迹。当两者结合应用时,不仅能定位转化流失环节,还能揭示用户“为何流失”,为精准优化提供数据支撑。本文以某电商平台优化购物转化率为例,阐述如何通过漏斗分析与用户路径分析的双向结合,实现转化率显著提升。 一、明确核心转化路径,构建基础漏斗模型 首先,该电商平台明确了用户从“浏览商
    • 21天前
  • ​ ClickHouse 自动 Merge 完整详解(MergeTree 引擎核心机制) 一、什么是自动 Merge MergeTree 系列引擎(包含 ReplacingMergeTree/AggregatingMergeTree)写入数据时不会直接合并分区内数据,每次 INSERT 都会生成独立小数据块(part); ClickHouse 后台有自动合并后台线程,定时把多个小 part 合并成大 part,实现: 减少文件数量,降低磁盘
  • 前言 在用户行为分析、埋点平台、人群分群、UV统计等业务场景中,我们经常需要存储整个人群包的用户ID列表,用于后续人群圈选、人群交集/并集计算、留存分析、报表复盘。 绝大多数业务初期都会直接使用 Array(String) 存储用户UUID,开发简单、上手零成本,但随着分群数量上涨、单分群用户体量突破十万/百万级别,会暴露出致命问题:存储空间爆炸、ARRAY JOIN查询缓慢、人群运算SQL极其复杂。 本文基于真实业务数据,横向对比 Array
  • 容器内执行clickhouse-backup的完整方案 适用环境 Docker单机部署ClickHouse Webfunny埋点日志库(分表多、分区多、ReplacingMergeTree引擎为主) 备份工具:clickhouse-backup(远程SFTP异地备份+本地备份双兜底) 配套能力:定时自动备份、备份过期自动清理、企业微信备份结果告警 关键避坑点 路径映射问题 宿主机执行备份恢复会因路径不一致失败,所有操作必须在容器内执行 权
  • 用户分析报告是产品团队最熟悉的"熟悉的陌生人"。每一轮迭代启动前,用研团队会交出一份结构工整、图表丰富、结论清晰的分析报告;产品经理在评审会上翻阅一遍,点头认可;设计师从中提取几个关键洞察贴进设计稿的理由说明里。然后,迭代继续向前滚动,那份报告被收进共享文件夹,很少有人再打开。 这个场景几乎发生在每一家有用户研究能力的产品团队里。问题不在报告的"有没有",而在结论的"能不能用"。一份报告包含的用户数据越多,往往离工程师的行动清单越远;结论越追求
    • 1月前
  • 通用说明 统一测试表:biz_data 时间字段:dt(日期时间类型) 统计指标:行数 cnt、金额求和 sum_amt 分组维度:分钟、小时、天、周、月、年,附带排序; 周统计附带说明周起始规则差异。 一、MySQL(5.7 / 8.0) 1. 按分钟(yyyy-MM-dd HH:mm) sql SELECT DATE_FORMAT(dt, '%Y-%m-%d %H:%i') AS stat_min, COUNT(*) AS cnt, SU