- 博客(11)
- 收藏
- 关注
原创 助睿实验七:自媒体运营分析——数据清洗与预处理、作品特征构建、可视化探索
实验摘要 本实验基于全班同学在多平台发布的实验作品数据,完成了从数据预处理到可视化分析的全流程实践。实验分为三个模块: 数据清洗与预处理:针对原始数据中的平台冗余、无效记录和缺失值问题,采用"分支处理"策略,同步生成全平台概况表和重点平台(B站/CSDN)分析表,为后续分析奠定基础。 特征工程:构建了两类关键特征:综合互动指标(点赞+收藏+分享+投币)和5个标题关键词标志位(如"保姆级""实战"等),通过关键词维度分析揭示了标题特征对互动量的影响。 可视化分析:基于"先总后分"原则设计交互式仪表盘,通过指标
2026-07-10 10:09:46
329
原创 助睿实验作业5-3:浏览器市场分析-大屏数据接入
本实验基于助睿Max蓝图编辑器,将MySQL数据库中的浏览器市场分析数据动态接入数据大屏。实验分步骤配置了9个图表组件的数据源,包括:1)通过SQL请求节点查询6张数据表;2)使用并行数据处理节点分发查询结果;3)将处理后的数据绑定到对应图表。关键操作包括创建数据库连接、编写SQL查询、配置数据映射关系,最终实现包含柱状图、折线图、饼图等8类图表的数据可视化大屏。通过本实验,学生掌握了使用蓝图编辑器实现数据动态展示的全流程方法。
2026-06-14 23:52:46
273
原创 编译原理 · Flex & Bison 入门到实战教学
本文是一篇关于编译原理中Flex和Bison工具的实战教学文章,主要面向已学习过编译原理理论、希望动手实践的读者。文章分为五个部分: 整体概述:介绍编译器工作流程中词法分析(Flex实现)和语法分析(Bison实现)的作用及工具关系。 Flex词法分析器详解: 讲解Flex文件的三大结构(定义段、规则段、用户代码段) 核心正则表达式语法和内置变量 提供简单Token识别、关键字与标识符区分等实例 Bison语法分析器详解: 说明Bison文件结构 解释终结符/非终结符/产生式 包含四则运算和变量赋值等进阶实
2026-06-14 21:13:38
511
原创 助睿实验作业5-2:浏览器市场分析-大屏静态布局制作
复制3个“总使用时长”组,分别重命名为“人均使用时长”、“活跃用户占比”、“重度用户占比”,其中“活跃用户占比”、“重度用户占比”两个组中的图标背景图链接更改为:https://gzu-edu-quality-max-studio.oss-cn-chengdu.aliyuncs.com/library-data/degree-thesis.png。复制上一小节制作的“使用频率分布”组,重命名为“浏览器使用数量分布”,参考以上的实验,调整位置、标题共并换图表类型为“基本饼图”
2026-06-11 21:07:18
243
原创 助睿实验作业5-1:浏览器市场与用户画像分析-数据加工(2)
分组字段为browser_name、week_range,聚合时对user_id进行去重计数,得到active_user_count,因此,聚合配置中输入字段“active_user_count”,subject 为“user_id”,类型为“统计不同值的数量(N)”360chrome.exe;我们先拖拽2个“排序记录”组件到画布中,分别创建“表输入”组件到“排序记录 1”组件的连线、“CSV文件输入”组件到“排序记录”组件的连线,其中“CSV文件输入”组件到“排序记录”组件的连线类型选择“主输出步骤”
2026-06-11 21:06:15
195
原创 助睿实验作业4:浏览器市场与用户画像分析-数据加工(1)
实验摘要 本实验基于互联网用户行为日志(半结构化TXT数据),通过助睿ETL平台完成数据清洗与结构化转换。实验重点包括: 数据解析:使用Java代码拆分日志字段,提取用户ID、进程名、URL等关键信息,构建结构化明细表(800万+条记录)。 分析方向:通过聚合统计发现浏览器类进程(如chrome.exe)用户覆盖率最高,确定其为分析核心。 指标加工: 计算窗口停留时长,生成用户-浏览器-小时粒度的基础表; 衍生浏览器市场格局表(用户数、总时长)和时段活跃表(按小时统计用户量)。 工具应用:全程采用零代码ET
2026-06-04 20:16:42
204
原创 助睿实验作业3:用户画像-学生考勤画像可视化分析
本文基于K-Means聚类结果,对"纪律高危型"学生群体进行专项画像分析。实验通过助睿数据科学平台,利用学生考勤主题标签表数据,构建了包含421名高危学生的分析样本。研究发现:该群体呈现明显的性别差异(男生占比54.22%)、年级聚集(高三占62%)、校区分布(老校区占93%)和班级集中(如高三09班38人)特征。分析表明,男生规则意识薄弱、高年级学业压力、老校区管理环境等因素共同导致违纪行为高发。建议采取针对性干预措施,包括加强男生纪律教育、优化老校区管理、整治重点班级等,为校园精细化
2026-05-28 17:57:12
485
原创 助睿实验作业3:学生用户画像 - 考勤主题扩展标签构建
选择后会自动加载表信息,我们主要是分析各类异常考勤占比的特征,所以只需保留 student_id 、class_id、late_count、early_leave_count、leave_count、uniform_violate_count,其他字段跳过(skip);为保留的字段选择对应的属性类型,最后点击“确定”C3(黄色,纪律高危型): 数据点呈现明显的 “离群特征”,在迟到次数与其他指标的组合图中,出现了大量高频迟到记录,且伴随有不同程度的早退、请假或校服违规行为,是唯一存在多维度叠加违纪的群体。
2026-05-28 16:46:25
532
原创 助睿实验作业2:基于零代码平台的学生多维度考勤统计与标签构建
本文介绍了基于"数智教育"大赛数据集的学生多维度考勤统计ETL实验。实验使用助睿零代码平台,通过7张核心业务表构建考勤分析模型,重点处理3张关键表(考勤主表、考勤类型码表、学生信息表)形成星型结构。实验设计了基础属性、画像维度和考勤行为三类标签,详细说明了字段处理口径和统计逻辑,如迟到次数需排除请假记录等。实验步骤包括创建项目、导入数据、配置ETL流程等,最终实现自动化考勤统计,解决人工统计效率低、口径不统一的问题,为校园管理提供数据支持。
2026-05-20 12:13:51
527
原创 助睿实验作业1:订单利润分流数据加工(零代码 ETL 完整流程)
本文记录了在助睿数智(Uniplore)一站式数据科学实验平台上完成的ETL入门实验。实验通过零代码拖拽方式,将订单明细表与产品信息表关联,计算利润后按正负值分流为盈利订单和亏损订单,并分别输出到Excel文件。实验详细介绍了平台登录、团队管理、项目创建、数据同步等准备工作,以及转换流设计的具体步骤,包括表输入、记录集连接、字段选择、过滤记录等组件的配置方法。该实验帮助初学者掌握数据集成平台的基本操作流程,为后续复杂数据处理任务奠定基础。
2026-05-14 17:26:37
496
原创 算法篇之二分
本文系统讲解二分算法,重点解决边界处理问题。介绍两种整数二分写法:红绿模型(开区间)和闭区间写法。红绿模型将区间分为红(不满足条件)和绿(满足条件)两部分,通过调整边界最终确定分界点,逻辑清晰不易出错。闭区间写法通过调整mid±1缩小区间,需根据查找目标(第一个≥x、最后一个<x等)调整判断条件。浮点二分则直接取中点逼近,通过精度控制循环。文章提供代码模板和示例,帮助读者掌握不同场景下的二分实现。
2026-04-04 15:26:35
1392
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅