- 博客(800)
- 收藏
- 关注
原创 《用 AI 赋能医药科研与新药开发》目录(持续更新)
本专栏旨在指导医学科研和药物研发人员运用AI技术提升研究效率。内容包括:利用AI分析文献、识别研究热点、自动生成研究草稿;在新药研发中,通过AI优化临床方案设计、受试者筛选等环节;介绍AI理论基础如大语言模型、提示词工程学及智能体技术发展历程。专栏采用5000-9000字的长文形式,系统讲解AI在医药研发各环节的应用方法,帮助研究者缩短周期、降低成本,推动医药研发进入智能化新阶段。
2026-04-07 21:15:10
257
原创 《人工智能应用实战宝典》目录(持续更新)
在数字化席卷全球的今天,人工智能早已走出科幻,深度融入我们生活的每个角落。从唤醒智能音箱到获取个性化推荐,从提升工作效率到改变各行各业的运行方式,AI正以前所未有的速度成为现代生活的“必需品”。它不是取代人类,而是赋能个体,让每个人都能拥有前所未有的创造力与效率。更重要的是,如今学习和使用AI的门槛比想象中低得多,不再是程序员的专属,而是每个普通人都可以掌握的基本技能。
2025-05-25 10:02:50
1364
1
原创 《用 R 探索医药数据科学》目录(持续更新,内容已超 230 万字)|订阅前后请务必认真阅读
我们重磅推出《用 R 探索医药数据科学》专栏!本文作为专栏【订阅后首读】的核心内容,堪称开启学习之旅的 “入门钥匙”,也是整个专栏最关键的一篇指引文。文中不仅完整呈现了专栏 9 大核心篇章 + 问答板块的详细目录,更囊括了订阅后必知的核心要点 —— 从阅读设备、实操工具的使用建议,到学习路径、更新规则的清晰说明,再到问题反馈、感悟记录的实用方法,一站式帮你摸清专栏框架、找准学习方向。建议各位订阅者务必认真阅读、吃透内容,这能让你后续的学习更高效、少走弯!
2024-11-18 06:22:40
17526
64
原创 正则表达式的基础要点
R语言提供了一些内置函数来处理正则表达式,如grep()、sub()、gsub()、strsplit()和paste()。这些函数结合正则表达式的使用,使得字符串处理变得更加方便和高效。在本节中,我们将详细探讨这些函数的用法,并通过示例演示如何在R中进行字符串处理。
2026-09-04 11:19:15
47
原创 字符串是编程语言中一种非常基础且重要的数据类型
字符串(String)是编程语言中一种非常基础且重要的数据类型。在R语言中,字符串是一组字符的有序集合,这些字符可以包括字母、数字、符号或其他字符。字符串在数据分析和文本处理任务中非常常见,比如存储文本信息、标识符号、代码中的注释和日志信息等。
2026-09-04 11:18:31
44
原创 2篇2章7节:横断面调查表的设计
调查表设计是横断面研究质量控制的核心,须紧扣研究目的,遵循科学性与逻辑性,涵盖明确目标、组建团队、编制条目、专家审核、预调查及信效度考评等步骤。结构上重视标题、封面知情同意、问题类型与顺序。信息化时代电子问卷提升了效率,但设计原则不变,是获取可靠数据、支撑决策的关键。
2026-09-03 09:11:02
104
原创 不管你是本科生、研究生还是临床医生,这可能是你科研路上最值的一笔投资
与其在碎片化的免费资源里反复试错,不如用一顿饭钱换一个系统性的解决方案。科研这件事,越早开始,越不焦虑。
2026-09-02 16:23:05
195
原创 为了更好地理解tidyr包的实际应用,我们来看看一个真实案例
为了更好地理解tidyr包的实际应用,我们来看看一个真实案例。假设我们有一个关于不同地区气温变化的数据集,我们需要将其从宽型数据转换为长型数据,以便进行进一步的分析和绘图。
2026-09-02 16:18:42
216
原创 从临床试验设计到期中分析,为什么你需要一套真正覆盖全流程的R语言教学体系!
核心内容是关于临床试验期中分析的重要性、统计挑战、监管要求,以及一个R语言教学体系的介绍。用户给出的原始内容很长,重点是:期中分析的核心价值、多重检验问题、监管法规学习需求缺口、以及如何用R学习这门技术。
2026-09-01 18:22:14
298
原创 4篇3章7节:如何进行临床试验期中分析(四)
综合所有数据分析可得,本次50%信息率的期中分析完全满足 O’Brien‑Fleming 成组序贯设计的优效终止标准,统计结果稳定、可靠、结论明确,可正式判定试验药物相较于安慰剂可显著降低患者收缩压,试验可依据统计结果提前终止,无需继续推进后续研究阶段。
2026-09-01 17:50:18
378
原创 4篇3章6节:如何进行临床试验期中分析(三)
本文基于模拟高血压临床试验数据,依托O’Brien‑Fleming两阶段成组序贯设计规范,完成期中分析数据集构建、数据质控核查与核心统计量提取工作,通过拆分试验组与对照组数据、计算两组有效样本量、血压变化均值及标准差,完成期中数据的标准数据提取步骤。
2026-09-01 16:41:27
219
原创 运用tidyr包和认识tidyr中的其他函数
在数据分析中,数据的存储方式直接影响分析过程的效率和准确性。常见的数据存储形式有宽型数据(wide format)和长型数据(long format)。宽型数据适合人类查看和理解,而长型数据则更适合计算机处理和分析。为此,R语言提供了tidyr包,用于在这两种数据格式之间进行转换。
2026-09-01 14:42:15
227
原创 2篇3章2节:队列研究的特点、类型和设计要点
本文依据研究启动、暴露发生与结局出现的时序关系,将队列研究划分为前瞻性、历史性(回顾性)与双向性三类,三类设计各有特征、优劣及适用场景,是临床科研中筛选适配研究方案的核心依据。
2026-09-01 14:39:25
143
原创 2篇3章1节:队列研究的起源发展和原理
本文梳理队列研究的发展历史,追溯 “队列” 一词的词源背景,介绍弗雷明汉心脏研究、英国医生研究、护士健康研究三项标志性前瞻性队列工作;阐释队列研究、暴露的核心定义,拆解队列研究从确定人群、暴露分组、随访观察到对比分析的完整原理;归纳其在病因探索、疗效与预后评估、药物上市后警戒、疾病自然史研究四大方向的应用;进一步对比固定队列与动态队列两类队列形式的定义、特征、适用指标与经典实例。
2026-09-01 11:54:45
92
原创 为什么每一位医药科研人都值得订阅《用 R 探索医药数据科学》
《用R探索医药数据科学》专栏专注医药数据科学,已发388篇文章、230万字,覆盖Meta分析、机器学习、NHANES/FAERS等数据库挖掘。每周更新,定价399.9元,提供可复现实操与独家深度内容,助研究生、医生及统计师高效产出科研成果。
2026-08-31 18:07:14
191
原创 2篇2章6节:横断面研究的常见偏倚及研究举例
在临床实际研究过程中,横断面研究受限于一次性横断面观察、无随访过程、人群筛选不严谨、信息收集不规范等问题,极易产生各类系统误差。本文将系统阐述横断面临床研究中选择偏倚、信息偏倚的具体类型、产生机制、临床实例、危害影响,为大家人员规范开展现况研究、提升研究质量、保障结论真实性提供理论与实践参考。
2026-08-31 08:33:34
133
原创 2篇2章5节:横断面研究的步骤及设计要点
横断面研究作为流行病学基础研究方法,凭借高效、便捷、贴合现况的优势。其完整实施流程包含研究目的明确、研究对象界定、调查方法确定、调研工具设计、调查质控培训、数据整理分析、结果规范解读七大核心步骤,各环节环环相扣、层层质控,共同决定研究的科学性与实用性。
2026-08-31 08:19:47
93
原创 运用tidyr包和认识spread()函数
在数据分析中,数据的存储方式直接影响分析过程的效率和准确性。常见的数据存储形式有宽型数据(wide format)和长型数据(long format)。宽型数据适合人类查看和理解,而长型数据则更适合计算机处理和分析。为此,R语言提供了tidyr包,用于在这两种数据格式之间进行转换。
2026-08-30 08:09:09
188
原创 宽格式数据集中,每一行代表一个独特的实体(如一个病人),每一列代表不同的变量或属性。所有的变量都以列的形式展开
在长格式数据集中,同一个实体可以在多行中出现,每一行包含一个特定的观察值或测量值。通常有两个主要的列,一个表示变量名称,另一个表示变量值。
2026-08-30 08:08:11
199
原创 4篇1章1节:我国医学科普的现状和对医务人员的作用
医学科普文章与医学专业文章在受众场景、创作目的、内容取材、语言结构、审核标准、职业价值等方面存在根本性区别,二者各司其职、互为补充。本节通过系统梳理与对比分析,厘清新时代医学科普的发展态势、创作价值与文体边界,为医务人员规范开展科普创作、依托科普实现职业进阶提供理论支撑与实践指引。
2026-08-29 11:12:18
86
原创 2篇2章4节:随机抽样调查方法的分类和应用
学界通用的随机抽样核心类型包含单纯随机抽样、系统抽样、整群抽样、分层抽样、多阶段抽样五种,五类方法的抽样逻辑、操作难度、误差特征、适配场景各有差异,可根据总体规模、分布特征、调研条件灵活选用,也可组合使用,最大限度提升抽样精度与调研效率。
2026-08-29 10:45:27
174
原创 2篇2章3节:非随机抽样调查方法的分类和应用
明确不同抽样方法在公共卫生与流行病学研究中的定位,总结抽样方法的科学选择准则与误差控制要点,旨在为科研调研、社会调查、疾病监测等工作提供标准化的方法参考,提升抽样调研数据的科学性与研究结论的可靠性。
2026-08-29 10:13:12
119
原创 2篇2章2节:介绍普查与抽样调查,认识 NHANES 数据库
横断面研究,又称现况研究,是流行病学观察性研究体系中最基础、应用最广泛的描述性研究设计。该研究依托某一特定时间点或极短时间窗口,对目标人群健康状态、疾病分布及相关暴露特征开展一次性调查,形成人群健康与社会现状的静态“快照”,核心用途为描述疾病三间分布特征、掌握人群健康基线水平、初步分析暴露因素与疾病结局的关联性。根据研究覆盖人群的范围不同,横断面研究可分为普查与抽样调查两类。
2026-08-29 09:37:32
146
原创 dplyr包的group_by()函数用于对数据集按照给定变量进行分组
数据预处理是数据科学工作流中的重要环节。通过数据清洗、数据集成、数据变换和数据规约等步骤,可以显著提高数据质量,为后续的分析和建模提供坚实基础。在实际应用中,结合具体数据的特点和分析目标,选择合适的数据预处理方法,可以有效提升模型的准确性和稳定性。dplyr是R语言中一个强大且高效的数据处理包,专门设计用于处理数据框(data frames)。它的语法简洁明了,操作高效,尤其适用于大数据集。dplyr提供了一系列函数,使得数据的筛选、变换、聚合和排序等操作变得简单直观。
2026-08-27 10:40:23
209
原创 2篇2章1节:认识横断面研究和其流程
横断面研究是流行病学与临床医学核心的观察性研究方法,又称患病率研究,核心特征为单一时间截面同步采集所有暴露与结局数据,可直观捕捉目标人群疾病、健康状态及相关影响因素的分布规律,形成“流行病学快照”。
2026-08-27 10:37:28
109
原创 认识dplyrR语言的dplyr扩展包是数据处理的利器,其名称中的‘d‘代表数据框(dataframe)
如果需要降序排序,可以在列名前使用desc()函数。例如,以下代码对iris数据集按照Sepal.Length进行降序排序,并显示前5行。
2026-08-26 07:32:28
244
原创 str()函数用于紧凑地显示数据集的内部结构
summary()函数提供了数据集的描述性统计量,包括最小值、最大值、四分位数、中位数、均值等。对于因子变量,它还提供了频数统计。这些信息对于初步了解数据的分布和特征非常有用。
2026-08-26 07:31:42
190
原创 4篇3章5节:如何进行临床试验期中分析(二)
这篇文章以高血压新药 Ⅲ 期临床试验为案例,演示如何借助 R 包完成确证性临床试验的成组序贯设计,计算期中及最终分析的临界 Z 判定边界,同时强调序贯设计必须在试验开展前完成固化并满足 SAP 合规要求。
2026-08-25 21:00:53
477
原创 4篇3章4节:如何进行临床试验期中分析(一)
文章依次演示期中数据集构建、样本核查、描述统计、普通两样本 t 检验,结合输出结果说明:即便期中数据得到很小的 P 值,也仅能反映当前已完成受试者的组间差异;新药确证试验是否可以提前优效终止,不能依靠普通 t 检验结果,必须对照方案预先锁定的成组序贯临界值进行判定,这也是国内外药监机构对期中分析的核心合规要求。
2026-08-25 18:58:43
343
原创 2篇1章5节:病例系列报告撰写的实操解读
综合上述病例筛选、资料收集、数据统计分析三大核心实操环节的案例解析与规范梳理,可清晰界定高质量病例系列分析的核心质控逻辑。
2026-08-24 18:22:40
121
1
原创 2篇1章4节:病例系列分析的方法特征和2026报告介绍
本文通过理论辨析加前沿实证案例的模式,为大家规范开展、科学解读病例系列研究提供清晰的理论依据与实践参考。
2026-08-24 17:48:58
133
1
原创 _all 变体函数,一次性操作所有列
_at 变体函数允许用户对数据框中的特定列进行操作。用户可以通过列名、列号或列的选择条件来指定目标列。这为用户提供了更大的灵活性,使其可以只对感兴趣的列进行操作,而不影响数据框中的其他列。
2026-08-24 08:16:40
158
原创 使用 mutate_if() 进行条件变换
在上述代码中,是对 iris 数据集进行按 Species 分组后,对所有数值型列进行标准化操作。具体而言,它将每个数值型变量的值除以该变量在各自物种组中的均值。mutate_if 用于选择数值型列进行变换,group_by(Species)则将数据按 Species 分组。
2026-08-24 08:15:22
174
原创 2篇1章3节:病例报告的 ICMJE 2026年版规范
2026版ICMJE规范已被《柳叶刀》(Lancet)、《新英格兰医学杂志》、《英国医学杂志》(BMJ)等全球顶级医学期刊全线采纳并强制执行,统一了全球病例报告的学术伦理准则、稿件结构化框架、原始数据公开标准、作者署名规范、利益冲突申报机制、人工智能写作合规要求及学术出版纠错体系,是当前临床医师撰写病例报告、期刊编辑审稿筛查、学术成果合规发表的唯一核心合规依据,现将病例报告全流程规范化撰写标准与落地实操要点详细拆解如下。
2026-08-24 06:50:16
130
1
原创 2篇1章2节:病例报告的实操要点与 ICMJE 的2026年版规范
为帮助临床医师及医学生规范掌握该类研究方法,精准把握病例筛选、资料收集、文稿撰写的核心规范,本文将结合临床实践与国际通用学术标准,系统拆解病例报告的实操要点与介绍新规范。
2026-08-23 20:02:39
100
1
原创 2篇1章1节:认识病例报告,以2026年SCI顶刊的病例报告分析举例
本文首先梳理了病例报告的方法学定位与核心优势,指出其在临床科研体系中作为高级别研究前置铺垫的基础作用。
2026-08-23 19:12:07
130
1
原创 数据预处理不仅是数据科学人员必备的技能,也是保障数据科学项目成功的关键。它也是数据科学工作流中的一个关键步骤
例如,我们查阅了一份人口数据基础信息表的信息,表里面包含了年龄、性别、身高等变量,其中年龄变量是整数型,而身高变量是浮点型(它用于表示带有小数部分的数值),同时还存在部分缺失的数值的变量,或者能视觉发现的异常值。
2026-08-23 18:38:36
162
原创 apply()函数可以作用于矩阵和数据框的行或者列
在R语言中,除了使用循环的方式来操作数据外,我们还可以使用更简洁和高效的遍历函数。这些函数可以帮助我们对数据进行各种操作,避免了显式的循环语句,使代码更加简洁和易读。以下是几种常用的遍历函数及其应用示例。
2026-08-23 18:37:29
227
原创 1篇3章5节:不同模型消耗成本不同,背后的原因是什么?
本文以国内两大主流AI原生代码编辑器的模型计费体系为研究样本,通过对比两大平台十余款主流大模型的积分倍率、定价规则与权限体系,系统剖析了AI大模型成本差异化的核心原因。
2026-08-22 11:11:43
263
从药品销售与疗效数据分析例子学会R语言中的ggplot2绘图技巧
2024-09-16
用R进行复杂用户行为数据分析:深入理解用户行为、转化率与交互模式
2024-09-15
使用R语言igraph和ggraph包绘制基因相互作用网络图
2024-09-07
使用Shiny构建带有蓝色背景的双人五子棋游戏
2024-09-06
R语言与Shiny的双人飞行棋小游戏代码:回合制胜负与实时状态显示
2024-09-06
使用R语言和recommenderlab包实现基于物品的协同过滤推荐系统及内容属性综合评分
2024-09-05
使用R语言和recommenderlab包构建基于用户协同过滤的自媒体内容推荐系统,结合多属性分析
2024-09-05
使用R语言和randomForest包构建血糖预测模型
2024-09-04
使用R语言和xgboost包构建血糖预测模型
2024-09-04
使用R语言和glmnet包构建血糖预测模型
2024-09-04
使用R语言实现CLARA算法对鸢尾花数据集进行大规模聚类分析
2024-09-03
使用R语言的SOM算法对鸢尾花数据集进行自组织映射分析
2024-09-03
使用R语言中的Fuzzy C-Means算法对iris数据集进行模糊聚类分析
2024-09-03
在R中用谱聚类算法,基于图论的高效数据分组与分析
2024-09-03
在R中使用PCA降维与K-means聚类结合的算法,高效的数据分类与可视化
2024-09-03
在R中使用高斯混合模型,多分布下的概率聚类与模型评估
2024-09-03
在R中使用层次聚类算法,探索数据层次关系的高级聚类方法
2024-09-03
在R中使用DBSCAN,一种密度驱动的高级聚类算法,识别噪声与复杂形状
2024-09-03
模拟家庭收入、区域、年龄、血压及多属性的大规模数据集生成的R代码和一份10000人数据集,可以用于学习机器学习
2024-09-01
理解K-means聚类算法:基于R语言对iris数据集的详细实现与分析,R代码
2024-09-01
trekcolors R 包为科幻迷和数据分析爱好者提供了独特的 Star Trek 和 LCARS 调色板
2024-11-17
R语言数据去重与匹配:20种常用函数详解及实战示例
2024-11-16
10个例子,学会使用管道操作符 %>% 进行数据处理与可视化
2024-11-11
在R语言中实现带有边缘直方图、箱线图和密度图的散点图,以及连续变量直方图的多图展示
2024-11-09
R语言数据重塑,20种高效函数操作数据格式与管理
2024-11-02
R语言字符串操作全攻略,30个技巧一览无余!
2024-10-28
一次性掌握7种强大的临床预测模型
2024-10-27
掌握20个R语言数据清洗技巧,让数据处理更加高效和简单!
2024-10-26
基于机器学习的高血压预测模型构建与评估
2024-10-25
如何通过R代码设置RStudio全局环境
2024-10-23
R语言版本检查与扩展包自动更新示例
2024-10-21
用R语言贪心算法解决旅行商问题的模拟演示
2024-10-17
用R演示药物对糖尿病患者血糖影响的方差分析及可视化
2024-10-17
基于卵巢癌数据的治疗和年龄组生存曲线分析
2024-10-14
使用R语言和ggplot2基于iris数据集绘制常见科研图表
2024-10-12
基于主成分分析的临床高血压患者数据分析与可视化
2024-10-05
用R语言创建基于逻辑回归的高血压预测模型(准确率达到82%)
2024-10-05
用Python的基于逻辑回归的高血压预测模型.py
2024-10-05
基于R语言的主成分分析:模拟数据生成与可视化
2024-10-05
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅