普癌新声 · 公众号
  • 首页
  • 肿瘤登记
  • R语言与数据科学
  • 肿瘤防治与健康科普

R语言与数据科学

RSS 订阅订阅本栏目

R语言、统计学、可复现数据分析与科研工具。

共 10 篇 ← 返回全部栏目

插值法是什么?线性、多项式、样条和径向基函数如何选择
R语言与数据科学
统计方法

当某个时间点、年龄或空间位置没有观测值时,插值可以根据周围的已知点,估计已知范围内的新数值。但估计值不是新观测,曲线更平滑也不代表更接近真实情况。线性、多项式、样条和径向基函数依赖不同的假设,选择时需要同时考虑数据维度、局部形态、噪声和使用目的。

发布于2026年9月5日
→
更新于2026年9月18日

主成分分析(PCA)和因子分析有什么区别?如何选择与用R实现
R语言与数据科学
统计方法

面对一组彼此相关的变量,主成分分析(PCA)和因子分析都能把它们概括成更少的维度,因此常被混在一起。两者真正的区别不在于“能不能降维”,而在于研究目的:PCA用于压缩数据,因子分析用于描述多个指标背后的共同特征。本文从原理、输出、适用场景和R实现四个方面说明如何选择。

发布于2026年9月5日
→
更新于2026年9月18日

肿瘤生存分析的7个常见误区:这篇综述讲对了什么,还缺什么
R语言与数据科学
文献解读

HR=0.8,能不能直接写成“疾病进展风险降低20%”?两条 Kaplan-Meier 曲线没有交叉,是否就说明比例风险假设成立?P>0.05,是否等于“没有影响”?

发布于2026年8月31日
→
更新于2026年9月18日

Agent Skills 与 MCP:一个教方法,一个接工具
R语言与数据科学
科研工具

Skill 负责把经验写成程序化工作方法,MCP 负责把外部世界变成可调用接口。

发布于2026年8月27日
→
更新于2026年9月18日

AI时代做数据分析,还要先学写代码吗?
R语言与数据科学
科研工具

不必把背语法当成入场券。但要让分析结果可信、可复核,仍然需要学会读代码、改代码和验证代码。

发布于2026年8月27日
→
更新于2026年9月18日

别让 AI 瞎编参考文献:让它去 PubMed 或 Zotero 找
R语言与数据科学
科研工具

检索近 5 年有关“大语言模型生成医学参考文献准确性”的研究,返回查询式、PMID、DOI、题名和摘要能支持的结论。未检索到的内容不要补写。

发布于2026年8月27日
→
更新于2026年9月18日

大数定律:样本多了,平均值为何会稳定?
R语言与数据科学
统计方法

大数定律描述的是:在适当条件下,随着重复观测增多,样本平均值会逐渐靠近总体的期望值。

发布于2026年8月27日
→
更新于2026年9月18日

设置种子,保证数据分析的可重复性
R语言与数据科学
科研工具

同一段抽样代码,运行两次却得到两组结果。这不一定是程序出错,很可能只是少了一行 set.seed()。

发布于2026年8月26日
→
更新于2026年9月18日

标准差与标准误:一个讲差异,一个讲精度
R语言与数据科学
统计方法

同一组数据,标准差是12,标准误却只有1.2。哪个数字更能代表数据“稳定”?先别比较大小,它们回答的不是同一个问题。

发布于2026年8月25日
→
更新于2026年9月18日

R 最佳实践速查表:从能运行到可维护
R语言与数据科学
科研工具

最近看到 Jacob Scott 的 R Best Practice Cheat Sheet。一张表,把项目结构、依赖管理、可复现示例、函数、命名、数据库和 Git 串了起来。很适合收藏,也值得加几条使用说明。

发布于2026年8月24日
→
更新于2026年9月18日
无匹配项
    微信公众号

    关注“普癌新声”

    持续获取肿瘤登记、R语言与数据科学、肿瘤防治与健康科普内容。

    让数据更可靠 让方法可复现 让健康知识有证据

    普癌新声微信公众号二维码,请长按识别或保存 长按关注公众号

    回到顶部

    © 2026 普癌新声

     

    肿瘤登记 · R语言与数据科学 · 肿瘤防治与健康科普