标签: #paper-review
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 17 篇
1美元赢过20美元的实验 — 认知失调原文与六十年的反驳
先让人做一件无聊透顶的任务,再请他去撒个谎,一组付1美元,另一组付20美元。事后说任务其实更有趣的,是拿钱少的那一组。费斯汀格与卡尔史密斯1959年的论文,每个条件只有20人,评分尺度从负5到正5,规模很小,却改变了社会心理学的走向。我们一路追下去:潜入末日预言团体的记录在方法上的硬伤、贝姆的自我知觉理论这一竞争解释,以及2010年被揭穿的自由选择范式的统计漏洞,看看什么留了下来,什么在动摇。
2026-07-26 · 19 分钟阅读 #psychology#paper-review#social-psychology#decision-making#mindset斯坦福监狱实验是怎么垮掉的 — 档案室说出的真相
1971年津巴多的监狱实验,以“普通大学生6天就变成残暴狱警”的故事写进了教科书,也拍成了电影。可原始资料并没有发表在顶级学术期刊上,而是登在一本小刊物里;样本只有24人;2007年的一项检验更发现,招募广告本身就把某类倾向的应募者吸引了过来。2018年蒂博·勒·特克西耶在斯坦福档案室查到的东西还要致命:狱警事先被指导要表现得强硬,而那位象征着精神崩溃的参与者,多年后自己说那是演的。即便如此,情境的力量这一主题并没有被废弃——只是它的证
2026-07-26 · 14 分钟阅读 #psychology#paper-review#social-psychology#replication#research-ethics损失比获得痛两倍 — 前景理论原文与此后的45年
“人感受到的损失之痛,是获得之喜的两倍”这句话,如今是谈判教材和定价方案里的常客。可是翻开出处——卡尼曼与特沃斯基1979年发表在《计量经济学》上的论文——真正的材料只是抛给以色列大学生的几道假想赌局题,外加一张回答比例表。那个著名的“两倍”并不出自1979年,而是1992年一项以25名研究生为对象的后续研究的中位数;2018年之后,还出现了认为损失规避被夸大的重新检验。我们用代码看看一个损失规避系数如何让期望值为正的赌局被拒绝,并分开
2026-07-26 · 18 分钟阅读 #psychology#paper-review#behavioral-economics#decision-making#money邓宁-克鲁格效应 — 那张著名的曲线图并不在原论文里
网上四处流传的“愚昧之巅”曲线图,在邓宁与克鲁格1999年的论文里根本不存在。原论文是四项研究:让康奈尔大学的本科生完成幽默、逻辑与语法任务,再按成绩四分位比较自我评价;真实结果显示,高分组低估自己的幅度,和低分组高估自己的幅度不相上下。更扎心的批评还在后面——把自我评价与实际成绩换成毫无关系的随机数,照样能画出一模一样的图。向平均回归造成的错觉、重新分析929人的2020年论文,以及即便如此仍然值得保留的元认知训练价值,本文一并梳理。
2026-07-26 · 15 分钟阅读 #psychology#paper-review#metacognition#self-assessment#statistics米尔格拉姆服从实验再检视 — 65%这个数字的背面
1961年始于耶鲁的米尔格拉姆实验,长期被压缩成一句话:65%的参与者一路加到了最高电压。可那个数字只是多达24个变式实验中某一个条件的值;换个条件,服从率会在0%到92.5%之间大幅摆动。吉娜·佩里在耶鲁档案室查到的,是实验者反复施加剧本之外的压力、且相当多参与者其实怀疑这是骗局的证据。哈斯拉姆与赖歇尔提出了另一种解释:不是盲目服从,而是对科学这一大义的认同;2009年伯格用只做到150伏就停下的设计做了部分重现,得到了接近的比例。本
2026-07-26 · 16 分钟阅读 #psychology#paper-review#social-psychology#obedience#research-ethics38人从一开始就不存在 — 旁观者效应的神话与真实的实验
1964年,《纽约时报》报道说,基蒂·吉诺维斯被杀害的过程中有38名邻居只是袖手旁观——旁观者效应这个概念就此诞生。可是2007年发表在《美国心理学家》上的核查指出,那个数字和大量情节相当程度上并非事实:能够目击的人少得多,报警是有的,还有一位邻居下到现场把她抱在怀里。即便如此,那篇报道催生的达利与拉塔内1968年的实验是真的,而且可以重复。我们用代码看看个人介入的概率与群体介入的概率如何分道扬镳,并一路追到219段真实监控录像给出的答
2026-07-26 · 18 分钟阅读 #psychology#paper-review#social-psychology#ethics#communication收入和幸福能一起涨到哪里——7.5万美元之争的来龙去脉
“年收入超过7.5万美元后,幸福就不再上涨”——卡尼曼2010年的研究成了常识。可到了2021年,基林斯沃思用智能手机的实时数据报告了完全相反的结果(幸福会一直上涨),争论就此开始。令人惊讶的是接下来的事:两人没有互相攻击,而是开展了共同研究,并在2023年一起证明了两个结果都部分正确。本篇用代码确认对数刻度的含义,阅读科学争论最优雅的一次解决。
2026-07-20 · 9 分钟阅读 #psychology#paper-review#mindset#happiness#money成长型思维,在夸大与真相之间 — 从表扬实验到国家级验证
"相信能力可以改变,成绩就会提高"——成长型思维席卷教育界的同时,也伴随着大量夸大。本文以原论文为准,还原一切的起点——1998年穆勒与德韦克的表扬实验(被夸聪明的孩子为什么开始挑简单的题),再跟进宣称没有效果的元分析,以及1万2千人规模的2019年《自然》国家实验。结论会让两个阵营都不舒服:效应真实存在但很小,可它非常便宜。
2026-07-20 · 9 分钟阅读 #psychology#paper-review#mindset#growth#education走神的心是不幸的心——在iPhone上完成的25万条幸福研究
2010年发表在《科学》上的一篇两页论文,用智能手机应用对2,250人的日常进行实时取样,报告了惊人的事实:人们醒着的时间里有47%在想着与手头之事无关的事情;比起在做什么,是否走神更能预测幸福;就连愉快的走神也不比专注更幸福。第五篇用代码理解“经验取样法”这一研究方法,并整理出能改变通勤路和洗碗时光的实践。
2026-07-20 · 9 分钟阅读 #psychology#paper-review#mindset#happiness#focus感恩日记真的有用吗 — 数算幸福实验与诚实的效应量
感恩日记是自我提升内容里的常客处方,它的出处是2003年埃蒙斯与麦卡洛的数算幸福实验。每周写下五件感恩之事的组,比记录烦心事的组更幸福、运动更多,连觉都睡得更好。不过,后续元分析给出的效应量比广告词谦逊得多。本篇按顺序读完原论文的三个实验,梳理去掉夸张后剩下的东西(一项小而便宜且安全的干预)、放大效果的条件,以及不让它枯萎的用法 — 系列至此完结。
2026-07-20 · 9 分钟阅读 #psychology#paper-review#mindset#gratitude#healing意志力真的会被耗尽吗——从萝卜实验到可重复性危机,用代码看懂发表偏倚
“意志力像肌肉一样会被消耗”的自我损耗理论,曾是心理学中看起来最扎实的理论之一。从1998年那场实验——在弥漫巧克力香气的房间里只吃萝卜的人更快放弃了谜题——到数百篇支持研究,再到2016年的反转:23个实验室、2000余人的联合重复验证报告效应实际为零。数百篇论文撑起的理论为什么会坍塌?本篇亲手跑一段发表偏倚的模拟代码来寻找答案。
2026-07-20 · 10 分钟阅读 #psychology#paper-review#mindset#willpower#replication棉花糖实验只有一半是真的 — 从原论文到2018年的重新验证
四岁时的忍耐力决定一生——棉花糖实验的故事人尽皆知。可是真正翻开原论文,会发现它与大众神话相去甚远。1972年米歇尔的原实验真正揭示了什么(等待的技巧是一种策略)、著名长期追踪相关背后的样本量,以及2018年瓦茨团队用约900人重新验证、在控制家庭环境后效应大幅缩水的故事 — 这是《用论文读心理学》系列的第一篇。
2026-07-20 · 9 分钟阅读 #psychology#paper-review#mindset#self-control#replication1万小时争论的原论文 — 柏林小提琴手与12%的真相
真正翻开1万小时定律诞生的那篇1993年艾利克森论文,你会看到一幅与畅销书所讲颇为不同的图景。本文依次阅读柏林音乐学院研究的真实设计(样本30人、回顾式估计)、论文真正主张了什么,以及2014年麦克纳马拉元分析给出的反转 — 练习量平均只解释实力差异的12%。既不是练习无用论,也不是练习万能论,这一篇要找的是两者之间的准确位置。
2026-07-20 · 8 分钟阅读 #psychology#paper-review#mindset#deliberate-practice#expertise别再重读,合上书回忆 — 测试效应的原始论文与间隔重复算法
把学过的东西重读一遍会有"懂了"的错觉,可一考试就崩了。2006年罗迪格与卡皮克的实验精确地揭示了原因:重复阅读在5分钟后的测试里获胜,却在一周后的测试里大败于反复提取(自我测验)。读一读提取练习与间隔效应的原始论文,再用Python亲手实现Anki所用的间隔重复算法SM-2。要改变学习方法,这一篇就够了。
2026-07-20 · 10 分钟阅读 #psychology#paper-review#mindset#learning#memory让跑步与抗抑郁药同台竞技 — SMILE临床试验及其后的25年
“运动对情绪有好处”这话谁都会说,但把确诊抑郁症的患者随机分配到运动组和抗抑郁药组、进行正面比较的临床试验并不多见。1999年布卢门撒尔的SMILE研究报告称,16周后两种治疗的缓解率相近,而在10个月的随访中,运动组的复发率最低。这些结果能信到什么程度 — 从设计的局限、2007年的重复实验,到综合218项临床试验的2024年网络元分析 — 本系列第九篇不加渲染地为你梳理。这是论文精读,不是医学建议。
2026-07-20 · 9 分钟阅读 #psychology#paper-review#mindset#exercise#mental-health每天睡6小时坚持两周,等于连熬两个通宵 — 睡眠负债的剂量-反应实验
有一篇论文,专门讲给那些说"我睡6小时就够了"的人听。2003年范东恩研究团队把参与者隔离在实验室里两周,把睡眠精确分配为4、6、8小时,然后每天测量认知能力。结果:6小时组的注意力呈直线下降,两周后达到连熬两个通宵的水平,可他们自己的困倦评分却在几天后就停住了。损伤在累积,自觉却停摆 — 这一篇用代码画出睡眠负债之所以危险的真正原因。
2026-07-20 · 9 分钟阅读 #psychology#paper-review#mindset#sleep#healthMamba 论文精读:用 Selective State Space Models 超越 Transformer
深入解读 Mamba(Selective State Space Models)论文。梳理从 S4 到 Mamba 的发展脉络、Selective Scan 机制、Hardware-Aware 算法,以及 Mamba-2 的 State Space Duality,并配合代码逐一分析。
2026-03-02 · 10 分钟阅读 #mamba#state-space-model#ssm#transformer#linear-attention