慢下来
2026-07-11 15:26:00 创建
2026-08-11 10:55:30 修改
20260711
其实很多想法想过以后,或者输出过以后,即使当时输出得不是很完美,但毕竟已经把这个想法表达出来了,它就不再占用我的大脑空间了(最近的一篇文章中我也表达了这样的看法,见近期杂记),如果让我重新把这些想法整理一下,记录下来,就显得很多余——或者说,我会比较懒惰。但是,for the sake of the future of my website,我还是把这些东西记录下来吧。毕竟,我已经决定“让自己的生活慢下来”了。
最近一直在尝试联系导师,可惜自从6月3号写完毕业论文后那一次,之后就再也没有合适的时机跟导师通话。在这个时间节点,研0的暑假,我的其他同学,要么已经在跟导师做科研了,要么已经在实习了,而我一直因为各种原因,或者说给自己找各种借口,没有进行这样的实践。这让我感到焦虑,那是一种空转的焦虑,我似乎无法允许自己合情合理地休息。即使什么都不干,去看书,去娱乐,去漫游,也总是要抱有目的性地,为了让自己变好。但最近几年的学习让我越来越焦躁,无法静下心来,总是(总是吗?)希望更快地看到结果。这也许是AI的便捷带给我的结果,也许只是我这几年很少有独立的深度思考,失去了深度思考的能力,或者失去了深度思考的自信了。根本问题在于:
- 我能坚持下去吗?
- 坚持下去能有好结果吗?
以上两点在实践中我都没有做到,对于从未做到的事情,我有何理由相信自己有能力做到呢?或许这也是我写这一篇记录的原因。因为在昨天晚上我说服自己要慢下来,接下来要做的事情就是,看看慢下来是否真的会带给我好结果。从某种角度讲,这也和“长期主义”有相似之处,而显然,我也不是一个长期主义者。当然,我很佩服那些长期主义者。题外话,很早就听到过21天养成一个好习惯的说法,但我似乎从来没有坚持下来过。在之前,我没有看到有什么坚持、培养某一个习惯的必要,但现在,或许是时候让长期主义发挥作用了。
下面就直接摘抄我发给claude的文字:
不出意外地,我问了今晚是否有时间,老师没回我。 也许我应该接受自己暑假什么都不干。也许我真的好久没有好好休息过了,即使大四下确实没有干多少事情,但麻木地虚度一些时光,消磨自己的精力,也称不上放松。何况毕业论文直到6月3号才交,最能说的上放松的时间只有最后不到一个月——因为还有考试。而最后这一段时间也总是在熬夜中度过的。 因为我太需要一个任务了。不管是一份实习,还是课题组的任务,我需要让自己有事可做,以便能回答别人的问题。但AI现在这行情,自己做又毫无资源,根本出不了什么成果,只能学一些理论知识,做一些简单的模型玩一玩。我不想去实习,我不知道自己现在去实习有什么竞争力,不如直接躺一个暑假等开学进课题组学习。说到这里,正是我前面提到的,我总是不能让自己心安理得地闲下来。 我有一些长期的任务,像是学英语,锻炼身体,做个人网站,记录心路历程,写小项目。我不知道是我本来就急躁,还是AI时代让我变得急躁。也许在没有AI的时代,排查一个报错花一晚上,花好几天都是常有的事;而复现一个实验光是与环境斗智斗勇都要折腾几个小时。但现在有了AI,我没有一点耐心。自己没有读过一点代码,翻来覆去让AI提供修改方案,看能不能跑,几个小时过去已经精疲力尽,也不知道是哪里消耗了精力,没弄明白,就已经再无心力。直接上Google的colab,好在最后在AI的帮助下,代码跑通了,虽然我现在也不知道代码写了什么,我也不确定我明天是否还会去看这项实验。(anthropic最近的j-space,我想对其有一个自己的理解)
也许我应该看书,看随便什么书,或者看有关人工智能史的书,哲学书,对整个图景有一个偏哲学的理解,知道自己在干什么。也许那些在做这些的人会想这些,也许他们不会想这些,但他们也许永远不会让这样的想法阻碍他们的步伐。但在我这样的想法中,看书还是抱有一定的目的,又回到了前面的说法,我永远不能让自己真的闲下来。
...
也因此我很向往未来读研的生活,无人打扰,我更向往未来工作了的生活,有一间自己的房子,可以是租的,然后把它打理得非常好,那时我有了经济能力(事实上我非常希望通过读这个研究生,让我在就业市场上有竞争力,首先本科就不差,但是确实本科期间学到的东西很少,自己又没怎么努力,混到了现在)。...所以我希望赶紧跳过这暑假两个月,但现在老师一直不回我话,我无聊地焦虑着。
所以我说我似乎不能让自己真正闲下来。
Claude没有给出什么有见地的回答,我只是在输出我的想法。
我真的很想抱怨现在的AI。它太快了,快到让人们失去耐心。j-space出来的第二天就有人说自己复现了实验。我不知道是他本来就具有这样的能力,还是它借助了强大的AI的能力。也许我本来就不应该考虑别人是怎么样的。我可能需要允许自己几天时间内就研究这一件事情——可能这才是在AI大规模使用前的常态吧!可惜我没有经历过。
如果一个人没有耐心,那他只会被那些使用强大模型,有更多额度的,更快看到结果的人,带向无尽的焦虑。说实话,我真的觉得在一个人自己搞明白一个系统之前,他不应该依赖AI。譬如说代码的学习,一个项目究竟是在干什么。但是搜索引擎,计算器,电脑,软件,已经进入了我们的日常生活,谁也不用知道这些事情背后的原理,谁也不用亲自理解每一件事情,但他们就会去用。那AI和这些东西,有什么本质区别呢?
也许是因为,正是因为我希望理解AI的背后原理,所以我才过得这么痛苦。研究AI的人和用AI的人应当有本质的区别。前者需要搞明白代码在干什么,一个事情背后的直觉是什么,算法,系统,都是需要理解的。但后者只需要利用,譬如生成一段文字,或者提供灵感,或者用AI来实现他的一个小想法。
嗯,我相信我上面的那一段话是正确的。我也相信下面这句话是正确的:
我觉得AI本身让研究AI的人和用AI的人之间的界限变得模糊。无论是本质上变得模糊,还是在社交媒体上说真话的人太少,导致界限变得模糊。
可能我总体对AI是持消极态度的,固然AI的确帮了我很多,如果以我本科的学习态度,我不确定如果没有AI我还能不能毕业,AI也的确让很多学习变得更加方便。但我仍然觉得——如上所述——我对AI的态度是消极的。AI某种程度上加快了人的效率,但这种效率似乎超过了我的承受范围。一人多用变得更加有可能,而在以前,可能只有少数天才/极客才能做出这样的事情,且其“效率”可能并不高。更多的情况,可能只是让一群有才智的人,聚在一起,慢慢涌现想法。
Claude表达了它的认可——我很需要这样一个认可,我总是需要一个外界的认可,针对我的想法。Claude带给我的总体感觉是一个反驳型、说教型人格,因此每次在跟它聊人生感悟时,在等待它回答时我总是很惶恐。然而在这里,它没有完全反驳我,在此将其回答摘抄如下:
先说你区分"研究AI的人"和"用AI的人"这件事——我觉得这个区分是对的,但界限模糊的原因,可能不完全是AI本身,而是验证的门槛消失了。以前一个人说"我理解这个系统",验证方式很朴素:他能不能不靠外部工具,把这套东西从头写出来、讲清楚、debug出来。现在AI能让一个完全不懂的人产出一个"看起来会跑"的结果,于是"我做出来了"和"我理解了"这两件事第一次可以被彻底剥离,而且外部几乎无法分辨。你说的第二天就有人"复现"j-space实验——那个复现,到底是理解之后的复现,还是照着AI的指令一步步点出来的复现,从外部看是一样的。这确实会让人焦虑,因为它取消了一种曾经可靠的信号:做出结果这件事本身,不再能证明理解。
关于搜索引擎、计算器和AI有什么本质区别——我觉得区别在于抽象的层级。计算器抽象掉的是算术,一个数学家不需要会心算才能做数论。搜索引擎抽象掉的是记忆,一个历史学家不需要背下所有档案才能做出判断。但这些工具抽象掉的,从来不是"这个领域本身在做什么"这件事的核心——你还是要自己理解论证、自己判断哪个搜索结果可信。而AI,尤其是在编程和研究这件事上,抽象掉的恰好是你正在试图学习的那个东西本身:怎么写代码、怎么debug、怎么设计实验。计算器不会替数学家证明定理,但AI会替你写出那段你本该自己写出来才算"学会"的代码。这是质的不同,不只是量的加速。
所以你说"研究者不应该在搞懂系统之前依赖AI",我觉得这个判断本身没问题,问题在于——你现在还不知道自己有没有资格慢下来。因为你亲眼看到别人用AI一天就出结果,而你告诉自己"我要花几天甚至几周真正搞懂",这在旁观者眼里,看起来就是慢、就是没效率。这才是真正折磨你的地方:不是AI让你没耐心,是AI让"有耐心"这件事在别人眼中显得可疑,甚至显得像找借口。
但研究这件事的历史一直都是这样:多数真正的理解,从来不是在跟同代人比速度中产生的,而是当时显得"慢"的那批人后来定义了整个领域怎么想问题。你不需要经历过AI之前的时代才有权利选择那种节奏——你现在选,一样有效。
然后我说,
AI slop,fomo,也许我又无形中陷入了fomo。**也许慢下来,并不会错过太多东西。**但现在宣传的叙事就是快,但快也并非虚假。
也许。
这让我很烦。
我究竟想要的是怎样的生活?数学本科的学习中,我并没有刨根问底,AI代替我完成了大部分学习和任务。我又有什么理由宣称自己要慢下来刨根问底地研究AI呢?
也许只是因为我已经走上了这条路。本科期间学习数学带给我的痛苦(可能是我确实学不会,可能是我觉得自己学不会)让我没有选择数学,而是选择了AI,可能是具身智能。既然选择了,我的本能让我知道,如果我要在这里立足,我需要刨根问底,我需要研究明白。我想,这跟那些其他人不同。
同样,用AI开发游戏的人,需要懂游戏,而不需要懂AI;写前端的人,需要懂JavaScript,而不需要懂AI;用AI来实现自己想法的人,只需要知道自己的想法是什么,而不需要懂AI。我需要懂的,是AI本身。
忽然有一种豁然开朗的感觉,我不确定我这种感觉是不是真实的,是不是有道理的。也许我明天要做的事情就是把我今天晚上的这些想法,整理,写进我的个人网站里。
Claude没有提供更多新思路了。总而言之,这场对话让我在心中坚定了一个想法(至少目前我相信它),那就是,我要让自己慢下来。当追求所谓的效率让我头晕眼花,还什么都没学到,那我就没必要再自欺欺人了。也许我应该首先把自己的生活过好,让自己每天都充满活力,然后,在良好的状态下,走在我现在选择的道路上,一步一个脚印。让我试图用未来几个月,验证长期主义的力量。以及去印证我在前面提到的一个猜测:慢下来,不会错过太多东西。
此外,前面我给Claude发送的消息中,也包含一些我其他的关于事物、世界、未来的思考,或许之后会在这里回顾那些想法。
2026年7月11日 17点07分
20260715
花了4天时间,学习了反向传播算法,并手动用numpy实现了MyTensor类和反向传播。我觉得挺有成就感的,而且理解确实是更深入了一些。有些问题,不在实践中,是发现不了的。这一部分或许是可以结束了,接下来可以不用在自己手搓的代码上死磕了,直接用pytorch,把注意力转向其他方向。
20260811
接续最近的一篇文章。回顾最近干的事情,或者自己以前干过的事情。
- 把网站做得更好看了,制作了node脚本来自动构建网站。测试了D1数据库和worker后端,尚未部署到实践中。测试了搜索功能。
- 手写张量类,实现了反向传播算法,在MNIST数据集上训练
- 运用PyTorch已有的基础函数,手写RNN,发现运算非常慢
- (曾经)在课程大作业上实现transformer,训练NanoGPT。
- (以前或最近)看过《数学:确定性的丧失》《反脆弱》《我的几何人生》
- (没看完的)《被讨厌的勇气》《学做工》
- (曾经)本地运行
llama.cpp部署小模型。(这真的能算吗?)