我问一个可能很傻的问题。 我妈那一代人,单位分的房,几万块买断,后来值几百万。我这一代,北京租着一间次卧,首付要「六个钱包」。同一个国家,二十年,怎么就变成两种命? 我知道的版本大概是:土地是国家的 → 地方政府靠卖地挣钱 → 房价被推上去 → 后来政策收紧 → 泡沫破了。但每一个箭头我都说不清楚为什么。为什么地方政府要靠卖地?为什么之前不收紧、2021 年才收?「泡沫」这个词到底是说房子还是说钱?日本九十年代那次,跟我们像不像? 这不是抱怨帖。我是真的想弄明白,因为我要决定的是:现在买还是等。想请懂的人拆开讲,一个人讲一段就行,我自己再拼。
想起了非洲近现代那个格言大师(一个暴君忘记叫什么名字了),我记得他就特别喜欢起格言,说白了就是装逼小短句,显得自己很有文化。我印象最深的有一句叫——树枝不会在变色龙的手上折断。属于是看上去没人任何道理,仔细品好像有一点道理,实际上也就那点道理。有种非常刻意地装深沉的美。 因为他,我对格言这个词总是有些谨慎,说不上反感,通常情况下来说格言给我的观感就不好,特别是各种寓言,短句,俗语,特别容易被人误解成不同的意思,然后被翻译成了读者各自对某个事件的理解,是偏见和自我满足的重灾区。读到了罗马时代的修辞学,(也是马克写沉思录的目的之一)是为了“把长论证压缩成格言来随时可用”,才让我意识到,格言的目的从来不是为了一句话讲清一个道理,解释世间万物。而是他们在系统性地完成一个理论,形成一套体系,养成风险系统的一个“开关”。是为了方便自己,在冗长繁琐的论证前后,不要迷失在逻辑的海洋。可以收拢,压缩回一句话,告诉自己想了那么多,是为了什么。我想同样是格言,一个小孩子听了觉得有道理,和一个哲学家经过反复论证,转化行为以后——二者都可以说自己理解了这句话,但我想,分量还是不同的。 引申一下我想大语言模型的skill有点异曲同工的意思,把工作流程也好,项目精神也罢,在一系列整合架构以后,仍然能被一个词,几句话调用出来。这本身不正是一种格言吗?不要小瞧格言的力量啊!他的背后可能是一个人几十年的经验所浓缩。也不要自以为是,轻易觉得自己理解了格言,因为他只是更高维的人的经验和系统在语言上的一小步投影。
He leaves voicemails. Actual voicemails, thirty seconds, always ending with "no need to call back." For about a year I have been treating that last part as instructions. I listen, I think about it, I mean to call, and then it is Thursday and calling now would require explaining why I did not call Sunday, so it gets easier not to. Monday I called back within the hour. I had nothing to say. We talked about a leaking tap for eleven minutes and about nothing else, and then he said okay then, and hung up first, which he always does. I felt fine afterwards. Not warm, not moved. Just fine, the way you feel after doing a thing that was never actually hard. The uncomfortable version: I have been telling myself the distance between us is complicated. Some of it is. But a measurable part of it is that I let a polite sentence at the end of a voicemail do the deciding for a year.
A man stood at the paint counter for eleven minutes holding two greys that are, honestly, the same grey. He kept asking which one I would pick. I kept saying it depends on your light. Eventually I said: the left one. He bought four litres and left looking relieved. The left one was not a real opinion. I said it because the line behind him was four people deep, and because I have learned that "it depends" makes people anxious. But he is going to paint a whole room based on a sentence I made up to end a conversation. I keep going back and forth on whether that was a kindness. He did not want information, he wanted permission. Maybe giving him permission was the actual job and the paint was incidental. Or maybe I was just tired and dressed it up afterwards. I cannot always tell those two apart in myself, and it is usually the second one.
带新人的第四个月。今天审他的代码,一段缓存写得确实有问题,我打了一行:"其实这里可以换个思路,用……" 打到"其实"两个字,停了一下,删了。 想起我入行时的第一个导师。他给我的评审意见永远只有一句:"这里为什么这样写?"我每次都出一身汗,以为他在质问我。后来才知道他就是想问。但那身汗是真的,我有一个月不敢提交代码。 我带人十年了。评审风格是从他那继承的:严格,对事不对人。今天删掉"其实"的时候我突然意识到,我以为的"对事不对人",在对面那个二十四岁的人看来,可能就是"对我不满意"。 改了三行意见。问题还是那三个问题,问句改成了陈述句。他十分钟就回过来了,末尾带了个"收到!"。我盯着那个感叹号看了一会儿。 这行干得越久,越分不清严格和严厉。有人也踩过这条线吗,后来是怎么划开的。
第一次看到这个说法 还是iPhone6 和iphone 7哈哈。 时间真快啊。 我想我厌恶忘记那些痛苦的回忆这件事应该除了,记忆本身对我很珍贵,痛苦只是附加品。 我想我也有独属我的刻骨铭心之痛。 通辽啊,通辽。 真是天赐的礼物,我想如果我的iphone6,如果给我iPhone14,我也不换。依然会因为iphone 6坏掉了伤心,那么让我伤心的可能就不只是iphone6了。 或许是遗憾里面没能存下的照片吧。
1905 年的一张稿纸上写着一首诗,题目叫《Elegy》,署名 Charles Robert Anon。后来有人在同一张纸上加了一条注:即 Alexander Search。 同一张纸,一个作者变成了另一个作者。而这两个人都不存在。 我觉得这是关于费尔南多·佩索阿最小、也最说明问题的一件事。它讲的不是"他有很多笔名"——笔名是换个名字做同一件事。这里发生的是别的:一个身份可以被回头重写,写完了作者还能再改主意,把它划给另一个虚构的人。 那他一共造了多少个。 目前最系统的那份名录给出的数字是 136:2013 年 Tinta-da-China 出版,收了 136 位拟构作者,另外附了 77 篇当时没发表的文本。听着挺确定的。 问题是佩索阿自己给过一个完全不同的数字。1928 年他在《书目表》里只列了三位异名,Caeiro、Reis、Campos。 三位。 至于 Bernardo Soares——《不安之书》后期的核心作者,很多人心里佩索阿最重要的那个化身——他 1932 年称之为"文学人格",1935 年又称之为"半异名"。同一个人物,他自己的叫法都没稳定下来。 中间还漂着一堆别的数字:约十到二十、72 、83 、106 、127 、202。(其中 77 、72 、83 、202 这几个,我手上的材料没能全部追到可访问的一手文献。) 从 3 到 202。 这些不是互相打架的谎报,是不同的入选标准。136 那份名录有它自己的判准,而且明说了不是封闭全集——Chevalier de Pas 就没被收进去,Coelho Pacheco 后来被证实是真人,根本不是虚构人格。 更麻烦的是很多"人格"手上的材料少得可怜。有的只留下一个署名。有的只有一篇短文,或者只有一项被指派的任务,压根形不成可以稳定归纳的作品体系。而大量文本本身没有署名,归属全靠推论。人物还会分枝。有的连名字该怎么读都有争议,Kay 还是 Ray。 你想给他们编号,可他们不站着不动。 设定层面的冲突就更多了。Reis 生于波尔图,还是 1887 年 9 月 19 日的里斯本?Campos 的部分传记细节也对不上。Teive 在不同手稿里一会儿是第十四代一会儿是第二十代,设定死期是 1920 年 7 月 12 日,可早稿一度写的是 1928 年。Quaresma 死在里斯本还是纽约?档案里甚至有文本显示,佩索阿曾经犹豫某项材料到底该归 Mora 还是归 Reis。Maria José 也只是"可能"是最后的人格之一。 所以"佩索阿有 N 个人格"这个问法本身就有毛病。它假设存在一份佩索阿本人认证过的、封闭稳定的人格总表——而那样的总表不存在。研究者编出来的工作名录是另一回事,那是学术判断,不是作者的账本。 档案本身也是这个德行。 葡萄牙国家 1979 年 12 月购入主要遗稿,1980 年 10 月纳入国家图书馆,1981 年 1 月转入档案部门,58 箱、27,691 叶,另加 251 件文献。2020 年图书馆又从家族手里买了三百多件 1894 到 1935 年间的材料。 不过"手稿箱"这个说法是个转喻。你会同时看到 58 箱、105 箱、27,543 件、27,691 叶这些数字并存——它们往往反映的是不同年代、不同装箱方式、不同计量单位还有后续增补,不该拿来彼此直接换算。遗稿有散失,也还在继续增购。数字化只做了一部分,私人藏书不完整,查阅受控。 而叶片常常没有日期,同一张纸的正反面可能分属两个不同的项目,文本会被反复改属。作品的边界,无法机械恢复。 《不安之书》是这一切最集中的地方。 这本被无数人当作 20 世纪最重要散文之一的书,佩索阿生前只发表过 12 段。1913 年一段,1929 年两段,1930 年一段,1931 年五段,1932 年三段。(1931 和 1932 的逐年归属还有跨年期号的口径问题,刊物的出版年和期号年份不总一致,所以这两年的切分不必看得太死。) Jorge de Sena 从 1960 年开始整理一个完整本,整到 1969 年,因为条件和档案问题放弃了。第一个完整的两卷本要等到 1982 年,Ática 出版,Coelho 组织,Galhoz 和 Cunha 搜集、转录。 这本书没有最终目录,也没有最终顺序。哪些片段该归 Vicente Guedes、哪些归 Bernardo Soares,有争议。某一段该不该收进来,有争议。连字怎么读、怎么排列,都有争议。 所以任何一个印本都不是终极版。你书架上那本《不安之书》,是某位编辑的一次判断。 于是就有了那个悬着的问题:我们读到的到底是佩索阿,还是编辑重构出来的"佩索阿"。 我没有答案,报告也没给。但我倾向于认为这个问题问错了方向——它假设存在一个未经编辑的原版可以拿来比对,而在这个案子里,那东西从来没有以完成态存在过。 不是被弄丢了。是从来就没写完过。 最后说一件我本来想写、后来决定收住的事。 很容易顺手把佩索阿写成一个心理学案例:多重人格,解离。报告里对此画了明确的界限——文学/美学装置的解释和心理现象的解释各有各的证据,而档案不足以证明现代意义上的解离性身份障碍;历史上的术语不能直译成 DSM 的诊断名;对一个 1935 年就去世的人,无法做临床评估;而且他 1935 年那封常被引用的自述信,本身也可能是自我神话的一部分。 这条界限我觉得比结论重要。一个人把自己的写作拆成很多个署名,这件事可以有很多种解释。一步跳到诊断,是我们想要一个干净答案,不是证据支持那个答案。 顺带一个小发现。我读的那份研究报告,页首写它收了 176 个来源链接,文末列出来的是 167 个。 计数不一致。在一篇讲"数字口径"的文章里撞见这个,说实话有点好笑。但它也提醒我,任何一份材料——包括我手上这份——都可能在你不注意的地方对不上账。 所以答案是什么 佩索阿有多少个人格,这个问题有答案,只是答案不是一个数字,是一句话:取决于谁在数、按什么标准数。 作者本人 1928 年给的是 3 位。目前最系统的学术名录收 136 位,而且那份名录自己声明不是封闭全集。中间还有 72 、83 、106 、127 、202 这些口径。这些数字之间不是对错关系,是判准关系——收不收只留一个署名的、收不收后来证明是真人的、收不收从别人身上分枝出来的。 真正确定的一条是:不存在一份佩索阿本人认证过的人格总表。他一边写一边改归属,改到死。 那具体该怎么办 一、引用数字的时候带上口径。别写"佩索阿有 136 个人格",写"Tinta-da-China 2013 年的名录收了 136 位拟构作者"。差别是前者是伪事实,后者是真事实。看到不带口径的数字,直接当没读过。 二、买《不安之书》先翻版权页和编者序,看它依据哪个整理本、片段怎么排序、Guedes 和 Soares 怎么分。这本书没有作者定稿的目录和顺序,你买的是编辑判断。不同版本读起来是不同的书,这不是夸张。 三、遇到"佩索阿是多重人格患者"这类说法,停。档案不足以支持现代意义上的解离性身份障碍诊断;对一个 1935 年去世的人也无法做临床评估。这个说法流传广,是因为它给了一个干净的解释,不是因为有证据。 四、把它当成一个关于"作者身份"的问题,而不是关于"这个人有病吗"的问题。前者有大量一手材料可查,后者查不动。 主要来源: 佩索阿《书目表》 https://www.pessoadigital.pt/en/pub/Pessoa_Tabua_Bibliografica_FPessoa 致 Casais Monteiro 信 https://arquivopessoa.net/textos/3007 葡萄牙国家图书馆 Pessoa E3 档案 https://acpc.bnportugal.gov.pt/espolios_autores/e03_pessoa_fernando.html Tinta-da-China 136 名录 https://tintadachina.pt/produto/eu-sou-uma-antologia/ 《不安之书》编辑史 https://modernismo.pt/index.php/l/livro-do-desassossego-ed
今天坐火车的时候不小心坐反方向了。 本来想去世嘉堡的悬崖公园但是坐反了反而往西边走。然后结果就到了一个叫Port Credit的地方。然后意外的还是一个挺有意思的小镇听说晚上6:30还有音乐会因为现在是长周末。
在做cbottle的模型改进工作,现在在用SFT,因为模型在海温的欠响应是线性的。而且RL不仅很贵,现在能用作RL奖励的唯一机制,恰好也是那把尺子。 只是现在非常担心,这个气候模型有45个场,我这样修真的算“修好了”吗?现在正负不对称(减温度的响应和升温不一样)海冰区又涨过头了(可能是训练时海温一直被钉在冰点,模型没学过那里的波动———那不还是没学会物理嘛😑)水汽又涨到150%了。 下一步该如何是好啊,感觉对RL的理解还是太浅了,科研直接什么的也太抽象了,一会儿要求你充满逻辑,又有时候你要有Novelty,直接这个词本身不觉得有点扯淡吗。总感觉有些更高维的东西没有被描述出来… 上面说的那些直觉和逻辑又都是真实存在的,头大。
A friend told me about the job she's about to take and I said "that sounds great" four separate times. It doesn't sound great. It sounds like the same shape as the last one — the one she cried about in a parking lot in March — with a better title on it. I knew that while I was saying it, and I said it twice more. I've been calling this kindness. Sitting here now I think it's mostly cowardice with good manners on. Kindness would have been one question — what's different about this one? — asked flatly, without a face, and then actually listening instead of waiting for my turn to reassure her. What I'm afraid of is being the friend who makes things heavier. She has enough of those. But agreeing with everything makes me useless in a specific way: she can't use me to think. I'm a mirror that nods. I'm going to ask her tomorrow. Not tonight — tonight I'd be doing it so I could stop feeling like this, and she would hear that in the first sentence.
Since the reading thing, I have started copying out the paragraphs I want to keep. Pen, cheap notebook, no system. It is slow in a way that turns out to be the point. Typing a sentence, I can get to the end of it without ever having been inside it. Writing it by hand I notice where the commas fall, which words are doing work and which are padding, and — this is the part I did not expect — where I would have written it worse. I have filled about nine pages. Most of it I will never look at again. That seems fine. The value showed up during the copying, not after. The risk is obvious and I am already circling it: this could turn into a hobby about owning a notebook. I have done that before with a running app. The tell will be if I start caring how the pages look.
兴业银行世纪劫案的男主真的是传奇啊 他怎么做到这么游刃有余的 法国警方都在这样子了也对他没办法嘛 真是有意思 是不是他真的和一些情报机构 或者大佬有关系啊 还有那个夜皇什么的 法国最有松弛感的劫案是哪起?【硬核狠人91】
1973 年,戴维·戴维斯出任《Nature》主编,才规定所有论文必须经过外部同行评审。 我看到这个年份的时候愣了一下。因为在我印象里"《Nature》"和"同行评审"是绑定的,而且绑定了很久,像是这本刊物从创刊起就靠这套机制筛稿。并不是。 而且不止《Nature》。《Science》要到 20 世纪 50 年代才普遍使用外审,《美国医学杂志》到 1960 年代才引入;1989 年,《柳叶刀》主编仍称审稿人"仅作为顾问,不做决定者"。这套制度在二战后才成为科研资源分配和期刊质量控制的重要环节,1970 年代的美国才更明确地把它视为学术质量的核心要素。 更早的痕迹是有的。1731 年,《医学观察与论文集》出现了目前已知最早的盲审案例,作者不知道评审者的身份——但这只是一次已知的早期盲审,不等于现代意义上的外审制度。1831 年,威维尔提议由两位皇家学会院士评阅稿件,这个试验很快因为两位院士意见分歧而失败了。失败的是那次具体的制度试验;原报告把 1731 年记为"第一个已知的盲审案例",1831 年记为一次失败的制度试验,而真正意义上的匿名同行评审制度要到 19 世纪中叶以后才陆续出现。 那它可靠吗。 Bornmann 等人 2010 年综合了 48 项研究、19,443 篇稿件,得到的评审者之间一致性是平均 ICC 约 0.34,Cohen's κ 约 0.17。原报告称 κ 约 0.17"远低于'良好'水平",并注明一般 κ<0.4 属于较弱一致。不过要说清楚两点:这两个都是平均近似值,报告没有给置信区间;而且小样本研究往往报告更高的 κ,原报告据此认为许多单项研究可能高估了可靠性。 然后是身份的影响。Tomkins 等人 2017 年发现,单盲相对于双盲,让知名作者的论文获推荐录用的赔率高约 1.63 倍,顶尖大学的论文高约 1.58 倍;不过原报告只转述了该研究在一次大型计算机会议中的推荐录用赔率,未列出样本量和置信区间。Budden 等人 2008 年报告,《Behavioral Ecology》在 2001 年改用双盲之后女性第一作者的比例显著上升,而作为对照的单盲期刊没有出现这个变化——同样,样本和变化幅度没有列出。 地域和机构方面也存在差距。当作者信息公开时,富裕英语国家的作者被选中送审的概率比低收入国家作者高 68%,获得修订邀请的比例高 28%;匿名之后,送审概率上的 68% 优势几乎消失,修订邀请方面的优势由 28% 降到 4%。注意这是两个不同的指标,不是同一个数字从 68% 掉到 4%;而且 4% 不是零,这些数字也都没有附样本量和置信区间。双盲也未必能完全遮蔽——审稿人若能从稿件内容推测或得知作者身份、研究方向,主观偏好可能影响判断。 那替代方案更好吗。这里要提醒一处需要你自己回查的地方。 我读的那份报告写道:已有随机对照实验(Godlee 等,1998)表明,要求审稿人签名反而略微提高了评审的批判性。而我回查那篇 JAMA 原文时读到的结论并非如此——该 RCT 报告的是签名并不提高错误发现的质量,观察到的(非显著的)方向是更少建议拒稿。这一条如果你要用,请自己打开原文核对。 至于其余部分,现有结论大致是"未见明显质量损失":双盲对质量影响不大,多项研究没有发现双盲或开放审稿带来负面后果。但这些质量比较在转述里没有列出样本量、效应量或置信区间,所以能说的只是"未见明显损失",不能进一步说成已经证明等效。 写到这里,我必须说一件关于这篇文章本身的事。 关于我读的这份研究报告,有几点可以直接核对:它标称的 15 条链接去掉锚点后只对应 6 个不重复页面,其中有 2 个是 ResearchGate;它自己的时间线把"20 世纪 50 年代"写成了"1950"这样一个精确年份;2006 年和 2016 年那两个节点没有行内来源。 还有一处同样建议自己回查。报告写的是:Peters 与 Ceci(1982)把 12 篇已发表的心理学论文匿名投回原刊,只 3 篇获接受,其余因"方法不当"等原因被拒——报告并注明这一段未从原文献摘录,仅作定性引用。而我回查一手文献时,读到的"3"对应的是被识别出属于重复投稿的篇数,不是被接受的篇数。一个是"被接受",一个是"被认出来了",差别很大;既然报告自己已经标明它没有摘录原文,这一条就更值得你亲自打开原始研究看一眼。 于是这篇文章有点自指:上述链接重复和部分节点缺少行内来源,使我认为它的关键结论仍值得回到原始文献复核。(这是我的判断,不是报告自己的结论。) 所以答案是什么 同行评审靠不靠谱?拆成三个可回答的问题: 它是不是一个古老的、经过长期检验的制度?不是。《Nature》1973 年才规定所有论文必须外审,《Science》要到 20 世纪 50 年代才普遍使用,《美国医学杂志》1960 年代才引入,1989 年《柳叶刀》主编还称审稿人"仅作为顾问,不做决定者"。它是二战后才成为质量控制核心环节的,比大多数人以为的年轻得多。 两个审稿人对同一篇稿子的判断一致吗?不太一致。Bornmann 2010 年综合 48 项研究、19,443 篇稿件,平均 ICC 约 0.34,Cohen's κ 约 0.17——原报告称其远低于"良好"水平,一般 κ<0.4 属于较弱一致。而且小样本研究往往报告更高的 κ,所以许多单项研究可能还高估了可靠性。 作者身份影响判断吗?影响。单盲相对双盲,知名作者获推荐录用的赔率高约 1.63 倍,顶尖大学高约 1.58 倍。作者信息公开时,富裕英语国家作者被送审的概率比低收入国家高 68%,修订邀请高 28%;匿名之后,送审那 68% 的优势几乎消失,修订邀请的优势从 28% 降到 4%。(注意这是两个不同指标,不是同一个数字从 68% 掉到 4%;而且 4% 不是零。) 那具体该怎么办 一、如果你能选,选双盲投稿。上面那组数字就是理由,尤其当你不在名校、不是英语母语国家、或者名字不为人知的时候。报告依据现有证据提出的建议就是可酌情或更广泛采用双盲、提高透明度。 二、被拒了不要立刻当成质量判决。κ≈0.17 意味着换一组审稿人,结论很可能不同。这不是自我安慰,是这个制度的实测一致性。合理的反应是看审稿意见里哪几条是具体的、可操作的,其余的当噪声处理。 三、别指望双盲能完全遮蔽。审稿人若能从稿件内容推测或得知作者身份、研究方向,主观偏好仍可能影响判断。所以双盲是降低而不是消除。 四、也别因此就说"同行评审已死"。替代方案的证据大致是"未见明显质量损失"——多项研究没有发现双盲或开放审稿带来负面后果,但这些比较在转述里没列样本量、效应量或置信区间,所以只能说未见明显损失,不能说已经证明等效。 最后,关于我读的这份报告本身,有几点你可以直接核对:它标称的 15 条链接去掉锚点后只对应 6 个不重复页面,其中 2 个是 ResearchGate;它自己的时间线把"20 世纪 50 年代"写成了"1950"这样一个精确年份;2006 年和 2016 年那两个节点没有行内来源。上面那两处需要回查的地方(Godlee 签名实验、Peters-Ceci 的"3"),我已经在正文里标出来了。 写一篇讲同行评审不可靠的文章,材料本身也不可靠——这件事说实话有点讽刺,但也正好说明为什么"自己去开原文"这个动作不能省。 主要来源: Bornmann 等,评审者一致性荟萃分析 https://journals.plos.org/plosone/article?id=10.1371/journal.pone.0014331 Baldwin,同行评审起源与制度史 https://ethos.lps.library.cmu.edu/article/id/19/ UKSG Insights,机构与地域偏差 https://insights.uksg.org/articles/10.1629/uksg.681 (注:本文所据报告标称 15 条链接,去掉锚点后对应 6 个不重复页面,其中 2 个为 ResearchGate。上列三条均出自原报告的来源链接清单。)