Saturday, August 15, 2026

2025-9-26 AI写的paper已经实现了从量变到质变

 

这次写proposal调研了一下近期的文献。总的来说,这一批AI产出的文章,句型句长更整齐划一了。以前时常能读到带有个人情绪的段落。现在完全没有。图越来越复杂,10个panel很常见,像一种行为艺术。方法和结论普遍更为惊人。充分体现“人有多大胆,地有多大产”。

早在AI以前,不少大牛的发迹,都带着一点欺诈和一丝谄媚。记得几年前,某热门领域一小牛犊做了一个benchmark,本想趁此拉拢各山头。万未想到,诸多发在各顶刊的方法,鲜有跑过随机线的。后来那benchmark文章投稿时,屡屡受阻。聪明的小牛犊请来业界大牛“指导”。大牛舐犊情深,点拨了一些绝招。后来,小牛犊把实验跑出来gold standard对着大牛的计算方法各种调整,最终成功发表。再后来,大牛变成了老牛,牛犊变成了大牛。

类似情况,自炼金术始源源不断:花费海量资源,产生海量数据和海量教授。等到领域冷却了,这批教授也大都tenure了。如此循环尔。

而AI的出现,将会进一步加快塑造大牛的速度。毕竟,过去能得到大牛点拨的,只是极个别一脉相承的牛犊。而现在打开ChatGPT,各种抽象的idea和方法,俱扑面扑来。

我这次主要是调研我比较熟悉的一个数据。没想到,预测精度已经是动辄0.9。而这类数据实验做两遍,重复性也就最多0.6-0.7。这些高精度,似乎大都是C兄的贡献:只要抱上foundation model,transfer learning, agent的大腿,就不必考虑道德伦常了。

又翻了翻曾涉足的另一领域。那时学生data leak的时候,我常批评学生,你就是让同一个人死两遍,也不可能如此精准。看看现在的情况,还是我太不识时务了。

人本性,爱奇迹。亩产万斤能报上去首先要有许多人相信。各宗教的传播也深深依赖这个心理特点。AI的blackbox让大家误以为能产生人间奇迹。另有一种因素,作者本人亦无法鉴别出AI产生的逻辑错误。chatgpt给出的推理和程序漏洞,更难甄别。

AI培养出来的大牛,应该和以前那些思路比较开阔的大牛一样,会对社会有较大贡献的。大部分的教授,无论如何,一生并做不出什么。这些大牛们,至少为社会提供了几十个工作岗位。是社会分配资源的重要节点。

假作真时真亦假。有的时候就这么鼓捣鼓捣,后来便成就了真正推动历史的大儒。毕竟,资源是一切的基础。的确有一小部分人有了资源之后开始出真东西了。这种笔者也见过一二。近的认识的不说。现代生物的鼻祖,孟德尔的数据也是大量筛捡过的。那么也未可知,AI写出的种种亩产万斤,或有一天真的能登陆火星。

No comments:

Post a Comment