耿同学揭露的是生物圈的冰山一角。除了Nature上的生物学文章,恐怕只有LV大家看到的第一反应是怀疑是不是假货吧。
所以我不会崇拜那些频频出顶刊的实验室,也不会鄙视一个一辈子发不了CNS的实验室。两者的区别可能只是对严谨性的要求不同。
生物学造假多,根源在于期刊的评价标准有问题。首先是对Novelty的要求。真正novel的东西是非常少的。我在我们领域写过40+ benchmark中的最佳performance算法。已经达到炉火纯青,随时可以产出的程度。但是20年来,我认为我有一定novelty的工作只有两篇,也是我唯二两篇最后落地的工作。可是我们领域每个月都至少发表20篇正刊或者大子刊,每一篇都在展示novelty。大部分是manufactured的novelty。可以用更简单的方法解决的问题,为了novelty要屎上雕花。
我唯二两篇有点novelty的文章都发在4分左右的杂志上。是因为lack of follow-up validation。文章要求跨专长validation,是促成造假的第二个原因。从做理论,做湿试验,到clinical验证,中间的跨度很大。不是一篇文章的时间线上能做出来的。这样的validation基本是为了满足评审去cherry pick。有些在A体系里正确的东西,也未必在B体系里正确。好比不能说相对论是对的,牛顿力学就不应该发表。
允许negative results的发表,允许只发表数据而无insight,允许不发表,都是治标不治本的。唯一可以根本解决这个问题的方式,是在科研体系内全面建立著名的神经网络结构—generative adversarial network (GAN)。
目前我们已经有了很强的generator部分,期刊上发的都是generative的成果。缺少的是对成果正确性判断的discriminator部分。我认为如果一个研究的成品是驳斥了一篇nature,这项研究也理应发在Nature上。如果一个学校要求三篇文章毕业,通过研究驳斥三篇文章也应该授予博士学位。期刊和基金至少应该留一半用来左右手互搏。
真理是越辩越明的。Academia从亚里士多德的时代就建立在辩论的机制之上。而现在的生物科研体系问题是没有任何辩论的预算。昨天我参加了一个PhD defense。小朋友问我,“That's not a real defense,right?” PhD defense本应是科研工作者的一生的第一个defense。可是现在连高中生都看透了在我们生物圈,没有真正的defense。
我这篇文章提出的原理和方案,恐怕要比绝大多数Nature上发的文章更加严密。但是,我这篇文章必然是发不了Nature的,因为这篇文章lack of novelty and lack of follow-up validation。