The Why, What, How and When of Big Science evaluation. Perspectives on socio-economic assessment of research infrastructures
本文认为,大规模研究基础设施的社会经济评估必须通过解决在合理性、方法论、沟通和治理方面的关键挑战,从偶发性的合规性练习演变为集成的生命周期管理工具。
原始论文采用 CC BY 4.0 许可(https://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
大型科学设施,通常被称为“大科学”(big science),是现代发现的巨大引擎。可以将它们想象成窥探遥远宇宙的巨型望远镜、通过粉碎原子来揭示物质基本组成部分的粒子加速器,或是试图复制恒星能量的核聚变反应堆。这些不仅仅是实验室;它们是研究基础设施,是耗资数十亿进行建设和运行、需要数十年规划与国际合作的庞大机器。由于它们成本高昂且依赖公共资金,一个关键问题随之而来:它们真的为社会带来了回报吗?仅仅知道它们产生了新的科学论文是不够的。政府和公民希望知道,这些投资是否激发了新产业、创造了就业机会、改善了健康或解决了全球性问题。这便是社会经济评估的领域,一个致力于衡量这些科学巨头真实世界价值的学科。多年来,人们一直预期每一项重大设施都应严格证明其价值,但现实情况却远为复杂。
一项新的分析汇集了来自整个欧洲科学界的专家,旨在探讨为什么存在这种差距以及如何解决这一问题。作者通过对从业者和政策制定者的结构化讨论,认为目前评判这些设施的方式是失效的。他们建议,不应将评估视为仅在资助方要求时才进行的、一次性的“打卡式”程序,而应将其作为设施生命周期中持续且整合的一部分。该论文指出,我们应该停止试图证明某台特定的机器导致了某项特定的发明——这通常是一项不可能完成的任务——转而关注该设施如何为更广泛的创新生态系统做出贡献。核心发现是,为了使这些评估发挥作用,必须从项目构思的第一天起就进行规划,并由专门的数据系统提供支持,同时在沟通中要诚实地对待已知的事实和尚不确定的部分。
评估这些项目的理由有三点,且每一项都需要不同的方法。首先是经济论据。科学通常是一种公共产品,这意味着发现带来的益处会惠及所有人,而不仅仅是出资者。由于无法捕获所有的利润,私营企业很少会对基础研究进行足够投资。公共资金填补了这一空白,但必须通过证明收益大于成本来证明其合理性。其次是合法性问题。随着公众监督的加强,科学家们必须能够向普通公民解释,为什么花费数十亿资金建设一台粒子加速器是一个明智的决定。这不仅是关于公共关系,更是关于维护允许这些项目存在的社会契约。第三是实际需求。在设计大型设施时,往往存在多种建设方案或建设时机的选择。评估可以帮助决策者选择最具价值的路径,但这只有在分析发生在蓝图最终确定和资金投入之前时才有效。
然而,衡量这种价值极其困难。一个主要的障碍是归因问题。在现代创新的复杂网络中,几乎不可能从对特定研究设施的特定投资中画出一条直线,直接指向货架上的特定产品。以全球定位系统(GPS)的历史为例。它始于20世纪50年代对卫星信号的一次简单观测,随后演变为潜艇导航系统,最终发展成为如今引导数十亿智能手机的技术。其商业应用在初期是不可见的;它们是通过长期的、曲折的发现过程在数十年后才显现出来的。试图声称最初的研究“导致”了智能手机产业是误导性的。相反,论文认为我们应该观察该设施如何为使此类发现成为可能的生态系统做出了贡献。另一个挑战是衡量那些无法买卖的事物。当科学家在冷战期间与对立政治阵营开展合作时,所开启的外交渠道价值几何?或者,激励一代学生成为科学家的价值又该如何衡量?这些影响是真实且至关重要的,但目前的评估方法难以用美元来衡量。
这些结果的沟通方式与数字本身同样重要。存在一种持续的压力,要求将复杂的评估简化为一个简洁的数字,例如宣称每投入一美元都会为经济带来十美元的回报。作者警告说,这是危险的。它制造了一种虚假的精确感,并鼓励研究人员不断调整模型,直到得到一个有利的数字。它还掩盖了预测未来时固有的不确定性。一种更诚实的做法是呈现可能结果的一个范围,承认未来不是一个单一的点,而是一个概率。这种透明度能让政策制定者理解风险与回报,而不被虚假的确定性所误导。
论文中最重要的建议或许是:评估必须被视为一种全生命周期的活动,而非一次性的事件。目前,许多设施只在建成之后才考虑评估,这造成了数据缺口。等到他们想要衡量影响时,基准数据已经消失,设施与世界之间的联系也变得难以追踪。作者建议,数据的收集应当像机器本身一样,从设计之初就内置到设施的设计中。这意味着要建立详细的记录,包括谁在那里工作、购买了什么以及发表了什么,并以经济学家能够实际使用的形式进行组织。一些设施,如大型强子对撞机的实验,已经以这种细致程度来管理其科学数据;论文认为,它们也应该对社会经济数据采取同样做法。这将允许建立一个持续的影响力叙事,随着设施的成熟而不断更新,而不是一份碎片化的报告集。
论文还涉及了评估的政治属性。决定什么算作成功以及什么不算,不仅仅是一个数学计算;它涉及价值判断。存在一种风险,即设施管理者可能会倾向于塑造其评估结果,使其看起来更出色,从而专注于短期、易于衡量的成果,而忽略了需要数十年才能成熟的长期、变革性的发现。为了应对这一点,作者提到了法国的一种模式,即由一个独立的办公室审查重大政府项目的经济评估质量。这种独立的监督有助于确保分析是诚实的,而不仅仅是作为政治辩护的工具。
最终,作者总结道,我们在衡量“大科学”价值时必须拥有一种谦逊感。我们的工具正在改进,但并不完美。它们难以应对科学发现的长周期以及定义健康社会的无形利益。承认这些局限性并非示弱,而是一种职业上的必要。通过将评估视为科学过程中持续、透明且整合的一部分,我们可以更好地理解对这些“大科学”投资的真实回报。这种转变将使我们从一种为了满足要求而提交报告的“合规文化”,转向一种“学习文化”,即通过获得的洞察来帮助塑造未来更好的科学和更好的政策。目标并不是要证明每一美元的支出都能保证获得利润,而是要建立一个系统,让我们能够诚实地看到这些驱动进步的巨大引擎是如何造福全人类的。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。