本文探讨了我们对 arXiv 上 AI 生成内容的质量进行评估的方法。通过分析论文的结构、语言风格和内容相关性等指标,我们试图量化 AI 在学术写作方面的能力。然而,在实际操作中,我们发现了一些关键问题,例如:


📎 原文:How we measured AI writing across arXiv, and where the measurement breaks | 来源:Hacker News