但作者指出该系统仍有局限性,新学网如归因能力有限和引文幻觉。闻科以鼓励进一步研究和优化。优化引文此外,幻觉研究显示,新学网OpenScholar生成的闻科答案在50%到70%的情况下比专家注释器的答案更有用。比如,优化引文LLM可以提供协助,幻觉网站转载,新学网OpenScholar的准确率比GPT4o和PaperQA2(一个文献综述工具)这类现有系统分别高出6.1%和5.5%。相关研究成果2月5日发表于《自然》。微调科学过程和引导新发现都很重要。并强调基于语言模型的系统无法使科学文献综述完全自动化。
相关论文信息:https://doi.org/10.1038/s41586-025-10072-4