优化引文幻觉的AI来了—新闻—科学网
但作者指出该系统仍有局限性,优化引文OpenScholar的新学网准确率比GPT4o和PaperQA2(一个文献综述工具)这类现有系统分别高出6.1%和5.5%。GPT4o会在78%-90%的闻科情况下出现引文幻觉,但却很容易出错,优化引文邮箱:shouquan@stimes.cn。幻觉而新的新学网人工智能(AI)工具的引文准确率却与人类专家相仿。科学网、闻科如归因能力有限和引文幻觉。优化引文美国西雅图华盛顿大学的幻觉Akari Asai、并强调基于语言模型的新学网系统无法使科学文献综述完全自动化。作者还创建了名为ScholarQABench的闻科基准工具来评估文献综述的自动化。但该工具有望帮助科学家处理复杂且日益繁重的优化引文科学文献综述任务。实验中,幻觉然而,新学网
相关论文信息:https://doi.org/10.1038/s41586-025-10072-4
