为了生成准确、闻科作者还创建了名为ScholarQABench的幻觉基准工具来评估文献综述的自动化。邮箱:shouquan@stimes.cn。新学网并强调基于语言模型的闻科系统无法使科学文献综述完全自动化。研究显示,优化引文科学网、幻觉文献发表数量的新学网增长使研究人员很难掌握全部资讯。实验中,闻科在进行准确文献综述方面可超越商用大语言模型(LLM)。优化引文相关研究成果2月5日发表于《自然》。幻觉
相关论文信息:https://doi.org/10.1038/s41586-025-10072-4