标签
本文介绍了ThReadMed-QA多轮医疗对话数据集,并评估了五种大语言模型在纠正患者误解方面的表现,发现后续轮次中性能显著下降。
Emily Bender 澄清了她2021年论文中“stochastic parrots”的原始含义,驳斥了关于大语言模型的常见误解,并批评“人工智能”一词过度推销技术。
一个关于AI能力常见误解的讨论问题。