文献综述:MELTing point:移动设备上语言Transformer的评估 | 在手机上基准测试LLMs
摘要
本文献综述介绍了MELT,这是一个用于在移动设备上评估大语言模型(LLMs)的基准测试,突显了在手机上运行Transformer的挑战与机遇。
暂无内容
相似文章
文献综述:边缘端LLM推理:持续负载下移动设备、NPU和GPU的性能效率权衡 | 手机上LLM的Bnechmarking [R]
本文献综述分析了持续负载下移动设备、NPU和GPU上LLM推理的性能效率权衡,重点关注手机上LLM的基准测试。
基于Transformer的语言模型在垂直领域中的应用:架构、应用与批判性评估
对基于Transformer的语言模型的全面综述,涵盖架构、在医疗、金融、法律等垂直领域的应用,以及对计算成本、对齐和数据来源等权衡因素的批判性评估。
LLM基准测试
一项关于大语言模型基准测试的研究或报告,可能比较了各种任务上的表现。
@v0xium: 我强烈推荐阅读Dan Jurafsky和James H. Martin的《Speech and Language Processing》中的Transformer章节…
推荐阅读Dan Jurafsky和James H. Martin的免费书籍《Speech and Language Processing》中的Transformer章节,这是理解LLM背后数学的最佳资源之一,并包含引用关于LLM预训练的解释。
Transformer 可扩展性危机:现代语言模型中性能墙的首次全面实证分析
本文对 118 个 Transformer 模型进行了首次大规模实证分析,揭示了关键的性能墙,其中成功率从 512 token 时的 88.1% 下降到 2048 token 时的 0%,挑战了主流的缩放假设。