标签
作者介绍了一个名为'llmog'的工具,该工具使用LLMs自动标注数据集,可以通过llama.cpp或vllm在本地运行,或使用外部API,适合偏好界面操作而非编码的用户。
介绍DocAnnot框架,该框架使用大型视觉语言模型、OCR以及一种空间感知的上下文匹配算法,自动生成用于文档关键信息提取的训练数据集,减少人工标注工作量。在CORD和SROIE基准测试中评估,取得了合理的F1分数,并实现了高效的人工验证。