@VikParuchuri: 我们正在开源一个9B模型,它可以从文档中提取结构化数据,性能接近前沿水平。 - 90.2% 在我们基准测试上…
摘要
Vik Paruchuri 正在开源一个9B模型,该模型可以从文档中提取结构化数据,性能接近前沿水平(在其基准测试中达到90.2%,而Gemini 3.5 Flash为91.3%)。
我们正在开源一个9B模型,该模型从文档中提取结构化数据,性能接近前沿水平。
- 在我们的基准测试中达到90.2%,而Gemini 3.5 Flash为91.3%
- 领先于NuExtract3等提取模型(81.5%)
- 9.5秒的p50时间
- 通过JSON Schema https://t.co/zIdRbGjaY5
查看缓存全文
缓存时间: 2026/06/20 14:35
我们正在开源一个9B参数的模型,能够以接近顶尖的性能从文档中提取结构化数据。
- 在我们的测试基准上达到90.2%,而Gemini 3.5 Flash为91.3%
- 领先于NuExtract3(81.5%)等提取模型
- p50处理时间为9.5秒
- 通过JSON模式验证 https://t.co/zIdRbGjaY5
相似文章
开源模型正以约1.5倍于前沿模型的速度缩小与GPT/Claude/Gemini的编码差距,且在去污染基准测试中,一个27B模型已经击败了Claude Opus 4.8 [实时仪表盘 + 分析]
一个实时仪表盘和统计分析显示,开源编码模型正以1.5倍的速度缩小与闭源模型的差距,一个27B模型已经在去污染基准测试中超越了Claude Opus。工具调用可靠性仍然是主要瓶颈。
@VikParuchuri: 我们正在推出 turbo mode 数据提取——比 Azure Content Understanding 快 5 倍、便宜 5 倍,且准确度高 7%……
VikParuchuri 宣布推出 turbo mode 数据提取,声称速度比 Azure Content Understanding 快 5 倍,成本低 5 倍,准确度提高 7%,并且实现了具有竞争力的延迟,适用于实时工作流。
@googleaidevs:我们想看看Gemini 3.5 Flash-Lite如何处理大规模、重复性的视觉任务。此演示让模型处理超过100万张…
Google AI 演示了 Gemini 3.5 Flash-Lite 处理超过100万张目录图片,以低延迟和高效令牌提取结构化数据,适用于大规模工作流。
@NielsRogge: 没错,一个3.9GB的文件在Math 500上取得了99.2%的准确率。这个数据集由@OpenAI在论文《Let's verify step by step》中引入…
PrismML的Bonsai-27B模型在Math 500数据集上取得了99.2%的准确率,超越了DeepSeek-R1和Kimi K2。
@VikParuchuri:这是 lift(我们的开源提取模型)从一份杂乱的26页合同中提取结构化数据。
Vik Paruchuri 展示了 lift,一个能够从杂乱合同中提取结构化数据的开源提取模型。