@josefchen:在arXiv上发布我们的新论文:我们训练了有史以来最大的多语言食品模型。410万食谱。7种语言。…

X AI KOLs Timeline 论文

摘要

新的arXiv论文宣布了最大的多语言食品模型,该模型在7种语言的410万食谱上训练,包含1,790种食材,压缩至2MB。

在arXiv上发布我们的新论文:我们训练了有史以来最大的多语言食品模型。 410万食谱。7种语言。1,790种食材。300维。 所有人类烹饪被压缩成2MB。https://t.co/b4GiZ62UMt
查看原文
查看缓存全文

缓存时间: 2026/05/26 23:15

在arXiv上发布我们的新论文:我们训练了有史以来最大的多语言食物模型。

410万食谱。7种语言。1,790种食材。300维。

所有人类烹饪压缩进2兆字节。https://t.co/b4GiZ62UMt

相似文章

SIMMER: 基于MLLM的跨模态食物图像-食谱检索

arXiv cs.CL

SIMMER提出了一种新颖的基于MLLM的嵌入方法,用于跨模态食物图像-食谱检索,用统一编码器替代传统的双编码器架构,在Recipe1M数据集上取得了最先进的结果,相比先前方法有显著改进。

MiniCPM-V 4.5:通过架构、数据与训练配方打造高效多模态大语言模型

Papers with Code Trending

MiniCPM-V 4.5 是一款 8B 参数规模的多模态大语言模型,凭借统一的 3D-Resampler 架构、创新的数据策略以及混合强化学习方法,实现了高效率与卓越性能。据悉,该模型在显著降低 GPU 显存占用与推理耗时的同时,综合表现已超越更大规模的闭源及开源标杆模型。