@josefchen:在arXiv上发布我们的新论文:我们训练了有史以来最大的多语言食品模型。410万食谱。7种语言。…
摘要
新的arXiv论文宣布了最大的多语言食品模型,该模型在7种语言的410万食谱上训练,包含1,790种食材,压缩至2MB。
在arXiv上发布我们的新论文:我们训练了有史以来最大的多语言食品模型。
410万食谱。7种语言。1,790种食材。300维。
所有人类烹饪被压缩成2MB。https://t.co/b4GiZ62UMt
查看缓存全文
缓存时间: 2026/05/26 23:15
在arXiv上发布我们的新论文:我们训练了有史以来最大的多语言食物模型。
410万食谱。7种语言。1,790种食材。300维。
所有人类烹饪压缩进2兆字节。https://t.co/b4GiZ62UMt
相似文章
加速研究人员和开发者使用新开放数据集构建多语言AI(7分钟阅读)
GitHub宣布推出GitHub多语言仓库数据集,这是一个开放的元数据集,涵盖4000万个仓库中的超过8000万条分类记录,旨在帮助研究人员和开发者构建多语言AI工具。
@vllm_project:我们刚刚上线了 http://recipes.vllm.ai 的重大改版。“如何在硬件 Y 上为任务 Z 运行模型 X?”现在有了……
vLLM 推出全新设计的 recipes 站点,可把任意 HuggingFace 模型地址一键变成适配指定硬件与任务的即用推理配方。
SIMMER: 基于MLLM的跨模态食物图像-食谱检索
SIMMER提出了一种新颖的基于MLLM的嵌入方法,用于跨模态食物图像-食谱检索,用统一编码器替代传统的双编码器架构,在Recipe1M数据集上取得了最先进的结果,相比先前方法有显著改进。
@raphaelsrty: 我们的LateOn模型以1.4亿参数取得了强劲结果。与LateOn无关,我对正…
拥有1.4亿参数的LateOn模型取得了强劲结果,社区对多向量模型的进展感到兴奋,包括新的CPU索引和多语言支持。
MiniCPM-V 4.5:通过架构、数据与训练配方打造高效多模态大语言模型
MiniCPM-V 4.5 是一款 8B 参数规模的多模态大语言模型,凭借统一的 3D-Resampler 架构、创新的数据策略以及混合强化学习方法,实现了高效率与卓越性能。据悉,该模型在显著降低 GPU 显存占用与推理耗时的同时,综合表现已超越更大规模的闭源及开源标杆模型。