open-llm

标签

Cards List
#open-llm

从零到英雄:为亚美尼亚打造开放的LLM生态系统

arXiv cs.LG · 2026-09-04 缓存

本文整理并发布了针对亚美尼亚语的开放数据集和模型,展示了通过新闻和STEM数据进行持续预训练可以提高性能,并解决低资源NLP中的数据稀缺问题。

0 人收藏 0 人点赞
#open-llm

面向多语言机器翻译的开放大型语言模型无参考后训练

arXiv cs.CL · 2026-08-12 缓存

本文来自小米,介绍了面向多语言机器翻译的无参考后训练,将带有质量评估奖励的GRPO应用于MiLMMT-46-v0.1 SFT模型,生成MiLMMT-46-v1.0,该模型提升了46种语言的翻译质量,并超越了开放和专有基线。

0 人收藏 0 人点赞
#open-llm

开放大语言模型的无参考后训练用于多语言机器翻译

Hugging Face Daily Papers · 2026-08-11 缓存

本文介绍了MiLMMT-46-v1.0,这是一个通过GRPO和检查点插值进行无参考后训练改进的多语言机器翻译模型,在46种语言上超越了强大的开放和专有基线模型。

0 人收藏 0 人点赞
#open-llm

@0x0SojalSec: 开放LLM的海盗湾,模型权重可通过种子下载。我们的下一个选项正在等待中

X AI KOLs Timeline · 2026-07-02 缓存

一条推文宣布了一个基于种子的网站,用于下载开放LLM模型权重,将其定位为开放模型的海盗湾替代品。

0 人收藏 0 人点赞
#open-llm

@bnjmn_marie:对于LFM2.5 8B A1B,MoQ GGUFs是最好的,它们拥有最佳的精度/大小比。再次,看到……

X AI KOLs Following · 2026-06-08 缓存

帖子作者指出,LFM2.5 8B A1B模型的MoQ GGUFs提供了最佳的精度/大小比,并建议不要使用精度恢复低于95%的版本。

0 人收藏 0 人点赞
#open-llm

测量开放大语言模型中的最大激活值

arXiv cs.CL · 2026-05-18 缓存

本文测量了来自8个开放LLM家族的27个检查点的最大激活幅度,发现不同家族、架构和训练阶段之间存在显著差异,这对低位量化和部署具有影响。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈