small-models

标签

Cards List
#small-models

基于小型语言模型网络的强化学习通信

arXiv cs.LG ↗ · 11小时前 缓存

TalkMesh 是一个采用强化学习的小型语言模型智能体去中心化网络,能够学习何时及进行何种通信,在 GSM8K 和 MATH-500 等基准测试中显著优于自洽性方法,显著提升了准确性。

0 人收藏 0 人点赞
#small-models

@MaximeRivest: 如果你的专用决策模型(即分类器)足够小,就无需托管。而且它甚至可以在手机上训练……

X AI KOLs Timeline ↗ · 2天前 缓存

一条推文指出,小型专用分类器可以无需托管部署,并且可以直接在移动设备上训练,突出了轻量级AI模型的进步。

0 人收藏 0 人点赞
#small-models

@MaximeRivest: 400万参数!仅用10,000个样本就能让微小的BERT超越opus和kimi!

X AI KOLs Timeline ↗ · 2天前 缓存

一项仅有400万参数的模型,通过10,000个样本微调,在某些基准测试中性能超越了opus和kimi。

0 人收藏 0 人点赞
#small-models

@ClementDelangue: 非常高兴地发布SmolDataEnvs:5,000个用于代码和数据科学中优化小型模型的可验证RL环境任务…

X AI KOLs Timeline ↗ · 3天前 缓存

SmolDataEnvs现已发布,这是一套包含5000个可验证RL环境任务的集合,专注于代码和数据科学领域的小型模型训练,完全开源。

0 人收藏 0 人点赞
#small-models

基于可验证奖励的强化学习用于小型搜索智能体

arXiv cs.AI ↗ · 4天前 缓存

本文将基于可验证奖励的强化学习应用于采用检索增强生成的小型语言模型,实现了无需蒸馏的3.8倍性能提升,并强调了针对小型模型进行奖励设计的重要性。

0 人收藏 0 人点赞
#small-models

Ngram与世界知识——为什么我们只在构建编码模型?

Reddit r/LocalLLaMA ↗ · 2026-09-22

作者讨论了AI模型需要更好的世界知识,利用N-gram技术将更多知识融入更小的模型,并质疑为什么开发更侧重于编码能力而非更广泛的世界知识。

0 人收藏 0 人点赞
#small-models

Kev:基于 Qwen3.5 的小型 Jev 风格决策模型家族

Hacker News Top ↗ · 2026-09-21 缓存

Kev 是基于 Qwen3.5 构建的小型决策模型家族,提供开源训练代码和预训练权重,支持本地部署,并兼容多种问题类型。

0 人收藏 0 人点赞
#small-models

@yibie: https://x.com/yibie/status/2101502455544451502

X AI KOLs Timeline ↗ · 2026-09-20 缓存

本文提供了如何用自己的数据微调小模型的完整指南,涵盖数据采集、清洗、训练、评测和部署,强调数据权利和评测纪律。

0 人收藏 0 人点赞
#small-models

真诚提问:更小的量化模型是否正在成为本地AI的最佳选择?

Reddit r/LocalLLaMA ↗ · 2026-09-19

文章探讨了更小的量化模型是否正在成为本地AI应用的首选,强调了它们在VRAM使用、性能和功能(如工具调用)之间的平衡。

0 人收藏 0 人点赞
#small-models

是否存在比Qwen3.5 4B更好的小型模型,用于快速的本地AI助手?

Reddit r/LocalLLaMA ↗ · 2026-09-14

文章询问是否有比Qwen3.5 4B更好的小型AI模型,用于构建快速的本地助手,重点是在保持速度的同时改进对话、推理、多语言支持和工具调用等能力。

0 人收藏 0 人点赞
#small-models

@reach_vb: 目前最好的少于30亿参数的开源权重大语言模型是什么?能够在浏览器或扩展中轻松运行的那种。

X AI KOLs Following ↗ · 2026-09-13 缓存

一位用户询问关于参数少于30亿、能够在浏览器环境中或作为扩展高效运行的最佳开源权重大语言模型。

0 人收藏 0 人点赞
#small-models

发布 smolbenchmark:助您为硬件挑选最佳模型!

Reddit r/LocalLLaMA ↗ · 2026-09-12

smolbenchmark 是一个新资源,可在消费级硬件设备上对小型 AI 模型进行基准测试,提供速度、能效和散热等指标,帮助用户为其特定硬件选择最佳模型。

0 人收藏 0 人点赞
#small-models

循环GPT-BERT:以参数换取计算的小型语言建模

arXiv cs.CL ↗ · 2026-09-10 缓存

本文介绍了循环GPT-BERT,它通过深度方向参数共享来训练参数更少的小型语言模型,在BabyLM 2026严格小规模设定中达到了与基准模型相当的性能。

0 人收藏 0 人点赞
#small-models

获取、修复、保存:一种诊断引导的小模型对话游戏代理后训练方案

Hugging Face Daily Papers ↗ · 2026-08-28 缓存

本文研究了一款用于对话游戏的2B模型的失败案例,并介绍了一种诊断引导的后训练方案,该方案使用SFT、DPO和LoRA来提升性能,同时保持通用能力。

0 人收藏 0 人点赞
#small-models

Scaffold CoT:一个围绕小型模型(>5B参数)自由形式思维失败而构建的CoT数据集。希望对你们有帮助!

Reddit r/LocalLLaMA ↗ · 2026-08-25

介绍Scaffold CoT,这是一个约400万示例的CoT数据集,通过结构化框架设计,旨在通过提供一致的分类型示例来增强小型语言模型的推理能力。

0 人收藏 0 人点赞
#small-models

小型子代理用于上下文工程

Reddit r/AI_Agents ↗ · 2026-08-24

作者建议使用小型、快速的AI子代理进行上下文工程,以提高AI系统的效率并降低成本,质疑为何这种方法未被广泛采用,并寻求社区反馈。

0 人收藏 0 人点赞
#small-models

如何在本地AI伴侣中提升推理和记忆能力?

Reddit r/AI_Agents ↗ · 2026-08-23

一位开发者讨论了在本地AI伴侣中提升推理和记忆处理的挑战,并寻求建议,重点是上下文选择和小模型的处理。

0 人收藏 0 人点赞
#small-models

精简您的智能开销(13分钟阅读)

TLDR AI ↗ · 2026-08-20 缓存

本文主张企业应通过为不同任务选用适配规模的模型与混合系统来优化AI智能开销,而非对所有应用都默认采用昂贵的前沿模型。

0 人收藏 0 人点赞
#small-models

从被动代理人到战略谈判者:使用 SocialRL 强化小型语言模型中的社会推理能力

arXiv cs.AI ↗ · 2026-08-17 缓存

本文介绍了 SocialRL,一种强化学习方法,用于增强小型语言模型中的社会推理能力,使其能够有效谈判,并在多种交互领域中匹配或超越 GPT-5 等大型模型的表现。

0 人收藏 0 人点赞
#small-models

@rohanpaul_ai:Meta新论文显示,小模型可能并非规模预测效果不佳,或许只是未获得充分调优。研究发现……

X AI KOLs Timeline ↗ · 2026-08-16 缓存

Meta最新论文显示,小型模型能够准确预测缩放规律,但需要更全面的超参数调优。研究发现,缩放规律在参数量约400万时开始显现,通过恰当调优其特征会变得更加清晰。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈