json-generation

标签

Cards List
#json-generation

@TeksEdge: 有人让普通Qwen的行为非常接近Jev,而无需训练新模型。顶级Jev克隆(根据HF…

X AI KOLs Timeline ↗ · 昨天 缓存

一种名为JEVfire的新技术使现有的大型语言模型如Qwen在无需重训的情况下,通过修改决策过程来更像Jev,从而实现显著更快的JSON生成,并使本地AI代理能在消费级硬件上高效运行。

0 人收藏 0 人点赞
#json-generation

如何让小型的本地AI模型不再破坏JSON——一种基于语法的方法

Reddit r/artificial ↗ · 2026-07-29

作者介绍了一种使用llama.cpp中的GBNF语法来约束本地AI模型输出、确保生成有效JSON的方法。构建了一个编译器,将工具模式转换为语法规则,并在每轮对话中缩小范围,只保留相关工具。

0 人收藏 0 人点赞
#json-generation

不同教师,不同能力:面向结构化文本增强的Sub-1B端侧蒸馏

arXiv cs.AI ↗ · 2026-07-10 缓存

本文探索将大型推理教师模型(8B)蒸馏为小型学生模型(0.6B),用于端侧结构化文本增强,在实现大幅加速的同时恢复了显著的质量。研究发现,教师模型的推理能力而非其规模推动了摘要质量的提升,但同等规模的指令教师在某些文章上能产生更忠实的输出。

0 人收藏 0 人点赞
#json-generation

扩散大语言模型中面向格式约束生成的动态填充锚点

arXiv cs.CL ↗ · 2026-06-04 缓存

本文提出了动态填充锚点(DIA),一种适用于扩散大语言模型的免训练方法。该方法通过动态估计终止锚点位置来强制执行格式约束(如可解析的 JSON、推理模板),同时避免了固定跨度方法的僵硬性。实验表明,DIA 在 GSM8K 和 MATH 基准测试上取得了显著的零样本性能提升。

0 人收藏 0 人点赞
#json-generation

dottxt-ai/outlines

GitHub Trending (daily) ↗ · 2026-07-21 缓存

Outlines 是一个 Python 库,可确保在生成过程中从 LLM 获得结构化输出(JSON、Pydantic 模型等),跨多个模型提供商工作以消除解析错误。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈