我确实于一年前构建了Jev架构,并完全开源了模型、数据集和论文
摘要
一位个人声称在一年前就开发并开源了一个类似于Jev的非自回归AI架构,比其公开发布早了一年,对缺乏来自前沿实验室的认可和支持表示沮丧。
现在每个人都在谈论那个非自回归的架构,它能使用JSON架构进行闪电般的概率预测。我确实在一年前的2025年3月就致力于此,发表了一篇arxiv论文,将模型推送到huggingface,并附有pypi包和训练数据集。然后一年后,一家前沿实验室出现了,提出了相同的想法,就像真正的突破一样,却没有技术论文、开放权重和开放数据集。我在这个subreddit中发布了我的方法。链接如下。供任何人参考,主要指导模型是RL,而不是嵌入模型或LLM。Reddit帖子:https://www.reddit.com/r/LocalLLaMA/s/6eGEwsAz43 论文:https://arxiv.org/abs/2503.23303 模型:https://huggingface.co/DeepMostInnovations/sales-conversion-model-reinf-learning 数据集:https://huggingface.co/datasets/DeepMostInnovations/saas-sales-conversations 另外,2025年9月发表的第二项工作正是Jev现在提出的完全相同的东西。论文:https://arxiv.org/abs/2510.01237 我的模型使用PPO在序列嵌入上输出逐步转换轨迹(概率从0.0到1.0)。Jev使用并行采样(通过RLCD训练)来输出置信度分布和架构选择。令人沮丧的是,你用数月辛勤工作、汗水和不眠之夜制作的东西,在架构上与垂直用例相似,却没有得到应得的支持,因为前沿实验室构建了某些水平的东西。总体开源故事 🙂
相似文章
Jev / TypesafeAI 在 LLM 领域堪称革命性
Jev 是一种新型 AI 模型,它输出评分、选择或二元决策,因其在创意查询时的速度、经济性和准确性而备受赞誉,不同于传统的前沿模型。
Jev-like逆向工程模型
本文介绍了'jevlike',一个用于在一次传递中从文本选项中选择的逆向工程AI模型,有演示如Doom和国际象棋游戏,托管在GitHub上。
@jakevin7: Jev 太厉害了!!!它完全是一个新的方向+新的模型范式。它带来了这么多完全不同的东西……
一篇社交媒体帖子称赞 Jev AI 模型是一个新范式,具有大规模检索、AI推荐系统和实时交易等潜在应用,尤其是在与 OpenCLI 配合使用时。
@0xLogicrw: This is probably the project that's expanded Jev's imaginative scope the most of anything I've seen so far. Once AI bec…
Vercel Labs engineer Chris Tate is experimenting with integrating Jev into json-render to enable AI to compose UI components at runtime, expanding creative possibilities as AI becomes faster and cheaper.
@0xMovez 的推文:https://x.com/0xMovez/status/2101007482919227841
本文提供了一个十步指南,教你如何使用TypeSafe AI的System One模型Jev来构建最快的AI代理大脑,与LLMs相比,它能提供更快且更便宜的决策。