hybrid-model

标签

Cards List
#hybrid-model

新模型发布:Ling-3.0-tiny:总参数7.9B,每个token仅激活1.3B——免费一周

Reddit r/LocalLLaMA · 5天前

Ling-3.0-tiny发布:一款混合推理模型,总参数7.9B,每个token仅激活1.3B,免费一周。

0 人收藏 0 人点赞
#hybrid-model

我构建了LOLM:一个更低成本、支持实时控制决策和密封运行收据的LLM智能体

Reddit r/ArtificialInteligence · 2026-07-31

LOLM的构建者宣布推出Qira开发的Transformer-SSM混合语言模型与智能体系统,具备实时决策控制器、运行收据、CLI、编码沙箱、MCP支持以及更低成本的托管访问。

0 人收藏 0 人点赞
#hybrid-model

LiquidAI/LFM2.5-2.6B

Hugging Face Models Trending · 2026-07-28 缓存

Liquid AI released LFM2.5-2.6B, a 2.6B-parameter hybrid model optimized for on-device deployment with 128K context, agentic post-training, and fast inference (220 tok/s on Apple M5 Max) under 2.5GB memory.

0 人收藏 0 人点赞
#hybrid-model

从季节性到语义:对玻利维亚路障混合概率预测系统的基准测试

arXiv cs.CL · 2026-07-27 缓存

本文提出了一种混合概率预测系统,将时间序列分解(Prophet)与自然语言处理技术相结合,应用于玻利维亚新闻报道以预测路障,相比纯统计模型,取得了改进的AUC-ROC和Brier分数。

0 人收藏 0 人点赞
#hybrid-model

ClickGuard:使用信息量度量和大语言模型检测并识破点击诱饵新闻

arXiv cs.AI · 2026-07-24 缓存

本文介绍了ClickGuard,一款浏览器扩展,它结合了Transformer嵌入和语言学特征的混合机器学习模型,用于检测并识破点击诱饵新闻,在组合数据集上达到了91%的F1分数。

0 人收藏 0 人点赞
#hybrid-model

Show HN: Cactus Hybrid: 我们教会了Gemma 4识别自身错误

Hacker News Top · 2026-07-22 缓存

Cactus Hybrid是一款经过后训练的Gemma 4模型,可输出置信度分数,支持在设备端进行推理,并在置信度较低时路由至更大模型,以最少的大模型调用实现了与Gemini 3.1 Flash-Lite相当的性能。

0 人收藏 0 人点赞
#hybrid-model

极化检测:结合AfroXLMR-Social与DeBERTa的低资源与高资源环境混合方法

arXiv cs.CL · 2026-07-14 缓存

本文提出了一种混合方法,用于检测英语和豪萨语中的在线极化现象。在英语中使用DeBERTa,在豪萨语及细粒度子任务中使用AfroXLMR-Social,并结合LoRA和数据增强以应对计算和数据限制。

0 人收藏 0 人点赞
#hybrid-model

@VukRosic99: 长上下文Transformer面临两大瓶颈:二次注意力计算和KV缓存(在1M tokens时可达数百GB)…

X AI KOLs Timeline · 2026-07-11 缓存

MiniCPM-SALA是一款9B参数的混合注意力模型,通过在稀疏注意力和线性注意力之间交替插入(每3个线性层插入1个稀疏层)来克服长上下文Transformer的二次计算和KV缓存瓶颈。在256K tokens下,其推理速度比Qwen3-8B快3.5倍,并能在消费级GPU上支持高达1M tokens。该模型采用经济高效的持续训练方法,训练成本降低约75%。

0 人收藏 0 人点赞
#hybrid-model

@gneubig: 我们发现这种 "sidekick" 架构在降低LLM成本方面非常有效,因为它允许你...

X AI KOLs Following · 2026-06-29 缓存

Graham Neubig 分享了一种通过将简单任务委托给较小的智能体来降低LLM成本的 sidekick 架构,并提供了一个使用 OpenHands SDK 的200行示例。这种方法也被用于 Cognition 的 Devin Fusion 混合模型 harness。

0 人收藏 0 人点赞
#hybrid-model

HybridCodec: 面向高效语音语言模型的离散与连续表示建模

arXiv cs.LG · 2026-06-29 缓存

提出HybridCodec,一种结合时间压缩离散令牌与连续残差的新颖框架,旨在改进语音语言模型中说话人特征的保留,在保持质量的同时减少自回归步骤。

0 人收藏 0 人点赞
#hybrid-model

LiquidAI/LFM2.5-230M

Hugging Face Models Trending · 2026-06-24 缓存

Liquid AI发布了LFM2.5-230M,一款紧凑的230M参数混合模型,针对设备端部署进行了优化,边缘推理速度快(在Galaxy S25 Ultra上达到213 tok/s),并通过强化学习构建,适用于智能体任务。

0 人收藏 0 人点赞
#hybrid-model

AMD / Strix Halo+ 用户的大新闻

Reddit r/LocalLLaMA · 2026-06-24

AMD Strix Halo 设备上的 NPU 现在可用于 AI 推理,支持混合模式,结合 NPU 和 iGPU 以实现更快的提示处理。Lemonade 和 AMD 的 ROCm 等软件使之成为可能。

0 人收藏 0 人点赞
#hybrid-model

混合NARX-LLM的格陵兰冰山排放预测:提示驱动的残差校正

arXiv cs.LG · 2026-06-16 缓存

本文提出了一种混合NARX-LLM框架用于预测格陵兰冰山排放,采用物理知识提示方法引导大语言模型进行残差校正,相比传统NARX模型提高了预测精度。

0 人收藏 0 人点赞
#hybrid-model

D2H-AD:一种利用超维计算的高级异常检测混合模型

arXiv cs.LG · 2026-06-15 缓存

D2H-AD是一种新颖的异常检测框架,采用超维计算(HDC),结合了基于距离和密度感知的编码。它在多个基准测试中优于五种基线方法,为边缘AI和物联网提供轻量级、可解释且高效的性能。

0 人收藏 0 人点赞
#hybrid-model

用于神经主题建模的混合经典-量子变分自编码器

arXiv cs.CL · 2026-06-15 缓存

本文提出了一种用于神经主题建模的混合经典-量子变分自编码器,在推理网络中嵌入了参数化量子电路。在AgNews数据集上的实验表明,与最先进的经典模型相比,主题连贯性和多样性有所提高,显示了在NISQ时代量子设备上的可行性。

0 人收藏 0 人点赞
#hybrid-model

为什么AI语音代理正在以超预期速度取代传统呼叫中心(LuMay、Voxentis.ai 等)

Reddit r/AI_Agents · 2026-06-08

得益于对话式AI、可扩展性和性能一致性方面的进步,像 LuMay Voice Agent 和 Voxentis.ai 这样的AI语音代理正在加速取代传统呼叫中心,推动医疗、房地产、电商等行业采用AI与人类混合的模式。

0 人收藏 0 人点赞
#hybrid-model

DAStatFormer:一种融合统计特征的混合多分支Transformer,用于基于DAS的模式识别

arXiv cs.LG · 2026-06-02 缓存

DAStatFormer是一种混合多分支Transformer,它通过门控注意力机制整合统计特征,实现分布式声学传感(DAS)中高效且准确的事件分类,在显著降低计算成本的同时达到高达99.4%的准确率。

0 人收藏 0 人点赞
#hybrid-model

QuChaTeR: 混合量子混沌时域框架用于地震预测

arXiv cs.LG · 2026-05-19 缓存

介绍QuChaTeR,一种混合架构,结合了小波预处理、混沌映射和变分量子电路与循环结构,用于地震预测,在收敛速度和准确性上优于经典和量子基线。

0 人收藏 0 人点赞
#hybrid-model

TajPersLexon:用于跨脚本低资源NLP的塔吉克-波斯语词汇资源与混合模型

arXiv cs.CL · 2026-05-11 缓存

本文介绍了 TajPersLexon,这是一个用于塔吉克-波斯语跨脚本自然语言处理的词汇资源,并通过将混合模型与神经基线模型进行基准测试,展示了其在低资源环境下的有效处理能力。

0 人收藏 0 人点赞
#hybrid-model

推出 Gemini 2.5 Flash

Google DeepMind Blog · 2025-04-17 缓存

Google 宣布推出 Gemini 2.5 Flash,这是一个新的混合推理模型,现已通过 Gemini API 以预览版形式提供。该模型具有可切换的思考能力、细粒度的思考预算以平衡质量、成本和延迟,并在保持快速推理速度的同时相比 2.0 Flash 提升了性能。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈