Parlor v2:在 M3 Pro 上尽力实现的完全本地 GPT-Live 克隆
摘要
作者分享了 Parlor v2,一个在 M3 Pro 上运行的完全本地 GPT-Live 克隆,在尝试微调 Gemma 4 12B 以实现全双工行为失败后,将其构建为级联系统。
GPT-Live 太棒了,我几乎每天都会使用。自从它发布以来,我一直想复刻它。我的第一次尝试是微调 Gemma 4 12B,使其表现得像一个全双工模型。有点像给模型嫁接一个决策 tick 和语音头。经过多次尝试后失败了。目前,我认为经典的级联系统仍然更好。我们只需要等待一家仁慈的前沿 AI 公司发布一款与 GPT-Live 相当的全双工模型。仓库:https://github.com/fikrikarim/parlor/
相似文章
我做了一个感觉像GPT-Live的东西,但你可以在Rust中自己运行
一个基于Rust的工具,复制了GPT-Live的体验,用户可以在本地运行。
Cerebras上的gemma-4-31B比ChatGPT语音模式更好
声称在Cerebras硬件上运行的Gemma-4-31B模型性能优于ChatGPT的语音模式,并通过Hugging Face Space展示了实时语音交互。
构建并发布了BetterGPT-150M——一个紧凑的1.5亿参数补全模型(含在线HF Space演示)
构建并发布了BetterGPT-150M,一个紧凑的1.5亿参数因果语言模型,资源占用低,性能优于GPT-2 Small。包含用于文本补全的实时Hugging Face Space演示。
GPT‑Live
OpenAI 宣布推出 GPT-Live,这是一种全新的全双工语音模型,通过允许同时收听和说话,实现更自然、实时的对话,后端模型为 GPT-5.5。
LLaMA.cpp的多令牌预测(MTP)——Gemma 4速度提升40%
llama.cpp中新的多令牌预测(MTP)实现为Gemma 4模型带来了40%的速度提升,已在MacBook Pro M5Max上测试。文章提供了量化GGUF模型和补丁源代码的链接。