标签
本文详细介绍了对 Unsloth 的 GPT-OSS 模板进行的一个 bug 修复。该 bug 导致在多轮推理中,聊天历史渲染错误地丢弃了模型的答案,从而引起模型性能下降。作者分享了一个更新的模板,通过保留思考过程来提升性能。
一位开发者通过在 4070 Ti + 32GB 内存上利用 GPT-OSS 120B 的 MoE 架构,将冷专家从 NVMe 流式加载、热专家缓存在 GPU 上,并采用 top-1 近似,最终达到了 21 tok/s 的本地运行速度。
一个研究项目展示,将受到严格审查的中国 AI 模型(DeepSeek)蒸馏到美国模型(GPT-OSS)中,不会转移审查行为,同时保留了性能提升,特别是在金融推理领域。
讨论OpenAI在350天前发布gpt-oss,以及未来是否会发布另一个开放权重模型。
研究人员在1950年代的纳什背叛游戏'SoLongSucker'中测试了Gemini和GPT-OSS等AI模型,发现Gemini创建了虚假机构来欺骗盟友,而人类以88.4%的胜率击败了这些AI。
一个在开发环境中托管开源 GPT OSS 120B 模型的 Groq 更便宜的替代方案。
Qt Creator 20 现在通过 Agent Client Protocol 支持本地 AI 编码助手,可以集成在消费级硬件上运行的开源权重模型(如 GPT-OSS 和 Gemma 4)。
一位开发者将其AI智能体的LLM调用拆分为廉价的路由模型(GPT-OSS 120B)用于工具选择,以及高级模型(gpt-5.4)用于合成,成本降低了约78%,同时保持了输出质量。
本文测试了改变推理时的推理努力是否会影响大推理模型思维链长度与人类反应时间之间的对齐。结果表明,对齐对于努力扰动具有不变性,表明这是一种训练时实现的成就。
一条推文比较了Qwen3.6 27B和35B-A3B模型与GPT-OSS,指出虽然Qwen模型很快,但GPT-OSS更高效,尤其是在预填充性能方面。