@no_stp_on_snek: 能装进4090……而且不开放权重,这是你的API密钥。多谢 /s
摘要
对 Pokee AI 的 Pokee-Isaac 28B 的讽刺回应。该模型号称拥有 1000 万 token 上下文,是智能体模型,可运行在单张 RTX 4090 上,但不开放权重,仅通过 API 提供。
查看缓存全文
缓存时间: 2026/08/05 20:28
4090 上能跑…… 但也不是开放权重,给你个 API key。
多谢 /s
Pokee AI (@Pokee_AI): 发布 Pokee-Isaac 28B —— 全球首个真正支持 1000 万 token 上下文的前沿级智能体模型,可在单张 GPU 上部署(从 RTX 4090 或同级显卡起步)。
全新的专有非仅解码器架构: • 在 10M token 上 RULER 得分 93.3% • 单卡预填充速度最高可达 137K tokens/s
相似文章
@no_stp_on_snek:mrcr v2 在 1m 长度下完成 8-needle 测试,采用开源权重堆栈,仅单台租赁 mi300x。longctx directional 0.688(n=30,mass-val 重跑待更新…
分享了一套开源模型堆栈在单卡 AMD MI300X 上运行的早期基准测试成绩与评估指标,表明其性能已具备与闭源方案竞争的实力。
@no_stp_on_snek: Anthropic 和 openAI 只需要开放权重,问题就解决了。
评论推文称,Anthropic 和 OpenAI 只需开放权重即可解决开放权重之争,回应了特朗普顾问告知 AI 公司不会对开放权重模型进行安全测试的消息。
@no_stp_on_snek: 非常棒。对3090团队来说意义重大。而且TurboQuant+已经在很多推理引擎中实现了。
一条回复对Unsloth AI即将推出的Qwen3.8-27B模型表示赞赏,该模型将能在17GB内存/显存配置下运行,并指出TurboQuant+已集成到众多推理引擎中——这对RTX 3090用户来说是个好消息。
@svpino:首次,我觉得开源权重模型已无法忽视。我们正处于这些模型具有竞争…
Santiago (@svpino) 强调 MiniMax-M2.7,一个 230B 参数的开源权重模型,能与 Opus 4.6 和 GPT-5.4 等顶级专有模型相抗衡,在 SambaNova 上以低成本实现 440+ tokens/s 的推理速度。
@danveloper: https://x.com/danveloper/status/2064387956387758206
一位开发者通过在NVMe SSD上流式传输模型权重,在树莓派5上运行了DeepSeek-V4-Flash,达到了1.3 tokens/秒的速率,功耗仅8瓦,证明了前沿级别的开放权重模型在低成本、离线硬件上的可行性。