1m-context

标签

Cards List
#1m-context

@thegenioo: 为什么这隐身模型在前端方面这么厉害?

X AI KOLs Timeline · 2026-08-20 缓存

OpenRouter 发布了一款名为 Ox Alpha 的新型隐身 AI 模型,该模型针对高效编码和代理任务进行了优化,具备 1M 令牌上下文窗口,并支持文本、图像和视频输入。

0 人收藏 0 人点赞
#1m-context

@modal: @Alibaba_Qwen 和 @alibaba_cloud 的 Qwen3.8-2.4T-A95B 现已登陆 Modal。配备自定义 DFlash 推测器…

X AI KOLs Following · 2026-08-13 缓存

阿里巴巴 Qwen 和阿里云的 Qwen3.8-2.4T-A95B 现已登陆 Modal,配备基于工具调用密集型数据训练的自定义 DFlash 推测器和完整的 1M 上下文窗口。

0 人收藏 0 人点赞
#1m-context

Qwen3.7 开源权重即将发布的首个证据。Qwen3.7-flash 已出现在 OpenRouter 上。他们曾将 Qwen3.6-35b-a3b 称为 Qwen3.6 flash,因此这很可能是一个小型 MoE。其价格远低于 3.6 flash,且原生支持 100 万上下文窗口。

Reddit r/LocalLLaMA · 2026-07-28 缓存

Qwen3.7 开源权重即将发布的证据,其 flash 变体(很可能是小型 MoE)已出现在 OpenRouter 上,具有 100 万上下文窗口,且价格比 Qwen3.6 flash 更低。

0 人收藏 0 人点赞
#1m-context

Laguna S 2.1 发布:比 Deepseek v4 Flash 更便宜,比 V4 Pro 更优

Reddit r/LocalLLaMA · 2026-07-21 缓存

Poolside 发布 Laguna S 2.1,这是一个 118B MoE 模型,每个 token 激活 8B 参数,针对智能体编码进行了优化。据称,其性能优于 DeepSeek V4 Pro,同时价格低于 DeepSeek V4 Flash,拥有 1M 上下文窗口和开源许可证。

0 人收藏 0 人点赞
#1m-context

Kimi K3 已在网页和App上发布

Reddit r/LocalLLaMA · 2026-07-16

Kimi K3 是一款全新AI模型,拥有2.8万亿参数和100万上下文长度,已在网页和App上发布,在编程、智能体任务、推理、视觉和智能体集群方面具备领先能力。

0 人收藏 0 人点赞
#1m-context

@yifanzhang_: https://thinkingmachines.ai/news/introducing-inkling/… RoPE已死,GRAPE万岁!

X AI KOLs Timeline · 2026-07-15 缓存

Thinking Machines AI发布了Inkling,这是一个开放权重的混合专家模型,总参数975B(41B活跃),支持文本、图像和音频,上下文窗口为100万token。它是一个广泛的基础模型,旨在通过其Tinker平台进行微调,同时还预览了较小的Inkling-Small变体。

0 人收藏 0 人点赞
#1m-context

@seclink: MiniMax M3开源了。 一般愿意开源的,都是过时的,还有未开源的弹药未释放。 Hugging Face 主仓库(推荐): https://huggingface.co/MiniMaxAI/MiniMax-M3… 这里提供完整模型权重…

X AI KOLs Timeline · 2026-07-14 缓存

MiniMax 开源了其原生多模态大模型 M3,参数约 428B(激活约 23B),支持 1M 上下文,并引入了 MiniMax Sparse Attention (MSA) 技术以提升长上下文效率。

0 人收藏 0 人点赞
#1m-context

@seclink: LongCat-2.0 发布 & 全新推出计费服务 ​ LongCat-2.0的核心特性如下: 万亿参数,1M超长上下文:原生工具调用与多步推理,稳定承载长上下文 Agent 任务。 卓越的 Coding 能力:在代码生成、代码理解与自动…

X AI KOLs Following · 2026-07-01 缓存

LongCat-2.0 模型发布,具有万亿参数和1M超长上下文,支持原生工具调用与多步推理,代码能力突出,同时推出Token资源包和按量计费的API计费服务。

0 人收藏 0 人点赞
#1m-context

@uzairansar: Qwythos-9B-Claude-Mythos-5 1M上下文微调版本发布!Empero刚刚发布了基于Claude Mythos的微调模型…

X AI KOLs Timeline · 2026-06-21 缓存

Empero发布了Qwythos-9B-Claude-Mythos-5,这是一个基于Fable-5和Mythos-5会话日志的合成思维链数据,使用1M上下文微调的全参数推理模型。

0 人收藏 0 人点赞
#1m-context

GLM-5.2: 专为长程任务打造

Hugging Face Blog · 2026-06-17 缓存

Z.AI推出GLM-5.2,这是一款专为长程任务设计的旗舰模型,拥有稳定的100万token上下文、改进的编码能力以及MIT开源许可证,在与Opus 4.8和GPT-5.5等领先模型的对比中展现了竞争力。

0 人收藏 0 人点赞
#1m-context

GLM-5.2 刚发布开放权重,在编程方面已经异常强大

Reddit r/LocalLLaMA · 2026-06-16

GLM-5.2 已以 MIT 许可证发布开放权重,拥有 100 万上下文窗口和两种推理努力模式。早期基准测试显示它在编程任务中表现出色,值得在基准截图之外进行测试。

0 人收藏 0 人点赞
#1m-context

@AdinaYakup: GLM 5.2 来了 753B (比你想象的要小?) 1M上下文 MIT许可证 GLM IndexShare: 跨层复用索引器…

X AI KOLs Following · 2026-06-16 缓存

GLM 5.2 作为一款753B参数的开源模型发布,拥有1M上下文长度,MIT许可证,在AIME 2026上达到99.2分,超越了GPT-5.5、Gemini 3.1 Pro和Claude Opus 4.8。

0 人收藏 0 人点赞
#1m-context

GLM-5.2(一分钟阅读)

TLDR AI · 2026-06-15 缓存

GLM-5.2 是新一代旗舰级编程模型,支持 100 万上下文并增强推理能力,现已面向 GLM 编程计划用户开放,将于下周以 MIT 许可证开源。

0 人收藏 0 人点赞
#1m-context

@Modular:我们的内核团队整周都在深入研究 MiniMax M3。百万token上下文和原生多模态让它的服务模式变得困难……

X AI KOLs Following · 2026-06-09 缓存

Modular 的内核团队正在优化对 MiniMax M3 的百万token上下文和原生多模态的服务,开放权重即将发布,可立即在 Modular 上部署。

0 人收藏 0 人点赞
#1m-context

MiniMax 承诺在发布百万上下文模型后公开 M3 权重(2 分钟阅读)

TLDR AI · 2026-06-03 缓存

MiniMax 通过 API 发布了 M3,这是一款拥有 100 万 token 上下文窗口并支持原生多模态输入的模型。该公司承诺在 10 天内发布开源权重和技术报告。

0 人收藏 0 人点赞
#1m-context

MiniMax M3 - 编码与智能体前沿,百万级上下文,多模态

Reddit r/LocalLLaMA · 2026-06-01 缓存

MiniMax 发布了 M3,这是一个开源权重模型,具备前沿编码能力、智能体能力、百万级上下文和原生多模态能力,在编码和智能体任务上取得了顶级基准成绩,并支持自主任务分解和长上下文。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈