模型

Cards List

更新基准测试:DeepSeek V4 Flash 在 SlopCodeBench(本地)上的表现

Reddit r/LocalLLaMA · 4小时前

用户分享了使用本地量化(antirez imatrix 量化)和 pi 工具在 SlopCodeBench 上对 DeepSeek V4 Flash 的最新基准测试结果,显示性能较之前运行有所提升,但仍比托管 API 慢。

0 人收藏 0 人点赞

LFM 2.6B 非常有趣。

Reddit r/LocalLLaMA · 6小时前

作者分享了使用 LFM 2.6B 的亲身经历,这是一款为手机设计的小型模型,作者称赞其速度和完成快速任务的实用性,例如摘要和自动补全,不过它只有 128k 的上下文限制。

0 人收藏 0 人点赞

我在ESP32 Dev Kit V1上运行了完整的LLM模型(仅用81KB内存)

Reddit r/ArtificialInteligence · 7小时前

一位开发者成功在ESP32 Dev Kit V1上运行了量化至INT4的520万参数MoE LLM,仅使用81KB SRAM,通过从闪存流式加载专家,实现了约每秒5个token的速度。

0 人收藏 0 人点赞

@rauchg:Grok Imagine Image 2.0 已上线 Vercel AI Gateway,优秀模型,已在 http://Arena.ai 排名第2

X AI KOLs Timeline · 8小时前 缓存

Guillermo Rauch 重点介绍了 Grok Imagine Image 2.0,该模型现已登陆 Vercel AI Gateway,并在 Arena.ai 排行榜上位列第二。Vercel 通过 AI CLI 和实时 Playground 提供访问。

0 人收藏 0 人点赞

Kimi K3 (Unsloth) IQ2-XXS 从 711GB 降至 478GB!!! 仅移除多语言来缩减体积

Reddit r/LocalLLaMA · 11小时前

Kimi K3 (IQ2-XXS) 的精简版纯英文 GGUF 通过移除多语言组件,将模型大小从 711GB 降至 478GB,早期测试表明它在编码任务上可能达到或超过标准 2-bit 版本。

0 人收藏 0 人点赞

@interjc: @grok 画一个勒布朗詹姆斯带领美国男足获得足球世界杯冠军从特朗普手上领取奖杯

X AI KOLs Following · 22小时前 缓存

Grok announces Imagine Image 2.0, a next-generation image model with precision editing, crisp text rendering, improved factuality, and real-world usefulness.

0 人收藏 0 人点赞

DeepMind 的飓风突破令气象科学家惊讶

Ars Technica · 昨天 缓存

DeepMind 的飓风 AI 模型为预报员提供了额外一天的预警时间,并以 WeatherNext 模型的形式开源,尽管研究人员并不完全了解其工作原理。

0 人收藏 0 人点赞

@jefffhj:试试 Imagine Image 2.0!

X AI KOLs Following · 昨天 缓存

Grok 发布了 Imagine Image 2.0,这是一款下一代图像模型,具备精准编辑、清晰的文字渲染以及改进的事实准确性,适用于实际应用。

0 人收藏 0 人点赞

@rohanpaul_ai: Grok Imagine Image 2.0(低)来自@SpaceXAI 上升12位至第2名,超越了自己旧版的质量模型。之前的…

X AI KOLs Following · 昨天 缓存

xAI的Grok Imagine Image 2.0(低)在文生图竞技场跃升至第2名,超越了自己旧版的质量模型,显示出显著进步。

0 人收藏 0 人点赞

还有人跟我一样对 Qwen 3.8 感到兴奋吗?

Reddit r/LocalLLaMA · 昨天

作者表达了对即将推出的 Qwen 3.8 模型的期待,分享了他们使用 Qwen 3.6 27B 进行本地 LLM 的体验,并讨论了自托管 AI 取代基于订阅的前沿模型的潜力。

0 人收藏 0 人点赞

@rohanpaul_ai: Meta的Muse Spark 1.2升至第4位,同时将Text Arena的成本-质量帕累托前沿向上推进。你只损失9分……

X AI KOLs Following · 昨天 缓存

Meta的Muse Spark 1.2在Text Arena中升至第4位,通过降价约91%将成本-质量帕累托前沿向上推进,同时相比顶级模型仅损失9分。

0 人收藏 0 人点赞

@ayushrajnc1z: 这感觉不像又一次AI视频更新,而更像一个正规制作工作流的开端。三十秒视频…

X AI KOLs Timeline · 昨天 缓存

Seedance 2.5 引入了30秒视频生成、多模态参考、多语言创作和定向编辑,面向开发者和企业的API访问即将在BytePlus上线。

0 人收藏 0 人点赞

@TheAhmadOsman:在 DGX Station 上运行 DeepSeek V4 Flash 0731 的一些数据

X AI KOLs Timeline · 昨天 缓存

Ahmad Osman 分享了在 NVIDIA DGX Station 上运行 DeepSeek V4 Flash 0731 的性能数据。

0 人收藏 0 人点赞

非洲和中东最好的AI模型

Reddit r/artificial · 昨天

埃及初创公司TokenAI宣布Horus Cyper Nano 1.0 BETA开启早期访问,这是一款专为进攻性安全与红队研究设计的专业网络安全模型,开放权重计划于2026年9月发布。

0 人收藏 0 人点赞

@rohanpaul_ai: 阿里巴巴发布了Qwen3.8-Max,一个2.4万亿参数模型,每个token仅激活约950亿参数。一个……

X AI KOLs Timeline · 昨天 缓存

阿里巴巴发布了Qwen3.8-Max,这是一个2.4万亿参数的稀疏MoE模型,每个token激活950亿参数,支持100万token的上下文,并具有强大的智能体能力和基准测试结果,包括自主编码数天、电路设计,以及在Terminal Bench和PaperBench上超越竞争对手。

0 人收藏 0 人点赞

@gabriel1:太令人兴奋了,等不及要试试这个猛兽

X AI KOLs Following · 昨天 缓存

Sam Altman 宣布,'astra' 是一个强大的 AI 模型,正在准备正式发布,由于其网络能力,需要额外的安全时间。

0 人收藏 0 人点赞

@sama: astra 是一个强大的模型,我们正在努力使其普遍可用。我们不认为将强大的模型保留给少数人是一个好策略…

X AI KOLs Timeline · 昨天 缓存

Sam Altman 宣布 Astra 模型非常强大,OpenAI 正在努力使其普遍可用,同时鉴于其网络能力,需要额外时间确保安全。

0 人收藏 0 人点赞

@gdb:GPT-5.6 Sol 用于网络安全:

X AI KOLs Following · 昨天 缓存

Greg Brockman 分享了来自 Grigori Karapetyan 的推荐语,称赞 GPT-5.6 Sol (Codex) 能够快速进行网络安全调查和响应。

0 人收藏 0 人点赞

Moonlight & Mayhem (Raccoon Heist by Codex + GPT-5.6 Sol Ultra)

Simon Willison's Blog · 昨天 缓存

Simon Willison 通过 Codex Desktop 测试 GPT-5.6 Sol Ultra,要求其根据一个四年前的提示重新制作“Raccoon Heist”游戏,结果比 Claude Fable 5 的版本好得多,但存在眼球过大的 bug。

0 人收藏 0 人点赞

@gdb:对我们下一个主要模型Astra的评估表明,在智能体编码和网络安全方面有显著的能力提升……

X AI KOLs Following · 昨天 缓存

OpenAI的下一代主要模型Astra在智能体编码和网络安全方面展现出显著的能力提升,并且根据《准备框架》被视为网络安全领域的“关键”模型,计划实施额外的控制措施。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈