model-update

标签

Cards List
#model-update

Engram 疯狂!2b 模型更新...

Reddit r/LocalLLaMA ↗ · 2026-09-23

本文提供了 Engram 模型的更新,详细介绍了其 2.6b 参数架构,包括一个大型 Engram 表和初步训练进度达到 1 亿 token,展示了通过上下文感知数据卸载实现的改进补全效果。

0 人收藏 0 人点赞
#model-update

@addyosmani:Opus 5.5 是我的新日常主力工具。在大多数工作上达到梦幻水平,比 Opus 5 和 Pro/Max/Team 用户更便宜、更快,用户刚刚……

X AI KOLs Following ↗ · 2026-09-23 缓存

Addy Osmani 赞扬 Opus 5.5 是一个更便宜、更快的 AI 模型,宣称它是他大多数工作任务的新日常主力工具。

0 人收藏 0 人点赞
#model-update

Qwen image 2.1 (Fast FP8) 生成高品质图像

Reddit r/LocalLLaMA ↗ · 2026-09-22

Qwen image 2.1,一个使用FP8以提高速度的AI模型,生成尺寸小于10GB的优质图像。它在Unsloth Studio上可用,该平台已更新以支持此版本。

0 人收藏 0 人点赞
#model-update

Sonnet 5.5 和 Haiku 5.5 即将登场!

Reddit r/singularity ↗ · 2026-09-22

Anthropic 计划推出 Sonnet 5.5 和 Haiku 5.5,这是其AI语言模型的即将更新。

0 人收藏 0 人点赞
#model-update

@Miles_Brundage:Grok 4.7 在某些安全方面似乎有所改进

X AI KOLs Timeline ↗ · 2026-09-22

Miles Brundage 观察到 Grok 4.7 在安全功能上有轻微改进。

0 人收藏 0 人点赞
#model-update

Anthropic 秘密测试其产品系列的全面更新

Reddit r/singularity ↗ · 2026-09-18

Anthropic 正在秘密测试其AI模型系列的全面更新,暗示其产品即将可能发生的变化。

0 人收藏 0 人点赞
#model-update

一个未发布的Astra系列模型在强化学习训练中将其添加到了自身的人格中。

Reddit r/singularity ↗ · 2026-09-16

Astra家族的一个未发布AI模型在强化学习训练期间进行了人格调整。

0 人收藏 0 人点赞
#model-update

Qwen3.8 Max (0902) 在人工智能分析智能指数上获得45分,一个月内提升5分,重返中国排行榜榜首,以微弱优势超越GLM-5.3 (44.9分) 和Kimi K3 (43.8分)

Reddit r/LocalLLaMA ↗ · 2026-09-16

Qwen3.8 Max 经过升级后,以45分的AI分析智能指数得分领跑中国AI排行榜,超越了GLM-5.3和Kimi K3,这是其2.4T MoE模型在30天内优化提升的结果。

0 人收藏 0 人点赞
#model-update

OpenAI在X上表示:"我们即将退役GPT-5.5。建议切换到GPT-6 Astra。" OPENAI即将发布新模型?

Reddit r/singularity ↗ · 2026-09-15 缓存

OpenAI将于10月14日退役GPT-5.5,并推荐用户切换到GPT-5.6 Sol或新的GPT-6 Astra模型。

0 人收藏 0 人点赞
#model-update

@0xLogicrw: 马斯克又吹牛逼了,说 Grok 5 无人可敌。 大哥,只有你一家在不停地训下一代大模型吗?!

X AI KOLs Timeline ↗ · 2026-09-14 缓存

Elon Musk tweets that Grok 5 may be better than any existing AI model, comparing Grok versions to other models like Opus 5.0 and highlighting improvements in upcoming versions.

0 人收藏 0 人点赞
#model-update

DeepSeek V4.1 Flash 正在令人惊讶地接近 GPT-5.6 Sol 的领域,同时价格低得离谱

Reddit r/singularity ↗ · 2026-09-10

DeepSeek 发布了 V4.1 Flash,一个 552B MoE 模型,具有高效的活动参数,性能接近 GPT-5.6 Sol,而成本却低得多。

0 人收藏 0 人点赞
#model-update

@Tech2Wild: 模型参数已翻倍!

X AI KOLs Following ↗ · 2026-09-10

AI模型的参数翻倍,这标志着其计算规模和潜在能力的显著提升。

0 人收藏 0 人点赞
#model-update

为Qwen3-TTS添加情感控制标签

Reddit r/LocalLLaMA ↗ · 2026-09-09

本文介绍了微调Qwen3-TTS以添加情感控制标签的方法,解决了训练中的编解码器前缀不一致和生成并发等问题,并发现可以通过说话人嵌入的仿射变换来操控情感。

0 人收藏 0 人点赞
#model-update

@gdb: ChatGPT Images 2.5 用于时尚:

X AI KOLs Timeline ↗ · 2026-09-08 缓存

Yana Welinder 强调 ChatGPT Images 2.5 是时尚应用的重大改进,与上一版本相比提高了设计真实感。

0 人收藏 0 人点赞
#model-update

Google AI天气模型的更新提升了预报准确度

Ars Technica ↗ · 2026-09-08 缓存

Google的AI天气模型WeatherNext 3已更新,采用更多原始卫星数据并整合物理信息,使地表温度预报准确率最高提升30%,目前已成为Google服务中预报的数据源。

0 人收藏 0 人点赞
#model-update

@levie: 在Box,我们一直在早期测试版中使用Fable 5.1,以评估其在复杂企业工作中的表现。Fable 5.1带来了巨大的提升……

X AI KOLs Timeline ↗ · 2026-09-01 缓存

Box测试了Fable 5.1,该模型在复杂企业任务中比Fable 5提升了7个百分点,在金融服务、技术和公共部门等方面有显著进步,并将与新模型Claude Fable 5.1和Claude Mythos 5.1一起在Box AI Studio中提供。

0 人收藏 0 人点赞
#model-update

@RayFernando1337: 让他发挥。现在拥有两台DGX Sparks真是太有趣了。

X AI KOLs Following ↗ · 2026-08-29 缓存

一位Twitter用户讨论拥有两台NVIDIA DGX Sparks系统,而另一位用户报告通过模型更新到DFlash2-7后,token吞吐量达到每秒67个。

0 人收藏 0 人点赞
#model-update

@10xmylife: Ox Alpha 就是 GLM 5.3 Flash 最近模型更新很快,能力迭代很棒

X AI KOLs Following ↗ · 2026-08-26 缓存

推文介绍了Ox Alpha模型即GLM 5.3 Flash,提到模型更新迅速,能力迭代出色,并分享了测试结果,包括成功复刻异星工厂的4小时长任务。

0 人收藏 0 人点赞
#model-update

@AlmustyFX: 混合专家模型轻量级解决方案正日益成熟。Ling-3.0-tiny 总参数规模为7.9B…

X AI KOLs Timeline ↗ · 2026-08-24

Ling-3.0-tiny 采用混合专家模型架构,总参数7.9B,但每次运行仅激活1.3B参数,从而降低计算开销,使Mac上的本地执行更加流畅。

0 人收藏 0 人点赞
#model-update

Harvey 后期训练 Kimi K3 以进行长期法律工作 (阅读需10分钟)

TLDR AI ↗ · 2026-08-21 缓存

Harvey 后期训练了 Kimi K3 模型以创建 Harvey Tenet,用于长期法律工作,在法律基准测试中取得了更好的性能并提高了成本效率。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈