标签
本文提供了 Engram 模型的更新,详细介绍了其 2.6b 参数架构,包括一个大型 Engram 表和初步训练进度达到 1 亿 token,展示了通过上下文感知数据卸载实现的改进补全效果。
Addy Osmani 赞扬 Opus 5.5 是一个更便宜、更快的 AI 模型,宣称它是他大多数工作任务的新日常主力工具。
Qwen image 2.1,一个使用FP8以提高速度的AI模型,生成尺寸小于10GB的优质图像。它在Unsloth Studio上可用,该平台已更新以支持此版本。
Anthropic 计划推出 Sonnet 5.5 和 Haiku 5.5,这是其AI语言模型的即将更新。
Miles Brundage 观察到 Grok 4.7 在安全功能上有轻微改进。
Qwen3.8 Max 经过升级后,以45分的AI分析智能指数得分领跑中国AI排行榜,超越了GLM-5.3和Kimi K3,这是其2.4T MoE模型在30天内优化提升的结果。
OpenAI将于10月14日退役GPT-5.5,并推荐用户切换到GPT-5.6 Sol或新的GPT-6 Astra模型。
Elon Musk tweets that Grok 5 may be better than any existing AI model, comparing Grok versions to other models like Opus 5.0 and highlighting improvements in upcoming versions.
DeepSeek 发布了 V4.1 Flash,一个 552B MoE 模型,具有高效的活动参数,性能接近 GPT-5.6 Sol,而成本却低得多。
本文介绍了微调Qwen3-TTS以添加情感控制标签的方法,解决了训练中的编解码器前缀不一致和生成并发等问题,并发现可以通过说话人嵌入的仿射变换来操控情感。
Yana Welinder 强调 ChatGPT Images 2.5 是时尚应用的重大改进,与上一版本相比提高了设计真实感。
Google的AI天气模型WeatherNext 3已更新,采用更多原始卫星数据并整合物理信息,使地表温度预报准确率最高提升30%,目前已成为Google服务中预报的数据源。
Box测试了Fable 5.1,该模型在复杂企业任务中比Fable 5提升了7个百分点,在金融服务、技术和公共部门等方面有显著进步,并将与新模型Claude Fable 5.1和Claude Mythos 5.1一起在Box AI Studio中提供。
一位Twitter用户讨论拥有两台NVIDIA DGX Sparks系统,而另一位用户报告通过模型更新到DFlash2-7后,token吞吐量达到每秒67个。
推文介绍了Ox Alpha模型即GLM 5.3 Flash,提到模型更新迅速,能力迭代出色,并分享了测试结果,包括成功复刻异星工厂的4小时长任务。
Ling-3.0-tiny 采用混合专家模型架构,总参数7.9B,但每次运行仅激活1.3B参数,从而降低计算开销,使Mac上的本地执行更加流畅。
Harvey 后期训练了 Kimi K3 模型以创建 Harvey Tenet,用于长期法律工作,在法律基准测试中取得了更好的性能并提高了成本效率。