ai-models

标签

Cards List
#ai-models

@ChatGPT: GPT-6 Sol 和 GPT-6 Luna,是你们闪耀的时候了。今天在 ChatGPT Work 和 Codex 推出,适用于 Plus、Pro、Business,…

X AI KOLs Timeline ↗ · 2026-09-22 缓存

GPT-6 Sol 和 GPT-6 Luna 今日面向 ChatGPT Work 和 Codex 用户推出,涵盖 Plus、Pro、Business、Enterprise 和 Edu 等级。

0 人收藏 0 人点赞
#ai-models

@dotey: 每次OpenAI发布新模型,第一周的体验总是特别好,然后似乎就变成了……

X AI KOLs Timeline ↗ · 2026-09-22 缓存

这条推文对比了AI模型性能的持久性,暗示OpenAI模型在发布初期表现优异,之后会退化,而Anthropic的Claude则能保持稳定。

0 人收藏 0 人点赞
#ai-models

@charliermarsh: 好吧,我感兴趣。为什么他们从 Opus 5 跳到 Opus 5.5。这是一个正常的顺序吗?

X AI KOLs Timeline ↗ · 2026-09-22

一条推文质疑 AI 模型中从 Opus 5 到 Opus 5.5 的版本跳跃,询问这是否是正常的序列实践。

0 人收藏 0 人点赞
#ai-models

@browser_use: 开源MiMo v2.6模型是新帕累托前沿 > MiMo v2.6 Flash: 37.6 > Grok 4.7的39.9 > 成本低57倍…

X AI KOLs Following ↗ · 2026-09-22 缓存

据称,开源MiMo v2.6模型建立了新的帕累托前沿,在基准测试中成本比Grok 4.7低57倍,比DeepSeek v4.1 Flash便宜27%。

0 人收藏 0 人点赞
#ai-models

据报道,GPT-6 Sol、Luna和“Astra Minor”刚刚出现在Microsoft的Azure模型配置中

Reddit r/singularity ↗ · 2026-09-22

据报道,名为GPT-6 Sol、Luna和Astra Minor的新AI模型出现在Microsoft的Azure模型配置中,这暗示了即将发布或集成的可能性。

0 人收藏 0 人点赞
#ai-models

Show HN: JevBench,一个用于类型化决策模型的可复现基准测试

Hacker News Top ↗ · 2026-09-22 缓存

JevBench v1.3.0 是一个用于Jev类决策模型的可复现基准测试,基于智能性、校准度、速度和成本对52个系统进行评估和排名。

0 人收藏 0 人点赞
#ai-models

阿里巴巴是否放弃了35B A3B?

Reddit r/LocalLLaMA ↗ · 2026-09-22

文章质疑阿里巴巴是否放弃了其35B A3B MoE模型,指出在Qwen 3.8发布之际,没有新的小规模MoE模型公告。

0 人收藏 0 人点赞
#ai-models

我发现这个代理每天能让你免费使用最多20小时的 GLM 5.3 Flash 或 DeepSeek 4.1 Flash,无需提供支付信息!

Reddit r/AI_Agents ↗ · 2026-09-22

一位用户发现了一个代理,提供每天最多20小时免费访问 GLM 5.3 Flash 和 DeepSeek 4.1 Flash AI 模型,对 GitHub 注册和连续使用有额外奖励,无需支付信息。

0 人收藏 0 人点赞
#ai-models

列表计数失败并非单一现象

arXiv cs.LG ↗ · 2026-09-22 缓存

研究表明,开放权重聊天模型在计数列表项时会因不同的错误模式而失败,而非单一现象,这对模型干预和迁移学习有影响。

0 人收藏 0 人点赞
#ai-models

@FiniYang: 做了一个小猫咪生存游戏 让官方的Jev和本地的Laya (mlx) 组队保护小猫 每一步都由模型自己选择…

X AI KOLs Timeline ↗ · 2026-09-22 缓存

作者创建了一个猫咪生存游戏来测试AI模型Jev和Laya的性能,发现Jev更准确但较慢,而Laya很快但不准确,并计划为这类模型开发一个排行榜。

0 人收藏 0 人点赞
#ai-models

@10xmylife: 即将推出 Qwen4 系列 - Qwen4-Max - Qwen4-Flash&Qwen4-Plus - Qwen4-27B 大型模型,参数规模达5T~10T级别…

X AI KOLs Following ↗ · 2026-09-22

Qwen4 系列 AI 模型,包括 Qwen4-Max、Qwen4-Flash&Qwen4-Plus 和 Qwen4-27B,即将推出,参数规模前所未有的达到5T至10T级别,在 Yunqi Conference 上进行了预览。

0 人收藏 0 人点赞
#ai-models

@NFTCPS: 收藏这个网站——它基本上能帮你节省半年到处搜寻AI工具的时间。FMHY AI 已经汇集了……

X AI KOLs Timeline ↗ · 2026-09-22 缓存

一个综合性的网站,汇集了免费使用的AI资源,包括主流模型、图像生成工具、编程辅助工具和本地部署选项,旨在帮助用户节省寻找AI工具的时间。

0 人收藏 0 人点赞
#ai-models

Claude 状态:多个模型错误率上升

Hacker News Top ↗ · 2026-09-22 缓存

Anthropic 报告了影响 Claude 模型(包括 Mythos 5.1、Fable 5.1 和 Opus 5)的错误率上升,这些问题在影响了 Claude API 和 Claude Code 等服务后已得到解决。

0 人收藏 0 人点赞
#ai-models

@elonmusk: 正确

X AI KOLs Timeline ↗ · 2026-09-22 缓存

埃隆·马斯克确认了Grok AI模型的快速进展,这些模型在短短90天内从勉强跻身前十提升到了前沿地位。

0 人收藏 0 人点赞
#ai-models

@elonmusk: 酷

X AI KOLs Following ↗ · 2026-09-22 缓存

Elon Musk 发推文回应用户 Auggie,后者报道称 Grok 4.7 在音乐错误检测测试中获得 100% 的分数,与 GPT-6 Astra 的表现相当。

0 人收藏 0 人点赞
#ai-models

AI 来袭 if 语句(4分钟阅读)

TLDR AI ↗ · 2026-09-22 缓存

Jev 和 SemIf 等 AI 模型正在优化软件中的 if-then 决策过程,从而大幅降低成本并提高准确性,这突显了专业化其他编程原语的潜力。

0 人收藏 0 人点赞
#ai-models

基准测试:Grok 4.7, GPT 6, Astra Fable 4.1 和 DeepSeek V4.1 Flash

Reddit r/artificial ↗ · 2026-09-21

发布最新AI模型的全面基准测试,包括Grok 4.7、GPT 6、Astra Fable 4.1和DeepSeek V4.1 Flash,以提供公正的比较。

0 人收藏 0 人点赞
#ai-models

为什么感觉有很多AI模型被发布?

Reddit r/ArtificialInteligence ↗ · 2026-09-21

文章质疑最近AI模型发布的增加,以及与两年前相比,它们在智能和价格方面的竞争力。

0 人收藏 0 人点赞
#ai-models

据《The Information》报道——令人难以置信的(如果属实)AI模型在OpenAI协助AI训练

Reddit r/singularity ↗ · 2026-09-21

《The Information》的报道指出,AI模型正在协助OpenAI进行AI训练,如果属实,可能预示着AI开发的重大进展。

0 人收藏 0 人点赞
#ai-models

@vista8: VPS抓取信息无法绕过Cloudflare,GPT5.6 sol拒绝帮助。切换到Zhipu GLM 5.3 Flash。发现th…

X AI KOLs Timeline ↗ · 2026-09-21 缓存

一位用户使用Zhipu GLM 5.3 Flash和curl_cffi绕过Cloudflare封锁,以在JoMu RSS阅读器中启用YouTube视频摘要。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈