model-review

标签

Cards List
#model-review

@CtrlAltDwayne: 我不明白@cognition做了什么或怎么做到的,但SWE-2是货真价实的,伙计们。唯一的缺点是缺少……

X AI KOLs Following ↗ · 2026-09-13

一位用户赞扬来自Cognition的SWE-2,因其强大的编程能力,将其与Codex进行比较,但指出缺乏计算机使用功能。

0 人收藏 0 人点赞
#model-review

@RayFernando1337: Grok 4.6 跑了一整晚,它好吗?

X AI KOLs Following ↗ · 2026-08-13 缓存

Ray Fernando 主持了一场直播测试,整夜运行 Grok 4.6,并讨论该模型是否优秀。

0 人收藏 0 人点赞
#model-review

V4-Flash-0731 - 首个周末使用后的感受

Reddit r/LocalLLaMA ↗ · 2026-08-03

一位用户在周末测试后分享了V4-Flash-0731的实际使用感受,指出量化会严重降低性能,Q3权重可以在代理工作流中替代Qwen3.6-27B,全精度版本以极低的成本接近GLM 5.2级别,但在通用知识方面较弱。

0 人收藏 0 人点赞
#model-review

评测 Ling 3.0 flash - 从一条提示到3D世界

Reddit r/LocalLLaMA ↗ · 2026-07-31

对最新发布的 Ling 3.0 flash 模型的评测,该模型可从单一文本提示生成3D世界。

0 人收藏 0 人点赞
#model-review

对Laguna S2.1及其用途的真实评价(基于实际使用)

Reddit r/LocalLLaMA ↗ · 2026-07-24

用户分享了使用Laguna S2.1模型的经验,发现其因详尽的推理风格在复杂调试中效果显著,但不适合作为通用规划器。它成功修复了Qwen和Claude等其他模型无法解决的错误。

0 人收藏 0 人点赞
#model-review

GLM-5.2 快速评测(附:审查问题回答)

Reddit r/LocalLLaMA ↗ · 2026-06-18

一位用户对通过 API 调用的 GLM-5.2 进行了详细评测,称赞其长上下文连贯性、自适应推理能力以及与 GPT-5.5 相当的前沿文本性能,同时指出缺乏原生视觉能力且本地计算需求较高。

0 人收藏 0 人点赞
#model-review

@TheGeorgePu: 我正在试用DeepSeek V4 Pro,非常喜欢。这个模型被严重低估了。从我运行的几次测试来看,它和Opus 4.8一样好。

X AI KOLs Timeline ↗ · 2026-06-17 缓存

用户@TheGeorgePu称赞DeepSeek V4 Pro,称其被低估,并根据初步测试将其与Opus 4.8进行有利比较。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈