ai-comparison

标签

Cards List
#ai-comparison

我今天新增了近10,000名粉丝!如果你刚来,这里有两件事可以开始:1. 我的vibe check …

X AI KOLs Timeline ↗ · 2天前 缓存

一条由@danshipper发布的推文,分享了关于AI模型比较和AI自动化对工作影响的文章。

0 人收藏 0 人点赞
#ai-comparison

大家都说我该去接触草地——但我觉得 Grok 4.7 做得最好?我在@kilocode 上比较了 Grok 4.7 和 Opus 5.5 在草地接触模拟器中的表现…

X AI KOLs Timeline ↗ · 2天前 缓存

一条推文在草地接触模拟器中比较了 Grok 4.7 和 Opus 5.5,显示了它们的价格:Grok 为 $3.52,Opus 为 $7.35。

0 人收藏 0 人点赞
#ai-comparison

我在相同Web开发提示下测试了9个LLM约8小时 — RTX 3060 12GB结果(请为最佳打分!)

Reddit r/LocalLLaMA ↗ · 4天前

本文呈现了在一个Web开发提示下对比9个LLM的8小时测试结果,重点关注哪些本地模型能在RTX 3060 12GB GPU上匹配前沿AI性能,包括详细的生成时间和实用见解。

0 人收藏 0 人点赞
#ai-comparison

@VraserX: 如果Gemini 4只能做到这样,那Google就完蛋了。

X AI KOLs Following ↗ · 6天前 缓存

一条推文比较了Gemini 4和GPT-6 Astra的性能,指出GPT-6 Astra更详细,但Gemini 4也不错,并质疑Google是否重回AI游戏。

0 人收藏 0 人点赞
#ai-comparison

ChatGPT 对比 Gemini

Reddit r/ArtificialInteligence ↗ · 2026-09-18

一位用户比较了ChatGPT和Gemini,发现Gemini在提供准确的法律推理和承认逻辑缺陷方面更胜一筹,而ChatGPT则依赖循环论证并回避直接回答。

0 人收藏 0 人点赞
#ai-comparison

@BenjaminDEKR: Figure是否目前已领先于Tesla Optimus?还是Tesla只是对其进展保持更安静/保密的状态?

X AI KOLs Following ↗ · 2026-09-17 缓存

该帖子讨论了Figure与Tesla Optimus机器人之间的竞争格局,质疑是Figure领先,还是Tesla刻意隐瞒进展。

0 人收藏 0 人点赞
#ai-comparison

幽默竞技场:哪个大语言模型最有趣?

Reddit r/LocalLLaMA ↗ · 2026-09-17

本文介绍了使用一个微调过的评判器对20个大语言模型版本在幽默生成方面的比较,其中Fable 5在笑话基准测试中得分最高。

0 人收藏 0 人点赞
#ai-comparison

Gemini 4 Pro 对比 Gemini 3.8 Flash(骑自行车的鹈鹕 SVG)

Reddit r/singularity ↗ · 2026-09-17

这是 Gemini 4 Pro 和 Gemini 3.8 Flash AI 模型之间的对比基准测试,测试内容为生成一个骑自行车的鹈鹕的 SVG 图像。

0 人收藏 0 人点赞
#ai-comparison

开源致敬帖

Reddit r/LocalLLaMA ↗ · 2026-09-16

作者批评病毒学研究中严格的AI安全措施,将Claude的限制与Deepseek V4.1的宽松性进行比较,并倡导开源AI以解锁科学进展。

0 人收藏 0 人点赞
#ai-comparison

@superalesha: 我给 DeepSeek 配置了一个 Astra 子代理。然后给 Astra 配置了一个 DeepSeek 子代理。接着我让两者单独工作,因为显然……

X AI KOLs Following ↗ · 2026-09-15 缓存

作者通过让 DeepSeek 和 Astra AI 模型作为子代理来构建 Mario Kart 游戏进行实验,比较输出结果,发现 DeepSeek 的版本更有灵魂。

0 人收藏 0 人点赞
#ai-comparison

ChatGPT Plus 与 Claude Pro 对比(我的观点)

Reddit r/AI_Agents ↗ · 2026-09-15

作者对比了 ChatGPT Plus 和 Claude Pro 在 3D 游戏开发项目中的编程应用,得出结论:Claude Pro 在大项目中具有更好的使用限额和代码理解能力,而 ChatGPT Plus 则在界面和模型访问方面更胜一筹。

0 人收藏 0 人点赞
#ai-comparison

@stackobserve:A\不仅不理解Harness,还贡献了一堆后来成为主流的愚蠢设计。相比OpenAI……

X AI KOLs Following ↗ · 2026-09-07 缓存

本文批评某款AI模型对Harness的理解存在严重缺陷,并将其与OpenAI进行对比,同时指出Codex Desktop在设计与功能上均优于Claude Desktop。

0 人收藏 0 人点赞
#ai-comparison

GLM 5.2 vs Opus 5 在移动设计中的对比

Reddit r/ArtificialInteligence ↗ · 2026-08-28

通过相同提示词比较GLM 5.2和Opus 5 AI模型在移动设计任务中的性能

0 人收藏 0 人点赞
#ai-comparison

人类在至少十个方面仍胜过AI:

Reddit r/artificial ↗ · 2026-08-28

文章突出了至少十个人类能力超越人工智能的领域。

0 人收藏 0 人点赞
#ai-comparison

学生在盲测中更偏好 Gemini 而非 ChatGPT 和 Claude 用于 AI 写作

Hacker News Top ↗ · 2026-08-26 缓存

StudyArena 的一项盲测显示,学生在撰写大学论文时更偏好 Gemini 而非 ChatGPT 和 Claude,选择率达到 39.6%。

0 人收藏 0 人点赞
#ai-comparison

@Youssofal_: Qwen 3.8 27B 对比 Fable、Kimi K3、GPT 5.6 Sol Pro 在 Flappy Bird 上。提示:“制作终极可爱、漂亮和美丽的……

X AI KOLs Timeline ↗ · 2026-08-25 缓存

本文比较了各种 AI 模型的性能,包括 Qwen 3.8 27B、Fable、Kimi K3 和 GPT 5.6 Sol Pro,在生成 HTML 版 Flappy Bird 游戏时的表现,重点突出了执行时间和质量的差异。

0 人收藏 0 人点赞
#ai-comparison

GPT-5.6 Sol 对比 Fable 5 - 移动应用设计

Reddit r/ArtificialInteligence ↗ · 2026-08-22

本文比较了GPT-5.6 Sol和Fable 5 AI模型在移动应用设计任务中使用相同提示的性能,并询问读者更偏好哪个模型。

0 人收藏 0 人点赞
#ai-comparison

开源本地模型在竞争中缺乏对ChatGPT的吸引力

Reddit r/ArtificialInteligence ↗ · 2026-08-22

本文比较了开源本地AI模型与ChatGPT的能力,指出前者在性能或功能上可能略逊一筹。

0 人收藏 0 人点赞
#ai-comparison

本地 Qwen 3.8 27B 对比 GPT-5.6 Terra 与 Grok 4.6

Reddit r/artificial ↗ · 2026-08-18

本文对比了三个AI模型——Qwen 3.8 27B、GPT-5.6 Terra和Grok 4.6——在构建Three.js香水发布网站方面的能力,详细阐述了它们的实施优势和潜在问题。

0 人收藏 0 人点赞
#ai-comparison

@bbcchinese: 一部被网友吐槽“烂到爆”的中国低成本动画《牛来》,却意外成为近期票房黑马,其票房已突破1000万元人民币。 这部电影于8月5日首映时,因剧情令人摸不着头脑、画面粗糙而乏人问津,但随后,一些网友以片中角色创作梗图,吸引了人们对这个两人制作的…

X AI KOLs Timeline ↗ · 2026-08-18 缓存

一部被网友吐槽的低成本中国动画《牛来》因梗图创作意外成为票房黑马,票房已破千万,并与AI生成内容形成对比。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈