coding

标签

Cards List
#coding

@cline:Qwen3.8-Max 是阿里巴巴迄今最大的模型,参数达 2.4T,在 Terminal-Bench 上的基准测试成绩比 Fable 5 高出 2%……

X AI KOLs Following · 6天前 缓存

阿里巴巴发布了其最大的模型 Qwen3.8-Max,参数规模达 2.4T,在 Terminal-Bench 上的成绩比 Fable 5 高出 2%,开放权重将于下周发布。

0 人收藏 0 人点赞
#coding

Qwen3.8-Max:编程与协作的新标杆

Hacker News Top · 6天前

Qwen3.8-Max 为 AI 模型的编程与协作能力树立了新标杆。

0 人收藏 0 人点赞
#coding

Qwen3.8-Max:编程与协作的新标杆(25分钟阅读)

TLDR AI · 6天前

Qwen 3.8-Max,一个拥有2.4万亿参数的模型,现已正式可用,开放权重将于下周发布,在编程、工作、研究和长期任务等方面带来全面改进。

0 人收藏 0 人点赞
#coding

Deepseek V4 Flash 现已成为仅次于 Kimi K3 的第二大开源权重模型,且成本低 50 倍以上

Reddit r/LocalLLaMA · 2026-07-31

DeepSeek 的新 V4 Flash 模型据报道是仅次于 Kimi K3 的第二大开源权重模型,以超过 50 倍更低的成本(每 100 万 tokens 0.09/0.18 美元)提供强劲性能,并具备扎实的代码和推理能力。

0 人收藏 0 人点赞
#coding

DeepSeek V4 Flash GA 在 DeepSWE 上排名与 Sonnet 5 和 Grok 4.5 相同

Reddit r/LocalLLaMA · 2026-07-31

DeepSeek 宣布推出 V4 Flash GA,声称其在 DeepSWE 基准测试上与 Sonnet 5 和 Grok 4.5 相当,但该说法尚未得到验证。

0 人收藏 0 人点赞
#coding

亚马逊意外使用Claude完成琐碎编码任务花费180万美元,超预算860%——内部AI使用指标发现'灾难性昂贵'的编码错误

Reddit r/ArtificialInteligence · 2026-07-30 缓存

亚马逊在一个Claude AI项目上花费了180万美元,该项目超预算860%,凸显了部署AI代理进行编码任务的成本风险。

0 人收藏 0 人点赞
#coding

我与LLM共事的经验

Reddit r/ArtificialInteligence · 2026-07-30

一位具有编码背景的VP/PM分享了使用Claude Opus和Fable等LLM的实践经验,重点指出了模型在记忆、幻觉和原创性方面的局限,同时强调了人类直觉和领域专业知识不可替代的价值。

0 人收藏 0 人点赞
#coding

@PrajwalTomar_:我只给了Grok 4.5一句话,它就在我喝完咖啡之前给我构建了一个能用的应用。Cursor刚刚推出了一项仅限...

X AI KOLs Following · 2026-07-28 缓存

Grok 4.5,一个强大的编码模型,现已纳入Cursor新推出的印度专属计划,每月₹649,让开发者仅凭一句话就能利用云端代理构建完整应用。

0 人收藏 0 人点赞
#coding

@kentcdodds: Claude Code 很实用,但 Annie Sexton 说它也把工程问题解决变得有些乏味——她还在…

X AI KOLs Timeline · 2026-07-27 缓存

Annie Sexton 和 Kent Dodds 谈到,Claude Code 虽然实用,但让工程问题解决变得枯燥,Sexton 仍在寻找那份乐趣去了哪里。

0 人收藏 0 人点赞
#coding

Kimi K3 今日开放权重——真的有人在用中国AI模型取代Claude或Codex吗?

Reddit r/ArtificialInteligence · 2026-07-27

月之暗面(Moonshot AI)开放了Kimi K3的模型权重,这是一个3T参数的前沿模型,专注于长周期编程、仓库级上下文和工具使用,支持自托管和微调。

0 人收藏 0 人点赞
#coding

Macaron-V1系列,基于Qwen3.6-35B-A3B构建

Reddit r/LocalLLaMA · 2026-07-26 缓存

MindLab Research发布了Macaron-V1-Tall,这是一个基于Qwen3.6-35B-A3B构建的Mixture of LoRA模型,配备了四个分别用于对话、代理、编码和GenUI任务的专家模块,上下文长度为262K。

0 人收藏 0 人点赞
#coding

Llama.cpp现已全面支持MCP!

Reddit r/LocalLLaMA · 2026-07-25

llama.cpp现已全面支持适用于所有协议的模型上下文协议(MCP),可在其WebUI中直接实现智能对话和工具集成,无需外部依赖。

0 人收藏 0 人点赞
#coding

2倍,而非10倍:2026年使用LLM编程

Hacker News Top · 2026-07-25 缓存

作者认为,由于LLM能够处理易于验证的任务,目前可为编程提供约2倍的生产力提升,但根本性限制使其无法实现10倍改进;进一步的提升将来自围绕现有能力重构工具,而非模型改进。

0 人收藏 0 人点赞
#coding

Laguna S 2.1 给我留下了深刻印象

Reddit r/LocalLLaMA · 2026-07-24

Laguna S 2.1 是一款 120B 类模型,它通过使用长思考令牌解决了 Julia 中的一个复杂编码问题,给我留下了深刻印象。在一个内存受限的重排任务中,它的表现超过了 Qwen 模型。

0 人收藏 0 人点赞
#coding

Anthropic 的 Opus 5 关乎 Token 效率,而非能力飞跃

Ars Technica · 2026-07-24 缓存

Anthropic 发布了 Opus 5,专注于 Token 效率和成本降低,而非重大的能力飞跃,提供接近 Fable 的性能,成本减半。

0 人收藏 0 人点赞
#coding

@bcherny:Opus 5 是一款出色的模型,适用于编程、数据分析、设计、生物学和知识工作。比任何这些评估分数更重要的是……

X AI KOLs Following · 2026-07-24 缓存

Anthropic 的 Claude Opus 5 被强调为编程、数据分析与知识工作领域的先进模型,具有前所未有的对提示注入攻击的抵抗力。系统卡显示,结合防御措施可将提示注入成功率降至接近零。

0 人收藏 0 人点赞
#coding

您的智能体操作超时了。您的代码会重试吗?

Reddit r/AI_Agents · 2026-07-23

技术文章,讨论当智能体操作超时时重试逻辑的重要性,并指出基于智能体的系统中一个常见误区。

0 人收藏 0 人点赞
#coding

本地测试(更新后的)Gemma 4在OpenCode中的编码表现

Reddit r/LocalLLaMA · 2026-07-23

在M5 Pro上使用llama.cpp本地测试了更新后的Gemma 4,使用OpenCode进行编码任务时达到60 tokens/s;后端表现良好,但UI/UX不佳。

0 人收藏 0 人点赞
#coding

我曾因这些技能引以为豪。如今,AI智能体做得更好。

Reddit r/artificial · 2026-07-23

作者反思了AI智能体在代码导航、调试和报告撰写方面如何超越自己,并询问他人在多智能体工作流(如MCP、Anvita Flow和Agent Protocol)方面的经验。

0 人收藏 0 人点赞
#coding

Gemini 和 antigravity 被低估了

Reddit r/singularity · 2026-07-21

一位开发者分享了一个激进观点:在 Antigravity 平台上使用 Google 的 Gemini Flash 模型,在执行小型编码任务时,其速度和简洁性优于 GPT 5.6,尽管 GPT 的智能上限更高。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈