deepseek

标签

Cards List
#deepseek

@NousResearch:应广大用户要求,我们将DeepSeek V4 Flash 0731的90%折扣优惠延长3天。今天就试试吧…

X AI KOLs Timeline · 1小时前 缓存

Nous Research 应广大用户要求,将 DeepSeek V4 Flash 0731 的 90% 折扣优惠再延长 3 天。

0 人收藏 0 人点赞
#deepseek

更新基准测试:DeepSeek V4 Flash 在 SlopCodeBench(本地)上的表现

Reddit r/LocalLLaMA · 19小时前

用户分享了使用本地量化(antirez imatrix 量化)和 pi 工具在 SlopCodeBench 上对 DeepSeek V4 Flash 的最新基准测试结果,显示性能较之前运行有所提升,但仍比托管 API 慢。

0 人收藏 0 人点赞
#deepseek

@TheAhmadOsman: OMP 搭配 DeepSeek V4 Flash 0731 实在是太棒了

X AI KOLs Following · 昨天

一条推文,称赞 OMP 与 DeepSeek V4 Flash 0731 结合的质量。

0 人收藏 0 人点赞
#deepseek

@mattworkman: 啥?!

X AI KOLs Following · 昨天 缓存

一条推文报道,有人一边照顾新生儿,一边使用 DeepSeek Flash 0731 在手机上对《Super Smash Bros Melee》进行了反编译和逆向工程,将其转换为大约 5000 行 C 代码。

0 人收藏 0 人点赞
#deepseek

@Saccc_c: K3 也突破安全限制了,这是继 OpenAI、Anthropic、Meta之后出现这一情况的新模型 我猜测下一个应该是 @deepseek_ai 了, @GeminiApp 简直就是路边一条

X AI KOLs Following · 昨天 缓存

K3 模型也突破了安全限制,成为继 OpenAI、Anthropic、Meta 之后出现类似情况的模型,作者猜测下一个会是 DeepSeek,并吐槽 Gemini 表现不佳。

0 人收藏 0 人点赞
#deepseek

@jakevin7: https://x.com/jakevin7/status/2086031167040426488

X AI KOLs Timeline · 昨天 缓存

Maka 是一个开源 Agent Harness,通过日志即运行时、上下文剪枝、thinking 回传等机制,将同一 DeepSeek 任务的成本降至 OpenCode 的 1/8,并在 Terminal-Bench 上以更低成本取得更高通过率。

0 人收藏 0 人点赞
#deepseek

@jakevin7: 用maka 去微信群 maka builder里获取自己的上下文,确实强大。 maka + deepseek flash真的是太好用了。 尤其是maka的swarm模式,做的确实爽啊。 https://github.com/maka-ag…

X AI KOLs Following · 昨天 缓存

作者在推特上分享使用 Maka 与 DeepSeek Flash 结合的心得,称其 swarm 模式很好用;附带的 GitHub README 介绍 Maka 是一个本地优先的 Agent 工作区,支持桌面、TUI、CLI 和无头运行,具备事件日志、工具调用与持久化任务等能力。

0 人收藏 0 人点赞
#deepseek

@TheAhmadOsman:在 DGX Station 上运行 DeepSeek V4 Flash 0731 的一些数据

X AI KOLs Timeline · 昨天 缓存

Ahmad Osman 分享了在 NVIDIA DGX Station 上运行 DeepSeek V4 Flash 0731 的性能数据。

0 人收藏 0 人点赞
#deepseek

还有人觉得 DeepSeek-V4-Flash 在非编程任务上不可靠吗?

Reddit r/LocalLLaMA · 昨天

一位用户报告称,尽管 DeepSeek-V4-Flash-0731 在基准测试中得分很高,但在摘要、会议记录等非编程办公任务上却并不可靠,在概念提取和说话人理解方面表现不佳,而 Gemma-4-31B 的表现更好。

0 人收藏 0 人点赞
#deepseek

@shikhargupta02: 我一直在学习潜在注意力(来自 DeepSeek)。它不是为每个 token 存储完整的 K 和 V 向量,而是……

X AI KOLs Timeline · 2天前 缓存

作者分享了他用 DeepSeek 的潜在注意力训练一个小模型的见解,观察到潜在空间的使用因层而异,以及一个可以将 KV 缓存减少 4 倍且损失不变的测试时技巧。

0 人收藏 0 人点赞
#deepseek

在 2x DGX Spark 上部署 DeepSeek v4 Flash 0731 — 5-7 GB 操作系统余量,你会如何降低 VRAM 占用并增加操作系统可用 RAM?

Reddit r/LocalLLaMA · 2天前

用户在使用 vLLM 在两台 DGX Spark 机器上部署 DeepSeek-V4-Flash-0731 时,寻求社区关于降低 VRAM 占用和释放操作系统 RAM 的建议,分享了详细的配置和内存测量数据。

0 人收藏 0 人点赞
#deepseek

@cline:DeepSeek V4-Flash 现在是 Cline 中使用量第一的模型。自 0731 更新以来,使用量增长 40%,token 消耗量增至 3 倍。…

X AI KOLs Timeline · 2天前 缓存

DeepSeek V4-Flash 已成为 Cline 中使用量最高的模型,自 0731 更新以来使用量增长 40%,token 消耗量翻了三倍,超过了后两个模型的总和,并连续刷新历史新高。

0 人收藏 0 人点赞
#deepseek

DeepSeek V4 Flash 0731

Hacker News Top · 2天前 缓存

DeepSeek V4 Flash 0731 展示了其在 ARC-AGI 基准上的结果,突显了 AI 模型在抽象推理方面的进展。

0 人收藏 0 人点赞
#deepseek

@Saccc_c: 想给deepseek v4 flash增加多模态能力,强烈建议配合qwen3.7-flash使用,目前最高性价比的模型组合 qwen3.7-flash是一个轻量多模态模型,速度快也很适合大部分图片理解任务。关键价格也够低,现在注册有100…

X AI KOLs Timeline · 2天前 缓存

推荐将 DeepSeek v4 flash 与 qwen3.7-flash 组合使用,以低成本为 DeepSeek 增加多模态图片理解能力,并提供了通过阿里云百炼和 Codex 的简单配置步骤。

0 人收藏 0 人点赞
#deepseek

@Vinkyu567: https://x.com/Vinkyu567/status/2085693615150674221

X AI KOLs Timeline · 2天前 缓存

本文介绍如何通过CC Switch将DeepSeek接入Codex,以便在Codex中使用DeepSeek的模型,同时保留Codex的插件和技能。

0 人收藏 0 人点赞
#deepseek

GLM 5.2、Kimi 2.7 还值得用吗?

Reddit r/LocalLLaMA · 2天前

这是一场讨论,质疑在 Kimi K3、Qwen 3.8 Max 和 DeepSeek V4 Pro 等新模型陆续推出后,GLM 5.2 和 Kimi 2.7 等旧 AI 模型是否仍对编程具有重要意义。

0 人收藏 0 人点赞
#deepseek

)

TLDR AI · 3天前 缓存

DeepSeek 宣布大幅上调 API 价格,分析认为此举不仅是 GPU 成本转嫁,更反映了市场向基于价值的定价转变以及开源生态系统带来的压力。

0 人收藏 0 人点赞
#deepseek

@rohanpaul_ai:中国人形机器人领导者Unitree正在筹集9.04亿美元。此次发行将出售扩大后公司10%的股份,估值为90亿美元。U…

X AI KOLs Following · 3天前 缓存

中国人形机器人领导者Unitree正在内地IPO中筹集9.04亿美元,估值90亿美元,2025年已交付超过5,500台人形机器人,并与DeepSeek合作进行模型开发。

0 人收藏 0 人点赞
#deepseek

@ropaulhan_ai: 开源模型刚刚在实际支出份额的两项新任务排行榜上夺得榜首:DeepSeek V4 Pro 在 shell 执行方面领先…

X AI KOLs Following · 3天前 缓存

开源模型在实际支出份额的两项新任务排行榜上名列前茅,其中 DeepSeek V4 Pro 在 shell 执行方面领先,Kimi K3 在工具调度方面领先,这表明模型路由正转向按任务特定化。

0 人收藏 0 人点赞
#deepseek

@YRSM_Simon:120 t/s!干得好,@UnslothAI

X AI KOLs Following · 3天前 缓存

Unsloth AI 宣布推出 DSpark,使 DeepSeek-V4-Flash GGUF 模型在本地运行速度提升约 1.4–2 倍,达到 120 tokens/s,且准确率无变化。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈