deepseek-v4-flash

标签

Cards List
#deepseek-v4-flash

更新:100-bot论坛的虚拟角色数量增至320个,不再具备全知能力——应众多用户请求,现在可直接与它们对话

Reddit r/singularity · 2026-09-08

botcitizens.com平台现已支持与320个虚拟角色进行一对一实时对话,每个角色都拥有个性化的背景设定及安全过滤机制。

0 人收藏 0 人点赞
#deepseek-v4-flash

HumanEval基准测试:Deepseek V4 Flash 0731 对比 GLM5.3 Flash 在双DGX Spark配置上的表现

Reddit r/LocalLLaMA · 2026-08-29

一项在双DGX Spark配置上的个人基准测试对比显示,GLM5.3 Flash在HumanEval上准确率更高,但上下文长度减小且速度较慢。

0 人收藏 0 人点赞
#deepseek-v4-flash

[基准测试] llama.cpp batch 与 ubatch 对 PP 和 TG 的影响

Reddit r/LocalLLaMA · 2026-08-24

本文基准测试了在 DGX Spark 机器上使用 DeepSeek v4 Flash 时,llama.cpp 中 batch 和 ubatch 参数对提示处理和文本生成速度的影响,揭示了文本生成性能的惊人效果。

0 人收藏 0 人点赞
#deepseek-v4-flash

@TheAhmadOsman: 澄清一下,OMP 有 97.5% 的缓存命中率。我的大部分使用都是自托管模型,并非所有推理设置都正确报告了遥测数据,所以…

X AI KOLs Timeline · 2026-08-23 缓存

一位用户澄清 OMP 有 97.5% 的缓存命中率,并讨论了自托管 DeepSeek V4 Flash 模型的使用,解决了对推理设置中缓存性能的担忧。

0 人收藏 0 人点赞
#deepseek-v4-flash

在128GB内存与约60GB显存(PCIe配置较弱)环境下运行DeepSeek-V4-Flash-0731 q4+量化版本的三次实验:实现可接受的生成速度和提示处理速度

Reddit r/LocalLLaMA · 2026-08-22

作者在配备128GB内存的系统上实验运行DeepSeek-V4-Flash-0731的4位量化模型,通过内存锁定和提示处理策略等优化手段,达到了可接受的推理速度。

0 人收藏 0 人点赞
#deepseek-v4-flash

相同模型,相同提示词,两个代理框架:45/50 vs 43/50

Reddit r/AI_Agents · 2026-08-21

文章对相同的deepseek-v4-flash模型上的两个开源编码代理进行了基准测试,发现任务成功率相似,但在性能指标上存在显著差异,并且一个代理的错误处理中存在一个关键漏洞。

0 人收藏 0 人点赞
#deepseek-v4-flash

如何在M3 Ultra上让DeepSeek V4 Flash快12倍

Reddit r/LocalLLaMA · 2026-08-19

作者通过优化内核和实现有效的缓存策略,在Mac Studio M3 Ultra上将DeepSeek V4 Flash的速度提升了12倍,将聊天轮次延迟从6-20秒降低到1.6秒。

0 人收藏 0 人点赞
#deepseek-v4-flash

使用 DeepSeek V4 Flash 扩展自我验证,在 Terminal-Bench 2.1 上击败 Claude Fable 5,同时成本低11倍

Reddit r/singularity · 2026-08-18 缓存

LLM-as-a-verifier 是一个为 AI 智能体提供细粒度反馈的框架,使用 DeepSeek V4 Flash 在 Terminal-Bench 2.1 等基准测试上实现了最先进的性能,以更低的成本优于 Claude Fable 5。

0 人收藏 0 人点赞
#deepseek-v4-flash

@VictorKaiWang1:在 Terminal Bench 2.1 上达到 95.3%,DeepSeek V4 Flash + StateM,在 TB2.1 上为 88.8%

X AI KOLs Timeline · 2026-08-18 缓存

研究人员使用 DeepSeek V4 Flash 和 StateM 在 Terminal-Bench 2.1 上达到了 95.3% 的准确率,匹配了 GPT-5.6 Sol Max 的性能,并探索了超越模型扩展的智能体改进。

0 人收藏 0 人点赞
#deepseek-v4-flash

DeepSeek V4 Flash 搭配 Antirez Dwarfstar 4 表现惊人

Reddit r/LocalLLaMA · 2026-08-17

本文强调了在高内存Mac上使用DeepSeek V4 Flash搭配Antirez Dwarfstar 4的出色性能,指出其超越其他AI模型,并减少了对更大系统的需求。

0 人收藏 0 人点赞
#deepseek-v4-flash

在一台 DGX Spark 上对 124B 模型进行了一周基准测试并全部公开——他找到的最快路径为 38.7 tok/s,比同机上的 DeepSeek V4 Flash 快 2.4 倍

Reddit r/LocalLLaMA · 2026-08-12

sudoingX 的一项独立基准测试显示,在澄清官方 INT4 量化确实可用之后,Ling-3.0-flash 模型在单台 DGX Spark 上的运行速度为 38.7 tok/s,比同硬件上的 DeepSeek V4 Flash 快 2.4 倍。

0 人收藏 0 人点赞
#deepseek-v4-flash

@MichaelGannotti: https://x.com/MichaelGannotti/status/2084186867000279436

X AI KOLs Following · 2026-08-03 缓存

对NVIDIA DGX Spark上的DeepSeek V4 Flash进行了14.7小时的浸泡测试,共971个请求,结果表明零崩溃或错误,但由于热节流,吞吐量下降了28%,而TTFT和推测接受率保持稳定。

0 人收藏 0 人点赞
#deepseek-v4-flash

DeepSeek-V4-Flash-0731:当“Low”高于“High”

Reddit r/LocalLLaMA · 2026-08-02

一位开发者对 DeepSeek-V4-Flash-0731 的四种推理努力模式(无、低、高、最大)进行了基准测试,发现低模式出人意料地冗长,并且 OpenRouter 存在一个影响推理努力模式的 bug。

0 人收藏 0 人点赞
#deepseek-v4-flash

DeepSeek v4 Flash 初步测试显示 UI/UX 设计能力显著提升(尽管 token 消耗较大)

Reddit r/LocalLLaMA · 2026-07-31

DeepSeek v4 Flash 的初步测试显示其 UI/UX 设计能力有显著提升,不过该模型仍十分消耗 token。

0 人收藏 0 人点赞
#deepseek-v4-flash

工具对决:Claude Code vs OpenCode vs Pi 搭配 DeepSeek V4 Flash

Reddit r/LocalLLaMA · 2026-07-26

一篇对比文章,将AI编码工具Claude Code、OpenCode和Pi与DeepSeek V4 Flash进行较量。

0 人收藏 0 人点赞
#deepseek-v4-flash

@YRSM_Simon: 7天,5亿token,Local AI GLM 5.2,deepseek v4 flash,Qwen 3.6 35B A3B,三个模型几乎能满足绝大部分业务自动化需求了

X AI KOLs Following · 2026-07-21 缓存

A user reports that using three local AI models (GLM 5.2, DeepSeek v4 Flash, Qwen 3.6 35B A3B) over 7 days with 500 million tokens can cover most business automation needs.

0 人收藏 0 人点赞
#deepseek-v4-flash

有没有其他人觉得 Mimo v2.5 比 DeepSeek v4 Flash 更好?

Reddit r/LocalLLaMA · 2026-07-08

一位用户反馈称,根据 Codex、Oh My Pi、Hermes 和 Terminal Bench v2.0 等基准测试,Mimo v2.5 在编程任务上优于 DeepSeek v4 Flash,尽管两者整体表现相似。

0 人收藏 0 人点赞
#deepseek-v4-flash

在 AMD MI300X 上运行 DeepSeek-V4-Flash

Hacker News Top · 2026-06-02 缓存

这篇博客文章详细记录了作者在 AMD MI300X GPU 上运行 DeepSeek-V4-Flash 的努力,重点介绍了 FP8 方言的软件兼容性问题,并提供了该过程的工作日志。

0 人收藏 0 人点赞
#deepseek-v4-flash

@libapi_: 因为有好几个人问我怎么在hermes-web-ui 面板里 免费使用 deepseek-v4-flash:free 授权登录激活 面板现在直接授权登录是不可以的,你需要到cli重新授权登录才会在面板里显现出来 : deepseek-v4-…

X AI KOLs Timeline · 2026-05-26 缓存

教程介绍如何在hermes-web-ui面板中通过CLI重新授权登录来免费使用deepseek-v4-flash:free模型,前提是已订阅nousresearch的0$套餐。

0 人收藏 0 人点赞
#deepseek-v4-flash

@dealignai: DeepSeek-V4-Flash 破解版(已消融/未审查) - 仅限Mac (Osaurus/vMLX) https://huggingface.co/dealignai/DeepSeek-V4…

X AI KOLs Timeline · 2026-05-24 缓存

DeepSeek-V4-Flash 的消融版(未审查),针对 Apple Mac 使用 MLX 进行了优化,移除了拒绝行为,同时保留了知识和推理能力。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈