speed

标签

Cards List
#speed

@HowToPrompt__: 你现在可以在MacBook上100%本地运行Claude Code,每月花费0美元。它叫做claude-code-local。它运行一个122B参数的模型…

X AI KOLs Timeline ↗ · 2026-06-16 缓存

一个名为claude-code-local的新开源工具允许在MacBook上本地运行一个122B参数的模型,每秒处理65个token,并完整支持Claude Code,在原始速度上击败云端Opus。

0 人收藏 0 人点赞
#speed

速度对 Google 网页搜索至关重要 [2009]

Lobsters Hottest ↗ · 2026-06-15 缓存

谷歌 2009 年的研究表明,较慢的搜索响应时间会降低用户参与度和满意度。

0 人收藏 0 人点赞
#speed

Diffusion Gemma 速度快4倍,但错误多6倍!

Reddit r/LocalLLaMA ↗ · 2026-06-12

一项基准测试显示,Diffusion Gemma 比 Gemma4 速度快4倍,但事实性错误多6倍,尤其是在冷门话题上,为了生成流畅文本而牺牲了事实准确性。

0 人收藏 0 人点赞
#speed

@steeve:我们更快了(我知道我知道)

X AI KOLs Following ↗ · 2026-06-08 缓存

Steeve Morin 报告称,经过5天的工作,他的实现速度现已与llama.cpp相差不到10%,达到每秒64个token对70个token,还需继续优化。

0 人收藏 0 人点赞
#speed

@aparnadhinak: https://x.com/aparnadhinak/status/2062233330196926720

X AI KOLs Timeline ↗ · 2026-06-03 缓存

一个Twitter讨论串,探讨了数据库文件系统抽象(PostgresFS)和基于技能的方法(使用本地 Bash)哪个更适合代理工作流。技能方法在组合性和速度上胜出。

0 人收藏 0 人点赞
#speed

@RuiTheBaker: GPT 5.5级别的排名,但快27倍?!@mixedbreadai

X AI KOLs Following ↗ · 2026-06-02 缓存

根据早期结果,Mixedbread 的重排序器在 OBLIQ-bench 上达到了 GPT 5.5 级别性能,同时速度快 27 倍。

0 人收藏 0 人点赞
#speed

@jerryjliu0: 以光速解析PDF(此视频为1倍速)简直是电影

X AI KOLs Following ↗ · 2026-05-29 缓存

Jerry Liu宣布了LiteParse v2,一款基于Rust的PDF解析器,据称是目前最快、最准确的开源、无模型PDF解析器。

0 人收藏 0 人点赞
#speed

全新LFM2.5 8b A1b模型!!

Reddit r/LocalLLaMA ↗ · 2026-05-29

介绍LFM2.5 8b A1b,一款性能与Nemotron 3 Nano相当但速度更快的新AI模型。SmallCode正在增加对非标准工具调用的支持。

0 人收藏 0 人点赞
#speed

快优于慢

Lobsters Hottest ↗ · 2026-05-27 缓存

一篇博客文章,主张软件开发中的速度能带来更好的学习和决策,并提供实用建议,如避免拖延和尽早分享工作。

0 人收藏 0 人点赞
#speed

Gemini 3.5 Flash 凭速度看很不错(8分钟阅读)

TLDR AI ↗ · 2026-05-26 缓存

谷歌发布了 Gemini 3.5 Flash,这是一款混合速度模型,在速度和成本上与 Opus 4.7 和 GPT-5.5 相抗衡,同时在智能体和编程基准测试中表现良好。

0 人收藏 0 人点赞
#speed

@no_stp_on_snek: 进行中

X AI KOLs Following ↗ · 2026-05-23 缓存

推广 Atlas Inference,这是一个开源推理服务工具,在 Qwen3.6-35B-A3B 基准测试上实现了 200+ tok/s 的性能。

0 人收藏 0 人点赞
#speed

为未来设计Firefox

Lobsters Hottest ↗ · 2026-05-22 缓存

Mozilla宣布Project Nova,这是Firefox的重新设计,专注于隐私、速度以及更简洁、更温暖的设计,并对标签、设置和紧凑模式进行了更新。

0 人收藏 0 人点赞
#speed

40+ token/秒 - 在单台 DGX Spark 上使用 vLLM 运行 Qwen 3.5 122B Int4 的优化方案

Reddit r/LocalLLaMA ↗ · 2026-05-20

用户分享了一种在单台 DGX Spark 上使用 vLLM 运行 Qwen 3.5 122B Int4 的优化方案,实现了每秒超过 40 个 token 的速度。他们邀请其他人尝试并进一步优化。

0 人收藏 0 人点赞
#speed

@YRSM_Simon: 这是个大新闻! kimi 2.6 是生成级的模型了,在 LLM 能力溢出的年代,速度要成为竞争的胜负手了,芯片领域又要“板块轮动”了吗

X AI KOLs Following ↗ · 2026-05-20 缓存

Cerebras is now running Kimi K2.6, a trillion-parameter model, in enterprise trials at ~1,000 tokens/s, the fastest frontier model performance ever measured by Artificial Analysis.

0 人收藏 0 人点赞
#speed

@VraserX:Gemini 3.5 Flash 可能是谷歌最具危险性的发布。基准测试令人印象深刻,但真正的故事是速…

X AI KOLs Following ↗ · 2026-05-19 缓存

一条推文强调谷歌的 Gemini 3.5 Flash 是一款快速、强大且价格实惠的 AI 模型发布,重点突出了其令人印象深刻的基准测试和性价比。

0 人收藏 0 人点赞
#speed

@julien_c: 我注意到网上有些困惑,关于如何以最简单的方式运行带MTP(多令牌预测)的llama.cpp……

X AI KOLs Following ↗ · 2026-05-19 缓存

Julien C 解释了如何运行带有MTP(多令牌预测)的llama.cpp,以实现约2倍的生成速度,可以使用Dense 27B或MoE 35B模型,并提供了安装和配置说明。

0 人收藏 0 人点赞
#speed

@populartourist: Unsloth Qwen3.6 27B Q6_K 在 RTX 5090 上通过 MTP 实现超过 100 令牌/秒。相比没有 MTP 时的 45-50 令牌/秒大幅提升。这真是太…

X AI KOLs Timeline ↗ · 2026-05-16 缓存

Unsloth Qwen3.6 27B Q6_K 在 RTX 5090 上通过 MTP 达到每秒超过 100 个令牌,相比没有 MTP 时的 45-50 令牌/秒显著提升。

0 人收藏 0 人点赞
#speed

@berryxia: 我靠,肉眼都跟不上这个速度了! Daniel Han,UnslothAI创始人,YC S24,之前在NVIDIA做ML,刚刚把Qwen3.6的实验MTP GGUF放出来了。 27B模型单GPU直接跑到140 tokens/s。 35B-A…

X AI KOLs Timeline ↗ · 2026-05-14

UnslothAI创始人Daniel Han发布了Qwen3.6的实验性MTP GGUF版本,在消费级GPU上实现27B模型140 tokens/s、35B-A3B版本220 tokens/s,速度提升1.4倍且精度零损失。

0 人收藏 0 人点赞
#speed

@tan_stack: TanStack Devtools 刚刚迁移到了 @OxcProject 解析器 + magic-string! 结果:单文件转换: 1.65 ms → 0.46 m…

X AI KOLs Following ↗ · 2026-05-13 缓存

TanStack Devtools 迁移到了 OxcProject 解析器和 magic-string,实现了 3.56 倍的加速,单文件转换时间从 1.65 毫秒降至 0.46 毫秒。

0 人收藏 0 人点赞
#speed

Previewing Ultrafast mode: GPT‑5.6 Sol at up to 14X the speed

YouTube AI Channels ↗ · 2026-08-14 缓存

OpenAI 预览了 GPT-5.6 Sol 的 Ultrafast 模式,速度最高提升 14 倍,同时保持与标准模式同等质量的智能,可在监控、数据处理、搜索和编码等场景中实现近乎实时的体验。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈