speed-up

标签

Cards List
#speed-up

@reach_vb: 用于自主优化工作的 Codex:

X AI KOLs Timeline · 2026-06-30 缓存

Charlie Marsh 分享称,OpenAI 的 Codex 在他忙于其他任务时,自主发现了一个格式化工具可以提速 5-10%。

0 人收藏 0 人点赞
#speed-up

@charliermarsh:我让它再试一次,它又轻松找到了5%的加速。

X AI KOLs Timeline · 2026-06-30 缓存

Charlie Marsh 报告称,在让一个未具名的AI或工具重试优化后,又获得了5%的加速,可能与Ruff或uv有关。

0 人收藏 0 人点赞
#speed-up

@charliermarsh: 让我仍然感到不可思议的是,你只需将模型指向某些东西,就能持续地改进它们。Codex 发现了…

X AI KOLs Timeline · 2026-06-30 缓存

Charlie Marsh 指出,Codex 在格式化程序中自动发现了 5-10% 的速度提升,凸显了 AI 辅助工具改进的力量。

0 人收藏 0 人点赞
#speed-up

quicktok: 一个更快的分词器(与tiktoken精确且字节一致)[P]

Reddit r/MachineLearning · 2026-06-16

quicktok 是一个快速且精确的 BPE 分词器,用 C++ 编写,与 tiktoken 字节一致,比现有替代方案快 2–11 倍。支持 cl100k、o200k、GPT-OSS、Llama-3 和 Qwen2.5/3 编码器。

0 人收藏 0 人点赞
#speed-up

@hank_aibtc: https://x.com/ClementDelangue/status/2058672394865111544/video/1… 本地大模型速度天花板又被打破了! llama.cpp 原生支持 MTP(多令牌预测): - 无需额外 dr…

X AI KOLs Timeline · 2026-05-26 缓存

llama.cpp 原生支持多令牌预测(MTP),无需额外 draft 模型,利用模型内置预测头,使 Qwen3.6-27B 等本地模型实现 1.7x+ 加速,让 27B 模型在消费级显卡上流畅运行。

0 人收藏 0 人点赞
#speed-up

@davideciffa: 如果你拥有Nvidia RTX 4090,--ddtree-budget 36是最佳配置,可在解码过程中带来2.5倍速度提升…

X AI KOLs Timeline · 2026-05-24 缓存

一条推文推荐Nvidia RTX 4090使用--ddtree-budget 36,声称在Qwen3.6_27B解码时实现2.5倍加速。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈