speed-improvement

标签

Cards List
#speed-improvement

@dzhng: 对于构建AI系统的人来说,这比Astra或Fable更重要。我希望这类模型能持续发展…

X AI KOLs Timeline · 22小时前 缓存

Diogo Almeida,ChatGPT的联合发明者,发布了一个名为Jev的新AI模型,该模型使用RLCD训练,声称速度提升20-200倍。这一宣布被强调为AI模型训练领域的重要进展。

0 人收藏 0 人点赞
#speed-improvement

@levie:令人难以置信的是,仍有整个宇宙的AI创新存在,甚至不在我们大多数人的……

X AI KOLs Following · 昨天 缓存

一款名为Jev的新前沿AI模型被宣布,处理速度提升20-200倍,能力显著提高,突显了其在企业代理工作流中的潜力。

0 人收藏 0 人点赞
#speed-improvement

如果您在候补名单上,请回复您想尝试什么,或许我会帮助您 …

X AI KOLs Following · 2天前 缓存

Diogo Almeida,ChatGPT的联合发明者,宣布发布一个新的AI模型Jev,该模型使用RLCD训练,并承诺显著的速度提升。

0 人收藏 0 人点赞
#speed-improvement

@omarsar0: 推荐阅读。Jev 省去文本生成以大幅加快AI速度。TypeSafe 构建了一种新架构,该…

X AI KOLs Following · 2天前 缓存

Jev 是一个新AI模型,通过省略文本生成,对结构化问题实现20-200倍更快的响应,利用TypeSafe的并行架构和RLCD训练。

0 人收藏 0 人点赞
#speed-improvement

@maximelabonne: 你无法阻止我们变得更小。

X AI KOLs Timeline · 2026-08-20 缓存

一条推文讨论了通过将量化从F16切换到QAD Q4_0来优化本地LFM2.5-2.6B AI模型,从而减小体积、提高速度、降低延迟,并保持高性能。

0 人收藏 0 人点赞
#speed-improvement

[R] SineKAN:基于正弦激活函数的Kolmogorov-Arnold网络

Reddit r/MachineLearning · 2026-08-17 缓存

SineKAN 提出了一种基于正弦激活函数的 Kolmogorov-Arnold 网络变体,在基准任务上,与基线 KAN 模型相比,显示出相当或更好的性能,并有显著的速度提升。

0 人收藏 0 人点赞
#speed-improvement

我们基于Hy3 295B的1位量化版本比云端API运行快2.2倍,且质量无损

Reddit r/LocalLLaMA · 2026-07-20

Hy3 295B模型的1位量化版本在推理速度上比云端API快2.2倍,且质量无损

0 人收藏 0 人点赞
#speed-improvement

Deepseek 又带来重大突破——DSpark。比 MTP 快太多了 [视频详解]

Reddit r/LocalLLaMA · 2026-07-03

Deepseek 宣布了 DSpark,这是一项新的 AI 突破,速度显著快于 MTP,视频中有详细解释。

0 人收藏 0 人点赞
#speed-improvement

提示:使用这个llama.cpp的PR提升Intel ARC上的提示处理速度

Reddit r/LocalLLaMA · 2026-07-02

一个llama.cpp的PR显著提升了Intel ARC GPU上的提示处理速度,基准测试显示在B580上从245t/s提升到462t/s。目前该改进仅适用于F16 KV量化,计划后续支持其他量化方式。

0 人收藏 0 人点赞
#speed-improvement

@DataChaz:@NVIDIA 刚刚发布了 LocateAnything,通过修复一个核心瓶颈使物体检测速度提升约10倍:模型如何…

X AI KOLs Following · 2026-06-17 缓存

NVIDIA发布了LocateAnything,这是一个开源模型,通过同时预测所有坐标而非顺序预测,实现了约10倍的物体检测速度提升,在单块H100上达到12.7 FPS,并超越了320亿参数模型。

0 人收藏 0 人点赞
#speed-improvement

@victormustar: 支持MTP的llama.cpp使本地模型足够快,可作为日常驱动 Qwen3.6-27B密集生成(在A10G上…

X AI KOLs Following · 2026-05-18 缓存

llama.cpp为Qwen3.6模型添加MTP支持,在A10G硬件上将生成速度提升78%,使本地模型可作为日常驱动使用。

0 人收藏 1 人点赞
#speed-improvement

@gabriel1:如果 Claude 5.5 速度提升 20 倍,你就能边说边写代码,界面会随着你说话实时更新

X AI KOLs Following · 2026-05-08

有人推测,如果 Claude 5.5 速度提升 20 倍,用户将能够实时对话并编写代码,界面会随着语音输入同步更新。

0 人收藏 0 人点赞
#speed-improvement

预览Ultrafast模式:GPT-5.6 Sol速度最高提升14倍

YouTube AI Channels · 2026-08-15 缓存

OpenAI的GPT-5.6 Sol在Ultrafast模式下提供最高14倍的速度提升,增强了事件管理和数据处理等复杂工作流,且不牺牲智能质量。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈