fast-inference

标签

Cards List
#fast-inference

Ling 3.0 Tiny 是我低端 PC 上最强大、最快速、最出色的模型!

Reddit r/LocalLLaMA · 6天前

用户赞扬 Ling 3.0 Tiny AI 模型在低端 PC 上快速高效,并将其与 Qwen 3.5 9b 和 Gemma 12 等模型进行了有利的比较。

0 人收藏 0 人点赞
#fast-inference

@no_stp_on_snek: 本周越来越好。

X AI KOLs Following · 2026-08-14 缓存

Molei Tao 介绍了 FLARE,这是一种扩散语言模型,其性能接近 GPT5,且推理速度显著更快。

0 人收藏 0 人点赞
#fast-inference

@_philschmid:它不仅性价比高,而且速度飞快!

X AI KOLs Timeline · 2026-08-13 缓存

Philipp Schmid 称赞一款未具名的 AI 模型,称其性价比高且速度极快。

0 人收藏 0 人点赞
#fast-inference

@maximelabonne: 我们刚刚发布了两个新的编码器模型(MLM)在2026年。它们非常快,易于训练,并且多语言能力强。试试…

X AI KOLs Following · 2026-07-28 缓存

Liquid AI发布了两个新的编码器模型,LFM2.5-Encoder-230M和LFM2.5-Encoder-350M。这些模型快速、易于训练且多语言能力强。速度基准测试显示,与ModernBERT-base相比,CPU性能提升了3.7倍以上。

0 人收藏 0 人点赞
#fast-inference

@mattshumer_: 看到我的那条疯传的帖子后@GroqInc的遭遇真是疯狂。乔纳森花了多年时间试图解释为什么快速推理很重要…

X AI KOLs Timeline · 2026-07-08 缓存

投资者Matt Shumer的一条疯传帖子通过有效展示快速推理的价值,极大地推动了Groq的业务,而Groq创始人Jonathan Ross多年以来一直难以传达这一点。

0 人收藏 0 人点赞
#fast-inference

Nano Banana 2 Lite

Simon Willison's Blog · 2026-06-30 缓存

Google DeepMind 发布了 Nano Banana 2 Lite(也称为 Gemini 3.1 Flash Lite Image),定位为最快、最便宜的 Gemini 图像模型,专为速度和规模优化。

0 人收藏 0 人点赞
#fast-inference

Mimo 2.5 在大上下文下_快速_(双 RTX Pro 6000)

Reddit r/LocalLLaMA · 2026-06-23

Mimo 2.5 使用双 RTX Pro 6000 GPU 展示了在大上下文窗口下的快速性能。

0 人收藏 0 人点赞
#fast-inference

DiffusionGemma: 文本生成速度提升4倍

Hacker News Top · 2026-06-10 缓存

Google推出DiffusionGemma,这是一个实验性的26B MoE开源模型,通过文本扩散技术,在GPU上实现高达4倍的文本生成速度提升,针对速度要求高的交互式本地工作流。

0 人收藏 0 人点赞
#fast-inference

@maxxxzdn:今天我们发布了Mosaic,一个概率天气模型,它推动了机器学习天气预报的帕累托前沿。

X AI KOLs Following · 2026-05-20 缓存

Mosaic是一个概率天气模型,其预报技巧与最先进的模型相当,同时在单个H100上能在12秒内生成24个成员的10天全球预报。

0 人收藏 0 人点赞
#fast-inference

@svpino:首次,我觉得开源权重模型已无法忽视。我们正处于这些模型具有竞争…

X AI KOLs Following · 2026-05-15

Santiago (@svpino) 强调 MiniMax-M2.7,一个 230B 参数的开源权重模型,能与 Opus 4.6 和 GPT-5.4 等顶级专有模型相抗衡,在 SambaNova 上以低成本实现 440+ tokens/s 的推理速度。

0 人收藏 0 人点赞
#fast-inference

baidu/ERNIE-Image-Turbo

Hugging Face Models Trending · 2026-04-02 缓存

百度发布了ERNIE-Image-Turbo,一个蒸馏文本到图像生成模型,可在8步推理中实现快速生成,同时保持强大的文本渲染、指令遵循和结构化图像生成能力。

0 人收藏 0 人点赞
#fast-inference

prunaai/p-image

Replicate Explore · 2026-06-27 缓存

P-Image 是 Pruna 的文本到图像生成模型,可在不到一秒内生成最先进的图像,兼具速度、经济性和高质量。

0 人收藏 0 人点赞
#fast-inference

prunaai/p-image-edit

Replicate Explore · 2026-04-21 缓存

Pruna的p-image-edit是一款运行在Replicate平台上的高端AI模型,能够在一秒内快速完成业界领先的图像编辑,兼具速度、经济性和高视觉质量,精准遵循提示词并具备强大的文字渲染能力。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈