onnx

标签

Cards List
#onnx

@DanKornas:构建个性化数字人不应需要从不同项目中拼凑预处理、训练和推理……

X AI KOLs Timeline · 2天前 缓存

Ultralight Digital Human 是一个开源 Python 项目,支持从 3-5 分钟的视频中训练一个面向特定人物的音频驱动数字人,并支持 HuBERT/WeNet 音频特征、ONNX 导出和流式推理。

0 人收藏 0 人点赞
#onnx

一个编码器,七个头:使用掩码损失训练统一安全分类器的经验 [P]

Reddit r/MachineLearning · 5天前

他们发布了一个统一的多头安全分类器(mmBERT-small编码器,七个头),使用掩码损失处理缺失任务标签,在七个任务上取得了高F1分数,同时还发布了量化的ONNX INT8变体。权重和指标已公开。

0 人收藏 0 人点赞
#onnx

qZACH-ViT: 基于递归归因稳定优化的量化感知内在解释

arXiv cs.LG · 2026-07-20 缓存

介绍了qZACH-ViT,这是ZACH-ViT的量化感知扩展,具有递归内在解释,以及用于稳定归因梯度的递归归因稳定优化(RASO)。在INT8转换后的MedMNIST数据集上实现了高预测一致性和加速。

0 人收藏 0 人点赞
#onnx

在没有GPU的情况下,语音助手的响应速度能有多快?在CPU上使用Qwen3-ASR和Kokoro-TTS ONNX。

Reddit r/LocalLLaMA · 2026-07-10

探讨了在没有GPU的情况下,在CPU上使用Qwen3-ASR和Kokoro-TTS ONNX模型运行语音助手的性能,测量响应时间。

0 人收藏 0 人点赞
#onnx

14× 更快的嵌入:我们如何重建Manticore中的ONNX路径

Hacker News Top · 2026-07-03 缓存

Manticore Search 27.1.5 引入了一个新的 ONNX Runtime 后端用于嵌入,其性能比之前的 SentenceTransformers/Candle 路径提升约14倍,吞吐量从每秒5-11个文档提高到每秒70-230个文档,并且无需更改API。

0 人收藏 0 人点赞
#onnx

使用Claude Code将Moebius 0.2B图像修复模型移植到浏览器中运行

Simon Willison's Blog · 2026-06-22 缓存

Simon Willison借助Claude Code,将Moebius 0.2B图像修复模型移植到浏览器中运行,使用了WebGPU和ONNX Runtime。最终的演示允许用户上传图片并通过修复移除物体。

0 人收藏 0 人点赞
#onnx

archex:本地优先、确定性代码上下文,适用于AI代理——无API密钥,无遥测(Apache 2.0)

Reddit r/LocalLLaMA · 2026-06-15

archex是一个本地优先、确定性的工具,用于为AI代理构建具有令牌预算的代码上下文包。它使用完整的检索管道(BM25F、本地嵌入、交叉编码器重排序器、依赖图扩展),在您的硬件上运行,无需API密钥或遥测,在召回率和效率方面优于替代方案。

0 人收藏 0 人点赞
#onnx

OpenCV 5 正式发布:计算机视觉多年来的最大飞跃

Hacker News Top · 2026-06-06 缓存

OpenCV 5 是计算机视觉库的重大版本更新,包含全新的 DNN 引擎、改进的 ONNX 支持、硬件加速以及更简洁的架构。对于从事经典视觉、深度学习及边缘部署的开发者而言,这标志着一次重要的现代化升级。

0 人收藏 0 人点赞
#onnx

@HuggingPapers: NVIDIA 刚刚在 Hugging Face 上发布了 Kokoro TTS 模型的优化版本。一款轻量级、8200万参数的语音合成器…

X AI KOLs Following · 2026-05-29 缓存

NVIDIA 在 Hugging Face 上发布了 Kokoro TTS 模型的优化 ONNX 版本。这款拥有 8200 万参数的模型轻量、快速,且可用于商业用途。

0 人收藏 0 人点赞
#onnx

@nicodotdev:关于 Transformers.js 你一直想了解的一切,都在一个视频中。我深入探讨了 AI 模型如何从…运行

X AI KOLs Following · 2026-05-27 缓存

一个深入探讨的视频,解释如何使用 Transformers.js 从 JavaScript 运行 AI 模型,涵盖张量、ONNX、量化、WebGPU/WASM 等。

0 人收藏 0 人点赞
#onnx

使用 ml-intern 和 DeepSeek v4 Flash 训练了一个提示注入检测器,运行在浏览器中

Reddit r/LocalLLaMA · 2026-05-22

使用 ml-intern 和 DeepSeek V4 Flash 训练了一个提示注入分类器,使用 DistilBERT 实现 F1 99%,优化至 ONNX int8(约 65 MB),可通过 Transformers.js v3 在浏览器中运行。

0 人收藏 0 人点赞
#onnx

@akshay_pachaar: 这个TTS模型生成语音的速度比人耳听到快167倍。Supertonic 是一款通过ONNX实现跨平台推理的设备端TTS引擎…

X AI KOLs Following · 2026-05-15 缓存

Supertonic 是一款新的开源TTS引擎,通过ONNX在设备上运行,支持31种语言,在速度上超越ElevenLabs,即使在无GPU的树莓派上也能运行。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈