Ternlight – 可在浏览器中运行的 7 MB 嵌入模型 (WASM)

Hacker News Top 模型

摘要

Ternlight 是一个 7 MB 的嵌入模型,通过 WASM 在浏览器中运行,无需任何 API 调用或服务器即可实现快速语义搜索。它以 npm 包的形式提供,只需三行代码即可使用。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/07/07 02:08

# ternlight · 语义搜索 · React 文档 来源:https://ternlight-demo.vercel.app/ 一个大小仅 **7 MB** 的嵌入模型。 在你的 **CPU** 上运行,无需 API。 直接嵌入,毫秒级生成文本向量,无需调用任何服务器。 在浏览器中运行 无 API 调用 引擎 + 权重 · 7 MB 迷你版 · 5 MB 快速嵌入 · 约 5 毫秒 仅需 CPU · 无需 GPU 立即使用 ## 三行代码实现语义搜索 以单个 npm 包形式发布。无需模型下载步骤,无需服务器。 ```bash npm install @ternlight/base ``` 示例.js ```js import { embed, similar } from '@ternlight/base'; similar('easy weeknight dinner ideas', recipes, { topK: 3 }); // → 排序后的匹配结果 · 约 5 毫秒 · 零网络请求 ``` 示例 ## React 文档搜索 在浏览器中搜索 React 文档。输入问题——由 @ternlight/mini (https://www.npmjs.com/package/@ternlight/mini) 驱动,该包仅 5 MB。

相似文章

Wterm – 面向网页的终端模拟器

Hacker News Top

Wterm 是一款面向网页的终端模拟器,使用 Zig 构建并编译为 WASM,以实现接近原生的性能,同时具备原生文本选择、复制/粘贴、查找和无障碍功能。

意图原型:嵌入API

Lobsters Hottest

Chromium团队为Web平台提出了一种新的嵌入API,允许开发者利用Chrome的AI基础设施在设备端生成向量嵌入,从而实现保护隐私的语义搜索、检索增强生成和内容聚类,同时降低延迟和成本。