Ternlight – 可在浏览器中运行的 7 MB 嵌入模型 (WASM)
摘要
Ternlight 是一个 7 MB 的嵌入模型,通过 WASM 在浏览器中运行,无需任何 API 调用或服务器即可实现快速语义搜索。它以 npm 包的形式提供,只需三行代码即可使用。
暂无内容
查看缓存全文
缓存时间: 2026/07/07 02:08
# ternlight · 语义搜索 · React 文档
来源:https://ternlight-demo.vercel.app/
一个大小仅 **7 MB** 的嵌入模型。
在你的 **CPU** 上运行,无需 API。
直接嵌入,毫秒级生成文本向量,无需调用任何服务器。
在浏览器中运行
无 API 调用
引擎 + 权重 · 7 MB
迷你版 · 5 MB
快速嵌入 · 约 5 毫秒
仅需 CPU · 无需 GPU
立即使用
## 三行代码实现语义搜索
以单个 npm 包形式发布。无需模型下载步骤,无需服务器。
```bash
npm install @ternlight/base
```
示例.js
```js
import { embed, similar } from '@ternlight/base';
similar('easy weeknight dinner ideas', recipes, { topK: 3 });
// → 排序后的匹配结果 · 约 5 毫秒 · 零网络请求
```
示例
## React 文档搜索
在浏览器中搜索 React 文档。输入问题——由 @ternlight/mini (https://www.npmjs.com/package/@ternlight/mini) 驱动,该包仅 5 MB。
相似文章
Wterm – 面向网页的终端模拟器
Wterm 是一款面向网页的终端模拟器,使用 Zig 构建并编译为 WASM,以实现接近原生的性能,同时具备原生文本选择、复制/粘贴、查找和无障碍功能。
@googledevs:认识 LiteRT.js:@Google 的新网页端 Edge AI 运行时!我们已使从 PyTorch 转换到 #WebAI 变得更加容易…
Google 发布了 LiteRT.js,这是一个高性能的 JavaScript 运行时,利用 WebAssembly 和硬件加速直接在浏览器中运行 AI 模型,是 TensorFlow.js 的演进。
PrismML 刚刚发布了二值和三值的 Bonsai Image 4B:一种 1比特/三值文本到图像扩散变换器,甚至可以在浏览器中通过 WebGPU 100% 本地运行。
PrismML 发布了 Bonsai Image 4B 模型的二值和三值量化版本,使得文本到图像生成可以仅用 3GB 大小通过 WebGPU 在浏览器中本地运行,采用 Apache-2.0 许可证。
[browser-use-wasm] 我制作了一个在WASM中运行的零成本浏览器使用代理
一位开发者构建了一个完全自包含的浏览器使用代理,完全在WASM/WebGPU中运行,零服务器成本,通过自然语言提示实现完整的网页控制。
意图原型:嵌入API
Chromium团队为Web平台提出了一种新的嵌入API,允许开发者利用Chrome的AI基础设施在设备端生成向量嵌入,从而实现保护隐私的语义搜索、检索增强生成和内容聚类,同时降低延迟和成本。