MicroLLM Lab – 在浏览器中试用7个微型语言模型
摘要
MicroLLM Lab是一个基于浏览器的工具,允许用户使用JavaScript对7个微型语言模型进行测试和基准测试,提供速度与准确性指标。
暂无内容
查看缓存全文
缓存时间: 2026/09/28 19:48
# MicroLLM 实验室 — 微型大语言模型,Q4量化,浏览器内运行
来源:https://stateofutopia.com/experiments/microllmlab/
目标为客观检测(正则表达式/精确Token匹配),而非写作质量。135M参数模型允许失败——这正是测量目的。选择模型后直接运行。若已有数据,将使用您上次的tokens/秒速度进行估算。
速度指标(tokens/秒、持续解码、测试套件总耗时)与准确率(客观测试通过率)均来源于当前浏览器运行结果。数据仅保留在本机。图表显示各模型最新测试套件结果。
您的姓名或昵称
设备与硬件信息
### 使用JavaScript编写测试基准
编辑器内容将在当前页面域执行`eval()`,随后对每个`check`函数运行模型解码文本检测。
### 为更大型大语言模型设计的提示词
### 函数形式测试基准
相似文章
LLMTest
LLMTest 是一个帮助开发者在应用中使用合适的 LLM 并设置回退方案的工具。
@PierceZhang34: 10秒训练一个小模型! LLM 训练神器:http://llm.istanbul 初体验 最近发现了一个超级有趣的开源风格工具网站 —— http://llm.istanbul,它号称 WebGPU LLM Workbench,意思是完全…
介绍了一个名为 llm.istanbul 的 WebGPU LLM 工作台,可在浏览器中训练小模型、训练分词器并生成文本。无需服务器,完全本地运行。
WebLLM: 高性能浏览器内LLM推理引擎
WebLLM是一个高性能的浏览器内LLM推理引擎,它利用WebGPU进行硬件加速,并且完全兼容OpenAI API,使得开源语言模型可以在本地运行。
超小型LLM真的有用吗?
探讨了非常小的语言模型是否能妥善处理日常对话,以及哪些训练因素使它们表现更佳。
Homebench – 基准测试本地LLM的速度、内存和质量
Homebench 是一款零配置终端工具,可对本地运行的LLM进行速度、内存和质量的基准测试,并提供实时排行榜。它支持 Ollama、LM Studio、llama.cpp、vLLM 以及兼容 OpenAI 的服务器。