model-management

标签

Cards List
#model-management

为什么本地代理不应在显存中保持所有模型热加载:来自代理循环的实际数据

Reddit r/AI_Agents ↗ · 2026-09-11

通过实现一个基于Rust的守护进程来动态休眠不活跃的AI模型,本地代理的GPU内存使用可以从122 GB减少到43 GB,唤醒延迟低于200毫秒,使得在单个工作站上运行多个模型变得可行。

0 人收藏 0 人点赞
#model-management

介绍Quartermaster,一个开源本地AI平台,旨在易用而不牺牲可定制性

Reddit r/LocalLLaMA ↗ · 2026-09-03

Quartermaster是一个开源本地AI平台,简化了模型管理、VRAM分配,并提供一个与OpenAI兼容的API,内置聊天游乐场,支持多种后端如llama.cpp和stable-diffusion.cpp。

0 人收藏 0 人点赞
#model-management

扩展前的证据:终身专家池中的重用、生成或推迟

arXiv cs.LG ↗ · 2026-08-21 缓存

本文介绍了一种为持续学习系统设计的统计决策层,允许专家池根据累积证据决定是重用现有模型、生成新模型还是推迟,具有管理非平稳数据流的理论保证和系统贡献。

0 人收藏 0 人点赞
#model-management

每次在 vLLM 和 llama.cpp 上换模型都要重写参数,所以我建了个工具来管理它们(llmux, MIT)

Reddit r/LocalLLaMA ↗ · 2026-07-27

一位开发者构建了 llmux,这是一个开源工具,用于简化跨不同引擎(如 vLLM 和 llama.cpp)管理模型配置,支持一键切换,并集成了 Docker 和 NVIDIA GPU 支持。

0 人收藏 0 人点赞
#model-management

Ketch - 本地模型的最佳搜索工具

Reddit r/LocalLLaMA ↗ · 2026-07-01

Ketch 是一款用于查找和管理本地AI模型的搜索工具。

0 人收藏 0 人点赞
#model-management

llama.cpp 现在通过API支持模型管理(下载等)

Reddit r/LocalLLaMA ↗ · 2026-06-17

llama.cpp 现在通过API支持模型管理,包括下载和生命周期管理,无需外部工具即可完全部署。

0 人收藏 0 人点赞
#model-management

@GitHub_Daily: 帮朋友安装 Claude Code、配本地大模型,每台机器环境都不一样,折腾半天还不一定能跑起来,颇为麻烦。 最近找到 EchoBird 这个项目,把 AI 工具的安装、本地模型运行、应用管理整合到了一个桌面客户端里。 只需配置一次,就能…

X AI KOLs Timeline ↗ · 2026-06-17 缓存

EchoBird 是一个开源的桌面客户端,将 AI 工具安装、本地大模型运行和应用管理整合在一起,支持一键配置和统一接口管理。

0 人收藏 0 人点赞
#model-management

@jundotkim:我刚发布了 oMLX v0.4.0,这是首个搭载全新原生 Swift macOS 应用的正式版本。

X AI KOLs Timeline ↗ · 2026-06-02 缓存

oMLX v0.4.0 搭载了原生 Swift macOS 应用,具备重新设计的引导流程、设置界面、Hugging Face 缓存发现功能,以及改进的模型管理,用于在 Mac 上运行本地 AI。

0 人收藏 0 人点赞
#model-management

@Michaelzsguo: https://x.com/Michaelzsguo/status/2056842405815447684

X AI KOLs Timeline ↗ · 2026-05-19 缓存

一份实用指南,介绍如何通过分层包装系统和一致的目录结构来组织本地LLM实验,以避免模型位置漂移、标志遗忘和测试框架耦合。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈