构建了一个轻量级Python框架,用于本地LLM角色扮演(Ollama/Phi-3),以防止上下文漂移。寻求反馈。
摘要
一个轻量级Python框架,使用Ollama和Phi-3进行本地LLM角色扮演,具有上下文保留和原生流式传输功能,防止角色漂移。
大家好,我想分享一个我正在构建的开源项目。我想要一种干净、轻量的方式来处理使用Ollama和Phi-3的本地AI角色扮演,但我一直遇到角色漂移、流式传输延迟和上下文管理的问题。我没有使用庞大、臃肿的AI代理框架,而是为此用例构建了一个专用的轻量级Python框架。它原生地处理上下文锁定和LLM流式传输,使角色保持锁定状态,同时不会消耗不必要的token内存。**内置功能:**
* **Ollama集成:** 专为本地模型如Phi-3定制(也支持其他模型,但我使用Phi-3)。
* **原生LLM流式传输:** 无需长时间等待生成。
* **上下文保留:** 即使在多轮长对话中也能保持角色完整性。
* **MIT许可证:** 完全开源。由于我的Reddit账户是全新的,如果包含直接的GitHub超链接,自动审核会删除我的帖子。如果你想查看代码、浏览文件或帮助测试,**直接链接已钉在我的Reddit个人资料简介中**,或者你可以在GitHub上搜索:**tegetgoofficial-bot/ai-roleplay-framework**
我想看看这里的其他开发者是否觉得这种结构合理。你们认为以这种方式处理本地角色扮演状态怎么样?
相似文章
I built a local LLM NPC backend focused on NPC-to-NPC conversations
作者构建了一个本地运行的LLM后端,使游戏中的NPC能够自发进行上下文感知的对话,支持记忆和玩家触发机制,无需预设脚本。
我搭建了一个竞技场,让LLM们在真实物理规则下进行剑斗。你来决定刀刃哪部分锋利,盲评胜负,免费OpenRouter模型争夺Elo排名。目前Llama 3.3正在刺向GPT-OSS的脸。
新竞技场让LLM控制物理布娃娃进行武器对决,用户定义武器伤害区域、盲评投票,模型争夺Elo排名。免费模型如Llama 3.3和GPT-OSS参与竞争,基础设施可自托管。
Built a Tauri v2 desktop chat shell for local LLMs — point it at Ollama / llama.cpp / any OpenAI-compatible endpoint, MIT, ~12 MB binary
Built a Tauri v2 desktop chat shell for local LLMs that can connect to Ollama, llama.cpp, or any OpenAI-compatible endpoint. The project is MIT licensed and produces a ~12 MB binary.
分享我一直在做的东西:LoreKit(智能体记忆系统)—— 寻求反馈
Mads 推出了 LoreKit,一个免费且开源的智能体记忆系统,支持 CLI、MCP 和 Web UI,旨在跨会话、团队和环境共享记忆。
本地LLM伙伴
一位拥有45年经验的开发者正在构建一个本地优先的LLM框架,包含多智能体逻辑,即将在GitHub上开源,并向社区询问哪些功能能改善他们的本地LLM体验。