标签
MorrowCache 是一个本地的、与 OpenAI 兼容的代理,它基于意图相似性缓存 AI 模型响应,以减少延迟和令牌成本,使用一个仲裁器来检查缓存的答案。
Zerg Router 提供了一个 OpenAI 兼容的端点,用于在 Codex 中运行 DeepSeek 等 AI 模型,支持预算控制和模型回退。
2BA.AI 提供欧盟托管的AI基础设施,每月固定20欧元费用,每5小时窗口提供4500次请求,并与Cursor和VS Code等工具集成,同时确保GDPR合规。
Lorivo是一个无服务器平台,允许共享GPU服务器来托管多个LoRA适配器,简化部署并降低微调AI模型的成本。
EmperoAI通过推出免费社区API端点庆祝达到2000粉丝,该端点支持Qwen3.8-27B-FP8 AI模型,允许开发者使用任何API密钥访问。
TeamoRouter提供DeepSeek V4 Pro等AI模型的免费或低成本访问,兼容Claude Code和Codex等开发工具,通过统一API实现便捷接入。
Eric Zakariasson宣布Grok 4.6现在可以通过与OpenAI格式兼容的API使用,使其能够轻松集成作为即插即用的替换方案。
Hetzner 通过 OpenAI 兼容的 API 免费提供对 Qwen 3.8 27B AI 模型的访问,声称在测试中其表现优于 GPT-5.6 Luna。
本文介绍了Gonka,一个去中心化的推理网络,允许通过OpenAI兼容接口访问具有完整1M上下文的V4-Flash AI模型,无需本地GPU所有权。
CORS Chat 是一个基于浏览器的工具,用于与 OpenAI Responses 兼容的 API 端点聊天,具有自定义头部、本地对话保存和渐进式 SVG 渲染功能。
已为 Qwen3.8-27B AI 模型部署免费公共端点,提供兼容 OpenAI 的 API,支持视觉、工具调用和大型上下文窗口,由 Hugging Face Inference Endpoints 提供支持,至少在线 72 小时。
DeepSeek 推出 V4-Pro 和 V4-Flash,支持灵活的推理强度、原生 OpenAI Responses API,以及针对 Codex 优化的智能体工作流,可通过 API 和应用/网页使用。
FAAAH 是一个无依赖、兼容 OpenAI 的代理,它将 API 请求转换为文本文件,并使用像 Claude Code 这样的 AI 编程代理作为后端,从而可以复用现有订阅,而无需为云 LLM API 付费。
Google Cloud API Gateway 现已在公开预览版中提供模型路由,提供一个无服务器入口层,可接受兼容 OpenAI 的请求,并动态路由到 Gemini、Claude 或 OpenAI 模型。
Google Cloud API Gateway 宣布模型路由公开预览,让开发者通过使用 OpenAPI 规范的单一端点访问 Gemini、Claude 和 OSS 模型。
Celeris-1 是一种采用基于扩散的推理架构的新型语言模型,实现了接近 GPT-5 水平的智能,响应速度快 15 倍,吞吐量高。
Hetzner 推出了一项实验性的 LLM 推理 API 服务,提供与 OpenAI 兼容的端点,并搭载 Qwen3.6-35B-A3B-FP8 模型。该服务在实验期间免费,无 SLA,旨在收集用户反馈。
Ramp 正在开源其内部 LLM 路由器,该路由器能根据每个请求自动选择最佳模型,以优化成本和性能。
CLIProxyAPI 是一个为 CLI 提供兼容 OpenAI/Gemini/Claude/Codex/Grok API 接口的代理服务器,现已支持 OpenAI Codex 和 Claude Code 的 OAuth 访问,方便开发者使用本地或多账户进行 CLI 访问。
Mesh LLM 是一个分布式AI计算平台,它聚集多台机器上的闲置GPU来运行大型语言模型,并暴露单一的OpenAI兼容API。该平台利用iroh的点对点网络,实现无需中央服务器的私有、去中心化推理。