标签
本文是关于并发服务器系列文章的一部分,介绍了如何使用Rust实现并发网络服务器,涵盖了顺序、线程和事件驱动方法,并提供了代码示例。
OxiSH 是一个用 Rust 编写的 SSH 服务器,为传统 SSH 服务器实现提供了一种内存安全的替代方案。
Sula 是一个用 Scryer Prolog 编写的 Gemini 协议服务器,具有通过 rustls 实现的 TLS、内容协商和优雅关闭功能,但需要修补过的 Scryer Prolog 构建版本。
一位开发者反思将 AI 智能体工作流迁移到服务器的经历,发现 systemd、日志、幂等性和故障告警这些枯燥的基础设施问题比智能体本身更重要。
Simon Willison 发布了 llm-chat-completions-server 0.1a0,这是一个插件,可运行一个本地 OpenAI Chat Completions 兼容服务器,由任何已安装的 LLM 模型提供支持,并使用内容寻址日志来高效管理对话状态。
HuggingFace发布了一篇详细的技术博文,包含交互式可视化,记录了2026年7月发生的一次服务器入侵攻击。
讨论搭建用于Qwen3 30B模型(Q8量化)的本地AI服务器,质疑所选硬件是否合适。
Meta 开发了一款定制 CXL 桥接芯片(Vistara),用于在新服务器中复用旧 DIMM,以解决内存短缺问题并降低成本,同时不会显著影响性能。
Hugging Face Jobs 现在允许你使用 vLLM 通过一条命令快速启动一个私有的、兼容 OpenAI 的 LLM 端点,无需配置服务器或 Kubernetes。
本文解释了非统一内存访问(NUMA)的概念、历史背景以及它在多插槽服务器上对性能的影响,同时介绍了Edera在使基于Xen的虚拟化实现端到端NUMA感知方面所做的工作。
Bootimus是一个自包含的PXE和HTTP启动服务器,使用Go语言编写,提供零配置、嵌入式iPXE,并支持超过50种发行版。它完全开源,基于Apache 2.0许可,无遥测功能。
oMLX是一款用于本地AI的MLX服务器,现在支持标准的Hugging Face缓存模型目录,简化了模型加载过程。
Ory Talos 是一个用 Go 编写的开源 API Key 服务器,用于大规模地签发、验证和管理 API 密钥,具有低延迟验证能力,并支持 JWT 和 macaroon 令牌。
llama.cpp server 现通过实验性标志内置了原生工具,支持文件操作、shell 命令等功能,无需外部包装器。
Kioxia和Dell合作,利用40块Kioxia LC9 245.76 TB SSD,打造出一款拥有近10 PB全闪存存储的2RU服务器,支持高密度AI基础设施。
用户报告,在 llama.cpp 服务器上连续运行约两周后,Qwen3.6 模型的能力显著下降,且重启会话无法解决此问题。