标签
对 llama.cpp 的一项修改,实现了为 Qwen 模型实时热插拔 Ngram PLE 表,从而支持知识注入,并为低成本训练提供了新的可能性。
DeadPool 为 LLM 训练引入了一种容错机制,能够通过零开销的内存检查点实现故障节点与备用节点的热插拔,在不中断任务的情况下实现快速恢复。