标签
Prime RL 现在支持表示和训练多智能体系统,可实现智能体裁判、自我对弈、用户模拟以及复杂智能体协作等用例。
Prime Intellect Lab 已结束测试,提供平台用于训练模型,支持多种架构和模态,助力自我改进的智能体。
Andrej Karpathy将LLM训练概括为文本、对话和环境;Prime Intellect的Verifiers是一个开源框架,用于构建和共享LLM的强化学习环境,采用MIT许可证发布,附带一个包含2500多个环境的中枢。
Prime Intellect 完成1.3亿美元A轮融资,助力企业构建专属AI代理。
Prime Intellect 以10亿美元估值完成1.3亿美元A轮融资,为企业提供构建自有AI代理的全栈平台,以市场形式提供算力访问、强化学习工具和评估能力。
Prime-rl 增加了一个一级算法层,内置六种 RL 算法(GRPO、MaxRL、OPD、OPSD、SFT、ECHO),使得通过单个文件实现自定义算法变得更加容易。
一位研究人员宣布他们已加入 PrimeIntellect 研究持续学习。