@seclink: 收录一看.
摘要
Liquid AI 推出 Pipette,这是一个与 ArtificialAnlys 合作创建的设备端模型评估套件,旨在改进边缘智能的基准测试。
收录一看.
查看缓存全文
缓存时间: 2026/08/24 19:57
Liquid AI (@liquidai): 今日我们与@ArtificialAnalyse合作发布Pipette——一套面向端侧智能的模型评估套件。当前多数基准测试平台主要针对云端基础模型的核心性能与速度特征进行优化,而Pipette则为该领域提供了
相似文章
@QuixiAI: Pipette 太棒了 @liquidai @maximelabonne 感谢你们将其开源。
Liquid AI 发布了 Pipette,这是一个用于设备端 AI 的开源模型评估套件,与 ArtificialAnlys 合作开发。
@seclink: 又一个基准测试,收录一下样本和标注。
PatronusAI 发布了 SpeedrunBench,这是首个评估 AI 代理在多个电子游戏中速通性能的基准测试。
@seclink: https://x.com/seclink/status/2057086514975404108
Anthropic工程师公开了长时AI智能体的开发经验,包括多角色分工、独立评估器等方法,使AI能在3-5小时内自动生成完整应用,连续运行能力提升12倍。
@liquidai: 如今,与AI分享机密信息已成为常态!我们可以做得更好。我们最新的编码器模型发现并……
Liquid AI的LFM2.5-Encoders能够在一次处理中识别并剥离16种语言的40种个人身份信息,专为在私有管道中进行安全AI数据处理而设计。
@xiaogaifun: https://x.com/xiaogaifun/status/2073771786202939572
字节Seed团队发布了EdgeBench基准测试,允许AI模型连续工作12-72小时来评估长程任务中的学习能力,发现模型从环境学习的时间和性能之间遵循log-sigmoid曲线,存在新的Scaling Law。