标签
TOPAS是一种面向工作流的前缀状态调度方法,用于多智能体LLM服务,通过优化缓存使用和请求调度来减少作业完成时间。
本文提供通过指派特定任务、安排操作以及在群聊中管理多个机器人来最大化利用Grok Bot的技巧,以简化业务工作流程。
DeepSeek 在空闲时段的价格是高峰时段的一半,高峰时段为周一至周五的特定时间,建议使用 cron 工具在空闲时段安排重要不紧急的任务。
Hermes 发布了一系列更新,包括浏览器自动化、多机器代理集群、对话中的实时交互式UI、独立代码审查、定时任务的持久记忆,以及改进的更新系统。
本研究论文介绍了一种基于LLM的预测调度系统,旨在提升数据中心效率并降低环境影响,通过实际合作实现了能源消耗和等待时间的显著减少。
本文介绍了SDDL,一个神经符号框架,通过将自然语言问题转化为形式化表示,提高了资源受限语言模型中的组合优化精度,与直接生成和求解器代码基线相比,实现了更高的可行性率。
Ferryman 是一款用于跨平台交叉发布和调度社交媒体内容的工具,帮助用户通过自动同步和 AI 集成来增长他们的受众。
Calendly 推出一款AI驱动的笔记工具,该工具加入会议进行录音、转录,并生成摘要和行动项,旨在为销售和营销专业人员自动化会后工作流程。
Kent C. Dodds 描述了使用名为 Kody 的 AI 代理工具来安排功能退役的唤醒提醒,展示了 AI 代理在开发工作流中的实用性。
本文提出了一种约束感知的GPU分配器,与FIFO调度相比,GPU利用率最高可提升33个百分点,突显了基于优先级的分配在企业AI系统中的关键作用。
Ferryman 是一款社交媒体跨平台发布和调度工具,可自动同步多个平台上的帖子,专为内容创作者和团队设计。
一位 Twitter 用户批评 Calendly 缺乏防止连续会议超过设定时长的功能,并质疑在公司有 500 名员工的情况下,开发重点在哪里。
LazyTrain 是一个研究系统,通过将检查点选择、激活放置、重计算以及 CPU-GPU-NVMe 通信重叠建模为混合整数调度问题,优化有限硬件上的大语言模型训练,相比匹配基线实现了约 1.24 倍的 TFLOPS 提升。
TideRL is a readiness-aware elastic RL system that improves training goodput for multi-turn agentic workloads via continuous task batching, resource-aware ref-actor pipelining, and elastic resource scaling, achieving up to 5.6x speedup over synchronous baselines and 33% over asynchronous baselines.
本文研究LLM智能体服务的GPU控制门控,分析并发队列调度和设备端路由与主机重新分发的对比,以减少主机往返并提高GPU利用率。
The article argues that Nix evaluation is fundamentally a scheduling problem and introduces Evix, a library-first async Nix evaluation engine designed for persistent, structured evaluation results.