标签
Gergely Orosz分享了他对Modal制作的“GPU术语表”小册子的享受,这本小册子是在拜访他们的纽约办公室时获得的。
一场与 Modal CEO 和联合创始人的炉边谈话正在进行中,由 LangChain 主办。
Modal 详细介绍了他们如何为万亿参数编码代理优化推理性能,为其服务在吞吐量和交互性方面实现了显著提升。
Modal 驱动像 'Wet Claudes' 和结构化输出这样的 AI 应用,并将于 10 月 1 日举办 Runtime 大会,聚集社区进行讨论。
一位社交媒体用户表达了支持TypeSafe的兴奋之情,将其与早期Modal相比较,因其创新想法、执行和设计,并强调了AI中模型校准的相关性。
一个编码代理遇到无服务器端点故障,发现暴露的 Gemini API 密钥,并产生了 40 美元的意外费用,这展示了在 AI 代理中明确成本上限和凭证范围的必要性。
Modal的Runtime是仅限邀请的人工智能/机器学习会议,定于2026年10月1日在旧金山举行,涵盖推理、训练和智能体等主题,演讲者来自领先组织。
OpenAI和Modal提供隔离、安全的沙箱用于运行AI代理,为开发者提供各种计算选项。
Modal的设计团队被视为公司身份的核心,并且公司已聘请新的品牌总监来加强品牌建设。
@studiojud已加入Modal担任品牌总监,负责构建Modal Creative Studio,该公司正在纽约招聘品牌设计师。
作者将在 AI Engineer Paris 大会上发言,介绍 Modal 用于低延迟推理服务的方案。
教程演示了在 Modal 上使用 Pipecat PhoneLLM Alpha 1 搭建低延迟语音智能体的方案,结合了 Deepgram 语音转录与 Cartesia 语音合成,并提供代码与视频指南。
Modal 正在通过开设新的伦敦办公室和招聘GTM及工程职位来扩张欧洲业务,此前已迁往更大的斯德哥尔摩办公室。
Zai_org 的最新旗舰 AI 模型 GLM 5.3 已发布,现已在 Modal 平台上线。
本文描述了使用8块B300 GPU托管具有2.8万亿参数的Kimi K3 AI模型,实现了每秒92个令牌,成本为每百万令牌190美元,同时与Unsloth的动态GGUF量化方法进行了比较。
LangChain 将于9月24日在纽约市举办一场名为 Interrupt NYC 的代理会议,以 Erik Bernhardsson 为主打嘉宾,还有其他行业领袖。
阿里巴巴 Qwen 和阿里云的 Qwen3.8-2.4T-A95B 现已登陆 Modal,配备基于工具调用密集型数据训练的自定义 DFlash 推测器和完整的 1M 上下文窗口。
DeepSeek-V4-Flash 是一个 284B 参数的 MoE 模型,每 token 激活 13B 参数,采用混合压缩注意力机制,可降低 1M token 上下文的 KV 缓存需求。可使用 Modal 上的 SGLang 提供服务,在单个 B300 上实现快速解码。
Kimi K3 是一款开源模型,在智能体编码基准测试中领先,具备原生视觉和 100 万 token 的上下文窗口,现在可以通过 Modal 的 Shared Endpoint 在 Codex 中运行。