modal

标签

Cards List
#modal

@modal: @Alibaba_Qwen 和 @alibaba_cloud 的 Qwen3.8-2.4T-A95B 现已登陆 Modal。配备自定义 DFlash 推测器…

X AI KOLs Following · 3天前 缓存

阿里巴巴 Qwen 和阿里云的 Qwen3.8-2.4T-A95B 现已登陆 Modal,配备基于工具调用密集型数据训练的自定义 DFlash 推测器和完整的 1M 上下文窗口。

0 人收藏 0 人点赞
#modal

@modal:DeepSeek-V4-Flash 总参数为 284B,每个 token 激活 13B。结合混合压缩注意力机…

X AI KOLs Following · 2026-08-03 缓存

DeepSeek-V4-Flash 是一个 284B 参数的 MoE 模型,每 token 激活 13B 参数,采用混合压缩注意力机制,可降低 1M token 上下文的 KV 缓存需求。可使用 Modal 上的 SGLang 提供服务,在单个 B300 上实现快速解码。

0 人收藏 0 人点赞
#modal

@modal:您现在可以在 Modal 上的 Codex 中运行 Kimi K3。K3 在智能体编码基准测试中领先开源模型,具备原生视觉和…

X AI KOLs Following · 2026-07-31 缓存

Kimi K3 是一款开源模型,在智能体编码基准测试中领先,具备原生视觉和 100 万 token 的上下文窗口,现在可以通过 Modal 的 Shared Endpoint 在 Codex 中运行。

0 人收藏 0 人点赞
#modal

@modal:在 Modal 上对 Inkling-Small 的 Day 0 支持。 - 276B 参数 MoE,12B 激活 - 1M 上下文 - 可变思考强度 …

X AI KOLs Following · 2026-07-30 缓存

Thinking Machines 发布了 Inkling-Small,这是一个 276B 参数的混合专家模型,具有 12B 激活参数、1M 上下文以及原生图像/音频理解能力,现已在 Modal 上可用,并支持 NVIDIA B300。

0 人收藏 0 人点赞
#modal

引用Akshat Bubna

Simon Willison's Blog · 2026-07-28 缓存

Modal的首席技术官Akshat Bubna澄清,涉及恶意代理的安全事件是由客户未经身份验证的端点导致的,并非Modal平台隔离遭到破坏。

0 人收藏 0 人点赞
#modal

使用开放模型的感觉出奇地好

Hacker News Top · 2026-07-28 缓存

作者描述了在自己的推理端点上使用开放AI模型(Kimi K3)带来的解放感,与使用专有服务的体验形成对比。

0 人收藏 0 人点赞
#modal

@quasagroup: Modal Review: Run AI Workloads Without Managing Servers https://youtu.be/a8vuwYK90-Q?si=vYj7YpobSXGNCDpQ… via @YouTube

X AI KOLs Timeline · 2026-07-24 缓存

Modal 是一个专为 AI 工作负载设计的无服务器云平台,支持推理、训练和沙箱,通过纯 Python 代码实现从零到上千 GPU 的瞬间扩展,大幅降低延迟并加速产品上市。

0 人收藏 0 人点赞
#modal

@modal: 记下日期。Modal 的首届年度大会 Runtime 将于 10 月 1 日在旧金山的 The Midway 举行。…

X AI KOLs Following · 2026-07-09 缓存

Modal 宣布其首届年度大会 Runtime 将于 10 月 1 日在旧金山的 The Midway 举行。

0 人收藏 0 人点赞
#modal

@charles_irl: 费率不是成本!无服务器 GPU 每小时可能更贵,但在许多实际情况下,它们总成本更低。…

X AI KOLs Following · 2026-07-08 缓存

无服务器 GPU 的每小时费率可能更高,但根据工作负载的峰值与平均需求比,总体而言可能更具成本效益。Modal 博客上的这篇文章用一个小组件进行了说明。

0 人收藏 0 人点赞
#modal

@charles_irl: 我在从旧金山飞往首尔参加ICML的航班上没有WiFi,所以没有写代码,而是写了一篇文章,内容是关于我最喜欢的…

X AI KOLs Following · 2026-07-06

Charles在飞往首尔参加ICML的航班上写了一篇文章,解释了什么是Modal。

0 人收藏 0 人点赞
#modal

@charles_irl: https://x.com/charles_irl/status/2073975754833203706

X AI KOLs Following · 2026-07-06 缓存

在一系列推文中,Modal 的创始人解释说,这个平台最好被理解为一台计算机,并将传统计算机架构与 Modal 的无服务器云基础设施进行了类比。

0 人收藏 0 人点赞
#modal

@mattpocockuk:我太爱原型设计了!Wayfinder再次惊艳,提供一个我可以在任何地方打开的模态框,用AI编辑我的课程文本……

X AI KOLs Timeline · 2026-07-03 缓存

Matt Pocock 称赞原型设计工具 Wayfinder 的 AI 驱动模态框,可随时随地编辑课程文本。

0 人收藏 0 人点赞
#modal

@akshat_b:Claude Science 内置了 @modal 集成。看到 Modal 作为计算基础设施的优势得以展现,真是太好了……

X AI KOLs Following · 2026-06-30 缓存

Modal 宣布与 Claude Science 集成,为生命科学研究人员提供弹性计算基础设施,并承诺提供高达 10 万美元的资源。

0 人收藏 0 人点赞
#modal

@charles_irl: 从比特到生物

X AI KOLs Timeline · 2026-06-30 缓存

Modal宣布与Claude Science集成,为生命科学研究人员提供弹性计算服务,最多提供10万美元的承诺资源。

0 人收藏 0 人点赞
#modal

@charles_irl: 推测就是一切

X AI KOLs Following · 2026-06-29 缓存

Yong Quan 强调,更好的推测解码器可以在 LLM 推理中实现近乎线性的吞吐量提升,该观点由 Charles 在 Modal 研讨会上提出。

0 人收藏 0 人点赞
#modal

@anthonycorletti:最好的开发者平台在计算、存储和网络之上创建抽象层,让即使是最复杂的工作负载也能无…

X AI KOLs Following · 2026-06-24 缓存

Modal 宣布推出 Auto Endpoints,实现轻松推理,开发者 Anthony Corletti 称赞其为计算、存储和网络之上的一流抽象。

0 人收藏 0 人点赞
#modal

Modal Auto Endpoints:你掌控的优化推理

Hacker News Top · 2026-06-23 缓存

Modal推出了Auto Endpoints,这是一项自助服务,提供优化的、生产级的LLM推理,具备完整代码所有权、透明指标和自动缩放功能,构建于其无服务器GPU基础设施之上。

0 人收藏 0 人点赞
#modal

@bernhardsson: 现在所有用户都可以在@modal上使用托管的私有LLM端点。只需在UI上点击几下或在CLI中敲击几下键盘即可部署。

X AI KOLs Timeline · 2026-06-23 缓存

Modal宣布向所有用户开放托管的私有LLM端点,支持通过UI或CLI轻松部署,并且客户可以完全访问底层代码。

0 人收藏 0 人点赞
#modal

@charles_irl: 几年前,人工智能的未来看起来一片黯淡——专有模型、专有推理服务……

X AI KOLs Following · 2026-06-23 缓存

Modal 宣布推出 Auto Endpoints,这是一项可通过一键实现优化的开源 AI 推理的服务,旨在对抗专有模型和服务的趋势。

0 人收藏 0 人点赞
#modal

@modal:现在真正拥有你的推理还为时不晚。介绍:Modal Auto Endpoints。

X AI KOLs Timeline · 2026-06-23 缓存

Modal 宣布推出 Auto Endpoints,这是一个用于拥有和部署 AI 推理的新功能。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈