@seclink: 冷知识: Mamba 阵营:走的"云侧前沿模型"路线,客户是 NVIDIA/AI21/IBM 这类卖企业 AI 平台的公司 → 如果你要做长上下文、低成本推理的云 API 数据加工,这个方向值得跟踪。 RWKV 阵营:走的"端侧/边缘内置…
摘要
文章对比了Mamba和RWKV两个AI模型架构阵营的路线:Mamba面向云侧企业AI平台,RWKV面向端侧和边缘设备,各自适配不同硬件与推理场景。
查看缓存全文
缓存时间: 2026/08/14 13:39
冷知识:
Mamba 阵营:走的“云侧前沿模型“路线,客户是 NVIDIA/AI21/IBM 这类卖企业 AI 平台的公司 → 如果你要做长上下文、低成本推理的云 API 数据加工,这个方向值得跟踪。
RWKV 阵营:走的“端侧/边缘内置“路线,客户是芯片厂、机器人、操作系统 → 如果你将来想做端侧灵巧手 / 第一视角设备的本地实时推理数据闭环,RWKV 的常显存、无 KV cache 特性反而更贴你的硬件约束。
相似文章
@MaxForAI: http://Z.ai和清华这篇ZCube,做Infra的家人们值得看下。 很多人聊AI infra,第一反应还是GPU、显存、量化、推理框架。 但到长上下文和Prefill-Decode分离之后,网络已经不再是机房里的「配角」了。 每一…
ZCube是一种新的网络架构,通过打平拓扑并混合单/多轨接入,优化了长上下文和PD分离场景下的KV Cache传输,在GLM-5.1生产集群中实现了交换机/光模块成本降低33%、GPU推理吞吐提升15%、TTFT P99下降40.6%。
@seclink: 1. Dell + NVIDIA 发布 Agentic AI 全栈方案(影响力最高) - 事件:Dell 联合 NVIDIA 推出「AI Factory」+ 桌面级 Agentic AI 产品线,从本地工作站到液冷机柜全覆盖 - 关键数据…
Dell与NVIDIA联合发布Agentic AI全栈方案,包括AI Factory和桌面级产品线,覆盖从本地工作站到液冷机柜,旨在降低企业将AI推理工作负载路由到公有云的成本和延迟。
@LinQingV: 之前做LLM推理芯片架构探索的时候,我把四大AI推理ASIC公司的架构都翻过一遍。Groq、SambaNova、Tenstorrent、Cerebras。前三家的思路虽然各有侧重,但底层逻辑都在同一个框架里:片上大SRAM + dataf…
The article analyzes the AI inference ASIC architectures of Groq, SambaNova, Tenstorrent, and Cerebras, highlighting Cerebras's unique wafer-scale engine design. It discusses the benefits of deterministic latency and high bandwidth for LLM inference, while noting challenges like yield, cost, and KV cache bottlenecks.
@QingQ77: 一套能自己部署的 agentic AI + BI 平台:建 agent、跑多 agent swarm、接知识库和数据源、看完整执行轨迹,全部跑在自己机器和自己的 API Key 上。 https://github.com/AgentSwa…
介绍 AgentSwarms,一套可自行部署的 agentic AI 与 BI 平台,支持构建 agent、运行多 agent swarm、接入知识库与数据源,并可查看完整执行轨迹,数据与 API key 均掌握在用户手中。
@seclink: 冷知识: 目前多模态大模型创业的具体落地方向通常有如下方向,如果都不是你感兴趣的话,还是别赶时髦,乖乖回去学AI coding吧 : 1. 游戏 AI NPC / 智能体中间件(如端云协同的 OmniNPC,赋能 3D 角色交互与情感叙事…
总结了当前多模态大模型创业的几个主要落地方向,包括游戏AI NPC、企业级多模态Agent、内容生成、具身智能和视觉代码助手等。