3970亿参数AI成功运行于iPhone
摘要
一个3970亿参数的AI模型已成功在iPhone上运行,展示了使用混合专家设计的设备端AI能力,尽管在速度、存储和散热方面面临挑战。
一个3970亿参数的AI刚刚在iPhone上运行。不是演示视频——是手机本身,在断网状态下生成文本。设备端AI已经如此强大,这个视频将展示具体实现过程以及你今天能实际运行什么。我们深入分析混合专家设计,它让96%的模型处于休眠状态;苹果三年前的论文预言了这一切;flash-moe团队为何删除自己的缓存代码后速度提升38%;以及它在哪些方面仍有不足——速度、存储和散热——这样你就能分辨哪些是真实的,哪些是炒作。如果你想让AI在自己的硬件上运行,而不是在别人的服务器上,这就是未来的发展方向。点击观看:3970亿AI成功运行于iPhone #OnDeviceAI #iPhone #AI #LocalAI #MixtureOfExperts #AppleSilicon #OnDeviceAI #LocalLLM
相似文章
80亿参数模型通过离线应用可在iPhone 15上无需联网运行
现在,一个80亿参数的AI模型可以通过专用应用在iPhone 15上离线运行,实现无需互联网的设备端推理。
@rohanpaul_ai: 设备端小模型的可能性太多了。@adrgrondin 正在 iPhone 17 Pro 上运行 Google 的 Gemma 4 E2B。大约 4…
Google 的 Gemma 4 E2B 通过 MLX 优化在 iPhone 17 Pro 上运行演示,达到约 40 tokens/秒,支持 128K 上下文以及离线思考模式,适用于编程和数学。
@0x0SojalSec:苹果在每台 M4 Mac 和 iPhone 中隐藏了 15.8 TFLOPS 的原始 AI 算力。他们只允许你使用神经网络引擎进行推理。……
一位开发者逆向工程了苹果的私有 API,使得在 M4 Mac 和 iPhone 的 Apple 神经网络引擎(ANE)上直接训练神经网络成为可能,绕过了 CoreML 和 GPU。该项目表明 ANE 硬件能够进行训练,尽管存在利用率低以及某些操作回退到 CPU 等限制。
本地iPhone AI图像生成正变得实用 - 每张图片仅需3秒
基准测试显示,在iPhone上本地运行Stable Diffusion 1.5,使用Realistic Vision V5.1 Hyper等优化模型,生成512x512图像最快仅需3.1秒,使得设备端AI图像生成变得切实可行。
在你的iPhone上运行(最大的)本地模型
一款工具或应用,让用户能直接从iPhone上运行大型本地AI模型,将设备端LLM推理带到iOS。