edge-ai

标签

Cards List
#edge-ai

无GPU革命:高效AI模型如何让人工智能大众化

Reddit r/AI_Agents · 2026-06-08

一场静默的革命正在让强大的AI模型无需昂贵GPU即可在消费级硬件上运行,这得益于量化技术和优化实现(如llama.cpp的Gemma4 MTP支持)的突破,为爱好者、小型企业和边缘计算打开了大门。

0 人收藏 0 人点赞
#edge-ai

集群三台Jetson Nano Orin Super

Reddit r/LocalLLaMA · 2026-06-07

作者宣布了一篇新的博客文章,内容是关于将三台Jetson Nano Orin Super组成集群,用于分布式训练和推理,延续了一个系列,旨在帮助人们使用易于获取的硬件构建小型计算集群。

0 人收藏 0 人点赞
#edge-ai

我们是否低估了小型边缘AI模型?[D]

Reddit r/MachineLearning · 2026-06-05

一位开发者认为,边缘AI社区忽视了那些可以在智能手机等设备上本地运行的小型专门模型,并以自建的离线摩尔斯电码识别功能为例。该项目使用了小于5MB的AI模型,基于TensorFlow/Keras和LiteRT,从数据生成到移动端集成的整个流程均为自建。

0 人收藏 0 人点赞
#edge-ai

@KanikaBK: Google刚刚投下了一颗AI重磅炸弹!一场十亿美元的游戏开始了。Gemma 4 12B在你的笔记本电脑上运行。16GB内存,那就是……

X AI KOLs Timeline · 2026-06-03 缓存

Google发布了Gemma 4 12B,这是一个采用Apache 2.0许可证的开源多模态AI模型,可在拥有16GB内存的笔记本电脑上本地运行,面向企业边缘部署。

0 人收藏 0 人点赞
#edge-ai

@zhixianio: 这两天新机器到了之后,我开始了「苦行僧」式的强迫自己使用本地模型来完成常见任务的修行 本以为会非常痛苦,没想到无论是速度还是质量都大大超出我的预期: 模型: Qwen3.6-35B-A3B-oQ6-fp16-mtp 运行:oMLX,开 N…

X AI KOLs Timeline · 2026-06-03 缓存

作者在本地新机器上使用Qwen3.6-35B-A3B模型和oMLX工具进行日常任务,发现速度和效果远超预期,甚至在PA和Coding场景下优于远程LLM,体现了端侧AI能力的显著提升。

0 人收藏 0 人点赞
#edge-ai

小型LLM基准测试:Jetson Orin Nano Super 8GB - 四种功率模式 × 八种模型

Reddit r/LocalLLaMA · 2026-06-02

一项对8个小型LLM(参数规模从1.35亿到约10亿)在售价250美元的Jetson Orin Nano Super上进行的深入基准测试,涵盖四种功率模式,发现25W是帕累托最优模式,其中SmolLM2-135M达到165.1 tok/s,效率最高。

0 人收藏 0 人点赞
#edge-ai

NVIDIA Jetson将代理式AI带入物理世界

NVIDIA Blog · 2026-06-02 缓存

NVIDIA宣布在Jetson上支持JetPack 7.2和NemoClaw,将代理式AI能力带给机器人和工业自动化等边缘设备,并带来性能提升和新的开发者工具。

0 人收藏 0 人点赞
#edge-ai

NVIDIA 工厂运营蓝图赋予工厂全新 AI 大脑

NVIDIA Blog · 2026-06-01 缓存

NVIDIA 发布工厂运营蓝图 (FOX),这是一项参考设计,用于构建能够集成实时数据、自动化模型训练并编排专用代理的自主工厂管理 AI 代理,已获多家主要制造商早期采用。

0 人收藏 0 人点赞
#edge-ai

@abidlabs:对于一个8B模型来说,非常出色!在这里查看 @Gradio 应用:https://huggingface.co/spaces/LiquidAI/LFM2.5-8B-A1B…

X AI KOLs Following · 2026-05-28 缓存

Liquid AI 发布了 LFM2.5-8B-A1B,这是一个8B MoE模型,拥有1.5B活跃参数和128K上下文,为边缘设备优化。

0 人收藏 0 人点赞
#edge-ai

一款可在手机上运行的微型开源自动驾驶AI [P]

Reddit r/MachineLearning · 2026-05-27

一个7MB的开源L4级自动驾驶AI被训练从视觉和传感器输入中学习导航、车道保持和漂移恢复,设计用于在手机和嵌入式设备上运行,无需重型基础设施。

0 人收藏 0 人点赞
#edge-ai

@Soranlan: https://x.com/starmexxx/status/2058933808406130855/video/1… 黄仁勋在台上卖了一台249美元的AI电脑,它能干掉你每月200美元的OpenAI账单。视频有217,000个赞 这个盒…

X AI KOLs Timeline · 2026-05-25 缓存

NVIDIA发布了售价249美元的Jetson Orin Nano Super开发者套件,一款能本地运行Llama 3、Mistral等大模型的AI电脑,可将每月200美元的OpenAI账单降至仅22美元电费。

0 人收藏 0 人点赞
#edge-ai

在微控制器上运行DCGAN推理:1260万参数,512KB SRAM,26秒生成,纯C实现 [P]

Reddit r/MachineLearning · 2026-05-25

演示在低成本RISC-V微控制器(CH32H417)上运行具有1260万int8量化参数的DCGAN,使用纯C推理和量子熵采样,在26秒内生成64x64的猫脸图像。

0 人收藏 0 人点赞
#edge-ai

@heyshrutimishra: 全尺寸AI模型现在可以在手机上运行。这就是 BitCPM,一个来自 ModelBest、清华大学和 OpenBMB 的全新开源模型。……

X AI KOLs Following · 2026-05-25 缓存

BitCPM 是一个来自 ModelBest、清华大学和 OpenBMB 的新开源模型,它使用三元权重(-1,0,1)在手机上运行全尺寸AI模型。

0 人收藏 0 人点赞
#edge-ai

为Orange Pi AIPro(Ascend 310B)上的MiniCPM-V 4.6编写自定义C++引擎以绕过框架开销

Reddit r/LocalLLaMA · 2026-05-25

为Orange Pi AIPro(Ascend 310B NPU)上的MiniCPM-V 4.6开发了自定义C++推理引擎,通过为matmul和causal-conv1d编写优化的AscendC内核,实现了相比原始框架2倍的加速,达到5.90 tokens/s。

0 人收藏 0 人点赞
#edge-ai

@rohanpaul_ai:BitCPM-CANN 成为全球首个完全基于中国自主研发AI基础设施训练并开源的1.58位三值LLM

X AI KOLs Following · 2026-05-22 缓存

BitCPM-CANN 是首个在完全基于中国自主研发AI基础设施(华为昇腾910B)上训练的开源1.58位三值大语言模型,实现了极致的存储缩减,适用于边缘部署。

0 人收藏 0 人点赞
#edge-ai

@ycombinator:General Instinct (@gen_instinct) 将前沿AI模型部署到受限边缘硬件上,助力机器人技术和物理…

X AI KOLs Following · 2026-05-19

General Instinct 推出一个部署层,使前沿AI模型能够在如 Jetson 和移动 NPU 等受限边缘硬件上运行,帮助机器人技术和物理AI团队实现低延迟离线推理。

0 人收藏 0 人点赞
#edge-ai

@paulabartabajo_: 下一波人工智能浪潮不会是大规模数据中心,而是运行在边缘的紧凑智能。你和地球…

X AI KOLs Timeline · 2026-05-19 缓存

一条推文认为,下一波人工智能浪潮将是边缘设备上的紧凑智能,而非更大的数据中心,Liquid AI 支持在手机、汽车和日常设备上运行 AI 的愿景。

0 人收藏 0 人点赞
#edge-ai

如何应对部署在无可靠连接区域的设备上AI模型的固件更新?是等待技术人员上门,还是接受模型过时?

Reddit r/AI_Agents · 2026-05-19

深入剖析在偏远或无网络连接环境中部署边缘设备时更新AI模型所面临的真实挑战,涵盖连接窗口、技术人员上门、网格传播以及接受模型过时等策略。

0 人收藏 0 人点赞
#edge-ai

边缘AI驱动的学习排序方法用于循环智能制造的分散式任务分配

arXiv cs.LG · 2026-05-19 缓存

本文提出了一种面向循环智能制造的边缘AI驱动分散式任务分配框架,该框架利用学习排序方法来匹配赢家选择的排序性质。仿真结果表明,在高负载和紧截止期限场景下,延迟、截止时间满足率和能源效率均得到改善。

0 人收藏 0 人点赞
#edge-ai

面向野外的可持续智能:通过知识自适应边缘专家代理实现生态监测民主化

arXiv cs.AI · 2026-05-19 缓存

本文提出了一种用于生态监测的知识自适应边缘专家代理架构,将视觉感知与推理分离,以减少对云资源的依赖,并在远程部署中实现可持续的端侧AI。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈