edge-deployment

标签

Cards List
#edge-deployment

面向铁路系统异常检测的深度学习:结构化综述

arXiv cs.LG ↗ · 14小时前 缓存

本文对基于深度学习的铁路系统异常检测方法进行了结构化综述,将CNN、RNN、注意力模型、自编码器、GAN及Transformer统一组织成一套分类体系,并提出了一个以决策为导向的框架,将异常特征、数据属性与部署约束(包括边缘-云协同架构)同各类检测范式相联系。

0 人收藏 0 人点赞
#edge-deployment

@svpino:这个开源模型仅用 3.66B 参数就在 BIG-Bench Hard 逻辑子集上拿下 95.4%。TwIL-LM3-Pro 是一个……

X AI KOLs Following ↗ · 2天前 缓存

TwIL-LM3-Pro 是一个 3.66B 参数的开源模型,在 BIG-Bench Hard 逻辑子集上取得 95.4% 的成绩,体积小到可以直接在笔记本电脑本地运行,展示了针对特定任务的小模型进行专业化后训练的强大威力。

0 人收藏 0 人点赞
#edge-deployment

Bern2Edge:通过伯恩斯坦多项式网络进行边缘部署的神经符号编译器

arXiv cs.LG ↗ · 2026-08-24 缓存

Bern2Edge是一种神经符号编译器,能将预训练神经网络转换为伯恩斯坦多项式表示,以在FPGA上实现高效且可解释的边缘部署,显著降低延迟和资源使用,同时保持准确性。

0 人收藏 0 人点赞
#edge-deployment

通过年龄感知训练实现儿童语音的边缘音素识别

arXiv cs.AI ↗ · 2026-08-12 缓存

提出了一种用于儿童语音音素识别的年龄感知多任务学习方法,使轻量级94M参数模型能够超越更大的模型,并在手机等边缘设备上运行。

0 人收藏 0 人点赞
#edge-deployment

@AdinaYakup: Ling 3.0 tiny a 7.9B/1.3B hybrid reasoning MoE https://huggingface.co/inclusionAI/Ling-3.0-tiny…

X AI KOLs Timeline ↗ · 2026-08-11 缓存

InclusionAI introduces Ling-3.0-tiny, a 7.9B-parameter hybrid reasoning MoE model with only 1.3B active parameters per token, optimized for efficient local and edge deployment.

0 人收藏 0 人点赞
#edge-deployment

RAG-HAR+:面向边缘部署的成本高效基于LLM的人体活动识别

arXiv cs.LG ↗ · 2026-07-30 缓存

RAG-HAR+ 是RAG-HAR的一种检索优先、成本优化的扩展,用于从可穿戴传感器进行人体活动识别。它利用检索设计器代理和多数投票机制,在降低LLM使用量的同时保持准确率,并展示了边缘部署的可行性。

0 人收藏 0 人点赞
#edge-deployment

@freeCodeCamp:机器人技术中的实时目标检测不仅仅需要一个好模型。在本教程中,Iyanuoluwa 将向您展示如何…

X AI KOLs Timeline ↗ · 2026-07-30 缓存

本教程介绍如何使用 ROS 2 和 YOLOv11 构建用于机器人技术的实时目标检测与跟踪管道,涵盖线程推理、ByteTrack 集成、置信度验证以及用于边缘部署的 ONNX 导出。

0 人收藏 0 人点赞
#edge-deployment

@jakevin7: MCP 大更新了。核心协议全面无状态化,告别 session 和长连接,更适合 serverless、边缘部署与横向扩容。 之前 MCP 更像 为 agent 特制的有状态 RPC; 现在中于更像 基础设施标准 一点了

X AI KOLs Timeline ↗ · 2026-07-29 缓存

MCP 迎来重大更新,核心协议全面无状态化,告别 session 和长连接,更适合 serverless、边缘部署与横向扩容,被称为自发布以来最大更新。

0 人收藏 0 人点赞
#edge-deployment

@akshay_pachaar: 无服务器 vs 本地部署 vs 边缘部署。(下次部署前必读)这三种方式是对同一个问题……

X AI KOLs Following ↗ · 2026-07-28 缓存

本文比较了无服务器、本地和边缘部署三种 AI 模型部署方式,指出了当前多模型服务中的低效问题。它介绍了 Superlinked Inference Engine (SIE),一个开源工具,通过动态加载和卸载权重,在单个 GPU 上服务多个模型,旨在降低成本和复杂性。

0 人收藏 0 人点赞
#edge-deployment

面向延迟和模型大小优化的LLM多目标结构化剪枝

arXiv cs.AI ↗ · 2026-07-28 缓存

提出了一种面向LLM的两阶段结构化剪枝框架,通过多目标深度剪枝和并行贝叶斯优化联合优化延迟与模型大小,在边缘部署中实现有利的权衡。

0 人收藏 0 人点赞
#edge-deployment

相同的预测,不同的原因:量化对模型解释的影响

arXiv cs.LG ↗ · 2026-07-28 缓存

本文系统评估了后训练量化如何影响使用Grad-CAM和LIME的CNN模型的可解释性,揭示分类准确性并非可解释性稳定性的可靠指标,并且架构选择对于可信部署至关重要。

0 人收藏 0 人点赞
#edge-deployment

RobustMAD:评估多模态小语言模型在可部署异常检测助手中的实际鲁棒性

arXiv cs.LG ↗ · 2026-07-21 缓存

RobustMAD 引入了一个基准,用于评估多模态小语言模型在实际部署的工业异常检测助手中的鲁棒性。它揭示了关键的失败模式,并为下一代系统提供了指导。

0 人收藏 0 人点赞
#edge-deployment

重新思考小型VLM量化:从组件分析到硬件感知的边缘部署

arXiv cs.LG ↗ · 2026-07-10 缓存

本文系统性地评估了Jetson边缘设备上小型视觉语言模型的组件级量化,发现模型架构(MoE vs 稠密)显著影响量化敏感性,且量化误差在大体上是累加的,除了模态对齐路径之外。

0 人收藏 0 人点赞
#edge-deployment

轻量级入侵检测模型在工业物联网网络中的跨域泛化失败

Hugging Face Daily Papers ↗ · 2026-07-01 缓存

本文研究了用于工业物联网入侵检测的轻量级机器学习模型的跨域泛化失败,发现它们依赖于粗糙的端口特征,并且对抗鲁棒性与跨网络性能无关。

0 人收藏 0 人点赞
#edge-deployment

小大脑,大成就:探索紧凑型语言模型

Hugging Face Daily Papers ↗ · 2026-06-29 缓存

本文对17个紧凑型语言模型(1B-8B参数)在俄语RAG系统中作为生成器进行了基准测试,仅使用CPU推理,发现Qwen系列模型在私有、无GPU部署中提供了出色的质量-延迟权衡。

0 人收藏 0 人点赞
#edge-deployment

压缩递归推理模型用于边缘设备时,什么得以保留?

arXiv cs.LG ↗ · 2026-06-26 缓存

对压缩递归推理模型用于边缘硬件进行系统研究发现,激进量化会破坏全局推理,同时保留局部预测。该论文引入每通道校准的INT4以恢复推理能力,并提供了适配8 MB SoC和4 MB MCU目标的部署方案。

0 人收藏 0 人点赞
#edge-deployment

@_avichawla: AI工程师应知的4种AI代理部署策略。(收藏此帖)代理可以按计划运行、在流上运行、…

X AI KOLs Timeline ↗ · 2026-06-25 缓存

一条推文线程解释了四种AI代理部署策略:批量部署、流部署、实时部署和边缘部署,并附有详细描述和使用场景。

0 人收藏 0 人点赞
#edge-deployment

用于设备端故障检测的轻量级Transformer模型:资源受限部署的基准研究

arXiv cs.LG ↗ · 2026-06-24 缓存

一项基准研究,在三个公开数据集上对比了传统机器学习方法(随机森林、XGBoost、SVM、逻辑回归)与轻量级Transformer变体(DistilBERT、TinyBERT、MobileBERT)在设备端故障检测中的表现。传统机器学习在远小得多的资源占用下实现了有竞争力的准确率,而TinyBERT-4L是最便于部署的Transformer模型。

0 人收藏 0 人点赞
#edge-deployment

@AdinaYakup: 百度 @PaddlePaddle 发布 PP-OCRv6:tiny 1.5M / small 7.7M / medium 34.5M,支持 48+ 种语言,支持手写/……

X AI KOLs Following ↗ · 2026-06-11 缓存

百度 PaddlePaddle 发布了 PP-OCRv6,一款支持 48+ 种语言的 OCR 模型,提供 tiny(1.5M)、small(7.7M)和 medium(34.5M)三种尺寸,针对边缘部署进行了优化,可处理手写、印刷、工业、屏幕和卡片文字。

0 人收藏 0 人点赞
#edge-deployment

Recover-LoRA用于激进量化:通过合成数据上的知识蒸馏低秩适配恢复2比特语言模型精度

arXiv cs.LG ↗ · 2026-06-04 缓存

AMD的研究人员提出了Recover-LoRA,该方法利用基于合成数据的知识蒸馏低秩适配,恢复因LLM激进2比特量化而损失的精度。在Qwen3-4B模型上仅使用1万个合成样本,就在12个基准测试中的9个上实现了80%–95%的精度恢复。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈