清除障碍:AI增强的RF干扰抑制
摘要
本文介绍了一种AI增强的RF干扰抑制方法,该方法使用带有有限标量量化分词器的Transformer模型,以提升性能并最小化延迟,并通过数字信号场景中的音频指标进行验证。
arXiv:2608.24974v1 公告类型:新
摘要:基于AI的结构化干扰抑制已日益流行,因为深度学习方法能够通过联合考虑感兴趣信号(SOI)和信号混合(SOI加干扰)来优于传统方法。这项工作在先前的AI增强方法基础上,该方法利用自回归Transformer模型,通过添加有限标量量化(FSQ)分词器层,旨在提高干扰抑制性能,同时将整体延迟降至最低。此外,我们实验了其他推理优化技术,目标是在不损失太多准确性的情况下加速推理。我们通过一项实验探索这一领域,其中SOI是数字调制的射频(RF)信号,结构化干扰是数字电视信号,这是一种极其常见的正交频分复用(OFDM)传输类型。我们的结果实现了低延迟和更高的干扰抑制,优于传统技术和其他AI增强方法的先前工作。我们通过音频指标(如语音质量感知评估(PESQ))展示了AI增强方法的好处。此外,我们探索了多种应用,并详细说明了我们的干扰抑制算法如何在实际操作相关的场景中使用。
相似文章
可重构计算挑战:在Versal AI引擎上使用Transformer进行喷注标记
本文提出了一种在AMD Versal AI引擎上用于喷注标记的量化、纯整数Transformer实现,包括一个可重用的开源框架,该框架将Transformer层映射到AIE瓦片上,用于CERN LHC的低延迟触发系统。
基于哈密顿启发的注意力机制用于可扩展射频发射器指纹识别
提出了一种哈密顿Transformer,一种物理信息注意力机制,通过强制保范数值动力学用于射频发射器指纹识别,在同一天条件下达到99.12%的准确率,在150个发射器时达到61.64%,优于CNN和Transformer基线。
@AlphaSignalAI: https://x.com/AlphaSignalAI/status/2062553418460479577
一款名为Headroom的开源工具采用可逆的Compress-Cache-Retrieve架构,能将AI智能体上下文压缩高达90%,使模型能够在需要时检索原始细节,而非永久丢弃。
嘈杂环境中的语音代理
一家语音公司训练了一个模型,该模型能消除噪声并识别主要说话者,在嘈杂环境中,领先的ASR模型的词错误率降低了50%。
RF-DETR:面向实时检测Transformer的神经架构搜索
RF-DETR提出了一种轻量级检测Transformer,通过权重共享神经架构搜索实现最先进的实时目标检测,在COCO和Roboflow100-VL上优于先前方法,同时运行速度快达20倍。