标签
Wired 评测并推荐了2026年仍配备耳机插孔的最佳智能手机,重点介绍了 Motorola Moto G Stylus 和 TCL 60 XE Nxtpaper 等型号,同时讨论了自苹果移除该插孔以来其逐渐衰落的情况。
MiniMax 发布 H3,这是一款开放的多模态生成模型,支持文本、图像、视频和音频,可生成最长 15 秒的 2K 视频并带有原生立体声,同时计划开源模型权重。
Nothing Ear 3A 耳机以99美元的价格提供出色的降噪和音频性能,但偶尔出现漏洞,默认音质低音过重,需调整均衡器。
audio.cpp 0.4 版本为 Higgs Audio v3 TTS 4B(10倍实时)和 Fish Audio S2 Pro 添加了基于 C++/GGML 的推理,支持完整 GGUF 加载,并实现了 Q8 速度与显存优化。
Fusion Embedding 引入了一个模型系列,将音频添加至冻结的视觉-语言嵌入主干网络,从而实现文本、图像、视频和音频检索的统一嵌入空间。该系列模型仅训练轻量级适配器,无需配对音视频数据即可实现音频-图像检索。
Instagram正在推出一项新功能,允许创作者无限次更换旧帖子的音频轨道,且点赞和评论不会丢失。这是其更广泛策略的一部分,旨在通过提供更灵活的内容编辑工具与TikTok竞争。
Cagire是一款免费开源步进音序器,每个步进包含Forth脚本而非传统音符数据,并内置名为Doux的音频引擎。它支持实时编码,适用于多个平台。
Skullcandy与Bose合作提升音质,并推出新款Crusher 1080 ANC耳机,旨在摆脱其廉价名声。
一个 Claude Code 插件,当 Claude 等待用户输入时播放 Mr. Meeseeks 音频提示,通过音频反馈增强开发体验。
腾讯 Hy3 295B MoE 模型和 NVIDIA 支持音频的 30B MoE 模型的 GGUF 量化版本已发布,附带详细的基准测试、imatrix 校准和完整的可复现数据。
audio.cpp更新引入了流式支持和四个ASR/STT模型(Nemotron 3.5、Higgs Audio STT、VibeVoice ASR、Hviske ASR),采用原生C++/GGML实现,速度比Python快高达2.41倍,词错误率(WER)和显存占用具有竞争力。
一款渐进式网络应用,重现东京山手线的完整声音景观,包括车站旋律、车门提示音、广播和列车环境噪音,让用户通过可分享且支持离线使用的界面收听所有30个车站的双向声音。