audio

标签

Cards List
#audio

说正经的,这个看起来和听起来都太棒了

Reddit r/ArtificialInteligence ↗ · 2026-05-18

一条称赞产品或演示外观和声音高质量的评论。

0 人收藏 0 人点赞
#audio

泄露图片揭示索尼十周年纪念版‘ColleXion’耳机

The Verge ↗ · 2026-05-18 缓存

泄露图片和细节揭示了索尼即将推出的十周年纪念版ColleXion耳机,采用高级设计、更新音频驱动,售价649美元,预计5月19日发布。

0 人收藏 0 人点赞
#audio

AudioMosaic:对比掩码音频表示学习

arXiv cs.LG ↗ · 2026-05-15 缓存

AudioMosaic 提出了一种基于对比学习的音频编码器,通过对频谱图块应用结构化时频掩码来构建正样本对,实现高效的大批量训练,在音频基准测试中达到最先进性能,并提升了音频-语言模型的效果。

0 人收藏 0 人点赞
#audio

测试一个智能体技能:将提示转化为音频课程并发布到Spotify

Reddit r/AI_Agents ↗ · 2026-05-13

作者描述了测试一个智能体工作流程,该流程将提示转化为音频课程以发布到Spotify,潜在用途包括会议简报、团队更新和学习笔记。

0 人收藏 0 人点赞
#audio

@OpenAI: 在以下平台收听OpenAI播客—— Spotify https://open.spotify.com/show/0zojMEDizKMh3aTxnGLENP… Apple https://podcasts.a…

X AI KOLs ↗ · 2026-04-17

OpenAI宣布其播客现已上线主流流媒体平台,包括Spotify、Apple Podcasts和YouTube。

0 人收藏 0 人点赞
#audio

Socrati

Product Hunt ↗ · 2026-04-14

Socrati 是一款在 Product Hunt 上发布的新产品,可以从各种来源生成个人知识播客。

0 人收藏 0 人点赞
#audio

OmniGUI:在全方位模态智能手机环境中对GUI智能体进行基准测试

Hugging Face Daily Papers ↗ · 2026-04-03 缓存

OmniGUI引入了一个针对GUI智能体的步骤级基准测试,该测试整合了静态图像、同步音频和视频片段,以模拟真实的智能手机交互。评估显示,当前模型在处理时序和听觉输入方面存在困难,凸显了对全方位模态能力的需求。

0 人收藏 0 人点赞
#audio

GPT-4o 系统卡

OpenAI Blog ↗ · 2024-08-08 缓存

OpenAI 发布了 GPT-4o 系统卡,详细介绍了在网络安全、生物威胁、说服力和模型自主性等方面的全面安全评估和风险缓解措施。这个多模态模型在准备框架类别中得分为低至中等,并为音频功能采用了新颖的防护措施。

0 人收藏 0 人点赞
#audio

yt-dlp/yt-dlp

GitHub Trending (daily) ↗ · 2026-05-22 缓存

yt-dlp 是一个功能丰富的命令行音视频下载器,支持数千个网站,从 youtube-dl 分支而来。

0 人收藏 0 人点赞
← Previous
← 返回首页

提交意见反馈