标签
Bland 发布 Speech v3,声称它是世界上第一个人类语音引擎,并且在 Design Arena 的音频真实感基准测试中名列前茅,超越了 ElevenLabs、Grok、Cartesia 和 OpenAI。
Composer v3被预告即将发布,早期下载数据显示首小时下载量达2.85k,表明需求旺盛。
OpenAI 宣布了 GPT-5.6 Sol 的有限预览,这是一个新一代前沿模型,同时推出了 GPT-5.6 Terra 和 GPT-5.6 Luna,以实现高效且经济实惠的工作。
Meta没有为其最新的面向开发者的AI模型计划发布日期,尽管此前计划本月发布。据报道,Muse Spark模型与OpenAI和Anthropic的产品具有竞争力,但尚未经过独立评估。
HexoAI 发布了 SIA,一个开源的自我改进型人工智能,能够通过递归自我提升来实现任何目标。
一位用户赞扬 QuixiAI 新发布的 AI 模型,特别提到了其运行速度快、采用 Apache 2.0 许可证以及美国出身。
OpenAI在大约15天内发布了多个GPT模型和功能,包括GPT Image 2、多个GPT 5.5变体(Pro、Instant、Cyber)、GPT Realtime 2以及相关工具。
OpenAI 已发布 GPT-5.5 Instant,将其作为 ChatGPT 的新默认模型,提供更智能、更个性化的回答。
DeepSeek 发布 DeepSeek-V4-Flash 和 DeepSeek-V4-Pro,新一代 MoE 语言模型,支持 100 万 token 上下文,效率和性能均有提升。
OpenAI 推出 GPT-5.2,这是目前最强大的模型系列,在知识工作、代码生成、图像理解、长上下文理解和工具调用方面都有显著提升。GPT-5.2 Thinking 变体在专业基准测试中达到最先进的性能,在 44 个职业的 GDPval 任务中,70.9% 的表现超越了人类专家。
OpenAI 发布 GPT-4,一个大型多模态模型,接受图像和文本输入,在专业和学术基准测试中表现出人类水平的性能,在各种评估指标上的表现明显优于 GPT-3.5。