Opus 5.5 展示了先进的视频创作能力,它自主生成了一个SNES风格的视频游戏视频,包含代码、音乐和角色,场景涉及Sydney、Altman和Claude。
Opus 5.5 展示了生成复杂 Web 3D 代码的出色能力,能够创建具有动态照明和物理等高级功能的交互式演示,表明软件开发范式发生了重大转变。
据报道,Opus 5.5 让 OpenAI 措手不及,压缩了 GPT-6.1 Astra 的时间表,并间接地让‘Bel’(解决了 Navier–Stokes 方程的模型)的发布更接近。
Opus 5.5 AI模型被用来创建一个黑暗之魂风格的游戏,显示了其强大的创意生成能力。
Claude Opus 5.5 被描绘为一个高度先进的AI模型,通过10个离谱案例展示了其惊人能力。
AI 模型 Opus 5.5 已发展至仅通过一个提示就能在单一 HTML 文件中生成逼真的 3D 世界,标志着 AI 能力的重大进步。
Meta 在其成功推出的基础上,为 Muse AI 智能体添加了新功能,包括视频聊天、电子邮件集成和在 Mac 上使用计算机。
Jev,一个结构化文本分类模型,展示了在40秒内仅以0.09美元代币处理37个品牌的724条实时广告的能力,通过并行处理和与Gemini的集成,实现了每条记录216毫秒的中位数延迟。
Mercury 2.5 LLM 在通过各种智能基准测试和能力指数评估后,达到了每秒 770 tokens 的速度。
本文宣布了 together/Tev1-4B-experimental 的发布,这是一个基于 Qwen3.5 4B 微调的类 Jev 分类模型,并提供了一份指南,教你如何以大约17美元训练自己的版本。
Opus 5.5在机器人试验中展示了成本效率的提升,得分比Opus 5高1.8倍,成本只有一半,同时以低21%的成本匹配Astra的性能。
FLUX 3 Action 是一款开放权重的 7B AI 模型,在 RoboLab 基准测试中树立了新标准,其性能超越了之前的开源模型,同时速度更快、效率更高,适用于机器人技术以及其他需要视觉动作规划的环境。
OpenAI宣布对GPT Voice进行重大升级,使其能够使用电子邮件和日历等工具,由GPT-6模型提供支持,并已在ChatGPT Work中上线,以增强生产力任务。
LensVLM-9B是苹果公司开发的一个拥有90亿参数的视觉语言模型,它能扫描压缩的文本图像,并利用学习到的工具选择性地展开相关页面,同时提供了论文、代码和使用说明。
Black Forest Labs发布了FLUX 3 Action,这是一组面向机器人的70亿参数AI模型,包含基础模型以及适用于SO-101和DROID的控制策略,已在Hugging Face平台上线。
Ryan Sael 展示了 Opus 5.5 能够在不到两小时内以低成本创建一个用于相机对焦教育的交互式镜头实验室,突显了先进的AI原型设计能力。
Google 推出 Gemini 3.8 Flash TTS 与 Gemini 3.8 Flash-Lite TTS,这些新的文本转语音模型可让创作者和开发者生成富有表现力且可定制的音频。
DrivingBench 评估前沿AI模型(如GPT-6 Astra)能否通过控制一辆丰田卡罗拉在预定义路线上驾驶真实汽车,并追踪诸如进度、距离和token成本等指标。
名为 Space Bunny 的秘密多模态 AI 模型已在 OpenCode 中发布,可免费试用,发布公司未知