标签
WSJ 报道,OpenAI 因内部测试中提出的安全担忧,取消了原计划于十月发布的 GPT-6.1 Astra 的发布。
本文报道了短篇小说创意写作基准测试的最新分数,显示了Opus 5.5、Grok 4.7和Gemini 3.8 Flash等AI模型的改进,排行榜涵盖了56个模型和超过100,000次评估判断。
文章讨论了顶级人工智能公司如何利用安全担忧作为营销策略,在竞争动态的背景下提到了Anthropic、OpenAI和ChatGPT。
Hao Zhang离开Meta超级智能实验室,加入Discovery Loop,这是一家由Jeff Dean新创立的AI公司,旨在自动化机器学习研究,估值很高。
这条推文强调了从Meta FAIR的CICERO模型在外交中的演进,到当前能以单一智能体处理社交策略的大语言模型,并邀请与前沿智能体竞争。
Ahmad Osman 回忆他的预测,即本地AI是一个用户体验问题,现在强调 @OsmanticAI 的免费、社区制作的AI,并断言开源AI将成为默认选择。
一位用户对用于演示日的史诗级机器表示兴奋,期待它在前往 Mars 的 starship 中的作用,这是对 cosmic robotics 关于建筑自动化的帖子的回应。
Databricks宣布赞助Cal Bears Field,所有联合创始人都是UC Berkeley校友,突显了公司在Berkeley数据和AI领域的根基。
作者分享了长时间运行的Django基准测试中学到的教训,强调了在评估工作流程稳定性方面的修复,以及更新后的结果,显示Flash Next是表现最佳的模型,现在推理努力级别得到了正确评估。
一篇文章描述了一项实验,作者要求Claude(一个由Opus 5.5构建的AI模型)揭示其内部工作机制的洞见。
OpenAI 已聘请前 Patreon 高管负责创作者产品策略,预示着即将发布面向创作者的变现工具和公告。
ChatGPT Ads 扩展至东南亚及台湾,增加广告主的使用机会,并继续OpenAI在ChatGPT中广告的全球推广。
GPT-6 Sol 在复杂任务上被确认弱于 GPT-5.6 Sol,但在成本与效率方面具有优势
一篇Reddit帖子分享了关于OpenAI的Aeon Persistent Agent的泄露信息,并提及可能的'Orbit'系统或模型,这标志着AI代理技术的新进展。
AI开发者乔治·格尔加诺夫发布推文,分享了一个链接,内容可能与技术或AI动态相关。