标签
一位用户回顾 GPT-4,称其是第一个让人感觉有用且实用的 LLM,在它完成训练四年后,表达了对未来的期待。
这篇arXiv论文通过生成并分析五个LLM的25,000个故事,调查了基于LLM的聊天AI对智障人士的隐性偏见。研究结果揭示了诸如幼态化、家长式作风和依赖性等负面偏见,凸显了在AI开发中减少偏见的必要性。
《PLOS One》上一项新研究发现,模仿112位英国公众人物的AI聊天机器人产生的回复在真实性、连贯性和相关性上均超过真人,警告称这可能造成政治欺骗引发社会危害。
本文详细介绍了如何逆向工程微软的 Windows Copilot,创建一个与 OpenAI 接口兼容的免费 API,从而无需 API 密钥和计费即可访问 GPT-4。
本文揭露了约翰·柯尼希(John Koenig)的《The Dictionary of Obscure Sorrows》的一个抄袭版本,该版本抄袭了整本书的文字,并用AI生成的图片替换了原始插图,同时还使用GPT-4让用户创作新的“悲伤”词条。这一事件引发了对AI助长抄袭和侵犯版权的担忧。
Dan Shipper认为,像GPT-4这样的人工智能模型可以在心理学等缺乏科学解释的领域取代人类直觉,主张即使没有完全理解,也要利用AI推动进步。
介绍Caltext,一款为iMessage构建的开源卡路里追踪工具,利用GPT-4.1视觉能力和现代技术栈,包括Bun、Turborepo、Hono和Vercel。
由James Zou领导的斯坦福研究人员发现,OpenAI、Anthropic和Google的AI模型在约30%的情况下引用错误来源,即使回答大部分正确。该研究突显了文本生成与准确引用之间的关键不匹配,给医学和法律等领域带来风险。
一场哲学讨论,质疑AI模型是否真正“理解”,或者我们只是将类似人类的认知投射到模式匹配系统上,并引用了塞尔的中文房间、“随机鹦鹉”和GPT-4的表现。
OpenAI 发布了 GABRIEL,这是一个开源工具包,利用 GPT 将非结构化的定性数据(文本、图像)转换为定量测量,供社会科学家和经济学家使用。该工具通过自动化重复的标注任务,使研究人员能够更高效地分析大规模的定性数据集,同时保留人类数据的丰富性。
# Higgsfield 如何将简单创意转化为电影级社交视频 来源:[https://openai.com/index/higgsfield/](https://openai.com/index/higgsfield/) 短视频驱动着现代商业,但要制作出真正有影响力的视频却比看起来更难。那些在 TikTok、Reels 和 Shorts 上看似毫不费力的片段,实则建立在一些无形的规则之上:钩子时机、镜头节奏、摄影机运动、节奏控制以及其他微妙的线索,它们让内容对当下流行的事物显得“原生”。[Higgsfield\\(打开
OpenAI宣布通过外部第三方测试和评估前沿AI模型来加强安全生态系统,包括独立评估、方法论审查和领域专家探测。该公司承诺通过公开分享第三方评估结果和自GPT-4推出以来支持独立评估来提高透明度。
Blue J 展示了如何通过将 GPT-4.1 与基于精选税务文档的检索增强生成相结合,在复杂监管领域扩展 AI 专业知识,实现低于 0.14% 的错误率和 70% 的周用户参与度,并通过严格的反馈循环和领域特定优化来优化性能。
Intercom分享了他们快速采用AI来改造客户服务平台的三个经验:深度测试模型、从一开始就以AI为中心的架构而非后期集成、以及使用严格的评估流程快速采用GPT-4.1等新模型。
摩根士丹利已在其财富管理部门成功部署了由 GPT-4 提供支持的 AI 解决方案,超过 98% 的顾问团队使用内部 AI 助手聊天机器人。该部署由一个强大的评估框架支持,该框架在生产环境推出前测试 AI 在文档摘要和多语言翻译等真实用例上的性能。
阿科教育(Arco Educação),巴西最大的教育运营系统,正与OpenAI合作推出“教师助手”(Teacher Assistant),这是一款基于GPT-4的AI工具,帮助教师为具有不同学习需求的学生制定个性化教案,大幅减少行政任务和备课时间。
Ada 利用 GPT-4 和由 OpenAI API 驱动的多智能体系统来提升客户服务质量,将问题解决率从 30% 提高到 60-80%,同时保持高解决率,建立了超越传统指标的新行业标准。