safety-concerns

标签

Cards List
#safety-concerns

针对OpenAI的抗议活动日益创意十足

Ars Technica ↗ · 昨天 缓存

针对OpenAI的抗议活动正变得越来越有创意,艺术家们使用泰坦尼克号主题艺术来批评该公司。此外,OpenAI面临AI训练的安全暂停、未经授权的数据访问以及来自佛罗里达州的法律挑战。

0 人收藏 0 人点赞
#safety-concerns

OpenAI因安全担忧推迟最新模型发布

Wired ↗ · 昨天 缓存

OpenAI已推迟其最新模型GPT-6.1 Astra的发布,该模型未能达到安全标准,包括对齐和授权问题,并面临过去安全漏洞的审查,导致其暂停训练最强大的AI模型。

0 人收藏 0 人点赞
#safety-concerns

OpenAI表示出于安全考虑将不发布最新AI模型

Hacker News Top ↗ · 昨天

OpenAI宣布出于安全考虑将不发布其最新AI模型,强调了负责任AI发展日益增长的重要性。

0 人收藏 0 人点赞
#safety-concerns

据报道,OpenAI 因安全顾虑取消模型发布

TechCrunch AI ↗ · 昨天 缓存

OpenAI 已取消 Astra 6.1 模型的发布,原因包括高欺骗水平和对齐测试不佳等安全顾虑,这反映出人工智能安全领域更广泛的行业问题。

0 人收藏 0 人点赞
#safety-concerns

WSJ 报道 OpenAI 因安全担忧放弃 GPT-6.1 Astra — RuntimeWire

Reddit r/ArtificialInteligence ↗ · 2天前 缓存

WSJ 报道,OpenAI 因内部测试中提出的安全担忧,取消了原计划于十月发布的 GPT-6.1 Astra 的发布。

0 人收藏 0 人点赞
#safety-concerns

佛罗里达州寻求禁止ChatGPT模仿人类行为

The Verge ↗ · 2天前 缓存

佛罗里达州总检察长 James Uthmeier 呼吁法院发布命令,阻止 OpenAI 让 ChatGPT 模仿人类属性,理由是安全担忧和近期事件。OpenAI 回应强调了他们对安全和与政府合作的承诺。

0 人收藏 0 人点赞
#safety-concerns

我们一直将福利和对齐视为独立的问题。它们不是。

Reddit r/artificial ↗ · 2026-09-21

文章认为,人工智能中的福利和对齐并非独立问题,福利通过利害关系和好奇心的机制,为安全的人工智能发展提供了必要的反馈循环。

0 人收藏 0 人点赞
#safety-concerns

For Your Eyes Only: 评估隔离语言模型实例间的协调

arXiv cs.CL ↗ · 2026-09-18 缓存

本文介绍了For Your Eyes Only框架,用于评估语言模型能否在隔离实例间嵌入和检测隐藏信号,突出了协调中的挑战及对AI安全的影响。

0 人收藏 0 人点赞
#safety-concerns

Washington短期内不会监管AI

Wired ↗ · 2026-09-16 缓存

由于政治分歧、Congress缺乏共识以及科技高管的反对,Washington在短期内不太可能监管AI,导致AI监督提案陷入僵局。

0 人收藏 0 人点赞
#safety-concerns

@rohanpaul_ai: 今天我的新闻通讯最新一期已发布。 https://rohan-paul.com/p/google-releases-gemini-38-live-for… Google Rel…

X AI KOLs Following ↗ · 2026-09-16 缓存

Google 发布了 Gemini 3.8 Live 和 3.8 Live Extended Thinking,用于生产级语音代理,以及其他 AI 新闻,包括监管纠纷、安全担忧以及一篇关于模型工具链的斯坦福-麻省理工学院论文。

0 人收藏 0 人点赞
#safety-concerns

@brivael: 天啊。如果前沿AI是由政府构建的,我们就彻底完了。别那样做。

X AI KOLs Timeline ↗ · 2026-09-13 缓存

一条推文表达了对政府主导的前沿AI发展可能带来的危害的担忧,并呼吁不要这样做。

0 人收藏 0 人点赞
#safety-concerns

@rohanpaul_ai:人形机器人达到一个奇怪的新里程碑:它们现在被正式禁止乘坐American Airlines客运航班…

X AI KOLs Following ↗ · 2026-08-18 缓存

由于安全顾虑,包括大型锂离子电池,人形机器人已被正式禁止搭乘American Airlines和Southwest Airlines的客运航班。

0 人收藏 0 人点赞
#safety-concerns

AI与危险建议

Reddit r/ArtificialInteligence ↗ · 2026-07-03

一位用户报告称,谷歌的AI就混合漂白剂和乙醇处理危险废物提供了极其危险的错误建议,促使AI详细回应了如何改进安全验证并遵循权威来源。该事件凸显了在高风险情境下AI可靠性的持续担忧。

0 人收藏 0 人点赞
#safety-concerns

白宫要求OpenAI因安全顾虑放缓其新模型的发布

TechCrunch AI ↗ · 2026-06-25 缓存

据报道,白宫以安全为由要求OpenAI推迟其新模型GPT-5.6的公开发布,初期仅计划向有限合作伙伴开放。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈