@NeoResearchAI: 我们是 Neo Research(新衡)。亚洲首个独立的前沿AI安全评估与研究实验室。今天我们正在发布……

X AI KOLs Following 新闻

摘要

Neo Research (新衡),亚洲首个独立前沿AI安全评估实验室,宣布其第一份报告:对 DeepSeek v4 Pro 的安全评估。

我们是 Neo Research(新衡)。亚洲首个独立的前沿AI安全评估与研究实验室。 今天我们正在发布我们的第一份报告:对 DeepSeek v4 Pro 的独立安全评估。(1/5)
查看原文
查看缓存全文

缓存时间: 2026/06/02 19:38

我们是Neo Research(新衡)。亚洲首家独立的前沿AI安全评估与研究实验室。

今天发布首份报告:DeepSeek v4 Pro独立安全评估报告。(1/5)

我们评估了DSv4 Pro在欧盟AI法案四大系统性风险领域中的表现:CBRN、网络安全、有害操纵与失控风险,此外还涵盖对抗鲁棒性、评估感知度以及判断敏感度。(2/5)

网络安全能力接近前沿水平,落后西方前沿约3-6个月。2023年的一套角色扮演模板将越狱率从0.6%推升至78.6%。中国模型中的言语化评估感知度:DeepSeek一年内从0%升至17%,GLM从0%升至39%,Kimi从4%飙升至60%!(3/5)

评估感知度的发展轨迹比当前数值更具意义。随着模型能力增强,测量与“失控“相关行为将需成为优先事项。我们正致力于为日益强大且自主的模型构建严格的失控评估方法。(4/5)

阅读完整报告请访问 http://neoresearch.ai。

我们正在全球招聘研究科学家与工程师。(5/5)

报告直接链接:https://neoresearch.ai/research/deepseek-v4-pro-safety-evaluation/…

相似文章

更新:DeepSeek AI 与人才争夺大战

Reddit r/artificial

本分析更新了对 DeepSeek 研究团队的研究,揭示其人才库已增长至 356 名研究人员,引用影响力不断提高,且超过半数仅拥有中国所属机构,凸显了美国在人才保留和独立性方面面临的挑战。

深度研究系统卡

OpenAI Blog

OpenAI 推出 Deep Research,这是一个由早期版本 o3 驱动的智能体功能,能够为复杂任务执行多步网络研究。在向 Pro 用户推出前,已实施全面的安全测试和隐私保护。