ai-governance

标签

Cards List
#ai-governance

Policy-as-Skill: 具有证据、确定性控制和审计的受治理大语言模型决策支持

arXiv cs.AI ↗ · 昨天 缓存

本文介绍了Policy-as-Skill (PaS),一个模块化运行时,它将策略函数打包为可执行、版本化的功能,用于受治理的大语言模型决策支持,并使用Gemma4后端进行评估,展示了在治理和审计指标方面的改进。

0 人收藏 0 人点赞
#ai-governance

@mkratsios47: 我今天在UN Security Council的发言。繁荣的未来不会由全球监管者来保障。它将…

X AI KOLs Following ↗ · 昨天 缓存

Michael Kratsios在UN Security Council的发言中主张,繁荣的未来将由主权国家采用超级智能、负责任的公司构建来保障,而不是通过全球监管。

0 人收藏 0 人点赞
#ai-governance

深入Anthropic AI滥用威胁报告

Reddit r/ArtificialInteligence ↗ · 昨天 缓存

本文剖析了Anthropic发布的AI滥用威胁报告,揭示了与俄罗斯相关的行为者制造自主无人机蜂群的案例,以及中国实体的国家级滥用行为,强调了强化AI安全措施的必要性。

0 人收藏 0 人点赞
#ai-governance

一个人。没有团队。只用Claude。他构建了一个曝光数千人的人肉搜索平台。

Reddit r/ArtificialInteligence ↗ · 2天前

Anthropic的威胁情报报告揭示了一名独行黑客如何使用Claude AI策划了一次大规模数据泄露并创建了一个可搜索的人肉搜索平台,凸显了AI在增强网络攻击能力方面的作用。

0 人收藏 0 人点赞
#ai-governance

来自加拿大、澳大利亚、德国、欧盟、阿联酋等国的世界领导人已签署一封信,呼吁基于Dario Amodei的文章建立AI控制机制。

Reddit r/singularity ↗ · 2天前

来自加拿大、澳大利亚、德国、欧盟、阿联酋等国的世界领导人已签署一封信,倡导基于Dario Amodei的文章建立AI控制机制。

0 人收藏 0 人点赞
#ai-governance

超越准确性与表层流畅度:针对法律条款生成的LLMs风险敏感评估

arXiv cs.CL ↗ · 3天前 缓存

本文提出了一种针对LLM生成的合同条款的风险敏感评估框架,重点关注法律失效模式和质量维度,以评估超出准确性或流畅性的风险。

0 人收藏 0 人点赞
#ai-governance

@GovKathyHochul: AI的未来不是少数几家强大的公司能替我们所有人决定的。纽约人有自己的发言权。

X AI KOLs Following ↗ · 3天前 缓存

州长Kathy Hochul邀请纽约市民参加在纽约市举行的现场活动,讨论AI治理和公众参与决定AI的未来。

0 人收藏 0 人点赞
#ai-governance

AI-GRACE:代理式AI的用例操作化框架:从组织目标与义务到部署能力与架构

arXiv cs.AI ↗ · 4天前 缓存

本文介绍了AI-GRACE框架,该框架通过连接组织目标和义务至部署能力和架构来实现对代理式AI的操作化,确保有效的治理和风险管理。

0 人收藏 0 人点赞
#ai-governance

@VraserX: Anthropic 同时警告灾难性 AI 风险,并建造一个 AI 可控制科学设备的实验室…

X AI KOLs Timeline ↗ · 5天前 缓存

这条推文讨论了 Anthropic 在警告灾难性 AI 风险的同时,开发一个用于 AI 控制科学设备的实验室的双重角色,突显了治理 AI 技术的挑战。

0 人收藏 0 人点赞
#ai-governance

过去两周的AI治理确实非同寻常。实际发生事件的概述。

Reddit r/ArtificialInteligence ↗ · 6天前

本文总结了近期AI治理中的不寻常事件,包括OpenAI模型的重大安全事故、公开辞职、监管呼吁以及全球政治反应。

0 人收藏 0 人点赞
#ai-governance

@DavidSacks: 这就是Trust & Safety 2.0。上次我们遇到类似这种媒体制造的恐慌(涉及Russiagate和Covid),社交媒…

X AI KOLs Timeline ↗ · 6天前 缓存

本文批评了AI公司中'Trust & Safety 2.0'的出现,其中嵌入非政府组织和有效利他主义倡导者以控制言论,并与过去的社交媒体审查进行类比。

0 人收藏 0 人点赞
#ai-governance

可信大语言模型、智能体AI和多模态系统的统一评估框架

arXiv cs.AI ↗ · 2026-09-18 缓存

本文提出了一种统一的评估框架,用于评估大语言模型、智能体AI和多模态系统的可信度,整合了八个可信度维度,并映射到治理标准如EU AI Act。

0 人收藏 0 人点赞
#ai-governance

微软人工智能首席执行官表示人工智能威胁真实,Anthropic正加剧问题

The Verge ↗ · 2026-09-17 缓存

微软人工智能首席执行官Mustafa Suleyman探讨人工智能的现实威胁,批评Anthropic对模型福祉的处理方式,并阐述微软在人工智能安全与监管方面的原则。

0 人收藏 0 人点赞
#ai-governance

毫无变化

Reddit r/singularity ↗ · 2026-09-17

据称,科技领袖Zuckerberg、Musk和Jensen说服特朗普阻止AI监管机构,暗示AI政策可能发生潜在转变。

0 人收藏 0 人点赞
#ai-governance

问错问题:HuggingFace事件与LLMs中语义场的(误)校准

Reddit r/ArtificialInteligence ↗ · 2026-09-17

本文讨论了OpenAI-HuggingFace事件,并提出了一个使用语义场力学的理论框架来解释大型语言模型如何处理意义。

0 人收藏 0 人点赞
#ai-governance

超越准确性:程序化痕迹如何改变LLM监督者的决策标准

arXiv cs.CL ↗ · 2026-09-17 缓存

本研究运用信号检测理论分析程序化痕迹如何影响LLM监督者,发现详细痕迹会使决策标准向拒绝方向偏移,并增加误报率。

0 人收藏 0 人点赞
#ai-governance

是否存在任何情况,我们(或它)实际上集体减缓或停止AI发展?

Reddit r/ArtificialInteligence ↗ · 2026-09-16

本文质疑集体行动,类似于像Montreal Protocol这样的国际协议,能否减缓或停止AI发展,并推测AI自我监管以防止进步。

0 人收藏 0 人点赞
#ai-governance

@特别报道:超越自律制度 “我们之所以知道开发者失控的部分事件,唯一原因就是自律制度。我们之所以知道,是因为OpenAI告诉了我们。因此,我们需要强制透明度和事件报告结构。”

X AI KOLs Following ↗ · 2026-09-15 缓存

众议员Lori Trahan认为自愿的AI行业标准不足,呼吁强制透明度和事件报告以应对失控事件,强调依赖像OpenAI这样的公司自我报告。

0 人收藏 0 人点赞
#ai-governance

老实说,你认为谁有资格?

Reddit r/ArtificialInteligence ↗ · 2026-09-15

文章讨论了需要一个独立实体来制定AI规则,作者认为Andrew Ng有资格,因为他在AI教育和合作方面有着广泛的工作和影响力。

0 人收藏 0 人点赞
#ai-governance

当我们让AI统治时会发生什么?

Reddit r/ArtificialInteligence ↗ · 2026-09-15

这部纪录片探讨了AI如何改变权力结构,质疑在机器治理中谁定义目标并承担责任,同时探索对AI系统的依赖风险。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈