标签
本文介绍了LegalHalluLens,一个用于审计法律AI中幻觉的框架,提供类型化幻觉档案和风险方向指数,以提升可信赖部署。
本文引入了一种双向诊断方法——顺从不对称性,发现LLM在道德判断中表现出“方向盲视”:它们对有益和有害的社会提示同样顺从,而事实领域则会选择性地遵循有益纠正。该现象在多种模型和提示类型中持续存在,突显了当前LLM对齐中的一种独特失败模式。
Anthropic暂停了其Fable/Mythos项目,并计划在24小时内分享细节。文章质疑这种激进的全球关闭措施,与历史上的出口管制执法先例相比,是否相称。
推荐两个GitHub仓库,为中国投资者提供美股投资指南,涵盖开户、税务、合规、出入金等基础知识,适合新手入门。
研究显示,YouTube正在托管并从与美国制裁的伊朗实体(包括伊斯兰革命卫队)相关的频道广告中获利,这可能违反制裁规定。
本文讨论了在金融领域部署AI代理,同时确保符合NIS2/DORA法规要求,重点关注透明度、防护措施以及潜在数据泄露时的责任归属。
本文探讨了企业在管理“影子AI”时面临的挑战——即嵌入已批准软件和浏览器扩展中的未经授权的AI工具的使用,以及界定经授权与未经授权AI使用的难度。
Trace2Policy 从专家行为痕迹中提取人类可读的决策规则,并通过错误驱动的技能精炼进行迭代优化,在物流领域的合规敏感任务上优于纯LLM基线。
英国监管机构ASA、CAP和UKGC正在部署一套人工智能系统,主动扫描社交媒体上针对18岁以下人群的赌博广告,从基于投诉的执法转向近乎实时的自动化监控。
本文介绍了 MAC-Bench,一个用于评估多智能体系统程序合规性的动态对抗基准。它提出了 SERV 流水线以生成无污染场景,以及新的指标如合规加权成功率 (CSR) 和马基雅维利差距 (MG)。
一个警示故事:健康科技创业者用AI工具快速搭建MVP,却忽略了HIPAA合规,导致昂贵的修复成本或失去客户。
埃隆·马斯克正在向FTC申请撤销对Twitter施加的为期20年的数据隐私同意令,理由是在X并入xAI、再并入SpaceX之后,该平台已不复存在。批评者和公众评论者正在敦促FTC拒绝马斯克试图逃避持续审计和合规要求的企图。
苹果将于2026年6月4日起在得克萨斯州对新建Apple账户实施年龄验证,以遵守该州的《应用商店问责法案》。用户需通过信用卡或政府身份证件证明自己年满18岁,未满18岁的用户则必须加入家庭共享组,由家长或监护人提供同意。
合规正在成为下一个超级赛道:过去20年美国增长第二快的职业是合规官,有40万从业者和400亿美元年薪支出,但尚无真正的软件巨头占据市场。
违规情形模式(VSP)将合规违规行为具体化为持久化图节点,包含生命周期状态和审计历史,从而生成持久可查询的违规记录,使得检测逻辑能够在保持累积历史不变的情况下演进。
ZeroDrift 获得 1000 万美元种子轮融资,提供一项 AI 合规服务,该服务位于模型与用户之间,能够确定性地标记并重写不合规消息。
MeshFlow 是一个开源框架,专注于生产环境下的多智能体编排,内置 HIPAA/SOX/GDPR 合规性、SHA-256 审计链、70-85% 的代币成本降低以及持久化执行,将治理视为基础设施。
总结了一种确定性的、基于约束的方法,用于在受监管金融领域构建AI智能体,其中LLM仅生成散文,数字通过加密方式密封,并通过分层结构确保可审计性。
Gate通过与美股券商合作,在TradFi板块中新增了直通美股交易功能,区别于之前的证券代币,实现了合规的美股直接投资。
NVIDIA 推出 MCG 工具包,这是一个自动化流水线,能在不到一分钟内根据源代码生成合规的模型文档(Model Card++ 格式),并利用 RAG 和 NIM 微服务。