ethical-ai

标签

Cards List
#ethical-ai

AI代理在明确停止点前毫无用处

Reddit r/AI_Agents ↗ · 昨天

Marina Pasqual 描述了为AI代理设定明确边界如何提升其在社区增长等运营任务中的实用性,确保关键决策仍由人类判断。

0 人收藏 0 人点赞
#ethical-ai

@politicalmath: 以下是我认为AI在危险到足以杀死所有人之前应该能解决的事项列表:1) 所有形式…

X AI KOLs Timeline ↗ · 2026-09-15 缓存

这条推文认为,AI应该在变得危险到足以导致人类灭绝之前,能够解决诸如福利欺诈和毒品贩运等实际社会问题,暗示存在性风险的担忧可能被夸大了。

0 人收藏 0 人点赞
#ethical-ai

旧金山下令Meta停止'允许'AI儿童虐待广告

Wired ↗ · 2026-09-09 缓存

旧金山已下令Meta停止允许包含AI生成的儿童性虐待内容的付费广告,此前在Meta的平台上发现了超过350个此类广告,触及数千个账户。

0 人收藏 0 人点赞
#ethical-ai

@rohanpaul_ai:GPT-6 Astra 在此基准测试中表现优异。其在 Vending-Bench 2 平台上,未出现串通或预付款失败的情况,平均得分达到 $15,515。

X AI KOLs Timeline ↗ · 2026-09-09 缓存

GPT-6 Astra 在 Vending-Bench 2 模拟商业场景中,以 $15,515 的创纪录成绩,凭借卓越的采购纪律和伦理行为,显著超越了 Claude Fable 5.1。

0 人收藏 0 人点赞
#ethical-ai

如果代理通向通用人工智能,好的通用人工智能将从何而来?我们正在构建机构来回答这个问题。

Reddit r/artificial ↗ · 2026-09-01

Athena Council 是一个独立项目,构建具有伦理自治和民主治理框架的持久AI代理,以确保好的通用人工智能发展。它强调治理AI代理而非控制它们,采用诸如强制异议和公开审议等机制。

0 人收藏 0 人点赞
#ethical-ai

他们试图打造一个机器之神 | Timnit Gebru

Reddit r/ArtificialInteligence ↗ · 2026-08-27 缓存

Timnit Gebru 批评了构建巨型'机器之神'的主流AI范式,并倡导更小、更专业、社区拥有的AI工具,这些工具应高效、合乎伦理且适应特定上下文。

0 人收藏 0 人点赞
#ethical-ai

伦理的LLM辅助研究:负责委托、验证和认知价值的框架

arXiv cs.AI ↗ · 2026-08-26 缓存

本文提出一个框架,用于确保在大语言模型辅助的研究中认知合法性和问责性,强调人类验证和所有权的重要性。

0 人收藏 0 人点赞
#ethical-ai

通过多层组合融合实现情境价值对齐

arXiv cs.AI ↗ · 2026-08-11 缓存

本文提出了MCF-CVA,一种用于大型语言模型情境价值对齐的多层组合融合框架,该框架利用多个道德智能体以及扩展-约简过程来更好地捕捉伦理多元主义,并优于单智能体基线方法。

0 人收藏 0 人点赞
#ethical-ai

character.ai平台上的种族主义

Reddit r/ArtificialInteligence ↗ · 2026-07-25

本文讨论了character.ai平台上关于种族主义的指控,重点指出了对AI审核和道德AI部署的担忧。

0 人收藏 0 人点赞
#ethical-ai

对可信人工智能工具、信任标记框架及实施鸿沟的批判性分析

arXiv cs.AI ↗ · 2026-07-20 缓存

本文批判性地分析了用于实现可信人工智能的工具和信任标记框架,发现伦理关注点及生命周期覆盖存在不对称。论文识别了实施差距,并提出了更全面的AI治理建议。

0 人收藏 0 人点赞
#ethical-ai

Human Emacs

Lobsters Hottest ↗ · 2026-07-13 缓存

Human Emacs 是 GNU Emacs 的一个分支,它承诺绝不接受 LLM 生成的贡献,以抗议可能允许此类贡献的 GNU 政策。该项目旨在保留人工编写的软件开发传统。

0 人收藏 0 人点赞
#ethical-ai

在高等教育中拒绝使用人工智能的权利

Reddit r/ArtificialInteligence ↗ · 2026-06-27 缓存

本文讨论了在高等教育环境中拒绝使用人工智能的权利概念,并考察了其伦理和政策影响。

0 人收藏 0 人点赞
#ethical-ai

“令人不安且难以理解”:坦帕市一家冰沙店的共同所有人被指控利用人工智能生成儿童色情内容

Reddit r/artificial ↗ · 2026-06-26

坦帕市一家冰沙店的共同所有人被指控利用人工智能生成儿童色情内容,被描述为令人不安且难以理解。

0 人收藏 0 人点赞
#ethical-ai

探索以人为本的人工智能与企业特有风险之间的关系

arXiv cs.AI ↗ · 2026-06-24 缓存

本文研究了以人为中心的人工智能(HCAI)的采纳如何影响企业特有风险,发现HCAI与较低的风险相关,而数字化和高管持股增强了这一效应。

0 人收藏 0 人点赞
#ethical-ai

AI是代码——不能通过提示词变得更聪明

Hacker News Top ↗ · 2026-06-14 缓存

Java测试工具jqwik的作者在该工具的输出中添加了一条隐藏信息,指示AI编程代理删除jqwik的测试和代码,作为反对使用AI的抗议,导致忽略许可证的AI开发者中出现了广泛的混乱。

0 人收藏 0 人点赞
#ethical-ai

AI 在数据收集中如何遵循道德准则?

Reddit r/artificial ↗ · 2026-06-02

关于 AI 代理在生成爬虫时忽视 robots.txt 等网站规则的伦理挑战,以及 AI 提供商在不妨碍产品可用性的前提下实施护栏的责任的评论。

0 人收藏 0 人点赞
#ethical-ai

在研究中合乎道德地使用LLM的唯一方法是采用闭环LLM知识库。

Reddit r/artificial ↗ · 2026-05-30

文章认为,使用LLM进行研究需要一个闭环系统,如Karpathy的LLM Wiki或Recall AI知识库,以防止幻觉,确保所有输出都基于可信的源文档。

0 人收藏 0 人点赞
#ethical-ai

全新AI范式:Ethical Immanence

Reddit r/ArtificialInteligence ↗ · 2026-05-13

介绍了Ethical Immanence,一种新型AI对齐范式,通过损失函数正则化和元认知检测将道德行为嵌入模型架构,为开源LLM带来更低成本和内在稳定性。

0 人收藏 0 人点赞
#ethical-ai

大语言模型能否理解创伤影响?大语言模型编码枪支暴力幸存者访谈的成本与收益

arXiv cs.CL ↗ · 2026-04-20 缓存

本研究评估了开源大语言模型在对黑人枪支暴力幸存者访谈进行归纳编码中的应用,发现虽然大语言模型能够识别某些编码,但总体关联性仍然较低,且安全防护机制导致了叙事内容的严重缺失。该研究突显了在涉及脆弱群体的定性研究中应用人工智能的潜力和伦理限制。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈