data-quality

标签

Cards List
#data-quality

AI垃圾内容正在成为一场溯源危机,而不仅仅是内容质量的问题

Reddit r/artificial · 2026-05-13 缓存

本文认为,AI生成内容(垃圾内容)的大量涌现正引发一场溯源危机,信息的来源和可靠性受到破坏,文中以自动外联误导向和虚假互动等例子加以说明。

0 人收藏 0 人点赞
#data-quality

强化学习数据的良好质量控制(18分钟阅读)

TLDR AI · 2026-05-08 缓存

本文讨论了强化学习数据质量控制的重要性,概述了当前数据供应商的不足之处以及前沿AI实验室用于评估RL数据的标准。

0 人收藏 0 人点赞
#data-quality

@thaiscbranco_:招聘 AI 工程师——不是随便那种,而是能把模型输出从“垃圾”变成“大厨之吻”、对评估与数据质量走火入魔、痛恨紫色渐变、热爱创意、为测试脚手架狂喜、坚信“记忆”才是 AI 最大瓶颈的顶尖高手

X AI KOLs Timeline · 2026-04-22 缓存

招聘方寻找精英 AI 工程师:专注打磨模型输出、死磕评估与数据质量,热衷底层工具而非花哨界面。

0 人收藏 0 人点赞
#data-quality

Wayfair 借助 OpenAI 提升目录准确性与支持速度

OpenAI Blog · 2026-03-11 缓存

Wayfair 已将 OpenAI 模型整合到核心运营系统中,以提升其 3000 万件商品目录的产品准确性和供应商支持工作流程,用可扩展、不依赖标签的系统取代了高昂的定制机器学习模型,使属性覆盖范围以之前 70 倍的速度扩展。

0 人收藏 0 人点赞
#data-quality

应对现实世界中不良内容检测的整体方法

OpenAI Blog · 2024-06-20 缓存

OpenAI 展示了一套全面的框架,通过精心设计分类体系、控制数据质量、构建主动学习流程以及采用防止过拟合的技术来构建鲁棒的内容审核系统。该方法能够检测包括性内容、仇恨言论、暴力和自伤在内的多个类别的不良内容,性能超越现有的现成模型。

0 人收藏 0 人点赞
#data-quality

open-metadata/OpenMetadata

GitHub Trending (daily) · 2026-04-22 缓存

OpenMetadata 是一个快速增长的统一开源元数据平台,提供数据发现、可观测性和治理功能,支持 84+ 连接器及零代码数据质量工具。

0 人收藏 0 人点赞
← Previous
← 返回首页

提交意见反馈