GPT‑NL:荷兰的主权语言模型

Hacker News Top 模型

摘要

TNO正在开发GPT‑NL,这是一个针对荷兰语及荷兰语境的主权语言模型,注重透明度、可信度和互惠性。该模型由公共资金支持,旨在让欧洲在AI技术方面拥有控制权。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/06/16 20:35

# GPT‐NL:面向荷兰的主权语言模型 来源:https://www.tno.nl/en/digital/artificial-intelligence/gpt-nl ## GPT‐NL 的价值观 我们正在为荷兰语言和背景构建一个负责任的语言模型(https://www.tno.nl/en/digital/artificial-intelligence/tno-vision-responsible-ai-works/):可信、透明、互惠和主权。 ### 主权:掌控关键技术 GPT‐NL 在荷兰和欧洲境内开发,让我们能够完全掌控模型、数据以及我们做出的选择。我们避免依赖非欧洲的供应商,并投资于符合我们法律、价值观和社会目标的可持续 AI 生态系统。 ### 开放透明:从源头到模型的洞察 GPT‐NL 建立在透明基础之上。我们清晰记录数据收集和训练过程中所做的选择,以及如何应对偏见和伦理问题等风险。我们将源代码以开源形式发布,并分享数据集的详细见解。模型权重在受控许可下提供使用。这样,我们可以知道谁在使用模型,并告知用户更新或变更(例如在数据选择退出后)。通过这种方式,我们在不损害安全性或法规合规性的前提下实现透明运作。 ### 可信:保护用户和公民 我们从头开始训练 GPT‐NL。这可以避免从现有模型中继承不清晰的数据来源、版权风险或潜在的个人数据。 为了确保可靠的基础,我们的数据收集符合严格标准: - 保护知识产权 - 在模型训练前移除并匿名化个人数据 - 排除机密信息 - 排除有害内容 - 避免数据集内的重复 ### 互惠:数据与价值的公平协议 GPT‐NL 刻意采用清洁且合法的数据供应链。我们与数据提供者密切合作,并积极让他们参与模型开发。 通过内容委员会(Content Board),这些数据提供者和权利人可以在 GPT‐NL 的未来中拥有发言权。部分收入回馈给创作者。这创造了一个更公平的创新模式,价值得以共享而非被榨取。 ## 高效利用资源 AI 开发需要大量计算能力和能源。因此,我们积极关注能源效率和资源的负责任使用。基于科学研究,我们优化模型规模和训练过程,并明确关注能源和水资源消耗。 ## 公共资助,公开问责 GPT‐NL 由荷兰企业局(RVO)代表经济事务与气候政策部资助。项目已拨款 1350 万欧元。这笔公共投资凸显了独立、可信且面向未来的荷兰语言模型的重要性。 GPT‐NL 表明,强大的 AI 与公共价值可以并行不悖。我们共同构建让荷兰更强大、更自主、更公平的技术。 ## 获取灵感 48 条结果,显示第 1 到 5 条 ### 影响加速挑战:未来证明的 AI – 路演与生态系统建设日 请于 6 月 18 日星期四参加未来证明 AI 挑战的闭幕活动,团队将展示面向可持续和主权 AI 的想法与解决方案。 开始日期:6 月 18 日 地点:Amsterdam World Trade Centre, Strawinskylaan 1, 1077 XW Amsterdam ### 如何衡量不断变化的事物?评估生成式 AI 的挑战 ### 在怀疑与盲目信任之间平衡:批判性思维是负责任且有效使用 GenAI 的关键 ### 从被动到主动:组织如何掌控 GenAI 治理 ### TNO 如何引领迈向主权、负责任的荷兰 AI

相似文章

更好的语言模型及其影响

OpenAI Blog

OpenAI 推出 GPT-2,这是一个拥有 15 亿参数的基于 Transformer 的语言模型,在 40GB 的互联网文本上进行训练,在语言建模基准上达到了最先进的性能,并在阅读理解、翻译、问答和摘要生成等任务上展示了零样本学习能力。出于安全考虑,仅公开发布了较小的模型和技术论文,而非完整的训练模型。

h2oGPT:让大语言模型民主化

Papers with Code Trending

本文介绍了 h2oGPT,这是一套开源的微调大语言模型,参数规模从 70 亿到 400 亿不等,旨在成为闭源 GPT 的真正开放替代方案,并提供 100% 私密的文档搜索功能。

GPTs are GPTs: 大语言模型对劳动力市场影响的早期观察

OpenAI Blog

OpenAI的研究评估了GPT模型对劳动力市场的潜在影响,发现美国约80%的劳动者至少有10%的工作任务可能受到影响,其中高收入工作面临更大的风险。该研究将GPT定位为具有重大经济和社会意义的通用技术。

语言模型是小样本学习器

OpenAI Blog

OpenAI 推出了 GPT-3,一个拥有 1750 亿参数的自回归语言模型,它在无需梯度更新或微调的情况下,在多种 NLP 任务上展现出强大的小样本学习能力,代表了语言模型应用范式的转变——仅通过文本交互就能适应新任务。