GPT‑NL:荷兰的主权语言模型
摘要
TNO正在开发GPT‑NL,这是一个针对荷兰语及荷兰语境的主权语言模型,注重透明度、可信度和互惠性。该模型由公共资金支持,旨在让欧洲在AI技术方面拥有控制权。
暂无内容
查看缓存全文
缓存时间: 2026/06/16 20:35
# GPT‐NL:面向荷兰的主权语言模型
来源:https://www.tno.nl/en/digital/artificial-intelligence/gpt-nl
## GPT‐NL 的价值观
我们正在为荷兰语言和背景构建一个负责任的语言模型(https://www.tno.nl/en/digital/artificial-intelligence/tno-vision-responsible-ai-works/):可信、透明、互惠和主权。
### 主权:掌控关键技术
GPT‐NL 在荷兰和欧洲境内开发,让我们能够完全掌控模型、数据以及我们做出的选择。我们避免依赖非欧洲的供应商,并投资于符合我们法律、价值观和社会目标的可持续 AI 生态系统。
### 开放透明:从源头到模型的洞察
GPT‐NL 建立在透明基础之上。我们清晰记录数据收集和训练过程中所做的选择,以及如何应对偏见和伦理问题等风险。我们将源代码以开源形式发布,并分享数据集的详细见解。模型权重在受控许可下提供使用。这样,我们可以知道谁在使用模型,并告知用户更新或变更(例如在数据选择退出后)。通过这种方式,我们在不损害安全性或法规合规性的前提下实现透明运作。
### 可信:保护用户和公民
我们从头开始训练 GPT‐NL。这可以避免从现有模型中继承不清晰的数据来源、版权风险或潜在的个人数据。
为了确保可靠的基础,我们的数据收集符合严格标准:
- 保护知识产权
- 在模型训练前移除并匿名化个人数据
- 排除机密信息
- 排除有害内容
- 避免数据集内的重复
### 互惠:数据与价值的公平协议
GPT‐NL 刻意采用清洁且合法的数据供应链。我们与数据提供者密切合作,并积极让他们参与模型开发。
通过内容委员会(Content Board),这些数据提供者和权利人可以在 GPT‐NL 的未来中拥有发言权。部分收入回馈给创作者。这创造了一个更公平的创新模式,价值得以共享而非被榨取。
## 高效利用资源
AI 开发需要大量计算能力和能源。因此,我们积极关注能源效率和资源的负责任使用。基于科学研究,我们优化模型规模和训练过程,并明确关注能源和水资源消耗。
## 公共资助,公开问责
GPT‐NL 由荷兰企业局(RVO)代表经济事务与气候政策部资助。项目已拨款 1350 万欧元。这笔公共投资凸显了独立、可信且面向未来的荷兰语言模型的重要性。
GPT‐NL 表明,强大的 AI 与公共价值可以并行不悖。我们共同构建让荷兰更强大、更自主、更公平的技术。
## 获取灵感
48 条结果,显示第 1 到 5 条
### 影响加速挑战:未来证明的 AI – 路演与生态系统建设日
请于 6 月 18 日星期四参加未来证明 AI 挑战的闭幕活动,团队将展示面向可持续和主权 AI 的想法与解决方案。
开始日期:6 月 18 日
地点:Amsterdam World Trade Centre, Strawinskylaan 1, 1077 XW Amsterdam
### 如何衡量不断变化的事物?评估生成式 AI 的挑战
### 在怀疑与盲目信任之间平衡:批判性思维是负责任且有效使用 GenAI 的关键
### 从被动到主动:组织如何掌控 GenAI 治理
### TNO 如何引领迈向主权、负责任的荷兰 AI
相似文章
更好的语言模型及其影响
OpenAI 推出 GPT-2,这是一个拥有 15 亿参数的基于 Transformer 的语言模型,在 40GB 的互联网文本上进行训练,在语言建模基准上达到了最先进的性能,并在阅读理解、翻译、问答和摘要生成等任务上展示了零样本学习能力。出于安全考虑,仅公开发布了较小的模型和技术论文,而非完整的训练模型。
h2oGPT:让大语言模型民主化
本文介绍了 h2oGPT,这是一套开源的微调大语言模型,参数规模从 70 亿到 400 亿不等,旨在成为闭源 GPT 的真正开放替代方案,并提供 100% 私密的文档搜索功能。
@KarelDoostrlnck:您是否使用英语以外的语言使用 ChatGPT?新更新在您的语言中感觉如何?我们非常希望听到您的……
OpenAI 发布了新版 GPT-5.5 Instant,在讨好性、事实准确性和多语言性能方面有所改进,并正在寻求用户反馈。
GPTs are GPTs: 大语言模型对劳动力市场影响的早期观察
OpenAI的研究评估了GPT模型对劳动力市场的潜在影响,发现美国约80%的劳动者至少有10%的工作任务可能受到影响,其中高收入工作面临更大的风险。该研究将GPT定位为具有重大经济和社会意义的通用技术。
语言模型是小样本学习器
OpenAI 推出了 GPT-3,一个拥有 1750 亿参数的自回归语言模型,它在无需梯度更新或微调的情况下,在多种 NLP 任务上展现出强大的小样本学习能力,代表了语言模型应用范式的转变——仅通过文本交互就能适应新任务。