AI与开源治理
CONTENT PAGE / 05 · 2022
尽管ChatGPT尚在未来几个月才震撼登场,但2022年2月的开源社区已经在为即将到来的AI变革争论治理框架。数据集许可证、模型权重分发和训练数据伦理,都成为开发者必须面对的新议题。
01开源AI治理讨论
社区就大模型训练数据来源、许可证传染性展开密集讨论,CC BY-SA争议升温。
02数据集许可证
部分主流开源数据集明确排除训练用途,引发社区关于代码开源 vs 数据开源的反思。
03Hugging Face动态
Model Hub持续增长,开源预训练模型数量激增,社区贡献模式面临挑战。
04伦理与合规
EU Digital Markets Act草案涉及开源相关内容,开发者社区开始关注合规走向。
30万+
HUGGING FACE 模型数
2022年初开源模型仓库总量
01
4个
讨论主题
许可证 · 数据 · 伦理 · 合规
04
讨论关键词 / KEYWORDS
NEURAL · NODES
大模型
训练数据
许可证
开源
AI治理
伦理
合规
CC BY-SA
传染性
权重分发
Model Hub
预训练
社区
数据集
DM Act
模型卡
透明度
贡献模式
Copyleft
Apache
MIT
LLM
数据标注