尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

如何向 awesome-public-datasets 贡献新数据集?5 步走通的避坑清单

如何向 awesome-public-datasets 贡献新数据集?5 步走通的避坑清单 如何向 awesome-public-datasets 贡献新数据集5 步走通的避坑清单【免费下载链接】awesome-public-datasetsA topic-centric list of HQ open datasets.项目地址: https://gitcode.com/GitHub_Trending/aw/awesome-public-datasets想收数据集进库却不知从哪下手你想把自己整理的一份公开数据集贡献到 awesome-public-datasets——一个按主题分类、收录数千个高质量公开数据集的开源精选库。可 clone 下来翻了一圈只看到一个两千多行的 README.rst、一份 LICENSE 和 Datasets 目录里一个示例数据包不知该从哪行改起。这篇文章就讲这一件事从查重、写条目到 PR 合并把你的数据集送进库。先建立全局认知从想法到合并的 5 个环节环节你要做什么产出查重在 README.rst 里全文检索数据集名与官网域名确认未被收录定章节在 Agriculture、Biology、Economics 等主题章节里选归属目标章节写条目按模板写一行条目并补上对应的 Meta yml 元数据文件条目行 元数据自检本地渲染 rst核对格式、截断与状态图标渲染正常的页面提 PRPR 描述里写明改动的主题章节与数据集名一个可审查的 PR动手前的 3 个前置动作1. 克隆仓库git clone https://gitcode.com/GitHub_Trending/aw/awesome-public-datasets2. 读贡献说明仓库首页 README.rst 开头写明本库由 apd-core 自动生成、不要直接改 README正式入口是提交 Meta yml 元数据文件再扫一遍顶部的目录结构心里先有章节全貌。3. 查重在 README.rst 全文搜索你的数据集名称、官网域名确认没有被收过。 每个数据集条目后面都挂着一个 Meta 文件链接那份 yml 才是条目的源文件——你的改动最终要落在它上面。逐字段拆解条目模板可复制的条目行rst 列表项格式* |OK_ICON| 数据集名称 - 一两句描述数据内容、规模、格式、获取方式 数据地址_ [Meta 主题/文件名.yml_]字段该写什么状态图标OK_ICON 表示链接可用FIXME_ICON 表示待修复新增条目用 OK_ICON数据集名称官方名称同章节内按字母序排列据此定位插入点功能描述单行摘要数据内容、规模、格式、获取方式别写成多行长文数据地址数据集官网、下载页或 DOI 链接Meta yml元数据源文件完整出处、许可协议、更新方式都写在这里 长引用怎么收纳这个库的做法是主列表只留单行摘要出处、DOI、许可这类长信息全部收进 Meta yml过长的描述在渲染时会被自动截断页面因此保持整洁。对照排查提交前的 6 个坑容易踩的坑正确做法直接改 README.rst 后提交README 由 apd-core 自动生成改 Meta yml重新生成后再核对数据集其实已被收录提交前全文检索数据集名与官网域名放错主题章节对照 Agriculture、Biology、Economics 等章节名判断归属拿不准先开 Issue 问描述写成多行长文保持单行细节与长引用写进 Meta yml条目插错位置同章节内按数据集名称字母序插入提交前不预览本地渲染 rst逐字段对照现有条目核对格式现在就动手把仓库 clone 下来照着模板写一条提交你的第一个数据集 PR ✨【免费下载链接】awesome-public-datasetsA topic-centric list of HQ open datasets.项目地址: https://gitcode.com/GitHub_Trending/aw/awesome-public-datasets创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表