Py学习  »  机器学习算法

全栈深度学习第3期: 怎样科学管理实验数据?

夕小瑶的卖萌屋 • 5 年前 • 405 次点击  

一起追剧鸭

简介

Berkeley全栈深度学习追剧计划是由夕小瑶的卖萌屋发起的优质公开课打卡项目,通过微信群为同期追剧的小伙伴提供交流平台。关于该计划的详请见这里

1. Berkeley深度学习追剧群

目前已有1000+小伙伴加入,公众号后台回复口令 深度学习追剧 入群。

2. 课程主页

https://course.fullstackdeeplearning.com

第3期内容

本期是FSDL课程的第三期:Data Management,主要介绍了数据管理的5个阶段。内容包括:

  1. 如何寻找训练数据源?

  2. 如何大规模标注数据?

  3. 怎样存储不同类型的数据?

  4. 数据的版控(推荐)?

  5. 怎样预处理生数据?

推荐课程中提到的好工具:DVC-面向机器学习项目的开源版本控制系统。DVC可以统一对代码、数据、配置文件做版本控制,可以帮助我们实现科学版控,快速复现历史实验。

DVC官网 https://dvc.org/doc/user-guide/what-is-dvc

追剧链接:

注:【夕小瑶的卖萌屋】后台回复  DL3获取本期PPT

往期内容回顾

全栈深度学习第1期:如何启动一个机器学习项目?
全栈深度学习第2期: 开发套件与工具篇

后台回复关键词【入群

加入卖萌屋NLP/IR/Rec与求职讨论群

后台回复关键词【顶会

获取ACL、CIKM等各大顶会论文集!

Python社区是高质量的Python/Django开发社区
本文地址:http://www.python88.com/topic/107934