社区所有版块导航
Python
python开源   Django   Python   DjangoApp   pycharm  
DATA
docker   Elasticsearch  
aigc
aigc   chatgpt  
WEB开发
linux   MongoDB   Redis   DATABASE   NGINX   其他Web框架   web工具   zookeeper   tornado   NoSql   Bootstrap   js   peewee   Git   bottle   IE   MQ   Jquery  
机器学习
机器学习算法  
Python88.com
反馈   公告   社区推广  
产品
短视频  
印度
印度  
Py学习  »  机器学习算法

【CVPR2023】全栈式,基于 GPU 的深度学习加速, 170页ppt

专知 • 3 年前 • 351 次点击  



这个教程主要介绍一些技术,以帮助深度学习从业者加速大型深度网络的训练和推理,同时在一系列现成硬件上减少内存需求,这对于自动驾驶和大型语言模型等重要应用是非常有用的。主题包括但不限于:
  1. 深度学习专用硬件概述。我们回顾最常用的深度学习加速硬件的架构,包括主要的计算处理器和内存模块。
  2. 如何在这些硬件上执行深度学习。我们涵盖算法强度的方面和计算的理论概述。与会者将学会如何仅通过查看硬件规格和网络架构来估算处理时间和延迟。
  3. 加速的最佳实践。我们提供了设计高效神经网络的最佳实践概述,包括选择通道数量、计算密集型操作或减少操作等。
  4. 模型加速的现有工具。在这部分,我们将重点介绍用于加速GPU设备上训练过的神经网络的现有工具。我们将特别讨论操作折叠、TensorRT、ONNX图优化、稀疏性等。
  5. 近期技术的研究概述。在最后一部分,我们将关注用于后训练模型优化的最新高级技术,包括剪枝、量化、模型蒸馏或神经结构搜索等。


专知便捷查看

便捷下载,请关注专知公众号(点击上方蓝色专知关注)

  • 后台回复或发消息“G170” 就可以获取《【CVPR2023】全栈式,基于 GPU 的深度学习加速, 170页ppt》专知下载链接

                       
专知,专业可信的人工智能知识分发,让认知协作更快更好!欢迎注册登录专知www.zhuanzhi.ai,获取100000+AI(AI与军事、医药、公安等)主题干货知识资料!
欢迎微信扫一扫加入专知人工智能知识星球群,获取最新AI专业干货知识教程资料和与专家交流咨询
点击“阅读原文”,了解使用专知,查看获取100000+AI主题知识资料

Python社区是高质量的Python/Django开发社区
本文地址:http://www.python88.com/topic/156955