赞
踩
TurboTransformers是腾讯最近开源的BERT推理模型,它的特点就是一个字,快。本人用BERT(huggingface/transformers)在V100上做了测试,测试结果和官宣的基本一致:TurboTransformers的推理速度要比Pytorch快上1~4倍。
它之所以快,是因为它是专用于BERT的轻量级推理模型。
不管是计算机的硬件、软件,还是现在的深度学习,它们都遵循着一个很重要的设计思想–分层:
Copyright © 2003-2013 www.wpsshop.cn 版权所有,并保留所有权利。