GLaM以低成本冲上1.2万亿
谷歌的GLaM塞进了1.2万亿参数,训练耗能却只有GPT-3的三分之一。
来源
arXiv — GLaM paper
Google Research — GLaM
打开完整版