您现在的位置是:电商 >>正文

让大模型“瘦身”90%!清华&哈工大提出极限压缩方案:1bit量化,能力同时保留83%

电商2人已围观

简介对大模型进行量化、剪枝等压缩操作,是部署时最常见不过的一环了。不过,这个极限究竟有多大?清华大学和哈工大的一项联合研究给出的答案是:90%。他们提出了大模型1bit极限压缩框架OneBit,首次实现大 ...

让大模型“瘦身”90%!清华&哈工大提出极限压缩方案:1bit量化,能力同时保留83%

对大模型进行量化、瘦身剪枝等压缩操作,模型是清华部署时最常见不过的一环了。不过,哈化这个极限究竟有多大?提出清华大学和哈工大的一项联合研究给出的答案是:90%。他们提出了大模型1bit极限压缩框架OneBit,极限首次实现大模型权重压缩超越90%并保留大部分(83%)能力。压缩可以说,量力同留玩儿的时保就是“既要也要”

......

本文由CSS站长资源合作伙伴自媒体作者“量子位公众号”授权发布于CSS站长资源平台,本平台仅提供信息索引服务。瘦身由于内容发布时间超过平台更新维护时间,模型为了保证文章信息的清华及时性,内容观点的哈化准确性,平台将不提供完全的提出内容展现,本页面内容仅为平台搜索索引使用。极限需阅读完整内容的用户,请查看原文,获取内容详情。

即将跳转到外部网站 安全性未知,是否继续 继续前往

Tags:

相关文章