让大模型“瘦身”90%!清华&哈工大提出极限压缩方案:1bit量化,能力同时保留83%
时间:2024-07-04 05:26:39 来源:带水拖泥网 作者:短视频 阅读:403次
对大模型进行量化、瘦身剪枝等压缩操作,模型是清华部署时最常见不过的一环了。不过,哈化这个极限究竟有多大?提出清华大学和哈工大的一项联合研究给出的答案是:90%。他们提出了大模型1bit极限压缩框架OneBit,极限首次实现大模型权重压缩超越90%并保留大部分(83%)能力。压缩可以说,量力同留玩儿的时保就是“既要也要”
......
本文由CSS站长资源合作伙伴自媒体作者“量子位公众号”授权发布于CSS站长资源平台,本平台仅提供信息索引服务。瘦身由于内容发布时间超过平台更新维护时间,模型为了保证文章信息的清华及时性,内容观点的哈化准确性,平台将不提供完全的提出内容展现,本页面内容仅为平台搜索索引使用。极限需阅读完整内容的用户,请查看原文,获取内容详情。
即将跳转到外部网站 安全性未知,是否继续 继续前往(责任编辑:自媒体)
最新内容
热点内容