😄 废话不多说,直入主题。
- ReLU:之前的一些经典网络里的标配,如ResNet等。
- GeLU:huggingface实现的bert里的标配激活函数。
- SwiGLU:目前很多大模型里的标配激活函数,如Google的PaLM,Meta的LLaMA等。
[1] PaLM中使用的激活函数:SwiGLU
[2] GELU激活函数
😄 废话不多说,直入主题。
[1] PaLM中使用的激活函数:SwiGLU
[2] GELU激活函数
本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.coloradmin.cn/o/1033008.html
如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈,一经查实,立即删除!