zh
红薯智语
每月不到10元,就可以无限制地访问最好的AIbase。立即成为会员
首页
AI资讯
AI日报
变现指南
AI教程
AI工具导航
AI产品库
zh
红薯智语
搜索全球AI产品动态
搜索全球AI信息,发现AI新机遇
新闻资讯
产品应用
变现案例
AI教程
类型 :
新闻资讯
产品应用
变现案例
AI教程
2024-08-01 10:31:36
.
AIbase
.
10.7k
打开语言模型“黑箱”!Google DeepMind 发布一套可视化工具Gemma Scope
Google DeepMind的最新研究Gemma Scope揭开了语言模型黑箱的秘密,通过稀疏自编码器(SAEs)分解和重构语言模型的激活,旨在揭示背后有意义的特征。Gemma Scope采用JumpReLU SAEs,通过控制激活,优化重建损失并正则化活跃的潜在特征数量,以揭示语言模型的内部机制。研究发现,残差流SAEs的性能通常较低,序列长度对SAE性能有显著影响,不同数据集子集的表现各异,DeepMind mathematics上表现最佳。Gemma Scope的发布不仅有助于理解SAEs,还能改进实际任务性能,对SAEs进行红队测试,提高AI的可解释性和安全性。
2024-08-01 10:03:42
.
AIbase
.
10.7k
谷歌发布全新Gemma 2 2B模型,性能超越GPT-3.5-Turbo与Mixtral-8x7B
谷歌推出了拥有20亿参数的Gemma22B模型,表现出在多种硬件环境下的卓越性能,尤其在“聊天机器人竞技场”中超越了GPT-3.5-Turbo-0613和Mixtral-8x7b等模型。此模型通过NVIDIA TensorRT-LLM库优化,高效部署于各种场景,从边缘设备到强大云环境。为提升安全性,谷歌还发布了ShieldGemma安全分类器和Gemma Scope工具,以过滤有害内容和分析模型决策。面对AI技术竞争的加剧,谷歌需加速创新,推出更强大的Gemma3模型以保持市场竞争力。