🔥 聚焦
谷歌发布Gemma 3n,开启端侧多模态新纪元: 谷歌正式发布Gemma 3n系列模型,专为端侧设备设计,原生支持文本、图像、音频和视频输入。该系列包括E2B和E4B两个型号,虽然实际参数量为5B和8B,但得益于创新的MatFormer“套娃”架构和逐层嵌入(PLE)技术,其显存占用仅相当于2B和4B模型,最低2GB RAM即可运行。Gemma 3n在LMArena竞技场得分超过1300,是首个低于10B参数达到此分数的模型,展现了其在低资源消耗下的卓越性能。目前,该模型已在Hugging Face、Ollama、MLX等主流开源平台全面上线,推动了端侧AI应用的进一步发展 (来源: HuggingFace Blog, karminski3, demishassabis, Reddit r/LocalLLaMA)