Gemma 4 模型设置与 llama.cpp 更新 | AI生成和翻译

首页 2026.07

以下是完整会话总结。


会话:Gemma 4 E4B — 下载、验证、更新 llama.cpp

1. 下载模型

2. 模型架构(来自 GGUF 元数据)

属性
架构 Gemma 4 (gemma4)
参数量 7.52 B(标注为 “E4B”)
层数 42
嵌入维度 2560
FF 维度 10240
注意力头数 8(GQA = 4,2 个 KV 头)
上下文长度 131,072
滑动窗口 512(混合 — 35 个 SWA 层 + 7 个全局层)
RoPE 基数 1,000,000(全局),10,000(SWA)
Logit softcap 30.0
共享 KV 层 18(层绑定 KV 设计)
每层输入嵌入 是(Gated Delta Net)
词表 BPE,262,144 个 token
许可证 Apache 2.0

3. 初始推理测试(旧版本 b8)

4. 更新 llama.cpp

5. 构建

6. 最终验证

当前状态


AI生成和翻译,但整理分享仍需精力。如果觉得有帮助,欢迎 捐助支持。 微信:@lzwjavaWeChat QR · X: @lzwjava · 打个招呼 👋

返回 捐助