Gemma 4 模型设置摘要 | AI生成和翻译

首页 2026.07

以下是本次会话的完整摘要。


会话:Gemma 4 E4B — 下载、验证、更新 llama.cpp

1. 下载模型

2. 模型架构(来自 GGUF 元数据)

属性
架构 Gemma 4 (gemma4)
参数量 7.52 B(标记为“E4B”)
层数 42
嵌入维度 2560
前馈维度 10240
注意力头数 8(GQA = 4,2 个 KV 头)
上下文长度 131,072
滑动窗口 512(混合型 — 35 个 SWA 层 + 7 个全局层)
RoPE 基准频率 1,000,000(全局),10,000(SWA)
Logit 软上限 30.0
共享 KV 层 18(层绑定 KV 设计)
逐层输入嵌入 是(Gated Delta Net)
词表 BPE,262,144 个 token
许可证 Apache 2.0

3. 初始推理测试(旧版 b8)

4. 更新 llama.cpp

5. 构建

6. 最终验证

当前状态


AI生成和翻译,但整理分享仍需精力。如果觉得有帮助,欢迎 捐助支持。 微信:@lzwjavaWeChat QR · X: @lzwjava · 打个招呼 👋

返回 捐助