yihong0618 和朋友们的频道 头像

消息来源频道

yihong0618 和朋友们的频道

@hyi0618

频道8,612 位成员公开可见0 人在线

yihong0618 和朋友们的频道

成员规模8,612 位成员
在线情况0 人在线
消息总数10,129 条消息
浏览量总数3,297,173 次浏览

在这个频道里搜索消息……

t.me/hyi0618

🐶 Google DeepMind 开源了SOTA模型 Gemma 4
• 推理能力 – 系列中所有模型均被设计为高能力推理器,支持可配置的思维模式。
• 扩展多模态 – 支持处理文本、可变宽高比和分辨率的图像(所有模型),以及视频和音频(E2B 和 E4B 模型原生支持)。
• 多样高效的架构 – 提供不同规模的密集型和混合专家(MoE)变体,支持灵活部署。
• 端侧优化 – 小型模型专为在笔记本电脑和移动设备上高效本地运行而设计。
• 更大上下文窗口 – 小型模型支持 128K 上下文窗口,中型模型支持 256K。
• 增强的编码与智能体能力 – 在编码基准测试中取得显著提升,同时原生支持函数调用,可驱动高能力的自主智能体。
• 原生系统提示支持 – Gemma 4 引入了对 system 角色的原生支持,实现更结构化、更可控的对话。
🐑 Ollama 更新 - v0.20.0
• 新增 Google 最新开源的SOTA Gemma 4 系列模型支持,提供四个版本:Effective 2B (E2B)、Effective 4B (E4B)、26B(混合专家模型,激活参数4B)和31B(密集模型)。
• 优化 MLX 后端,使其在 pipeline 中遵循 tokenizer 的 add_bos_token 设置,确保与模型配置的一致性。
• 扩展 tokenizer 功能,新增对 SentencePiece 风格 BPE(字节对编码)的支持,提升了分词器的兼容性和处理能力。
🔑 关键词:
#ollama #gemma Gemma 4, Deepmind, 模型发布, tokenizer, BPE, MLX
🤗 HuggingFace | 🎲 Github