Google DeepMind 发布开源轻量多模态嵌入模型 EmbeddingGemma 2
Google DeepMind 发布 EmbeddingGemma 2,一个 740M 参数的开源多模态嵌入模型,基于 Gemma 4 架构并以 Apache 2.0 许可发布,可将文本、图像、音频、视频和代码映射到统一嵌入空间。
推荐理由:官方公布了参数规模、模态组合、内存占用和基准提升等细节,读者可以据此评估端侧多模态嵌入的选型空间。
内容形态
新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。
4 条精选近 30 天 4 条共收录 13 条
Google DeepMind 发布 EmbeddingGemma 2,一个 740M 参数的开源多模态嵌入模型,基于 Gemma 4 架构并以 Apache 2.0 许可发布,可将文本、图像、音频、视频和代码映射到统一嵌入空间。
推荐理由:官方公布了参数规模、模态组合、内存占用和基准提升等细节,读者可以据此评估端侧多模态嵌入的选型空间。
GPT-6 Astra Ultrafast 现已在 OpenAI API 及符合条件的 ChatGPT Work 和 Codex 用户中可用,运行在 NVIDIA Blackwell GPU 上,token 生成速度比 Astra Standard 模式最高快 8x。
推荐理由:原文解释了 Ultrafast 模式如何借助 NVIDIA Blackwell 提速 8x,以及这对智能体开发循环的具体影响。
Google DeepMind 宣布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向可信网络防御者开放,定价为每百万输入 token $2、输出 token $10,缓存输入 95% 折扣。
推荐理由:官方发布正文给出定价、基准分数和内部落地实例,读者可以据此了解模型在工程与防御安全场景的实际表现。
Google DeepMind 发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking 两款语音对话模型。
推荐理由:官方同时给出两个新语音模型的定位差异、基准成绩和可用入口,读者可以据此判断该选哪个模型。