Stacklok 两位 Kubernetes 创始人如何用云原生 harness 让 coding agent 走出桌面
Richard MacManus 采访 Stacklok 创始人 Craig McLuckie 和 Joe Beda,二人正用 Kubernetes 式思路把 coding agent harness 搬到云端。
Richard MacManus 采访 Stacklok 创始人 Craig McLuckie 和 Joe Beda,二人正用 Kubernetes 式思路把 coding agent harness 搬到云端。
Simon Willison 发布 llm-openai-decisions 0.1a0 插件,用于调用 OpenAI 在 DevDay 上预告后新发布的 Jev 风格 Decisions API,插件由 GPT-6 Astra 阅读 API 文档后参照 llm-typesafe 构建。
Simon Willison 赞赏 EmbeddingGemma 2 采用 Apache 2.0 许可,认为嵌入模型不适合使用封闭的纯托管专有模型,因为应用中需计算并存储数百万条嵌入向量,供应商停供后重新计算成本高。他同时表示自己不愿自行托管,更倾向付费托管开放权重模型,保留必要时自托管或更换供应商的退路。
Google DeepMind 发布 EmbeddingGemma 2,一个 740M 参数的开源多模态嵌入模型,基于 Gemma 4 架构并以 Apache 2.0 许可发布,可将文本、图像、音频、视频和代码映射到统一嵌入空间。
推荐理由:官方公布了参数规模、模态组合、内存占用和基准提升等细节,读者可以据此评估端侧多模态嵌入的选型空间。
Google 发布开源嵌入模型 EmbeddingGemma 2,参数量 740M,Google 称在多模态嵌入基准上超过规模两倍的竞争模型。
电信运营商正日益将 AI 战略建立在开源模型之上,NVIDIA 电信行业 AI 现状报告显示 89% 的受访者认为开源模型和软件对公司 AI 战略很重要。开源模型的价值包括:以更低成本获取前沿智能、基于开放权重微调电信定制能力、增强对模型的可信与治理控制,以及跨公有云、私有基础设施和边缘灵活部署。
Reflection 发布 text-only 的 501B 总参数 / 23B 激活 MoE 模型 Beam,面向编码、Agent 和科学工作,从头训练,Apache 2.0 全权重本月内放出。