Tony Fadell 谈第一波 AI 硬件为何失败及下一步走向
Tony Fadell 在 MIT Future Fest 上表示 Rabbit R1、Humane AI pin 和 Limitless pendant 等 Gen 1 AI 设备失败,是因为没有解决真实需求,只是极客眼中的有趣技术。
Tony Fadell 在 MIT Future Fest 上表示 Rabbit R1、Humane AI pin 和 Limitless pendant 等 Gen 1 AI 设备失败,是因为没有解决真实需求,只是极客眼中的有趣技术。
Simon Willison 赞赏 EmbeddingGemma 2 采用 Apache 2.0 许可,认为嵌入模型不适合使用封闭的纯托管专有模型,因为应用中需计算并存储数百万条嵌入向量,供应商停供后重新计算成本高。他同时表示自己不愿自行托管,更倾向付费托管开放权重模型,保留必要时自托管或更换供应商的退路。
Google DeepMind 发布 EmbeddingGemma 2,一个 740M 参数的开源多模态嵌入模型,基于 Gemma 4 架构并以 Apache 2.0 许可发布,可将文本、图像、音频、视频和代码映射到统一嵌入空间。
推荐理由:官方公布了参数规模、模态组合、内存占用和基准提升等细节,读者可以据此评估端侧多模态嵌入的选型空间。
Google 发布开源嵌入模型 EmbeddingGemma 2,参数量 740M,Google 称在多模态嵌入基准上超过规模两倍的竞争模型。
NVIDIA 宣布 DGX Spark 新增 64GB 统一内存配置,10 月 23 日起经 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 开售,起价 $4,999。
推荐理由:原文给出64GB配置的具体价格、内存上限和双机集群性能数据,读者可以据此评估本地AI部署方案。
Berkeley Sky Lab 在进化式内核搜索框架 K-Search 基础上新增 MLX 后端,通过结构化 CUDA-to-MLX 翻译层,把已有 CUDA 内核作为知识库自动适配为 Apple Silicon 上的高质量 GPU 内核。