Amazon SageMaker Studio 现可直接管理 SageMaker HyperPod Spaces
AWS 推出直接在 SageMaker Studio 界面中创建和管理 HyperPod EKS 集群上 SageMaker Spaces 的能力,数据科学家无需 CLI 或 kubectl 即可启动 JupyterLab 和 Code Editor 环境。
AWS 推出直接在 SageMaker Studio 界面中创建和管理 HyperPod EKS 集群上 SageMaker Spaces 的能力,数据科学家无需 CLI 或 kubectl 即可启动 JupyterLab 和 Code Editor 环境。
Z.ai 的 GLM 5.3 现已登陆 Amazon Bedrock,这是一个 753B 参数的 MoE 模型,主打编码和长程智能体任务,Z.ai 报告其在 CyberGym 基准上得分为 84.5。
推荐理由:原文给出了 GLM 5.3 的参数规模、基准成绩和 Bedrock 上的调用与缓存方法,读者可以据此评估迁移与成本。
Amazon SageMaker AI 优化生成式 AI 推理推出 aws-ai-ml 技能,通过 Agent Toolkit for AWS 提供,可接入 Kiro、Claude Code、Codex 等任何支持 MCP 的编码智能体。
NVIDIA 宣布 DGX Spark 新增 64GB 统一内存配置,10 月 23 日起经 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 开售,起价 $4,999。
推荐理由:原文给出64GB配置的具体价格、内存上限和双机集群性能数据,读者可以据此评估本地AI部署方案。
CoreWeave 在 CoreWeave Fully Connected 大会上宣布 NVIDIA Vera Rubin NVL72 系统与 Spectrum-X 102.4T 以太网正式可用,Devin 开发商 Cognition 成为首家在生产环境运行该系统的客户,SWE-2 推理的总 token 吞吐量较 GB200 NVL72 提升最高 4.8x。
Microsoft Research 推出 Quine,一个结合生物学多模态世界模型与交互式 harness 的 AI 研究系统,可连接科学工具、文献、湿实验与研究人员。
Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,将低延迟流式视频与实时语音结合,为对话带来视觉形象,即日起在 Gemini Enterprise 中可用。该功能支持精准唇形同步、自然表情、异步工具调用,并能跨 97 种语言无缝切换而不降低视频保真度。企业可通过参考图自定义形象,输出内容由 SynthID 水印标记。
微软研究挑战机器人推理必须依赖机载 GPU 的假设,系统评估移动操作工作负载后发现卸载推理到边缘或云端 GPU 可显著提升任务成功率、精度并延长续航,如 Jetson Thor 等大机载 GPU 可使电池消耗增加高达 160%。
Google Private AI Compute 团队宣布为平台增加私密的服务端持久记忆,解决云上 AI 跨设备长期记忆与设备端隐私标准难以兼得的问题。新架构将数据封存在云端专用加密存储中,解密密钥仅保存在用户个人设备,并借助硬件安全飞地、端到端加密通道和按用户隔离的数据库处理请求,连 Google 也无法访问。
Google DeepMind 发布 AlphaGenome Atlas 平台,包含人类基因组中约 90 亿个单核苷酸变异的分子效应预测,是超过 1PB 的数据集,可经免费网站、AlphaGenome API 和 Google Antigravity 技能访问。
推荐理由:官方平台整合了 AlphaGenome 与 AlphaMissense 的预测,读者可以了解它如何用于变异排序和稀有病等研究场景。