跳到正文
今天10月7日周三35 条
  1. Simon Willison33

    软件博客的写作反模式

    Michael Lynch 撰文总结软件博客写作的反模式,包括冗长开场、误判读者已有知识、假设读者读过旧文、过度拘谨,以及滥用链接代替术语解释。他强调要用自己自然的语气写作,而非僵硬的正式文风。Simon Willison 认同这一观点,并指出在大量开发者把写作交给 AI 的当下,博客正变得千篇一律,读者渴望有个性的文字。

  2. TechCrunch · AI53

    Google Labs 推出 AI 游戏创作平台 Playground

    Google Labs 于周三推出 AI 游戏创作平台 Playground,用户通过简单文字提示即可制作基于浏览器的游戏,无需编程经验。用户可选择游戏类型、2D 或 3D、单人或多人模式,上传图片生成游戏素材,作品可私有、链接分享或发布到 Explore 画廊,支持排行榜并可在发布后继续修改。

  3. TechCrunch · AI11

    TechCrunch Disrupt 2026 互动圆桌全阵容揭晓:从 AI 到 Physical AI 的深度讨论

    TechCrunch Disrupt 2026 将于 10 月 13-15 日在旧金山 Moscone West 举行,预计 10,000+ 创始人、投资人及技术领袖参会。持票者可参加多场互动圆桌,议题涵盖 Physical AI、专业后训练数据、agentic AI 从试点走向生产、企业软件与融资等方向。目前购票可立减 $100,第二张票享 50% 折扣。

  4. TechCrunch · AI61

    Google 开放 SynthID 网站供公众检测 AI 生成内容

    Google 于周二上线一个新网站,任何人都可以用它检测图片、视频或音频是否由 AI 生成。该工具此前在 Google I/O 上向部分记者、媒体从业者和研究者开放测试,现已向所有人开放;图片支持 JPG、PNG、WEBP、GIF 等格式,视频支持 MP4、MOV、WEBM,音频支持 WAV、MP3、FLAC 等。

  5. The Verge · AI58

    Common Sense Media 评估称 ChatGPT for Teens 是不可接受的风险

    Common Sense Media 发布评估称 OpenAI 的 ChatGPT for Teens 是不可接受的风险,该功能于 8 月推出。报告指出 ChatGPT 在应有情况下不向家长发送警报、在危机情境中未提供恰当帮助、仍会代写作业,执行总监 Tom Siegel 称在 OpenAI 修复并通过独立测试验证前 ChatGPT 应仅限成人使用。

  6. The Decoder75

    OpenAI 在 GitHub 发布 372 个 AI 生成的数学证明结果

    OpenAI 发布由内部前沿模型生成的 372 项数学结果,托管在 GitHub 仓库而非学术期刊,含改进主要计算机算法和与黎曼猜想相关的进展。多数结果附带 Lean 形式化以便机器验证,平均每个结果消耗约三小时 ChatGPT Pro Thinking 算力;此前同一模型产出的 Navier-Stokes 解动用了 1 万个 agent 和数百万美元算力,仍在正式评审中。

  7. TechCrunch · AI41

    前 Ramp 工程师创办 AI 广告创意平台 Melius,推翻首个产品后融资 2000 万美元

    由三名前 Ramp 工程师创立的 AI 平台 Melius 宣布共融资 2500 万美元,包括 CRV 领投的 2000 万美元 A 轮和 General Catalyst 领投的 500 万美元种子轮。该公司在放弃最初的 AI 营销工具并重写代码后,于 7 月推出新平台,用自然语言生成广告活动、图片和视频,并称上线两个月内年化收入超过 100 万美元。

  8. Ars Technica · AI56

    OpenAI 将在欧盟默认对 ChatGPT 输出添加水印

    OpenAI 宣布在欧盟对 ChatGPT 生成的文本自动添加水印,其他地区默认关闭。此举是为遵守已于 8 月生效、要求标记 AI 生成内容的欧盟 AI Act。水印方法名为 textGrain,通过人眼难以察觉的用词模式实现,可被专门检测器识别,但作者指出此类水印对具备基本技术的人仍相对容易绕过。OpenAI 将向有限数量的研究者和组织开放检测器,其他人可申请审批加入。

  9. Simon Willison55

    Simon Willison 谈 EmbeddingGemma 2 采用 Apache 2.0 许可的价值

    Simon Willison 赞赏 EmbeddingGemma 2 采用 Apache 2.0 许可,认为嵌入模型不适合使用封闭的纯托管专有模型,因为应用中需计算并存储数百万条嵌入向量,供应商停供后重新计算成本高。他同时表示自己不愿自行托管,更倾向付费托管开放权重模型,保留必要时自托管或更换供应商的退路。

  10. TechCrunch · AI51

    Musubi 发布开源权重决策模型 PolicyLM-1.7B,用于实时内容审核

    Musubi 周二宣布推出面向实时内容审核的轻量级决策模型 PolicyLM-1.7B,以开放权重发布。该模型可在 50 毫秒内将英文内容政策应用到消息上,成本和速度接近现有 AI 分类器,但政策变更时无需重新训练;决策模型因输出限定结果概率而比大语言模型更快更省,此前 OpenAI 和 Amazon 也已推出同类模型。

  11. Google DeepMind62

    Google DeepMind 发布开源轻量多模态嵌入模型 EmbeddingGemma 2

    Google DeepMind 发布 EmbeddingGemma 2,一个 740M 参数的开源多模态嵌入模型,基于 Gemma 4 架构并以 Apache 2.0 许可发布,可将文本、图像、音频、视频和代码映射到统一嵌入空间。

    推荐理由:官方公布了参数规模、模态组合、内存占用和基准提升等细节,读者可以据此评估端侧多模态嵌入的选型空间。

  12. Microsoft Research47

    Microsoft Research 播客:Jennifer Neville 谈 AI 的意外失败与评估的作用

    Microsoft Research 播客中,资深研究经理 Jennifer Neville 与首席应用科学家 Chad Atalla 对谈,探讨评估如何推动 AI 系统性能突破传统 benchmark,以及测试超出常规基准时出现的“意外失败”。她还分享了使用当前 AI 系统的实用建议,并谈到结果不符预期时为何要仔细审视数据,以及数十年 AI 发展对她预测未来的启示。

10月6日周二
  1. AWS Machine Learning Blog27

    负责任的 AI 治理:AWS 如何帮助客户对齐 ISO/IEC 42005:2025 标准

    AWS 解读国际标准 ISO/IEC 42005:2025,说明如何将 AI 系统影响评估融入企业整体风险管理。该标准覆盖评估全生命周期,包括范围界定、执行、报告、持续监控及再评估触发条件,Annex D 提供与现有 IT 系统影响评估(风险、隐私、网络安全等)整合以避免重复的流程,Annex E 提供独立可用的模板。