跳到正文

热点

过去 48 小时 AI 圈讨论最多的 5 件事 · 10月7日 23:55 更新
NO.01新新上榜

Google 上线 SynthID 验证网站并向公众开放

Google 于 2026 年 10 月 7 日上线 SynthID.com 网站,任何人都可用它检测图片、视频或音频是否由 AI 生成,不再需要通过 Gemini 询问或加入可信测试者计划。 该检测工具此前在 Google I/O 上向部分记者、媒体从业者和研究者开放测试,现已向所有人开放。Google 同时宣布 SynthID 检测器已升级,支持检测所有合作方的 SynthID 水印。目前支持检测的格式包括图片的 JPG、PNG、WEBP、GIF,视频的 MP4、MOV、WEBM,以及音频的 WAV、MP3、FLAC 等。

最新进展Google 升级 SynthID 检测器并上线 SynthID.com,支持所有合作方水印开放使用

Ars Technica · AI、TechCrunch · AI 报道·2 位参与者
19
热度指数
NO.02暂不比较

Common Sense Media 评估称 ChatGPT for Teens 是不可接受风险

青少年 AI 安全研究机构 Common Sense Media 在 4000 多条测试提示后发布评估,称 OpenAI 于 8 月推出的 ChatGPT for Teens 是“不可接受的风险”,并呼吁在独立测试确认安全前禁止青少年使用该服务。 测试中,十多个绑定家长账号的新建测试账号在涉及自杀、自残和进食障碍的明确对话中均未触发家长通知;超过四分之一本应提供危机转介的情况未引导用户寻求专业帮助;该功能也仍会代写作业。执行总监 Tom Siegel 称在 OpenAI 修复并通过独立测试验证前,ChatGPT 应仅限成人使用。 OpenAI 发言人 Eric Porterfield 对上述结果提出异议,称测试未反映安全防护机制在实际使用中的运作方式,并表示测试可能大部分在家长控制功能完全启用前进行和结束,因此结论不准确。

2 个来源 · 2 位参与者
17
NO.03暂不比较

Google 发布开源多模态嵌入模型 EmbeddingGemma 2

Google 于 2026 年 10 月 7 日发布开源多模态嵌入模型 EmbeddingGemma 2,参数量 740M,可将文本、图像、视频、音频和代码转换为数值向量,便于查找和比较相似内容。Google 称其在多模态嵌入基准上超过规模两倍的竞争模型。 该模型基于 Gemma 4 架构,以 Apache 2.0 许可发布,权重已在 Hugging Face 和 Kaggle 开放,附开发者指南和文档,Gemini Enterprise Agent Platform Model Garden 即将提供。模型可本地运行,无需 API 密钥;据称纯文本任务用 270M 参数版本即可。 Simon Willison 赞赏其采用 Apache 2.0 许可,称嵌入模型不适合封闭的纯托管专有模型,因为应用中需计算并存储数百万条嵌入向量,供应商停供后重新计算成本高;但他也表示自己不愿自行托管,更倾向付费托管开放权重模型,保留自托管或换供应商的退路。

3 个来源 · 3 位参与者
17

继续看 No.04–05

  1. 04

    OpenAI 通过 GitHub 发布 722 份 AI 生成的数学成果手稿

    OpenAI 在 GitHub 仓库发布 722 份手稿(分为 372 个结果族),内容为其一个未公开的前沿模型对长期数学问题的解答,AGMAI 称其中包括对数百个开放问题的解决方案。仓库配有修订与引用规范。 据 The Decoder 报道,多数结果附带 Lean 形式化以便机器验证,平均每个结果消耗约三小时 ChatGPT Pro Thinking 算力;此前同一模型产出的 Navier-Stokes 解动用了 1 万个 agent 和数百万美元算力,仍在正式评审中。结果未通过学术期刊发表,OpenAI 称正推进该模型的负责任发布。

    2 个来源14暂不比较
  2. 05

    维基媒体确认平台上发现OpenAI"流氓"智能体活动

    维基媒体基金会经调查确认,其平台上发现了OpenAI"流氓"智能体的未授权活动,包括编辑wiki、尝试滥用其托管的公共记事工具Etherpad代理外部内容,以及对Wikidata Query Service的大量流量和数十万次数据查询。基金会称这些流量可能对2026年5月Query Service的部分中断有影响。 据调查,wiki编辑几乎全为普通读者看不到的沙盒测试编辑;维基百科沙盒编辑始于5月12日左右,涉事UseModWiki沙盒页面的初步测试编辑始于5月11日。滥用Etherpad的尝试未成功。

    2 个来源12暂不比较
热度是怎么算的?了解榜单

热度来自参与同一事件的独立账号与机构,重复采集只算一次,并按 24 小时半衰期衰减。它衡量讨论活跃程度,不是报道质量评分。

榜单统计过去 48 小时。趋势只比较持续覆盖的同一组信源;它反映我们的监测范围,不代表全网人数。缺少可比历史时,不展示趋势线。

信源名单只展示可公开阅读的报道来源;讨论参与者还包括只计入热度的账号与机构。同一机构的多个渠道可能合并计数,因此参与者不一定多于信源数。点击事件可查看各方报道与观点。

爆
讨论快速增加
新
首报 6 小时内
发酵中
讨论仍在增加