跳到正文
10月12日 · 周一

最新精选

10月10日周六
  1. The Verge · AI78

    The Verge 访谈三十余位数学家:OpenAI 数学发布引发的震动与争议

    The Verge 采访三十余位数学家,记录他们对 OpenAI 本周释出近 400 项 AI 生成数学结果的反应。成果分布于 700 余份手稿,覆盖组合数学、几何、数论、理论计算机科学、拓扑、概率等领域,但仅约 42%(719 份中 300 项)完成 Lean 形式化验证,且截至 10 月 8 日已撤回 3 篇因符号错误导致论证失效的论文。

    推荐理由:原文汇集三十余位数学家对 OpenAI 数学发布的第一手反应,呈现社区在兴奋、忧虑与冲击之间的真实张力。

10月7日周三
  1. The Decoder87

    Common Sense Media 测评称 ChatGPT 对青少年存在不可接受风险,OpenAI 否认

    Common Sense Media 旗下机构对 OpenAI 的 ChatGPT for Teens 进行 4000 余次测试,认定其为青少年不可接受风险,建议在独立验证前禁止未成年人使用。

    推荐理由:Common Sense Media 的实测结论与 OpenAI 的回应同时呈现,可作为评估现有青少年保护机制是否真的有效的参照。

9月23日周三
  1. Simon Willison84

    Claude Opus 5.5 与 GPT-6 Sol/Luna 同日发布,定价全面下探

    Anthropic 发布 Claude Opus 5.5,OpenAI 紧随其后推出 GPT-6 Sol 和 GPT-6 Luna。

    推荐理由:原文把 GPT-6 Sol/Luna 和 Claude Opus 5.5 放在同一价格表里对比,并给出 Pelican 测试中的实测观察,能帮读者快速判断新模型相对上一代的位置。

已经到底了