Latent Space 公布 AINews v3 改版计划并汇总本周 AI 动态
Latent Space 主笔 swyx 宣布 AINews v3 计划,将合并 Discord 与 AINews 的功能、探索迁移至 Beehiiv,并重新开放赞助(business@latent.space)与 PR/tips 投稿。
Latent Space 主笔 swyx 宣布 AINews v3 计划,将合并 Discord 与 AINews 的功能、探索迁移至 Beehiiv,并重新开放赞助(business@latent.space)与 PR/tips 投稿。
Endura Therapeutics CEO Adrian Sanborn 提出 AI x Science 的两条路径:Foundries 用新技术把实验数据产出提速一个量级,Navigators 用 LLM 消化思考盈余、优化决策与流程。
Radical Numerics CEO Eric Nguyen 认为,提升生物能力的同一类基因组语言模型(GLM)也能让防御不落后,而目前防御正在这场生物安全军备竞赛中落败。
Latent Space 发布对 John Platt(奥斯卡奖得主、SVM 等教科书算法发明人)的访谈,介绍其团队在 Google 的 Empirical Research Assistance(ERA)。
METR 研究发现 AI 在网络安全领域带来重大加速、对数学研究是小幅加速,而对 AI 研究本身优化无可测加速。华盛顿大学、斯坦福等多校团队发布 SPADE 框架,通过自博弈共同进化环境生成与智能体能力,在 Qwen3-30B-A3B 上使游戏环境套件平均分达 58.3,较基座高 +8.1。
伦敦国王学院、复旦大学与 The Alan Turing Institute 构建 SocioHack 基准,含 72 个沙盒社会环境,RL 训练的 LLM 无需直接指令即以 61.25% recall、90.85% precision 重新发现历史漏洞。
Berkeley AI Research 发布对并行推理领域的综述分析,主张让模型自主决定何时分解任务、并行多少线程以及如何协调。文章指出串行推理 token 线性增长会导致上下文过载(context-rot)和长达数十分钟的延迟,并评述了 ParaThinker、GroupThink、Hogwild! Inference 等近期方法,指出现有方法的并行结构仍由外部固定设定,而非模型自适应决定。
Jack Clark在Import AI 455撰文称,基于公开数据他勉强判断2028年底前出现无人类参与的自动化AI研发(模型自主训练后继者)的概率超过60%,2027年为30%。
AlphaGo 击败围棋世界冠军十周年之际,Google DeepMind 回顾其影响:2016 年对弈李世石(Lee Sae Dol)时"第 37 手"成为 AI 标志性时刻,围棋盘上共有 10^170 种可能局面。
AlphaFold 2 于 2020 年在 CASP14 比赛中高精度解决蛋白质结构预测难题,五年间推动全球生物科学发现,并于 2024 年获诺贝尔化学奖。其免费的 AlphaFold Protein Database 已被 190 多个国家超过 300 万研究者使用,相关研究被引用超 35,000 篇论文。
经济学家 Tyler Cowen 讲解 OpenAI o1 处理复杂经济学问题的方式,展示该模型在经济学推理任务上的表现。
Cognition 联合创始人兼 CEO Scott Wu 解释了 OpenAI o1 如何以更像人类的方式做出编程决策。