跳到正文

#Google

今日 5 条
11月25日周二
  1. Google DeepMind59

    AlphaFold 助力解析心脏病关键蛋白 apoB100 结构

    密苏里大学研究人员结合冷冻电镜与 AlphaFold,解析了'坏胆固醇'LDL 核心蛋白 apoB100 的结构,该蛋白困扰科学界约 50 年。模型显示 apoB100 形成包裹 LDL 颗粒的笼状外壳和维持颗粒完整性的带状结构,为高胆固醇和动脉粥样硬化性心血管疾病(ASCVD)的预防、诊断与治疗提供新方向。

11月24日周一
11月22日周六
  1. Google Research31

    Google Research 用简单 AI 模型预测充电桩可用性,缓解电动车里程焦虑

    Google Research 发布一个轻量级线性回归模型,预测特定时间后电动车充电桩可用的概率。团队在加州和德国的真实充电网络数据上训练,以一天中各小时为特征,在 30 和 60 分钟预测窗口、100 座随机选取的站点上评估,表现优于"保持当前状态"基线。该简单模型依赖易获取的特征即可实现低延迟部署,有助于减少里程焦虑。

11月20日周四
  1. Google DeepMind80

    Google DeepMind 发布 Nano Banana Pro(Gemini 3 Pro Image)图像生成与编辑模型

    Google DeepMind 发布 Nano Banana Pro(Gemini 3 Pro Image),基于 Gemini 3 Pro 的高保真图像生成与编辑模型,已开始在 Google AI Studio 和 Vertex AI 面向付费预览推出。

    推荐理由:官方发布文给出了模型能力细节、2K/4K 分辨率、接入渠道和定价定位,开发者可据此评估是否切换或叠加使用。

11月19日周三
11月17日周一
11月14日周五
11月13日周四
11月12日周三
  1. Google Research51

    Google 发布 JAX-Privacy 1.0,简化大规模差分隐私训练

    Google 发布 JAX-Privacy 1.0,一套构建和审计差分隐私(DP)模型的开源工具包,提供 DP-SGD、DP-FTRL、DP 矩阵分解等算法和基于 JAX 的原生并行扩展能力。库内含 per-example 梯度裁剪、噪声注入、微批处理等组件,并附 Keras 下微调 Gemma 系列模型的完整示例,此前曾用于训练 VaultGemma。

11月11日周二
  1. Google DeepMind50

    Google DeepMind 研究:让 AI 视觉表征更接近人类的方式看世界

    Google DeepMind 在 Nature 发表论文,分析 AI 视觉模型组织视觉世界的方式与人类不同,并提出一种对齐方法。该方法基于预训练模型 SigLIP-SO400M 和包含数百万条人类“找出不同项”判断的 THINGS 数据集,训练教师模型后生成百万图像规模的新数据集 AligNet,再用其微调学生模型。对齐后的模型内部表征按类别清晰组织,鲁棒性和泛化能力得到提升。

11月8日周六
  1. Google Research60

    Google Research 提出嵌套学习范式并发布 Hope 架构应对持续学习

    Google Research 在 NeurIPS 2025 发表 Nested Learning 论文,将机器学习模型视为多层嵌套的优化问题,统一模型架构与优化算法两个层面。

    推荐理由:原文提出把模型架构与优化算法统一为嵌套优化问题的新范式,并给出 Hope 架构的实验验证,对持续学习方向有方法层面的参考价值。

11月7日周五
11月6日周四
11月5日周三
  1. Google Research65

    Google 发布 Project Suncatcher 预印论文,探索基于卫星的可扩展太空 AI 基础设施

    Google 发布预印论文,提出 Project Suncatcher 计划,设想在晨昏太阳同步低地球轨道部署搭载 TPU、以自由空间光链路互联的太阳能卫星星座来扩展 AI 算力。

    推荐理由:Google 官方给出太空 AI 算力设想的关键数据与验证进展,读者可据此了解星载 TPU、星间光链路与发射成本的具体可行性分析。

10月31日周五
10月30日周四
10月28日周二
  1. Google Research51

    Google 基于 Gemini 构建 Fitbit 个人健康教练并开启公测

    Google 推出由 Gemini 模型驱动的个人健康教练,从次日起向符合条件的美国 Fitbit Premium Android 用户开放自愿参与的公开预览,并将很快扩展到 iOS。系统采用多智能体框架(对话、数据科学、领域专家子智能体),基于 SHARP 评测框架进行验证,涉及超 100 万条人工标注和超 10 万小时专家评估。

10月23日周四
  1. Google Research62

    Google 发布 Earth AI 技术论文,详解基础模型与跨模态地理空间推理

    Google 发布 Google Earth AI 相关技术论文,介绍新的 Imagery 与 Population 基础模型,以及由 Gemini 驱动的 Geospatial Reasoning 智能体,用于多步地理空间问答。

    推荐理由:官方同步放出技术论文和评测数字,读者可以据此了解跨模态地理空间推理的实际能力边界与应用案例。

10月16日周四
10月7日周二
  1. Hugging Face Blog68

    BigCode 发布 BigCodeArena:通过代码执行端到端评判代码生成模型

    BigCode 发布 BigCodeArena,一个通过真实执行来评判代码生成模型的人类投票平台,支持 10 种语言和 8 种执行环境,开放无需注册。上线 5 个月收集 14K 对话、4700+ 偏好投票,Elo 排名中 o3-mini 和 o1-mini 居首。

    推荐理由:基于5个月社区执行评估数据发布代码生成评测平台,给出分语言和执行环境的模型表现差异与两个新基准。

9月4日周四
  1. Hugging Face Blog67

    Google 发布 EmbeddingGemma 高效多语言嵌入模型

    Google 发布开源嵌入模型 EmbeddingGemma,308M 参数、2K 上下文窗口,支持超过 100 种语言,量化后内存占用低于 200 MB,适合端侧 RAG 和 Agent 场景。

    推荐理由:官方博客给出架构、基准和各框架用法,还附完整微调示例,读者可以据此判断如何把它接入现有检索流程。

7月23日周三
  1. Hugging Face Blog53

    Hugging Face 发布 TimeScope 长视频理解基准

    Hugging Face 发布开源基准 TimeScope,将约 5-10 秒的短视频"针"插入 1 分钟到 8 小时的基础视频中,评测局部检索、信息综合和细粒度时序感知三类能力。测试发现多数先进模型在真实时序任务上仍吃力,Gemini 2.5-Pro 是唯一在超过一小时视频上保持高准确率的模型,而扩大参数量并不能延长模型的有效时序范围。数据集、排行榜和 lmms-eval 评测框架均已开源。

6月26日周四
  1. Hugging Face Blog73

    Gemma 3n 正式登陆开源生态,发布 E2B 与 E4B 两档端侧多模态模型

    Google Gemma 3n 正式开源,发布 E2B 和 E4B 两个尺寸、各含 base 与 instruct 版本,支持图像、文本、音频和视频输入。E2B/E4B 实际参数为 5B/8B,但借助 MatFormer 架构与 Per-Layer Embeddings,仅需 2GB/3GB GPU 内存即可运行,E4B 还在 LMArena 上取得 1300+ 分数。

    推荐理由:原文给出模型的有效参数设计、显存需求和各开源库用法,端侧开发者可以据此选择部署方式。

5月21日周三
5月12日周一
3月12日周三
2月27日周四
2月21日周五
  1. Hugging Face Blog55

    Google 发布多语言视觉语言编码器家族 SigLIP 2

    Google 发布 SigLIP 2 多语言视觉语言编码器家族,在 sigmoid 损失之上加入解码器、Global-Local 损失和 Masked Prediction 等训练目标。新模型在零样本分类、图文检索和为 VLM 提取视觉表征的迁移能力上全面超过旧版 SigLIP,并新增动态分辨率的 naflex 变体和 1B 参数的 Giant 系列,模型已在 Hugging Face 开放。