跳到正文

#Meta

今日 4 条
今天10月2日周五
  1. The Verge · AI48

    Instagram 将在 Edits 应用中加入 AI“创意助手”指导发帖

    Instagram 宣布在独立 Edits 应用中推出 AI“创意助手”,基于用户账号数据为创作者提供发帖建议。该助手可调用点赞、观看量、视频留存率和分享等指标,回答关于流行趋势、内容表现及文案、音频、脚本创作等问题,对创作者免费,重度用户可购买 Meta One 订阅获得更多用量。YouTube 也刚宣布了类似的 AI 创作者数据面板更新。

10月1日周四
9月30日周三
9月26日周六
  1. Simon Willison38

    John Gruber 谈 Meta Muse:可爱外表下的强大与危险

    John Gruber 评价 Meta 的 Muse:它为每位用户提供运行在 Meta 云端的专属持久 Linux VM,是首个消费者可用的 agentic AI 系统,安装使用简单、以吉祥物形象呈现。但他警告,消费者可能并未意识到 Muse 有多强大、因而多危险,尤其是运行在 Mac 上时。

9月25日周五
8月10日周一
8月3日周一
  1. Import AI48

    Import AI 467:自持自复制的 AI 病毒、AI 进展节奏与 AI 与创造力的困惑

    多伦多大学、Vector Institute、剑桥大学与 ServiceNow 的研究者构建了一个用开源权重 LLM 驱动的自复制计算机蠕虫原型:被攻陷主机的 GPU 上运行 LLM 进行推理,自主发现漏洞并感染新目标,单 GPU(80GB A100)即可运行且不依赖厂商 API。漏洞检测成功率约 80%,利用约 53%,自复制 88%,完整攻击总体成功率约 37%。

6月8日周一
4月20日周一
  1. Berkeley AI Research44

    Berkeley AI Research 提出 GRASP:面向更长时程世界模型的梯度规划方法

    Berkeley AI Research 提出 GRASP,一种基于梯度的世界模型规划器,让长时程规划更稳定可靠。其核心做法有三点:把轨迹提升到虚拟状态使优化在时间上并行、在状态迭代中直接引入随机性以实现探索、重塑梯度让动作获得干净的信号并避开脆弱的“状态-输入”梯度。

3月31日周二
  1. Hugging Face Blog32

    OpenMed 用 165 美元跨 25 物种训练 mRNA 语言模型

    OpenMed 构建了覆盖结构预测、序列设计与密码子优化的端到端蛋白质 AI 流水线。在对比多种 transformer 架构后,CodonRoBERTa-large-v2 胜出,困惑度 4.10、Spearman CAI 相关性 0.40,显著超过 ModernBERT;团队随后扩展到 25 个物种,用 55 GPU 小时训练了 4 个生产模型,建立了其他开源项目没有的物种条件化系统。

2月12日周四
1月27日周二
10月23日周四
10月7日周二
  1. Hugging Face Blog68

    BigCode 发布 BigCodeArena:通过代码执行端到端评判代码生成模型

    BigCode 发布 BigCodeArena,一个通过真实执行来评判代码生成模型的人类投票平台,支持 10 种语言和 8 种执行环境,开放无需注册。上线 5 个月收集 14K 对话、4700+ 偏好投票,Elo 排名中 o3-mini 和 o1-mini 居首。

    推荐理由:基于5个月社区执行评估数据发布代码生成评测平台,给出分语言和执行环境的模型表现差异与两个新基准。

9月22日周一
  1. Hugging Face Blog61

    Meta 发布 Gaia2 智能体基准及开源评估框架 ARE

    Meta 的 Hugging Face 团队发布 GAIA 后续基准 Gaia2 和配套开源框架 Meta Agents Research Environments(ARE),Gaia2 数据集采用 CC BY 4.0 许可,ARE 采用 MIT 许可。

    推荐理由:官方发布新基准 Gaia2 和开源评估框架 ARE,含七类任务和主流模型结果,便于开发者调试和评估自己的 Agent。

8月13日周三
8月5日周二
5月12日周一
4月5日周六
  1. Hugging Face Blog80

    Meta 发布 Llama 4 Maverick 与 Scout,Hugging Face 同步上线权重与生态支持

    Meta 发布 Llama 4 Maverick(约 400B、128 专家)和 Scout(约 109B、16 专家),均为 17B 激活参数的 MoE 原生多模态模型,在最多 40 万亿 token、200 种语言数据上训练。

    推荐理由:官方公告给出两款模型的参数、上下文长度与架构细节,读者可以据此评估部署门槛和与 transformers 的集成方式。

1月27日周一
11月20日周三
11月19日周二
10月21日周一
9月18日周三
8月19日周一
7月23日周二
  1. Hugging Face Blog88

    Meta 发布 Llama 3.1(8B/70B/405B),支持 128K 上下文与多语言

    Meta 发布 Llama 3.1 系列,在 Hugging Face Hub 上线 8B、70B、405B 三个规模共 8 个开放权重模型,上下文长度提升至 128K tokens,支持 8 种语言和工具调用。

    推荐理由:官方发布说明覆盖了三个规模、内存需求和量化权重,读者可以据此选择适合自己硬件的部署与微调路径。

5月24日周五
  1. Hugging Face Blog44

    CyberSecEval 2:Meta 推出的大语言模型网络安全风险与能力综合评测框架

    Meta 发布开源评测框架 CyberSecEval 2,用于评估 LLM 在生成不安全代码、提示词注入、协助网络攻击、代码解释器滥用和自动化攻击能力等方面的安全风险。评测显示,LLM 平均协助网络攻击的合规率已从上一版的 52% 降至 28%;提示词注入防护仍未解决,模型在端到端漏洞利用上能力有限。全部代码开源,并提供 leaderboard,欢迎社区贡献。

4月18日周四
3月25日周一
9月28日周四
9月26日周二
9月13日周三
8月25日周五
  1. Hugging Face Blog83

    Code Llama 发布:Llama 2 代码特化系列模型接入 Hugging Face 生态

    Hugging Face 发布 Code Llama 系列开源代码模型集成,含 7B、13B、34B 三种规格,基于 Llama 2 在 500B token 代码数据上训练,提供 Python 特化版和指令微调版。

    推荐理由:官方完整介绍了模型规格、上下文扩展原理和生态接入方式,读者可以直接据此选择规格并上手部署使用。

8月8日周二