跳到正文

全部动态

今日 34 条
7月17日周三
7月16日周二
  1. Mistral AI62

    Mistral 发布 Mamba 架构编码模型 Codestral Mamba

    Mistral AI 发布 Mamba 架构的 Codestral Mamba,在 Albert Gu 和 Tri Dao 协助下训练,具备线性时间推理和理论无限序列建模能力,已测试 256k token 的上下文检索,参数量 7,285,403,648。

    推荐理由:官方介绍了 Mamba 架构在线性推理和长序列上的特点、部署方式与许可证差异,读者可据此评估本地编码助手的可行性。

7月11日周四
7月10日周三
  1. Hugging Face Blog41

    Hugging Face 在 Dataset Hub 上试验基于 Presidio 的 PII 自动检测

    Hugging Face 正在 Dataset Hub 上试验一项新功能,使用开源 PII 检测工具 Presidio 自动生成数据集中个人身份信息(PII)的报告。报告可帮助开发者在训练前评估数据集的 PII 风险,也帮助数据集所有者在发布前验证其 PII 过滤流程。Hugging Face 还感谢法国 CNIL 在 GDPR 合规方面提供的指导。

7月9日周二
7月8日周一
7月3日周三
7月1日周一
6月27日周四
  1. Hugging Face Blog78

    Google 发布开源大语言模型 Gemma 2,Hugging Face 完成生态集成

    Google 发布开源大语言模型 Gemma 2,提供 9B 和 27B 两种参数规模,各有 base 与 instruction-tuned 版本,已上架 Hugging Face Hub。

    推荐理由:Hugging Face 官方介绍 Gemma 2 四个开放权重模型的技术细节与生态集成,并给出 transformers、TRL 微调和 Inference Endpoints 部署的可用方法。

6月25日周二
6月24日周一
  1. Hugging Face Blog42

    Hugging Face 伦理与社会通讯 #6:构建更好的 AI——数据质量的重要性

    Hugging Face 伦理与社会通讯第 6 期探讨 AI 数据质量:Reddit 与 Google 的内容合作因 RAG 搜索引擎输出“披萨加胶水”等错误推荐而受挫,说明并非所有数据都同样优质。好数据的关键在于与任务匹配,需具备相关性、全面性、时效性并缓解偏见。文章还阐述高质量数据可提升模型性能、鲁棒性、效率与可复现性,并建议通过去重、内容过滤、人工反馈和数据治理框架来保障质量。

6月21日周五
6月20日周四
6月19日周三
6月18日周二
  1. OpenAI News26

    Paf 全公司采用 ChatGPT Enterprise,工程师用 custom GPTs 提升开发效率

    Paf 在全公司采用 ChatGPT Enterprise,工程师每天使用 custom GPTs 加速日常开发任务,并将 ChatGPT Enterprise 集成到 grit:lab 编程学院(gritlab.ax),以 AI 增强的系统架构思维培养下一代软件开发者。目前 Paf 有 70% 的员工活跃使用 ChatGPT Enterprise,覆盖财务、HR、市场和客户支持等业务团队。

6月17日周一
6月13日周四
  1. OpenAI News67

    OpenAI 任命美国陆军退役上将 Paul M. Nakasone 进入董事会

    OpenAI 宣布任命美国陆军退役上将 Paul M. Nakasone 进入董事会,其将为不断扩大的董事会带来网络安全经验,并将加入董事会的安全与保障委员会。

    推荐理由:官方宣布美国陆军退役上将 Paul M. Nakasone 加入董事会并进入安全与保障委员会,读者可据此关注其网络安全背景对公司安全方向的影响。

6月12日周三
6月10日周一
6月8日周六
6月7日周五