OpenAI 封禁伊朗相关 STORM-2035 账号,打击 AI 生成选举影响活动
OpenAI 封禁了与伊朗相关的 STORM-2035 账号,这些账号利用 AI 生成针对美国和英国选举的内容,并跨多个网站发布。
OpenAI 封禁了与伊朗相关的 STORM-2035 账号,这些账号利用 AI 生成针对美国和英国选举的内容,并跨多个网站发布。
OpenAI 封禁了疑似属于 CyberAv3ngers 的账号,该组织涉嫌利用 AI 研究工业控制系统、默认凭据及攻击目标。CyberAv3ngers 是与伊朗关联的网络研究活动主体。
OpenAI 封禁了一个疑似源自美国、使用 AI 伪造 ChatGPT 报错信息的账号,该报错误称检测到“俄罗斯巨魔”活动。
OpenAI 封禁了一批利用 AI 起草辱骂性举报和投诉的账号,这些举报针对越南公众人物和平台。
OpenAI 封禁了一批账号,这些账号通过一家以色列初创公司访问其模型,批量生成对话并在 X 上发送赌博网站链接。OpenAI 表示此举旨在打击滥用其模型的垃圾信息网络。
Hugging Face 推出 BenCzechMark,这是首个也是目前最全面的捷克语大语言模型评测套件,包含覆盖 9 个类别的 50 个任务,其中 90% 为原生非翻译内容,涵盖阅读理解、事实知识、语法、语言建模、数学推理等维度。评测同时配套上线 BenCzechMark 排行榜,收录了超过 25 个不同规模的开源模型,并使用 Acc、EM、AUROC 和词级 Ppl 四类指标进行评分。
OpenAI 封禁了源自俄罗斯的 Stop News 行动相关账号,这些账号使用 AI 生成多语言文章和帖子,针对乌克兰和西方国家开展影响力活动。
Hugging Face 发布教程,讲解如何将顶点着色网格转换为 UV 映射的带贴图网格,并开源了 InstantTexture 库实现一键转换。教程详解用 xatlas 生成 UV 映射、通过重心插值填充 1024 尺寸纹理,再结合 inpainting、中值滤波、高斯模糊和降采样消除纹理孔洞。这类顶点着色网格常见于 InstantMesh 等生成式 3D 模型的输出。
OpenAI 升级 Moderation API,推出一款基于 GPT-4o 构建的新多模态审核模型,能更准确地检测有害文本和图像。该模型面向开发者开放,用于构建更稳健的内容审核系统。
明尼苏达州企业翻译办公室(Enterprise Translation Office)使用 ChatGPT 来弥合语言沟通鸿沟。OpenAI 新闻报道了这一政府机构将 ChatGPT 应用于翻译工作的案例。
OpenAI 与意大利媒体集团 GEDI 宣布达成战略合作,将意大利语新闻内容引入 ChatGPT。
Meta 发布 Llama 3.2,Hugging Face 上线 10 个开放权重模型,包括 11B 和 90B 两个视觉模型(各有 base 与 instruct 版本)以及 1B 和 3B 两个可端侧运行的文本模型。
推荐理由:原文来自 Hugging Face 官方,详细说明了 Vision 与端侧小模型的规模、显存需求、许可证限制和上手方式,适合据此评估是否采用。
Mercado Libre 推出 AI 开发平台 Verdi,由 GPT-4o 驱动。该平台面向开发者提供基于 GPT-4o 的能力支持。
Hugging Face 介绍其 Daily Papers 页面的多项实用功能。过去一年该页面已收录超过 3,700 篇论文,订阅者超过 12k。用户可一键认领论文、提交推荐论文、@作者讨论、用 @librarian-bot 获取相似论文推荐,还能通过多语言评论翻译和 arXiv 扩展跳转体验相关 Space demo。
Hugging Face 发布 FineVideo 数据集,包含 43k 段视频共 3.4k 小时,附丰富描述、叙事细节、场景切分和 QA 对,并撰文披露完整构建流程。
Hugging Face 指导如何用 Optimum-Intel 和 OpenVINO GenAI 优化并部署 Transformers 模型,以 meta-llama/Meta-Llama-3.1-8B 为例,通过 NNCF 进行 INT8/INT4 weight-only 量化(如 AWQ、scale estimation、混合精度)。
生物科技公司 Genmab 启动 "AI Everywhere" 计划,全面采用 ChatGPT Enterprise。OpenAI 的安全与隐私承诺为此次部署提供支持。
Hugging Face 发布把 Llama3 8B 微调到 BitNet 1.58 比特(三元权重 -1/0/1)的方法,模型在 HF1BitLLM 组织开源,其中两个在 10B tokens 上训练、一个在 100B tokens 上训练,MMLU 成绩超过 Llama 1 7B。
OpenAI 在巴西探索用 GPT-4 改善教学与学习,通过教育场景的应用帮助教师提升课堂效果、支持学生学习。该合作展示了大语言模型在教育资源补充方面的实际用途。
Mistral AI 宣布 la Plateforme 推出免费层供实验、评估和原型开发,并对全系模型降价,Mistral Small 与 Codestral 降价 80%,Mistral Large 降价 33%。同时发布 22B 参数的 Mistral Small v24.09(MRL 许可),Pixtral 12B 以 Apache 2.0 许可在 le Chat 上免费提供图像理解能力。
推荐理由:原文给出 la Plateforme 免费层、全线降价幅度和新模型细节,读者可据此比较部署与成本选项。
Mistral 发布原生多模态模型 Pixtral 12B,采用从零训练的 400M 参数视觉编码器和基于 Mistral Nemo 的 12B 多模态解码器,以 Apache 2.0 协议开源。
推荐理由:官方披露了架构细节、基准数字和 Apache 2.0 开源协议,读者可以对比同规模开源多模态模型并评估迁移成本。
Hugging Face 宣布在 Hub 上推出 SQL Console,用户在每个数据集页面点击徽标即可运行 SQL 查询。查询由 DuckDB WASM 在浏览器本地完成,无需服务器,支持导出 Parquet 和通过链接分享结果;数据集前 5GB 会自动转换为 Parquet。
推荐理由:官方介绍浏览器内 SQL 查询数据集的能力与限制,文中示例可直接迁移到自己的数据集格式转换工作流。
OpenAI 发布了关于其安全与安保实践的更新说明,介绍相关安全措施的最新进展。该更新来自 OpenAI 官方新闻渠道,面向关注其模型安全实践的用户与研究者。
Hugging Face 在 HuggingChat 上发布 Community Tools 功能,允许把任意公开 Space 转成模型可直接调用的工具,并借此扩展图像理解、视频生成和文本转语音等多模态能力。
推荐理由:官方介绍了把任意 Space 转成 HuggingChat 工具的做法,覆盖创建、配置参数和打包进助手的完整流程,读者可以照着复用。
Hugging Face 发布 Accelerate 1.0.0 的首个候选版本,该库在三年半间从简化 PyTorch 多 GPU/TPU 训练的工具,成长为 transformers、diffusers、peft、trl 等包的基础。
OpenAI 官方宣布推出 o1 模型。原文正文抓取失败,仅标题可用,更多细节待正文补充。
OpenAI 发布题为 Learning to reason with LLMs 的文章,主题是让大语言模型学习推理。本次抓取仅获取到标题,正文内容缺失,无法提供更多细节。原文链接:https://openai.com/index/learning-to-reason-with-llms
OpenAI 官宣 o1-mini,定位为更具成本效益的推理模型。原文正文缺失,仅提供标题与副标题“Advancing cost-efficient reasoning”,具体能力、定价和可用性细节以官方后续说明为准。
推荐理由:官方原文仅给出标题与口号,正文缺失,难以提炼具体阅读价值。
OpenAI 发布 o1 Contributions 页面,介绍 o1 模型的相关贡献信息。页面来自 OpenAI 官方 News 来源,内容本身较为简略,未提供更多细节。
经济学家 Tyler Cowen 讲解 OpenAI o1 处理复杂经济学问题的方式,展示该模型在经济学推理任务上的表现。
遗传学家 Catherine Brownstein 展示了如何用 OpenAI o1 加速罕见疾病诊断过程。o1 在该场景下用于辅助解码基因信息,缩短罕见疑难病症的诊断耗时。
量子物理学家 Mario Krenn 使用 OpenAI o1 协助解答物理问题。原文内容较为简短,仅说明他将该模型用于探索重大科学问题的研究工作。
Cognition 联合创始人兼 CEO Scott Wu 解释了 OpenAI o1 如何以更像人类的方式做出编程决策。
客服公司 Ada 采用 GPT-4 提升客户服务质量。借助 GPT-4,Ada 为客户提供更高水平的自动化客服支持,树立新的行业标准。
Hugging Face 宣布与 Truffle Security 合作,将开源工具 TruffleHog 的密钥扫描集成到平台。
Hugging Face LeRobot 团队提出 LeRobotDataset 格式,用视频编码存储机器人数据集的视觉模态,数据集平均仅为其原大小的 14%(最佳情况可达 0.2%),且保持完整训练能力。解码方面,单帧加载时间与 PNG 压缩图像相当,解码多连续帧时仅为 PNG 加载时间的 25%-50%。该格式轻量、易分享(与 Hub 原生集成)并配有在线可视化工具。
亚利桑那州立大学(Arizona State University)全校采用 ChatGPT,用于个性化学习、推进科研,并帮助学生为未来做好准备。此次合作为该校师生提供了基于 ChatGPT 的校园级应用支持。
Hugging Face 官方博客盘点 Hub 上五个常被忽视的工具:ZeroGPU(免费 A100 GPU,每工作负载 40GB vRAM)、多进程 Docker Space(用 supervisord)、Gradio API、Webhooks 和 Nomic Atlas 语义搜索。
推荐理由:作者用免费语义搜索项目实际串起 ZeroGPU、多进程 Docker、Gradio API、Webhooks 和 Nomic Atlas 的用法,附可直接复用的代码示例。
Hugging Face 通过新 PR 和 DataCollatorWithFlattening 使无填充打包的指令微调训练兼容 Flash Attention 2,TRL 的 SFTTrainer 也可通过 padding_free=True 使用。
OpenAI 宣布 GPT-4o 现已支持微调,用户可使用自有数据对 GPT-4o 进行定制。