跳到正文

#开源生态

今日 0 条
9月28日周一
  1. Mistral AI38

    Mistral 在慕尼黑开设德国中心,推进欧洲工业 AI

    Mistral 在慕尼黑开设新中心,聚焦 Physics AI 与工业 AI,并直接服务企业合作伙伴。该中心将组建 Physics AI 和工业 AI 专项研究团队,并与宝马、西门子能源及慕尼黑工业大学合作。Mistral 计划到 2030 年建成 1 吉瓦欧洲算力,其开放权重架构支持模型在客户自有基础设施上运行,数据不离开组织。

9月24日周四
  1. Hugging Face Blog60

    Liquid AI 发布 LFM2.5-VL-DSpark 草稿模型,加速视觉语言模型推理

    Liquid AI 发布 LFM2.5-VL-3B 的实验性 DSpark 草稿模型,通过投机解码在几乎不增加内存的前提下提升推理速度,解码加速最高达 3.13x(设备端)和 2.66x(H100),端到端提升最高 2.62x 和 2.27x。

    推荐理由:原文给出了解码加速倍数、内存开销和三种推理框架的接入方式,读者可据此评估端侧视觉模型的推理收益。

  2. NVIDIA Blog75

    NVIDIA 联合 Google DeepMind 等机构发布 2800 多种病毒蛋白复合物 3D 结构开放数据集

    NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,通过 AlphaFold Database 开放了 2800 多种病毒的蛋白复合物预测 3D 结构,供全球任何科学家使用。

    推荐理由:原文给出了数据集规模、开放入口和可复用的推理流程,读者可据此评估它对病毒研究和疫情准备的实际价值。

  3. Hugging Face Blog62

    NVIDIA 教程:用 Warp 与 MJWarp 将 MuJoCo 机器人仿真扩展到 2048 并行环境

    NVIDIA 发布教程,讲解如何用 NVIDIA Warp 与 MuJoCo Warp(MJWarp)将 SO-101 机械臂场景从单世界 CPU 仿真迁移到最多 2048 个并行 GPU 环境。文章覆盖单世界校验、批量分配、容量调优与吞吐测量,并给出 pip install warp-lang 与 mujoco-warp 的安装入口。

    推荐理由:原文给出从单世界 MuJoCo 迁移到 2048 并行 MJWarp 环境的完整步骤,读者可直接照做并复现吞吐测量。

9月23日周三
9月22日周二
  1. NVIDIA Blog62

    NVIDIA Isaac ROS 5.0 发布,引入智能体工作流并支持 ROS Lyrical

    NVIDIA 在 ROSCon 大会上发布 Isaac ROS 5.0,这是一套基于 ROS 的 GPU 加速开源包,新增智能体工作流和平台支持,帮助开发者更快构建、定制和部署机器人应用。

    推荐理由:原文给出了 Isaac ROS 5.0 的智能体工作流、ROS Lyrical 支持和生态伙伴落地案例,读者可据此判断它如何加速机器人开发。

  2. Hugging Face Blog42

    oMLX 创建者 Jun Kim 加入 Hugging Face,助力 MLX 社区发展

    oMLX 创建者及维护者 Jun Kim 加入 Hugging Face,以支持 MLX 社区。oMLX 将保持 Apache 2.0 开源协议,并由 Jun 继续主导开发,从兼职项目升级为全职维护项目,有望带来更稳定的发展和更快的迭代。Hugging Face 希望 oMLX 成为新想法的试验场,并加速 transformers 模型定义到 MLX 实现的转换。

  3. Hugging Face Blog73

    Hugging Face transformers 支持运行 llama.cpp 的 GGUF 量化模型

    Hugging Face 在 transformers 中加入对 GGUF 模型的高效运行支持,通过复用 ggml 的 Metal 内核,可在 Apple Silicon 上以熟悉的 from_pretrained 接口加载并生成。

    推荐理由:原文给出了 GGUF 加载方式、性能对比和当前限制,读者可以据此判断在 transformers 里跑本地量化模型的可行性与适用场景。

  4. NVIDIA Blog33

    从赋能到落地,埃及AI生态迈向生产规模

    埃及AI生态正从潜力走向规模化生产,NVIDIA在开罗举办活动展示其全栈AI方案。过去一年,NVIDIA深度学习学院在埃及的学习者数量增长超十倍;Hassan Allam Data Centers获许可建设数据中心,预计投资4亿美元。非洲一年内新增四座AI工厂,另有656兆瓦容量在建,Cassava Technologies等企业正推动本地化AI基础设施部署。

9月21日周一
  1. NVIDIA Blog42

    AI 安全是工程问题:NVIDIA 如何在智能体栈每一层解决它

    NVIDIA 提出 AI 安全本质是工程问题,需在智能体栈的每一层(模型、工具、运行时环境)落实可执行的安全边界、责任人与防护证据。NVIDIA 开源 OpenShell 安全运行时,在智能体触及范围之外强制策略并提供沙箱执行;Cisco DefenseClaw、JFrog 等合作伙伴正基于 OpenShell 构建治理与技能扫描层。

  2. Hugging Face Blog62

    Multiverse 提出将 LLM 块剪枝转化为伊辛优化问题,深度压缩下 MMLU 提升近 23 个百分点

    Multiverse Computing 发表论文,将大语言模型的块删除(深度剪枝)重构为约束二元优化问题,映射到伊辛玻璃自旋系统,用能量作为下游性能的廉价代理,从而无需逐一基准测试即可筛选大量候选配置。

    推荐理由:把剪枝块选择映射为伊辛玻璃能量最小化,用物理求解器处理组合问题,在深度压缩下显著领先现有方法。

9月17日周四
  1. GitHub Blog · AI & ML85

    GitHub 用 Copilot 将 Copilot 运行时重写为 Rust

    GitHub 用 Copilot 将 Copilot 运行时从 TypeScript 重写为超过 80 万行生产 Rust,历时约 14.5 周,由一名开发者主导完成。重写采用组件级就地替换策略,性能提升数个数量级,并新增 C ABI 支持进程内嵌入。

    推荐理由:原文给出了用 Copilot 自身完成大规模 Rust 重写的完整过程与数据,读者可据此评估 AI 辅助重写的可行性与工程方法。

9月16日周三
  1. Mistral AI60

    Mistral 与 Mozilla 合作,为 Firefox 智能窗口提供模型支持

    Mistral 宣布与 Mozilla 合作,为 Firefox 的 AI 浏览助手 Smart Window(测试版)提供模型支持,初期覆盖法国和北美用户,英国和德国预计今年晚些时候跟进。双方强调开源、隐私与用户控制,对话默认不保存在 Mozilla 服务器,合作伙伴同意零数据留存。

    推荐理由:原文给出了合作范围、地区上线顺序和隐私默认设置,读者可据此判断开源模型进入浏览器助手后的实际形态。

9月15日周二
  1. NVIDIA Blog62

    费城儿童医院如何用开源 NVIDIA AI 在数秒内完成儿童心脏建模

    费城儿童医院(CHOP)基于 NVIDIA 联合发起的开源医学影像框架 MONAI,将儿童心脏建模从原先需要熟练研究员四小时的工作缩短到数秒,已用于先天性心脏病手术规划。

    推荐理由:原文展示了开源AI工具如何把心脏建模从四小时压缩到秒级,并推动多家儿童医院落地,读者可借此理解开源生态在罕见病医疗中的实际价值。

9月10日周四
  1. Hugging Face Blog65

    Gradio Workflow 用 73 个节点重建 AUTOMATIC1111 功能集

    Hugging Face 发布 Workflow1111,用 Gradio Workflow 以 73 个节点、11 条媒体管线重建了 AUTOMATIC1111 的 stable-diffusion-webui 主要功能,涵盖文生图、图生图、高清修复、提示词矩阵、VLM 反推提示词、检测转蒙版、ControlNet 风格标注器、背景移除、PNG Info 和图生视频。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  2. Hugging Face Blog78

    AsyncGRPOTrainer 结合 LoRA 跨 HF Jobs 训练:用存储桶同步适配器,无需 NCCL

    Hugging Face 博客介绍如何用 AsyncGRPOTrainer 结合 LoRA 在 HF Jobs 上跨节点训练,通过 Storage Bucket 同步适配器而非 NCCL,并用代理路由请求。500 步训练从 3 小时 27 分钟优化到 53 分钟,速度提升 3.9 倍,代码已开源。

    推荐理由:原文给出了完整的架构、代码和调优过程,读者可以据此复现跨节点 LoRA 异步强化学习训练。

9月8日周二
  1. Mistral AI62

    Mistral 完成 30 亿欧元 D 轮融资,估值超 210 亿欧元

    Mistral 宣布完成 30 亿欧元 D 轮融资,投后估值超 210 亿欧元,为欧洲科技公司史上最大股权融资。三星电子领投,EQT 管理的 Scaleup Europe Fund 和现有投资者 PSG Equity 联合领投。资金将用于扩大前沿研究、算力、基础设施及国际业务,公司现覆盖 20 国,服务 Airbus、ASML、HSBC 等 125 余家企业的关键 AI 转型。

    推荐理由:原文给出了融资规模、估值和领投方,读者可以据此判断欧洲AI公司的资本格局与主权AI路线的市场认可度。

9月3日周四
  1. Hugging Face Blog62

    Hugging Face 发布多模态编码器 NeoMME,260M 与 800M 两档开源

    Hugging Face 发布 NeoMME,一个 260M 和 800M 的多语言多模态编码器家族,用单一双向 Transformer 同时处理文本 token 和原始图像块,从零训练,不使用预训练视觉塔或因果语言模型。

    推荐理由:原文给出了模型架构、检索性能和压缩方案,读者可据此评估其在视觉文档检索中的适用性。

  2. Hugging Face Blog62

    用100步GRPO微调350M模型,IFStruct结构化输出从22.6%提升至29.7%

    Hugging Face 发布公开教程,用 TRL 库对 LFM2.5-350M 做约500样本、100步的 GRPO 微调,在 IFStruct 基准上从22.6%提升至29.7%,其中 JSON 通过率从18.0%升至31.9%。整套流程可在免费版 Colab 或 Kaggle GPU 上运行,评估可在 MacBook 上通过 llama.cpp 完成,代码已开源在 GitHub。

    推荐理由:给出了一套约500样本、100步的轻量GRPO微调配方,读者可据此低成本提升小模型的结构化输出合规率。

  3. Hugging Face Blog62

    用 TRL 和 OpenEnv 训练编码模型画水彩:完整开源复现

    作者用 TRL 和 OpenEnv 复现了 Surya Narreddi 的用语言模型写 JavaScript 画水彩的项目,并开源了参考数据集、RL 环境、训练脚本和训练好的模型。

    推荐理由:作者用 TRL 和 OpenEnv 完整复现了用代码画水彩的 RL 训练流程,并开源全部数据集、环境和模型,读者可据此复现或改造。

9月2日周三
  1. Google Research62

    Google 与 NASA JPL 发布 MAPL-EMIT:用深度学习从太空绘制全球甲烷排放

    Google Research 与 NASA JPL 合作发表 PNAS 论文,提出 MAPL-EMIT 深度学习框架,基于 Swin-S vision transformer 处理 EMIT 高光谱数据,可同时完成甲烷羽流增强量化、羽流分割和源定位。

    推荐理由:原文给出了模型架构、训练方法和实测召回率,读者可据此评估这套深度学习方案在甲烷点源监测上的实际能力。

9月1日周二
  1. Hugging Face Blog73

    Hugging Face 发布 @huggingface/kernels:207 个 WebGPU 内核加速本地 AI 推理

    Hugging Face 发布 @huggingface/kernels,一个用于从 Hub 加载和运行优化 WebGPU 内核的库,并推出 207 个内核的初始集合,Apache-2.0 许可。在 Apple M4 GPU 上与 ORT WebGPU 对比,几何平均快 2.57 倍,中位数快 1.90 倍。同时推出 Fleet 浏览器基准测试套件,用于众包收集真实 GPU 上的正确性和性能证据。

    推荐理由:原文给出了 207 个 WebGPU 内核的发布、性能对比数据和开源许可,读者可据此评估浏览器端推理的加速空间。

  2. Google Research65

    Google 发布 TimesFM-3 多变量时序预测基础模型

    Google Research 发布 TimesFM-3,这是其时序基础模型家族的新一代版本,原生预训练用于多变量预测,参数量 3.3 亿,在超过 1 万亿时间点的真实与合成语料上完成预训练。

    推荐理由:原文给出了模型架构、参数量、评测排名和开放入口,读者可据此判断它相对单变量模型的提升幅度。

  3. Microsoft Research62

    微软发布 GigaPath-Flash 与 GigaTIME-Flash 高效病理基础模型

    微软研究院发布 GigaPath-Flash 与 GigaTIME-Flash,通过知识蒸馏将十亿参数编码器压缩为 22M 参数的 ViT-S 骨干,在保持约 97% 预测性能的同时将全切片分析计算量降低约 50 倍,空间蛋白组学预测提速约 6 倍、显存减少约 8 倍。两模型均以 Apache 2.0 协议开放权重,代码与权重已上架 Hugging Face,面向科研用途而非临床诊疗。

    推荐理由:原文给出了蒸馏压缩后的效率提升和开放权重入口,读者可据此评估病理基础模型在更大队列研究中的实用成本。

8月25日周二
  1. Hugging Face Blog75

    IBM 发布 Granite 4.2 推理模型家族:3B、8B、30B 三档开源

    IBM 发布 Granite 4.2 推理模型家族,包含 3B、8B、30B 三个尺寸,均基于 Granite-4.1 基座模型后训练而来,采用多阶段强化学习流水线,其中 8B 和 30B 额外经过智能体强化学习,可在真实沙箱环境中调用工具、编辑代码、操作终端和搜索网页。所有模型均支持思考与非思考模式切换、低努力思考模式及原生工具调用,以 Apache 2.0 协议开源。

    推荐理由:IBM 官方详解 Granite 4.2 推理模型家族的构建过程,读者可借此了解其多阶段强化学习与智能体训练的具体做法。

  2. Mistral AI40

    Mistral 与 HUMAIN 达成战略合作,推动沙特及中东主权 AI 发展

    Mistral 宣布与 HUMAIN 达成战略合作,聚焦 AI 基础设施、先进模型开发及解决方案部署,初期重点涵盖网络安全和语音领域,并计划开发在阿拉伯语上表现优异的前沿模型。双方合作金额达数亿欧元,Mistral 将探索使用 HUMAIN 的数据中心基础设施,并联合制定面向沙特受监管行业的市场策略,以满足主权 AI 需求。

8月21日周五
  1. Hugging Face Blog80

    Hugging Face 研究:语音识别模型存在基准拟合现象,高分模型复现错误转录

    Hugging Face 发布研究,提出三项测试量化语音识别中的基准优化现象,评估 11 个开源 ASR 模型后发现多个高分模型会复现 VoxPopuli 和 LibriSpeech 基准中的错误转录,即使音频与之矛盾或数字被静音。

    推荐理由:原文用三项探针量化了语音识别模型对公开基准的拟合程度,并给出可复现的检测脚本,读者可据此判断模型真实泛化能力。

  2. Hugging Face Blog62

    Liquid AI 发布 LFM2.5-DSpark 草稿模型,推理速度最高提升 3.18 倍

    Liquid AI 发布 LFM2.5 系列三款模型的 DSpark 草稿模型检查点,通过投机解码在 GPU 上实现最高 3.18 倍吞吐提升,端侧最高 2.87 倍,且不改变输出质量。LFM2.5-2.6B 的函数调用延迟平均降低 57%,并已开源支持 llama.cpp 和 SGLang。

    推荐理由:原文给出了三款草稿模型的加速数据和接入方式,读者可据此评估投机解码带来的实际收益。

  3. Microsoft Research62

    微软研究院发布 Skala 1.1,扩展 DFT 精度与软件集成

    微软研究院发布深度学习 DFT 泛函 Skala 1.1,训练数据量为此前版本的 2.5 倍,在 GMTKN55 基准的 55 个类别中 32 项排名第一,加权平均误差为 2.8 kcal/mol,精度超越主流全局杂化泛函。Skala 现已集成至 CP2K,并正在集成到 Psi4、FHI-aims、ORCA 和 VASP,同时推出持续更新的性能基准报告。

    推荐理由:微软研究院发布 Skala 1.1,训练数据扩充 2.5 倍,并推进多款量子化学软件的集成,读者可据此评估其精度与可用性。

8月14日周五
  1. Hugging Face Blog70

    Hugging Face 发布 2026 夏季开源模型生态观察报告

    Hugging Face 发布 2026 年夏季开源模型生态半年报告,覆盖 1 至 8 月的观察。报告指出中国实验室前沿模型规模持续领先,美国厂商则更多通过 AMD、NVIDIA 等硬件公司发布开源模型;下载与点赞反映不同信号,Qwen 以 151,448 个衍生模型成为社区基础模型,小模型占据 83% 的历史下载量,智能体首次成为 Hub 第一大用户。

    推荐理由:报告用 Hub 下载、点赞与衍生模型数据拆解开源生态的结构性变化,可帮助读者理解前沿模型与基础设施之间的真实关系。

  2. Hugging Face Blog62

    Strands Robots 与 Hugging Face Storage Buckets 实现录制、训练、部署一体化数据闭环

    AWS 开源的 Strands Robots SDK 与 Hugging Face Storage Buckets 结合,实现从录制机器人演示、流式训练到部署策略的完整数据闭环。

    推荐理由:原文演示了从录制、存储、流式训练到部署的完整数据闭环,读者可据此评估这套开源工作流是否适合自己的机器人数据采集场景。

8月13日周四
  1. Hugging Face Blog82

    Hugging Face 社区用智能体复现 ICML 2026 论文 2226 篇

    Hugging Face 于 7 月 15 日至 8 月 2 日举办 ICML 2026 开放复现挑战赛,1221 名社区成员使用各自编码智能体复现了 2226 篇论文,占会议论文的 34%,共发布 6816 份 Trackio 日志。

    推荐理由:原文给出了大规模复现实验的完整数据与具体案例,读者可以据此判断AI智能体参与科研评审的实际效果与局限。

8月11日周二
  1. Mistral AI62

    Mistral 推出区域推理端点与优先级层级,并接入第三方开源模型

    Mistral 宣布三项推进 AI 主权的新举措:区域推理端点 Mistral Regional Endpoints 正式可用,允许客户选择推理在欧洲或美国运行;Mistral Priority Tier 进入公开预览,为关键任务负载提供承诺服务级别和可用性 SLA。

    推荐理由:原文给出区域端点、优先级层级和第三方开源模型接入的具体安排,读者可据此评估欧洲主权 AI 基础设施的落地路径。

8月10日周一
  1. Hugging Face Blog85

    Meta 发布开源多模态模型 Muse Glimmer-30B,主打本地智能体场景

    Meta 今日发布 Muse Glimmer,一个从 Muse 蒸馏到 30B 参数的多模态模型,专为本地智能体场景设计,采用 Apache 2.0 许可。模型由 2B 视觉编码器和 28B 文本解码器组成,支持图像、视频输入及多模态工具调用,并附带 DFlash 投机解码加速。

    推荐理由:原文给出架构细节、基准对比和本地部署路径,读者可据此评估它在端侧智能体场景的适用性。

8月6日周四
8月4日周二
  1. Mistral AI70

    Mistral 发布 3B 开源多模态安全审核模型 Shieldstral

    Mistral 发布 Shieldstral,一个 3B 开源多模态安全审核模型,在文本安全上匹配最高 7 倍规模的模型,并在多模态审核上达到新 SOTA。它把内容审核建模为策略自适应问答,推理时用自然语言问题定义策略,无需重训即可统一审核文本和图像,返回校准的安全分数。模型以 Apache 2.0 开源,可在单张 16GB NVIDIA GPU 上运行。

    推荐理由:原文给出了把内容审核建模为策略自适应问答的思路,读者可以据此判断这种免重训的审核方式是否适合自身场景。