Engram 采样器:将 AI 幻觉变成音乐
音乐初创公司 Thoughtful Things 为旗下首款乐器 Engram 发起 Kickstarter 众筹。这是一款采样器与律动工作站,利用本地运行的“微型 AI”处理输入音频,甚至能幻觉出全新声音,旨在探索实验性音色而非生成流行歌曲。其模型基于仅含商用授权音频的开放数据集自研训练,公司计划开源固件,众筹限量版起价 $675。
音乐初创公司 Thoughtful Things 为旗下首款乐器 Engram 发起 Kickstarter 众筹。这是一款采样器与律动工作站,利用本地运行的“微型 AI”处理输入音频,甚至能幻觉出全新声音,旨在探索实验性音色而非生成流行歌曲。其模型基于仅含商用授权音频的开放数据集自研训练,公司计划开源固件,众筹限量版起价 $675。
Mistral 在慕尼黑开设新中心,聚焦 Physics AI 与工业 AI,并直接服务企业合作伙伴。该中心将组建 Physics AI 和工业 AI 专项研究团队,并与宝马、西门子能源及慕尼黑工业大学合作。Mistral 计划到 2030 年建成 1 吉瓦欧洲算力,其开放权重架构支持模型在客户自有基础设施上运行,数据不离开组织。
gpt-load 发布 v2.0.0-rc.37,新增 Mistral 原生路由支持,并修复了 bifrost 协议下 provider base URL 语义不一致的问题。2.x 为全新重写版本,与 1.x 数据不兼容,需使用全新数据库和新的 encryption.key 部署。
Hugging Face 发布 Holo4 系列智能体模型,含 27B dense 和 35B-A3B MoE 两个尺寸,均已在 H Models API 上线,并同步开源 Holotron4 Nano。
推荐理由:原文给出了新模型的双尺寸、跨界面能力和开源轨迹数据,读者可据此评估它在真实业务工作流中的性价比。
LiteLLM v1.104.0-rc.1 发布,所有 Docker 镜像均使用 cosign 签名,并支持通过固定提交哈希或发布标签进行签名验证。该版本还包含多项修复,如 Azure code_interpreter 容器文件测试覆盖、预算 Redis 管道同步读取修复,以及将 SDK 回调迁移至 Langfuse v4。
LiteLLM v1.103.0 发布,所有 Docker 镜像均使用 cosign 签名,并支持通过固定 commit hash 或 release tag 进行签名验证。
Apache APISIX 发布 3.19.0 版本,由 shreemaan-abhishek 于 9 月 28 日发布。该版本包含多项更新,具体变更内容需查看标签对比或发布说明。
OpenAI 正在收集使用 Codex 的开发者、研究者与创作者的真实故事,邀请他们参与 Codex Originals 项目下一篇章。如果你希望成为其中一员,可通过下方表单分享你的项目经历。
Simon Willison 在 WeAreDevelopers 大会闭幕演讲中回顾了2026年AI行业的关键趋势。年初 Claude Opus 4.5 和 GPT-5.1 让编码智能体变得可靠,随后 OpenClaw 掀起个人智能体热潮,开源模型如 Qwen 3.8 27B 已能在笔记本上接近前沿水平。
推荐理由:作者以亲历者视角梳理2026年AI行业关键趋势,从编码智能体成熟到开源模型崛起,适合快速把握一年脉络。
针对 Bluesky 上日益增多的自动回复机器人,Simon Willison 用 Opus 5.5 通过 vibe coding 开发了一款检测工具。该工具通过分析账户回复速度、是否从不发布原创内容以及回复中是否含问号等信号,识别疑似回复机器人。Bluesky 仍提供免费可用的 API,使这类调查成为可能。
gpt-load 发布 v2.0.0-rc.36,新增 Cline API key 通道支持,并将 guardrails 的审查限制为一次有界 JEV 调用。2.x 为全新重写版本,与 1.x 数据不兼容,需以全新数据库和新的 encryption.key 部署。
gpt-load v2.0.0-rc.35 发布,修复网关实时日志与 teardown 绑定问题,并优化 guardrails 对不透明内容的过滤及审查失败处理。2.x 为全新重写版本,与 1.x 数据不兼容,需以全新数据库和新的 encryption.key 部署。
gpt-load 发布 v2.0.0-rc.34,2.x 为全新重写版本,与 1.x 数据不兼容,需以全新数据库和新的 encryption.key 部署。本次更新为网关新增语音模式和实时通话重试,恢复 WebSocket 错误恢复,并为渠道新增七个兼容预设及 OpenCode Go 和 Zen 预设。
gpt-load 发布 v2.0.0-rc.33,新增 Gemini 原生嵌入协议、Codex 实时语音中继,并改进访问密钥控制台。该版本为 2.x 重写版,与 1.x 数据不兼容,需以全新数据库和新的 encryption.key 部署。
Langfuse v4.46.0 发布,新增基础技能管理、数据集条目 JSON 格式化,并为追踪表格增加 100 行分页选项。该版本还优化了 trace 播放功能移除、图表改进及多项界面修复,并将数据集运行项读取路由至只读副本以提升性能。
Langfuse 发布 v4.45.3,主要包含多项修复:更新 image-size 依赖至 2.0.4,API key 查找失败时记录公钥,拒绝以 /systemone 结尾或含查询字符串的 TypeSafe 基础 URL,切换上游时保留自定义 TypeSafe 基础 URL,以及修复 evals 中决策模型的选择与去重问题。
LiteLLM v1.104.0-dev.2 发布,所有 Docker 镜像均使用 cosign 签名,可通过固定 commit hash 或 release tag 验证签名。本次更新同步了 Google Gemini、OpenAI、AWS Bedrock、Vertex AI 等多家模型价格,并修复了 Bedrock 流式传输、Claude Opus 4.7/4.8 强制工具调用等问题。
LiteLLM v1.100.3 发布,所有 Docker 镜像均使用 cosign 签名,并支持通过固定 commit hash 或 release tag 进行签名验证。该版本还通过 backport 合并了 #39631、#39729、#40639 三个 PR 至 stable/1.100.x 分支。
Latent Space 发布本周 AI 新闻汇总,涵盖多家前沿实验室的新模型发布与价格调整,包括 Claude Opus 5.5、GPT-6 系列、Gemini 3.8 Flash 及小米 MiMo-V2.6-Pro 等,并提及 TypeSafe AI 以 100 亿美元估值融资等动态。
Liquid AI 发布 LFM2.5-VL-3B 的实验性 DSpark 草稿模型,通过投机解码在几乎不增加内存的前提下提升推理速度,解码加速最高达 3.13x(设备端)和 2.66x(H100),端到端提升最高 2.62x 和 2.27x。
推荐理由:原文给出了解码加速倍数、内存开销和三种推理框架的接入方式,读者可据此评估端侧视觉模型的推理收益。
NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,通过 AlphaFold Database 开放了 2800 多种病毒的蛋白复合物预测 3D 结构,供全球任何科学家使用。
推荐理由:原文给出了数据集规模、开放入口和可复用的推理流程,读者可据此评估它对病毒研究和疫情准备的实际价值。
Langfuse v4.45.1 发布,修复了 PieChart 颜色与其他图表不一致的问题,并更新了评分测试逻辑。该版本还为 TypeSafe 连接新增了默认及自定义模型支持。
Meta 在 Connect 2026 上以个人智能体 Muse 为核心,推出语音与实时视频、Mac 电脑使用、Muse Mail 及 1500+ 连接器,并发布 Ray-Ban Meta Gen 3、售价 1299 美元的 Meta VR Glasses 和 12 月发货的 Muse Charm。
推荐理由:Meta Connect 2026 的完整梳理,涵盖硬件、智能体、语音与收购,可作了解 Meta 全栈布局的入口。
NVIDIA 发布教程,讲解如何用 NVIDIA Warp 与 MuJoCo Warp(MJWarp)将 SO-101 机械臂场景从单世界 CPU 仿真迁移到最多 2048 个并行 GPU 环境。文章覆盖单世界校验、批量分配、容量调优与吞吐测量,并给出 pip install warp-lang 与 mujoco-warp 的安装入口。
推荐理由:原文给出从单世界 MuJoCo 迁移到 2048 并行 MJWarp 环境的完整步骤,读者可直接照做并复现吞吐测量。
LibreChat v0.8.8-rc4 发布,新增 GPT-6 Sol、GPT-6 Luna 和 Claude Opus 5.5 支持,并引入 Open Responses API 的调用方执行工具。
NVIDIA AI Day Singapore 于 9 月 22-23 日在新加坡莱佛士城会议中心举行,NVIDIA 与合作伙伴展示东南亚地区的 AI 突破。
Simon Willison 发布 llm 0.36 版本。该版本更新内容未在原文中详细说明,仅提及这是其月度简报的一部分,简报每月汇总最重要的 LLM 发展动态,赞助费用为 $10/month。
NVIDIA 在 ROSCon 大会上发布 Isaac ROS 5.0,这是一套基于 ROS 的 GPU 加速开源包,新增智能体工作流和平台支持,帮助开发者更快构建、定制和部署机器人应用。
推荐理由:原文给出了 Isaac ROS 5.0 的智能体工作流、ROS Lyrical 支持和生态伙伴落地案例,读者可据此判断它如何加速机器人开发。
oMLX 创建者及维护者 Jun Kim 加入 Hugging Face,以支持 MLX 社区。oMLX 将保持 Apache 2.0 开源协议,并由 Jun 继续主导开发,从兼职项目升级为全职维护项目,有望带来更稳定的发展和更快的迭代。Hugging Face 希望 oMLX 成为新想法的试验场,并加速 transformers 模型定义到 MLX 实现的转换。
Hugging Face 在 transformers 中加入对 GGUF 模型的高效运行支持,通过复用 ggml 的 Metal 内核,可在 Apple Silicon 上以熟悉的 from_pretrained 接口加载并生成。
推荐理由:原文给出了 GGUF 加载方式、性能对比和当前限制,读者可以据此判断在 transformers 里跑本地量化模型的可行性与适用场景。
英国 AI 安全研究所(AISI)开始通过 EvalEval 的 Evaluation Cards 平台公开共享评估结果,以提升评估科学的可复现性与可验证性。
Cloudflare 宣布 Python Workers 正式全面可用,Python 成为其开发者平台的一等支持语言。该实现通过 Pyodide 将 Python 编译为 WebAssembly 在基于 V8 的 workerd 运行时中运行,但多进程和多线程在 WebAssembly 虚拟机中不可用。
Open WebUI 发布 v0.11.4,slim 镜像缩减至约 175 MB,比上一版小 89%,标准镜像也减少约 170 MB。新版本新增终端技能、模型背景图、聊天内创建技能、终端标签页、文件夹上传、并排文件对比等功能,并包含多项安全修复,官方建议生产环境尽快升级。
埃及AI生态正从潜力走向规模化生产,NVIDIA在开罗举办活动展示其全栈AI方案。过去一年,NVIDIA深度学习学院在埃及的学习者数量增长超十倍;Hassan Allam Data Centers获许可建设数据中心,预计投资4亿美元。非洲一年内新增四座AI工厂,另有656兆瓦容量在建,Cassava Technologies等企业正推动本地化AI基础设施部署。
new-api v1.0.0-rc.40 发布,将任务插件源码上传上限提高到 8 MiB,并接受上游 201/202 等 2xx 状态码,避免任务被误判失败。该版本还修复了定价配置在插件收窄选项后仍可编辑、Claude/Responses 工具结果图片按图片而非文本发送等问题。
NVIDIA 提出 AI 安全本质是工程问题,需在智能体栈的每一层(模型、工具、运行时环境)落实可执行的安全边界、责任人与防护证据。NVIDIA 开源 OpenShell 安全运行时,在智能体触及范围之外强制策略并提供沙箱执行;Cisco DefenseClaw、JFrog 等合作伙伴正基于 OpenShell 构建治理与技能扫描层。
Multiverse Computing 发表论文,将大语言模型的块删除(深度剪枝)重构为约束二元优化问题,映射到伊辛玻璃自旋系统,用能量作为下游性能的廉价代理,从而无需逐一基准测试即可筛选大量候选配置。
推荐理由:把剪枝块选择映射为伊辛玻璃能量最小化,用物理求解器处理组合问题,在深度压缩下显著领先现有方法。
new-api v1.0.0-rc.38 发布,系统设置新增请求策略,可集中配置请求检查、会话与重试、渠道健康,并在使用日志中记录策略决策。渠道新增 vLLM、SGLang 支持,并可按渠道开启 Responses WebSocket 与 OpenAI 兼容对话。该版本仍不推荐用于生产环境,从 v1.0.0-rc.26 或更早版本升级的用户需重新配置所有视频模型价格。
GitHub 用 Copilot 将 Copilot 运行时从 TypeScript 重写为超过 80 万行生产 Rust,历时约 14.5 周,由一名开发者主导完成。重写采用组件级就地替换策略,性能提升数个数量级,并新增 C ABI 支持进程内嵌入。
推荐理由:原文给出了用 Copilot 自身完成大规模 Rust 重写的完整过程与数据,读者可据此评估 AI 辅助重写的可行性与工程方法。
Mistral 宣布与 Mozilla 合作,为 Firefox 的 AI 浏览助手 Smart Window(测试版)提供模型支持,初期覆盖法国和北美用户,英国和德国预计今年晚些时候跟进。双方强调开源、隐私与用户控制,对话默认不保存在 Mozilla 服务器,合作伙伴同意零数据留存。
推荐理由:原文给出了合作范围、地区上线顺序和隐私默认设置,读者可据此判断开源模型进入浏览器助手后的实际形态。