GPT-6 Sol 与 GPT-6 Luna 在 Amazon Bedrock 上正式可用
OpenAI 的 GPT-6 Sol 和 GPT-6 Luna 现已在 Amazon Bedrock 上正式可用,两者 API 定价均显著低于 GPT-5.6 前代。
推荐理由:原文给出了两款模型的分工定位、降价幅度和提示词缓存能力,读者可据此判断如何按负载匹配模型。
OpenAI 的 GPT-6 Sol 和 GPT-6 Luna 现已在 Amazon Bedrock 上正式可用,两者 API 定价均显著低于 GPT-5.6 前代。
推荐理由:原文给出了两款模型的分工定位、降价幅度和提示词缓存能力,读者可据此判断如何按负载匹配模型。
Simon Willison 发布 llm-anthropic 0.29,这是其 llm 命令行工具(版本 635)的 Anthropic 插件更新(版本 342)。该版本面向使用 Claude 模型的开发者,具体变更内容未在原文中详述。
Simon Willison 为 LLM 构建了新插件 llm-typesafe,以支持 TypeSafe AI 的 Jev 模型。
NVIDIA 在 ROSCon 大会上发布 Isaac ROS 5.0,这是一套基于 ROS 的 GPU 加速开源包,新增智能体工作流和平台支持,帮助开发者更快构建、定制和部署机器人应用。
推荐理由:原文给出了 Isaac ROS 5.0 的智能体工作流、ROS Lyrical 支持和生态伙伴落地案例,读者可据此判断它如何加速机器人开发。
GPT-6 Astra 使 Parallel 的智能体在研究和综合劳动力市场数据时,时间和成本均较此前模型降低一半。该结果来自 Parallel 的实际应用,体现了新模型在数据密集型任务上的效率提升。
LibreChat 发布 chart-2.0.13 版本,要求使用命名 Helm 凭据密钥,并更新文档以阐明 Helm 凭据注入和 Meilisearch 密钥的相关说明。
Hugging Face 在 transformers 中加入对 GGUF 模型的高效运行支持,通过复用 ggml 的 Metal 内核,可在 Apple Silicon 上以熟悉的 from_pretrained 接口加载并生成。
推荐理由:原文给出了 GGUF 加载方式、性能对比和当前限制,读者可以据此判断在 transformers 里跑本地量化模型的可行性与适用场景。
Open WebUI 发布 v0.11.4,slim 镜像缩减至约 175 MB,比上一版小 89%,标准镜像也减少约 170 MB。新版本新增终端技能、模型背景图、聊天内创建技能、终端标签页、文件夹上传、并排文件对比等功能,并包含多项安全修复,官方建议生产环境尽快升级。
new-api v1.0.0-rc.40 发布,将任务插件源码上传上限提高到 8 MiB,并接受上游 201/202 等 2xx 状态码,避免任务被误判失败。该版本还修复了定价配置在插件收窄选项后仍可编辑、Claude/Responses 工具结果图片按图片而非文本发送等问题。
relaykit v0.2.1 发布,本次更新包含一个针对 Claude tool_result 的修复,并感谢了 #7444 的作者。该提交已通过验证签名,附带 2 个资源文件。
Higgsfield AI 借助 GPT-6 Astra 在一天内推出新视频功能,让小型企业更轻松地制作视频广告,并加速新创意工具上市。该合作显著缩短了从构思到上线的周期,提升了产品迭代速度。
OpenAI Academy 推出面向员工、开发者、领导者、教育者和学生的新学习路径,帮助用户构建并展示实用 AI 技能。这些路径覆盖不同角色需求,旨在提升各领域人群的 AI 应用能力。
Hugging Face 发布 tokenizers v1 的候选版本,编码路径比 v0.23 快 3 到 30 倍,在 Apple M4 Max 上八线程扩展效率为线性扩展的 76%,且输出 token ID 与旧版完全一致。
推荐理由:原文给出了 v1 相比 v0.23 的编码提速幅度和实现原理,读者可据此判断升级收益与适用场景。
V7 利用 GPT-5.6 将散落的公司文件转化为智能体可用的上下文,以完成复杂且可溯源的工作。该方案使成本降低 78%,同时提升了准确性。
new-api v1.0.0-rc.39 发布,任务插件现已兼容 OpenAI Images,可承接 `/v1/images/generations` 和 `/v1/images/edits` 请求。阿里云百炼万相图片模型改走任务插件,豆包 Seedream 图片生成已接入。额度设置新增钱包免预扣门槛和输入预扣倍率,余额足够时可跳过预扣。
new-api v1.0.0-rc.38 发布,系统设置新增请求策略,可集中配置请求检查、会话与重试、渠道健康,并在使用日志中记录策略决策。渠道新增 vLLM、SGLang 支持,并可按渠道开启 Responses WebSocket 与 OpenAI 兼容对话。该版本仍不推荐用于生产环境,从 v1.0.0-rc.26 或更早版本升级的用户需重新配置所有视频模型价格。
Pawprint Studio 的开放世界抓宠 RPG《Aniimo》本周登陆 GeForce NOW,玩家无需等待 45GB 下载即可在 Steam Deck、Firefox 浏览器等设备上串流游玩。
Cooley 基于 ChatGPT Work 构建了 GO Public,将智能引入 IPO 流程,帮助律师更早发现问题,并将判断力聚焦于最关键环节。
OpenAI 发布 Astra for Law,为法律行业带来前沿智能、定制化律所工作流、连接的法律数据源,以及面向机密客户工作的法律级控制。该产品旨在将前沿 AI 能力深度融入法律实务场景。
OpenAI 推出全新 AI 驱动广告体验,包括 Sponsored Agents、面向营销人员的工具,以及与 HubSpot 和 Shopify 的集成。这些功能旨在将 AI 智能体直接融入广告投放与营销工作流,帮助品牌更高效地触达用户并优化转化效果。
Hex 的数据智能体利用 GPT-6 Astra 将分析结果转化为交互式可视化报告,让员工更乐于分享。该功能旨在简化复杂数据分析流程,提升报告的可读性与传播效率。
LibreChat v0.8.8-rc3 发布,重点推出实验性的 Bring-Your-Own-Machine(BYOM)功能,用于可扩展编码智能体,并新增 GPT-6 Astra 支持、Agent/Skills CRUD API 改进、Conversation Trace Viewer 及子智能体文件共享。
LibreChat 发布 Helm chart 2.0.12,本次更新为常规版本号递增(chore),无功能变更说明。该版本已通过 GitHub 验证签名,可用于部署或升级 LibreChat 应用。
Fyxer 借助 OpenAI 模型、微调、记忆机制和真实用户反馈,为用户整理收件箱并按个人语气起草邮件。该系统通过持续学习用户偏好,提升回复的个性化与可信度,从而赢得用户对 AI 行政助理的信任。
Perplexity 已采用 GPT-6 Astra 处理通信撰写、软件变更及生产系统监控等端到端任务。相比早期模型,Perplexity 对 Astra 的检查频率大幅降低,表明其对该模型的自主能力信任度显著提升。
GPT-6 Astra 提升了 Devin 的软件测试与验证能力,目标是让工程师减少代码审查工作量、加快交付速度。
new-api v1.0.0-rc.37 推出定价配置功能,可将旧定价转为计费表达式草稿,并支持按条件、按次、按时间及图片用量/缓存计价,为 gpt-image-2、gpt-image-2.5-sunburst、gpt-image-2.5-flare 提供内置计费表达式默认值。
OpenAI 在 ChatGPT Work 中推出 Data agent,用户可通过自然语言连接公司数据、挖掘洞察并构建交互式仪表盘。该功能旨在让非技术用户也能直接对业务数据进行分析与可视化,无需编写代码或依赖数据团队。
Dify v1.17.1 发布,知识库服务 API 密钥现可绑定至特定数据集,越权访问返回 403,现有密钥保持工作区级行为不变。工作流画布节点与评论支持键盘移动,插件作者获得公开主页,Markdown 表单字段名长度上限可通过环境变量配置。自托管用户需注意:内置 Weaviate 须从 1.27.0 手动分阶段升级至 1.39.2,跳过中间版本可能导致向量搜索永久损坏。
done-hub 发布 v1.23.22 版本,主要修复了 Gemini 地图相关功能。该版本已通过 GitHub Releases 提供下载。
OpenAI 发布 ChatGPT for Financial Services,将内置金融数据与 GPT-6 Astra 结合,用于研究、建模和客户材料生成。该产品面向金融服务场景,旨在提升相关工作的效率与产出质量。
OpenAI 将 GPT-Live-1 引入 API,支持全双工自然语音对话,具备更强的指令遵循能力、自定义语音和电话支持。开发者可通过 API 直接构建更流畅的实时语音交互体验。
OpenAI 推出 Agents API,这是一项托管服务,由 Codex harness 提供编排、长时间运行会话和工具使用能力,用于构建和启动云端智能体。
推荐理由:原文给出了 Agents API 的定位与核心能力,读者可据此判断它如何简化云端智能体的构建与部署。
done-hub v1.23.21 发布,本次更新修复了 codex 镜像问题。该版本已通过 GitHub Releases 提供下载,包含 2 个资源文件。
Google DeepMind 发布 AlphaGenome Atlas 平台,包含人类基因组中 90 亿个单核苷酸变异的分子效应预测,并推出 AVI 评分用于快速排序变异影响。该平台以 1PB 数据集形式提供,面向学术研究免费开放,可通过网站门户、AlphaGenome API 及 Google Antigravity 技能访问,商业用途即将在 Google Cloud 上线。
推荐理由:原文给出了覆盖全基因组 90 亿单核苷酸变异的预测平台及其开放入口,读者可据此判断它在罕见病和复杂性状研究中的可用范围。
OpenAI 发布 ChatGPT Images 2.5,可将想法、草图与参考照片转化为更个性化、更精致的图像,以更好地反映用户意图。
GitHub 推出 Project HydraFusion 研究预览,通过运行时编排在多个提供商的模型中选择执行计划,以平衡质量、成本与延迟。它支持 Single、Cascade、Critique 三种执行模式,在 TerminalBench 2.1 上相比 Claude Opus 5 提升 4.9 个百分点且成本降低 67%。
推荐理由:原文给出了多模型编排的三种执行模式与基准测试结果,读者可据此判断它在质量与成本之间的取舍。
Playco 基于 GPT-6 Astra 从同一灰盒基础构建了三款主题游戏原型,手动修复量较上一代模型减少 50%。
Legora 借助 GPT-6 Astra 在几分钟内完成 41 份文档的审阅,找出了全部四个预设错误,并在该财务审阅工作流中将性能提升近 40%。
Hugging Face 发布开源工具 funes,为 Claude Code、Codex、pi 和 Hermes 等编码智能体提供本地持久记忆层。它从智能体已有会话日志构建索引,支持 recall 和 get 工具,默认本地运行,也可绑定到私有 Hugging Face 数据集跨机器共享。基准测试显示 recall 比手写交接便宜 8 倍和 4 倍。
推荐理由:原文给出了安装命令、跨智能体记忆机制和基准对比,读者可据此判断它能否解决自己切换智能体时丢失上下文的问题。