跳到正文

#教程/实践

今日 2 条
今天9月29日周二
9月28日周一
  1. AWS Machine Learning Blog38

    跨账户自动化管理 Amazon Textract 适配器生命周期

    AWS 发布跨账户自动化管理 Amazon Textract 适配器生命周期的解决方案,涵盖适配器提升、文档路由与生产安全三大挑战。通过将适配器 ID 外部化到 AWS Systems Manager Parameter Store,更新生产引用可实现零停机、无需重新部署应用,将原本耗时数小时或数天的协调工作缩短至数秒。

  2. Simon Willison40

    Bluesky 回复机器人检测工具

    针对 Bluesky 上日益增多的自动回复机器人,Simon Willison 用 Opus 5.5 通过 vibe coding 开发了一款检测工具。该工具通过分析账户回复速度、是否从不发布原创内容以及回复中是否含问号等信号,识别疑似回复机器人。Bluesky 仍提供免费可用的 API,使这类调查成为可能。

9月27日周日
9月26日周六
  1. GitHub Blog · AI & ML50

    GitHub Copilot app 初学者指南:如何用 canvases 构建自定义工作流

    GitHub Copilot app 的 canvases(画布)功能让用户无需编码即可通过 /create-canvas 技能用自然语言描述需求,生成可共享的看板、发布清单、仪表盘等自定义界面。画布支持双向交互,用户和智能体可同时更新卡片、字段或按钮,且无需单独同步步骤。创建后的画布可保存为扩展供团队或个人复用,社区还通过 Awesome Copilot 分享了现成的画布扩展。

  2. AWS Machine Learning Blog38

    AWS 如何用 EKS、EFA 与 DeepEP 将 MoE 强化学习吞吐提升 40%

    AWS 提出一种结合 Amazon EKS、EFA 与 DeepEP 的架构,用于加速大规模 MoE 模型的强化学习后训练,吞吐量提升 40%。该方案重点优化专家并行(EP)带来的动态 all-to-all 通信,并协调 rollout 生成与策略训练之间的异构算力需求。文章分析了 RL 训练在算力、内存与网络带宽上的三重挑战,以及 PPO 与 GRPO 两类流程的共性基础设施压力。

  3. AWS Machine Learning Blog57

    NarrateAI 在 Amazon Bedrock 上的生产级 LLM 质量保障实践

    AWS 机器学习博客发布 NarrateAI 系列第二篇,详解在 Amazon Bedrock 上实现生产级 LLM 质量保障的五项技术:自适应流水线编排、跨账户多模型故障转移、实时流式评估、复合评估框架和数据准确性验证。该系统为超过 4,000 名 AWS 高管提供商业智能服务,实测数值准确率约 99%,流式响应约 13 秒开始输出,相比顺序评估延迟降低 86.8%。

9月25日周五
9月24日周四
  1. Hugging Face Blog62

    NVIDIA 教程:用 Warp 与 MJWarp 将 MuJoCo 机器人仿真扩展到 2048 并行环境

    NVIDIA 发布教程,讲解如何用 NVIDIA Warp 与 MuJoCo Warp(MJWarp)将 SO-101 机械臂场景从单世界 CPU 仿真迁移到最多 2048 个并行 GPU 环境。文章覆盖单世界校验、批量分配、容量调优与吞吐测量,并给出 pip install warp-lang 与 mujoco-warp 的安装入口。

    推荐理由:原文给出从单世界 MuJoCo 迁移到 2048 并行 MJWarp 环境的完整步骤,读者可直接照做并复现吞吐测量。

  2. GitHub Blog · AI & ML60

    GitHub Copilot 应用如何渲染超大 Pull Request

    GitHub Copilot 应用重构了 Pull Request 视图,以应对 2200 个文件、超百万行改动和 400 多条评论的极端场景。方案将文档高度拆分为确定性代码高度与动态块高度两个独立域,用单次空闲与滚动门控的测量通道替代逐块 ResizeObserver,并通过按身份而非像素的滚动锚定避免跳动。团队还构建了自主的变更、测量、改进循环,用真实信号自动定位性能问题。

    推荐理由:原文拆解了超大 diff 渲染的虚拟化、测量调度与滚动锚定方案,读者可借鉴其工程取舍。

  3. AWS Machine Learning Blog62

    AWS 教程:用 Amazon Bedrock 上的开源权重模型运行 OpenCode 编码智能体

    AWS 发布教程,介绍如何用 Amazon Bedrock 上的开源权重模型运行 OpenCode 编码智能体。OpenCode 是 Go 编写的终端原生 AI 编码智能体,支持 75 多个 LLM 提供商,推理在 AWS 账户内安全进行,无按席位费用。

    推荐理由:原文给出了在 Bedrock 上运行 OpenCode 的完整配置方法,读者可以据此搭建多模型编码工作流。

9月21日周一
9月16日周三
9月15日周二
  1. NVIDIA Blog62

    费城儿童医院如何用开源 NVIDIA AI 在数秒内完成儿童心脏建模

    费城儿童医院(CHOP)基于 NVIDIA 联合发起的开源医学影像框架 MONAI,将儿童心脏建模从原先需要熟练研究员四小时的工作缩短到数秒,已用于先天性心脏病手术规划。

    推荐理由:原文展示了开源AI工具如何把心脏建模从四小时压缩到秒级,并推动多家儿童医院落地,读者可借此理解开源生态在罕见病医疗中的实际价值。

9月12日周六
  1. GitHub Blog · AI & ML60

    GitHub 日本韩国市场负责人:用 GitHub Copilot 把活动运营从策划到跟进全流程自动化

    GitHub 日韩市场负责人 Tomoko Tanaka 分享如何用 GitHub Copilot 将活动运营自动化:从单个 GitHub Issue 自动搭建落地页、生成 UTM 链接、每日筛选报名者,到会后用 /lead-upload 和 /event-report 两个斜杠命令完成 CRM 上传和报告。

    推荐理由:作者用 GitHub Copilot 把活动运营流程自动化,给出了从 Issue 表单到 Skills 的完整可迁移方法。

9月11日周五
  1. GitHub Blog · AI & ML43

    GitHub Copilot app 入门:用 diff、终端和浏览器面板审查 AI 代码

    GitHub Copilot app 新增内置 diff、终端和浏览器面板,让用户无需离开应用即可审查、运行并预览智能体对代码的改动。diff 面板以红绿高亮显示增删行,支持接受或评论;终端面板可直接运行项目命令,浏览器面板配合 Pick & Polish 工具可迭代调整界面元素。完成审查后可直接在应用内接受改动并创建 pull request。

9月10日周四
  1. Hugging Face Blog78

    AsyncGRPOTrainer 结合 LoRA 跨 HF Jobs 训练:用存储桶同步适配器,无需 NCCL

    Hugging Face 博客介绍如何用 AsyncGRPOTrainer 结合 LoRA 在 HF Jobs 上跨节点训练,通过 Storage Bucket 同步适配器而非 NCCL,并用代理路由请求。500 步训练从 3 小时 27 分钟优化到 53 分钟,速度提升 3.9 倍,代码已开源。

    推荐理由:原文给出了完整的架构、代码和调优过程,读者可以据此复现跨节点 LoRA 异步强化学习训练。

9月9日周三
  1. Mistral AI62

    Mistral 用 AI 智能体将 4 万行 Fortran 77 迁移到 C++ 的实践

    Mistral 帮助一家欧洲能源运营商将 4 万行 Fortran 77 物理模拟器迁移到 C++,并总结了可复用的方法。项目先构建数值一致性校验框架,再用 Vibe CLI 生成调用树并派上百个智能体整理文档,最后采用人工把关的规划、编码、测试、审查智能体工作流逐模块迁移。

    推荐理由:原文给出了用智能体迁移遗留代码的完整工作流和三条可复用原则,读者可直接借鉴到同类项目。

9月4日周五
  1. GitHub Blog · AI & ML38

    GitHub Copilot app 入门:如何同时运行多个智能体

    GitHub Copilot app 支持在同一项目上并行运行多个 AI 智能体会话,每个会话独立执行任务、互不干扰,并拥有各自的 Git worktree 和上下文,用户可随时切换且无需重新解释。通过 sessions view 可同时跟踪多个任务进度,例如在示例仓库 tailspin-toys 中并行实现 funded sort 功能、可访问性审查和测试运行,从而减少等待和上下文切换时间。

9月3日周四
  1. Hugging Face Blog62

    用100步GRPO微调350M模型,IFStruct结构化输出从22.6%提升至29.7%

    Hugging Face 发布公开教程,用 TRL 库对 LFM2.5-350M 做约500样本、100步的 GRPO 微调,在 IFStruct 基准上从22.6%提升至29.7%,其中 JSON 通过率从18.0%升至31.9%。整套流程可在免费版 Colab 或 Kaggle GPU 上运行,评估可在 MacBook 上通过 llama.cpp 完成,代码已开源在 GitHub。

    推荐理由:给出了一套约500样本、100步的轻量GRPO微调配方,读者可据此低成本提升小模型的结构化输出合规率。

  2. Hugging Face Blog62

    用 TRL 和 OpenEnv 训练编码模型画水彩:完整开源复现

    作者用 TRL 和 OpenEnv 复现了 Surya Narreddi 的用语言模型写 JavaScript 画水彩的项目,并开源了参考数据集、RL 环境、训练脚本和训练好的模型。

    推荐理由:作者用 TRL 和 OpenEnv 完整复现了用代码画水彩的 RL 训练流程,并开源全部数据集、环境和模型,读者可据此复现或改造。

8月26日周三
8月21日周五
8月18日周二
  1. Hugging Face Blog62

    Dharma AI 发布约束感知 GPU 分配器:同集群利用率提升 33 个百分点

    Dharma AI 构建了约束感知 GPU 分配器,并在七个基准场景中与 FIFO 调度器对比,相同硬件和负载下 GPU 利用率最高提升 33 个百分点,优先级加权输出平均提升 52%。分配器将实时推理需求视为曲线而非峰值预留,按优先级跨整个时间轴放置批处理作业,并在 1 到 2 毫秒内完成调度。文章还介绍了训练、量化等负载的专用预测器,以及 24 小时优化、每 30 到 60 分钟重跑的机制。

    推荐理由:原文给出了约束感知 GPU 分配器相对 FIFO 的实测收益和实现思路,读者可据此评估调度顺序优化对集群利用率的实际影响。

8月14日周五
  1. Hugging Face Blog62

    Strands Robots 与 Hugging Face Storage Buckets 实现录制、训练、部署一体化数据闭环

    AWS 开源的 Strands Robots SDK 与 Hugging Face Storage Buckets 结合,实现从录制机器人演示、流式训练到部署策略的完整数据闭环。

    推荐理由:原文演示了从录制、存储、流式训练到部署的完整数据闭环,读者可据此评估这套开源工作流是否适合自己的机器人数据采集场景。

7月10日周五
7月6日周一
  1. Hugging Face Blog62

    Photoroom 详解 PRX 图像模型的数据策略:从数据源到去重过滤的完整管线

    Photoroom 发布 PRX 系列第四篇博客,详解其图像生成模型 PRX 的预训练数据策略。数据管线混合公开与内部数据集,用 VLM 重写长标题,以 Lance 构建、MDS 流式训练,并采用 JPEG 质量 92 存储、感知哈希去重和基于标题的轻量过滤。作者对比了多个标题生成模型,最终选用 Qwen3-VL-8B,并分享了碎片化、跳过列表等工程经验。

    推荐理由:Photoroom 公开了 PRX 图像模型预训练数据管线的完整设计,从数据源、重写标题到去重过滤,读者可据此复现或改进自己的数据流程。

5月16日周六
  1. Google DeepMind78

    Google DeepMind 详解 WeatherNext 如何帮助美国国家飓风中心提前五天预测飓风 Melissa 登陆牙买加

    Google DeepMind 发布文章,介绍其 AI 天气模型 WeatherNext 在 2025 年飓风 Melissa 中帮助美国国家飓风中心(NHC)提前五天以 80% 置信度预测其将以五级强度登陆牙买加,三天前置信度升至接近 100%。

    推荐理由:原文展示了 WeatherNext 在飓风预报中的实际应用与验证数据,读者可据此了解 AI 天气模型如何辅助官方预警决策。

3月11日周三
  1. Mistral AI62

    Mistral 用 Vibe 构建自动写 RSpec 测试的智能体

    Mistral 基于开源编码助手 Vibe 构建了一个自主智能体,自动为 Rails 代码库生成或改进 RSpec 测试,并在 CI/CD 中无人干预运行。它通过 AGENTS.md 提供分步执行计划、按文件类型拆分技能文件,并加入 RuboCop 和 SimpleCov 自定义工具强制验证。

    推荐理由:原文给出了用 AGENTS.md、技能文件和自定义工具构建测试智能体的完整方法,读者可直接迁移到自己的项目。

1月22日周四
  1. Mistral AI62

    Mistral AI 复盘 vLLM 内存泄漏排查:从 Heaptrack 到 GDB 定位 UCX 根因

    Mistral AI 发布工程深度复盘,记录其在 vLLM 预填充/解码分离部署中排查内存泄漏的过程。问题表现为生产流量下系统内存以每分钟 400 MB 线性增长,最终通过 pmap、BPFtrace 和 GDB 定位到 UCX 的 mmap 钩子机制导致匿名内存区域持续增长。设置 UCX_MEM_MMAP_HOOK_MODE=none 即可解决,相关修复已合并进 vLLM 仓库。

    推荐理由:Mistral AI 完整复盘了 vLLM 内存泄漏的排查链路,从 Heaptrack 到 BPFtrace 再到 GDB,读者可复用这套方法论定位依赖层隐藏问题。

8月1日周五
4月9日周三
  1. Mistral AI38

    Mistral 评估 RAG 系统:以 LLM 为裁判与 RAG Triad 框架

    Mistral 探讨如何用“LLM As A Judge”方法评估 RAG 系统,通过裁判模型按数值、二元或定性量表为生成答案打分。文章介绍了 RAG Triad 框架,从上下文相关性、接地性和答案相关性三个维度检查检索与生成质量。Mistral 的模型可同时充当生成器和裁判,其 API 的结构化输出功能可用于构建更可靠的评估流程。

3月4日周二