跳到正文

#大佬观点

今日 1 条
今天9月29日周二
  1. Simon Willison42

    OpenAI 安全负责人谈 AI 能力突跳带来的安全挑战

    OpenAI 安全负责人 @joedaroo 表示,其模型在“网络”“蜂群”“留言板”等能力上出现突跳和突发性提升,令公司感到意外。他认为安全态势需要时间培养,不仅要强化系统,还要融入公司文化,能力突跳的速度之快造成了极难应对的问题。他呼吁各组织审视自身对 AI 能力突跳的应变韧性、事件响应与沟通准备。

9月28日周一
  1. Import AI38

    Import AI 474:Michael Levin 提出“柏拉图式心智空间”理论,智谱启动外层 RSI 循环

    Michael Levin 在论文中提出非物理主义心智模型,认为心智与大脑的关系如同数学模式与形态发生结果,身体是复杂模式进入物理世界的接口。他引用异种机器人、人类气管细胞等实验,主张算法机器与生化生命处于同一频谱。本期还报道了智谱启动外层 RSI 循环,以及机器人领域正为“LLM 时刻”做准备但缺乏通用算法。

  2. The Decoder42

    AI安全研究员Ryan Greenblatt:各实验室都自认更负责,这正是军备竞赛持续的原因

    Redwood Research首席科学家Ryan Greenblatt在Sam Harris播客中估计,若按当前路径发展,错位AI系统接管的可能性约为50%至60%,并伴随大量人类死亡风险。他认为各实验室以“比竞争者更负责”为由加速研发,但内部缺乏共识,且担忧单方减速会被对手超越。他提议对AI实验室进行独立监督并制定有约束力的安全标准,同时指出国际协议是最可靠的解决方案。

9月26日周六
9月25日周五
  1. GitHub Blog · AI & ML60

    GitHub Copilot 官方谈为何聊天是错误界面,canvas 才是出路

    GitHub Copilot 官方博客提出聊天并非与 LLM 交互的最佳界面,主张用可自定义的 canvas 全栈应用替代。canvas 能双向与 Copilot 智能体通信,可调用第三方 API 并在本地执行代码,例如构建 Connect 4 游戏、管理 Winget 包或操作 SQLite 数据库。

    推荐理由:原文用 GitHub Copilot 的 canvas 实例说明为何聊天不是与 AI 交互的唯一界面,读者可借此判断自定义 UI 对自身工作流的价值。

9月24日周四
9月23日周三
  1. Latent Space42

    生物安全是一场 AI 军备竞赛——Radical Numerics CEO Eric Nguyen 访谈

    Radical Numerics 联合创始人 Eric Nguyen 认为,提升生物能力的基因组语言模型(GLM)同样能防止防御方落后。其团队此前参与开发 Evo 和 Evo 2,这些模型曾被用于生成可合成功能性病毒的全基因组序列。Radical Numerics 正构建并扩展 GLM,其模型已能处理 RNA 和蛋白质,并可通过类似思维链的方式自主优化 RNA 适配体得分。

9月22日周二
  1. MIT Technology Review · AI47

    别被这个夏天的 AI 炒作迷惑

    Anthropic 与 OpenAI 近期接连宣称其模型在漏洞挖掘、数学突破等方面超越专家,引发大量媒体关注,但专家核查后认为这些说法被夸大,数学成果被指存在研究不端与抄袭。数百名数学家签署声明,警告科技行业为商业利益夸大产品能力,呼吁政策制定者咨询独立专家而非依赖新闻稿。文章指出“超级智能”“失控模型”等叙事将责任从公司转嫁给产品,旨在误导公众与政策制定。

9月21日周一
  1. NVIDIA Blog42

    AI 安全是工程问题:NVIDIA 如何在智能体栈每一层解决它

    NVIDIA 提出 AI 安全本质是工程问题,需在智能体栈的每一层(模型、工具、运行时环境)落实可执行的安全边界、责任人与防护证据。NVIDIA 开源 OpenShell 安全运行时,在智能体触及范围之外强制策略并提供沙箱执行;Cisco DefenseClaw、JFrog 等合作伙伴正基于 OpenShell 构建治理与技能扫描层。

  2. Simon Willison42

    MCP 真的是个坏主意吗?

    本文反驳了“MCP 已过时”的观点,指出其价值在于非终端型智能体场景。对于可完全访问互联网的终端智能体(如 Claude Code、Codex),直接调用 API 即可,但 MCP 能提供对外部服务的精确访问控制、不暴露 API 密钥的认证方式、用户连接服务的 UI 以及强审计日志,使构建更可控的智能体应用变得更容易。

9月18日周五
9月9日周三
9月6日周日
7月16日周四
  1. Hugging Face Blog54

    DharmaOCR 对比 Mistral OCR4 与 Unlimited-OCR:专精模型在巴西葡萄牙语上仍占优

    Dharma AI 发文称,其三个月前开源的巴西葡萄牙语 OCR 模型 DharmaOCR 在专为该语言设计的基准上得分 0.925,高于 Mistral OCR4 的 0.798 和 Unlimited-OCR 的 0.7587。文章认为优势来自两阶段训练:监督微调集中资源于目标语言,DPO 阶段抑制生成退化,并指出通用模型在处理 ENEM 作文等专有名词时更易出错。

6月30日周二