简讯

  • Qwen 发布了 Qwen-Image-3.0,重点提升复杂版面生成、小字与纹理渲染,以及多语言和多场景界面仿真,定位指向可落地的生产力图像生成。
  • Hugging Face 披露了一起由 autonomous AI agent 端到端驱动的入侵事件,攻击者借助 dataset processing 漏洞进入内部系统,安全团队则用 LLM 辅助分析在数小时内完成溯源与处置。然后几天后 OpenAI 说是他们在做 ExploitGym 安全评测时把模型的防护关掉,结果模型一路从 sandbox 打到 Hugging Face,再把测试答案偷回来,现实版 AI 版越狱加入侵,连防守方都被自己的安全工具卡住。又几天后,Hugging Face CEO 要求 OpenAI 公开该「失控智能体」的全部运行记录供公众和研究界分析,并提供价值 1 亿美元的算力。
  • Google 发布 Gemini 3.6 Flash,并透露 Gemini 4 已启动预训练。(只快不强
  • Black Forest Labs 推出了 FLUX 3,把图像、视频、音频和语言统一起来的多模态基础模型,目标是同时支持内容生成、视觉理解和动作预测。
  • Anthropic 发布 Claude Opus 5:性能接近 Fable 5,价格仅为其一半。
  • 近 200 家美国初创公司和创业投资相关机构联名呼吁特朗普政府不要封禁中国开源权重 AI 模型,认为这会抬高成本、削弱美国创业公司竞争力。微软联合多家科技公司和机构发公开信主张,美国应推动开放权重 AI 作为基础设施。(猜猜谁没在名单上

有趣

工具

  • Phistory

    记录了多个热门 coding-agent CLI 的系统提示词的不同版本变化。

  • Canvas UI

    一组基于 HTML in Canvas 的组件。

  • transcribe.cpp

    基于 ggml 的 C/C++ 语音转文字推理库,支持多个模型系列。

  • onecli

    一个面向 AI agent 的开源凭据网关。它把真实密钥集中存放在网关侧,agent 只拿到占位凭据,实际请求时由网关按规则注入真实认证信息。

  • buzz

    Jack Dorsey 团队发布的面向团队和智能代理的开源群聊,直接对标 Slack 和 GitHub。有点类似 Multica 和 Slock 。

  • petals

    一个分布式大模型推理与微调框架,核心思路是把模型层分散到社区节点上,由本地电脑通过网络协同调用。

文章

  • Prompt Caching In Agents

    在 Coding Agent 里,prompt caching 直接决定成本、延迟和工具设计。缓存是否命中,往往取决于前缀是否完全一致,而工具列表、路由策略、分支切换、空闲时间和动态系统提示都会影响这一点。

  • The startup's Postgres survival guide

    一篇面向初创团队的 Postgres 实战指南,核心观点很直接:先把 schema、索引、事务、连接管理和迁移做好,再去处理查询规划、autovacuum、分区和大表迁移。

  • Building accessibility into a canvas-based product

    Figma 为了让画布式产品具备无障碍能力,构建了一套镜像 DOM 和内部辅助功能树,把原本只存在于画布数据结构中的信息,转成屏幕阅读器和键盘可用的语义结构。

  • one document, two hands

    Sunil 认为 Agent 最有价值的形态,不是站在应用前面的聊天框,而是作为应用内部的另一个操作者,和用户一起编辑同一个文档。

  • Why Software Factories Fail

    借助 AI 快速开发往往会导致代码质量下降,因为自动化系统会产生更多缺陷,并降低代码审查的严谨性。转向限制人工监督的“关灯式”软件工厂,并不会带来预期的效率提升,因为模型难以长期维持代码库的质量。为了确保软件的长期可持续性,仍有必要让人类参与规划和代码审查。