Search: #开发者工具

  1. AI 时代给年轻开发者的六条建议:写代码已经不够了有人问资深工程师 Matthias Endler,今天会给年轻开发者什么建议

    AI 时代给年轻开发者的六条建议:写代码已经不够了

    有人问资深工程师 Matthias Endler,今天会给年轻开发者什么建议。他的回答出人意料——几乎与代码无关。

    学会做产品。 即使 LLM 能写大部分代码,市场仍然需要能理解用户需求、设计方案、根据反馈迭代的人。这项能力不随技术更替而贬值。

    学会学习。 当信息唾手可得,真正稀缺的是批判性思维和基于数据做决策的能力。理解底层原理,远胜于死记硬背和简单的模式匹配。

    学会沟通。 能把想法讲清楚、能激发他人协作的人,影响力是成倍放大的。别做独狼。

    成为问题解决者。 当所有人都用同样的工具时,拉开差距的是你解决问题的速度和质量。选一个问题,深入领域,建立快速反馈循环,不断迭代。

    拥有不止一项技能。 只会写代码的人很容易被替代。把编程能力和你真正感兴趣的领域结合起来——比如健身、金融、教育——这会大幅缩小你的竞争圈。好奇心驱动的探索比纯靠意志力更持久。

    本质上什么都没变。 上一代人或许仅凭编码能力就能找到工作,但最优秀的开发者从来都不只是写代码。工具变强了,意味着"写代码"本身不再是护城河,你必须锻炼其他肌肉。

    🔗 https://endler.dev/2026/advice-to-young-developers/

    #开发者成长 #AI时代 #职业建议 #软技能 #产品思维 Advice to Young Developers

  2. AI Agent 框架如何实现崩溃自愈?深入 Pi 的 Durable Harness v2 架构设计在构建复杂且长周期的 AI Agent 系统时,进程崩溃、外部 API 超时以及并发冲突是不可避免的挑战

    AI Agent 框架如何实现崩溃自愈?深入 Pi 的 Durable Harness v2 架构设计

    在构建复杂且长周期的 AI Agent 系统时,进程崩溃、外部 API 超时以及并发冲突是不可避免的挑战。开源 AI Agent 工具库 Pi(earendil-works/pi)发布了其核心执行引擎 AgentHarness v2 的设计规范,全面重构了 Agent 的持久化、并发与容错模型。

    ---

    核心设计亮点

    1. 确定性持久化与崩溃恢复(Durable Runs)
    预写意图(Intent-first):在执行任何副作用(LLM 请求、工具调用)之前,必须先持久化一条意图记录;执行完成后再将结果作为节点提交。
    零中间态:无论是调用中断、系统崩溃还是上下文超限,重启后都能根据日志精确定位到最近的安全边界进行恢复或重试,绝不产生不一致的脏状态。

    2. Lanes(多泳道并行架构)
    • 引入类似 Git 分支的 Lane 概念。一个会话(Session)拥有唯一的共享对话树,但可以在上面并发运行多个独立的 Lane(如 Slack 频道下的不同 Thread)。
    • 每个 Lane 拥有独立的 Leaf 指针与操作日志,保证多任务互不干扰且免受竞态冲突影响。

    3. 对 KV Cache 极度友好的追加模式(Append-Only Context)
    • 运行中所有交互和配置修改均以追加(Append)形式进入上下文,避免因中间插入导致模型端 KV Cache 失效,显著降低 Token 消耗与延迟。
    • 只有在显式触发压缩(Compaction)时才做重整。

    4. 单步驱动与确定性测试(Deterministic Stepping)
    • 支持 manual 驱动模式:Agent 的每一个网络请求、工具执行、Hook 回调和存储写入都会在虚拟门控前暂停。
    • 开发者和测试套件可以一步步单步调试,任意注入输入或模拟崩溃,彻底消除异步 Agent 系统的难以复现的隐蔽 Bug。

    5. 清晰的职责分离
    Session Tree:只负责只增的对话与事实树,不掺杂编排逻辑。
    Operation Logs:记录状态机流水,专为崩溃恢复服务。
    Hooks 与 Events 分立:Hooks 负责拦截与修改执行流,Events 负责单向、实时的 UI 状态订阅。
    多存储后端:原生适配内存、JSONL 与 SQLite,并向下兼容 v3 格式。

    ---

    对于正在探索长时间运行 Agent、多分支 Agent 或企业级容错工作流的开发者来说,Pi 的 Harness v2 提供了一套非常严谨、工业级的状态机与架构参考范式。

    完整设计文档:https://github.com/earendil-works/pi/blob/harness-v2/j4/packages/agent/docs/harness-v2.md

    #AIAgent #系统架构 #开源项目 #LLM #状态机 pi/packages/agent/docs/harness-v2.md at harness-v2/j4 · earendil-works/pi

  3. 你的网站对 AI 智能体友好吗?Vercel 推出评估工具 Is Agentic随着 AI Agent(智能体)逐渐成为网络内容的重要消费者与使用者,网站不仅要为人类设计,也需要对 AI 更加友好

    你的网站对 AI 智能体友好吗?Vercel 推出评估工具 Is Agentic

    随着 AI Agent(智能体)逐渐成为网络内容的重要消费者与使用者,网站不仅要为人类设计,也需要对 AI 更加友好。Vercel 联手 Ora 推出了 Is Agentic,一个专门评估网站“Agent 就绪度”(AI Agent Readiness Score)的在线测试工具。

    核心亮点:

    多维度能力检测:评估 AI Agent 在网站上的发现、检索、理解与交互体验。主要涵盖服务端渲染(SSR)、清晰的语义化结构、规范的 HTTP 响应及可恢复的错误处理等基础指标。
    动态匹配,不滥扣分:根据网站实际能力进行推荐项检测(如 API、OAuth 认证、GraphQL、MCP Server 支持等)。若网站本就不包含特定接口,不会因此扣分。
    具象化诊断与路径观察:不仅给出具体改进建议,还会记录 Agent 实际浏览该网站时的操作路径与遇到的阻碍(Friction)。
    面向 Agent 优化输出:支持直接以 Markdown、JSON API 形式读取报告,并提供了专属的 MCP(Model Context Protocol)Server,方便将检测能力直接集成到各类 Agent 工作流中。

    输入网址即可快速测试你的网站对 AI 智能体的易用程度,并获取针对性的优化建议。

    访问地址:https://is-agentic.com

    #AIAgent #Web开发 #Vercel #MCP #开发者工具 Is Agentic: AI Agent Readiness Score for your Site and App

  4. 通俗解读:什么是 AI 时代的「Agent Harness」?业界常用一个极简公式来定义智能体:Agent = Model + Harness

    通俗解读:什么是 AI 时代的「Agent Harness」?

    业界常用一个极简公式来定义智能体:Agent = Model + Harness

    如果把大模型(Model)比作攀登者的核心力量,那么 Harness(原意为登山安全带/挽具) 就是为你提供支撑、挂载工具并确保安全的整套装备。

    在 AI 领域,Agent Harness 是为模型提供运行环境的软件外壳。它主要承担四个核心职能:

    1. 系统提示(System Prompt):像给新员工的工作指引,规范模型在特定场景下的行为准则。
    2. 工具挂载(Tools):为模型提供搜索、写代码、发邮件等能力接口,并由模型自主判断何时调用。
    3. 自主循环(Agentic Loop):构建「理解任务 ➔ 调用工具 ➔ 评估结果 ➔ 自主修正 ➔ 交付成果」的完整工作流闭环。
    4. 模型转换层(Translation Layer):抹平不同大模型(OpenAI、Anthropic、开源模型等)的接口差异,支持灵活切换与混用。

    为什么 Harness 越来越重要?
    大模型往往掌握在少数巨头手中,但 Harness 可以开源并运行在本地。借助像 Pi、OpenClaw 这类中立的开源框架,用户能够将控制权掌握在自己手中,按需定制属于自己的 AI 工作流。

    阅读原文:https://earendil.com/posts/what-is-a-harness/

    #AI智能体 #Agent #人工智能 #开源技术 What is a Harness? | EARENDIL

  5. 告别合盖中断:为 AI 编程智能体打造的专属后台运行环境 Herdr在使用 Claude Code、Codex 等 AI 编程助手时,许多人经常遇到两个痛点:一旦合上笔记本电脑或断开连接任务就会中断;同时跑多个 Agent 时,很难及时发现哪一个正在等待输入确认

    告别合盖中断:为 AI 编程智能体打造的专属后台运行环境 Herdr

    在使用 Claude Code、Codex 等 AI 编程助手时,许多人经常遇到两个痛点:一旦合上笔记本电脑或断开连接任务就会中断;同时跑多个 Agent 时,很难及时发现哪一个正在等待输入确认。

    Herdr 正是为解决这些问题而生的智能体运行时(Runtime)。它作为一个后台服务运行,接管终端会话,让你的 AI 智能体可以全天候自主工作。

    核心特性

    后台常驻,合盖不掉线:终端直接运行在 Herdr 后台服务中,即使关闭电脑屏幕、网络断开甚至系统重启,会话与分屏布局都能完整保留并继续执行。
    状态感知,告别逐屏排查:自动识别每个窗格中 Agent 的实时状态(工作中 / 等待输入 / 空闲),当某个 Agent 需要人工确认时一目了然,无需在多个终端间来回切换。
    Agent 原生协作:提供统一的 CLI 与 Socket API,不同的 Agent 可以自主分屏、相互唤起并协同处理复杂任务。
    开箱即用,无缝兼容:无需改变原有的使用习惯,开箱支持 Claude Code、Cursor、Codex、Copilot 等 20 多种主流 Agent CLI,单二进制文件支持 macOS、Linux 和 Windows。

    安装只需一行命令即可接入现有的开发流,让 AI 智能体真正具备独立持续干活的能力。

    原链接:https://herdr.dev/

    #AI编程 #Agent运行时 #开发者工具 #ClaudeCode #终端工具 Herdr: the runtime coding agents run on

  6. Cloudflare 推出 Kitesurf:专为 AI Agent 打造的轻量级浏览器传统的浏览器(如 Chromium)是为人类设计的,包含了大量 AI 并不需要的组件(如标签页、主题、平滑滚动等),这使得它们非常消耗内存和计算资源

    Cloudflare 推出 Kitesurf:专为 AI Agent 打造的轻量级浏览器

    传统的浏览器(如 Chromium)是为人类设计的,包含了大量 AI 并不需要的组件(如标签页、主题、平滑滚动等),这使得它们非常消耗内存和计算资源。为了解决这个问题,Cloudflare 团队基于其 Workers 平台构建了一款专门针对 AI 代理(Agent)的新型浏览器——Kitesurf

    核心亮点

    专为 AI 优化:抛弃了人类才需要的视觉与交互开销,专注于 Token 数量、上下文窗口、可扩展性以及成本。
    极致的资源节省:与 Chromium 相比,在执行网页截图和 HTML 提取等常见任务时,Kitesurf 的 CPU 占用减少了 3 倍以上,内存占用减少了 4 到 7 倍,大幅降低了运行成本。
    构建在边缘网络:完全运行在 Cloudflare Workers 之上,利用 Rust 编译的 Wasm 模块和 Dynamic Workers 技术,实现极高的隔离性与无状态运行。
    兼容现有工具:支持 CDP(Chrome DevTools Protocol)协议,你可以直接配合 Puppeteer、Playwright 以及各类 MCP 客户端使用。

    虽然目前 Kitesurf 的首帧渲染时间比 Chromium 稍慢(约 1.7 倍),且暂不支持 WebGL、视频播放等复杂功能,但对于高并发的网页内容提取、截图及自动化任务,它是一个极具性价比的轻量化选择。

    Kitesurf 目前已在 Browser Run 开放免费 Beta 测试,并计划在成熟后开源。

    https://blog.cloudflare.com/kitesurf/

    #Cloudflare #AIAgent #浏览器 #开发者 #技术资讯 Introducing Kitesurf: The agent-first browser that runs in V8 isolates on Cloudflare Workers

  7. anydoc:毫秒级将主流文档转换为干净 Markdown 的 Rust 利器anydoc 是由网页解析平台 Firecrawl 开源的一款极速文档转换库

    anydoc:毫秒级将主流文档转换为干净 Markdown 的 Rust 利器

    anydoc 是由网页解析平台 Firecrawl 开源的一款极速文档转换库。它完全基于 Rust 编写,旨在将 Word、PowerPoint、Excel、PDF、EPUB、RTF 及 CSV 等多种主流文档格式,统一转换为干净、规范的 GitHub 风格 Markdown(GFM)。

    核心亮点:

    极致性能:纯 Rust 编写,不依赖重量级 AI 模型或外部云服务,单次转换的中位数时间小于 5 毫秒。
    📦 多端支持:除了 Rust 原生库外,还提供了 Node.js、Python 绑定以及开箱即用的 CLI 命令行工具。
    🤖 AI Agent 友好:支持作为 Agent Skill 一键集成(例如使用 npx skills),方便 AI 智能体直接读取和理解本地文档。
    🔍 智能格式检测:通过文件头字节自动识别格式,即使文件后缀名错误也能精准转换。
    📊 基准测试领先:在与 Pandoc、Docling、MarkItDown 等工具的对比测试中,anydoc 在格式支持完整度与转换速度上表现十分抢眼。

    无论是用于构建 LLM 知识库的数据预处理,还是日常的文档清理,anydoc 都是一个非常高效的开发者工具。

    项目地址:https://github.com/firecrawl/anydoc

    #Markdown #Rust #文档转换 #开发工具 #开源项目 GitHub - firecrawl/anydoc: Convert Word, PowerPoint, Excel, OpenDocument, RTF, EPUB, CSV, and PDF to clean Markdown. Built in Rust…

  8. 深入浅出 Chrome DevTools Protocol (CDP):浏览器自动化的幕后功臣当你在 Chrome 中按下 F12 打开开发者工具,查看网络请求、调试 JS 代码或模拟手机时,你是否好奇过这个面板是如何与浏览器核心进行通信的?答案就是 CDP(Chrome DevTools Protocol,Chrome 开发者工具协议)

    深入浅出 Chrome DevTools Protocol (CDP):浏览器自动化的幕后功臣

    当你在 Chrome 中按下 F12 打开开发者工具,查看网络请求、调试 JS 代码或模拟手机时,你是否好奇过这个面板是如何与浏览器核心进行通信的?

    答案就是 CDP(Chrome DevTools Protocol,Chrome 开发者工具协议)。它是所有 Chromium 系浏览器(包括 Chrome、Edge、Brave、Arc 等)对外的控制接口。无论是开发者面板本身,还是 Puppeteer、Playwright 等自动化测试框架,甚至是最新的 AI 浏览器 Agent,底层都依赖 CDP。

    什么是 CDP?

    CDP 是一个基于 JSON 的通信协议,通常通过 WebSocket 传输。它将浏览器的控制权划分为多个不同的“域”(Domains):

    Page:负责控制页面导航、截屏等。
    Network:观察和拦截网络请求与响应。
    Runtime:执行 JavaScript 代码并获取控制台输出。
    Input:模拟底层的鼠标、键盘和触摸输入。
    Target:发现并连接到不同的页面、Iframe 或 Service Worker。

    为什么直接操作原生 CDP 非常困难?

    虽然发送 JSON 指令看起来很简单,但维护浏览器状态却极其复杂:

    1. 动态生命周期:页面导航会销毁旧的 JavaScript 执行上下文并创建新的上下文。一旦发生跳转,之前的对象 ID 和引用都会失效。
    2. 多进程架构(Site Isolation):为了安全,浏览器会将跨站点的 Iframe 放在不同的渲染进程中。在 CDP 中,这意味着它们会被作为不同的 Target 暴露,你需要自己管理复杂的 Session 树。
    3. 协议演进快:CDP 的方法会随着 Chromium 的更新而频繁变动,维护兼容性成本极高。

    因此,在实际开发中,更推荐使用 Playwright 或 Puppeteer 这样成熟的库。它们帮我们处理了繁琐的等待、定位和生命周期管理,只在需要更底层能力时才向外暴露 CDP 会话。

    理解 CDP 的工作原理,能让我们在构建浏览器自动化工具或浏览器 AI Agent 时,做出更合理的架构设计。

    原文链接:https://x.com/kylejeong/status/2078196340216185127

    #浏览器自动化 #Chrome #CDP #开发者工具 #Web开发

  9. Grok Build 开源:xAI 推出终端 AI 编码助手马斯克旗下的 AI 公司 xAI(SpaceXAI)开源了其终端 AI 编码代理工具 Grok Build(命令行工具名为 grok)

    Grok Build 开源:xAI 推出终端 AI 编码助手

    马斯克旗下的 AI 公司 xAI(SpaceXAI)开源了其终端 AI 编码代理工具 Grok Build(命令行工具名为 grok)。

    Grok Build 是一款运行在终端(TUI)的全屏交互式 AI 助手,专为开发者设计。它不仅能够深度理解你的本地代码库,还可以直接编辑文件、执行 Shell 命令、进行网页搜索,并管理长期运行的任务。

    主要特性:

    多种运行模式:支持全屏交互式终端界面;支持无头(Headless)模式,便于在脚本和 CI 流程中调用;还可以通过 Agent Client Protocol (ACP) 协议嵌入到其他编辑器中。
    极速体验:项目 99% 以上的代码由 Rust 编写,保证了极佳的运行效率和响应速度。
    开源协议:采用 Apache License 2.0 协议。需要注意的是,目前该项目主要由 xAI 内部单向同步,暂不接受外部代码贡献。

    想要体验的开发者可以通过以下命令快速安装:

    curl -fsSL https://x.ai/cli/install.sh | bash
    


    https://github.com/xai-org/grok-build

    #Grok #xAI #AI编码助手 #开源项目 #Rust

  10. OpenConnector:让 AI Agent 轻松连接万物的开源授权网关在构建 AI Agent 时,如何安全、高效地让它连接各种第三方 SaaS 服务(如 GitHub、Gmail、Notion、Slack 等)?Composio 的开源替代方案 —— OpenConnector 带来了一个优雅的解法

    OpenConnector:让 AI Agent 轻松连接万物的开源授权网关

    在构建 AI Agent 时,如何安全、高效地让它连接各种第三方 SaaS 服务(如 GitHub、Gmail、Notion、Slack 等)?Composio 的开源替代方案 —— OpenConnector 带来了一个优雅的解法。

    OpenConnector 是一个专为 AI Agent 设计的开源连接授权网关。通过它,你只需配置一次用户账号,即可向 Agent 开放包含 1,000+ 服务商、超过 10,000 个预置 Action 的共享目录。

    核心亮点

    安全隔离:敏感凭证、OAuth 权限和运行日志均保留在可审计的运行时内,Agent 无法直接接触,有效保障数据安全。
    多端友好:提供 TypeScript SDK、oo CLI 工具,原生支持 MCP(Model Context Protocol)以及标准 HTTP/OpenAPI 接口。
    灵活部署:支持本地 Docker 运行,也支持部署在 Fly.io、Cloudflare Workers 等无服务器(Serverless)平台,或直接使用官方托管版本。
    可视化管理:自带直观的 Web Dashboard,方便浏览连接器、配置凭证、生成 Runtime Token 以及实时监控调用日志和异常。

    对于正在开发 Agent 应用,且需要稳定、安全地对接用户日常工作流软件的开发者来说,这是一个非常值得尝试的基础设施。

    原链接:https://github.com/oomol-lab/open-connector

    #AIAgent #开源工具 #API网关 #MCP GitHub - oomol-lab/open-connector: Open-source auth gateway connecting 1500+ SaaS providers to AI agents through SDK, CLI, MCP…

  11. 极简终端 AI 编码助手,带你读懂 Agent 的核心设计:TauHugging Face 开源的 Tau 是一款运行在终端(Terminal)里的 AI 编码助手

    极简终端 AI 编码助手,带你读懂 Agent 的核心设计:Tau

    Hugging Face 开源的 Tau 是一款运行在终端(Terminal)里的 AI 编码助手。只需输入简单的需求,它就能帮你读取文件、修改代码、执行 Bash 命令并记录会话历史。

    不同于庞大复杂的商业项目,Tau 的核心定位是一个教学型项目。它的代码极其精简、层级分明,非常适合开发者用来理解“AI 编码 Agent 是如何从零构建的”。

    核心特性:

    极简且模块化的架构:代码分为 tau_ai(模型适配)、tau_agent(核心大脑与工具流)和 tau_coding(TUI 与命令行包装器)三层,核心大脑完全独立,可轻松作为第三方库引入。
    终端交互式操作:内置基于 Textual 的命令行 TUI 界面,支持 /login 登录、模型切换以及流式输出。
    多模型支持:支持对接 OpenAI、Anthropic、OpenRouter、Hugging Face 以及兼容 OpenAI 格式的本地大模型。
    持久化会话管理:通过 JSONL 格式安全存储每一次会话,支持中断恢复与分支操作。

    如果你想拥有一个轻量级的命令行开发助手,或是想动手写一个自己的 AI Agent,Tau 是一个绝佳的起点。

    项目链接:https://github.com/huggingface/tau

    #AI #Agent #Python #开源项目 #编程助手 GitHub - huggingface/tau: A Python port of Pi’s minimalist coding agent.

  12. 面向 Codex 用户的本地无限画布插件:Cowart如果你在使用 Codex 并且需要一个好用的可视化工具,不妨关注一下 Cowart

    面向 Codex 用户的本地无限画布插件:Cowart

    如果你在使用 Codex 并且需要一个好用的可视化工具,不妨关注一下 Cowart。它是一个基于 tldraw 开发的本地无限画布插件,专门用来帮助开发者在本地进行构思、标注、生成以及迭代图片。所有画布数据都默认保存在你当前项目的 canvas/ 目录下,安全又私密。

    核心功能包括:

    本地无限画布:在 Codex 中一键拉起本地 tldraw 可视化页面。
    本地持久化:所有的画布数据与图片资源都会跟着你的项目走。
    AI 占位符生成:在画布里创建一个 AI 占位框,写下提示词,Codex 就会根据比例自动填入生成的图像。
    标注图迭代:在画布里随手画标注或箭头,截图发给 Codex,它就能直接帮你生成修改后的干净新图并并排摆放。
    MCP 工具支持:支持通过 MCP 接口自动读取状态、保存或插入图片,实现工作流自动化。

    对于想要摆脱云端束缚,又想拥有丝滑 AI 绘图/修改体验的 Codex 用户来说,这绝对是一个值得尝试的效率利器。

    https://github.com/zhongerxin/Cowart

    #Codex #无限画布 #AICanvas #开源项目 #效率工具 GitHub - zhongerxin/Cowart

  13. 像使用 shadcn/ui 一样构建 AI Agent:开源模板库 agentcn如果你喜欢 shadcn/ui 的组件化设计,那一定不要错过 agentcn

    像使用 shadcn/ui 一样构建 AI Agent:开源模板库 agentcn

    如果你喜欢 shadcn/ui 的组件化设计,那一定不要错过 agentcn。这是由 shadcn-labs 推出的开源、可定制且生产可用的 AI Agent 模板库。它将 shadcn 的设计理念带入到了 AI 智能体开发领域。

    项目亮点:

    零配置开箱即用:提供合理的默认设置,支持一键命令快速初始化。
    无缝兼容 shadcn CLI:采用相同的 Registry 格式,使用体验与 shadcn/ui 高度一致。
    强大的底层支撑:基于 Eve 和 Flue 框架构建,完整包含指令、工具、技能和工作流。
    可组合与在线预览:支持通过声明式组件构建复杂的交互界面,并在文档中提供直接运行的实时预览。

    对于想要快速、规范地搭建 AI Agent 的开发者来说,这是一个非常值得尝试的脚手架工具。

    https://github.com/shadcn-labs/agentcn

    #AIAgent #开源项目 #前端开发 #shadcn #人工智能 GitHub - shadcn-labs/agentcn: shadcn/ui, but for building agents. 🤖

  14. omp:直接集成 IDE 能力的终端 AI 编码助手oh my pi (omp) 是一个专为终端设计的开源 AI 编码智能体

    omp:直接集成 IDE 能力的终端 AI 编码助手

    oh my pi (omp) 是一个专为终端设计的开源 AI 编码智能体。它不仅是一个代码生成器,更是一个深度集成 IDE 工具的“全能型选手”,旨在为开发者提供开箱即用、无缝连接的终端开发体验。

    核心亮点:

    深度集成 IDE 工具链:内置 LSP(Language Server Protocol),AI 能够像在 IDE 中一样精准进行跨文件重命名与格式化;同时支持 DAP(Debug Adapter Protocol),可以直接启动调试器(如 lldb, dlv, debugpy)进行单步调试和堆栈排查。
    创新的 Snapcompact 图像压缩:当对话历史过长时,omp 不使用 LLM 进行文本总结,而是将历史记录渲染成极其微小的像素字体 PNG 图像,并发送给多模态模型读取。这一技术能够确保上下文细节不丢失,且仅消耗约 1/3 的 Token 成本。
    强悍的 Rust 原生引擎:核心由约 5.5 万行 Rust 代码构建,搜索、shell、AST 分析等高频操作均在进程内完成,避免频繁 fork 子进程,效率极高。
    本地化记忆与离线整理:使用本地 SQLite 矢量记忆库,并使用本地的小模型(如 Qwen-1.7B / Gemma-1B)在本地整理记忆与会话标题,数据不离设备。
    强大的协作与扩展性:支持通过 /collab 实现端到端加密的实时会话共享;兼容多种主流编辑器规则(如 Cursor, Cline, Copilot),甚至可以通过 ACP 协议直接在 Zed 编辑器中驱动终端中的同一个 omp 实例。

    原链接:https://omp.sh/

    #AI编码助手 #编程工具 #Rust #开源项目 #智能开发 omp — a coding agent with the IDE wired in

  15. Slim Tools:为 AI 智能体减负的统一 MCP 工具网关在使用 AI Agent(如 Claude、Cursor 等)时,你是否遇到过因为加载了太多 MCP 或 OpenAPI 工具,导致上下文窗口(Context Window)被严重占用、Token 消耗飞涨的情况?Slim Tools 提供了一个巧妙的解决方案:它将所有上游工具统一封装进一个极简的 MCP 接口中

    Slim Tools:为 AI 智能体减负的统一 MCP 工具网关

    在使用 AI Agent(如 Claude、Cursor 等)时,你是否遇到过因为加载了太多 MCP 或 OpenAPI 工具,导致上下文窗口(Context Window)被严重占用、Token 消耗飞涨的情况?

    Slim Tools 提供了一个巧妙的解决方案:它将所有上游工具统一封装进一个极简的 MCP 接口中。

    核心特性:

    统一入口:无需向 AI 暴露所有工具,只需提供一个 Slim Tools 的 MCP URL(https://slim.tools/mcp)。
    按需探索:AI 代理在运行阶段仅能看到 discover_tools(工具搜索)和 execute_code(沙盒代码执行)两个核心能力。
    高效联动:AI 通过搜索找到匹配的工具,然后在沙盒中运行代码来组合并调用这些上游 API(如 GitHub、Notion、Slack、Figma 等)。
    简化授权:统一管理所有上游服务的 OAuth 授权,无需重复配置。

    通过这种“运行时发现”的设计,AI 代理无需在上下文里“背负”沉重的工具集,不仅让 Prompt 更加清爽,也让 Agent 的响应速度大幅提升。

    原文链接:http://slim.tools

    #AIAgents #MCP #开发者工具 #效率工具 Slim Tools | Tool Orchestration Runtime for AI Agents

  16. Flue:构建下一代 AI Agent 的 TypeScript 架构框架Flue 提出了一个核心公式:Agent = Model + Harness

    Flue:构建下一代 AI Agent 的 TypeScript 架构框架

    Flue 提出了一个核心公式:Agent = Model + Harness。它不仅仅是一个简单的 SDK,而是一个专为构建自主 Agent 设计的“可编程治理框架”(Harness),旨在让开发者能够轻松打造像 Claude Code 或 Codex 这样具备规划、环境感知和执行能力的强力工具。

    核心特性:

    高度可编程: 使用 TypeScript 编写 Agent 逻辑,支持定义复杂的技能(Skills)、工作流和多 Session 管理。
    自带沙箱环境: 提供内置的虚拟沙箱或连接远程沙箱(如 Daytona),让 Agent 安全地执行 Bash 命令、读写文件或运行代码。
    安全与隐私: 采用精细的权限控制,确保敏感的 API Token 不会被模型或沙箱环境直接接触。
    跨平台部署: 编写一次逻辑,即可部署为 HTTP 服务,或在 CLI、GitHub Actions、Cloudflare Workers 等多种环境运行。

    与其使用通用的成品 AI 工具,Flue 鼓励开发者根据特定的产品需求、数据和工作流,构建完全属于自己的定制化 Agent。

    https://flueframework.com/

    #AI #Agent #TypeScript #开发工具 #开源项目 Flue — The Open Agent Framework

  17. Obscura:专为 AI Agent 和大规模爬虫打造的 Rust 无头浏览器如果你觉得传统的 Headless Chrome 过于臃肿且容易被反爬虫识别,那么 Obscura 绝对值得一试

    Obscura:专为 AI Agent 和大规模爬虫打造的 Rust 无头浏览器

    如果你觉得传统的 Headless Chrome 过于臃肿且容易被反爬虫识别,那么 Obscura 绝对值得一试。这是一个基于 Rust 编写的开源无头浏览器引擎,旨在为 AI Agent 和网页抓取提供极速、轻量且隐形的自动化体验。

    核心优势

    轻量化:内存占用仅需约 30MB(相比 Chrome 的 200MB+),二进制文件仅 70MB。
    极致速度:启动几乎是瞬间完成,页面加载速度比 Headless Chrome 快约 6 倍。
    内置隐身模式:默认支持反指纹识别、随机化 GPU/Canvas/Audio 等硬件信息,并自动拦截 3500+ 个追踪器。
    兼容性强:支持 Chrome DevTools Protocol (CDP),可以作为 Puppeteer 和 Playwright 的无缝替代品。
    Rust 驱动:利用 V8 引擎运行真实 JavaScript,确保执行环境的高性能与安全性。

    快速上手

    Obscura 提供单二进制文件,无需安装 Node.js 或 Chrome 即可运行。你可以通过简单的命令行直接抓取动态内容,或者启动一个 CDP 服务器供自动化脚本调用:

    # 获取网页标题
    ./obscura fetch https://example.com --eval "document.title"
    
    # 启动 CDP 服务
    ./obscura serve --port 9222 --stealth
    


    对于追求性能和隐匿性的开发者来说,Obscura 是构建下一代 AI 自动化工具的理想底层引擎。

    https://github.com/h4ckf0r0day/obscura

    #开源项目 #无头浏览器 #Rust #AI工具 #爬虫技术 GitHub - h4ckf0r0day/obscura: The headless browser for AI agents and web scraping

  18. Paseo:随时随地指挥你的 AI 编程助手想要在离开工位时也能继续推进代码进度?Paseo 是一款开源、自托管的 AI 编程 Agent 调度平台,让你能够从手机、桌面或终端轻松管理和运行 AI 助手

    Paseo:随时随地指挥你的 AI 编程助手

    想要在离开工位时也能继续推进代码进度?Paseo 是一款开源、自托管的 AI 编程 Agent 调度平台,让你能够从手机、桌面或终端轻松管理和运行 AI 助手。

    主要功能亮点:

    全平台覆盖:支持 iOS、Android、桌面端及 Web,甚至可以直接通过 CLI 脚本化运行,实现多端无缝衔接。
    集成主流 Agent:完美支持 Claude Code、Codex 和 OpenCode 等主流 AI 编程助手,保留原有的技能和配置。
    隐私与安全:代码始终保留在你的本地机器上,支持端到端加密中继,确保远程连接时的代码安全。
    本地语音交互:内置完全本地化的语音识别与合成技术,无需将语音数据上传云端即可实现指令下达。
    开发者友好:支持键盘快捷键优先操作、Git 工作流隔离(Worktrees)以及全方位的命令行支持。

    Paseo 是一款纯粹的开源工具,不直接调用推理 API,而是作为官方 CLI 的透明调度层,既自由又强大。

    https://paseo.sh/

    #AI编程 #开源项目 #Paseo #开发者工具 #人工智能 Paseo – Run Claude Code, Codex, Copilot, OpenCode from anywhere

  19. CursorBench:Cursor 如何更贴近真实开发来评估模型质量开发者正在把更长、更复杂的编程任务交给智能体:跨多个文件、工具和步骤

    CursorBench:Cursor 如何更贴近真实开发来评估模型质量

    开发者正在把更长、更复杂的编程任务交给智能体:跨多个文件、工具和步骤。Cursor 认为,评测方式也必须随之升级,才能真实反映“好用与否”。

    Cursor 的做法是 线上 + 线下 的混合评测闭环:

    线下:CursorBench(内部基准)
    基于工程团队的真实 Cursor 会话构建,而不是从公开代码库抽题。因为更贴近实际工作流、信息更不充分且常带歧义,CursorBench 往往能更好地区分前沿模型,并衡量多维能力(正确性、代码质量、效率、交互行为等)。

    线上:真实流量的受控实验
    用于捕捉线下评测遗漏的退化:例如线下评分器判“正确”,但开发者实际体验变差。Cursor 会用多类代理指标(交互信号 + 输出质量信号)综合观察,并通过消融实验归因(如移除语义搜索工具来定位其关键场景)。

    为什么不太依赖公开基准?Cursor 指出三类常见问题:

    1. 任务不匹配:许多基准仍偏向“修 bug”或“解谜题”,与真实开发请求脱节。
    2. 评分困难:真实请求常有多种正确解,固定答案容易误伤合理方案。
    3. 数据污染:公开仓库题目容易进入训练数据,分数被抬高;甚至出现“记忆补丁”与测试缺陷等问题。

    下一步,Cursor 预计开发会更多转向“长时运行智能体”。他们也计划让 CursorBench 适配更长任务,并解决成本、可复现性、以及离线结果与真实体验之间的差距。

    原文链接:https://cursor.com/cn/blog/cursorbench

    #模型评测 #编程智能体 #基准测试 #Cursor #开发者体验 How we compare model quality in Cursor · Cursor

  20. Stripe「Minions」:一键生成、端到端交付的无人值守编码代理Stripe 在内部打造了一套名为 Minions 的编码代理:从接到任务到产出可评审的 PR,全程几乎无需人类介入

    Stripe「Minions」:一键生成、端到端交付的无人值守编码代理

    Stripe 在内部打造了一套名为 Minions 的编码代理:从接到任务到产出可评审的 PR,全程几乎无需人类介入。现在,Stripe 每周有超过 1000 个合并的 PR 是由 Minions 从头到尾生成的(人类负责 Review,但不写代码)。

    为什么要自研?

    在 Stripe 这种超大规模、强约束的工程环境里,“从零写个原型”和“在成熟巨型代码库里安全改动”完全不是一回事:

    • 代码库规模巨大(数亿行),栈也相对小众:大量后端是 Ruby + Sorbet,还有大量 Stripe 自研库,LLM 天然不熟
    • 业务风险极高:Stripe 的代码承载着 每年超过 1 万亿美元 的支付规模,并受金融合规与监管约束
    • 既要让代理“会写”,也要让它“按规矩写、能跑通、能过 CI”,并与既有研发流程深度结合

    工程师怎么用?

    最常见的入口是 Slack

    • 在讨论线程里 @Slack App 就能发起 Minion,它会读取整个线程与相关链接作为上下文
    • 也集成到内部系统里:文档平台、Feature Flag、工单系统等
    例如 CI 发现 flaky tests,会生成工单,直接提供按钮让 Minion 去修

    完成后,Minion 会:

    • 创建分支 → 推送 → 跑 CI → 按模板生成 PR

    如果效果不理想,人类可以补充指令让它再改;即使不完美,也常常是很好的“可用起点”。

    Minions 背后怎么运作(要点版)

    Stripe 的思路是:把“创意生成”交给 LLM,把“必须可靠执行的步骤”交给确定性工具链

    • 运行环境:在隔离的 devbox 中执行(10 秒内可启动,预热并预载代码与服务),与生产与公网隔离,便于并行
    • Agent 框架:基于 Block 的开源编码代理 goose 的 fork,并做了强定制
    • 规则与上下文:读取各类 agent rule 文件,但多为“按目录条件生效”,避免全局死规则拖累
    • 工具调用:接入 MCP(函数调用通用协议),并建设内部 MCP 服务 Toolshed,提供 400+ 工具(文档、工单、构建状态、Sourcegraph 搜索等)
    • 反馈与质量闸门:
    • 首先跑本地启发式 lint/检查(通常 <5 秒)
    • 再跑选择性的 CI(Stripe 有 300 万+ 测试),部分失败可自动修复
    • 为控制成本与等待时间:最多两轮 CI,强调“能本地提前发现就不要拖到 CI”

    接下来

    这篇是系列 Part 1,主要讲“怎么用、能做什么”;Part 2 会深入实现细节。整体信号很明确:当“开发者注意力”成为稀缺资源时,无人值守、可并行的编码代理正在改变工程协作方式。

    原文链接:https://stripe.dev/blog/minions-stripes-one-shot-end-to-end-coding-agents

    #AI工程化 #编码代理 #开发者效率 #CI实践 #Stripe Minions: Stripe’s one-shot, end-to-end coding agents

1px