Search: #AIAgent

  1. AI Agent 框架如何实现崩溃自愈?深入 Pi 的 Durable Harness v2 架构设计在构建复杂且长周期的 AI Agent 系统时,进程崩溃、外部 API 超时以及并发冲突是不可避免的挑战

    AI Agent 框架如何实现崩溃自愈?深入 Pi 的 Durable Harness v2 架构设计

    在构建复杂且长周期的 AI Agent 系统时,进程崩溃、外部 API 超时以及并发冲突是不可避免的挑战。开源 AI Agent 工具库 Pi(earendil-works/pi)发布了其核心执行引擎 AgentHarness v2 的设计规范,全面重构了 Agent 的持久化、并发与容错模型。

    ---

    核心设计亮点

    1. 确定性持久化与崩溃恢复(Durable Runs)
    预写意图(Intent-first):在执行任何副作用(LLM 请求、工具调用)之前,必须先持久化一条意图记录;执行完成后再将结果作为节点提交。
    零中间态:无论是调用中断、系统崩溃还是上下文超限,重启后都能根据日志精确定位到最近的安全边界进行恢复或重试,绝不产生不一致的脏状态。

    2. Lanes(多泳道并行架构)
    • 引入类似 Git 分支的 Lane 概念。一个会话(Session)拥有唯一的共享对话树,但可以在上面并发运行多个独立的 Lane(如 Slack 频道下的不同 Thread)。
    • 每个 Lane 拥有独立的 Leaf 指针与操作日志,保证多任务互不干扰且免受竞态冲突影响。

    3. 对 KV Cache 极度友好的追加模式(Append-Only Context)
    • 运行中所有交互和配置修改均以追加(Append)形式进入上下文,避免因中间插入导致模型端 KV Cache 失效,显著降低 Token 消耗与延迟。
    • 只有在显式触发压缩(Compaction)时才做重整。

    4. 单步驱动与确定性测试(Deterministic Stepping)
    • 支持 manual 驱动模式:Agent 的每一个网络请求、工具执行、Hook 回调和存储写入都会在虚拟门控前暂停。
    • 开发者和测试套件可以一步步单步调试,任意注入输入或模拟崩溃,彻底消除异步 Agent 系统的难以复现的隐蔽 Bug。

    5. 清晰的职责分离
    Session Tree:只负责只增的对话与事实树,不掺杂编排逻辑。
    Operation Logs:记录状态机流水,专为崩溃恢复服务。
    Hooks 与 Events 分立:Hooks 负责拦截与修改执行流,Events 负责单向、实时的 UI 状态订阅。
    多存储后端:原生适配内存、JSONL 与 SQLite,并向下兼容 v3 格式。

    ---

    对于正在探索长时间运行 Agent、多分支 Agent 或企业级容错工作流的开发者来说,Pi 的 Harness v2 提供了一套非常严谨、工业级的状态机与架构参考范式。

    完整设计文档:https://github.com/earendil-works/pi/blob/harness-v2/j4/packages/agent/docs/harness-v2.md

    #AIAgent #系统架构 #开源项目 #LLM #状态机 pi/packages/agent/docs/harness-v2.md at harness-v2/j4 · earendil-works/pi

  2. 你的网站对 AI 智能体友好吗?Vercel 推出评估工具 Is Agentic随着 AI Agent(智能体)逐渐成为网络内容的重要消费者与使用者,网站不仅要为人类设计,也需要对 AI 更加友好

    你的网站对 AI 智能体友好吗?Vercel 推出评估工具 Is Agentic

    随着 AI Agent(智能体)逐渐成为网络内容的重要消费者与使用者,网站不仅要为人类设计,也需要对 AI 更加友好。Vercel 联手 Ora 推出了 Is Agentic,一个专门评估网站“Agent 就绪度”(AI Agent Readiness Score)的在线测试工具。

    核心亮点:

    多维度能力检测:评估 AI Agent 在网站上的发现、检索、理解与交互体验。主要涵盖服务端渲染(SSR)、清晰的语义化结构、规范的 HTTP 响应及可恢复的错误处理等基础指标。
    动态匹配,不滥扣分:根据网站实际能力进行推荐项检测(如 API、OAuth 认证、GraphQL、MCP Server 支持等)。若网站本就不包含特定接口,不会因此扣分。
    具象化诊断与路径观察:不仅给出具体改进建议,还会记录 Agent 实际浏览该网站时的操作路径与遇到的阻碍(Friction)。
    面向 Agent 优化输出:支持直接以 Markdown、JSON API 形式读取报告,并提供了专属的 MCP(Model Context Protocol)Server,方便将检测能力直接集成到各类 Agent 工作流中。

    输入网址即可快速测试你的网站对 AI 智能体的易用程度,并获取针对性的优化建议。

    访问地址:https://is-agentic.com

    #AIAgent #Web开发 #Vercel #MCP #开发者工具 Is Agentic: AI Agent Readiness Score for your Site and App

  3. 让 AI 也能做出极简可爱的吉祥物:IP as Logo Skill为产品设计一个辨识度高、圆润可爱的 IP Logo 往往需要多次打磨

    让 AI 也能做出极简可爱的吉祥物:IP as Logo Skill

    为产品设计一个辨识度高、圆润可爱的 IP Logo 往往需要多次打磨。开源项目 ip-as-logo-skill 为具备生图能力的 AI Agent 提供了一套结构化的设计规范,帮助你一键生成可以直接商用的极简 IP 角色。

    🌟 核心亮点

    严控设计复杂度:遵循极简与微拟物(Neo-skeuomorphism)美学,主体由 4~7 个基础圆形几何构成,默认采用「2 种 IP 主色 + 1 种纯色背景」的三色搭配。
    精心调校的构图:角色默认从左下角或右下角探出并占据画面 85%~95%,避免传统居中构图的呆板感。
    标准化的生图流程:Agent 会先梳理产品背景并提供 3 种设计方向,确认后一次性生成 6 张不同构图的独立高清候选图,无需繁琐调试提示词。
    纯净的 Prompt 策略:提示词专注描述画面视觉元素,不包含 “logo/icon” 等干扰词,充分释放图像模型的生成质感。

    🛠️ 兼容性与安装

    支持 Codex、豆包、Coze、Manus、YouMind、Gemini Apps、Replit Agent 等支持图像资产输出的 Agent 环境。

    通过 Agent Skills CLI 一键安装:

    npx skills@latest add s1dashu/ip-as-logo-skill
    


    项目采用 MIT 协议开源,生成内容均可免费商用。此外,作者还提供了免费的在线图库 ipaslogo.com,无需配置即可直接下载现成素材。

    🔗 项目地址:https://github.com/s1dashu/ip-as-logo-skill

    #开源项目 #AIAgent #Logo设计 #AI生图 #设计工具

  4. Cloudflare 推出 Kitesurf:专为 AI Agent 打造的轻量级浏览器传统的浏览器(如 Chromium)是为人类设计的,包含了大量 AI 并不需要的组件(如标签页、主题、平滑滚动等),这使得它们非常消耗内存和计算资源

    Cloudflare 推出 Kitesurf:专为 AI Agent 打造的轻量级浏览器

    传统的浏览器(如 Chromium)是为人类设计的,包含了大量 AI 并不需要的组件(如标签页、主题、平滑滚动等),这使得它们非常消耗内存和计算资源。为了解决这个问题,Cloudflare 团队基于其 Workers 平台构建了一款专门针对 AI 代理(Agent)的新型浏览器——Kitesurf

    核心亮点

    专为 AI 优化:抛弃了人类才需要的视觉与交互开销,专注于 Token 数量、上下文窗口、可扩展性以及成本。
    极致的资源节省:与 Chromium 相比,在执行网页截图和 HTML 提取等常见任务时,Kitesurf 的 CPU 占用减少了 3 倍以上,内存占用减少了 4 到 7 倍,大幅降低了运行成本。
    构建在边缘网络:完全运行在 Cloudflare Workers 之上,利用 Rust 编译的 Wasm 模块和 Dynamic Workers 技术,实现极高的隔离性与无状态运行。
    兼容现有工具:支持 CDP(Chrome DevTools Protocol)协议,你可以直接配合 Puppeteer、Playwright 以及各类 MCP 客户端使用。

    虽然目前 Kitesurf 的首帧渲染时间比 Chromium 稍慢(约 1.7 倍),且暂不支持 WebGL、视频播放等复杂功能,但对于高并发的网页内容提取、截图及自动化任务,它是一个极具性价比的轻量化选择。

    Kitesurf 目前已在 Browser Run 开放免费 Beta 测试,并计划在成熟后开源。

    https://blog.cloudflare.com/kitesurf/

    #Cloudflare #AIAgent #浏览器 #开发者 #技术资讯 Introducing Kitesurf: The agent-first browser that runs in V8 isolates on Cloudflare Workers

  5. OpenConnector:让 AI Agent 轻松连接万物的开源授权网关在构建 AI Agent 时,如何安全、高效地让它连接各种第三方 SaaS 服务(如 GitHub、Gmail、Notion、Slack 等)?Composio 的开源替代方案 —— OpenConnector 带来了一个优雅的解法

    OpenConnector:让 AI Agent 轻松连接万物的开源授权网关

    在构建 AI Agent 时,如何安全、高效地让它连接各种第三方 SaaS 服务(如 GitHub、Gmail、Notion、Slack 等)?Composio 的开源替代方案 —— OpenConnector 带来了一个优雅的解法。

    OpenConnector 是一个专为 AI Agent 设计的开源连接授权网关。通过它,你只需配置一次用户账号,即可向 Agent 开放包含 1,000+ 服务商、超过 10,000 个预置 Action 的共享目录。

    核心亮点

    安全隔离:敏感凭证、OAuth 权限和运行日志均保留在可审计的运行时内,Agent 无法直接接触,有效保障数据安全。
    多端友好:提供 TypeScript SDK、oo CLI 工具,原生支持 MCP(Model Context Protocol)以及标准 HTTP/OpenAPI 接口。
    灵活部署:支持本地 Docker 运行,也支持部署在 Fly.io、Cloudflare Workers 等无服务器(Serverless)平台,或直接使用官方托管版本。
    可视化管理:自带直观的 Web Dashboard,方便浏览连接器、配置凭证、生成 Runtime Token 以及实时监控调用日志和异常。

    对于正在开发 Agent 应用,且需要稳定、安全地对接用户日常工作流软件的开发者来说,这是一个非常值得尝试的基础设施。

    原链接:https://github.com/oomol-lab/open-connector

    #AIAgent #开源工具 #API网关 #MCP GitHub - oomol-lab/open-connector: Open-source auth gateway connecting 1500+ SaaS providers to AI agents through SDK, CLI, MCP…

  6. 像使用 shadcn/ui 一样构建 AI Agent:开源模板库 agentcn如果你喜欢 shadcn/ui 的组件化设计,那一定不要错过 agentcn

    像使用 shadcn/ui 一样构建 AI Agent:开源模板库 agentcn

    如果你喜欢 shadcn/ui 的组件化设计,那一定不要错过 agentcn。这是由 shadcn-labs 推出的开源、可定制且生产可用的 AI Agent 模板库。它将 shadcn 的设计理念带入到了 AI 智能体开发领域。

    项目亮点:

    零配置开箱即用:提供合理的默认设置,支持一键命令快速初始化。
    无缝兼容 shadcn CLI:采用相同的 Registry 格式,使用体验与 shadcn/ui 高度一致。
    强大的底层支撑:基于 Eve 和 Flue 框架构建,完整包含指令、工具、技能和工作流。
    可组合与在线预览:支持通过声明式组件构建复杂的交互界面,并在文档中提供直接运行的实时预览。

    对于想要快速、规范地搭建 AI Agent 的开发者来说,这是一个非常值得尝试的脚手架工具。

    https://github.com/shadcn-labs/agentcn

    #AIAgent #开源项目 #前端开发 #shadcn #人工智能 GitHub - shadcn-labs/agentcn: shadcn/ui, but for building agents. 🤖

  7. Cloudflare 推出临时账户功能,让 AI Agent 实现免登录一键部署如今,使用 AI Agent 编写代码已成常态

    Cloudflare 推出临时账户功能,让 AI Agent 实现免登录一键部署

    如今,使用 AI Agent 编写代码已成常态。但在部署阶段,Agent 往往会被专为人类设计的浏览器 OAuth 授权、控制台操作和多因素认证(MFA)所阻挡。

    为了打破这一障碍,Cloudflare 推出了面向 AI Agent 的临时账户功能(Temporary Cloudflare Accounts)

    核心特性:

    免注册部署:Agent 无需预先注册或登录账号,只需运行 wrangler deploy --temporary,即可在几秒钟内完成 Worker 的部署。
    快速迭代:Agent 可以在临时账户中反复修改并重新部署代码,极大地缩短了“编写-部署-测试”的循环周期。
    60 分钟申领期:临时部署的有效期为 60 分钟。在此期间,用户可以通过 Agent 提供的链接登录并“申领(Claim)”该账户,将其转为永久账户;若超时未申领,系统将自动清理相关资源。

    这一举措消除了人机交互的摩擦,让 AI 代理能够真正实现全自动的闭环开发与部署。

    原链接:https://blog.cloudflare.com/temporary-accounts/?utm_campaign=cf_blog&utm_content=20260619&utm_medium=organic_social&utm_source=twitter

    #Cloudflare #AIAgent #CloudflareWorkers #DevOps Temporary Cloudflare Accounts for AI agents

  8. Vercel 推出 AI Agent 开发框架 Eve:像写 Next.js 一样构建智能体Vercel 刚刚发布了全新的 AI Agent 开发框架 —— Eve

    Vercel 推出 AI Agent 开发框架 Eve:像写 Next.js 一样构建智能体

    Vercel 刚刚发布了全新的 AI Agent 开发框架 —— Eve。官方将其定位为“智能体领域的 Next.js”,旨在为开发者提供一套开箱即用的 AI 智能体开发、部署与运行基础设施。

    以下是 Eve 的核心特性:

    极简的目录即 Agent 结构:使用 Markdown 撰写角色指令和技能(如 instructions.md),使用 TypeScript 编写工具函数(如 tools/),无需繁琐的注册与配置,直接运行即可启动。
    天然持久化支持 (Durable by default):基于 Vercel Workflows,智能体运行中的每一步都会自动保存状态。在等待用户输入或长时间任务时,智能体会自动“挂起”,并在需要时无缝恢复,完全不用担心进程中断。
    隔离的沙箱环境 (Sandboxed compute):为智能体提供独立的虚拟化运行环境,支持安全地运行代码、读写文件或执行 Bash 命令。
    多渠道轻松连接:一份代码即可多端部署,轻松接入 Slack、Discord、Teams、Web 网页以及各种自定义 API。
    企业级功能支持:内置人机协同(Human-in-the-loop)审批流、子智能体协作(Subagents)、定时任务(Schedules)以及自动化测试评估(Evaluations)。

    Eve 将复杂的 AI 基础设施进行了高度抽象与整合,让开发者可以专注于智能体本身的业务逻辑,告别零散工具的拼凑。

    详情点击官网了解:https://vercel.com/eve

    #Vercel #AIAgent #Eve #前端开发 #人工智能 eve – The Agent Framework - Vercel

  9. GitAgent:用 Git 仓库定义 AI Agent 的开放标准AI Agent 框架百花齐放,但每个框架都有自己的结构,Agent 定义无法跨平台复用

    GitAgent:用 Git 仓库定义 AI Agent 的开放标准

    AI Agent 框架百花齐放,但每个框架都有自己的结构,Agent 定义无法跨平台复用。GitAgent 提出了一种框架无关、基于 Git 的 Agent 定义标准——克隆一个仓库,就能获得一个 Agent。

    核心理念

    Git 原生:版本控制、分支管理、Diff 比较、协作能力开箱即用
    框架无关:通过适配器导出到 Claude Code、OpenAI、CrewAI、Cursor 等任意框架
    合规就绪:内置 FINRA、美联储、SEC 等金融监管合规支持
    可组合:Agent 之间可以继承、依赖和委托

    怎么用?

    一个仓库只需两个文件即可成为 Agent:

    agent.yaml:清单文件,定义名称、版本、模型、技能、工具等
    SOUL.md:身份文件,定义人格、沟通风格和价值观

    可选添加 RULES.md(硬约束)、DUTIES.md(职责分离)、skills/(技能模块)、workflows/(工作流)等目录,按需扩展。

    亮点设计

    12 种架构模式:包括人类审批(Human-in-the-Loop)、Agent 版本管理、分支部署、Agent Fork 与混用、CI/CD 集成、生命周期钩子等
    职责分离(SOD):定义角色权限和冲突矩阵,确保关键流程不被单一 Agent 端到端控制
    SkillsFlow:用 YAML 定义确定性多步工作流,支持步骤依赖和模板数据流
    11 个导出适配器:覆盖 system-prompt、Claude Code、OpenAI、CrewAI、Cursor、Lyzr 等主流平台

    快速开始

    npm install -g gitagent
    gitagent init --template standard
    gitagent validate
    gitagent export --format system-prompt
    


    项目目前已获 1.1k Star,MIT 开源协议。

    🔗 https://github.com/open-gitagent/gitagent

    #AIAgent #GitAgent #开源 #Agent标准化 #框架无关 GitHub - open-gitagent/gitagent: A universal git-native AI agent framework. Your agent lives inside a git repo — identity, rules…

  10. 别构建 Agent,构建 Skills 才是正道来自 Anthropic 的 Barry Zhang 和 Mahesh Murag 在 AI Engineer 大会上分享了一个重要理念:与其不断重建 Agent,不如专注构建 Skills

    别构建 Agent,构建 Skills 才是正道

    来自 Anthropic 的 Barry Zhang 和 Mahesh Murag 在 AI Engineer 大会上分享了一个重要理念:与其不断重建 Agent,不如专注构建 Skills。

    核心观点:

    🔹 代码是通用接口 — 代码不仅是一种用例,更是连接数字世界的通用接口。Claude Code 实际上是一个通用型 Agent,核心脚手架可以简化到 bash 和文件系统。

    🔹 Agent 的短板 — 当前 Agent 虽然智能,但缺乏领域专业知识。就像让天才数学家去报税,不如找一个经验丰富的税务专家。

    🔹 什么是 Skills — Skills 是组织化的文件夹集合,包含可组合的程序性知识。设计上保持简单:可以用 Git 版本控制、放在 Google Drive、打包分享。

    🔹 渐进式加载 — Skills 采用渐进式披露机制,运行时仅加载元数据,需要时才读取完整内容,可支持数百个 Skills 同时存在。

    🔹 生态发展 — 发布 5 周已产生数千个 Skills,涵盖基础能力、第三方集成、企业内部知识等类型。非技术人员如财务、法务也在创建 Skills。

    🔹 与 MCP 互补 — MCP 提供外部世界的连接,Skills 提供专业知识,两者协同工作。

    🔹 持续学习 — Skills 让 Claude 在第 30 天比第 1 天更强,学习成果可跨会话迁移。

    类比传统计算:
    模型 ≈ 处理器
    Agent 运行时 ≈ 操作系统
    Skills ≈ 应用程序

    📺 原视频

    #AIAgent #Skills #Anthropic #ClaudeCode #MCP

  11. Claude Opus 4.5:AI Agent 时代的里程碑作者在使用 Claude Opus 4.5 两周后认为,这是 AI 发展史上的重要时刻,堪比 GPT-4 开启聊天时代、Sonnet 3.5 开启编程时代——Opus 4.5 正式开启了 Agent 时代.核心观点:• 可靠的 AI 助手:Opus 4.5 就像 Waymo 自动驾驶,告诉它"从 A 到 B",它就能自主完成. 这种体验会彻底改变你的工作方式.• 最佳组合:Opus 4.5 + Claude Agent SDK 是构建实用 Agent 的黄金搭档. 模型再好,没有优秀的框架也白搭. 这套组合让 Agent 真正能完成复杂的现实任务.• Anthropic 的崛起:过去三年,Anthropic 年收入增长 10 倍(2025 年预计达 100 亿美元). 作者预测其估值可能在 2027 年初超越 OpenAI.实用建议:- 把 Opus 4.5 当作真正的同事,给它更复杂的任务,信任它独立完成- 用语音输入随意表达想法,让它整理成完整方案- Claude Code + Opus 4.5 是目前最强的 AI 编程工具,新的"计划模式"显著提升了复杂任务表现- 尝试编写伪代码,Opus 4.5 能精准理解意图并实现- 深入学习 Claude Agent SDK,用它构建自动化工具来处理日常重复任务Opus 4.5 的图像理解能力大幅提升,截图转代码功能达到全新水平. 作者强调:如果你对 Agent 持怀疑态度,现在该转变了——这一切都是真的.阅读原文#ClaudeOpus45 #AIAgent #Anthropic #AI编程 #自动化工具

    Claude Opus 4.5:AI Agent 时代的里程碑

    作者在使用 Claude Opus 4.5 两周后认为,这是 AI 发展史上的重要时刻,堪比 GPT-4 开启聊天时代、Sonnet 3.5 开启编程时代——Opus 4.5 正式开启了 Agent 时代.

    核心观点:

    可靠的 AI 助手:Opus 4.5 就像 Waymo 自动驾驶,告诉它"从 A 到 B",它就能自主完成. 这种体验会彻底改变你的工作方式.

    最佳组合:Opus 4.5 + Claude Agent SDK 是构建实用 Agent 的黄金搭档. 模型再好,没有优秀的框架也白搭. 这套组合让 Agent 真正能完成复杂的现实任务.

    Anthropic 的崛起:过去三年,Anthropic 年收入增长 10 倍(2025 年预计达 100 亿美元). 作者预测其估值可能在 2027 年初超越 OpenAI.

    实用建议:

    - 把 Opus 4.5 当作真正的同事,给它更复杂的任务,信任它独立完成
    - 用语音输入随意表达想法,让它整理成完整方案
    - Claude Code + Opus 4.5 是目前最强的 AI 编程工具,新的"计划模式"显著提升了复杂任务表现
    - 尝试编写伪代码,Opus 4.5 能精准理解意图并实现
    - 深入学习 Claude Agent SDK,用它构建自动化工具来处理日常重复任务

    Opus 4.5 的图像理解能力大幅提升,截图转代码功能达到全新水平. 作者强调:如果你对 Agent 持怀疑态度,现在该转变了——这一切都是真的.

    阅读原文

    #ClaudeOpus45 #AIAgent #Anthropic #AI编程 #自动化工具

  12. 如何构建一个可靠的 AI Agent?随着 AI 的发展,构建能长期稳定运行且行为可靠的 Agent 已成为 AI 工程师的核心竞争力之一

    如何构建一个可靠的 AI Agent?

    随着 AI 的发展,构建能长期稳定运行且行为可靠的 Agent 已成为 AI 工程师的核心竞争力之一。借鉴 Anthropic、GitHub 和 Docker 的最新实践,我们可以遵循以下五个关键步骤来打造强大的 AI Agent。

    1. 从明确的规范开始
    当前多数 Agent 因指令模糊、状态和工作流管理不善而表现不佳。一份好的规范应明确其角色技术栈预期输出示例行为边界(如数据访问权限、API 速率限制等)。不要只依赖“你是一个有用的助手”,而是给 Agent 一份定义清晰的合同。

    2. 将工作分解为可验证的小任务
    与其给出一个模糊的大任务(例如“为我构建一个 X 的克隆”),不如将其分解为具体、可验证的步骤,如“计划 → 编码 → 测试 → 部署 → 监控”。为 Agent 提供清晰的任务列表和严格的工作流程,能有效避免因模糊性导致的失败。

    3. 在模型外部持久化状态
    为了让 Agent 能够处理长时间运行的任务并在会话中断后恢复,需要将其状态(如进度日志、任务清单、文件差异等)存储在外部文件或数据库中。这确保了 Agent 能够随时检索到完成任务所需的相关上下文。

    4. 避免过度填充上下文窗口
    将所有信息塞进系统提示会导致响应缓慢和高昂的 Token 成本。更高效的策略是让 Agent 生成代码来调用外部工具或 API,然后仅将结果返回给模型。这种方法能显著节省 Token,使 Agent 响应更快、成本更低。

    5. 在沙箱中运行高风险操作
    如果 Agent 需要执行代码,必须将其置于沙箱环境中,并严格限制其可用的工具文件系统访问权限。为 Agent 设置明确的“护栏”,可以有效降低应用和服务器面临的风险。

    总而言之,一个成功的 Agent 由三部分组成:行为(清晰的规范)、状态(外部持久化)和护栏(安全限制)。

    原文链接: https://interviewready.io/blog/how-to-build-an-ai-agent-lessons-from-anthrophic-github-and-docker

    #AIAgent #AI开发 #最佳实践 #工程化 How to Build an AI Agent: Lessons from Anthrophic, Github and Docker

1px