550 articles · Page 1 of 28

agentd:用操作系统的思路驯服 AI Agent 的 Rust 运行时

2026-10-07T22:00:00+08:00

不内置任何工具、supervisor 不碰 LLM、推理跑在可被强杀的子进程里——agentd 用系统编程思路重做 Agent 运行时

AI Agent Rust MCP Agent Runtime
Read More →

Harbor 深度解析:任何 Agent × 任何沙箱,把评测变成可复现的软件包

2026-10-07T21:00:00+08:00

Harbor 拆解:task 目录格式与 reward 约定、42 个 Agent 适配、沙箱可插拔、ATIF 统一轨迹格式、多步任务、Rewardkit 与 Harbor Hub。

Harbor Terminal-Bench Agent 评测 沙箱 RL ATIF 开源
Read More →

OpenWiki:让 AI Agent 给代码库写一本带证据链的活维基

2026-10-07T20:00:00+08:00

LangChain 开源的 OpenWiki 把代码库变成带溯源 Claims 的活维基:MCP 生命周期、断点续跑、源码漂移自动重写,17k stars 背后的工程细节。

AI Agent LangChain MCP Documentation
Read More →

Muse Gadgets SDK 深度解析:一块 ESP32,把家里的设备接进 AI 助手

2026-10-06T20:00:00+08:00

Muse Gadgets SDK 拆解:ESP32 与 Linux 两条设备路线、20+ 开发板支持、43 个设备技能目录、安全模型与 AGENTS.md 驱动的 AI 原生开发流程。

Muse Gadgets Meta ESP32 Raspberry Pi Agent Skill IoT 开源
Read More →

AgentTeams 深度解析:多 Agent 协作为什么跑在 Matrix 房间里

2026-10-06T18:00:00+08:00

AgentTeams 拆解:用 Matrix 房间当协作底座、Manager-Workers 架构、网关凭证隔离、四种 Worker 运行时共存、MinIO 共享文件系统与 K8s 原生部署。

AgentTeams 多 Agent Matrix Kubernetes HITL DeepSeek Harness 开源
Read More →

OpenJudge 深度解析:把评估做成可复用的 grader,再把结果变成奖励信号

2026-10-06T16:00:00+08:00

OpenJudge 拆解:50+ 内置 grader 的分类学、四种造 grader 的路径、GradingRunner 与加权聚合、VERL 奖励信号集成,以及 PawBench 的模型×harness 共同评估。

OpenJudge AgentScope 评估 Grader RLHF LLM-as-a-Judge 开源
Read More →

AgentScope 2.0 深度解析:不约束模型、只给基元,3.2 万星的 Agent 框架怎么设计

2026-10-06T14:00:00+08:00

AgentScope 2.0 拆解:九个 SDK 基元、ReAct 循环与事件总线、权限与中间件、记忆与八种沙箱后端、Agent Service,以及 2026 年 9 月的新方向。

AgentScope Agent 多 Agent MCP A2A Realtime 开源 Tutorial
Read More →

为什么 Mac 跑大模型的速度能算出来:拆解 SimulKit 的性能模型

2026-10-06T11:00:00+08:00

拆解 SimulKit 的 Apple 本地 LLM 性能模型:decode 由内存带宽决定、prefill 由算力决定、能不能装下由 macOS 显存上限决定,附量化与 MoE 取舍和实测锚点。

SimulKit 本地推理 Apple Silicon MLX llama.cpp 量化 MoE
Read More →

OpenAI Agents SDK 完整教程:从 Agent 到多 Agent、护栏、会话、MCP 与语音

2026-10-05T22:00:00+08:00

OpenAI Agents SDK 全知识点教程:Agent 配置、Runner 与 RunConfig、结果与中断恢复、流式、工具体系、Handoffs、会话记忆、上下文、护栏、MCP、模型与追踪。

OpenAI Agents SDK Agent 多 Agent MCP Guardrails Tutorial
Read More →

A2A 协议详解:Agent 之间该怎么对话,以及 ADK 里怎么落地

2026-10-05T20:00:00+08:00

A2A 协议与 ADK 落地:三种绑定、Agent Card 契约、to_a2a/RemoteA2aAgent 实战、扩展机制,以及它修掉的三个流式 bug。

A2A Agent2Agent ADK 多 Agent MCP 协议 开源
Read More →

Claude Agent SDK 使用指南:把 Claude Code 当库来跑(Python / TypeScript)

2026-10-05T18:30:00+08:00

Claude Agent SDK 实战:query 与 ClaudeSDKClient、ClaudeAgentOptions 配置、六步权限链、进程内 MCP 自定义工具、hooks、子 Agent、会话与结构化输出。

Claude Agent SDK Anthropic Claude Code Agent Hooks MCP Tutorial
Read More →

agentd 深度解析:把桌面 OS 变成 Agent 的 HTTP API,以及它留下的三个好问题

2026-10-05T18:00:00+08:00

agentd 拆解:以 VM 为边界的桌面 Agent 接口、扁平的鼠标键盘 API、录制即审计,以及这个 45 星项目停更后仍值得借鉴的设计。

agentd AgentSea Computer Use AI Agent 虚拟机 自托管 开源
Read More →

Octop 深度解析:腾讯云开源的多人 Agent 平台,为什么坚持单进程

2026-10-05T16:00:00+08:00

Octop 拆解:单进程架构、控制面与工作区分层、harness/gateway/memory/browser 四件套、IM 全通道、ACP 双向与安全边界。

Octop 腾讯云 Agent 自托管 MCP ACP Harness 开源
Read More →

Claude Code Mods 深度解析:能画界面、能拦工具调用的插件新形态

2026-10-05T14:30:00+08:00

Claude Code Mods 拆解:跑在进程内的 JS/TS 事件钩子、可画界面可接管工具调用、权限与信任模型、事件与 API 清单、多 mod 中间件链与限额。

Claude Code Mods 插件 Agent Hooks MCP DeepSeek Harness
Read More →

GPT-6 Sol Codex 提示词泄露拆解:7 个能直接搬走的工程套路

2026-10-05T13:00:00+08:00

拆解 16 万字符的 Codex 系统提示词合集:负面词清单、权限判定规则、checkpoint 交接、工具决策边界、审查过滤器等 7 个可复用套路。

提示词工程 Codex OpenAI Agent 上下文工程 AI 安全
Read More →

OpenSearch 3.9 深度解析:零停机部署、自适应限流,以及一份 TLA+ 证明

2026-10-05T11:30:00+08:00

OpenSearch 3.9 拆解:部署 drain API、Vegas/Gradient2/AIMD 自适应限流、虚拟线程、远程存储 fencing 的 TLA+ 形式化模型与 MPP 分析引擎。

OpenSearch 搜索引擎 Lucene 分布式系统 TLA+ 运维 开源
Read More →

archify 深度解析:7.7 万星的 Agent Skill,把架构图变成可交互 HTML

2026-10-05T10:30:00+08:00

archify 深度解析:类型化 JSON IR → 可校验的交互式 HTML,五种图类型、四道交付门禁、仓库取证与 Mermaid 输入。

archify Agent Skill 架构图 Claude Code Codex DeepSeek Harness 开源
Read More →

Strands Evals 深度解析:给 Agent 上评测,从打分到定位失败根因

2026-10-04T15:00:00+08:00

Strands Evals 评测体系解析:四块拼图、四个层级、Detectors 根因分析、Simulators 与 CLI 落地。

Strands Evals Agent 评测 Evals AWS CI
Read More →

Strands harness 深度解析:一次 import 拿到成品 Agent,默认值里藏了什么

2026-10-04T14:00:00+08:00

Strands harness 上手解析:默认 harness 装了什么、7 个关键默认值、失效边界与三种上手路径。

Strands harness Agent AWS Harness MCP 开源
Read More →

Strands Decider 2B:2B 参数的开源决策模型,本地几十毫秒出结果

2026-10-04T13:00:00+08:00

Strands 开源 2B 决策模型:砍掉 LM head 换指针头,本地可跑,附 Agent 干预示例。

Strands 决策模型 Agent AWS 开源 JevBench
Read More →
...