550 articles · Page 1 of 28
agentd:用操作系统的思路驯服 AI Agent 的 Rust 运行时
不内置任何工具、supervisor 不碰 LLM、推理跑在可被强杀的子进程里——agentd 用系统编程思路重做 Agent 运行时
Harbor 深度解析:任何 Agent × 任何沙箱,把评测变成可复现的软件包
Harbor 拆解:task 目录格式与 reward 约定、42 个 Agent 适配、沙箱可插拔、ATIF 统一轨迹格式、多步任务、Rewardkit 与 Harbor Hub。
OpenWiki:让 AI Agent 给代码库写一本带证据链的活维基
LangChain 开源的 OpenWiki 把代码库变成带溯源 Claims 的活维基:MCP 生命周期、断点续跑、源码漂移自动重写,17k stars 背后的工程细节。
Muse Gadgets SDK 深度解析:一块 ESP32,把家里的设备接进 AI 助手
Muse Gadgets SDK 拆解:ESP32 与 Linux 两条设备路线、20+ 开发板支持、43 个设备技能目录、安全模型与 AGENTS.md 驱动的 AI 原生开发流程。
AgentTeams 深度解析:多 Agent 协作为什么跑在 Matrix 房间里
AgentTeams 拆解:用 Matrix 房间当协作底座、Manager-Workers 架构、网关凭证隔离、四种 Worker 运行时共存、MinIO 共享文件系统与 K8s 原生部署。
OpenJudge 深度解析:把评估做成可复用的 grader,再把结果变成奖励信号
OpenJudge 拆解:50+ 内置 grader 的分类学、四种造 grader 的路径、GradingRunner 与加权聚合、VERL 奖励信号集成,以及 PawBench 的模型×harness 共同评估。
AgentScope 2.0 深度解析:不约束模型、只给基元,3.2 万星的 Agent 框架怎么设计
AgentScope 2.0 拆解:九个 SDK 基元、ReAct 循环与事件总线、权限与中间件、记忆与八种沙箱后端、Agent Service,以及 2026 年 9 月的新方向。
为什么 Mac 跑大模型的速度能算出来:拆解 SimulKit 的性能模型
拆解 SimulKit 的 Apple 本地 LLM 性能模型:decode 由内存带宽决定、prefill 由算力决定、能不能装下由 macOS 显存上限决定,附量化与 MoE 取舍和实测锚点。
OpenAI Agents SDK 完整教程:从 Agent 到多 Agent、护栏、会话、MCP 与语音
OpenAI Agents SDK 全知识点教程:Agent 配置、Runner 与 RunConfig、结果与中断恢复、流式、工具体系、Handoffs、会话记忆、上下文、护栏、MCP、模型与追踪。
A2A 协议详解:Agent 之间该怎么对话,以及 ADK 里怎么落地
A2A 协议与 ADK 落地:三种绑定、Agent Card 契约、to_a2a/RemoteA2aAgent 实战、扩展机制,以及它修掉的三个流式 bug。
Claude Agent SDK 使用指南:把 Claude Code 当库来跑(Python / TypeScript)
Claude Agent SDK 实战:query 与 ClaudeSDKClient、ClaudeAgentOptions 配置、六步权限链、进程内 MCP 自定义工具、hooks、子 Agent、会话与结构化输出。
agentd 深度解析:把桌面 OS 变成 Agent 的 HTTP API,以及它留下的三个好问题
agentd 拆解:以 VM 为边界的桌面 Agent 接口、扁平的鼠标键盘 API、录制即审计,以及这个 45 星项目停更后仍值得借鉴的设计。
Octop 深度解析:腾讯云开源的多人 Agent 平台,为什么坚持单进程
Octop 拆解:单进程架构、控制面与工作区分层、harness/gateway/memory/browser 四件套、IM 全通道、ACP 双向与安全边界。
Claude Code Mods 深度解析:能画界面、能拦工具调用的插件新形态
Claude Code Mods 拆解:跑在进程内的 JS/TS 事件钩子、可画界面可接管工具调用、权限与信任模型、事件与 API 清单、多 mod 中间件链与限额。
GPT-6 Sol Codex 提示词泄露拆解:7 个能直接搬走的工程套路
拆解 16 万字符的 Codex 系统提示词合集:负面词清单、权限判定规则、checkpoint 交接、工具决策边界、审查过滤器等 7 个可复用套路。
OpenSearch 3.9 深度解析:零停机部署、自适应限流,以及一份 TLA+ 证明
OpenSearch 3.9 拆解:部署 drain API、Vegas/Gradient2/AIMD 自适应限流、虚拟线程、远程存储 fencing 的 TLA+ 形式化模型与 MPP 分析引擎。
archify 深度解析:7.7 万星的 Agent Skill,把架构图变成可交互 HTML
archify 深度解析:类型化 JSON IR → 可校验的交互式 HTML,五种图类型、四道交付门禁、仓库取证与 Mermaid 输入。
Strands Evals 深度解析:给 Agent 上评测,从打分到定位失败根因
Strands Evals 评测体系解析:四块拼图、四个层级、Detectors 根因分析、Simulators 与 CLI 落地。
Strands harness 深度解析:一次 import 拿到成品 Agent,默认值里藏了什么
Strands harness 上手解析:默认 harness 装了什么、7 个关键默认值、失效边界与三种上手路径。
Strands Decider 2B:2B 参数的开源决策模型,本地几十毫秒出结果
Strands 开源 2B 决策模型:砍掉 LM head 换指针头,本地可跑,附 Agent 干预示例。
📢 广告位招租
通过公众号「AI人工智能时代」留言联系作者
关注公众号入群聊