● 最新博客
全部文章 →Muse Gadgets SDK 深度解析:一块 ESP32,把家里的设备接进 AI 助手
Muse Gadgets SDK 拆解:ESP32 与 Linux 两条设备路线、20+ 开发板支持、43 个设备技能目录、安全模型与 AGENTS.md 驱动的 AI 原生开发流程。
AgentTeams 深度解析:多 Agent 协作为什么跑在 Matrix 房间里
AgentTeams 拆解:用 Matrix 房间当协作底座、Manager-Workers 架构、网关凭证隔离、四种 Worker 运行时共存、MinIO 共享文件系统与 K8s 原生部署。
OpenJudge 深度解析:把评估做成可复用的 grader,再把结果变成奖励信号
OpenJudge 拆解:50+ 内置 grader 的分类学、四种造 grader 的路径、GradingRunner 与加权聚合、VERL 奖励信号集成,以及 PawBench 的模型×harness 共同评估。
AgentScope 2.0 深度解析:不约束模型、只给基元,3.2 万星的 Agent 框架怎么设计
AgentScope 2.0 拆解:九个 SDK 基元、ReAct 循环与事件总线、权限与中间件、记忆与八种沙箱后端、Agent Service,以及 2026 年 9 月的新方向。
为什么 Mac 跑大模型的速度能算出来:拆解 SimulKit 的性能模型
拆解 SimulKit 的 Apple 本地 LLM 性能模型:decode 由内存带宽决定、prefill 由算力决定、能不能装下由 macOS 显存上限决定,附量化与 MoE 取舍和实测锚点。
OpenAI Agents SDK 完整教程:从 Agent 到多 Agent、护栏、会话、MCP 与语音
OpenAI Agents SDK 全知识点教程:Agent 配置、Runner 与 RunConfig、结果与中断恢复、流式、工具体系、Handoffs、会话记忆、上下文、护栏、MCP、模型与追踪。
A2A 协议详解:Agent 之间该怎么对话,以及 ADK 里怎么落地
A2A 协议与 ADK 落地:三种绑定、Agent Card 契约、to_a2a/RemoteA2aAgent 实战、扩展机制,以及它修掉的三个流式 bug。
Claude Agent SDK 使用指南:把 Claude Code 当库来跑(Python / TypeScript)
Claude Agent SDK 实战:query 与 ClaudeSDKClient、ClaudeAgentOptions 配置、六步权限链、进程内 MCP 自定义工具、hooks、子 Agent、会话与结构化输出。
agentd 深度解析:把桌面 OS 变成 Agent 的 HTTP API,以及它留下的三个好问题
agentd 拆解:以 VM 为边界的桌面 Agent 接口、扁平的鼠标键盘 API、录制即审计,以及这个 45 星项目停更后仍值得借鉴的设计。
Octop 深度解析:腾讯云开源的多人 Agent 平台,为什么坚持单进程
Octop 拆解:单进程架构、控制面与工作区分层、harness/gateway/memory/browser 四件套、IM 全通道、ACP 双向与安全边界。
Claude Code Mods 深度解析:能画界面、能拦工具调用的插件新形态
Claude Code Mods 拆解:跑在进程内的 JS/TS 事件钩子、可画界面可接管工具调用、权限与信任模型、事件与 API 清单、多 mod 中间件链与限额。
GPT-6 Sol Codex 提示词泄露拆解:7 个能直接搬走的工程套路
拆解 16 万字符的 Codex 系统提示词合集:负面词清单、权限判定规则、checkpoint 交接、工具决策边界、审查过滤器等 7 个可复用套路。
OpenSearch 3.9 深度解析:零停机部署、自适应限流,以及一份 TLA+ 证明
OpenSearch 3.9 拆解:部署 drain API、Vegas/Gradient2/AIMD 自适应限流、虚拟线程、远程存储 fencing 的 TLA+ 形式化模型与 MPP 分析引擎。
archify 深度解析:7.7 万星的 Agent Skill,把架构图变成可交互 HTML
archify 深度解析:类型化 JSON IR → 可校验的交互式 HTML,五种图类型、四道交付门禁、仓库取证与 Mermaid 输入。
Strands Evals 深度解析:给 Agent 上评测,从打分到定位失败根因
Strands Evals 评测体系解析:四块拼图、四个层级、Detectors 根因分析、Simulators 与 CLI 落地。
Strands harness 深度解析:一次 import 拿到成品 Agent,默认值里藏了什么
Strands harness 上手解析:默认 harness 装了什么、7 个关键默认值、失效边界与三种上手路径。
Strands Decider 2B:2B 参数的开源决策模型,本地几十毫秒出结果
Strands 开源 2B 决策模型:砍掉 LM head 换指针头,本地可跑,附 Agent 干预示例。
ACP 协议详解:让任何编辑器连任何 Agent 的'JSON-RPC 粘合层',怎么用
Zed 发起的 Agent Client Protocol 详解:与 MCP 的关系、JSON-RPC over stdio、prompt turn 生命周期、40+ 生态与三种上手方式。
DeepSeek 公开 DSec 论文:每天 300 万沙箱、38 万并发的 Agentic 训练基建
DeepSeek 论文 DSec:160 节点每天 300 万沙箱、38 万并发的 Agentic RL 训练基建全拆解——四后端、EROFS 分层、内存回收、agent 恶意行为实录。
Open-Agent:AFFiNE 血统的 Manus 开源替代,多模型协作 + 第二大脑
Open-Agent:AFFiNE 血统的通用 Agent 开源替代(Claude Agent SDK/ChatGPT Agents/Manus),多模型协作 + 第二大脑。注意已停更一年。
讯飞开源 Astron Agent:把 RPA 焊进 Agent 平台,高可用版本全量开源
讯飞开源 Astron Agent:9100 星的企业级 Agent 工作流平台,Apache 2.0 无商用限制,特色是 RPA 集成与高可用全量开源。
别用想象的 case 测模型:OpenRouter 从生产流量构建黄金评测集指南翻译
OpenRouter 教程三部曲收官:从生产流量构建黄金评测集——五步流程、规模参考、rubric 设计与跨模型选型。全文翻译加解读。
Agent 调错工具 vs 传错参数:OpenRouter 工具调用准确性测试指南翻译
OpenRouter 官方教程:工具选择与参数正确性分开测——无参考 judge、确定性 schema 检查、轨迹比较三方法与常见错误。全文翻译加解读。
📢 广告位招租
通过公众号「AI人工智能时代」留言联系作者
关注公众号入群聊