Agent Harness
拆解上下文、工具、记忆、权限、评测与运行时如何共同决定 Agent 的可靠性。
研究Agent 工程 · AI for Math · 教育 SaaS
长期研究与拆解 Agent 工程,探索 AI 在教育场景中的落地。关注 Agent Harness、LLM 应用工程、AI for Math 与教育 SaaS 产品化实践。
核心理念
拆解上下文、工具、记忆、权限、评测与运行时如何共同决定 Agent 的可靠性。
研究关注从原型到生产环境的 Agent 架构、可观测性、成本与工程边界。
工程把形式推理与 Agent 工程应用到数学学习系统和教育产品化实践中。
落地AI for Math · Math Agent · Multi Agent · Formal Reasoning · Proof Verification
结合 First Proof、Momus、LeanMarathon、Danus 与 Aletheia 等案例,分析数学 Agent 在路线选择、依赖管理、长证明和失败信息保留上的核心难点。
约 17 分钟
阅读LLM Engineering · Agent Efficiency · Context Engineering · LLM Cost · Model Routing
面向 Agent、Skill、MCP、AI 编程与模型 API 的成本优化指南:从任务成本核算、上下文管理、缓存、工具裁剪到模型选择与停止条件。
约 15 分钟
阅读