2026-09-10
《太空行动》怎么用-太空行动每个版本
从“生成一篇知识点”到“面对面讲清一道题”:我用魔珐星云改造 AI 教育助手的实践
作者通过接入魔珐星云数字人SDK,将AI教育助手从静态知识点生成升级为实时讲解的具身智能体。数字人能够流式接收模型输出并实时表达,让二次函数讲解从文章变成面对面教学。本文分享了改造过程与架构设计,为教育场景提供可落地的数字人交互方案。
2026-07-23 0
24—AI Skill 测评工作流工具箱化:regression 为何自然出现
本文探讨AI Skill测评工作流工具箱化,解析regression为何自然涌现。通过将单体管道拆分为原子工具并以文件作为接口,实现了按需组合工作流。工具箱化最大价值不是速度提升,而是让回归测试这种按需工作流变得可能,支持日常修复验证。
2026-07-23 0
调查研究-198 Agent 到底该记住什么 读懂《What Must Generalist Agents Remember?》
这篇关于通用Agent记忆的深度解读,解析Agent到底该记住什么。核心观点是记忆必须消除隐藏环境不确定性,保留控制相关信息以支持决策。文章提出四层记忆框架,涵盖上下文引用、任务状态、环境区分和局部世界模型,为Agent系统设计提供理论指导。
2026-07-23 0
Claude 不会直接执行你的函数:它只会生成一段结构化的工具调用请求。真正执行函数、访问数据库、请求外部 API 的动作:必须由你的后端完成。
Claude 不会直接执行函数,而是生成结构化工具调用请求,真正执行函数、访问数据库或请求外部API的操作必须由后端完成。Claude Tool Use 的核心是让模型负责决策和参数生成,后端负责执行和安全控制,包括参数校验、权限校验和异常处理,适合查询实时数据、访问内部系统等场景,确保大模型安全稳定地参与真实业务流程。
2026-07-23 0
给 Claude Code 布置任务:它为什么总是理解错——我找到原因了
Coding Agent任务描述总出错?82%失败源于规划阶段而非执行。本文揭示Claude Code任务描述的5段式模板与CLAUDE.md项目级约束,先定约束再谈实现,首次成功率从23%升到61%。帮助开发者避免反复修正,高效利用AI编码工具提升效率。
2026-07-23 0
读懂 Claude Code loop 与编码 Agent 的循环革命
Claude Code /loop 实现带记忆的定时循环,让编码Agent从单次prompt转向循环革命。它通过会话级调度、持久上下文和抖动机制,高效处理CI修复、测试批量修复等重复任务。理解三层循环模型,掌握loop engineering新范式,是2026年编码效率提升的关键。
2026-07-23 0
中间件系统:于 Agent 执行流中插入自定义逻辑
中间件系统提供9个钩子,在Agent执行流中插入自定义逻辑实现可写拦截。与只读的Callback不同,中间件可改写消息历史、工具调用结果,支持错误处理、悬空工具调用修补和上下文压缩。开发者通过嵌入基础中间件只实现关心的钩子,灵活控制Agent行为。
2026-07-23 0
01 - OpenAI Codex 初探:AI 编程袋里的四种打开方式
OpenAI Codex是AI编程代理,提供桌面应用、命令行、IDE插件和云端Web四种入口。它能直接读取项目文件、修改代码并运行测试,属于执行者而非顾问。与ChatGPT互补,同Claude Code各有侧重,适合开发者快速上手提升效率。
2026-07-23 0
准确率从45%飙升至78%:为何 Agentic 架构是 RAG 的唯一解?
Agentic架构让RAG准确率从45%提升至78%,成为企业AI应用的关键升级。本文解析RAG与Agent融合架构的模式演进框架选型与实施路线,涵盖Hybrid RAG、Graph RAG等架构模式。通过智能客服实战案例展示Agentic RAG如何解决复杂推理问题,帮助企业提升AI系统效果。
2026-07-23 0
从零开始搭建一个AI Agent —— LangChain + TypeScript实战手记
本文分享从零搭建AI Agent的实战教程,使用LangChain与TypeScript实现。涵盖项目初始化、工具定义、Agent创建、流式输出、多轮对话及Extended Thinking。适合开发者快速掌握AI Agent开发核心要点。
2026-07-23 0
日本发布媲美Fable5的模型?Fugu Ultra初探!
日本Sakana公司发布Fugu Ultra模型,采用多智能体编排系统,通过单一API提供高性能推理。其性能媲美Fable 5和Mythos,在编程和代码审查场景表现突出。Fugu Ultra强调AI主权,可动态切换底层模型规避供应链风险,提供订阅和按量付费方案。
2026-07-23 0
从“跨 SSH 肉眼打捞”到“一底座多视图溯源”:2026硬核技术团队的链路治理革新
从跨SSH肉眼打捞到一底座多视图溯源,2026硬核技术团队以分布式执行流日志溯源工具推动链路治理革新。该工具实现全栈状态穿透,通过分布式执行流日志溯源解决日志断层与黑盒排障困境,达成拓扑一键定责,提升复杂流水线的交付效能。
2026-07-23 0
公司固定资产怎么管才合规?采购 入库 领用 盘点 处置全流程规范
本文详述公司固定资产合规管理全流程,包括采购、入库、领用、盘点、处置等环节。核心是建立一物一码和责任人制度,实现从购买到报废的闭环管理,有效解决资产盘点混乱和流失问题。
2026-07-23 0
验证码识别实战:前端不写页面改训模型了?
本文记录前端团队借助AI辅助,用DDDD低代码和PyTorch CNN两种方案训练验证码识别模型。分别应对简单与复杂难度的4位数字字母验证码,展现前端从调用API到自主生产模型的AI协作过程,让验证码识别不再依赖传统页面开发。
2026-07-23 0
一句话:让你用上 GPT-5.6
通过一个XML探针Prompt可让模型输出内部Juice数字,以此推测是否已用上GPT-5.6。若返回128,可能意味着灰度到GPT-5.6 Sol版本。这个技巧帮助用户检测模型路由环境,了解自己是否处于新版本测试中。
2026-07-23 0