混合技术应用 AI 应用
阅读 13 评论 0 点赞 0

混合技术应用

本文通过9个典型场景,拆解RAG、Agent、多模态处理、工具调用、工程化部署等核心技术的混合应用逻辑。RAG构建企业知识库,解决幻觉与私有知识问题,生产端经文档解析、智能切片、向量化建库,消费端通过多路召回、重排、流式生成实现闭环。Agent通过意图路由、短期/长期记忆与工具调用形成对话记忆闭环;多Agent编排借助总控与子Agent分工处理复杂任务。FC、MCP与RAG构成“黄金三角”,分别负责动态工具调用、标准化接入与静态知识检索。多模态摘要降维、NL2SQL自助取数、高并发工程策略、数仓ETL及推荐系统三层链路进一步拓展应用边界。读者可掌握从技术选型到系统落地的完整思路,核心在于场景化组合RAG+向量库+大模型+工具链的底层逻辑。

#综合应用#架构设计
OpenClaw 自托管 Agent 网关 AI 应用
阅读 4 评论 0 点赞 1

OpenClaw 自托管 Agent 网关

OpenClaw是一个自托管开源AI助手网关,将飞书、钉钉、微信等聊天软件统一接入本地LLM Agent,实现多渠道统一接入、自托管安全可控。其核心三层架构(Channel/Brain/Body)实现关注点分离:Gateway层负责消息路由与鉴权,从不调用模型;Brain层负责指令解析、人格定义和LLM推理,支持Claude/GPT等模型无缝切换;Body层提供工具调用(如天气、日程)和文件操作。消息处理遵循七阶段Agentic循环(归一化、路由、上下文组装、LLM推理、ReAct工具循环、技能加载、持久化记忆)。记忆采用Markdown+YAML文件存储,支持人工编辑和Git备份,通过检索式访问避免上下文窗口爆炸。自动化任务支持Heartbeat心跳、Cron定时和Webhook事件触发。安全设计三道权限闸:入口闸(本地连接与配对码)、工具闸(默认拒绝白名单)、执行闸(Docker沙箱隔离)。实践踩坑提示包括记忆选择性遗忘、技能依赖耦合、Cron时区问题及Docker权限控制。核心优势:透明可控、安全隔离、灵活扩展。

#OpenClaw#Agent网关#系统设计
Claude Code 原理与优化 AI 应用
阅读 5 评论 0 点赞 0

Claude Code 原理与优化

Claude Code 的核心是单线程 while 主循环(ReAct 模式),通过工具调用触发循环,纯文本回复终止;支持实时打断(h2A 双缓冲队列)。为应对上下文窗口限制,设计五层压缩流水线(从丢弃旧消息到语义压缩),并强调状态外化到文件(如 CLAUDE.md)避免依赖内存。持久记忆由跨会话的 CLAUDE.md 和会话级扁平消息历史构成。四大扩展机制(MCP、Skills、Plugins、Hooks)与子代理(仅返回摘要)实现可控扩展。成本优化需分级选模型、主动压缩(/compact)、回退隔离及切换镜像。Agent SDK 复用核心 harness 加速开发。掌握工具触发循环、压缩策略和状态外化,可构建可控、可调试的生产级 AI 代理系统。

#Claude Code#Agent#上下文工程
Vanna 与 NL2SQL AI 应用
阅读 6 评论 0 点赞 0

Vanna 与 NL2SQL

Vanna 是一个基于 RAG 的开源 NL2SQL 框架,不微调模型,而是通过向量化存储 DDL、业务文档和示例 SQL 对,在用户提问时检索相关上下文,由 LLM 生成 SQL 并执行,支持安全校验和自校正。其核心优势在于低成本、可增量更新、可解释且框架无关(支持多种 LLM、向量库和数据库)。训练阶段仅需向量化语料,提问阶段自动完成检索、生成、执行和结果可视化。针对 Schema Linking、业务口径歧义、SQL 方言差异和安全风险等难点,Vanna 提供两级检索、业务文档定义、方言指定和三层安全防御等方案。评估应使用执行结果准确率而非文本匹配。Vanna 2.0 转向 Agent 化架构,支持多轮交互、用户权限和流式富 UI。读者可快速落地低成本、可扩展的文本转 SQL 方案,连接业务人员与数据库。

#NL2SQL#Vanna#Text-to-SQL