程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Ollama Tool Calling × 本地 AI Agent:JSON Schema 协议 × 生产级多工具系统 × 安全防护实战
编程
Ollama Tool Calling × 本地 AI Agent:JSON Schema 协议 × 生产级多工具系统 × 安全防护实战
2026-07-03 08:45:53 +0800 CST
view 317
深度解析 Ollama v0.20 Tool Calling,从协议原理到生产级多工具 Agent 实战,含天气查询、数据库查询、Web搜索三大实战案例与安全防护策略。
Ollama
AI Agent
Tool Calling
本地大模型
【深度长文】Ollama v0.20 工具调用实战:本地大模型 + JSON Schema + 生产级 Agent 系统搭建指南(2026)
编程
【深度长文】Ollama v0.20 工具调用实战:本地大模型 + JSON Schema + 生产级 Agent 系统搭建指南(2026)
2026-07-03 08:47:18 +0800 CST
view 319
深度长文:Ollama v0.20 Tool Calling 从协议原理到生产级多工具 Agent 实战,含天气查询、数据库操作、Web搜索三大案例与安全防护策略(2026)。
Ollama
AI Agent
Tool Calling
本地大模型
生产级
AI编程Agent用10小时凿开CUDA护城河:推理战场的底层软件革命与程序员的真实机遇
编程
AI编程Agent用10小时凿开CUDA护城河:推理战场的底层软件革命与程序员的真实机遇
2026-08-10 14:47:15 +0800 CST
view 120
深度拆解AI编程Agent用10小时为非英伟达芯片搭建底层软件栈的事件:从CUDA三层架构本质、Infinity Ignition Agent原理、推理战场竞争格局、到验证生态护城河,结合DeepSeek TileLang路径对比,给出程序员视角的机遇分析。
CUDA
AI Agent
推理芯片
Infinity
Ignition
d-Matrix
底层软件
GPU Kernel
芯片适配
护城河
DeerFlow 2.0 深度实战:字节跳动 49K Star 的超级智能体运行时——从 LangGraph DAG 到沙箱隔离的全链路架构解析
编程
DeerFlow 2.0 深度实战:字节跳动 49K Star 的超级智能体运行时——从 LangGraph DAG 到沙箱隔离的全链路架构解析
2026-05-07 04:37:34 +0800 CST
view 1014
深度拆解字节跳动开源的 DeerFlow 2.0 超级智能体框架,从 LangGraph DAG 工作流到 11 层中间件链,从动态子智能体到 Docker/K8s 沙箱隔离,从三层记忆架构到六大 IM 渠道接入,全链路架构解析与生产级部署实战。
DeerFlow
AI Agent
LangGraph
字节跳动
智能体
沙箱
开源
编程
Headroom 深度实战:当 AI Agent 学会「上下文压缩」——从 Token 暴降 95% 原理到生产级实践的完全指南(2026)
2026-06-08 17:53:16 +0800 CST
view 850
Headroom 是一个专为 AI Agent 设计的开源上下文压缩中间层,实测节省 60-95% Token,精度保留率高达 97%。本文从架构原理、六大压缩算法、MCP集成到生产级部署全面深度解析。涵盖 ContentRouter、SmartCrusher、可逆缓存等核心技术,配完整 Python 代码示例。适合 Claude Code、Cursor、LangChain 等工具链用户。Apache 2.0 开源可商用。
AI Agent,Token优化,上下文压缩,Headroom,LLM,Python,上下文管理,AI编程,生产实践
Headroom深度实战:当AI Agent学会「上下文减肥」——从60-95% Token压缩到零精度损失的工程完全指南(2026)
编程
Headroom深度实战:当AI Agent学会「上下文减肥」——从60-95% Token压缩到零精度损失的工程完全指南(2026)
2026-06-14 19:18:14 +0800 CST
view 541
全面拆解Headroom上下文压缩工具的原理、架构、接入方式与生产实践,解决AI Agent开发的Token成本与上下文窗口痛点
AI Agent
上下文压缩
Headroom
Token优化
LLM
Headroom深度实战:AI Agent上下文压缩完全指南——60-95% Token节省的零精度损失方案(2026)
编程
Headroom深度实战:AI Agent上下文压缩完全指南——60-95% Token节省的零精度损失方案(2026)
2026-06-14 19:19:54 +0800 CST
view 575
全面拆解Headroom上下文压缩工具的原理、架构、接入方式与生产实践,解决AI Agent开发的Token成本与上下文窗口痛点
AI Agent
上下文压缩
Headroom
Token优化
LLM
Next.js 16.2 深度实战:Vercel启动提速400%、Turbopack生产级打磨、AI Agent原生支持完全指南(2026)
编程
Next.js 16.2 深度实战:Vercel启动提速400%、Turbopack生产级打磨、AI Agent原生支持完全指南(2026)
2026-06-20 04:53:32 +0800 CST
view 472
Next.js 16.2深度实战:启动速度提升400%、Turbopack 200+项修复、Server Fast Refresh默认开启、JSON.parse性能优化350%、AI Agent原生支持。从背景介绍到架构分析、从代码实战到生产部署,15000字完全指南。
Next.js
Turbopack
React
Server Components
AI Agent
Hermes Agent 深度实战:47K+ Star 的自进化 AI 智能体框架——从 Harness Engineering 到 Skill 闭环系统的全链路架构解析
编程
Hermes Agent 深度实战:47K+ Star 的自进化 AI 智能体框架——从 Harness Engineering 到 Skill 闭环系统的全链路架构解析
2026-05-07 07:06:42 +0800 CST
view 889
深度解析 Hermes Agent 的自我进化机制、四层记忆架构、Skill 自动生成系统,以及从本地到生产的完整部署实践。
AI
Agent
开源
框架
自进化
字节跳动DeerFlow 2.0技术全解析:从零构建生产级AI智能体系统(2026完整实战指南)
编程
字节跳动DeerFlow 2.0技术全解析:从零构建生产级AI智能体系统(2026完整实战指南)
2026-05-19 11:18:35 +0800 CST
view 721
DeerFlow 2.0是字节跳动开源的企业级多智能体协作框架,本文从架构设计、核心机制、源码分析、实战部署、性能调优五个维度进行深度解析。
DeerFlow
AI Agent
字节跳动
智能体框架
多智能体
MCP 深度拆解:当 AI Agent 学会「插拔」——Model Context Protocol 如何用 JSON-RPC 2.0 重写 AI 工具调用的心智模型
编程
MCP 深度拆解:当 AI Agent 学会「插拔」——Model Context Protocol 如何用 JSON-RPC 2.0 重写 AI 工具调用的心智模型
2026-07-15 09:42:17 +0800 CST
view 273
从工程师视角深度拆解 MCP 协议:三大核心原语、传输层机制(stdio/SSE)、Python/TypeScript SDK 实战、生产架构设计,以及它对 AI Agent 生态的深远影响。
MCP
Model Context Protocol
JSON-RPC
AI Agent
Tool Calling
sqlite-vec 深度实战:当 SQLite 遇见向量搜索,AI 应用的轻量级记忆系统从此有了标准答案(2026)
编程
sqlite-vec 深度实战:当 SQLite 遇见向量搜索,AI 应用的轻量级记忆系统从此有了标准答案(2026)
2026-07-22 01:16:13 +0800 CST
view 207
深度解析 sqlite-vec:一个纯C实现的SQLite向量搜索扩展,让SQLite直接支持语义搜索。涵盖核心架构、HNSW索引原理、SQL API完全指南、Python实战案例(知识库检索系统、AI Agent长期记忆、RAG系统)、性能优化、常见问题解决方案以及LangChain/LlamaIndex生态集成。
sqlite-vec
SQLite
向量搜索
AI应用
语义检索
RAG
Embedding
HNSW
AI Agent
vLLM 深度拆解:当 KV Cache 学会「分页」——用操作系统智慧重写 LLM 推理的心智模型
编程
vLLM 深度拆解:当 KV Cache 学会「分页」——用操作系统智慧重写 LLM 推理的心智模型
2026-07-15 10:13:07 +0800 CST
view 249
深度拆解 vLLM 核心架构:从 PagedAttention 分页内存管理、Continuous Batching 动态调度,到 Speculative Decoding、Prefix Caching 等高级特性,配完整代码示例与生产部署指南。
vLLM
PagedAttention
LLM推理
深度学习
GPU优化
Continuous Batching
LangChain 2026 深度解析:从 Chain 到 Agent,LLM 应用开发的事实标准全面进化
编程
LangChain 2026 深度解析:从 Chain 到 Agent,LLM 应用开发的事实标准全面进化
2026-05-14 12:41:08 +0800 CST
view 947
LangChain 2026完成架构级重构:Agent取代Chain成为核心抽象、LangGraph状态机支持分支循环暂停、Deep Agents多智能体协作、MCP标准化工具协议、LangSmith全链路可观测性。完整API对比(2024 vs 2026)、迁移指南与企业知识库Agent实战。
LangChain
LangGraph
Agent
MCP
AI
Headroom 深度实战:当 AI Agent 的上下文压缩层省下 95% Token——从 ContentRouter 智能路由到 CCR 可逆压缩、从 Claude Code 到 MCP 的生产级完全指南(2026)
编程
Headroom 深度实战:当 AI Agent 的上下文压缩层省下 95% Token——从 ContentRouter 智能路由到 CCR 可逆压缩、从 Claude Code 到 MCP 的生产级完全指南(2026)
2026-06-20 06:24:34 +0800 CST
view 708
Headroom 是 AI Agent 的上下文压缩层,通过 ContentRouter、SmartCrusher、CodeCompressor、Kompress-base 与 CCR 可逆压缩,在 LLM 接收前削减 60–95% token。本文从架构、算法、代码实战到生产落地,提供完整指南。
Headroom
AI Agent
Context Compression
MCP
Token Optimization
Solon AOT & Native:三段式编译,把 Java 原生编译的门槛从珠穆朗玛峰削到崇明岛
编程
Solon AOT & Native:三段式编译,把 Java 原生编译的门槛从珠穆朗玛峰削到崇明岛
2026-08-17 13:15:31 +0800 CST
view 15
深度拆解 Solon AOT & Native 三段式编译流水线:如何将 GraalVM Native Image 的适配工作从手动模式变成自动模式,配完整可运行代码与性能对比数据。
Solon
AOT
Native Image
GraalVM
Java
原生编译
云原生
Serverless
Web Access Skill开源:让AI Agent接管你的Chrome,Cookie登录态全继承
编程
Web Access Skill开源:让AI Agent接管你的Chrome,Cookie登录态全继承
2026-05-14 12:57:53 +0800 CST
view 692
Web Access是开源Agent Skill,通过CDP协议直接接管日常Chrome浏览器,继承Cookie登录态/扩展/书签,三层能力架构:工具自动调度+真实浏览器操作+站点经验积累,兼容Claude Code/Cursor/Gemini CLI等。
AI Agent
浏览器自动化
CDP
Skill
开源项目
Nanobot:港大开源4000行代码的超轻量AI助手,仅OpenClaw代码量的1%,却复刻了核心战力
编程
Nanobot:港大开源4000行代码的超轻量AI助手,仅OpenClaw代码量的1%,却复刻了核心战力
2026-04-16 19:06:52 +0800 CST
view 1104
Nanobot是香港大学数据科学实验室开源的超轻量AI助手框架,仅用约4000行代码实现了OpenClaw的核心能力,支持9大聊天平台接入和数十种LLM模型,23.1K Stars。
AI助手
OpenClaw
港大
Python
开源
MIT
轻量级
Agent
腾讯云 Cube Sandbox 全栈开源解读:AI Agent 安全执行底座的架构与实战
编程
腾讯云 Cube Sandbox 全栈开源解读:AI Agent 安全执行底座的架构与实战
2026-04-26 04:41:26 +0800 CST
view 1526
深度解析腾讯云开源的 Cube Sandbox:业内首个兼顾硬件级隔离与亚百毫秒启动的 AI Agent 沙箱服务,从架构设计到生产实战全指南
Cube Sandbox
AI Agent
云原生
沙箱安全
MicroVM
开源
腾讯开源Agent Memory:上下文卸载+Mermaid任务画布,Token消耗降低61%
编程
腾讯开源Agent Memory:上下文卸载+Mermaid任务画布,Token消耗降低61%
2026-05-14 15:31:52 +0800 CST
view 905
腾讯云开源TencentDB Agent Memory,通过上下文卸载+Mermaid任务画布为Agent长任务提供记忆压缩,实测Token消耗降低61%同时提升成功率,兼容OpenClaw/Hermes,零依赖SQLite本地存储。
AI Agent
腾讯开源
上下文管理
Token优化
Mermaid
GLM-5.2 深度解析:百万上下文 + 异步Agent RL + MIT开源,国产大模型里程碑级突破
编程
GLM-5.2 深度解析:百万上下文 + 异步Agent RL + MIT开源,国产大模型里程碑级突破
2026-06-27 18:46:30 +0800 CST
view 1218
智谱AI发布GLM-5.2旗舰开源大模型:744B MoE架构+40B激活参数、1M百万Token稳定上下文、异步Agent RL训练、IndexShare稀疏注意力将计算量降低2.9倍。SWE-bench Pro编程能力超越GPT-5.5,MIT协议完全开源。本文深度解析其技术架构、训练方法、性能评测与生产实践。
GLM-5.2
Z.ai
开源大模型
MoE
异步Agent RL
百万上下文
MIT协议
MCP 深度解析:为什么 Model Context Protocol 正在成为 AI Agent 的 USB 标准
编程
MCP 深度解析:为什么 Model Context Protocol 正在成为 AI Agent 的 USB 标准
2026-07-03 12:16:35 +0800 CST
view 348
深度解析 Anthropic MCP 协议:4000+生态、四层架构、TypeScript SDK实战、安全模型与最佳实践
MCP
Model Context Protocol
AI Agent
Claude Code
Anthropic
Grok 4.6 深度测评:xAI 如何用「长程 Agent」撕开 OpenAI 的护城河——从架构原理到生产级集成全链路拆解
编程
Grok 4.6 深度测评:xAI 如何用「长程 Agent」撕开 OpenAI 的护城河——从架构原理到生产级集成全链路拆解
2026-08-17 15:16:22 +0800 CST
view 11
深度拆解 xAI Grok 4.6:长程 Agent 任务的专用优化、500K 上下文、实时 X 数据访问、与 GPT-5.6 Sol 的真实差距,以及 Cursor/Cloudflare/OpenRouter/Vercel 全平台集成实战,配完整代码与基准测试数据。
Grok 4.6
xAI
AI Agent
长程任务
Grok
API集成
Cloudflare
OpenRouter
Cursor
模型评测
LangGraph:告别if-else,用图结构编排复杂AI工作流,循环和人工干预天然支持
编程
LangGraph:告别if-else,用图结构编排复杂AI工作流,循环和人工干预天然支持
2026-04-16 19:09:33 +0800 CST
view 921
LangGraph是langchain-ai开源的AI Agent工作流编排框架(25K Stars),用图结构替代LangChain的链式调用,支持循环、条件分支、检查点和人工干预,适合复杂多步骤Agent。
LangGraph
AI
工作流
LangChain
Agent
开源
Python
图结构
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
60
61
62
63
64
...
127
下一页