程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Ollama v0.20 Tool Calling 深度解析:本地 AI Agent 的最后一公里——JSON Schema 协议 × 生产级多工具实战 × 安全防护全指南
编程
Ollama v0.20 Tool Calling 深度解析:本地 AI Agent 的最后一公里——JSON Schema 协议 × 生产级多工具实战 × 安全防护全指南
2026-07-03 08:44:52 +0800 CST
view 167
深度解析 Ollama v0.20 的 Tool Calling 能力,从 JSON Schema 协议原理到生产级多工具 Agent 实战,含安全防护与性能基准测试。
Ollama
AI Agent
Tool Calling
本地大模型
LangChain4j
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
编程
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
2026-07-15 08:45:14 +0800 CST
view 131
从工程师视角深度拆解 Ollama 与本地大模型推理引擎:GGUF 单文件格式、K-quant/IQ-quant 量化家族、内存带宽墙、llama.cpp 计算图与 KV Cache,配 Modelfile、Python/Go 流式客户端与自量化实战。
Ollama
llama.cpp
GGUF
本地推理
大模型量化
KV Cache
vLLM 深度拆解:当 KV Cache 学会「分页」——用操作系统智慧重写 LLM 推理的心智模型
编程
vLLM 深度拆解:当 KV Cache 学会「分页」——用操作系统智慧重写 LLM 推理的心智模型
2026-07-15 10:13:07 +0800 CST
view 136
深度拆解 vLLM 核心架构:从 PagedAttention 分页内存管理、Continuous Batching 动态调度,到 Speculative Decoding、Prefix Caching 等高级特性,配完整代码示例与生产部署指南。
vLLM
PagedAttention
LLM推理
深度学习
GPU优化
Continuous Batching
LangChain 2026 深度解析:从 Chain 到 Agent,LLM 应用开发的事实标准全面进化
编程
LangChain 2026 深度解析:从 Chain 到 Agent,LLM 应用开发的事实标准全面进化
2026-05-14 12:41:08 +0800 CST
view 790
LangChain 2026完成架构级重构:Agent取代Chain成为核心抽象、LangGraph状态机支持分支循环暂停、Deep Agents多智能体协作、MCP标准化工具协议、LangSmith全链路可观测性。完整API对比(2024 vs 2026)、迁移指南与企业知识库Agent实战。
LangChain
LangGraph
Agent
MCP
AI
Go 1.27 深度拆解:当 SIMD 终于走进标准库——两层模型如何用架构无关设计重写 Go 性能优化心智模型
编程
Go 1.27 深度拆解:当 SIMD 终于走进标准库——两层模型如何用架构无关设计重写 Go 性能优化心智模型
2026-07-15 11:15:27 +0800 CST
view 123
从工程师视角深度拆解 Go 1.27 SIMD:两层模型(archsimd + portable simd)、AMD64 AVX2/AVX-512 向量指令、动态位宽抽象、水平求和优化,配完整代码示例与性能调优实战。
Go语言
SIMD
性能优化
archsimd
AVX512
向量计算
Go 1.27
amd64
Claude Code官方桌面端正式发布,实时预览太强了
编程
Claude Code官方桌面端正式发布,实时预览太强了
2026-05-29 04:15:00 +0800 CST
view 660
Claude Code Desktop是Anthropic官方推出的桌面应用程序,集成Chat、Cowork和Code三大核心功能,免登录即可使用。最惊艳的功能是Claude Preview,改完代码自动起开发服务器,在内嵌浏览器里实时看效果。
Claude Code
桌面端
Anthropic
AI编程
Claude Preview
CC Switch
前端开发
实时预览
Arch Linux AUR 供应链攻击深度实战:当400+软件包沦为攻击跳板——从PKGBUILD恶意修改到eBPF Rootkit、从孤儿包领养机制到供应链安全的生产级防御完全指南(2026)
编程
Arch Linux AUR 供应链攻击深度实战:当400+软件包沦为攻击跳板——从PKGBUILD恶意修改到eBPF Rootkit、从孤儿包领养机制到供应链安全的生产级防御完全指南(2026)
2026-06-20 08:26:44 +0800 CST
view 305
2026年6月,Arch Linux AUR遭遇史上最大规模供应链攻击。本文深度解析攻击原理、PKGBUILD恶意修改手法、eBPF Rootkit技术细节,并提供完整的防御体系构建指南。
Arch Linux
AUR
供应链攻击
PKGBUILD
eBPF
Rootkit
开源安全
Linux安全
LangGraph:告别if-else,用图结构编排复杂AI工作流,循环和人工干预天然支持
编程
LangGraph:告别if-else,用图结构编排复杂AI工作流,循环和人工干预天然支持
2026-04-16 19:09:33 +0800 CST
view 692
LangGraph是langchain-ai开源的AI Agent工作流编排框架(25K Stars),用图结构替代LangChain的链式调用,支持循环、条件分支、检查点和人工干预,适合复杂多步骤Agent。
LangGraph
AI
工作流
LangChain
Agent
开源
Python
图结构
LangChain4j:把LangChain的能力带入Java世界,一个库搞定LLM集成、RAG、Agent
编程
LangChain4j:把LangChain的能力带入Java世界,一个库搞定LLM集成、RAG、Agent
2026-04-16 19:11:21 +0800 CST
view 651
LangChain4j是Java世界的LangChain,简化Java应用集成大语言模型,支持OpenAI/Claude/DeepSeek等模型,提供RAG、Agent、Tool Calling、Memory等完整能力,Apache 2.0协议。
Java
LangChain
AI
LLM
RAG
Agent
开源
工具调用
Chrome DevTools MCP 1.3 深度实战:当 Google 把浏览器控制权交给 AI Agent——从 CDP + MCP 双协议架构到 49 个生产级工具、从性能 Trace 到堆内存分析的完全指南(2026)
编程
Chrome DevTools MCP 1.3 深度实战:当 Google 把浏览器控制权交给 AI Agent——从 CDP + MCP 双协议架构到 49 个生产级工具、从性能 Trace 到堆内存分析的完全指南(2026)
2026-06-20 11:26:28 +0800 CST
view 309
Google 官方 Chrome DevTools MCP 1.3 完全指南:49 个 MCP 工具、CDP + MCP 双协议架构、性能 Trace、内存堆快照、Lighthouse 审计与生产级安全实践。
Chrome DevTools
MCP
AI Agent
浏览器自动化
性能优化
前端调试
Chrome DevTools MCP 1.3 完全实战:AI 编程助手如何接管 Chrome 的 49 个工具——从 CDP + MCP 架构到性能优化、内存调试与 CI/CD 落地指南(2026)
编程
Chrome DevTools MCP 1.3 完全实战:AI 编程助手如何接管 Chrome 的 49 个工具——从 CDP + MCP 架构到性能优化、内存调试与 CI/CD 落地指南(2026)
2026-06-20 11:28:34 +0800 CST
view 290
Google 官方 Chrome DevTools MCP 1.3 完全指南:49 个 MCP 工具、CDP + MCP 双协议架构、性能 Trace、内存堆快照、Lighthouse 审计与生产级安全实践。
Chrome DevTools
MCP
AI Agent
浏览器自动化
性能优化
前端调试
Apache Arrow Flight SQL 深度实战:从零拷贝列式内存到跨语言高速数据传输——架构、协议与生产落地的工程全解(2026)
编程
Apache Arrow Flight SQL 深度实战:从零拷贝列式内存到跨语言高速数据传输——架构、协议与生产落地的工程全解(2026)
2026-07-22 07:19:06 +0800 CST
view 29
深度解析 Apache Arrow Flight SQL:从零拷贝列式内存到跨语言高速数据传输。涵盖 Arrow 内存布局、Flight RPC 协议、Flight SQL 查询接口、Rust/Go/Python 实战代码、生产级部署架构与性能优化,实现 5-10x 性能提升。
Apache Arrow
Flight SQL
零拷贝
列式存储
gRPC
数据传输
大数据
DataFusion
性能优化
Gai:AI 原生的 Go Web 全栈框架
编程
Gai:AI 原生的 Go Web 全栈框架
2026-05-21 16:19:43 +0800 CST
view 460
Gai是AI原生的Go Web全栈框架,融合Go简洁高效与Laravel优雅设计,Schema驱动开发,内置全平台AI Agent Rules,支持MySQL/PostgreSQL/SQLite。
开源项目
Go
Web框架
AI原生
ORM
Schema驱动
Apache Pulsar 深度实战:当消息系统把存储与计算彻底拆开——从分层分片架构、BookKeeper 低延迟存储引擎到 Pulsar Functions 与分级存储的完整工程指南(2026)
编程
Apache Pulsar 深度实战:当消息系统把存储与计算彻底拆开——从分层分片架构、BookKeeper 低延迟存储引擎到 Pulsar Functions 与分级存储的完整工程指南(2026)
2026-07-09 08:16:40 +0800 CST
view 128
从架构原理到生产实战,深度拆解 Apache Pulsar 的分层分片架构、BookKeeper 低延迟存储引擎、Pulsar Functions 与分级存储。
Apache Pulsar
消息队列
BookKeeper
云原生
流处理
消息中间件
大模型推理引擎实战:从 PagedAttention、Continuous Batching 到投机解码与量化部署,把 GPU 利用率榨到极限(vLLM/SGLang 2026 完全指南)
编程
大模型推理引擎实战:从 PagedAttention、Continuous Batching 到投机解码与量化部署,把 GPU 利用率榨到极限(vLLM/SGLang 2026 完全指南)
2026-07-09 09:17:24 +0800 CST
view 292
深入剖析 2026 年大模型推理引擎核心技术:PagedAttention、Continuous Batching、Chunked Prefill、RadixAttention 前缀缓存、投机解码与 AWQ/GPTQ/FP8 量化,结合 vLLM 与 SGLang 部署实战,把 GPU 利用率榨到极限的生产级完全指南。
LLM推理引擎
vLLM
SGLang
推理优化
量化部署
投机解码
GPU利用率
KV Cache
PagedAttention
百度 Unlimited OCR 深度解析:端到端长文档 OCR 的新范式——从 R-SWA 机制到 3B 参数模型、从 KV Cache 压缩到生产级部署的完整技术指南(2026)
编程
百度 Unlimited OCR 深度解析:端到端长文档 OCR 的新范式——从 R-SWA 机制到 3B 参数模型、从 KV Cache 压缩到生产级部署的完整技术指南(2026)
2026-07-04 03:13:57 +0800 CST
view 256
2026年6月百度开源Unlimited OCR,5天GitHub Star破1万。深度解析R-SWA机制、3B参数模型架构、KV Cache压缩原理,含完整部署代码与生产级应用案例。
百度
Unlimited OCR
OCR
R-SWA
KV Cache
长文档识别
端到端OCR
多模态模型
TensorRT-LLM 1.0 深度实战:当 PyTorch 架构成为默认体验,NVIDIA 的 LLM 推理引擎正式走向成熟
编程
TensorRT-LLM 1.0 深度实战:当 PyTorch 架构成为默认体验,NVIDIA 的 LLM 推理引擎正式走向成熟
2026-07-22 10:46:37 +0800 CST
view 26
深度解析 TensorRT-LLM 1.0:PyTorch 架构正式稳定、LLM API 稳定化、多模态 VLM 原生支持、Qwen3 MoE 优化、LoRA 生产级管理、trtllm-serve 推理服务化,配完整部署实战代码。
TensorRT-LLM
LLM推理
GPU加速
PyTorch
NVIDIA
深度学习
模型部署
推理优化
Headroom 深度解析:AI Agent 上下文压缩引擎——从 Token 暴降 95% 的原理到生产级部署的完整技术指南(2026)
编程
Headroom 深度解析:AI Agent 上下文压缩引擎——从 Token 暴降 95% 的原理到生产级部署的完整技术指南(2026)
2026-07-04 04:42:34 +0800 CST
view 212
Headroom 深度解析:AI Agent 上下文压缩引擎,节省 60-95% Token 消耗,零侵入透明压缩层,含四种接入模式详解、压缩算法剖析、性能基准测试与生产级部署指南。
Headroom
AI Agent
上下文压缩
Token优化
成本优化
LangChain
Claude Code
Proxy模式
ML路由
oh-my-pi (omp) 深度实战:终端原生 AI 编码 Agent——Hash-Anchored 编辑架构与 Rust 实现全解(2026)
编程
oh-my-pi (omp) 深度实战:终端原生 AI 编码 Agent——Hash-Anchored 编辑架构与 Rust 实现全解(2026)
2026-07-22 11:47:48 +0800 CST
view 45
深度解析 oh-my-pi (omp):终端原生 AI 编码 Agent,Hash-Anchored 编辑架构、Rust 实现、LSP 集成、小模型优化,14K+ commits,87% 基准分。
oh-my-pi
AI编程
Hash-Anchored
Rust
终端工具
AI Agent
LSP
开源项目
小模型优化
TUI
MemPalace 深度实战:当 AI 学会「记忆宫殿」——从原话存储到跨项目知识图谱的生产级完全指南(2026)
编程
MemPalace 深度实战:当 AI 学会「记忆宫殿」——从原话存储到跨项目知识图谱的生产级完全指南(2026)
2026-06-15 07:48:47 +0800 CST
view 331
MemPalace 深度实战:原话存储、宫殿式架构、四级渐进加载、Hallway/Tunnel 知识图谱、MCP 集成 Claude Code,从安装到生产部署的完全指南
MemPalace
AI记忆
MCP
ChromaDB
知识图谱
Claude Code
Origin、DeltaDB、Project Switch:AI原生版本控制三路对决——Git正在被颠覆的底层逻辑与工程启示
编程
Origin、DeltaDB、Project Switch:AI原生版本控制三路对决——Git正在被颠覆的底层逻辑与工程启示
2026-07-16 01:47:06 +0800 CST
view 112
深度拆解Cursor Origin、GitLab Project Switch、Zed DeltaDB三大AI原生版本控制方案,从架构设计、核心创新到工程取舍,配Meta Sapling技术演进史,全面分析Git正在被颠覆的底层逻辑。
AI-native Git
Origin
DeltaDB
Project Switch
版本控制
GitHub颠覆
Sapling
LLM 推理的显存战争:从 PagedAttention 到统一内存架构——KV Cache 管理五世代深度解析(2026)
编程
LLM 推理的显存战争:从 PagedAttention 到统一内存架构——KV Cache 管理五世代深度解析(2026)
2026-06-15 11:18:23 +0800 CST
view 378
深度解析大模型推理中 KV Cache 管理的五世代演进:从连续分配到 PagedAttention,再到异构缓存、分布式 KV 和统一混合内存架构。结合 vLLM、SGLang、TensorRT-LLM 给出生产环境选型指南。
LLM
大模型
KVCache
PagedAttention
vLLM
SGLang
TensorRT
推理优化
显存管理
分布式
Agent-Reach 深度实战:当 AI Agent 学会了「看世界」——从零成本互联网能力层到多后端路由架构、从 10+ 平台接入到生产级 AI 编程助手完全指南(2026)
编程
Agent-Reach 深度实战:当 AI Agent 学会了「看世界」——从零成本互联网能力层到多后端路由架构、从 10+ 平台接入到生产级 AI 编程助手完全指南(2026)
2026-06-21 01:54:43 +0800 CST
view 295
Agent-Reach 深度实战:从能力层架构设计到多后端路由机制,从 10+ 平台接入实战到与 Claude Code/OpenClaw 集成,完整解析如何让 AI Agent 免费接入整个互联网。
Agent-Reach
AI Agent
互联网能力
Python
开源工具
MCP
Helidon 4.4:当 Java 微服务框架开始"长脑子",AI 编排不再是 Python 专利
编程
Helidon 4.4:当 Java 微服务框架开始"长脑子",AI 编排不再是 Python 专利
2026-04-08 15:04:17 +0800 CST
view 711
Oracle Helidon 4.4.0 引入 AI Agent 编排能力,Java 微服务框架进入 AI 原生时代。深度解析 Workflows、Dynamic Agents 两种执行模式,完整代码实战。
Helidon
Java
AI Agent
LangChain4j
微服务
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
29
30
31
32
33
...
80
下一页