程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
PyTorch 2.13 深度拆解:从 Metal 原生内核到 4 倍内存优化的工程全貌
编程
PyTorch 2.13 深度拆解:从 Metal 原生内核到 4 倍内存优化的工程全貌
2026-07-17 11:13:32 +0800 CST
view 566
深度拆解 PyTorch 2.13:FlexAttention 在 Apple Silicon 上提速 12 倍、CUTeDSL 为 Inductor 引入第二条代码生成路径、nn.LinearCrossEntropyLoss 将大词汇量模型显存降低 4 倍、torchcomms 重塑分布式训练通信层、ExecuTorch 正式并入核心,配完整生产级代码实战。
PyTorch
深度学习
AI框架
Metal
FlexAttention
Apple Silicon
分布式训练
vLLM 2026 推理引擎全解:从 PagedAttention 到分离式 Prefill,如何把大模型跑出 GPU 极限性能
编程
vLLM 2026 推理引擎全解:从 PagedAttention 到分离式 Prefill,如何把大模型跑出 GPU 极限性能
2026-06-29 17:16:04 +0800 CST
view 688
2026年vLLM 0.18深度解析:PagedAttention显存管理、EAGLE3推测解码、连续批处理、分离式Prefill、FP4量化,附生产级部署代码与Benchmark对比
vLLM
LLM推理
PagedAttention
推测解码
EAGLE3
FP4量化
CUDA
GPU性能优化
Node.js 原生 SQLite 深度实战:从 node:sqlite 到零依赖数据库——同步 API、WASM 引擎与百万级写入优化的完全指南(2026)
编程
Node.js 原生 SQLite 深度实战:从 node:sqlite 到零依赖数据库——同步 API、WASM 引擎与百万级写入优化的完全指南(2026)
2026-06-02 07:24:55 +0800 CST
view 741
Node.js 原生 SQLite 模块深度实战:从 node:sqlite 架构原理到百万级写入优化,涵盖同步 API、WASM 引擎、事务管理、全文搜索、备份恢复与 better-sqlite3 迁移完全指南
Node.js
SQLite
WASM
数据库
性能优化
万字长文拆解 vLLM 0.18:PagedAttention 如何用操作系统思维颠覆大模型推理
编程
万字长文拆解 vLLM 0.18:PagedAttention 如何用操作系统思维颠覆大模型推理
2026-06-29 17:17:00 +0800 CST
view 425
2026年vLLM 0.18深度解析:PagedAttention显存管理、EAGLE3推测解码、连续批处理、分离式Prefill、FP4量化,附生产级部署代码与Benchmark对比
vLLM
LLM推理
PagedAttention
推测解码
EAGLE3
FP4量化
CUDA
GPU性能优化
code-review-graph 深度拆解:Tree-sitter 知识图谱如何让 AI 代码审查节省 82 倍 Token
编程
code-review-graph 深度拆解:Tree-sitter 知识图谱如何让 AI 代码审查节省 82 倍 Token
2026-07-28 15:15:51 +0800 CST
view 210
深入剖析2026年7月GitHub Trending榜首项目code-review-graph:用Tree-sitter+SQLite知识图谱+MCP协议,让AI代码审查Token消耗降低82倍,附架构原理、代码实战、CI/CD集成完整指南。
AI编程
Tree-sitter
知识图谱
MCP
Token优化
代码审查
IntelliJ IDEA 2026.1 深度解析:IDE 的战略升维——从代码编辑器到 AI Agent 开放平台
编程
IntelliJ IDEA 2026.1 深度解析:IDE 的战略升维——从代码编辑器到 AI Agent 开放平台
2026-05-09 23:43:15 +0800 CST
view 906
IntelliJ IDEA 2026.1深度解析:ACP协议开放AI Agent平台、Codex/Cursor/Claude多Agent协作、Spring运行时洞察、Java 26首日支持、虚拟线程调试工具链等核心新特性全剖析
IntelliJ IDEA
JetBrains
Java
Kotlin
AI Agent
ACP协议
IDE
编程工具
Spring
虚拟线程
LLM推理框架2026选型完全指南:从vLLM到TensorRT-LLM,一次讲透四大引擎的架构哲学与生产级实战
编程
LLM推理框架2026选型完全指南:从vLLM到TensorRT-LLM,一次讲透四大引擎的架构哲学与生产级实战
2026-06-02 09:36:52 +0800 CST
view 894
从vLLM到TensorRT-LLM,一次讲透vLLM、SGLang、TensorRT-LLM、llama.cpp四大LLM推理框架的架构哲学、核心原理、生产级部署实战与选型决策树。
LLM
vLLM
TensorRT-LLM
llama.cpp
SGLang
推理优化
GPU
Context Engineering深度解析:从RAG到下一代AI Agent记忆架构
编程
Context Engineering深度解析:从RAG到下一代AI Agent记忆架构
2026-07-05 14:43:41 +0800 CST
view 417
2026年AI Agent的核心战场从模型能力转向上下文能力。本文深度解析Context Engineering的四层架构、RAG进化、记忆分层、Manus六大策略,附完整生产级代码实现。
Context Engineering
RAG
AI Agent
记忆架构
上下文工程
代码库记忆革命:codebase-memory-mcp 如何让 AI 编程助手真正「读懂」你的项目
编程
代码库记忆革命:codebase-memory-mcp 如何让 AI 编程助手真正「读懂」你的项目
2026-07-29 00:14:08 +0800 CST
view 177
深度剖析2026年7月爆火的GitHub项目codebase-memory-mcp:用知识图谱为AI编程助手构建持久化代码库记忆,从AST解析到14个MCP工具完整实战。
codebase-memory-mcp
Tree-sitter
知识图谱
MCP协议
AI编程
代码智能
上下文管理
AI 编程助手 Token 烧钱太快?9Router + RTK 双剑合璧:从架构设计到生产级实践,节省 90% 成本完全指南
编程
AI 编程助手 Token 烧钱太快?9Router + RTK 双剑合璧:从架构设计到生产级实践,节省 90% 成本完全指南
2026-05-23 00:19:03 +0800 CST
view 784
深入剖析 9Router 智能模型路由和 RTK Token 压缩的技术原理、架构设计与生产级实践,帮助开发者节省高达 90% 的 AI 编程成本。
AI编程
Token优化
9Router
RTK
成本控制
Cloudflare 统一推理层深度实战:当一个API连通12家供应商70+模型——从AI Gateway到边缘智能体、从自动故障转移到多模态推理的生产级完全指南(2026)
编程
Cloudflare 统一推理层深度实战:当一个API连通12家供应商70+模型——从AI Gateway到边缘智能体、从自动故障转移到多模态推理的生产级完全指南(2026)
2026-06-22 04:23:24 +0800 CST
view 549
2026年4月Cloudflare发布统一推理层,一个API连通12家供应商70+模型。本文深度解析AI Gateway架构、边缘推理优化、多模态支持、智能体集成,附带完整代码示例,打造生产级AI应用。
Cloudflare
AI推理
边缘计算
AI Gateway
统一推理层
AI基础设施
百度 Unlimited OCR 深度解析:R-SWA 如何把 KV Cache 从线性增长压成常数,端到端 OCR 的长文档革命
编程
百度 Unlimited OCR 深度解析:R-SWA 如何把 KV Cache 从线性增长压成常数,端到端 OCR 的长文档革命
2026-06-29 19:45:14 +0800 CST
view 351
深度解析百度开源的 Unlimited OCR:R-SWA 如何把 KV Cache 从线性增长压成常数,解决长文档 OCR 的失忆问题,OmniDocBench v1.6 刷新 SOTA 93.92%
Unlimited OCR
百度
OCR
端到端
长文档
R-SWA
开源
深度学习
文档解析
Markdown
Go 1.26 Green Tea GC 深度拆解:10%~40% GC 开销消失的背后,Go 团队做对了什么?
编程
Go 1.26 Green Tea GC 深度拆解:10%~40% GC 开销消失的背后,Go 团队做对了什么?
2026-07-29 00:45:39 +0800 CST
view 201
深度拆解 Go 1.26 默认启用的 Green Tea 垃圾回收器:分代复制算法如何让 GC CPU 开销降低 10-40%,附完整代码实战与迁移指南。
Go语言
Green Tea GC
垃圾回收
Go 1.26
性能优化
内存管理
MCP 与 A2A 协议深度拆解:AI Agent 互联互通的「血管系统」——从协议原理、Go/Python 双实现到生产级工具生态完全指南(2026)
编程
MCP 与 A2A 协议深度拆解:AI Agent 互联互通的「血管系统」——从协议原理、Go/Python 双实现到生产级工具生态完全指南(2026)
2026-08-13 06:17:44 +0800 CST
view 134
深度拆解 MCP 与 A2A 协议:从四元组形式化定义、三层传输协议(stdio/HTTP+SSE/WebSocket)、Go/Python 双语言完整实现,到 2026-07-28 新规范核心变更(Roots/Sampling/Tasks),配 15 条生产踩坑清单与多 Agent 协作架构实战。
MCP
Model Context Protocol
A2A
AI Agent
工具调用
协议标准
Anthropic
Claude
工具生态
Zig 0.16.0 深度实战:当「无隐藏魔法」终结系统编程的隐性行为——从 comptime 到 I/O Interface 的生产级完全指南(2026)
编程
Zig 0.16.0 深度实战:当「无隐藏魔法」终结系统编程的隐性行为——从 comptime 到 I/O Interface 的生产级完全指南(2026)
2026-06-10 22:53:26 +0800 CST
view 572
Zig 0.16.0 深度解析:I/O Interface、comptime元编程、语言变更、标准库更新、编译器改进,含大量可运行代码示例
Zig
系统编程
comptime
I/O Interface
SIMD
ego lite 深度拆解:当 Chromium 内核决定「干掉 AI 浏览器的全部围墙」——一个 5.3K Star 的开源浏览器如何用 Space 隔离和内核级快照重新定义人与 Agent 共生的终极形态
编程
ego lite 深度拆解:当 Chromium 内核决定「干掉 AI 浏览器的全部围墙」——一个 5.3K Star 的开源浏览器如何用 Space 隔离和内核级快照重新定义人与 Agent 共生的终极形态
2026-08-04 15:14:57 +0800 CST
view 253
深度拆解ego lite:5.3K Star开源AI浏览器,基于Chromium内核改造、Space隔离并行执行、内核级Snapshot语义快照、Code Base执行模式、Skill经验积累系统,重新定义人与Agent共生的浏览器架构
ego-lite
Chromium
AI浏览器
Space隔离
Snapshot
浏览器自动化
Agent
Codex
Claude Code
Spring AI 1.1 深度解析:从 RAG 到 MCP 协议——Java 开发者构建企业级 AI 应用的工程化实战
编程
Spring AI 1.1 深度解析:从 RAG 到 MCP 协议——Java 开发者构建企业级 AI 应用的工程化实战
2026-05-10 04:41:17 +0800 CST
view 929
Spring AI 1.1 深度解析:Tool Calling 让 AI 真正动手干活、MCP 协议统一工具接入标准、Agent 框架实现自主决策、Memory 让多轮对话成为可能、RAG 构建企业知识库。Java 开发者不容错过的 AI 工程化实战指南。
Spring AI
SpringBoot AI
AI应用
Tool Calling
MCP
Model Context Protocol
Agent
RAG
ChatMemory
Java AI
向量数据库
企业级 AI
DuckDB 1.5 深度拆解:当「分析界的 SQLite」装上 VARIANT 与 Vortex 引擎——从进程内向量化执行到 Lakehouse 实战的工程全貌(2026)
编程
DuckDB 1.5 深度拆解:当「分析界的 SQLite」装上 VARIANT 与 Vortex 引擎——从进程内向量化执行到 Lakehouse 实战的工程全貌(2026)
2026-07-18 01:14:31 +0800 CST
view 411
深度拆解 DuckDB 1.5:VARIANT 类型、Vortex 存储引擎、Iceberg DML、内置 GEOMETRY、非阻塞 Checkpoint,配完整 Python/Go/SQL 代码实战与性能优化指南。
DuckDB
VARIANT
Vortex
OLAP
嵌入式数据库
Iceberg
向量化执行
Lakehouse
OmniRoute 深度拆解:一个开源 AI 网关如何终结「AI 路由焦虑」,290+ 厂商、19 种策略与 Token 暴降 60% 的工程实践
编程
OmniRoute 深度拆解:一个开源 AI 网关如何终结「AI 路由焦虑」,290+ 厂商、19 种策略与 Token 暴降 60% 的工程实践
2026-07-29 03:15:11 +0800 CST
view 268
深度拆解 GitHub 28.8k Star 的 OmniRoute:一个开源本地 AI 网关的完整架构解析,涵盖 19 种智能路由策略、RTK+Caveman 双引擎 Token 压缩(成本降低 60%)、配额感知动态路由,以及与 Claude Code、Cursor 等工具的深度集成实战,附生产级配置指南。
OmniRoute
AI网关
智能路由
Token压缩
API聚合
成本优化
Claude Code
Cursor
OpenAI
Anthropic
DeepSeek
RTK
Caveman
从碎片化到统一:OmniRoute 架构设计、19 种路由策略与 Token 暴降 60% 实战
编程
从碎片化到统一:OmniRoute 架构设计、19 种路由策略与 Token 暴降 60% 实战
2026-07-29 03:15:39 +0800 CST
view 246
深度拆解 GitHub 28.8k Star 的 OmniRoute:一个开源本地 AI 网关的完整架构解析,涵盖 19 种智能路由策略、RTK+Caveman 双引擎 Token 压缩(成本降低 60%)、配额感知动态路由,以及与 Claude Code、Cursor 等工具的深度集成实战,附生产级配置指南。
OmniRoute
AI网关
智能路由
Token压缩
API聚合
成本优化
Claude Code
Cursor
OpenAI
Anthropic
DeepSeek
RTK
Caveman
SGLang深度解析:RadixAttention架构下的大模型推理革命——从零到生产的高性能LLM服务框架实战指南
编程
SGLang深度解析:RadixAttention架构下的大模型推理革命——从零到生产的高性能LLM服务框架实战指南
2026-07-05 18:13:38 +0800 CST
view 610
深度解析SGLang高性能大模型推理框架:RadixAttention自动前缀缓存、零开销C++调度器、PD分离架构、多LoRA批处理、推测解码。含完整代码实战与vLLM/TensorRT-LLM对比。
SGLang
RadixAttention
LLM
推理引擎
大模型
vLLM
GPU
高并发
AI基础设施
性能优化
MCP 2026-07 规范深度解析:从工具调用协议到生产级 Agent 基础设施
编程
MCP 2026-07 规范深度解析:从工具调用协议到生产级 Agent 基础设施
2026-07-23 18:45:50 +0800 CST
view 421
深度解析MCP 2026-07规范核心变化:无状态核心、能力发现与治理、任务体系、结构化交付,以及企业级落地实践。程序员视角的技术指南。
MCP
Model Context Protocol
AI Agent
A2A
协议
生产级
无状态
JSON Schema
链路追踪
企业级
MCP 与 A2A 协议深度拆解:AI Agent 的血管系统——Go/Python 双实现、2026 新规范与 15 条生产踩坑清单
编程
MCP 与 A2A 协议深度拆解:AI Agent 的血管系统——Go/Python 双实现、2026 新规范与 15 条生产踩坑清单
2026-08-13 06:23:27 +0800 CST
view 164
深度拆解 MCP 与 A2A 协议:从四元组形式化定义、三层传输协议(stdio/HTTP+SSE/WebSocket)、Go/Python 双语言完整实现,到 2026-07-28 新规范核心变更(Roots/Sampling/Tasks),配 15 条生产踩坑清单与多 Agent 协作架构实战。
MCP
Model Context Protocol
A2A
AI Agent
工具调用
协议标准
Anthropic
Claude
工具生态
SGLang 深度拆解:当 LLM 推理引擎学会「结构化生成」与前缀复用——从 RadixAttention、约束解码到生产级高吞吐部署的工程全貌(2026)
编程
SGLang 深度拆解:当 LLM 推理引擎学会「结构化生成」与前缀复用——从 RadixAttention、约束解码到生产级高吞吐部署的工程全貌(2026)
2026-07-18 02:45:17 +0800 CST
view 309
深度拆解 SGLang:RadixAttention 跨请求前缀复用、约束解码让 JSON 快 10 倍、DP Attention 为 DeepSeek MLA 而生,配 DSL/分布式/量化代码实战与生产调优清单。
SGLang
LLM推理
RadixAttention
约束解码
大模型服务化
高吞吐
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
100
101
102
103
104
...
114
下一页