程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
OmniRoute 深度拆解:一个端点接入 290+ 大模型——免费 AI 网关的工程架构与 2026 年 Token 经济学革命
编程
OmniRoute 深度拆解:一个端点接入 290+ 大模型——免费 AI 网关的工程架构与 2026 年 Token 经济学革命
2026-07-30 20:46:41 +0800 CST
view 258
OmniRoute:GitHub 33k Stars 开源 AI 网关,支持 290+ 提供商、500+ 模型,RTK+Caveman 双引擎 Token 压缩节省 15-95%,18 种智能路由策略,内置 104 MCP 工具,与 Claude Code/Cursor/Copilot 无缝集成,月均 ~15.3 亿免费 Token 配额
OmniRoute
AI网关
Token压缩
RTK
Caveman
AI编程
免费API
开源
多模型路由
MCP
从碎片对话到结构化知识:腾讯 Agent Memory 四层记忆架构工程实践
编程
从碎片对话到结构化知识:腾讯 Agent Memory 四层记忆架构工程实践
2026-08-14 15:46:56 +0800 CST
view 101
深度拆解腾讯开源的 Agent Memory 项目:从 L0 原始对话层到 L3 用户画像层的四层渐进式记忆架构,配完整代码实战与生产级集成指南。
Agent Memory
腾讯云
AI记忆
LLM
TencentDB
知识图谱
个性化AI
向量数据库
LLM 推理服务引擎深度拆解:从 PagedAttention 到 PD 分离,把 GPU 榨干的七层优化栈
编程
LLM 推理服务引擎深度拆解:从 PagedAttention 到 PD 分离,把 GPU 榨干的七层优化栈
2026-07-30 21:49:19 +0800 CST
view 169
深度拆解 LLM 推理服务的七层优化栈:PagedAttention 分页显存与写时复制、连续批处理消灭队头阻塞、前缀缓存命中率实操、Chunked Prefill 与 PD 分离决策、KV Cache 分层复用的拉取/重算临界点、投机解码加速比数学与失效场景、量化与并行选型。附大量可运行代码、压测骨架、调优顺序与七个常见误区。
LLM推理
vLLM
SGLang
PagedAttention
PD分离
KV Cache
前缀缓存
投机解码
Chunked Prefill
性能优化
MCP 协议深度拆解:当 Anthropic 决定「把有状态连接扔进垃圾桶」——从双工会话到无状态核心,一个被 Linux 基金会托管的 AI 工具协议如何用「请求即自包含」重新定义 Agent 基础设施的终极形态
编程
MCP 协议深度拆解:当 Anthropic 决定「把有状态连接扔进垃圾桶」——从双工会话到无状态核心,一个被 Linux 基金会托管的 AI 工具协议如何用「请求即自包含」重新定义 Agent 基础设施的终极形态
2026-08-06 03:43:55 +0800 CST
view 185
深度拆解MCP 2026-07-28规范:从有状态到无状态架构转变、基于请求头的路由机制、OAuth 2.1授权框架、Tasks异步任务扩展、版本化扩展框架,附完整Python/Go/Nginx代码实战与生产部署指南
MCP
Model Context Protocol
Anthropic
无状态
OAuth
AI Agent
协议规范
Linux基金会
Agent基础设施
JSON-RPC
Claude Context 深度实战:让 AI 读懂你整个代码库——语义代码搜索引擎从原理到生产级部署完全指南(2026)
编程
Claude Context 深度实战:让 AI 读懂你整个代码库——语义代码搜索引擎从原理到生产级部署完全指南(2026)
2026-06-04 09:26:09 +0800 CST
view 727
Claude Context 是 Zilliz 开源的 MCP 插件,通过 AST 智能代码分块和混合检索将整个代码库转化为 AI 编程助手的语义知识库,实测 Token 消耗降低约 40%。
Claude Context
语义搜索
MCP协议
向量数据库
AI编程
UI-TARS-Desktop 深度解析:ByteDance 如何用多模态 AI Agent 重新定义 GUI 自动化
编程
UI-TARS-Desktop 深度解析:ByteDance 如何用多模态 AI Agent 重新定义 GUI 自动化
2026-05-12 04:43:13 +0800 CST
view 1244
UI-TARS-Desktop 是 ByteDance 开源的多模态 AI Agent 技术栈,包含 Agent TARS CLI/Web UI 和 UI-TARS-Desktop 原生应用。支持自然语言控制电脑、视觉理解界面、MCP 工具集成、Event Stream 协议驱动的 Context Engineering。本文深入解析其架构设计、核心特性、实战案例、性能基准与部署最佳实践。
UI-TARS
ByteDance
GUI自动化
多模态AI
MCP
vLLM v1 Engine 架构深度拆解:从异步调度到 Chunked Prefill 的生产级推理引擎演进(2026实战指南)
编程
vLLM v1 Engine 架构深度拆解:从异步调度到 Chunked Prefill 的生产级推理引擎演进(2026实战指南)
2026-08-14 17:45:25 +0800 CST
view 85
深度拆解vLLM v1 Engine架构:Continuous Batching、Chunked Prefill、异步内存管理等核心特性,从源码到生产部署,配完整代码实战与性能基准测试
vLLM
LLM推理
PagedAttention
ContinuousBatching
GPU优化
生产部署
推测解码
Python
Node.js 26 深度实战:Temporal API 默认开启、原生VFS虚拟文件系统与十年架构演进
编程
Node.js 26 深度实战:Temporal API 默认开启、原生VFS虚拟文件系统与十年架构演进
2026-06-25 21:46:50 +0800 CST
view 629
2026年Node.js 26深度实战:Temporal API默认开启、node:vfs虚拟文件系统、Undici 8.0、V8 14.6 Map.upsert等新特性完整指南,万字长文带你全面掌握Node.js最新版本
Node.js
Node.js 26
Temporal
VFS
Undici
JavaScript
V8
运行时
vLLM v1 Engine 深度拆解:Continuous Batching + Chunked Prefill 如何将推理吞吐量翻倍(2026生产实战)
编程
vLLM v1 Engine 深度拆解:Continuous Batching + Chunked Prefill 如何将推理吞吐量翻倍(2026生产实战)
2026-08-14 17:46:24 +0800 CST
view 79
深度拆解vLLM v1 Engine架构:Continuous Batching、Chunked Prefill、异步内存管理等核心特性,配完整代码实战与性能基准测试
vLLM
LLM推理
PagedAttention
ContinuousBatching
GPU优化
生产部署
推测解码
Python
Python标准库中的sqlite3模块,提供了轻量级的数据库解决方案
编程
Python标准库中的sqlite3模块,提供了轻量级的数据库解决方案
2024-11-17 08:12:20 +0800 CST
view 1967
本文介绍了Python标准库中的sqlite3模块,提供了轻量级的数据库解决方案。通过简单的代码示例,展示了如何创建数据库和表、插入、查询、更新和删除数据,以及如何处理潜在的数据库错误。SQLite适合嵌入式应用,易于使用,适合开发小型应用和快速数据操作。
数据库
Python
编程
数据管理
SQLite
Turso + libSQL:把 SQLite 带进 AI 时代的分布式数据库实战指南
编程
Turso + libSQL:把 SQLite 带进 AI 时代的分布式数据库实战指南
2026-04-21 14:52:17 +0800 CST
view 950
全面解析 libSQL 分叉 SQLite 的架构设计、Turso 边缘托管的分布式能力,以及在 AI 时代的独特价值,含 Go/Python 完整代码示例
SQLite
libSQL
Turso
分布式数据库
边缘计算
Go
Python
AI Agent
Go 1.26 深度实战:Green Tea GC 如何用 8KiB 扫描单元把垃圾回收开销砍掉 40%
编程
Go 1.26 深度实战:Green Tea GC 如何用 8KiB 扫描单元把垃圾回收开销砍掉 40%
2026-05-04 04:22:37 +0800 CST
view 910
Go 1.26 Green Tea GC 深度实战:从 span 扫描到 AVX-512 向量化标记,详解新 GC 如何将开销降低 40%,以及 new(expr)、errors.AsType、递归泛型等核心特性
Go
GC
Green Tea
性能优化
垃圾回收
万字深度解析 Nano-vLLM:当1200行Python代码重构大模型推理——从架构设计到性能超越vLLM的完整技术指南(2026)
编程
万字深度解析 Nano-vLLM:当1200行Python代码重构大模型推理——从架构设计到性能超越vLLM的完整技术指南(2026)
2026-07-01 14:44:55 +0800 CST
view 340
Nano-vLLM:用约1200行Python代码实现的轻量级vLLM替代方案。深度解析KV Cache管理、GQA注意力、RoPE位置编码、Continuous Batching等核心技术,Benchmark性能超越vLLM 5.3%。适合学习大模型推理原理和内网轻量级部署。
Nano-vLLM
大模型推理
LLM
Tensor Parallelism
KV Cache
Continuous Batching
Python
PyTorch
Qwen2
开源项目
MCP 深度解析:Model Context Protocol 如何重塑 AI 应用开发——从协议设计到生产级实战的完整技术内幕
编程
MCP 深度解析:Model Context Protocol 如何重塑 AI 应用开发——从协议设计到生产级实战的完整技术内幕
2026-05-18 02:15:34 +0800 CST
view 637
深入解析 Anthropic MCP 协议的设计哲学、架构实现、开发实战与生产级部署
MCP
Model Context Protocol
AI应用开发
协议设计
工具集成
MCP 企业授权体系 2026 深度拆解:从零散 Token 到零接触 SSO,一次把 ID-JAG 讲透
编程
MCP 企业授权体系 2026 深度拆解:从零散 Token 到零接触 SSO,一次把 ID-JAG 讲透
2026-07-13 10:44:21 +0800 CST
view 651
深度拆解MCP企业授权体系2026最新进展:从分散Token到零接触SSO,ID-JAG核心原理、Okta集成、工具级细粒度权限与生产级实战代码。
MCP
ID-JAG
AI Agent
企业安全
OAuth
Okta
Model Context Protocol
Go 1.25 Green Tea GC 深度实战:当垃圾回收学会「按页扫描」,我们如何榨干现代 CPU 的缓存与向量指令
编程
Go 1.25 Green Tea GC 深度实战:当垃圾回收学会「按页扫描」,我们如何榨干现代 CPU 的缓存与向量指令
2026-08-15 04:19:27 +0800 CST
view 68
深度拆解 Go 1.25/1.26 Green Tea 垃圾回收器:从内存墙与指针追逐讲起,详解页级批量扫描、Seen/Scanned 双位元数据与 AVX-512 向量加速,配可复现压测、gctrace 与 runtime/metrics 观测方法及 15 条生产级调优建议。
Go
Golang
垃圾回收
GC
Green Tea
性能优化
云原生
内存管理
Vite 8 深度解析:Rolldown + Oxc 驱动的前端工具链革命,Webpack 时代彻底终结
编程
Vite 8 深度解析:Rolldown + Oxc 驱动的前端工具链革命,Webpack 时代彻底终结
2026-04-22 08:59:01 +0800 CST
view 1207
Vite 8 深度解析:Rolldown 统一 dev/build 引擎,Oxc 替代 Babel/ESLint/Prettier,前端工具链全面 Rust 化的工程实践与迁移指南
Vite
Rolldown
Oxc
Rust
前端工具链
Webpack
Rust 重塑前端工具链:从 Rolldown 到 Oxc,一场静悄悄的性能革命(2026 完全指南)
编程
Rust 重塑前端工具链:从 Rolldown 到 Oxc,一场静悄悄的性能革命(2026 完全指南)
2026-06-04 13:42:02 +0800 CST
view 800
2026年Rust全面重塑前端工具链,Rolldown、Oxc、Rspack、SWC、Biome五大核心工具深度解析,含架构分析、代码实战和渐进式迁移策略
Rust
前端工具链
Rolldown
Oxc
Rspack
SWC
Biome
Vite
Web性能优化
JavaScript
Ruflo 深度解析:39K Star 的 AI Agent 编排平台,如何用 Rust + WASM 重塑多智能体协作的工程范式
编程
Ruflo 深度解析:39K Star 的 AI Agent 编排平台,如何用 Rust + WASM 重塑多智能体协作的工程范式
2026-05-04 16:23:37 +0800 CST
view 907
深度解析 Ruflo Agent 编排平台:100+专业化Agent、SONA自学习神经网络、HNSW向量记忆、Swarm群体协调、零信任联邦协作。从架构设计到代码实战,全面剖析多智能体协作的工程范式。
AI Agent
Rust
WASM
Multi-Agent
Architecture
Ruflo 深度解析:39K Star 的 AI Agent 编排平台如何重塑多智能体协作
编程
Ruflo 深度解析:39K Star 的 AI Agent 编排平台如何重塑多智能体协作
2026-05-04 16:23:56 +0800 CST
view 1079
深度解析 Ruflo Agent 编排平台:100+专业化Agent、SONA自学习神经网络、HNSW向量记忆、Swarm群体协调、零信任联邦协作。从架构设计到代码实战,全面剖析多智能体协作的工程范式。
AI Agent
Rust
WASM
Multi-Agent
Architecture
MCP 协议深度拆解:从 JSON-RPC 传输层到工具编排——如何用 Model Context Protocol 构建生产级 AI 工具链(2026 实战指南)
编程
MCP 协议深度拆解:从 JSON-RPC 传输层到工具编排——如何用 Model Context Protocol 构建生产级 AI 工具链(2026 实战指南)
2026-08-15 07:41:58 +0800 CST
view 62
2026 深度拆解 MCP:JSON-RPC 内核、Host/Client/Server 架构、stdio 与 Streamable HTTP 传输、Tools/Resources/Prompts 原语与 Sampling/Roots/Elicitation,配 Python+TypeScript 实战与 15 条生产级建议。
MCP
Model Context Protocol
AI Agent
工具调用
JSON-RPC
FastMCP
Vite 6 深度解析:Environment API 与前端构建工具的新里程碑
编程
Vite 6 深度解析:Environment API 与前端构建工具的新里程碑
2026-05-12 13:13:02 +0800 CST
view 679
深度解析Vite 6的重大革新:Environment API统一多环境开发、HMR性能提升30%、Vue4/React19/Svelte5深度集成、构建性能优化实战。
Vite6
EnvironmentAPI
前端构建工具
HMR
多环境开发
Vue4
React19
Rolldown 深度解析:Vite 团队用 Rust 重写打包器的野心——从 Oxc 解析到 Rollup 兼容的完整技术内幕
编程
Rolldown 深度解析:Vite 团队用 Rust 重写打包器的野心——从 Oxc 解析到 Rollup 兼容的完整技术内幕
2026-05-18 07:13:14 +0800 CST
view 656
Rolldown 是 Vite 团队用 Rust 从零重写的下一代打包器,本文从架构设计、核心模块、代码实战到生产迁移,深度解析 Rolldown 的完整技术内幕。
Rolldown
Vite
Rust
前端构建
打包器
Vue 3.6 深度前瞻:Vapor Mode 与 alien-signals 如何重塑前端性能天花板
编程
Vue 3.6 深度前瞻:Vapor Mode 与 alien-signals 如何重塑前端性能天花板
2026-07-20 10:13:59 +0800 CST
view 280
Vue 3.6 带来两大颠覆性更新:Vapor Mode 彻底跳过虚拟 DOM、alien-signals 重写响应式核心。深度解析原理、性能数据与迁移策略。
Vue
Vapor Mode
alien-signals
前端性能
响应式
虚拟DOM
SolidJS
Svelte
编译时优化
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
99
100
101
102
103
...
107
下一页