程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
LLM 推理框架选型实战:vLLM、TensorRT-LLM、TGI、DeepSpeed-MII 深度对比与生产部署指南
编程
LLM 推理框架选型实战:vLLM、TensorRT-LLM、TGI、DeepSpeed-MII 深度对比与生产部署指南
2026-07-03 13:49:04 +0800 CST
view 435
深度对比 vLLM 0.5、TensorRT-LLM 1.8、TGI 2.0、DeepSpeed-MII 0.9 四大推理框架,从核心技术原理、性能数据、成本账本到生产部署实战,帮你做出正确的框架选型决策。
LLM
vLLM
TensorRT-LLM
TGI
DeepSpeed
推理优化
大模型部署
GPU优化
Go 1.26 深度实战:Green Tea 垃圾回收器把 GC 开销砍掉 40%,再到泛型自我引用、new() 表达式操作数与 cgo 提速的完整工程指南(2026)
编程
Go 1.26 深度实战:Green Tea 垃圾回收器把 GC 开销砍掉 40%,再到泛型自我引用、new() 表达式操作数与 cgo 提速的完整工程指南(2026)
2026-07-09 05:15:05 +0800 CST
view 310
Go 1.26 深度实战:从 Green Tea 垃圾回收器的缓存局部性优化,到泛型自我引用、new() 表达式操作数、cgo 调用开销下降 30% 与 go fix 自动迁移,配可运行代码与性能实测的完整工程指南。
Go
Go 1.26
Green Tea GC
垃圾回收
泛型
性能优化
cgo
MCP 2026-07-28 候选规范深度实战:从有状态会话到无状态基础设施——协议层无状态化、统一能力治理、长任务协作与全链路可信溯源的工程全解(2026)
编程
MCP 2026-07-28 候选规范深度实战:从有状态会话到无状态基础设施——协议层无状态化、统一能力治理、长任务协作与全链路可信溯源的工程全解(2026)
2026-07-22 06:44:51 +0800 CST
view 239
拆解 MCP 2026-07-28 候选规范四大支柱:协议层无状态化、统一能力治理、长任务协作与全链路可信溯源,配 Python SDK 实战、可跑代码与性能优化清单。
MCP
Model Context Protocol
AI智能体
无状态架构
能力治理
长任务协作
可信溯源
协议规范
Go 1.26 深度实战:Green Tea GC 性能狂飙 40%、泛型自引用突破、go fix 智能化——从语法革命到生产级升级的完整指南
编程
Go 1.26 深度实战:Green Tea GC 性能狂飙 40%、泛型自引用突破、go fix 智能化——从语法革命到生产级升级的完整指南
2026-06-28 02:43:02 +0800 CST
view 385
Go 1.26 于 2026 年 2 月正式发布,Green Tea GC 默认启用带来 10%-40% 的性能提升,new 函数支持表达式彻底改变指针初始化方式,泛型自引用突破递归数据结构的限制,go fix 智能化重构助力代码现代化。本文将从架构原理、核心特性、性能基准到生产级部署,全方位深度解析 Go 1.26。
Go 1.26
Green Tea GC
泛型
go fix
性能优化
cgo
sqlh:Go 语言零样板 SQL 库,结构体标签生成 CRUD,50 行搞定
编程
sqlh:Go 语言零样板 SQL 库,结构体标签生成 CRUD,50 行搞定
2026-07-09 07:57:04 +0800 CST
view 242
Go语言零样板SQL库sqlh,结构体标签自动生成CRUD,泛型类型安全,自动事务,SQLite/MySQL/PostgreSQL支持,约200KB,115行→50行缩减57%。
Go
SQL
ORM
sqlx
GORM
CRUD
数据库
SQLite
泛型
开源
Go 1.26 深度实战:Green Tea GC、new(expr)语法、泛型递归约束与工程级性能优化全解析
编程
Go 1.26 深度实战:Green Tea GC、new(expr)语法、泛型递归约束与工程级性能优化全解析
2026-04-26 16:12:00 +0800 CST
view 652
Go 1.26深度实战:从Green Tea GC架构原理到new(expr)语法糖,从泛型递归约束到go fix现代化重构,配完整代码示例与性能基准测试
Go
Golang
GC
泛型
性能优化
Green Tea
Go 1.25 Green Tea GC 深度实战:从「三色标记」到「以页扫描」,一次把缓存局部性榨干的垃圾回收革命
编程
Go 1.25 Green Tea GC 深度实战:从「三色标记」到「以页扫描」,一次把缓存局部性榨干的垃圾回收革命
2026-07-27 02:15:09 +0800 CST
view 181
Go 1.25 实验性垃圾回收器 Green Tea 深度实战:以内存页(span)为单位扫描替代随机指针追逐,用空间局部性换缓存命中,GC 耗时降低 10%-40%。附源码原理、benchmark、runtime/metrics 观测及容器感知 GOMAXPROCS 落地清单。
Go
垃圾回收
GreenTea
GC
GOMAXPROCS
性能优化
云原生
Golang
MCP协议2026-07-28深度拆解:从有状态双向RPC到无状态客户端驱动的范式跃迁
编程
MCP协议2026-07-28深度拆解:从有状态双向RPC到无状态客户端驱动的范式跃迁
2026-08-11 06:16:58 +0800 CST
view 37
深度拆解MCP 2026-07-28大改版:从有状态双向RPC到无状态客户端驱动的范式跃迁。涵盖无状态化、主动能力发现、MRTR模式、网关标准化头、长任务规范化、扩展框架与迁移指南。
MCP
Model Context Protocol
无状态协议
AI Agent
云原生
RPC
分布式系统
告别传统工单系统:开源客服平台 Tentix 用向量知识库让 AI 真正懂业务
编程
告别传统工单系统:开源客服平台 Tentix 用向量知识库让 AI 真正懂业务
2026-04-17 10:00:51 +0800 CST
view 716
本文介绍开源客服系统 Tentix,它将历史工单、对话、文档统一沉淀到 PostgreSQL + pgvector 向量知识库中,支持 MCP 扩展,让 AI 客服越跑越懂业务,不再工单电子化。
开源
Tentix
客服系统
向量知识库
AI
pgvector
MCP
Oxc Angular 编译器深度实战:Rust 重写前端工具链的革命性突破——从架构设计到性能飙升的全链路解析
编程
Oxc Angular 编译器深度实战:Rust 重写前端工具链的革命性突破——从架构设计到性能飙升的全链路解析
2026-05-07 23:07:41 +0800 CST
view 695
深度解析 VoidZero 团队用 Rust 重写的 Oxc Angular 编译器,构建性能提升高达 20 倍。从模板解析器架构、代码发射器设计到 Vite 集成实战,全面剖析前端工具链的「氧化」革命。
Rust
Angular
前端工具链
Vite
编译器
性能优化
VoidZero 加入 Cloudflare 深度解析:当 Vite 8 遇上 Rolldown 1.0——前端工具链的 Rust 化革命与 AI 时代 Web 开发新范式(2026)
编程
VoidZero 加入 Cloudflare 深度解析:当 Vite 8 遇上 Rolldown 1.0——前端工具链的 Rust 化革命与 AI 时代 Web 开发新范式(2026)
2026-06-15 04:47:16 +0800 CST
view 712
2026年6月4日,VoidZero加入Cloudflare。本文深度解析Rolldown 1.0架构、Vite 8性能飞跃,以及前端工具链Rust化革命
前端工程化
Vite
Rust
Cloudflare
构建工具
性能优化
Rust 异步编程深度解析:从 async/await 原理到 Tokio 运行时架构——Future 状态机、Work-Stealing 调度、多线程执行器与生产级网络服务完整技术指南(2026)
编程
Rust 异步编程深度解析:从 async/await 原理到 Tokio 运行时架构——Future 状态机、Work-Stealing 调度、多线程执行器与生产级网络服务完整技术指南(2026)
2026-07-04 02:44:50 +0800 CST
view 278
Rust 异步编程深度解析:从 async/await 语法基础到 Tokio 运行时架构,系统剖析 Future 状态机、Pin 内存安全、Waker 唤醒机制、Work-Stealing 调度算法,配备大量可运行代码示例,助你掌握 Rust 异步编程的完整技术栈。
Rust
异步编程
Tokio
async/await
Future
状态机
Work-Stealing
高性能网络服务
大模型推理引擎实战:从 PagedAttention、Continuous Batching 到投机解码与量化部署,把 GPU 利用率榨到极限(vLLM/SGLang 2026 完全指南)
编程
大模型推理引擎实战:从 PagedAttention、Continuous Batching 到投机解码与量化部署,把 GPU 利用率榨到极限(vLLM/SGLang 2026 完全指南)
2026-07-09 09:17:24 +0800 CST
view 484
深入剖析 2026 年大模型推理引擎核心技术:PagedAttention、Continuous Batching、Chunked Prefill、RadixAttention 前缀缓存、投机解码与 AWQ/GPTQ/FP8 量化,结合 vLLM 与 SGLang 部署实战,把 GPU 利用率榨到极限的生产级完全指南。
LLM推理引擎
vLLM
SGLang
推理优化
量化部署
投机解码
GPU利用率
KV Cache
PagedAttention
Turso Database 深度拆解:用 Rust 完全重写 SQLite,这次不是玩票
编程
Turso Database 深度拆解:用 Rust 完全重写 SQLite,这次不是玩票
2026-07-27 03:16:01 +0800 CST
view 204
Turso Database 深度拆解:为何重写而非分叉 SQLite、io_uring 异步 I/O、MVCC 并发写绕开单写者限制、确定性模拟测试(DST)保障正确性,附 Rust/JS/Python 代码实战与生产选型指南。
Turso
SQLite
Rust
嵌入式数据库
MVCC
io_uring
向量搜索
libSQL
Model Context Protocol 2026年7月无状态化升级全解析:客户端驱动模式如何重构 AI Agent 工具调用生态
编程
Model Context Protocol 2026年7月无状态化升级全解析:客户端驱动模式如何重构 AI Agent 工具调用生态
2026-08-11 06:18:16 +0800 CST
view 52
深度拆解MCP 2026-07-28大改版:从有状态双向RPC到无状态客户端驱动的范式跃迁。涵盖无状态化、主动能力发现、MRTR模式、网关标准化头、长任务规范化、扩展框架与迁移指南。
MCP
Model Context Protocol
无状态协议
AI Agent
云原生
RPC
分布式系统
百度 Unlimited OCR 深度解析:端到端长文档 OCR 的新范式——从 R-SWA 机制到 3B 参数模型、从 KV Cache 压缩到生产级部署的完整技术指南(2026)
编程
百度 Unlimited OCR 深度解析:端到端长文档 OCR 的新范式——从 R-SWA 机制到 3B 参数模型、从 KV Cache 压缩到生产级部署的完整技术指南(2026)
2026-07-04 03:13:57 +0800 CST
view 428
2026年6月百度开源Unlimited OCR,5天GitHub Star破1万。深度解析R-SWA机制、3B参数模型架构、KV Cache压缩原理,含完整部署代码与生产级应用案例。
百度
Unlimited OCR
OCR
R-SWA
KV Cache
长文档识别
端到端OCR
多模态模型
OmniRoute 深度实战:一个端点聚合237家AI模型,省95% Token的本地网关架构全解析
编程
OmniRoute 深度实战:一个端点聚合237家AI模型,省95% Token的本地网关架构全解析
2026-07-09 10:14:24 +0800 CST
view 579
深度解析开源AI网关OmniRoute:一个端点聚合237家模型,RTK+Caveman双层压缩节省95% Token,含架构分析、代码实战、性能实测完整指南
AI网关
OmniRoute
Token压缩
OpenAI API
Claude Code
AI编程
开源工具
百度 Unlimited OCR 深度实战:30亿参数仅激活5亿、R-SWA注意力革命——长文档OCR端到端SOTA完全指南(2026)
编程
百度 Unlimited OCR 深度实战:30亿参数仅激活5亿、R-SWA注意力革命——长文档OCR端到端SOTA完全指南(2026)
2026-06-28 06:43:54 +0800 CST
view 584
百度2026年6月开源Unlimited OCR:30亿参数仅激活5亿,R-SWA注意力把KV Cache压成常数,一次前向推理处理几十页文档,OmniDocBench v1.6得分93.92%刷新SOTA。
百度 Unlimited OCR
OCR
R-SWA
长文档
端到端
MoE
SGLang
TensorRT-LLM 1.0 深度实战:当 PyTorch 架构成为默认体验,NVIDIA 的 LLM 推理引擎正式走向成熟
编程
TensorRT-LLM 1.0 深度实战:当 PyTorch 架构成为默认体验,NVIDIA 的 LLM 推理引擎正式走向成熟
2026-07-22 10:46:37 +0800 CST
view 176
深度解析 TensorRT-LLM 1.0:PyTorch 架构正式稳定、LLM API 稳定化、多模态 VLM 原生支持、Qwen3 MoE 优化、LoRA 生产级管理、trtllm-serve 推理服务化,配完整部署实战代码。
TensorRT-LLM
LLM推理
GPU加速
PyTorch
NVIDIA
深度学习
模型部署
推理优化
OmniRoute深度解析:一个端点掌控237家AI服务商,RTK+Caveman双层压缩节省95%Token
编程
OmniRoute深度解析:一个端点掌控237家AI服务商,RTK+Caveman双层压缩节省95%Token
2026-07-09 11:15:31 +0800 CST
view 426
深入解析OmniRoute技术架构:一个端点聚合237家AI服务商,RTK+Caveman双层压缩节省95%Token,支持Claude Code/Cursor/Codex等24+工具
AI网关
OmniRoute
Token压缩
OpenAI API
Claude
CSP 3.0 与 WebAssembly:浏览器安全策略的范式革命
编程
CSP 3.0 与 WebAssembly:浏览器安全策略的范式革命
2026-07-27 06:14:24 +0800 CST
view 153
2026年深度解析CSP 3.0对WebAssembly的安全控制:wasm-unsafe-eval原理、Worker双重检查、生产配置最佳实践与性能影响,程序员视角的WASM安全指南。
WebAssembly
CSP 3.0
浏览器安全
CSP
WASM
W3C
前端安全
Content-Security-Policy
Vue 3.6 Vapor Mode 深度解析:跳过虚拟 DOM——从编译原理到性能极致优化的完整技术指南(2026)
编程
Vue 3.6 Vapor Mode 深度解析:跳过虚拟 DOM——从编译原理到性能极致优化的完整技术指南(2026)
2026-07-04 05:42:15 +0800 CST
view 673
Vue 3.6 Vapor Mode 深度解析:跳过虚拟 DOM,直接操作真实 DOM,内存砍半,性能媲美 SolidJS 和 Svelte 5。含完整代码示例与生产级部署指南。
Vue
Vapor Mode
虚拟DOM
前端框架
性能优化
编译时优化
SolidJS
Svelte
OmniRoute + Caveman:AI编码网关的双层Token压缩革命,一文讲透省95%成本的底层原理
编程
OmniRoute + Caveman:AI编码网关的双层Token压缩革命,一文讲透省95%成本的底层原理
2026-07-09 12:15:02 +0800 CST
view 301
深入剖析OmniRoute本地AI网关的RTK请求压缩与Caveman输出风格压缩双层机制,从架构设计到底层原理,从实测数据到工程哲学,一文讲透AI编码工具如何实现省95% Token成本
OmniRoute
Caveman
Token压缩
AI编码
Claude Code
Cursor
开源工具
OmniRoute本地AI网关实战:RTK+Caveman双层压缩让Claude Code Token成本直降80%
编程
OmniRoute本地AI网关实战:RTK+Caveman双层压缩让Claude Code Token成本直降80%
2026-07-09 12:23:20 +0800 CST
view 256
深入剖析OmniRoute本地AI网关的RTK请求压缩与Caveman输出风格压缩双层机制,从架构设计到底层原理,从实测数据到工程哲学,一文讲透AI编码工具如何实现省80% Token成本
OmniRoute
Caveman
Token压缩
AI编码
Claude Code
Cursor
开源工具
成本优化
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
99
100
101
102
103
下一页