程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
万字长文拆解 vLLM 0.18:PagedAttention 如何用操作系统思维颠覆大模型推理
编程
万字长文拆解 vLLM 0.18:PagedAttention 如何用操作系统思维颠覆大模型推理
2026-06-29 17:17:00
view 434
2026年vLLM 0.18深度解析:PagedAttention显存管理、EAGLE3推测解码、连续批处理、分离式Prefill、FP4量化,附生产级部署代码与Benchmark对比
vLLM
LLM推理
PagedAttention
推测解码
EAGLE3
FP4量化
CUDA
GPU性能优化
PostgreSQL 19 Parallel Autovacuum:从单线程清理到并行革命的深度技术剖析
编程
PostgreSQL 19 Parallel Autovacuum:从单线程清理到并行革命的深度技术剖析
2026-05-16 13:50:16
view 666
深入剖析PostgreSQL 19的Parallel Autovacuum新特性,从MVCC原理到并行架构设计,从参数调优到生产实战,全面掌握大表清理性能提升3-5倍的秘诀。
PostgreSQL 19
Parallel Autovacuum
数据库优化
MVCC
性能调优
PostgreSQL 19 Beta 1 深度解析:SQL/PGQ图查询、时态操作、并行Vacuum——60+新特性重新定义关系型数据库
编程
PostgreSQL 19 Beta 1 深度解析:SQL/PGQ图查询、时态操作、并行Vacuum——60+新特性重新定义关系型数据库
2026-06-29 21:42:34
view 900
2026年6月PostgreSQL 19 Beta 1发布,带来SQL/PGQ图查询、时态DML、并行Vacuum、外键2x提速等60+新特性,深度解析每个特性的原理与实战。
PostgreSQL
SQL/PGQ
图查询
时态数据
并行Vacuum
AIO
逻辑复制
英伟达 CUDA-Oxide 0.1 深度解析:用 Rust 编写 GPU 内核的破冰之旅
编程
英伟达 CUDA-Oxide 0.1 深度解析:用 Rust 编写 GPU 内核的破冰之旅
2026-05-10 08:20:42
view 1010
英伟达发布实验性Rust-to-CUDA编译器CUDA-Oxide 0.1,支持用Rust编写SIMT GPU内核并输出标准PTX中间代码。深度解析其架构设计、代码示例与未来展望。
CUDA-Oxide
Rust
GPU编程
NVIDIA
PTX
SIMT
并行计算
高性能计算
SGLang 深度拆解:当 LLM 推理引擎决定「干掉全部慢吞吞的 GPU 服务器」——从 RadixAttention 到 GB300 NVL72 的 25 倍飞跃,一个 27K Star 的 Python 框架如何重新定义大模型推理的终极形态
编程
SGLang 深度拆解:当 LLM 推理引擎决定「干掉全部慢吞吞的 GPU 服务器」——从 RadixAttention 到 GB300 NVL72 的 25 倍飞跃,一个 27K Star 的 Python 框架如何重新定义大模型推理的终极形态
2026-08-04 19:22:29
view 226
深度拆解SGLang 27K Star开源LLM推理框架:RadixAttention基数树前缀缓存实现3-8倍加速、自研FlashInfer CUDA Kernel、Prefill-Decode分离架构、GB300 NVL72上25倍性能飞跃、DFlash投机采样、多LoRA热切换,附完整部署与调优指南
SGLang
LLM推理
RadixAttention
FlashInfer
GPU加速
大模型部署
推理引擎
PagedAttention
PD分离
投机采样
CUDA
开源
TileKernels 深度解析:DeepSeek 用 80 行代码榨干 GPU,算子开发范式的降维打击
编程
TileKernels 深度解析:DeepSeek 用 80 行代码榨干 GPU,算子开发范式的降维打击
2026-04-30 03:22:15
view 1041
深度解析 DeepSeek 开源的高性能 GPU 算子库 TileKernels:基于 TileLang DSL 用 80 行代码实现手写 CUDA 级性能,覆盖 MoE Gating/Routing、FP8/FP4 量化、Engram 门控等七大算子家族,首次原生支持 NVIDIA Blackwell 架构,并通过 TVM 编译器打通昇腾等国产芯片。
DeepSeek
TileKernels
GPU
CUDA
TileLang
MoE
算子优化
PostgreSQL 19 深度前瞻:原生图查询、零停机 REPACK 与并行 Autovacuum,2026 年最值得升级的数据库大版本
编程
PostgreSQL 19 深度前瞻:原生图查询、零停机 REPACK 与并行 Autovacuum,2026 年最值得升级的数据库大版本
2026-07-24 00:44:08
view 277
PostgreSQL 19 深度前瞻:SQL/PGQ原生图查询、ON CONFLICT DO SELECT、REPACK CONCURRENTLY在线表重组、并行autovacuum与优先级机制、64位MultiXact,配完整代码示例与升级实操清单。
PostgreSQL 19
SQL/PGQ
图查询
REPACK
Autovacuum
ON CONFLICT
数据库
性能优化
MultiXact
逻辑复制
DwarfStar 4 深度拆解:当 Redis 之父决定「干掉全部通用推理引擎」——一个专用 MoE 推理栈如何用 2-Bit 量化和磁盘 KV 缓存在 MacBook 上跑出 26 tok/s
编程
DwarfStar 4 深度拆解:当 Redis 之父决定「干掉全部通用推理引擎」——一个专用 MoE 推理栈如何用 2-Bit 量化和磁盘 KV 缓存在 MacBook 上跑出 26 tok/s
2026-08-04 22:46:33
view 273
深度拆解Redis创始人antirez打造的DwarfStar 4本地推理引擎:专用MoE推理栈、非对称2-Bit量化、磁盘KV缓存、SSD流式加载、多机流水线并行,在128GB MacBook上跑出26 tok/s的284B模型推理
DwarfStar
Redis
antirez
DeepSeek
MoE
本地推理
LLM
推理引擎
2-Bit量化
KV缓存
Apple Metal
CUDA
开源
DFlash 深度实战:块扩散模型如何实现 6 倍无损加速——从自回归瓶颈到并行生成的范式跃迁
编程
DFlash 深度实战:块扩散模型如何实现 6 倍无损加速——从自回归瓶颈到并行生成的范式跃迁
2026-05-23 11:16:44
view 713
深度解析UC San Diego Z Lab提出的DFlash(Block Diffusion for Flash Speculative Decoding),详解块扩散草稿模型如何突破自回归瓶颈,在Qwen3-8B上实现6倍无损加速的架构原理、训练方法与生产级实战代码
LLM推理,投机解码,块扩散模型,大模型加速,DFlash,Speculative Decoding,UC San Diego,PyTorch,深度学习,AI推理优化
PostgreSQL 19 深度解析:SQL/PGQ图查询、REPACK表重整与并行Autovacuum——三十而立的数据库之王如何重新定义关系型数据库的边界
编程
PostgreSQL 19 深度解析:SQL/PGQ图查询、REPACK表重整与并行Autovacuum——三十而立的数据库之王如何重新定义关系型数据库的边界
2026-07-06 01:12:51
view 538
深度解析PostgreSQL 19 Beta 1核心特性:SQL/PGQ图查询标准在关系型表上执行图遍历、REPACK命令终结VACUUM FULL混乱并支持并发重整、并行Autovacuum让大表清理不再痛苦、在线Checksum开关、LZ4默认压缩、逻辑复制序列同步、查询优化器全面增强。含完整代码实战与升级指南。
PostgreSQL
PostgreSQL 19
SQL/PGQ
图查询
REPACK
并行Autovacuum
数据库
开源
PostgreSQL 19 深度实战:当关系数据库遇见图查询、时态操作与在线重组织——从SQL/PGQ属性图到并行自动清理、原子UPSERT的生产级完全指南(2026)
编程
PostgreSQL 19 深度实战:当关系数据库遇见图查询、时态操作与在线重组织——从SQL/PGQ属性图到并行自动清理、原子UPSERT的生产级完全指南(2026)
2026-06-17 04:52:56
view 416
PostgreSQL 19深度解读:SQL/PGQ属性图查询、ON CONFLICT DO SELECT原子UPSERT、FOR PORTION OF时态操作、REPACK在线重组织、并行自动清理、原生JSON导出等核心新特性完全指南。
PostgreSQL 19
SQL/PGQ
图查询
时态数据
在线重组织
并行VACUUM
UPSERT
PostgreSQL 19 深度拆解:当数据库之王决定「干掉全部性能瓶颈」——从 ANTI JOIN 智能转换到 SIMD 加速 COPY,一个 40 年历史的开源数据库如何用 289 倍查询提速重新定义关系型数据库的终极形态
编程
PostgreSQL 19 深度拆解:当数据库之王决定「干掉全部性能瓶颈」——从 ANTI JOIN 智能转换到 SIMD 加速 COPY,一个 40 年历史的开源数据库如何用 289 倍查询提速重新定义关系型数据库的终极形态
2026-08-05 03:17:21
view 240
深度拆解PostgreSQL 19 Beta 2:ANTI JOIN智能转换实现289倍查询提速、SIMD加速COPY 3.5倍、并行Autovacuum清理提速4倍、lz4默认压缩、新监控体系,附完整迁移指南与代码实战
PostgreSQL
数据库
PostgreSQL 19
查询优化
ANTI JOIN
SIMD
异步I/O
Autovacuum
性能优化
开源数据库
llama.cpp 深度实战:从 GGUF 量化到 CUDA 内核优化——纯 C/C++ 如何在 CPU/GPU 上榨出 LLM 推理的极限性能
编程
llama.cpp 深度实战:从 GGUF 量化到 CUDA 内核优化——纯 C/C++ 如何在 CPU/GPU 上榨出 LLM 推理的极限性能
2026-05-23 17:18:22
view 2386
2026年深度拆解 llama.cpp 的核心架构:GGUF 格式原理、20+量化方法对比、KV Cache 优化、多硬件后端性能实测,与 Ollama/vLLM 完整横评。
llama.cpp
GGUF
量化
CUDA
Metal
LLM推理
C++
本地部署
性能优化
GGML
DSpark深度解析:DeepSeek联合北大开源的推测解码框架——半自回归生成+置信度调度如何让大模型推理速度飙升85%
编程
DSpark深度解析:DeepSeek联合北大开源的推测解码框架——半自回归生成+置信度调度如何让大模型推理速度飙升85%
2026-07-06 07:43:51
view 601
深度解析DeepSeek联合北京大学开源的DSpark推测解码推理加速框架:半自回归生成架构解决后缀衰减、置信度调度验证机制避免算力浪费、单用户生成速度提升60%-85%、吞吐量最高暴涨661%。含完整代码实战与性能基准测试。
DSpark
DeepSeek
推测解码
Speculative Decoding
推理加速
半自回归
置信度调度
大模型推理
gsplat深度解析:3D高斯泼溅的CUDA加速革命——从伯克利/英伟达开源库到生产级实时渲染
编程
gsplat深度解析:3D高斯泼溅的CUDA加速革命——从伯克利/英伟达开源库到生产级实时渲染
2026-06-30 15:18:05
view 1176
深度解析UC伯克利/NVIDIA等机构联合开发的gsplat开源库:CUDA加速的3D高斯泼溅渲染引擎,节省4倍显存、缩短15%训练时间,涵盖数学原理、CUDA架构、训练流程、性能优化与生产应用。
gsplat
3D Gaussian Splatting
CUDA
图形渲染
3D重建
NeRF
实时渲染
PyTorch
AI Agent 沙箱三国杀:OpenSandbox vs CubeSandbox vs E2B,从内核隔离到秒级调度的全链路技术拆解
编程
AI Agent 沙箱三国杀:OpenSandbox vs CubeSandbox vs E2B,从内核隔离到秒级调度的全链路技术拆解
2026-05-02 06:06:14
view 1601
深度拆解阿里OpenSandbox、腾讯CubeSandbox与E2B三大AI Agent沙箱方案,从内核隔离原理、API协议设计、调度架构、性能实测到生产部署全链路技术分析
OpenSandbox
CubeSandbox
E2B
AI Agent
沙箱
KVM
Docker
Kubernetes
eBPF
RustVMM
Cua:15.9K Stars!给 AI 一台隔离云桌面,让它真正会用电脑
案例
Cua:15.9K Stars!给 AI 一台隔离云桌面,让它真正会用电脑
2026-05-11 16:22:59
view 856
15.9K Stars 的开源项目 Cua,由 Y Combinator 孵化。给 AI 一个隔离云桌面,让它真的去开浏览器、点按钮、跑应用。支持 macOS/Linux/Windows/Android,三周暴涨 2000+ Stars。
Cua
AI Agent
Computer Use
云桌面
沙盒
Y Combinator
Claude Code
跨平台
万字深度解析 PostgreSQL 19 Beta 1:2026 年数据库内核最重磅升级——从并行 Vacuum 到 SQL/PGQ 属性图的全方位革新
编程
万字深度解析 PostgreSQL 19 Beta 1:2026 年数据库内核最重磅升级——从并行 Vacuum 到 SQL/PGQ 属性图的全方位革新
2026-07-01 01:14:41
view 543
2026年6月PostgreSQL 19 Beta 1正式发布,万字深度解析从并行Vacuum到SQL/PGQ属性图的全方位革新,含代码实战与升级指南
PostgreSQL19
PostgreSQL
数据库内核
SQL/PGQ
属性图
Vacuum
查询优化
逻辑复制
postgres_fdw
JIT编译
PostgreSQL 19 深度拆解:当数据库决定「把图查询塞进关系引擎」——从 SQL/PGQ 属性图到 LZ4 压缩革命,一个 Beta 2 版本如何用 7 大破坏性变更重新定义 OLTP 数据库的终极形态
编程
PostgreSQL 19 深度拆解:当数据库决定「把图查询塞进关系引擎」——从 SQL/PGQ 属性图到 LZ4 压缩革命,一个 Beta 2 版本如何用 7 大破坏性变更重新定义 OLTP 数据库的终极形态
2026-08-05 17:16:55
view 365
深度拆解PostgreSQL 19 Beta 2的7大破坏性变更:SQL/PGQ属性图查询、LZ4默认压缩、并行Autovacuum、逻辑复制热切换、分区合并拆分、pg_plan_advice查询建议器、vacuumdb干运行模式,附完整代码实战与升级指南
PostgreSQL
PG19
SQL/PGQ
属性图
LZ4
并行Autovacuum
逻辑复制
数据库
PostgreSQL 19 Beta 2 深度拆解:从查询提速289倍到并行Autovacuum的工程全貌(2026)
编程
PostgreSQL 19 Beta 2 深度拆解:从查询提速289倍到并行Autovacuum的工程全貌(2026)
2026-07-19 13:19:09
view 369
2026年7月PostgreSQL 19 Beta 2正式发布,深度拆解查询优化器289倍提速。并行Autovacuum Workers、TOAST lz4压缩算法、MD5废弃等重大改进,配完整升级指南。
PostgreSQL 19
PostgreSQL Beta 2
查询优化
ANTI JOIN
并行 Autovacuum
TOAST lz4
MD5 废弃
SCRAM
分区 MERGE
pg_stat_lock
数据库
PostgreSQL 19 深度实战:212 项更新背后的架构革命——从 ON CONFLICT DO SELECT 到并行 Autovacuum 的工程完全指南
编程
PostgreSQL 19 深度实战:212 项更新背后的架构革命——从 ON CONFLICT DO SELECT 到并行 Autovacuum 的工程完全指南
2026-06-04 06:43:36
view 803
PG19 Beta 212项更新深度解析:DO SELECT补齐Upsert、SQL/PGQ图查询、64位MultiXact消灭回卷、并行Autovacuum加速大表清理
PostgreSQL
数据库
SQL
图查询
Autovacuum
OpenCut 深度拆解:当开源视频剪辑刀重写自己——从 Next.js+FFmpeg 到 Rust 核心、插件优先与 MCP Server 的工程全貌(2026)
编程
OpenCut 深度拆解:当开源视频剪辑刀重写自己——从 Next.js+FFmpeg 到 Rust 核心、插件优先与 MCP Server 的工程全貌(2026)
2026-07-19 13:43:29
view 537
深度拆解 OpenCut:登顶 GitHub Trending 的开源 CapCut 替代品,正从 Next.js+FFmpeg 重写为 Rust 核心单代码库,引入插件优先、Editor API、MCP Server 与 Headless 模式。配架构分析与代码实战。
OpenCut
开源
视频编辑
Rust
MCP Server
Lucebox 深度解析:9.56L 铝合金盒子如何用 RTX 3090 + Ryzen AI MAX+ 395 的 128GB 统一内存 + DFlash 推测解码 + 自研 CUDA 内核让消费级硬件实现 4-6 倍云端推理加速——从硬件架构到开源推理引擎 lucebox-hub 的完整实战指南
编程
Lucebox 深度解析:9.56L 铝合金盒子如何用 RTX 3090 + Ryzen AI MAX+ 395 的 128GB 统一内存 + DFlash 推测解码 + 自研 CUDA 内核让消费级硬件实现 4-6 倍云端推理加速——从硬件架构到开源推理引擎 lucebox-hub 的完整实战指南
2026-07-07 00:44:30
view 452
深度解析Lucebox本地AI推理盒子:9.56L铝合金机身塞入RTX 3090+Ryzen AI MAX+ 395的128GB统一内存,配合自研DFlash推测解码和CUDA内核优化,在消费级硬件上实现4-6倍推理加速。从硬件架构到开源引擎lucebox-hub的完整实战指南。
Lucebox
本地推理
AI Agent
推测解码
CUDA
RTX 3090
Ryzen AI MAX
开源
万字深度解析 PostgreSQL 19 Beta 1:当「世界上最先进的开源数据库」遇见性能与开发者体验的双重革命——从异步 I/O 自动扩展到 SQL/PGQ 标准查询的完整技术指南(2026)
编程
万字深度解析 PostgreSQL 19 Beta 1:当「世界上最先进的开源数据库」遇见性能与开发者体验的双重革命——从异步 I/O 自动扩展到 SQL/PGQ 标准查询的完整技术指南(2026)
2026-07-01 14:14:59
view 663
2026年6月PostgreSQL 19 Beta 1发布,深度解析异步I/O自动扩展、VACUUM并行化、SQL/PGQ属性图查询、GROUP BY ALL等重磅特性,配15+代码示例
PostgreSQL 19
PostgreSQL
数据库
性能优化
SQL/PGQ
异步I/O
VACUUM并行化
开发者体验
属性图查询
GROUP BY ALL
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
python
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
上一页
1
...
7
8
9
10
11
...
33
下一页