程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
从140GB到4GB:AirLLM无量化层间推理原理深度剖析与生产级部署实战(2026)
编程
从140GB到4GB:AirLLM无量化层间推理原理深度剖析与生产级部署实战(2026)
2026-06-22 19:28:19 +0800 CST
view 404
深入解析 AirLLM 的无量化层间 Offloading 技术原理,探讨如何通过 CPU-GPU 混合推理在 4GB 显存上运行 70B 大模型,附完整代码实战与生产部署指南。
LLM推理
GPU优化
CPU Offload
层间调度
AirLLM
PyTorch
eBPF深度实践指南:从内核hook点到云原生可观测性的完整工程手册
编程
eBPF深度实践指南:从内核hook点到云原生可观测性的完整工程手册
2026-07-24 10:45:42 +0800 CST
view 171
深度解析eBPF技术:内核hook机制、XDP网络加速、kprobe系统追踪、LSM安全模块、Cilium服务网格,从架构原理到生产落地,配完整可运行代码示例
eBPF
Linux内核
云原生
网络
性能优化
安全监控
Kubernetes
Cilium
2026服务端WebAssembly深度解析:Wasmtime、WASMer、WasmEdge三足鼎立,WASI终于走向生产
编程
2026服务端WebAssembly深度解析:Wasmtime、WASMer、WasmEdge三足鼎立,WASI终于走向生产
2026-07-29 14:49:26 +0800 CST
view 114
深度拆解2026年四大主流服务端Wasm运行时(Wasmtime/WASMer/WasmEdge/Hyperlight Wasm)的架构设计、性能真相与生产选型,含WASI Preview 2组件模型完整实战与跨语言互操作代码示例
WebAssembly
Wasm
WASI
服务端运行时
Wasmtime
WASMer
WasmEdge
云原生
Serverless
Edge计算
组件模型
WIT
性能优化
CNCF
Hyperlight
ECC 深度实战:当 AI 编程助手学会「自我优化」——从 Skills 到 MCP 的生产级 Agent 性能调优完全指南(2026)
编程
ECC 深度实战:当 AI 编程助手学会「自我优化」——从 Skills 到 MCP 的生产级 Agent 性能调优完全指南(2026)
2026-06-11 13:23:32 +0800 CST
view 505
ECC 是一个为 AI Agent Harness 设计的性能优化系统,源自 Anthropic 黑客松冠军项目,GitHub 20 万 Star。本文深入剖析其 Skills、Agents、Hooks、MCP 架构,提供从零到生产级的完整实战指南。
AI编程
Claude Code
Cursor
开源
性能优化
ECC
LCLM 深度实战:当「潜在上下文」颠覆大模型记忆困境——从 8.8 倍速提升到工业级部署的完整指南(2026)
编程
LCLM 深度实战:当「潜在上下文」颠覆大模型记忆困境——从 8.8 倍速提升到工业级部署的完整指南(2026)
2026-06-17 08:57:22 +0800 CST
view 341
深入解析2026年LCLM潜在上下文语言模型,8.8倍速度提升背后的技术原理与工业级部署实战,含完整代码示例与性能对比。
大模型
上下文压缩
KV缓存
LCLM
Transformer
AI优化
推理加速
9个高级前端必会的性能优化 API,你掌握了几个?
编程
9个高级前端必会的性能优化 API,你掌握了几个?
2025-07-14 12:35:24 +0800 CST
view 1301
本文介绍了9个高级前端性能优化API,包括requestIdleCallback、IntersectionObserver、WeakMap等,详细阐述了它们的适用场景和代码示例。这些API可以显著提升页面性能和用户体验,帮助开发者写出更现代的前端代码。
前端开发
性能优化
Web技术
TriAttention深度解析:用三角函数革命性压缩KV Cache,让长推理从「显存地狱」中脱困
编程
TriAttention深度解析:用三角函数革命性压缩KV Cache,让长推理从「显存地狱」中脱困
2026-05-17 04:14:18 +0800 CST
view 570
深入解析MIT韩松团队提出的TriAttention方法,利用Pre-RoPE空间Q/K集中性和三角函数级数实现革命性的KV Cache压缩,在AIME25上以3072 KV budget达到与Full Attention持平的40.8%准确率,同时实现10.7倍KV显存压缩和2.5-6.3倍吞吐量提升。
LLM
KV Cache
TriAttention
MIT
英伟达
浙大
长推理
KV压缩
三角函数
RoPE
Attention优化
当「潜在上下文」颠覆大模型记忆困境:LCLM 8.8 倍速提升完整拆解与工业部署指南(2026)
编程
当「潜在上下文」颠覆大模型记忆困境:LCLM 8.8 倍速提升完整拆解与工业部署指南(2026)
2026-06-17 08:57:46 +0800 CST
view 360
深入解析2026年LCLM潜在上下文语言模型,8.8倍速度提升背后的技术原理与工业级部署实战,含完整代码示例与性能对比。
大模型
上下文压缩
KV缓存
LCLM
Transformer
AI优化
推理加速
Go 1.24 深度解析:Swiss Table 哈希表革命、泛型增强与 weak 包——重新定义 Go 并发性能
编程
Go 1.24 深度解析:Swiss Table 哈希表革命、泛型增强与 weak 包——重新定义 Go 并发性能
2026-06-30 13:15:00 +0800 CST
view 224
2025年2月Go 1.24正式发布,内置map全面切换为Swiss Table,sync.Map引入HashTrieMap架构。本文深入解析两大数据结构的底层原理、性能对比、泛型类型别名、weak包、runtime.AddCleanup等核心新特性,提供完整代码实战与迁移指南。
Go
Go1.24
Swiss Table
HashTrieMap
泛型
weak包
sync.Map
性能优化
【重制版】TriAttention深度解析:三角函数如何让长推理从显存地狱中脱困
编程
【重制版】TriAttention深度解析:三角函数如何让长推理从显存地狱中脱困
2026-05-17 04:14:33 +0800 CST
view 495
深入解析MIT韩松团队提出的TriAttention方法,利用Pre-RoPE空间Q/K集中性和三角函数级数实现革命性的KV Cache压缩,在AIME25上以3072 KV budget达到与Full Attention持平的40.8%准确率,同时实现10.7倍KV显存压缩和2.5-6.3倍吞吐量提升。
LLM
KV Cache
TriAttention
MIT
英伟达
浙大
长推理
KV压缩
三角函数
RoPE
Attention优化
PostgreSQL 18 核心特性完全指南:AIO 异步 I/O、Skip Scan 索引、虚拟列、uuidv7 与 OAuth 认证实战(2026)
编程
PostgreSQL 18 核心特性完全指南:AIO 异步 I/O、Skip Scan 索引、虚拟列、uuidv7 与 OAuth 认证实战(2026)
2026-07-18 15:15:19 +0800 CST
view 168
深度拆解 PostgreSQL 18:AIO 子系统 3 倍性能提升、Skip Scan 解放多列索引、虚拟生成列零存储成本、uuidv7 时间有序 ID、OAuth 原生认证支持,含完整代码实战与生产升级指南
PostgreSQL
数据库
性能优化
AIO
OAuth
PostgreSQL 18 → 19 深度实战:当世界上最先进的开源数据库迎来 30 岁——从异步 I/O 引擎到智能图查询,2026 生产级完全指南
编程
PostgreSQL 18 → 19 深度实战:当世界上最先进的开源数据库迎来 30 岁——从异步 I/O 引擎到智能图查询,2026 生产级完全指南
2026-06-11 14:48:47 +0800 CST
view 463
深度解析 PostgreSQL 18 异步I/O、跳过扫描、UUIDv7 等核心新特性,前瞻 PG19 Beta 的 REPACK、64位 MultiXact、ON CONFLICT DO SELECT 等关键改进,附完整性能优化实战案例和生产级配置指南。
PostgreSQL
数据库
性能优化
PostgreSQL 18
PostgreSQL 19
AIO
SQL
eBPF:Linux 内核的超能力——云原生时代的核心技术底座
编程
eBPF:Linux 内核的超能力——云原生时代的核心技术底座
2026-06-30 14:14:39 +0800 CST
view 592
深度解析 eBPF 技术:从核心原理到生产级应用,涵盖 XDP 网络加速、内核跟踪、安全策略、开发实战,以及 2026 年云原生生态全景
eBPF
Linux
内核
云原生
可观测性
网络
安全
XDP
性能优化
千万级数据的全表更新的正确方式
编程
千万级数据的全表更新的正确方式
2024-11-19 01:43:51 +0800 CST
view 1979
在处理千万级数据的全表更新时,直接执行SQL会导致主库负载剧增,影响主从同步性能。通过分批处理和索引优化,可以有效减少对数据库的压力。使用`SQL_NO_CACHE`避免缓存影响,强制使用主键索引,并按主键顺序更新数据,从而提高效率,确保数据库正常运行。
数据库
性能
优化
MySQL
数据处理
Headroom 深度实战:当 Netflix 工程师用「上下文压缩」掀翻 AI 成本底牌——从 CCR 可逆机制到跨 Agent 记忆的生产级完全指南(2026)
编程
Headroom 深度实战:当 Netflix 工程师用「上下文压缩」掀翻 AI 成本底牌——从 CCR 可逆机制到跨 Agent 记忆的生产级完全指南(2026)
2026-06-11 15:20:19 +0800 CST
view 659
Netflix工程师开源的AI上下文压缩工具Headroom,能在保持答案质量的前提下将Token消耗压缩60-95%,累计节省70万美元成本。本文深度剖析其架构设计、CCR可逆机制、跨Agent记忆共享与生产级集成实践。
AI编程
Token压缩
上下文管理
LLM优化
OpenSource
Python 工具链的 Rust 化革命:从 uv、Ruff 到 LiteLLM——当 Rust 吃掉 Python 的工具生态
编程
Python 工具链的 Rust 化革命:从 uv、Ruff 到 LiteLLM——当 Rust 吃掉 Python 的工具生态
2026-06-30 14:43:40 +0800 CST
view 263
深度解析Python工具链的Rust化革命:从uv的包管理、Ruff的静态分析到LiteLLM的AI网关迁移,万字长文剖析Rust如何以10-100倍的性能优势重塑Python开发生态
Rust
Python
uv
Ruff
LiteLLM
Polars
性能优化
包管理
Pydantic
PostgreSQL 18 终极指南:AIO 革命性性能升级、Skip Scan 索引黑科技与生产部署实操(2026)
编程
PostgreSQL 18 终极指南:AIO 革命性性能升级、Skip Scan 索引黑科技与生产部署实操(2026)
2026-07-18 15:17:34 +0800 CST
view 479
深度拆解 PostgreSQL 18:AIO 子系统带来 3 倍 I/O 性能提升、Skip Scan 解放多列索引、虚拟生成列零存储成本、uuidv7 时间有序 ID、OAuth 原生认证支持,含完整代码实战与生产升级指南
PostgreSQL
数据库
AIO
性能优化
skip-scan
uuidv7
OAuth
编程
TIME_WAIT状态的连接过多导致系统端口资源耗尽问题
2024-11-17 21:27:27 +0800 CST
view 3456
本文讨论了如何优化Linux系统中的TIME_WAIT状态,使用netstat命令查看TCP连接状态,并通过修改/etc/sysctl.conf文件中的相关参数来减少TIME_WAIT套接字的数量。具体参数包括开启SYNCookies、重用TIME-WAITsockets、快速回收TIME-WAITsockets等,最后通过执行/sysctl-p命令使修改生效。
Linux
网络优化
TCP配置
Vue中的异步更新是如何实现的?
编程
Vue中的异步更新是如何实现的?
2024-11-18 19:24:29 +0800 CST
view 1384
在Vue.js中,异步更新机制是其响应式系统的核心。Vue利用JavaScript的事件循环和虚拟DOM技术,将数据变化推迟到下一个事件循环周期进行统一处理,从而避免频繁的DOM更新,提升性能。示例代码展示了如何通过按钮点击触发异步更新,2秒后更新消息,体现了Vue的异步更新特性。
前端开发
Vue.js
性能优化
WindowsReactor 深度实战:当微软用 Rust 重写 Windows 11——从内存安全到原生应用性能飙升的生产级完全指南(2026)
编程
WindowsReactor 深度实战:当微软用 Rust 重写 Windows 11——从内存安全到原生应用性能飙升的生产级完全指南(2026)
2026-06-11 15:53:20 +0800 CST
view 420
深度解析微软用 Rust 重写 Windows 11 原生应用的技术内核,从所有权系统到 WindowsReactor 架构,从性能剖析到代码实战,带你理解 Rust 如何在桌面应用领域掀起性能革命。
Rust
Windows
WinUI
性能优化
系统编程
桌面开发
微软
内存安全
Python 工具链 Rust 化深度解析:从 uv、Ruff 到 LiteLLM——当系统级语言重塑 Python 开发体验
编程
Python 工具链 Rust 化深度解析:从 uv、Ruff 到 LiteLLM——当系统级语言重塑 Python 开发体验
2026-06-30 14:44:22 +0800 CST
view 216
深度解析Python工具链的Rust化革命:从uv的包管理、Ruff的静态分析到LiteLLM的AI网关迁移,万字长文剖析Rust如何以10-100倍的性能优势重塑Python开发生态
Rust
Python
uv
Ruff
LiteLLM
Polars
性能优化
包管理
Pydantic
Headroom 深度拆解:当 AI Agent 学会「断舍离」——从上下文压缩层、CCR 可逆检索到 6 大压缩算法的工程全貌(2026)
编程
Headroom 深度拆解:当 AI Agent 学会「断舍离」——从上下文压缩层、CCR 可逆检索到 6 大压缩算法的工程全貌(2026)
2026-07-18 15:45:16 +0800 CST
view 160
Headroom 是 AI Agent 的上下文压缩层,在 Agent 与 LLM 之间插入本地优先、完全可逆的压缩中间件,实测节省 60-95% Token。本文从架构、4种集成模式、CCR 可逆检索到 6 大压缩算法与可运行代码实战全面拆解。
Headroom
AI Agent
上下文压缩
Token优化
LLM工程
PostgreSQL 18 异步 I/O 深度拆解:io_method 三种模式、ReadStream 流水线与生产调优实录
编程
PostgreSQL 18 异步 I/O 深度拆解:io_method 三种模式、ReadStream 流水线与生产调优实录
2026-07-30 02:13:05 +0800 CST
view 99
深度拆解 PostgreSQL 18 异步 I/O 子系统:sync/worker/io_uring 三种 io_method 架构对比、ReadStream 预读流水线原理、冷缓存实测 2-3 倍提升数据、生产调优参数与边界分析,附 PG18 其他新特性速览。
PostgreSQL
异步IO
io_uring
数据库
性能优化
AIO
ReadStream
云存储
UUIDv7
开源
Rust 正在重塑 Python 的工具链:深入解析 uv、Ruff 与 LiteLLM 的架构革命与 100 倍性能提升
编程
Rust 正在重塑 Python 的工具链:深入解析 uv、Ruff 与 LiteLLM 的架构革命与 100 倍性能提升
2026-06-30 14:45:17 +0800 CST
view 348
深度解析Python工具链的Rust化革命:从uv的包管理、Ruff的静态分析到LiteLLM的AI网关迁移,万字长文剖析Rust如何以10-100倍的性能优势重塑Python开发生态
Rust
Python
uv
Ruff
LiteLLM
Polars
性能优化
包管理
Pydantic
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
17
18
19
20
21
...
45
下一页