程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Vite 6 深度解析:Environment API 与前端构建工具的新里程碑
编程
Vite 6 深度解析:Environment API 与前端构建工具的新里程碑
2026-05-12 13:13:02 +0800 CST
view 686
深度解析Vite 6的重大革新:Environment API统一多环境开发、HMR性能提升30%、Vue4/React19/Svelte5深度集成、构建性能优化实战。
Vite6
EnvironmentAPI
前端构建工具
HMR
多环境开发
Vue4
React19
vLLM 深度解析:LLM 推理性能的终极引擎——从 PagedAttention 到生产级部署的完整技术内幕
编程
vLLM 深度解析:LLM 推理性能的终极引擎——从 PagedAttention 到生产级部署的完整技术内幕
2026-05-18 08:22:35 +0800 CST
view 936
全面解析 vLLM 推理引擎的核心架构,从 PagedAttention 原理到生产级部署实战,涵盖量化推理、多GPU并行、性能调优等完整技术栈
vLLM
LLM推理
PagedAttention
GPU优化
量化推理
深度解析
Temporal Replay 2026 深度实战:当持久执行成为 AI Agent 可靠性的行业共识
编程
Temporal Replay 2026 深度实战:当持久执行成为 AI Agent 可靠性的行业共识
2026-06-18 20:25:10 +0800 CST
view 425
深度解析 Temporal Replay 2026 大会发布的 Serverless Workers、Standalone Activities、Workflow Streams 等新特性,以及与 Google ADK、OpenAI Agents SDK 的深度集成如何重新定义 AI Agent 可靠性标准。
Temporal
持久执行
AI Agent
分布式系统
工作流
Workflow
Go
Python
Pyodide 3.14 深度实战:当 PEP 783 将 Python WASM 分发带入 PyPI 时代——从 300+ 包手动维护到去中心化生态的范式跃迁(2026)
编程
Pyodide 3.14 深度实战:当 PEP 783 将 Python WASM 分发带入 PyPI 时代——从 300+ 包手动维护到去中心化生态的范式跃迁(2026)
2026-06-18 22:26:50 +0800 CST
view 716
深度解析 Pyodide 3.14.0 与 PEP 783 的里程碑意义:Python WASM 包如何从 Pyodide 团队手工托管 300+ 包,转变为通过 PyPI 实现去中心化分发。涵盖 PyEmscripten ABI 原理、cibuildwheel 构建流水线、WASM wheel 发布实战、生态现状盘点与未来展望。
Python
Pyodide
WebAssembly
WASM
PEP 783
PyPI
浏览器端 Python
前端 AI
Emscripten
ONNX Runtime
KV Cache 深度拆解:当推理引擎决定把「注意力状态」做成一套存储系统——从 PagedAttention 分页、PD 分离成本方程到分层缓存盈亏平衡点的 Goodput 工程学
编程
KV Cache 深度拆解:当推理引擎决定把「注意力状态」做成一套存储系统——从 PagedAttention 分页、PD 分离成本方程到分层缓存盈亏平衡点的 Goodput 工程学
2026-08-09 02:16:55 +0800 CST
view 130
深度拆解 LLM 推理的 KV Cache 工程体系:为什么北极星指标必须从 Throughput 换成 Goodput、PagedAttention 的链式 hash 与前缀树实现、PD 分离的盈亏平衡方程(长输入短输出为何是负优化)、KVConnector 逐层流水传输、分层存储的盈亏平衡带宽公式与运行时决策函数、缓存感知路由,含可运行代码、调优清单与十条踩坑。
KV Cache
vLLM
PD分离
PagedAttention
LLM推理
Goodput
前缀缓存
RDMA
分层存储
性能优化
Intel OpenVINO 2026.3 深度拆解:让 300 亿参数 MoE 模型跑进 16GB 内存的工程实践
编程
Intel OpenVINO 2026.3 深度拆解:让 300 亿参数 MoE 模型跑进 16GB 内存的工程实践
2026-08-09 03:16:31 +0800 CST
view 185
深度拆解 Intel OpenVINO 2026.3:MoE 模型磁盘卸载(16GB 运行 30B MoE)、FP8 量化、NNCF、持续批处理、至强 6+ AMX 加速、Omni 多模态流水线等核心新特性,含可运行代码与十大生产踩坑清单。
OpenVINO
Intel
AI推理
模型部署
LLM
MoE
FP8量化
持续批处理
异构计算
NPU
CPU优化
80个Agent之后,AI团队终于不用自己写Agent了
代码
80个Agent之后,AI团队终于不用自己写Agent了
2026-07-02 13:29:20 +0800 CST
view 249
Rakuten France用4人AI团队服务全公司80+Agent,关键是把Agent从项目变成生产线:Agent Builder让业务团队自己创建Agent,Shared SOP统一规范,Registry解决治理难题。
AI
Agent
组织变革
数字化转型
Rakuten
Notion
民主化
SPEC CPU 2026 深度解析:九年磨一剑,52 个基准测试如何重塑 CPU 性能评估标准
编程
SPEC CPU 2026 深度解析:九年磨一剑,52 个基准测试如何重塑 CPU 性能评估标准
2026-05-18 17:44:27 +0800 CST
view 857
2026年5月5日SPEC正式发布SPEC CPU 2026基准测试套件,九年来首次重大版本更新。52个基准测试、源码行数翻倍、内存需求64GB、全面拥抱AI工作负载。本文深度解析新特性、技术架构升级及Intel/AMD/NVIDIA实测对比。
CPU
基准测试
SPEC
Intel
AMD
Arm
编译器
LLVM
性能优化
服务器
从 43 到 52:SPEC CPU 2026 深度解析——九年磨一剑,CPU 性能评估标准全面重塑
编程
从 43 到 52:SPEC CPU 2026 深度解析——九年磨一剑,CPU 性能评估标准全面重塑
2026-05-18 17:48:07 +0800 CST
view 1395
2026年5月5日SPEC正式发布SPEC CPU 2026基准测试套件,九年来首次重大版本更新。52个基准测试、源码行数翻倍、内存需求64GB、全面拥抱AI工作负载。本文深度解析新特性、技术架构升级及Intel/AMD/NVIDIA实测对比。
CPU
基准测试
SPEC
Intel
AMD
Arm
编译器
LLVM
性能优化
服务器
给 AI Agent 一台专属电脑:Cloudflare Computer 开源深度解析
编程
给 AI Agent 一台专属电脑:Cloudflare Computer 开源深度解析
2026-08-09 12:17:39 +0800 CST
view 204
深度拆解 Cloudflare 开源的 @cloudflare/computer:SQLite 虚拟文件系统作为 AI Agent 的持久化工作区,可插拔执行后端(V8 Isolate + Cloudflare Workers)智能调度,配完整代码示例与性能对比。
Cloudflare
AI Agent
SQLite
分布式
云原生
TypeScript
Kimi K3 架构深度解析:从第一性原理吃透 2.8 万亿参数 MoE 模型的三层核心创新
编程
Kimi K3 架构深度解析:从第一性原理吃透 2.8 万亿参数 MoE 模型的三层核心创新
2026-08-01 14:17:55 +0800 CST
view 307
深度解析 Kimi K3 的三大架构创新:KDA 混合线性注意力、Attention Residuals 注意力残差、Stable LatentMoE 分位数均衡路由,从第一性原理配代码示例吃透 2.8 万亿参数 MoE 模型。
Kimi
K3
MoE
KDA
AttnRes
StableLatentMoE
LLM
开源大模型
OpenVINO 2026.3 深度拆解:从 MoE 磁盘卸载到 FP8 量化,Intel 的端侧 AI 推理全家桶又升级了
编程
OpenVINO 2026.3 深度拆解:从 MoE 磁盘卸载到 FP8 量化,Intel 的端侧 AI 推理全家桶又升级了
2026-08-10 11:46:27 +0800 CST
view 186
深度拆解 Intel OpenVINO 2026.3 四大核心更新:MoE 磁盘卸载让 300B 模型跑在 16GB 机器上、Linux 懒加载消除权重复制、FP8 量化新能力、三条 GenAI 新流水线,配完整代码实战与性能数据对比
OpenVINO
Intel
AI推理
MoE
FP8量化
端侧部署
NNCF
LLM
CPU推理
vLLM 深度实战:当 LLM 推理遇上 PagedAttention——从 KV 缓存管理到生产级高并发服务的完全指南(2026)
编程
vLLM 深度实战:当 LLM 推理遇上 PagedAttention——从 KV 缓存管理到生产级高并发服务的完全指南(2026)
2026-06-08 22:52:24 +0800 CST
view 798
深度解析vLLM推理框架的核心原理、PagedAttention创新机制、分布式推理架构,以及生产环境部署的最佳实践。
vLLM
PagedAttention
LLM推理
KV缓存
分布式推理
2026 年 vLLM 推理服务实战:PagedAttention 原理、分布式部署与性能调优完全指南
编程
2026 年 vLLM 推理服务实战:PagedAttention 原理、分布式部署与性能调优完全指南
2026-06-08 22:53:03 +0800 CST
view 514
深度解析vLLM推理框架的核心原理、PagedAttention创新机制、分布式推理架构,以及生产环境部署的最佳实践。
vLLM
PagedAttention
LLM推理
KV缓存
分布式推理
DataBuff 深度拆解:当 APM 学会「多智能体协作」——用 OpenTelemetry + AI 原生架构重写可观测性的心智模型
编程
DataBuff 深度拆解:当 APM 学会「多智能体协作」——用 OpenTelemetry + AI 原生架构重写可观测性的心智模型
2026-07-15 15:15:44 +0800 CST
view 350
深度拆解 DataBuff:AI 原生 OpenTelemetry APM 的多智能体根因分析架构、极简三组件设计、MCP 双向开放能力,配完整 Docker/K8s 部署实战与代码示例。
DataBuff
OpenTelemetry
APM
AI-native
多智能体
可观测性
MCP
Doris
2026年AI架构突破全景解析:从 Kimi Attention Residuals 到存算一体——告别参数内卷,走向效率革命
编程
2026年AI架构突破全景解析:从 Kimi Attention Residuals 到存算一体——告别参数内卷,走向效率革命
2026-05-30 09:40:11 +0800 CST
view 916
深度解析2026年AI架构五大突破:Attention Residuals、存算一体、多模态原生、自我学习、量子AI,从算法到硬件全方位革新
AI架构
Attention Residuals
存算一体
量子AI
多模态原生
告别传统工单系统:开源客服平台 Tentix 用向量知识库让 AI 真正懂业务
编程
告别传统工单系统:开源客服平台 Tentix 用向量知识库让 AI 真正懂业务
2026-04-17 10:00:51 +0800 CST
view 743
本文介绍开源客服系统 Tentix,它将历史工单、对话、文档统一沉淀到 PostgreSQL + pgvector 向量知识库中,支持 MCP 扩展,让 AI 客服越跑越懂业务,不再工单电子化。
开源
Tentix
客服系统
向量知识库
AI
pgvector
MCP
LLM 推理优化全景实战:从 PagedAttention 到投机解码——让大模型推理成本下降 70% 的技术革命(2026)
编程
LLM 推理优化全景实战:从 PagedAttention 到投机解码——让大模型推理成本下降 70% 的技术革命(2026)
2026-05-30 15:42:55 +0800 CST
view 643
深度解析 LLM 推理优化的核心技术:PagedAttention 内存管理革命、投机解码加速策略、INT4/FP8 量化技术、MoE 架构优化,从架构原理到代码实战,让大模型推理成本下降 70%。
LLM
推理优化
vLLM
PagedAttention
投机解码
量化
MoE
vLLM 深度拆解:当大模型推理学会「分页注意力」——PagedAttention、连续批处理与 V1 引擎如何重写 GPU 推理服务的心智模型
编程
vLLM 深度拆解:当大模型推理学会「分页注意力」——PagedAttention、连续批处理与 V1 引擎如何重写 GPU 推理服务的心智模型
2026-07-16 04:19:16 +0800 CST
view 281
从工程师视角深度拆解 vLLM:PagedAttention 分页注意力、连续批处理、V1 引擎架构、KV Cache 管理、量化与投机解码,配 OpenAI 兼容服务、引导解码与生产调优实战。
vLLM
PagedAttention
连续批处理
大模型推理
GPU推理服务
KV缓存
V1引擎
OpenClaw 310k Star 全链路工程架构深度拆解:从 Gateway 控制平面到 Pi Loop 执行闭环
编程
OpenClaw 310k Star 全链路工程架构深度拆解:从 Gateway 控制平面到 Pi Loop 执行闭环
2026-08-11 13:56:35 +0800 CST
view 114
深度拆解 OpenClaw 310k Star 全链路工程架构:从 Gateway 控制平面、SessionKey 并发模型、Pi Loop 执行闭环到生产部署实战,含完整代码示例与 15 条踩坑清单。
OpenClaw
AI Agent
架构设计
Gateway
SessionKey
Pi Loop
并发控制
本地优先
Node.js
WebSocket
ego-lite 深度拆解:一个人类和 AI 并行操控的浏览器,如何重新定义 Agent 的网页自动化
编程
ego-lite 深度拆解:一个人类和 AI 并行操控的浏览器,如何重新定义 Agent 的网页自动化
2026-07-27 10:46:16 +0800 CST
view 290
深度拆解 GitHub Trending 项目 ego-lite:如何用一个 Chromium 分支解决 AI 浏览器自动化的登录态共享、人机并行与资源开销三大难题,附架构分析、代码实战与竞品对比。
AI编程
浏览器自动化
ego-lite
Chromium
Agent
Web自动化
CDP
Turso 深度拆解:当 SQLite 被 Rust 重写成"AI Agent 的专属数据库"——从进程内异步架构到百万数据库分片的全链路实战
编程
Turso 深度拆解:当 SQLite 被 Rust 重写成"AI Agent 的专属数据库"——从进程内异步架构到百万数据库分片的全链路实战
2026-08-18 07:15:18 +0800 CST
view 56
深度拆解 Turso/libSQL:Rust 重写的 SQLite,支持 MVCC 并发写入、io_uring 异步 I/O、原生向量搜索,专为 AI Agent 时代设计的边缘数据库,配完整 Python/Rust 实战代码与性能基准。
Turso
SQLite
Rust
AI Agent
嵌入式数据库
向量搜索
边缘计算
libSQL
TEN Framework 深度解析:当实时多模态语音 AI 遇上真正的"即插即用"
编程
TEN Framework 深度解析:当实时多模态语音 AI 遇上真正的"即插即用"
2026-04-08 19:04:47 +0800 CST
view 749
TEN Framework 是一个开源的实时多模态对话 AI 框架,让开发者能够像搭积木一样快速构建低延迟、高质量的实时语音/视频 AI Agent。本文深度解析其核心架构、实战应用与性能优化策略。
TEN Framework
语音AI
实时多模态
WebRTC
AI Agent
TensorRT-LLM 深度实战:从 Blackwell 架构到 INT4 量化的 LLM 推理性能革命
编程
TensorRT-LLM 深度实战:从 Blackwell 架构到 INT4 量化的 LLM 推理性能革命
2026-05-22 06:19:51 +0800 CST
view 836
深入解析TensorRT-LLM推理框架,从Paged KV Cache、连续批处理到INT4/INT8/FP8量化实战,覆盖Blackwell架构适配、Triton部署与K8s生产方案
TensorRT-LLM
LLM推理
量化
INT4
Blackwell
GPU优化
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
68
69
70
71
72
...
134
下一页