程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
编程
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
2026-07-15 08:45:14 +0800 CST
view 329
从工程师视角深度拆解 Ollama 与本地大模型推理引擎:GGUF 单文件格式、K-quant/IQ-quant 量化家族、内存带宽墙、llama.cpp 计算图与 KV Cache,配 Modelfile、Python/Go 流式客户端与自量化实战。
Ollama
llama.cpp
GGUF
本地推理
大模型量化
KV Cache
sched_ext 源码级深度拆解:把 Linux 调度器变成可热插拔的 BPF 程序——从 DSQ 状态机到手写一个大小核感知调度器(附完整 C 实现)
编程
sched_ext 源码级深度拆解:把 Linux 调度器变成可热插拔的 BPF 程序——从 DSQ 状态机到手写一个大小核感知调度器(附完整 C 实现)
2026-08-02 02:19:25 +0800 CST
view 112
深度拆解 Linux 6.12 主线 sched_ext 可扩展调度器类:为什么 CFS/EEVDF 在异构硬件下失灵、sched_class 层级与 struct_ops 加载机制、DSQ 三件套与回调时序状态机,手写 v1~v4 四个逐步进化的 BPF 调度器(含完整可编译 C 代码与大小核感知实现),附 verifier 十条纪律、scx_lavd/scx_layered/scx_rusty 选型决策树、可观测调试与十条生产踩坑清单。
sched_ext
Linux内核
BPF
CPU调度器
eBPF
EEVDF
scx
性能优化
异构计算
云原生
LangChain 2026 深度解析:从 Chain 到 Agent,LLM 应用开发的事实标准全面进化
编程
LangChain 2026 深度解析:从 Chain 到 Agent,LLM 应用开发的事实标准全面进化
2026-05-14 12:41:08 +0800 CST
view 923
LangChain 2026完成架构级重构:Agent取代Chain成为核心抽象、LangGraph状态机支持分支循环暂停、Deep Agents多智能体协作、MCP标准化工具协议、LangSmith全链路可观测性。完整API对比(2024 vs 2026)、迁移指南与企业知识库Agent实战。
LangChain
LangGraph
Agent
MCP
AI
Go 1.27 深度拆解:当 SIMD 终于走进标准库——两层模型如何用架构无关设计重写 Go 性能优化心智模型
编程
Go 1.27 深度拆解:当 SIMD 终于走进标准库——两层模型如何用架构无关设计重写 Go 性能优化心智模型
2026-07-15 11:15:27 +0800 CST
view 189
从工程师视角深度拆解 Go 1.27 SIMD:两层模型(archsimd + portable simd)、AMD64 AVX2/AVX-512 向量指令、动态位宽抽象、水平求和优化,配完整代码示例与性能调优实战。
Go语言
SIMD
性能优化
archsimd
AVX512
向量计算
Go 1.27
amd64
Go 1.27 原生 SIMD 深度拆解:两层 API 如何终结 Go 十年性能之痛,手写一个自适应 CPU 的向量计算库
编程
Go 1.27 原生 SIMD 深度拆解:两层 API 如何终结 Go 十年性能之痛,手写一个自适应 CPU 的向量计算库
2026-08-02 06:43:17 +0800 CST
view 229
从 Issue #73787/#78902/#78979 拆解 Go 1.26/1.27 原生 SIMD 两层 API 设计,附完整代码与性能优化方法论。
Go
SIMD
archsimd
性能优化
AVX-512
编译器
向量化
Go 1.27
Go 十年 SIMD 之痛终结:archsimd 与可移植 simd 包全拆解,手写自动适配 AVX2/AVX-512 的向量计算库
编程
Go 十年 SIMD 之痛终结:archsimd 与可移植 simd 包全拆解,手写自动适配 AVX2/AVX-512 的向量计算库
2026-08-02 06:44:17 +0800 CST
view 157
从 Issue #73787/#78902/#78979 拆解 Go 1.26/1.27 原生 SIMD 两层 API 设计,附完整代码与性能优化方法论。
Go
SIMD
archsimd
性能优化
AVX-512
编译器
向量化
Go 1.27
XTDB 深度实战:当数据库学会了时间旅行——从双时态模型到 LSM-Tree 存储引擎、从 SQL:2011 到 PostgreSQL 兼容的生产级完全指南(2026)
编程
XTDB 深度实战:当数据库学会了时间旅行——从双时态模型到 LSM-Tree 存储引擎、从 SQL:2011 到 PostgreSQL 兼容的生产级完全指南(2026)
2026-06-20 08:09:09 +0800 CST
view 415
深入解析 XTDB 双时态数据库:从 SQL:2011 双时态模型到 LSM-Tree + Apache Arrow 存储引擎,从 System Time/Valid Time 到时间旅行查询,包含金融审计、保险理赔、AI Agent 可观测性等完整实战案例
XTDB
bitemporal
SQL:2011
时间旅行
PostgreSQL
LSM-Tree
Apache Arrow
数据库
审计合规
Dolt 2.0 深度拆解:当 SQL 数据库遇上 Git——Prolly Tree、Archives 压缩与版本控制的工程哲学
编程
Dolt 2.0 深度拆解:当 SQL 数据库遇上 Git——Prolly Tree、Archives 压缩与版本控制的工程哲学
2026-08-02 07:13:28 +0800 CST
view 98
深度拆解 Dolt 2.0:Prolly Tree 如何实现 O(d) Diff、Archives 压缩如何节省 30-50% 存储、自动 GC 与自适应存储引擎的设计哲学,以及从零构建版本控制博客系统的完整实战。
Dolt
SQL
版本控制
Prolly Tree
数据库
Git
存储引擎
Archives
Arch Linux AUR 供应链攻击深度实战:当400+软件包沦为攻击跳板——从PKGBUILD恶意修改到eBPF Rootkit、从孤儿包领养机制到供应链安全的生产级防御完全指南(2026)
编程
Arch Linux AUR 供应链攻击深度实战:当400+软件包沦为攻击跳板——从PKGBUILD恶意修改到eBPF Rootkit、从孤儿包领养机制到供应链安全的生产级防御完全指南(2026)
2026-06-20 08:26:44 +0800 CST
view 468
2026年6月,Arch Linux AUR遭遇史上最大规模供应链攻击。本文深度解析攻击原理、PKGBUILD恶意修改手法、eBPF Rootkit技术细节,并提供完整的防御体系构建指南。
Arch Linux
AUR
供应链攻击
PKGBUILD
eBPF
Rootkit
开源安全
Linux安全
LangGraph:告别if-else,用图结构编排复杂AI工作流,循环和人工干预天然支持
编程
LangGraph:告别if-else,用图结构编排复杂AI工作流,循环和人工干预天然支持
2026-04-16 19:09:33 +0800 CST
view 901
LangGraph是langchain-ai开源的AI Agent工作流编排框架(25K Stars),用图结构替代LangChain的链式调用,支持循环、条件分支、检查点和人工干预,适合复杂多步骤Agent。
LangGraph
AI
工作流
LangChain
Agent
开源
Python
图结构
LangChain4j:把LangChain的能力带入Java世界,一个库搞定LLM集成、RAG、Agent
编程
LangChain4j:把LangChain的能力带入Java世界,一个库搞定LLM集成、RAG、Agent
2026-04-16 19:11:21 +0800 CST
view 759
LangChain4j是Java世界的LangChain,简化Java应用集成大语言模型,支持OpenAI/Claude/DeepSeek等模型,提供RAG、Agent、Tool Calling、Memory等完整能力,Apache 2.0协议。
Java
LangChain
AI
LLM
RAG
Agent
开源
工具调用
Chrome DevTools MCP 1.3 深度实战:当 Google 把浏览器控制权交给 AI Agent——从 CDP + MCP 双协议架构到 49 个生产级工具、从性能 Trace 到堆内存分析的完全指南(2026)
编程
Chrome DevTools MCP 1.3 深度实战:当 Google 把浏览器控制权交给 AI Agent——从 CDP + MCP 双协议架构到 49 个生产级工具、从性能 Trace 到堆内存分析的完全指南(2026)
2026-06-20 11:26:28 +0800 CST
view 447
Google 官方 Chrome DevTools MCP 1.3 完全指南:49 个 MCP 工具、CDP + MCP 双协议架构、性能 Trace、内存堆快照、Lighthouse 审计与生产级安全实践。
Chrome DevTools
MCP
AI Agent
浏览器自动化
性能优化
前端调试
Chrome DevTools MCP 1.3 完全实战:AI 编程助手如何接管 Chrome 的 49 个工具——从 CDP + MCP 架构到性能优化、内存调试与 CI/CD 落地指南(2026)
编程
Chrome DevTools MCP 1.3 完全实战:AI 编程助手如何接管 Chrome 的 49 个工具——从 CDP + MCP 架构到性能优化、内存调试与 CI/CD 落地指南(2026)
2026-06-20 11:28:34 +0800 CST
view 393
Google 官方 Chrome DevTools MCP 1.3 完全指南:49 个 MCP 工具、CDP + MCP 双协议架构、性能 Trace、内存堆快照、Lighthouse 审计与生产级安全实践。
Chrome DevTools
MCP
AI Agent
浏览器自动化
性能优化
前端调试
Gai:AI 原生的 Go Web 全栈框架
编程
Gai:AI 原生的 Go Web 全栈框架
2026-05-21 16:19:43 +0800 CST
view 578
Gai是AI原生的Go Web全栈框架,融合Go简洁高效与Laravel优雅设计,Schema驱动开发,内置全平台AI Agent Rules,支持MySQL/PostgreSQL/SQLite。
开源项目
Go
Web框架
AI原生
ORM
Schema驱动
Apache Pulsar 深度实战:当消息系统把存储与计算彻底拆开——从分层分片架构、BookKeeper 低延迟存储引擎到 Pulsar Functions 与分级存储的完整工程指南(2026)
编程
Apache Pulsar 深度实战:当消息系统把存储与计算彻底拆开——从分层分片架构、BookKeeper 低延迟存储引擎到 Pulsar Functions 与分级存储的完整工程指南(2026)
2026-07-09 08:16:40 +0800 CST
view 216
从架构原理到生产实战,深度拆解 Apache Pulsar 的分层分片架构、BookKeeper 低延迟存储引擎、Pulsar Functions 与分级存储。
Apache Pulsar
消息队列
BookKeeper
云原生
流处理
消息中间件
大模型推理引擎实战:从 PagedAttention、Continuous Batching 到投机解码与量化部署,把 GPU 利用率榨到极限(vLLM/SGLang 2026 完全指南)
编程
大模型推理引擎实战:从 PagedAttention、Continuous Batching 到投机解码与量化部署,把 GPU 利用率榨到极限(vLLM/SGLang 2026 完全指南)
2026-07-09 09:17:24 +0800 CST
view 486
深入剖析 2026 年大模型推理引擎核心技术:PagedAttention、Continuous Batching、Chunked Prefill、RadixAttention 前缀缓存、投机解码与 AWQ/GPTQ/FP8 量化,结合 vLLM 与 SGLang 部署实战,把 GPU 利用率榨到极限的生产级完全指南。
LLM推理引擎
vLLM
SGLang
推理优化
量化部署
投机解码
GPU利用率
KV Cache
PagedAttention
百度 Unlimited OCR 深度解析:端到端长文档 OCR 的新范式——从 R-SWA 机制到 3B 参数模型、从 KV Cache 压缩到生产级部署的完整技术指南(2026)
编程
百度 Unlimited OCR 深度解析:端到端长文档 OCR 的新范式——从 R-SWA 机制到 3B 参数模型、从 KV Cache 压缩到生产级部署的完整技术指南(2026)
2026-07-04 03:13:57 +0800 CST
view 429
2026年6月百度开源Unlimited OCR,5天GitHub Star破1万。深度解析R-SWA机制、3B参数模型架构、KV Cache压缩原理,含完整部署代码与生产级应用案例。
百度
Unlimited OCR
OCR
R-SWA
KV Cache
长文档识别
端到端OCR
多模态模型
MCP协议深度解析:从协议原理到生产级 MCP Server 实战
编程
MCP协议深度解析:从协议原理到生产级 MCP Server 实战
2026-07-09 09:44:54 +0800 CST
view 250
深度解析 Model Context Protocol(MCP)协议原理、架构设计与生产级实战,从零构建文件系统、GitHub、数据库 MCP Server,覆盖安全、性能、可观测性等生产环境关键议题。
MCP
Model Context Protocol
AI工具
AI Agent
协议解析
Python
TypeScript
Chrome DevTools
编程
TensorRT-LLM 1.0 深度实战:当 PyTorch 架构成为默认体验,NVIDIA 的 LLM 推理引擎正式走向成熟
编程
TensorRT-LLM 1.0 深度实战:当 PyTorch 架构成为默认体验,NVIDIA 的 LLM 推理引擎正式走向成熟
2026-07-22 10:46:37 +0800 CST
view 176
深度解析 TensorRT-LLM 1.0:PyTorch 架构正式稳定、LLM API 稳定化、多模态 VLM 原生支持、Qwen3 MoE 优化、LoRA 生产级管理、trtllm-serve 推理服务化,配完整部署实战代码。
TensorRT-LLM
LLM推理
GPU加速
PyTorch
NVIDIA
深度学习
模型部署
推理优化
Headroom 深度解析:AI Agent 上下文压缩引擎——从 Token 暴降 95% 的原理到生产级部署的完整技术指南(2026)
编程
Headroom 深度解析:AI Agent 上下文压缩引擎——从 Token 暴降 95% 的原理到生产级部署的完整技术指南(2026)
2026-07-04 04:42:34 +0800 CST
view 364
Headroom 深度解析:AI Agent 上下文压缩引擎,节省 60-95% Token 消耗,零侵入透明压缩层,含四种接入模式详解、压缩算法剖析、性能基准测试与生产级部署指南。
Headroom
AI Agent
上下文压缩
Token优化
成本优化
LangChain
Claude Code
Proxy模式
ML路由
Open Code Review 深度拆解:阿里如何用「确定性工程 + LLM Agent」混合架构终结 AI 代码审查的三大顽疾——从 70 条静态规则到 Agent 工具调用的全链路架构哲学
编程
Open Code Review 深度拆解:阿里如何用「确定性工程 + LLM Agent」混合架构终结 AI 代码审查的三大顽疾——从 70 条静态规则到 Agent 工具调用的全链路架构哲学
2026-08-03 04:43:14 +0800 CST
view 136
深度拆解阿里开源Open Code Review混合架构:确定性工程层四机制(精准文件选择、智能分组、规则匹配、位置校准)+ LLM Agent两阶段审查(Plan+Review),附完整执行链路、CI集成配置与实测对比分析
Open Code Review
阿里开源
AI代码审查
LLM Agent
Code Review
确定性工程
AACR-Bench
GitHub开源
开发工具
CI/CD
MemPalace 深度实战:当 AI 学会「记忆宫殿」——从原话存储到跨项目知识图谱的生产级完全指南(2026)
编程
MemPalace 深度实战:当 AI 学会「记忆宫殿」——从原话存储到跨项目知识图谱的生产级完全指南(2026)
2026-06-15 07:48:47 +0800 CST
view 494
MemPalace 深度实战:原话存储、宫殿式架构、四级渐进加载、Hallway/Tunnel 知识图谱、MCP 集成 Claude Code,从安装到生产部署的完全指南
MemPalace
AI记忆
MCP
ChromaDB
知识图谱
Claude Code
LLM 推理的显存战争:从 PagedAttention 到统一内存架构——KV Cache 管理五世代深度解析(2026)
编程
LLM 推理的显存战争:从 PagedAttention 到统一内存架构——KV Cache 管理五世代深度解析(2026)
2026-06-15 11:18:23 +0800 CST
view 527
深度解析大模型推理中 KV Cache 管理的五世代演进:从连续分配到 PagedAttention,再到异构缓存、分布式 KV 和统一混合内存架构。结合 vLLM、SGLang、TensorRT-LLM 给出生产环境选型指南。
LLM
大模型
KVCache
PagedAttention
vLLM
SGLang
TensorRT
推理优化
显存管理
分布式
Agent-Reach 深度实战:当 AI Agent 学会了「看世界」——从零成本互联网能力层到多后端路由架构、从 10+ 平台接入到生产级 AI 编程助手完全指南(2026)
编程
Agent-Reach 深度实战:当 AI Agent 学会了「看世界」——从零成本互联网能力层到多后端路由架构、从 10+ 平台接入到生产级 AI 编程助手完全指南(2026)
2026-06-21 01:54:43 +0800 CST
view 418
Agent-Reach 深度实战:从能力层架构设计到多后端路由机制,从 10+ 平台接入实战到与 Claude Code/OpenClaw 集成,完整解析如何让 AI Agent 免费接入整个互联网。
Agent-Reach
AI Agent
互联网能力
Python
开源工具
MCP
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
19
20
21
22
23
...
82
下一页