程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Hermes Agent 深度解析:拆解自进化 AI Agent 的完整工程架构,从源码到生产部署
编程
Hermes Agent 深度解析:拆解自进化 AI Agent 的完整工程架构,从源码到生产部署
2026-07-21 11:44:46 +0800 CST
view 242
深度拆解 Nous Research 开源的 Hermes Agent(150K+ Stars):从源码层面解析自进化闭环学习系统、四层记忆体系、技能自创建与 patch 优化机制、200+ 模型统一抽象层、工具安全设计与 Curator 自动维护,并提供从源码编译到 Docker 生产部署的完整实战指南。
Hermes Agent
Nous Research
AI Agent
自进化
闭环学习
SQLite
FTS5
模型路由
MCP
开源
LLM推理引擎深度实战:从PagedAttention到生产级部署,万字长文吃透2026年最关键的AI基础设施
编程
LLM推理引擎深度实战:从PagedAttention到生产级部署,万字长文吃透2026年最关键的AI基础设施
2026-06-27 12:44:29 +0800 CST
view 335
2026年LLM推理引擎深度实战:从PagedAttention、连续批处理、量化技术到生产级K8s部署,万字长文覆盖vLLM、SGLang、TensorRT-LLM、TGI四大框架架构原理与实测对比
LLM推理
vLLM
PagedAttention
SGLang
推理优化
TensorRT-LLM
生产部署
KV Cache
量化
内核authencesn模板in-place优化的9年潜伏:CVE-2026-31431漏洞从crypto接口到root的完整攻击链
编程
内核authencesn模板in-place优化的9年潜伏:CVE-2026-31431漏洞从crypto接口到root的完整攻击链
2026-08-01 15:36:23 +0800 CST
view 94
深度剖析 CVE-2026-31431 Copy Fail 漏洞:从 AF_ALG 加密接口、authencesn in-place 优化、splice 零拷贝到 page cache 篡改的完整攻击链路,附内核源码解析、非破坏性检测工具、完整修复方案和 eBPF 监控实战。
Linux内核
CVE
漏洞分析
安全
提权
AF_ALG
page_cache
CryptoAPI
Kubernetes
容器安全
eBPF
Falco
KV Cache 显存优化深度解析:从 PagedAttention 到 2026 年最新压缩技术演进
编程
KV Cache 显存优化深度解析:从 PagedAttention 到 2026 年最新压缩技术演进
2026-08-01 15:47:00 +0800 CST
view 74
从第一性原理深度剖析 KV Cache 显存困境,系统拆解 PagedAttention 核心原理,对比 vLLM/TensorRT-LLM/SGLang 三大推理框架技术路线,涵盖 FP8/INT4 量化、前缀缓存、StreamingLLM 等 2026 年最新压缩技术,含完整代码示例与生产调优指南。
KV Cache
PagedAttention
vLLM
TensorRT-LLM
SGLang
LLM推理
GPU优化
显存优化
量化
深度学习
TypeScript 7.0 深度拆解:当微软用 Go 语言重写 14 年老编译器,一次编译提速 10 倍背后的工程方法论
编程
TypeScript 7.0 深度拆解:当微软用 Go 语言重写 14 年老编译器,一次编译提速 10 倍背后的工程方法论
2026-07-15 07:43:20 +0800 CST
view 153
深度解析 TypeScript 7.0 用 Go 重写编译器的技术原理:并行类型检查、worker pool 架构、破坏性变更、升级路径与工程意义,附完整代码示例与性能调优实战
TypeScript 7.0
TypeScript Go重写
Go编译器
TypeScript性能优化
前端工具链
monorepo
typecheck
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
编程
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
2026-07-15 08:45:14 +0800 CST
view 254
从工程师视角深度拆解 Ollama 与本地大模型推理引擎:GGUF 单文件格式、K-quant/IQ-quant 量化家族、内存带宽墙、llama.cpp 计算图与 KV Cache,配 Modelfile、Python/Go 流式客户端与自量化实战。
Ollama
llama.cpp
GGUF
本地推理
大模型量化
KV Cache
sched_ext 源码级深度拆解:把 Linux 调度器变成可热插拔的 BPF 程序——从 DSQ 状态机到手写一个大小核感知调度器(附完整 C 实现)
编程
sched_ext 源码级深度拆解:把 Linux 调度器变成可热插拔的 BPF 程序——从 DSQ 状态机到手写一个大小核感知调度器(附完整 C 实现)
2026-08-02 02:19:25 +0800 CST
view 62
深度拆解 Linux 6.12 主线 sched_ext 可扩展调度器类:为什么 CFS/EEVDF 在异构硬件下失灵、sched_class 层级与 struct_ops 加载机制、DSQ 三件套与回调时序状态机,手写 v1~v4 四个逐步进化的 BPF 调度器(含完整可编译 C 代码与大小核感知实现),附 verifier 十条纪律、scx_lavd/scx_layered/scx_rusty 选型决策树、可观测调试与十条生产踩坑清单。
sched_ext
Linux内核
BPF
CPU调度器
eBPF
EEVDF
scx
性能优化
异构计算
云原生
XTDB 深度实战:当数据库学会了时间旅行——从双时态模型到 LSM-Tree 存储引擎、从 SQL:2011 到 PostgreSQL 兼容的生产级完全指南(2026)
编程
XTDB 深度实战:当数据库学会了时间旅行——从双时态模型到 LSM-Tree 存储引擎、从 SQL:2011 到 PostgreSQL 兼容的生产级完全指南(2026)
2026-06-20 08:09:09 +0800 CST
view 350
深入解析 XTDB 双时态数据库:从 SQL:2011 双时态模型到 LSM-Tree + Apache Arrow 存储引擎,从 System Time/Valid Time 到时间旅行查询,包含金融审计、保险理赔、AI Agent 可观测性等完整实战案例
XTDB
bitemporal
SQL:2011
时间旅行
PostgreSQL
LSM-Tree
Apache Arrow
数据库
审计合规
Effect-TS 深度拆解:TypeScript 代数效应系统的工程哲学——从函数式编程到生产级架构的范式跃迁
编程
Effect-TS 深度拆解:TypeScript 代数效应系统的工程哲学——从函数式编程到生产级架构的范式跃迁
2026-08-02 22:45:12 +0800 CST
view 63
深度拆解Effect-TS代数效应框架:从三参数Effect类型、Generator驱动的do-notation、Layer依赖注入到结构化并发,附完整微服务实战代码与性能对比分析
Effect-TS
TypeScript
函数式编程
代数效应
类型系统
依赖注入
结构化并发
Layer
Effect.gen
Schema
Hermes Agent 深度解析:6.1万Star的自进化AI智能体,如何用闭环学习颠覆传统Agent架构
编程
Hermes Agent 深度解析:6.1万Star的自进化AI智能体,如何用闭环学习颠覆传统Agent架构
2026-04-17 07:14:13 +0800 CST
view 1030
Hermes Agent深度技术解析:6.1万Star的自进化AI智能体,三层记忆系统、闭环学习机制、技能自动创建与优化,与传统Agent架构的对比分析及生产部署实践
AI Agent
Hermes
自进化
开源
Nous Research
Apache Arrow Flight SQL 深度实战:从零拷贝列式内存到跨语言高速数据传输——架构、协议与生产落地的工程全解(2026)
编程
Apache Arrow Flight SQL 深度实战:从零拷贝列式内存到跨语言高速数据传输——架构、协议与生产落地的工程全解(2026)
2026-07-22 07:19:06 +0800 CST
view 161
深度解析 Apache Arrow Flight SQL:从零拷贝列式内存到跨语言高速数据传输。涵盖 Arrow 内存布局、Flight RPC 协议、Flight SQL 查询接口、Rust/Go/Python 实战代码、生产级部署架构与性能优化,实现 5-10x 性能提升。
Apache Arrow
Flight SQL
零拷贝
列式存储
gRPC
数据传输
大数据
DataFusion
性能优化
DeepSeek V4 架构全拆解:MLA 压缩、MoE 动态路由与 1.6T 参数的工程哲学——从训练到推理的全栈重构
编程
DeepSeek V4 架构全拆解:MLA 压缩、MoE 动态路由与 1.6T 参数的工程哲学——从训练到推理的全栈重构
2026-08-03 00:13:26 +0800 CST
view 62
深度拆解 DeepSeek V4 四大核心架构创新:MLA 16x KV Cache 压缩、MoE-Routing v2 Token级动态路由、HAAA混合注意力、antirez ds4.c推理引擎,附完整代码示例与生产部署指南
DeepSeek
MoE
MLA
KV Cache
大模型
AI推理
开源
性能优化
混合注意力
量化
PHP RFC6455 WebSocket纯协议实现:Ratchet + Workerman优雅解耦方案
编程
PHP RFC6455 WebSocket纯协议实现:Ratchet + Workerman优雅解耦方案
2026-06-20 12:28:56 +0800 CST
view 384
PHP WebSocket纯协议实现方案,基于Ratchet RFC6455 + Workerman。协议层与传输层完全解耦,自动处理握手/分帧/掩码/分片/Ping-Pong。适合需要深度定制WebSocket协议的场景。
PHP
WebSocket
RFC6455
Workerman
Ratchet
实时通信
开源
PSR-7
网络协议
Hermes Agent 深度实战:从「LLM 审判官」到自进化 Skills——不训练模型也能越用越强的 Agent 工程全解(2026)
编程
Hermes Agent 深度实战:从「LLM 审判官」到自进化 Skills——不训练模型也能越用越强的 Agent 工程全解(2026)
2026-07-22 07:45:42 +0800 CST
view 143
深度解析 Hermes Agent 自进化机制:LLM 审判官、三层记忆系统、Skill 自动生成的工程实现。不训练模型也能越用越强的 Agent 架构全解,含源码分析、部署指南与竞品对比。
Hermes Agent
AI Agent
自进化
记忆系统
Skill生成
LLM
开源项目
Nous Research
Gai:AI 原生的 Go Web 全栈框架
编程
Gai:AI 原生的 Go Web 全栈框架
2026-05-21 16:19:43 +0800 CST
view 533
Gai是AI原生的Go Web全栈框架,融合Go简洁高效与Laravel优雅设计,Schema驱动开发,内置全平台AI Agent Rules,支持MySQL/PostgreSQL/SQLite。
开源项目
Go
Web框架
AI原生
ORM
Schema驱动
大模型推理引擎实战:从 PagedAttention、Continuous Batching 到投机解码与量化部署,把 GPU 利用率榨到极限(vLLM/SGLang 2026 完全指南)
编程
大模型推理引擎实战:从 PagedAttention、Continuous Batching 到投机解码与量化部署,把 GPU 利用率榨到极限(vLLM/SGLang 2026 完全指南)
2026-07-09 09:17:24 +0800 CST
view 414
深入剖析 2026 年大模型推理引擎核心技术:PagedAttention、Continuous Batching、Chunked Prefill、RadixAttention 前缀缓存、投机解码与 AWQ/GPTQ/FP8 量化,结合 vLLM 与 SGLang 部署实战,把 GPU 利用率榨到极限的生产级完全指南。
LLM推理引擎
vLLM
SGLang
推理优化
量化部署
投机解码
GPU利用率
KV Cache
PagedAttention
百度 Unlimited OCR 深度解析:端到端长文档 OCR 的新范式——从 R-SWA 机制到 3B 参数模型、从 KV Cache 压缩到生产级部署的完整技术指南(2026)
编程
百度 Unlimited OCR 深度解析:端到端长文档 OCR 的新范式——从 R-SWA 机制到 3B 参数模型、从 KV Cache 压缩到生产级部署的完整技术指南(2026)
2026-07-04 03:13:57 +0800 CST
view 371
2026年6月百度开源Unlimited OCR,5天GitHub Star破1万。深度解析R-SWA机制、3B参数模型架构、KV Cache压缩原理,含完整部署代码与生产级应用案例。
百度
Unlimited OCR
OCR
R-SWA
KV Cache
长文档识别
端到端OCR
多模态模型
vLLM 推理引擎源码级拆解:PagedAttention 显存虚拟化、Continuous Batching 调度与量化落地全指南
编程
vLLM 推理引擎源码级拆解:PagedAttention 显存虚拟化、Continuous Batching 调度与量化落地全指南
2026-07-27 03:44:38 +0800 CST
view 134
从显存字节到 CUDA kernel 源码级拆解 vLLM:PagedAttention 分页显存管理、Continuous Batching 连续批处理调度、Prefix Caching 前缀缓存与量化/投机解码实战,附完整代码与生产调参踩坑清单。
vLLM
PagedAttention
大模型推理
KV Cache
显存优化
连续批处理
量化
LLM Serving
Hermes Agent 深度实战:NousResearch 开源的自进化 AI 智能体——从闭环学习架构到生产级部署的全链路解析
编程
Hermes Agent 深度实战:NousResearch 开源的自进化 AI 智能体——从闭环学习架构到生产级部署的全链路解析
2026-05-08 07:10:58 +0800 CST
view 658
全面拆解 Hermes Agent 的 GEPA 自进化闭环、四层记忆架构、渐进式技能系统与七种终端后端,从架构原理到生产级部署的全链路实战指南
Hermes Agent
AI Agent
自进化智能体
NousResearch
GEPA
yas,一个开源的C++库:比Protobuf快10倍的序列化方案
代码
yas,一个开源的C++库:比Protobuf快10倍的序列化方案
2026-06-28 07:14:32 +0800 CST
view 309
YAS是C++ header-only序列化库,纯头文件零依赖,性能比Protobuf快10倍,支持二进制/文本/JSON三种格式,适合游戏存档和网络协议等高性能场景。
C++
序列化
性能优化
开源
header-only
二进制
WinRM for Go — 用Go语言远程管理Windows机器
编程
WinRM for Go — 用Go语言远程管理Windows机器
2026-07-04 07:36:57 +0800 CST
view 236
WinRM for Go是纯Go实现的Windows远程管理库,支持Basic/NTLM/Kerberos认证,可通过SSH隧道穿透内网。让Go开发者像SSH连Linux一样远程操作Windows服务器,执行命令、获取输出,适合自动化运维场景。
WinRM
Go
Windows
远程管理
NTLM
Kerberos
SSH隧道
运维
PowerShell
Hermes Agent 深度实战:自进化 AI Agent 的架构设计与生产级部署完全指南(2026)
编程
Hermes Agent 深度实战:自进化 AI Agent 的架构设计与生产级部署完全指南(2026)
2026-05-30 16:41:27 +0800 CST
view 562
深入解析 Nous Research 开源的 Hermes Agent:六层核心架构、GEPA 自进化闭环、三层持久记忆系统、200+ 模型支持,以及从 $5 VPS 到 Modal Serverless 的完整生产级部署实战指南。
AI Agent
Hermes Agent
Nous Research
自进化
GEPA
Skill系统
生产部署
LLM 推理的显存战争:从 PagedAttention 到统一内存架构——KV Cache 管理五世代深度解析(2026)
编程
LLM 推理的显存战争:从 PagedAttention 到统一内存架构——KV Cache 管理五世代深度解析(2026)
2026-06-15 11:18:23 +0800 CST
view 473
深度解析大模型推理中 KV Cache 管理的五世代演进:从连续分配到 PagedAttention,再到异构缓存、分布式 KV 和统一混合内存架构。结合 vLLM、SGLang、TensorRT-LLM 给出生产环境选型指南。
LLM
大模型
KVCache
PagedAttention
vLLM
SGLang
TensorRT
推理优化
显存管理
分布式
Helidon 4.4:当 Java 微服务框架开始"长脑子",AI 编排不再是 Python 专利
编程
Helidon 4.4:当 Java 微服务框架开始"长脑子",AI 编排不再是 Python 专利
2026-04-08 15:04:17 +0800 CST
view 799
Oracle Helidon 4.4.0 引入 AI Agent 编排能力,Java 微服务框架进入 AI 原生时代。深度解析 Workflows、Dynamic Agents 两种执行模式,完整代码实战。
Helidon
Java
AI Agent
LangChain4j
微服务
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
10
11
12
13
14
...
71
下一页