程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
DuckDB 深度解析:把分析型数据库塞进进程内——从列式存储、向量化执行引擎到零拷贝与分布式 Smallpond 的完整实战(2026)
编程
DuckDB 深度解析:把分析型数据库塞进进程内——从列式存储、向量化执行引擎到零拷贝与分布式 Smallpond 的完整实战(2026)
2026-07-07 22:54:09 +0800 CST
view 277
进程内 OLAP 数据库 DuckDB 深度解析:从列式存储、向量化执行引擎、Apache Arrow 零拷贝,到 ASOF JOIN/PIVOT/QUALIFY 实战与性能优化,附 Smallpond 分布式展望。
DuckDB
嵌入式数据库
OLAP
列式存储
向量化执行
Apache Arrow
数据分析
DuckDB 深度实战:进程内分析数据库凭什么单机跑 TB 级——向量化执行、列式存储与零拷贝数据湖全解析
编程
DuckDB 深度实战:进程内分析数据库凭什么单机跑 TB 级——向量化执行、列式存储与零拷贝数据湖全解析
2026-07-14 13:15:39 +0800 CST
view 188
DuckDB 进程内 OLAP 数据库深度实战:拆解向量化执行引擎与列式存储原理,配 Python 代码演示直接查 Parquet、Pandas/Arrow 零拷贝、S3 数据湖查询与性能优化,并对比 ClickHouse/PostgreSQL 选型边界。
DuckDB
OLAP
列式存储
向量化执行
数据分析
嵌入式数据库
Parquet
Apache Arrow
Hermes Agent 深度实战:当我们终于造出「越用越聪明」的 AI Agent——从自进化闭环、三层记忆架构到 200+ 模型接入的完整工程指南(2026)
编程
Hermes Agent 深度实战:当我们终于造出「越用越聪明」的 AI Agent——从自进化闭环、三层记忆架构到 200+ 模型接入的完整工程指南(2026)
2026-07-21 06:14:08 +0800 CST
view 163
> 2026年2月,Nous Research 发布 Hermes Agent,两个月 GitHub Star 突破 11 万。有人说它是「爱马仕」,有人说它是 OpenClaw 的最强挑战者。但当你深入它的源码,会发现这些标签都太浅了——它的真正价值在于:把「自我进化」从营销词汇变成了工程现实。 一、背景:为什么现有的 Agent 框架都卡在了同一个地方 过去两年,我们见过太多 Agent...
Hermes Agent
AI Agent
Nous Research
自进化
Self-improving
记忆系统
Skill系统
Python
万字深度解析百度 Unlimited OCR:当长文档解析遇见 R-SWA 革命——从常数级 KV Cache 到 40 页一次性识别的完整技术指南(2026)
编程
万字深度解析百度 Unlimited OCR:当长文档解析遇见 R-SWA 革命——从常数级 KV Cache 到 40 页一次性识别的完整技术指南(2026)
2026-07-02 18:16:20 +0800 CST
view 512
深度解析百度 Unlimited OCR 的 R-SWA 参考滑动窗口注意力机制,将 KV Cache 从线性增长压至常数级;3B MoE 解码器架构、DeepEncoder 视觉编码器;完整本地部署代码、KV Cache 监控脚本与 SGLang 生产推理优化指南。OmniDocBench v1.6 综合得分 93.92%,端到端 OCR 新 SOTA。
OCR
R-SWA
KV Cache
MoE
百度
长文档解析
Transformer
深度学习
Python
性能优化
Hermes Agent 深度拆解:三层记忆架构 × 五阶段学习闭环 × 八种执行后端,一个自进化 AI Agent 的工程化全景
编程
Hermes Agent 深度拆解:三层记忆架构 × 五阶段学习闭环 × 八种执行后端,一个自进化 AI Agent 的工程化全景
2026-08-01 10:15:57 +0800 CST
view 36
深度拆解 Hermes Agent 自进化 AI 框架:三层记忆架构(L1/L2/L3)、五阶段学习闭环、GEPA 自省引擎、八种执行后端、六种消息平台。从认知科学映射到工程实践,附完整部署指南与踩坑清单。
Hermes Agent
AI Agent
记忆系统
自进化
Nous Research
LLM
技能系统
学习闭环
分布式
工程实践
百度 Unlimited OCR 深度解读:R-SWA 如何将 KV Cache 压成常数,5天 GitHub Star 破万的端到端 OCR 新范式
编程
百度 Unlimited OCR 深度解读:R-SWA 如何将 KV Cache 压成常数,5天 GitHub Star 破万的端到端 OCR 新范式
2026-06-27 09:15:20 +0800 CST
view 195
百度开源 Unlimited OCR,5天 GitHub Star 破万。本文深度解析其核心创新 R-SWA(Reference Sliding Window Attention),如何将解码器 KV Cache 从线性增长压成常数,OmniDocBench v1.6 刷榜 SOTA(93.92%),30B 总参/5B 激活,32K 超长上下文,一次前向全稿转录,附完整代码实战。
Unlimited OCR
R-SWA
KV Cache
MoE
端到端 OCR
百度
深度学习
Transformer
文档识别
OCR
Hermes Agent 深度解析:拆解自进化 AI Agent 的完整工程架构,从源码到生产部署
编程
Hermes Agent 深度解析:拆解自进化 AI Agent 的完整工程架构,从源码到生产部署
2026-07-21 11:44:46 +0800 CST
view 215
深度拆解 Nous Research 开源的 Hermes Agent(150K+ Stars):从源码层面解析自进化闭环学习系统、四层记忆体系、技能自创建与 patch 优化机制、200+ 模型统一抽象层、工具安全设计与 Curator 自动维护,并提供从源码编译到 Docker 生产部署的完整实战指南。
Hermes Agent
Nous Research
AI Agent
自进化
闭环学习
SQLite
FTS5
模型路由
MCP
开源
LLM推理引擎深度实战:从PagedAttention到生产级部署,万字长文吃透2026年最关键的AI基础设施
编程
LLM推理引擎深度实战:从PagedAttention到生产级部署,万字长文吃透2026年最关键的AI基础设施
2026-06-27 12:44:29 +0800 CST
view 319
2026年LLM推理引擎深度实战:从PagedAttention、连续批处理、量化技术到生产级K8s部署,万字长文覆盖vLLM、SGLang、TensorRT-LLM、TGI四大框架架构原理与实测对比
LLM推理
vLLM
PagedAttention
SGLang
推理优化
TensorRT-LLM
生产部署
KV Cache
量化
Pyrefly 深度解析:Facebook 用 Rust 重写 Python 类型检查器,一场关于速度与健壮性的工程革命
编程
Pyrefly 深度解析:Facebook 用 Rust 重写 Python 类型检查器,一场关于速度与健壮性的工程革命
2026-07-26 11:44:46 +0800 CST
view 113
深度解析Meta旗下Pyrefly:Facebook用Rust重写Python类型检查器,比mypy快5-18倍,比Pyright快2-4倍。本文从架构设计、绑定系统、Crate组织、性能优化、AI Agent集成五维度全面拆解Pyrefly的工程实现。
Pyrefly
Python
类型检查器
Rust
Meta
LSP
type checker
静态分析
pyright
mypy
内核authencesn模板in-place优化的9年潜伏:CVE-2026-31431漏洞从crypto接口到root的完整攻击链
编程
内核authencesn模板in-place优化的9年潜伏:CVE-2026-31431漏洞从crypto接口到root的完整攻击链
2026-08-01 15:36:23 +0800 CST
view 59
深度剖析 CVE-2026-31431 Copy Fail 漏洞:从 AF_ALG 加密接口、authencesn in-place 优化、splice 零拷贝到 page cache 篡改的完整攻击链路,附内核源码解析、非破坏性检测工具、完整修复方案和 eBPF 监控实战。
Linux内核
CVE
漏洞分析
安全
提权
AF_ALG
page_cache
CryptoAPI
Kubernetes
容器安全
eBPF
Falco
KV Cache 显存优化深度解析:从 PagedAttention 到 2026 年最新压缩技术演进
编程
KV Cache 显存优化深度解析:从 PagedAttention 到 2026 年最新压缩技术演进
2026-08-01 15:47:00 +0800 CST
view 43
从第一性原理深度剖析 KV Cache 显存困境,系统拆解 PagedAttention 核心原理,对比 vLLM/TensorRT-LLM/SGLang 三大推理框架技术路线,涵盖 FP8/INT4 量化、前缀缓存、StreamingLLM 等 2026 年最新压缩技术,含完整代码示例与生产调优指南。
KV Cache
PagedAttention
vLLM
TensorRT-LLM
SGLang
LLM推理
GPU优化
显存优化
量化
深度学习
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
编程
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
2026-07-15 08:45:14 +0800 CST
view 222
从工程师视角深度拆解 Ollama 与本地大模型推理引擎:GGUF 单文件格式、K-quant/IQ-quant 量化家族、内存带宽墙、llama.cpp 计算图与 KV Cache,配 Modelfile、Python/Go 流式客户端与自量化实战。
Ollama
llama.cpp
GGUF
本地推理
大模型量化
KV Cache
Polars 深度拆解:当 DataFrame 学会「延迟计算」——用 Rust + Apache Arrow + 查询优化器重写数据分析的心智模型
编程
Polars 深度拆解:当 DataFrame 学会「延迟计算」——用 Rust + Apache Arrow + 查询优化器重写数据分析的心智模型
2026-07-15 15:46:12 +0800 CST
view 167
从工程师视角深度拆解 Polars:Rust + Apache Arrow 列式内存、表达式系统、查询优化器(投影/谓词下推、公共子表达式消除)、多线程 SIMD 与 Streaming 流式引擎,配完整代码实战与 7 个性能优化技巧。
Polars
Rust
数据分析
DataFrame
查询优化器
高性能计算
Apache Arrow
流式计算
向量化
Python
Hermes Agent 深度实战:当 AI 学会「自我进化」——从学习闭环到生产级持久记忆的完全指南(2026)
编程
Hermes Agent 深度实战:当 AI 学会「自我进化」——从学习闭环到生产级持久记忆的完全指南(2026)
2026-06-09 00:21:26 +0800 CST
view 405
深度解析 Hermes Agent 的自进化闭环架构:记忆系统(SQLite+FTS5)、技能系统(自动创建与改进)、训练数据闭环。含完整部署实战代码(本地/Docker/VPS)、性能优化方案、与 OpenClaw/Superpowers/nanobot 横向对比。12000 字工程师视角长文。
Hermes Agent
自进化AI
AI Agent
Python
Nous Research
记忆系统
技能系统
Hermes Agent 深度解析:6.1万Star的自进化AI智能体,如何用闭环学习颠覆传统Agent架构
编程
Hermes Agent 深度解析:6.1万Star的自进化AI智能体,如何用闭环学习颠覆传统Agent架构
2026-04-17 07:14:13 +0800 CST
view 1005
Hermes Agent深度技术解析:6.1万Star的自进化AI智能体,三层记忆系统、闭环学习机制、技能自动创建与优化,与传统Agent架构的对比分析及生产部署实践
AI Agent
Hermes
自进化
开源
Nous Research
Apache Arrow Flight SQL 深度实战:从零拷贝列式内存到跨语言高速数据传输——架构、协议与生产落地的工程全解(2026)
编程
Apache Arrow Flight SQL 深度实战:从零拷贝列式内存到跨语言高速数据传输——架构、协议与生产落地的工程全解(2026)
2026-07-22 07:19:06 +0800 CST
view 148
深度解析 Apache Arrow Flight SQL:从零拷贝列式内存到跨语言高速数据传输。涵盖 Arrow 内存布局、Flight RPC 协议、Flight SQL 查询接口、Rust/Go/Python 实战代码、生产级部署架构与性能优化,实现 5-10x 性能提升。
Apache Arrow
Flight SQL
零拷贝
列式存储
gRPC
数据传输
大数据
DataFusion
性能优化
DeepSeek V4 架构全拆解:MLA 压缩、MoE 动态路由与 1.6T 参数的工程哲学——从训练到推理的全栈重构
编程
DeepSeek V4 架构全拆解:MLA 压缩、MoE 动态路由与 1.6T 参数的工程哲学——从训练到推理的全栈重构
2026-08-03 00:13:26 +0800 CST
view 17
深度拆解 DeepSeek V4 四大核心架构创新:MLA 16x KV Cache 压缩、MoE-Routing v2 Token级动态路由、HAAA混合注意力、antirez ds4.c推理引擎,附完整代码示例与生产部署指南
DeepSeek
MoE
MLA
KV Cache
大模型
AI推理
开源
性能优化
混合注意力
量化
PHP RFC6455 WebSocket纯协议实现:Ratchet + Workerman优雅解耦方案
编程
PHP RFC6455 WebSocket纯协议实现:Ratchet + Workerman优雅解耦方案
2026-06-20 12:28:56 +0800 CST
view 361
PHP WebSocket纯协议实现方案,基于Ratchet RFC6455 + Workerman。协议层与传输层完全解耦,自动处理握手/分帧/掩码/分片/Ping-Pong。适合需要深度定制WebSocket协议的场景。
PHP
WebSocket
RFC6455
Workerman
Ratchet
实时通信
开源
PSR-7
网络协议
Hermes Agent 深度实战:从「LLM 审判官」到自进化 Skills——不训练模型也能越用越强的 Agent 工程全解(2026)
编程
Hermes Agent 深度实战:从「LLM 审判官」到自进化 Skills——不训练模型也能越用越强的 Agent 工程全解(2026)
2026-07-22 07:45:42 +0800 CST
view 125
深度解析 Hermes Agent 自进化机制:LLM 审判官、三层记忆系统、Skill 自动生成的工程实现。不训练模型也能越用越强的 Agent 架构全解,含源码分析、部署指南与竞品对比。
Hermes Agent
AI Agent
自进化
记忆系统
Skill生成
LLM
开源项目
Nous Research
Apache Pulsar 深度实战:当消息系统把存储与计算彻底拆开——从分层分片架构、BookKeeper 低延迟存储引擎到 Pulsar Functions 与分级存储的完整工程指南(2026)
编程
Apache Pulsar 深度实战:当消息系统把存储与计算彻底拆开——从分层分片架构、BookKeeper 低延迟存储引擎到 Pulsar Functions 与分级存储的完整工程指南(2026)
2026-07-09 08:16:40 +0800 CST
view 170
从架构原理到生产实战,深度拆解 Apache Pulsar 的分层分片架构、BookKeeper 低延迟存储引擎、Pulsar Functions 与分级存储。
Apache Pulsar
消息队列
BookKeeper
云原生
流处理
消息中间件
大模型推理引擎实战:从 PagedAttention、Continuous Batching 到投机解码与量化部署,把 GPU 利用率榨到极限(vLLM/SGLang 2026 完全指南)
编程
大模型推理引擎实战:从 PagedAttention、Continuous Batching 到投机解码与量化部署,把 GPU 利用率榨到极限(vLLM/SGLang 2026 完全指南)
2026-07-09 09:17:24 +0800 CST
view 394
深入剖析 2026 年大模型推理引擎核心技术:PagedAttention、Continuous Batching、Chunked Prefill、RadixAttention 前缀缓存、投机解码与 AWQ/GPTQ/FP8 量化,结合 vLLM 与 SGLang 部署实战,把 GPU 利用率榨到极限的生产级完全指南。
LLM推理引擎
vLLM
SGLang
推理优化
量化部署
投机解码
GPU利用率
KV Cache
PagedAttention
百度 Unlimited OCR 深度解析:端到端长文档 OCR 的新范式——从 R-SWA 机制到 3B 参数模型、从 KV Cache 压缩到生产级部署的完整技术指南(2026)
编程
百度 Unlimited OCR 深度解析:端到端长文档 OCR 的新范式——从 R-SWA 机制到 3B 参数模型、从 KV Cache 压缩到生产级部署的完整技术指南(2026)
2026-07-04 03:13:57 +0800 CST
view 353
2026年6月百度开源Unlimited OCR,5天GitHub Star破1万。深度解析R-SWA机制、3B参数模型架构、KV Cache压缩原理,含完整部署代码与生产级应用案例。
百度
Unlimited OCR
OCR
R-SWA
KV Cache
长文档识别
端到端OCR
多模态模型
vLLM 推理引擎源码级拆解:PagedAttention 显存虚拟化、Continuous Batching 调度与量化落地全指南
编程
vLLM 推理引擎源码级拆解:PagedAttention 显存虚拟化、Continuous Batching 调度与量化落地全指南
2026-07-27 03:44:38 +0800 CST
view 116
从显存字节到 CUDA kernel 源码级拆解 vLLM:PagedAttention 分页显存管理、Continuous Batching 连续批处理调度、Prefix Caching 前缀缓存与量化/投机解码实战,附完整代码与生产调参踩坑清单。
vLLM
PagedAttention
大模型推理
KV Cache
显存优化
连续批处理
量化
LLM Serving
Apache APISIX 深度拆解:从 API 网关到 AI 网关——当 Lua 脚本引擎遇上 20+ LLM 提供商,手写一个生产级 AI 流量治理平台
编程
Apache APISIX 深度拆解:从 API 网关到 AI 网关——当 Lua 脚本引擎遇上 20+ LLM 提供商,手写一个生产级 AI 流量治理平台
2026-08-03 03:43:49 +0800 CST
view 10
深度拆解Apache APISIX从API网关到AI网关的架构演进:10个AI插件构建完整LLM流量治理栈、多LLM负载均衡、Token级限流、Prompt安全三层防线、AI RAG网关层注入、Agent Skills用AI管理AI网关,附完整生产部署配置与性能基准测试
Apache APISIX
AI Gateway
LLM
API Gateway
OpenResty
Lua
etcd
Token限流
Prompt安全
RAG
多LLM路由
负载均衡
内容审核
AI Agent Skills
MCP
云原生
微服务
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
3
4
5
6
7
...
62
下一页