程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
vLLM 推理引擎源码级拆解:PagedAttention 显存虚拟化、Continuous Batching 调度与量化落地全指南
编程
vLLM 推理引擎源码级拆解:PagedAttention 显存虚拟化、Continuous Batching 调度与量化落地全指南
2026-07-27 03:44:38 +0800 CST
view 50
从显存字节到 CUDA kernel 源码级拆解 vLLM:PagedAttention 分页显存管理、Continuous Batching 连续批处理调度、Prefix Caching 前缀缓存与量化/投机解码实战,附完整代码与生产调参踩坑清单。
vLLM
PagedAttention
大模型推理
KV Cache
显存优化
连续批处理
量化
LLM Serving
Elasticsearch 监控和警报
编程
Elasticsearch 监控和警报
2024-11-19 10:02:29 +0800 CST
view 1985
Elasticsearch的监控和警报是确保其稳定运行和高效性能的重要手段。通过实时监控集群状态、性能指标和资源使用情况,运维人员可以及时发现并解决潜在问题。警报系统能够在异常情况下迅速通知运维团队,避免系统中断。使用ElasticStack、Kibana、Prometheus等工具,可以实现全面的监控和警报管理,提升运维效率和系统可用性。
Elasticsearch
运维
监控工具
性能优化
系统管理
TensorRT-LLM 1.0 深度实战:当 PyTorch 架构成为默认体验,NVIDIA 的 LLM 推理引擎正式走向成熟
编程
TensorRT-LLM 1.0 深度实战:当 PyTorch 架构成为默认体验,NVIDIA 的 LLM 推理引擎正式走向成熟
2026-07-22 10:46:37 +0800 CST
view 121
深度解析 TensorRT-LLM 1.0:PyTorch 架构正式稳定、LLM API 稳定化、多模态 VLM 原生支持、Qwen3 MoE 优化、LoRA 生产级管理、trtllm-serve 推理服务化,配完整部署实战代码。
TensorRT-LLM
LLM推理
GPU加速
PyTorch
NVIDIA
深度学习
模型部署
推理优化
Java环境中使用Elasticsearch
编程
Java环境中使用Elasticsearch
2024-11-18 22:46:32 +0800 CST
view 1795
本文详细介绍了如何在Java环境中使用Elasticsearch,包括环境准备、客户端初始化、索引的创建、删除、文档的增删改查等操作。通过具体的代码示例,读者可以快速掌握Elasticsearch的基本用法,并在实际项目中进行集成和定制化开发。
编程
数据库
搜索引擎
Java
Elasticsearch
oh-my-pi (omp) 深度实战:终端原生 AI 编码 Agent——Hash-Anchored 编辑架构与 Rust 实现全解(2026)
编程
oh-my-pi (omp) 深度实战:终端原生 AI 编码 Agent——Hash-Anchored 编辑架构与 Rust 实现全解(2026)
2026-07-22 11:47:48 +0800 CST
view 175
深度解析 oh-my-pi (omp):终端原生 AI 编码 Agent,Hash-Anchored 编辑架构、Rust 实现、LSP 集成、小模型优化,14K+ commits,87% 基准分。
oh-my-pi
AI编程
Hash-Anchored
Rust
终端工具
AI Agent
LSP
开源项目
小模型优化
TUI
纯Go实现WebRTC的开源方案:Pion WebRTC
编程
纯Go实现WebRTC的开源方案:Pion WebRTC
2026-07-04 07:21:09 +0800 CST
view 245
Pion WebRTC是纯Go实现的WebRTC API,无需Cgo,一条命令即可编译到任何平台。支持ICE、DTLS、SRTP、SCTP、DataChannel、弱网优化(WACC/NACK/RTX)、WASM。完整遵循W3C webrtc-pc规范,可用于服务器端音视频通话、直播推流、文件传输、嵌入式设备等场景。
WebRTC
Go
Pion
实时通信
音视频
DataChannel
ICE
DTLS
SRTP
SCTP
WASM
弱网优化
LLM 推理的显存战争:从 PagedAttention 到统一内存架构——KV Cache 管理五世代深度解析(2026)
编程
LLM 推理的显存战争:从 PagedAttention 到统一内存架构——KV Cache 管理五世代深度解析(2026)
2026-06-15 11:18:23 +0800 CST
view 419
深度解析大模型推理中 KV Cache 管理的五世代演进:从连续分配到 PagedAttention,再到异构缓存、分布式 KV 和统一混合内存架构。结合 vLLM、SGLang、TensorRT-LLM 给出生产环境选型指南。
LLM
大模型
KVCache
PagedAttention
vLLM
SGLang
TensorRT
推理优化
显存管理
分布式
Agent-Reach 深度实战:当 AI Agent 学会了「看世界」——从零成本互联网能力层到多后端路由架构、从 10+ 平台接入到生产级 AI 编程助手完全指南(2026)
编程
Agent-Reach 深度实战:当 AI Agent 学会了「看世界」——从零成本互联网能力层到多后端路由架构、从 10+ 平台接入到生产级 AI 编程助手完全指南(2026)
2026-06-21 01:54:43 +0800 CST
view 318
Agent-Reach 深度实战:从能力层架构设计到多后端路由机制,从 10+ 平台接入实战到与 Claude Code/OpenClaw 集成,完整解析如何让 AI Agent 免费接入整个互联网。
Agent-Reach
AI Agent
互联网能力
Python
开源工具
MCP
Helidon 4.4:当 Java 微服务框架开始"长脑子",AI 编排不再是 Python 专利
编程
Helidon 4.4:当 Java 微服务框架开始"长脑子",AI 编排不再是 Python 专利
2026-04-08 15:04:17 +0800 CST
view 755
Oracle Helidon 4.4.0 引入 AI Agent 编排能力,Java 微服务框架进入 AI 原生时代。深度解析 Workflows、Dynamic Agents 两种执行模式,完整代码实战。
Helidon
Java
AI Agent
LangChain4j
微服务
AMD EPYC Venice 深度拆解:全球首款 2nm 服务器 CPU,2030 亿晶体管如何重塑 AI 计算基础设施
编程
AMD EPYC Venice 深度拆解:全球首款 2nm 服务器 CPU,2030 亿晶体管如何重塑 AI 计算基础设施
2026-07-27 11:44:58 +0800 CST
view 119
全球首款2nm服务器CPU AMD EPYC Venice深度解析:2030亿晶体管、256核Zen 6、GAA纳米片工艺、chiplet封装、Helios AI机架,附程序员实战视角的NUMA调优、Kubernetes策略与多语言性能优化指南。
AMD
EPYC Venice
Zen 6
2nm
GAA
chiplet
服务器CPU
AI基础设施
台积电
paniclock深度解析:macOS一键禁用Touch ID的隐私防护利器
编程
paniclock深度解析:macOS一键禁用Touch ID的隐私防护利器
2026-04-27 20:07:25 +0800 CST
view 573
paniclock是一款开源macOS菜单栏工具,一键禁用Touch ID、锁定屏幕,强制密码解锁,保护隐私安全。支持合盖自动锁定、自定义快捷键。
macOS
隐私安全
开源工具
Touch ID
Apache Kafka KRaft 深度实战:从 ZooKeeper 到自管理集群,Raft 共识、Controller Quorum 与生产迁移全指南
编程
Apache Kafka KRaft 深度实战:从 ZooKeeper 到自管理集群,Raft 共识、Controller Quorum 与生产迁移全指南
2026-07-27 13:44:19 +0800 CST
view 50
深度拆解Apache Kafka KRaft模式:从Raft共识算法原理、Controller Quorum架构设计到Docker/Go代码实战,附ZooKeeper到KRaft完整迁移指南与生产调优清单
Apache Kafka
KRaft
Raft
ZooKeeper
消息队列
分布式系统
Go
Kafka调优
流处理
百度 Unlimited OCR 深度解析:R-SWA 如何让长文档 OCR 从"逐页煎熬"走向"一次搞定"
编程
百度 Unlimited OCR 深度解析:R-SWA 如何让长文档 OCR 从"逐页煎熬"走向"一次搞定"
2026-06-28 14:13:06 +0800 CST
view 403
深度解析百度 Unlimited OCR 的 R-SWA 参考滑动窗口注意力机制,如何将 KV Cache 从线性增长压到常数,使长文档 OCR 性能恒定不衰减。含完整架构分析、训练配方、性能基准和实战代码。
Unlimited OCR
R-SWA
OCR
端到端
百度
文档识别
KV Cache
MoE
DeepEncoder
长文档处理
Cognee 深度实战:当 AI Agent 装上持久化记忆——从向量搜索到知识图谱的生产级完全指南(2026)
编程
Cognee 深度实战:当 AI Agent 装上持久化记忆——从向量搜索到知识图谱的生产级完全指南(2026)
2026-06-09 23:18:18 +0800 CST
view 409
深度解析开源项目 Cognee 如何通过向量搜索与知识图谱的融合,为 AI Agent 提供持久化、动态化的记忆能力。从核心概念、架构设计到生产级代码实战。
AI Agent
记忆系统
知识图谱
向量搜索
Cognee
Python
LangChain
DeerFlow 2.0 深度解析:从「深度研究」到「全能AI员工」的架构跃迁
编程
DeerFlow 2.0 深度解析:从「深度研究」到「全能AI员工」的架构跃迁
2026-04-08 19:15:26 +0800 CST
view 2210
深度解析字节跳动开源的 DeerFlow 2.0 SuperAgent 框架,涵盖 LangGraph 动态架构、子智能体协作、Docker 沙箱安全隔离、长期记忆系统、可插拔技能等核心模块,提供实战部署指南与最佳实践。
AI Agent
LangGraph
DeerFlow
字节跳动
LangChain
CC Switch 深度实战:AI 编程工具统一管理面板——从本地路由协议转换到企业级故障转移的完整指南(2026)
编程
CC Switch 深度实战:AI 编程工具统一管理面板——从本地路由协议转换到企业级故障转移的完整指南(2026)
2026-06-28 18:13:18 +0800 CST
view 597
深度解析 CC Switch 开源 AI 编程工具统一管理面板:Tauri 2 + Rust 三层架构、本地路由协议转换引擎、50+ 供应商预设系统、MCP 统一管理到企业级故障转移,8500+ 字完整指南。
CC Switch
AI编程
Tauri
Rust
Claude Code
Codex
MCP
开源
本地代理
n8n 深度实战:从工作流自动化引擎到 AI Agent 编排平台——源码架构、生产部署与性能优化的完整指南(2026)
编程
n8n 深度实战:从工作流自动化引擎到 AI Agent 编排平台——源码架构、生产部署与性能优化的完整指南(2026)
2026-06-28 19:13:10 +0800 CST
view 334
n8n 深度实战:从源码架构、执行引擎、AI Agent 集成、生产级 Docker 部署、性能优化到安全架构,12000 字完整指南(2026)
n8n
工作流自动化
AI Agent
LangChain
RAG
低代码
TypeScript
Node.js
自托管
生产部署
当 C/C++ 遇上 Rust:llama.cpp 与 LiteBox 深度架构对比——2026 年本地 LLM 推理框架的心智模型之战
编程
当 C/C++ 遇上 Rust:llama.cpp 与 LiteBox 深度架构对比——2026 年本地 LLM 推理框架的心智模型之战
2026-07-16 12:50:04 +0800 CST
view 170
深度对比 llama.cpp 与 LiteBox 两大本地 LLM 推理框架:GGUF 格式设计、K-Quant 量化内核、KV cache 管理、多后端抽象、并发架构,配完整代码实战与性能实测数据。
llama.cpp
LiteBox
GGUF
量化
KV cache
本地LLM
推理框架
Rust
C/C++
模型压缩
智谱 GLM-5.1 深度解析:当开源模型突破「8小时自治」临界点
编程
智谱 GLM-5.1 深度解析:当开源模型突破「8小时自治」临界点
2026-04-09 00:53:51 +0800 CST
view 1426
2026年4月8日智谱发布GLM-5.1,744B参数MIT开源,SWE-bench Pro 58.4分超越Claude Opus 4.6,全球首个支持8小时长程自治的开源模型。
GLM-5.1
智谱AI
开源大模型
MoE
SWE-bench
长程自治
LLM
Agent-Reach 深度拆解:一个CLI工具,如何用17行核心代码让AI Agent「看见」整个互联网
编程
Agent-Reach 深度拆解:一个CLI工具,如何用17行核心代码让AI Agent「看见」整个互联网
2026-07-27 20:46:42 +0800 CST
view 61
深度拆解 GitHub 24K Stars 开源项目 Agent-Reach:从架构设计、17平台渠道适配、MCP集成到生产实战,解析如何用工程现实主义解决 AI Agent 的互联网接入难题。
AI Agent
Agent-Reach
MCP
GitHub
CLI
Python
OpenClaw
Claude Code
用 Obsidian + Claude 整了个 AI 记忆外挂:claude-obsidian 深度测评
编程
用 Obsidian + Claude 整了个 AI 记忆外挂:claude-obsidian 深度测评
2026-07-04 16:22:16 +0800 CST
view 356
claude-obsidian是GitHub上8.5K Stars的开源AI知识引擎,将PDF/文本自动整理为wiki知识图谱,hot.md持久化跨会话记忆,autoresearch三轮自主研究+归档,支持PARA/LYT/Zettelkasten四种知识组织方法论,MIT协议数据不锁死。
Obsidian
Claude
AI第二大脑
知识图谱
claude-obsidian
hot缓存
autoresearch
PARA
LYT
Zettelkasten
Markdown
MIT
开源
2026年4月24日:大模型军备竞赛进入新纪元——DeepSeek V4 与 GPT-5.5 深度技术对比解析
编程
2026年4月24日:大模型军备竞赛进入新纪元——DeepSeek V4 与 GPT-5.5 深度技术对比解析
2026-04-28 08:54:41 +0800 CST
view 931
2026年4月24日,DeepSeek V4与GPT-5.5同日发布。本文从MoE架构、注意力机制、性能基准、Engram记忆模块、mHC超连接、Muon优化器等核心技术点进行硬核深度对比,配大量代码示例,为开发者提供实用的技术选型指南。
AI大模型
LLM
GitHub精选
开源项目
TechNews
Agent-Reach 深度解析:给 AI Agent 装上互联网的「万能眼睛」——从脚手架架构到 11 平台全覆盖、从零成本接入到生产级部署的完整技术指南(2026)
编程
Agent-Reach 深度解析:给 AI Agent 装上互联网的「万能眼睛」——从脚手架架构到 11 平台全覆盖、从零成本接入到生产级部署的完整技术指南(2026)
2026-07-04 16:42:45 +0800 CST
view 398
深度解析 Agent-Reach 项目:给 AI Agent 装上互联网能力的脚手架工具,覆盖 11 大平台,零成本接入,包含完整技术指南和生产部署最佳实践。
Agent-Reach
AI Agent
互联网访问
Claude Code
OpenClaw
Cursor
MCP
GitHub
Twitter
YouTube
脚手架
LangGraph vs CrewAI 深度对决:2026年生产级多智能体系统的架构选型与工程实践
编程
LangGraph vs CrewAI 深度对决:2026年生产级多智能体系统的架构选型与工程实践
2026-07-16 15:13:37 +0800 CST
view 208
从架构哲学、状态管理、MCP集成到生产部署,深度对比LangGraph和CrewAI两大多智能体框架,提供选型决策树和混合架构实战指南
LangGraph
CrewAI
多智能体
AI Agent
MCP
A2A
LangChain
生产级系统
架构设计
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
19
20
21
22
23
...
52
下一页