程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
LLM推理引擎全栈优化实战:从PagedAttention到投机解码,榨干GPU的每一滴算力
编程
LLM推理引擎全栈优化实战:从PagedAttention到投机解码,榨干GPU的每一滴算力
2026-05-17 10:21:56 +0800 CST
view 703
深度拆解LLM推理引擎核心技术栈:PagedAttention消除内存碎片、连续批处理榨干GPU算力、NUMA感知调度、混合精度量化、投机解码加速、算子融合、分布式推理架构,附代码示例与性能数据
LLM
vLLM
PagedAttention
推理优化
量化
投机解码
ContinuousBatching
GPU
万字深度:PagedAttention、连续批处理与投机解码——LLM推理优化七层实战
编程
万字深度:PagedAttention、连续批处理与投机解码——LLM推理优化七层实战
2026-05-17 10:22:13 +0800 CST
view 746
深度拆解LLM推理引擎核心技术栈:PagedAttention消除内存碎片、连续批处理榨干GPU算力、NUMA感知调度、混合精度量化、投机解码加速、算子融合、分布式推理架构,附代码示例与性能数据
LLM
vLLM
PagedAttention
推理优化
量化
投机解码
ContinuousBatching
GPU
PostgreSQL 18 深度拆解:当关系型数据库拥抱异步 I/O——从 io_uring 子系统、Skip Scan 到 uuidv7 与虚拟生成列的工程全貌(2026)
编程
PostgreSQL 18 深度拆解:当关系型数据库拥抱异步 I/O——从 io_uring 子系统、Skip Scan 到 uuidv7 与虚拟生成列的工程全貌(2026)
2026-07-19 05:13:17 +0800 CST
view 222
PostgreSQL 18 深度拆解:从全新异步 I/O 子系统(io_uring/worker)、read stream 抽象、B-Tree Skip Scan,到 uuidv7 有序主键、虚拟生成列、OAuth 2.0 与统计信息迁移的升级实战全指南。
PostgreSQL
io_uring
异步IO
Skip Scan
uuidv7
数据库
DeerFlow 2.0 深度拆解:当字节跳动决定「给 AI 造一台带沙箱的电脑」——从 LangGraph 图引擎到 Docker 隔离执行,一个 70K Star 的超级智能体框架如何用「Lead Agent + Sub-Agent」架构重新定义复杂任务自动化的终极形态
编程
DeerFlow 2.0 深度拆解:当字节跳动决定「给 AI 造一台带沙箱的电脑」——从 LangGraph 图引擎到 Docker 隔离执行,一个 70K Star 的超级智能体框架如何用「Lead Agent + Sub-Agent」架构重新定义复杂任务自动化的终极形态
2026-08-05 15:50:38 +0800 CST
view 205
深度拆解字节跳动开源的DeerFlow 2.0超级智能体框架:Lead Agent+Sub-Agent架构、Docker沙箱隔离执行、Markdown Skills系统、LangGraph图引擎集成、MCP协议支持,附完整代码实战与生产部署指南
DeerFlow
AI Agent
LangGraph
Docker沙箱
超级智能体
字节跳动
开源
Python
MCP
Agent编排
vLLM vs SGLang 深度拆解:当推理引擎分道扬镳——从 PagedAttention 到 RadixAttention 的架构革命与选型决策指南(2026)
编程
vLLM vs SGLang 深度拆解:当推理引擎分道扬镳——从 PagedAttention 到 RadixAttention 的架构革命与选型决策指南(2026)
2026-08-14 07:12:45 +0800 CST
view 48
深度拆解 vLLM 与 SGLang 两大推理框架:从 PagedAttention 分页内存管理到 RadixAttention 前缀树复用,从 Continuous Batching 到压缩有限状态机,配完整性能对比数据与 15 条生产踩坑清单。
vLLM
SGLang
大模型推理
PagedAttention
RadixAttention
KV Cache
高性能计算
LLM部署
Nginx最强配置清单(反向代理/限流/SSL/负载均衡)
编程
Nginx最强配置清单(反向代理/限流/SSL/负载均衡)
2025-07-26 10:43:48 +0800 CST
view 1248
本文介绍了Nginx的强大配置,包括负载均衡、反向代理、限流、安全防护、性能优化和日志管理等功能。通过示例代码,读者可以学习如何配置Nginx以实现高效的反向代理、SSL加密、请求限流、IP访问控制、静态资源缓存等。还涉及了高级功能如灰度发布和地理位置限制,帮助用户提升网站的安全性和性能。
Nginx
Web服务器
网络安全
性能优化
Linux 7.0 内核深度解析:从 TIP 时间片扩展到 EEVDF 调度器——Linus 亲自操刀的性能革命
编程
Linux 7.0 内核深度解析:从 TIP 时间片扩展到 EEVDF 调度器——Linus 亲自操刀的性能革命
2026-05-02 11:04:50 +0800 CST
view 699
Linux 7.0内核深度技术解析:EEVDF调度器取代CFS、TIP时间片扩展优化游戏性能、XFS自我修复、Atomic Writes存储加速、Sheaves内存管理、开放树命名空间容器启动飞跃、IO_uring零拷贝网络
Linux
内核
EEVDF
调度器
TIP
XFS
Atomic Writes
IO_uring
万字深度解析:Andrej Karpathy 的 Vibe Coding 与 CLAUDE.md——70行配置文件如何重新定义AI辅助编程(2026)
编程
万字深度解析:Andrej Karpathy 的 Vibe Coding 与 CLAUDE.md——70行配置文件如何重新定义AI辅助编程(2026)
2026-07-01 00:43:10 +0800 CST
view 253
Andrej Karpathy的CLAUDE.md(70行6万Star)和Vibe Coding理念深度解析,四大核心原则、完整实战、工具集成与避坑指南,约12000字
VibeCoding
ClaudeMD
AI辅助编程
Karpathy
软件工程
LLM
代码生成
最佳实践
vLLM vs SGLang 深度拆解:从 PagedAttention 到 RadixAttention 的架构革命(2026实战指南)
编程
vLLM vs SGLang 深度拆解:从 PagedAttention 到 RadixAttention 的架构革命(2026实战指南)
2026-08-14 07:13:18 +0800 CST
view 100
深度拆解 vLLM 与 SGLang 两大推理框架:从 PagedAttention 分页内存管理到 RadixAttention 前缀树复用,从 Continuous Batching 到压缩有限状态机,配完整性能对比数据与 15 条生产踩坑清单。
vLLM
SGLang
大模型推理
PagedAttention
RadixAttention
KV Cache
高性能计算
LLM部署
DeerFlow 2.0深度解析:字节跳动开源的超级智能体框架——从LangGraph重构到生产级AI Agent工程化实践
编程
DeerFlow 2.0深度解析:字节跳动开源的超级智能体框架——从LangGraph重构到生产级AI Agent工程化实践
2026-05-17 12:15:20 +0800 CST
view 764
深度解析字节跳动开源的DeerFlow 2.0超级智能体框架,探讨其基于LangGraph的架构设计、技能系统、Docker沙箱安全执行等核心技术,以及生产级AI Agent的工程化实践。
AI Agent
LangGraph
字节跳动
智能体框架
Python
DiffusionGemma 深度实战:当文本扩散重新定义本地AI推理——从'打字机'到'印刷机'的4倍速架构革命
编程
DiffusionGemma 深度实战:当文本扩散重新定义本地AI推理——从'打字机'到'印刷机'的4倍速架构革命
2026-06-12 17:21:39 +0800 CST
view 386
2026年6月Google发布DiffusionGemma,首个生产级文本扩散大模型,本地推理速度提升4倍。本文深入剖析其从自回归到并行生成的架构革命,附完整代码实战。
DiffusionGemma
文本扩散
本地AI
Gemma
大模型推理
扩散模型
Python
Ollama
Scrapling 深度实战:当自适应爬虫颠覆传统技术栈——从智能元素追踪、StealthyFetcher 反反爬到 Spider 并发引擎与 MCP 集成的生产级完全指南(2026)
编程
Scrapling 深度实战:当自适应爬虫颠覆传统技术栈——从智能元素追踪、StealthyFetcher 反反爬到 Spider 并发引擎与 MCP 集成的生产级完全指南(2026)
2026-06-17 16:56:52 +0800 CST
view 663
Scrapling 52K Star 自适应爬虫框架深度实战:智能元素追踪、StealthyFetcher 反反爬、Spider 并发引擎、MCP 集成的生产级完全指南
Scrapling
Python
爬虫
反反爬
Cloudflare
RustFS 深度解析:用 Rust 重写的高性能对象存储——2.3 倍于 MinIO 的小文件吞吐、Apache 2.0 零合规风险,从架构原理到生产部署的完整实战指南
编程
RustFS 深度解析:用 Rust 重写的高性能对象存储——2.3 倍于 MinIO 的小文件吞吐、Apache 2.0 零合规风险,从架构原理到生产部署的完整实战指南
2026-07-06 14:16:29 +0800 CST
view 621
深度解析RustFS开源对象存储:Rust编写,4KB小文件写入2.3倍于MinIO,Apache 2.0协议零合规风险。三层架构设计、纠删码实现、io_uring加速、S3 API完全兼容、Docker/K8s一键部署。含完整代码实战与性能调优指南。
RustFS
Rust
对象存储
MinIO
S3
分布式存储
Apache 2.0
io_uring
编程
nginx通过设置配置获取post的数据请求
2024-11-19 03:54:05 +0800 CST
view 5681
本文介绍了如何配置nginx的日志记录,包括打开nginx.conf文件设置log_format和access_log,重启nginx后可以在日志中查看POST请求参数。详细解释了各个日志格式参数的含义,如访问时间、请求状态码、客户端IP等,帮助用户理解日志内容及其用途。
nginx
服务器
日志管理
nginx通过location设置禁止访问某个目录
编程
nginx通过location设置禁止访问某个目录
2024-11-17 05:03:33 +0800 CST
view 4747
本文介绍了如何通过nginx配置禁止访问uploads目录下的php文件,以防止挂码。提供了相应的配置示例,并简要说明了nginxlocation指令的语法规则,包括精确匹配、常规字符串匹配和正则匹配等。通过这些规则,可以灵活控制对特定路径的访问权限。
nginx
服务器配置
安全
微软 Build 2026 全解:从 MAI-Thinking-1 自研推理模型到 Copilot 超级应用——微软 AI 全家桶的技术革命与开发者影响(2026 完全指南)
编程
微软 Build 2026 全解:从 MAI-Thinking-1 自研推理模型到 Copilot 超级应用——微软 AI 全家桶的技术革命与开发者影响(2026 完全指南)
2026-06-03 11:46:04 +0800 CST
view 1292
微软 Build 2026 大会全解:MAI-Thinking-1 自研推理模型、MAI-Code-1 编码模型、Copilot 超级应用、Scout AI Agent 等重磅发布的技术分析与开发者影响评估
微软
Build 2026
MAI-Thinking-1
Copilot
Scout Agent
GitHub Copilot
AI模型
推理模型
自研AI
VS Code
智谱 slime 深度实战:当 RL 后训练终于有了工业级「炼丹炉」——从 Megatron+SGLang 三模块联调到 GLM-5.2 两天完成 OPD 后训练的生产级完全指南(2026)
编程
智谱 slime 深度实战:当 RL 后训练终于有了工业级「炼丹炉」——从 Megatron+SGLang 三模块联调到 GLM-5.2 两天完成 OPD 后训练的生产级完全指南(2026)
2026-06-23 07:54:24 +0800 CST
view 539
2026年6月智谱开源RL后训练框架slime,支撑GLM-5.2仅用2天完成OPD后训练。本文深度解析其三模块架构、原生引擎透传设计、PD分离、增量权重同步等核心技术,附完整生产级部署实战代码。
强化学习
RL训练
slime框架
智谱AI
GLM-5.2
Megatron
SGLang
后训练
开源框架
生产级部署
Zerolang 深度拆解:当「源码」不再是文本——Vercel 把编译器数据库直接交给 AI Agent
编程
Zerolang 深度拆解:当「源码」不再是文本——Vercel 把编译器数据库直接交给 AI Agent
2026-07-30 10:44:29 +0800 CST
view 168
深度拆解 Vercel 实验室 Zerolang:语义图升格为程序数据库、文本源码降级为投影,zero query/patch 的数据库式编辑接口、graph hash 乐观并发控制,附完整工作流实战、四条路线横向对比与 token 经济学分析。
Zerolang
Vercel
AI Agent
编程语言
程序数据库
图优先
能力安全
结构化编辑
开源
Remix 3.0 深度拆解:当全栈框架决定「抛弃 React」——从函数式虚拟 DOM 到命令式 Web 原生,一个 14 年来最激进的框架重写如何用 Fetch API 和 Preact 重新定义前端的终极形态
编程
Remix 3.0 深度拆解:当全栈框架决定「抛弃 React」——从函数式虚拟 DOM 到命令式 Web 原生,一个 14 年来最激进的框架重写如何用 Fetch API 和 Preact 重新定义前端的终极形态
2026-08-05 18:17:20 +0800 CST
view 174
深度拆解Remix 3.0 beta:抛弃React拥抱Web标准原生能力,Fetch API路由+命令式模型+Frames服务器驱动UI+Unbundling取消打包,重新定义前端框架终极形态
Remix
Remix 3
Web标准
Preact
Fetch API
全栈框架
前端框架
命令式编程
服务器驱动UI
Frames
Unbundling
DeerFlow 2.0 深度实战:从"半途而废"到"真正干活"——字节跳动开源超级 Agent Harness 完全指南(2026)
编程
DeerFlow 2.0 深度实战:从"半途而废"到"真正干活"——字节跳动开源超级 Agent Harness 完全指南(2026)
2026-05-24 06:02:50 +0800 CST
view 883
DeerFlow 2.0 是字节跳动开源的超级 Agent 框架,提供沙箱执行、持久化记忆、多 Agent 编排等生产级能力。本文深入剖析其架构设计、三层沙箱机制、记忆系统和实战案例。
AI Agent
DeerFlow
字节跳动
LangGraph
多Agent编排
万字深度解析 Ghostty:当 Zig 遇上 GPU 加速——下一代终端模拟器的架构革命(2026)
编程
万字深度解析 Ghostty:当 Zig 遇上 GPU 加速——下一代终端模拟器的架构革命(2026)
2026-07-01 03:13:50 +0800 CST
view 378
2026年Ghostty终端模拟器万字深度解析:Zig语言实现、GPU加速渲染、平台原生UI、libghostty跨平台库架构,从技术原理到代码实战全覆盖
Ghostty
Zig
终端模拟器
GPU加速
系统编程
跨平台
Metal
OpenGL
GTK4
libghostty
Everything Claude Code(ECC)深度解析:20万Star的AI编程操作系统如何用61个Agent+246个Skills把Claude Code变成虚拟开发团队——从黑客松冠军到工程化标配的完整实战指南
编程
Everything Claude Code(ECC)深度解析:20万Star的AI编程操作系统如何用61个Agent+246个Skills把Claude Code变成虚拟开发团队——从黑客松冠军到工程化标配的完整实战指南
2026-07-06 16:16:15 +0800 CST
view 438
深度解析GitHub近20万Star的Everything Claude Code(ECC)AI编程操作系统:61个专业Agent集群、246个按需加载Skills、Hooks全流程自动化、AgentShield安全防御、MCP工具链调度。从Anthropic黑客松冠军到工程化标配,含完整安装部署、实战工作流、性能优化与竞品对比指南。
ECC
Everything Claude Code
Claude Code
AI编程
Agent
Skills
Hooks
AgentShield
开源
GitHub
TradingAgents 深度实战:从 78.7k Star 的多智能体交易框架到量化投研工程化完全指南
编程
TradingAgents 深度实战:从 78.7k Star 的多智能体交易框架到量化投研工程化完全指南
2026-05-24 06:38:48 +0800 CST
view 1278
深度拆解 TradingAgents 多智能体交易框架的架构设计,从 LangGraph 状态图编排到结构化辩论机制,完整代码实战指南
AI Agent
量化交易
LangGraph
多智能体
LLM
Muse Glimmer 30B 深度拆解:Meta「真开源」旗舰Agent模型如何用一块显卡颠覆本地AI工作流
编程
Muse Glimmer 30B 深度拆解:Meta「真开源」旗舰Agent模型如何用一块显卡颠覆本地AI工作流
2026-08-14 09:44:53 +0800 CST
view 69
深度拆解Meta开源的Muse Glimmer 30B端侧Agent模型:从稠密Transformer架构、1.8B ViT-G/14视觉编码器,到4-bit GGUF量化、DFlash推测性解码,再到Ollama一键部署、配完整代码实战与15条生产踩坑清单
Muse Glimmer
Meta
Agent模型
本地AI
开源LLM
量化部署
Function Calling
多模态
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
37
38
39
40
41
...
53
下一页