程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
SGLang 深度解析:RadixAttention 前缀缓存与结构化 LLM 推理革命——从 RAG/Agent 场景到生产级部署的完整指南
编程
SGLang 深度解析:RadixAttention 前缀缓存与结构化 LLM 推理革命——从 RAG/Agent 场景到生产级部署的完整指南
2026-06-30 11:17:15 +0800 CST
view 392
深度解析 SGLang 大模型推理框架:RadixAttention 前缀缓存、零开销 CPU 调度器、结构化输出约束、推测解码、PD 分离等核心技术,对比 vLLM/TensorRT-LLM 选型,提供完整代码示例与生产级部署实践
SGLang
大模型推理
RadixAttention
前缀缓存
结构化输出
推测解码
PD分离
vLLM
TensorRT-LLM
NGINX Rift 深度实战:CVE-2026-42945 漏洞原理、利用链与生产级防护完全指南
编程
NGINX Rift 深度实战:CVE-2026-42945 漏洞原理、利用链与生产级防护完全指南
2026-05-23 16:45:06 +0800 CST
view 794
深度解析潜伏18年的NGINX高危漏洞CVE-2026-42945,从源码层面拆解堆溢出原理、RCE利用链及生产级防护策略
NGINX
安全漏洞
RCE
CVE-2026-42945
堆溢出
网络安全
HTMX 深度实战:当"超媒体驱动"重塑 Web 开发范式——从 REST 哲学到不用一行 JavaScript 的现代化全栈指南(2026)
编程
HTMX 深度实战:当"超媒体驱动"重塑 Web 开发范式——从 REST 哲学到不用一行 JavaScript 的现代化全栈指南(2026)
2026-06-11 12:24:17 +0800 CST
view 839
2026年最新!深入讲解 HTMX 超媒体驱动理念,配合 Rust + Axum + HTMX + SSE 完整实战,探讨不用一行 JavaScript 的现代化全栈开发
HTMX
超媒体
HATEOAS
REST
全栈开发
FastAPI
Django
Rust
Axum
DiffusionGemma 深度实战:当离散文本扩散颠覆自回归霸权——从并行去噪原理到 MoE 架构、本地推理优化与混合范式展望的生产级完全指南(2026)
编程
DiffusionGemma 深度实战:当离散文本扩散颠覆自回归霸权——从并行去噪原理到 MoE 架构、本地推理优化与混合范式展望的生产级完全指南(2026)
2026-06-17 07:55:50 +0800 CST
view 382
Google开源DiffusionGemma:基于离散文本扩散的26B MoE模型,并行去噪实现4倍推理加速,双向注意力天然支持代码补全与行内编辑
DiffusionGemma
LLM
扩散模型
推理加速
MoE
Headroom 深度实战:让 LLM Token 消耗暴减 95% 的压缩引擎——从语义熵编码到 RAG 块优化的完全指南(2026)
编程
Headroom 深度实战:让 LLM Token 消耗暴减 95% 的压缩引擎——从语义熵编码到 RAG 块优化的完全指南(2026)
2026-06-02 21:19:20 +0800 CST
view 1531
Headroom 是专为 LLM 设计的通用压缩层,以 Library、Proxy、MCP Server 三种形态存在,在信息不丢失的前提下把 Token 消耗砍掉 60-95%。本文从信息论底层原理讲起,完整拆解四层压缩管线,结合真实代码实战演示接入方式。
LLM
Token优化
GitHub Trending
Python
RAG
HTMX 超媒体实战:不用写 JavaScript 也能做现代化全栈(Rust Axum + FastAPI + Django 三大框架全覆盖)
编程
HTMX 超媒体实战:不用写 JavaScript 也能做现代化全栈(Rust Axum + FastAPI + Django 三大框架全覆盖)
2026-06-11 12:24:49 +0800 CST
view 483
深入讲解 HTMX 超媒体驱动理念,配合 Rust + Axum + HTMX + SSE 完整实战
HTMX
超媒体
HATEOAS
REST
全栈开发
FastAPI
Django
Rust
Axum
吴恩达 OpenWorker 深度拆解:开源版AI同事如何用 aisuite 引擎 + 审批门控重新定义桌面自动化
编程
吴恩达 OpenWorker 深度拆解:开源版AI同事如何用 aisuite 引擎 + 审批门控重新定义桌面自动化
2026-07-29 15:14:32 +0800 CST
view 147
深度拆解吴恩达团队开源的 OpenWorker 项目:开源版 AI 同事如何用 aisuite 多模型引擎 + 审批门控机制重新定义桌面自动化,附架构解析、代码实战与生产部署指南。
OpenWorker
吴恩达
AI助手
aisuite
开源
桌面自动化
MCP
Function Calling
审批门控
Python
TradingAgents 深度实战:71.4K Star 的 AI 多智能体交易系统——从多 Agent 投研体系到生产级量化策略的完全指南(2026)
编程
TradingAgents 深度实战:71.4K Star 的 AI 多智能体交易系统——从多 Agent 投研体系到生产级量化策略的完全指南(2026)
2026-06-02 22:14:57 +0800 CST
view 581
TradingAgents 用7个专业LLM Agent完整复刻华尔街投研流程,GitHub 71.4K Star,本文从架构设计、Agent协作机制、LLM调度策略到生产级部署全面深度拆解。
AI交易
多智能体
量化交易
LLM
LangGraph
吴恩达开源 OpenWorker 深度拆解:桌面 AI 助手的开源之路,从 aisuite 引擎到审批门控的工程实践
编程
吴恩达开源 OpenWorker 深度拆解:桌面 AI 助手的开源之路,从 aisuite 引擎到审批门控的工程实践
2026-07-29 15:15:04 +0800 CST
view 149
深度拆解吴恩达团队开源的 OpenWorker 项目:开源版 AI 同事如何用 aisuite 多模型引擎 + 审批门控机制重新定义桌面自动化,附架构解析、代码实战与生产部署指南。
OpenWorker
吴恩达
AI助手
aisuite
开源
桌面自动化
MCP
Function Calling
审批门控
Python
Ruff 深度拆解:当 Python 决定「用 Rust 重建整个工具链」——从 Flake8 到 Black 到 mypy,一个 Astral 生态如何用 100 倍速度重新定义代码质量的终极形态
编程
Ruff 深度拆解:当 Python 决定「用 Rust 重建整个工具链」——从 Flake8 到 Black 到 mypy,一个 Astral 生态如何用 100 倍速度重新定义代码质量的终极形态
2026-08-05 07:15:24 +0800 CST
view 83
深度拆解Astral公司用Rust重建Python整个开发工具链:uv包管理器、Ruff代码检查器和格式化器、ty类型检查器,性能提升10-100倍,配置统一到pyproject.toml,附完整迁移指南与性能基准对比
Ruff
Python
Astral
Rust
代码质量
linting
格式化
uv
类型检查
mypy
Flake8
Black
Go应用中使用MongoDB客户端库mongo-driver
编程
Go应用中使用MongoDB客户端库mongo-driver
2024-11-18 21:53:37 +0800 CST
view 2040
本文介绍了如何在Go应用中使用MongoDB客户端库mongo-driver,包括安装、连接、基本的CRUD操作、索引管理、聚合操作和事务支持。通过代码示例,展示了如何高效地与MongoDB进行交互,适用于各种应用场景。
编程
数据库
Go语言
MongoDB
开发
TradingAgents 深度实战:7个LLM Agent复刻华尔街投研——从LangGraph多智能体架构到AI量化交易生产部署(2026完全指南)
编程
TradingAgents 深度实战:7个LLM Agent复刻华尔街投研——从LangGraph多智能体架构到AI量化交易生产部署(2026完全指南)
2026-06-02 22:15:17 +0800 CST
view 842
TradingAgents 用7个专业LLM Agent完整复刻华尔街投研流程,GitHub 71.4K Star,本文从架构设计、Agent协作机制、LLM调度策略到生产级部署全面深度拆解。
AI交易
多智能体
量化交易
LLM
LangGraph
Apache Flink 3.0 深度解析:从实时计算引擎到 Agent Native 基础设施——Agentic Streaming、Flink Agents 与多模态数据湖的完整实战指南
编程
Apache Flink 3.0 深度解析:从实时计算引擎到 Agent Native 基础设施——Agentic Streaming、Flink Agents 与多模态数据湖的完整实战指南
2026-07-06 06:42:31 +0800 CST
view 554
深度解析Apache Flink 3.0 Agent Native架构:从Cloud Native到Agent Native的范式转换、Agentic Streaming流水线架构、Flink Agents事件驱动智能体框架、Apache Paimon 2.0多模态数据湖、Apache Fluss 1.0实时上下文层与MCP Gateway、CPU+GPU混合调度、淘宝闪购与小红书生产实战。含Java/Python完整代码示例。
Apache Flink
Flink Agents
Agent Native
Agentic Streaming
实时计算
AI Agent
多模态数据湖
Apache Paimon
Apache Fluss
AI Agent 可观测性深度实战:当黑箱遇见全链路追踪——从 OTel GenAI 语义规范到 LoongSuite Pilot 端侧采集、Python 零代码插桩与安全审计的生产级完全指南
编程
AI Agent 可观测性深度实战:当黑箱遇见全链路追踪——从 OTel GenAI 语义规范到 LoongSuite Pilot 端侧采集、Python 零代码插桩与安全审计的生产级完全指南
2026-06-17 11:56:08 +0800 CST
view 540
深入剖析 AI Agent 可观测性核心难题,基于阿里云 LoongSuite 开源方案,从 OTel GenAI 语义规范扩展到端侧采集、零代码插桩与安全审计的完整生产级实战指南
AI Agent
可观测性
OpenTelemetry
LoongSuite
安全审计
Transformers.js v4 深度解析:WebGPU 原生化让 AI 推理在 Node/Bun/Deno 中真正起飞
编程
Transformers.js v4 深度解析:WebGPU 原生化让 AI 推理在 Node/Bun/Deno 中真正起飞
2026-04-12 04:55:32 +0800 CST
view 1057
深度解析 Transformers.js v4 的 WebGPU 原生化架构:如何用 C++ 重写 WebGPU Runtime、与 ONNX Runtime 深度集成、在 Node/Bun/Deno 中实现原生 GPU AI 推理。包含代码实战、性能对比与生产部署指南。
JavaScript
AI
WebGPU
Transformers
HuggingFace
Node.js
Bun
Deno
ONNX
LangGraph 2026 生产级深度实战:从有状态图编排到企业级多租户 Agent 平台——AI Agent 工程化完全指南
编程
LangGraph 2026 生产级深度实战:从有状态图编排到企业级多租户 Agent 平台——AI Agent 工程化完全指南
2026-05-23 23:32:58 +0800 CST
view 741
2026 年 AI Agent 工程化完全指南,深度剖析 LangGraph 有状态图架构、持久化机制、人工介入、性能优化及企业级多租户部署,附完整研究助手项目实战代码。
LangGraph
AI Agent
Python
生产级
多租户
DeerFlow 2.0 深度解析:字节跳动如何让 AI 从"聊天"进化到"真正干活"
编程
DeerFlow 2.0 深度解析:字节跳动如何让 AI 从"聊天"进化到"真正干活"
2026-05-11 13:22:57 +0800 CST
view 695
字节跳动开源超级智能体框架 DeerFlow 2.0,50K+ Stars,Docker沙箱执行环境、多智能体协作、长期记忆系统、Markdown技能系统。解决传统AI"记性差、不敢乱动、只能动嘴"三大痛点,实现从分钟级到小时级复杂任务自动化。
DeerFlow,字节跳动,SuperAgent,Docker沙箱,多智能体协作,长期记忆,技能系统,AI生产力,LinuxFoundation,LangGraph
Rust 2026:首进 TIOBE 前十、1.96 Range 重构、Tokio 统治异步生态——系统编程王者的全面解析
编程
Rust 2026:首进 TIOBE 前十、1.96 Range 重构、Tokio 统治异步生态——系统编程王者的全面解析
2026-07-24 14:47:22 +0800 CST
view 219
Rust语言2026年首进TIOBE前十。深度解析Rust 1.96 Range类型重构、Tokio异步运行时架构、生产级并发编程实践,以及Rust在WebAssembly、云原生、AI基础设施的最新应用版图
Rust
Rust 1.96
Range
async
Tokio
异步编程
系统编程
MiMo Code 深度实战:当小米杀入 AI 编程赛道——从 SQLite FTS5 持久记忆到子智能体编排、Max Mode 并行推理与 Compose 自进化工作流的生产级完全指南(2026)
编程
MiMo Code 深度实战:当小米杀入 AI 编程赛道——从 SQLite FTS5 持久记忆到子智能体编排、Max Mode 并行推理与 Compose 自进化工作流的生产级完全指南(2026)
2026-06-17 13:23:19 +0800 CST
view 725
深度拆解小米 MiMo Code V0.1.0 的架构设计、持久记忆系统、子智能体编排、Goal 裁判模型、Max Mode 并行推理与 Compose 工作流
AI编程
MiMo Code
小米
Coding Agent
开源项目
LLM推理引擎全栈优化实战:从PagedAttention到投机解码,榨干GPU的每一滴算力
编程
LLM推理引擎全栈优化实战:从PagedAttention到投机解码,榨干GPU的每一滴算力
2026-05-17 10:21:56 +0800 CST
view 677
深度拆解LLM推理引擎核心技术栈:PagedAttention消除内存碎片、连续批处理榨干GPU算力、NUMA感知调度、混合精度量化、投机解码加速、算子融合、分布式推理架构,附代码示例与性能数据
LLM
vLLM
PagedAttention
推理优化
量化
投机解码
ContinuousBatching
GPU
万字深度:PagedAttention、连续批处理与投机解码——LLM推理优化七层实战
编程
万字深度:PagedAttention、连续批处理与投机解码——LLM推理优化七层实战
2026-05-17 10:22:13 +0800 CST
view 707
深度拆解LLM推理引擎核心技术栈:PagedAttention消除内存碎片、连续批处理榨干GPU算力、NUMA感知调度、混合精度量化、投机解码加速、算子融合、分布式推理架构,附代码示例与性能数据
LLM
vLLM
PagedAttention
推理优化
量化
投机解码
ContinuousBatching
GPU
DeerFlow 2.0 深度拆解:当字节跳动决定「给 AI 造一台带沙箱的电脑」——从 LangGraph 图引擎到 Docker 隔离执行,一个 70K Star 的超级智能体框架如何用「Lead Agent + Sub-Agent」架构重新定义复杂任务自动化的终极形态
编程
DeerFlow 2.0 深度拆解:当字节跳动决定「给 AI 造一台带沙箱的电脑」——从 LangGraph 图引擎到 Docker 隔离执行,一个 70K Star 的超级智能体框架如何用「Lead Agent + Sub-Agent」架构重新定义复杂任务自动化的终极形态
2026-08-05 15:50:38 +0800 CST
view 117
深度拆解字节跳动开源的DeerFlow 2.0超级智能体框架:Lead Agent+Sub-Agent架构、Docker沙箱隔离执行、Markdown Skills系统、LangGraph图引擎集成、MCP协议支持,附完整代码实战与生产部署指南
DeerFlow
AI Agent
LangGraph
Docker沙箱
超级智能体
字节跳动
开源
Python
MCP
Agent编排
Nginx最强配置清单(反向代理/限流/SSL/负载均衡)
编程
Nginx最强配置清单(反向代理/限流/SSL/负载均衡)
2025-07-26 10:43:48 +0800 CST
view 1230
本文介绍了Nginx的强大配置,包括负载均衡、反向代理、限流、安全防护、性能优化和日志管理等功能。通过示例代码,读者可以学习如何配置Nginx以实现高效的反向代理、SSL加密、请求限流、IP访问控制、静态资源缓存等。还涉及了高级功能如灰度发布和地理位置限制,帮助用户提升网站的安全性和性能。
Nginx
Web服务器
网络安全
性能优化
DeerFlow 2.0深度解析:字节跳动开源的超级智能体框架——从LangGraph重构到生产级AI Agent工程化实践
编程
DeerFlow 2.0深度解析:字节跳动开源的超级智能体框架——从LangGraph重构到生产级AI Agent工程化实践
2026-05-17 12:15:20 +0800 CST
view 734
深度解析字节跳动开源的DeerFlow 2.0超级智能体框架,探讨其基于LangGraph的架构设计、技能系统、Docker沙箱安全执行等核心技术,以及生产级AI Agent的工程化实践。
AI Agent
LangGraph
字节跳动
智能体框架
Python
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
60
61
62
63
64
...
87
下一页