程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
LLM 推理服务引擎深度拆解:从 PagedAttention 到 PD 分离,把 GPU 榨干的七层优化栈
编程
LLM 推理服务引擎深度拆解:从 PagedAttention 到 PD 分离,把 GPU 榨干的七层优化栈
2026-07-30 21:49:19 +0800 CST
view 126
深度拆解 LLM 推理服务的七层优化栈:PagedAttention 分页显存与写时复制、连续批处理消灭队头阻塞、前缀缓存命中率实操、Chunked Prefill 与 PD 分离决策、KV Cache 分层复用的拉取/重算临界点、投机解码加速比数学与失效场景、量化与并行选型。附大量可运行代码、压测骨架、调优顺序与七个常见误区。
LLM推理
vLLM
SGLang
PagedAttention
PD分离
KV Cache
前缀缓存
投机解码
Chunked Prefill
性能优化
阿里 Qoder 1.0 深度解析:从 AI IDE 到智能体自主开发工作台——架构重构、Agent Runtime 与多项目并行的技术内幕
编程
阿里 Qoder 1.0 深度解析:从 AI IDE 到智能体自主开发工作台——架构重构、Agent Runtime 与多项目并行的技术内幕
2026-05-17 22:14:41 +0800 CST
view 713
阿里云Qoder 1.0深度技术解析
Qoder
AI编程
Agent
智能体
阿里云
DeerFlow 2.0 深度解析:字节跳动开源 SuperAgent Harness 的架构哲学与工程实践
编程
DeerFlow 2.0 深度解析:字节跳动开源 SuperAgent Harness 的架构哲学与工程实践
2026-06-04 08:27:55 +0800 CST
view 548
深度解析字节跳动 DeerFlow 2.0 的 Harness Engineering 理念、LangGraph 多智能体编排、沙箱隔离机制、MCP 协议集成及生产部署实践
DeerFlow
AI Agent
多智能体
字节跳动
MCP
LangGraph
万字深度解析 CLI-Universe:当终端智能体遇见「数据炼金术」——6K轨迹如何让32B模型逆袭480B大模型
编程
万字深度解析 CLI-Universe:当终端智能体遇见「数据炼金术」——6K轨迹如何让32B模型逆袭480B大模型
2026-07-01 11:44:19 +0800 CST
view 307
2026年南京大学、阶跃星辰等机构联合发布的CLI-Universe,仅凭6K高质量轨迹让32B模型超越480B大模型。本文深度解析其从能力分类学、证据导向检索到多阶段可执行过滤的完整技术架构。
CLI-Universe
终端智能体
数据合成
AI训练
Agent
阶跃星辰
南京大学
LongCat-2.0 深度解析:美团万亿参数 MoE 大模型如何用国产算力 + LSA 稀疏注意力 + 零计算专家打造 Agentic Coding 王者——从架构原理到生产级实战的完整指南
编程
LongCat-2.0 深度解析:美团万亿参数 MoE 大模型如何用国产算力 + LSA 稀疏注意力 + 零计算专家打造 Agentic Coding 王者——从架构原理到生产级实战的完整指南
2026-07-07 00:13:46 +0800 CST
view 298
深度解析美团开源的LongCat-2.0万亿参数MoE大模型:50K国产卡全流程训练、LSA稀疏注意力实现1M超长上下文、零计算专家动态激活33B-56B、MOPD多专家融合、SWE-bench Pro 59.5超越GPT-5.5。从架构原理到生产级实战的完整指南。
LongCat-2.0
美团
MoE
万亿参数
国产算力
LSA稀疏注意力
Agentic Coding
开源大模型
Rust Tokio 异步运行时深度解剖:Future 状态机、Waker 唤醒、I/O Driver 与生产调优实战
编程
Rust Tokio 异步运行时深度解剖:Future 状态机、Waker 唤醒、I/O Driver 与生产调优实战
2026-07-25 09:16:32 +0800 CST
view 209
深度拆解 Tokio 三层架构:Future 状态机、Waker 唤醒机制、I/O Driver 与任务调度器,从第一性原理理解 Rust 异步的本质,并附完整 mini-Tokio 实现代码与生产调优实战。
Tokio
Rust
async
异步编程
异步runtime
Future
Waker
系统编程
cognee 深度实战:从向量检索到知识图谱——AI Agent 持久记忆的工程化完全指南(2026)
编程
cognee 深度实战:从向量检索到知识图谱——AI Agent 持久记忆的工程化完全指南(2026)
2026-05-24 15:59:41 +0800 CST
view 809
cognee 是 GitHub 12K+ Stars 的开源 AI Agent 记忆控制平面,支持向量检索与知识图谱双引擎融合。深入解析其架构原理、代码实战与工程化落地。
AI Agent
cognee
记忆系统
知识图谱
RAG
Lucebox 深度解析:9.56L 铝合金盒子如何用 RTX 3090 + Ryzen AI MAX+ 395 的 128GB 统一内存 + DFlash 推测解码 + 自研 CUDA 内核让消费级硬件实现 4-6 倍云端推理加速——从硬件架构到开源推理引擎 lucebox-hub 的完整实战指南
编程
Lucebox 深度解析:9.56L 铝合金盒子如何用 RTX 3090 + Ryzen AI MAX+ 395 的 128GB 统一内存 + DFlash 推测解码 + 自研 CUDA 内核让消费级硬件实现 4-6 倍云端推理加速——从硬件架构到开源推理引擎 lucebox-hub 的完整实战指南
2026-07-07 00:44:30 +0800 CST
view 373
深度解析Lucebox本地AI推理盒子:9.56L铝合金机身塞入RTX 3090+Ryzen AI MAX+ 395的128GB统一内存,配合自研DFlash推测解码和CUDA内核优化,在消费级硬件上实现4-6倍推理加速。从硬件架构到开源引擎lucebox-hub的完整实战指南。
Lucebox
本地推理
AI Agent
推测解码
CUDA
RTX 3090
Ryzen AI MAX
开源
Redis 8.x AI 原生深度拆解:从缓存到 AI 实时数据基础设施——向量搜索、语义缓存、Agent Memory 工程实战
编程
Redis 8.x AI 原生深度拆解:从缓存到 AI 实时数据基础设施——向量搜索、语义缓存、Agent Memory 工程实战
2026-07-30 22:43:18 +0800 CST
view 155
深度拆解 Redis 8.x 的 AI 原生能力:Vector Sets 原生向量数据类型、HNSW/SVS-VAMANA 向量索引、LangCache 语义缓存、Agent Memory 智能体记忆层、完整 RAG Pipeline 实战,以及生产部署架构决策与渐进式采纳路线。万字长文,代码实战。
Redis
AI原生
向量搜索
语义缓存
Agent Memory
RAG
Spring AI
Vector Sets
HNSW
LangCache
Koog 深度解析:JetBrains 如何用工程化思维重新定义 JVM AI Agent 框架
编程
Koog 深度解析:JetBrains 如何用工程化思维重新定义 JVM AI Agent 框架
2026-04-13 04:23:36 +0800 CST
view 751
深入解析 JetBrains 推出的 Koog 框架,了解其如何为 JVM 生态带来可预测、容错、企业级就绪的 AI Agent 开发能力
AI
Agent
JVM
Java
Kotlin
Koog
JetBrains
DeerFlow 2.0 深度解析:字节跳动开源超级智能体框架——从LangGraph架构到生产级沙箱隔离的完整技术内幕
编程
DeerFlow 2.0 深度解析:字节跳动开源超级智能体框架——从LangGraph架构到生产级沙箱隔离的完整技术内幕
2026-05-17 23:22:05 +0800 CST
view 738
深度解析字节跳动开源的DeerFlow 2.0超级智能体框架,涵盖LangGraph架构、Docker+gVisor二层沙箱隔离、三层记忆系统、技能插件机制和生产级部署方案。
AI Agent
LangGraph
DeerFlow
字节跳动
沙箱隔离
Claude Context 深度实战:让 AI 读懂你整个代码库——语义代码搜索引擎从原理到生产级部署完全指南(2026)
编程
Claude Context 深度实战:让 AI 读懂你整个代码库——语义代码搜索引擎从原理到生产级部署完全指南(2026)
2026-06-04 09:26:09 +0800 CST
view 676
Claude Context 是 Zilliz 开源的 MCP 插件,通过 AST 智能代码分块和混合检索将整个代码库转化为 AI 编程助手的语义知识库,实测 Token 消耗降低约 40%。
Claude Context
语义搜索
MCP协议
向量数据库
AI编程
JetBrains Koog 框架深度解析:构建企业级 JVM AI Agent 的工程实践
编程
JetBrains Koog 框架深度解析:构建企业级 JVM AI Agent 的工程实践
2026-04-13 04:24:23 +0800 CST
view 697
深入解析 JetBrains 推出的 Koog 框架,了解其如何为 JVM 生态带来可预测、容错、企业级就绪的 AI Agent 开发能力
AI
Agent
JVM
Java
Kotlin
Koog
JetBrains
刚刚开源!Turix让AI操作一切App,微信、淘宝、抖音都能自动化
编程
刚刚开源!Turix让AI操作一切App,微信、淘宝、抖音都能自动化
2026-04-21 13:57:27 +0800 CST
view 989
GitHub热榜开源项目!Turix让AI像人一样操作电脑任何App,微信自动通过好友、淘宝下单、抖音发评论都可自动化。接入OpenClaw、Claude Code等Agent。
Turix
CUA
Computer Use Agent
AI自动化
开源
从零理解 JetBrains Koog:企业级 JVM AI Agent 框架的设计与实现
编程
从零理解 JetBrains Koog:企业级 JVM AI Agent 框架的设计与实现
2026-04-13 04:25:09 +0800 CST
view 744
深入解析 JetBrains 推出的 Koog 框架,了解其如何为 JVM 生态带来可预测、容错、企业级就绪的 AI Agent 开发能力
AI
Agent
JVM
Java
Kotlin
Koog
JetBrains
世界模型深度解析:从预测下一个词到预测世界下一秒——NTP 到 NSP 的范式革命与生产级实战指南
编程
世界模型深度解析:从预测下一个词到预测世界下一秒——NTP 到 NSP 的范式革命与生产级实战指南
2026-07-07 02:12:36 +0800 CST
view 308
深度解析2026年最火爆的AI技术——世界模型:从Next Token Prediction到Next-State Prediction的范式革命。涵盖DreamerV3潜在空间动力学、Google Gemini Omni原生多模态世界模型、EvoPhys-World国产GPU训练突破,含完整PyTorch实战代码。
世界模型
World Model
NTP
NSP
Next-State Prediction
DreamerV3
Gemini Omni
PyTorch
AI
深入浅出 JetBrains Koog:JVM 平台的 AI Agent 开发新范式
编程
深入浅出 JetBrains Koog:JVM 平台的 AI Agent 开发新范式
2026-04-13 04:25:55 +0800 CST
view 712
全面解读 JetBrains Koog 框架:可预测性、容错性与企业级特性的完美结合
AI
Agent
JVM
Java
Kotlin
Koog
Warp 开源深度解析:从 AI 终端到 ADE 智能体开发环境——Rust 重构、多 Agent 编排与下一代开发者工作流的技术内幕
编程
Warp 开源深度解析:从 AI 终端到 ADE 智能体开发环境——Rust 重构、多 Agent 编排与下一代开发者工作流的技术内幕
2026-05-18 00:59:23 +0800 CST
view 714
2026年4月Warp开源,从Rust终端进化为ADE智能体开发环境。本文深度解析其Blocks设计、多Agent编排、知识图谱共享与GPU渲染架构的技术内幕。
Warp
ADE
Rust
AI终端
多Agent
2026 LLM 推理框架深度拆解:当 vLLM 0.5 决定「让 PagedAttention 吞掉最后一块显存碎片」——从 PagedAttention 到 FlashAttention 3.0,四大推理框架如何用「算子融合 + 量化混合 + 动态批处理」重新定义大模型推理的终极形态
编程
2026 LLM 推理框架深度拆解:当 vLLM 0.5 决定「让 PagedAttention 吞掉最后一块显存碎片」——从 PagedAttention 到 FlashAttention 3.0,四大推理框架如何用「算子融合 + 量化混合 + 动态批处理」重新定义大模型推理的终极形态
2026-08-06 06:16:32 +0800 CST
view 104
深度拆解2026年四大主流LLM推理框架:vLLM 0.5 PagedAttention进化、TGI 2.0流式输出优化、TensorRT-LLM 1.8算子融合、DeepSpeed-MII 0.9自动优化,含完整架构分析、代码实战、性能基准测试与成本计算
LLM
vLLM
TensorRT-LLM
推理框架
PagedAttention
量化
GPU
H100
大模型
DeepSpeed
TGI
Agent Skills 深度解析:重塑 AI 协作范式——从开放标准到工程化落地的完整技术内幕
编程
Agent Skills 深度解析:重塑 AI 协作范式——从开放标准到工程化落地的完整技术内幕
2026-05-18 01:45:05 +0800 CST
view 910
2026年5月Agent Skills开放标准发布,将AI能力模块化封装为技能包。本文深入剖析架构设计、工作原理、工程实践与生态前景。
Agent Skills
AI工程
Claude
开放标准
技能编排
GitNexus 深度实战:从零服务器架构到代码知识图谱——2026 年 AI Agent 代码理解完全指南
编程
GitNexus 深度实战:从零服务器架构到代码知识图谱——2026 年 AI Agent 代码理解完全指南
2026-05-24 21:51:49 +0800 CST
view 551
GitNexus 深度实战:零服务器代码知识图谱引擎,让 AI Agent 真正理解你的代码库。包含架构分析、代码实战、性能优化。
GitNexus
代码知识图谱
AI Agent
Graph RAG
代码理解
Mastra 深度解析:16K Stars 的 TypeScript AI Agent 框架如何用 Workflows + RAG + Evals 五件套让前端工程师也能构建生产级智能体应用——从架构原理到完整实战指南
编程
Mastra 深度解析:16K Stars 的 TypeScript AI Agent 框架如何用 Workflows + RAG + Evals 五件套让前端工程师也能构建生产级智能体应用——从架构原理到完整实战指南
2026-07-07 03:12:54 +0800 CST
view 354
深度解析GitHub 16K+ Stars的Mastra TypeScript AI Agent框架:五原语架构(Agents/Tools/Workflows/RAG/Evals)、Vercel AI SDK模型路由、图状态机工作流引擎、向量检索知识库、自动化评估体系。从Next.js集成到生产级客服系统实战,含完整代码示例与LangChain/Vercel AI SDK/CrewAI全面对比。
Mastra
TypeScript
AI Agent
Workflows
RAG
Evals
前端开发
开源框架
Qwen3.8-Max 深度拆解:当阿里决定「用 2.4 万亿参数只激活 4%」——从稀疏 MoE 路由到混合注意力分层,一个 PaperBench 全球第一的旗舰模型如何用「极致稀疏化 + 自主进化」重新定义国产大模型的终极形态
编程
Qwen3.8-Max 深度拆解:当阿里决定「用 2.4 万亿参数只激活 4%」——从稀疏 MoE 路由到混合注意力分层,一个 PaperBench 全球第一的旗舰模型如何用「极致稀疏化 + 自主进化」重新定义国产大模型的终极形态
2026-08-06 06:42:51 +0800 CST
view 157
深度拆解阿里Qwen3.8-Max旗舰大模型:2.4T MoE架构、混合注意力分层、16天自主编程、125小时论文复现,PaperBench全球第一的技术内幕
Qwen3.8-Max
MoE
混合注意力
大模型
阿里千问
AI Agent
PaperBench
自主编程
Block Goose深度解析:从「方块鹅」到全栈工程代理——沙箱安全、Capability模型与MCP集成的工程全解
编程
Block Goose深度解析:从「方块鹅」到全栈工程代理——沙箱安全、Capability模型与MCP集成的工程全解
2026-04-13 05:54:38 +0800 CST
view 697
深入解析Block开源的Goose AI Agent框架,从技术架构、Capability权限模型、Docker沙箱隔离、MCP协议集成等维度全面拆解这款超越代码建议的全栈工程代理工具
AI Agent
Rust
Docker
MCP
Goose
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
67
68
69
70
71
...
117
下一页