程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
三省六部制 AI 多智能体编排系统:用古代官制设计现代 Agent 协作架构
编程
三省六部制 AI 多智能体编排系统:用古代官制设计现代 Agent 协作架构
2026-05-24 22:54:10 +0800 CST
view 535
当西方还在追逐 CrewAI、AutoGen 时,一个基于唐朝官制的 Multi-Agent 系统悄然登顶 GitHub Trending——12个AI Agent 模拟古代朝廷运作,分权制衡、专职审核、完全可观测。
AI Agent
Multi-Agent系统
OpenClaw
Agent编排
AI协作
古代官制
分布式AI
代码审核
沙箱安全
实时看板
从 MCP 到 A2A 再到 AG-UI:AI Agent 协议栈三层架构全解析
编程
从 MCP 到 A2A 再到 AG-UI:AI Agent 协议栈三层架构全解析
2026-07-25 12:15:58 +0800 CST
view 169
深度拆解 AI Agent 三层协议栈:MCP 工具层、A2A 协作层、AG-UI 交互层,从第一性原理剖析架构设计,附完整代码实现与工程实践。
AI Agent
MCP
A2A
AG-UI
协议栈
Multi-Agent
Agent框架
OpenMontage 深度实战:把 AI 编程助手变成一间视频工作室——一次把「Agentic 视频生产」架构讲透
编程
OpenMontage 深度实战:把 AI 编程助手变成一间视频工作室——一次把「Agentic 视频生产」架构讲透
2026-07-14 02:12:18 +0800 CST
view 271
深度拆解 OpenMontage 开源 Agentic 视频生产系统:从三层知识架构、backlot 真实素材库、Remotion 程序化合成到自审批准门禁,配完整可运行代码与成本优化实战。
OpenMontage
Agentic Video Production
AI 编程助手
Remotion
视频自动化
GitHub Trending
多 Agent 工作流
Shepherd 深度解析:Stanford 把 Git 搬进 AI Agent 运行时——让 Agent 从「能跑」到「可回退、可监督、可训练」的完整实战指南
编程
Shepherd 深度解析:Stanford 把 Git 搬进 AI Agent 运行时——让 Agent 从「能跑」到「可回退、可监督、可训练」的完整实战指南
2026-07-07 13:19:13 +0800 CST
view 130
Stanford Christopher Manning团队发布Shepherd,把Git式版本控制引入AI Agent运行时:可逆执行轨迹让Agent执行可回退、可分叉、可重放;Syscall Jail把权限约束压到OS内核层物理不可绕过;Tree-GRPO让RL训练翻倍加速。完整实战+代码示例。
Shepherd
AI Agent
Meta-Agent
Git
Stanford
可逆执行
RL训练
Agent工程
版本控制
Python
2026年AI Agent开发框架全景解析:从LangGraph到多Agent协作的工程化实战
编程
2026年AI Agent开发框架全景解析:从LangGraph到多Agent协作的工程化实战
2026-04-23 07:11:32 +0800 CST
view 732
2026年AI Agent开发框架全景解析,深度对比LangGraph、CrewAI、AutoGen、OpenAI Agents SDK等主流框架,详解A2A与MCP协议,附完整多Agent内容生产系统实战代码。
AI Agent
LangGraph
CrewAI
AutoGen
OpenAI Agents SDK
多Agent协作
A2A协议
MCP协议
人工智能
OpenMontage 深度实战:全球首个开源 AI Agent 视频制作系统
编程
OpenMontage 深度实战:全球首个开源 AI Agent 视频制作系统
2026-06-27 01:14:57 +0800 CST
view 506
2026年6月GitHub Trending榜首项目OpenMontage深度解析:全球首个开源AI Agent视频制作系统,12条管线、52个工具、500+技能。
OpenMontage
AI Agent
视频制作
开源
Agentic
GitHub Trending
2026年AI Agent开发框架全景对比与选型指南:从LangGraph到PydanticAI,架构师的必读手册
编程
2026年AI Agent开发框架全景对比与选型指南:从LangGraph到PydanticAI,架构师的必读手册
2026-05-19 17:18:47 +0800 CST
view 1081
2026年AI Agent开发框架全景对比,深度剖析LangGraph、AutoGen、CrewAI、OpenAI Agents SDK、Google ADK、MetaGPT、PydanticAI七大框架的架构设计与适用场景,附带完整代码示例和选型决策树。
AI Agent
框架对比
LangGraph
PydanticAI
Multi-Agent
DeerFlow 2.0 深度解析:字节跳动开源的超级 Agent Harness——从 14 层中间件到沙箱隔离、从 Sub-Agent 编排到生产级部署的完整技术指南(2026)
编程
DeerFlow 2.0 深度解析:字节跳动开源的超级 Agent Harness——从 14 层中间件到沙箱隔离、从 Sub-Agent 编排到生产级部署的完整技术指南(2026)
2026-07-04 01:44:07 +0800 CST
view 205
深度解析字节跳动开源的 DeerFlow 2.0 超级 Agent 框架:14 层中间件管道、三层沙箱隔离、Sub-Agent 并发编排、跨会话记忆系统、Skills 技能扩展,含完整代码示例与生产部署指南。
DeerFlow 2.0
字节跳动
Agent Harness
LangGraph
AI Agent
中间件管道
沙箱隔离
Sub-Agent
DeerFlow 2.0 深度实战:字节跳动开源 Super Agent 框架——从架构原理到生产级多智能体协作的完整指南
编程
DeerFlow 2.0 深度实战:字节跳动开源 Super Agent 框架——从架构原理到生产级多智能体协作的完整指南
2026-05-21 18:19:52 +0800 CST
view 432
30天斩获4.9万Star,MIT协议完全开源。深度解析DeerFlow 2.0的Lead Agent + Sub-Agents架构、沙箱执行环境、任务拆解算法,以及与LangChain/AutoGPT的本质差异。
AI Agent
Super Agent
DeerFlow
字节跳动
多智能体协作
Agent框架
2026 大模型推理框架深度对比:vLLM 0.5、TGI 2.0、TensorRT-LLM 1.8、DeepSpeed-MII 0.9 性能与成本终极较量
编程
2026 大模型推理框架深度对比:vLLM 0.5、TGI 2.0、TensorRT-LLM 1.8、DeepSpeed-MII 0.9 性能与成本终极较量
2026-07-23 08:13:30 +0800 CST
view 103
2026年四大主流大模型推理框架深度对比:vLLM 0.5、TGI 2.0、TensorRT-LLM 1.8、DeepSpeed-MII 0.9。从核心技术优化、吞吐量延迟、算力成本、部署适配性四大维度开展极致测评,为企业技术选型提供精准参考。
vLLM
TensorRT-LLM
TGI
DeepSpeed-MII
大模型推理
PagedAttention
FlashAttention
量化推理
GPU推理优化
OpenTelemetry 深度实战:当可观测性终于有了统一标准——从三大信号模型、Collector 管线到 eBPF 零侵入采集的生产级完全指南
编程
OpenTelemetry 深度实战:当可观测性终于有了统一标准——从三大信号模型、Collector 管线到 eBPF 零侵入采集的生产级完全指南
2026-07-11 15:44:43 +0800 CST
view 194
深度拆解 OpenTelemetry 的 Signals 信号模型、OTLP 协议、语义约定与上下文传播,剖析 Collector 接收-处理-导出管线与 Agent/Gateway 部署拓扑,配 Go/Python/Java 手动与自动埋点、Collector 配置与 eBPF 零侵入采集实战,并给出尾部采样、基数治理与成本优化方案。
OpenTelemetry
可观测性
分布式追踪
OpenTelemetry Collector
eBPF
云原生
APM
分布式系统
OpenTelemetry 深度拆解:当可观测性成为云原生第一公民——三大信号、Collector 架构与 AI 原生 APM 新范式
编程
OpenTelemetry 深度拆解:当可观测性成为云原生第一公民——三大信号、Collector 架构与 AI 原生 APM 新范式
2026-07-16 13:20:48 +0800 CST
view 211
深度拆解 OpenTelemetry:三大信号体系(Traces/Metrics/Logs)、Collector Pipeline 架构、Kubernetes 部署实战、AI 原生 APM 新范式,配 Python/FastAPI、Go/gRPC 完整代码示例。
OpenTelemetry
OTel
可观测性
分布式追踪
Traces
Metrics
Logs
云原生
Collector
CNCF
SigNoz
Databuff
APM
采样策略
Grafana
Prometheus
ClickHouse
Loki
tail sampling
AI Agent
Kimi K3 深度拆解:2.8万亿参数开源MoE霸主的工程革命,从注意力机制到Infra全链路解析
编程
Kimi K3 深度拆解:2.8万亿参数开源MoE霸主的工程革命,从注意力机制到Infra全链路解析
2026-07-29 07:45:23 +0800 CST
view 32
深度拆解 Kimi K3:2.8万亿参数开源MoE霸主的完整架构解析,涵盖 KDA 注意力机制、Stable LatentMoE、FlashKDA 高性能算子、MoonEP 通信库、AgentENV 训练沙箱,附代码实战与性能评测。
Kimi K3
MoE架构
KDA
Attention Residuals
FlashKDA
AgentENV
MoonEP
开源大模型
长上下文
代码生成
TriAttention深度解析:用三角函数革命性压缩KV Cache,让长推理从「显存地狱」中脱困
编程
TriAttention深度解析:用三角函数革命性压缩KV Cache,让长推理从「显存地狱」中脱困
2026-05-17 04:14:18 +0800 CST
view 528
深入解析MIT韩松团队提出的TriAttention方法,利用Pre-RoPE空间Q/K集中性和三角函数级数实现革命性的KV Cache压缩,在AIME25上以3072 KV budget达到与Full Attention持平的40.8%准确率,同时实现10.7倍KV显存压缩和2.5-6.3倍吞吐量提升。
LLM
KV Cache
TriAttention
MIT
英伟达
浙大
长推理
KV压缩
三角函数
RoPE
Attention优化
【重制版】TriAttention深度解析:三角函数如何让长推理从显存地狱中脱困
编程
【重制版】TriAttention深度解析:三角函数如何让长推理从显存地狱中脱困
2026-05-17 04:14:33 +0800 CST
view 471
深入解析MIT韩松团队提出的TriAttention方法,利用Pre-RoPE空间Q/K集中性和三角函数级数实现革命性的KV Cache压缩,在AIME25上以3072 KV budget达到与Full Attention持平的40.8%准确率,同时实现10.7倍KV显存压缩和2.5-6.3倍吞吐量提升。
LLM
KV Cache
TriAttention
MIT
英伟达
浙大
长推理
KV压缩
三角函数
RoPE
Attention优化
AI Agent 可观测性深度实战:当黑箱遇见全链路追踪——从 OTel GenAI 语义规范到 LoongSuite Pilot 端侧采集、Python 零代码插桩与安全审计的生产级完全指南
编程
AI Agent 可观测性深度实战:当黑箱遇见全链路追踪——从 OTel GenAI 语义规范到 LoongSuite Pilot 端侧采集、Python 零代码插桩与安全审计的生产级完全指南
2026-06-17 11:56:08 +0800 CST
view 470
深入剖析 AI Agent 可观测性核心难题,基于阿里云 LoongSuite 开源方案,从 OTel GenAI 语义规范扩展到端侧采集、零代码插桩与安全审计的完整生产级实战指南
AI Agent
可观测性
OpenTelemetry
LoongSuite
安全审计
大模型推理引擎 2026 终极对决:vLLM vs SGLang,从 PagedAttention 到 RadixAttention,一次把 LLM 部署讲透(深度实战)
编程
大模型推理引擎 2026 终极对决:vLLM vs SGLang,从 PagedAttention 到 RadixAttention,一次把 LLM 部署讲透(深度实战)
2026-07-13 05:12:59 +0800 CST
view 187
深度对比 vLLM 与 SGLang 两大 LLM 推理引擎:从 KV Cache、PagedAttention、RadixAttention、连续批处理、分块预填充、推测解码、P/D 分离到量化部署,配可直接运行的生产级代码与基准测试。
vLLM
SGLang
LLM推理
大模型部署
PagedAttention
RadixAttention
Hermes Agent 自进化闭环深度拆解:从三层记忆到技能自沉淀,一次把 Nous Research 的 AI Agent 革命讲透(2026)
编程
Hermes Agent 自进化闭环深度拆解:从三层记忆到技能自沉淀,一次把 Nous Research 的 AI Agent 革命讲透(2026)
2026-07-13 16:47:56 +0800 CST
view 186
深度拆解 Hermes Agent 自进化 AI Agent 框架:从 GEPA 引擎、四层记忆系统、五步学习闭环到 MCP 集成,配完整代码示例与性能横评,一次把 2026 年最火的开源 Agent 讲透。
Hermes Agent
Nous Research
GEPA
AI Agent
自进化
记忆系统
MCP
SQLite FTS5
OpenRouter
Python
OpenTelemetry eBPF Instrumentation 深度实战:当可观测性从「改代码」走向「看内核」——一次把零侵入全链路追踪讲透(2026)
编程
OpenTelemetry eBPF Instrumentation 深度实战:当可观测性从「改代码」走向「看内核」——一次把零侵入全链路追踪讲透(2026)
2026-07-14 05:15:00 +0800 CST
view 265
深度拆解 OpenTelemetry eBPF Instrumentation(OBI):从埋点税痛点、eBPF 内核原理、双层次架构、DaemonSet 部署、Prometheus 查询到自己写 eBPF 探针,配完整配置与代码,一次把零侵入全链路追踪讲透。
eBPF
OpenTelemetry
可观测性
零侵入
分布式追踪
eBPFInstrumentation
Kubernetes
RED指标
2.8万亿参数、896专家、1M上下文:Kimi K3技术架构深度解析与工程能力全面评估
编程
2.8万亿参数、896专家、1M上下文:Kimi K3技术架构深度解析与工程能力全面评估
2026-07-21 18:15:42 +0800 CST
view 158
深度解析 Kimi K3 的 Stable LatentMoE 稀疏架构、KDA 混合线性注意力、Attention Residuals 跨层检索机制,评估其在软件工程任务(前端编程、芯片设计)中的实际能力,对比 DeepSeek V4、GLM-5.2、Claude Fable 5 等竞品
Kimi K3
MoE
Stable LatentMoE
KDA
Attention Residuals
长上下文
开源大模型
百万token
小米 MiMo UltraSpeed 深度解析:当 SWA 架构重塑 LLM 推理——从 O(n²) 困境到 1000 tokens/s 的极致跨越
编程
小米 MiMo UltraSpeed 深度解析:当 SWA 架构重塑 LLM 推理——从 O(n²) 困境到 1000 tokens/s 的极致跨越
2026-06-15 21:20:49 +0800 CST
view 271
深入解析小米MiMo UltraSpeed如何通过SWA架构在通用GPU上突破1000 tokens/s推理速度,从O(n²)困境到极致跨越的完整技术指南。
SWA
Sliding Window Attention
LLM推理
小米MiMo
推理优化
Transformer
PagedAttention
量化推理
端侧AI
vLLM 深度实战:从 PagedAttention 到 Speculative Decoding——2026年大模型推理引擎内核架构完全指南
编程
vLLM 深度实战:从 PagedAttention 到 Speculative Decoding——2026年大模型推理引擎内核架构完全指南
2026-05-23 18:44:14 +0800 CST
view 572
2026年深度长文,从PagedAttention分页思想、Continuous Batching调度算法、Speculative Decoding并行验证机制到CUDA Kernel底层实现,全面拆解vLLM推理引擎内核架构,附生产级部署实战与框架横向对比。
vLLM
PagedAttention
Continuous Batching
Speculative Decoding
GPU推理
大模型部署
深度学习
CUDA
WebAssembly 从浏览器走向服务器:WASI + Component Model 如何重塑边缘计算
编程
WebAssembly 从浏览器走向服务器:WASI + Component Model 如何重塑边缘计算
2026-07-12 12:45:20 +0800 CST
view 219
深度解析 WebAssembly 从浏览器到服务器的演进路径,剖析 WASI 系统接口规范、Component Model 组件化架构、WIT 接口语言,以及 Wasmtime / WAMR / WasmEdge 等主流运行时对比,附 Rust 实战代码与边缘计算性能基准测试。
WebAssembly
WASI
Component Model
WASM Runtime
边缘计算
Cloudflare Workers
Wasmtime
WasmEdge
Bytecode Alliance
性能优化
跨平台
Serverless
Claude Memory Compiler 深度解析:当 AI 编程助手第一次拥有「编译器思维」的记忆系统
编程
Claude Memory Compiler 深度解析:当 AI 编程助手第一次拥有「编译器思维」的记忆系统
2026-04-10 03:35:31 +0800 CST
view 877
claude-memory-compiler 把 AI 对话当作源代码,用 LLM 编译成结构化知识库,让 Claude Code 拥有跨会话记忆能力
Claude Code
AI Agent
Knowledge Management
LLM
Memory System
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
10
11
12
13
14
...
91
下一页