程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
MCP 2026-07 规范深度解析:从工具调用协议到生产级 Agent 基础设施
编程
MCP 2026-07 规范深度解析:从工具调用协议到生产级 Agent 基础设施
2026-07-23 18:45:50 +0800 CST
view 332
深度解析MCP 2026-07规范核心变化:无状态核心、能力发现与治理、任务体系、结构化交付,以及企业级落地实践。程序员视角的技术指南。
MCP
Model Context Protocol
AI Agent
A2A
协议
生产级
无状态
JSON Schema
链路追踪
企业级
TriAttention深度解析:用三角函数革命性压缩KV Cache,让长推理从「显存地狱」中脱困
编程
TriAttention深度解析:用三角函数革命性压缩KV Cache,让长推理从「显存地狱」中脱困
2026-05-17 04:14:18 +0800 CST
view 637
深入解析MIT韩松团队提出的TriAttention方法,利用Pre-RoPE空间Q/K集中性和三角函数级数实现革命性的KV Cache压缩,在AIME25上以3072 KV budget达到与Full Attention持平的40.8%准确率,同时实现10.7倍KV显存压缩和2.5-6.3倍吞吐量提升。
LLM
KV Cache
TriAttention
MIT
英伟达
浙大
长推理
KV压缩
三角函数
RoPE
Attention优化
【重制版】TriAttention深度解析:三角函数如何让长推理从显存地狱中脱困
编程
【重制版】TriAttention深度解析:三角函数如何让长推理从显存地狱中脱困
2026-05-17 04:14:33 +0800 CST
view 544
深入解析MIT韩松团队提出的TriAttention方法,利用Pre-RoPE空间Q/K集中性和三角函数级数实现革命性的KV Cache压缩,在AIME25上以3072 KV budget达到与Full Attention持平的40.8%准确率,同时实现10.7倍KV显存压缩和2.5-6.3倍吞吐量提升。
LLM
KV Cache
TriAttention
MIT
英伟达
浙大
长推理
KV压缩
三角函数
RoPE
Attention优化
GPT-5.6 Sol/Terra/Luna 三层模型体系深度解析:Ultra 并行 Agent 刷新编程基准背后的技术真相与生产级实战
编程
GPT-5.6 Sol/Terra/Luna 三层模型体系深度解析:Ultra 并行 Agent 刷新编程基准背后的技术真相与生产级实战
2026-07-13 00:44:45 +0800 CST
view 380
深度解析GPT-5.6 Sol/Terra/Luna三层模型体系:Ultra模式4路并行Agent、Terminal-Bench 91.9% SOTA、Prompt Cache省80%费用、SWE-Bench Pro 64.6%背后的真实原因,配Python生产级代码实战。
GPT-5.6
OpenAI
AI编程
Agent
模型选型
Prompt Cache
Ultra模式
API调用
sched_ext 深度拆解:当 Linux 决定把调度器「按 cgroup 分包出租」——从 DSQ 阻抗匹配到 cid 拓扑 ID 与子调度器的架构手术
编程
sched_ext 深度拆解:当 Linux 决定把调度器「按 cgroup 分包出租」——从 DSQ 阻抗匹配到 cid 拓扑 ID 与子调度器的架构手术
2026-08-09 00:55:14 +0800 CST
view 112
深度拆解 sched_ext:从 DSQ 阻抗匹配层、完整调度周期与 custody 语义,到 2026 主线内核新增的 cid 拓扑有序 CPU ID 与按 cgroup 挂载的子调度器。含两个可读的 BPF 调度器完整实现、events 计数器逐条排障表、七条调优经验与十条踩坑清单。
sched_ext
eBPF
Linux内核
CPU调度
BPF
内核调度器
cgroup
性能优化
Rust
scx
Capo.js:你的head排序对了吗?一行代码检测出来
案例
Capo.js:你的head排序对了吗?一行代码检测出来
2026-05-09 06:37:27 +0800 CST
view 555
Capo.js开源工具:检测HTML head元素排序是否合理,11级权重体系量化排序规则,零依赖6kB Gzip,Chrome扩展装上就能用,程序化API适合CI集成
前端性能
head排序
性能优化
零依赖
Chrome扩展
ct.css
Everything Claude Code 深度解析:黑客马拉松冠军如何让 AI 编程从「裸奔」到「武装到牙齿」
编程
Everything Claude Code 深度解析:黑客马拉松冠军如何让 AI 编程从「裸奔」到「武装到牙齿」
2026-05-11 08:21:24 +0800 CST
view 716
深度解析2026年GitHub增长最快的AI开源项目Everything Claude Code:105K Star、27个专业Agent、Instinct持续学习系统、AgentShield安全审计、Hook自动化,让Claude Code从单次会话工具进化为生产级AI编程平台
AI编程,ClaudeCode,EverythingClaudeCode,AI Agent,开发者工具
Rspack 2.0 深度拆解:字节跳动如何用 Rust 把 Webpack 的 192 个依赖砍到 1 个——从 ESM 核心到 React Server Components 的前端构建革命
编程
Rspack 2.0 深度拆解:字节跳动如何用 Rust 把 Webpack 的 192 个依赖砍到 1 个——从 ESM 核心到 React Server Components 的前端构建革命
2026-08-04 04:42:42 +0800 CST
view 169
深度拆解Rspack 2.0架构:字节跳动基于Rust的JavaScript打包工具从依赖192个砍到1个的供应链安全革命、纯ESM核心迁移、SWC缓存复用、React Server Components实验性支持、10000组件项目构建时间从5.6秒降至1.4秒,附完整代码示例与性能优化实战指南
Rspack
Rust
Webpack
前端构建
字节跳动
ESM
React Server Components
SWC
打包器
性能优化
Temporal Replay 2026 深度解析:Serverless Workers + 独立活动 + Workflow 流——持久执行范式重塑 AI Agent 基础设施
编程
Temporal Replay 2026 深度解析:Serverless Workers + 独立活动 + Workflow 流——持久执行范式重塑 AI Agent 基础设施
2026-06-30 01:46:49 +0800 CST
view 353
2026年Temporal Replay大会重磅发布:Serverless Workers、Standalone Activities、Workflow Streams、External Payload Storage,以及Google ADK和OpenAI Agents SDK集成。从架构原理到代码实战,深度解析持久执行范式如何重塑AI Agent基础设施。
Temporal
AI Agent
Durable Execution
Serverless
Workflow Streams
Standalone Activity
Temporal Replay 2026 深度解析:Serverless Workers、Workflow Streams 与 AI Agent 基础设施的范式革命
编程
Temporal Replay 2026 深度解析:Serverless Workers、Workflow Streams 与 AI Agent 基础设施的范式革命
2026-07-23 19:16:51 +0800 CST
view 215
深度解析Temporal Replay 2026新功能:Serverless Workers、Workflow Streams、Standalone Activities、External Payload Storage、Rust SDK,以及AI Agent基础设施架构实战。
Temporal
Durable Execution
AI Agent
Serverless
Workflow Streams
分布式系统
Temporal Replay 2026 深度实战:当持久化执行引擎成为 AI Agent 的神经系统——从 Workflow Streams 到 Serverless Workers、从 AI 调试到生产级部署的完全指南(2026)
编程
Temporal Replay 2026 深度实战:当持久化执行引擎成为 AI Agent 的神经系统——从 Workflow Streams 到 Serverless Workers、从 AI 调试到生产级部署的完全指南(2026)
2026-06-22 10:57:19 +0800 CST
view 473
深入解析 Temporal Replay 2026 四大新特性:Serverless Workers、Standalone Activities、Workflow Streams 及 AI 框架集成,配完整代码示例和生产部署指南。
Temporal
Serverless
Workflow
Streams
AI
Agent
Durable
Execution
Superpowers 深度实战:从"碰运气"到"走流程"——2026 年 AI 编程 Agent 工程化方法论完全指南
编程
Superpowers 深度实战:从"碰运气"到"走流程"——2026 年 AI 编程 Agent 工程化方法论完全指南
2026-05-23 22:02:27 +0800 CST
view 558
Superpowers 深度实战指南,详解 14 个技能如何赋能 AI 编程助手遵循工程化方法论。
AI编程
Superpowers
ClaudeCode
TDD
工程化
Temporal Replay 2026 深度实战:从持久化执行范式到 AI Agent 编排新纪元,手写生产级智能工作流引擎
编程
Temporal Replay 2026 深度实战:从持久化执行范式到 AI Agent 编排新纪元,手写生产级智能工作流引擎
2026-07-10 09:15:33 +0800 CST
view 326
深度剖析 Temporal Replay 2026 新特性:从 Durable Execution 核心原理、Serverless Workers、Standalone Activities、Workflow Streams 持久化流式输出,到 AI Agent 生态集成(Google ADK / OpenAI Agents SDK)、Worker Versioning、手写生产级 AI 数据摄取流水线。
Temporal
Durable Execution
AI Agent
Workflow Streams
Go
Serverless
分布式系统
工作流引擎
OmniRoute 深度解析:聚合 237 家模型提供商的免费 AI 网关如何用智能路由+Token 压缩实现每月 16 亿 Token 白嫖——从架构原理到生产级部署的完整实战指南
编程
OmniRoute 深度解析:聚合 237 家模型提供商的免费 AI 网关如何用智能路由+Token 压缩实现每月 16 亿 Token 白嫖——从架构原理到生产级部署的完整实战指南
2026-07-07 13:47:41 +0800 CST
view 491
深度解析 OmniRoute 开源 AI 网关:聚合 237 家模型提供商、90+免费模型、智能路由、自动故障转移、RTK+Caveman Token 压缩技术,月享 16 亿免费 Token
OmniRoute
AI网关
开源
Token压缩
智能路由
免费模型
Groq
Together
OpenAI
API
百度 Unlimited OCR 深度解析:端到端架构、R-SWA 常数量化 KV Cache,以及让 AI 像人一样抄书的工程革命
编程
百度 Unlimited OCR 深度解析:端到端架构、R-SWA 常数量化 KV Cache,以及让 AI 像人一样抄书的工程革命
2026-07-05 05:41:29 +0800 CST
view 397
深度解析百度2026年开源的Unlimited OCR模型:端到端架构、R-SWA常数量化KV Cache机制、MoE解码器设计,以及让AI像人一样连续解析长文档的工程革命。含完整代码实战。
OCR
百度
端到端OCR
R-SWA
KV Cache
文档识别
多模态
编程
apache自带的ab(http)与abs(https)压测工具用法详解
2024-11-19 01:53:49 +0800 CST
view 8654
本文详细介绍了Apache自带的ab(http)和abs(https)压测工具的使用方法,包括吞吐率、并发连接数、用户请求等待时间等基本概念。通过示例代码展示如何使用ab工具进行压力测试,并提供了测试结果的分析,包括请求数、响应时间等关键指标。最后,比较了Windows和Linux环境下的测试结果,指出了服务器性能的优化方向。
性能测试
网络工具
Apache
Helidon 4.4 深度解析:当 Oracle 把 LangChain4j AI Agent 能力直接内建进 Java 微服务框架
编程
Helidon 4.4 深度解析:当 Oracle 把 LangChain4j AI Agent 能力直接内建进 Java 微服务框架
2026-04-11 11:26:05 +0800 CST
view 1044
2026年4月Oracle发布Helidon 4.4,原生集成LangChain4j AI Agent能力。本文深度解析这一重磅更新,从架构演进、代码实战到性能优化,全面展示Java微服务框架如何拥抱AI Agent时代。
Java
Helidon
LangChain4j
AI Agent
微服务
llmfit 深度拆解:一条命令算清你的机器能跑哪个大模型,Rust 硬件探测与适配度评分引擎全解析
编程
llmfit 深度拆解:一条命令算清你的机器能跑哪个大模型,Rust 硬件探测与适配度评分引擎全解析
2026-07-24 07:14:55 +0800 CST
view 199
深度拆解 GitHub Trending 破万星的 llmfit:Rust 硬件探测、权重与 KV cache 显存估算公式、内存带宽速度模型、MoE offload 运行模式,附 100 行 Python 复现 mini-llmfit 与工程集成实战。
llmfit
Rust
本地大模型
Ollama
llama.cpp
量化
KV cache
MoE
硬件选型
开源
1.6万亿参数,1M上下文,仅需27%算力:DeepSeek-V4-Pro 如何重新定义长文本推理
编程
1.6万亿参数,1M上下文,仅需27%算力:DeepSeek-V4-Pro 如何重新定义长文本推理
2026-05-11 10:53:54 +0800 CST
view 750
DeepSeek-V4-Pro 以 1.6T 总参数、49B 激活参数的 MoE 架构,原生支持 100 万 token 上下文,同时将推理算力降至 V3.2 的 27%、KV Cache 降至 10%。本文深度解析 CSA/HCA 混合注意力机制、mHC 流形约束超连接、KV Cache 极致优化、Muon 优化器等核心技术创新,以及如何在 Ollama、vLLM、官方 API 三种方式下部署运行。
DeepSeek-V4,MoE架构,CSA注意力,HCA注意力,KV Cache,1M上下文,长文本推理,开源大模型
RustFS 深度拆解:当 Rust 决定干掉全部对象存储的性能瓶颈
编程
RustFS 深度拆解:当 Rust 决定干掉全部对象存储的性能瓶颈
2026-08-05 09:34:14 +0800 CST
view 210
深度拆解RustFS:383天30K Star的Rust对象存储系统,写入性能2倍领先MinIO,零GC停顿,io_uring异步IO,100% S3兼容,Apache 2.0许可证,完整架构分析与代码实战
RustFS
Rust
对象存储
MinIO
分布式存储
纠删码
io_uring
云原生
S3兼容
Apache 2.0
GitHub
Apache Doris 4.1 深度拆解:当实时数仓长出 AI 大脑——从向量检索到统一数据底座的全链路技术实战
编程
Apache Doris 4.1 深度拆解:当实时数仓长出 AI 大脑——从向量检索到统一数据底座的全链路技术实战
2026-05-02 10:33:28 +0800 CST
view 836
深入拆解Apache Doris 4.1的技术内核:从FE/BE架构到存算分离、从原生向量检索到混合搜索、从RAG实战到生产部署,全方位解析实时数仓如何演化为AI时代统一数据底座
Apache Doris
向量检索
实时数仓
RAG
存算分离
OLAP
AI数据库
vLLM vs SGLang 深度拆解:当推理引擎分道扬镳——从 PagedAttention 到 RadixAttention 的架构革命与选型决策指南(2026)
编程
vLLM vs SGLang 深度拆解:当推理引擎分道扬镳——从 PagedAttention 到 RadixAttention 的架构革命与选型决策指南(2026)
2026-08-14 07:12:45 +0800 CST
view 52
深度拆解 vLLM 与 SGLang 两大推理框架:从 PagedAttention 分页内存管理到 RadixAttention 前缀树复用,从 Continuous Batching 到压缩有限状态机,配完整性能对比数据与 15 条生产踩坑清单。
vLLM
SGLang
大模型推理
PagedAttention
RadixAttention
KV Cache
高性能计算
LLM部署
vLLM vs SGLang 深度拆解:从 PagedAttention 到 RadixAttention 的架构革命(2026实战指南)
编程
vLLM vs SGLang 深度拆解:从 PagedAttention 到 RadixAttention 的架构革命(2026实战指南)
2026-08-14 07:13:18 +0800 CST
view 106
深度拆解 vLLM 与 SGLang 两大推理框架:从 PagedAttention 分页内存管理到 RadixAttention 前缀树复用,从 Continuous Batching 到压缩有限状态机,配完整性能对比数据与 15 条生产踩坑清单。
vLLM
SGLang
大模型推理
PagedAttention
RadixAttention
KV Cache
高性能计算
LLM部署
RustFS 深度解析:用 Rust 重写的高性能对象存储——2.3 倍于 MinIO 的小文件吞吐、Apache 2.0 零合规风险,从架构原理到生产部署的完整实战指南
编程
RustFS 深度解析:用 Rust 重写的高性能对象存储——2.3 倍于 MinIO 的小文件吞吐、Apache 2.0 零合规风险,从架构原理到生产部署的完整实战指南
2026-07-06 14:16:29 +0800 CST
view 622
深度解析RustFS开源对象存储:Rust编写,4KB小文件写入2.3倍于MinIO,Apache 2.0协议零合规风险。三层架构设计、纠删码实现、io_uring加速、S3 API完全兼容、Docker/K8s一键部署。含完整代码实战与性能调优指南。
RustFS
Rust
对象存储
MinIO
S3
分布式存储
Apache 2.0
io_uring
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
15
16
17
18
19
...
100
下一页