程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
LLM 推理优化全景实战:从 PagedAttention 到投机解码——让大模型推理成本下降 70% 的技术革命(2026)
编程
LLM 推理优化全景实战:从 PagedAttention 到投机解码——让大模型推理成本下降 70% 的技术革命(2026)
2026-05-30 15:42:55 +0800 CST
view 584
深度解析 LLM 推理优化的核心技术:PagedAttention 内存管理革命、投机解码加速策略、INT4/FP8 量化技术、MoE 架构优化,从架构原理到代码实战,让大模型推理成本下降 70%。
LLM
推理优化
vLLM
PagedAttention
投机解码
量化
MoE
vLLM 深度拆解:当大模型推理学会「分页注意力」——PagedAttention、连续批处理与 V1 引擎如何重写 GPU 推理服务的心智模型
编程
vLLM 深度拆解:当大模型推理学会「分页注意力」——PagedAttention、连续批处理与 V1 引擎如何重写 GPU 推理服务的心智模型
2026-07-16 04:19:16 +0800 CST
view 234
从工程师视角深度拆解 vLLM:PagedAttention 分页注意力、连续批处理、V1 引擎架构、KV Cache 管理、量化与投机解码,配 OpenAI 兼容服务、引导解码与生产调优实战。
vLLM
PagedAttention
连续批处理
大模型推理
GPU推理服务
KV缓存
V1引擎
vLLM V1 深度拆解:当一个 LLM 推理引擎决定「从零重写」——PagedAttention、分离式推理与 LMCache 如何重新定义大模型服务的性能天花板
编程
vLLM V1 深度拆解:当一个 LLM 推理引擎决定「从零重写」——PagedAttention、分离式推理与 LMCache 如何重新定义大模型服务的性能天花板
2026-08-03 09:43:58 +0800 CST
view 136
深度拆解vLLM V1引擎四大核心架构:PagedAttention V2融合块表与前缀树缓存、分离式推理Prefill/Decode架构、KV Connector标准化接口、LMCache三层KV Cache管理,附完整部署配置与性能基准测试
vLLM
PagedAttention
LMCache
分离式推理
大模型推理
KV Cache
推理引擎
LLM Serving
GPU优化
开源
ego-lite 深度拆解:一个人类和 AI 并行操控的浏览器,如何重新定义 Agent 的网页自动化
编程
ego-lite 深度拆解:一个人类和 AI 并行操控的浏览器,如何重新定义 Agent 的网页自动化
2026-07-27 10:46:16 +0800 CST
view 206
深度拆解 GitHub Trending 项目 ego-lite:如何用一个 Chromium 分支解决 AI 浏览器自动化的登录态共享、人机并行与资源开销三大难题,附架构分析、代码实战与竞品对比。
AI编程
浏览器自动化
ego-lite
Chromium
Agent
Web自动化
CDP
别再手写汇编了!Go 1.27 原生SIMD,性能直接起飞
编程
别再手写汇编了!Go 1.27 原生SIMD,性能直接起飞
2026-07-04 08:18:54 +0800 CST
view 283
Go 1.27正式支持原生SIMD,无需手写Plan9汇编即可使用向量指令。底层archsimd包+高层Highway封装,两步走策略。Green Tea GC已用SIMD让GC开销降10%,runtime.freegc让strings.Builder扩容翻2倍。高性能计算牌桌上Go正式入座。
Go
SIMD
AVX
AVX-512
ARM64
NEON
SVE
高性能计算
并行计算
GreenTeaGC
编译器优化
Warp Terminal 开源深度解析:Rust + GPU 加速的 AI Agent 终端架构全览
编程
Warp Terminal 开源深度解析:Rust + GPU 加速的 AI Agent 终端架构全览
2026-05-08 17:08:45 +0800 CST
view 948
深度解析Warp Terminal开源事件,从Block输出模型、GPU加速渲染、AI Agent原生集成三个维度拆解其60+ crates、近2000个Rust源文件的架构全貌,探讨Agent Terminal的未来趋势。
Rust
GPU
AI Agent
Warp
Terminal
WebGPU
Agent Terminal 时代来临:Warp 开源背后的 Rust + GPU 加速架构密码
编程
Agent Terminal 时代来临:Warp 开源背后的 Rust + GPU 加速架构密码
2026-05-08 17:09:32 +0800 CST
view 681
深度解析Warp Terminal开源事件,从Block输出模型、GPU加速渲染、AI Agent原生集成三个维度拆解其60+ crates、近2000个Rust源文件的架构全貌,探讨Agent Terminal的未来趋势。
Rust
GPU
AI Agent
Warp
Terminal
WebGPU
从60+ crates到WarpUI自研框架:拆解开源Warp的GPU渲染与Agent架构设计
编程
从60+ crates到WarpUI自研框架:拆解开源Warp的GPU渲染与Agent架构设计
2026-05-08 17:10:32 +0800 CST
view 607
深度解析Warp Terminal开源事件,从Block输出模型、GPU加速渲染、AI Agent原生集成三个维度拆解其60+ crates、近2000个Rust源文件的架构全貌,探讨Agent Terminal的未来趋势。
Rust
GPU
AI Agent
Warp
Terminal
WebGPU
GPU渲染+AI Agent:开源Warp的终端革命与60+ crates架构全解析
编程
GPU渲染+AI Agent:开源Warp的终端革命与60+ crates架构全解析
2026-05-08 17:11:00 +0800 CST
view 459
深度解析Warp Terminal开源事件,从Block输出模型、GPU加速渲染、AI Agent原生集成三个维度拆解其60+ crates、近2000个Rust源文件的架构全貌,探讨Agent Terminal的未来趋势。
Rust
GPU
AI Agent
Warp
Terminal
WebGPU
当 AI 编程遇上 Context-Mode:上下文管理范式的降维打击
编程
当 AI 编程遇上 Context-Mode:上下文管理范式的降维打击
2026-06-09 22:20:29 +0800 CST
view 628
登顶GitHub Trending的Context-Mode如何让AI编程成本降低98%?系统拆解上下文外置隔离、语义智能检索、计算逻辑外移、输出范式精简四大核心降本技术,附生产级落地指南。
AI编程
Context-Mode
MCP
上下文管理
Token优化
Go 1.26 深度实战:当「精益求精」遇上「性能暴击」——从 Green Tea GC 到 new(expr) 语法糖的全方位完全指南(2026)
编程
Go 1.26 深度实战:当「精益求精」遇上「性能暴击」——从 Green Tea GC 到 new(expr) 语法糖的全方位完全指南(2026)
2026-06-15 19:20:33 +0800 CST
view 572
Go 1.26 全面解析:Green Tea GC 默认启用降低 10-40% CPU 开销,new(expr) 语法糖革新指针初始化,go fix 彻底重构,slog 正式转正,Crypto 库重构加速 29-81%,从原理到实战深度讲解。
Go语言
Golang
GC
性能优化
GreenTea
编程
Go 1.27 encoding/json/v2 正式落地:标准库 JSON 的全面重构
编程
Go 1.27 encoding/json/v2 正式落地:标准库 JSON 的全面重构
2026-07-04 14:20:04 +0800 CST
view 333
Go 1.27正式发布encoding/json/v2,三层API设计(Marshal/Unmarshal→MarshalWrite/UnmarshalRead→jsontext token流),默认严格模式(拒绝非法UTF-8、重复key、大小写敏感),unmarshal性能显著提升。v1用户无需修改享受底层优化,可通过Options逐步迁移。
Go
encoding/json
v2
标准库
JSON
jsontext
token流
UTF-8
重复key
大小写敏感
泛型
流式处理
性能优化
vLLM 0.5 深度解析:PagedAttention 架构原理与生产级 LLM 推理优化实战
编程
vLLM 0.5 深度解析:PagedAttention 架构原理与生产级 LLM 推理优化实战
2026-07-04 18:15:46 +0800 CST
view 392
深度解析 vLLM 0.5 的 PagedAttention 架构原理,涵盖 KV Cache 分页管理、MoE 优化、分布式推理、量化技术,并通过代码实战和性能对比,帮助开发者掌握生产级 LLM 推理最佳实践。
vLLM
PagedAttention
LLM推理
CUDA
KV Cache
深度学习
AI基础设施
Python
生产部署
性能优化
Claude Context深度解析:基于Milvus的语义代码搜索引擎实战
编程
Claude Context深度解析:基于Milvus的语义代码搜索引擎实战
2026-04-28 11:51:05 +0800 CST
view 725
深度解析claude-context项目,讲解如何基于Milvus向量数据库构建语义代码搜索引擎,实现AI编程助手对大规模代码库的理解能力,节省97%的Token消耗。
Claude Context
Milvus
语义搜索
AI编程
向量数据库
CloakBrowser 深度解析:用源码级补丁绕过所有反爬虫检测——开源 Stealth Chromium 如何做到 30/30 测试全过
编程
CloakBrowser 深度解析:用源码级补丁绕过所有反爬虫检测——开源 Stealth Chromium 如何做到 30/30 测试全过
2026-05-16 01:14:57 +0800 CST
view 898
CloakBrowser通过49个C++补丁修改Chromium源码,实现真正的stealth浏览器自动化。本文深度解析其技术原理、架构设计、实战应用,以及与playwright-stealth等工具的本质区别。
CloakBrowser
浏览器自动化
反爬虫
Chromium
Stealth
Playwright
Python
JavaScript
开源
AI_Agent
GitNexus 深度解析:当 AI Agent 终于拥有了自己的「代码神经系统」
编程
GitNexus 深度解析:当 AI Agent 终于拥有了自己的「代码神经系统」
2026-04-09 05:25:32 +0800 CST
view 1418
GitNexus 将任意代码库索引为知识图谱,通过 MCP 协议让 AI Agent 拥有代码架构感知能力,解决 AI 编程工具不"看见"代码结构的核心痛点。
AI编程
GitNexus
知识图谱
MCP
代码智能
Agent
Agent Lightning 深度解析:微软如何用零代码改造让 AI Agent 实现自我进化
编程
Agent Lightning 深度解析:微软如何用零代码改造让 AI Agent 实现自我进化
2026-04-18 15:12:54 +0800 CST
view 760
深入剖析微软开源项目 Agent Lightning 的技术架构,详解零代码接入、多框架兼容、强化学习训练等核心特性
AI Agent
强化学习
LangChain
AutoGen
微软
开源
字节跳动 DeerFlow 2.0 深度解析:46k Star 的超级智能体框架,让 AI 真正「动手做事」
编程
字节跳动 DeerFlow 2.0 深度解析:46k Star 的超级智能体框架,让 AI 真正「动手做事」
2026-04-28 13:55:13 +0800 CST
view 654
深度解析字节跳动开源的 DeerFlow 2.0 超级智能体框架,46k Star 的核心技术架构、LangGraph 状态机原理、代码实战与性能优化指南。
AI Agent
LangGraph
DeerFlow
字节跳动
多智能体
深度学习
Goose 深度实战:当 Rust 遇见本地 AI Agent——从 Block 开源到 Linux Foundation AAIF 的生产级完全指南(2026)
编程
Goose 深度实战:当 Rust 遇见本地 AI Agent——从 Block 开源到 Linux Foundation AAIF 的生产级完全指南(2026)
2026-06-16 02:47:41 +0800 CST
view 676
Goose 是由 Block 开源、现已迁入 Linux Foundation AAIF 的 Rust AI Agent。支持 15+ LLM、70+ MCP 扩展,本文深度解析其架构与实战。
Goose
Rust
AI Agent
MCP
AACP
Linux Foundation
Agent Lightning 深度解析:零代码如何让任何框架的 AI Agent 实现自我进化
编程
Agent Lightning 深度解析:零代码如何让任何框架的 AI Agent 实现自我进化
2026-04-18 15:13:12 +0800 CST
view 687
深入剖析微软开源项目 Agent Lightning 的技术架构,详解零代码接入、多框架兼容、强化学习训练等核心特性
AI Agent
强化学习
LangChain
AutoGen
微软
开源
x402 协议深度解析:Linux 基金会如何用 HTTP 原生支付重塑 AI Agent 经济基础设施
编程
x402 协议深度解析:Linux 基金会如何用 HTTP 原生支付重塑 AI Agent 经济基础设施
2026-05-09 07:08:39 +0800 CST
view 873
Linux基金会x402协议深度解析:HTTP 402原生支付如何为AI Agent提供自动化微支付基础设施,含架构分析、代码实战、安全设计与生态全景
x402
HTTP
AI Agent
支付协议
Linux Foundation
SkillSpector 深度实战:当 NVIDIA 遇见 AI Agent 技能安全——从零到生产级 AI 智能体安全扫描完全指南(2026)
编程
SkillSpector 深度实战:当 NVIDIA 遇见 AI Agent 技能安全——从零到生产级 AI 智能体安全扫描完全指南(2026)
2026-06-16 03:20:51 +0800 CST
view 761
NVIDIA 开源 AI Agent 技能安全扫描工具 SkillSpector 深度实战,覆盖安装、架构、代码实战、性能优化全流程
AI Agent 安全
NVIDIA
技能扫描
Python 安全
Claw Code 深度解析:当韩国开发者用 Rust 重写 Claude Code,GitHub 史上最快 5 万星项目诞生
编程
Claw Code 深度解析:当韩国开发者用 Rust 重写 Claude Code,GitHub 史上最快 5 万星项目诞生
2026-04-09 06:04:37 +0800 CST
view 1343
韩国开发者用 Rust 重写 Claude Code,claw-code 项目 2 小时破 5 万星,创下 GitHub 史上最快增速纪录。深度解析其 Python+Rust 混合架构、净室重写工程实践和 Agent Harness 设计理念。
Rust
AI编程
开源项目
Claude Code
Agent Harness
净室重写
GitHub 22k Star 的 Beads:如何用 Dolt 给 AI Agent 装上一个永久记忆大脑
编程
GitHub 22k Star 的 Beads:如何用 Dolt 给 AI Agent 装上一个永久记忆大脑
2026-04-28 14:54:44 +0800 CST
view 744
深度解析 GitHub 22.3k Star 的 Beads 项目:用 Dolt 版本控制数据库为 AI coding agent 构建持久化记忆系统,覆盖架构设计、Dolt 分支模型、代码实战与生产部署指南。
AI编程
Dolt
Agent
GitHub开源
版本控制
SQL数据库
编程工具
长任务追踪
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
76
77
78
79
80
...
129
下一页