程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
vLLM 深度拆解:当 KV Cache 学会「分页」——用操作系统智慧重写 LLM 推理的心智模型
编程
vLLM 深度拆解:当 KV Cache 学会「分页」——用操作系统智慧重写 LLM 推理的心智模型
2026-07-15 10:13:07 +0800 CST
view 119
深度拆解 vLLM 核心架构:从 PagedAttention 分页内存管理、Continuous Batching 动态调度,到 Speculative Decoding、Prefix Caching 等高级特性,配完整代码示例与生产部署指南。
vLLM
PagedAttention
LLM推理
深度学习
GPU优化
Continuous Batching
DeepSeek-R1边缘推理实战:从云端独占到本地智能的范式转移
编程
DeepSeek-R1边缘推理实战:从云端独占到本地智能的范式转移
2026-05-19 12:42:27 +0800 CST
view 475
2026年,边缘AI不再只是云端模型的精简版。本文深入剖析DeepSeek-R1 CPU版的技术原理,从模型蒸馏、量化技术的底层原理到生产环境的完整部署方案,提供可直接落地的代码和可量化的性能数据。
DeepSeek
R1
边缘计算
AI推理
模型蒸馏
量化
llama.cpp
Ollama
端侧AI
从 Caveman 令牌压缩到 Agent Skills:2026年7月 GitHub Trending AI 编码工具深度解析
编程
从 Caveman 令牌压缩到 Agent Skills:2026年7月 GitHub Trending AI 编码工具深度解析
2026-07-09 01:47:33 +0800 CST
view 369
深度解析2026年7月GitHub Trending上的AI编码工具生态:Caveman令牌压缩65%背后的工程原理、mattpocock/skills 354个生产级技能、openai/codex-plugin-cc多代理协作,以及这场正在发生的AI编程工具工程化革命。
AI编程工具
GitHub Trending
Caveman
Agent Skills
AI Agent
LLM
Copilot
2026技术
Agent Skills 深度拆解:当 AI 编程助手学会「工程纪律」——mattpocock/skills、addyosmani/agent-skills 与 Superpowers 如何用可组合 SOP 重写人机协作的心智模型
编程
Agent Skills 深度拆解:当 AI 编程助手学会「工程纪律」——mattpocock/skills、addyosmani/agent-skills 与 Superpowers 如何用可组合 SOP 重写人机协作的心智模型
2026-07-15 12:18:39 +0800 CST
view 162
从工程师视角深度拆解 Agent Skills 运动:mattpocock/skills、addyosmani/agent-skills 与 Superpowers 如何用可组合 SOP、Checkpoint 与反合理化给 AI 编程助手装上工程纪律,配 SKILL.md、TDD、CI 与 MCP 协同实战。
Agent Skills
AI编程
工程纪律
mattpocock
addyosmani
Superpowers
SKILL.md
TDD
vLLM 深度实战:当 LLM 推理遇上 PagedAttention——从 KV 缓存管理到生产级高并发服务的完全指南(2026)
编程
vLLM 深度实战:当 LLM 推理遇上 PagedAttention——从 KV 缓存管理到生产级高并发服务的完全指南(2026)
2026-06-08 22:52:24 +0800 CST
view 530
深度解析vLLM推理框架的核心原理、PagedAttention创新机制、分布式推理架构,以及生产环境部署的最佳实践。
vLLM
PagedAttention
LLM推理
KV缓存
分布式推理
2026 年 vLLM 推理服务实战:PagedAttention 原理、分布式部署与性能调优完全指南
编程
2026 年 vLLM 推理服务实战:PagedAttention 原理、分布式部署与性能调优完全指南
2026-06-08 22:53:03 +0800 CST
view 323
深度解析vLLM推理框架的核心原理、PagedAttention创新机制、分布式推理架构,以及生产环境部署的最佳实践。
vLLM
PagedAttention
LLM推理
KV缓存
分布式推理
Agent Skills 深度实战:当 AI 学会「工程师纪律」——从 Addy Osmani 的 7 个斜杠命令到生产级 AI 编程工作流的完全指南(2026)
编程
Agent Skills 深度实战:当 AI 学会「工程师纪律」——从 Addy Osmani 的 7 个斜杠命令到生产级 AI 编程工作流的完全指南(2026)
2026-06-15 00:50:09 +0800 CST
view 563
Agent Skills 是 Google 工程总监 Addy Osmani 开源的 AI 编程工程技能库,通过 7 个斜杠命令(/spec、/plan、/build、/test、/review、/code-simplify、/ship)将软件开发六阶段生命周期固化到 AI 工作流中,让 AI 从「代码生成器」升级为「工程助手」。
AI编程
Agent Skills
Addy Osmani
Claude Code
工程化
软件开发
Skill
生产级
LLM 推理优化全景实战:从 PagedAttention 到投机解码——让大模型推理成本下降 70% 的技术革命(2026)
编程
LLM 推理优化全景实战:从 PagedAttention 到投机解码——让大模型推理成本下降 70% 的技术革命(2026)
2026-05-30 15:42:55 +0800 CST
view 469
深度解析 LLM 推理优化的核心技术:PagedAttention 内存管理革命、投机解码加速策略、INT4/FP8 量化技术、MoE 架构优化,从架构原理到代码实战,让大模型推理成本下降 70%。
LLM
推理优化
vLLM
PagedAttention
投机解码
量化
MoE
Local-File-Organizer 深度解析:3K Stars 本地 AI 文件整理,Llama3.2+LLaVA 完全离线运行
编程
Local-File-Organizer 深度解析:3K Stars 本地 AI 文件整理,Llama3.2+LLaVA 完全离线运行
2026-05-15 12:22:33 +0800 CST
view 440
深入解析 3K Stars 的 Local-File-Organizer:基于 Llama3.2 3B + LLaVA-v1.6 双模型的本地 AI 文件整理工具,使用 Nexa SDK 实现 100% 离线推理,自动识别文件内容、智能分类重命名、支持图片视觉分析和文档内容解析,零数据外泄。
Local-File-Organizer
AI文件整理
Llama3
LLaVA
本地AI
隐私
英伟达ASPIRE深度解析:具身智能的Skill时刻——从Coding Agent到机器人技能库、从经验沉淀到持续学习范式的完整技术指南(2026)
编程
英伟达ASPIRE深度解析:具身智能的Skill时刻——从Coding Agent到机器人技能库、从经验沉淀到持续学习范式的完整技术指南(2026)
2026-07-04 08:12:57 +0800 CST
view 433
2026年7月1日,英伟达GEAR团队开源机器人技能库ASPIRE,具身智能负责人Jim Fan称之为范式转变。深度解析ASPIRE的核心原理、技术架构、实现细节,以及它如何像Coding Agent一样让机器人通过写代码、看执行轨迹、修程序、沉淀技能来实现持续学习。
NVIDIA ASPIRE
具身智能
机器人技能库
持续学习
Coding Agent
Skill Refinement
经验沉淀
LLM
GPT-4
Claude
Jim Fan
GEAR团队
给 AI 编码 Agent 装上「谷歌级工程纪律」:深度解析 Addy Osmani 的 agent-skills,从 Skill 解剖学到亲手写一个生产级技能
编程
给 AI 编码 Agent 装上「谷歌级工程纪律」:深度解析 Addy Osmani 的 agent-skills,从 Skill 解剖学到亲手写一个生产级技能
2026-07-10 02:47:04 +0800 CST
view 158
深度解析 Addy Osmani 开源的 agent-skills:如何把 Google 级工程规范编译成 AI 编码 Agent 可执行的技能,涵盖 Skill 解剖学、六阶段生命周期、七命令映射、Hooks 闸门,并手搓一个生产级「数据库迁移安全检查」技能(含完整代码)。
agent-skills
AI 编程
Claude Code
工程化
Skill
提示工程
Python
SGLang vs vLLM:2026年大模型推理框架深度对比与选型指南
编程
SGLang vs vLLM:2026年大模型推理框架深度对比与选型指南
2026-04-08 15:51:53 +0800 CST
view 1865
深度对比SGLang与vLLM两大LLM推理框架,从架构设计、核心原理、性能实测、适用场景多维度解析,附2026年选型建议
LLM
SGLang
vLLM
推理优化
大模型
Karpathy Skills 深度解析:187K Star 的 AI 编程四原则——从错误假设到工程级代码的完整进化指南
编程
Karpathy Skills 深度解析:187K Star 的 AI 编程四原则——从错误假设到工程级代码的完整进化指南
2026-07-04 13:14:42 +0800 CST
view 234
深度解析 Andrej Karpathy Skills 项目:187K Star 的 AI 编程四原则,从错误假设、过度工程化、附带损伤、验证缺失四大痛点出发,详细阐述 Think Before Coding、Simplicity First、Surgical Changes、Goal-Driven Execution 四原则的技术原理、工程实践与代码示例。
Karpathy Skills
AI编程
CLAUDE.md
Claude Code
Cursor
提示工程
代码质量
LLM编程
四原则
工程实践
Ollama 本地大模型部署实战:从零到生产级应用的完全指南(2026)
编程
Ollama 本地大模型部署实战:从零到生产级应用的完全指南(2026)
2026-06-10 01:20:57 +0800 CST
view 519
2026年Ollama本地大模型部署完全指南:从架构原理、GGUF量化、ModelFile自定义、多语言集成(Python/JS/Go)、RAG实战到Docker/K8s生产部署,8500字深度长文。
Ollama
本地部署
大模型
LLM
生产级
GGUF
量化
从零构建企业级本地化RAG系统:Ollama与RAGFlow深度实战
编程
从零构建企业级本地化RAG系统:Ollama与RAGFlow深度实战
2026-06-29 01:46:19 +0800 CST
view 399
深入探讨如何基于Ollama和RAGFlow构建完全本地化的RAG系统,涵盖架构设计、部署实战、代码实现和性能优化。
RAG
Ollama
RAGFlow
本地部署
LLM
分布式 LLM 推理架构深度实战:从 vLLM 单节点到 llm-d 多集群的生产级演进全链路解析
编程
分布式 LLM 推理架构深度实战:从 vLLM 单节点到 llm-d 多集群的生产级演进全链路解析
2026-05-09 03:39:58 +0800 CST
view 620
深度解析分布式 LLM 推理架构,从 vLLM 单节点到 llm-d 多集群的生产级演进。涵盖推理引擎层、编排调度层、Kubernetes 多机多卡部署实战、性能优化技巧及成本优化策略。
LLM
vLLM
分布式推理
Kubernetes
Ray
推理引擎
Agent Lightning 深度解析:微软开源 AI Agent 训练框架——零代码改动,让任何 AI Agent 学会「自我进化」
编程
Agent Lightning 深度解析:微软开源 AI Agent 训练框架——零代码改动,让任何 AI Agent 学会「自我进化」
2026-05-16 03:14:41 +0800 CST
view 533
微软研究院开源 Agent Lightning:零代码改动训练任何 AI Agent,支持 RL/APO/SFT,已验证 128 GPU 大规模训练。
AgentLightning
强化学习
AI Agent
微软开源
LLM训练
Pathway 深度解析:Python ETL 框架的流式处理革命 —— 用 Rust 引擎吊打 Flink/Spark,构建实时 LLM Pipeline
编程
Pathway 深度解析:Python ETL 框架的流式处理革命 —— 用 Rust 引擎吊打 Flink/Spark,构建实时 LLM Pipeline
2026-05-16 03:46:12 +0800 CST
view 502
55K+ Star,基于 Differential Dataflow 的 Rust 引擎,增量计算,内存计算,无缝集成 Python ML 生态——Pathway 正在重新定义实时流处理与 LLM Pipeline 的边界。
Python
流处理
实时分析
LLM
RAG
Pathway
ETL
开源项目
GitHub Trending
Andrej Karpathy Skills 深度实战:当 AI 学会了「编程自律」——从 CLAUDE.md 四大原则到 AI 编程行为矫正、从错误假设捕获到极简代码生成的完全指南(2026)
编程
Andrej Karpathy Skills 深度实战:当 AI 学会了「编程自律」——从 CLAUDE.md 四大原则到 AI 编程行为矫正、从错误假设捕获到极简代码生成的完全指南(2026)
2026-06-21 14:25:24 +0800 CST
view 254
深入剖析 GitHub 149K+ Stars 爆火项目 andrej-karpathy-skills,揭示 Andrej Karpathy 如何通过一份 65 行的 CLAUDE.md 文件,将 AI 编程助手的准确率从 65% 提升到 94%。
AI编程
Claude Code
LLM
行为准则
代码质量
字节 DeerFlow 2.0 深度解析:从研究框架到 Super Agent 基础设施的技术跃迁
编程
字节 DeerFlow 2.0 深度解析:从研究框架到 Super Agent 基础设施的技术跃迁
2026-07-05 02:11:57 +0800 CST
view 165
2026年6月字节跳动开源 DeerFlow 2.0,登顶 GitHub Trending。本文从架构设计、五大核心特性、代码实战、性能优化、安全部署等维度全方位深度解析,附完整 Python SDK 使用示例。
AI Agent
Super Agent
DeerFlow
字节跳动
开源项目
LLM
Agent框架
MarkItDown 深度实战:当文档转换遇见LLM友好格式——从多格式解析到MCP集成的生产级完全指南(2026)
编程
MarkItDown 深度实战:当文档转换遇见LLM友好格式——从多格式解析到MCP集成的生产级完全指南(2026)
2026-06-16 04:47:57 +0800 CST
view 345
深度实战微软开源神器MarkItDown:从多格式文档解析到LLM友好Markdown转换,涵盖RAG系统构建、MCP集成、批量处理优化、生产级API服务部署,10000字完整指南。
MarkItDown
文档转换
Markdown
RAG
LLM
MCP
AI Agent
Python
OpenCode 深度解析:157K Star 的开源 AI 编程智能体——如何打造 Claude Code 的完美平替
编程
OpenCode 深度解析:157K Star 的开源 AI 编程智能体——如何打造 Claude Code 的完美平替
2026-05-16 05:45:45 +0800 CST
view 586
深度解析OpenCode——157K Star的开源AI编程智能体,支持75+ LLM提供商,如何成为Claude Code的完美平替
AI编程
开源
OpenCode
Claude Code平替
LLM
Dify v1.15.0 深度解析:difyctl CLI + 思维链可视化,手把手打造生产级 LLM 应用编排引擎
编程
Dify v1.15.0 深度解析:difyctl CLI + 思维链可视化,手把手打造生产级 LLM 应用编排引擎
2026-07-10 18:17:23 +0800 CST
view 203
深度解析 Dify v1.15.0 三大核心更新:difyctl CLI 将 AI 应用纳入 GitOps 管理,思维链可视化让 LLM 推理透明可追溯,慢模型轮询机制解决质量与速度的两难。附完整代码示例与生产部署指南。
Dify
LLM应用
工作流编排
difyctl
思维链可视化
Agent
RAG
GitOps
Kubernetes
生产部署
Obsidian Skills 深度解析:当 Agent Skills 规范让 AI Agent 真正"接管"本地知识库
编程
Obsidian Skills 深度解析:当 Agent Skills 规范让 AI Agent 真正"接管"本地知识库
2026-04-09 07:23:15 +0800 CST
view 1014
深入解析 Obsidian CEO kepano 开源的 obsidian-skills 项目,探讨 Agent Skills 规范如何让 AI Agent 真正理解本地知识库的底层格式,实现从"工具集成"到"知识接管"的范式跃迁。
obsidian
agent-skills
claude-code
知识管理
ai-agent
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
35
36
37
38
39
...
51
下一页