程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
TypeScript 巫师的 21 个 Claude 技能:当 AI 编程从"氛围"走向"工程"
编程
TypeScript 巫师的 21 个 Claude 技能:当 AI 编程从"氛围"走向"工程"
2026-05-06 11:34:54 +0800 CST
view 945
深度解析 Matt Pocock 开源的 21 个 Claude Code Agent Skills,涵盖 TDD、PRD 生成、Git 安全守护等核心技能,探索「知识资产结构化共享」的 AI 原生工程范式。
TypeScript
Claude Code
AI编程
Agent Skills
Matt Pocock
编译器级代码感知:codebase-memory-mcp 如何用 C 语言 + tree-sitter 为 AI Agent 装上「编译器级记忆」
编程
编译器级代码感知:codebase-memory-mcp 如何用 C 语言 + tree-sitter 为 AI Agent 装上「编译器级记忆」
2026-08-01 11:45:06 +0800 CST
view 45
深度拆解 codebase-memory-mcp 架构:tree-sitter AST 解析、混合 LSP 语义增强、SQLite 持久化知识图谱、14 个 MCP 工具设计,以及完整接入 Cursor/Claude Code 的实战指南。
MCP
tree-sitter
AI编程
代码知识图谱
SQLite
VibeVoice 深度解析:微软如何用连续语音Tokenizer和Next-Token Diffusion重塑语音AI边界
编程
VibeVoice 深度解析:微软如何用连续语音Tokenizer和Next-Token Diffusion重塑语音AI边界
2026-04-15 22:19:22 +0800 CST
view 762
深度解析微软VibeVoice开源语音AI全家桶:7.5Hz连续Tokenizer如何压缩60分钟音频,Next-Token Diffusion如何驱动90分钟对话合成,附完整代码实战与性能对比。
VibeVoice
微软
语音AI
ASR
TTS
Diffusion
LLM
万字深度解析 LMCache:当 LLM 推理遇见 KV Cache 革命——从 TTFT 优化到跨引擎 KV 复用、从 GPU/CPU/Disk 三级存储到分布式 P2P 共享的完整技术指南(2026)
编程
万字深度解析 LMCache:当 LLM 推理遇见 KV Cache 革命——从 TTFT 优化到跨引擎 KV 复用、从 GPU/CPU/Disk 三级存储到分布式 P2P 共享的完整技术指南(2026)
2026-07-03 03:14:31 +0800 CST
view 251
深度解析LMCache KV Cache管理层:从TTFT优化原理、GPU/CPU/Disk三级存储架构、跨引擎KV复用、分布式P2P共享,到与vLLM深度集成的生产级部署实战,含完整代码和性能调优指南。
LMCache
LLM推理
KV Cache
vLLM
TTFT优化
GPU优化
AI推理加速
分布式缓存
用 C 语言 + tree-sitter 为 AI 装上编译器级记忆:codebase-memory-mcp 架构深度解析
编程
用 C 语言 + tree-sitter 为 AI 装上编译器级记忆:codebase-memory-mcp 架构深度解析
2026-08-01 11:45:25 +0800 CST
view 39
深度拆解 codebase-memory-mcp 架构:tree-sitter AST 解析、混合 LSP 语义增强、SQLite 持久化知识图谱、14 个 MCP 工具设计,以及完整接入 Cursor/Claude Code 的实战指南。
MCP
tree-sitter
AI编程
代码知识图谱
SQLite
VibeVoice 深度实战:微软开源的 33K Star 语音AI全家桶——从架构设计到生产部署的全链路解析
编程
VibeVoice 深度实战:微软开源的 33K Star 语音AI全家桶——从架构设计到生产部署的全链路解析
2026-05-06 13:01:56 +0800 CST
view 1092
微软开源 VibeVoice 语音AI框架深度解析,33K Star,单次处理60分钟ASR、90分钟TTS、300ms实时生成。
VibeVoice
语音AI
微软
开源
TTS
ASR
实时语音
SGLang 深度实战:新一代 LLM 编程与推理框架——从 RadixAttention 原理到 Agent 系统生产部署
编程
SGLang 深度实战:新一代 LLM 编程与推理框架——从 RadixAttention 原理到 Agent 系统生产部署
2026-05-06 17:37:39 +0800 CST
view 751
深度解析 SGLang 推理框架的 RadixAttention 原理、DSL 编程范式、正则约束解码,以及在 Agent 系统和多轮对话场景的生产部署实践。
SGLang
LLM
推理加速
Agent
RadixAttention
结构化生成
Kimi K3 架构深度解析:从第一性原理吃透 2.8 万亿参数 MoE 模型的三层核心创新
编程
Kimi K3 架构深度解析:从第一性原理吃透 2.8 万亿参数 MoE 模型的三层核心创新
2026-08-01 14:17:55 +0800 CST
view 78
深度解析 Kimi K3 的三大架构创新:KDA 混合线性注意力、Attention Residuals 注意力残差、Stable LatentMoE 分位数均衡路由,从第一性原理配代码示例吃透 2.8 万亿参数 MoE 模型。
Kimi
K3
MoE
KDA
AttnRes
StableLatentMoE
LLM
开源大模型
深入解析 codebase-memory-mcp:让 AI 编程助手真正「看懂」代码库
编程
深入解析 codebase-memory-mcp:让 AI 编程助手真正「看懂」代码库
2026-07-26 09:44:32 +0800 CST
view 186
深入解析 GitHub 10K+ Stars 的 codebase-memory-mcp 项目:用 tree-sitter + 知识图谱为 AI 编程助手构建持久化代码记忆,让 Claude Code、Cursor 等工具真正「看懂」代码库结构。
AI编程助手
codebase-memory-mcp
MCP
代码知识图谱
AI Agent
tree-sitter
OmniVoice Studio:5k Star开源声音克隆工具,646种语言,无GPU也能跑
编程
OmniVoice Studio:5k Star开源声音克隆工具,646种语言,无GPU也能跑
2026-05-28 20:50:27 +0800 CST
view 813
OmniVoice Studio是5k Star全本地运行ElevenLabs开源替代方案,支持零样本声音克隆、646种语言、无GPU也能跑(最低4GB内存),跨平台桌面客户端,支持MCP。
声音克隆
开源
TTS
AI音频
OmniVoice
语音合成
多语言
CosyVoice
MCP
LLM推理引擎深度实战:从PagedAttention到生产级部署,万字长文吃透2026年最关键的AI基础设施
编程
LLM推理引擎深度实战:从PagedAttention到生产级部署,万字长文吃透2026年最关键的AI基础设施
2026-06-27 12:44:29 +0800 CST
view 319
2026年LLM推理引擎深度实战:从PagedAttention、连续批处理、量化技术到生产级K8s部署,万字长文覆盖vLLM、SGLang、TensorRT-LLM、TGI四大框架架构原理与实测对比
LLM推理
vLLM
PagedAttention
SGLang
推理优化
TensorRT-LLM
生产部署
KV Cache
量化
CodeGraph 深度实战:当 AI 编程助手拥有「代码记忆」——从预索引知识图谱到跨语言调用链追踪的生产级完全指南(2026)
编程
CodeGraph 深度实战:当 AI 编程助手拥有「代码记忆」——从预索引知识图谱到跨语言调用链追踪的生产级完全指南(2026)
2026-06-06 08:37:32 +0800 CST
view 630
CodeGraph深度实战:从预索引知识图谱架构到跨语言调用链追踪,7个真实项目基准测试Token减少47%,工具调用减少58%,20+语言支持,14种框架路由检测,100%本地运行
CodeGraph
AI编程
知识图谱
MCP
代码索引
Tree-sitter
Claude Code
Cursor
KV Cache 显存优化深度解析:从 PagedAttention 到 2026 年最新压缩技术演进
编程
KV Cache 显存优化深度解析:从 PagedAttention 到 2026 年最新压缩技术演进
2026-08-01 15:47:00 +0800 CST
view 43
从第一性原理深度剖析 KV Cache 显存困境,系统拆解 PagedAttention 核心原理,对比 vLLM/TensorRT-LLM/SGLang 三大推理框架技术路线,涵盖 FP8/INT4 量化、前缀缓存、StreamingLLM 等 2026 年最新压缩技术,含完整代码示例与生产调优指南。
KV Cache
PagedAttention
vLLM
TensorRT-LLM
SGLang
LLM推理
GPU优化
显存优化
量化
深度学习
MOSS-TTS-Nano:0.1B 参数的开源语音模型,CPU 直跑,浏览器里都能用
编程
MOSS-TTS-Nano:0.1B 参数的开源语音模型,CPU 直跑,浏览器里都能用
2026-04-25 08:17:20 +0800 CST
view 1342
MOSS-TTS-Nano 是模思智能和OpenMOSS团队开源的0.1B参数超小语音合成模型,支持纯CPU推理、ONNX加速、20种语言、零样本语音克隆、流式输出48kHz立体声,还有浏览器插件可直接在Chrome中使用。
AI
开源
语音合成
TTS
MOSS
ECMAScript 2026 深度解析:从 Temporal API 到 using 声明,一场改变 JavaScript 未来的语言革命
编程
ECMAScript 2026 深度解析:从 Temporal API 到 using 声明,一场改变 JavaScript 未来的语言革命
2026-06-27 14:43:49 +0800 CST
view 317
ECMAScript 2026引入using声明、Temporal API、Pattern Matching、Records Tuples等重大新特性。本文深度解析这些将改变JavaScript未来的语言变革,配完整代码示例。
ECMAScript 2026
Temporal API
using
Pattern Matching
JavaScript
前端
TypeScript
Node.js
2.8万亿参数、896专家、1M上下文:Kimi K3技术架构深度解析与工程能力全面评估
编程
2.8万亿参数、896专家、1M上下文:Kimi K3技术架构深度解析与工程能力全面评估
2026-07-21 18:15:42 +0800 CST
view 247
深度解析 Kimi K3 的 Stable LatentMoE 稀疏架构、KDA 混合线性注意力、Attention Residuals 跨层检索机制,评估其在软件工程任务(前端编程、芯片设计)中的实际能力,对比 DeepSeek V4、GLM-5.2、Claude Fable 5 等竞品
Kimi K3
MoE
Stable LatentMoE
KDA
Attention Residuals
长上下文
开源大模型
百万token
code-review-graph 深度解析:AI 编码助手的「大脑地图」,让代码审查不再烧 Token
编程
code-review-graph 深度解析:AI 编码助手的「大脑地图」,让代码审查不再烧 Token
2026-07-22 00:16:38 +0800 CST
view 247
深度解析 code-review-graph:如何用 Tree-sitter 构建代码知识图谱,通过 MCP 协议让 AI 编码助手精准读取上下文,平均减少 138.2 倍 Token 消耗,实测成本节省 98.8%。
code-review-graph
AI编程
知识图谱
MCP
Tree-sitter
Token优化
代码审查
Claude Code
Cursor
vLLM 深度拆解:当 KV Cache 学会「分页」——用操作系统智慧重写 LLM 推理的心智模型
编程
vLLM 深度拆解:当 KV Cache 学会「分页」——用操作系统智慧重写 LLM 推理的心智模型
2026-07-15 10:13:07 +0800 CST
view 176
深度拆解 vLLM 核心架构:从 PagedAttention 分页内存管理、Continuous Batching 动态调度,到 Speculative Decoding、Prefix Caching 等高级特性,配完整代码示例与生产部署指南。
vLLM
PagedAttention
LLM推理
深度学习
GPU优化
Continuous Batching
FinceptTerminal 深度实战:当 C++20 遇上金融终端——从 Qt6 原生渲染到 37 个 AI 智能体与 QuantLib 量化引擎的生产级完全指南(2026)
编程
FinceptTerminal 深度实战:当 C++20 遇上金融终端——从 Qt6 原生渲染到 37 个 AI 智能体与 QuantLib 量化引擎的生产级完全指南(2026)
2026-06-14 22:28:06 +0800 CST
view 473
开源金融终端 Fincept Terminal v4 深度实战:C++20 原生渲染、37 个 AI 投资智能体、QuantLib 18 模块量化引擎、100+ 数据源、16 家券商接入
FinceptTerminal
C++20
Qt6
金融终端
量化交易
AI智能体
QuantLib
开源金融
基于 Go + Gin 框架开发 PMSM 风机监测系统:Flutter + Go + C# 全栈开源方案
编程
基于 Go + Gin 框架开发 PMSM 风机监测系统:Flutter + Go + C# 全栈开源方案
2026-06-20 08:48:36 +0800 CST
view 326
开源PMSM风机监测系统,采用Flutter+Go+C#全栈架构。Go+Gin提供HTTP服务与TCP Socket监听,Flutter负责Windows桌面UI,C#上位机网关连接串口硬件。支持8风机演示模式、WebSocket实时推送、远程控制、OTA更新。
Go
Gin
Flutter
PMSM
风机监测
工业物联网
开源项目
C#
WinCC
上位机
vLLM 深度实战:当 LLM 推理遇上 PagedAttention——从 KV 缓存管理到生产级高并发服务的完全指南(2026)
编程
vLLM 深度实战:当 LLM 推理遇上 PagedAttention——从 KV 缓存管理到生产级高并发服务的完全指南(2026)
2026-06-08 22:52:24 +0800 CST
view 659
深度解析vLLM推理框架的核心原理、PagedAttention创新机制、分布式推理架构,以及生产环境部署的最佳实践。
vLLM
PagedAttention
LLM推理
KV缓存
分布式推理
2026 年 vLLM 推理服务实战:PagedAttention 原理、分布式部署与性能调优完全指南
编程
2026 年 vLLM 推理服务实战:PagedAttention 原理、分布式部署与性能调优完全指南
2026-06-08 22:53:03 +0800 CST
view 398
深度解析vLLM推理框架的核心原理、PagedAttention创新机制、分布式推理架构,以及生产环境部署的最佳实践。
vLLM
PagedAttention
LLM推理
KV缓存
分布式推理
Flutter 3.44 万字深度解析:当跨平台框架遇见 AI 原生时代——Agentic Hot Reload × HCPP × SwiftPM × GenKit,从 I/O 2026 到生产级迁移的完整技术指南
编程
Flutter 3.44 万字深度解析:当跨平台框架遇见 AI 原生时代——Agentic Hot Reload × HCPP × SwiftPM × GenKit,从 I/O 2026 到生产级迁移的完整技术指南
2026-07-03 15:44:39 +0800 CST
view 700
深度解析 Flutter 3.44(I/O 2026)全部重磅更新:Material/Cupertino 解耦、Agentic Hot Reload、HCPP Vulkan 渲染、SwiftPM 取代 CocoaPods、Genkit Dart、Gemma 4 本地推理、GenUI 生成式界面、AGP 9 迁移,含完整代码示例与生产迁移指南
Flutter
Dart
跨平台
移动开发
AI编程
Google I/O
Vulkan
2026年AI架构突破全景解析:从 Kimi Attention Residuals 到存算一体——告别参数内卷,走向效率革命
编程
2026年AI架构突破全景解析:从 Kimi Attention Residuals 到存算一体——告别参数内卷,走向效率革命
2026-05-30 09:40:11 +0800 CST
view 711
深度解析2026年AI架构五大突破:Attention Residuals、存算一体、多模态原生、自我学习、量子AI,从算法到硬件全方位革新
AI架构
Attention Residuals
存算一体
量子AI
多模态原生
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
12
13
14
15
16
...
40
下一页