程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
OpenSpec:AI编程助手的规范驱动开发框架,比Spec Kit更轻量
编程
OpenSpec:AI编程助手的规范驱动开发框架,比Spec Kit更轻量
2026-05-23 15:18:15 +0800 CST
view 653
OpenSpec是规范驱动开发(SDD)框架,为AI编程助手提供轻量级spec层,流动式迭代、支持20+AI工具、比Spec Kit更轻量、比Kiro更开放,MIT开源。
AI编程
OpenSpec
规范驱动
SDD
Claude Code
Codex
slash命令
SGLang 深度解析:RadixAttention 如何重塑大模型推理的「结构化革命」
编程
SGLang 深度解析:RadixAttention 如何重塑大模型推理的「结构化革命」
2026-06-30 11:16:18 +0800 CST
view 342
深度解析 SGLang 大模型推理框架:RadixAttention 前缀缓存、零开销 CPU 调度器、结构化输出约束、推测解码、PD 分离等核心技术,对比 vLLM/TensorRT-LLM 选型,提供完整代码示例与生产级部署实践
SGLang
大模型推理
RadixAttention
前缀缓存
结构化输出
推测解码
PD分离
vLLM
TensorRT-LLM
LLM推理引擎终极对决:vLLM vs TensorRT-LLM深度解析与2026生产环境选型指南
编程
LLM推理引擎终极对决:vLLM vs TensorRT-LLM深度解析与2026生产环境选型指南
2026-04-20 13:45:31 +0800 CST
view 921
深度对比vLLM与TensorRT-LLM两大LLM推理框架,从PagedAttention到Kernel Fusion,从量化技术到生产部署,助你做出正确的技术选型决策
LLM
vLLM
TensorRT-LLM
推理优化
大模型部署
量化技术
AI工程
SGLang 深度解析:RadixAttention 前缀缓存与结构化 LLM 推理革命——从 RAG/Agent 场景到生产级部署的完整指南
编程
SGLang 深度解析:RadixAttention 前缀缓存与结构化 LLM 推理革命——从 RAG/Agent 场景到生产级部署的完整指南
2026-06-30 11:17:15 +0800 CST
view 413
深度解析 SGLang 大模型推理框架:RadixAttention 前缀缓存、零开销 CPU 调度器、结构化输出约束、推测解码、PD 分离等核心技术,对比 vLLM/TensorRT-LLM 选型,提供完整代码示例与生产级部署实践
SGLang
大模型推理
RadixAttention
前缀缓存
结构化输出
推测解码
PD分离
vLLM
TensorRT-LLM
Unsloth 深度实战:从 Triton 内核优化到 70% 显存压缩——2026 年 LLM 本地微调的工业级完全指南
编程
Unsloth 深度实战:从 Triton 内核优化到 70% 显存压缩——2026 年 LLM 本地微调的工业级完全指南
2026-05-23 20:00:37 +0800 CST
view 577
深度剖析 Unsloth 如何通过手写 Triton 内核、智能显存管理和 LoRA/QLoRA 优化,实现训练速度 2-5 倍提升、显存占用降低 70% 的技术奇迹。
LLM
微调
Unsloth
LoRA
深度学习
Headroom 深度实战:当 Netflix 工程师用「上下文压缩」掀翻 AI 成本底牌——从 CCR 可逆机制到跨 Agent 记忆的生产级完全指南(2026)
编程
Headroom 深度实战:当 Netflix 工程师用「上下文压缩」掀翻 AI 成本底牌——从 CCR 可逆机制到跨 Agent 记忆的生产级完全指南(2026)
2026-06-11 15:20:19 +0800 CST
view 738
Netflix工程师开源的AI上下文压缩工具Headroom,能在保持答案质量的前提下将Token消耗压缩60-95%,累计节省70万美元成本。本文深度剖析其架构设计、CCR可逆机制、跨Agent记忆共享与生产级集成实践。
AI编程
Token压缩
上下文管理
LLM优化
OpenSource
Kimi K2.7 Code 深度解析:万亿参数 MoE 编程模型如何用 MLA 注意力和反过度思考机制成为 GitHub Copilot 首个开源模型——从架构设计到生产部署的完整实战指南
编程
Kimi K2.7 Code 深度解析:万亿参数 MoE 编程模型如何用 MLA 注意力和反过度思考机制成为 GitHub Copilot 首个开源模型——从架构设计到生产部署的完整实战指南
2026-07-06 12:13:00 +0800 CST
view 497
深度解析月之暗面Kimi K2.7 Code:1.1万亿参数MoE架构、MLA多头潜在注意力、384专家动态路由、token消耗降30%、MCP Mark Verified 81.1分反超Opus 4.8。GitHub Copilot首个开源模型,含完整API接入与本地部署实战。
Kimi K2.7 Code
MoE
MLA
GitHub Copilot
开源模型
编程模型
月之暗面
Moonshot AI
Openship 深度拆解:桌面控制平面 + 零 YAML,自托管部署平台的新范式
编程
Openship 深度拆解:桌面控制平面 + 零 YAML,自托管部署平台的新范式
2026-07-24 19:44:05 +0800 CST
view 297
深度拆解 GitHub Trending 开源项目 Openship:桌面控制平面的安全创新、零配置栈检测原理、内置邮件/CDN/备份的全家桶设计、MCP 原生 AI Agent 接口,以及与 Coolify/Dokploy/Kamal 的横向选型对比。
Openship
自托管
CI/CD
部署平台
Docker
DevOps
MCP
开源
Vercel替代
PaaS
2026大模型推理框架终极对决:vLLM 0.5 vs TGI 2.0 vs TensorRT-LLM 1.8 vs DeepSpeed-MII 0.9——谁才是生产级部署的真正王者?
编程
2026大模型推理框架终极对决:vLLM 0.5 vs TGI 2.0 vs TensorRT-LLM 1.8 vs DeepSpeed-MII 0.9——谁才是生产级部署的真正王者?
2026-06-23 08:22:26 +0800 CST
view 600
深度对比2026年四大主流大模型推理框架:vLLM 0.5、TGI 2.0、TensorRT-LLM 1.8、DeepSpeed-MII 0.9,从核心架构、性能压测、成本分析到代码实战的完全指南。
vLLM
TensorRT-LLM
大模型推理
性能优化
DeepSpeed
TGI
Bun 用 Claude 11天完成 Zig → Rust 全量重写:代码、哲学与工程权衡的完整复盘
编程
Bun 用 Claude 11天完成 Zig → Rust 全量重写:代码、哲学与工程权衡的完整复盘
2026-07-19 12:44:49 +0800 CST
view 255
深度拆解 Bun 从 Zig 到 Rust 的 11 天 AI 驱动全量重写:96 万行代码、64 个 Claude 并行、16,000 个编译器错误的工程全貌,配真实 Bug 案例与性能数据
Bun
Zig
Rust
AI编程
Claude
语言迁移
性能优化
unsafe
内存安全
TypeScript
Kimi K2.6 开源:12小时连续编码,300个Agent并行,4000次工具调用
编程
Kimi K2.6 开源:12小时连续编码,300个Agent并行,4000次工具调用
2026-04-21 11:06:57 +0800 CST
view 808
Kimi K2.6 开源版发布:SWE-Bench Pro 58.6,多项榜单压GPT-5.4和Claude Opus 4.6,支持300个并行sub-agent、12小时持续编码、4000次工具调用,开源SOTA位置稳固
Kimi
K2.6
开源
SWE-Bench
Agent
Swarm
长程编码
AI编程
模型开源
HuggingFace
Moonshot
Bun 从 Zig 到 Rust 的百万行重写:当 AI 用 9 天改写 JavaScript 运行时的命运
编程
Bun 从 Zig 到 Rust 的百万行重写:当 AI 用 9 天改写 JavaScript 运行时的命运
2026-08-06 01:46:57 +0800 CST
view 111
深度拆解Bun从Zig到Rust的百万行代码重写:Claude Code 9天生成100万行Rust代码、99.8%测试通过率背后超万个unsafe代码块的安全争议、性能基准测试对比、AI重写基础设施的范式转移
Bun
Rust
Zig
JavaScript运行时
AI编程
内存安全
Claude Code
unsafe
Anthropic
前端工具链
Chrome DevTools MCP 深度解析:Google 官方 45K Stars 的 AI 浏览器调试协议如何让编码 Agent 掌控 Console、Network、Performance 全链路——从 MCP 协议架构到生产级前端调试工作流的完整实战指南
编程
Chrome DevTools MCP 深度解析:Google 官方 45K Stars 的 AI 浏览器调试协议如何让编码 Agent 掌控 Console、Network、Performance 全链路——从 MCP 协议架构到生产级前端调试工作流的完整实战指南
2026-07-07 01:12:47 +0800 CST
view 351
深度解析Google官方开源的Chrome DevTools MCP:45K+ Stars,通过MCP协议将Chrome DevTools的完整调试能力暴露给AI编码Agent。从协议架构、10大类40+工具清单、与Playwright MCP对比到WebMCP下一代标准。
Chrome DevTools
MCP
AI Agent
浏览器调试
Google
Console
Performance
前端开发
开源
wrkflw 深度解析:告别「fix ci」无限循环——本地运行 GitHub Actions 的完整技术内幕
编程
wrkflw 深度解析:告别「fix ci」无限循环——本地运行 GitHub Actions 的完整技术内幕
2026-05-17 23:47:51 +0800 CST
view 592
wrkflw深度解析:如何用Rust打造的CLI工具在本地运行GitHub Actions,告别fix ci无限循环
GitHub Actions
CI/CD
Rust
DevOps
wrkflw
2026 LLM 推理框架深度拆解:当 vLLM 0.5 决定「让 PagedAttention 吞掉最后一块显存碎片」——从 PagedAttention 到 FlashAttention 3.0,四大推理框架如何用「算子融合 + 量化混合 + 动态批处理」重新定义大模型推理的终极形态
编程
2026 LLM 推理框架深度拆解:当 vLLM 0.5 决定「让 PagedAttention 吞掉最后一块显存碎片」——从 PagedAttention 到 FlashAttention 3.0,四大推理框架如何用「算子融合 + 量化混合 + 动态批处理」重新定义大模型推理的终极形态
2026-08-06 06:16:32 +0800 CST
view 127
深度拆解2026年四大主流LLM推理框架:vLLM 0.5 PagedAttention进化、TGI 2.0流式输出优化、TensorRT-LLM 1.8算子融合、DeepSpeed-MII 0.9自动优化,含完整架构分析、代码实战、性能基准测试与成本计算
LLM
vLLM
TensorRT-LLM
推理框架
PagedAttention
量化
GPU
H100
大模型
DeepSpeed
TGI
Ghostty + Zig 2026:HashiCorp联合创始人造了个不用Electron的终端,Rust的性能神话要被打破了?
编程
Ghostty + Zig 2026:HashiCorp联合创始人造了个不用Electron的终端,Rust的性能神话要被打破了?
2026-06-25 23:48:00 +0800 CST
view 676
2026年最值得关注的技术事件之一:HashiCorp联合创始人Mitchell Hashimoto用Zig语言打造的Ghostty终端模拟器,完全绕过Electron,GPU加速渲染,内存占用接近系统原生终端。本文深度解析Ghostty架构设计、Zig语言技术优势、2026年Zig生态全景,以及系统级编程语言选型指南。
Zig
Ghostty
终端模拟器
Rust
系统编程
2026
OpenSource
高性能
当 AI 用 6 天重构了互联网的 JavaScript 运行时:Bun 的 Zig → Rust 迁移完整复盘
编程
当 AI 用 6 天重构了互联网的 JavaScript 运行时:Bun 的 Zig → Rust 迁移完整复盘
2026-07-01 16:45:22 +0800 CST
view 320
2026年5月,Bun在6天内由Claude Code完成了96万行代码从Zig到Rust的迁移。本文深度复盘技术内幕:多Agent协作流水线、99.8%测试通过率的真正含义、13000个unsafe代码块背后的安全真相,以及AI编程时代代码信任体系的建立。
Bun
Rust
Zig
AI编程
Claude Code
代码迁移
内存安全
unsafe
JavaScript运行时
编程工具
Moonshine 深度解剖:27M 参数挑战 Whisper——可变长度推理、RoPE 与毫秒级流式延迟的边缘 ASR 工程真相
编程
Moonshine 深度解剖:27M 参数挑战 Whisper——可变长度推理、RoPE 与毫秒级流式延迟的边缘 ASR 工程真相
2026-07-25 13:44:10 +0800 CST
view 153
深度拆解 Moonshine 边缘端语音识别模型:可变长度推理如何免除 Whisper 的 30 秒填充税、RoPE 与卷积波形前端的架构决策、34ms 流式延迟原理,附 Python/ONNX/浏览器三条部署路线与量化调优实战。
Moonshine
语音识别
ASR
Whisper
边缘计算
RoPE
ONNX
INT8量化
流式识别
开源
Qdrant 向量数据库深度实战:从 HNSW 索引、标量量化到混合检索与 RAG 生产落地的完整工程指南(2026)
编程
Qdrant 向量数据库深度实战:从 HNSW 索引、标量量化到混合检索与 RAG 生产落地的完整工程指南(2026)
2026-07-20 07:13:11 +0800 CST
view 236
2026 年 Qdrant 向量数据库深度实战:从 HNSW 索引、标量量化、稠密/稀疏/多向量到混合检索与生产级 RAG 落地的完整工程指南,附可运行代码。
Qdrant
向量数据库
RAG
混合检索
HNSW
标量量化
Embedding
BGE-M3
我和 Claude Code 聊了 605 句,直到运行 /insights 才发现一直在做无用功
案例
我和 Claude Code 聊了 605 句,直到运行 /insights 才发现一直在做无用功
2026-05-04 23:01:37 +0800 CST
view 664
通过Claude Code的/insights命令复盘一个月的AI编程会话,发现错误模式,优化CLAUDE.md和自定义Skills,显著提升开发效率
Claude Code
insights
CLAUDE.md
效率优化
自定义Skills
AI编程
OceanBase 湖库一体 AI数据库深度实战:当「湖」的灵活遇上「库」的一致,一次把国产 AI 数据库架构讲透(2026)
编程
OceanBase 湖库一体 AI数据库深度实战:当「湖」的灵活遇上「库」的一致,一次把国产 AI 数据库架构讲透(2026)
2026-07-13 17:45:29 +0800 CST
view 236
深度拆解OceanBase 2026湖库一体AI数据库架构:从行存列存统一存储、内置VECTOR类型向量检索、生产级AI Agent数据底座实战,到性能对比与避坑指南,配完整SQL与Python代码。
OceanBase
湖库一体
AI数据库
向量检索
HNSW
国产数据库
分布式数据库
RAG
OLAP
OLTP
Rust + WiFi CSI + DensePose:RuView 如何用「感知无线电」重构人体姿态估计的技术全貌
编程
Rust + WiFi CSI + DensePose:RuView 如何用「感知无线电」重构人体姿态估计的技术全貌
2026-08-08 16:15:32 +0800 CST
view 113
深度拆解 RuView:Rust + WiFi CSI + DensePose 的端到端姿态估计方案。从 CSI 物理信号模型、多径分离算法、Rust 54,000 FPS 信号处理核心、神经网络推理管道到实战部署与性能评估,覆盖完整技术栈。
Rust
WiFi
CSI
姿态估计
DensePose
AI感知
信号处理
隐私计算
GitHub Agentic Workflows 深度实战:用自然语言 Markdown 重写 CI/CD——GitHub 官方 AI 工作流引擎完全指南(2026)
编程
GitHub Agentic Workflows 深度实战:用自然语言 Markdown 重写 CI/CD——GitHub 官方 AI 工作流引擎完全指南(2026)
2026-06-04 20:46:11 +0800 CST
view 770
GitHub 官方 AI Agentic Workflows (gh-aw) 完全指南:用自然语言 Markdown 替代 YAML,实现 Issue 分类、PR 审查、Changelog 自动化,含安全模型深度解析和生产级实战代码。
GitHub Agentic Workflows
gh-aw
GitHub Actions
AI Agent
CI/CD
自然语言编程
LLaDA2.2 深度拆解:全球首个大规模 Agentic 扩散模型——Levenshtein 编辑 + L-EBPO 如何打破自回归垄断
编程
LLaDA2.2 深度拆解:全球首个大规模 Agentic 扩散模型——Levenshtein 编辑 + L-EBPO 如何打破自回归垄断
2026-07-31 10:46:00 +0800 CST
view 138
全球首个大规模 Agentic 扩散模型深度拆解,详解 Levenshtein 编辑范式、L-EBPO 强化学习算法与 BlockRouting 128K 长上下文工程实践,对比自回归模型 Agent 能力评测。
扩散语言模型
Agentic AI
Levenshtein编辑
L-EBPO
蚂蚁集团
MoE架构
128K上下文
开源模型
AI Agent
强化学习
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
13
14
15
16
17
...
83
下一页