程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
万字深度解析 NVIDIA Blackwell 架构:当 GPU 编程遇见「Tile 抽象革命」——从 CUDA 13.1 Python 内核生成到 Blackwell Ultra 30 倍推理加速的完整技术指南(2026)
编程
万字深度解析 NVIDIA Blackwell 架构:当 GPU 编程遇见「Tile 抽象革命」——从 CUDA 13.1 Python 内核生成到 Blackwell Ultra 30 倍推理加速的完整技术指南(2026)
2026-07-02 07:45:18 +0800 CST
view 335
深度解析 NVIDIA Blackwell GPU 架构与 CUDA 13.1 Tile 编程模型,涵盖 FP4 量化、Tensor Core v5、NVLink 5.0、DeepSeek V4 推理优化等核心技术,提供完整 Python 实战代码。
Blackwell
CUDA
GPU编程
AI推理
性能优化
深度学习
并行计算
NVIDIA
量化
Tensor Core
FFmpeg 9.0「Lei」深度拆解:当音视频框架决定把滤镜链整个搬进 GPU——Vulkan 统一计算层、SMPTE 2094-50 元数据透传与 ONNX Runtime DNN 后端的三条暗线
编程
FFmpeg 9.0「Lei」深度拆解:当音视频框架决定把滤镜链整个搬进 GPU——Vulkan 统一计算层、SMPTE 2094-50 元数据透传与 ONNX Runtime DNN 后端的三条暗线
2026-08-09 04:19:53 +0800 CST
view 95
深度拆解 FFmpeg 9.0「Lei」:媒体只报道了动画WebP和代号故事,但5.2万行代码背后是三条架构主线——Vulkan compute 统一硬件加速层、ST 2094-50 元数据全链路透传、ONNX Runtime GPU 后端让AI推理进入滤镜图。含滤镜链PCIe往返三层验证、元数据diff脚本、七条调优规律与十条踩坑清单。
FFmpeg
Vulkan
音视频
硬件加速
HDR
ONNX Runtime
滤镜链
CUDA
编解码
性能优化
RAG-Anything:港大开源多模态文档 RAG 框架,让 AI 真正读懂图、表、公式
编程
RAG-Anything:港大开源多模态文档 RAG 框架,让 AI 真正读懂图、表、公式
2026-07-14 11:37:51 +0800 CST
view 314
RAG-Anything是香港大学开源的All-in-One多模态文档RAG框架(基于LightRAG),文本/图像/表格/LaTeX公式统一为知识实体,多模态知识图谱双图结构,跨模态混合检索,金融研报/法律合同/科研文献/制造质检开箱即用。
RAG
RAG-Anything
LightRAG
多模态
知识图谱
VLM
RAG框架
开源
HKUDS
DwarfStar 深度解析:antirez 的 DeepSeek V4 Flash 本地推理引擎——Metal 与 CUDA 双轨优化革命(2026 完全指南)
编程
DwarfStar 深度解析:antirez 的 DeepSeek V4 Flash 本地推理引擎——Metal 与 CUDA 双轨优化革命(2026 完全指南)
2026-05-28 19:13:18 +0800 CST
view 647
DwarfStar(ds4)是Redis创始人antirez开发的DeepSeek V4 Flash专用推理引擎,支持Metal与CUDA双轨优化、磁盘KV Cache、imatrix量化和原生Agent集成。本文深入解析其架构设计与性能表现。
DeepSeek
ds4
Metal
CUDA
本地推理
MoE
量化
GGUF
Agent
Python
C
DeepTutor 深度解剖:港大 HKUDS 的「终身个性化导师」——统一 Agent 运行时、四引擎 RAG 与双循环解题的工程真相
编程
DeepTutor 深度解剖:港大 HKUDS 的「终身个性化导师」——统一 Agent 运行时、四引擎 RAG 与双循环解题的工程真相
2026-07-26 08:16:13 +0800 CST
view 261
深度拆解港大HKUDS开源的终身个性化导师DeepTutor:六大工作流共享统一Agent运行时、LlamaIndex/PageIndex/GraphRAG/LightRAG四引擎可插拔知识库、双循环解题与逐步验证、SKILL.md技能子系统与EduHub生态,附Docker部署与自部署避坑清单。
DeepTutor
HKUDS
AI Agent
RAG
LightRAG
多智能体
AI教育
知识库
MCP
开源
DFlash 深度解析:块扩散模型如何让 LLM 推理加速 6 倍——2026 投机解码完全指南
编程
DFlash 深度解析:块扩散模型如何让 LLM 推理加速 6 倍——2026 投机解码完全指南
2026-05-28 19:39:07 +0800 CST
view 912
深入解析 DFlash 块扩散投机解码方案:如何让 Qwen3-8B 实现 6 倍无损加速,超越 EAGLE-3 与 llama.cpp,附 SGLang/vLLM/MLX 完整部署指南。
LLM推理
投机解码
块扩散
DFlash
推理加速
Transformer优化
GPU
CUDA
SGLang
vLLM
RAG-Anything 深度实战:港大开源全模态 RAG 框架,让知识库真正看懂图片、表格和公式
编程
RAG-Anything 深度实战:港大开源全模态 RAG 框架,让知识库真正看懂图片、表格和公式
2026-04-25 00:31:11 +0800 CST
view 840
深度解析港大开源RAG-Anything框架:从多模态文档解析到跨模态知识图谱构建,包含完整代码实战、自定义模态处理器开发、性能优化与生产部署指南
RAG
多模态
知识图谱
HKUDS
LightRAG
MinerU
VLM
文档理解
AI编程Agent用10小时凿开CUDA护城河:推理战场的底层软件革命与程序员的真实机遇
编程
AI编程Agent用10小时凿开CUDA护城河:推理战场的底层软件革命与程序员的真实机遇
2026-08-10 14:47:15 +0800 CST
view 104
深度拆解AI编程Agent用10小时为非英伟达芯片搭建底层软件栈的事件:从CUDA三层架构本质、Infinity Ignition Agent原理、推理战场竞争格局、到验证生态护城河,结合DeepSeek TileLang路径对比,给出程序员视角的机遇分析。
CUDA
AI Agent
推理芯片
Infinity
Ignition
d-Matrix
底层软件
GPU Kernel
芯片适配
护城河
Vibe-Trading 深度拆解:当 LLM 学会「炒股」——自然语言量化交易的多智能体架构与工程实践
编程
Vibe-Trading 深度拆解:当 LLM 学会「炒股」——自然语言量化交易的多智能体架构与工程实践
2026-07-15 11:45:26 +0800 CST
view 623
深度拆解港大HKUDS开源的Vibe-Trading项目:ReAct循环驱动的自然语言量化交易Agent、69个金融技能按需加载、30个多智能体Swarm团队、四大市场回测引擎、456个Alpha因子库,以及Shadow Account行为诊断功能,配完整代码示例与工程边界分析。
Vibe-Trading
LLM
量化交易
多智能体
ReAct
金融科技
HKUDS
Alpha Zoo
Shadow Account
bpftime for GPU 深度实战:将 eBPF 带进 GPU Kernel 内部——从 PTX 级插桩到线程级可观测性的全链路架构解析
编程
bpftime for GPU 深度实战:将 eBPF 带进 GPU Kernel 内部——从 PTX 级插桩到线程级可观测性的全链路架构解析
2026-05-07 10:07:31 +0800 CST
view 702
深入解析 bpftime for GPU 如何将 eBPF 的可编程观测能力带入 GPU Kernel 内部,实现 PTX 级插桩、per-thread 粒度观测和零拷贝数据回传,为 AI 训练和高性能计算提供全新的调试与分析范式。
eBPF
GPU
CUDA
PTX
可观测性
性能优化
sqlh:Go 语言零样板 SQL 库,结构体标签生成 CRUD,50 行搞定
编程
sqlh:Go 语言零样板 SQL 库,结构体标签生成 CRUD,50 行搞定
2026-07-09 07:57:04 +0800 CST
view 253
Go语言零样板SQL库sqlh,结构体标签自动生成CRUD,泛型类型安全,自动事务,SQLite/MySQL/PostgreSQL支持,约200KB,115行→50行缩减57%。
Go
SQL
ORM
sqlx
GORM
CRUD
数据库
SQLite
泛型
开源
DuckDB 1.5 + Sirius:GPU加速嵌入式分析数据库的性能革命
编程
DuckDB 1.5 + Sirius:GPU加速嵌入式分析数据库的性能革命
2026-04-08 14:42:27 +0800 CST
view 1150
深度解析DuckDB 1.5新特性与Sirius GPU加速扩展,涵盖ExtensionKit、ClickBench基准测试、性能优化与实战指南
DuckDB
Sirius
GPU
数据分析
NVIDIA
cuDF
DeepTutor深度解析:港大HKUDS开源的Agent-Native个性化学习系统,如何用双环推理架构让AI真正懂你在学什么
编程
DeepTutor深度解析:港大HKUDS开源的Agent-Native个性化学习系统,如何用双环推理架构让AI真正懂你在学什么
2026-04-17 18:13:26 +0800 CST
view 1770
港大HKUDS开源的DeepTutor深度解析,探讨其Agent-Native架构、双环协同推理机制、代码实战与未来展望
AI教育
Agent
DeepTutor
HKUDS
Python
Khal 深度实战:一次编写,跨越 WebGPU、CUDA 与 CPU 的 GPU 通用计算新范式(2026)
编程
Khal 深度实战:一次编写,跨越 WebGPU、CUDA 与 CPU 的 GPU 通用计算新范式(2026)
2026-06-15 11:46:16 +0800 CST
view 578
Khal(Kompute Hardware Abstraction Layer)是 Rust 生态的跨平台 GPU 硬件抽象层,让开发者用一门语言编写一次计算着色器,即可部署到 WebGPU、CUDA 和 CPU 所有目标平台。本文深入解析其架构设计、编译流程、标准库与实战代码示例。
Rust
GPU
WebGPU
CUDA
高性能计算
图形编程
OmniVoice 深度实战:当小米 k2-fsa 团队用扩散语言模型重塑语音合成——从零样本克隆到 600 语言高保真 TTS 的生产级完全指南(2026)
编程
OmniVoice 深度实战:当小米 k2-fsa 团队用扩散语言模型重塑语音合成——从零样本克隆到 600 语言高保真 TTS 的生产级完全指南(2026)
2026-06-15 14:21:23 +0800 CST
view 686
深入解析小米 k2-fsa 团队开源的 OmniVoice 单阶段扩散语言模型 TTS 系统,0.8B 参数支持 600+ 语言,零样本克隆仅需 3-10 秒参考音频,RTF 低至 0.025,Apache-2.0 免费商用。
TTS
语音合成
OmniVoice
k2-fsa
扩散模型
零样本克隆
多语言
MachineLearning
Audio
小米
ds4 深度解析:Redis 作者的最后一战?—— DwarfStar 4 本地推理引擎的技术革命
编程
ds4 深度解析:Redis 作者的最后一战?—— DwarfStar 4 本地推理引擎的技术革命
2026-05-15 17:47:40 +0800 CST
view 976
深入解析 antirez(Redis 作者)新开源项目 ds4:DwarfStar 4 本地推理引擎,专门为 DeepSeek V4 Flash 打造,支持 Metal/CUDA 后端,2-bit 量化可在 96GB 内存 MacBook 上运行 284B 参数模型。
AI推理
本地部署
DeepSeek
Redis
Apple Silicon
CUDA
Metal
MoE
量化
VoxCPM2 深度拆解:当语音合成决定杀死分词器——从 Tokenizer-Free 架构到 48kHz 高保真克隆的全链路工程革命
编程
VoxCPM2 深度拆解:当语音合成决定杀死分词器——从 Tokenizer-Free 架构到 48kHz 高保真克隆的全链路工程革命
2026-08-12 02:14:35 +0800 CST
view 77
深度拆解OpenBMB开源VoxCPM2无分词器TTS系统:扩散自回归架构、AudioVAE V2非对称编解码、Voice Design音色创造、Controllable Cloning可控克隆、48kHz高保真输出、RTF 0.13实时部署、Nano-vLLM/vLLM-Omni生产实践、30条踩坑清单
VoxCPM2
TTS
语音合成
Tokenizer-Free
扩散模型
Voice Design
声音克隆
AudioVAE
多语言TTS
开源AI
vLLM 0.5 深度解析:PagedAttention 架构原理与生产级 LLM 推理优化实战
编程
vLLM 0.5 深度解析:PagedAttention 架构原理与生产级 LLM 推理优化实战
2026-07-04 18:15:46 +0800 CST
view 414
深度解析 vLLM 0.5 的 PagedAttention 架构原理,涵盖 KV Cache 分页管理、MoE 优化、分布式推理、量化技术,并通过代码实战和性能对比,帮助开发者掌握生产级 LLM 推理最佳实践。
vLLM
PagedAttention
LLM推理
CUDA
KV Cache
深度学习
AI基础设施
Python
生产部署
性能优化
ZeroClaw 深度拆解:Rust 重写 AI Agent 网关,10MB 内存如何撑起「多模型 + 多渠道 + 记忆」全栈能力
编程
ZeroClaw 深度拆解:Rust 重写 AI Agent 网关,10MB 内存如何撑起「多模型 + 多渠道 + 记忆」全栈能力
2026-07-30 06:15:15 +0800 CST
view 240
深度拆解 ZeroClaw:100% Rust 实现的 AI Agent 网关,单二进制 3.4MB、内存 <5MB、冷启动 <0.01s,完整覆盖 Trait 驱动架构、28+ Provider、14+ Channel、SQLite 混合记忆、Docker 沙箱安全模型,与 OpenClaw 的功能与性能全面对比。
ZeroClaw
Rust
AI Agent
OpenClaw
物联网
OpenClaw对比
Trait驱动
轻量化
Star-Office-UI:超可爱的像素风格AI办公室看板,把龙虾摸鱼状态可视化
案例
Star-Office-UI:超可爱的像素风格AI办公室看板,把龙虾摸鱼状态可视化
2026-05-09 07:16:11 +0800 CST
view 743
Star-Office-UI开源项目:像素风格的AI办公室看板,实时可视化Agent工作状态,支持多Agent协作、中英日三语、桌面宠物模式,与OpenClaw深度集成一条命令部署
OpenClaw
像素风格
AI看板
多Agent协作
桌面宠物
可视化
OpenClaw集成
AstronClaw 深度解析:科大讯飞如何用软硬一体架构让AI Agent走进物理世界
编程
AstronClaw 深度解析:科大讯飞如何用软硬一体架构让AI Agent走进物理世界
2026-04-19 07:17:09 +0800 CST
view 768
深度解析科大讯飞AstronClaw软硬一体AI Agent架构,从技术原理到应用场景全面剖析,探讨AI Agent如何突破屏幕限制走进物理世界。
AstronClaw
科大讯飞
AI Agent
软硬一体
智能体
星火大模型
Loomy
GlassClaw
SkillHub
ClickHouse v26.2 深度拆解:当 OLAP 数据库进入全栈内嵌时代——从 ClickStack 可观测 UI 到向量搜索分布式化(2026)
编程
ClickHouse v26.2 深度拆解:当 OLAP 数据库进入全栈内嵌时代——从 ClickStack 可观测 UI 到向量搜索分布式化(2026)
2026-07-17 15:15:41 +0800 CST
view 266
深度拆解 ClickHouse v26.2:ClickStack 可观测 UI、TOTP 原生认证、BigLake 集成、向量搜索分布式化、QBit 数据类型 GA、Insert 去重行为变更,配完整代码实战与生产升级指南。
ClickHouse
OLAP
向量数据库
数据库
大数据
实时分析
ClickStack
HNSW
Iceberg
OfficeCLI 深度拆解:单日暴涨 1700 Star 的「AI 原生 Office 套件」,如何给智能体装上操作 Word/Excel/PPT 的手和眼
编程
OfficeCLI 深度拆解:单日暴涨 1700 Star 的「AI 原生 Office 套件」,如何给智能体装上操作 Word/Excel/PPT 的手和眼
2026-07-29 04:42:52 +0800 CST
view 156
深度拆解 GitHub 单日暴涨 1700 Star 的 OfficeCLI:单二进制零依赖的 AI 原生 Office 套件,三层命令架构、内置高保真渲染引擎、350+ Excel 函数写入即求值、模板合并与 Dump 往返,附完整命令实战与冷静的边界分析。
OfficeCLI
AI Agent
Office自动化
MCP
CLI工具
OOXML
开源
文档自动化
ClawSwarm 深度实战:当多Agent学会「群聊协作」——从 Hub-and-Spoke 架构到生产级 AI 团队编排完全指南(2026)
编程
ClawSwarm 深度实战:当多Agent学会「群聊协作」——从 Hub-and-Spoke 架构到生产级 AI 团队编排完全指南(2026)
2026-06-12 19:47:32 +0800 CST
view 519
ClawSwarm深度实战:从Hub-and-Spoke架构到生产级多Agent协作完全指南。详解消息路由、任务拆解、Token优化,附完整代码实战。
ClawSwarm
多Agent
OpenClaw
AI协作
群聊编排
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
41
42
43
44
45
...
49
下一页