程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
DeepGEMM 深度解析:DeepSeek 开源的 FP8 GEMM 内核如何重塑 AI 推理性能边界
编程
DeepGEMM 深度解析:DeepSeek 开源的 FP8 GEMM 内核如何重塑 AI 推理性能边界
2026-04-21 05:16:09 +0800 CST
view 1103
深入剖析 DeepSeek 开源的 DeepGEMM 库:从 FP8 精度革命到 1550 TFLOPS 性能突破,揭秘现代 AI 推理基础设施的底层优化技术
DeepGEMM
FP8
DeepSeek
CUDA
AI推理
GPU优化
GEMM
TensorCore
DiffusionGemma 深度实战:当文本扩散重新定义本地AI推理——从'打字机'到'印刷机'的4倍速架构革命
编程
DiffusionGemma 深度实战:当文本扩散重新定义本地AI推理——从'打字机'到'印刷机'的4倍速架构革命
2026-06-12 17:21:39 +0800 CST
view 384
2026年6月Google发布DiffusionGemma,首个生产级文本扩散大模型,本地推理速度提升4倍。本文深入剖析其从自回归到并行生成的架构革命,附完整代码实战。
DiffusionGemma
文本扩散
本地AI
Gemma
大模型推理
扩散模型
Python
Ollama
DiffusionGemma 深度实战:当谷歌用图像扩散的逻辑重塑文本生成——从离散扩散原理到 4 倍推理加速的生产级完全指南(2026)
编程
DiffusionGemma 深度实战:当谷歌用图像扩散的逻辑重塑文本生成——从离散扩散原理到 4 倍推理加速的生产级完全指南(2026)
2026-06-17 23:28:33 +0800 CST
view 594
2026年6月谷歌开源DiffusionGemma,26B MoE参数仅激活3.8B,通过离散扩散实现4倍推理加速。本文从原理、架构、代码实战、性能优化全面深度解析这一范式级创新。
DiffusionGemma
谷歌
文本扩散
MoE
AI推理
Gemma
开源模型
离散扩散
并行生成
深度学习
Shimmy 深度解剖:Airframe 引擎与 TurboShimmy INT4 KV——纯 Rust WebGPU 推理如何用 4GB 显存跑起 7B 模型
编程
Shimmy 深度解剖:Airframe 引擎与 TurboShimmy INT4 KV——纯 Rust WebGPU 推理如何用 4GB 显存跑起 7B 模型
2026-07-25 10:15:27 +0800 CST
view 247
深度拆解 Shimmy v2.x 的 Airframe 纯 Rust WebGPU 推理引擎与 TurboShimmy INT4 KV Cache 压缩技术:从 WGSL shader 到 GGUF 模型加载,从跨平台 GPU 适配到 4GB 显存跑 7B 模型的工程真相。
Shimmy
WebGPU
GGUF
LLM推理
Rust
Inference Engine
TurboShimmy
INT4量化
消费级GPU
本地部署
wgpu
WGSL
Airframe
OpenAI API
DesktopCommander MCP 深度实战:当 AI Agent 真正接管你的桌面——从「聊天窗口」到「操作系统级助手」的跨越(2026)
编程
DesktopCommander MCP 深度实战:当 AI Agent 真正接管你的桌面——从「聊天窗口」到「操作系统级助手」的跨越(2026)
2026-07-14 10:46:01 +0800 CST
view 301
深度拆解 DesktopCommander MCP:从文件操作、终端控制、内存代码执行到 Docker 安全隔离,探讨 AI 从「聊天窗口」到「操作系统级助手」的范式转变与安全实践。
DesktopCommander
MCP协议
AI Agent
桌面自动化
Claude Code
AI编程工具
操作系统
进程管理
开源工具
2026技术趋势
万字深度解析 commaai/openpilot:当开源自动驾驶遇见「机器人操作系统」——从 tinygrad 推理引擎到 ISO26262 安全架构的完整技术指南(2026)
编程
万字深度解析 commaai/openpilot:当开源自动驾驶遇见「机器人操作系统」——从 tinygrad 推理引擎到 ISO26262 安全架构的完整技术指南(2026)
2026-07-01 15:17:02 +0800 CST
view 430
深度解析62.9k Star的开源自动驾驶系统openpilot,从tinygrad推理引擎、panda安全MCU、CAN总线通信到控制环路100Hz实时性,涵盖完整技术架构与新车适配实战代码
commaai
openpilot
自动驾驶
tinygrad
CAN总线
ISO26262
python
嵌入式
深度解析 commaai/openpilot:开源自动驾驶的完整技术栈——tinygrad 推理 · panda 安全 MCU · CAN 总线协议 · 100Hz 实时控制(2026)
编程
深度解析 commaai/openpilot:开源自动驾驶的完整技术栈——tinygrad 推理 · panda 安全 MCU · CAN 总线协议 · 100Hz 实时控制(2026)
2026-07-01 15:18:02 +0800 CST
view 720
深度解析62.9k Star的开源自动驾驶系统openpilot,从tinygrad推理引擎、panda安全MCU、CAN总线通信到控制环路100Hz实时性
commaai
openpilot
自动驾驶
tinygrad
CAN总线
ISO26262
python
嵌入式
DesktopCommanderMCP 深度拆解:当 MCP 协议把 AI 变成真正的操作系统级 Agent
编程
DesktopCommanderMCP 深度拆解:当 MCP 协议把 AI 变成真正的操作系统级 Agent
2026-07-14 17:17:22 +0800 CST
view 292
深度拆解 GitHub Trending #1 项目 DesktopCommanderMCP:从 MCP 协议机制、终端控制架构、安全沙箱设计、内存代码执行到多客户端生态,一次把「让 AI 操控整台电脑」的操作系统级 Agent 方案讲透。
DesktopCommanderMCP
MCP协议
AI Agent
操作系统
JSON-RPC
沙箱
Docker
TypeScript
开源
GitHub Trending
万字深度解析 commaai/openpilot:当开源自动驾驶遇见传感器融合——从 ModelD 神经网络到 CAN 总线控制、从 Model Predictive Control 到生产级部署的完整技术指南
编程
万字深度解析 commaai/openpilot:当开源自动驾驶遇见传感器融合——从 ModelD 神经网络到 CAN 总线控制、从 Model Predictive Control 到生产级部署的完整技术指南
2026-07-03 10:55:48 +0800 CST
view 751
深度解析 GitHub 62K Stars 开源自动驾驶项目 openpilot:从 ModelD 神经网络感知、扩展卡尔曼滤波融合、Model Predictive Control 规划、CAN 总线车辆控制到生产级部署,含完整 Python/伪代码实战
openpilot
commaai
自动驾驶
传感器融合
CAN总线
MPC
【深度长文】开源自动驾驶项目技术完全指南:摄像头感知×雷达融合×MPC控制×CAN总线——commaai 工程实践全解析(2026)
编程
【深度长文】开源自动驾驶项目技术完全指南:摄像头感知×雷达融合×MPC控制×CAN总线——commaai 工程实践全解析(2026)
2026-07-03 10:56:29 +0800 CST
view 376
深度解析 GitHub 62K Stars 开源自动驾驶项目 openpilot:从 ModelD 神经网络感知、扩展卡尔曼滤波融合、Model Predictive Control 规划、CAN 总线车辆控制到生产级部署,含完整 Python/伪代码实战
openpilot
commaai
自动驾驶
传感器融合
CAN总线
MPC
Vite 8 深度拆解:当 Vite 亲手拆掉「esbuild + Rollup」双引擎——Rolldown、Oxc 与打包式开发的范式回收
编程
Vite 8 深度拆解:当 Vite 亲手拆掉「esbuild + Rollup」双引擎——Rolldown、Oxc 与打包式开发的范式回收
2026-08-11 04:49:04 +0800 CST
view 89
Vite 8 深度拆解:Rolldown 如何终结 esbuild+Rollup 双打包器时代、Oxc 统一工具链的跨层优化、自动/手动分包算法模型与 codeSplitting 取代 manualChunks 的根因、Lazy Barrel 让 antd 少编译 92% 模块、CJS 互操作语义统一陷阱、Vite 8.1 Bundled Dev Mode 与 Chunk Import Map。含完整迁移剧本与十六条踩坑清单。
Vite
Vite 8
Rolldown
Oxc
前端工具链
打包器
代码分割
Lazy Barrel
Lightning CSS
Rust
构建性能
前端工程化
Tree Shaking
CommonJS
视觉即代码:GLM-5V-Turbo 如何用 94.8 分重新定义 Design2Code
编程
视觉即代码:GLM-5V-Turbo 如何用 94.8 分重新定义 Design2Code
2026-05-11 09:52:48 +0800 CST
view 797
智谱AI发布GLM-5V-Turbo多模态编程基座模型,从预训练阶段原生融合视觉与语言,在Design2Code基准测试中以94.8分超越所有竞品。本文深度解析CogViT视觉编码器、MMTP多模态多Token预测、多任务RL优化等技术细节,以及如何用API接入实现从设计稿到可运行代码的完整工作流。
GLM-5V-Turbo
视觉编程
Design2Code
多模态
CogViT
MMTP
智谱AI
AI编程
PyTorch 2.13 深度解析:一次把框架换心与跨平台革命讲透
编程
PyTorch 2.13 深度解析:一次把框架换心与跨平台革命讲透
2026-07-14 01:14:51 +0800 CST
view 474
2026年7月PyTorch 2.13重磅发布:FlexAttention在Apple Silicon实现12倍加速、CuTeDSL提供CUTLASS级GEMM代码生成、融合损失函数将大词汇量训练峰值显存削减4倍、torchcomms革新分布式通信后端、ExecuTorch正式并入核心,深度拆解六大核心更新与实战代码。
PyTorch
深度学习
机器学习框架
GPU
Distributed Training
FlexAttention
CUDA
GEMM
ROCm
Apple Silicon
MPS
eBPF 2026 深度实战:当内核成为可编程平台——从 LSFMM+BPF 峰会到 Cilium 网络革命、bpftrace 生产级追踪与零侵入可观测性完全指南
编程
eBPF 2026 深度实战:当内核成为可编程平台——从 LSFMM+BPF 峰会到 Cilium 网络革命、bpftrace 生产级追踪与零侵入可观测性完全指南
2026-06-19 00:02:55 +0800 CST
view 603
从 2026 LSFMM+BPF 峰会核心议题到 Cilium 网络替代 kube-proxy、bpftrace 火焰图与延迟追踪、eBPF 驱动的零侵入可观测性、Falco 安全监控,再到 eBPF 与 AI Agent 融合的前沿实践,8000+ 字生产级完全指南
eBPF
Cilium
bpftrace
Linux Kernel
Cloud Native
Observability
Kubernetes
XDP
LSFMM 2026
Falco
万字深度解析 CubeSandbox:当 AI Agent 遇见微虚拟机革命——从 KVM 硬件隔离到亚秒级启动的完整技术指南(2026)
编程
万字深度解析 CubeSandbox:当 AI Agent 遇见微虚拟机革命——从 KVM 硬件隔离到亚秒级启动的完整技术指南(2026)
2026-07-02 17:44:52 +0800 CST
view 405
深度解析 CubeSandbox 开源 AI Agent 安全沙箱:基于 RustVMM 和 KVM 的硬件级隔离,<60ms 冷启动,CubeCoW 快照引擎,E2B 无缝兼容,凭证保险库与零信任架构,含完整代码实战。
CubeSandbox
AI Agent
沙箱
KVM
RustVMM
微服务
安全
E2B
硬件虚拟化
Copy-on-Write
Gemma 4 12B 深度实战:当无编码器统一多模态架构走进本地
编程
Gemma 4 12B 深度实战:当无编码器统一多模态架构走进本地
2026-06-14 17:49:21 +0800 CST
view 587
深入解析 Google Gemma 4 12B 的无编码器统一多模态架构,从技术原理到生产部署的完整指南
Gemma4
Google
多模态
本地部署
AI
LLM
Encoder-Free
Gemma 4 12B 工程实践:Encoder-Free 统一多模态架构从原理到本地部署完全指南(2026)
编程
Gemma 4 12B 工程实践:Encoder-Free 统一多模态架构从原理到本地部署完全指南(2026)
2026-06-14 17:49:38 +0800 CST
view 697
深入解析 Google Gemma 4 12B 的无编码器统一多模态架构,从技术原理到生产部署的完整指南
Gemma4
Google
多模态
本地部署
AI
LLM
Encoder-Free
Gemma MacOS Tuner 深度解析:在 Apple Silicon 上用 PyTorch 和 MPS 高效微调多模态 Gemma
编程
Gemma MacOS Tuner 深度解析:在 Apple Silicon 上用 PyTorch 和 MPS 高效微调多模态 Gemma
2026-04-09 01:14:39 +0800 CST
view 1338
详解 gemma-tuner-multimodal 项目:在 Apple Silicon 上通过 PyTorch MPS 后端对 Google Gemma 系列模型进行 LoRA 微调,支持文本、图像、音频三种模态,完全本地运行,数据不出机器,零 NVIDIA GPU 依赖。
Gemma
Apple Silicon
PyTorch
MPS
LoRA
微调
Machine Learning
Google AI Edge Gallery:手机离线跑大模型时代来了,2.2万Star端侧AI神器
案例
Google AI Edge Gallery:手机离线跑大模型时代来了,2.2万Star端侧AI神器
2026-05-09 07:36:45 +0800 CST
view 1198
Google开源AI神器AI Edge Gallery斩获2.2万Star,支持iOS和Android手机离线运行Gemma 4等大模型,提供AI Chat、Ask Image、Audio Scribe、Agent Skills四大功能,消费级入口形态让普通用户轻松体验端侧AI
端侧AI
手机大模型
离线推理
Gemma 4
Google开源
iOS
Android
DiffusionGemma 深度实战:当文本生成告别逐字蹦字——从离散扩散到 1100 tokens/s 的生产级完全指南(2026)
编程
DiffusionGemma 深度实战:当文本生成告别逐字蹦字——从离散扩散到 1100 tokens/s 的生产级完全指南(2026)
2026-06-16 07:18:07 +0800 CST
view 451
Google DeepMind 开源 DiffusionGemma 离散文本扩散模型深度实战:从并行去噪原理到 1100 tokens/s 推理,完整代码示例与 Agent 构建
DiffusionGemma
文本扩散
离散扩散
LLM
开源模型
Google DeepMind
shimmy v2.3.0 深度解析:纯 Rust WebGPU 推理引擎如何让 GGUF 模型跑满你的每一块 GPU
编程
shimmy v2.3.0 深度解析:纯 Rust WebGPU 推理引擎如何让 GGUF 模型跑满你的每一块 GPU
2026-07-23 11:45:35 +0800 CST
view 210
深度解析纯 Rust WebGPU 推理引擎 shimmy v2.3.0:GGUF 原生加载、OpenAI API 兼容、KV Cache 量化、Flash Attention 等效实现,配 Tauri 桌面应用集成实战与性能基准测试。
shimmy
WebGPU
Rust
GGUF
LLM
llama.cpp
推理引擎
WebAssembly
Kubernetes Gateway API 1.4 全面 GA:从 Ingress 的泥潭到南北/东西向统一治理——一次讲透 GatewayClass、HTTPRoute 与 GAMMA
编程
Kubernetes Gateway API 1.4 全面 GA:从 Ingress 的泥潭到南北/东西向统一治理——一次讲透 GatewayClass、HTTPRoute 与 GAMMA
2026-08-13 03:11:48 +0800 CST
view 58
2026 年 8 月 Kubernetes Gateway API v1.4 正式 GA。本文从 Ingress 的注解地狱讲起,拆解 GatewayClass/Gateway/HTTPRoute 三层角色模型与 GAMMA 东西向统一,配 Envoy/Cilium 全链路实战与 15 条生产优化清单。
Kubernetes
Gateway API
云原生
Ingress
服务网格
GAMMA
Envoy
DiffusionGemma 深度实战:当 Google 用「扩散」颠覆自回归——从离散文本扩散原理到 MoE 架构、本地推理加速与生产级部署的完全指南(2026)
编程
DiffusionGemma 深度实战:当 Google 用「扩散」颠覆自回归——从离散文本扩散原理到 MoE 架构、本地推理加速与生产级部署的完全指南(2026)
2026-06-16 18:52:52 +0800 CST
view 576
Google DeepMind联合NVIDIA发布DiffusionGemma——基于离散文本扩散的实验性开源模型。本文深入解读26B MoE架构、双向注意力机制、本地推理4倍加速原理,附完整代码示例和部署实战。
Google
DiffusionGemma
扩散模型
MoE
开源LLM
本地推理
AI推理加速
Gemma 4 架构解密:MoE 路由 × GQA 注意力 × Thinking Mode——31B 如何击败 20 倍参数对手
编程
Gemma 4 架构解密:MoE 路由 × GQA 注意力 × Thinking Mode——31B 如何击败 20 倍参数对手
2026-04-19 17:47:49 +0800 CST
view 875
深入解析 Google Gemma 4 的核心技术架构:MoE 稀疏专家路由、GQA 分组查询注意力、PLE 逐层嵌入、Thinking Mode 推理机制,详解 31B 模型如何以小博大击败 20 倍参数对手,附全场景部署实战代码。
Gemma
Google
AI
开源大模型
MoE
GQA
Transformer
深度学习
模型架构
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
2
3
...
51
下一页