程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Kubernetes 异构计算统一调度平台 HAMi 深度解析:从 GPU 虚拟化到 AI 基础设施范式革命
编程
Kubernetes 异构计算统一调度平台 HAMi 深度解析:从 GPU 虚拟化到 AI 基础设施范式革命
2026-08-08 23:45:50 +0800 CST
view 23
深度解析 CNCF 沙盒项目 HAMi:四层架构设计、NVIDIA vGPU 虚拟化与国产芯片统一调度、代码实战与生产踩坑清单,从调度平台到 AI 基础设施操作系统。
HAMi
Kubernetes
GPU虚拟化
CNCF
异构计算
云原生
AI基础设施
GPU调度
昇腾
昆仑芯
DeepSeek V4 深度技术解析:从 MoE 架构到百万上下文的生产级实战指南
编程
DeepSeek V4 深度技术解析:从 MoE 架构到百万上下文的生产级实战指南
2026-07-08 01:51:46 +0800 CST
view 310
深度解析DeepSeek V4的MoE架构、DSA稀疏注意力、百万Token上下文、国产算力适配等核心技术,配完整API接入代码与成本优化指南
DeepSeek-V4
MoE架构
DSA稀疏注意力
大模型
AI编程
开源模型
百万上下文
华为昇腾
XY-Serve 深度实战:当昇腾 NPU 终于学会「驯服动态负载」——从元原语分解、Token级调度到 Attention/Linear 双内核优化的完整工程指南(2026)
编程
XY-Serve 深度实战:当昇腾 NPU 终于学会「驯服动态负载」——从元原语分解、Token级调度到 Attention/Linear 双内核优化的完整工程指南(2026)
2026-07-21 08:20:26 +0800 CST
view 181
华为联合清华大学开源的 XY-Serve 论文被 ASPLOS 2026 录用,解决了 NPU 上高效运行动态 LLM 负载的核心挑战。吞吐量提升95%,Attention 内核提速21.5%,Linear 内核提速14.6%。
XY-Serve
华为昇腾
NPU
LLM推理
Meta-Attention
虚拟填充
动态负载
ASPLOS
AI基础设施
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调