程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Kubernetes 1.36 原生 Gang 调度深度拆解:PodGroup/Workload API 如何终结 AI 训练的「半个作业」困局
编程
Kubernetes 1.36 原生 Gang 调度深度拆解:PodGroup/Workload API 如何终结 AI 训练的「半个作业」困局
2026-08-02 02:51:55 +0800 CST
view 92
从一个 8 卡训练任务的调度死锁讲起,拆解 Kubernetes 1.36 原生 Gang 调度(PodGroup/Workload API)的设计取舍、调度框架扩展点源码实现、DRA 不支持抢占带来的优先级反转,以及生产落地的选型清单与性能调优方法。
Kubernetes
Gang Scheduling
DRA
kube-scheduler
AI训练
云原生
Unsloth 深度拆解:当 LLM 微调学会「省显存」——2倍速+70%显存节省背后的 QLoRA 工程革命
编程
Unsloth 深度拆解:当 LLM 微调学会「省显存」——2倍速+70%显存节省背后的 QLoRA 工程革命
2026-07-15 17:47:08 +0800 CST
view 198
深度拆解Unsloth技术栈:QLoRA量化原理、4-bit NF4精度机制、Triton内核重写、8-bit Adam优化器、梯度检查点优化,以及从Notebook到Ollama/vLLM生产部署的完整工程路径,含完整代码实战
Unsloth
LLM微调
QLoRA
LoRA
4-bit量化
深度学习
模型训练
Unsloth实战:当QLoRA让27B模型在RTX 4090上跑起来——从Qwen3.5微调到Ollama部署的完整工程链
编程
Unsloth实战:当QLoRA让27B模型在RTX 4090上跑起来——从Qwen3.5微调到Ollama部署的完整工程链
2026-07-15 17:48:36 +0800 CST
view 187
深度拆解Unsloth技术栈:QLoRA量化原理、4-bit NF4精度机制、Triton内核重写、8-bit Adam优化器、梯度检查点优化,以及从Notebook到Ollama/vLLM生产部署的完整工程路径,含完整代码实战
Unsloth
LLM微调
QLoRA
LoRA
4-bit量化
深度学习
模型训练
Microsoft Agent Lightning 深度实战:零代码变更强化学习——让 AI Agent 在真实交互中自我进化(2026 完全指南)
编程
Microsoft Agent Lightning 深度实战:零代码变更强化学习——让 AI Agent 在真实交互中自我进化(2026 完全指南)
2026-05-30 10:10:57 +0800 CST
view 488
Microsoft Agent Lightning 深度解析:零代码变更强化学习框架,让AI Agent在真实交互中自我进化。涵盖架构原理、LightningRL算法、代码实战、信用分配机制与生产级部署。
Microsoft Agent Lightning
强化学习
AI Agent 训练
RL
零代码变更
Kueue:Kubernetes 原生 Job Queueing——一个 Controller 搞定 Job 排队和资源配额
编程
Kueue:Kubernetes 原生 Job Queueing——一个 Controller 搞定 Job 排队和资源配额
2026-06-28 12:18:45 +0800 CST
view 423
深入解析 Kueue 的核心概念、架构设计与生产实践,涵盖 ResourceFlavor、ClusterQueue、Cohort、Workload 等关键组件,配有完整的 YAML 示例与多租户 GPU 集群实战。
Kubernetes
K8s
Kueue
云原生
AI训练
GPU调度
批量调度
Kueue 深度解析:Kubernetes 原生 Job 队列与多租户 GPU 配额管理实战
编程
Kueue 深度解析:Kubernetes 原生 Job 队列与多租户 GPU 配额管理实战
2026-06-28 12:19:03 +0800 CST
view 329
深入解析 Kueue 的核心概念、架构设计与生产实践,涵盖 ResourceFlavor、ClusterQueue、Cohort、Workload 等关键组件,配有完整的 YAML 示例与多租户 GPU 集群实战。
Kubernetes
K8s
Kueue
云原生
AI训练
GPU调度
批量调度
AReaL:当异步强化学习遇上大模型Agent,训练效率狂飙2.77倍
编程
AReaL:当异步强化学习遇上大模型Agent,训练效率狂飙2.77倍
2026-04-18 09:13:49 +0800 CST
view 588
深度解析蚂蚁集团开源的大规模异步强化学习框架AReaL,训练效率提升2.77倍,支持数学推理、搜索Agent、多模态等多种场景。
强化学习
Agent
AI训练
开源框架
异步计算
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
2
下一页