程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
TileKernels 深度解析:DeepSeek 用 80 行代码榨干 GPU,算子开发范式的降维打击
编程
TileKernels 深度解析:DeepSeek 用 80 行代码榨干 GPU,算子开发范式的降维打击
2026-04-30 03:22:15 +0800 CST
view 848
深度解析 DeepSeek 开源的高性能 GPU 算子库 TileKernels:基于 TileLang DSL 用 80 行代码实现手写 CUDA 级性能,覆盖 MoE Gating/Routing、FP8/FP4 量化、Engram 门控等七大算子家族,首次原生支持 NVIDIA Blackwell 架构,并通过 TVM 编译器打通昇腾等国产芯片。
DeepSeek
TileKernels
GPU
CUDA
TileLang
MoE
算子优化
DeepSeek-TUI:终端里的 Claude Code,Rust 重写让 AI 编程助手轻到飞起
编程
DeepSeek-TUI:终端里的 Claude Code,Rust 重写让 AI 编程助手轻到飞起
2026-05-11 14:25:25 +0800 CST
view 556
DeepSeek-TUI由美国独立开发者Hunter Bown用Rust编写,是DeepSeek版的Claude Code。支持1M token上下文、流式推理可视化、Plan/Agent/YOLO三种模式、MCP协议、LSP诊断。成本仅为Claude Code的1/10,MIT开源,单二进制无运行时依赖。
DeepSeek-TUI,Hunter Bown,Rust,Claude Code替代,终端AI助手,AI编程,Agent模式,YOLO模式,DeepSeek V4,MCP协议
万字深度解析 DeepSeek V4:当 1.6 万亿参数遇见 DSA 稀疏注意力——开源大模型如何让 API 账单暴降 95%(2026)
编程
万字深度解析 DeepSeek V4:当 1.6 万亿参数遇见 DSA 稀疏注意力——开源大模型如何让 API 账单暴降 95%(2026)
2026-07-01 07:13:58 +0800 CST
view 292
2026年4月DeepSeek V4发布,1.6万亿参数+百万上下文+SWE-Bench 80.6%,API成本暴降95%。深度解析DSA稀疏注意力、MoE架构、生产级部署实战。
DeepSeek V4
DSA 稀疏注意力
MoE 架构
百万上下文
开源大模型
API 成本优化
大模型部署
Agent 能力
SWE-Bench
DeepSeek
eBPF 2026 深度实战:当内核成为可编程平台——从 LSFMM+BPF 峰会到 Cilium 网络革命、bpftrace 生产级追踪与零侵入可观测性完全指南
编程
eBPF 2026 深度实战:当内核成为可编程平台——从 LSFMM+BPF 峰会到 Cilium 网络革命、bpftrace 生产级追踪与零侵入可观测性完全指南
2026-06-19 00:02:55 +0800 CST
view 447
从 2026 LSFMM+BPF 峰会核心议题到 Cilium 网络替代 kube-proxy、bpftrace 火焰图与延迟追踪、eBPF 驱动的零侵入可观测性、Falco 安全监控,再到 eBPF 与 AI Agent 融合的前沿实践,8000+ 字生产级完全指南
eBPF
Cilium
bpftrace
Linux Kernel
Cloud Native
Observability
Kubernetes
XDP
LSFMM 2026
Falco
Svelte 5 深度实战:从编译时优化到 Runes 响应式系统——2026 年前端框架性能之巅完全指南
编程
Svelte 5 深度实战:从编译时优化到 Runes 响应式系统——2026 年前端框架性能之巅完全指南
2026-05-24 03:30:59 +0800 CST
view 535
在 React、Vue、Angular 三足鼎立的现代前端界,Svelte 5 带着编译时优化的革命性理念和 Runes 响应式系统强势来袭。本文将深入 Svelte 5 的内核架构,从编译器设计、响应式原理、组件机制到生产级性能优化,用大量代码示例和实战案例,带你掌握这款编译型框架的真正威力。
Svelte 5
前端框架
编译时优化
Runes
响应式编程
SvelteKit
性能优化
Web开发
Svelte 5 编译时优化完全指南:用 Runes 响应式系统碾压虚拟 DOM
编程
Svelte 5 编译时优化完全指南:用 Runes 响应式系统碾压虚拟 DOM
2026-05-24 03:31:37 +0800 CST
view 568
Svelte 5 的编译时优化和 Runes 响应式系统彻底颠覆了传统前端框架的性能模型。本文从编译器原理、响应式机制、组件架构到生产级性能优化,用大量代码示例和基准测试数据,证明 Svelte 如何碾压虚拟 DOM 框架。
Svelte 5
前端框架
编译时优化
Runes
响应式编程
SvelteKit
性能优化
Web开发
Svelte 5 深度实战:当响应式编程迎来编译期革命——从 Runes 细粒度响应系统到编译器架构重构、性能极限与生产级完全指南(2026)
编程
Svelte 5 深度实战:当响应式编程迎来编译期革命——从 Runes 细粒度响应系统到编译器架构重构、性能极限与生产级完全指南(2026)
2026-06-18 15:53:59 +0800 CST
view 346
Svelte 5 深度实战:从 Runes 响应系统到编译器架构重构,深入讲解 $state/$derived/$effect/$props,对比 React 19/Vue 3.5,附生产级 Todo 全栈项目与性能测试。
Svelte 5
Runes
前端框架
响应式编程
编译期优化
SvelteKit
TypeScript
性能优化
信号系统
Svelte 5 深度解析:Runes 革命与响应式编程的范式跃迁
编程
Svelte 5 深度解析:Runes 革命与响应式编程的范式跃迁
2026-05-12 14:11:40 +0800 CST
view 556
深度解析Svelte 5的重大革新:Runes响应式系统、//新语法、Snippets代码片段、TypeScript原生支持、性能提升33%。包含Runes系统深度解析、Svelte 4迁移指南、性能优化实战。
Svelte5
Runes系统
响应式编程
SvelteKit
Snippets
MusaCoder 深度实战:当国产GPU遇见AI驱动的Kernel生成——从PyTorch到CUDA/MUSA原生算子的全栈训练完全指南(2026)
编程
MusaCoder 深度实战:当国产GPU遇见AI驱动的Kernel生成——从PyTorch到CUDA/MUSA原生算子的全栈训练完全指南(2026)
2026-06-16 06:47:47 +0800 CST
view 396
MusaCoder是首个基于国产GPU完成全链路训练的代码大模型,在KernelBench上超越Claude Opus 4.7。从三阶段数据合成、多样性RFT到执行反馈RL,深度解析全栈训练方法论。
MusaCoder
GPU Kernel
摩尔线程
国产GPU
CUDA
MUSA
大模型
强化学习
KernelBench
代码大模型
AI Coding
深度学习
Kubernetes v1.35(Timbernetes)深度解析:从 Pod 资源就地更新到 Gang 调度——云原生基础设施的 2026 技术革命
编程
Kubernetes v1.35(Timbernetes)深度解析:从 Pod 资源就地更新到 Gang 调度——云原生基础设施的 2026 技术革命
2026-07-04 07:17:17 +0800 CST
view 357
Kubernetes v1.35 (Timbernetes) 深度解析:60项改进、Pod资源就地更新、Pod证书原生身份、Gang调度AI/ML支持、批处理调度器6倍性能提升、KYAML安全子集、用户命名空间容器安全革命,含完整代码实战与生产级升级指南。
Kubernetes
Kubernetes v1.35
Timbernetes
云原生
Pod资源更新
Gang调度
Pod证书
KYAML
用户命名空间
容器安全
TileLang + TileKernels 深度解析:DeepSeek 如何用 Python 写出让 GPU 逼近理论性能上限的 GPU 内核
编程
TileLang + TileKernels 深度解析:DeepSeek 如何用 Python 写出让 GPU 逼近理论性能上限的 GPU 内核
2026-04-28 10:55:20 +0800 CST
view 664
深度剖析 DeepSeek 开源的 TileLang DSL 和 TileKernels GPU 内核库:从 GEMM 到 MoE,从 TVM 编译基础设施到生产级量化内核,揭示用 Python 写接近硬件极限性能 GPU 代码的秘密。
TileLang
GPU内核
DeepSeek
高性能计算
CUDA
GEMM
MoE
量化
TVM
开源项目
万字深度解析 Model Context Protocol:当 AI Agent 遇见「USB-C 协议革命」——从 Safari MCP 服务器到全平台生态覆盖的完整技术指南(2026)
编程
万字深度解析 Model Context Protocol:当 AI Agent 遇见「USB-C 协议革命」——从 Safari MCP 服务器到全平台生态覆盖的完整技术指南(2026)
2026-07-02 19:22:59 +0800 CST
view 650
深度解析 MCP 协议架构:从 Safari WebKit MCP 服务器、X 托管 MCP 服务、DeepSeek V4.1 原生 MCP 支持,到生产级 MCP Server 开发实战,含完整代码
Model Context Protocol
MCP
AI Agent
Anthropic
Safari
DeepSeek
Gemini
Windows Coreutils 深度实战:当微软用 Rust 为 Windows 重新实现 Linux 命令行工具链——从 Build 2026 到生产级完全指南(2026)
编程
Windows Coreutils 深度实战:当微软用 Rust 为 Windows 重新实现 Linux 命令行工具链——从 Build 2026 到生产级完全指南(2026)
2026-06-16 18:23:52 +0800 CST
view 409
Build 2026微软发布Windows Coreutils:基于Rust+uutils重写,75个Linux命令原生运行,NTFS硬链接架构,多调用二进制设计,替代Git Bash/WSL的生产级方案。
Rust
Windows
Coreutils
uutils
GNUCoreutils
Build2026
Redis之父antirez亲自下场!为DeepSeek V4 Flash打造专属推理引擎,Mac上跑出468 token/s
案例
Redis之父antirez亲自下场!为DeepSeek V4 Flash打造专属推理引擎,Mac上跑出468 token/s
2026-05-10 08:40:22 +0800 CST
view 750
Redis之父antirez亲自下场!为DeepSeek V4 Flash打造专属推理引擎ds4.c,C+Metal从头编写,Mac Studio M3 Ultra上预填充468 token/s。关键优化:非对称量化(MoE专家层2-bit)、KV缓存搬硬盘、内置OpenAI/Anthropic双API。128GB Mac可跑,专为coding agent优化。
DeepSeek
AI推理
Mac
Redis
antirez
Metal
本地推理
MoE
GGUF
C语言
Apple Silicon
Claude Code
OpenAI API
Anthropic API
Redis之父的「孤注一掷」:ds4.c如何让284B参数模型在128GB MacBook上跑起来
编程
Redis之父的「孤注一掷」:ds4.c如何让284B参数模型在128GB MacBook上跑起来
2026-07-11 16:17:33 +0800 CST
view 173
Redis之父 Salvatore Sanfilippo 2026年5月发布的新项目 ds4.c,专为 DeepSeek V4 Flash + Apple Silicon Metal 打造本地推理引擎,8000行代码实现2.5倍性能提升。本文深度解析其架构设计、Graph Executor、KV Cache页式管理与Metal Shader实现。
推理引擎
Apple Silicon
DeepSeek
Metal
Redis
ds4.c
ds4.c 深度解析:Redis之父如何用纯C代码在MacBook上跑通284B大模型——从不对称量化到KV缓存磁盘化的完整技术内幕
编程
ds4.c 深度解析:Redis之父如何用纯C代码在MacBook上跑通284B大模型——从不对称量化到KV缓存磁盘化的完整技术内幕
2026-05-18 06:15:03 +0800 CST
view 638
Redis之父antirez开源ds4.c项目深度解析:用纯C语言在MacBook上运行284B参数大模型,不对称2-bit量化、KV缓存磁盘化、OpenAI/Anthropic API兼容,打造首个真正的本地Agent推理后端
AI推理
本地大模型
Redis
Apple Silicon
DeepSeek
ds4 深度解析:Redis 作者的最后一战?—— DwarfStar 4 本地推理引擎的技术革命
编程
ds4 深度解析:Redis 作者的最后一战?—— DwarfStar 4 本地推理引擎的技术革命
2026-05-15 17:47:40 +0800 CST
view 780
深入解析 antirez(Redis 作者)新开源项目 ds4:DwarfStar 4 本地推理引擎,专门为 DeepSeek V4 Flash 打造,支持 Metal/CUDA 后端,2-bit 量化可在 96GB 内存 MacBook 上运行 284B 参数模型。
AI推理
本地部署
DeepSeek
Redis
Apple Silicon
CUDA
Metal
MoE
量化
OmniRoute 深度拆解:一个开源 AI 网关如何终结「AI 路由焦虑」,290+ 厂商、19 种策略与 Token 暴降 60% 的工程实践
编程
OmniRoute 深度拆解:一个开源 AI 网关如何终结「AI 路由焦虑」,290+ 厂商、19 种策略与 Token 暴降 60% 的工程实践
2026-07-29 03:15:11 +0800 CST
view 21
深度拆解 GitHub 28.8k Star 的 OmniRoute:一个开源本地 AI 网关的完整架构解析,涵盖 19 种智能路由策略、RTK+Caveman 双引擎 Token 压缩(成本降低 60%)、配额感知动态路由,以及与 Claude Code、Cursor 等工具的深度集成实战,附生产级配置指南。
OmniRoute
AI网关
智能路由
Token压缩
API聚合
成本优化
Claude Code
Cursor
OpenAI
Anthropic
DeepSeek
RTK
Caveman
从碎片化到统一:OmniRoute 架构设计、19 种路由策略与 Token 暴降 60% 实战
编程
从碎片化到统一:OmniRoute 架构设计、19 种路由策略与 Token 暴降 60% 实战
2026-07-29 03:15:39 +0800 CST
view 22
深度拆解 GitHub 28.8k Star 的 OmniRoute:一个开源本地 AI 网关的完整架构解析,涵盖 19 种智能路由策略、RTK+Caveman 双引擎 Token 压缩(成本降低 60%)、配额感知动态路由,以及与 Claude Code、Cursor 等工具的深度集成实战,附生产级配置指南。
OmniRoute
AI网关
智能路由
Token压缩
API聚合
成本优化
Claude Code
Cursor
OpenAI
Anthropic
DeepSeek
RTK
Caveman
万字深度解析 DeepSeek-TUI:当 Rust 遇见 100 万 Token——终端原生 AI 编程 Agent 的极致工程化实践(2026)
编程
万字深度解析 DeepSeek-TUI:当 Rust 遇见 100 万 Token——终端原生 AI 编程 Agent 的极致工程化实践(2026)
2026-07-02 00:15:19 +0800 CST
view 336
深度解析DeepSeek-TUI如何用Rust实现12MB内存占用、100万Token上下文的终端AI编程Agent,与Claude Code的全面对比
Rust
AI Agent
DeepSeek
终端
编程工具
性能优化
100万Token
Claude Code平替
GitHub 3.5K Star!DeepSeek TUI:终端中的深度思考编码智能体
案例
GitHub 3.5K Star!DeepSeek TUI:终端中的深度思考编码智能体
2026-05-05 19:10:30 +0800 CST
view 1069
GitHub 3.5K Star!DeepSeek TUI把V4模型搬进终端,原生RLM并行推理、实时思考模式展示、1M Token超上下文、三种工作模式,会话保存与工作区回滚
AI编程
DeepSeek
TUI
终端工具
编码智能体
Claude Code平替
1MToken
Cindy AI Agent 深度拆解:双 Harness 融合架构如何重新定义 AI 编程助手
编程
Cindy AI Agent 深度拆解:双 Harness 融合架构如何重新定义 AI 编程助手
2026-07-28 16:19:47 +0800 CST
view 36
深入剖析心动公司发布的开源AI Agent产品Cindy:双Harness融合架构原理、上下文连续性机制、多Agent协作模式、安全信任设计,以及它在整个2026年AI Agent生态中的独特定位。
Cindy
AI Agent
双Harness
Claude Code
Codex
Harness Engineering
多Agent协作
Context连续性
Model Routing
MCP协议
OpenClaw
2026技术趋势
开源AI
eBPF 深度实战:当 Linux 内核变成可编程沙箱——从零理解内核级可观测性到生产级性能调优的完全指南(2026)
编程
eBPF 深度实战:当 Linux 内核变成可编程沙箱——从零理解内核级可观测性到生产级性能调优的完全指南(2026)
2026-06-10 19:21:48 +0800 CST
view 678
eBPF从原理到生产的完全指南:架构解析、Map机制、Hook点详解、延迟分析器/SQL审计/容器防火墙实战、XDP性能调优、KernelScript 0.1、OTel融合、安全攻防
eBPF
Linux
可观测性
性能优化
内核
KernelScript
eBPF 深度实战:当内核可编程性颠覆 Linux 基础设施——从 VM 架构到 XDP 高性能网络、eBPF 安全监控与 KernelScript 新范式的生产级完全指南(2026)
编程
eBPF 深度实战:当内核可编程性颠覆 Linux 基础设施——从 VM 架构到 XDP 高性能网络、eBPF 安全监控与 KernelScript 新范式的生产级完全指南(2026)
2026-06-17 20:25:08 +0800 CST
view 323
eBPF是Linux内核最革命性的技术之一。本文从eBPF虚拟机架构讲起,深入XDP高性能网络加速、生产级安全监控、性能火焰图,最后落地到KernelScript如何用高级语言抽象把eBPF开发门槛砍掉70%。
eBPF
XDP
Linux内核
KernelScript
网络加速
安全监控
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
2
3
...
74
下一页