程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Go 语言 Web 开发深度实战:从 net/http 标准库到 Gin/Echo/Fiber 的架构取舍,以及 Go 1.26 性能革命下的工程实践
编程
Go 语言 Web 开发深度实战:从 net/http 标准库到 Gin/Echo/Fiber 的架构取舍,以及 Go 1.26 性能革命下的工程实践
2026-07-10 19:12:54 +0800 CST
view 287
深度实战 Go Web 开发:对比 net/http、Gin、Echo、Fiber、Chi 的架构取舍,结合 Go 1.26 的 Green Tea GC、容器感知 GOMAXPROCS、json/v2,给出可运行代码与性能优化手册。
Go Web
net/http
Gin
Echo
Fiber
Go 1.26
性能优化
Wails:Go 版 Electron,打包体积直接缩小 10 倍!
编程
Wails:Go 版 Electron,打包体积直接缩小 10 倍!
2026-06-11 11:57:18 +0800 CST
view 472
Wails是Go语言写的跨平台桌面应用框架,GitHub 34.7K Stars,打包体积10-20MB(Electron的1/10)。Go后端+任意前端+系统原生WebView,Go方法直接当JS函数调用,支持热重载和v3跨平台编译。
Wails
Go桌面应用
Electron替代
Tauri对比
跨平台桌面
WebView
前端开发
Golang
Go 1.24 深度解析:Swiss Table 哈希表革命、泛型增强与 weak 包——重新定义 Go 并发性能
编程
Go 1.24 深度解析:Swiss Table 哈希表革命、泛型增强与 weak 包——重新定义 Go 并发性能
2026-06-30 13:15:00 +0800 CST
view 253
2025年2月Go 1.24正式发布,内置map全面切换为Swiss Table,sync.Map引入HashTrieMap架构。本文深入解析两大数据结构的底层原理、性能对比、泛型类型别名、weak包、runtime.AddCleanup等核心新特性,提供完整代码实战与迁移指南。
Go
Go1.24
Swiss Table
HashTrieMap
泛型
weak包
sync.Map
性能优化
Go 1.24 异步函数深度解析:Goroutine 演进路线与 Gin 高并发实战
编程
Go 1.24 异步函数深度解析:Goroutine 演进路线与 Gin 高并发实战
2026-05-26 16:36:51 +0800 CST
view 487
深入解析 Go 1.24/1.25 引入的 async/await 语法,从底层原理到 Gin 框架高并发实战,配合完整项目代码和性能优化指南。
Go
Golang
async
await
Gin
并发
Web开发
性能优化
万字深度解析 Go 1.24:Swiss Tables 颠覆哈希表、泛型类型别名、Weak 指针与后量子密码学
编程
万字深度解析 Go 1.24:Swiss Tables 颠覆哈希表、泛型类型别名、Weak 指针与后量子密码学
2026-07-03 10:46:06 +0800 CST
view 285
深度解析 Go 1.24 核心变更:Swiss Table 重写哈希表带来 2-3% 性能提升、泛型类型别名正式落地、Weak 指针填补内存管理缺口、ML-KEM 后量子密码进入标准库、os.Root 目录限制型文件系统、tool directives 告别 tools.go,以及 bytes 迭代器、runtime.AddCleanup、testing.B.Loop 等全面升级
Go
Go1.24
SwissTable
WeakPointer
crypto
Go 1.24 全方位深度解析:从 Swiss Table 哈希表到后量子密码学,从 Weak 指针到工具链革命
编程
Go 1.24 全方位深度解析:从 Swiss Table 哈希表到后量子密码学,从 Weak 指针到工具链革命
2026-07-03 10:47:06 +0800 CST
view 239
深度解析 Go 1.24 核心变更:Swiss Table 重写哈希表带来 2-3% 性能提升、泛型类型别名正式落地、Weak 指针填补内存管理缺口、ML-KEM 后量子密码进入标准库、os.Root 目录限制型文件系统、tool directives 告别 tools.go,以及 bytes 迭代器、runtime.AddCleanup、testing.B.Loop 等全面升级
Go
Go1.24
SwissTable
WeakPointer
crypto
【深度长文】Go 1.24 发版!瑞士表取代哈希表带来无声性能革命,附 Weak 指针内存优化实战
编程
【深度长文】Go 1.24 发版!瑞士表取代哈希表带来无声性能革命,附 Weak 指针内存优化实战
2026-07-03 10:48:08 +0800 CST
view 259
深度解析 Go 1.24 核心变更:Swiss Table 重写哈希表带来 2-3% 性能提升、泛型类型别名正式落地、Weak 指针填补内存管理缺口、ML-KEM 后量子密码进入标准库、os.Root 目录限制型文件系统、tool directives 告别 tools.go,以及 bytes 迭代器、runtime.AddCleanup、testing.B.Loop 等全面升级
Go
Go1.24
SwissTable
WeakPointer
crypto
程序员视角:升级 Go 1.24 后你的代码会发生什么?瑞士表实测与 Weak 指针应用指南
编程
程序员视角:升级 Go 1.24 后你的代码会发生什么?瑞士表实测与 Weak 指针应用指南
2026-07-03 10:49:24 +0800 CST
view 291
深度解析 Go 1.24 核心变更:Swiss Table 重写哈希表带来 2-3% 性能提升、泛型类型别名正式落地、Weak 指针填补内存管理缺口、ML-KEM 后量子密码进入标准库、os.Root 目录限制型文件系统、tool directives 告别 tools.go,以及 bytes 迭代器、runtime.AddCleanup、testing.B.Loop 等全面升级
Go
Go1.24
SwissTable
WeakPointer
crypto
Go 标准库即将支持自动ETag:静态文件缓存终于不用手写了
编程
Go 标准库即将支持自动ETag:静态文件缓存终于不用手写了
2026-05-21 16:30:11 +0800 CST
view 578
Go团队接受提案#60940,在io/fs中新增HashFileInfo接口,让embed.FS和net/http.FileServer自动生成和校验ETag,Go 1.27起静态文件服务不再需要手动管理HTTP缓存。
Go语言
标准库
ETag
HTTP缓存
Go1.27
io/fs
embed
Web服务
GoGPU 深度实战:纯 Go、零 CGO 的 GPU 计算生态——从 2D 图形到 GUI 工具包的完整指南(2026)
编程
GoGPU 深度实战:纯 Go、零 CGO 的 GPU 计算生态——从 2D 图形到 GUI 工具包的完整指南(2026)
2026-06-28 15:44:07 +0800 CST
view 327
深度解析 GoGPU 纯 Go GPU 计算生态的完整架构:wgpu GPU 抽象层、gg 5 引擎智能光栅化、ui GUI 工具包、naga Shader 编译器、g3d 3D 渲染引擎,含完整代码实战、性能基准与生产部署指南(2026)
Go
GoGPU
WebGPU
GPU计算
图形编程
wgpu
GUI
2D渲染
开源
性能优化
MusaCoder 深度实战:当国产GPU遇见AI驱动的Kernel生成——从PyTorch到CUDA/MUSA原生算子的全栈训练完全指南(2026)
编程
MusaCoder 深度实战:当国产GPU遇见AI驱动的Kernel生成——从PyTorch到CUDA/MUSA原生算子的全栈训练完全指南(2026)
2026-06-16 06:47:47 +0800 CST
view 446
MusaCoder是首个基于国产GPU完成全链路训练的代码大模型,在KernelBench上超越Claude Opus 4.7。从三阶段数据合成、多样性RFT到执行反馈RL,深度解析全栈训练方法论。
MusaCoder
GPU Kernel
摩尔线程
国产GPU
CUDA
MUSA
大模型
强化学习
KernelBench
代码大模型
AI Coding
深度学习
TurboQuant+ 深度拆解:用 2bit KV Cache 压缩重构 LLM 推理经济学——从 Walsh-Hadamard 旋转到 llama.cpp 生产级落地
编程
TurboQuant+ 深度拆解:用 2bit KV Cache 压缩重构 LLM 推理经济学——从 Walsh-Hadamard 旋转到 llama.cpp 生产级落地
2026-07-28 11:48:24 +0800 CST
view 117
深度拆解Google ICLR 2026论文TurboQuant及其工程增强TurboQuant+:极坐标量化+QJL残差编码实现2bit KV Cache压缩,配合llama.cpp跨后端(CUDA/ROCm/Metal/Vulkan)生产级落地,附完整代码实战与选型建议
TurboQuant
KV Cache
LLM推理
llama.cpp
量化
显存优化
Walsh-Hadamard
Vulkan
CUDA
ROCm
TurboQuant+ 深度拆解:用 2bit KV Cache 压缩重构 LLM 推理经济学——从 Walsh-Hadamard 旋转到 llama.cpp 生产级落地
编程
TurboQuant+ 深度拆解:用 2bit KV Cache 压缩重构 LLM 推理经济学——从 Walsh-Hadamard 旋转到 llama.cpp 生产级落地
2026-07-28 11:50:04 +0800 CST
view 145
深度拆解Google ICLR 2026论文TurboQuant及其工程增强TurboQuant+:极坐标量化+QJL残差编码实现2bit KV Cache压缩,配合llama.cpp跨后端(CUDA/ROCm/Metal/Vulkan)生产级落地,附完整代码实战与选型建议
TurboQuant
KV Cache
LLM推理
llama.cpp
量化
显存优化
Walsh-Hadamard
Vulkan
CUDA
ROCm
TurboQuant+深度拆解:极坐标量化+QJL残差编码——2bit KV Cache压缩重构 LLM 推理经济学
编程
TurboQuant+深度拆解:极坐标量化+QJL残差编码——2bit KV Cache压缩重构 LLM 推理经济学
2026-07-28 11:52:16 +0800 CST
view 194
深度拆解Google ICLR 2026论文TurboQuant及其工程增强TurboQuant+:极坐标量化+QJL残差编码实现2bit KV Cache压缩,配合llama.cpp跨后端(CUDA/ROCm/Metal/Vulkan)生产级落地,附完整代码实战与选型建议
TurboQuant
KV Cache
LLM推理
llama.cpp
量化
显存优化
Walsh-Hadamard
Vulkan
CUDA
ROCm
AMD ROCm 7.14 正式版深度解析:从技术预览到生产级 AI 基础设施的完整蜕变
编程
AMD ROCm 7.14 正式版深度解析:从技术预览到生产级 AI 基础设施的完整蜕变
2026-07-23 12:16:06 +0800 CST
view 264
深度解析 AMD ROCm 7.14 正式版:TheRock 构建系统、Ryzen AI Max PRO 400 硬件支持、PyTorch 2.12 + JAX 0.10.0 框架支持、HIPify CUDA 迁移实战与 vLLM 推理部署完整指南。
ROCm
AMD GPU
HIP
CUDA迁移
PyTorch
JAX
MI350P
Ryzen AI Max
ROCm 7.14
vLLM 2026 推理引擎全解:从 PagedAttention 到分离式 Prefill,如何把大模型跑出 GPU 极限性能
编程
vLLM 2026 推理引擎全解:从 PagedAttention 到分离式 Prefill,如何把大模型跑出 GPU 极限性能
2026-06-29 17:16:04 +0800 CST
view 548
2026年vLLM 0.18深度解析:PagedAttention显存管理、EAGLE3推测解码、连续批处理、分离式Prefill、FP4量化,附生产级部署代码与Benchmark对比
vLLM
LLM推理
PagedAttention
推测解码
EAGLE3
FP4量化
CUDA
GPU性能优化
AMD ROCm 7.14 正式版发布:TheRock 构建系统 × Ryzen AI Max PRO 400 × PyTorch 2.12 生产级实战
编程
AMD ROCm 7.14 正式版发布:TheRock 构建系统 × Ryzen AI Max PRO 400 × PyTorch 2.12 生产级实战
2026-07-23 12:17:54 +0800 CST
view 242
深度解析 AMD ROCm 7.14 正式版:TheRock 模块化构建系统、Ryzen AI Max PRO 400 统一内存架构、PyTorch 2.12+JAX 0.10.0 框架支持,配 HIPify 迁移实战与 vLLM 推理部署完整指南。
ROCm
AMD GPU
HIP
CUDA迁移
PyTorch
JAX
MI350P
Ryzen AI Max
万字长文拆解 vLLM 0.18:PagedAttention 如何用操作系统思维颠覆大模型推理
编程
万字长文拆解 vLLM 0.18:PagedAttention 如何用操作系统思维颠覆大模型推理
2026-06-29 17:17:00 +0800 CST
view 341
2026年vLLM 0.18深度解析:PagedAttention显存管理、EAGLE3推测解码、连续批处理、分离式Prefill、FP4量化,附生产级部署代码与Benchmark对比
vLLM
LLM推理
PagedAttention
推测解码
EAGLE3
FP4量化
CUDA
GPU性能优化
DeepTutor 深度解析:当 AI 教育从「问答工具」进化为「原生智能体导师」
编程
DeepTutor 深度解析:当 AI 教育从「问答工具」进化为「原生智能体导师」
2026-04-10 05:13:09 +0800 CST
view 1765
香港大学数据科学研究所开源的 DeepTutor v1.0.0,标志教育AI进入Agent-Native时代:持久记忆、主动教学、多实例TutorBot、CLI原生,从问答工具进化为智能体导师生态系统。
AI
教育
Agent
DeepTutor
HKUDS
开源
英伟达 CUDA-Oxide 0.1 深度解析:用 Rust 编写 GPU 内核的破冰之旅
编程
英伟达 CUDA-Oxide 0.1 深度解析:用 Rust 编写 GPU 内核的破冰之旅
2026-05-10 08:20:42 +0800 CST
view 885
英伟达发布实验性Rust-to-CUDA编译器CUDA-Oxide 0.1,支持用Rust编写SIMT GPU内核并输出标准PTX中间代码。深度解析其架构设计、代码示例与未来展望。
CUDA-Oxide
Rust
GPU编程
NVIDIA
PTX
SIMT
并行计算
高性能计算
SGLang 深度拆解:当 LLM 推理引擎决定「干掉全部慢吞吞的 GPU 服务器」——从 RadixAttention 到 GB300 NVL72 的 25 倍飞跃,一个 27K Star 的 Python 框架如何重新定义大模型推理的终极形态
编程
SGLang 深度拆解:当 LLM 推理引擎决定「干掉全部慢吞吞的 GPU 服务器」——从 RadixAttention 到 GB300 NVL72 的 25 倍飞跃,一个 27K Star 的 Python 框架如何重新定义大模型推理的终极形态
2026-08-04 19:22:29 +0800 CST
view 94
深度拆解SGLang 27K Star开源LLM推理框架:RadixAttention基数树前缀缓存实现3-8倍加速、自研FlashInfer CUDA Kernel、Prefill-Decode分离架构、GB300 NVL72上25倍性能飞跃、DFlash投机采样、多LoRA热切换,附完整部署与调优指南
SGLang
LLM推理
RadixAttention
FlashInfer
GPU加速
大模型部署
推理引擎
PagedAttention
PD分离
投机采样
CUDA
开源
TileKernels 深度解析:DeepSeek 用 80 行代码榨干 GPU,算子开发范式的降维打击
编程
TileKernels 深度解析:DeepSeek 用 80 行代码榨干 GPU,算子开发范式的降维打击
2026-04-30 03:22:15 +0800 CST
view 925
深度解析 DeepSeek 开源的高性能 GPU 算子库 TileKernels:基于 TileLang DSL 用 80 行代码实现手写 CUDA 级性能,覆盖 MoE Gating/Routing、FP8/FP4 量化、Engram 门控等七大算子家族,首次原生支持 NVIDIA Blackwell 架构,并通过 TVM 编译器打通昇腾等国产芯片。
DeepSeek
TileKernels
GPU
CUDA
TileLang
MoE
算子优化
LightRAG 深度拆解:当 RAG 决定「干掉全部纯向量检索」——一个 38K Star 的知识图谱引擎如何用实体-关系双层检索重新定义检索增强生成的终极形态
编程
LightRAG 深度拆解:当 RAG 决定「干掉全部纯向量检索」——一个 38K Star 的知识图谱引擎如何用实体-关系双层检索重新定义检索增强生成的终极形态
2026-08-04 23:15:13 +0800 CST
view 94
深度拆解38K Star开源RAG框架LightRAG:实体-关系双层检索架构、六种检索模式、Neo4j/PostgreSQL可插拔存储、RRF融合排序算法、多模态支持,附完整代码实战与性能基准对比
LightRAG
知识图谱
RAG
向量检索
EMNLP
Python
LLM
检索增强生成
HKUDS
开源
KTransformers 深度拆解:单张 4090 跑满血 DeepSeek-R1 671B,清华团队如何用 CPU/GPU 异构推理实现 28 倍加速
编程
KTransformers 深度拆解:单张 4090 跑满血 DeepSeek-R1 671B,清华团队如何用 CPU/GPU 异构推理实现 28 倍加速
2026-07-29 09:44:03 +0800 CST
view 183
深度拆解清华开源的 KTransformers:MoE 稀疏性卸载、AMX/Marlin 高性能算子、CUDA Graph 与 YAML 注入框架四层架构,单张 4090 跑满血 DeepSeek-R1 671B,附完整部署实战与性能调优清单。
KTransformers
异构推理
MoE
DeepSeek
AMX
CUDA Graph
大模型部署
性能优化
开源
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
41
42
43
44
45
...
93
下一页