程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Valkey 深度拆解:当 Redis 的守护者变成掠夺者——从 BSD 分叉到 2000 节点 10 亿 RPS 的开源逆袭之路
编程
Valkey 深度拆解:当 Redis 的守护者变成掠夺者——从 BSD 分叉到 2000 节点 10 亿 RPS 的开源逆袭之路
2026-08-03 14:13:50 +0800 CST
view 139
深度拆解Valkey从Redis BSD分叉到2000节点10亿RPS的开源逆袭之路:异步IO线程重写、数据预取与内存访问分摊技术、RDMA支持、Valkey-Search向量搜索、原子级槽位迁移,附完整Java/Python代码示例与生产部署指南
Valkey
Redis
内存数据库
开源
BSD
Linux基金会
分布式系统
性能优化
RDMA
向量搜索
Bun 换核启示录:从 Zig 到 Rust,一次 AI 驱动的大型系统迁移工程全记录
编程
Bun 换核启示录:从 Zig 到 Rust,一次 AI 驱动的大型系统迁移工程全记录
2026-06-28 15:15:22 +0800 CST
view 393
2026年5月,Bun完成从Zig到Rust的AI驱动迁移。6755个提交、100万行代码、13365个unsafe,一次教科书级别的工程实验。
Rust
Zig
Bun
JavaScript
TypeScript
AI编程
系统迁移
FFI
unsafe
内存安全
6天、96万行Rust:一场让Claude Code亲手"换心"的疯狂实验,炸出了软件工程的根本矛盾
编程
6天、96万行Rust:一场让Claude Code亲手"换心"的疯狂实验,炸出了软件工程的根本矛盾
2026-07-27 15:16:09 +0800 CST
view 188
2026年Bun从Zig迁移到Rust的完整技术解析:6天96万行代码,99.8%测试通过,13000个unsafe背后的工程权衡,以及这场荒诞实验对软件工程未来的深远影响。
Bun
Zig
Rust
Claude Code
Anthropic
JavaScript
AI编程
语言迁移
开源
内存安全
当 Redis 走向闭源:手搓生产级内存数据库内核,从 RESP 协议到无锁事件循环(附 Go 完整代码)
编程
当 Redis 走向闭源:手搓生产级内存数据库内核,从 RESP 协议到无锁事件循环(附 Go 完整代码)
2026-07-10 07:46:51 +0800 CST
view 290
Redis 改双协议闭源后,Valkey 如何从 Redis 7.2.4 分叉成长为 10 亿 QPS 的开源内存数据库?本文从 RESP 协议、单线程事件循环、跳表 ZSET 到 AOF 持久化,用一份可运行的 Go 代码手搓生产级 KV 引擎内核,并拆解 Valkey 8/9 的 IO 多线程与原子槽位迁移等性能演进。
Valkey
Redis
内存数据库
RESP
Go
KV存储
高性能缓存
Vue 3.5 深度实战:响应式系统重构与性能飞跃——从双向链表到版本计数的内存优化革命
编程
Vue 3.5 深度实战:响应式系统重构与性能飞跃——从双向链表到版本计数的内存优化革命
2026-05-22 05:20:15 +0800 CST
view 630
深度解析 Vue 3.5 响应式系统的颠覆性重构:双向链表与版本计数机制如何让内存占用减少56%、数组操作性能提升10倍。从架构原理到源码实现,再到生产级优化策略的完整指南。
Vue 3.5
响应式系统
双向链表
版本计数
性能优化
内存优化
Preact Signals
Bun 深度拆解:当一个 9 万 Star 的 JavaScript 运行时决定用 Rust 重写自己——从 Zig 到 Rust 的百万行代码迁徙如何重塑 JS 运行时的未来
编程
Bun 深度拆解:当一个 9 万 Star 的 JavaScript 运行时决定用 Rust 重写自己——从 Zig 到 Rust 的百万行代码迁徙如何重塑 JS 运行时的未来
2026-08-03 19:42:24 +0800 CST
view 147
深度拆解Bun从Zig到Rust的百万行代码重写:6755个commit、100万+新增代码、二进制体积缩小3-8MB、内存泄漏修复、AI辅助开发实践,附完整性能基准与迁移指南
Bun
Rust
JavaScript运行时
Node.js替代
Zig
内存安全
JavaScriptCore
性能优化
开源
AI辅助开发
Bun 从 Zig 迁移到 Rust:78 万行代码、11 天、16.5 万美元——AI 主导大规模重写的工程启示录
编程
Bun 从 Zig 迁移到 Rust:78 万行代码、11 天、16.5 万美元——AI 主导大规模重写的工程启示录
2026-07-16 16:13:43 +0800 CST
view 698
2026年7月Bun从Zig全面迁移到Rust:11天完成78万行代码转换,100%测试通过。深度解析迁移背后的技术决策、AI辅助工程实践、以及Rust相比Zig在内存安全方面的核心优势。
Bun
Rust
Zig
AI编程
前端工具链
代码迁移
内存安全
TypeScript
JavaScript
系统编程
Rust 首进 TIOBE 前十:一条编程语言榜单背后的内存安全革命
编程
Rust 首进 TIOBE 前十:一条编程语言榜单背后的内存安全革命
2026-07-10 14:13:59 +0800 CST
view 327
深度解析2026年7月Rust首进TIOBE前十背后的技术真相,从所有权系统、借用检查器、生命周期到Tokio异步运行时,结合代码示例全面剖析Rust的内存安全革命。
Rust
内存安全
编程语言
TIOBE
所有权系统
Async Rust
Tokio
Rust 突围 2026:从 TIOBE 历史新高到四大生产落地的全链路实战指南
编程
Rust 突围 2026:从 TIOBE 历史新高到四大生产落地的全链路实战指南
2026-06-10 07:49:15 +0800 CST
view 638
Rust 首次跻身 TIOBE 全球第12名,从语言演进到四大生产落地案例的全链路实战指南
Rust
TIOBE
系统编程
内存安全
异步编程
Intel OpenVINO 2026.3 深度拆解:当推理工具包决定拥抱 Agentic AI——从 MoE 磁盘卸载到 GenAI 三条流水线全链路实战
编程
Intel OpenVINO 2026.3 深度拆解:当推理工具包决定拥抱 Agentic AI——从 MoE 磁盘卸载到 GenAI 三条流水线全链路实战
2026-08-12 14:45:58 +0800 CST
view 61
深度拆解 Intel OpenVINO 2026.3:MoE 磁盘卸载让 300 亿参数模型跑在 16GB 内存、三条 GenAI 新流水线(多模态 Omni/ASR/嵌入生成)、FP8 量化和持续批处理全链路实战,配完整 Python 代码与 15 条生产踩坑清单
OpenVINO
Intel
AI推理
MoE
GenAI
边缘计算
模型压缩
FP8量化
持续批处理
推测解码
2026年大模型推理框架横评:vLLM 0.5 vs TGI 2.0 vs TensorRT-LLM 1.8 vs DeepSpeed-MII 0.9
编程
2026年大模型推理框架横评:vLLM 0.5 vs TGI 2.0 vs TensorRT-LLM 1.8 vs DeepSpeed-MII 0.9
2026-07-10 17:44:16 +0800 CST
view 423
深度对比2026年四大主流LLM推理框架:vLLM 0.5、TGI 2.0、TensorRT-LLM 1.8、DeepSpeed-MII 0.9,涵盖PagedAttention、FP8量化、ZeRO-3、连续批处理等核心技术原理,配生产级代码示例与实测性能数据。
LLM
vLLM
TensorRT-LLM
TGI
DeepSpeed
推理优化
量化
AI部署
Google AI Edge Gallery:手机离线跑大模型时代来了,2.2万Star端侧AI神器
案例
Google AI Edge Gallery:手机离线跑大模型时代来了,2.2万Star端侧AI神器
2026-05-09 07:36:45 +0800 CST
view 1198
Google开源AI神器AI Edge Gallery斩获2.2万Star,支持iOS和Android手机离线运行Gemma 4等大模型,提供AI Chat、Ask Image、Audio Scribe、Agent Skills四大功能,消费级入口形态让普通用户轻松体验端侧AI
端侧AI
手机大模型
离线推理
Gemma 4
Google开源
iOS
Android
Headroom 深度实战:当 AI Agent 学会了「精打细算」——从 Token 成本黑洞到上下文压缩的底层原理、从 CCR 可逆存储到六大压缩算法的生产级完全指南(2026)
编程
Headroom 深度实战:当 AI Agent 学会了「精打细算」——从 Token 成本黑洞到上下文压缩的底层原理、从 CCR 可逆存储到六大压缩算法的生产级完全指南(2026)
2026-06-21 15:57:54 +0800 CST
view 362
深度解析开源项目 Headroom:AI Agent 的上下文压缩中间层,60-95% Token 节省,CCR 可逆存储,六大压缩算法完全指南。
AI编程
Token压缩
Headroom
上下文管理
LLM推理优化
AI Agent
BrickNet开源:AI玩乐高不再翻车,连接图让积木组装零误差
案例
BrickNet开源:AI玩乐高不再翻车,连接图让积木组装零误差
2026-05-09 07:38:19 +0800 CST
view 791
BrickNet开源项目:用连接图替代绝对坐标预测,解决AI乐高组装的误差累积问题。基于Qwen 3训练,标注五种连接器类型,使用32万+组装样本数据集,生成物理可行的分步组装程序,可直接用于机器人执行
AI乐高
连接图生成
3D组装
Qwen 3
结构推理
LDraw
机器人组装
Qwen3.8-Max架构深度拆解:2.4万亿稀疏MoE如何用950亿激活参数挑战Claude——从混合专家路由到百万Token滑窗记忆的全链路工程革命
编程
Qwen3.8-Max架构深度拆解:2.4万亿稀疏MoE如何用950亿激活参数挑战Claude——从混合专家路由到百万Token滑窗记忆的全链路工程革命
2026-08-12 18:14:32 +0800 CST
view 57
深度拆解阿里巴巴Qwen3.8-Max架构:2.4万亿参数的稀疏MoE如何用950亿激活参数实现GPT-4级能力,从分层专家路由、百万Token滑动窗口缓存到自主编程能力的全链路工程解析
Qwen3.8-Max
稀疏MoE
混合专家
Transformer架构
大模型推理
百万Token上下文
深度学习
AI
DeepSeek 专家模式深度解析:当低调更新成为AGI赛道的产品哲学宣言
编程
DeepSeek 专家模式深度解析:当低调更新成为AGI赛道的产品哲学宣言
2026-04-09 10:23:56 +0800 CST
view 895
2026年4月8日,DeepSeek悄然上线「专家模式」,无发布会无公告,却被业内视为V4发布前最有分量的产品预告。本文深度拆解双模式技术架构差异,实测数理推理、专业编程、创意写作三大场景,并解读这一低调更新背后的产品哲学与行业信号。
DeepSeek
AI大模型
V4
专家模式
推理模型
产品设计
国产AI
场景分层
Kimi K3 纯 C 语言 CPU 推理实战:2.8 万亿参数大模型如何在单台 MacBook 上跑起来
编程
Kimi K3 纯 C 语言 CPU 推理实战:2.8 万亿参数大模型如何在单台 MacBook 上跑起来
2026-08-12 19:44:53 +0800 CST
view 61
深度拆解纯C语言实现Kimi K3大模型CPU推理:MoE架构、MXFP4量化、SIMD优化、KDA注意力机制,配完整代码示例与生产踩坑清单
Kimi K3
MoE架构
CPU推理
纯C语言
极限量化
K8s 1.36 ImageVolume 深度实战:当 OCI 镜像成为 Volume——从模型权重分发到配置即代码的云原生分发范式革命(2026)
编程
K8s 1.36 ImageVolume 深度实战:当 OCI 镜像成为 Volume——从模型权重分发到配置即代码的云原生分发范式革命(2026)
2026-06-21 20:32:03 +0800 CST
view 348
深入解析 Kubernetes v1.36 GA 的 ImageVolume 特性,揭示 OCI 镜像作为 Volume 的架构原理与实战用法,涵盖 AI 模型权重分发、安全签名、CI/CD 工件等核心场景。
Kubernetes
K8s
ImageVolume
OCI
云原生
容器存储
AI推理
DevOps
GitOps
纯 C 语言运行 Kimi K3:2.8 万亿参数大模型的 CPU 推理实战与架构深度拆解
编程
纯 C 语言运行 Kimi K3:2.8 万亿参数大模型的 CPU 推理实战与架构深度拆解
2026-08-12 19:45:46 +0800 CST
view 61
深度拆解纯C语言实现Kimi K3大模型CPU推理:MoE架构、MXFP4量化、SIMD优化、KDA注意力机制,配完整代码示例与生产踩坑清单
Kimi K3
MoE架构
CPU推理
纯C语言
极限量化
TurboQuant+ 深度拆解:用 2bit KV Cache 压缩重构 LLM 推理经济学——从 Walsh-Hadamard 旋转到 llama.cpp 生产级落地
编程
TurboQuant+ 深度拆解:用 2bit KV Cache 压缩重构 LLM 推理经济学——从 Walsh-Hadamard 旋转到 llama.cpp 生产级落地
2026-07-28 11:48:24 +0800 CST
view 139
深度拆解Google ICLR 2026论文TurboQuant及其工程增强TurboQuant+:极坐标量化+QJL残差编码实现2bit KV Cache压缩,配合llama.cpp跨后端(CUDA/ROCm/Metal/Vulkan)生产级落地,附完整代码实战与选型建议
TurboQuant
KV Cache
LLM推理
llama.cpp
量化
显存优化
Walsh-Hadamard
Vulkan
CUDA
ROCm
DSpark:DeepSeek联手北大「投机解码」登顶,推理速度飙升85%背后真相
编程
DSpark:DeepSeek联手北大「投机解码」登顶,推理速度飙升85%背后真相
2026-06-29 13:45:21 +0800 CST
view 407
深度解析DeepSeek联合北京大学发布的DSpark置信度调度投机解码框架,剖析半自回归候选生成、动态验证调度、硬件感知前缀缓存三大核心创新
DeepSeek
DSpark
投机解码
大模型推理
置信度调度
Speculative Decoding
LMCache 实战:大模型推理的 KV Cache 终极优化方案
编程
LMCache 实战:大模型推理的 KV Cache 终极优化方案
2026-07-23 08:44:51 +0800 CST
view 200
LMCache 实战指南:通过智能 KV Cache 管理,实现 LLM 推理吞吐量最高 10 倍提升,显存占用降低 40%-60%。包含 vLLM/TGI 集成、分布式缓存、性能调优最佳实践。
LMCache
KV Cache
LLM推理优化
vLLM
RAG性能优化
TurboQuant+ 深度拆解:用 2bit KV Cache 压缩重构 LLM 推理经济学——从 Walsh-Hadamard 旋转到 llama.cpp 生产级落地
编程
TurboQuant+ 深度拆解:用 2bit KV Cache 压缩重构 LLM 推理经济学——从 Walsh-Hadamard 旋转到 llama.cpp 生产级落地
2026-07-28 11:50:04 +0800 CST
view 174
深度拆解Google ICLR 2026论文TurboQuant及其工程增强TurboQuant+:极坐标量化+QJL残差编码实现2bit KV Cache压缩,配合llama.cpp跨后端(CUDA/ROCm/Metal/Vulkan)生产级落地,附完整代码实战与选型建议
TurboQuant
KV Cache
LLM推理
llama.cpp
量化
显存优化
Walsh-Hadamard
Vulkan
CUDA
ROCm
TurboQuant+深度拆解:极坐标量化+QJL残差编码——2bit KV Cache压缩重构 LLM 推理经济学
编程
TurboQuant+深度拆解:极坐标量化+QJL残差编码——2bit KV Cache压缩重构 LLM 推理经济学
2026-07-28 11:52:16 +0800 CST
view 218
深度拆解Google ICLR 2026论文TurboQuant及其工程增强TurboQuant+:极坐标量化+QJL残差编码实现2bit KV Cache压缩,配合llama.cpp跨后端(CUDA/ROCm/Metal/Vulkan)生产级落地,附完整代码实战与选型建议
TurboQuant
KV Cache
LLM推理
llama.cpp
量化
显存优化
Walsh-Hadamard
Vulkan
CUDA
ROCm
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
6
7
8
9
10
...
16
下一页