程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
ds4 (DwarfStar) 深度实战:当 Redis 之父学会「大模型量化」——从非对称 2-bit 量化到磁盘 KV 缓存的生产级完全指南(2026)
编程
ds4 (DwarfStar) 深度实战:当 Redis 之父学会「大模型量化」——从非对称 2-bit 量化到磁盘 KV 缓存的生产级完全指南(2026)
2026-06-15 00:18:14 +0800 CST
view 531
深度剖析 Redis 之父 antirez 的最新项目 ds4 (DwarfStar),专为 DeepSeek V4 Flash 设计的本地推理引擎。涵盖非对称 2-bit 量化、磁盘 KV 缓存、Metal/CUDA 优化、内置 Coding Agent 等核心技术。
ds4
DwarfStar
antirez
Redis
大模型推理
MoE架构
量化
Kimi K2 系列深度实战:月之暗面开源编码大模型架构解析与生产级部署完全指南
编程
Kimi K2 系列深度实战:月之暗面开源编码大模型架构解析与生产级部署完全指南
2026-06-28 03:15:43 +0800 CST
view 438
深度解析月之暗面Kimi K2系列(K2.5/K2.6/K2.7 Code)的MoE架构、多模态能力、Token优化策略,附Ollama本地部署、OpenRouter API集成、OpenCode实战及Agent工作流完整代码。
Kimi K2
月之暗面
MoE架构
编码大模型
AI编程
Token优化
本地部署
OpenRouter
多模态
Agent工作流
当 Redis 之父遇上 DeepSeek V4 Flash:ds4.c 如何用 900 行代码重写本地大模型推理
编程
当 Redis 之父遇上 DeepSeek V4 Flash:ds4.c 如何用 900 行代码重写本地大模型推理
2026-07-15 18:15:32 +0800 CST
view 181
Redis创始人antirez开源ds4.c:用C语言+Metal GPU手写DeepSeek V4 Flash推理引擎,26 tok/s性能,2-bit MoE量化,KV缓存磁盘分层管理
ds4.c
DeepSeek V4 Flash
Metal推理
Redis之父
MoE量化
KV缓存分层
百度 Unlimited OCR 深度实战:30亿参数仅激活5亿、R-SWA注意力革命——长文档OCR端到端SOTA完全指南(2026)
编程
百度 Unlimited OCR 深度实战:30亿参数仅激活5亿、R-SWA注意力革命——长文档OCR端到端SOTA完全指南(2026)
2026-06-28 06:43:54 +0800 CST
view 461
百度2026年6月开源Unlimited OCR:30亿参数仅激活5亿,R-SWA注意力把KV Cache压成常数,一次前向推理处理几十页文档,OmniDocBench v1.6得分93.92%刷新SOTA。
百度 Unlimited OCR
OCR
R-SWA
长文档
端到端
MoE
SGLang
DuckDB 深度拆解:当分析型数据库学会「嵌入式」——列式向量化引擎与 Morsel 驱动并行如何重写 OLAP 心智模型
编程
DuckDB 深度拆解:当分析型数据库学会「嵌入式」——列式向量化引擎与 Morsel 驱动并行如何重写 OLAP 心智模型
2026-07-15 19:43:28 +0800 CST
view 170
从架构原理到实战场景,深度拆解 DuckDB 嵌入式分析型数据库的列式向量化引擎、Morsel 驱动并行架构、MySQL+DuckDB 混合存储引擎,以及 10 个日常使用场景和 7 个性能优化技巧。
DuckDB
OLAP
列式存储
向量化执行
Morsel驱动并行
数据分析
嵌入式数据库
Parquet
DuckDB 深度拆解:嵌入式 OLAP 数据库的列式向量化引擎架构与工程实践
编程
DuckDB 深度拆解:嵌入式 OLAP 数据库的列式向量化引擎架构与工程实践
2026-07-15 19:43:45 +0800 CST
view 139
从架构原理到实战场景,深度拆解 DuckDB 嵌入式分析型数据库的列式向量化引擎、Morsel 驱动并行架构、MySQL+DuckDB 混合存储引擎,以及 10 个日常使用场景和 7 个性能优化技巧。
DuckDB
OLAP
列式存储
向量化执行
Morsel驱动并行
数据分析
嵌入式数据库
Parquet
GLM-5.2 深度实战:当开源编程模型首次摸到 Opus 4.8 的天花板——从 753B MoE 架构到 1M 无损上下文、从 DSA 稀疏注意力到国产算力 Day-0 部署的生产级完全指南(2026)
编程
GLM-5.2 深度实战:当开源编程模型首次摸到 Opus 4.8 的天花板——从 753B MoE 架构到 1M 无损上下文、从 DSA 稀疏注意力到国产算力 Day-0 部署的生产级完全指南(2026)
2026-06-20 15:52:19 +0800 CST
view 831
GLM-5.2 开源深度解析:753B MoE 架构、1M 无损上下文、DSA 稀疏注意力、生产级部署完全指南
AI
开源模型
GLM
智谱
编程工具
MoE
大模型
Vue 3.6 Vapor Mode 深度解析:跳过虚拟 DOM——从编译原理到性能极致优化的完整技术指南(2026)
编程
Vue 3.6 Vapor Mode 深度解析:跳过虚拟 DOM——从编译原理到性能极致优化的完整技术指南(2026)
2026-07-04 05:42:15 +0800 CST
view 508
Vue 3.6 Vapor Mode 深度解析:跳过虚拟 DOM,直接操作真实 DOM,内存砍半,性能媲美 SolidJS 和 Svelte 5。含完整代码示例与生产级部署指南。
Vue
Vapor Mode
虚拟DOM
前端框架
性能优化
编译时优化
SolidJS
Svelte
Kimi K2.6开源:13小时编码与300子Agent集群,国产大模型抢滩长程编程高地
编程
Kimi K2.6开源:13小时编码与300子Agent集群,国产大模型抢滩长程编程高地
2026-04-27 14:52:59 +0800 CST
view 819
深度解析月之暗面开源的Kimi K2.6模型:13小时不间断编码、300子Agent集群协作、5天自主运行的技术架构与实测案例分析
Kimi K2.6
开源模型
长程编程
AI Agent
国产大模型
Moonshot AI
Agent集群
编程助手
DeepSeek V4 深度解析:DSA 稀疏注意力与 mHC 流形约束——百万上下文普惠化的技术革命(2026)
编程
DeepSeek V4 深度解析:DSA 稀疏注意力与 mHC 流形约束——百万上下文普惠化的技术革命(2026)
2026-07-04 06:44:28 +0800 CST
view 254
2026年4月DeepSeek V4发布,开创百万上下文普惠化时代。深度解析DSA稀疏注意力、mHC流形约束、Muon优化器三大技术创新,含完整代码实战与部署指南。
DeepSeek V4
大模型
MoE
稀疏注意力
长上下文
DSA
mHC
LLM 推理优化全景实战:从 PagedAttention 到投机解码——让大模型推理成本下降 70% 的技术革命(2026)
编程
LLM 推理优化全景实战:从 PagedAttention 到投机解码——让大模型推理成本下降 70% 的技术革命(2026)
2026-05-30 15:42:55 +0800 CST
view 513
深度解析 LLM 推理优化的核心技术:PagedAttention 内存管理革命、投机解码加速策略、INT4/FP8 量化技术、MoE 架构优化,从架构原理到代码实战,让大模型推理成本下降 70%。
LLM
推理优化
vLLM
PagedAttention
投机解码
量化
MoE
WorldMonitor 深度拆解:73K Stars 的「全球态势感知」仪表盘,凭什么不用任何前端框架?
编程
WorldMonitor 深度拆解:73K Stars 的「全球态势感知」仪表盘,凭什么不用任何前端框架?
2026-07-27 08:44:14 +0800 CST
view 73
深度拆解一周涨1万Star的WorldMonitor:500+信源聚合、双地图引擎、零框架Vanilla TS前端、一套代码6个站点变体、本地Ollama兜底与MCP/SDK全家桶,附自托管与mini复刻实战。
WorldMonitor
开源
态势感知
Vanilla TypeScript
deck.gl
MCP
Ollama
Tauri
OpenMontage 深度实战:全球首个开源 AI Agent 视频制作系统——12条管线、52个工具、500+技能,让 AI 编程助手变身完整视频工作室(2026)
编程
OpenMontage 深度实战:全球首个开源 AI Agent 视频制作系统——12条管线、52个工具、500+技能,让 AI 编程助手变身完整视频工作室(2026)
2026-06-28 09:45:13 +0800 CST
view 699
深度解析全球首个开源 AI Agent 视频制作系统 OpenMontage:12条制作管线、52个工具、500+ Agent技能,支持 AI 图像动画和真实素材剪辑两种路径,成本低至 0.02 美元,附完整代码实战和架构解析。
AI视频,Agent,开源,Remotion,CLIP,FLUX,视频制作,AI编程,自动化
6G通感算智融合架构深度解析:当通信基站进化为「超级智能体」——从协议栈到底层原理的完全指南(2026)
编程
6G通感算智融合架构深度解析:当通信基站进化为「超级智能体」——从协议栈到底层原理的完全指南(2026)
2026-06-09 19:51:27 +0800 CST
view 609
深度解析6G通感算智融合架构:太赫兹通信、通感一体化ISAC、天地一体组网、算力网络协同。含代码示例和架构分析。
6G
通信技术
通感算智融合
ISAC
太赫兹
天地一体
边缘计算
网络架构
低轨卫星
MIMO
OpenHuman 深度实战:Rust+Tauri 构建本地优先的 AI 桌面助手——Memory Tree 持久记忆与 118+ 集成完全指南(2026)
编程
OpenHuman 深度实战:Rust+Tauri 构建本地优先的 AI 桌面助手——Memory Tree 持久记忆与 118+ 集成完全指南(2026)
2026-05-30 21:11:41 +0800 CST
view 528
OpenHuman 用 Rust+Tauri 构建本地优先的 AI 桌面助手,通过 Memory Tree 持久记忆和 118+ 集成让 Agent 拥有跨会话长期记忆。本文从架构原理到生产级部署完整拆解。
OpenHuman
Rust
Tauri
AI桌面助手
Memory Tree
知识图谱
本地AI
4万Star的AI Agent底层框架pi-mono:OpenClaw的发动机,用4个工具做到了极致
编程
4万Star的AI Agent底层框架pi-mono:OpenClaw的发动机,用4个工具做到了极致
2026-04-27 21:05:47 +0800 CST
view 965
pi-mono是一个4万Star的TypeScript单仓项目,专门用来构建AI Agent和管理LLM部署。OpenClaw的核心运行时就是基于Pi的SDK构建的。核心只有4个工具,系统提示词不到1000个token,通过7个独立npm包实现模块化架构。
Agent框架
开源项目
AI编程
GitHub
pi-mono
智谱 GLM-5.1 深度解析:当开源模型突破「8小时自治」临界点
编程
智谱 GLM-5.1 深度解析:当开源模型突破「8小时自治」临界点
2026-04-09 00:53:51 +0800 CST
view 1429
2026年4月8日智谱发布GLM-5.1,744B参数MIT开源,SWE-bench Pro 58.4分超越Claude Opus 4.6,全球首个支持8小时长程自治的开源模型。
GLM-5.1
智谱AI
开源大模型
MoE
SWE-bench
长程自治
LLM
DeepSeek V4 深度解析:百万token上下文的技术革命,让开源模型站上全球之巅
编程
DeepSeek V4 深度解析:百万token上下文的技术革命,让开源模型站上全球之巅
2026-04-28 08:19:25 +0800 CST
view 649
深度解析 DeepSeek V4:混合注意力机制、MoE 架构、100万token 上下文、Agent 能力,从技术原理到部署实战,全面剖析开源模型新天花板
DeepSeek
AI大模型
开源
长上下文
MoE
混合注意力
Agent
小米 MiMo UltraSpeed 深度解析:当 SWA 架构重塑 LLM 推理——从 O(n²) 困境到 1000 tokens/s 的极致跨越
编程
小米 MiMo UltraSpeed 深度解析:当 SWA 架构重塑 LLM 推理——从 O(n²) 困境到 1000 tokens/s 的极致跨越
2026-06-15 21:20:49 +0800 CST
view 272
深入解析小米MiMo UltraSpeed如何通过SWA架构在通用GPU上突破1000 tokens/s推理速度,从O(n²)困境到极致跨越的完整技术指南。
SWA
Sliding Window Attention
LLM推理
小米MiMo
推理优化
Transformer
PagedAttention
量化推理
端侧AI
TileLang + TileKernels 深度解析:DeepSeek 如何用 Python 写出让 GPU 逼近理论性能上限的 GPU 内核
编程
TileLang + TileKernels 深度解析:DeepSeek 如何用 Python 写出让 GPU 逼近理论性能上限的 GPU 内核
2026-04-28 10:55:20 +0800 CST
view 675
深度剖析 DeepSeek 开源的 TileLang DSL 和 TileKernels GPU 内核库:从 GEMM 到 MoE,从 TVM 编译基础设施到生产级量化内核,揭示用 Python 写接近硬件极限性能 GPU 代码的秘密。
TileLang
GPU内核
DeepSeek
高性能计算
CUDA
GEMM
MoE
量化
TVM
开源项目
Google Gemma 4 深度解析:当开源AI进入「逐层嵌入平行化」时代
编程
Google Gemma 4 深度解析:当开源AI进入「逐层嵌入平行化」时代
2026-04-09 04:54:56 +0800 CST
view 966
Google于2026年4月发布Gemma 4开源模型系列,首次全面切换Apache 2.0许可证,搭载Per-Layer Embedding架构创新,26B MoE以3.8B激活参数击败Qwen3-235B。本文深度解析PLE架构、稀疏激活机制与全规格产品矩阵。
Gemma 4
Google
开源模型
Apache 2.0
MoE
Per-Layer Embedding
Vue 3.6 深度拆解:一行 vapor 标记告别虚拟 DOM,alien-signals 底盘换血,这场憋了三年的编译期革命终于落地
编程
Vue 3.6 深度拆解:一行 vapor 标记告别虚拟 DOM,alien-signals 底盘换血,这场憋了三年的编译期革命终于落地
2026-07-28 04:16:48 +0800 CST
view 60
深度拆解 Vue 3.6:Vapor Mode 编译产物级对比(VNode 树 vs DOM 指令流)、alien-signals 双向链表与 push-pull 混合传播原理、双模式互操作与渐进迁移策略,附行情列表实战与升级检查清单。
Vue
Vapor Mode
alien-signals
响应式
虚拟DOM
前端框架
性能优化
编译器
信号
开源
Vue 3.6 深度解析:Vapor Mode 与 alien-signals——前端框架性能战争的终局之战
编程
Vue 3.6 深度解析:Vapor Mode 与 alien-signals——前端框架性能战争的终局之战
2026-07-23 00:45:15 +0800 CST
view 95
深入解析 Vue 3.6 的两大核心更新:Vapor Mode(消除虚拟 DOM 的编译时渲染策略)和 alien-signals(1KB 重写的响应式引擎)。涵盖原理分析、性能数据、实战代码与生态影响。
Vue
Vapor Mode
alien-signals
前端性能
响应式
编译优化
PostgreSQL 18 → 19 深度实战:当世界上最先进的开源数据库迎来 30 岁——从异步 I/O 引擎到智能图查询,2026 生产级完全指南
编程
PostgreSQL 18 → 19 深度实战:当世界上最先进的开源数据库迎来 30 岁——从异步 I/O 引擎到智能图查询,2026 生产级完全指南
2026-06-11 14:48:47 +0800 CST
view 429
深度解析 PostgreSQL 18 异步I/O、跳过扫描、UUIDv7 等核心新特性,前瞻 PG19 Beta 的 REPACK、64位 MultiXact、ON CONFLICT DO SELECT 等关键改进,附完整性能优化实战案例和生产级配置指南。
PostgreSQL
数据库
性能优化
PostgreSQL 18
PostgreSQL 19
AIO
SQL
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
16
17
18
19
20
...
58
下一页