程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
oMLX 深度实战:当 Apple Silicon 遇见本地大模型推理——从 MTP 加速到分层 KV 缓存的生产级完全指南(2026)
编程
oMLX 深度实战:当 Apple Silicon 遇见本地大模型推理——从 MTP 加速到分层 KV 缓存的生产级完全指南(2026)
2026-06-16 16:46:05 +0800 CST
view 995
深度解析 2026 年 Apple Silicon 本地大模型推理技术栈:从 llama.cpp 量化体系到 oMLX 分层 KV 缓存架构,从 MTP 加速到 CoreAI 全栈指南,包含实测 Benchmark 与生产级部署方案。
Apple Silicon
MLX
llama.cpp
oMLX
MTP
本地大模型
量化
本地推理
Kubernetes 深度拆解:当 Google 决定「干掉 Kubernetes 的控制平面」——从 1.36 的 DRA 革命到 Agent Substrate 的 30 倍超额订阅,一个容器编排平台如何被重新定义为 AI 智能体的操作系统
编程
Kubernetes 深度拆解:当 Google 决定「干掉 Kubernetes 的控制平面」——从 1.36 的 DRA 革命到 Agent Substrate 的 30 倍超额订阅,一个容器编排平台如何被重新定义为 AI 智能体的操作系统
2026-08-04 15:44:36 +0800 CST
view 181
深度拆解Kubernetes从容器编排到AI原生基础设施的范式革命:K8s 1.36 DRA GA、用户命名空间GA、PodGroup API,Google Agent Sandbox安全沙箱、Agent Substrate 30倍超额订阅调度层,附完整部署实战指南
Kubernetes
AI原生
Agent Substrate
Agent Sandbox
DRA
容器编排
云原生
GKE
gVisor
PodGroup
智能体调度
Google
OpenTelemetry Collector 生产级部署:从架构设计到 eBPF 无侵入可观测性的完整实战
编程
OpenTelemetry Collector 生产级部署:从架构设计到 eBPF 无侵入可观测性的完整实战
2026-04-29 14:20:56 +0800 CST
view 678
深度解析 OpenTelemetry Collector 生产级部署架构,从 Gateway+Agent 模式到 eBPF 无侵入可观测性,涵盖批处理优化、尾部采样、高可用设计与性能调优完整实战
OpenTelemetry
eBPF
可观测性
云原生
Kubernetes
分布式追踪
Redis之父antirez亲自下场!为DeepSeek V4 Flash打造专属推理引擎,Mac上跑出468 token/s
案例
Redis之父antirez亲自下场!为DeepSeek V4 Flash打造专属推理引擎,Mac上跑出468 token/s
2026-05-10 08:40:22 +0800 CST
view 847
Redis之父antirez亲自下场!为DeepSeek V4 Flash打造专属推理引擎ds4.c,C+Metal从头编写,Mac Studio M3 Ultra上预填充468 token/s。关键优化:非对称量化(MoE专家层2-bit)、KV缓存搬硬盘、内置OpenAI/Anthropic双API。128GB Mac可跑,专为coding agent优化。
DeepSeek
AI推理
Mac
Redis
antirez
Metal
本地推理
MoE
GGUF
C语言
Apple Silicon
Claude Code
OpenAI API
Anthropic API
Zed 深度拆解:当 Rust 决定「干掉全部 Electron 代码编辑器」——一个 88K Star 的 GPU 原生编辑器如何用 GPUI 和 Agent Client Protocol 重新定义「代码编辑器」的终极形态
编程
Zed 深度拆解:当 Rust 决定「干掉全部 Electron 代码编辑器」——一个 88K Star 的 GPU 原生编辑器如何用 GPUI 和 Agent Client Protocol 重新定义「代码编辑器」的终极形态
2026-08-04 17:44:55 +0800 CST
view 209
深度拆解Zed 88K Star GPU原生代码编辑器:GPUI自研渲染引擎、多Agent并行编排、ACP开放协议、DeltaDB下一代版本控制、Zeta编辑预测模型,重新定义AI时代的代码编辑器架构
Zed
Rust
GPUI
Agent Client Protocol
ACP
GPU加速
代码编辑器
Parallel Agents
DeltaDB
Zeta
AI编辑器
开源
DiffusionGemma 深度实战:当 Google 用「扩散」颠覆自回归——从离散文本扩散原理到 MoE 架构、本地推理加速与生产级部署的完全指南(2026)
编程
DiffusionGemma 深度实战:当 Google 用「扩散」颠覆自回归——从离散文本扩散原理到 MoE 架构、本地推理加速与生产级部署的完全指南(2026)
2026-06-16 18:52:52 +0800 CST
view 583
Google DeepMind联合NVIDIA发布DiffusionGemma——基于离散文本扩散的实验性开源模型。本文深入解读26B MoE架构、双向注意力机制、本地推理4倍加速原理,附完整代码示例和部署实战。
Google
DiffusionGemma
扩散模型
MoE
开源LLM
本地推理
AI推理加速
Drizzle ORM 深度拆解:当 TypeScript 决定「干掉全部传统 ORM」——一个 35K Star 的查询构建器如何用 JIT 编译和零运行时抽象重新定义数据库访问的终极形态
编程
Drizzle ORM 深度拆解:当 TypeScript 决定「干掉全部传统 ORM」——一个 35K Star 的查询构建器如何用 JIT 编译和零运行时抽象重新定义数据库访问的终极形态
2026-08-04 18:14:32 +0800 CST
view 147
深度拆解35K Star开源TypeScript ORM Drizzle:JIT Row Mapper把ORM开销压到接近零、类型安全查询构建器全链路推导、支持10+数据库驱动和边缘计算部署,Bun+Drizzle基准测试延迟7.3ms碾压Go
Drizzle ORM
TypeScript
ORM
数据库
JIT编译
查询构建器
Bun
PostgreSQL
SQLite
边缘计算
Gemma 4 架构解密:MoE 路由 × GQA 注意力 × Thinking Mode——31B 如何击败 20 倍参数对手
编程
Gemma 4 架构解密:MoE 路由 × GQA 注意力 × Thinking Mode——31B 如何击败 20 倍参数对手
2026-04-19 17:47:49 +0800 CST
view 884
深入解析 Google Gemma 4 的核心技术架构:MoE 稀疏专家路由、GQA 分组查询注意力、PLE 逐层嵌入、Thinking Mode 推理机制,详解 31B 模型如何以小博大击败 20 倍参数对手,附全场景部署实战代码。
Gemma
Google
AI
开源大模型
MoE
GQA
Transformer
深度学习
模型架构
TimesFM 2.5 深度解析:Google 如何用 200M 参数的时间序列基础模型颠覆传统预测范式
编程
TimesFM 2.5 深度解析:Google 如何用 200M 参数的时间序列基础模型颠覆传统预测范式
2026-04-19 19:46:34 +0800 CST
view 1015
Google TimesFM 2.5 时间序列基础模型深度解析:Patched Decoder 架构、XReg 协变量机制、LoRA 微调实战、BigQuery ML 部署,从零样本预测到生产落地全链路指南
TimesFM
时间序列
机器学习
Google
深度学习
Google ADK 2.0 深度解析:图工作流、协作智能体与A2A协议——从单Agent到企业级多智能体编排的完整实战指南
编程
Google ADK 2.0 深度解析:图工作流、协作智能体与A2A协议——从单Agent到企业级多智能体编排的完整实战指南
2026-07-05 20:42:20 +0800 CST
view 708
深度解析Google ADK 2.0核心架构:图工作流引擎、动态工作流、协作智能体、A2A协议。从架构原理到代码实战,覆盖五语言SDK、部署运维、1.x迁移指南,含完整多Agent协作系统示例。
Google ADK
Agent Development Kit
A2A
图工作流
多智能体
AI Agent
Gemini
Python
Go
企业级
LiteRT-LM:Google端侧大模型推理引擎的革命性架构——从TensorFlow Lite的困境到LLM原生推理的全链路解析
编程
LiteRT-LM:Google端侧大模型推理引擎的革命性架构——从TensorFlow Lite的困境到LLM原生推理的全链路解析
2026-04-19 22:17:39 +0800 CST
view 1148
深入解析Google LiteRT-LM端侧LLM推理引擎的核心架构:分层内存池、KV Cache量化、算子融合、WebGPU运行时。与TensorFlow Lite、llama.cpp、MLX横向对比,提供生产级部署实战指南。
Google
端侧AI
LiteRT-LM
WebGPU
量化
KV Cache
TensorFlow Lite
LLM推理
LLRT 深度拆解:当 AWS 用 Rust 重新定义 JavaScript 运行时——从冷启动毫秒级到 Serverless 成本革命的完整指南(2026)
编程
LLRT 深度拆解:当 AWS 用 Rust 重新定义 JavaScript 运行时——从冷启动毫秒级到 Serverless 成本革命的完整指南(2026)
2026-08-13 10:44:10 +0800 CST
view 88
深度拆解 AWS 开源的 LLRT(Low Latency Runtime):Rust 原生设计 + QuickJS 引擎实现 3ms 冷启动,内存占用比 Node.js 低 60%,配合完整可运行代码与 15 条生产踩坑清单。
LLRT
AWS Lambda
JavaScript运行时
QuickJS
Rust
Serverless
性能优化
Redis之父的「孤注一掷」:ds4.c如何让284B参数模型在128GB MacBook上跑起来
编程
Redis之父的「孤注一掷」:ds4.c如何让284B参数模型在128GB MacBook上跑起来
2026-07-11 16:17:33 +0800 CST
view 326
Redis之父 Salvatore Sanfilippo 2026年5月发布的新项目 ds4.c,专为 DeepSeek V4 Flash + Apple Silicon Metal 打造本地推理引擎,8000行代码实现2.5倍性能提升。本文深度解析其架构设计、Graph Executor、KV Cache页式管理与Metal Shader实现。
推理引擎
Apple Silicon
DeepSeek
Metal
Redis
ds4.c
Rust重写一切:2026年AI基础设施全面Rust化的技术浪潮——从推理引擎到向量数据库,从编译器到运行时的深度解析
编程
Rust重写一切:2026年AI基础设施全面Rust化的技术浪潮——从推理引擎到向量数据库,从编译器到运行时的深度解析
2026-07-05 22:44:34 +0800 CST
view 749
深度解析2026年Rust在AI基础设施中的全面崛起:推理引擎Candle/Burn、向量数据库Qdrant/Lance、工具链OXC/Biome/Ruff/uv、运行时Bun重写、WASM推理、MCP Server实现,含完整代码实战与性能优化指南
Rust
AI基础设施
推理引擎
向量数据库
开发者工具链
Candle
Qdrant
Ruff
OXC
性能优化
Drizzle ORM + Bun 性能革命:当 TypeScript 生态终于在数据库层跑出比 Go 更低的延迟
编程
Drizzle ORM + Bun 性能革命:当 TypeScript 生态终于在数据库层跑出比 Go 更低的延迟
2026-07-11 17:15:17 +0800 CST
view 321
深度解析 Drizzle ORM 的 SQL-first 架构设计,benchmark 数据背后的工程原理,以及 Drizzle + Bun 组合在生产环境的实战指南
Drizzle ORM
Bun
TypeScript
ORM
数据库
性能优化
PostgreSQL
SQLite
React 19 Compiler 深度实战:当 React 亲手取代 useMemo——自动记忆化编译器的架构、编译产物与生产迁移完全指南
编程
React 19 Compiler 深度实战:当 React 亲手取代 useMemo——自动记忆化编译器的架构、编译产物与生产迁移完全指南
2026-07-11 17:42:59 +0800 CST
view 430
深度拆解 React 19 Compiler(前身 React Forget)的编译原理、缓存策略与编译产物分析,附从 React 18 到 19 + Compiler 的完整迁移实战指南、Airbnb/Meta 性能基准数据、与 Vue Vapor Mode/Svelte 的架构对比。
React 19
React Compiler
React Forget
前端框架
性能优化
编译时优化
Server Components
RSC
当 Apple Silicon 遇上视觉大模型:MLX-VLM 如何把「本地多模态推理」变成现实
编程
当 Apple Silicon 遇上视觉大模型:MLX-VLM 如何把「本地多模态推理」变成现实
2026-04-11 10:24:48 +0800 CST
view 958
深度解析 Apple Silicon 上的视觉语言模型推理引擎 MLX-VLM,涵盖架构设计、模型支持、性能优化与实战部署。
Apple Silicon
MLX
视觉语言模型
VLM
Mac本地AI
多模态推理
2026 前端框架三国杀:React 19.2 Server Components 成熟、Vue 3.5 Vapor Mode 内存砍半、Angular 21 彻底无 Zone——新一代前端渲染架构全景深度对比
编程
2026 前端框架三国杀:React 19.2 Server Components 成熟、Vue 3.5 Vapor Mode 内存砍半、Angular 21 彻底无 Zone——新一代前端渲染架构全景深度对比
2026-06-30 07:42:20 +0800 CST
view 508
深度解析2026年React 19.2 Server Components、Vue 3.5 Vapor Mode、Angular 21 Zoneless三大前端框架架构演进,附完整代码示例与性能基准测试
React
Vue
Angular
Vapor Mode
Server Components
Signal
前端框架
性能优化
Zoneless
Langfuse深度解析:ClickHouse加持的开源LLM可观测性平台——从Trace追踪到Prompt管理的AI工程化完整实战指南
编程
Langfuse深度解析:ClickHouse加持的开源LLM可观测性平台——从Trace追踪到Prompt管理的AI工程化完整实战指南
2026-07-06 00:14:59 +0800 CST
view 372
深度解析Langfuse开源AI工程平台:ClickHouse高性能Trace存储、三大核心模块(Observability/Prompt Management/Evaluation)、Python/JS SDK完整代码实战、Docker Compose自部署指南、与LangSmith/Helicone竞品对比、ClickHouse收购战略分析
Langfuse
LLM
可观测性
ClickHouse
OpenTelemetry
AI工程
Trace追踪
Prompt管理
Zig 深度拆解:当系统编程语言决定「干掉全部隐藏控制流」——从 comptime 到 C 互操作,一个 39K Star 的语言如何用极简哲学重新定义底层开发的终极形态
编程
Zig 深度拆解:当系统编程语言决定「干掉全部隐藏控制流」——从 comptime 到 C 互操作,一个 39K Star 的语言如何用极简哲学重新定义底层开发的终极形态
2026-08-05 02:48:25 +0800 CST
view 145
深度拆解Zig系统编程语言:comptime编译时执行、显式内存分配器、零隐藏控制流、无缝C互操作,TigerBeetle生产级案例分析,Zig vs Rust全方位对比
Zig
系统编程
comptime
内存管理
C互操作
TigerBeetle
性能优化
编程语言
开源
底层开发
OpenTelemetry 深度解析:可观测性终极标准如何重塑云原生监控——从三大支柱到 AI 根因分析的全链路实战
编程
OpenTelemetry 深度解析:可观测性终极标准如何重塑云原生监控——从三大支柱到 AI 根因分析的全链路实战
2026-05-11 05:48:38 +0800 CST
view 797
OpenTelemetry深度解析:可观测性终极标准如何重塑云原生监控,从Traces/Metrics/Logs三大支柱到AI根因分析的全链路实战
OpenTelemetry,可观测性,分布式追踪,Metrics,Logs,OTLP,云原生
谷歌 I/O 2026 全景深度解析:从 Gemini 3.5 Flash 到 Antigravity 2.0,从 93 个 Agent 造 OS 到 Spark 全天候个人助手——一场重新定义开发者工作流的架构革命
编程
谷歌 I/O 2026 全景深度解析:从 Gemini 3.5 Flash 到 Antigravity 2.0,从 93 个 Agent 造 OS 到 Spark 全天候个人助手——一场重新定义开发者工作流的架构革命
2026-06-17 06:29:30 +0800 CST
view 621
从 Gemini 3.5 Flash 的 289 tokens/秒到 Antigravity 2.0 的 93 个 Agent 造 OS,从 Spark 的 7×24 小时自主运转到 Omni 的任意输入直出视频——谷歌 I/O 2026 全景技术深度解析
Google I/O 2026
Gemini 3.5 Flash
Antigravity 2.0
AI Agent
Gemini Spark
Gemini Omni
oMLX 深度实战:当 macOS 菜单栏成为本地 LLM 推理的控制中心——从连续批处理到 SSD 分层缓存、从 MLX 后端加速到生产级部署的完全指南(2026)
编程
oMLX 深度实战:当 macOS 菜单栏成为本地 LLM 推理的控制中心——从连续批处理到 SSD 分层缓存、从 MLX 后端加速到生产级部署的完全指南(2026)
2026-06-22 17:24:05 +0800 CST
view 666
oMLX 是专为 Apple Silicon 优化的 LLM 推理服务器,通过连续批处理、分层 KV Cache、MLX 后端加速和 macOS 菜单栏管理,让本地 AI 推理从可用走向实用。
LLM
Apple Silicon
MLX
本地推理
MCP
Apple Container 深度实战:当 Swift 遇见 VM-per-Container——从架构革命到 macOS 原生容器化的生产级完全指南(2026)
编程
Apple Container 深度实战:当 Swift 遇见 VM-per-Container——从架构革命到 macOS 原生容器化的生产级完全指南(2026)
2026-06-17 06:57:55 +0800 CST
view 837
Apple Container v1.0.0 深度实战:VM-per-Container 架构革命、Containerization Swift 包、独立 IP 网络、OCI 兼容、性能优化与生产级部署指南
Apple Container
Swift
容器化
macOS
Virtualization
OCI
VM
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
58
59
60
61
62
...
67
下一页