程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
DeepSeek-R1边缘推理实战:从云端独占到本地智能的范式转移
编程
DeepSeek-R1边缘推理实战:从云端独占到本地智能的范式转移
2026-05-19 12:42:27 +0800 CST
view 491
2026年,边缘AI不再只是云端模型的精简版。本文深入剖析DeepSeek-R1 CPU版的技术原理,从模型蒸馏、量化技术的底层原理到生产环境的完整部署方案,提供可直接落地的代码和可量化的性能数据。
DeepSeek
R1
边缘计算
AI推理
模型蒸馏
量化
llama.cpp
Ollama
端侧AI
oMLX 深度解析:Apple Silicon 原生的本地大模型推理服务器——从分层 KV 缓存到菜单栏级 AI 编码伴侣
编程
oMLX 深度解析:Apple Silicon 原生的本地大模型推理服务器——从分层 KV 缓存到菜单栏级 AI 编码伴侣
2026-05-21 22:30:11 +0800 CST
view 678
深入解析 oMLX 的分层 KV 缓存架构(热 RAM + 冷 SSD)、Copy-on-Write 优化、与 Claude Code 的深度集成,以及 Apple Silicon 原生的推理性能优化。
oMLX
Apple Silicon
本地大模型
KV缓存
MLX
推理服务器
ds4 深度解析:Redis 作者的最后一战?—— DwarfStar 4 本地推理引擎的技术革命
编程
ds4 深度解析:Redis 作者的最后一战?—— DwarfStar 4 本地推理引擎的技术革命
2026-05-15 17:47:40 +0800 CST
view 726
深入解析 antirez(Redis 作者)新开源项目 ds4:DwarfStar 4 本地推理引擎,专门为 DeepSeek V4 Flash 打造,支持 Metal/CUDA 后端,2-bit 量化可在 96GB 内存 MacBook 上运行 284B 参数模型。
AI推理
本地部署
DeepSeek
Redis
Apple Silicon
CUDA
Metal
MoE
量化
Ollama 0.30 深度实战:当本地 LLM 推理有了双引擎——从 llama.cpp + MLX 双后端到 Gemma 4 QAT、从 Cohere2 MoE 到 ollama launch AI 编程助手生态的生产级完全指南(2026)
编程
Ollama 0.30 深度实战:当本地 LLM 推理有了双引擎——从 llama.cpp + MLX 双后端到 Gemma 4 QAT、从 Cohere2 MoE 到 ollama launch AI 编程助手生态的生产级完全指南(2026)
2026-06-21 08:54:17 +0800 CST
view 502
Ollama 0.30 深度解析:双引擎推理架构、Gemma 4 QAT、Cohere2 MoE、ollama launch 生态与生产级部署完全指南
Ollama
LLM
本地推理
AI编程
llama.cpp
MLX
Gemma
开源
Apple CoreCrypto 开源深度解析:后量子密码学的形式化验证革命
编程
Apple CoreCrypto 开源深度解析:后量子密码学的形式化验证革命
2026-05-31 09:25:15 +0800 CST
view 598
深度解析 Apple CoreCrypto 后量子密码学开源实现,包括 ML-KEM、ML-DSA 算法的架构设计、形式化验证方法论,以及生产环境落地指南。
密码学
安全
Apple
后量子
形式化验证
Gemma MacOS Tuner 深度解析:在 Apple Silicon 上用 PyTorch 和 MPS 高效微调多模态 Gemma
编程
Gemma MacOS Tuner 深度解析:在 Apple Silicon 上用 PyTorch 和 MPS 高效微调多模态 Gemma
2026-04-09 01:14:39 +0800 CST
view 1163
详解 gemma-tuner-multimodal 项目:在 Apple Silicon 上通过 PyTorch MPS 后端对 Google Gemma 系列模型进行 LoRA 微调,支持文本、图像、音频三种模态,完全本地运行,数据不出机器,零 NVIDIA GPU 依赖。
Gemma
Apple Silicon
PyTorch
MPS
LoRA
微调
Machine Learning
OmniRoute深度实践:构建高可用AI智能路由网关——整合多AI提供商的最佳实践
编程
OmniRoute深度实践:构建高可用AI智能路由网关——整合多AI提供商的最佳实践
2026-07-05 03:13:30 +0800 CST
view 244
深入剖析OmniRoute AI智能路由网关的架构设计与实战,涵盖统一抽象层、路由决策引擎、故障切换、负载均衡、成本优化等核心特性,附完整TypeScript代码实现。
AI
路由网关
OmniRoute
AI Provider
负载均衡
故障切换
Free Claude Code:让Claude Code接入任意模型,打破Anthropic绑定
编程
Free Claude Code:让Claude Code接入任意模型,打破Anthropic绑定
2026-04-29 12:20:38 +0800 CST
view 1203
Free Claude Code是让Claude Code接入任意模型的代理层项目,打破Anthropic绑定,支持NVIDIA NIM/OpenRouter/DeepSeek/Ollama/LM Studio等后端,适合想降成本或本地部署AI编程环境的人。
Claude Code
AI编程
开源工具
OpenRouter
DeepSeek
Ollama
LM Studio
AI Coding
Anthropic
GraphQL.js v17 + Hive Router Demand Control:当 GraphQL 终于学会「算账」——从原生 TypeScript 重写到成本控制革命的完全指南(2026)
编程
GraphQL.js v17 + Hive Router Demand Control:当 GraphQL 终于学会「算账」——从原生 TypeScript 重写到成本控制革命的完全指南(2026)
2026-06-22 21:26:46 +0800 CST
view 202
2026年6月19日 GraphQL.js v17 发布,原生 TypeScript 重写、ESM 优先。同日 Hive Router 推出 Demand Control 功能,解决 GraphQL 查询成本逃逸问题。本文深度剖析技术原理、迁移指南与生产实践。
GraphQL
TypeScript
ESM
Hive Router
Demand Control
OpenAPI
9Router 深度解析:开源路由器如何让 AI 编程成本归零,RTK 压缩省 40% Token
编程
9Router 深度解析:开源路由器如何让 AI 编程成本归零,RTK 压缩省 40% Token
2026-05-12 02:44:46 +0800 CST
view 867
深度解析9Router:RTK Token Saver压缩工具输出省20-40% token、Caveman Mode省65%输出token、三层自动降级Subscription→Cheap→Free、40+供应商100+模型、格式转换9种API格式、多账户轮询+OAuth自动刷新
9Router,AI路由器,RTK,Token压缩,ClaudeCode,Cursor,多模型路由,自动降级,KiroAI,免费AI编程,CavemanMode,OpenAI兼容
OmniRoute 深度解析:聚合 237 家模型提供商的免费 AI 网关如何用智能路由+Token 压缩实现每月 16 亿 Token 白嫖——从架构原理到生产级部署的完整实战指南
编程
OmniRoute 深度解析:聚合 237 家模型提供商的免费 AI 网关如何用智能路由+Token 压缩实现每月 16 亿 Token 白嫖——从架构原理到生产级部署的完整实战指南
2026-07-07 13:47:41 +0800 CST
view 258
深度解析 OmniRoute 开源 AI 网关:聚合 237 家模型提供商、90+免费模型、智能路由、自动故障转移、RTK+Caveman Token 压缩技术,月享 16 亿免费 Token
OmniRoute
AI网关
开源
Token压缩
智能路由
免费模型
Groq
Together
OpenAI
API
Flutter Impeller 渲染引擎深度解析:从 Skia 的「历史包袱」到 GPU 原生渲染的性能革命(2026)
编程
Flutter Impeller 渲染引擎深度解析:从 Skia 的「历史包袱」到 GPU 原生渲染的性能革命(2026)
2026-07-22 01:43:58 +0800 CST
view 64
深度解析 Flutter Impeller 渲染引擎:从 Skia 的历史包袱、Entity Pass 架构、Metal/Vulkan 后端实现到着色器预编译机制,配完整代码示例与性能优化实战,涵盖 iOS/Android 迁移指南与未来方向。
Flutter
Impeller
Skia
Metal
Vulkan
GPU渲染
性能优化
移动开发
Flutter3.22
渲染引擎
MCP 企业级授权深度实战:当 AI Agent 终于可以安全可控地伸手够数据——从零架构到生产级部署完全指南(2026)
编程
MCP 企业级授权深度实战:当 AI Agent 终于可以安全可控地伸手够数据——从零架构到生产级部署完全指南(2026)
2026-07-12 16:16:15 +0800 CST
view 250
深度解析 MCP 企业托管授权架构:从 IdP 集成、策略引擎、Token 验证到生产级 Kubernetes 部署,配完整代码实战与合规报告生成。
MCP
AI编程
企业安全
OAuth2
Authorization Server
TypeScript
MCP 企业托管授权完全指南:从身份提供商集成到 Kubernetes 生产级部署(2026·深度实战)
编程
MCP 企业托管授权完全指南:从身份提供商集成到 Kubernetes 生产级部署(2026·深度实战)
2026-07-12 16:17:41 +0800 CST
view 199
深度解析 MCP 企业托管授权架构:从 IdP 集成、策略引擎、Token 验证到生产级 Kubernetes 部署,配完整代码实战与合规报告生成。
MCP
AI编程
企业安全
OAuth2
Authorization Server
TypeScript
微软 Coreutils for Windows 深度实战:当 GNU 工具链以 Rust 之名「穿越」到 Windows NT——从多调用二进制到跨平台开发流的完全指南(2026)
编程
微软 Coreutils for Windows 深度实战:当 GNU 工具链以 Rust 之名「穿越」到 Windows NT——从多调用二进制到跨平台开发流的完全指南(2026)
2026-06-14 11:51:49 +0800 CST
view 362
2026年Build大会发布的微软Coreutils for Windows技术深度解析:Rust重写GNU coreutils,多调用二进制+NTFS硬链接架构,让Linux命令在Windows NT上原生运行的技术完全指南。
Rust
Windows
Coreutils
uutils
跨平台开发
命令行工具
System32
Kubernetes Gateway API 深度实战:从 Ingress 的「表达能力天花板」到生产级流量治理的完全指南(2026)
编程
Kubernetes Gateway API 深度实战:从 Ingress 的「表达能力天花板」到生产级流量治理的完全指南(2026)
2026-07-22 00:43:39 +0800 CST
view 72
2026 生产级实战 Kubernetes Gateway API:系统拆解 GatewayClass/Gateway/HTTPRoute/GRPCRoute/ReferenceGrant 对象模型、主流数据面(Istio/Envoy Gateway/Cilium)架构差异与 GAMMA 服务网格统一标准,配完整 YAML 与 Go 客户端代码,覆盖金丝雀发布、TLS、跨命名空间路由、可观测性与从 Ingress 平滑迁移完全指南。
Kubernetes
Gateway API
Ingress
云原生
Envoy Gateway
流量治理
服务网格
GRPCRoute
tinyauth:Go 认证中间件,环境变量搞定反向代理 SSO,7K Star
编程
tinyauth:Go 认证中间件,环境变量搞定反向代理 SSO,7K Star
2026-07-11 08:43:10 +0800 CST
view 151
tinyauth是Go编写的极简认证授权服务器,静态二进制+环境变量配置+SQLite存储,支持本地/OAuth/LDAP/TOTP/OIDC,Traefik/Caddy/Nginx/Envoy通吃,Forward Auth机制统一自托管应用SSO。
Go
认证
tinyauth
SSO
反向代理
OAuth
LDAP
OIDC
自托管
开源
微软 Windows 11 原生 Coreutils 深度解析:用 Rust 重写 GNU 命令行工具链的工程革命
编程
微软 Windows 11 原生 Coreutils 深度解析:用 Rust 重写 GNU 命令行工具链的工程革命
2026-06-03 10:48:18 +0800 CST
view 768
2026年6月微软Build大会上发布的Windows 11 Coreutils深度解析,深入剖析uutils项目架构设计、微软工程决策、性能对比及对整个生态的影响。
Rust
Windows
Coreutils
uutils
命令行
系统工具
自建大模型统一网关:多模型路由、故障转移与成本治理的工程实战
编程
自建大模型统一网关:多模型路由、故障转移与成本治理的工程实战
2026-07-23 02:41:45 +0800 CST
view 41
从协议碎片化病根讲起,拆解生产级 LLM 网关必须解决的六类工程问题,并用手写 Go 网关+Python 语义缓存跑通路由、熔断、重试与成本记账。
LLM Gateway
大模型网关
多模型路由
故障转移
成本治理
LiteLLM
OmniRoute
OpenHuman 深度实战:用 Rust 构建个人 AI 操作系统——从记忆树到模型路由,登顶 GitHub Trending 的技术内幕
编程
OpenHuman 深度实战:用 Rust 构建个人 AI 操作系统——从记忆树到模型路由,登顶 GitHub Trending 的技术内幕
2026-05-16 07:44:37 +0800 CST
view 681
OpenHuman 深度技术拆解:Memory Tree记忆树、TokenJuice压缩、模型路由、潜意识循环、SQLite+Markdown双轨存储
OpenHuman
Rust
AI Agent
Memory Tree
Model Router
开源项目
AI 编程助手 Token 烧钱太快?9Router + RTK 双剑合璧:从架构设计到生产级实践,节省 90% 成本完全指南
编程
AI 编程助手 Token 烧钱太快?9Router + RTK 双剑合璧:从架构设计到生产级实践,节省 90% 成本完全指南
2026-05-23 00:19:03 +0800 CST
view 541
深入剖析 9Router 智能模型路由和 RTK Token 压缩的技术原理、架构设计与生产级实践,帮助开发者节省高达 90% 的 AI 编程成本。
AI编程
Token优化
9Router
RTK
成本控制
Gemma 4 MoE 架构技术深度解析:Dense MLP + Routed MoE 双路径设计如何重塑开源大模型
编程
Gemma 4 MoE 架构技术深度解析:Dense MLP + Routed MoE 双路径设计如何重塑开源大模型
2026-04-21 14:22:20 +0800 CST
view 644
深度解析 Google Gemma 4 的 Dual-Path 混合架构设计:Dense MLP 保障通用基座能力,Routed MoE 释放专业化推理效率。一文吃透技术原理、部署实战与选型对比。
Gemma 4
MoE架构
Dense MLP
Routed MoE
Google DeepMind
开源大模型
Transformer
模型部署
混合专家
9Router:给所有 AI 编程工具加个智能调度中心,节省 20-40% Token
编程
9Router:给所有 AI 编程工具加个智能调度中心,节省 20-40% Token
2026-05-12 07:49:50 +0800 CST
view 788
9Router是一个本地AI路由器和Token节省器,统一连接Claude Code、Cursor、Codex等工具,自动路由到40+ AI提供商和100+模型,每次请求节省20-40% Token。GitHub 8K Star。
9Router
AI路由
Token节省
Claude Code
AI编程工具
9Router:三层降级路由+RTK Token压缩,让AI编程订阅永不中断
编程
9Router:三层降级路由+RTK Token压缩,让AI编程订阅永不中断
2026-05-12 20:20:40 +0800 CST
view 565
9Router把40+AI供应商、100+模型统一调度,三层降级路由确保开发不中断,RTK Token压缩平均节省20%-40%,GitHub连续多日登上Trending。npm一行命令安装,支持Claude Code/Codex/Cursor等所有主流AI编程工具。
9Router
AI路由
Token压缩
Claude Code
Codex
RTK
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
3
4
5
6
7
...
72
下一页