程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Spring AI 1.1 深度解析:从 RAG 到 MCP 协议——Java 开发者构建企业级 AI 应用的工程化实战
编程
Spring AI 1.1 深度解析:从 RAG 到 MCP 协议——Java 开发者构建企业级 AI 应用的工程化实战
2026-05-10 04:41:17 +0800 CST
view 741
Spring AI 1.1 深度解析:Tool Calling 让 AI 真正动手干活、MCP 协议统一工具接入标准、Agent 框架实现自主决策、Memory 让多轮对话成为可能、RAG 构建企业知识库。Java 开发者不容错过的 AI 工程化实战指南。
Spring AI
SpringBoot AI
AI应用
Tool Calling
MCP
Model Context Protocol
Agent
RAG
ChatMemory
Java AI
向量数据库
企业级 AI
Nanobot 深度实战:当 4000 行 Python 重写了 AI Agent 的游戏规则——从核心架构到生产级部署的超轻量智能体完全指南(2026)
编程
Nanobot 深度实战:当 4000 行 Python 重写了 AI Agent 的游戏规则——从核心架构到生产级部署的超轻量智能体完全指南(2026)
2026-06-21 20:53:09 +0800 CST
view 448
Nanobot 是 HKUDS 开源的超轻量 AI Agent 运行时框架,核心仅 4000 行 Python,支持 13+ 聊天平台、20+ 模型提供商、MCP 协议、持久化记忆和渐进式 Skills 加载。本文深度解析其四大核心组件架构、Skills 三级加载机制、自定义工具实战、生产级部署方案及性能优化策略。
AI Agent
Nanobot
Python
开源项目
MCP
Redis之父antirez亲自下场!为DeepSeek V4 Flash打造专属推理引擎,Mac上跑出468 token/s
案例
Redis之父antirez亲自下场!为DeepSeek V4 Flash打造专属推理引擎,Mac上跑出468 token/s
2026-05-10 08:40:22 +0800 CST
view 786
Redis之父antirez亲自下场!为DeepSeek V4 Flash打造专属推理引擎ds4.c,C+Metal从头编写,Mac Studio M3 Ultra上预填充468 token/s。关键优化:非对称量化(MoE专家层2-bit)、KV缓存搬硬盘、内置OpenAI/Anthropic双API。128GB Mac可跑,专为coding agent优化。
DeepSeek
AI推理
Mac
Redis
antirez
Metal
本地推理
MoE
GGUF
C语言
Apple Silicon
Claude Code
OpenAI API
Anthropic API
Ruffle 深度拆解:当 Rust 为 Flash 续命——ActionScript 3.0 运行时、多渲染后端与 WebAssembly 全栈指南(2026)
编程
Ruffle 深度拆解:当 Rust 为 Flash 续命——ActionScript 3.0 运行时、多渲染后端与 WebAssembly 全栈指南(2026)
2026-07-17 06:13:59 +0800 CST
view 218
深度拆解 Rust 编写的 Flash 模拟器 Ruffle:从 AVM2 字节码虚拟机、显示列表渲染引擎、多后端渲染系统,到 WebAssembly 浏览器端部署、Security 安全模型与性能优化策略,配完整可运行代码。
Ruffle
Flash模拟器
Rust
ActionScript
WebAssembly
字节码虚拟机
多渲染后端
SWF
数字遗产
前端工具链
Ruflo 深度实战:48K Star 的多智能体编排引擎——如何让 AI 像蜂群一样协同开发,从架构到部署的完整指南
编程
Ruflo 深度实战:48K Star 的多智能体编排引擎——如何让 AI 像蜂群一样协同开发,从架构到部署的完整指南
2026-05-16 08:44:52 +0800 CST
view 921
Ruflo 多智能体编排平台深度实战,从架构设计到生产部署的完整指南
Ruflo
多智能体
AI Agent
Claude Code
蜂群协作
开源项目
shimmy v2.3.0 深度解析:纯 Rust WebGPU 推理引擎如何让 GGUF 模型跑满你的每一块 GPU
编程
shimmy v2.3.0 深度解析:纯 Rust WebGPU 推理引擎如何让 GGUF 模型跑满你的每一块 GPU
2026-07-23 11:45:35 +0800 CST
view 158
深度解析纯 Rust WebGPU 推理引擎 shimmy v2.3.0:GGUF 原生加载、OpenAI API 兼容、KV Cache 量化、Flash Attention 等效实现,配 Tauri 桌面应用集成实战与性能基准测试。
shimmy
WebGPU
Rust
GGUF
LLM
llama.cpp
推理引擎
WebAssembly
llama.cpp 深度实战:当端侧 LLM 成为生产级事实标准——从 GGUF 量化到跨平台部署的完全指南(2026)
编程
llama.cpp 深度实战:当端侧 LLM 成为生产级事实标准——从 GGUF 量化到跨平台部署的完全指南(2026)
2026-06-11 00:19:05 +0800 CST
view 505
全面解析 llama.cpp 推理引擎,从 GGUF 格式、量化原理、架构设计到跨平台部署,提供生产级代码实战和性能优化指南。
llama.cpp
GGUF
量化
端侧推理
大语言模型
Astral 生态系统深度解析:Rust 重写 Python 工具链的终极形态——uv + Ruff + ty 三驾马车如何统一 Python 开发全流程
编程
Astral 生态系统深度解析:Rust 重写 Python 工具链的终极形态——uv + Ruff + ty 三驾马车如何统一 Python 开发全流程
2026-07-05 19:45:23 +0800 CST
view 293
深度解析Astral生态系统三大核心产品:Ruff(lint+format)、uv(包管理)、ty(类型检查)。从架构设计到性能对比,从实战迁移到生态整合,全面覆盖Rust重写Python工具链的技术原理与落地实践。
Astral
Ruff
uv
ty
Python
Rust
工具链
类型检查
包管理
代码格式化
Scrapling 深度解析:52K Star 自适应爬虫框架——从抗改版自适应解析到原生绕过 Cloudflare 的工程革命
编程
Scrapling 深度解析:52K Star 自适应爬虫框架——从抗改版自适应解析到原生绕过 Cloudflare 的工程革命
2026-06-30 04:12:59 +0800 CST
view 579
Scrapling 52K+ Star Python自适应爬虫框架深度解析:抗改版自适应解析、原生绕过Cloudflare、类Scrapy并发框架,附完整代码实战与性能对比。
Scrapling
Python
爬虫
Web Scraping
Cloudflare绕过
自适应解析
Camoufox
反反爬
Rust重写一切:2026年AI基础设施全面Rust化的技术浪潮——从推理引擎到向量数据库,从编译器到运行时的深度解析
编程
Rust重写一切:2026年AI基础设施全面Rust化的技术浪潮——从推理引擎到向量数据库,从编译器到运行时的深度解析
2026-07-05 22:44:34 +0800 CST
view 602
深度解析2026年Rust在AI基础设施中的全面崛起:推理引擎Candle/Burn、向量数据库Qdrant/Lance、工具链OXC/Biome/Ruff/uv、运行时Bun重写、WASM推理、MCP Server实现,含完整代码实战与性能优化指南
Rust
AI基础设施
推理引擎
向量数据库
开发者工具链
Candle
Qdrant
Ruff
OXC
性能优化
llama.cpp 深度实战:从 GGUF 量化到 CUDA 内核优化——纯 C/C++ 如何在 CPU/GPU 上榨出 LLM 推理的极限性能
编程
llama.cpp 深度实战:从 GGUF 量化到 CUDA 内核优化——纯 C/C++ 如何在 CPU/GPU 上榨出 LLM 推理的极限性能
2026-05-23 17:18:22 +0800 CST
view 2087
2026年深度拆解 llama.cpp 的核心架构:GGUF 格式原理、20+量化方法对比、KV Cache 优化、多硬件后端性能实测,与 Ollama/vLLM 完整横评。
llama.cpp
GGUF
量化
CUDA
Metal
LLM推理
C++
本地部署
性能优化
GGML
Ollama深度解析:Go语言打造的本地LLM推理引擎——从Modelfile容器化到GPU调度的完整实战指南
编程
Ollama深度解析:Go语言打造的本地LLM推理引擎——从Modelfile容器化到GPU调度的完整实战指南
2026-07-06 05:48:17 +0800 CST
view 197
深度解析Ollama本地LLM推理引擎架构与实战
Ollama
本地推理
LLM
Go
llama.cpp
GGUF
GPU
Modelfile
Ruff 深度拆解:当 Python 决定「用 Rust 重建整个工具链」——从 Flake8 到 Black 到 mypy,一个 Astral 生态如何用 100 倍速度重新定义代码质量的终极形态
编程
Ruff 深度拆解:当 Python 决定「用 Rust 重建整个工具链」——从 Flake8 到 Black 到 mypy,一个 Astral 生态如何用 100 倍速度重新定义代码质量的终极形态
2026-08-05 07:15:24 +0800 CST
view 7
深度拆解Astral公司用Rust重建Python整个开发工具链:uv包管理器、Ruff代码检查器和格式化器、ty类型检查器,性能提升10-100倍,配置统一到pyproject.toml,附完整迁移指南与性能基准对比
Ruff
Python
Astral
Rust
代码质量
linting
格式化
uv
类型检查
mypy
Flake8
Black
Python 工具链的 Rust 化革命:从 uv、Ruff 到 LiteLLM——当 Rust 吃掉 Python 的工具生态
编程
Python 工具链的 Rust 化革命:从 uv、Ruff 到 LiteLLM——当 Rust 吃掉 Python 的工具生态
2026-06-30 14:43:40 +0800 CST
view 271
深度解析Python工具链的Rust化革命:从uv的包管理、Ruff的静态分析到LiteLLM的AI网关迁移,万字长文剖析Rust如何以10-100倍的性能优势重塑Python开发生态
Rust
Python
uv
Ruff
LiteLLM
Polars
性能优化
包管理
Pydantic
Python 工具链 Rust 化深度解析:从 uv、Ruff 到 LiteLLM——当系统级语言重塑 Python 开发体验
编程
Python 工具链 Rust 化深度解析:从 uv、Ruff 到 LiteLLM——当系统级语言重塑 Python 开发体验
2026-06-30 14:44:22 +0800 CST
view 219
深度解析Python工具链的Rust化革命:从uv的包管理、Ruff的静态分析到LiteLLM的AI网关迁移,万字长文剖析Rust如何以10-100倍的性能优势重塑Python开发生态
Rust
Python
uv
Ruff
LiteLLM
Polars
性能优化
包管理
Pydantic
Rust 正在重塑 Python 的工具链:深入解析 uv、Ruff 与 LiteLLM 的架构革命与 100 倍性能提升
编程
Rust 正在重塑 Python 的工具链:深入解析 uv、Ruff 与 LiteLLM 的架构革命与 100 倍性能提升
2026-06-30 14:45:17 +0800 CST
view 354
深度解析Python工具链的Rust化革命:从uv的包管理、Ruff的静态分析到LiteLLM的AI网关迁移,万字长文剖析Rust如何以10-100倍的性能优势重塑Python开发生态
Rust
Python
uv
Ruff
LiteLLM
Polars
性能优化
包管理
Pydantic
Ruflo深度解析:从单兵作战到AI蜂群指挥系统——40+K Stars的多智能体编排引擎全维度技术剖析
编程
Ruflo深度解析:从单兵作战到AI蜂群指挥系统——40+K Stars的多智能体编排引擎全维度技术剖析
2026-05-11 18:28:13 +0800 CST
view 668
Ruflo(48K+ Stars,v3.6.30)是面向Claude Code的多智能体编排平台,用100+专业化Agent、分布式共识算法和自学习记忆系统,让AI从单兵作战升级为蜂群协作。
Ruflo,Claude Code,多智能体编排,AI编程,Swarm协调,分布式共识,Agent,AI Agent,SONA,HNSW,Rust,WASM
CVE-2026-7482深度剖析:30万台Ollama服务器的内存裸奔危机与防御实战
编程
CVE-2026-7482深度剖析:30万台Ollama服务器的内存裸奔危机与防御实战
2026-06-03 17:44:19 +0800 CST
view 421
Ollama高危漏洞CVE-2026-7482(BLEEDING LLAMA)深度剖析,CVSS 9.1分,攻击者可远程读取30万台服务器内存数据,提供企业级修复方案
安全
Ollama
GGUF
CVE
AI
大模型
漏洞
Ollama v0.14.3 深度实战:从本地部署到多模态 AI——2026 年私有化大模型工程化完全指南
编程
Ollama v0.14.3 深度实战:从本地部署到多模态 AI——2026 年私有化大模型工程化完全指南
2026-05-24 12:04:34 +0800 CST
view 388
Ollama v0.14.3 深度实战指南:从架构解析到生产部署,涵盖 GGUF 格式、API 集成、多模态模型、性能优化等核心内容,2026 年私有化大模型首选方案。
Ollama
大模型
本地部署
GGUF
多模态
从原理到实战:llama.cpp 与 GGUF 量化格式的工程实践全解
编程
从原理到实战:llama.cpp 与 GGUF 量化格式的工程实践全解
2026-04-12 22:56:41 +0800 CST
view 1050
2026年深度解析 llama.cpp 架构设计与 GGUF 量化格式,从底层原理到工程实战,涵盖 K-Quant/IQ 量化、Flash Attention、KV Cache 优化、Intel NPU/GPU 部署全流程。
llama.cpp
GGUF
量化
大模型
C++
本地部署
Shimmy 深度解剖:Airframe 引擎与 TurboShimmy INT4 KV——纯 Rust WebGPU 推理如何用 4GB 显存跑起 7B 模型
编程
Shimmy 深度解剖:Airframe 引擎与 TurboShimmy INT4 KV——纯 Rust WebGPU 推理如何用 4GB 显存跑起 7B 模型
2026-07-25 10:15:27 +0800 CST
view 172
深度拆解 Shimmy v2.x 的 Airframe 纯 Rust WebGPU 推理引擎与 TurboShimmy INT4 KV Cache 压缩技术:从 WGSL shader 到 GGUF 模型加载,从跨平台 GPU 适配到 4GB 显存跑 7B 模型的工程真相。
Shimmy
WebGPU
GGUF
LLM推理
Rust
Inference Engine
TurboShimmy
INT4量化
消费级GPU
本地部署
wgpu
WGSL
Airframe
OpenAI API
Shimmy 深度解析:纯 Rust WebGPU 推理引擎如何用一行命令颠覆浏览器端 AI 推理
编程
Shimmy 深度解析:纯 Rust WebGPU 推理引擎如何用一行命令颠覆浏览器端 AI 推理
2026-07-25 15:14:38 +0800 CST
view 116
深度解析 Shimmy v2.3.0:纯 Rust WebGPU 推理引擎如何实现浏览器端原生运行 GGUF 量化模型,OpenAI API 兼容,零依赖部署。
WebGPU
Rust
GGUF
AI推理
浏览器
llama.cpp
OpenAI API
前端工程
Ruff + Semgrep 双引擎实战:Python 代码质量与安全分析完整工程指南(2026)
编程
Ruff + Semgrep 双引擎实战:Python 代码质量与安全分析完整工程指南(2026)
2026-07-20 08:44:16 +0800 CST
view 204
深度拆解 Ruff(Rust 极速 Python Linter)和 Semgrep(AST 模式匹配安全分析)的架构原理与生产级实战,附双引擎组合完整配置与 CI/CD 集成指南。
Ruff
Semgrep
Python
静态分析
代码质量
Linter
安全扫描
DevSecOps
把大模型装进机房:Ollama 本地推理工程化实战——量化、并发、缓存与生产部署一次讲透(2026)
编程
把大模型装进机房:Ollama 本地推理工程化实战——量化、并发、缓存与生产部署一次讲透(2026)
2026-07-14 03:43:32 +0800 CST
view 225
深度拆解 Ollama 本地大模型推理工程化:从 GGUF 量化原理、MoE 专家调度、推理栈与 KV 缓存,到 Modelfile 定制、自量化、Python 客户端、FastAPI 生产服务、Docker 部署与性能调优,配完整可运行代码与 vLLM 对比。
Ollama
本地大模型
llama.cpp
GGUF量化
大模型部署
AI工程化
隐私计算
推理优化
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
2
3
4
...
43
下一页