程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Spring AI 2.0 深度拆解:当 Java 企业级框架学会「AI 原生思维」——ChatClient、MCP 工具调用与 Advisors 可组合架构
编程
Spring AI 2.0 深度拆解:当 Java 企业级框架学会「AI 原生思维」——ChatClient、MCP 工具调用与 Advisors 可组合架构
2026-07-17 10:44:29
view 332
深度拆解 Spring AI 2.0 GA:ChatClient Fluent API、Advisors 可组合拦截器链、@Tool 声明式工具调用、MCP 协议支持、RAG ETL Pipeline,配完整生产级代码实战。
Spring AI
Java
AI
Spring Boot
LLM
MCP
RAG
AI Agent
Tool Calling
Meta Muse Glimmer 深度拆解:300亿参数端侧Agent模型的工程革命——从知识蒸馏到4bit量化的完整实战指南(2026)
编程
Meta Muse Glimmer 深度拆解:300亿参数端侧Agent模型的工程革命——从知识蒸馏到4bit量化的完整实战指南(2026)
2026-08-13 18:49:00
view 134
深度拆解Meta 2026年8月发布的Muse Glimmer:300亿参数开放权重Dense模型,4bit量化可在单张RTX 3090/4090上本地运行。涵盖架构设计、知识蒸馏、量化原理、本地部署实战与性能基准测试。
Muse Glimmer
端侧AI
知识蒸馏
4bit量化
Agent本地部署
300亿参数
Meta
Apache 2.0
llama.cpp
Ollama
Muse Glimmer 端侧Agent革命:300亿参数模型如何在消费级GPU上跑出生产级性能(2026实战)
编程
Muse Glimmer 端侧Agent革命:300亿参数模型如何在消费级GPU上跑出生产级性能(2026实战)
2026-08-13 18:50:11
view 176
深度拆解Meta 2026年8月发布的Muse Glimmer:300亿参数开放权重Dense模型,4bit量化可在单张RTX 3090/4090上本地运行。涵盖架构设计、知识蒸馏、量化原理、本地部署实战与性能基准测试。
Muse Glimmer
端侧AI
知识蒸馏
4bit量化
Agent本地部署
300亿参数
Meta
Apache 2.0
llama.cpp
Ollama
samber/cc-skills-golang:给 AI 编程助手的 Go 技能包,让 AI 写 Go 少一点玄学
编程
samber/cc-skills-golang:给 AI 编程助手的 Go 技能包,让 AI 写 Go 少一点玄学
2026-06-13 08:23:38
view 549
cc-skills-golang是一组面向AI编程助手的Go技能包,将Go工程判断、编码约定、排查方法整理成指令文档,让Claude Code/Codex/Cursor等AI在写Go时按统一口径工作,With Skill准确率98% vs 56%。
cc-skills-golang
Go
Claude Code
Codex
Cursor
AI编程
代码规范
Agent Skill
Code Review
把大模型装进机房:Ollama 本地推理工程化实战——量化、并发、缓存与生产部署一次讲透(2026)
编程
把大模型装进机房:Ollama 本地推理工程化实战——量化、并发、缓存与生产部署一次讲透(2026)
2026-07-14 03:43:32
view 341
深度拆解 Ollama 本地大模型推理工程化:从 GGUF 量化原理、MoE 专家调度、推理栈与 KV 缓存,到 Modelfile 定制、自量化、Python 客户端、FastAPI 生产服务、Docker 部署与性能调优,配完整可运行代码与 vLLM 对比。
Ollama
本地大模型
llama.cpp
GGUF量化
大模型部署
AI工程化
隐私计算
推理优化
Ollama 完全指南:本地大模型部署的事实标准——从原理到生产级 AI 应用开发(2026)
编程
Ollama 完全指南:本地大模型部署的事实标准——从原理到生产级 AI 应用开发(2026)
2026-06-05 04:13:34
view 581
Ollama 本地大模型部署完全指南,从架构原理到生产级部署,涵盖 RAG 集成、性能优化、Docker/K8s 部署等核心内容。
Ollama
本地大模型
AI应用开发
Go语言
llama.cpp
Ollama 完全指南:本地大模型部署的事实标准——架构、实战与生产级部署(2026)
编程
Ollama 完全指南:本地大模型部署的事实标准——架构、实战与生产级部署(2026)
2026-06-05 04:13:52
view 810
Ollama 本地大模型部署完全指南,从架构原理到生产级部署,涵盖 RAG 集成、性能优化、Docker/K8s 部署等核心内容。
Ollama
本地大模型
AI应用开发
Go语言
llama.cpp
Ollama 深度拆解:从傻瓜式本地大模型部署到底层 llama.cpp 调度器的工程全貌(2026·完整版)
编程
Ollama 深度拆解:从傻瓜式本地大模型部署到底层 llama.cpp 调度器的工程全貌(2026·完整版)
2026-07-20 18:18:40
view 498
深度拆解 Ollama 工程架构:Go 服务层封装 llama.cpp、CGO 内存边界、GGUF 量化格式、Modelfile DSL、OpenAI 兼容层、Metal GPU 加速与生产部署实战,配完整 Go/Python/Shell 代码示例。
Ollama
本地大模型
llama.cpp
GGUF
Go
CGO
量化
Apple Silicon
猛涨25K Star!LLMFit:一键检测你的电脑能跑哪些大模型
案例
猛涨25K Star!LLMFit:一键检测你的电脑能跑哪些大模型
2026-05-06 07:35:19
view 798
25K+Star的LLMFit一键检测你的电脑能跑哪些大模型,Rust编写支持NVIDIA/AMD/Intel/Apple Silicon,智能量化推荐Q8到Q2,四维评分系统,TUI+CLI双模式
LLM部署
硬件检测
量化推荐
Rust
终端工具
本地部署
Ollama
OpenWorker 深度解析:吴恩达的桌面 AI 智能体,从 aisuite 到生产级 Agent 架构的完整演进
编程
OpenWorker 深度解析:吴恩达的桌面 AI 智能体,从 aisuite 到生产级 Agent 架构的完整演进
2026-07-26 12:13:55
view 534
深度解析吴恩达开源的桌面AI智能体OpenWorker:aisuite统一模型接口、Agent运行时架构、权限沙箱、记忆系统、任务规划、ReAct执行循环、工具系统、多模型策略、成本优化与实战应用。
OpenWorker
AI Agent
aisuite
桌面智能体
吴恩达
Andrew Ng
多模型
Ollama
本地LLM
Agent架构
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
编程
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
2026-07-15 08:45:14
view 427
从工程师视角深度拆解 Ollama 与本地大模型推理引擎:GGUF 单文件格式、K-quant/IQ-quant 量化家族、内存带宽墙、llama.cpp 计算图与 KV Cache,配 Modelfile、Python/Go 流式客户端与自量化实战。
Ollama
llama.cpp
GGUF
本地推理
大模型量化
KV Cache
DeepSeek-R1边缘推理实战:从云端独占到本地智能的范式转移
编程
DeepSeek-R1边缘推理实战:从云端独占到本地智能的范式转移
2026-05-19 12:42:27
view 655
2026年,边缘AI不再只是云端模型的精简版。本文深入剖析DeepSeek-R1 CPU版的技术原理,从模型蒸馏、量化技术的底层原理到生产环境的完整部署方案,提供可直接落地的代码和可量化的性能数据。
DeepSeek
R1
边缘计算
AI推理
模型蒸馏
量化
llama.cpp
Ollama
端侧AI
通义千问 Qwen3.8-27B 深度解析:Max 级旗舰权重首次开源,270 亿参数 Dense 模型如何在家用显卡上跑出旗舰性能
编程
通义千问 Qwen3.8-27B 深度解析:Max 级旗舰权重首次开源,270 亿参数 Dense 模型如何在家用显卡上跑出旗舰性能
2026-08-17 18:44:06
view 134
深度拆解阿里 Qwen3.8-27B:2.4T 旗舰与 27B 开源版的关系、MoE 架构细节、Dense 模型设计、vLLM/Ollama/昇腾部署实战、性能实测,以及完整的本地 RAG 代码示例。Apache 2.0 开源,家用显卡可跑。
Qwen3.8
通义千问
大模型
MoE
Dense架构
vLLM
Ollama
本地部署
WorldMonitor 深度拆解:73K Stars 的「全球态势感知」仪表盘,凭什么不用任何前端框架?
编程
WorldMonitor 深度拆解:73K Stars 的「全球态势感知」仪表盘,凭什么不用任何前端框架?
2026-07-27 08:44:14
view 459
深度拆解一周涨1万Star的WorldMonitor:500+信源聚合、双地图引擎、零框架Vanilla TS前端、一套代码6个站点变体、本地Ollama兜底与MCP/SDK全家桶,附自托管与mini复刻实战。
WorldMonitor
开源
态势感知
Vanilla TypeScript
deck.gl
MCP
Ollama
Tauri
Ollama 本地大模型部署实战:从零到生产级应用的完全指南(2026)
编程
Ollama 本地大模型部署实战:从零到生产级应用的完全指南(2026)
2026-06-10 01:20:57
view 853
2026年Ollama本地大模型部署完全指南:从架构原理、GGUF量化、ModelFile自定义、多语言集成(Python/JS/Go)、RAG实战到Docker/K8s生产部署,8500字深度长文。
Ollama
本地部署
大模型
LLM
生产级
GGUF
量化
从零构建企业级本地化RAG系统:Ollama与RAGFlow深度实战
编程
从零构建企业级本地化RAG系统:Ollama与RAGFlow深度实战
2026-06-29 01:46:19
view 670
深入探讨如何基于Ollama和RAGFlow构建完全本地化的RAG系统,涵盖架构设计、部署实战、代码实现和性能优化。
RAG
Ollama
RAGFlow
本地部署
LLM
Chrome DevTools MCP 深度实战:让 AI 编程助手真正看懂并操控浏览器的技术革命
编程
Chrome DevTools MCP 深度实战:让 AI 编程助手真正看懂并操控浏览器的技术革命
2026-05-16 04:43:16
view 682
Chrome DevTools MCP 让 AI 编程助手通过 MCP 协议直接控制浏览器,实现深度调试、性能分析和自动化测试。本文详解架构、实战和性能优化。
Chrome DevTools
MCP
AIAgent
前端调试
自动化测试
Polars 1.41 深度拆解:当 Rust 把 DataFrame 从 pandas 手里抢过来——从 Arrow 内存模型、惰性优化器到流式引擎的全链路实战
编程
Polars 1.41 深度拆解:当 Rust 把 DataFrame 从 pandas 手里抢过来——从 Arrow 内存模型、惰性优化器到流式引擎的全链路实战
2026-08-19 01:14:11
view 125
深度拆解 Polars 1.41:从 Arrow 内存模型、惰性查询优化器、Rayon 多线程向量化引擎到流式执行的工程原理,配可运行代码与生产性能优化清单。
Polars
Rust
DataFrame
Apache Arrow
数据分析
Python
性能优化
惰性执行
流式引擎
DuckDB 深度拆解:当「进程内」分析数据库把 Pandas + PostgreSQL 的活儿一口气干了——从列式存储、向量化执行到零拷贝 Arrow 的全链路实战
编程
DuckDB 深度拆解:当「进程内」分析数据库把 Pandas + PostgreSQL 的活儿一口气干了——从列式存储、向量化执行到零拷贝 Arrow 的全链路实战
2026-08-19 02:43:06
view 155
深度拆解 DuckDB 1.5.5:从列式存储、向量化 Volcano 执行、Morsel-Driven 并行到异步 I/O(Work,Thread,Work),配可运行代码与生产调优清单。
DuckDB
进程内OLAP
向量化执行
列式存储
Arrow
零拷贝
DuckLake
数据分析
ETL
性能优化
MCP 协议史上最大修订:2026年从AI工具调用协议到生产级智能体基础设施的蜕变
编程
MCP 协议史上最大修订:2026年从AI工具调用协议到生产级智能体基础设施的蜕变
2026-07-23 09:14:29
view 381
深度解析MCP协议2026-07-28候选规范:OIDC身份认证、W3C分布式追踪、多Agent协作协议、声明式扩展、Policy Engine与审计日志,从工具调用协议到生产级智能体基础设施的完整蜕变
MCP
Model Context Protocol
AI Agent
智能体协议
OpenID Connect
分布式追踪
MCP协议深度解析:从架构原理到AI Agent实战开发
编程
MCP协议深度解析:从架构原理到AI Agent实战开发
2026-07-05 09:42:31
view 344
从协议规范、架构设计、通信机制到Python/TypeScript双语言实战,彻底搞懂MCP——不只是比喻,而是能落地到生产环境的完整开发指南。
MCP
AI Agent
Model Context Protocol
JSON-RPC
Python
TypeScript
Chrome DevTools MCP 深度解析:谷歌官方出品的 AI 编程助手浏览器控制利器
编程
Chrome DevTools MCP 深度解析:谷歌官方出品的 AI 编程助手浏览器控制利器
2026-04-29 08:44:10
view 892
37K+ Star 谷歌官方开源项目,让 Claude、Cursor、Copilot 等 AI 编程助手直接操控浏览器进行自动化调试、性能分析和智能测试。深度解析 MCP 协议、CDP 协议、30+ 工具详解、代码实战、部署指南。
Chrome DevTools
MCP
AI编程助手
浏览器自动化
性能分析
Chrome DevTools MCP 深度实战:当浏览器调试成为 AI 编程助手的标准接口——从 MCP 协议原理到生产级自动化调试的完全指南(2026)
编程
Chrome DevTools MCP 深度实战:当浏览器调试成为 AI 编程助手的标准接口——从 MCP 协议原理到生产级自动化调试的完全指南(2026)
2026-06-10 23:47:25
view 714
Chrome DevTools MCP 深度实战:从 MCP 协议原理到生产级自动化调试的完全指南。详解如何将浏览器调试能力通过 MCP 协议暴露给 AI 系统,实现 AI 原生的自动化调试。
Chrome DevTools
MCP
AI编程
浏览器调试
自动化测试
Polars 深度实战:当 Python 数据处理终于不再「等」——从 Arrow 内核、查询优化器到生产级迁移指南
编程
Polars 深度实战:当 Python 数据处理终于不再「等」——从 Arrow 内核、查询优化器到生产级迁移指南
2026-07-11 10:47:57
view 261
深度拆解 Polars 的 Rust 内核、Arrow 列式存储、查询优化器、SIMD 向量化与惰性求值,配 10 个生产级代码示例与 Pandas 迁移指南。
Polars
Python
Rust
Arrow
DataFrame
数据处理
性能优化
ETL
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
python
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
上一页
1
...
11
12
13
14
15
...
66
下一页