程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
TensorRT-LLM 1.0 深度实战:当 PyTorch 架构成为默认体验,NVIDIA 的 LLM 推理引擎正式走向成熟
编程
TensorRT-LLM 1.0 深度实战:当 PyTorch 架构成为默认体验,NVIDIA 的 LLM 推理引擎正式走向成熟
2026-07-22 10:46:37 +0800 CST
view 177
深度解析 TensorRT-LLM 1.0:PyTorch 架构正式稳定、LLM API 稳定化、多模态 VLM 原生支持、Qwen3 MoE 优化、LoRA 生产级管理、trtllm-serve 推理服务化,配完整部署实战代码。
TensorRT-LLM
LLM推理
GPU加速
PyTorch
NVIDIA
深度学习
模型部署
推理优化
LLM 推理优化全景实战:从 PagedAttention 到投机解码——让大模型推理成本下降 70% 的技术革命(2026)
编程
LLM 推理优化全景实战:从 PagedAttention 到投机解码——让大模型推理成本下降 70% 的技术革命(2026)
2026-05-30 15:42:55 +0800 CST
view 605
深度解析 LLM 推理优化的核心技术:PagedAttention 内存管理革命、投机解码加速策略、INT4/FP8 量化技术、MoE 架构优化,从架构原理到代码实战,让大模型推理成本下降 70%。
LLM
推理优化
vLLM
PagedAttention
投机解码
量化
MoE
WorldMonitor 深度拆解:73K Stars 的「全球态势感知」仪表盘,凭什么不用任何前端框架?
编程
WorldMonitor 深度拆解:73K Stars 的「全球态势感知」仪表盘,凭什么不用任何前端框架?
2026-07-27 08:44:14 +0800 CST
view 381
深度拆解一周涨1万Star的WorldMonitor:500+信源聚合、双地图引擎、零框架Vanilla TS前端、一套代码6个站点变体、本地Ollama兜底与MCP/SDK全家桶,附自托管与mini复刻实战。
WorldMonitor
开源
态势感知
Vanilla TypeScript
deck.gl
MCP
Ollama
Tauri
Local-File-Organizer 深度解析:3K Stars 本地 AI 文件整理,Llama3.2+LLaVA 完全离线运行
编程
Local-File-Organizer 深度解析:3K Stars 本地 AI 文件整理,Llama3.2+LLaVA 完全离线运行
2026-05-15 12:22:33 +0800 CST
view 570
深入解析 3K Stars 的 Local-File-Organizer:基于 Llama3.2 3B + LLaVA-v1.6 双模型的本地 AI 文件整理工具,使用 Nexa SDK 实现 100% 离线推理,自动识别文件内容、智能分类重命名、支持图片视觉分析和文档内容解析,零数据外泄。
Local-File-Organizer
AI文件整理
Llama3
LLaVA
本地AI
隐私
英伟达ASPIRE深度解析:具身智能的Skill时刻——从Coding Agent到机器人技能库、从经验沉淀到持续学习范式的完整技术指南(2026)
编程
英伟达ASPIRE深度解析:具身智能的Skill时刻——从Coding Agent到机器人技能库、从经验沉淀到持续学习范式的完整技术指南(2026)
2026-07-04 08:12:57 +0800 CST
view 602
2026年7月1日,英伟达GEAR团队开源机器人技能库ASPIRE,具身智能负责人Jim Fan称之为范式转变。深度解析ASPIRE的核心原理、技术架构、实现细节,以及它如何像Coding Agent一样让机器人通过写代码、看执行轨迹、修程序、沉淀技能来实现持续学习。
NVIDIA ASPIRE
具身智能
机器人技能库
持续学习
Coding Agent
Skill Refinement
经验沉淀
LLM
GPT-4
Claude
Jim Fan
GEAR团队
llama.cpp 深度拆解:一个纯 C++ 引擎如何让 180K Star 成为端侧 LLM 的事实标准——从 GGUF 格式到多后端架构的全栈解析
编程
llama.cpp 深度拆解:一个纯 C++ 引擎如何让 180K Star 成为端侧 LLM 的事实标准——从 GGUF 格式到多后端架构的全栈解析
2026-08-03 10:45:17 +0800 CST
view 291
深度拆解llama.cpp四大核心架构:GGUF模型格式设计、GGML计算引擎、8种多后端抽象层、K-Quant/I-Quant量化技术体系,附完整代码示例与性能基准测试
llama.cpp
GGUF
GGML
量化
端侧推理
LLM
C++
推理引擎
多后端
K-Quant
SGLang vs vLLM:2026年大模型推理框架深度对比与选型指南
编程
SGLang vs vLLM:2026年大模型推理框架深度对比与选型指南
2026-04-08 15:51:53 +0800 CST
view 2138
深度对比SGLang与vLLM两大LLM推理框架,从架构设计、核心原理、性能实测、适用场景多维度解析,附2026年选型建议
LLM
SGLang
vLLM
推理优化
大模型
Ollama 本地大模型部署实战:从零到生产级应用的完全指南(2026)
编程
Ollama 本地大模型部署实战:从零到生产级应用的完全指南(2026)
2026-06-10 01:20:57 +0800 CST
view 704
2026年Ollama本地大模型部署完全指南:从架构原理、GGUF量化、ModelFile自定义、多语言集成(Python/JS/Go)、RAG实战到Docker/K8s生产部署,8500字深度长文。
Ollama
本地部署
大模型
LLM
生产级
GGUF
量化
从零构建企业级本地化RAG系统:Ollama与RAGFlow深度实战
编程
从零构建企业级本地化RAG系统:Ollama与RAGFlow深度实战
2026-06-29 01:46:19 +0800 CST
view 594
深入探讨如何基于Ollama和RAGFlow构建完全本地化的RAG系统,涵盖架构设计、部署实战、代码实现和性能优化。
RAG
Ollama
RAGFlow
本地部署
LLM
分布式 LLM 推理架构深度实战:从 vLLM 单节点到 llm-d 多集群的生产级演进全链路解析
编程
分布式 LLM 推理架构深度实战:从 vLLM 单节点到 llm-d 多集群的生产级演进全链路解析
2026-05-09 03:39:58 +0800 CST
view 761
深度解析分布式 LLM 推理架构,从 vLLM 单节点到 llm-d 多集群的生产级演进。涵盖推理引擎层、编排调度层、Kubernetes 多机多卡部署实战、性能优化技巧及成本优化策略。
LLM
vLLM
分布式推理
Kubernetes
Ray
推理引擎
mattpocock/skills 深度拆解:两个月 18 万 Star,TypeScript 教父用一堆 Markdown 宣告「方法论可以被 git push」
编程
mattpocock/skills 深度拆解:两个月 18 万 Star,TypeScript 教父用一堆 Markdown 宣告「方法论可以被 git push」
2026-07-28 04:42:50 +0800 CST
view 189
深度拆解两个月狂揽 18 万 Star 的 mattpocock/skills:SKILL.md 结构解剖、grill-me/tdd/diagnose 工程流水线、小而可组合 vs 全流程框架之争,附团队私有技能库落地实战与三个真实的坑。
mattpocock/skills
AI Agent
Claude Code
Skill
TDD
工程方法论
Prompt工程
开发者工具
TypeScript
开源
PydanticAI 深度实战:当 Python 类型系统遇见 AI Agent——从类型安全到生产级智能体工程完全指南(2026)
编程
PydanticAI 深度实战:当 Python 类型系统遇见 AI Agent——从类型安全到生产级智能体工程完全指南(2026)
2026-06-21 13:24:53 +0800 CST
view 358
PydanticAI深度实战:类型安全+依赖注入+评估驱动开发,从零构建生产级AI Agent,含完整代码示例和性能优化策略。
PydanticAI
Python
AI Agent
类型安全
生产级
LLM
前端工具链的Rust革命:从Vite 8到Vite+,尤雨溪的「一次编写、极速构建」终极愿景
编程
前端工具链的Rust革命:从Vite 8到Vite+,尤雨溪的「一次编写、极速构建」终极愿景
2026-07-23 01:12:52 +0800 CST
view 273
深度解析Vite 8底层革命:Rolldown替换esbuild+Rollup双轨制,性能提升10~30倍。全面解读Vite+一体化工具链设计哲学,从项目创建到生产构建的统一入口。涵盖Rolldown技术架构、Oxc工具链、性能基准测试及实战迁移指南。
Vite 8
Rolldown
Vite+
Oxc
Rust
前端工具链
VoidZero
前端构建工具
Module Federation
Vite Plus
Dolt 2.0 深度拆解:当 Git 决定「吞掉 SQL」——从 Prolly 树到向量版本控制,一个 17K Star 的数据库如何重新定义数据管理的终极范式
编程
Dolt 2.0 深度拆解:当 Git 决定「吞掉 SQL」——从 Prolly 树到向量版本控制,一个 17K Star 的数据库如何重新定义数据管理的终极范式
2026-08-04 00:43:09 +0800 CST
view 116
深度拆解Dolt 2.0版本控制型SQL数据库:Prolly树内容寻址架构、自动垃圾回收、归档压缩存储去重、向量版本控制、MySQL兼容协议,附完整代码示例与性能基准对比
Dolt
Git
版本控制
SQL数据库
Prolly树
向量数据库
数据管理
开源
性能优化
Agent Lightning 深度解析:微软开源 AI Agent 训练框架——零代码改动,让任何 AI Agent 学会「自我进化」
编程
Agent Lightning 深度解析:微软开源 AI Agent 训练框架——零代码改动,让任何 AI Agent 学会「自我进化」
2026-05-16 03:14:41 +0800 CST
view 642
微软研究院开源 Agent Lightning:零代码改动训练任何 AI Agent,支持 RL/APO/SFT,已验证 128 GPU 大规模训练。
AgentLightning
强化学习
AI Agent
微软开源
LLM训练
Pathway 深度解析:Python ETL 框架的流式处理革命 —— 用 Rust 引擎吊打 Flink/Spark,构建实时 LLM Pipeline
编程
Pathway 深度解析:Python ETL 框架的流式处理革命 —— 用 Rust 引擎吊打 Flink/Spark,构建实时 LLM Pipeline
2026-05-16 03:46:12 +0800 CST
view 644
55K+ Star,基于 Differential Dataflow 的 Rust 引擎,增量计算,内存计算,无缝集成 Python ML 生态——Pathway 正在重新定义实时流处理与 LLM Pipeline 的边界。
Python
流处理
实时分析
LLM
RAG
Pathway
ETL
开源项目
GitHub Trending
字节 DeerFlow 2.0 深度解析:从研究框架到 Super Agent 基础设施的技术跃迁
编程
字节 DeerFlow 2.0 深度解析:从研究框架到 Super Agent 基础设施的技术跃迁
2026-07-05 02:11:57 +0800 CST
view 273
2026年6月字节跳动开源 DeerFlow 2.0,登顶 GitHub Trending。本文从架构设计、五大核心特性、代码实战、性能优化、安全部署等维度全方位深度解析,附完整 Python SDK 使用示例。
AI Agent
Super Agent
DeerFlow
字节跳动
开源项目
LLM
Agent框架
MarkItDown 深度实战:当文档转换遇见LLM友好格式——从多格式解析到MCP集成的生产级完全指南(2026)
编程
MarkItDown 深度实战:当文档转换遇见LLM友好格式——从多格式解析到MCP集成的生产级完全指南(2026)
2026-06-16 04:47:57 +0800 CST
view 549
深度实战微软开源神器MarkItDown:从多格式文档解析到LLM友好Markdown转换,涵盖RAG系统构建、MCP集成、批量处理优化、生产级API服务部署,10000字完整指南。
MarkItDown
文档转换
Markdown
RAG
LLM
MCP
AI Agent
Python
Dify v1.15.0 深度解析:difyctl CLI + 思维链可视化,手把手打造生产级 LLM 应用编排引擎
编程
Dify v1.15.0 深度解析:difyctl CLI + 思维链可视化,手把手打造生产级 LLM 应用编排引擎
2026-07-10 18:17:23 +0800 CST
view 646
深度解析 Dify v1.15.0 三大核心更新:difyctl CLI 将 AI 应用纳入 GitOps 管理,思维链可视化让 LLM 推理透明可追溯,慢模型轮询机制解决质量与速度的两难。附完整代码示例与生产部署指南。
Dify
LLM应用
工作流编排
difyctl
思维链可视化
Agent
RAG
GitOps
Kubernetes
生产部署
Obsidian Skills 深度解析:当 Agent Skills 规范让 AI Agent 真正"接管"本地知识库
编程
Obsidian Skills 深度解析:当 Agent Skills 规范让 AI Agent 真正"接管"本地知识库
2026-04-09 07:23:15 +0800 CST
view 1185
深入解析 Obsidian CEO kepano 开源的 obsidian-skills 项目,探讨 Agent Skills 规范如何让 AI Agent 真正理解本地知识库的底层格式,实现从"工具集成"到"知识接管"的范式跃迁。
obsidian
agent-skills
claude-code
知识管理
ai-agent
METATRON 深度解析:当 AI 渗透测试在本地跑出「免费版 GPT-4 安全助手」
编程
METATRON 深度解析:当 AI 渗透测试在本地跑出「免费版 GPT-4 安全助手」
2026-04-09 07:55:23 +0800 CST
view 1165
深度解析 METATRON:如何在本地零成本跑起一个完整的 AI 渗透测试助手,基于 Qwen 微调模型 + Ollama + MariaDB,无需 API Key,数据完全不出本地。
AI渗透测试
Ollama
Qwen
本地大模型
MariaDB
Pentest
安全工具
Agent
PydanticAI 深度拆解:当 Python 决定「干掉 LangChain」——一个 26K Star 的 AI Agent 框架如何用类型安全重新定义智能体开发的工程哲学
编程
PydanticAI 深度拆解:当 Python 决定「干掉 LangChain」——一个 26K Star 的 AI Agent 框架如何用类型安全重新定义智能体开发的工程哲学
2026-08-04 04:21:25 +0800 CST
view 135
深度拆解PydanticAI 26K Star AI Agent框架:类型驱动设计、RunContext依赖注入、结构化输出自动校验重试、MCP原生集成、多供应商模型抽象,附完整生产级代码示例与性能基准对比
PydanticAI
AI Agent
Python
类型安全
结构化输出
MCP
依赖注入
LLM
DiffusionGemma 深度实战:当文本生成告别逐字蹦字——从离散扩散到 1100 tokens/s 的生产级完全指南(2026)
编程
DiffusionGemma 深度实战:当文本生成告别逐字蹦字——从离散扩散到 1100 tokens/s 的生产级完全指南(2026)
2026-06-16 07:18:07 +0800 CST
view 446
Google DeepMind 开源 DiffusionGemma 离散文本扩散模型深度实战:从并行去噪原理到 1100 tokens/s 推理,完整代码示例与 Agent 构建
DiffusionGemma
文本扩散
离散扩散
LLM
开源模型
Google DeepMind
Rolldown 与 VoidZero:当 Rust 重构整个 JavaScript 工具链,前端基建的终局之战
编程
Rolldown 与 VoidZero:当 Rust 重构整个 JavaScript 工具链,前端基建的终局之战
2026-06-29 11:43:40 +0800 CST
view 262
深度解析 Rolldown 与 VoidZero 的 Rust 全栈工具链蓝图,从源码架构到 Cloudflare 收购的战略意义,附完整实战迁移指南与性能基准测试。
Rolldown
VoidZero
Vite
Rust
前端工程化
构建工具
JavaScript工具链
Cloudflare
Oxc
尤雨溪
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
89
90
91
92
93
...
105
下一页