程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
从140GB到4GB:AirLLM无量化层间推理原理深度剖析与生产级部署实战(2026)
编程
从140GB到4GB:AirLLM无量化层间推理原理深度剖析与生产级部署实战(2026)
2026-06-22 19:28:19 +0800 CST
view 333
深入解析 AirLLM 的无量化层间 Offloading 技术原理,探讨如何通过 CPU-GPU 混合推理在 4GB 显存上运行 70B 大模型,附完整代码实战与生产部署指南。
LLM推理
GPU优化
CPU Offload
层间调度
AirLLM
PyTorch
一行命令搞定!16.5k Star 的开源神器,让 AI 生成的前端终于有审美了
案例
一行命令搞定!16.5k Star 的开源神器,让 AI 生成的前端终于有审美了
2026-05-11 16:39:33 +0800 CST
view 557
16.5K Stars 的开源项目 taste-skill,让 AI 生成的前端代码告别紫蓝渐变 Hero + 三列圆角卡片的模板风。一行命令安装,支持 Cursor/Claude Code/Codex 等主流编程 Agent。
taste-skill
AI前端
设计规范
Claude Code
Cursor
反slop
前端开发
SKILL
从 Caveman 令牌压缩到 Agent Skills:2026年7月 GitHub Trending AI 编码工具深度解析
编程
从 Caveman 令牌压缩到 Agent Skills:2026年7月 GitHub Trending AI 编码工具深度解析
2026-07-09 01:47:33 +0800 CST
view 408
深度解析2026年7月GitHub Trending上的AI编码工具生态:Caveman令牌压缩65%背后的工程原理、mattpocock/skills 354个生产级技能、openai/codex-plugin-cc多代理协作,以及这场正在发生的AI编程工具工程化革命。
AI编程工具
GitHub Trending
Caveman
Agent Skills
AI Agent
LLM
Copilot
2026技术
从零构建企业级本地化RAG系统:Ollama与RAGFlow深度实战
编程
从零构建企业级本地化RAG系统:Ollama与RAGFlow深度实战
2026-06-29 01:46:19 +0800 CST
view 424
深入探讨如何基于Ollama和RAGFlow构建完全本地化的RAG系统,涵盖架构设计、部署实战、代码实现和性能优化。
RAG
Ollama
RAGFlow
本地部署
LLM
字节 DeerFlow 2.0 深度解析:从研究框架到 Super Agent 基础设施的技术跃迁
编程
字节 DeerFlow 2.0 深度解析:从研究框架到 Super Agent 基础设施的技术跃迁
2026-07-05 02:11:57 +0800 CST
view 178
2026年6月字节跳动开源 DeerFlow 2.0,登顶 GitHub Trending。本文从架构设计、五大核心特性、代码实战、性能优化、安全部署等维度全方位深度解析,附完整 Python SDK 使用示例。
AI Agent
Super Agent
DeerFlow
字节跳动
开源项目
LLM
Agent框架
Rolldown 与 VoidZero:当 Rust 重构整个 JavaScript 工具链,前端基建的终局之战
编程
Rolldown 与 VoidZero:当 Rust 重构整个 JavaScript 工具链,前端基建的终局之战
2026-06-29 11:43:40 +0800 CST
view 151
深度解析 Rolldown 与 VoidZero 的 Rust 全栈工具链蓝图,从源码架构到 Cloudflare 收购的战略意义,附完整实战迁移指南与性能基准测试。
Rolldown
VoidZero
Vite
Rust
前端工程化
构建工具
JavaScript工具链
Cloudflare
Oxc
尤雨溪
Cloudflare收购VoidZero深度解析:从Vite工具链到AI驱动Web开发的范式革命(2026)
编程
Cloudflare收购VoidZero深度解析:从Vite工具链到AI驱动Web开发的范式革命(2026)
2026-06-10 16:20:46 +0800 CST
view 534
2026年6月4日Cloudflare收购VoidZero,尤雨溪公司全员加入CF。本文深度解析Vite/Rolldown/Oxc产品矩阵,剖析Cloudflare战略意图,探讨Rust化工具链的技术演进,以及AI Agent时代前端开发的范式革命。
Cloudflare
VoidZero
Vite
Rolldown
Oxc
前端工具链
Rust
AI编程
边缘计算
AstronClaw 深度解析:科大讯飞如何用软硬一体架构让AI Agent走进物理世界
编程
AstronClaw 深度解析:科大讯飞如何用软硬一体架构让AI Agent走进物理世界
2026-04-19 07:17:09 +0800 CST
view 673
深度解析科大讯飞AstronClaw软硬一体AI Agent架构,从技术原理到应用场景全面剖析,探讨AI Agent如何突破屏幕限制走进物理世界。
AstronClaw
科大讯飞
AI Agent
软硬一体
智能体
星火大模型
Loomy
GlassClaw
SkillHub
stop-slop 深度实战:让 AI 写作告别"机器味"——从 AI Tells 识别到零痕迹输出的完全指南(2026)
编程
stop-slop 深度实战:让 AI 写作告别"机器味"——从 AI Tells 识别到零痕迹输出的完全指南(2026)
2026-06-02 15:55:21 +0800 CST
view 760
深度解析 stop-slop 项目,系统性移除 AI 写作痕迹的实战指南,涵盖规则体系、评分标准、实战集成与完整代码示例。
AI写作
stop-slop
LLM
提示工程
技术写作
LiteRT-LM:Google端侧大模型推理引擎的革命性架构——从TensorFlow Lite的困境到LLM原生推理的全链路解析
编程
LiteRT-LM:Google端侧大模型推理引擎的革命性架构——从TensorFlow Lite的困境到LLM原生推理的全链路解析
2026-04-19 22:17:39 +0800 CST
view 969
深入解析Google LiteRT-LM端侧LLM推理引擎的核心架构:分层内存池、KV Cache量化、算子融合、WebGPU运行时。与TensorFlow Lite、llama.cpp、MLX横向对比,提供生产级部署实战指南。
Google
端侧AI
LiteRT-LM
WebGPU
量化
KV Cache
TensorFlow Lite
LLM推理
Tabby 深度实战:用一台消费级 GPU 搭好团队私有的"Copilot"
编程
Tabby 深度实战:用一台消费级 GPU 搭好团队私有的"Copilot"
2026-07-24 01:46:45 +0800 CST
view 28
深度实战 TabbyML/tabby 自托管 AI 编程助手:三层架构与 llama-server 独立化重构、消费级 GPU 模型选型、Repository Context 语法感知 RAG 索引、FIM Prompt 拼装原理、systemd/nginx 生产部署、压测与 Prometheus 监控全套方案。
Tabby
AI编程
代码补全
自托管
llama.cpp
RAG
Rust
GPU
开源
Copilot
KTransformers 深度拆解:一块 RTX 5090 跑 100B+ 大模型,CPU/GPU 异构推理凭什么改写 LLM 本地部署规则
编程
KTransformers 深度拆解:一块 RTX 5090 跑 100B+ 大模型,CPU/GPU 异构推理凭什么改写 LLM 本地部署规则
2026-07-24 07:44:31 +0800 CST
view 32
KTransformers 通过 CPU/GPU 异构计算,让一块 RTX 5090(32GB 显存)能跑起 100B+ MoE 大模型,且无需量化压缩,保持原精度 FP16。实测比 llama.cpp Q8_0 快 4.5 倍。本文深度拆解其专家细粒度卸载、异步预取、DMA 优化等核心技术,以及实战部署指南。
KTransformers
LLM推理
MoE
异构计算
DeepSeek
SGLang
CPU Offload
本地部署
GPU优化
WebAssembly 从浏览器走向服务器:WASI + Component Model 如何重塑边缘计算
编程
WebAssembly 从浏览器走向服务器:WASI + Component Model 如何重塑边缘计算
2026-07-12 12:45:20 +0800 CST
view 193
深度解析 WebAssembly 从浏览器到服务器的演进路径,剖析 WASI 系统接口规范、Component Model 组件化架构、WIT 接口语言,以及 Wasmtime / WAMR / WasmEdge 等主流运行时对比,附 Rust 实战代码与边缘计算性能基准测试。
WebAssembly
WASI
Component Model
WASM Runtime
边缘计算
Cloudflare Workers
Wasmtime
WasmEdge
Bytecode Alliance
性能优化
跨平台
Serverless
Eino 框架深度解析:Go 语言大模型应用开发的工程化实践
编程
Eino 框架深度解析:Go 语言大模型应用开发的工程化实践
2026-07-25 11:45:47 +0800 CST
view 12
深入解析字节跳动 CloudWeGo 开源的 Eino 框架:从架构设计、核心组件、ADK 多 Agent 协作到生产级 RAG 系统实战
Go语言
LLM
AI框架
Eino
CloudWeGo
RAG
Agent
Eino 深度实战:Go 语言 LLM 应用开发的组件化革命——从架构哲学到生产级 Agent 构建的完全指南(2026)
编程
Eino 深度实战:Go 语言 LLM 应用开发的组件化革命——从架构哲学到生产级 Agent 构建的完全指南(2026)
2026-06-04 15:49:45 +0800 CST
view 563
Eino是字节跳动CloudWeGo团队开源的Go语言LLM应用开发框架,本文从架构设计到代码实战,完整讲解组件化设计、Chain/Graph编排、Tool Calling、RAG、Memory、可观测性及生产级部署
Go
Eino
LLM
CloudWeGo
AI Agent
RAG
组件化框架
Cloudflare 收购 VoidZero 深度拆解:当前端工具链之王遇见边缘计算巨头——从 Vite 生态、Rust 工具链革命到 AI 原生开发范式的完整工程图景(2026)
编程
Cloudflare 收购 VoidZero 深度拆解:当前端工具链之王遇见边缘计算巨头——从 Vite 生态、Rust 工具链革命到 AI 原生开发范式的完整工程图景(2026)
2026-07-20 06:46:29 +0800 CST
view 84
2026年Cloudflare收购尤雨溪创办的VoidZero公司深度拆解:从Vite、Rolldown、Oxc工具链技术架构,到Vue生态影响、开源社区担忧、Cloudflare商业战略,配完整代码实战与性能基准测试。
Cloudflare
VoidZero
Vite
Vue
尤雨溪
Rust
Rolldown
Oxc
边缘计算
前端工具链
Qwen3.8 深度实战:2.4T MoE 巨兽来了——从 Preview API 接入、函数调用到本地部署与微调的完整工程指南(2026)
编程
Qwen3.8 深度实战:2.4T MoE 巨兽来了——从 Preview API 接入、函数调用到本地部署与微调的完整工程指南(2026)
2026-07-21 01:43:04 +0800 CST
view 100
2026年Qwen3.8深度实战:2.4T MoE架构原理、Preview API接入、流式调用、函数调用、RAG检索增强、vLLM/SGLang本地部署与QLoRA微调的完整工程指南
Qwen3.8
MoE
大模型部署
函数调用
QLoRA
vLLM
通义千问
2026
GraphQL Federation 3.0 深度实战:当API聚合遇见超级图革命,从架构原理到生产级网关部署完全指南
编程
GraphQL Federation 3.0 深度实战:当API聚合遇见超级图革命,从架构原理到生产级网关部署完全指南
2026-07-02 15:52:36 +0800 CST
view 197
深度解析 GraphQL Federation 3.0 的架构原理、超级图设计模式、生产级部署与性能优化,含完整代码实战
GraphQL
Federation
API网关
微服务
Apollo
后端架构
Flowise 深度实战:当 LangChain 遇上低代码——从架构原理到生产级 AI 工作流完全指南(2026)
编程
Flowise 深度实战:当 LangChain 遇上低代码——从架构原理到生产级 AI 工作流完全指南(2026)
2026-06-05 20:08:17 +0800 CST
view 351
Flowise 是一个开源的、可视化的低代码工具,专门用来构建基于大语言模型的应用程序或智能体(AI Agent)。本文深入剖析 Flowise 的架构设计、核心组件、实战案例,并提供生产级部署的最佳实践。
Flowise
LangChain
低代码
AI Agent
LLM
XY-Serve 深度实战:当昇腾 NPU 终于学会「驯服动态负载」——从元原语分解、Token级调度到 Attention/Linear 双内核优化的完整工程指南(2026)
编程
XY-Serve 深度实战:当昇腾 NPU 终于学会「驯服动态负载」——从元原语分解、Token级调度到 Attention/Linear 双内核优化的完整工程指南(2026)
2026-07-21 08:20:26 +0800 CST
view 79
华为联合清华大学开源的 XY-Serve 论文被 ASPLOS 2026 录用,解决了 NPU 上高效运行动态 LLM 负载的核心挑战。吞吐量提升95%,Attention 内核提速21.5%,Linear 内核提速14.6%。
XY-Serve
华为昇腾
NPU
LLM推理
Meta-Attention
虚拟填充
动态负载
ASPLOS
AI基础设施
GitHub Copilot 首次接入开源模型 Kimi K2.7 Code:从 MoE 架构到私有化部署的完整技术解析
编程
GitHub Copilot 首次接入开源模型 Kimi K2.7 Code:从 MoE 架构到私有化部署的完整技术解析
2026-07-03 14:13:50 +0800 CST
view 746
2026年7月3日,GitHub Copilot首次接入开源模型Kimi K2.7 Code。万字深度解析MoE架构、MLA注意力机制、30% Token优化技术原理、Copilot集成方案、私有化部署实战与成本分析。
Kimi K2.7 Code
GitHub Copilot
MoE
开源模型
AI编程
MoonshotAI
vLLM
模型部署
字节跳动 DeerFlow 2.0 深度解析:46k Star 的超级智能体框架,让 AI 真正「动手做事」
编程
字节跳动 DeerFlow 2.0 深度解析:46k Star 的超级智能体框架,让 AI 真正「动手做事」
2026-04-28 13:55:13 +0800 CST
view 546
深度解析字节跳动开源的 DeerFlow 2.0 超级智能体框架,46k Star 的核心技术架构、LangGraph 状态机原理、代码实战与性能优化指南。
AI Agent
LangGraph
DeerFlow
字节跳动
多智能体
深度学习
Scrapling 深度解析:下一代自适应 Python 爬虫框架——从反反爬到大规模并发抓取、从 Cloudflare 绕过到智能元素定位的完整技术指南(2026)
编程
Scrapling 深度解析:下一代自适应 Python 爬虫框架——从反反爬到大规模并发抓取、从 Cloudflare 绕过到智能元素定位的完整技术指南(2026)
2026-07-04 20:11:27 +0800 CST
view 377
深度解析 Scrapling 自适应 Python 爬虫框架:从 Fetcher/StealthyFetcher/DynamicFetcher 三大抓取引擎,到自适应解析引擎的元素自愈能力,从 Cloudflare 绕过到大规模并发 Spider 框架,完整代码实战与生产级部署指南。
Scrapling
Python爬虫
自适应爬虫
反反爬
Cloudflare绕过
StealthyFetcher
Web Scraping
数据采集
DeerFlow深度解析:字节跳动如何用"Harness架构"重新定义AI Agent执行系统
编程
DeerFlow深度解析:字节跳动如何用"Harness架构"重新定义AI Agent执行系统
2026-04-28 15:20:25 +0800 CST
view 652
深度解析字节跳动开源的超级Agent框架DeerFlow,从Harness架构设计到Memory持久化、沙箱隔离、技能系统等核心技术实现,附完整代码实战和生产部署指南。
DeerFlow
AI Agent
字节跳动
SuperAgent
多智能体
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
9
10
11
12
13
...
42
下一页