程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
腾讯混元开源 HyOCR-1.5 深度解读:端到端 OCR 的工程哲学与 DFlash 投机解码完全指南
编程
腾讯混元开源 HyOCR-1.5 深度解读:端到端 OCR 的工程哲学与 DFlash 投机解码完全指南
2026-07-21 12:46:56 +0800 CST
view 265
2026年7月腾讯混元开源HyOCR-1.5端到端OCR大模型,1B参数OmniDocBench 94.74分霸榜。深度拆解DFlash投机解码6.37倍加速、Agentic Data Flow自动化数据闭环、三阶段训练配方,以及vLLM/llama.cpp全场景部署实战。
HyOCR
HunyuanOCR
腾讯混元
端到端OCR
DFlash
投机解码
多模态模型
文档解析
文字识别
视觉语言模型
OmniDocBench
vLLM
llama.cpp
深度学习
Nushell 深度实战:30K Star 的结构化数据 Shell——从类型系统到插件架构的生产级全链路解析
编程
Nushell 深度实战:30K Star 的结构化数据 Shell——从类型系统到插件架构的生产级全链路解析
2026-05-07 00:37:06 +0800 CST
view 786
深度解析 Nushell 的类型系统、结构化数据管道、Rust 多 Crate 架构、插件机制和生产实践,从 Bash 迁移到 Nu 的全链路实战指南
Nushell
Rust
Shell
结构化数据
管道
插件系统
类型系统
DevOps
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
编程
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
2026-07-15 08:45:14 +0800 CST
view 363
从工程师视角深度拆解 Ollama 与本地大模型推理引擎:GGUF 单文件格式、K-quant/IQ-quant 量化家族、内存带宽墙、llama.cpp 计算图与 KV Cache,配 Modelfile、Python/Go 流式客户端与自量化实战。
Ollama
llama.cpp
GGUF
本地推理
大模型量化
KV Cache
DeepSeek-R1边缘推理实战:从云端独占到本地智能的范式转移
编程
DeepSeek-R1边缘推理实战:从云端独占到本地智能的范式转移
2026-05-19 12:42:27 +0800 CST
view 619
2026年,边缘AI不再只是云端模型的精简版。本文深入剖析DeepSeek-R1 CPU版的技术原理,从模型蒸馏、量化技术的底层原理到生产环境的完整部署方案,提供可直接落地的代码和可量化的性能数据。
DeepSeek
R1
边缘计算
AI推理
模型蒸馏
量化
llama.cpp
Ollama
端侧AI
Bun Shell:首个 JavaScript 原生 Shell 环境深度拆解——从架构原理到生产级实战
编程
Bun Shell:首个 JavaScript 原生 Shell 环境深度拆解——从架构原理到生产级实战
2026-08-17 13:47:56 +0800 CST
view 44
深度拆解 Bun Shell 架构设计、语法特性、生产级实战,与 bash/Node.js child_process 的性能对比,以及 Node.js 兼容层完整指南。
Bun
Shell
JavaScript
TypeScript
Node.js
跨平台
Shell脚本
深度长文:LLM 推测解码(Speculative Decoding)工程化实战——从原理到3倍加速的完整实现
编程
深度长文:LLM 推测解码(Speculative Decoding)工程化实战——从原理到3倍加速的完整实现
2026-07-26 17:15:22 +0800 CST
view 259
深度长文实战 Speculative Decoding 推测解码技术:从拒绝采样原理、草稿模型选型到 vLLM 生产部署,包含完整代码实现、性能基准测试和 DSpark 等前沿变体解析,不修改模型不牺牲质量即可实现 2-3 倍推理加速。
Speculative Decoding
LLM推理加速
推测解码
vLLM
DSpark
通义千问 Qwen3.8-27B 深度解析:Max 级旗舰权重首次开源,270 亿参数 Dense 模型如何在家用显卡上跑出旗舰性能
编程
通义千问 Qwen3.8-27B 深度解析:Max 级旗舰权重首次开源,270 亿参数 Dense 模型如何在家用显卡上跑出旗舰性能
2026-08-17 18:44:06 +0800 CST
view 44
深度拆解阿里 Qwen3.8-27B:2.4T 旗舰与 27B 开源版的关系、MoE 架构细节、Dense 模型设计、vLLM/Ollama/昇腾部署实战、性能实测,以及完整的本地 RAG 代码示例。Apache 2.0 开源,家用显卡可跑。
Qwen3.8
通义千问
大模型
MoE
Dense架构
vLLM
Ollama
本地部署
TensorRT-LLM 1.0 深度实战:当 PyTorch 架构成为默认体验,NVIDIA 的 LLM 推理引擎正式走向成熟
编程
TensorRT-LLM 1.0 深度实战:当 PyTorch 架构成为默认体验,NVIDIA 的 LLM 推理引擎正式走向成熟
2026-07-22 10:46:37 +0800 CST
view 205
深度解析 TensorRT-LLM 1.0:PyTorch 架构正式稳定、LLM API 稳定化、多模态 VLM 原生支持、Qwen3 MoE 优化、LoRA 生产级管理、trtllm-serve 推理服务化,配完整部署实战代码。
TensorRT-LLM
LLM推理
GPU加速
PyTorch
NVIDIA
深度学习
模型部署
推理优化
WorldMonitor 深度拆解:73K Stars 的「全球态势感知」仪表盘,凭什么不用任何前端框架?
编程
WorldMonitor 深度拆解:73K Stars 的「全球态势感知」仪表盘,凭什么不用任何前端框架?
2026-07-27 08:44:14 +0800 CST
view 418
深度拆解一周涨1万Star的WorldMonitor:500+信源聚合、双地图引擎、零框架Vanilla TS前端、一套代码6个站点变体、本地Ollama兜底与MCP/SDK全家桶,附自托管与mini复刻实战。
WorldMonitor
开源
态势感知
Vanilla TypeScript
deck.gl
MCP
Ollama
Tauri
Local-File-Organizer 深度解析:3K Stars 本地 AI 文件整理,Llama3.2+LLaVA 完全离线运行
编程
Local-File-Organizer 深度解析:3K Stars 本地 AI 文件整理,Llama3.2+LLaVA 完全离线运行
2026-05-15 12:22:33 +0800 CST
view 600
深入解析 3K Stars 的 Local-File-Organizer:基于 Llama3.2 3B + LLaVA-v1.6 双模型的本地 AI 文件整理工具,使用 Nexa SDK 实现 100% 离线推理,自动识别文件内容、智能分类重命名、支持图片视觉分析和文档内容解析,零数据外泄。
Local-File-Organizer
AI文件整理
Llama3
LLaVA
本地AI
隐私
Rolldown 深度拆解:当 Rust 重写打包器成为 Vite 8 的统一底座——从 Rollup 兼容 API 到 esbuild 特性对齐与 19k 模块基准的全链路实战
编程
Rolldown 深度拆解:当 Rust 重写打包器成为 Vite 8 的统一底座——从 Rollup 兼容 API 到 esbuild 特性对齐与 19k 模块基准的全链路实战
2026-08-18 07:45:30 +0800 CST
view 53
深度拆解 Rolldown:用 Rust 重写的 JS/TS 打包器如何成为 Vite 8 统一底座——Rollup 兼容 API 加 esbuild 特性对齐,19k 模块 1.61s 基准,配可运行构建、插件与基准复现代码。
Rolldown
Vite 8
前端构建
Rust 打包器
esbuild
Rollup
oxc
SGLang vs vLLM:2026年大模型推理框架深度对比与选型指南
编程
SGLang vs vLLM:2026年大模型推理框架深度对比与选型指南
2026-04-08 15:51:53 +0800 CST
view 2199
深度对比SGLang与vLLM两大LLM推理框架,从架构设计、核心原理、性能实测、适用场景多维度解析,附2026年选型建议
LLM
SGLang
vLLM
推理优化
大模型
Nushell 深度解析:为什么 2026 年最值得学习的 Shell 不是 Bash
编程
Nushell 深度解析:为什么 2026 年最值得学习的 Shell 不是 Bash
2026-04-18 00:47:07 +0800 CST
view 726
深入解析 2026 年最值得学习的 Shell 工具 Nushell,从架构设计、管道机制、代码实战多维度剖析,探讨它如何用结构化数据管道取代传统文本流,以及如何在生产环境中落地使用。
Nushell
Rust
Shell
命令行
Linux
Ollama 本地大模型部署实战:从零到生产级应用的完全指南(2026)
编程
Ollama 本地大模型部署实战:从零到生产级应用的完全指南(2026)
2026-06-10 01:20:57 +0800 CST
view 775
2026年Ollama本地大模型部署完全指南:从架构原理、GGUF量化、ModelFile自定义、多语言集成(Python/JS/Go)、RAG实战到Docker/K8s生产部署,8500字深度长文。
Ollama
本地部署
大模型
LLM
生产级
GGUF
量化
当 C/C++ 遇上 Rust:llama.cpp 与 LiteBox 深度架构对比——2026 年本地 LLM 推理框架的心智模型之战
编程
当 C/C++ 遇上 Rust:llama.cpp 与 LiteBox 深度架构对比——2026 年本地 LLM 推理框架的心智模型之战
2026-07-16 12:50:04 +0800 CST
view 275
深度对比 llama.cpp 与 LiteBox 两大本地 LLM 推理框架:GGUF 格式设计、K-Quant 量化内核、KV cache 管理、多后端抽象、并发架构,配完整代码实战与性能实测数据。
llama.cpp
LiteBox
GGUF
量化
KV cache
本地LLM
推理框架
Rust
C/C++
模型压缩
从零构建企业级本地化RAG系统:Ollama与RAGFlow深度实战
编程
从零构建企业级本地化RAG系统:Ollama与RAGFlow深度实战
2026-06-29 01:46:19 +0800 CST
view 618
深入探讨如何基于Ollama和RAGFlow构建完全本地化的RAG系统,涵盖架构设计、部署实战、代码实现和性能优化。
RAG
Ollama
RAGFlow
本地部署
LLM
前端工具链的Rust革命:从Vite 8到Vite+,尤雨溪的「一次编写、极速构建」终极愿景
编程
前端工具链的Rust革命:从Vite 8到Vite+,尤雨溪的「一次编写、极速构建」终极愿景
2026-07-23 01:12:52 +0800 CST
view 301
深度解析Vite 8底层革命:Rolldown替换esbuild+Rollup双轨制,性能提升10~30倍。全面解读Vite+一体化工具链设计哲学,从项目创建到生产构建的统一入口。涵盖Rolldown技术架构、Oxc工具链、性能基准测试及实战迁移指南。
Vite 8
Rolldown
Vite+
Oxc
Rust
前端工具链
VoidZero
前端构建工具
Module Federation
Vite Plus
Dolt 2.0 深度拆解:当 Git 决定「吞掉 SQL」——从 Prolly 树到向量版本控制,一个 17K Star 的数据库如何重新定义数据管理的终极范式
编程
Dolt 2.0 深度拆解:当 Git 决定「吞掉 SQL」——从 Prolly 树到向量版本控制,一个 17K Star 的数据库如何重新定义数据管理的终极范式
2026-08-04 00:43:09 +0800 CST
view 154
深度拆解Dolt 2.0版本控制型SQL数据库:Prolly树内容寻址架构、自动垃圾回收、归档压缩存储去重、向量版本控制、MySQL兼容协议,附完整代码示例与性能基准对比
Dolt
Git
版本控制
SQL数据库
Prolly树
向量数据库
数据管理
开源
性能优化
Andrej Karpathy Skills 深度实战:当 AI 学会了「编程自律」——从 CLAUDE.md 四大原则到 AI 编程行为矫正、从错误假设捕获到极简代码生成的完全指南(2026)
编程
Andrej Karpathy Skills 深度实战:当 AI 学会了「编程自律」——从 CLAUDE.md 四大原则到 AI 编程行为矫正、从错误假设捕获到极简代码生成的完全指南(2026)
2026-06-21 14:25:24 +0800 CST
view 392
深入剖析 GitHub 149K+ Stars 爆火项目 andrej-karpathy-skills,揭示 Andrej Karpathy 如何通过一份 65 行的 CLAUDE.md 文件,将 AI 编程助手的准确率从 65% 提升到 94%。
AI编程
Claude Code
LLM
行为准则
代码质量
OpenCode 深度解析:157K Star 的开源 AI 编程智能体——如何打造 Claude Code 的完美平替
编程
OpenCode 深度解析:157K Star 的开源 AI 编程智能体——如何打造 Claude Code 的完美平替
2026-05-16 05:45:45 +0800 CST
view 879
深度解析OpenCode——157K Star的开源AI编程智能体,支持75+ LLM提供商,如何成为Claude Code的完美平替
AI编程
开源
OpenCode
Claude Code平替
LLM
Andrej Karpathy Skills 深度实战:终结LLM编程的「四大天坑」——从 CLAUDE.md 规范到生产级 AI 辅助编程的完全指南(2026)
编程
Andrej Karpathy Skills 深度实战:终结LLM编程的「四大天坑」——从 CLAUDE.md 规范到生产级 AI 辅助编程的完全指南(2026)
2026-06-10 12:47:30 +0800 CST
view 803
前 Tesla AI 总监 Andrej Karpathy 开源的 CLAUDE.md 配置项目,系统性解决 LLM 编程四大天坑。本文深度解析四大核心原则、架构设计、代码实战,助你从「AI 代码生成器」进化到「AI 工程协作」。
AI编程
LLM
Claude Code
Python
测试驱动开发
Google LangExtract 深度解析:从混乱文本到结构化数据的工程化实践
编程
Google LangExtract 深度解析:从混乱文本到结构化数据的工程化实践
2026-04-29 01:09:56 +0800 CST
view 785
深度解析Google开源的LangExtract库:基于LLM的结构化信息提取框架,精确来源定位、交互可视化、零微调部署。从架构设计到代码实战,全面剖析21k+ Star背后的技术内核。
LangExtract
Google
信息提取
LLM
结构化数据
Python
开源
2026前端启示录:Rust正在系统性颠覆整个JavaScript工具链——从Webpack到Rolldown、Rspack、Oxc的架构革命
编程
2026前端启示录:Rust正在系统性颠覆整个JavaScript工具链——从Webpack到Rolldown、Rspack、Oxc的架构革命
2026-05-09 11:15:12 +0800 CST
view 862
深度解析2026年Rust语言在前端工具链的全面崛起:Rolldown、Rspack、Oxc、SWC如何用50-100倍性能重写JavaScript工具链,以及前端开发者的迁移实战指南。
Rust
JavaScript
前端工具链
Rolldown
Oxc
Vite 6
构建优化
Rolldown 深度实战:Vite 团队用 Rust 重写 JavaScript 打包引擎——从双引擎架构到 Bitset 代码分割的完整技术揭秘
编程
Rolldown 深度实战:Vite 团队用 Rust 重写 JavaScript 打包引擎——从双引擎架构到 Bitset 代码分割的完整技术揭秘
2026-05-16 11:13:14 +0800 CST
view 724
深度解析 Rolldown:Vite 团队用 Rust 重写的下一代 JavaScript 打包器,从三阶段架构到 Bitset 代码分割算法,从 Vite 6+ 配置到插件开发,万字实战指南
Rolldown
Vite
Rust
前端打包
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
123
124
125
126
127
...
133
下一页