程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
KTransformers 深度拆解:一块 RTX 5090 跑 100B+ 大模型,CPU/GPU 异构推理凭什么改写 LLM 本地部署规则
编程
KTransformers 深度拆解:一块 RTX 5090 跑 100B+ 大模型,CPU/GPU 异构推理凭什么改写 LLM 本地部署规则
2026-07-24 07:44:31 +0800 CST
view 240
KTransformers 通过 CPU/GPU 异构计算,让一块 RTX 5090(32GB 显存)能跑起 100B+ MoE 大模型,且无需量化压缩,保持原精度 FP16。实测比 llama.cpp Q8_0 快 4.5 倍。本文深度拆解其专家细粒度卸载、异步预取、DMA 优化等核心技术,以及实战部署指南。
KTransformers
LLM推理
MoE
异构计算
DeepSeek
SGLang
CPU Offload
本地部署
GPU优化
Ollama 深度拆解:从傻瓜式本地大模型部署到底层 llama.cpp 调度器的工程全貌(2026·完整版)
编程
Ollama 深度拆解:从傻瓜式本地大模型部署到底层 llama.cpp 调度器的工程全貌(2026·完整版)
2026-07-20 18:18:40 +0800 CST
view 387
深度拆解 Ollama 工程架构:Go 服务层封装 llama.cpp、CGO 内存边界、GGUF 量化格式、Modelfile DSL、OpenAI 兼容层、Metal GPU 加速与生产部署实战,配完整 Go/Python/Shell 代码示例。
Ollama
本地大模型
llama.cpp
GGUF
Go
CGO
量化
Apple Silicon
Karpathy 四原则深度实战:当 AI 编程助手学会「克制」——从错误率 41% 到 3% 的生产级完全指南(2026)
编程
Karpathy 四原则深度实战:当 AI 编程助手学会「克制」——从错误率 41% 到 3% 的生产级完全指南(2026)
2026-06-06 09:38:11 +0800 CST
view 576
前 Tesla AI 总监 Karpathy 提炼的四条 AI 编程原则,如何在 6 周内让 30 个代码库错误率从 41% 降到 3%。深入剖析 Think Before Coding、Simplicity First、Surgical Changes、Goal-Driven Execution 四原则的底层逻辑与实战应用。
AI编程
Claude Code
Karpathy
LLM
编码原则
Zig 语言 2026 深度拆解:从 C 的替代品到系统编程新范式—— comptime 元编程、泛型推导与零开销抽象的全链路实战
编程
Zig 语言 2026 深度拆解:从 C 的替代品到系统编程新范式—— comptime 元编程、泛型推导与零开销抽象的全链路实战
2026-08-11 15:33:53 +0800 CST
view 112
深度拆解 Zig 语言 2026 年最新发展,涵盖 comptime 元编程、C Interop、内存管理、WebAssembly 目标支持、构建系统、与 Rust/Go 的深度对比,含完整代码示例与生产踩坑清单。
Zig
comptime
元编程
系统编程
泛型
零开销抽象
C语言
WebAssembly
构建系统
内存管理
Python 3.14 深度拆解:当 CPython 决定拆掉 GIL 的最后一道墙——free-threading 转正、实验性 JIT、t-string 与子解释器并行的全链路实战
编程
Python 3.14 深度拆解:当 CPython 决定拆掉 GIL 的最后一道墙——free-threading 转正、实验性 JIT、t-string 与子解释器并行的全链路实战
2026-08-12 03:43:22 +0800 CST
view 94
深度拆解 Python 3.14:free-threading 官方支持、实验性 JIT、t-string、子解释器标准库化与惰性注解,含代码实战与性能选型。
Python 3.14
free-threading
t-string
子解释器
JIT
GIL
并发编程
CPython
ClickHouse 深度实战:当实时分析遇上列式存储——从 MergeTree 引擎家族、物化视图到分布式集群的工程全景
编程
ClickHouse 深度实战:当实时分析遇上列式存储——从 MergeTree 引擎家族、物化视图到分布式集群的工程全景
2026-07-11 08:11:22 +0800 CST
view 288
从工程视角讲透 ClickHouse 的列式存储内核、MergeTree 引擎家族、物化视图的插入触发器本质、分布式集群取舍与一组可落地的性能优化手段,配 SQL/Go/Python 实战代码。
ClickHouse
实时分析
OLAP
MergeTree
物化视图
llama.cpp 深度实战:当端侧 LLM 成为生产级事实标准——从 GGUF 量化到跨平台部署的完全指南(2026)
编程
llama.cpp 深度实战:当端侧 LLM 成为生产级事实标准——从 GGUF 量化到跨平台部署的完全指南(2026)
2026-06-11 00:19:05 +0800 CST
view 615
全面解析 llama.cpp 推理引擎,从 GGUF 格式、量化原理、架构设计到跨平台部署,提供生产级代码实战和性能优化指南。
llama.cpp
GGUF
量化
端侧推理
大语言模型
微软 Majorana 2 量子芯片深度实战:当拓扑量子比特从毫秒跃升至分钟——从铅基超导材料革命到混合量子经典编程的生产级完全指南(2026)
编程
微软 Majorana 2 量子芯片深度实战:当拓扑量子比特从毫秒跃升至分钟——从铅基超导材料革命到混合量子经典编程的生产级完全指南(2026)
2026-06-16 22:27:56 +0800 CST
view 573
微软Majorana 2拓扑量子芯片深度解析:铅基超导材料带来1000倍可靠性提升,量子态维持时间从毫秒跃升至分钟级
量子计算
微软
Majorana
拓扑量子比特
Azure Quantum
当 Apple Silicon 遇上视觉大模型:MLX-VLM 如何把「本地多模态推理」变成现实
编程
当 Apple Silicon 遇上视觉大模型:MLX-VLM 如何把「本地多模态推理」变成现实
2026-04-11 10:24:48 +0800 CST
view 955
深度解析 Apple Silicon 上的视觉语言模型推理引擎 MLX-VLM,涵盖架构设计、模型支持、性能优化与实战部署。
Apple Silicon
MLX
视觉语言模型
VLM
Mac本地AI
多模态推理
玄铁C950深度实战:当RISC-V旗舰芯片突破SPECint2006 70分大关——从超标量流水线到千亿参数大模型原生推理的完全指南(2026)
编程
玄铁C950深度实战:当RISC-V旗舰芯片突破SPECint2006 70分大关——从超标量流水线到千亿参数大模型原生推理的完全指南(2026)
2026-06-22 20:59:56 +0800 CST
view 750
深度剖析2026年RISC-V旗舰芯片玄铁C950:SPECint2006首次突破70分、8指令译码16级流水线、千亿参数大模型原生推理、CoVE机密计算——从微架构设计到生态格局的完全解读。
RISC-V
玄铁
处理器架构
AI推理
SPECint2006
开源芯片
阿里达摩院
Apache Iceberg V3 深度拆解:Deletion Vectors、Row Lineage 与 Variant 类型,开放表格式如何终结数据湖的「文件散养」时代
编程
Apache Iceberg V3 深度拆解:Deletion Vectors、Row Lineage 与 Variant 类型,开放表格式如何终结数据湖的「文件散养」时代
2026-07-30 01:46:13 +0800 CST
view 221
深度拆解 Apache Iceberg V3 规范三大核心改动:Binary Deletion Vectors 终结删除文件堆积、Row Lineage 行级血缘赋能增量计算与审计、Variant 半结构化类型落地,附 V2 升级实战与冷静的边界分析。
Iceberg
数据湖
Deletion Vectors
Row Lineage
Variant
表格式
Spark
Trino
大数据
开源
Meta-Harness 深度拆解:当 AI 编程进入「多 Agent 并行时代」——Databricks Omnigent、Zed ACP、Vercel HarnessAgent 三大开源方案如何用「Harness 之上的 Harness」重新定义 Agent 工程化的终极形态
编程
Meta-Harness 深度拆解:当 AI 编程进入「多 Agent 并行时代」——Databricks Omnigent、Zed ACP、Vercel HarnessAgent 三大开源方案如何用「Harness 之上的 Harness」重新定义 Agent 工程化的终极形态
2026-08-05 12:44:41 +0800 CST
view 210
深度拆解2026年最热AI工程化范式Meta-Harness:Databricks Omnigent、Zed ACP、Vercel HarnessAgent三大开源方案如何用Harness之上的Harness重新定义多Agent编排与治理
Meta-Harness
Omnigent
ACP
HarnessAgent
Agent编排
多Agent
Databricks
Vercel
Cloudflare
RUFLO
n8n 工作流自动化深度解析:从入门到企业级架构设计——2026技术团队效率革命实战指南
编程
n8n 工作流自动化深度解析:从入门到企业级架构设计——2026技术团队效率革命实战指南
2026-04-14 10:23:31 +0800 CST
view 881
深入解析 n8n 的三层架构设计、500+节点系统、代码节点实战、AI工作流构建、子工作流模块化及生产部署,是 2026 年技术团队必备的自动化平台深度指南。
n8n
工作流自动化
AI集成
低代码
Python
JavaScript
RPA
集成平台
企业自动化
DevOps
TypeScript 7.0 深度实战:Go 重写编译器如何把 10 倍提速变成现实——从 tsgo 架构原理到生产迁移全链路拆解
编程
TypeScript 7.0 深度实战:Go 重写编译器如何把 10 倍提速变成现实——从 tsgo 架构原理到生产迁移全链路拆解
2026-08-16 11:44:27 +0800 CST
view 11
深度拆解 TypeScript 7.0 Go 原生编译器 tsgo:从五阶段流水线、共享内存并行架构到生产迁移、基准测试与性能优化全链路实战,配完整代码示例。
TypeScript
TypeScript 7
tsgo
Go
编译器
性能优化
前端工程化
CLAUDE.md 完全指南(上):当 AI 学会「工程师纪律」——Karpathy 四大原则深度解析(2026)
编程
CLAUDE.md 完全指南(上):当 AI 学会「工程师纪律」——Karpathy 四大原则深度解析(2026)
2026-06-15 02:19:02 +0800 CST
view 811
2026年GitHub Trending榜首项目(149K+ Stars)深度解析(上篇):深入剖析Karpathy观察到的LLM编程四大陷阱,以及CLAUDE.md四大原则的工程哲学。
AI编程
Claude Code
LLM
工程实践
提示词工程
Headroom 深度实战:当上下文窗口成为AI Agent的成本黑洞——从Token爆炸到60-95%压缩率的生产级完全指南(2026)
编程
Headroom 深度实战:当上下文窗口成为AI Agent的成本黑洞——从Token爆炸到60-95%压缩率的生产级完全指南(2026)
2026-06-15 13:19:56 +0800 CST
view 673
深度解析开源项目Headroom:AI Agent的上下文压缩中间层,60-95% Token节省,CCR可逆压缩机制,六大压缩引擎架构分析,生产级部署指南。
AI Agent
Token压缩
上下文管理
LLM
Claude Code
Cursor
Headroom
Python
开源工具
工程实践
Hermes Agent 深度解析:当 AI Agent 终于学会「记住一切、学会一切、成为一切」
编程
Hermes Agent 深度解析:当 AI Agent 终于学会「记住一切、学会一切、成为一切」
2026-04-09 01:07:00 +0800 CST
view 1872
36k+ stars 的开源自进化 AI Agent,Nous Research 出品,支持记忆持久化、跨平台网关、自创建技能和 $5 VPS 运行能力
AI Agent
Hermes Agent
Nous Research
自进化
记忆系统
Zerostack 深度实战:7k 行 Rust 打造 8MB 内存占用的 Unix 哲学 AI 编码代理
编程
Zerostack 深度实战:7k 行 Rust 打造 8MB 内存占用的 Unix 哲学 AI 编码代理
2026-05-22 12:46:54 +0800 CST
view 613
Zerostack 用 7k 行 Rust 代码和 8MB 内存占用挑战传统 AI 编码工具。本文深入解析其 Unix 管道式架构、tree-sitter 代码分析、Rust 零成本抽象实现,以及与 Claude Code 的性能对比。
Rust
AI 编码代理
Unix 哲学
性能优化
tree-sitter
2026 AI Agent 框架四分天下:OpenAI、Claude Code、CodeBuddy、OpenClaw 的架构哲学对决
编程
2026 AI Agent 框架四分天下:OpenAI、Claude Code、CodeBuddy、OpenClaw 的架构哲学对决
2026-04-09 06:54:56 +0800 CST
view 1649
2026年AI Agent领域最值得关注的不是某个新框架的诞生,而是既有格局的彻底分叉。本文深入剖析OpenAI、Claude Code、CodeBuddy和OpenClaw四条路线的架构哲学、核心机制与实际取舍,为AI Agent选型提供真正有价值的参考。
AI Agent
OpenAI
Claude Code
OpenClaw
多Agent
框架对比
MusaCoder 深度实战:当国产GPU遇见AI驱动的Kernel生成——从PyTorch到CUDA/MUSA原生算子的全栈训练完全指南(2026)
编程
MusaCoder 深度实战:当国产GPU遇见AI驱动的Kernel生成——从PyTorch到CUDA/MUSA原生算子的全栈训练完全指南(2026)
2026-06-16 06:47:47 +0800 CST
view 478
MusaCoder是首个基于国产GPU完成全链路训练的代码大模型,在KernelBench上超越Claude Opus 4.7。从三阶段数据合成、多样性RFT到执行反馈RL,深度解析全栈训练方法论。
MusaCoder
GPU Kernel
摩尔线程
国产GPU
CUDA
MUSA
大模型
强化学习
KernelBench
代码大模型
AI Coding
深度学习
Headroom深度解析:让AI Agent「吃得少、营养好」的上下文压缩革命
编程
Headroom深度解析:让AI Agent「吃得少、营养好」的上下文压缩革命
2026-07-05 04:43:37 +0800 CST
view 269
Headroom是一个开源的LLM上下文压缩中间件,能减少60-95%的token消耗,同时保持97%+的信息精度。本文深度解析其四层压缩管线、架构设计、使用模式和实战案例。
AI Agent
上下文压缩
Headroom
LLM
Token优化
Connect RPC 深度拆解:当 gRPC 学会「说 HTTP」——跨语言 RPC 框架的工程革命(2026)
编程
Connect RPC 深度拆解:当 gRPC 学会「说 HTTP」——跨语言 RPC 框架的工程革命(2026)
2026-07-17 06:44:27 +0800 CST
view 226
深度拆解 Connect RPC:从协议设计、connect-go 六层架构、流式传输、拦截器链到多语言生态(Go/TS/Python/Kotlin/Swift/Dart),配完整代码实战与性能基准,一份写给后端工程师的微服务 RPC 完全指南(2026)
Connect RPC
gRPC
Protocol Buffers
微服务
Buf
connect-go
RPC框架
protobuf
CNCF
API设计
Anthropic Claude Science深度解析:多智能体架构如何重塑科研工作流
编程
Anthropic Claude Science深度解析:多智能体架构如何重塑科研工作流
2026-07-05 06:14:18 +0800 CST
view 373
深入解析Anthropic Claude Science的技术架构与工程实现,探讨多智能体协作如何重塑科研工作流。
AI
多智能体
Claude
Anthropic
科研工具
Agent架构
Little Snitch for Linux 开源深度解析:当 macOS 传奇防火墙「杀入」Linux 生态
编程
Little Snitch for Linux 开源深度解析:当 macOS 传奇防火墙「杀入」Linux 生态
2026-04-10 00:25:47 +0800 CST
view 810
2026年4月8日Objective Development开源Little Snitch for Linux的eBPF核心代码。本文从源码出发,深度拆解其架构设计、过滤引擎算法、eBPF内核空间实现与用户态程序。
Linux
eBPF
网络安全
Rust
Firewall
Little Snitch
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
67
68
69
70
71
...
234
下一页