程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
DuckDB 深度实战:把「分析引擎」塞进应用进程里——向量化执行、列式存储与直查 PB 级 Parquet 湖仓的完整指南(2026)
编程
DuckDB 深度实战:把「分析引擎」塞进应用进程里——向量化执行、列式存储与直查 PB 级 Parquet 湖仓的完整指南(2026)
2026-07-08 12:15:42 +0800 CST
view 208
从工程视角彻底讲透 DuckDB:嵌入式进程内 OLAP 的定位、向量化执行与列式存储原理、直查 Parquet/Iceberg 的架构,配 7 个可运行代码实战与性能优化清单。
DuckDB
OLAP
向量化执行
列式存储
Parquet
数据湖仓
ETL
Arrow
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
编程
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
2026-07-15 08:45:14 +0800 CST
view 254
从工程师视角深度拆解 Ollama 与本地大模型推理引擎:GGUF 单文件格式、K-quant/IQ-quant 量化家族、内存带宽墙、llama.cpp 计算图与 KV Cache,配 Modelfile、Python/Go 流式客户端与自量化实战。
Ollama
llama.cpp
GGUF
本地推理
大模型量化
KV Cache
DuckDB 深度实战:把分析型数据库装进进程里——向量化执行引擎、Quack 客户端协议与 1.5.x 全解析
编程
DuckDB 深度实战:把分析型数据库装进进程里——向量化执行引擎、Quack 客户端协议与 1.5.x 全解析
2026-07-09 01:14:03 +0800 CST
view 175
进程内分析型数据库 DuckDB 1.5.x 深度解析:向量化执行引擎原理、列式存储与 Zone Map 剪枝、Quack 客户端-服务端协议、Iceberg/Lance Lakehouse 直查,配 Python/SQL 实战与性能调优。
DuckDB
OLAP
向量化执行
列存数据库
数据分析
DeepSeek-R1边缘推理实战:从云端独占到本地智能的范式转移
编程
DeepSeek-R1边缘推理实战:从云端独占到本地智能的范式转移
2026-05-19 12:42:27 +0800 CST
view 553
2026年,边缘AI不再只是云端模型的精简版。本文深入剖析DeepSeek-R1 CPU版的技术原理,从模型蒸馏、量化技术的底层原理到生产环境的完整部署方案,提供可直接落地的代码和可量化的性能数据。
DeepSeek
R1
边缘计算
AI推理
模型蒸馏
量化
llama.cpp
Ollama
端侧AI
Go 1.27 原生 SIMD 深度拆解:两层 API 如何终结 Go 十年性能之痛,手写一个自适应 CPU 的向量计算库
编程
Go 1.27 原生 SIMD 深度拆解:两层 API 如何终结 Go 十年性能之痛,手写一个自适应 CPU 的向量计算库
2026-08-02 06:43:17 +0800 CST
view 83
从 Issue #73787/#78902/#78979 拆解 Go 1.26/1.27 原生 SIMD 两层 API 设计,附完整代码与性能优化方法论。
Go
SIMD
archsimd
性能优化
AVX-512
编译器
向量化
Go 1.27
Vibe-Trading 深度拆解:当 LLM 学会「炒股」——自然语言量化交易的多智能体架构与工程实践
编程
Vibe-Trading 深度拆解:当 LLM 学会「炒股」——自然语言量化交易的多智能体架构与工程实践
2026-07-15 11:45:26 +0800 CST
view 486
深度拆解港大HKUDS开源的Vibe-Trading项目:ReAct循环驱动的自然语言量化交易Agent、69个金融技能按需加载、30个多智能体Swarm团队、四大市场回测引擎、456个Alpha因子库,以及Shadow Account行为诊断功能,配完整代码示例与工程边界分析。
Vibe-Trading
LLM
量化交易
多智能体
ReAct
金融科技
HKUDS
Alpha Zoo
Shadow Account
Go 十年 SIMD 之痛终结:archsimd 与可移植 simd 包全拆解,手写自动适配 AVX2/AVX-512 的向量计算库
编程
Go 十年 SIMD 之痛终结:archsimd 与可移植 simd 包全拆解,手写自动适配 AVX2/AVX-512 的向量计算库
2026-08-02 06:44:17 +0800 CST
view 71
从 Issue #73787/#78902/#78979 拆解 Go 1.26/1.27 原生 SIMD 两层 API 设计,附完整代码与性能优化方法论。
Go
SIMD
archsimd
性能优化
AVX-512
编译器
向量化
Go 1.27
TurboQuant 深度实战:Google 的 KV 缓存压缩算法完全指南(2026)
编程
TurboQuant 深度实战:Google 的 KV 缓存压缩算法完全指南(2026)
2026-06-08 20:52:38 +0800 CST
view 427
2026年3月Google Research在ICLR 2026发表TurboQuant算法,将LLM的KV缓存压缩至3-bit,实现6倍内存缩减和8倍推理加速。本文深入剖析TurboQuant的技术原理,并提供生产级部署指南。
TurboQuant
KV缓存压缩
LLM推理优化
量化算法
Google Research
ICLR2026
DuckDB 1.5 深度实战:向量化执行引擎、VARIANT 类型与零拷贝数据栈,重新定义进程内 OLAP(2026)
编程
DuckDB 1.5 深度实战:向量化执行引擎、VARIANT 类型与零拷贝数据栈,重新定义进程内 OLAP(2026)
2026-07-22 03:42:25 +0800 CST
view 189
2026年7月DuckDB 1.5深度实战:向量化执行引擎、列式存储、Morsel驱动并行、Arrow零拷贝、VARIANT半结构化类型、pg_duckdb与性能优化完全指南。
DuckDB
OLAP
向量化执行
VARIANT
进程内数据库
数据分析
零拷贝
Parquet
FinceptTerminal 深度实战:当 C++20 遇上金融终端——从 Qt6 原生渲染到 37 个 AI 智能体与 QuantLib 量化引擎的生产级完全指南(2026)
编程
FinceptTerminal 深度实战:当 C++20 遇上金融终端——从 Qt6 原生渲染到 37 个 AI 智能体与 QuantLib 量化引擎的生产级完全指南(2026)
2026-06-14 22:28:06 +0800 CST
view 483
开源金融终端 Fincept Terminal v4 深度实战:C++20 原生渲染、37 个 AI 投资智能体、QuantLib 18 模块量化引擎、100+ 数据源、16 家券商接入
FinceptTerminal
C++20
Qt6
金融终端
量化交易
AI智能体
QuantLib
开源金融
DuckDB 深度拆解:从嵌入式 OLAP 到异步 I/O 与 DuckLake——一个「不该存在」的数据库如何改写分析引擎的游戏规则
编程
DuckDB 深度拆解:从嵌入式 OLAP 到异步 I/O 与 DuckLake——一个「不该存在」的数据库如何改写分析引擎的游戏规则
2026-08-02 21:13:52 +0800 CST
view 50
深度拆解DuckDB架构:从嵌入式列存引擎到异步I/O管线(v2.0 TPC-H提速3.7倍)、Quack C/S协议、DuckLake湖仓格式,附完整代码示例与生产调优指南
DuckDB
OLAP
异步IO
DuckLake
列存
向量化执行
Quack协议
湖仓一体
数据工程
数据库
ds4 (DwarfStar) 深度实战:当 Redis 之父学会「大模型量化」——从非对称 2-bit 量化到磁盘 KV 缓存的生产级完全指南(2026)
编程
ds4 (DwarfStar) 深度实战:当 Redis 之父学会「大模型量化」——从非对称 2-bit 量化到磁盘 KV 缓存的生产级完全指南(2026)
2026-06-15 00:18:14 +0800 CST
view 617
深度剖析 Redis 之父 antirez 的最新项目 ds4 (DwarfStar),专为 DeepSeek V4 Flash 设计的本地推理引擎。涵盖非对称 2-bit 量化、磁盘 KV 缓存、Metal/CUDA 优化、内置 Coding Agent 等核心技术。
ds4
DwarfStar
antirez
Redis
大模型推理
MoE架构
量化
Polars 深度拆解:当 DataFrame 学会「延迟计算」——用 Rust + Apache Arrow + 查询优化器重写数据分析的心智模型
编程
Polars 深度拆解:当 DataFrame 学会「延迟计算」——用 Rust + Apache Arrow + 查询优化器重写数据分析的心智模型
2026-07-15 15:46:12 +0800 CST
view 178
从工程师视角深度拆解 Polars:Rust + Apache Arrow 列式内存、表达式系统、查询优化器(投影/谓词下推、公共子表达式消除)、多线程 SIMD 与 Streaming 流式引擎,配完整代码实战与 7 个性能优化技巧。
Polars
Rust
数据分析
DataFrame
查询优化器
高性能计算
Apache Arrow
流式计算
向量化
Python
RISC-V 深度拆解:当开源指令集学会「造芯」——NVIDIA SiFive 联姻、Linux 7.2 默认支持与 NumPy RVV 优化如何重写芯片战争格局
编程
RISC-V 深度拆解:当开源指令集学会「造芯」——NVIDIA SiFive 联姻、Linux 7.2 默认支持与 NumPy RVV 优化如何重写芯片战争格局
2026-07-15 16:17:47 +0800 CST
view 489
深度拆解 2026 年 RISC-V 生态关键技术突破:NVIDIA SiFive 战略合作、Linux 7.2 默认支持国产芯片、灵睿智芯 P100 v1、RISC-V Vector 扩展优化,配完整代码实战与性能对比。
RISC-V
RV-Vector
RVV
NVIDIA
SiFive
向量计算
SIMD
LLVM向量化
NumPy
国产芯片
Linux内核
AI推理
异构计算
DeepSeek V4 架构全拆解:MLA 压缩、MoE 动态路由与 1.6T 参数的工程哲学——从训练到推理的全栈重构
编程
DeepSeek V4 架构全拆解:MLA 压缩、MoE 动态路由与 1.6T 参数的工程哲学——从训练到推理的全栈重构
2026-08-03 00:13:26 +0800 CST
view 59
深度拆解 DeepSeek V4 四大核心架构创新:MLA 16x KV Cache 压缩、MoE-Routing v2 Token级动态路由、HAAA混合注意力、antirez ds4.c推理引擎,附完整代码示例与生产部署指南
DeepSeek
MoE
MLA
KV Cache
大模型
AI推理
开源
性能优化
混合注意力
量化
Unsloth 深度拆解:当 LLM 微调学会「省显存」——2倍速+70%显存节省背后的 QLoRA 工程革命
编程
Unsloth 深度拆解:当 LLM 微调学会「省显存」——2倍速+70%显存节省背后的 QLoRA 工程革命
2026-07-15 17:47:08 +0800 CST
view 190
深度拆解Unsloth技术栈:QLoRA量化原理、4-bit NF4精度机制、Triton内核重写、8-bit Adam优化器、梯度检查点优化,以及从Notebook到Ollama/vLLM生产部署的完整工程路径,含完整代码实战
Unsloth
LLM微调
QLoRA
LoRA
4-bit量化
深度学习
模型训练
Unsloth实战:当QLoRA让27B模型在RTX 4090上跑起来——从Qwen3.5微调到Ollama部署的完整工程链
编程
Unsloth实战:当QLoRA让27B模型在RTX 4090上跑起来——从Qwen3.5微调到Ollama部署的完整工程链
2026-07-15 17:48:36 +0800 CST
view 168
深度拆解Unsloth技术栈:QLoRA量化原理、4-bit NF4精度机制、Triton内核重写、8-bit Adam优化器、梯度检查点优化,以及从Notebook到Ollama/vLLM生产部署的完整工程路径,含完整代码实战
Unsloth
LLM微调
QLoRA
LoRA
4-bit量化
深度学习
模型训练
大模型推理引擎实战:从 PagedAttention、Continuous Batching 到投机解码与量化部署,把 GPU 利用率榨到极限(vLLM/SGLang 2026 完全指南)
编程
大模型推理引擎实战:从 PagedAttention、Continuous Batching 到投机解码与量化部署,把 GPU 利用率榨到极限(vLLM/SGLang 2026 完全指南)
2026-07-09 09:17:24 +0800 CST
view 411
深入剖析 2026 年大模型推理引擎核心技术:PagedAttention、Continuous Batching、Chunked Prefill、RadixAttention 前缀缓存、投机解码与 AWQ/GPTQ/FP8 量化,结合 vLLM 与 SGLang 部署实战,把 GPU 利用率榨到极限的生产级完全指南。
LLM推理引擎
vLLM
SGLang
推理优化
量化部署
投机解码
GPU利用率
KV Cache
PagedAttention
vLLM 推理引擎源码级拆解:PagedAttention 显存虚拟化、Continuous Batching 调度与量化落地全指南
编程
vLLM 推理引擎源码级拆解:PagedAttention 显存虚拟化、Continuous Batching 调度与量化落地全指南
2026-07-27 03:44:38 +0800 CST
view 131
从显存字节到 CUDA kernel 源码级拆解 vLLM:PagedAttention 分页显存管理、Continuous Batching 连续批处理调度、Prefix Caching 前缀缓存与量化/投机解码实战,附完整代码与生产调参踩坑清单。
vLLM
PagedAttention
大模型推理
KV Cache
显存优化
连续批处理
量化
LLM Serving
当 Redis 之父遇上 DeepSeek V4 Flash:ds4.c 如何用 900 行代码重写本地大模型推理
编程
当 Redis 之父遇上 DeepSeek V4 Flash:ds4.c 如何用 900 行代码重写本地大模型推理
2026-07-15 18:15:32 +0800 CST
view 233
Redis创始人antirez开源ds4.c:用C语言+Metal GPU手写DeepSeek V4 Flash推理引擎,26 tok/s性能,2-bit MoE量化,KV缓存磁盘分层管理
ds4.c
DeepSeek V4 Flash
Metal推理
Redis之父
MoE量化
KV缓存分层
DuckDB 深度拆解:当分析型数据库学会「嵌入式」——列式向量化引擎与 Morsel 驱动并行如何重写 OLAP 心智模型
编程
DuckDB 深度拆解:当分析型数据库学会「嵌入式」——列式向量化引擎与 Morsel 驱动并行如何重写 OLAP 心智模型
2026-07-15 19:43:28 +0800 CST
view 204
从架构原理到实战场景,深度拆解 DuckDB 嵌入式分析型数据库的列式向量化引擎、Morsel 驱动并行架构、MySQL+DuckDB 混合存储引擎,以及 10 个日常使用场景和 7 个性能优化技巧。
DuckDB
OLAP
列式存储
向量化执行
Morsel驱动并行
数据分析
嵌入式数据库
Parquet
DuckDB 深度拆解:嵌入式 OLAP 数据库的列式向量化引擎架构与工程实践
编程
DuckDB 深度拆解:嵌入式 OLAP 数据库的列式向量化引擎架构与工程实践
2026-07-15 19:43:45 +0800 CST
view 164
从架构原理到实战场景,深度拆解 DuckDB 嵌入式分析型数据库的列式向量化引擎、Morsel 驱动并行架构、MySQL+DuckDB 混合存储引擎,以及 10 个日常使用场景和 7 个性能优化技巧。
DuckDB
OLAP
列式存储
向量化执行
Morsel驱动并行
数据分析
嵌入式数据库
Parquet
PostgreSQL × DuckDB 一库多态:当列存引擎与行存内核协同工作——架构设计与生产实践全解
编程
PostgreSQL × DuckDB 一库多态:当列存引擎与行存内核协同工作——架构设计与生产实践全解
2026-07-22 12:17:32 +0800 CST
view 148
深度解析腾讯云 PostgreSQL × DuckDB 一库多态架构:双引擎协同、向量化执行原理、RAG 加速、Agent 分析、HTAP 混合负载实战,配完整代码示例与性能优化指南。
PostgreSQL
DuckDB
HTAP
向量化执行
列式存储
RAG
AI Agent
数据库
Kronos 深度解析:金融市场基础模型的崛起——从120亿K线数据中炼金的AI革命
编程
Kronos 深度解析:金融市场基础模型的崛起——从120亿K线数据中炼金的AI革命
2026-04-17 15:45:39 +0800 CST
view 894
Kronos是首个开源金融K线基础模型,在45个交易所120亿条数据上预训练,零样本价格预测RankIC提升93%。本文深入解析其Tokenizer架构、预训练范式,并提供代码实战指南。
Kronos
金融AI
基础模型
时间序列
K线
量化交易
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
4
5
6
7
下一页