程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
DuckDB 深度实战:把「分析引擎」塞进应用进程里——向量化执行、列式存储与直查 PB 级 Parquet 湖仓的完整指南(2026)
编程
DuckDB 深度实战:把「分析引擎」塞进应用进程里——向量化执行、列式存储与直查 PB 级 Parquet 湖仓的完整指南(2026)
2026-07-08 12:15:42 +0800 CST
view 172
从工程视角彻底讲透 DuckDB:嵌入式进程内 OLAP 的定位、向量化执行与列式存储原理、直查 Parquet/Iceberg 的架构,配 7 个可运行代码实战与性能优化清单。
DuckDB
OLAP
向量化执行
列式存储
Parquet
数据湖仓
ETL
Arrow
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
编程
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
2026-07-15 08:45:14 +0800 CST
view 185
从工程师视角深度拆解 Ollama 与本地大模型推理引擎:GGUF 单文件格式、K-quant/IQ-quant 量化家族、内存带宽墙、llama.cpp 计算图与 KV Cache,配 Modelfile、Python/Go 流式客户端与自量化实战。
Ollama
llama.cpp
GGUF
本地推理
大模型量化
KV Cache
DeepSeek-R1边缘推理实战:从云端独占到本地智能的范式转移
编程
DeepSeek-R1边缘推理实战:从云端独占到本地智能的范式转移
2026-05-19 12:42:27 +0800 CST
view 517
2026年,边缘AI不再只是云端模型的精简版。本文深入剖析DeepSeek-R1 CPU版的技术原理,从模型蒸馏、量化技术的底层原理到生产环境的完整部署方案,提供可直接落地的代码和可量化的性能数据。
DeepSeek
R1
边缘计算
AI推理
模型蒸馏
量化
llama.cpp
Ollama
端侧AI
综合
Manticore Search:高性能的搜索引擎
2024-11-19 03:43:32 +0800 CST
view 2514
ManticoreSearch是一个高性能的开源搜索引擎,基于C++开发,适用于高效的全文搜索。相较于Elasticsearch,Manticore在多个场景下表现出色,尤其在处理大规模数据和日志分析时。它支持SQL查询,轻量级且易于部署,适合实时数据处理和多种编程语言的客户端支持。ManticoreSearch是替代Elasticsearch的理想选择,广泛应用于数据分析和实时处理。
搜索引擎
数据分析
开源软件
性能优化
实时处理
GitNexus 深度实战:零服务器代码知识图谱引擎——从架构原理到生产级代码理解的完整指南
编程
GitNexus 深度实战:零服务器代码知识图谱引擎——从架构原理到生产级代码理解的完整指南
2026-05-19 13:15:04 +0800 CST
view 492
GitNexus深度实战:零服务器代码知识图谱引擎,Shape RAG结构感知检索,纯客户端代码理解工具完整指南
GitNexus
知识图谱
RAG
代码分析
开源项目
Vibe-Trading 深度拆解:当 LLM 学会「炒股」——自然语言量化交易的多智能体架构与工程实践
编程
Vibe-Trading 深度拆解:当 LLM 学会「炒股」——自然语言量化交易的多智能体架构与工程实践
2026-07-15 11:45:26 +0800 CST
view 398
深度拆解港大HKUDS开源的Vibe-Trading项目:ReAct循环驱动的自然语言量化交易Agent、69个金融技能按需加载、30个多智能体Swarm团队、四大市场回测引擎、456个Alpha因子库,以及Shadow Account行为诊断功能,配完整代码示例与工程边界分析。
Vibe-Trading
LLM
量化交易
多智能体
ReAct
金融科技
HKUDS
Alpha Zoo
Shadow Account
TurboQuant 深度实战:Google 的 KV 缓存压缩算法完全指南(2026)
编程
TurboQuant 深度实战:Google 的 KV 缓存压缩算法完全指南(2026)
2026-06-08 20:52:38 +0800 CST
view 398
2026年3月Google Research在ICLR 2026发表TurboQuant算法,将LLM的KV缓存压缩至3-bit,实现6倍内存缩减和8倍推理加速。本文深入剖析TurboQuant的技术原理,并提供生产级部署指南。
TurboQuant
KV缓存压缩
LLM推理优化
量化算法
Google Research
ICLR2026
FinceptTerminal 深度实战:当 C++20 遇上金融终端——从 Qt6 原生渲染到 37 个 AI 智能体与 QuantLib 量化引擎的生产级完全指南(2026)
编程
FinceptTerminal 深度实战:当 C++20 遇上金融终端——从 Qt6 原生渲染到 37 个 AI 智能体与 QuantLib 量化引擎的生产级完全指南(2026)
2026-06-14 22:28:06 +0800 CST
view 445
开源金融终端 Fincept Terminal v4 深度实战:C++20 原生渲染、37 个 AI 投资智能体、QuantLib 18 模块量化引擎、100+ 数据源、16 家券商接入
FinceptTerminal
C++20
Qt6
金融终端
量化交易
AI智能体
QuantLib
开源金融
ds4 (DwarfStar) 深度实战:当 Redis 之父学会「大模型量化」——从非对称 2-bit 量化到磁盘 KV 缓存的生产级完全指南(2026)
编程
ds4 (DwarfStar) 深度实战:当 Redis 之父学会「大模型量化」——从非对称 2-bit 量化到磁盘 KV 缓存的生产级完全指南(2026)
2026-06-15 00:18:14 +0800 CST
view 531
深度剖析 Redis 之父 antirez 的最新项目 ds4 (DwarfStar),专为 DeepSeek V4 Flash 设计的本地推理引擎。涵盖非对称 2-bit 量化、磁盘 KV 缓存、Metal/CUDA 优化、内置 Coding Agent 等核心技术。
ds4
DwarfStar
antirez
Redis
大模型推理
MoE架构
量化
RISC-V 深度拆解:当开源指令集学会「造芯」——NVIDIA SiFive 联姻、Linux 7.2 默认支持与 NumPy RVV 优化如何重写芯片战争格局
编程
RISC-V 深度拆解:当开源指令集学会「造芯」——NVIDIA SiFive 联姻、Linux 7.2 默认支持与 NumPy RVV 优化如何重写芯片战争格局
2026-07-15 16:17:47 +0800 CST
view 448
深度拆解 2026 年 RISC-V 生态关键技术突破:NVIDIA SiFive 战略合作、Linux 7.2 默认支持国产芯片、灵睿智芯 P100 v1、RISC-V Vector 扩展优化,配完整代码实战与性能对比。
RISC-V
RV-Vector
RVV
NVIDIA
SiFive
向量计算
SIMD
LLVM向量化
NumPy
国产芯片
Linux内核
AI推理
异构计算
ElasticSearch集群搭建指南
编程
ElasticSearch集群搭建指南
2024-11-19 02:31:21 +0800 CST
view 1583
本文介绍了搭建ElasticSearch集群的详细步骤,包括环境准备、节点配置、集群设置、节点角色分配及性能优化。确保硬件和软件环境符合要求,配置网络和安装包,修改配置文件以设置集群名称、节点角色等。启动服务后,通过API验证集群状态,并进行性能监控和日志分析,以确保集群的稳定性和可靠性。
搜索引擎
数据分析
分布式系统
Unsloth 深度拆解:当 LLM 微调学会「省显存」——2倍速+70%显存节省背后的 QLoRA 工程革命
编程
Unsloth 深度拆解:当 LLM 微调学会「省显存」——2倍速+70%显存节省背后的 QLoRA 工程革命
2026-07-15 17:47:08 +0800 CST
view 163
深度拆解Unsloth技术栈:QLoRA量化原理、4-bit NF4精度机制、Triton内核重写、8-bit Adam优化器、梯度检查点优化,以及从Notebook到Ollama/vLLM生产部署的完整工程路径,含完整代码实战
Unsloth
LLM微调
QLoRA
LoRA
4-bit量化
深度学习
模型训练
ElasticSearch 结构
编程
ElasticSearch 结构
2024-11-18 10:05:24 +0800 CST
view 1526
ElasticSearch是一种开源搜索和分析引擎,具有高度可扩展性。其核心组件包括节点(如数据节点、主节点等)、集群、索引、文档、分片和副片。节点通过HTTP协议通信,集群管理数据存储和搜索。索引用于存储数据,文档是基本数据单元。ElasticSearch支持多种搜索方式和分析功能,能够高效处理大量数据,实现高可用性和强大搜索能力。
搜索引擎
数据管理
大数据分析
Unsloth实战:当QLoRA让27B模型在RTX 4090上跑起来——从Qwen3.5微调到Ollama部署的完整工程链
编程
Unsloth实战:当QLoRA让27B模型在RTX 4090上跑起来——从Qwen3.5微调到Ollama部署的完整工程链
2026-07-15 17:48:36 +0800 CST
view 141
深度拆解Unsloth技术栈:QLoRA量化原理、4-bit NF4精度机制、Triton内核重写、8-bit Adam优化器、梯度检查点优化,以及从Notebook到Ollama/vLLM生产部署的完整工程路径,含完整代码实战
Unsloth
LLM微调
QLoRA
LoRA
4-bit量化
深度学习
模型训练
零成本跑 AI 股票分析:GitHub 15k+ Stars 的 daily_stock_analysis 每天自动给你一份操盘报告
编程
零成本跑 AI 股票分析:GitHub 15k+ Stars 的 daily_stock_analysis 每天自动给你一份操盘报告
2026-04-17 10:00:51 +0800 CST
view 1191
介绍 GitHub Stars 超过 15k 的开源项目 daily_stock_analysis,一个基于 AI 大模型的 A/H/美股自选股分析系统,支持每日自动分析并推送决策仪表盘到手机,零成本定时运行。
开源
daily_stock_analysis
股票分析
AI
GitHub
A股
港股
美股
大模型推理引擎实战:从 PagedAttention、Continuous Batching 到投机解码与量化部署,把 GPU 利用率榨到极限(vLLM/SGLang 2026 完全指南)
编程
大模型推理引擎实战:从 PagedAttention、Continuous Batching 到投机解码与量化部署,把 GPU 利用率榨到极限(vLLM/SGLang 2026 完全指南)
2026-07-09 09:17:24 +0800 CST
view 364
深入剖析 2026 年大模型推理引擎核心技术:PagedAttention、Continuous Batching、Chunked Prefill、RadixAttention 前缀缓存、投机解码与 AWQ/GPTQ/FP8 量化,结合 vLLM 与 SGLang 部署实战,把 GPU 利用率榨到极限的生产级完全指南。
LLM推理引擎
vLLM
SGLang
推理优化
量化部署
投机解码
GPU利用率
KV Cache
PagedAttention
vLLM 推理引擎源码级拆解:PagedAttention 显存虚拟化、Continuous Batching 调度与量化落地全指南
编程
vLLM 推理引擎源码级拆解:PagedAttention 显存虚拟化、Continuous Batching 调度与量化落地全指南
2026-07-27 03:44:38 +0800 CST
view 56
从显存字节到 CUDA kernel 源码级拆解 vLLM:PagedAttention 分页显存管理、Continuous Batching 连续批处理调度、Prefix Caching 前缀缓存与量化/投机解码实战,附完整代码与生产调参踩坑清单。
vLLM
PagedAttention
大模型推理
KV Cache
显存优化
连续批处理
量化
LLM Serving
Elasticsearch 聚合和分析
编程
Elasticsearch 聚合和分析
2024-11-19 06:44:08 +0800 CST
view 1605
Elasticsearch是一个强大的搜索和分析引擎,其聚合功能允许用户深入分析数据。聚合分为桶聚合、度量聚合和管道聚合,支持复杂的数据统计和分组操作。通过示例,展示了如何在电商平台和社交媒体上应用聚合功能来分析销售数据和用户行为,从而提取有价值的信息,帮助做出更好的业务决策。
搜索引擎
数据分析
大数据
ClickHouse 26.x 深度解析:2026 年分析型数据库的全面进化,从性能冠军到 AI 时代的数据基础设施
编程
ClickHouse 26.x 深度解析:2026 年分析型数据库的全面进化,从性能冠军到 AI 时代的数据基础设施
2026-05-15 06:42:15 +0800 CST
view 705
ClickHouse 26.x带来颠覆性查询优化器(性能提升40-60%)、Agentic Coding让AI直接写SQL、向量化搜索增强、反向索引、26.3 LTS企业级稳定性保障。深度解析架构演进与生产实战。
ClickHouse
OLAP
向量搜索
查询优化器
数据分析
当 Redis 之父遇上 DeepSeek V4 Flash:ds4.c 如何用 900 行代码重写本地大模型推理
编程
当 Redis 之父遇上 DeepSeek V4 Flash:ds4.c 如何用 900 行代码重写本地大模型推理
2026-07-15 18:15:32 +0800 CST
view 184
Redis创始人antirez开源ds4.c:用C语言+Metal GPU手写DeepSeek V4 Flash推理引擎,26 tok/s性能,2-bit MoE量化,KV缓存磁盘分层管理
ds4.c
DeepSeek V4 Flash
Metal推理
Redis之父
MoE量化
KV缓存分层
Pyrefly 深度实战:Meta 用 Rust 重写 Python 类型检查器,从急切推断到每秒 180 万行的架构拆解
编程
Pyrefly 深度实战:Meta 用 Rust 重写 Python 类型检查器,从急切推断到每秒 180 万行的架构拆解
2026-07-27 04:44:43 +0800 CST
view 65
深度拆解 Meta 开源的 Rust 版 Python 类型检查器 Pyrefly:三步求解流水线、模块级并行、急切推断 vs ty 的渐进保证,附安装配置、mypy 迁移、CI 集成与性能调优清单。
Pyrefly
Python
Rust
类型检查
mypy
Pyright
静态分析
工具链
PostgreSQL × DuckDB 一库多态:当列存引擎与行存内核协同工作——架构设计与生产实践全解
编程
PostgreSQL × DuckDB 一库多态:当列存引擎与行存内核协同工作——架构设计与生产实践全解
2026-07-22 12:17:32 +0800 CST
view 107
深度解析腾讯云 PostgreSQL × DuckDB 一库多态架构:双引擎协同、向量化执行原理、RAG 加速、Agent 分析、HTAP 混合负载实战,配完整代码示例与性能优化指南。
PostgreSQL
DuckDB
HTAP
向量化执行
列式存储
RAG
AI Agent
数据库
综合
一款功能强大的开源舆情管理系统
2024-11-18 20:51:24 +0800 CST
view 2853
思通舆情是一款功能强大的开源舆情管理系统,支持本地化部署,提供数据采集、智能预警和深度分析功能。系统通过多种数据源实时监测舆情,自动预警,生成分析报告,帮助用户及时应对危机。采用多种开源技术,确保高并发性和稳定性,适用于企业公关、政府机关和市场营销等多个场景。
舆情管理
开源软件
数据分析
人工智能
危机管理
Cursor 3 深度解析:当 IDE 退居二线,智能体控制台成为主角
编程
Cursor 3 深度解析:当 IDE 退居二线,智能体控制台成为主角
2026-04-08 14:02:14 +0800 CST
view 935
Cursor3.0版本(代号'Glass')彻底重构产品形态,将传统IDE退居次要位置,以智能体管理控制台为核心。它支持多智能体并行工作、本地-云端无缝切换、集成化PR工作流和多仓库支持,采用AI-First架构和智能体编排引擎,标志着AI辅助开发从'增强人类编码'向'人类指挥智能体'的根本转变,推动开发者角色从编码者向架构师或AI编排师演进。
AI编程工具
软件开发范式
智能体技术
开发者工作流
技术趋势分析
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
7
8
9
10
11
下一页