程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
ElasticSearch 结构
编程
ElasticSearch 结构
2024-11-18 10:05:24 +0800 CST
view 1521
ElasticSearch是一种开源搜索和分析引擎,具有高度可扩展性。其核心组件包括节点(如数据节点、主节点等)、集群、索引、文档、分片和副片。节点通过HTTP协议通信,集群管理数据存储和搜索。索引用于存储数据,文档是基本数据单元。ElasticSearch支持多种搜索方式和分析功能,能够高效处理大量数据,实现高可用性和强大搜索能力。
搜索引擎
数据管理
大数据分析
Elasticsearch 聚合和分析
编程
Elasticsearch 聚合和分析
2024-11-19 06:44:08 +0800 CST
view 1598
Elasticsearch是一个强大的搜索和分析引擎,其聚合功能允许用户深入分析数据。聚合分为桶聚合、度量聚合和管道聚合,支持复杂的数据统计和分组操作。通过示例,展示了如何在电商平台和社交媒体上应用聚合功能来分析销售数据和用户行为,从而提取有价值的信息,帮助做出更好的业务决策。
搜索引擎
数据分析
大数据
ClickHouse v26.2 深度拆解:当 OLAP 数据库进入全栈内嵌时代——从 ClickStack 可观测 UI 到向量搜索分布式化(2026)
编程
ClickHouse v26.2 深度拆解:当 OLAP 数据库进入全栈内嵌时代——从 ClickStack 可观测 UI 到向量搜索分布式化(2026)
2026-07-17 15:15:41 +0800 CST
view 158
深度拆解 ClickHouse v26.2:ClickStack 可观测 UI、TOTP 原生认证、BigLake 集成、向量搜索分布式化、QBit 数据类型 GA、Insert 去重行为变更,配完整代码实战与生产升级指南。
ClickHouse
OLAP
向量数据库
数据库
大数据
实时分析
ClickStack
HNSW
Iceberg
ClickHouse 2026 深度实战:当列式存储遇见 AI 时代——从 MergeTree 引擎到 PB 级实时分析,构建下一代数据基础设施的完全指南
编程
ClickHouse 2026 深度实战:当列式存储遇见 AI 时代——从 MergeTree 引擎到 PB 级实时分析,构建下一代数据基础设施的完全指南
2026-06-21 21:58:21 +0800 CST
view 324
2026 年 ClickHouse 生产级完全指南:从列式存储、MergeTree 引擎、向量化执行到分布式架构、物化视图、Kafka 集成、性能优化与 AI 场景实战。
ClickHouse
OLAP
列式存储
MergeTree
实时分析
数据库
大数据
性能优化
物化视图
云原生
10亿级数据高效写入MySQL:架构设计与实战优化
编程
10亿级数据高效写入MySQL:架构设计与实战优化
2025-03-29 15:24:44 +0800 CST
view 1531
本文探讨了在大数据时代如何高效地将10亿级数据写入MySQL的技术方案,包括架构设计、并行处理、批量写入、LOADDATAINFILE等优化技术。通过分库分表、数据分片、监控系统等策略,确保数据的高效存储与处理。同时,提供了实战案例分析和最佳实践建议,以帮助实现高效稳定的数据存储架构。
大数据
数据库
技术方案
数据存储
性能优化
DuckLake v1.0 深度解析:用关系型数据库如何颠覆湖仓一体的"小文件地狱"
编程
DuckLake v1.0 深度解析:用关系型数据库如何颠覆湖仓一体的"小文件地狱"
2026-04-19 03:14:23 +0800 CST
view 845
DuckDB团队发布DuckLake v1.0,用关系型数据库管理元数据,查询速度比Iceberg快926倍。深度解析数据内联、排序表、桶分区、VARIANT类型等核心特性。
DuckLake
DuckDB
湖仓一体
数据湖
大数据
Venice 深度拆解:LinkedIn 如何用衍生数据平台承载每日 1.2PB 数据写入与万亿级特征服务
编程
Venice 深度拆解:LinkedIn 如何用衍生数据平台承载每日 1.2PB 数据写入与万亿级特征服务
2026-07-29 12:16:37 +0800 CST
view 16
深度拆解 LinkedIn 开源的 Venice 衍生数据平台:1.2PB/日写入吞吐、CRDT多活、混合负载架构、Read Compute 向量计算,以及作为 Feature Store 在线存储层的独特价值。
Venice
LinkedIn
Feature Store
衍生数据平台
分布式系统
CRDT
多区域多活
Write Compute
Read Compute
大数据
shore-kafka是一个为Python开发者设计适用于大数据流处理
综合
shore-kafka是一个为Python开发者设计适用于大数据流处理
2024-11-19 02:00:32 +0800 CST
view 1812
shore-kafka是一个为Python开发者设计的库,简化了与ApacheKafka的交互,适用于大数据流处理。本文介绍了shore-kafka的安装、基本用法(创建生产者和消费者)、高级用法(自定义序列化器和消费者拦截器)以及实际使用案例(实时日志处理)。该库提供丰富功能,帮助开发者快速实现数据的实时传输与处理。
Python库
大数据
流处理
实时数据
Kafka
Apache Iceberg 深度实战:当数据湖长出 ACID 与模式演进——从 Manifest 三层元数据到隐藏分区、时间旅行与生产级 Lakehouse 完全指南(2026)
编程
Apache Iceberg 深度实战:当数据湖长出 ACID 与模式演进——从 Manifest 三层元数据到隐藏分区、时间旅行与生产级 Lakehouse 完全指南(2026)
2026-07-09 04:48:40 +0800 CST
view 154
从一次数据湖事故出发,深入拆解 Apache Iceberg 的四层元数据、隐藏分区、Schema/Partition 演进、时间旅行与行级更新,并给出可直接落地的 Spark/Trino/PyIceberg 代码与性能优化清单。
数据湖
Iceberg
Lakehouse
表格式
大数据
Apache Arrow Flight SQL 深度实战:从零拷贝列式内存到跨语言高速数据传输——架构、协议与生产落地的工程全解(2026)
编程
Apache Arrow Flight SQL 深度实战:从零拷贝列式内存到跨语言高速数据传输——架构、协议与生产落地的工程全解(2026)
2026-07-22 07:19:06 +0800 CST
view 118
深度解析 Apache Arrow Flight SQL:从零拷贝列式内存到跨语言高速数据传输。涵盖 Arrow 内存布局、Flight RPC 协议、Flight SQL 查询接口、Rust/Go/Python 实战代码、生产级部署架构与性能优化,实现 5-10x 性能提升。
Apache Arrow
Flight SQL
零拷贝
列式存储
gRPC
数据传输
大数据
DataFusion
性能优化
Polars vs Pandas 深度实战:列式存储、懒执行与多线程如何重构大数据处理范式
编程
Polars vs Pandas 深度实战:列式存储、懒执行与多线程如何重构大数据处理范式
2026-06-28 07:12:26 +0800 CST
view 250
深入剖析 Polars 如何用 Apache Arrow 列式存储、声明式懒执行、Rust 多线程重写大数据处理范式,包含架构原理、性能基准、迁移指南与生产级代码实战。
Polars
Pandas
数据处理
Apache Arrow
Rust
Python
大数据
DataFrame
xlwings是一个用于与Excel进行交互的Python库
综合
xlwings是一个用于与Excel进行交互的Python库
2024-11-19 07:16:23 +0800 CST
view 2337
xlwings是一个用于与Excel进行交互的Python库,提供简单易用的API,支持Excel的所有功能,包括公式、图表和透视表。本文介绍了xlwings的安装方法、主要特性、基本和高级功能,以及在财务数据处理、数据可视化和报表生成等实际应用场景中的使用,帮助开发者高效地操作Excel文件。
Python库
数据分析
Excel自动化
数据可视化
财务分析
DuckDB 深度解剖:把 OLAP 数据库塞进一个进程,它凭什么比你的数仓还快
编程
DuckDB 深度解剖:把 OLAP 数据库塞进一个进程,它凭什么比你的数仓还快
2026-07-23 19:44:10 +0800 CST
view 94
DuckDB 是 OLAP 版的 SQLite:进程内嵌入、零依赖、单文件、列式存储加向量化执行引擎。本文从工程师视角深度拆解向量化执行、Push-Based流水线与Morsel并行、列存压缩、Larger-than-Memory外存溢写、直接查Parquet/S3、跨源联邦查询与DuckDB-Wasm,配Python/SQL代码实战与性能优化清单。
DuckDB
OLAP
列式存储
向量化执行
Morsel并行
数据分析
Parquet
嵌入式数据库
数据库
WebAssembly
cocanb是一个强大的Python库,专注于数据读取、处理和可视化
综合
cocanb是一个强大的Python库,专注于数据读取、处理和可视化
2024-11-19 00:35:28 +0800 CST
view 1919
cocanb是一个强大的Python库,专注于数据读取、处理和可视化。本文介绍了cocanb的安装、基本用法和高级功能,包括数据透视表和缺失值处理,并提供了实际使用案例,如股票数据分析。通过cocanb,开发者可以高效地进行数据操作和分析,提升工作效率。
Python库
数据处理
数据可视化
数据分析
编程
DuckDB 深度实战:嵌入式 OLAP 如何重塑数据工程——从向量化执行引擎到 Parquet 湖仓查询的完整指南(2026)
编程
DuckDB 深度实战:嵌入式 OLAP 如何重塑数据工程——从向量化执行引擎到 Parquet 湖仓查询的完整指南(2026)
2026-07-13 01:42:52 +0800 CST
view 144
深入解析 DuckDB 嵌入式 OLAP 引擎:从向量化执行、列式存储、查询优化器到 Parquet 湖仓直读与 S3 查询,配可运行代码与性能实测,附与 SQLite/Pandas/ClickHouse/Spark 横评及适用场景决策树。
DuckDB
OLAP
数据分析
数据工程
嵌入式数据库
Parquet
DuckDB 深度实战:2026年嵌入式OLAP的终极武器——从零到生产部署的完整指南
编程
DuckDB 深度实战:2026年嵌入式OLAP的终极武器——从零到生产部署的完整指南
2026-06-27 03:44:00 +0800 CST
view 230
2026年DuckDB深度实战指南:从架构原理、性能优化到生产部署,包含25+完整代码示例,带你掌握这个比Pandas快100倍的嵌入式OLAP数据库。
DuckDB
OLAP
数据分析
嵌入式数据库
列式存储
数据工程
Python
SQL
ClickHouse 深度拆解:当关系型数据库学会「按列思考」——从 MergeTree 引擎、向量化执行到稀疏索引与生产级 OLAP 完全指南(2026)
编程
ClickHouse 深度拆解:当关系型数据库学会「按列思考」——从 MergeTree 引擎、向量化执行到稀疏索引与生产级 OLAP 完全指南(2026)
2026-07-17 02:44:42 +0800 CST
view 182
深度拆解 ClickHouse v25.8 LTS:从列存与向量化执行原理、MergeTree 引擎家族、稀疏主键索引、物理存储布局,到物化视图、跳数索引、Kafka 接入与 Python 实战、生产级性能优化完全指南。
ClickHouse
OLAP
列式存储
MergeTree
向量化执行
物化视图
数据分析
数据库
sql语句分别按日,按周,按月,按季统计金额
编程
sql语句分别按日,按周,按月,按季统计金额
2024-11-17 05:05:22 +0800 CST
view 3353
本文讨论如何使用SQL语句按日、周、月和季节统计消费记录的总量。提供了四条SQL示例语句,分别实现不同时间段的消费总和计算,并说明了如何根据指定日期进行查询。示例中使用了聚合函数和groupby语句,适用于消费记录表的分析。
数据库
SQL
数据分析
DuckDB 1.5 深度实战:当分析型数据库压缩进一个文件,我们为什么还需要 Spark?
编程
DuckDB 1.5 深度实战:当分析型数据库压缩进一个文件,我们为什么还需要 Spark?
2026-07-11 03:41:54 +0800 CST
view 258
DuckDB 1.5 深度实战:拆解嵌入式分析型数据库如何用向量化执行、列式存储和进程内架构,把 Spark 的单体分析任务压缩进一个文件。含 Python 联邦查询、DuckLake/Iceberg、Parquet 下推与性能优化实战。
DuckDB
OLAP
嵌入式数据库
数据分析
向量化执行
列式存储
Parquet
DuckDB 深度实战:当嵌入式 OLAP 遇见「零配置」分析革命——从列式存储原理到 MotherDuck 云原生架构的生产级完全指南(2026)
编程
DuckDB 深度实战:当嵌入式 OLAP 遇见「零配置」分析革命——从列式存储原理到 MotherDuck 云原生架构的生产级完全指南(2026)
2026-06-17 03:53:14 +0800 CST
view 436
DuckDB 是嵌入式 OLAP 数据库,被誉为分析界的 SQLite。本文从列式存储原理、向量化执行引擎、多格式数据集成、Python/Go/Rust 多语言实战、性能优化、MotherDuck 云原生架构到 AI/ML 工作流中的新角色,全方位深度拆解 DuckDB 的生产级使用。
DuckDB
OLAP
列式存储
数据分析
嵌入式数据库
DuckDB 1.5.0 深度实战:当嵌入式数据库终于能当湖仓用——从 VARIANT 原生类型、非阻塞检查点到 DuckLake 1.0 的生产级完全指南
编程
DuckDB 1.5.0 深度实战:当嵌入式数据库终于能当湖仓用——从 VARIANT 原生类型、非阻塞检查点到 DuckLake 1.0 的生产级完全指南
2026-07-12 04:11:24 +0800 CST
view 179
深度拆解 DuckDB 1.5.0:VARIANT 原生类型、GEOMETRY 进核心、非阻塞检查点、read_duckdb 通配读取与 DuckLake 湖仓,配可运行 SQL 与生产级性能优化实战。
DuckDB
VARIANT
DuckLake
OLAP
嵌入式数据库
数据分析
DuckDB 1.5 深度拆解:当嵌入式 OLAP 数据库学会「联网」——从 VARIANT 类型、Quack 远程协议到 v2.0 前瞻的工程全貌(2026)
编程
DuckDB 1.5 深度拆解:当嵌入式 OLAP 数据库学会「联网」——从 VARIANT 类型、Quack 远程协议到 v2.0 前瞻的工程全貌(2026)
2026-07-19 06:42:56 +0800 CST
view 231
深度拆解 DuckDB 2026 技术全景:VARIANT 二进制半结构化类型、Quack 客户端-服务器协议、Async I/O Parquet 预读、PEG 解析器、Iceberg MERGE INTO、pg_duckdb 融合、DuckLake + Quack 湖仓架构,配完整代码实战与生产级 ETL 管道部署指南。
DuckDB
OLAP
数据库
Quack
VARIANT
Parquet
数据分析
ascacou是一个Python库,专注于数据分析和处理
综合
ascacou是一个Python库,专注于数据分析和处理
2024-11-18 06:19:36 +0800 CST
view 1602
ascacou是一个假设存在的Python库,专注于数据分析和处理。本文介绍了如何安装ascacou库,并展示了其基本用法,包括数据读取、数据清洗、数据聚合和异常值处理等功能。通过示例,读者可以了解如何使用ascacou进行高效的数据操作,帮助开发者快速分析和处理数据。
Python库
数据处理
数据分析
编程
万字深度解析 DuckDB 2026:当嵌入式 OLAP 遇见 PostgreSQL——从向量化引擎到 pg_duckdb 扩展的生产级实战
编程
万字深度解析 DuckDB 2026:当嵌入式 OLAP 遇见 PostgreSQL——从向量化引擎到 pg_duckdb 扩展的生产级实战
2026-07-01 02:12:35 +0800 CST
view 315
2026年,嵌入式分析数据库 DuckDB 正在悄然重塑数据分析生态。本文万字深度解析 DuckDB 的向量化执行引擎、列式存储架构、与 PostgreSQL 的无缝集成、以及生产级实战应用。
DuckDB
PostgreSQL
OLAP
数据分析
向量化执行
pg_duckdb
Parquet
性能优化
DuckLake
嵌入式数据库
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
2
3
...
29
下一页