程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
ClickHouse v26.2 深度拆解:当 OLAP 数据库进入全栈内嵌时代——从 ClickStack 可观测 UI 到向量搜索分布式化(2026)
编程
ClickHouse v26.2 深度拆解:当 OLAP 数据库进入全栈内嵌时代——从 ClickStack 可观测 UI 到向量搜索分布式化(2026)
2026-07-17 15:15:41 +0800 CST
view 162
深度拆解 ClickHouse v26.2:ClickStack 可观测 UI、TOTP 原生认证、BigLake 集成、向量搜索分布式化、QBit 数据类型 GA、Insert 去重行为变更,配完整代码实战与生产升级指南。
ClickHouse
OLAP
向量数据库
数据库
大数据
实时分析
ClickStack
HNSW
Iceberg
10亿级数据高效写入MySQL:架构设计与实战优化
编程
10亿级数据高效写入MySQL:架构设计与实战优化
2025-03-29 15:24:44 +0800 CST
view 1535
本文探讨了在大数据时代如何高效地将10亿级数据写入MySQL的技术方案,包括架构设计、并行处理、批量写入、LOADDATAINFILE等优化技术。通过分库分表、数据分片、监控系统等策略,确保数据的高效存储与处理。同时,提供了实战案例分析和最佳实践建议,以帮助实现高效稳定的数据存储架构。
大数据
数据库
技术方案
数据存储
性能优化
DuckLake v1.0 深度解析:用关系型数据库如何颠覆湖仓一体的"小文件地狱"
编程
DuckLake v1.0 深度解析:用关系型数据库如何颠覆湖仓一体的"小文件地狱"
2026-04-19 03:14:23 +0800 CST
view 853
DuckDB团队发布DuckLake v1.0,用关系型数据库管理元数据,查询速度比Iceberg快926倍。深度解析数据内联、排序表、桶分区、VARIANT类型等核心特性。
DuckLake
DuckDB
湖仓一体
数据湖
大数据
ClickHouse 2026 深度实战:当列式存储遇见 AI 时代——从 MergeTree 引擎到 PB 级实时分析,构建下一代数据基础设施的完全指南
编程
ClickHouse 2026 深度实战:当列式存储遇见 AI 时代——从 MergeTree 引擎到 PB 级实时分析,构建下一代数据基础设施的完全指南
2026-06-21 21:58:21 +0800 CST
view 330
2026 年 ClickHouse 生产级完全指南:从列式存储、MergeTree 引擎、向量化执行到分布式架构、物化视图、Kafka 集成、性能优化与 AI 场景实战。
ClickHouse
OLAP
列式存储
MergeTree
实时分析
数据库
大数据
性能优化
物化视图
云原生
Venice 深度拆解:LinkedIn 如何用衍生数据平台承载每日 1.2PB 数据写入与万亿级特征服务
编程
Venice 深度拆解:LinkedIn 如何用衍生数据平台承载每日 1.2PB 数据写入与万亿级特征服务
2026-07-29 12:16:37 +0800 CST
view 39
深度拆解 LinkedIn 开源的 Venice 衍生数据平台:1.2PB/日写入吞吐、CRDT多活、混合负载架构、Read Compute 向量计算,以及作为 Feature Store 在线存储层的独特价值。
Venice
LinkedIn
Feature Store
衍生数据平台
分布式系统
CRDT
多区域多活
Write Compute
Read Compute
大数据
Apache Iceberg V3 深度拆解:Deletion Vectors、Row Lineage 与 Variant 类型,开放表格式如何终结数据湖的「文件散养」时代
编程
Apache Iceberg V3 深度拆解:Deletion Vectors、Row Lineage 与 Variant 类型,开放表格式如何终结数据湖的「文件散养」时代
2026-07-30 01:46:13 +0800 CST
view 18
深度拆解 Apache Iceberg V3 规范三大核心改动:Binary Deletion Vectors 终结删除文件堆积、Row Lineage 行级血缘赋能增量计算与审计、Variant 半结构化类型落地,附 V2 升级实战与冷静的边界分析。
Iceberg
数据湖
Deletion Vectors
Row Lineage
Variant
表格式
Spark
Trino
大数据
开源
shore-kafka是一个为Python开发者设计适用于大数据流处理
综合
shore-kafka是一个为Python开发者设计适用于大数据流处理
2024-11-19 02:00:32 +0800 CST
view 1812
shore-kafka是一个为Python开发者设计的库,简化了与ApacheKafka的交互,适用于大数据流处理。本文介绍了shore-kafka的安装、基本用法(创建生产者和消费者)、高级用法(自定义序列化器和消费者拦截器)以及实际使用案例(实时日志处理)。该库提供丰富功能,帮助开发者快速实现数据的实时传输与处理。
Python库
大数据
流处理
实时数据
Kafka
Apache Iceberg 深度实战:当数据湖长出 ACID 与模式演进——从 Manifest 三层元数据到隐藏分区、时间旅行与生产级 Lakehouse 完全指南(2026)
编程
Apache Iceberg 深度实战:当数据湖长出 ACID 与模式演进——从 Manifest 三层元数据到隐藏分区、时间旅行与生产级 Lakehouse 完全指南(2026)
2026-07-09 04:48:40 +0800 CST
view 163
从一次数据湖事故出发,深入拆解 Apache Iceberg 的四层元数据、隐藏分区、Schema/Partition 演进、时间旅行与行级更新,并给出可直接落地的 Spark/Trino/PyIceberg 代码与性能优化清单。
数据湖
Iceberg
Lakehouse
表格式
大数据
Apache Arrow Flight SQL 深度实战:从零拷贝列式内存到跨语言高速数据传输——架构、协议与生产落地的工程全解(2026)
编程
Apache Arrow Flight SQL 深度实战:从零拷贝列式内存到跨语言高速数据传输——架构、协议与生产落地的工程全解(2026)
2026-07-22 07:19:06 +0800 CST
view 125
深度解析 Apache Arrow Flight SQL:从零拷贝列式内存到跨语言高速数据传输。涵盖 Arrow 内存布局、Flight RPC 协议、Flight SQL 查询接口、Rust/Go/Python 实战代码、生产级部署架构与性能优化,实现 5-10x 性能提升。
Apache Arrow
Flight SQL
零拷贝
列式存储
gRPC
数据传输
大数据
DataFusion
性能优化
ElasticSearch 结构
编程
ElasticSearch 结构
2024-11-18 10:05:24 +0800 CST
view 1526
ElasticSearch是一种开源搜索和分析引擎,具有高度可扩展性。其核心组件包括节点(如数据节点、主节点等)、集群、索引、文档、分片和副片。节点通过HTTP协议通信,集群管理数据存储和搜索。索引用于存储数据,文档是基本数据单元。ElasticSearch支持多种搜索方式和分析功能,能够高效处理大量数据,实现高可用性和强大搜索能力。
搜索引擎
数据管理
大数据分析
Elasticsearch 聚合和分析
编程
Elasticsearch 聚合和分析
2024-11-19 06:44:08 +0800 CST
view 1602
Elasticsearch是一个强大的搜索和分析引擎,其聚合功能允许用户深入分析数据。聚合分为桶聚合、度量聚合和管道聚合,支持复杂的数据统计和分组操作。通过示例,展示了如何在电商平台和社交媒体上应用聚合功能来分析销售数据和用户行为,从而提取有价值的信息,帮助做出更好的业务决策。
搜索引擎
数据分析
大数据
Polars vs Pandas 深度实战:列式存储、懒执行与多线程如何重构大数据处理范式
编程
Polars vs Pandas 深度实战:列式存储、懒执行与多线程如何重构大数据处理范式
2026-06-28 07:12:26 +0800 CST
view 267
深入剖析 Polars 如何用 Apache Arrow 列式存储、声明式懒执行、Rust 多线程重写大数据处理范式,包含架构原理、性能基准、迁移指南与生产级代码实战。
Polars
Pandas
数据处理
Apache Arrow
Rust
Python
大数据
DataFrame
达梦图数据库 V4.0 深度实战:图原生+向量深度融合,千亿级数据让AI真正"懂业务"
编程
达梦图数据库 V4.0 深度实战:图原生+向量深度融合,千亿级数据让AI真正"懂业务"
2026-05-16 13:15:18 +0800 CST
view 495
2026年4月,达梦数据发布图数据库V4.0,实现图原生与向量数据库的深度融合理念。本文深度解析其架构设计、三大AI增强能力和千亿级性能优化实践。
数据库
图数据库
向量数据库
AI
达梦
达梦GDMBASE V4.0揭秘:千亿级图数据库与向量数据库的"原生融合"架构革命
编程
达梦GDMBASE V4.0揭秘:千亿级图数据库与向量数据库的"原生融合"架构革命
2026-05-16 13:15:41 +0800 CST
view 546
2026年4月,达梦数据发布图数据库V4.0,实现图原生与向量数据库的深度融合理念。本文深度解析其架构设计、三大AI增强能力和千亿级性能优化实践。
数据库
图数据库
向量数据库
AI
达梦
DuckDB 深度解剖:把 OLAP 数据库塞进一个进程,它凭什么比你的数仓还快
编程
DuckDB 深度解剖:把 OLAP 数据库塞进一个进程,它凭什么比你的数仓还快
2026-07-23 19:44:10 +0800 CST
view 108
DuckDB 是 OLAP 版的 SQLite:进程内嵌入、零依赖、单文件、列式存储加向量化执行引擎。本文从工程师视角深度拆解向量化执行、Push-Based流水线与Morsel并行、列存压缩、Larger-than-Memory外存溢写、直接查Parquet/S3、跨源联邦查询与DuckDB-Wasm,配Python/SQL代码实战与性能优化清单。
DuckDB
OLAP
列式存储
向量化执行
Morsel并行
数据分析
Parquet
嵌入式数据库
数据库
WebAssembly
cocanb是一个强大的Python库,专注于数据读取、处理和可视化
综合
cocanb是一个强大的Python库,专注于数据读取、处理和可视化
2024-11-19 00:35:28 +0800 CST
view 1920
cocanb是一个强大的Python库,专注于数据读取、处理和可视化。本文介绍了cocanb的安装、基本用法和高级功能,包括数据透视表和缺失值处理,并提供了实际使用案例,如股票数据分析。通过cocanb,开发者可以高效地进行数据操作和分析,提升工作效率。
Python库
数据处理
数据可视化
数据分析
编程
DuckDB 深度实战:嵌入式 OLAP 如何重塑数据工程——从向量化执行引擎到 Parquet 湖仓查询的完整指南(2026)
编程
DuckDB 深度实战:嵌入式 OLAP 如何重塑数据工程——从向量化执行引擎到 Parquet 湖仓查询的完整指南(2026)
2026-07-13 01:42:52 +0800 CST
view 144
深入解析 DuckDB 嵌入式 OLAP 引擎:从向量化执行、列式存储、查询优化器到 Parquet 湖仓直读与 S3 查询,配可运行代码与性能实测,附与 SQLite/Pandas/ClickHouse/Spark 横评及适用场景决策树。
DuckDB
OLAP
数据分析
数据工程
嵌入式数据库
Parquet
OceanBase 湖库一体 AI数据库深度实战:当「湖」的灵活遇上「库」的一致,一次把国产 AI 数据库架构讲透(2026)
编程
OceanBase 湖库一体 AI数据库深度实战:当「湖」的灵活遇上「库」的一致,一次把国产 AI 数据库架构讲透(2026)
2026-07-13 17:45:29 +0800 CST
view 171
深度拆解OceanBase 2026湖库一体AI数据库架构:从行存列存统一存储、内置VECTOR类型向量检索、生产级AI Agent数据底座实战,到性能对比与避坑指南,配完整SQL与Python代码。
OceanBase
湖库一体
AI数据库
向量检索
HNSW
国产数据库
分布式数据库
RAG
OLAP
OLTP
Redis 8.0 深度解析:30项性能飞跃、8种新数据结构与重回开源的破局之路
编程
Redis 8.0 深度解析:30项性能飞跃、8种新数据结构与重回开源的破局之路
2026-05-12 18:40:32 +0800 CST
view 446
深度解析Redis 8.0最新版本核心变化:命令延迟降低87%、吞吐量提升112%、新增8种数据结构(向量集/JSON/时序/概率结构)、重回BSD开源、I/O线程重构、Query Engine提升16倍。含架构解析与代码实战。
Redis8,Redis新版本,向量数据库,JSON数据结构,内存数据库,性能优化,开源
DuckDB 深度实战:2026年嵌入式OLAP的终极武器——从零到生产部署的完整指南
编程
DuckDB 深度实战:2026年嵌入式OLAP的终极武器——从零到生产部署的完整指南
2026-06-27 03:44:00 +0800 CST
view 234
2026年DuckDB深度实战指南:从架构原理、性能优化到生产部署,包含25+完整代码示例,带你掌握这个比Pandas快100倍的嵌入式OLAP数据库。
DuckDB
OLAP
数据分析
嵌入式数据库
列式存储
数据工程
Python
SQL
在MySQL中全局回滚一张表数据的多种方法,包括使用事务、备份与恢复、触发器和二进制日志
编程
在MySQL中全局回滚一张表数据的多种方法,包括使用事务、备份与恢复、触发器和二进制日志
2024-11-18 13:59:43 +0800 CST
view 1730
本文探讨了在MySQL中全局回滚一张表数据的多种方法,包括使用事务、备份与恢复、触发器和二进制日志。通过具体的代码示例,详细介绍了如何管理事务、进行数据备份与恢复、创建触发器记录数据变化,以及解析二进制日志进行数据回滚。提供了实践建议,以帮助数据库管理员和开发人员有效应对数据操作错误,确保数据安全性和一致性。
数据库
数据管理
MySQL
数据恢复
编程
ClickHouse 深度拆解:当关系型数据库学会「按列思考」——从 MergeTree 引擎、向量化执行到稀疏索引与生产级 OLAP 完全指南(2026)
编程
ClickHouse 深度拆解:当关系型数据库学会「按列思考」——从 MergeTree 引擎、向量化执行到稀疏索引与生产级 OLAP 完全指南(2026)
2026-07-17 02:44:42 +0800 CST
view 198
深度拆解 ClickHouse v25.8 LTS:从列存与向量化执行原理、MergeTree 引擎家族、稀疏主键索引、物理存储布局,到物化视图、跳数索引、Kafka 接入与 Python 实战、生产级性能优化完全指南。
ClickHouse
OLAP
列式存储
MergeTree
向量化执行
物化视图
数据分析
数据库
sql语句分别按日,按周,按月,按季统计金额
编程
sql语句分别按日,按周,按月,按季统计金额
2024-11-17 05:05:22 +0800 CST
view 3354
本文讨论如何使用SQL语句按日、周、月和季节统计消费记录的总量。提供了四条SQL示例语句,分别实现不同时间段的消费总和计算,并说明了如何根据指定日期进行查询。示例中使用了聚合函数和groupby语句,适用于消费记录表的分析。
数据库
SQL
数据分析
Redis 8 深度实战:当 antirez 亲手写下 Vector Set,Redis 如何长成内存里的多模型数据库
编程
Redis 8 深度实战:当 antirez 亲手写下 Vector Set,Redis 如何长成内存里的多模型数据库
2026-07-10 19:43:38 +0800 CST
view 168
深度拆解 Redis 8 的多模型进化:Vector Set 向量检索、原生 JSON、Bloom/Cuckoo/CMS/Top-K/T-Digest 概率结构、TimeSeries 与统一查询引擎,配可运行代码与 RAG 语义缓存实战。
Redis 8
Vector Set
向量数据库
RedisJSON
概率数据结构
RAG
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
2
3
...
27
下一页