程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
数据分析 相关技术文章
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
150 条 AI 视频 prompt 统计后,我用 n8n 搭了个每日一发的自动流程
编程
150 条 AI 视频 prompt 统计后,我用 n8n 搭了个每日一发的自动流程
2026-09-07 22:15:58
六节点无密钥的 n8n 工作流每日自动发布 AI 视频 prompt 与样片,并统计 150 条真实 prompt:中位长度 152 字符、镜头并非必须、音频是最大差异化,附元素频率数据。
n8n
AI
自动化
数据分析
SQL joins 与窗口函数:一个电商库讲透两种核心能力
编程
SQL joins 与窗口函数:一个电商库讲透两种核心能力
2026-09-07 20:22:27
用两张表的电商库讲透 join 四大家族与窗口函数:INNER/LEFT/FULL/SELF JOIN 的保留语义与 NULL 陷阱,ROW_NUMBER/RANK、滚动 SUM、LAG 环比等实战写法。
SQL
数据库
数据分析
Power BI 连 SQL 数据库实战:本地 PostgreSQL 与 Aiven 云库
编程
Power BI 连 SQL 数据库实战:本地 PostgreSQL 与 Aiven 云库
2026-09-07 20:22:26
Power BI Desktop 连接本地 PostgreSQL 与 Aiven 云库的完整链路:SSL 模式、驱动、表加载与星型建模,以及分析师为什么仍然必须懂 SQL——性能下推、数据准备与口径一致性。
PowerBI
SQL
PostgreSQL
数据分析
DuckDB v1.5.0 "Variegata" 发布:嵌入式分析数据库的性能优化与新特性解读
编程
DuckDB v1.5.0 "Variegata" 发布:嵌入式分析数据库的性能优化与新特性解读
2026-09-06 23:16:35
DuckDB发布v1.5.0版本代号Variegata。DuckDB是嵌入式分析型数据库(分析版SQLite),列式存储+向量化执行+零运维。核心特性:1.查询性能优化(优化器改进谓词下推/连接顺序/公共子表达式消除;执行引擎向量化/SIMD/并行;特定查询聚合/窗口函数/递归CTE优化,整体性能提升15-20%);2.SQL兼容性增强(GROUP BY ALL/QUALIFY/EXCLUDE/REPLACE新语法;PostgreSQL/MySQL/SQLite/Spark兼容性改进);3.数据导入导出增强(Parquet多文件/分区读取;CSV自动检测/并行读取;JSON/JSON Lines支持;Excel/Arrow/Pandas互操作;Iceberg/Delta Lake扩展);4.存储引擎改进(压缩算法/区域映射索引/MVCC/检查点/WAL/缓冲区管理);5.扩展系统增强(httpfs/json/icu/fts核心扩展;spatial/postgres/mysql/excel/delta/iceberg社区扩展;扩展签名验证);6.客户端API改进(CLI自动补全/语法高亮;Python/R/Java/Node/Go/Rust API;Pandas/Arrow/Polars/Jupyter/DBT集成)。TPC-H 1TB性能提升15-20%。
DuckDB
嵌入式数据库
OLAP
数据分析
SQL
列式存储
Parquet
开源
Orange:开源可视化数据挖掘工具
编程
Orange:开源可视化数据挖掘工具
2026-09-04 22:50:23
Orange 是一款图形化、免编程的开源数据挖掘与机器学习平台。本文整理其组件体系、下载安装、Add-ons 插件扩展,并用 Classification Tree 示例流程演示组件串联做交互式分类分析的完整路径,适合想摆脱写代码、可视化做数据分析的初学者。
Orange
数据挖掘
机器学习
可视化
数据分析
dbt:面向分析工程师的 SQL 转换工作流工具
代码
dbt:面向分析工程师的 SQL 转换工作流工具
2026-09-04 22:45:19
介绍开源数据转换工具 dbt:只写 SQL/Python 定义数据模型,自动化 ETL/ELT 转换、依赖管理、测试与文档化。对比 dbt Core 与 dbt Cloud,附官方文档与注册地址。
dbt
数据转换
ELT
SQL
数据分析
Redash:开源数据可视化与协作工具的接入与共享流程
案例
Redash:开源数据可视化与协作工具的接入与共享流程
2026-09-04 22:30:34
Redash 是开源数据可视化与协作工具,可连接多种 SQL/NoSQL/API 数据源,内置 SQL 编辑器、图表仪表盘、告警、群组权限与共享链接,并暴露 REST API 供集成。本文梳理其接入与团队共享流程。
Redash
数据可视化
仪表盘
开源
数据分析
用 PandaAI 做自然语言数据分析:数据源、可视化与自托管部署
编程
用 PandaAI 做自然语言数据分析:数据源、可视化与自托管部署
2026-09-04 22:26:16
PandaAI 是 Python 实现的自然语言数据分析工具,支持 Text2SQL 与问答式图表生成。文章介绍数据源支持、LiteLLM 多模型接入、在线 PandaBI 体验,以及 pip 自托管部署的最小示例。
PandaAI
数据分析
Text2SQL
Python
LLM
Apache Zeppelin 怎么跑起来:一个支持 Spark/Flink/Hive 的协作 Notebook
编程
Apache Zeppelin 怎么跑起来:一个支持 Spark/Flink/Hive 的协作 Notebook
2026-09-04 22:00:53
Apache Zeppelin 是基于 Web 的交互式数据分析 Notebook,类似 Jupyter,支持 SQL/Java/Scala/Python/R 以及 Spark、Flink、Hive、MongoDB 等后端。本文贴稿介绍其语言与数据源支持、JDK 8 + Ubuntu/macOS 安装前提、两种解释器安装包差异、Unix/Windows 启动命令与 localhost:8080 访问方式,并提示自带示例 notebook 与源码/Docker 安装选项。
Apache
Zeppelin
Notebook
大数据
数据分析
Spark
Flink
Huashu-Excel:开源数据分析 Skill
资讯
Huashu-Excel:开源数据分析 Skill
2026-08-26 15:40:38
开源数据分析 Skill Huashu-Excel 发布。通过八步流程(体检、清洗、对齐、分析、对账、交付、验图、质控)帮助 agent 处理 Excel/CSV 数据,并将分析师经验、Anthropic AI 心理学与 test-time scaling 结合,规避大模型在数据处理上的缺陷。经真实业务数据压测,支持 HTML/Excel/Word/PPT 报告输出。
AI
数据分析
agent
开源
Huashu-Excel 开源:给 Agent 装上「八步流程」,让 Excel 数据分析不再「零报错、错到底」
资讯
Huashu-Excel 开源:给 Agent 装上「八步流程」,让 Excel 数据分析不再「零报错、错到底」
2026-08-26 15:29:40
花叔开源了一款名为 Huashu-Excel 的 Excel 数据处理与分析 skill。它通过「体检→清洗→对账→质控」等八步流程,避开大模型在数据处理上「算错不报错」的致命缺陷,并用十份真实业务数据压测验证。本商品介绍它的核心卖点、四大真实案例与设计逻辑。
AI
数据分析
Excel
开源
Agent
DuckDB 深度拆解:当「进程内」分析数据库把 Pandas + PostgreSQL 的活儿一口气干了——从列式存储、向量化执行到零拷贝 Arrow 的全链路实战
编程
DuckDB 深度拆解:当「进程内」分析数据库把 Pandas + PostgreSQL 的活儿一口气干了——从列式存储、向量化执行到零拷贝 Arrow 的全链路实战
2026-08-19 02:43:06
深度拆解 DuckDB 1.5.5:从列式存储、向量化 Volcano 执行、Morsel-Driven 并行到异步 I/O(Work,Thread,Work),配可运行代码与生产调优清单。
DuckDB
进程内OLAP
向量化执行
列式存储
Arrow
零拷贝
DuckLake
数据分析
ETL
性能优化
Polars 1.41 深度拆解:当 Rust 把 DataFrame 从 pandas 手里抢过来——从 Arrow 内存模型、惰性优化器到流式引擎的全链路实战
编程
Polars 1.41 深度拆解:当 Rust 把 DataFrame 从 pandas 手里抢过来——从 Arrow 内存模型、惰性优化器到流式引擎的全链路实战
2026-08-19 01:14:11
深度拆解 Polars 1.41:从 Arrow 内存模型、惰性查询优化器、Rayon 多线程向量化引擎到流式执行的工程原理,配可运行代码与生产性能优化清单。
Polars
Rust
DataFrame
Apache Arrow
数据分析
Python
性能优化
惰性执行
流式引擎
DuckDB 1.5.0 深度拆解:向量化执行引擎如何把 TB 级分析塞进一台笔记本——从 VARIANT 类型到湖仓直查的全链路实战
编程
DuckDB 1.5.0 深度拆解:向量化执行引擎如何把 TB 级分析塞进一台笔记本——从 VARIANT 类型到湖仓直查的全链路实战
2026-08-18 19:12:37
深度拆解 DuckDB 1.5.0 向量化执行引擎:从列式存储、Data Chunk、Morsel-Driven 并行到 VARIANT 半结构化类型与湖仓直查,配 Python/Go/SQL 代码与性能优化清单。
DuckDB
向量化执行
OLAP
嵌入式数据库
VARIANT
湖仓直查
数据分析
Python
DuckDB 深度拆解:进程内向量化列式引擎如何把 TB 级分析塞进单机——从 Parquet 直查到 Pandas 替身的工程全链路实战
编程
DuckDB 深度拆解:进程内向量化列式引擎如何把 TB 级分析塞进单机——从 Parquet 直查到 Pandas 替身的工程全链路实战
2026-08-18 04:10:53
深度拆解 DuckDB:进程内向量化列式引擎如何用列裁剪、谓词下推与 min-max 剪枝把 TB 级分析塞进单机,配 Parquet 直查、pandas 联邦与本地 Lakehouse 可运行实战与性能优化清单。
DuckDB
OLAP
向量化执行
列式存储
Parquet
嵌入式数据库
数据分析
Python
DuckDB 深度实战:把 OLAP 引擎装进你的进程——从列式向量化执行到 Quack 协议与 DuckLake 湖仓,一篇讲透
编程
DuckDB 深度实战:把 OLAP 引擎装进你的进程——从列式向量化执行到 Quack 协议与 DuckLake 湖仓,一篇讲透
2026-08-16 01:16:06
深入剖析 DuckDB 进程内 OLAP 引擎:列式存储、向量化执行、VARIANT/GEOMETRY 类型、Quack 客户端协议与 DuckLake 湖仓,配可运行 SQL/Python 代码与性能优化实战。
DuckDB
OLAP
列式存储
向量化执行
DuckLake
Quack
数据分析
DuckDB 深度拆解:向量化执行引擎 + Async I/O「Work, Thread, Work」——嵌入式 OLAP 如何重写本地数据分析范式(2026 实战指南)
编程
DuckDB 深度拆解:向量化执行引擎 + Async I/O「Work, Thread, Work」——嵌入式 OLAP 如何重写本地数据分析范式(2026 实战指南)
2026-08-15 03:12:40
从背景、核心概念、向量化执行引擎、Async I/O「Work, Thread, Work」架构、多语言代码实战到 15 条生产级性能建议,深度拆解嵌入式 OLAP 数据库 DuckDB
DuckDB
OLAP
向量化执行
嵌入式数据库
数据分析
SQL-on-Files
Async I/O
DuckLake
DuckDB 深度拆解:当分析型数据库塞进一个进程——从向量化执行引擎到 DuckLake 湖仓一体的完全指南(2026)
编程
DuckDB 深度拆解:当分析型数据库塞进一个进程——从向量化执行引擎到 DuckLake 湖仓一体的完全指南(2026)
2026-08-13 12:42:03
深度拆解 DuckDB 进程内分析型数据库:列式存储、向量化执行引擎、CBO 优化器、与 Pandas/Arrow 零拷贝协作、DuckLake 湖仓实战,配 15 条生产踩坑清单。
DuckDB
OLAP
向量化执行
列式存储
数据分析
DuckLake
湖仓一体
SQLite
Python
性能优化
DuckDB 2026 深度拆解:当嵌入式数据库决定「干掉全部 OLAP 数据仓库」——一个 26K Star 的 C++ 引擎如何用向量化执行和异步 I/O 重新定义「分析即查询」
编程
DuckDB 2026 深度拆解:当嵌入式数据库决定「干掉全部 OLAP 数据仓库」——一个 26K Star 的 C++ 引擎如何用向量化执行和异步 I/O 重新定义「分析即查询」
2026-08-04 22:18:44
深度拆解26K Star开源嵌入式OLAP数据库DuckDB:向量化执行引擎、列式存储压缩、Quack客户端-服务器协议、异步I/O预取队列、DuckLake SQL原生湖仓格式,附完整架构分析与Python实战代码
DuckDB
向量化执行
OLAP
列式存储
异步I/O
Quack协议
DuckLake
数据分析
嵌入式数据库
开源
DuckDB 深度拆解:当嵌入式数据库决定「干掉全部 OLAP 数据仓库」——一个 26K Star 的 C++ 引擎如何用向量化执行和异步 I/O 重新定义「分析即查询」的终极形态
编程
DuckDB 深度拆解:当嵌入式数据库决定「干掉全部 OLAP 数据仓库」——一个 26K Star 的 C++ 引擎如何用向量化执行和异步 I/O 重新定义「分析即查询」的终极形态
2026-08-04 22:16:41
深度拆解26K Star开源嵌入式OLAP数据库DuckDB:向量化执行引擎、列式存储压缩、Quack客户端-服务器协议、异步I/O预取队列、DuckLake SQL原生湖仓格式,附完整架构分析与Python实战代码
DuckDB
向量化执行
OLAP
列式存储
异步I/O
Quack协议
DuckLake
数据分析
嵌入式数据库
开源
OpenDuck 深度拆解:把 MotherDuck 开源化——DuckDB「差分存储 + 混合执行」云边协同架构与自托管实战
编程
OpenDuck 深度拆解:把 MotherDuck 开源化——DuckDB「差分存储 + 混合执行」云边协同架构与自托管实战
2026-07-31 05:44:28
深度拆解开源项目 OpenDuck:把 MotherDuck 验证过的差分存储、混合执行、ATTACH 原生体验拆成可自托管开源形态。含 catalog 级集成原理、四大构件源码边界、plan splitting 与 bridge operator 数据流、完整 PoC 实战、自定义后端协议实现与生产化清单。
OpenDuck
DuckDB
MotherDuck
差分存储
混合执行
数据库
云原生
开源
Arrow
数据分析
DuckDB 1.5.5深度解析:向量化执行引擎如何重新定义OLAP游戏规则
编程
DuckDB 1.5.5深度解析:向量化执行引擎如何重新定义OLAP游戏规则
2026-07-25 14:12:44
深入解析DuckDB 1.5.5版本的向量化执行引擎原理、pg_duckdb集成实战、性能调优与ClickHouse选型对比
DuckDB
OLAP
向量化
pg_duckdb
数据库
数据分析
DuckDB 深度解剖:向量化执行引擎、列式存储内核与千万级数据分析的工程实战
编程
DuckDB 深度解剖:向量化执行引擎、列式存储内核与千万级数据分析的工程实战
2026-07-25 01:43:45
从第一性原理深度拆解 DuckDB 架构设计、向量化执行引擎、列式存储、扩展系统,以及千万级数据分析实战与性能调优。
DuckDB
列式存储
向量化执行
OLAP
数据分析
Python
Parquet
嵌入式数据库
性能优化
开源
DuckDB 深度解剖:把 OLAP 数据库塞进一个进程,它凭什么比你的数仓还快
编程
DuckDB 深度解剖:把 OLAP 数据库塞进一个进程,它凭什么比你的数仓还快
2026-07-23 19:44:10
DuckDB 是 OLAP 版的 SQLite:进程内嵌入、零依赖、单文件、列式存储加向量化执行引擎。本文从工程师视角深度拆解向量化执行、Push-Based流水线与Morsel并行、列存压缩、Larger-than-Memory外存溢写、直接查Parquet/S3、跨源联邦查询与DuckDB-Wasm,配Python/SQL代码实战与性能优化清单。
DuckDB
OLAP
列式存储
向量化执行
Morsel并行
数据分析
Parquet
嵌入式数据库
数据库
WebAssembly
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
python
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
上一页
1
2
3
4
下一页
共 4 页
到第
页
确定