程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
NautilusTrader深度解析:Rust+Python构建纳秒级确定性算法交易引擎
编程
NautilusTrader深度解析:Rust+Python构建纳秒级确定性算法交易引擎
2026-04-23 21:42:03 +0800 CST
view 565
深度解析NautilusTrader架构设计与实战应用:Rust内核提供纳秒级事件处理与确定性保证,Python控制平面保留策略开发灵活性,从回测到实盘零代码修改
Rust
Python
量化交易
算法交易
NautilusTrader
猛涨25K Star!LLMFit:一键检测你的电脑能跑哪些大模型
案例
猛涨25K Star!LLMFit:一键检测你的电脑能跑哪些大模型
2026-05-06 07:35:19 +0800 CST
view 576
25K+Star的LLMFit一键检测你的电脑能跑哪些大模型,Rust编写支持NVIDIA/AMD/Intel/Apple Silicon,智能量化推荐Q8到Q2,四维评分系统,TUI+CLI双模式
LLM部署
硬件检测
量化推荐
Rust
终端工具
本地部署
Ollama
DwarfStar 4 深度实战:当 Redis 之父用 C 语言重新发明本地推理——从磁盘 KV 一等公民到 284B 模型跑进 MacBook 的工程完全指南(2026)
编程
DwarfStar 4 深度实战:当 Redis 之父用 C 语言重新发明本地推理——从磁盘 KV 一等公民到 284B 模型跑进 MacBook 的工程完全指南(2026)
2026-06-14 09:48:41 +0800 CST
view 620
Redis之父antirez的ds4项目深度解析:非对称2-bit量化、磁盘KV缓存一等公民、session_sync增量推理、方向引导、分布式推理的工程实战指南
ds4
DwarfStar
本地推理
DeepSeek
MoE
KV缓存
antirez
Metal
量化
端侧大模型深度解析:当AI走出云端、住进你的手机——从千亿参数到4B模型的边缘智能革命
编程
端侧大模型深度解析:当AI走出云端、住进你的手机——从千亿参数到4B模型的边缘智能革命
2026-04-15 21:23:26 +0800 CST
view 618
2026年端侧大模型技术深度解析:从千亿参数云端模型到4B端侧模型的工程革命,涵盖量化、蒸馏、架构优化与Mano-P实战案例
端侧大模型
边缘AI
模型量化
知识蒸馏
Mano-P
GUI智能体
TinyML
AI手机
DwarfStar 深度解析:antirez 的 DeepSeek V4 Flash 本地推理引擎——Metal 与 CUDA 双轨优化革命(2026 完全指南)
编程
DwarfStar 深度解析:antirez 的 DeepSeek V4 Flash 本地推理引擎——Metal 与 CUDA 双轨优化革命(2026 完全指南)
2026-05-28 19:13:18 +0800 CST
view 472
DwarfStar(ds4)是Redis创始人antirez开发的DeepSeek V4 Flash专用推理引擎,支持Metal与CUDA双轨优化、磁盘KV Cache、imatrix量化和原生Agent集成。本文深入解析其架构设计与性能表现。
DeepSeek
ds4
Metal
CUDA
本地推理
MoE
量化
GGUF
Agent
Python
C
DuckDB 深度实战:当「分析界的 SQLite」装上向量化引擎——1.5 版本如何用进程内 OLAP 重写本地数据心智模型
编程
DuckDB 深度实战:当「分析界的 SQLite」装上向量化引擎——1.5 版本如何用进程内 OLAP 重写本地数据心智模型
2026-07-15 03:12:30 +0800 CST
view 112
从工程师视角深度拆解 DuckDB 1.5:进程内 OLAP、列存加向量化执行引擎、VARIANT 半结构化类型、全新 CLI,配 Python/Rust/SQL 实战与 HTAP 落地指南。
DuckDB
OLAP
向量化执行
进程内数据库
Parquet
VARIANT
数据分析
turbovec 深度实战:当 Google 把向量索引做到「内存极简」——从 TurboQuant 算法到生产级 Rust SIMD 检索引擎的完全指南(2026)
编程
turbovec 深度实战:当 Google 把向量索引做到「内存极简」——从 TurboQuant 算法到生产级 Rust SIMD 检索引擎的完全指南(2026)
2026-06-14 14:51:19 +0800 CST
view 594
基于 Google Research ICLR 2026 TurboQuant 算法,深度拆解 turbovec 如何用 4-bit 量化将向量索引内存压缩 16 倍,同时搜索速度超越 FAISS。涵盖算法原理、Rust SIMD 内核、过滤搜索与生产级 RAG 集成。
Rust
SIMD
向量检索
TurboQuant
turbovec
向量量化
RAG
FAISS
PyO3
SIMD加速
ClickHouse 深度实战:当实时 OLAP 撞上次世代列式引擎——MergeTree、稀疏索引与向量化执行如何重写数据分析心智模型
编程
ClickHouse 深度实战:当实时 OLAP 撞上次世代列式引擎——MergeTree、稀疏索引与向量化执行如何重写数据分析心智模型
2026-07-15 04:11:41 +0800 CST
view 112
从工程师视角深度拆解 ClickHouse:列存、向量化执行、MergeTree 引擎家族、稀疏主键索引、跳过索引与物化视图,配 Docker/SQL/Python/Go 实战与性能调优指南。
ClickHouse
MergeTree
列式存储
向量化执行
稀疏索引
实时数仓
OLAP
物化视图
ClickHouse Keeper
LLM推理引擎深度实战:从PagedAttention到生产级部署,万字长文吃透2026年最关键的AI基础设施
编程
LLM推理引擎深度实战:从PagedAttention到生产级部署,万字长文吃透2026年最关键的AI基础设施
2026-06-27 12:44:29 +0800 CST
view 270
2026年LLM推理引擎深度实战:从PagedAttention、连续批处理、量化技术到生产级K8s部署,万字长文覆盖vLLM、SGLang、TensorRT-LLM、TGI四大框架架构原理与实测对比
LLM推理
vLLM
PagedAttention
SGLang
推理优化
TensorRT-LLM
生产部署
KV Cache
量化
Ollama 深度实战:当本地大模型成为生产级基础设施——从模型量化到高并发推理、从 REST API 到 Kubernetes 部署的完全指南(2026)
编程
Ollama 深度实战:当本地大模型成为生产级基础设施——从模型量化到高并发推理、从 REST API 到 Kubernetes 部署的完全指南(2026)
2026-06-20 01:25:22 +0800 CST
view 462
Ollama本地大模型生产级部署完全指南:从GGUF格式原理、INT4/INT8量化实战、REST API集成、多语言SDK(Python/Go/TypeScript)、GPU显存管理、Kubernetes+Helm生产部署、性能调优到RAG知识库构建,全流程深度实战。
Ollama
本地大模型
LLM部署
模型量化
GGUF
llama.cpp
REST API
Kubernetes
GPU
RAG
1.58-bit 大模型极限量化实战:从 BitNet 三值权重到单颗 CPU 跑起 100B 模型
编程
1.58-bit 大模型极限量化实战:从 BitNet 三值权重到单颗 CPU 跑起 100B 模型
2026-07-21 16:20:29 +0800 CST
view 29
2026极限量化实战:BitNet三值权重、absmean/absmax量化、BitLinear实现、带宽数学与bitnet.cpp内核优化,单CPU跑100B模型。
BitNet
1.58-bit
大模型量化
LLM
端侧推理
bitnet.cpp
Fincept Terminal 深度解析:Bloomberg 终端的开源革命者,如何用 C++20 重新定义金融智能
编程
Fincept Terminal 深度解析:Bloomberg 终端的开源革命者,如何用 C++20 重新定义金融智能
2026-04-25 10:31:25 +0800 CST
view 812
深度解析 Fincept Terminal 开源金融分析平台:C++20+Qt6+Python 技术架构、CFA级别分析能力、100+数据连接器、DCF估值实战、与Bloomberg对比
Fincept Terminal
C++20
Qt6
金融终端
开源
量化交易
Bloomberg替代
BitNet 深度实战:微软 32K Star 的 1-bit LLM 推理框架——从三值量化原理到 CPU 原生推理的全链路架构解析
编程
BitNet 深度实战:微软 32K Star 的 1-bit LLM 推理框架——从三值量化原理到 CPU 原生推理的全链路架构解析
2026-05-07 03:35:48 +0800 CST
view 515
深度解析微软 BitNet 1-bit LLM 推理框架,从三值量化数学原理到 bitnet.cpp 内核优化,再到 CPU 原生推理实战部署的全链路架构解析
BitNet
1-bit LLM
量化
CPU推理
微软
DuckDB 深度实战:把「分析引擎」塞进应用进程里——向量化执行、列式存储与直查 PB 级 Parquet 湖仓的完整指南(2026)
编程
DuckDB 深度实战:把「分析引擎」塞进应用进程里——向量化执行、列式存储与直查 PB 级 Parquet 湖仓的完整指南(2026)
2026-07-08 12:15:42 +0800 CST
view 138
从工程视角彻底讲透 DuckDB:嵌入式进程内 OLAP 的定位、向量化执行与列式存储原理、直查 Parquet/Iceberg 的架构,配 7 个可运行代码实战与性能优化清单。
DuckDB
OLAP
向量化执行
列式存储
Parquet
数据湖仓
ETL
Arrow
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
编程
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
2026-07-15 08:45:14 +0800 CST
view 117
从工程师视角深度拆解 Ollama 与本地大模型推理引擎:GGUF 单文件格式、K-quant/IQ-quant 量化家族、内存带宽墙、llama.cpp 计算图与 KV Cache,配 Modelfile、Python/Go 流式客户端与自量化实战。
Ollama
llama.cpp
GGUF
本地推理
大模型量化
KV Cache
DuckDB 深度实战:把分析型数据库装进进程里——向量化执行引擎、Quack 客户端协议与 1.5.x 全解析
编程
DuckDB 深度实战:把分析型数据库装进进程里——向量化执行引擎、Quack 客户端协议与 1.5.x 全解析
2026-07-09 01:14:03 +0800 CST
view 104
进程内分析型数据库 DuckDB 1.5.x 深度解析:向量化执行引擎原理、列式存储与 Zone Map 剪枝、Quack 客户端-服务端协议、Iceberg/Lance Lakehouse 直查,配 Python/SQL 实战与性能调优。
DuckDB
OLAP
向量化执行
列存数据库
数据分析
DeepSeek-R1边缘推理实战:从云端独占到本地智能的范式转移
编程
DeepSeek-R1边缘推理实战:从云端独占到本地智能的范式转移
2026-05-19 12:42:27 +0800 CST
view 476
2026年,边缘AI不再只是云端模型的精简版。本文深入剖析DeepSeek-R1 CPU版的技术原理,从模型蒸馏、量化技术的底层原理到生产环境的完整部署方案,提供可直接落地的代码和可量化的性能数据。
DeepSeek
R1
边缘计算
AI推理
模型蒸馏
量化
llama.cpp
Ollama
端侧AI
Vibe-Trading 深度拆解:当 LLM 学会「炒股」——自然语言量化交易的多智能体架构与工程实践
编程
Vibe-Trading 深度拆解:当 LLM 学会「炒股」——自然语言量化交易的多智能体架构与工程实践
2026-07-15 11:45:26 +0800 CST
view 176
深度拆解港大HKUDS开源的Vibe-Trading项目:ReAct循环驱动的自然语言量化交易Agent、69个金融技能按需加载、30个多智能体Swarm团队、四大市场回测引擎、456个Alpha因子库,以及Shadow Account行为诊断功能,配完整代码示例与工程边界分析。
Vibe-Trading
LLM
量化交易
多智能体
ReAct
金融科技
HKUDS
Alpha Zoo
Shadow Account
TurboQuant 深度实战:Google 的 KV 缓存压缩算法完全指南(2026)
编程
TurboQuant 深度实战:Google 的 KV 缓存压缩算法完全指南(2026)
2026-06-08 20:52:38 +0800 CST
view 351
2026年3月Google Research在ICLR 2026发表TurboQuant算法,将LLM的KV缓存压缩至3-bit,实现6倍内存缩减和8倍推理加速。本文深入剖析TurboQuant的技术原理,并提供生产级部署指南。
TurboQuant
KV缓存压缩
LLM推理优化
量化算法
Google Research
ICLR2026
DuckDB 1.5 深度实战:向量化执行引擎、VARIANT 类型与零拷贝数据栈,重新定义进程内 OLAP(2026)
编程
DuckDB 1.5 深度实战:向量化执行引擎、VARIANT 类型与零拷贝数据栈,重新定义进程内 OLAP(2026)
2026-07-22 03:42:25 +0800 CST
view 17
2026年7月DuckDB 1.5深度实战:向量化执行引擎、列式存储、Morsel驱动并行、Arrow零拷贝、VARIANT半结构化类型、pg_duckdb与性能优化完全指南。
DuckDB
OLAP
向量化执行
VARIANT
进程内数据库
数据分析
零拷贝
Parquet
FinceptTerminal 深度实战:当 C++20 遇上金融终端——从 Qt6 原生渲染到 37 个 AI 智能体与 QuantLib 量化引擎的生产级完全指南(2026)
编程
FinceptTerminal 深度实战:当 C++20 遇上金融终端——从 Qt6 原生渲染到 37 个 AI 智能体与 QuantLib 量化引擎的生产级完全指南(2026)
2026-06-14 22:28:06 +0800 CST
view 392
开源金融终端 Fincept Terminal v4 深度实战:C++20 原生渲染、37 个 AI 投资智能体、QuantLib 18 模块量化引擎、100+ 数据源、16 家券商接入
FinceptTerminal
C++20
Qt6
金融终端
量化交易
AI智能体
QuantLib
开源金融
ds4 (DwarfStar) 深度实战:当 Redis 之父学会「大模型量化」——从非对称 2-bit 量化到磁盘 KV 缓存的生产级完全指南(2026)
编程
ds4 (DwarfStar) 深度实战:当 Redis 之父学会「大模型量化」——从非对称 2-bit 量化到磁盘 KV 缓存的生产级完全指南(2026)
2026-06-15 00:18:14 +0800 CST
view 426
深度剖析 Redis 之父 antirez 的最新项目 ds4 (DwarfStar),专为 DeepSeek V4 Flash 设计的本地推理引擎。涵盖非对称 2-bit 量化、磁盘 KV 缓存、Metal/CUDA 优化、内置 Coding Agent 等核心技术。
ds4
DwarfStar
antirez
Redis
大模型推理
MoE架构
量化
Polars 深度拆解:当 DataFrame 学会「延迟计算」——用 Rust + Apache Arrow + 查询优化器重写数据分析的心智模型
编程
Polars 深度拆解:当 DataFrame 学会「延迟计算」——用 Rust + Apache Arrow + 查询优化器重写数据分析的心智模型
2026-07-15 15:46:12 +0800 CST
view 105
从工程师视角深度拆解 Polars:Rust + Apache Arrow 列式内存、表达式系统、查询优化器(投影/谓词下推、公共子表达式消除)、多线程 SIMD 与 Streaming 流式引擎,配完整代码实战与 7 个性能优化技巧。
Polars
Rust
数据分析
DataFrame
查询优化器
高性能计算
Apache Arrow
流式计算
向量化
Python
RISC-V 深度拆解:当开源指令集学会「造芯」——NVIDIA SiFive 联姻、Linux 7.2 默认支持与 NumPy RVV 优化如何重写芯片战争格局
编程
RISC-V 深度拆解:当开源指令集学会「造芯」——NVIDIA SiFive 联姻、Linux 7.2 默认支持与 NumPy RVV 优化如何重写芯片战争格局
2026-07-15 16:17:47 +0800 CST
view 285
深度拆解 2026 年 RISC-V 生态关键技术突破:NVIDIA SiFive 战略合作、Linux 7.2 默认支持国产芯片、灵睿智芯 P100 v1、RISC-V Vector 扩展优化,配完整代码实战与性能对比。
RISC-V
RV-Vector
RVV
NVIDIA
SiFive
向量计算
SIMD
LLVM向量化
NumPy
国产芯片
Linux内核
AI推理
异构计算
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
2
3
4
5
下一页