程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
英伟达 CUDA-Oxide 0.1 深度解析:用 Rust 编写 GPU 内核的破冰之旅
编程
英伟达 CUDA-Oxide 0.1 深度解析:用 Rust 编写 GPU 内核的破冰之旅
2026-05-10 08:20:42 +0800 CST
view 761
英伟达发布实验性Rust-to-CUDA编译器CUDA-Oxide 0.1,支持用Rust编写SIMT GPU内核并输出标准PTX中间代码。深度解析其架构设计、代码示例与未来展望。
CUDA-Oxide
Rust
GPU编程
NVIDIA
PTX
SIMT
并行计算
高性能计算
Polars 深度拆解:当 DataFrame 学会「延迟计算」——用 Rust + Apache Arrow + 查询优化器重写数据分析的心智模型
编程
Polars 深度拆解:当 DataFrame 学会「延迟计算」——用 Rust + Apache Arrow + 查询优化器重写数据分析的心智模型
2026-07-15 15:46:12 +0800 CST
view 122
从工程师视角深度拆解 Polars:Rust + Apache Arrow 列式内存、表达式系统、查询优化器(投影/谓词下推、公共子表达式消除)、多线程 SIMD 与 Streaming 流式引擎,配完整代码实战与 7 个性能优化技巧。
Polars
Rust
数据分析
DataFrame
查询优化器
高性能计算
Apache Arrow
流式计算
向量化
Python
别再手写汇编了!Go 1.27 原生SIMD,性能直接起飞
编程
别再手写汇编了!Go 1.27 原生SIMD,性能直接起飞
2026-07-04 08:18:54 +0800 CST
view 186
Go 1.27正式支持原生SIMD,无需手写Plan9汇编即可使用向量指令。底层archsimd包+高层Highway封装,两步走策略。Green Tea GC已用SIMD让GC开销降10%,runtime.freegc让strings.Builder扩容翻2倍。高性能计算牌桌上Go正式入座。
Go
SIMD
AVX
AVX-512
ARM64
NEON
SVE
高性能计算
并行计算
GreenTeaGC
编译器优化
WebAssembly 2.0 深度实战:当浏览器性能突破原生壁垒——从 GC/线程/WASI 到生产级高性能计算完全指南(2026)
编程
WebAssembly 2.0 深度实战:当浏览器性能突破原生壁垒——从 GC/线程/WASI 到生产级高性能计算完全指南(2026)
2026-06-11 13:52:44 +0800 CST
view 430
深入解析 WebAssembly 2.0 核心新特性:GC 类型系统、多线程并行、Component Model 跨语言互操作、WASI 0.2 全平台支持、CSP 3.0 安全集成,配合 Rust 实战代码和性能实测数据。
WebAssembly
WASM
WASM 2.0
WASI
高性能计算
前端性能
浏览器性能
Rust
PHP也能Native AOT编译了!Swoole-Compiler让PHP代码直接变成机器码,性能提升150倍
编程
PHP也能Native AOT编译了!Swoole-Compiler让PHP代码直接变成机器码,性能提升150倍
2026-04-23 16:03:56 +0800 CST
view 554
2026年4月22日Swoole团队发布Native AOT编译器,将PHP代码直接编译为原生二进制,斐波那契测试性能提升150倍,支持C++无缝互调用,PHP正式进入编译型语言性能时代。
Swoole
AOT编译
PHP性能优化
原生编译
C++互调
高性能计算
CUDA Tile 深度拆解:当 GPU 编程从「线程思维」跃迁到「数据块思维」——从 Tile IR、cuTile Python 到 Blackwell 硬件映射的工程全貌(2026)
编程
CUDA Tile 深度拆解:当 GPU 编程从「线程思维」跃迁到「数据块思维」——从 Tile IR、cuTile Python 到 Blackwell 硬件映射的工程全貌(2026)
2026-07-18 03:17:24 +0800 CST
view 98
深度拆解 NVIDIA CUDA 13.1 Tile 编程模型:从 SIMT 到 Tile-based 的范式革命、Tile IR 虚拟指令集、cuTile Python DSL、与 Triton 的竞争格局、Flash Attention 实战案例、完整迁移指南与性能优化技巧。
CUDA
GPU编程
cuTile
Tile IR
Blackwell
Tensor Core
高性能计算
深度学习
Python
Polars 深度实战:碾压 Pandas 的 Rust 极速 DataFrame 引擎——从 Apache Arrow 内存模型到 Lazy Execution 的完全指南(2026)
编程
Polars 深度实战:碾压 Pandas 的 Rust 极速 DataFrame 引擎——从 Apache Arrow 内存模型到 Lazy Execution 的完全指南(2026)
2026-06-02 16:24:32 +0800 CST
view 508
深度解析 Polars 如何基于 Rust 和 Apache Arrow 实现比 Pandas 快 94 倍的性能,涵盖 Lazy Execution、查询优化、生产实践
Polars
Rust
DataFrame
Python数据分析
高性能计算
Apache Arrow
Lazy Execution
RISC-V 正在重写芯片世界:从香山处理器到如意系统,一场从指令集到生态的开源革命
编程
RISC-V 正在重写芯片世界:从香山处理器到如意系统,一场从指令集到生态的开源革命
2026-07-13 11:15:02 +0800 CST
view 182
深度拆解RISC-V开源芯片生态:从香山处理器微架构、如意操作系统内核设计、向量/矩阵扩展AI推理到玄铁C930服务器级部署,配完整代码示例与性能优化指南。
RISC-V
香山处理器
如意系统
开源芯片
指令集架构
高性能计算
AI推理
DeepSeek DeepGEMM 2026年4月重磅更新:Mega MoE融合算子、FP4精度与极致性能优化
编程
DeepSeek DeepGEMM 2026年4月重磅更新:Mega MoE融合算子、FP4精度与极致性能优化
2026-04-23 08:41:45 +0800 CST
view 615
深度解析DeepSeek DeepGEMM 2026年4月重大更新:Mega MoE融合算子(dispatch+Linear+SwiGLU+Combine五合一,NVLink通信与Tensor Core计算重叠)、FP8xFP4 GEMM、FP4 Indexer、PDL调度优化与JIT加速,附完整代码实战。
DeepGEMM
DeepSeek
GPU优化
CUDA
FP8
FP4
MoE
AI Infra
高性能计算
NVIDIA
SGLang 深度实战:当 RadixAttention 重新定义 LLM 推理——从架构原理到生产部署的完整工程指南(2026)
编程
SGLang 深度实战:当 RadixAttention 重新定义 LLM 推理——从架构原理到生产部署的完整工程指南(2026)
2026-07-20 17:18:01 +0800 CST
view 104
深度解析SGLang推理框架核心技术:RadixAttention基数树KV缓存、连续批处理与CPU-GPU调度重叠、约束解码结构化输出、CVE-2026-5760安全漏洞修复、生产部署实战,以及与vLLM的完整对比选型指南。
SGLang
LLM
RadixAttention
PagedAttention
推理优化
Python
深度学习
向量检索
Agent
RAG
vLLM
CVE
Rust
高性能计算
Khal 深度实战:一次编写,跨越 WebGPU、CUDA 与 CPU 的 GPU 通用计算新范式(2026)
编程
Khal 深度实战:一次编写,跨越 WebGPU、CUDA 与 CPU 的 GPU 通用计算新范式(2026)
2026-06-15 11:46:16 +0800 CST
view 491
Khal(Kompute Hardware Abstraction Layer)是 Rust 生态的跨平台 GPU 硬件抽象层,让开发者用一门语言编写一次计算着色器,即可部署到 WebGPU、CUDA 和 CPU 所有目标平台。本文深入解析其架构设计、编译流程、标准库与实战代码示例。
Rust
GPU
WebGPU
CUDA
高性能计算
图形编程
TileLang + TileKernels 深度解析:DeepSeek 如何用 Python 写出让 GPU 逼近理论性能上限的 GPU 内核
编程
TileLang + TileKernels 深度解析:DeepSeek 如何用 Python 写出让 GPU 逼近理论性能上限的 GPU 内核
2026-04-28 10:55:20 +0800 CST
view 616
深度剖析 DeepSeek 开源的 TileLang DSL 和 TileKernels GPU 内核库:从 GEMM 到 MoE,从 TVM 编译基础设施到生产级量化内核,揭示用 Python 写接近硬件极限性能 GPU 代码的秘密。
TileLang
GPU内核
DeepSeek
高性能计算
CUDA
GEMM
MoE
量化
TVM
开源项目
Pgrx 深度解析:用 Rust 为 PostgreSQL 打造高性能扩展——从入门到生产级实战
编程
Pgrx 深度解析:用 Rust 为 PostgreSQL 打造高性能扩展——从入门到生产级实战
2026-04-28 14:24:36 +0800 CST
view 470
深度解析 Pgrx(4.5k+ Stars)框架:用 Rust 为 PostgreSQL 编写高性能扩展,涵盖类型映射、内存管理、代码实战与生产部署完整指南。
Rust
PostgreSQL
数据库扩展
高性能
开源
系统编程
Pgrx
Rust 2026:从 TIOBE 第12名到生产级 Async——Tokio 如何一统异步生态,革了 Go 的命?
编程
Rust 2026:从 TIOBE 第12名到生产级 Async——Tokio 如何一统异步生态,革了 Go 的命?
2026-06-29 09:43:39 +0800 CST
view 348
2026年6月 Rust 首次跻身 TIOBE 第12名。本文从源码级别剖析 Tokio work-stealing 调度器架构,对比 Rust Axum 与 Go Gin 在高并发场景下的真实性能差异,并附生产级完整代码示例。
Rust
Tokio
异步编程
后端开发
高性能
Go Fiber v3 深度实战:当 Express 风格遇上 Go 高性能——从零基础到生产级 Web 开发的完全指南(2026)
编程
Go Fiber v3 深度实战:当 Express 风格遇上 Go 高性能——从零基础到生产级 Web 开发的完全指南(2026)
2026-06-11 02:16:42 +0800 CST
view 346
Go Fiber v3 深度实战教程,从零开始构建生产级 Web 应用,涵盖路由系统、中间件、数据库集成、性能优化和容器化部署
Go Fiber v3
Go Web 框架
Express 风格
高性能 Web 开发
生产级部署
基于 Rust Pingora 构建高性能的负载均衡器
编程
基于 Rust Pingora 构建高性能的负载均衡器
2024-11-18 08:49:35 +0800 CST
view 1942
本文介绍了使用Rust语言编写的Pingora框架,重点讲解了其高性能、低资源消耗和模块化设计的优势。通过一个简单的HTTP负载均衡器示例,展示了如何使用Pingora构建高性能的负载均衡解决方案,并介绍了健康检查、服务发现等扩展功能,适合构建高可用的网络服务。
编程
网络
负载均衡
Rust
高性能
TigerBeetle深度解析:Zig语言打造的金融事务数据库——从零锁批处理到1000倍OLTP性能跃迁的完整实战指南
编程
TigerBeetle深度解析:Zig语言打造的金融事务数据库——从零锁批处理到1000倍OLTP性能跃迁的完整实战指南
2026-07-06 06:12:44 +0800 CST
view 318
深度解析TigerBeetle金融事务数据库:Zig语言从零构建、零锁批处理架构、1000倍OLTP性能提升、Viewstamped Replication共识、LSM-Tree分层存储、两阶段提交。含Python/Go完整代码实战与生产部署指南。
TigerBeetle
Zig
金融数据库
OLTP
高性能
分布式系统
开源
Rust 高性能七层网关实战:从 Tokio 异步运行时到零拷贝 HTTP 转发的架构完全指南
编程
Rust 高性能七层网关实战:从 Tokio 异步运行时到零拷贝 HTTP 转发的架构完全指南
2026-05-23 20:31:57 +0800 CST
view 450
深度剖析如何用 Rust 构建高性能七层网关,从 Tokio 异步运行时原理、零拷贝转发机制、HTTP/2 与 HTTP/3 支持、连接池管理、到 TLS 硬件卸载等核心技术,结合生产级代码示例,带你掌握下一代高性能网关的架构设计与实战技巧。
Rust
异步编程
高性能网关
Tokio
零拷贝
Valkey 8.0 深度实战:当 Redis 分支版本单节点性能媲美集群——从异步 IO 线程到数据预取、从内存访问分摊到百万 QPS 生产级完全指南(2026)
编程
Valkey 8.0 深度实战:当 Redis 分支版本单节点性能媲美集群——从异步 IO 线程到数据预取、从内存访问分摊到百万 QPS 生产级完全指南(2026)
2026-06-23 05:23:57 +0800 CST
view 273
Valkey 8.0 通过异步 IO 线程、数据预取和内存访问分摊技术,使单节点性能突破 100 万 QPS,媲美 Redis Cluster。本文从架构原理到生产部署,提供完整实战指南。
Valkey
Redis
缓存
高性能
键值存储
异步IO
NUMA
PHP高性能框架Workerman的核心技术epoll,分析了其如何利用IO多路复用机制实现高性能
综合
PHP高性能框架Workerman的核心技术epoll,分析了其如何利用IO多路复用机制实现高性能
2024-11-19 03:09:27 +0800 CST
view 1851
本文深入探讨了PHP高性能框架Workerman的核心技术epoll,分析了其如何利用IO多路复用机制实现高性能。通过代码示例,展示了如何在PHP中使用epoll创建TCP服务器和处理客户端请求。Workerman的高性能依赖于epoll的高效事件处理能力,使其能够应对高并发场景,为PHP开发者提供了构建高效Web应用的基础。
编程
Web开发
高性能框架
PHP
网络编程
Tokio 1.38 深度实战:当 Rust 异步运行时遇上 io_uring——从调度器架构到零拷贝优化、百万级并发与生产级部署的完全指南(2026)
编程
Tokio 1.38 深度实战:当 Rust 异步运行时遇上 io_uring——从调度器架构到零拷贝优化、百万级并发与生产级部署的完全指南(2026)
2026-06-18 02:23:15 +0800 CST
view 307
深入拆解Tokio 1.38核心架构与2026年最新特性,结合io_uring、零拷贝、百万级并发实战,提供生产级部署最佳实践
Rust
异步运行时
Tokio
io_uring
高性能并发
io_uring 深度解析:Linux 异步 I/O 的新纪元——从共享环形缓冲区到零拷贝的三层架构设计
编程
io_uring 深度解析:Linux 异步 I/O 的新纪元——从共享环形缓冲区到零拷贝的三层架构设计
2026-05-17 19:54:31 +0800 CST
view 563
io_uring 是 Linux 5.1 引入的高性能异步 I/O 框架,通过共享内存环形缓冲区、SQPOLL 内核线程池和零拷贝提交的三层架构,重新定义了 Linux 异步 I/O 的性能边界。本文从内核设计哲学到用户态实战,深入讲解 io_uring 的核心原理。
Linux
异步IO
io_uring
高性能
系统编程
Ghostty + Zig 2026:HashiCorp联合创始人造了个不用Electron的终端,Rust的性能神话要被打破了?
编程
Ghostty + Zig 2026:HashiCorp联合创始人造了个不用Electron的终端,Rust的性能神话要被打破了?
2026-06-25 23:48:00 +0800 CST
view 519
2026年最值得关注的技术事件之一:HashiCorp联合创始人Mitchell Hashimoto用Zig语言打造的Ghostty终端模拟器,完全绕过Electron,GPU加速渲染,内存占用接近系统原生终端。本文深度解析Ghostty架构设计、Zig语言技术优势、2026年Zig生态全景,以及系统级编程语言选型指南。
Zig
Ghostty
终端模拟器
Rust
系统编程
2026
OpenSource
高性能
io_uring 深度实战:Linux 异步 I/O 如何用零拷贝和共享内存把网络吞吐量推到极限
编程
io_uring 深度实战:Linux 异步 I/O 如何用零拷贝和共享内存把网络吞吐量推到极限
2026-05-04 20:07:01 +0800 CST
view 536
从 Linux 异步 I/O 的历史痛点出发,深度解析 io_uring 的共享内存环形队列架构、零拷贝通信机制,用大量 C/Rust/Go 代码实战演示网络服务开发,给出 SQPOLL、Multishot、Provided Buffers 等生产级优化策略和踩坑经验
io_uring
Linux
异步I/O
网络编程
高性能
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
2
3
...
37
下一页