程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
AgentKernelArena 深度解析:AI 代理能否替代人类优化 GPU 内核?——AMD 评测体系完全指南(2026)
编程
AgentKernelArena 深度解析:AI 代理能否替代人类优化 GPU 内核?——AMD 评测体系完全指南(2026)
2026-05-28 22:05:16 +0800 CST
view 382
AMD研究团队2026年5月发布AgentKernelArena,首次系统性评测AI代理在GPU内核优化任务上的表现,深入解析AI替代人类优化GPU内核的可行性、局限与未来方向。
GPU内核优化
AI代理
AMD AgentKernelArena
GPU编程
系统编程
TileLang + TileKernels 深度解析:DeepSeek 如何用 Python 写出让 GPU 逼近理论性能上限的 GPU 内核
编程
TileLang + TileKernels 深度解析:DeepSeek 如何用 Python 写出让 GPU 逼近理论性能上限的 GPU 内核
2026-04-28 10:55:20 +0800 CST
view 644
深度剖析 DeepSeek 开源的 TileLang DSL 和 TileKernels GPU 内核库:从 GEMM 到 MoE,从 TVM 编译基础设施到生产级量化内核,揭示用 Python 写接近硬件极限性能 GPU 代码的秘密。
TileLang
GPU内核
DeepSeek
高性能计算
CUDA
GEMM
MoE
量化
TVM
开源项目
Linux 7.2 内核深度解析:Intel Xe3 架构驱动 Arc B390 核显性能跃升 12% 的技术内幕
编程
Linux 7.2 内核深度解析:Intel Xe3 架构驱动 Arc B390 核显性能跃升 12% 的技术内幕
2026-07-23 20:15:41 +0800 CST
view 263
深度解析 Linux 7.2 内核如何让 Intel Xe3 架构的 Arc B390 核显性能提升 12%。涵盖 Xe3 架构设计、GuC 批量命令提交、显存预分配策略、智能电源管理、AI 推理优化实战。
Linux
Intel
Xe3
Arc B390
GPU
i915
内核优化
图形驱动
光线追踪
AI推理
Valkey 深度实战:当 Redis 被许可协议「背刺」后,Linux 基金会如何用一把 BSD 利刃重塑内存数据库格局——从异步 IO 线程、内存预取到 9.0 原子槽迁移的完整工程指南(2026)
编程
Valkey 深度实战:当 Redis 被许可协议「背刺」后,Linux 基金会如何用一把 BSD 利刃重塑内存数据库格局——从异步 IO 线程、内存预取到 9.0 原子槽迁移的完整工程指南(2026)
2026-07-21 02:45:24 +0800 CST
view 94
2026 深度实战 Valkey:从 Redis 7.2.4 BSD 分支的诞生、RESP 协议级兼容,到 8.0 异步 IO 线程+内存预取把单机推到 100W/s,再到 9.0 原子槽迁移与哈希字段过期。配 Go/Python 可运行代码与集群、迁移实战。
Valkey
Redis
内存数据库
BSD
异步IO
原子槽迁移
内核优化
Go
Linux 7.2 存储栈深度实战:当两行代码让 IOPS 提升 5%——从 iomap 框架到 io_uring 零拷贝、从 Block Layer 到 NVMe 高并发存储引擎的生产级完全指南
编程
Linux 7.2 存储栈深度实战:当两行代码让 IOPS 提升 5%——从 iomap 框架到 io_uring 零拷贝、从 Block Layer 到 NVMe 高并发存储引擎的生产级完全指南
2026-06-20 07:28:05 +0800 CST
view 389
深度解析 Linux 7.2 iomap 框架优化:两行代码让 IOPS 提升 5%。从 iomap_iter 热路径分析到 io_uring 异步引擎实战,涵盖 Block Layer、NVMe 驱动、性能调优全链路。
Linux
io_uring
iomap
NVMe
存储
内核优化
GoGPU 深度实战:纯 Go、零 CGO 的 GPU 计算生态——从 2D 图形到 GUI 工具包的完整指南(2026)
编程
GoGPU 深度实战:纯 Go、零 CGO 的 GPU 计算生态——从 2D 图形到 GUI 工具包的完整指南(2026)
2026-06-28 15:44:07 +0800 CST
view 225
深度解析 GoGPU 纯 Go GPU 计算生态的完整架构:wgpu GPU 抽象层、gg 5 引擎智能光栅化、ui GUI 工具包、naga Shader 编译器、g3d 3D 渲染引擎,含完整代码实战、性能基准与生产部署指南(2026)
Go
GoGPU
WebGPU
GPU计算
图形编程
wgpu
GUI
2D渲染
开源
性能优化
WebGPU 计算着色器深度解析:WGSL 编程范式与 GPU 并行计算实战
编程
WebGPU 计算着色器深度解析:WGSL 编程范式与 GPU 并行计算实战
2026-05-17 11:46:05 +0800 CST
view 658
深入解析 WebGPU 计算着色器与 WGSL 着色语言,从架构原理到代码实战,涵盖图像处理、粒子模拟、神经网络推理三大场景,探讨 GPU 并行计算的优化策略与生态趋势。
WebGPU
WGSL
Compute Shader
GPU编程
并行计算
JavaScript
前端性能
GPGPU
WebGPU 深度拆解:当浏览器学会「直面 GPU」——从 WGSL 计算着色器、跨平台运行时到生产级 GPU 计算的工程全貌(2026)
编程
WebGPU 深度拆解:当浏览器学会「直面 GPU」——从 WGSL 计算着色器、跨平台运行时到生产级 GPU 计算的工程全貌(2026)
2026-07-18 03:42:25 +0800 CST
view 133
深度拆解 WebGPU:从对象模型、WGSL 计算着色器、与 Vulkan/Metal/D3D12 的映射,到浏览器与 Deno 跨平台实战、端侧 Transformer 推理与生产级性能优化。
WebGPU
WGSL
GPU计算
浏览器
前端工程化
Deno
TypeScript
GPGPU
WebGPU 计算管线深度拆解:当浏览器开始「直接调用 GPU 算力」——从 WGSL 计算着色器、Storage Buffer 到浏览器端 GPGPU 与 AI 推理的工程全貌(2026)
编程
WebGPU 计算管线深度拆解:当浏览器开始「直接调用 GPU 算力」——从 WGSL 计算着色器、Storage Buffer 到浏览器端 GPGPU 与 AI 推理的工程全貌(2026)
2026-07-19 02:43:47 +0800 CST
view 120
深度拆解 WebGPU 计算管线:从 WGSL 计算着色器、Storage Buffer、workgroup 共享内存,到矩阵乘法 tiling、图像卷积、真实 GPU 基准对比,并落地浏览器端大模型推理(WebLLM/ONNX Runtime Web)。
WebGPU
GPGPU
WGSL
计算管线
浏览器AI
GPU计算
Shimmy 深度解剖:Airframe 引擎与 TurboShimmy INT4 KV——纯 Rust WebGPU 推理如何用 4GB 显存跑起 7B 模型
编程
Shimmy 深度解剖:Airframe 引擎与 TurboShimmy INT4 KV——纯 Rust WebGPU 推理如何用 4GB 显存跑起 7B 模型
2026-07-25 10:15:27 +0800 CST
view 72
深度拆解 Shimmy v2.x 的 Airframe 纯 Rust WebGPU 推理引擎与 TurboShimmy INT4 KV Cache 压缩技术:从 WGSL shader 到 GGUF 模型加载,从跨平台 GPU 适配到 4GB 显存跑 7B 模型的工程真相。
Shimmy
WebGPU
GGUF
LLM推理
Rust
Inference Engine
TurboShimmy
INT4量化
消费级GPU
本地部署
wgpu
WGSL
Airframe
OpenAI API
WebGPU 深度解析:当浏览器真正拥有「显卡驱动」——从 WGSL 计算着色器到浏览器端 AI 推理的完整实战指南
编程
WebGPU 深度解析:当浏览器真正拥有「显卡驱动」——从 WGSL 计算着色器到浏览器端 AI 推理的完整实战指南
2026-07-07 12:44:09 +0800 CST
view 164
深度解析WebGPU图形与计算API:WGSL计算着色器实战、浏览器端AI推理、渲染管线优化、生产级应用场景,从架构原理到完整代码示例的全面指南。
WebGPU
WGSL
Compute Shader
GPU
Browser AI
Rendering
WebGL
万字深度解析 HAMi:当 KubeCon EU 2026 把 GPU 调度器推向云原生 AI 基础设施舞台中央——从异构算力虚拟化到 K8s 生产级部署的完整技术指南(2026)
编程
万字深度解析 HAMi:当 KubeCon EU 2026 把 GPU 调度器推向云原生 AI 基础设施舞台中央——从异构算力虚拟化到 K8s 生产级部署的完整技术指南(2026)
2026-07-02 17:16:43 +0800 CST
view 411
深度解析 HAMi 项目在 KubeCon EU 2026 的亮相,涵盖异构算力虚拟化原理、K8s 生产部署实践、性能优化与监控体系
HAMi
GPU调度
Kubernetes
云原生
AI基础设施
KubeCon
异构算力
NPU
CNCF
vGPU
WebGPU 深度解析:当 Chrome 正式发布 WebGPU 实现,Web 图形与通用计算的新纪元已至
编程
WebGPU 深度解析:当 Chrome 正式发布 WebGPU 实现,Web 图形与通用计算的新纪元已至
2026-04-15 19:20:07 +0800 CST
view 629
深入解析 Chrome 113 正式发布的 WebGPU 实现:架构设计、WGSL 着色器语言、Compute Shader 机器学习推理实战、性能对比与完整代码示例
WebGPU
WGSL
Chrome
图形API
GPU计算
Compute Shader
机器学习
Web图形
WebGPU 深度解析:浏览器图形的第三次革命——从 WebGL 的 20fps 到 WebGPU 的 120fps
编程
WebGPU 深度解析:浏览器图形的第三次革命——从 WebGL 的 20fps 到 WebGPU 的 120fps
2026-05-14 11:45:03 +0800 CST
view 415
WebGPU是W3C历时7年打造的浏览器图形API新标准,2026年全浏览器稳定支持。Compute Shader让浏览器可做ML推理和物理模拟,Draw Call从2000提升至50000每帧,wgpu让Rust一套代码跑遍Web/桌面/移动5平台。深度解析WGSL着色器、PBR渲染、100万粒子模拟实战、WebGL迁移指南。
WebGPU
WebGL
GPU
Compute Shader
Rust
Linux 7.1 原生 NTFS 驱动深度解析:3.6万行代码重写,NTFS 读写困境终得解
编程
Linux 7.1 原生 NTFS 驱动深度解析:3.6万行代码重写,NTFS 读写困境终得解
2026-04-22 12:30:37 +0800 CST
view 1157
Linux 7.1 主线内核正式合并全新原生 NTFS 驱动,由 Namjae Jeon 历时四年、编写超过 3.6 万行代码完成。本文深度解析该驱动的技术架构、MFT 日志处理、folio 与 iomap 集成、性能对比及使用指南。
Linux内核
NTFS驱动
文件系统
内核开发
性能优化
Linux 7.1 内核 NTFS 驱动深度解析:3.6 万行代码如何完成 NTFS 的「四年复活」
编程
Linux 7.1 内核 NTFS 驱动深度解析:3.6 万行代码如何完成 NTFS 的「四年复活」
2026-05-09 15:46:09 +0800 CST
view 659
2026年4月17日Linux 7.1内核正式合并全新NTFS驱动,由Namjae Jeon历时四年重构完成,超过3.6万行代码。本文深入解析NTFS文件系统核心设计(MFT、LCN/VCN、LogFile日志机制、B+树目录索引),对比历代Linux NTFS方案的缺陷,剖析新驱动的现代内核架构(iomap、folio),性能测试数据及实际迁移指南。
Linux内核
NTFS
文件系统
内核驱动
文件系统架构
Linux 7.0内核Rust转正实战:从零编写你的第一个Rust内核驱动程序
编程
Linux 7.0内核Rust转正实战:从零编写你的第一个Rust内核驱动程序
2026-04-25 03:31:43 +0800 CST
view 800
深度解析Linux 7.0内核Rust转正:从架构原理到环境搭建,从零编写完整的Rust字符设备驱动,涵盖内存安全模型、C互操作、性能优化和调试策略。
Rust
Linux内核
驱动开发
内核编程
Rust for Linux
CVE-2026-31431 Copy Fail深度解析:Linux内核零拷贝页缓存污染与本地提权完整指南
编程
CVE-2026-31431 Copy Fail深度解析:Linux内核零拷贝页缓存污染与本地提权完整指南
2026-07-27 01:12:18 +0800 CST
view 34
深度解析2026年最热Linux内核漏洞CVE-2026-31431(Copy Fail):从AF_ALG加密接口、splice()零拷贝机制到authencesn写入原理,完整拆解攻击链,提供检测、修复和生产环境防御方案。
CVE
Linux内核
内核漏洞
本地提权
AF_ALG
splice
页缓存
安全漏洞
零拷贝
权限提升
KernelScript 深度拆解:当 Linux 内核学会「说人话」——eBPF CO-RE 开发范式的终极指南
编程
KernelScript 深度拆解:当 Linux 内核学会「说人话」——eBPF CO-RE 开发范式的终极指南
2026-07-16 15:51:25 +0800 CST
view 184
深度拆解2026年5月发布的KernelScript 0.1新语言与eBPF CO-RE可移植性机制,从Verifier安全模型、Maps数据结构、Hook挂载点到生产级工具链横向对比,配完整C/Go代码实战。
eBPF
KernelScript
CO-RE
Linux内核
内核追踪
网络编程
云原生
BTF
可观测性
Zed 深度实战:Rust + GPU 渲染 + CRDT 协作,手搓 RGA 内核看懂 AI 原生编辑器
编程
Zed 深度实战:Rust + GPU 渲染 + CRDT 协作,手搓 RGA 内核看懂 AI 原生编辑器
2026-07-10 05:13:16 +0800 CST
view 167
拆解 Zed 编辑器的 Rust + GPU 渲染 + CRDT 协作架构,并用约 80 行 Rust 手搓一个可运行的 RGA 协作内核,讲透 AI 原生编辑器的底层范式。
Zed
Rust
GPUI
CRDT
RGA
AI编辑器
协作内核
WebGPU 深度实战:当浏览器成为 GPU 计算平台——从计算着色器、异步管线到跨平台性能优化的工程全貌(2026)
编程
WebGPU 深度实战:当浏览器成为 GPU 计算平台——从计算着色器、异步管线到跨平台性能优化的工程全貌(2026)
2026-07-20 00:16:12 +0800 CST
view 145
2026年WebGPU成为W3C推荐标准,浏览器正式成为GPU计算平台。本文深度拆解:从架构演进、计算着色器实战、性能优化到跨平台兼容与生产级渲染器架构。
WebGPU
GPU计算
计算着色器
性能优化
跨平台
图形编程
前端技术
WebAssembly + WebGPU 深度实战:当浏览器成为高性能计算平台——从 WASM 组件模型到 GPU 通用计算的生产级完全指南(2026)
编程
WebAssembly + WebGPU 深度实战:当浏览器成为高性能计算平台——从 WASM 组件模型到 GPU 通用计算的生产级完全指南(2026)
2026-06-06 07:08:04 +0800 CST
view 612
深度解析 WebAssembly + WebGPU 协同架构,从 WASM 组件模型到 WebGPU Compute Shader,涵盖共享内存通信、性能优化、生产部署完整指南
WebAssembly
WebGPU
WASM
GPU计算
组件模型
WGSL
性能优化
WebGPU + WebAssembly 2026:浏览器高性能计算的黄金组合全解析
编程
WebGPU + WebAssembly 2026:浏览器高性能计算的黄金组合全解析
2026-05-09 08:36:41 +0800 CST
view 782
深入解析2026年Chrome正式发布的WebGPU实现与WebAssembly的协同计算架构,从底层原理到代码实战,涵盖WGSL着色器、SIMD优化与性能调优
WebGPU
WebAssembly
WASM
GPU
WGSL
MusaCoder 深度实战:当国产GPU遇见AI驱动的Kernel生成——从PyTorch到CUDA/MUSA原生算子的全栈训练完全指南(2026)
编程
MusaCoder 深度实战:当国产GPU遇见AI驱动的Kernel生成——从PyTorch到CUDA/MUSA原生算子的全栈训练完全指南(2026)
2026-06-16 06:47:47 +0800 CST
view 386
MusaCoder是首个基于国产GPU完成全链路训练的代码大模型,在KernelBench上超越Claude Opus 4.7。从三阶段数据合成、多样性RFT到执行反馈RL,深度解析全栈训练方法论。
MusaCoder
GPU Kernel
摩尔线程
国产GPU
CUDA
MUSA
大模型
强化学习
KernelBench
代码大模型
AI Coding
深度学习
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
2
3
...
49
下一页