程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
LLM推理引擎全栈优化实战:从PagedAttention到投机解码,榨干GPU的每一滴算力
编程
LLM推理引擎全栈优化实战:从PagedAttention到投机解码,榨干GPU的每一滴算力
2026-05-17 10:21:56 +0800 CST
view 552
深度拆解LLM推理引擎核心技术栈:PagedAttention消除内存碎片、连续批处理榨干GPU算力、NUMA感知调度、混合精度量化、投机解码加速、算子融合、分布式推理架构,附代码示例与性能数据
LLM
vLLM
PagedAttention
推理优化
量化
投机解码
ContinuousBatching
GPU
万字深度:PagedAttention、连续批处理与投机解码——LLM推理优化七层实战
编程
万字深度:PagedAttention、连续批处理与投机解码——LLM推理优化七层实战
2026-05-17 10:22:13 +0800 CST
view 532
深度拆解LLM推理引擎核心技术栈:PagedAttention消除内存碎片、连续批处理榨干GPU算力、NUMA感知调度、混合精度量化、投机解码加速、算子融合、分布式推理架构,附代码示例与性能数据
LLM
vLLM
PagedAttention
推理优化
量化
投机解码
ContinuousBatching
GPU
Zig 深度实战:向 AI 代码说「不」的系统编程语言——从 comptime 元编程到手动内存管理的完全指南(2026)
编程
Zig 深度实战:向 AI 代码说「不」的系统编程语言——从 comptime 元编程到手动内存管理的完全指南(2026)
2026-06-03 06:47:06 +0800 CST
view 773
Zig 语言深度实战指南:从 comptime 编译期计算、手动内存管理、错误处理到 C 无缝互操作,完整代码示例与 HTTP 服务器实战项目
Zig
系统编程
comptime
内存管理
C互操作
omlx:Mac 本地 LLM 推理的终极方案——从菜单栏管理到 SSD 缓存的完整工程实践
编程
omlx:Mac 本地 LLM 推理的终极方案——从菜单栏管理到 SSD 缓存的完整工程实践
2026-07-24 17:17:27 +0800 CST
view 16
深度解析 omlx:专为 Mac 优化的本地 LLM 推理服务器,通过连续批处理、分层 KV Cache、SSD 缓存和菜单栏管理,实现便捷与控制兼得的推理体验。涵盖技术架构、性能调优、RAG 实战和最佳实践。
LLM
Mac
Apple Silicon
推理优化
本地部署
omlx
NVIDIA Cosmos 3 深度实战:当世界模型重塑 Physical AI——从 MoT 架构到机器人策略的生产级完全指南(2026)
编程
NVIDIA Cosmos 3 深度实战:当世界模型重塑 Physical AI——从 MoT 架构到机器人策略的生产级完全指南(2026)
2026-06-12 15:50:50 +0800 CST
view 523
深入解析 NVIDIA Cosmos 3 全模态物理 AI 世界模型:MoT 双塔架构、统一动作表征、3D MRoPE 位置编码,以及 Hugging Face 实战代码。适合机器人、自动驾驶、AI 研究者和工程师。
NVIDIA
Cosmos
世界模型
Physical AI
MoT
机器人
Transformer
具身智能
llmfit 深度拆解:一条命令算出你的电脑能跑哪些大模型——硬件感知适配引擎的工程解剖
编程
llmfit 深度拆解:一条命令算出你的电脑能跑哪些大模型——硬件感知适配引擎的工程解剖
2026-07-24 18:44:04 +0800 CST
view 15
深度拆解 GitHub Trending 开源工具 llmfit:四维评分系统、量化自动试探、MoE 精算、带宽速度模型、Plan 模式与 bench 众包校准,从第一性原理讲透本地大模型的硬件适配方法论。
llmfit
本地大模型
LLM
Rust
量化
Ollama
llama.cpp
Apple Silicon
硬件适配
开源
WebGPU 计算着色器深度解析:WGSL 编程范式与 GPU 并行计算实战
编程
WebGPU 计算着色器深度解析:WGSL 编程范式与 GPU 并行计算实战
2026-05-17 11:46:05 +0800 CST
view 631
深入解析 WebGPU 计算着色器与 WGSL 着色语言,从架构原理到代码实战,涵盖图像处理、粒子模拟、神经网络推理三大场景,探讨 GPU 并行计算的优化策略与生态趋势。
WebGPU
WGSL
Compute Shader
GPU编程
并行计算
JavaScript
前端性能
GPGPU
Zig 语言深度实战:从哲学根基到生产级系统编程的完全指南(2026)
编程
Zig 语言深度实战:从哲学根基到生产级系统编程的完全指南(2026)
2026-06-17 19:56:30 +0800 CST
view 606
深入解析 Zig 语言的设计哲学、核心语法、comptime 编译期计算、async 协程模型、C 互操作与生产实践,对比 Rust 提供选型建议
Zig
系统编程
内存安全
comptime
C互操作
colibrì 深度拆解:当1300行纯C在25GB笔记本上跑起744B大模型——纯C运行时、MoE稀疏激活与智谱GLM-5.2的工程奇迹(2026)
编程
colibrì 深度拆解:当1300行纯C在25GB笔记本上跑起744B大模型——纯C运行时、MoE稀疏激活与智谱GLM-5.2的工程奇迹(2026)
2026-07-19 09:14:11 +0800 CST
view 345
纯C语言实现的大模型推理引擎,仅用1300行代码在25GB内存笔记本上运行744B参数的GLM-5.2 MoE模型,含完整代码示例与技术解析
C语言
GLM-5.2
MoE
大模型推理
量化
AVX2
MLA注意力
推测解码
Apple Silicon
Zig 0.14 深度实战:从 comptime 编译时元编程到跨平台 C 互操作——2026 年系统编程新锐的工程化完全指南
编程
Zig 0.14 深度实战:从 comptime 编译时元编程到跨平台 C 互操作——2026 年系统编程新锐的工程化完全指南
2026-05-24 08:35:12 +0800 CST
view 615
深入剖析 Zig 0.14 核心特性:comptime 编译时元编程、错误联合类型、分配器设计、泛型实现、C 互操作、交叉编译,以及与 Bun/Rust/Go 的对比分析,附完整代码实战。
Zig
系统编程
comptime
C互操作
LLVM
交叉编译
内存管理
WSL Containers 深度解析:Windows 11 原生 Linux 容器的破局之战——wslc 命令行 + Container API 从零到生产级的完整实战指南
编程
WSL Containers 深度解析:Windows 11 原生 Linux 容器的破局之战——wslc 命令行 + Container API 从零到生产级的完整实战指南
2026-07-06 20:14:53 +0800 CST
view 311
深度解析微软WSL Containers:Windows 11原生Linux容器支持,wslc命令行工具与Container API,virtiofs文件系统性能革命,从安装配置到生产级实战,含完整代码示例与性能基准测试。
WSL Containers
wslc
Windows 11
Linux容器
Docker替代
容器化
微软
WSL
Zig 0.16 深度解剖:comptime 元编程、无隐藏控制流与手动内存管理的工程真相
编程
Zig 0.16 深度解剖:comptime 元编程、无隐藏控制流与手动内存管理的工程真相
2026-07-25 07:44:29 +0800 CST
view 13
从第一性原理深度拆解 Zig:comptime 一统泛型与反射、allocator 显式化内存模型、error union 与 errdefer 错误处理、无隐藏控制流哲学、@cImport 与 zig cc 交叉编译神器,以及 Zig vs Rust 的诚实选型冷思考。
Zig
comptime
系统编程
内存管理
allocator
错误处理
C互操作
交叉编译
Rust
性能优化
Zig 0.15 深度解析:当系统编程语言回归「零隐式」哲学——从 comptime 元编程到 Vercel Zero-Native,一个正在重写基础设施的 C 语言终极替代者
编程
Zig 0.15 深度解析:当系统编程语言回归「零隐式」哲学——从 comptime 元编程到 Vercel Zero-Native,一个正在重写基础设施的 C 语言终极替代者
2026-07-06 22:43:27 +0800 CST
view 305
深度解析Zig 0.15系统编程语言:零隐式设计哲学、comptime编译期元编程、显式Allocator内存管理、零成本C互操作、Vercel Zero-Native跨平台框架。从语言特性到生产实战,含完整代码示例与Zig/Rust/C三方对比。
Zig
系统编程
comptime
Vercel
Zero-Native
Rust
C语言
交叉编译
桌面应用
Loco.rs 深度实战:用 Rust 打造 Rails 式全栈 Web 应用
编程
Loco.rs 深度实战:用 Rust 打造 Rails 式全栈 Web 应用
2026-06-18 04:54:15 +0800 CST
view 386
Loco.rs 是一个借鉴 Ruby on Rails 设计理念的 Rust 全栈 Web 框架。本文从架构设计、核心功能、代码实战、性能优化到生产部署,全方位深入讲解 Loco.rs 的使用,帮助开发者快速掌握 Rust Web 全栈开发。
Rust
Web开发
全栈框架
Loco.rs
SeaORM
cognee 深度实战:从向量检索到知识图谱——AI Agent 持久记忆的工程化完全指南(2026)
编程
cognee 深度实战:从向量检索到知识图谱——AI Agent 持久记忆的工程化完全指南(2026)
2026-05-24 15:59:41 +0800 CST
view 715
cognee 是 GitHub 12K+ Stars 的开源 AI Agent 记忆控制平面,支持向量检索与知识图谱双引擎融合。深入解析其架构原理、代码实战与工程化落地。
AI Agent
cognee
记忆系统
知识图谱
RAG
Claude Context 深度实战:让 AI 读懂你整个代码库——语义代码搜索引擎从原理到生产级部署完全指南(2026)
编程
Claude Context 深度实战:让 AI 读懂你整个代码库——语义代码搜索引擎从原理到生产级部署完全指南(2026)
2026-06-04 09:26:09 +0800 CST
view 480
Claude Context 是 Zilliz 开源的 MCP 插件,通过 AST 智能代码分块和混合检索将整个代码库转化为 AI 编程助手的语义知识库,实测 Token 消耗降低约 40%。
Claude Context
语义搜索
MCP协议
向量数据库
AI编程
刚刚开源!Turix让AI操作一切App,微信、淘宝、抖音都能自动化
编程
刚刚开源!Turix让AI操作一切App,微信、淘宝、抖音都能自动化
2026-04-21 13:57:27 +0800 CST
view 891
GitHub热榜开源项目!Turix让AI像人一样操作电脑任何App,微信自动通过好友、淘宝下单、抖音发评论都可自动化。接入OpenClaw、Claude Code等Agent。
Turix
CUA
Computer Use Agent
AI自动化
开源
万字深度解析 Nano-vLLM:当1200行Python代码重构大模型推理——从架构设计到性能超越vLLM的完整技术指南(2026)
编程
万字深度解析 Nano-vLLM:当1200行Python代码重构大模型推理——从架构设计到性能超越vLLM的完整技术指南(2026)
2026-07-01 14:44:55 +0800 CST
view 219
Nano-vLLM:用约1200行Python代码实现的轻量级vLLM替代方案。深度解析KV Cache管理、GQA注意力、RoPE位置编码、Continuous Batching等核心技术,Benchmark性能超越vLLM 5.3%。适合学习大模型推理原理和内网轻量级部署。
Nano-vLLM
大模型推理
LLM
Tensor Parallelism
KV Cache
Continuous Batching
Python
PyTorch
Qwen2
开源项目
CUA (Computer-Use Agents) 深度实战:当 AI 真正学会"使用电脑"——从沙箱基础设施到多模型接入、评测闭环与生产级部署的完全指南(2026)
编程
CUA (Computer-Use Agents) 深度实战:当 AI 真正学会"使用电脑"——从沙箱基础设施到多模型接入、评测闭环与生产级部署的完全指南(2026)
2026-06-18 08:54:52 +0800 CST
view 376
CUA 是专为 Computer-Use Agent 设计的开源基础设施,覆盖沙箱、驱动、Agent 框架、评测、macOS 虚拟化五大模块。本文深度拆解架构设计与实战。
Computer-Use Agents
AI Agent
CUA
桌面自动化
沙箱基础设施
WSLC 深度解析:微软如何用 wslc.exe + virtiofs + WSL Container API 让 Windows 11 原生跑 Linux 容器——从架构原理到告别 Docker Desktop 的完整实战指南
编程
WSLC 深度解析:微软如何用 wslc.exe + virtiofs + WSL Container API 让 Windows 11 原生跑 Linux 容器——从架构原理到告别 Docker Desktop 的完整实战指南
2026-07-07 08:44:11 +0800 CST
view 308
深度解析微软Build 2026发布的WSL Container(WSLC):wslc.exe命令行工具兼容Docker CLI、virtiofs实现2倍文件I/O性能提升、WSL Container API支持C/C++/C#原生调用Linux容器。从架构原理到Node.js/Python/多服务编排完整实战,含性能基准测试与Docker Desktop/Podman全面对比。
WSLC
WSL
Docker
容器
Windows 11
virtiofs
containerd
云原生
防止 macOS 生成 .DS_Store 文件
编程
防止 macOS 生成 .DS_Store 文件
2024-11-19 07:39:27 +0800 CST
view 2030
.DS_Store是macOS自动生成的隐藏文件,用于存储文件夹的自定义属性。它在版本控制和跨平台项目中可能造成问题。为避免影响,可以将其添加到.gitignore文件中,使用终端命令防止生成,或删除现有文件。通过这些方法,可以有效管理.DS_Store文件,减少对项目的干扰。
文件管理
macOS
版本控制
Python中使用macosx-tts库来实现MacOS的文本到语音功能
编程
Python中使用macosx-tts库来实现MacOS的文本到语音功能
2024-11-18 23:46:50 +0800 CST
view 1727
本文介绍了如何在Python中使用macosx-tts库来实现MacOS的文本到语音功能。内容涵盖了库的安装、基本用法和一些高级功能,如自定义发音和异步朗读。通过示例代码,读者可以轻松上手并将语音合成功能集成到自己的项目中。
编程
语音技术
MacOS
Python库
开发工具
PyTorch 2.13 深度解析:一次把框架换心与跨平台革命讲透
编程
PyTorch 2.13 深度解析:一次把框架换心与跨平台革命讲透
2026-07-14 01:14:51 +0800 CST
view 285
2026年7月PyTorch 2.13重磅发布:FlexAttention在Apple Silicon实现12倍加速、CuTeDSL提供CUTLASS级GEMM代码生成、融合损失函数将大词汇量训练峰值显存削减4倍、torchcomms革新分布式通信后端、ExecuTorch正式并入核心,深度拆解六大核心更新与实战代码。
PyTorch
深度学习
机器学习框架
GPU
Distributed Training
FlexAttention
CUDA
GEMM
ROCm
Apple Silicon
MPS
`tree` 是一个命令行工具,用于以树状结构显示目录内容
编程
`tree` 是一个命令行工具,用于以树状结构显示目录内容
2024-11-19 05:38:41 +0800 CST
view 1914
在macOS中,`tree`是一个命令行工具,用于以树状结构显示目录内容。如果出现`zsh:commandnotfound:tree`错误,说明未安装该命令。可以通过Homebrew安装,使用命令`brewinstalltree`。安装后,可以使用`tree-L2`显示当前目录两级的树形结构,方便查看目录内容。
macOS
命令行工具
软件安装
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
80
81
82
83
84
下一页