程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
从原理到实战:llama.cpp 与 GGUF 量化格式的工程实践全解
编程
从原理到实战:llama.cpp 与 GGUF 量化格式的工程实践全解
2026-04-12 22:56:41 +0800 CST
view 1167
2026年深度解析 llama.cpp 架构设计与 GGUF 量化格式,从底层原理到工程实战,涵盖 K-Quant/IQ 量化、Flash Attention、KV Cache 优化、Intel NPU/GPU 部署全流程。
llama.cpp
GGUF
量化
大模型
C++
本地部署
Astral 深度拆解:当 OpenAI 决定「用 Rust 重写 Python 工具链」——从 uv 到 ruff 再到 ty,一个被收购的团队如何用 87K Star 重新定义 Python 开发体验
编程
Astral 深度拆解:当 OpenAI 决定「用 Rust 重写 Python 工具链」——从 uv 到 ruff 再到 ty,一个被收购的团队如何用 87K Star 重新定义 Python 开发体验
2026-08-06 03:17:16 +0800 CST
view 185
深度拆解Astral Python全栈工具链(uv+ruff+ty):Rust重写Python包管理、代码检查、类型检查三大核心工具,被OpenAI收购后如何重新定义Python开发体验
Astral
uv
ruff
ty
Python工具链
Rust
OpenAI
代码检查
类型检查
包管理
性能优化
开源
Shimmy 深度解剖:Airframe 引擎与 TurboShimmy INT4 KV——纯 Rust WebGPU 推理如何用 4GB 显存跑起 7B 模型
编程
Shimmy 深度解剖:Airframe 引擎与 TurboShimmy INT4 KV——纯 Rust WebGPU 推理如何用 4GB 显存跑起 7B 模型
2026-07-25 10:15:27 +0800 CST
view 261
深度拆解 Shimmy v2.x 的 Airframe 纯 Rust WebGPU 推理引擎与 TurboShimmy INT4 KV Cache 压缩技术:从 WGSL shader 到 GGUF 模型加载,从跨平台 GPU 适配到 4GB 显存跑 7B 模型的工程真相。
Shimmy
WebGPU
GGUF
LLM推理
Rust
Inference Engine
TurboShimmy
INT4量化
消费级GPU
本地部署
wgpu
WGSL
Airframe
OpenAI API
Shimmy 深度解析:纯 Rust WebGPU 推理引擎如何用一行命令颠覆浏览器端 AI 推理
编程
Shimmy 深度解析:纯 Rust WebGPU 推理引擎如何用一行命令颠覆浏览器端 AI 推理
2026-07-25 15:14:38 +0800 CST
view 156
深度解析 Shimmy v2.3.0:纯 Rust WebGPU 推理引擎如何实现浏览器端原生运行 GGUF 量化模型,OpenAI API 兼容,零依赖部署。
WebGPU
Rust
GGUF
AI推理
浏览器
llama.cpp
OpenAI API
前端工程
Ruff + Semgrep 双引擎实战:Python 代码质量与安全分析完整工程指南(2026)
编程
Ruff + Semgrep 双引擎实战:Python 代码质量与安全分析完整工程指南(2026)
2026-07-20 08:44:16 +0800 CST
view 288
深度拆解 Ruff(Rust 极速 Python Linter)和 Semgrep(AST 模式匹配安全分析)的架构原理与生产级实战,附双引擎组合完整配置与 CI/CD 集成指南。
Ruff
Semgrep
Python
静态分析
代码质量
Linter
安全扫描
DevSecOps
gRPC 深度实战:当 HTTP/2 + Protocol Buffers 重塑微服务通信——从流式 RPC、双向流到生产级性能优化的完整工程指南(2026)
编程
gRPC 深度实战:当 HTTP/2 + Protocol Buffers 重塑微服务通信——从流式 RPC、双向流到生产级性能优化的完整工程指南(2026)
2026-07-20 11:17:47 +0800 CST
view 210
2026年gRPC深度实战:从HTTP/2多路复用、Protocol Buffers序列化到四种RPC模式、生产级性能优化的完整工程指南,配Go代码示例。
gRPC
微服务
Protocol Buffers
HTTP/2
云原生
RPC
Go
服务通信
把大模型装进机房:Ollama 本地推理工程化实战——量化、并发、缓存与生产部署一次讲透(2026)
编程
把大模型装进机房:Ollama 本地推理工程化实战——量化、并发、缓存与生产部署一次讲透(2026)
2026-07-14 03:43:32 +0800 CST
view 287
深度拆解 Ollama 本地大模型推理工程化:从 GGUF 量化原理、MoE 专家调度、推理栈与 KV 缓存,到 Modelfile 定制、自量化、Python 客户端、FastAPI 生产服务、Docker 部署与性能调优,配完整可运行代码与 vLLM 对比。
Ollama
本地大模型
llama.cpp
GGUF量化
大模型部署
AI工程化
隐私计算
推理优化
Ollama 深度拆解:从傻瓜式本地大模型部署到底层 llama.cpp 调度器的工程全貌(2026·完整版)
编程
Ollama 深度拆解:从傻瓜式本地大模型部署到底层 llama.cpp 调度器的工程全貌(2026·完整版)
2026-07-20 18:18:40 +0800 CST
view 391
深度拆解 Ollama 工程架构:Go 服务层封装 llama.cpp、CGO 内存边界、GGUF 量化格式、Modelfile DSL、OpenAI 兼容层、Metal GPU 加速与生产部署实战,配完整 Go/Python/Shell 代码示例。
Ollama
本地大模型
llama.cpp
GGUF
Go
CGO
量化
Apple Silicon
WebAssembly 服务端 AI 推理实战:WASI 0.2 组件模型与 WasmEdge 边缘部署全链路深度解析
编程
WebAssembly 服务端 AI 推理实战:WASI 0.2 组件模型与 WasmEdge 边缘部署全链路深度解析
2026-08-16 01:47:12 +0800 CST
view 35
深度解析 WebAssembly 在 AI 推理领域的应用:从 WASI 0.2 组件模型的接口契约设计、WASI-NN 神经网络推理接口,到 WasmEdge 的生产级服务部署与性能调优,配完整 Rust/Python 代码示例。
WebAssembly
WASI
WasmEdge
边缘计算
AI推理
ONNX
组件模型
Serverless
云原生
GGUF
llama.cpp 架构深度拆解:从 GGML 到 GGUF、量化内核到跨平台推理栈,一文吃透本地 LLM 推理工程化
编程
llama.cpp 架构深度拆解:从 GGML 到 GGUF、量化内核到跨平台推理栈,一文吃透本地 LLM 推理工程化
2026-08-01 08:18:35 +0800 CST
view 239
深度拆解 llama.cpp 全栈架构:从 GGML 到 GGUF 格式演进、K-Quant 量化内核原理、ggml 张量计算图层、libllama 推理逻辑层、10+ 硬件后端调度,以及生产调优实战与踩坑清单。
llama.cpp
GGUF
GGML
量化
本地LLM
CPU推理
GPU加速
跨平台
K-Quant
Apache Iceberg v3 深度拆解:当表格式决定给每一行发身份证——删除向量、行血缘继承链与 v4 相对路径的元数据手术
编程
Apache Iceberg v3 深度拆解:当表格式决定给每一行发身份证——删除向量、行血缘继承链与 v4 相对路径的元数据手术
2026-08-10 05:49:00 +0800 CST
view 90
深度拆解 Apache Iceberg v3 规范:Puffin deletion-vector-v1 删除向量的 64->32+32 位图切分、_row_id 行血缘四级继承链与乐观提交重试的关系、variant/geometry/unknown 新类型与默认值真值表、多参数变换 source-ids 互斥规则、表加密密钥分层,以及 v4 相对路径解析的双斜杠陷阱。含完整升级剧本、体检 SQL、七条工程规律与十条踩坑清单。
Apache Iceberg
表格式
删除向量
行血缘
数据湖
Puffin
Roaring Bitmap
Variant
数据库
湖仓一体
OpenAI 收购 Astral 深度拆解:Python 工具链被 AI 吞并后,程序员该何去何从?
编程
OpenAI 收购 Astral 深度拆解:Python 工具链被 AI 吞并后,程序员该何去何从?
2026-07-15 01:43:37 +0800 CST
view 480
2026年3月OpenAI收购Astral,本文从工程师视角深度拆解uv、Ruff、ty的技术架构与性能优势,分析Codex整合后的Python工具链AI-Native进化,以及程序员应对策略。
OpenAI
Astral
uv
Ruff
ty
Python
Codex
AI编程
工具链
Rust
性能优化
GitHub Trending
Ollama 深度实战:当本地大模型成为生产级基础设施——从模型量化到高并发推理、从 REST API 到 Kubernetes 部署的完全指南(2026)
编程
Ollama 深度实战:当本地大模型成为生产级基础设施——从模型量化到高并发推理、从 REST API 到 Kubernetes 部署的完全指南(2026)
2026-06-20 01:25:22 +0800 CST
view 729
Ollama本地大模型生产级部署完全指南:从GGUF格式原理、INT4/INT8量化实战、REST API集成、多语言SDK(Python/Go/TypeScript)、GPU显存管理、Kubernetes+Helm生产部署、性能调优到RAG知识库构建,全流程深度实战。
Ollama
本地大模型
LLM部署
模型量化
GGUF
llama.cpp
REST API
Kubernetes
GPU
RAG
Gin v1.12.0 深度解析:Protobuf 内容协商 × 性能跃升 × 生产级实战指南
编程
Gin v1.12.0 深度解析:Protobuf 内容协商 × 性能跃升 × 生产级实战指南
2026-08-02 00:16:45 +0800 CST
view 156
2026年2月Gin v1.12.0重大更新深度解析:Protobuf原生内容协商支持、encoding.UnmarshalText参数绑定、GetError错误溯源、DELETE路由独立实现、Recover栈读取优化、BSON渲染等新特性,从第一性原理剖析原理并附生产级代码示例。
Go语言
Gin框架
Web开发
Protobuf
性能优化
中间件
路由
内容协商
API设计
生产实践
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
编程
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
2026-07-15 08:45:14 +0800 CST
view 354
从工程师视角深度拆解 Ollama 与本地大模型推理引擎:GGUF 单文件格式、K-quant/IQ-quant 量化家族、内存带宽墙、llama.cpp 计算图与 KV Cache,配 Modelfile、Python/Go 流式客户端与自量化实战。
Ollama
llama.cpp
GGUF
本地推理
大模型量化
KV Cache
DataBuff 深度拆解:当 APM 学会「多智能体协作」——用 OpenTelemetry + AI 原生架构重写可观测性的心智模型
编程
DataBuff 深度拆解:当 APM 学会「多智能体协作」——用 OpenTelemetry + AI 原生架构重写可观测性的心智模型
2026-07-15 15:15:44 +0800 CST
view 322
深度拆解 DataBuff:AI 原生 OpenTelemetry APM 的多智能体根因分析架构、极简三组件设计、MCP 双向开放能力,配完整 Docker/K8s 部署实战与代码示例。
DataBuff
OpenTelemetry
APM
AI-native
多智能体
可观测性
MCP
Doris
llama.cpp 深度拆解:一个纯 C++ 引擎如何让 180K Star 成为端侧 LLM 的事实标准——从 GGUF 格式到多后端架构的全栈解析
编程
llama.cpp 深度拆解:一个纯 C++ 引擎如何让 180K Star 成为端侧 LLM 的事实标准——从 GGUF 格式到多后端架构的全栈解析
2026-08-03 10:45:17 +0800 CST
view 368
深度拆解llama.cpp四大核心架构:GGUF模型格式设计、GGML计算引擎、8种多后端抽象层、K-Quant/I-Quant量化技术体系,附完整代码示例与性能基准测试
llama.cpp
GGUF
GGML
量化
端侧推理
LLM
C++
推理引擎
多后端
K-Quant
Ollama 本地大模型部署实战:从零到生产级应用的完全指南(2026)
编程
Ollama 本地大模型部署实战:从零到生产级应用的完全指南(2026)
2026-06-10 01:20:57 +0800 CST
view 759
2026年Ollama本地大模型部署完全指南:从架构原理、GGUF量化、ModelFile自定义、多语言集成(Python/JS/Go)、RAG实战到Docker/K8s生产部署,8500字深度长文。
Ollama
本地部署
大模型
LLM
生产级
GGUF
量化
llama.cpp 深度实战:当 C/C++ 重写遇见端侧 LLM 推理——从 GGUF 量化到 Apple Silicon 38 tokens/s 的生产级完全指南(2026)
编程
llama.cpp 深度实战:当 C/C++ 重写遇见端侧 LLM 推理——从 GGUF 量化到 Apple Silicon 38 tokens/s 的生产级完全指南(2026)
2026-06-16 01:17:28 +0800 CST
view 911
llama.cpp 是端侧 LLM 推理的事实标准(180K+ Stars)。本文从源码架构、GGUF 格式、量化方法、跨平台后端、生产部署、性能优化到 DeepSeek V4 Flash 实战,全方位讲解本地 AI 推理。
llama.cpp
GGUF
量化
端侧推理
本地AI
C/C++
Apple Silicon
Cloudflare收购VoidZero深度解析:当Vite遇上边缘计算——前端工具链的AI原生未来完全指南(2026)
编程
Cloudflare收购VoidZero深度解析:当Vite遇上边缘计算——前端工具链的AI原生未来完全指南(2026)
2026-06-05 21:14:11 +0800 CST
view 745
2026年6月4日,Cloudflare宣布收购VoidZero(尤雨溪创办的Vite工具链公司)。本文深度解析:Vite架构原理(ESM+HMR)、OXC用Rust重写JS工具链、Rolldown打包器、Cloudflare Workers边缘计算、AI原生开发范式转变。全文约10000字,覆盖技术细节、代码示例、性能对比与未来展望。
Cloudflare
VoidZero
Vite
尤雨溪
前端工具链
边缘计算
Rust
OXC
Rolldown
Cloudflare Workers
Gemma 4 MoE 架构技术深度解析:Dense MLP + Routed MoE 双路径设计如何重塑开源大模型
编程
Gemma 4 MoE 架构技术深度解析:Dense MLP + Routed MoE 双路径设计如何重塑开源大模型
2026-04-21 14:22:20 +0800 CST
view 758
深度解析 Google Gemma 4 的 Dual-Path 混合架构设计:Dense MLP 保障通用基座能力,Routed MoE 释放专业化推理效率。一文吃透技术原理、部署实战与选型对比。
Gemma 4
MoE架构
Dense MLP
Routed MoE
Google DeepMind
开源大模型
Transformer
模型部署
混合专家
Goose 深度解析:从 Block 的 AI 编程助手到 Linux Foundation 的开源 Agent 平台
编程
Goose 深度解析:从 Block 的 AI 编程助手到 Linux Foundation 的开源 Agent 平台
2026-04-08 18:24:35 +0800 CST
view 1510
深入解析从 Block 迁移至 Linux Foundation AAIF 的开源 AI Agent 项目 Goose:Rust 引擎、三位一体架构、70+MCP 扩展生态
AI Agent
Rust
MCP
Linux Foundation
Open Source
Vite 8 + Rolldown 深度拆解:Rust 打包器如何终结「dev ≠ prod」,以及 Cloudflare 收购 VoidZero 之后的前端工具链版图
编程
Vite 8 + Rolldown 深度拆解:Rust 打包器如何终结「dev ≠ prod」,以及 Cloudflare 收购 VoidZero 之后的前端工具链版图
2026-07-30 21:15:54 +0800 CST
view 180
深度拆解 Vite 8 用 Rolldown 统一打包内核:双打包器架构的历史债、Rolldown+Oxc 四段流水线、Full Bundle Mode 对 no-bundle 的自我否定、Advanced Chunks 声明式分包、插件跨语言性能陷阱与 filter 下沉、可复现的基准测试脚本、六大迁移坑与检查清单,以及 Cloudflare 收购 VoidZero 后的工具链版图。
Vite,Rolldown,Oxc,VoidZero,Rust,前端工程化,打包器,Cloudflare,构建优化,Full Bundle Mode
WWDC 2026 开发者全景深度解析:Swift 6.4 底层革命、Xcode 27 Agentic 编程与 SwiftUI 工业级进化
编程
WWDC 2026 开发者全景深度解析:Swift 6.4 底层革命、Xcode 27 Agentic 编程与 SwiftUI 工业级进化
2026-06-21 15:30:28 +0800 CST
view 789
WWDC 2026 完整开发者更新解析:Swift 6.4 Ref/MutableRef 底层革命、Xcode 27 Agentic 编程与 Agent Skills、SwiftUI 工业级进化、Foundation Models LanguageModel 协议,配完整代码实战。
WWDC 2026
Swift 6.4
Xcode 27
SwiftUI
Foundation Models
Swift Testing
macOS 27
AI编程
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
2
3
4
5
...
35
下一页