程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Ollama 深度实战:当本地大模型成为生产级基础设施——从模型量化到高并发推理、从 REST API 到 Kubernetes 部署的完全指南(2026)
编程
Ollama 深度实战:当本地大模型成为生产级基础设施——从模型量化到高并发推理、从 REST API 到 Kubernetes 部署的完全指南(2026)
2026-06-20 01:25:22 +0800 CST
view 471
Ollama本地大模型生产级部署完全指南:从GGUF格式原理、INT4/INT8量化实战、REST API集成、多语言SDK(Python/Go/TypeScript)、GPU显存管理、Kubernetes+Helm生产部署、性能调优到RAG知识库构建,全流程深度实战。
Ollama
本地大模型
LLM部署
模型量化
GGUF
llama.cpp
REST API
Kubernetes
GPU
RAG
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
编程
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
2026-07-15 08:45:14 +0800 CST
view 131
从工程师视角深度拆解 Ollama 与本地大模型推理引擎:GGUF 单文件格式、K-quant/IQ-quant 量化家族、内存带宽墙、llama.cpp 计算图与 KV Cache,配 Modelfile、Python/Go 流式客户端与自量化实战。
Ollama
llama.cpp
GGUF
本地推理
大模型量化
KV Cache
2026年前端框架三国杀:Vue 3.5 Vapor Mode 内存砍半、React 19.2 Server Components 成熟、Angular 21 彻底无 Zone
编程
2026年前端框架三国杀:Vue 3.5 Vapor Mode 内存砍半、React 19.2 Server Components 成熟、Angular 21 彻底无 Zone
2026-07-03 11:44:16 +0800 CST
view 308
深度解析2026年前端三大框架最新特性:Vue 3.5 Vapor Mode让内存砍半、React 19.2 Server Components成熟、Angular 21彻底告别Zone.js,从技术原理、编译优化到实战性能全面对比。
Vue
React
Angular
Vapor Mode
Server Components
Signals
前端框架
前端性能优化
Mano-P + Cider:4B模型本地操控Mac,端侧GUI Agent新时代
案例
Mano-P + Cider:4B模型本地操控Mac,端侧GUI Agent新时代
2026-05-07 13:34:32 +0800 CST
view 473
明略科技开源Mano-P(4B量化模型本地操控Mac)和Cider(MLX推理加速框架)。476 tokens/s预填充,76 tokens/s解码,峰值内存4.3GB,完全本地运行数据不出设备,离线长任务自主规划
GUI Agent
端侧AI
Apple Silicon
MLX
视觉理解
本地运行
Mano-P
Cider
告别 Electron 的 150MB:Fyne / Gio / Wails / Tauri 四框架选型实录
编程
告别 Electron 的 150MB:Fyne / Gio / Wails / Tauri 四框架选型实录
2026-07-09 07:56:09 +0800 CST
view 183
桌面GUI框架选型对比:Tauri/Wails(WebView混合派)和Fyne/Gio(纯Go自绘派)的包体、启动性能、移动端支持、学习曲线横向评测,选型决策树。
Go
Rust
Tauri
Wails
Fyne
Gio
桌面应用
GUI
跨平台
Electron
选型
Rust 桌面 GUI 框架 2026 大决战:Vizia 0.4、Euv、Tauri 2、Dioxus 深度实战与选型指南
编程
Rust 桌面 GUI 框架 2026 大决战:Vizia 0.4、Euv、Tauri 2、Dioxus 深度实战与选型指南
2026-05-29 09:47:20 +0800 CST
view 1013
Rust桌面GUI框架深度对比:Vizia 0.4信号系统、Euv的Rust+WASM方案、Tauri 2生产级轻量架构、Dioxus跨平台能力,从架构设计到代码实战到性能基准的完整选型指南
Rust
GUI
Vizia
Euv
Tauri
Dioxus
桌面应用
Oxc Angular 编译器深度实战:Rust 重写前端工具链的革命性突破——从架构设计到性能飙升的全链路解析
编程
Oxc Angular 编译器深度实战:Rust 重写前端工具链的革命性突破——从架构设计到性能飙升的全链路解析
2026-05-07 23:07:41 +0800 CST
view 515
深度解析 VoidZero 团队用 Rust 重写的 Oxc Angular 编译器,构建性能提升高达 20 倍。从模板解析器架构、代码发射器设计到 Vite 集成实战,全面剖析前端工具链的「氧化」革命。
Rust
Angular
前端工具链
Vite
编译器
性能优化
Vizia 0.4 深度实战:纯 Rust 声明式响应式 GUI 框架——从信号系统到 GPU 加速渲染的完全指南(2026)
编程
Vizia 0.4 深度实战:纯 Rust 声明式响应式 GUI 框架——从信号系统到 GPU 加速渲染的完全指南(2026)
2026-05-31 01:42:37 +0800 CST
view 419
Vizia 0.4 深度解析:纯 Rust 声明式响应式 GUI 框架,覆盖信号系统、morphorm 布局引擎、GPU 批绘制优化,附完整 Todo App 实战代码。
Rust
GUI
Vizia
桌面应用
响应式编程
GoGPU 深度实战:纯 Go、零 CGO 的 GPU 计算生态——从 2D 图形到 GUI 工具包的完整指南(2026)
编程
GoGPU 深度实战:纯 Go、零 CGO 的 GPU 计算生态——从 2D 图形到 GUI 工具包的完整指南(2026)
2026-06-28 15:44:07 +0800 CST
view 216
深度解析 GoGPU 纯 Go GPU 计算生态的完整架构:wgpu GPU 抽象层、gg 5 引擎智能光栅化、ui GUI 工具包、naga Shader 编译器、g3d 3D 渲染引擎,含完整代码实战、性能基准与生产部署指南(2026)
Go
GoGPU
WebGPU
GPU计算
图形编程
wgpu
GUI
2D渲染
开源
性能优化
Agent S:首个超越人类水平的开源GUI Agent框架
编程
Agent S:首个超越人类水平的开源GUI Agent框架
2026-05-15 18:39:02 +0800 CST
view 539
Agent S3是首个在OSWorld基准测试中超越人类水平的GUI Agent,达到72.60%成绩。支持Linux、Mac、Windows,pip一行安装,让AI像人类一样操作电脑。
开源项目
GUI Agent
电脑使用
AI自动化
Ollama 融资 6500 万美元背后:2026 年本地大模型运行时生态深度拆解——为什么「极简主义」赢了
编程
Ollama 融资 6500 万美元背后:2026 年本地大模型运行时生态深度拆解——为什么「极简主义」赢了
2026-07-16 11:45:03 +0800 CST
view 219
从 Ollama 6500 万美元融资事件切入,深度拆解 2026 年本地大模型运行时生态:Ollama、llama.cpp、LocalAI、LiteBox、vLLM 的架构设计、性能对比、API 设计、适用场景,配完整代码实战与生产部署踩坑指南。
Ollama
本地大模型
llama.cpp
LocalAI
LiteBox
本地LLM
推理引擎
量化
GGUF
MCP
Ollama 本地大模型部署实战:从零到生产级应用的完全指南(2026)
编程
Ollama 本地大模型部署实战:从零到生产级应用的完全指南(2026)
2026-06-10 01:20:57 +0800 CST
view 536
2026年Ollama本地大模型部署完全指南:从架构原理、GGUF量化、ModelFile自定义、多语言集成(Python/JS/Go)、RAG实战到Docker/K8s生产部署,8500字深度长文。
Ollama
本地部署
大模型
LLM
生产级
GGUF
量化
当 C/C++ 遇上 Rust:llama.cpp 与 LiteBox 深度架构对比——2026 年本地 LLM 推理框架的心智模型之战
编程
当 C/C++ 遇上 Rust:llama.cpp 与 LiteBox 深度架构对比——2026 年本地 LLM 推理框架的心智模型之战
2026-07-16 12:50:04 +0800 CST
view 123
深度对比 llama.cpp 与 LiteBox 两大本地 LLM 推理框架:GGUF 格式设计、K-Quant 量化内核、KV cache 管理、多后端抽象、并发架构,配完整代码实战与性能实测数据。
llama.cpp
LiteBox
GGUF
量化
KV cache
本地LLM
推理框架
Rust
C/C++
模型压缩
llama.cpp 深度实战:当 C/C++ 重写遇见端侧 LLM 推理——从 GGUF 量化到 Apple Silicon 38 tokens/s 的生产级完全指南(2026)
编程
llama.cpp 深度实战:当 C/C++ 重写遇见端侧 LLM 推理——从 GGUF 量化到 Apple Silicon 38 tokens/s 的生产级完全指南(2026)
2026-06-16 01:17:28 +0800 CST
view 591
llama.cpp 是端侧 LLM 推理的事实标准(180K+ Stars)。本文从源码架构、GGUF 格式、量化方法、跨平台后端、生产部署、性能优化到 DeepSeek V4 Flash 实战,全方位讲解本地 AI 推理。
llama.cpp
GGUF
量化
端侧推理
本地AI
C/C++
Apple Silicon
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
2
3
4
下一页