程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Ollama 完全指南:本地大模型部署的事实标准——架构、实战与生产级部署(2026)
编程
Ollama 完全指南:本地大模型部署的事实标准——架构、实战与生产级部署(2026)
2026-06-05 04:13:52 +0800 CST
view 623
Ollama 本地大模型部署完全指南,从架构原理到生产级部署,涵盖 RAG 集成、性能优化、Docker/K8s 部署等核心内容。
Ollama
本地大模型
AI应用开发
Go语言
llama.cpp
Go 1.26 Goroutine Leak Profiler 深度解析:等了 12 年,一行代码揪出协程泄露
编程
Go 1.26 Goroutine Leak Profiler 深度解析:等了 12 年,一行代码揪出协程泄露
2026-05-05 13:54:01 +0800 CST
view 626
Go 1.26 引入 goroutine leak profiler,通过 GC 可达性分析检测协程泄露。支持 HTTP 端点实时检测、测试自动检测、生产监控告警,由 Uber 工程师贡献提案,等了 12 年终于落地。
Go
Golang
Goroutine
性能优化
pprof
内存泄露
资讯
定制开发一个App到底需要多少钱?
2024-11-19 01:06:47 +0800 CST
view 1905
定制开发App的成本受多种因素影响,包括功能复杂度、设计要求、开发团队、开发周期、测试与质量保证、维护与更新及市场推广。开发流程包括需求分析、UI/UX设计、开发、测试及上线审核。定制开发的优势在于精确满足需求、独特用户体验、性能优化、安全保障、易于维护和高投资回报。团队由营销专家、设计师和工程师组成,致力于提供优质服务。
App开发
定制开发
用户体验
市场推广
技术服务
万字深度解析 React Server Components:当同构渲染遇见「边界艺术」——从渲染模型到生产级性能优化的完整技术指南(2026)
编程
万字深度解析 React Server Components:当同构渲染遇见「边界艺术」——从渲染模型到生产级性能优化的完整技术指南(2026)
2026-07-02 15:44:03 +0800 CST
view 212
深度解析 React Server Components 的性能调优策略,涵盖边界划分艺术、流式渲染进阶、多级缓存体系构建,以及 Next.js App Router 实战优化,含 20+ 可运行代码示例
React Server Components
RSC
性能优化
Next.js
App Router
前端优化
流式渲染
llama.cpp 架构深度拆解:从 GGML 到 GGUF、量化内核到跨平台推理栈,一文吃透本地 LLM 推理工程化
编程
llama.cpp 架构深度拆解:从 GGML 到 GGUF、量化内核到跨平台推理栈,一文吃透本地 LLM 推理工程化
2026-08-01 08:18:35 +0800 CST
view 121
深度拆解 llama.cpp 全栈架构:从 GGML 到 GGUF 格式演进、K-Quant 量化内核原理、ggml 张量计算图层、libllama 推理逻辑层、10+ 硬件后端调度,以及生产调优实战与踩坑清单。
llama.cpp
GGUF
GGML
量化
本地LLM
CPU推理
GPU加速
跨平台
K-Quant
html-ppt-skill:AI原生的HTML演示文稿技能,20天2600+Star
案例
html-ppt-skill:AI原生的HTML演示文稿技能,20天2600+Star
2026-05-06 17:02:28 +0800 CST
view 1456
20天2600+Star的神级skill!html-ppt-skill让AI帮你做PPT,输出纯HTML文件,零构建零依赖。36套主题、15套模板、31种布局、47个动效、像素级演讲者模式
AI PPT
HTML演示
Agent Skill
Claude Code
演示文稿
零依赖
演讲者模式
腾讯混元开源 HyOCR-1.5 深度解读:端到端 OCR 的工程哲学与 DFlash 投机解码完全指南
编程
腾讯混元开源 HyOCR-1.5 深度解读:端到端 OCR 的工程哲学与 DFlash 投机解码完全指南
2026-07-21 12:46:56 +0800 CST
view 175
2026年7月腾讯混元开源HyOCR-1.5端到端OCR大模型,1B参数OmniDocBench 94.74分霸榜。深度拆解DFlash投机解码6.37倍加速、Agentic Data Flow自动化数据闭环、三阶段训练配方,以及vLLM/llama.cpp全场景部署实战。
HyOCR
HunyuanOCR
腾讯混元
端到端OCR
DFlash
投机解码
多模态模型
文档解析
文字识别
视觉语言模型
OmniDocBench
vLLM
llama.cpp
深度学习
UniApp H5跨域问题终极解决方案:两种代理配置方式详解
编程
UniApp H5跨域问题终极解决方案:两种代理配置方式详解
2025-09-01 20:46:27 +0800 CST
view 1819
本文介绍了在UniAppH5项目中解决跨域问题的两种方法:通过修改manifest.json文件和创建vue.config.js文件进行代理配置。详细说明了每种方法的配置步骤、参数解释及注意事项,并提供了请求封装的示例代码,帮助开发者提高代码的可维护性和复用性。
前端开发
UniApp
跨域问题
API
开发工具
Node.js 26 深度实战:当 TypeScript 第一次"裸奔"进 V8——Type Stripping 如何用"只擦除不转译"重写 Node 跑 TS 的心智模型
编程
Node.js 26 深度实战:当 TypeScript 第一次"裸奔"进 V8——Type Stripping 如何用"只擦除不转译"重写 Node 跑 TS 的心智模型
2026-07-15 06:42:33 +0800 CST
view 215
TypeScript 第一次无需编译直接跑进 V8:拆解 Node.js 26 Type Stripping 的"只擦除不转译"原理、能力边界(enum/namespace/装饰器为何报错)、与 tsx/ts-node/tsc 的取舍,附可运行代码与工程迁移实战。
Node.js 26
TypeScript
Type Stripping
原生 TS
类型擦除
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
编程
Ollama 深度拆解:当大模型变成「一个文件」——GGUF、4-bit 量化与 llama.cpp 计算图如何重写本地推理的心智模型
2026-07-15 08:45:14 +0800 CST
view 254
从工程师视角深度拆解 Ollama 与本地大模型推理引擎:GGUF 单文件格式、K-quant/IQ-quant 量化家族、内存带宽墙、llama.cpp 计算图与 KV Cache,配 Modelfile、Python/Go 流式客户端与自量化实战。
Ollama
llama.cpp
GGUF
本地推理
大模型量化
KV Cache
百度秒哒App上线:手机上对话就能搓出一个APP,从想法到安装包全链路搞定
编程
百度秒哒App上线:手机上对话就能搓出一个APP,从想法到安装包全链路搞定
2026-05-14 12:49:04 +0800 CST
view 953
百度秒哒在Create 2026推出App版,手机对话即可生成可安装APP,从需求文档到打包签名发布全链路AI搞定,8岁小朋友用对话搓出拼伞小程序,普通人的创造力被AI解锁。
AI编程
百度秒哒
Vibe Coding
无代码
App开发
DeepSeek-R1边缘推理实战:从云端独占到本地智能的范式转移
编程
DeepSeek-R1边缘推理实战:从云端独占到本地智能的范式转移
2026-05-19 12:42:27 +0800 CST
view 554
2026年,边缘AI不再只是云端模型的精简版。本文深入剖析DeepSeek-R1 CPU版的技术原理,从模型蒸馏、量化技术的底层原理到生产环境的完整部署方案,提供可直接落地的代码和可量化的性能数据。
DeepSeek
R1
边缘计算
AI推理
模型蒸馏
量化
llama.cpp
Ollama
端侧AI
TiDB HTAP 架构深度拆解:从 Raft 共识到列存 MPP,手写一个混合负载查询引擎
编程
TiDB HTAP 架构深度拆解:从 Raft 共识到列存 MPP,手写一个混合负载查询引擎
2026-08-02 20:14:17 +0800 CST
view 72
从第一性原理深度剖析TiDB HTAP架构:Raft Multi-Group共识协议、Percolator 2PC分布式事务、TiKV行存与TiFlash列存并存设计、MPP执行引擎、查询优化器的CBO代价模型,附完整Docker部署与性能调优方法论
TiDB
HTAP
分布式数据库
Raft
TiFlash
TiKV
列存
MPP
MySQL兼容
性能优化
Papacito OS:本地转录+图片OCR+搜索,开源AI第二大脑有点实用
编程
Papacito OS:本地转录+图片OCR+搜索,开源AI第二大脑有点实用
2026-06-20 13:43:05 +0800 CST
view 345
Papacito OS 是一个本地优先的个人知识系统,基于 whisper.cpp 本地语音转文字 + Tesseract 图片 OCR + SQLite 关键词搜索。100% Local,适合会议录音、截图、白板、零散笔记整理。
AI
第二大脑
本地优先
知识管理
转录
OCR
语音转文字
开源
Next.js
whisper.cpp
Tesseract
WinApps:让 Linux 流畅运行 Windows 应用,狂揽 1.5 万 Star
编程
WinApps:让 Linux 流畅运行 Windows 应用,狂揽 1.5 万 Star
2026-07-09 11:57:08 +0800 CST
view 183
WinApps在Linux上运行Windows应用,Word/Excel/Photoshop像原生一样独立窗口,VM投射+文件共享,15400+ Star,一行命令安装。
Linux
Windows
WinApps
开源
虚拟机
兼容性
Office
跨平台
Docker
llama.cpp 深度拆解:一个纯 C++ 引擎如何让 180K Star 成为端侧 LLM 的事实标准——从 GGUF 格式到多后端架构的全栈解析
编程
llama.cpp 深度拆解:一个纯 C++ 引擎如何让 180K Star 成为端侧 LLM 的事实标准——从 GGUF 格式到多后端架构的全栈解析
2026-08-03 10:45:17 +0800 CST
view 65
深度拆解llama.cpp四大核心架构:GGUF模型格式设计、GGML计算引擎、8种多后端抽象层、K-Quant/I-Quant量化技术体系,附完整代码示例与性能基准测试
llama.cpp
GGUF
GGML
量化
端侧推理
LLM
C++
推理引擎
多后端
K-Quant
Next.js 15 深度实战:当 App Router 遇上 Turbopack —— 从缓存革命到生产级性能优化的完全指南(2026)
编程
Next.js 15 深度实战:当 App Router 遇上 Turbopack —— 从缓存革命到生产级性能优化的完全指南(2026)
2026-06-09 21:48:40 +0800 CST
view 573
Next.js 15 深度实战指南,详解 Turbopack、Partial Prerendering、use() Hook 等核心特性,从架构原理到生产级优化的完整教程。
Next.js 15
Turbopack
React
App Router
性能优化
GitHub 8K+ Star的AI PPT工具:生成的不是图片,是真正可以编辑的PowerPoint
编程
GitHub 8K+ Star的AI PPT工具:生成的不是图片,是真正可以编辑的PowerPoint
2026-04-28 03:24:21 +0800 CST
view 1076
PPT Master是一个8K+ Star的开源AI PPT工具,通过SVG→DrawingML转换生成真正可编辑的PowerPoint原生对象,不是图片。支持PDF、Word、网页等多种输入,本地处理数据不出本机,最低$0.08/份。
PPT
AI工具
开源项目
GitHub
PowerPoint
Ollama 融资 6500 万美元背后:2026 年本地大模型运行时生态深度拆解——为什么「极简主义」赢了
编程
Ollama 融资 6500 万美元背后:2026 年本地大模型运行时生态深度拆解——为什么「极简主义」赢了
2026-07-16 11:45:03 +0800 CST
view 319
从 Ollama 6500 万美元融资事件切入,深度拆解 2026 年本地大模型运行时生态:Ollama、llama.cpp、LocalAI、LiteBox、vLLM 的架构设计、性能对比、API 设计、适用场景,配完整代码实战与生产部署踩坑指南。
Ollama
本地大模型
llama.cpp
LocalAI
LiteBox
本地LLM
推理引擎
量化
GGUF
MCP
当 C/C++ 遇上 Rust:llama.cpp 与 LiteBox 深度架构对比——2026 年本地 LLM 推理框架的心智模型之战
编程
当 C/C++ 遇上 Rust:llama.cpp 与 LiteBox 深度架构对比——2026 年本地 LLM 推理框架的心智模型之战
2026-07-16 12:50:04 +0800 CST
view 209
深度对比 llama.cpp 与 LiteBox 两大本地 LLM 推理框架:GGUF 格式设计、K-Quant 量化内核、KV cache 管理、多后端抽象、并发架构,配完整代码实战与性能实测数据。
llama.cpp
LiteBox
GGUF
量化
KV cache
本地LLM
推理框架
Rust
C/C++
模型压缩
Ollama 0.30 深度实战:当本地 LLM 推理有了双引擎——从 llama.cpp + MLX 双后端到 Gemma 4 QAT、从 Cohere2 MoE 到 ollama launch AI 编程助手生态的生产级完全指南(2026)
编程
Ollama 0.30 深度实战:当本地 LLM 推理有了双引擎——从 llama.cpp + MLX 双后端到 Gemma 4 QAT、从 Cohere2 MoE 到 ollama launch AI 编程助手生态的生产级完全指南(2026)
2026-06-21 08:54:17 +0800 CST
view 652
Ollama 0.30 深度解析:双引擎推理架构、Gemma 4 QAT、Cohere2 MoE、ollama launch 生态与生产级部署完全指南
Ollama
LLM
本地推理
AI编程
llama.cpp
MLX
Gemma
开源
Temporal Replay 2026 深度解析:Serverless Workers、Workflow Streams 与持久化执行新范式
编程
Temporal Replay 2026 深度解析:Serverless Workers、Workflow Streams 与持久化执行新范式
2026-07-14 00:44:21 +0800 CST
view 202
2026年5月Temporal Replay大会发布重磅更新:Serverless Workers、Standalone Activities、Workflow Streams等新特性,从架构原理、代码实战、生产避坑三个维度深度拆解分布式持久化执行新范式。
Temporal
Replay 2026
Serverless Workers
Workflow Streams
Standalone Activities
Durable Execution
分布式系统
AI Agent
OpenClaw Skills 系统工程化深度解析:从 SKILL.md 动态注入到 MetaSkill DAG 的全链路架构
编程
OpenClaw Skills 系统工程化深度解析:从 SKILL.md 动态注入到 MetaSkill DAG 的全链路架构
2026-08-01 01:17:16 +0800 CST
view 100
深度解析OpenClaw Skills系统的核心架构:Tool/Skill/Plugin三角关系、SKILL.md动态注入机制、Token预算管理、Skill Workshop自举能力、MetaSkill DAG确定性编排,以及完整的代码实战示例。
OpenClaw
Skills系统
MetaSkill
SKILL.md
AI Agent
Tool
Plugin
架构设计
XY-Serve 深度实战:当昇腾 NPU 终于学会「驯服动态负载」——从元原语分解、Token级调度到 Attention/Linear 双内核优化的完整工程指南(2026)
编程
XY-Serve 深度实战:当昇腾 NPU 终于学会「驯服动态负载」——从元原语分解、Token级调度到 Attention/Linear 双内核优化的完整工程指南(2026)
2026-07-21 08:20:26 +0800 CST
view 158
华为联合清华大学开源的 XY-Serve 论文被 ASPLOS 2026 录用,解决了 NPU 上高效运行动态 LLM 负载的核心挑战。吞吐量提升95%,Attention 内核提速21.5%,Linear 内核提速14.6%。
XY-Serve
华为昇腾
NPU
LLM推理
Meta-Attention
虚拟填充
动态负载
ASPLOS
AI基础设施
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
3
4
5
6
7
...
49
下一页