程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
SwanLab 深度实战:当国产开源 AI 训练跟踪工具遇见 W&B 替代方案——从 PyTorch 全链路监控到私有化部署、从硬件感知到多框架集成的生产级完全指南(2026)
编程
SwanLab 深度实战:当国产开源 AI 训练跟踪工具遇见 W&B 替代方案——从 PyTorch 全链路监控到私有化部署、从硬件感知到多框架集成的生产级完全指南(2026)
2026-06-21 18:24:22 +0800 CST
view 367
深度解析 SwanLab——国产开源 AI 训练跟踪工具,对标 W&B 和 MLflow。涵盖架构设计、PyTorch/Transformers/LLaMA Factory 集成、硬件全链路监控、实验对比、私有化部署(Docker/K8s)、SDK v0.8.0 性能优化等内容。
SwanLab
AI训练
PyTorch
W&B替代
MLflow
实验跟踪
硬件监控
私有化部署
科大讯飞开源SkillHub:企业级智能体技能注册中心
案例
科大讯飞开源SkillHub:企业级智能体技能注册中心
2026-05-06 07:34:11 +0800 CST
view 676
科大讯飞开源SkillHub企业级智能体技能注册中心,自托管私有化部署,支持发布/发现/管理技能包,RBAC权限控制,两级审核治理,完整审计日志,Java 21 + React 19 + PostgreSQL 16技术栈
AI Agent
Skill Registry
企业级
讯飞开源
技能管理
Rbac
私有化部署
AI-CS:开源AI智能客服系统,AI+人工一体、支持私有化部署
编程
AI-CS:开源AI智能客服系统,AI+人工一体、支持私有化部署
2026-05-14 07:02:13 +0800 CST
view 621
AI-CS是一款MIT协议开源的AI智能客服系统,Go+Next.js全栈架构,内置RAG知识库检索、多模型管理、实时草稿共享、数据报表和SEO官网,支持私有化部署,三步即可跑通。
AI客服
开源项目
Go
Next.js
RAG
私有化部署
chinese-poetry-api:40万首古诗词 API,Go高性能 REST+GraphQL双接口 + Docker一键部署
编程
chinese-poetry-api:40万首古诗词 API,Go高性能 REST+GraphQL双接口 + Docker一键部署
2026-07-22 07:39:47 +0800 CST
view 149
chinese-poetry-api(40万首古典诗词)Go高性能双接口:RESTful+GraphQL支持分页/筛选/自定义字段、简繁300ns切换、多维度精准检索(朝代/作者/体裁)、Docker一行命令部署(amd64/arm64)、内置IP限流+k6压测脚本(3000并发),私有化部署无第三方限制。
chinese-poetry-api
古诗词API
Go
GraphQL
RESTful
简繁转换
Docker
诗词数据库
GPL
私有化部署
后端
Coolify 深度拆解:一个 44K Star 的开源 PaaS 如何用 Laravel + Docker + SSH 重新定义「自托管部署」——从 Heroku 替代品到 280+ 一键服务的全栈架构哲学
编程
Coolify 深度拆解:一个 44K Star 的开源 PaaS 如何用 Laravel + Docker + SSH 重新定义「自托管部署」——从 Heroku 替代品到 280+ 一键服务的全栈架构哲学
2026-08-03 15:45:07 +0800 CST
view 39
深度拆解Coolify 44K Star开源PaaS架构:Laravel+Docker+SSH远程执行引擎、Traefik动态反向代理、Nixpacks自动构建、280+一键服务生态,附完整部署代码示例与性能优化实战指南
Coolify
开源PaaS
自托管
Vercel替代
Docker部署
Laravel
SSH远程管理
CI/CD
容器化部署
一键部署
RLX 深度拆解:MIT 如何用纯 Rust 写出一个「编译器+运行时合一」的 ML 框架——从 JAX 形状的张量 IR 到 15 种硬件后端的全栈工程哲学
编程
RLX 深度拆解:MIT 如何用纯 Rust 写出一个「编译器+运行时合一」的 ML 框架——从 JAX 形状的张量 IR 到 15 种硬件后端的全栈工程哲学
2026-08-04 01:43:34 +0800 CST
view 33
深度拆解MIT RLX纯Rust ML编译器架构:统一IR贯穿图优化到内核调度、15种硬件后端支持、JAX形自动微分、INT8量化感知训练、FPGA综合、Iroh NAT穿透分布式训练,附完整代码示例与性能优化实战指南
RLX
Rust
ML编译器
张量IR
自动微分
边缘计算
WebGPU
CUDA
Apple Silicon
量化部署
开源
里程碑!AI Agent 现在可以自己注册账号、购买域名、部署上线了
案例
里程碑!AI Agent 现在可以自己注册账号、购买域名、部署上线了
2026-05-04 07:37:15 +0800 CST
view 586
Cloudflare与Stripe合作推出Stripe Projects,让AI Agent可以自动完成账号创建、域名购买和应用部署,无需人工介入,标志着Agent能力边界的重要突破
Cloudflare
Stripe
AI Agent
自动化部署
无服务器
DevOps
oh-my-claudecode 深度实战:让 Claude Code 从"写代码"到"能交付"——2026 年多智能体编排完全指南
编程
oh-my-claudecode 深度实战:让 Claude Code 从"写代码"到"能交付"——2026 年多智能体编排完全指南
2026-05-26 16:07:56 +0800 CST
view 598
深入剖析 oh-my-claudecode 的四层架构(Hooks、Skills、Agents、State),详解模型路由策略,并通过完整实战案例展示从需求到部署的全生命周期编排。
AI编程
Claude Code
多智能体
Agent编排
自动化部署
大模型推理引擎实战:从 PagedAttention、Continuous Batching 到投机解码与量化部署,把 GPU 利用率榨到极限(vLLM/SGLang 2026 完全指南)
编程
大模型推理引擎实战:从 PagedAttention、Continuous Batching 到投机解码与量化部署,把 GPU 利用率榨到极限(vLLM/SGLang 2026 完全指南)
2026-07-09 09:17:24 +0800 CST
view 413
深入剖析 2026 年大模型推理引擎核心技术:PagedAttention、Continuous Batching、Chunked Prefill、RadixAttention 前缀缓存、投机解码与 AWQ/GPTQ/FP8 量化,结合 vLLM 与 SGLang 部署实战,把 GPU 利用率榨到极限的生产级完全指南。
LLM推理引擎
vLLM
SGLang
推理优化
量化部署
投机解码
GPU利用率
KV Cache
PagedAttention
Qwen3.8-Max 深度拆解:2.4万亿参数的MoE巨兽如何重新定义大模型天花板——从稀疏混合专家到1M上下文的全栈架构哲学
编程
Qwen3.8-Max 深度拆解:2.4万亿参数的MoE巨兽如何重新定义大模型天花板——从稀疏混合专家到1M上下文的全栈架构哲学
2026-08-03 17:14:27 +0800 CST
view 71
深度拆解Qwen3.8-Max 2.4万亿参数MoE大模型架构:稀疏混合专家路由机制、混合注意力1M上下文、GQA KV Cache优化、量化部署实战、vLLM推理优化,附完整代码示例与性能基准分析
Qwen3.8
MoE
大模型
阿里巴巴
通义千问
混合专家
1M上下文
稀疏注意力
量化部署
vLLM
开源
Mailcow:构建私有邮件服务器的开源利器
编程
Mailcow:构建私有邮件服务器的开源利器
2025-05-12 10:32:01 +0800 CST
view 2083
Mailcow是一个基于Docker的开源邮件服务器套件,提供功能齐全、易于部署和管理的邮件服务。它支持多种邮件协议和安全特性,适合个人和企业使用。Mailcow采用模块化架构,集成了多种组件,如Postfix、Dovecot和Rspamd,确保邮件服务的稳定和安全。用户可以通过图形化管理界面轻松管理多个域名和用户账户,并支持定期备份邮件数据。
邮件服务
开源软件
私有云
技术
安全
PostgreSQL 18 深度实战:I/O 子系统重构带来 3 倍性能提升——从 uuidv7() 到虚拟生成列的生产级完全指南(2026)
编程
PostgreSQL 18 深度实战:I/O 子系统重构带来 3 倍性能提升——从 uuidv7() 到虚拟生成列的生产级完全指南(2026)
2026-06-11 01:17:03 +0800 CST
view 550
PostgreSQL 18 带来 I/O 子系统重构(性能提升高达 3 倍)、虚拟生成列、uuidv7() 函数、OAuth 2.0 认证支持等重磅新特性。本文从架构原理到生产实战,带你全面掌握 PostgreSQL 18。
PostgreSQL 18
数据库
性能优化
I/O子系统
uuidv7
虚拟私有云成列
猛涨25K Star!LLMFit:一键检测你的电脑能跑哪些大模型
案例
猛涨25K Star!LLMFit:一键检测你的电脑能跑哪些大模型
2026-05-06 07:35:19 +0800 CST
view 666
25K+Star的LLMFit一键检测你的电脑能跑哪些大模型,Rust编写支持NVIDIA/AMD/Intel/Apple Silicon,智能量化推荐Q8到Q2,四维评分系统,TUI+CLI双模式
LLM部署
硬件检测
量化推荐
Rust
终端工具
本地部署
Ollama
【深度长文】agency-agents 深度解析:140+ 专业AI专家角色库——从角色定义规范到多Agent协作、从Claude Code集成到生产级团队搭建的完整技术指南(2026)
编程
【深度长文】agency-agents 深度解析:140+ 专业AI专家角色库——从角色定义规范到多Agent协作、从Claude Code集成到生产级团队搭建的完整技术指南(2026)
2026-07-04 05:12:12 +0800 CST
view 511
深度解析agency-agents(The Agency)核心架构、角色定义规范、多Agent协作机制、与Claude Code/Cursor的集成实战、生产级部署指南,助你快速搭建专业AI团队。
agency-agents
AI Agent
多Agent协作
Claude Code
专业角色库
AI助手
零部署成本
生产级部署
agency-agents 深度解析:140+ 专业AI专家角色库——零部署成本的多Agent协作框架与生产级部署指南(2026)
编程
agency-agents 深度解析:140+ 专业AI专家角色库——零部署成本的多Agent协作框架与生产级部署指南(2026)
2026-07-04 05:13:29 +0800 CST
view 378
深度解析agency-agents(The Agency)核心架构、角色定义规范、多Agent协作机制、与Claude Code/Cursor的集成实战、生产级部署指南,助你快速搭建专业AI团队。
agency-agents
AI Agent
多Agent协作
Claude Code
专业角色库
AI助手
零部署成本
生产级部署
vLLM 深度实战:当 PagedAttention 遇上生产级 LLM 推理——从内存革命到分布式部署的完全指南(2026)
编程
vLLM 深度实战:当 PagedAttention 遇上生产级 LLM 推理——从内存革命到分布式部署的完全指南(2026)
2026-06-10 10:17:56 +0800 CST
view 478
深度解析 vLLM 的核心架构 PagedAttention 和 Continuous Batching,从内存管理原理到生产级分布式部署的完全指南。
vLLM
LLM推理
PagedAttention
GPU优化
大模型部署
AI推理
2026年大模型推理框架横评:vLLM 0.5 vs TGI 2.0 vs TensorRT-LLM 1.8 vs DeepSpeed-MII 0.9
编程
2026年大模型推理框架横评:vLLM 0.5 vs TGI 2.0 vs TensorRT-LLM 1.8 vs DeepSpeed-MII 0.9
2026-07-10 17:44:16 +0800 CST
view 340
深度对比2026年四大主流LLM推理框架:vLLM 0.5、TGI 2.0、TensorRT-LLM 1.8、DeepSpeed-MII 0.9,涵盖PagedAttention、FP8量化、ZeRO-3、连续批处理等核心技术原理,配生产级代码示例与实测性能数据。
LLM
vLLM
TensorRT-LLM
TGI
DeepSpeed
推理优化
量化
AI部署
Dify v1.15.0 深度解析:difyctl CLI + 思维链可视化,手把手打造生产级 LLM 应用编排引擎
编程
Dify v1.15.0 深度解析:difyctl CLI + 思维链可视化,手把手打造生产级 LLM 应用编排引擎
2026-07-10 18:17:23 +0800 CST
view 518
深度解析 Dify v1.15.0 三大核心更新:difyctl CLI 将 AI 应用纳入 GitOps 管理,思维链可视化让 LLM 推理透明可追溯,慢模型轮询机制解决质量与速度的两难。附完整代码示例与生产部署指南。
Dify
LLM应用
工作流编排
difyctl
思维链可视化
Agent
RAG
GitOps
Kubernetes
生产部署
45+在线图片工具+REST API+AI修图:SnapOtter让NAS秒变个人图片处理中心
编程
45+在线图片工具+REST API+AI修图:SnapOtter让NAS秒变个人图片处理中心
2026-04-28 18:27:20 +0800 CST
view 1019
基于Docker的自托管图片编辑器SnapOtter:45+工具、REST API接入AI Agent、本地AI修图(OCR/背景移除/高清化)、数据永久存NAS。海康智存部署教程。
Docker
NAS
图片处理
AI修图
本地部署
REST API
OpenClaw
Hermes
Go Fiber v3 深度实战:当 Express 风格遇上 Go 高性能——从零基础到生产级 Web 开发的完全指南(2026)
编程
Go Fiber v3 深度实战:当 Express 风格遇上 Go 高性能——从零基础到生产级 Web 开发的完全指南(2026)
2026-06-11 02:16:42 +0800 CST
view 437
Go Fiber v3 深度实战教程,从零开始构建生产级 Web 应用,涵盖路由系统、中间件、数据库集成、性能优化和容器化部署
Go Fiber v3
Go Web 框架
Express 风格
高性能 Web 开发
生产级部署
vLLM 深度实战:当 PagedAttention 终结 GPU 显存浪费——从推理引擎原理到生产级高并发部署的完全指南(2026)
编程
vLLM 深度实战:当 PagedAttention 终结 GPU 显存浪费——从推理引擎原理到生产级高并发部署的完全指南(2026)
2026-06-11 03:16:24 +0800 CST
view 522
深度解析vLLM推理引擎的PagedAttention原理、连续批处理、量化优化,以及从零搭建生产级高并发部署的完整实战指南(2026版)
vLLM
PagedAttention
大模型推理
GPU优化
AI部署
SGLang 深度拆解:当 LLM 推理引擎决定「干掉全部慢吞吞的 GPU 服务器」——从 RadixAttention 到 GB300 NVL72 的 25 倍飞跃,一个 27K Star 的 Python 框架如何重新定义大模型推理的终极形态
编程
SGLang 深度拆解:当 LLM 推理引擎决定「干掉全部慢吞吞的 GPU 服务器」——从 RadixAttention 到 GB300 NVL72 的 25 倍飞跃,一个 27K Star 的 Python 框架如何重新定义大模型推理的终极形态
2026-08-04 19:22:29 +0800 CST
view 11
深度拆解SGLang 27K Star开源LLM推理框架:RadixAttention基数树前缀缓存实现3-8倍加速、自研FlashInfer CUDA Kernel、Prefill-Decode分离架构、GB300 NVL72上25倍性能飞跃、DFlash投机采样、多LoRA热切换,附完整部署与调优指南
SGLang
LLM推理
RadixAttention
FlashInfer
GPU加速
大模型部署
推理引擎
PagedAttention
PD分离
投机采样
CUDA
开源
vLLM 0.17 深度实战:PagedAttention与连续批处理如何把GPU吞吐量提升4倍——从KV Cache原理到生产级大模型推理部署完全指南(2026)
编程
vLLM 0.17 深度实战:PagedAttention与连续批处理如何把GPU吞吐量提升4倍——从KV Cache原理到生产级大模型推理部署完全指南(2026)
2026-06-11 03:17:21 +0800 CST
view 894
深度解析vLLM推理引擎的PagedAttention原理、连续批处理、量化优化,以及从零搭建生产级高并发部署的完整实战指南(2026版)
vLLM
PagedAttention
大模型推理
GPU优化
AI部署
MCP 2026-07-28 深度拆解:当 Anthropic 决定「干掉 MCP 的全部会话状态」——从有状态双连接到无状态请求响应,一个 18 个月的协议如何被彻底重写为企业级 AI 工具总线
编程
MCP 2026-07-28 深度拆解:当 Anthropic 决定「干掉 MCP 的全部会话状态」——从有状态双连接到无状态请求响应,一个 18 个月的协议如何被彻底重写为企业级 AI 工具总线
2026-08-04 19:47:29 +0800 CST
view 19
深度拆解MCP 2026-07-28第5版规范:从有状态双连接全面转向无状态架构的核心变革,Streamable HTTP传输层、基于请求头路由、可缓存列表结果、MCP Apps与Tasks扩展框架、OAuth 2.0企业级安全,附完整生产级代码示例与迁移指南
MCP
Model Context Protocol
无状态架构
AI工具集成
Anthropic
Streamable HTTP
OAuth 2.0
企业级部署
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
2
3
4
下一页