程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
OctaFuse Gateway:统一管理Coding Plan/Token Plan的开源AI网关,个人SaaS都能用
编程
OctaFuse Gateway:统一管理Coding Plan/Token Plan的开源AI网关,个人SaaS都能用
2026-06-22 21:00:01 +0800 CST
view 389
OctaFuse Gateway开源AI网关,把Provider、模型路由、API Key、用户、预算、用量审计、财务记账和管理后台放在一起。个人用可统一Coding Plan/Token Plan入口;做SaaS可变成LLM服务底座。支持OpenAI/Anthropic/Gemini多协议,Provider Key池统一调度多套额度,三层成本口径(metered/standard/charged),自带Admin后台+Playground+Simulator。
OctaFuse
AI网关
开源
LLM管理
多模型路由
SaaS
计费审计
Provider Key池
案例
手机盲盒系统支持微信小程序和h5
2024-11-18 16:12:48 +0800 CST
view 1794
该系统是一个功能全面的后台管理系统,设计用于管理商品、用户、订单等核心业务操作。通过模块化设计,系统提供用户管理、财务管理、商品管理、订单管理等多项功能,确保管理员能够高效完成各类管理任务。系统界面友好,功能布局合理,适合多种业务需求,帮助管理员处理日常运营事务,确保系统高效运行和用户良好体验。
管理系统
电子商务
后台管理
用户体验
财务管理
案例
地图标注管理系统
2024-11-19 09:14:52 +0800 CST
view 1915
地图标注管理系统是一个专业的工具,旨在帮助企业高效管理订单和地图标注。系统包括待跟进订单、地图管理、套餐设置、问题反馈、权限管理和账号管理等模块,提供灵活的操作和用户价值,提升企业运营效率和客户满意度。该系统适合需要综合管理地图和订单的企业,是提升服务质量的理想选择。
地图管理
订单管理
客户服务
企业管理
系统安全
LLM 推理的显存战争:从 PagedAttention 到统一内存架构——KV Cache 管理五世代深度解析(2026)
编程
LLM 推理的显存战争:从 PagedAttention 到统一内存架构——KV Cache 管理五世代深度解析(2026)
2026-06-15 11:18:23 +0800 CST
view 494
深度解析大模型推理中 KV Cache 管理的五世代演进:从连续分配到 PagedAttention,再到异构缓存、分布式 KV 和统一混合内存架构。结合 vLLM、SGLang、TensorRT-LLM 给出生产环境选型指南。
LLM
大模型
KVCache
PagedAttention
vLLM
SGLang
TensorRT
推理优化
显存管理
分布式
LLM推理框架2026选型完全指南:从vLLM到TensorRT-LLM,一次讲透四大引擎的架构哲学与生产级实战
编程
LLM推理框架2026选型完全指南:从vLLM到TensorRT-LLM,一次讲透四大引擎的架构哲学与生产级实战
2026-06-02 09:36:52 +0800 CST
view 732
从vLLM到TensorRT-LLM,一次讲透vLLM、SGLang、TensorRT-LLM、llama.cpp四大LLM推理框架的架构哲学、核心原理、生产级部署实战与选型决策树。
LLM
vLLM
TensorRT-LLM
llama.cpp
SGLang
推理优化
GPU
综合
全新 Nginx 在线管理平台
2024-11-19 04:18:33 +0800 CST
view 2049
该项目是一个基于Go和Vue.js的Nginx在线管理平台,提供流量统计、日志查看、配置文件编辑、自动检查和重载等功能。支持Docker部署和Linux安装,具备深色模式和国际化支持,旨在为IT从业者和爱好者提供便捷的Nginx管理工具。
开源
Web管理
服务器管理
开发工具
uv 深度解析:Rust 重写的 Python 工具链,如何一口气吃掉 pip/poetry/pyenv/pipx
编程
uv 深度解析:Rust 重写的 Python 工具链,如何一口气吃掉 pip/poetry/pyenv/pipx
2026-07-24 02:43:38 +0800 CST
view 187
从工程师视角深度拆解 Astral 的 uv:PubGrub 解析器、内容寻址全局缓存与硬链接、universal resolution 跨平台锁文件、PEP 723 内联脚本依赖,以及 Docker/CI 生产落地与从 pip/poetry 迁移的完整实战。
uv
Python
Rust
pip
poetry
依赖管理
PubGrub
包管理
Astral
工具链
EchoBird百灵鸟:2.2K Star开源AI桌面客户端,一个工具搞定所有AI Agent的安装配置与管理
编程
EchoBird百灵鸟:2.2K Star开源AI桌面客户端,一个工具搞定所有AI Agent的安装配置与管理
2026-06-18 08:34:13 +0800 CST
view 835
EchoBird(百灵鸟)是2200+ Star的开源AI桌面客户端,基于Tauri+Rust,图形界面一键安装管理12+ AI Agent工具(Claude Code/Codex/OpenClaw/Aider等),Model Nexus统一配置模型,内置llama.cpp/vLLM本地推理引擎,一键启动本地大模型。
EchoBird
AI桌面客户端
Agent管理
Tauri
Rust
开源
本地大模型
AI工具管理
百灵鸟
案例
百度订单系统手机微信多产品在线下单网站PHP单页竞价管理系统
2024-11-19 09:32:21 +0800 CST
view 2348
我们的订单系统和手机微信多产品在线下单网站是为现代企业设计的一体化解决方案,集成了订单管理、在线支付、客户管理和产品展示等功能。系统支持多种支付方式,实时库存显示,提供全面的订单管理和数据分析,帮助企业提升销售效率和优化广告投放策略,适用于电商、服务行业和广告投放企业。
订单管理
在线支付
客户管理
数据分析
电商解决方案
uv 深度实战:一个 Rust 二进制如何统一 Python 工具链——从 pip 到 poetry 再到 pyenv,一次把 Python 包管理讲透(2026)
编程
uv 深度实战:一个 Rust 二进制如何统一 Python 工具链——从 pip 到 poetry 再到 pyenv,一次把 Python 包管理讲透(2026)
2026-07-14 05:42:24 +0800 CST
view 142
深度拆解 uv:从 Python 工具链碎片化史、Rust 架构(全局缓存/PubGrub 求解/python-build-standalone/uv.lock),到 uv init/add/sync/run/python/uvx/workspaces 全命令实战、CI 与 Docker 多阶段加速,配完整可运行代码与 Astral 生态版图、避坑指南。
uv
Python
包管理
Astral
Rust
依赖管理
Poetry
pyenv
pip
uv 深度实战:Rust 写的 Python 包管理器,如何把依赖安装从分钟级干到秒级(附渐进式迁移与 monorepo 工作区实战)
编程
uv 深度实战:Rust 写的 Python 包管理器,如何把依赖安装从分钟级干到秒级(附渐进式迁移与 monorepo 工作区实战)
2026-07-08 02:15:19 +0800 CST
view 305
从架构原理到生产实战讲透 uv:全局内容寻址缓存、硬链接/写时复制虚拟环境、Rust 依赖解析器,附 pip/Poetry 渐进式迁移与 monorepo 工作区实战。
Python
uv
包管理
依赖管理
工程化
案例
API 管理系统售卖系统
2024-11-19 08:54:18 +0800 CST
view 2208
API管理系统是一款灵活的后台管理平台,专为处理订单、报价、卡密等业务流程而设计。系统提供控制台、权限管理、系统设置、商品数据库等模块,支持多平台集成和精细的权限控制,确保数据安全与操作规范。通过实时日志监控,管理员能够高效管理各类业务,提高管理效率和客户满意度。
后台管理
电商
系统集成
业务流程
数据管理
综合
一款功能强大的开源舆情管理系统
2024-11-18 20:51:24 +0800 CST
view 2898
思通舆情是一款功能强大的开源舆情管理系统,支持本地化部署,提供数据采集、智能预警和深度分析功能。系统通过多种数据源实时监测舆情,自动预警,生成分析报告,帮助用户及时应对危机。采用多种开源技术,确保高并发性和稳定性,适用于企业公关、政府机关和市场营销等多个场景。
舆情管理
开源软件
数据分析
人工智能
危机管理
Ansible 一个极其简单的 IT 自动化平台
综合
Ansible 一个极其简单的 IT 自动化平台
2024-11-19 03:58:56 +0800 CST
view 1644
Ansible是一个简单易用的IT自动化平台,支持通过SSH进行应用程序和系统的自动化部署、配置和管理。它使用YAML格式的剧本定义任务,具有智能补全、可靠性和丰富的插件,适用于服务器部署、应用部署、配置管理、自动化测试等多种场景。Ansible强调安全性,支持SSH免密登录,且可与多种工具结合使用,简化运维工作。
IT自动化
运维工具
开源软件
云管理
配置管理
深入解析pnpm的依赖管理机制:如何根治"幻影依赖"顽疾
编程
深入解析pnpm的依赖管理机制:如何根治"幻影依赖"顽疾
2025-03-30 09:15:39 +0800 CST
view 1650
本文深入探讨了pnpm的依赖管理机制,重点分析了幻影依赖问题及其对前端项目的影响。通过对比npm和pnpm的依赖管理方式,展示了pnpm如何通过硬链接和软链接的结合,实现依赖隔离、版本共存和空间效率的提升。文章还提供了迁移到pnpm的步骤及常见问题解决方案,展望了pnpm在未来Node.js生态中的重要性。
前端开发
包管理
软件工程
技术分析
依赖管理
2026年大模型推理框架横评:vLLM 0.5 vs TGI 2.0 vs TensorRT-LLM 1.8 vs DeepSpeed-MII 0.9
编程
2026年大模型推理框架横评:vLLM 0.5 vs TGI 2.0 vs TensorRT-LLM 1.8 vs DeepSpeed-MII 0.9
2026-07-10 17:44:16 +0800 CST
view 347
深度对比2026年四大主流LLM推理框架:vLLM 0.5、TGI 2.0、TensorRT-LLM 1.8、DeepSpeed-MII 0.9,涵盖PagedAttention、FP8量化、ZeRO-3、连续批处理等核心技术原理,配生产级代码示例与实测性能数据。
LLM
vLLM
TensorRT-LLM
TGI
DeepSpeed
推理优化
量化
AI部署
LLM推理引擎终极对决:vLLM vs TensorRT-LLM深度解析与2026生产环境选型指南
编程
LLM推理引擎终极对决:vLLM vs TensorRT-LLM深度解析与2026生产环境选型指南
2026-04-20 13:45:31 +0800 CST
view 886
深度对比vLLM与TensorRT-LLM两大LLM推理框架,从PagedAttention到Kernel Fusion,从量化技术到生产部署,助你做出正确的技术选型决策
LLM
vLLM
TensorRT-LLM
推理优化
大模型部署
量化技术
AI工程
2026 LLM 推理框架深度拆解:当 vLLM 0.5 决定「让 PagedAttention 吞掉最后一块显存碎片」——从 PagedAttention 到 FlashAttention 3.0,四大推理框架如何用「算子融合 + 量化混合 + 动态批处理」重新定义大模型推理的终极形态
编程
2026 LLM 推理框架深度拆解:当 vLLM 0.5 决定「让 PagedAttention 吞掉最后一块显存碎片」——从 PagedAttention 到 FlashAttention 3.0,四大推理框架如何用「算子融合 + 量化混合 + 动态批处理」重新定义大模型推理的终极形态
2026-08-06 06:16:32 +0800 CST
view 30
深度拆解2026年四大主流LLM推理框架:vLLM 0.5 PagedAttention进化、TGI 2.0流式输出优化、TensorRT-LLM 1.8算子融合、DeepSpeed-MII 0.9自动优化,含完整架构分析、代码实战、性能基准测试与成本计算
LLM
vLLM
TensorRT-LLM
推理框架
PagedAttention
量化
GPU
H100
大模型
DeepSpeed
TGI
2026大模型推理框架年度横评:vLLM/TGI/TensorRT-LLM/DeepSpeed-MII 架构深度解析与生产级选型指南
编程
2026大模型推理框架年度横评:vLLM/TGI/TensorRT-LLM/DeepSpeed-MII 架构深度解析与生产级选型指南
2026-06-18 17:54:54 +0800 CST
view 759
深度横评2026年四大主流大模型推理框架,涵盖PagedAttention架构、ContinuousBatching、算子融合、FP8量化、NVMe卸载等核心技术,配实测数据与生产级选型指南
大模型
LLM
推理框架
vLLM
TensorRT-LLM
TGI
DeepSpeed
GPU推理
AI部署
NVIDIA
LLM推理引擎深度实战:从PagedAttention到生产级部署,万字长文吃透2026年最关键的AI基础设施
编程
LLM推理引擎深度实战:从PagedAttention到生产级部署,万字长文吃透2026年最关键的AI基础设施
2026-06-27 12:44:29 +0800 CST
view 348
2026年LLM推理引擎深度实战:从PagedAttention、连续批处理、量化技术到生产级K8s部署,万字长文覆盖vLLM、SGLang、TensorRT-LLM、TGI四大框架架构原理与实测对比
LLM推理
vLLM
PagedAttention
SGLang
推理优化
TensorRT-LLM
生产部署
KV Cache
量化
KV Cache 显存优化深度解析:从 PagedAttention 到 2026 年最新压缩技术演进
编程
KV Cache 显存优化深度解析:从 PagedAttention 到 2026 年最新压缩技术演进
2026-08-01 15:47:00 +0800 CST
view 96
从第一性原理深度剖析 KV Cache 显存困境,系统拆解 PagedAttention 核心原理,对比 vLLM/TensorRT-LLM/SGLang 三大推理框架技术路线,涵盖 FP8/INT4 量化、前缀缓存、StreamingLLM 等 2026 年最新压缩技术,含完整代码示例与生产调优指南。
KV Cache
PagedAttention
vLLM
TensorRT-LLM
SGLang
LLM推理
GPU优化
显存优化
量化
深度学习
LLM 推理框架选型实战:vLLM、TensorRT-LLM、TGI、DeepSpeed-MII 深度对比与生产部署指南
编程
LLM 推理框架选型实战:vLLM、TensorRT-LLM、TGI、DeepSpeed-MII 深度对比与生产部署指南
2026-07-03 13:49:04 +0800 CST
view 390
深度对比 vLLM 0.5、TensorRT-LLM 1.8、TGI 2.0、DeepSpeed-MII 0.9 四大推理框架,从核心技术原理、性能数据、成本账本到生产部署实战,帮你做出正确的框架选型决策。
LLM
vLLM
TensorRT-LLM
TGI
DeepSpeed
推理优化
大模型部署
GPU优化
LMCache 实战:大模型推理的 KV Cache 终极优化方案
编程
LMCache 实战:大模型推理的 KV Cache 终极优化方案
2026-07-23 08:44:51 +0800 CST
view 167
LMCache 实战指南:通过智能 KV Cache 管理,实现 LLM 推理吞吐量最高 10 倍提升,显存占用降低 40%-60%。包含 vLLM/TGI 集成、分布式缓存、性能调优最佳实践。
LMCache
KV Cache
LLM推理优化
vLLM
RAG性能优化
万字深度解析 LMCache:当 LLM 推理遇见「KV 缓存革命」——从 Transformer 注意力机制到多层存储分级、从 vLLM/SGLang 集成到生产级 PD 拆分的完整技术指南(2026)
编程
万字深度解析 LMCache:当 LLM 推理遇见「KV 缓存革命」——从 Transformer 注意力机制到多层存储分级、从 vLLM/SGLang 集成到生产级 PD 拆分的完整技术指南(2026)
2026-07-02 08:42:52 +0800 CST
view 331
深度解析 LMCache 开源项目:LLM 推理 KV 缓存管理层,涵盖架构设计、多级存储、Multiprocess 模式、非前缀复用、PD 拆分等核心技术,15+ 可运行代码示例。
LMCache
LLM推理
KV缓存
vLLM
SGLang
AI推理优化
GPU优化
分布式缓存
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
2
3
...
40
下一页