程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
vLLM 与 SGLang 深度横评:两种推理范式的工程哲学对决
编程
vLLM 与 SGLang 深度横评:两种推理范式的工程哲学对决
2026-07-24 06:14:45 +0800 CST
view 279
深度对比vLLM与SGLang两大LLM推理引擎:PagedAttention vs RadixAttention,Continuous Batching原理,吞吐与延迟实战选型指南
vLLM
SGLang
LLM推理
PagedAttention
RadixAttention
Continuous Batching
GPU优化
推理引擎
Hermes Agent 深度实战:Nous Research 开源自进化 AI Agent——从闭环学习到生产级部署的完整指南
编程
Hermes Agent 深度实战:Nous Research 开源自进化 AI Agent——从闭环学习到生产级部署的完整指南
2026-05-23 13:15:28 +0800 CST
view 484
Hermes Agent 是由 Nous Research 开源的自进化 AI Agent 框架,内置学习闭环,能从经验中自动创建技能、持久化记忆、跨会话召回,越用越强。本文深度解析其架构设计、核心实现与生产级部署实践。
AI Agent
自进化
Nous Research
Python
LLM
编程
Gatus 深度实战:当主动式健康检查遇见开发者友好状态页——从多协议探测到40+告警通道、分布式存储的生产级完全指南(2026)
2026-06-17 05:52:13 +0800 CST
view 516
Gatus深度实战:当主动式健康检查遇见开发者友好状态页——从多协议探测到40+告警通道、分布式存储的生产级完全指南
Gatus
主动监控
健康检查
Go语言
DevOps
DiffusionGemma 深度实战:当离散文本扩散颠覆自回归霸权——从并行去噪原理到 MoE 架构、本地推理优化与混合范式展望的生产级完全指南(2026)
编程
DiffusionGemma 深度实战:当离散文本扩散颠覆自回归霸权——从并行去噪原理到 MoE 架构、本地推理优化与混合范式展望的生产级完全指南(2026)
2026-06-17 07:55:50 +0800 CST
view 377
Google开源DiffusionGemma:基于离散文本扩散的26B MoE模型,并行去噪实现4倍推理加速,双向注意力天然支持代码补全与行内编辑
DiffusionGemma
LLM
扩散模型
推理加速
MoE
微软VibeVoice深度解析:7.5Hz超低帧率+Next-Token Diffusion如何让AI一口气说90分钟——从TTS-1.5B到ASR-7B的语音AI全家桶实战指南
编程
微软VibeVoice深度解析:7.5Hz超低帧率+Next-Token Diffusion如何让AI一口气说90分钟——从TTS-1.5B到ASR-7B的语音AI全家桶实战指南
2026-07-06 04:43:23 +0800 CST
view 401
深度解析微软开源VibeVoice语音AI全家桶:7.5Hz超低帧率连续分词器+Next-Token Diffusion框架,TTS-1.5B单次生成90分钟4人对话,ASR-7B单次转录60分钟会议,Realtime-0.5B实现300ms实时响应。含完整代码实战与生产部署指南。
VibeVoice
微软
TTS
语音合成
ASR
开源
Next-Token Diffusion
语音AI
Claude Opus 4.8 深度实战:Dynamic Workflows 如何让单个开发者指挥百个 AI Agent 并行编码——从混合推理架构到生产级多智能体调度的完全指南(2026)
编程
Claude Opus 4.8 深度实战:Dynamic Workflows 如何让单个开发者指挥百个 AI Agent 并行编码——从混合推理架构到生产级多智能体调度的完全指南(2026)
2026-06-03 03:15:05 +0800 CST
view 456
深度解析 Claude Opus 4.8 的 Dynamic Workflows 多智能体并行编码能力,涵盖混合推理架构、Effort Control 推理控制、诚实性对齐改进,附完整 Python 调度器实现和代码审查流水线实战
Claude
Opus 4.8
Dynamic Workflows
AI Agent
混合推理
多智能体
LLM推理引擎全栈优化实战:从PagedAttention到投机解码,榨干GPU的每一滴算力
编程
LLM推理引擎全栈优化实战:从PagedAttention到投机解码,榨干GPU的每一滴算力
2026-05-17 10:21:56 +0800 CST
view 669
深度拆解LLM推理引擎核心技术栈:PagedAttention消除内存碎片、连续批处理榨干GPU算力、NUMA感知调度、混合精度量化、投机解码加速、算子融合、分布式推理架构,附代码示例与性能数据
LLM
vLLM
PagedAttention
推理优化
量化
投机解码
ContinuousBatching
GPU
万字深度:PagedAttention、连续批处理与投机解码——LLM推理优化七层实战
编程
万字深度:PagedAttention、连续批处理与投机解码——LLM推理优化七层实战
2026-05-17 10:22:13 +0800 CST
view 701
深度拆解LLM推理引擎核心技术栈:PagedAttention消除内存碎片、连续批处理榨干GPU算力、NUMA感知调度、混合精度量化、投机解码加速、算子融合、分布式推理架构,附代码示例与性能数据
LLM
vLLM
PagedAttention
推理优化
量化
投机解码
ContinuousBatching
GPU
DiffusionGemma 深度实战:当文本扩散重新定义本地AI推理——从'打字机'到'印刷机'的4倍速架构革命
编程
DiffusionGemma 深度实战:当文本扩散重新定义本地AI推理——从'打字机'到'印刷机'的4倍速架构革命
2026-06-12 17:21:39 +0800 CST
view 359
2026年6月Google发布DiffusionGemma,首个生产级文本扩散大模型,本地推理速度提升4倍。本文深入剖析其从自回归到并行生成的架构革命,附完整代码实战。
DiffusionGemma
文本扩散
本地AI
Gemma
大模型推理
扩散模型
Python
Ollama
向量数据库深度实战:当 RAG 遇见生产级向量检索——从 ANN 算法原理到 Milvus/Qdrant 性能对比、LangChain 集成与亿级数据落地的完全指南(2026)
编程
向量数据库深度实战:当 RAG 遇见生产级向量检索——从 ANN 算法原理到 Milvus/Qdrant 性能对比、LangChain 集成与亿级数据落地的完全指南(2026)
2026-06-17 17:25:03 +0800 CST
view 391
深度解析向量数据库核心原理、主流方案对比、ANN 算法优化、RAG 架构设计,并提供从零到生产的完整实战代码。
向量数据库
RAG
Milvus
Qdrant
ANN
向量数据库完全指南:RAG 生产级实战——从 ANN 算法原理到 Milvus/Qdrant 性能对比、LangChain 集成与亿级数据落地(2026 版)
编程
向量数据库完全指南:RAG 生产级实战——从 ANN 算法原理到 Milvus/Qdrant 性能对比、LangChain 集成与亿级数据落地(2026 版)
2026-06-17 17:26:02 +0800 CST
view 463
深度解析向量数据库核心原理、主流方案对比、ANN 算法优化、RAG 架构设计,并提供从零到生产的完整实战代码。
向量数据库
RAG
Milvus
Qdrant
ANN
DiffusionGemma 深度实战:当谷歌用图像扩散的逻辑重塑文本生成——从离散扩散原理到 4 倍推理加速的生产级完全指南(2026)
编程
DiffusionGemma 深度实战:当谷歌用图像扩散的逻辑重塑文本生成——从离散扩散原理到 4 倍推理加速的生产级完全指南(2026)
2026-06-17 23:28:33 +0800 CST
view 570
2026年6月谷歌开源DiffusionGemma,26B MoE参数仅激活3.8B,通过离散扩散实现4倍推理加速。本文从原理、架构、代码实战、性能优化全面深度解析这一范式级创新。
DiffusionGemma
谷歌
文本扩散
MoE
AI推理
Gemma
开源模型
离散扩散
并行生成
深度学习
ClickHouse 2026 深度实战:从列式存储到向量检索——OLAP 之王的全栈工程化完全指南
编程
ClickHouse 2026 深度实战:从列式存储到向量检索——OLAP 之王的全栈工程化完全指南
2026-05-24 10:34:46 +0800 CST
view 726
2026年ClickHouse深度实战完全指南:从列式存储原理到MergeTree引擎家族,从集群架构到最新向量检索能力,从数据摄入到生产级性能调优,覆盖12大核心主题的工程化长文。
ClickHouse
OLAP
数据库
列式存储
向量检索
编程
Gatus 深度实战:Go 语言编写的主动式健康监控状态页——从被动告警到主动探测的运维工程革命(2026)
2026-06-04 07:44:29 +0800 CST
view 418
Gatus 是一款 Go 编写的开源健康状态监控面板,通过主动探测替代被动告警,填补 Prometheus 监控体系的盲区。本文深入讲解架构原理、Suite 端到端检查、K8s 部署、Prometheus 集成与实战案例。
Go
Gatus
监控
DevOps
运维
健康检查
状态页
给 AI 编码代理装上「刹车」:从 destructive_command_guard 看命令级安全护栏的工程实现(2026)
编程
给 AI 编码代理装上「刹车」:从 destructive_command_guard 看命令级安全护栏的工程实现(2026)
2026-07-19 17:15:29 +0800 CST
view 143
以2026年7月登顶GitHub Trending的destructive_command_guard为切入点,讲透如何给Claude Code/Codex/Cursor等编码代理装上命令级安全护栏:从PreToolUse钩子原理、正则+AST命令解析、deny/ask/allow三层规则,到bwrap/Docker硬隔离与可运行代码。
AI编码代理
命令拦截
安全护栏
PreToolUse
沙箱
bwrap
Python
shell安全
GitNexus 深度实战:从零服务器架构到代码知识图谱——2026 年 AI Agent 代码理解完全指南
编程
GitNexus 深度实战:从零服务器架构到代码知识图谱——2026 年 AI Agent 代码理解完全指南
2026-05-24 21:51:49 +0800 CST
view 545
GitNexus 深度实战:零服务器代码知识图谱引擎,让 AI Agent 真正理解你的代码库。包含架构分析、代码实战、性能优化。
GitNexus
代码知识图谱
AI Agent
Graph RAG
代码理解
万字深度解析 Nano-vLLM:当1200行Python代码重构大模型推理——从架构设计到性能超越vLLM的完整技术指南(2026)
编程
万字深度解析 Nano-vLLM:当1200行Python代码重构大模型推理——从架构设计到性能超越vLLM的完整技术指南(2026)
2026-07-01 14:44:55 +0800 CST
view 302
Nano-vLLM:用约1200行Python代码实现的轻量级vLLM替代方案。深度解析KV Cache管理、GQA注意力、RoPE位置编码、Continuous Batching等核心技术,Benchmark性能超越vLLM 5.3%。适合学习大模型推理原理和内网轻量级部署。
Nano-vLLM
大模型推理
LLM
Tensor Parallelism
KV Cache
Continuous Batching
Python
PyTorch
Qwen2
开源项目
GitNexus 深度解析:35K Star 的零服务端代码智能引擎——从知识图谱构建到 Graph RAG 的全链路技术实战
编程
GitNexus 深度解析:35K Star 的零服务端代码智能引擎——从知识图谱构建到 Graph RAG 的全链路技术实战
2026-05-04 22:37:35 +0800 CST
view 623
GitNexus 35K Star 开源项目深度解析:12阶段DAG流水线构建代码知识图谱,Graph RAG让AI Agent真正理解代码架构,从符号提取到影响分析的全链路技术实战
GitNexus
知识图谱
代码智能
Graph RAG
MCP
代码分析
GitNexus 深度实战:零服务器代码知识图谱引擎——让 AI 真正"看懂"代码(2026)
编程
GitNexus 深度实战:零服务器代码知识图谱引擎——让 AI 真正"看懂"代码(2026)
2026-06-04 18:18:27 +0800 CST
view 418
深度解析 GitNexus 零服务器代码知识图谱引擎,让 AI 编程助手真正理解代码依赖关系。
GitNexus
代码知识图谱
AI编程
零服务器
GitHub Agentic Workflows 深度解析:Don Syme 操刀的下一代 AI 工作流引擎,4300+ Stars 的技术内幕与实战指南
编程
GitHub Agentic Workflows 深度解析:Don Syme 操刀的下一代 AI 工作流引擎,4300+ Stars 的技术内幕与实战指南
2026-06-26 11:46:19 +0800 CST
view 264
深度解析 GitHub Agentic Workflows(gh-aw):F# 之父亲自操刀的下一代 AI 工作流引擎。涵盖架构设计、安全机制、实战指南、设计模式与生产部署,4300+ Stars 的技术内幕全揭秘。
GitHub
GitHub Actions
AI Agent
gh-aw
Don Syme
工作流自动化
Continuous AI
开发者工具
A股美股全覆盖!这款开源Python实时股票行情SDK真香
案例
A股美股全覆盖!这款开源Python实时股票行情SDK真香
2026-05-05 19:04:40 +0800 CST
view 1141
TickPlus开源Python行情SDK,支持A股、港股、美股、期货实时行情,历史K线数据,技术指标,五档盘口,适合量化交易者和个人开发者
Python
股票
量化交易
SDK
数据接口
金融科技
TickPlus
PakePlus:Web项目打包桌面/手机应用,体积比Electron小20倍
编程
PakePlus:Web项目打包桌面/手机应用,体积比Electron小20倍
2026-05-26 12:32:52 +0800 CST
view 504
PakePlus是基于Tauri2的Web项目打包工具,将网站/Vue/React打包为桌面和手机应用,体积小于5M,性能比Electron快10倍,MIT开源,无需本地环境。
Tauri
跨平台
桌面应用
打包工具
开源
PakePlus
React
Vue
DiffusionGemma 深度实战:当文本生成进入「扩散纪元」——从离散扩散原理到本地高速推理的完全指南(2026)
编程
DiffusionGemma 深度实战:当文本生成进入「扩散纪元」——从离散扩散原理到本地高速推理的完全指南(2026)
2026-06-14 01:18:58 +0800 CST
view 705
2026年6月Google开源DiffusionGemma——基于离散扩散技术的文本生成模型,打破传统自回归范式,实现4倍生成速度提升。本文深入解析其架构原理、性能实测、代码实战与生产落地。
DiffusionGemma
离散扩散
文本生成
AI大模型
Google
并行推理
MoE架构
RAGFlow:81.1k Star开源RAG引擎,AI时代最强外脑
编程
RAGFlow:81.1k Star开源RAG引擎,AI时代最强外脑
2026-05-26 13:35:41 +0800 CST
view 625
RAGFlow是InfiniFlow团队(Milvus原班人马)开发的81.1k Star开源RAG引擎,专注解决文档解析问题,支持DeepDoc深度文档理解、可视化切片、Agentic RAG,可私有化部署。
RAG
开源
LLM
文档解析
AI应用
RAGFlow
InfiniFlow
Milvus
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
110
111
112
113
114
下一页