程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
PlayCanvas 深度实战:当浏览器遇上 WebGPU——从 WebGL 后时代到生产级 3D 游戏引擎的完全指南(2026)
编程
PlayCanvas 深度实战:当浏览器遇上 WebGPU——从 WebGL 后时代到生产级 3D 游戏引擎的完全指南(2026)
2026-06-09 16:51:07 +0800 CST
view 610
深入剖析 PlayCanvas 游戏引擎如何整合 WebGPU 技术,从 Compute Shader 粒子系统到 3D Gaussian Splatting 革命性渲染,带你掌握浏览器端 3D 游戏开发的最新技术栈。
WebGPU
PlayCanvas
3D游戏引擎
WebGL
Compute Shader
Gaussian Splatting
前端图形渲染
vLLM 深度拆解:当大模型推理学会「分页注意力」——PagedAttention、连续批处理与 V1 引擎如何重写 GPU 推理服务的心智模型
编程
vLLM 深度拆解:当大模型推理学会「分页注意力」——PagedAttention、连续批处理与 V1 引擎如何重写 GPU 推理服务的心智模型
2026-07-16 04:19:16 +0800 CST
view 215
从工程师视角深度拆解 vLLM:PagedAttention 分页注意力、连续批处理、V1 引擎架构、KV Cache 管理、量化与投机解码,配 OpenAI 兼容服务、引导解码与生产调优实战。
vLLM
PagedAttention
连续批处理
大模型推理
GPU推理服务
KV缓存
V1引擎
vLLM V1 深度拆解:当一个 LLM 推理引擎决定「从零重写」——PagedAttention、分离式推理与 LMCache 如何重新定义大模型服务的性能天花板
编程
vLLM V1 深度拆解:当一个 LLM 推理引擎决定「从零重写」——PagedAttention、分离式推理与 LMCache 如何重新定义大模型服务的性能天花板
2026-08-03 09:43:58 +0800 CST
view 100
深度拆解vLLM V1引擎四大核心架构:PagedAttention V2融合块表与前缀树缓存、分离式推理Prefill/Decode架构、KV Connector标准化接口、LMCache三层KV Cache管理,附完整部署配置与性能基准测试
vLLM
PagedAttention
LMCache
分离式推理
大模型推理
KV Cache
推理引擎
LLM Serving
GPU优化
开源
llama.cpp 深度拆解:一个纯 C++ 引擎如何让 180K Star 成为端侧 LLM 的事实标准——从 GGUF 格式到多后端架构的全栈解析
编程
llama.cpp 深度拆解:一个纯 C++ 引擎如何让 180K Star 成为端侧 LLM 的事实标准——从 GGUF 格式到多后端架构的全栈解析
2026-08-03 10:45:17 +0800 CST
view 123
深度拆解llama.cpp四大核心架构:GGUF模型格式设计、GGML计算引擎、8种多后端抽象层、K-Quant/I-Quant量化技术体系,附完整代码示例与性能基准测试
llama.cpp
GGUF
GGML
量化
端侧推理
LLM
C++
推理引擎
多后端
K-Quant
agentmemory 深度解析:AI Coding Agent 持久化记忆引擎——让 AI 助手真正「记住」你的项目
编程
agentmemory 深度解析:AI Coding Agent 持久化记忆引擎——让 AI 助手真正「记住」你的项目
2026-05-15 18:12:26 +0800 CST
view 1031
agentmemory 深度解析:让 AI Coding Agent 真正记住你的项目。混合检索引擎(BM25+Vector+Graph),95.2% R@5,本地免费 embedding,支持 Claude Code/Cursor/Codex 等所有主流 AI 编程工具。
AI Agent
记忆引擎
Claude Code
MCP
持久化记忆
Temporal 深度解析:分布式持久化执行引擎如何终结微服务编排的地狱模式
编程
Temporal 深度解析:分布式持久化执行引擎如何终结微服务编排的地狱模式
2026-04-18 02:45:06 +0800 CST
view 926
深度解析Temporal持久化执行引擎的架构设计、事件溯源机制、Go SDK实战与生产调优,从微服务编排困境到分布式容错的全链路技术剖析
Temporal
分布式
微服务
Go
工作流引擎
Ollama 融资 6500 万美元背后:2026 年本地大模型运行时生态深度拆解——为什么「极简主义」赢了
编程
Ollama 融资 6500 万美元背后:2026 年本地大模型运行时生态深度拆解——为什么「极简主义」赢了
2026-07-16 11:45:03 +0800 CST
view 334
从 Ollama 6500 万美元融资事件切入,深度拆解 2026 年本地大模型运行时生态:Ollama、llama.cpp、LocalAI、LiteBox、vLLM 的架构设计、性能对比、API 设计、适用场景,配完整代码实战与生产部署踩坑指南。
Ollama
本地大模型
llama.cpp
LocalAI
LiteBox
本地LLM
推理引擎
量化
GGUF
MCP
Temporal Replay 2026 深度实战:从持久化执行范式到 AI Agent 编排新纪元,手写生产级智能工作流引擎
编程
Temporal Replay 2026 深度实战:从持久化执行范式到 AI Agent 编排新纪元,手写生产级智能工作流引擎
2026-07-10 09:15:33 +0800 CST
view 264
深度剖析 Temporal Replay 2026 新特性:从 Durable Execution 核心原理、Serverless Workers、Standalone Activities、Workflow Streams 持久化流式输出,到 AI Agent 生态集成(Google ADK / OpenAI Agents SDK)、Worker Versioning、手写生产级 AI 数据摄取流水线。
Temporal
Durable Execution
AI Agent
Workflow Streams
Go
Serverless
分布式系统
工作流引擎
OmX深度解析:给OpenAI Codex装上工作流引擎,如何补全工程化短板
编程
OmX深度解析:给OpenAI Codex装上工作流引擎,如何补全工程化短板
2026-04-18 10:19:12 +0800 CST
view 1066
深度解析开源项目OmX如何为OpenAI Codex CLI添加工作流引擎,覆盖$deep-interview需求澄清、$ralplan架构规划、$ralph闭环验证、$team多Agent协作四大核心技能,揭示工程化才是AI编程工具的下一场仗。
OmX
oh-my-codex
Codex
OpenAI
AI编程
工作流引擎
多Agent协作
tmux
分布式 LLM 推理架构深度实战:从 vLLM 单节点到 llm-d 多集群的生产级演进全链路解析
编程
分布式 LLM 推理架构深度实战:从 vLLM 单节点到 llm-d 多集群的生产级演进全链路解析
2026-05-09 03:39:58 +0800 CST
view 732
深度解析分布式 LLM 推理架构,从 vLLM 单节点到 llm-d 多集群的生产级演进。涵盖推理引擎层、编排调度层、Kubernetes 多机多卡部署实战、性能优化技巧及成本优化策略。
LLM
vLLM
分布式推理
Kubernetes
Ray
推理引擎
WebAssembly 深度实战:从零构建跨平台游戏引擎的架构设计与性能优化
编程
WebAssembly 深度实战:从零构建跨平台游戏引擎的架构设计与性能优化
2026-04-18 10:45:51 +0800 CST
view 568
深度解析如何基于 WebAssembly 构建跨平台游戏引擎,涵盖 ECS 架构设计、渲染管线、资源系统、输入抽象、性能优化等核心环节,提供完整的 Rust 代码实现与 WebGPU/WebGL2 后端适配。
WebAssembly
Rust
游戏引擎
跨平台
WebGPU
MiroFish 深度解析:当群体智能引擎把"预测未来"做成了一门生意
编程
MiroFish 深度解析:当群体智能引擎把"预测未来"做成了一门生意
2026-04-09 03:35:55 +0800 CST
view 1097
深度解析MiroFish——北邮学生用Claude Code 10天写出的群体智能预测引擎,获陈天桥3000万投资的技术内幕、架构原理与商业前景
MiroFish
群体智能
多智能体
Agent
OASIS
数字沙盘
预测引擎
MiroFish 深度解析:群体智能预测引擎的技术革命——用数千个AI Agent构建平行数字世界,让未来在数字沙盘中预演
编程
MiroFish 深度解析:群体智能预测引擎的技术革命——用数千个AI Agent构建平行数字世界,让未来在数字沙盘中预演
2026-05-16 00:46:06 +0800 CST
view 615
MiroFish 深度解析:群体智能预测引擎的技术革命。本文从核心概念、架构分析、代码实战、算法解析、性能优化等维度,全面剖析 MiroFish 如何用数千个 AI Agent 构建平行数字世界,让未来在数字沙盘中预演。
MiroFish
群体智能
AI Agent
预测引擎
NVIDIA Nemotron-Cascade-2 深度实战:30B MoE 模型如何拿下 IMO/IOI 双料金牌——从稀疏专家架构到生产级部署的完全指南(2026)
编程
NVIDIA Nemotron-Cascade-2 深度实战:30B MoE 模型如何拿下 IMO/IOI 双料金牌——从稀疏专家架构到生产级部署的完全指南(2026)
2026-06-01 12:56:48 +0800 CST
view 515
深度解析NVIDIA Nemotron-Cascade-2-30B-A3B模型:30B总参、3B激活参数的MoE架构,如何拿下IMO/IOI双料金牌,以及如何从HuggingFace加载到vLLM生产部署。
NVIDIA
Nemotron
MoE
AI模型
GPU
深度学习
推理引擎
vLLM
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
5
6
7
下一页