程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
LLM推理引擎深度实战:从PagedAttention到生产级部署,万字长文吃透2026年最关键的AI基础设施
编程
LLM推理引擎深度实战:从PagedAttention到生产级部署,万字长文吃透2026年最关键的AI基础设施
2026-06-27 12:44:29
view 433
2026年LLM推理引擎深度实战:从PagedAttention、连续批处理、量化技术到生产级K8s部署,万字长文覆盖vLLM、SGLang、TensorRT-LLM、TGI四大框架架构原理与实测对比
LLM推理
vLLM
PagedAttention
SGLang
推理优化
TensorRT-LLM
生产部署
KV Cache
量化
Playwright MCP 深度解析:让 AI Agent 拥有浏览器自动化能力——12.8K Star 的 OpenClaw 核心技能揭秘
编程
Playwright MCP 深度解析:让 AI Agent 拥有浏览器自动化能力——12.8K Star 的 OpenClaw 核心技能揭秘
2026-04-16 08:56:12
view 845
深度解析12.8K Star开源项目Playwright MCP,了解它如何让AI大模型获得浏览器自动化能力,成为OpenClaw的核心技能。
Playwright
MCP
浏览器自动化
AI Agent
OpenClaw
Skill
自动化测试
Ollama v0.20 Tool Calling 深度解析:让本地大模型真正「动起手来」——从协议原理到生产级多工具 Agent 系统实战
编程
Ollama v0.20 Tool Calling 深度解析:让本地大模型真正「动起手来」——从协议原理到生产级多工具 Agent 系统实战
2026-07-03 08:43:53
view 402
深度解析 Ollama v0.20 的 Tool Calling 能力:从 JSON Schema 协议原理、HTTP API 调用循环,到生产级多工具 Agent 系统的完整实战(天气查询/数据库查询/Web搜索),配套 LangChain4j 集成方案与安全防护策略。
Ollama
AI Agent
Tool Calling
本地大模型
LangChain4j
生产级实战
内核authencesn模板in-place优化的9年潜伏:CVE-2026-31431漏洞从crypto接口到root的完整攻击链
编程
内核authencesn模板in-place优化的9年潜伏:CVE-2026-31431漏洞从crypto接口到root的完整攻击链
2026-08-01 15:36:23
view 2065
深度剖析 CVE-2026-31431 Copy Fail 漏洞:从 AF_ALG 加密接口、authencesn in-place 优化、splice 零拷贝到 page cache 篡改的完整攻击链路,附内核源码解析、非破坏性检测工具、完整修复方案和 eBPF 监控实战。
Linux内核
CVE
漏洞分析
安全
提权
AF_ALG
page_cache
CryptoAPI
Kubernetes
容器安全
eBPF
Falco
Gemma 4 12B 深度实战:当无编码器统一多模态架构走进本地
编程
Gemma 4 12B 深度实战:当无编码器统一多模态架构走进本地
2026-06-14 17:49:21
view 654
深入解析 Google Gemma 4 12B 的无编码器统一多模态架构,从技术原理到生产部署的完整指南
Gemma4
Google
多模态
本地部署
AI
LLM
Encoder-Free
Kubernetes 1.36 ImageVolume GA:当 OCI 镜像从容器运行时滑向数据分发层——从 KEP-4639 到生产落地的完全指南(2026)
编程
Kubernetes 1.36 ImageVolume GA:当 OCI 镜像从容器运行时滑向数据分发层——从 KEP-4639 到生产落地的完全指南(2026)
2026-06-20 01:54:28
view 411
Kubernetes 1.36 ImageVolume GA 深度实战:从 OCI Artifacts 演进、KEP-4639 架构分析到构建数据镜像、subPath 挂载、AI 推理服务集成与生产优化
Kubernetes
ImageVolume
OCI
云原生
容器化
Ollama v0.20 Tool Calling 深度解析:本地 AI Agent 的最后一公里——JSON Schema 协议 × 生产级多工具实战 × 安全防护全指南
编程
Ollama v0.20 Tool Calling 深度解析:本地 AI Agent 的最后一公里——JSON Schema 协议 × 生产级多工具实战 × 安全防护全指南
2026-07-03 08:44:52
view 333
深度解析 Ollama v0.20 的 Tool Calling 能力,从 JSON Schema 协议原理到生产级多工具 Agent 实战,含安全防护与性能基准测试。
Ollama
AI Agent
Tool Calling
本地大模型
LangChain4j
KV Cache 显存优化深度解析:从 PagedAttention 到 2026 年最新压缩技术演进
编程
KV Cache 显存优化深度解析:从 PagedAttention 到 2026 年最新压缩技术演进
2026-08-01 15:47:00
view 250
从第一性原理深度剖析 KV Cache 显存困境,系统拆解 PagedAttention 核心原理,对比 vLLM/TensorRT-LLM/SGLang 三大推理框架技术路线,涵盖 FP8/INT4 量化、前缀缓存、StreamingLLM 等 2026 年最新压缩技术,含完整代码示例与生产调优指南。
KV Cache
PagedAttention
vLLM
TensorRT-LLM
SGLang
LLM推理
GPU优化
显存优化
量化
深度学习
LLRT 深度实战:AWS如何用 QuickJS + Rust 把 Serverless JavaScript 冷启动压到 1ms 以下——从架构原理到生产级部署全链路拆解
编程
LLRT 深度实战:AWS如何用 QuickJS + Rust 把 Serverless JavaScript 冷启动压到 1ms 以下——从架构原理到生产级部署全链路拆解
2026-08-16 17:19:15
view 138
深度拆解 AWS LLRT 轻量级 JavaScript 运行时:QuickJS + Rust 架构、1ms 冷启动、TypeScript 原生支持、child_process.execFile 生产级实战,配完整代码与性能基准
LLRT
Serverless
AWS Lambda
QuickJS
Edge Computing
冷启动
TypeScript
云原生
Kimi K2.6 深度解析:月之暗面最强代码模型的工程化突破与 Agent 集群实战
编程
Kimi K2.6 深度解析:月之暗面最强代码模型的工程化突破与 Agent 集群实战
2026-04-25 08:14:23
view 1366
深度解析月之暗面开源的Kimi K2.6模型:长程编码能力、Agent集群架构、代码实战与性能优化指南
Kimi
K2.6
月之暗面
AI编程
Agent集群
代码模型
开源模型
Gemma 4 12B 工程实践:Encoder-Free 统一多模态架构从原理到本地部署完全指南(2026)
编程
Gemma 4 12B 工程实践:Encoder-Free 统一多模态架构从原理到本地部署完全指南(2026)
2026-06-14 17:49:38
view 775
深入解析 Google Gemma 4 12B 的无编码器统一多模态架构,从技术原理到生产部署的完整指南
Gemma4
Google
多模态
本地部署
AI
LLM
Encoder-Free
Ollama Tool Calling × 本地 AI Agent:JSON Schema 协议 × 生产级多工具系统 × 安全防护实战
编程
Ollama Tool Calling × 本地 AI Agent:JSON Schema 协议 × 生产级多工具系统 × 安全防护实战
2026-07-03 08:45:53
view 348
深度解析 Ollama v0.20 Tool Calling,从协议原理到生产级多工具 Agent 实战,含天气查询、数据库查询、Web搜索三大实战案例与安全防护策略。
Ollama
AI Agent
Tool Calling
本地大模型
【深度长文】Ollama v0.20 工具调用实战:本地大模型 + JSON Schema + 生产级 Agent 系统搭建指南(2026)
编程
【深度长文】Ollama v0.20 工具调用实战:本地大模型 + JSON Schema + 生产级 Agent 系统搭建指南(2026)
2026-07-03 08:47:18
view 365
深度长文:Ollama v0.20 Tool Calling 从协议原理到生产级多工具 Agent 实战,含天气查询、数据库操作、Web搜索三大案例与安全防护策略(2026)。
Ollama
AI Agent
Tool Calling
本地大模型
生产级
AI编程Agent用10小时凿开CUDA护城河:推理战场的底层软件革命与程序员的真实机遇
编程
AI编程Agent用10小时凿开CUDA护城河:推理战场的底层软件革命与程序员的真实机遇
2026-08-10 14:47:15
view 155
深度拆解AI编程Agent用10小时为非英伟达芯片搭建底层软件栈的事件:从CUDA三层架构本质、Infinity Ignition Agent原理、推理战场竞争格局、到验证生态护城河,结合DeepSeek TileLang路径对比,给出程序员视角的机遇分析。
CUDA
AI Agent
推理芯片
Infinity
Ignition
d-Matrix
底层软件
GPU Kernel
芯片适配
护城河
DeerFlow 2.0 深度实战:字节跳动 49K Star 的超级智能体运行时——从 LangGraph DAG 到沙箱隔离的全链路架构解析
编程
DeerFlow 2.0 深度实战:字节跳动 49K Star 的超级智能体运行时——从 LangGraph DAG 到沙箱隔离的全链路架构解析
2026-05-07 04:37:34
view 1072
深度拆解字节跳动开源的 DeerFlow 2.0 超级智能体框架,从 LangGraph DAG 工作流到 11 层中间件链,从动态子智能体到 Docker/K8s 沙箱隔离,从三层记忆架构到六大 IM 渠道接入,全链路架构解析与生产级部署实战。
DeerFlow
AI Agent
LangGraph
字节跳动
智能体
沙箱
开源
编程
Headroom 深度实战:当 AI Agent 学会「上下文压缩」——从 Token 暴降 95% 原理到生产级实践的完全指南(2026)
2026-06-08 17:53:16
view 895
Headroom 是一个专为 AI Agent 设计的开源上下文压缩中间层,实测节省 60-95% Token,精度保留率高达 97%。本文从架构原理、六大压缩算法、MCP集成到生产级部署全面深度解析。涵盖 ContentRouter、SmartCrusher、可逆缓存等核心技术,配完整 Python 代码示例。适合 Claude Code、Cursor、LangChain 等工具链用户。Apache 2.0 开源可商用。
AI Agent,Token优化,上下文压缩,Headroom,LLM,Python,上下文管理,AI编程,生产实践
Headroom深度实战:当AI Agent学会「上下文减肥」——从60-95% Token压缩到零精度损失的工程完全指南(2026)
编程
Headroom深度实战:当AI Agent学会「上下文减肥」——从60-95% Token压缩到零精度损失的工程完全指南(2026)
2026-06-14 19:18:14
view 577
全面拆解Headroom上下文压缩工具的原理、架构、接入方式与生产实践,解决AI Agent开发的Token成本与上下文窗口痛点
AI Agent
上下文压缩
Headroom
Token优化
LLM
Headroom深度实战:AI Agent上下文压缩完全指南——60-95% Token节省的零精度损失方案(2026)
编程
Headroom深度实战:AI Agent上下文压缩完全指南——60-95% Token节省的零精度损失方案(2026)
2026-06-14 19:19:54
view 622
全面拆解Headroom上下文压缩工具的原理、架构、接入方式与生产实践,解决AI Agent开发的Token成本与上下文窗口痛点
AI Agent
上下文压缩
Headroom
Token优化
LLM
Next.js 16.2 深度实战:Vercel启动提速400%、Turbopack生产级打磨、AI Agent原生支持完全指南(2026)
编程
Next.js 16.2 深度实战:Vercel启动提速400%、Turbopack生产级打磨、AI Agent原生支持完全指南(2026)
2026-06-20 04:53:32
view 522
Next.js 16.2深度实战:启动速度提升400%、Turbopack 200+项修复、Server Fast Refresh默认开启、JSON.parse性能优化350%、AI Agent原生支持。从背景介绍到架构分析、从代码实战到生产部署,15000字完全指南。
Next.js
Turbopack
React
Server Components
AI Agent
Hermes Agent 深度实战:47K+ Star 的自进化 AI 智能体框架——从 Harness Engineering 到 Skill 闭环系统的全链路架构解析
编程
Hermes Agent 深度实战:47K+ Star 的自进化 AI 智能体框架——从 Harness Engineering 到 Skill 闭环系统的全链路架构解析
2026-05-07 07:06:42
view 957
深度解析 Hermes Agent 的自我进化机制、四层记忆架构、Skill 自动生成系统,以及从本地到生产的完整部署实践。
AI
Agent
开源
框架
自进化
字节跳动DeerFlow 2.0技术全解析:从零构建生产级AI智能体系统(2026完整实战指南)
编程
字节跳动DeerFlow 2.0技术全解析:从零构建生产级AI智能体系统(2026完整实战指南)
2026-05-19 11:18:35
view 775
DeerFlow 2.0是字节跳动开源的企业级多智能体协作框架,本文从架构设计、核心机制、源码分析、实战部署、性能调优五个维度进行深度解析。
DeerFlow
AI Agent
字节跳动
智能体框架
多智能体
MCP 深度拆解:当 AI Agent 学会「插拔」——Model Context Protocol 如何用 JSON-RPC 2.0 重写 AI 工具调用的心智模型
编程
MCP 深度拆解:当 AI Agent 学会「插拔」——Model Context Protocol 如何用 JSON-RPC 2.0 重写 AI 工具调用的心智模型
2026-07-15 09:42:17
view 334
从工程师视角深度拆解 MCP 协议:三大核心原语、传输层机制(stdio/SSE)、Python/TypeScript SDK 实战、生产架构设计,以及它对 AI Agent 生态的深远影响。
MCP
Model Context Protocol
JSON-RPC
AI Agent
Tool Calling
sqlite-vec 深度实战:当 SQLite 遇见向量搜索,AI 应用的轻量级记忆系统从此有了标准答案(2026)
编程
sqlite-vec 深度实战:当 SQLite 遇见向量搜索,AI 应用的轻量级记忆系统从此有了标准答案(2026)
2026-07-22 01:16:13
view 251
深度解析 sqlite-vec:一个纯C实现的SQLite向量搜索扩展,让SQLite直接支持语义搜索。涵盖核心架构、HNSW索引原理、SQL API完全指南、Python实战案例(知识库检索系统、AI Agent长期记忆、RAG系统)、性能优化、常见问题解决方案以及LangChain/LlamaIndex生态集成。
sqlite-vec
SQLite
向量搜索
AI应用
语义检索
RAG
Embedding
HNSW
AI Agent
vLLM 深度拆解:当 KV Cache 学会「分页」——用操作系统智慧重写 LLM 推理的心智模型
编程
vLLM 深度拆解:当 KV Cache 学会「分页」——用操作系统智慧重写 LLM 推理的心智模型
2026-07-15 10:13:07
view 299
深度拆解 vLLM 核心架构:从 PagedAttention 分页内存管理、Continuous Batching 动态调度,到 Speculative Decoding、Prefix Caching 等高级特性,配完整代码示例与生产部署指南。
vLLM
PagedAttention
LLM推理
深度学习
GPU优化
Continuous Batching
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
python
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
上一页
1
...
57
58
59
60
61
...
108
下一页