程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
ego lite 深度拆解:让浏览器成为 AI Agent 的「操作系统」——Space 隔离架构、语义快照与 ACP 协议全解
编程
ego lite 深度拆解:让浏览器成为 AI Agent 的「操作系统」——Space 隔离架构、语义快照与 ACP 协议全解
2026-07-31 08:44:29 +0800 CST
view 127
深度拆解 ego lite:如何把浏览器改造为 AI Agent 的通用基础设施。Space 隔离架构、语义快照技术、JavaScript 批量执行、ACP 开放协议全解析,以及 70% 用户留存的工程实践。
AI Agent
浏览器自动化
Space隔离
Snapshot
ACP协议
Chromium
Token优化
PyTorch 2.13 深度解析:一次把框架换心与跨平台革命讲透
编程
PyTorch 2.13 深度解析:一次把框架换心与跨平台革命讲透
2026-07-14 01:14:51 +0800 CST
view 393
2026年7月PyTorch 2.13重磅发布:FlexAttention在Apple Silicon实现12倍加速、CuTeDSL提供CUTLASS级GEMM代码生成、融合损失函数将大词汇量训练峰值显存削减4倍、torchcomms革新分布式通信后端、ExecuTorch正式并入核心,深度拆解六大核心更新与实战代码。
PyTorch
深度学习
机器学习框架
GPU
Distributed Training
FlexAttention
CUDA
GEMM
ROCm
Apple Silicon
MPS
编程
Flowise 完全指南:低代码可视化 AI Agent 构建平台——从架构原理到生产级部署(2026)
2026-06-05 03:42:39 +0800 CST
view 1226
Flowise 完全指南:从架构原理到生产级部署。详解可视化AI Agent构建、RAG全流程、多智能体系统、性能优化与云服务部署。
Flowise
AI Agent
低代码
LangChain
RAG
多智能体
万字深度解析 CloakBrowser:当反爬虫遇见「源码级隐身革命」——从 Chromium 指纹检测机制到 59 处 C++ 补丁、从浏览器自动化到 AI Agent 操控的完整技术指南(2026)
编程
万字深度解析 CloakBrowser:当反爬虫遇见「源码级隐身革命」——从 Chromium 指纹检测机制到 59 处 C++ 补丁、从浏览器自动化到 AI Agent 操控的完整技术指南(2026)
2026-07-02 09:16:05 +0800 CST
view 410
深度解析 CloakBrowser——2026年革命性反爬虫解决方案,59处C++源码补丁实现真正的浏览器级隐身,通过所有主流反机器人检测系统。
CloakBrowser
反爬虫
Chromium指纹
浏览器自动化
Playwright
Puppeteer
Web Scraping
Python
JavaScript
AI Agent
Odysseus 深度实战:当 YouTuber 之王用代码掀翻云端 AI 霸权——从自托管工作空间到生产级本地 Agent 的完全指南(2026)
编程
Odysseus 深度实战:当 YouTuber 之王用代码掀翻云端 AI 霸权——从自托管工作空间到生产级本地 Agent 的完全指南(2026)
2026-06-13 19:51:26 +0800 CST
view 653
PewDiePie开源的Odysseus自托管AI工作空间深度实战指南:从架构设计、LLM集成、Agent系统、记忆系统到安全架构的完全解析
Odysseus
自托管AI
PewDiePie
Agent
MCP
本地LLM
FastAPI
ChromaDB
LangGraph 深度实战:从状态图到生产级 Agent 系统——用图结构重新定义 AI 工程边界
编程
LangGraph 深度实战:从状态图到生产级 Agent 系统——用图结构重新定义 AI 工程边界
2026-04-14 10:54:15 +0800 CST
view 971
深度解析 LangGraph 核心架构与实战用法:状态机、节点/边设计、Human-in-the-Loop、多 Agent 协作、生产级持久化部署,附代码审查 Agent 完整案例,5000字+实战长文。
LangGraph
AI Agent
Python
LangChain
多智能体
OpenAI Codex 2026 全面深度实战:从安装到成为你的「AI 编程队友」
编程
OpenAI Codex 2026 全面深度实战:从安装到成为你的「AI 编程队友」
2026-05-26 15:39:03 +0800 CST
view 843
2026年5月OpenAI Codex迎来史上最大更新:CLI、移动端、Chrome插件全面上线。本文从零开始,全面解析Codex的核心用法,通过10个实战案例教你把它变成真正的「AI编程队友」。
OpenAI
Codex
AI编程
ChatGPT
GPT-5
AI Agent
自动化
开发工具
CLI
Flowise 深度实战:当 LangChain 遇上低代码——从架构原理到生产级 AI 工作流完全指南(2026)
编程
Flowise 深度实战:当 LangChain 遇上低代码——从架构原理到生产级 AI 工作流完全指南(2026)
2026-06-05 20:08:17 +0800 CST
view 419
Flowise 是一个开源的、可视化的低代码工具,专门用来构建基于大语言模型的应用程序或智能体(AI Agent)。本文深入剖析 Flowise 的架构设计、核心组件、实战案例,并提供生产级部署的最佳实践。
Flowise
LangChain
低代码
AI Agent
LLM
MemPalace 深度实战:54K+ Star 本地优先 AI 记忆系统,从「记忆宫殿」架构到生产部署完全指南——2026 年 AI Agent 长期记忆终极解决方案
编程
MemPalace 深度实战:54K+ Star 本地优先 AI 记忆系统,从「记忆宫殿」架构到生产部署完全指南——2026 年 AI Agent 长期记忆终极解决方案
2026-06-27 07:44:31 +0800 CST
view 300
MemPalace 深度实战指南:54K+ Star 本地优先 AI 记忆系统,96.6% R@5 召回率,宫殿架构、AAAK 压缩、29+ MCP 工具、完整代码实战与生产部署。
MemPalace
AI记忆
长期记忆
MCP
向量数据库
ChromaDB
本地优先
AI Agent
Chrome DevTools MCP 深度实战:当 AI 学会「看懂」网页——从 CDP 协议到生产级浏览器自动化的完全指南(2026)
编程
Chrome DevTools MCP 深度实战:当 AI 学会「看懂」网页——从 CDP 协议到生产级浏览器自动化的完全指南(2026)
2026-06-14 15:18:38 +0800 CST
view 400
深入剖析 Chrome DevTools MCP 的技术架构、协议设计、实战场景和性能优化,带你从原理到生产级部署,完整掌握这个改变 AI-浏览器交互范式的技术。
Chrome DevTools
MCP
CDP
AI Agent
浏览器自动化
前端调试
LLM推理引擎深度实战:从PagedAttention到生产级部署,万字长文吃透2026年最关键的AI基础设施
编程
LLM推理引擎深度实战:从PagedAttention到生产级部署,万字长文吃透2026年最关键的AI基础设施
2026-06-27 12:44:29 +0800 CST
view 339
2026年LLM推理引擎深度实战:从PagedAttention、连续批处理、量化技术到生产级K8s部署,万字长文覆盖vLLM、SGLang、TensorRT-LLM、TGI四大框架架构原理与实测对比
LLM推理
vLLM
PagedAttention
SGLang
推理优化
TensorRT-LLM
生产部署
KV Cache
量化
Ollama v0.20 Tool Calling 深度解析:让本地大模型真正「动起手来」——从协议原理到生产级多工具 Agent 系统实战
编程
Ollama v0.20 Tool Calling 深度解析:让本地大模型真正「动起手来」——从协议原理到生产级多工具 Agent 系统实战
2026-07-03 08:43:53 +0800 CST
view 295
深度解析 Ollama v0.20 的 Tool Calling 能力:从 JSON Schema 协议原理、HTTP API 调用循环,到生产级多工具 Agent 系统的完整实战(天气查询/数据库查询/Web搜索),配套 LangChain4j 集成方案与安全防护策略。
Ollama
AI Agent
Tool Calling
本地大模型
LangChain4j
生产级实战
Ollama v0.20 Tool Calling 深度解析:本地 AI Agent 的最后一公里——JSON Schema 协议 × 生产级多工具实战 × 安全防护全指南
编程
Ollama v0.20 Tool Calling 深度解析:本地 AI Agent 的最后一公里——JSON Schema 协议 × 生产级多工具实战 × 安全防护全指南
2026-07-03 08:44:52 +0800 CST
view 225
深度解析 Ollama v0.20 的 Tool Calling 能力,从 JSON Schema 协议原理到生产级多工具 Agent 实战,含安全防护与性能基准测试。
Ollama
AI Agent
Tool Calling
本地大模型
LangChain4j
KV Cache 显存优化深度解析:从 PagedAttention 到 2026 年最新压缩技术演进
编程
KV Cache 显存优化深度解析:从 PagedAttention 到 2026 年最新压缩技术演进
2026-08-01 15:47:00 +0800 CST
view 83
从第一性原理深度剖析 KV Cache 显存困境,系统拆解 PagedAttention 核心原理,对比 vLLM/TensorRT-LLM/SGLang 三大推理框架技术路线,涵盖 FP8/INT4 量化、前缀缓存、StreamingLLM 等 2026 年最新压缩技术,含完整代码示例与生产调优指南。
KV Cache
PagedAttention
vLLM
TensorRT-LLM
SGLang
LLM推理
GPU优化
显存优化
量化
深度学习
LangChain 2026 深度解析:从 Chain 到 Agent,LLM 应用开发的事实标准全面进化
编程
LangChain 2026 深度解析:从 Chain 到 Agent,LLM 应用开发的事实标准全面进化
2026-05-14 12:41:08 +0800 CST
view 876
LangChain 2026完成架构级重构:Agent取代Chain成为核心抽象、LangGraph状态机支持分支循环暂停、Deep Agents多智能体协作、MCP标准化工具协议、LangSmith全链路可观测性。完整API对比(2024 vs 2026)、迁移指南与企业知识库Agent实战。
LangChain
LangGraph
Agent
MCP
AI
LangGraph:告别if-else,用图结构编排复杂AI工作流,循环和人工干预天然支持
编程
LangGraph:告别if-else,用图结构编排复杂AI工作流,循环和人工干预天然支持
2026-04-16 19:09:33 +0800 CST
view 827
LangGraph是langchain-ai开源的AI Agent工作流编排框架(25K Stars),用图结构替代LangChain的链式调用,支持循环、条件分支、检查点和人工干预,适合复杂多步骤Agent。
LangGraph
AI
工作流
LangChain
Agent
开源
Python
图结构
Elasticsearch 9.4 深度解析:从搜索引擎到 Agent 平台,2026 年 Elastic 的战略级重构
编程
Elasticsearch 9.4 深度解析:从搜索引擎到 Agent 平台,2026 年 Elastic 的战略级重构
2026-05-14 17:40:49 +0800 CST
view 802
Elasticsearch 9.4.0 于 2026 年 4 月 30 日发布。核心变化:Elastic 正在从搜索 + 日志老三件套,重写成一个 Agent 平台。深度解析 Agent Builder、MCP 协议集成、向量搜索优化、Kibana AI 增强、性能基准测试。
Elasticsearch
向量搜索
Agent
AI
Kibana
MCP
搜索
LangChain4j:把LangChain的能力带入Java世界,一个库搞定LLM集成、RAG、Agent
编程
LangChain4j:把LangChain的能力带入Java世界,一个库搞定LLM集成、RAG、Agent
2026-04-16 19:11:21 +0800 CST
view 733
LangChain4j是Java世界的LangChain,简化Java应用集成大语言模型,支持OpenAI/Claude/DeepSeek等模型,提供RAG、Agent、Tool Calling、Memory等完整能力,Apache 2.0协议。
Java
LangChain
AI
LLM
RAG
Agent
开源
工具调用
Chrome DevTools MCP 1.3 深度实战:当 Google 把浏览器控制权交给 AI Agent——从 CDP + MCP 双协议架构到 49 个生产级工具、从性能 Trace 到堆内存分析的完全指南(2026)
编程
Chrome DevTools MCP 1.3 深度实战:当 Google 把浏览器控制权交给 AI Agent——从 CDP + MCP 双协议架构到 49 个生产级工具、从性能 Trace 到堆内存分析的完全指南(2026)
2026-06-20 11:26:28 +0800 CST
view 394
Google 官方 Chrome DevTools MCP 1.3 完全指南:49 个 MCP 工具、CDP + MCP 双协议架构、性能 Trace、内存堆快照、Lighthouse 审计与生产级安全实践。
Chrome DevTools
MCP
AI Agent
浏览器自动化
性能优化
前端调试
Chrome DevTools MCP 1.3 完全实战:AI 编程助手如何接管 Chrome 的 49 个工具——从 CDP + MCP 架构到性能优化、内存调试与 CI/CD 落地指南(2026)
编程
Chrome DevTools MCP 1.3 完全实战:AI 编程助手如何接管 Chrome 的 49 个工具——从 CDP + MCP 架构到性能优化、内存调试与 CI/CD 落地指南(2026)
2026-06-20 11:28:34 +0800 CST
view 362
Google 官方 Chrome DevTools MCP 1.3 完全指南:49 个 MCP 工具、CDP + MCP 双协议架构、性能 Trace、内存堆快照、Lighthouse 审计与生产级安全实践。
Chrome DevTools
MCP
AI Agent
浏览器自动化
性能优化
前端调试
大模型推理引擎实战:从 PagedAttention、Continuous Batching 到投机解码与量化部署,把 GPU 利用率榨到极限(vLLM/SGLang 2026 完全指南)
编程
大模型推理引擎实战:从 PagedAttention、Continuous Batching 到投机解码与量化部署,把 GPU 利用率榨到极限(vLLM/SGLang 2026 完全指南)
2026-07-09 09:17:24 +0800 CST
view 423
深入剖析 2026 年大模型推理引擎核心技术:PagedAttention、Continuous Batching、Chunked Prefill、RadixAttention 前缀缓存、投机解码与 AWQ/GPTQ/FP8 量化,结合 vLLM 与 SGLang 部署实战,把 GPU 利用率榨到极限的生产级完全指南。
LLM推理引擎
vLLM
SGLang
推理优化
量化部署
投机解码
GPU利用率
KV Cache
PagedAttention
vLLM 推理引擎源码级拆解:PagedAttention 显存虚拟化、Continuous Batching 调度与量化落地全指南
编程
vLLM 推理引擎源码级拆解:PagedAttention 显存虚拟化、Continuous Batching 调度与量化落地全指南
2026-07-27 03:44:38 +0800 CST
view 140
从显存字节到 CUDA kernel 源码级拆解 vLLM:PagedAttention 分页显存管理、Continuous Batching 连续批处理调度、Prefix Caching 前缀缓存与量化/投机解码实战,附完整代码与生产调参踩坑清单。
vLLM
PagedAttention
大模型推理
KV Cache
显存优化
连续批处理
量化
LLM Serving
Headroom 深度解析:AI Agent 上下文压缩引擎——从 Token 暴降 95% 的原理到生产级部署的完整技术指南(2026)
编程
Headroom 深度解析:AI Agent 上下文压缩引擎——从 Token 暴降 95% 的原理到生产级部署的完整技术指南(2026)
2026-07-04 04:42:34 +0800 CST
view 310
Headroom 深度解析:AI Agent 上下文压缩引擎,节省 60-95% Token 消耗,零侵入透明压缩层,含四种接入模式详解、压缩算法剖析、性能基准测试与生产级部署指南。
Headroom
AI Agent
上下文压缩
Token优化
成本优化
LangChain
Claude Code
Proxy模式
ML路由
LLM 推理的显存战争:从 PagedAttention 到统一内存架构——KV Cache 管理五世代深度解析(2026)
编程
LLM 推理的显存战争:从 PagedAttention 到统一内存架构——KV Cache 管理五世代深度解析(2026)
2026-06-15 11:18:23 +0800 CST
view 478
深度解析大模型推理中 KV Cache 管理的五世代演进:从连续分配到 PagedAttention,再到异构缓存、分布式 KV 和统一混合内存架构。结合 vLLM、SGLang、TensorRT-LLM 给出生产环境选型指南。
LLM
大模型
KVCache
PagedAttention
vLLM
SGLang
TensorRT
推理优化
显存管理
分布式
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
7
8
9
10
11
...
96
下一页