程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Ollama v0.20 Tool Calling 深度解析:让本地大模型真正「动起手来」——从协议原理到生产级多工具 Agent 系统实战
编程
Ollama v0.20 Tool Calling 深度解析:让本地大模型真正「动起手来」——从协议原理到生产级多工具 Agent 系统实战
2026-07-03 08:43:53 +0800 CST
view 326
深度解析 Ollama v0.20 的 Tool Calling 能力:从 JSON Schema 协议原理、HTTP API 调用循环,到生产级多工具 Agent 系统的完整实战(天气查询/数据库查询/Web搜索),配套 LangChain4j 集成方案与安全防护策略。
Ollama
AI Agent
Tool Calling
本地大模型
LangChain4j
生产级实战
内核authencesn模板in-place优化的9年潜伏:CVE-2026-31431漏洞从crypto接口到root的完整攻击链
编程
内核authencesn模板in-place优化的9年潜伏:CVE-2026-31431漏洞从crypto接口到root的完整攻击链
2026-08-01 15:36:23 +0800 CST
view 263
深度剖析 CVE-2026-31431 Copy Fail 漏洞:从 AF_ALG 加密接口、authencesn in-place 优化、splice 零拷贝到 page cache 篡改的完整攻击链路,附内核源码解析、非破坏性检测工具、完整修复方案和 eBPF 监控实战。
Linux内核
CVE
漏洞分析
安全
提权
AF_ALG
page_cache
CryptoAPI
Kubernetes
容器安全
eBPF
Falco
Gemma 4 12B 深度实战:当无编码器统一多模态架构走进本地
编程
Gemma 4 12B 深度实战:当无编码器统一多模态架构走进本地
2026-06-14 17:49:21 +0800 CST
view 567
深入解析 Google Gemma 4 12B 的无编码器统一多模态架构,从技术原理到生产部署的完整指南
Gemma4
Google
多模态
本地部署
AI
LLM
Encoder-Free
Kubernetes 1.36 ImageVolume GA:当 OCI 镜像从容器运行时滑向数据分发层——从 KEP-4639 到生产落地的完全指南(2026)
编程
Kubernetes 1.36 ImageVolume GA:当 OCI 镜像从容器运行时滑向数据分发层——从 KEP-4639 到生产落地的完全指南(2026)
2026-06-20 01:54:28 +0800 CST
view 353
Kubernetes 1.36 ImageVolume GA 深度实战:从 OCI Artifacts 演进、KEP-4639 架构分析到构建数据镜像、subPath 挂载、AI 推理服务集成与生产优化
Kubernetes
ImageVolume
OCI
云原生
容器化
Ollama v0.20 Tool Calling 深度解析:本地 AI Agent 的最后一公里——JSON Schema 协议 × 生产级多工具实战 × 安全防护全指南
编程
Ollama v0.20 Tool Calling 深度解析:本地 AI Agent 的最后一公里——JSON Schema 协议 × 生产级多工具实战 × 安全防护全指南
2026-07-03 08:44:52 +0800 CST
view 262
深度解析 Ollama v0.20 的 Tool Calling 能力,从 JSON Schema 协议原理到生产级多工具 Agent 实战,含安全防护与性能基准测试。
Ollama
AI Agent
Tool Calling
本地大模型
LangChain4j
KV Cache 显存优化深度解析:从 PagedAttention 到 2026 年最新压缩技术演进
编程
KV Cache 显存优化深度解析:从 PagedAttention 到 2026 年最新压缩技术演进
2026-08-01 15:47:00 +0800 CST
view 141
从第一性原理深度剖析 KV Cache 显存困境,系统拆解 PagedAttention 核心原理,对比 vLLM/TensorRT-LLM/SGLang 三大推理框架技术路线,涵盖 FP8/INT4 量化、前缀缓存、StreamingLLM 等 2026 年最新压缩技术,含完整代码示例与生产调优指南。
KV Cache
PagedAttention
vLLM
TensorRT-LLM
SGLang
LLM推理
GPU优化
显存优化
量化
深度学习
Kimi K2.6 深度解析:月之暗面最强代码模型的工程化突破与 Agent 集群实战
编程
Kimi K2.6 深度解析:月之暗面最强代码模型的工程化突破与 Agent 集群实战
2026-04-25 08:14:23 +0800 CST
view 1302
深度解析月之暗面开源的Kimi K2.6模型:长程编码能力、Agent集群架构、代码实战与性能优化指南
Kimi
K2.6
月之暗面
AI编程
Agent集群
代码模型
开源模型
Gemma 4 12B 工程实践:Encoder-Free 统一多模态架构从原理到本地部署完全指南(2026)
编程
Gemma 4 12B 工程实践:Encoder-Free 统一多模态架构从原理到本地部署完全指南(2026)
2026-06-14 17:49:38 +0800 CST
view 661
深入解析 Google Gemma 4 12B 的无编码器统一多模态架构,从技术原理到生产部署的完整指南
Gemma4
Google
多模态
本地部署
AI
LLM
Encoder-Free
Ollama Tool Calling × 本地 AI Agent:JSON Schema 协议 × 生产级多工具系统 × 安全防护实战
编程
Ollama Tool Calling × 本地 AI Agent:JSON Schema 协议 × 生产级多工具系统 × 安全防护实战
2026-07-03 08:45:53 +0800 CST
view 295
深度解析 Ollama v0.20 Tool Calling,从协议原理到生产级多工具 Agent 实战,含天气查询、数据库查询、Web搜索三大实战案例与安全防护策略。
Ollama
AI Agent
Tool Calling
本地大模型
【深度长文】Ollama v0.20 工具调用实战:本地大模型 + JSON Schema + 生产级 Agent 系统搭建指南(2026)
编程
【深度长文】Ollama v0.20 工具调用实战:本地大模型 + JSON Schema + 生产级 Agent 系统搭建指南(2026)
2026-07-03 08:47:18 +0800 CST
view 291
深度长文:Ollama v0.20 Tool Calling 从协议原理到生产级多工具 Agent 实战,含天气查询、数据库操作、Web搜索三大案例与安全防护策略(2026)。
Ollama
AI Agent
Tool Calling
本地大模型
生产级
AI编程Agent用10小时凿开CUDA护城河:推理战场的底层软件革命与程序员的真实机遇
编程
AI编程Agent用10小时凿开CUDA护城河:推理战场的底层软件革命与程序员的真实机遇
2026-08-10 14:47:15 +0800 CST
view 38
深度拆解AI编程Agent用10小时为非英伟达芯片搭建底层软件栈的事件:从CUDA三层架构本质、Infinity Ignition Agent原理、推理战场竞争格局、到验证生态护城河,结合DeepSeek TileLang路径对比,给出程序员视角的机遇分析。
CUDA
AI Agent
推理芯片
Infinity
Ignition
d-Matrix
底层软件
GPU Kernel
芯片适配
护城河
DeerFlow 2.0 深度实战:字节跳动 49K Star 的超级智能体运行时——从 LangGraph DAG 到沙箱隔离的全链路架构解析
编程
DeerFlow 2.0 深度实战:字节跳动 49K Star 的超级智能体运行时——从 LangGraph DAG 到沙箱隔离的全链路架构解析
2026-05-07 04:37:34 +0800 CST
view 978
深度拆解字节跳动开源的 DeerFlow 2.0 超级智能体框架,从 LangGraph DAG 工作流到 11 层中间件链,从动态子智能体到 Docker/K8s 沙箱隔离,从三层记忆架构到六大 IM 渠道接入,全链路架构解析与生产级部署实战。
DeerFlow
AI Agent
LangGraph
字节跳动
智能体
沙箱
开源
编程
Headroom 深度实战:当 AI Agent 学会「上下文压缩」——从 Token 暴降 95% 原理到生产级实践的完全指南(2026)
2026-06-08 17:53:16 +0800 CST
view 810
Headroom 是一个专为 AI Agent 设计的开源上下文压缩中间层,实测节省 60-95% Token,精度保留率高达 97%。本文从架构原理、六大压缩算法、MCP集成到生产级部署全面深度解析。涵盖 ContentRouter、SmartCrusher、可逆缓存等核心技术,配完整 Python 代码示例。适合 Claude Code、Cursor、LangChain 等工具链用户。Apache 2.0 开源可商用。
AI Agent,Token优化,上下文压缩,Headroom,LLM,Python,上下文管理,AI编程,生产实践
Headroom深度实战:当AI Agent学会「上下文减肥」——从60-95% Token压缩到零精度损失的工程完全指南(2026)
编程
Headroom深度实战:当AI Agent学会「上下文减肥」——从60-95% Token压缩到零精度损失的工程完全指南(2026)
2026-06-14 19:18:14 +0800 CST
view 523
全面拆解Headroom上下文压缩工具的原理、架构、接入方式与生产实践,解决AI Agent开发的Token成本与上下文窗口痛点
AI Agent
上下文压缩
Headroom
Token优化
LLM
Pydantic AI 深度实战:当 Pydantic 团队亲自下场做 AI Agent——从类型安全到生产级可观测、从依赖注入到 Durable Execution 的完全指南(2026)
编程
Pydantic AI 深度实战:当 Pydantic 团队亲自下场做 AI Agent——从类型安全到生产级可观测、从依赖注入到 Durable Execution 的完全指南(2026)
2026-06-20 04:22:53 +0800 CST
view 596
Pydantic AI 是 Pydantic 团队官方出品的 AI Agent 框架,把 FastAPI 的开发体验带进 GenAI 应用开发。本文深度解析其核心概念、Tools 与依赖注入、Structured Output、Capabilities、RAG 实战、多 Agent 协作、Durable Execution、Graph、MCP/A2A、可观测性、Evals,以及与其它框架的对比,附带完整的银行客服 Agent 实战代码。
Pydantic AI
Python
AI Agent
类型安全
生产级
FastAPI
Headroom深度实战:AI Agent上下文压缩完全指南——60-95% Token节省的零精度损失方案(2026)
编程
Headroom深度实战:AI Agent上下文压缩完全指南——60-95% Token节省的零精度损失方案(2026)
2026-06-14 19:19:54 +0800 CST
view 549
全面拆解Headroom上下文压缩工具的原理、架构、接入方式与生产实践,解决AI Agent开发的Token成本与上下文窗口痛点
AI Agent
上下文压缩
Headroom
Token优化
LLM
AI 生成界面为什么总是样板间? taste-skill 用 SKILL.md 给 AI 装上设计品味
编程
AI 生成界面为什么总是样板间? taste-skill 用 SKILL.md 给 AI 装上设计品味
2026-07-08 12:50:03 +0800 CST
view 407
taste-skill 通过将设计品味封装为可组合的 SKILL.md 技能集,解决 AI 生成界面千篇一律的核心问题。本文深入解析其三段旋钮系统、设计技能体系与工程实践。
AI编程
taste-skill
前端设计
SKILL.md
Claude Code
设计系统
AI Agent
Hermes Agent 深度实战:47K+ Star 的自进化 AI 智能体框架——从 Harness Engineering 到 Skill 闭环系统的全链路架构解析
编程
Hermes Agent 深度实战:47K+ Star 的自进化 AI 智能体框架——从 Harness Engineering 到 Skill 闭环系统的全链路架构解析
2026-05-07 07:06:42 +0800 CST
view 841
深度解析 Hermes Agent 的自我进化机制、四层记忆架构、Skill 自动生成系统,以及从本地到生产的完整部署实践。
AI
Agent
开源
框架
自进化
字节跳动DeerFlow 2.0技术全解析:从零构建生产级AI智能体系统(2026完整实战指南)
编程
字节跳动DeerFlow 2.0技术全解析:从零构建生产级AI智能体系统(2026完整实战指南)
2026-05-19 11:18:35 +0800 CST
view 690
DeerFlow 2.0是字节跳动开源的企业级多智能体协作框架,本文从架构设计、核心机制、源码分析、实战部署、性能调优五个维度进行深度解析。
DeerFlow
AI Agent
字节跳动
智能体框架
多智能体
sqlite-vec 深度实战:当 SQLite 遇见向量搜索,AI 应用的轻量级记忆系统从此有了标准答案(2026)
编程
sqlite-vec 深度实战:当 SQLite 遇见向量搜索,AI 应用的轻量级记忆系统从此有了标准答案(2026)
2026-07-22 01:16:13 +0800 CST
view 179
深度解析 sqlite-vec:一个纯C实现的SQLite向量搜索扩展,让SQLite直接支持语义搜索。涵盖核心架构、HNSW索引原理、SQL API完全指南、Python实战案例(知识库检索系统、AI Agent长期记忆、RAG系统)、性能优化、常见问题解决方案以及LangChain/LlamaIndex生态集成。
sqlite-vec
SQLite
向量搜索
AI应用
语义检索
RAG
Embedding
HNSW
AI Agent
vLLM 深度拆解:当 KV Cache 学会「分页」——用操作系统智慧重写 LLM 推理的心智模型
编程
vLLM 深度拆解:当 KV Cache 学会「分页」——用操作系统智慧重写 LLM 推理的心智模型
2026-07-15 10:13:07 +0800 CST
view 226
深度拆解 vLLM 核心架构:从 PagedAttention 分页内存管理、Continuous Batching 动态调度,到 Speculative Decoding、Prefix Caching 等高级特性,配完整代码示例与生产部署指南。
vLLM
PagedAttention
LLM推理
深度学习
GPU优化
Continuous Batching
LangChain 2026 深度解析:从 Chain 到 Agent,LLM 应用开发的事实标准全面进化
编程
LangChain 2026 深度解析:从 Chain 到 Agent,LLM 应用开发的事实标准全面进化
2026-05-14 12:41:08 +0800 CST
view 914
LangChain 2026完成架构级重构:Agent取代Chain成为核心抽象、LangGraph状态机支持分支循环暂停、Deep Agents多智能体协作、MCP标准化工具协议、LangSmith全链路可观测性。完整API对比(2024 vs 2026)、迁移指南与企业知识库Agent实战。
LangChain
LangGraph
Agent
MCP
AI
MemPalace 深度实战:当 AI Agent 学会「永久记忆」——从三层宫殿架构到 96.6% 召回率的工程完全指南(2026)
编程
MemPalace 深度实战:当 AI Agent 学会「永久记忆」——从三层宫殿架构到 96.6% 召回率的工程完全指南(2026)
2026-06-14 20:20:25 +0800 CST
view 374
MemPalace 深度实战:全量原文存储的 AI 记忆系统,96.6% LongMemEval 召回率,零 API 依赖。从三层宫殿架构到四层记忆栈,29 个 MCP 工具完整解析,性能优化从 3 秒到 50ms。
AI Agent
Memory System
MemPalace
MCP
Claude Code
ChromaDB
Vector Search
如何在Vue3中使用sessionStorage保存会话数据?
编程
如何在Vue3中使用sessionStorage保存会话数据?
2024-11-19 03:37:49 +0800 CST
view 1928
本文探讨了如何在Vue3应用中使用sessionStorage保存会话数据。sessionStorage是WebStorageAPI的一部分,仅在一个会话期间有效。通过示例代码,展示了如何创建Vue3项目、表单组件,并在用户输入时保存数据到sessionStorage,以及在组件挂载时加载数据。最终实现了在页面刷新后仍能保留用户输入的数据,提升用户体验。
前端开发
WebStorage
Vue框架
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
52
53
54
55
56
...
63
下一页