程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
shell 相关搜索结果(第6页)
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
消息队列与任务调度:从内存队列到生产级架构的实战指南
编程
消息队列与任务调度:从内存队列到生产级架构的实战指南
2026-06-27 13:44:00
从内存队列到生产级消息架构的完整实战指南,涵盖 Redis 队列、RabbitMQ、Kafka 三种方案,包含完整代码示例、性能对比和最佳实践。
消息队列
Redis
RabbitMQ
Kafka
异步处理
架构设计
任务调度
分布式系统
llama.cpp 深度实战:当端侧 LLM 成为生产级事实标准——从 GGUF 量化到跨平台部署的完全指南(2026)
编程
llama.cpp 深度实战:当端侧 LLM 成为生产级事实标准——从 GGUF 量化到跨平台部署的完全指南(2026)
2026-06-11 00:19:05
全面解析 llama.cpp 推理引擎,从 GGUF 格式、量化原理、架构设计到跨平台部署,提供生产级代码实战和性能优化指南。
llama.cpp
GGUF
量化
端侧推理
大语言模型
vLLM 深度解析:LLM 推理性能的终极引擎——从 PagedAttention 到生产级部署的完整技术内幕
编程
vLLM 深度解析:LLM 推理性能的终极引擎——从 PagedAttention 到生产级部署的完整技术内幕
2026-05-18 08:22:35
全面解析 vLLM 推理引擎的核心架构,从 PagedAttention 原理到生产级部署实战,涵盖量化推理、多GPU并行、性能调优等完整技术栈
vLLM
LLM推理
PagedAttention
GPU优化
量化推理
深度解析
OpenCode 深度解析:157K Star 的开源 AI 编程智能体——如何打造 Claude Code 的完美平替
编程
OpenCode 深度解析:157K Star 的开源 AI 编程智能体——如何打造 Claude Code 的完美平替
2026-05-16 05:45:45
深度解析OpenCode——157K Star的开源AI编程智能体,支持75+ LLM提供商,如何成为Claude Code的完美平替
AI编程
开源
OpenCode
Claude Code平替
LLM
TensorRT-LLM 深度实战:从 Blackwell 架构到 INT4 量化的 LLM 推理性能革命
编程
TensorRT-LLM 深度实战:从 Blackwell 架构到 INT4 量化的 LLM 推理性能革命
2026-05-22 06:19:51
深入解析TensorRT-LLM推理框架,从Paged KV Cache、连续批处理到INT4/INT8/FP8量化实战,覆盖Blackwell架构适配、Triton部署与K8s生产方案
TensorRT-LLM
LLM推理
量化
INT4
Blackwell
GPU优化
Harness Engineering 深度实战:从"玄学 Prompt"到"硬核线束架构"——2026年 AI Agent 开发范式转移完全指南
编程
Harness Engineering 深度实战:从"玄学 Prompt"到"硬核线束架构"——2026年 AI Agent 开发范式转移完全指南
2026-05-23 18:15:43
深入拆解2026年AI Agent开发最新范式:Harness Engineering(线束工程),从Prompt Engineering的结构性失败到硬核系统约束的范式转移,六大核心支柱与生产级实战代码
AI Agent
Harness Engineering
工程实践
架构设计
FlashPrefill 深度解析:当瞬时注意力遇上 GPU 原语——从 O(N²) 困境到 27 倍速的工程革命
编程
FlashPrefill 深度解析:当瞬时注意力遇上 GPU 原语——从 O(N²) 困境到 27 倍速的工程革命
2026-04-15 17:20:25
深度解析中科院与腾讯微信联合研发的 FlashPrefill 如何通过即时注意力模式发现和动态阈值筛选,将 25.6 万字符长文本处理速度提升 27.78 倍,同时保持近乎完美的精度。
LLM推理优化
FlashAttention
GPU计算
长文本处理
注意力机制
Transformer
深度学习
OXC 深度实战:当 Rust 重写 JavaScript 工具链——从 AST 到底层架构、从 Parser 到 100 倍性能跨越的生产级完全指南(2026)
编程
OXC 深度实战:当 Rust 重写 JavaScript 工具链——从 AST 到底层架构、从 Parser 到 100 倍性能跨越的生产级完全指南(2026)
2026-06-19 14:28:15
深入解析 OXC(The Oxidation Compiler):字节跳动开源的 Rust 版 JavaScript 工具链,Parser 比 SWC 快 3 倍,Linter 比 ESLint 快 50-100 倍。涵盖 AST 设计、Arena 内存分配、六大核心工具及生产接入实战。
Rust
JavaScript
TypeScript
前端工具链
性能优化
编译器
编程
MarkItDown 深度解析:微软如何用轻量级 Python 工具重新定义文档转换——从 PDF 到 Markdown 的工程革命
2026-04-15 07:53:17
深度解析微软开源的 MarkItDown 工具——GitHub 10万+ Star 的文档转换利器,涵盖架构设计、核心转换器实现、插件系统、RAG管道集成和生产级优化策略。
Python
Markdown
PDF
微软
RAG
开源
Hermes Agent 深度拆解:当 AI 学会「自我进化」——从动态技能生成、三层记忆架构到强化学习闭环的工程全貌(2026)
编程
Hermes Agent 深度拆解:当 AI 学会「自我进化」——从动态技能生成、三层记忆架构到强化学习闭环的工程全貌(2026)
2026-07-18 07:15:45
深度拆解 Hermes Agent:21.6万 Stars 的自进化 AI Agent 框架。从动态技能生成、三层记忆架构(Built-in/External/Session)、ACP 跨 Agent 通信协议到 GRPO 强化学习闭环的完整工程全貌,配代码实战与部署指南。
Hermes Agent
AI Agent
自进化
记忆系统
强化学习
GRPO
ACP协议
Nous Research
当 WASM 遇上 WebGPU:浏览器端 AI 推理的第三次革命——用 Web 技术重写本地智能的心智模型
编程
当 WASM 遇上 WebGPU:浏览器端 AI 推理的第三次革命——用 Web 技术重写本地智能的心智模型
2026-07-15 14:17:19
深度拆解 2026 年 WebGPU、WASM 与 WebNN 融合技术:三层计算模型、WGSL 编写、GEMM 量化推理、KV Cache、算子融合,配完整代码与性能基准。
WebGPU
WASM
WebNN
浏览器AI
WGSL
端侧推理
WebLLM
前端工程化
Rolldown 1.0 深度实战:当 Rust 重写前端打包器——从 Vite 8 底层引擎到 10-30 倍性能飞跃的生产级完全指南
编程
Rolldown 1.0 深度实战:当 Rust 重写前端打包器——从 Vite 8 底层引擎到 10-30 倍性能飞跃的生产级完全指南
2026-06-15 17:21:29
Rolldown 1.0 用 Rust 融合 Rollup 生态兼容与 esbuild 极致性能,成为 Vite 8 统一底层引擎。从架构设计到 Tree-shaking 精度革命、代码分割策略、插件兼容、Vite 迁移实战的生产级完全指南。
Rolldown
Rust
Vite
打包器
Tree-shaking
前端工程化
oxc
AI Agent Skills 生态爆发:mattpocock/skills、superpowers 与 agent-skills 如何重塑编程范式
编程
AI Agent Skills 生态爆发:mattpocock/skills、superpowers 与 agent-skills 如何重塑编程范式
2026-07-16 00:50:14
深度解析2026年GitHub Trending上三大AI Agent Skills项目:mattpocock/skills、obra/superpowers、addyosmani/agent-skills,从核心原理、架构设计到实战编写SKILL.md,探讨Skills与MCP的关系与边界。
AI
Agent
Skills
MCP
GitHub
开源
TypeScript
Docker AI Toolkit 2026 深度实战:生产级 AI 工程化完全指南
编程
Docker AI Toolkit 2026 深度实战:生产级 AI 工程化完全指南
2026-05-30 19:42:17
从 MLOps 到边缘推理,从模型编译到统一部署——Docker AI Toolkit 2026 如何将 AI 工程化从「手工炼丹」升级为「工业流水线」
Docker
AI
工程化
MLOps
容器化
NixOS 26.05 "Yarara" 深度实战:当声明式配置成为开发环境的终极形态——从 Nix Flakes 到 devshell、从原子化回滚到跨平台复现的完全指南(2026)
编程
NixOS 26.05 "Yarara" 深度实战:当声明式配置成为开发环境的终极形态——从 Nix Flakes 到 devshell、从原子化回滚到跨平台复现的完全指南(2026)
2026-06-18 21:27:15
深度讲解 Nix/NixOS 26.05 的声明式配置哲学、Nix Flakes 现代化用法、Nix devshell 可复现开发环境实战,以及与 Docker 的协同方案。含完整代码示例与生产级配置模板。
NixOS
Nix
Flakes
devshell
声明式配置
开发环境
可复现构建
DevOps
LLM 推理服务引擎深度拆解:从 PagedAttention 到 PD 分离,把 GPU 榨干的七层优化栈
编程
LLM 推理服务引擎深度拆解:从 PagedAttention 到 PD 分离,把 GPU 榨干的七层优化栈
2026-07-30 21:49:19
深度拆解 LLM 推理服务的七层优化栈:PagedAttention 分页显存与写时复制、连续批处理消灭队头阻塞、前缀缓存命中率实操、Chunked Prefill 与 PD 分离决策、KV Cache 分层复用的拉取/重算临界点、投机解码加速比数学与失效场景、量化与并行选型。附大量可运行代码、压测骨架、调优顺序与七个常见误区。
LLM推理
vLLM
SGLang
PagedAttention
PD分离
KV Cache
前缀缓存
投机解码
Chunked Prefill
性能优化
DuckDB Quack 协议深度实战:从嵌入式分析到分布式多写者的架构进化
编程
DuckDB Quack 协议深度实战:从嵌入式分析到分布式多写者的架构进化
2026-05-22 06:50:01
DuckDB Quack 协议让嵌入式分析数据库支持多并发写入的客户端-服务器模式,从协议架构、实战部署、性能调优到生产级高可用设计的完整指南
DuckDB
Quack
数据库
OLAP
Arrow
数据分析
万字深度解析 DeepSeek V4:当 1.6T 开源模型遇见「架构效率革命」——从 mHC 稳压机制到 CSA/HCA 稀疏注意力、从 FP4 量化到 Muon 优化器的完整技术指南(2026)
编程
万字深度解析 DeepSeek V4:当 1.6T 开源模型遇见「架构效率革命」——从 mHC 稳压机制到 CSA/HCA 稀疏注意力、从 FP4 量化到 Muon 优化器的完整技术指南(2026)
2026-07-02 06:43:56
DeepSeek V4 技术架构深度解析:从 mHC 流形约束超连接、CSA/HCA 混合稀疏注意力、FP4 量化感知训练到 Muon 优化器,完整拆解 1.6T 开源模型如何用架构创新把 1M token 推理效率提升到 V3.2 的 10%。
DeepSeek V4
大模型架构
MoE
CSA/HCA 注意力
FP4 量化
mHC
AI 开源
长上下文
Hermes Agent 深度拆解:自进化 AI Agent 架构全解析——从闭环学习到持久记忆的工程真相
编程
Hermes Agent 深度拆解:自进化 AI Agent 架构全解析——从闭环学习到持久记忆的工程真相
2026-07-20 15:48:15
深度解析 Nous Research 开源的 Hermes Agent:五大核心模块、自进化学习循环实现、FTS5 记忆系统、Docker/Ollama 部署实战、MCP 协议集成与 2026 年工程最佳实践
Hermes Agent
AI Agent
自进化
Nous Research
MCP
Python
2026
LLM 推理的显存战争:从 PagedAttention 到统一内存架构——KV Cache 管理五世代深度解析(2026)
编程
LLM 推理的显存战争:从 PagedAttention 到统一内存架构——KV Cache 管理五世代深度解析(2026)
2026-06-15 11:18:23
深度解析大模型推理中 KV Cache 管理的五世代演进:从连续分配到 PagedAttention,再到异构缓存、分布式 KV 和统一混合内存架构。结合 vLLM、SGLang、TensorRT-LLM 给出生产环境选型指南。
LLM
大模型
KVCache
PagedAttention
vLLM
SGLang
TensorRT
推理优化
显存管理
分布式
FinceptTerminal 深度实战:当 C++20 遇见金融终端——从 Qt6 原生渲染到 37 个 AI 智能体、从 QuantLib 定价引擎到 16 家券商直连的生产级完全指南(2026)
编程
FinceptTerminal 深度实战:当 C++20 遇见金融终端——从 Qt6 原生渲染到 37 个 AI 智能体、从 QuantLib 定价引擎到 16 家券商直连的生产级完全指南(2026)
2026-06-21 16:55:33
深度解析开源金融终端FinceptTerminal:C++20+Qt6原生UI、内嵌Python量化引擎、37个AI智能体多角度分析、QuantLib定价、16家券商直连、零拷贝行情架构的完整实战指南
C++
Qt6
金融终端
量化交易
AI Agent
FinceptTerminal
QuantLib
Python
期权定价
开源
Hermes Agent 深度实战:当 AI Agent 学会了自我进化——从 E-A-A-S 学习闭环到三层记忆、从 Skill 自动生成到多平台网关的生产级完全指南(2026)
编程
Hermes Agent 深度实战:当 AI Agent 学会了自我进化——从 E-A-A-S 学习闭环到三层记忆、从 Skill 自动生成到多平台网关的生产级完全指南(2026)
2026-06-19 06:25:05
深度拆解 Hermes Agent 的自学习闭环、三层记忆架构、技能自动生成、多平台网关,配完整代码实战与生产部署指南
AI Agent
Hermes
自学习
记忆系统
开源
Ollama 0.30 深度实战:当本地 LLM 推理有了双引擎——从 llama.cpp + MLX 双后端到 Gemma 4 QAT、从 Cohere2 MoE 到 ollama launch AI 编程助手生态的生产级完全指南(2026)
编程
Ollama 0.30 深度实战:当本地 LLM 推理有了双引擎——从 llama.cpp + MLX 双后端到 Gemma 4 QAT、从 Cohere2 MoE 到 ollama launch AI 编程助手生态的生产级完全指南(2026)
2026-06-21 08:54:17
Ollama 0.30 深度解析:双引擎推理架构、Gemma 4 QAT、Cohere2 MoE、ollama launch 生态与生产级部署完全指南
Ollama
LLM
本地推理
AI编程
llama.cpp
MLX
Gemma
开源
Bun Shell:首个 JavaScript 原生 Shell 环境深度拆解——从架构原理到生产级实战
编程
Bun Shell:首个 JavaScript 原生 Shell 环境深度拆解——从架构原理到生产级实战
2026-08-17 13:47:56
深度拆解 Bun Shell 架构设计、语法特性、生产级实战,与 bash/Node.js child_process 的性能对比,以及 Node.js 兼容层完整指南。
Bun
Shell
JavaScript
TypeScript
Node.js
跨平台
Shell脚本
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
python
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
上一页
1
…
3
4
5
6
7
8
9
…
307
下一页
共 307 页
到第
页
确定