程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
World Monitor 深度拆解:500+ 信息源、56 种地图图层、一套代码发 6 个站,日增 300 星的开源态势感知仪表盘怎么造
编程
World Monitor 深度拆解:500+ 信息源、56 种地图图层、一套代码发 6 个站,日增 300 星的开源态势感知仪表盘怎么造
2026-07-24 08:17:48 +0800 CST
view 438
深度拆解 GitHub Trending 榜首 World Monitor:500+ 信息源聚合去重管线、deck.gl/globe.gl 双地图引擎、281 个 Protobuf 防腐层、三层缓存、一套代码发 6 个变体站与 Tauri sidecar 安全教训,配可运行代码复现核心机制。
World Monitor
开源
deck.gl
Tauri
态势感知
信息聚合
边缘计算
Transformers.js
Ollama
TypeScript
SGLang 深度解析:RadixAttention 如何重塑大模型推理的「结构化革命」
编程
SGLang 深度解析:RadixAttention 如何重塑大模型推理的「结构化革命」
2026-06-30 11:16:18 +0800 CST
view 325
深度解析 SGLang 大模型推理框架:RadixAttention 前缀缓存、零开销 CPU 调度器、结构化输出约束、推测解码、PD 分离等核心技术,对比 vLLM/TensorRT-LLM 选型,提供完整代码示例与生产级部署实践
SGLang
大模型推理
RadixAttention
前缀缓存
结构化输出
推测解码
PD分离
vLLM
TensorRT-LLM
SGLang 深度解析:RadixAttention 前缀缓存与结构化 LLM 推理革命——从 RAG/Agent 场景到生产级部署的完整指南
编程
SGLang 深度解析:RadixAttention 前缀缓存与结构化 LLM 推理革命——从 RAG/Agent 场景到生产级部署的完整指南
2026-06-30 11:17:15 +0800 CST
view 384
深度解析 SGLang 大模型推理框架:RadixAttention 前缀缓存、零开销 CPU 调度器、结构化输出约束、推测解码、PD 分离等核心技术,对比 vLLM/TensorRT-LLM 选型,提供完整代码示例与生产级部署实践
SGLang
大模型推理
RadixAttention
前缀缓存
结构化输出
推测解码
PD分离
vLLM
TensorRT-LLM
3MB就能跑PostgreSQL:PGlite如何用WebAssembly彻底改变前端数据库生态
编程
3MB就能跑PostgreSQL:PGlite如何用WebAssembly彻底改变前端数据库生态
2026-05-11 17:27:19 +0800 CST
view 520
PGlite将完整PostgreSQL编译为WebAssembly,在浏览器里跑真正的数据库。3MB gzip、无依赖、完整SQL支持、ACID事务、pgvector向量搜索。本文深度解析PGlite技术架构,并从零构建本地优先AI笔记应用实战。
PGlite
PostgreSQL
WebAssembly
前端数据库
WASM
本地优先
pgvector
万字深度解析 Ghostty:当 Zig 遇上 GPU 加速——下一代终端模拟器的架构革命(2026)
编程
万字深度解析 Ghostty:当 Zig 遇上 GPU 加速——下一代终端模拟器的架构革命(2026)
2026-07-01 03:13:50 +0800 CST
view 328
2026年Ghostty终端模拟器万字深度解析:Zig语言实现、GPU加速渲染、平台原生UI、libghostty跨平台库架构,从技术原理到代码实战全覆盖
Ghostty
Zig
终端模拟器
GPU加速
系统编程
跨平台
Metal
OpenGL
GTK4
libghostty
Claude Mythos Preview 深度解析:当 AI 成为漏洞挖掘机,网络安全格局的范式转移
编程
Claude Mythos Preview 深度解析:当 AI 成为漏洞挖掘机,网络安全格局的范式转移
2026-04-12 17:55:58 +0800 CST
view 1196
深度解析 Anthropic 发布 Claude Mythos Preview:72.4%零日漏洞挖掘成功率、发现 OpenBSD 27年漏洞、FFmpeg 16年漏洞,12家机构联合启动 Project Glasswing 网络安全计划。
AI安全
网络安全
Claude
Anthropic
漏洞挖掘
零日漏洞
Project Glasswing
AI编程
大模型推理引擎 2026 终极对决:vLLM vs SGLang,从 PagedAttention 到 RadixAttention,一次把 LLM 部署讲透(深度实战)
编程
大模型推理引擎 2026 终极对决:vLLM vs SGLang,从 PagedAttention 到 RadixAttention,一次把 LLM 部署讲透(深度实战)
2026-07-13 05:12:59 +0800 CST
view 244
深度对比 vLLM 与 SGLang 两大 LLM 推理引擎:从 KV Cache、PagedAttention、RadixAttention、连续批处理、分块预填充、推测解码、P/D 分离到量化部署,配可直接运行的生产级代码与基准测试。
vLLM
SGLang
LLM推理
大模型部署
PagedAttention
RadixAttention
colibrì 深度拆解:1300行纯C代码驱动7440亿参数大模型——当「不可能」变成「只是慢」
编程
colibrì 深度拆解:1300行纯C代码驱动7440亿参数大模型——当「不可能」变成「只是慢」
2026-07-19 14:42:08 +0800 CST
view 402
深度拆解 colibrì 项目:一位意大利开发者用 10 天、1300 行纯 C 代码,在 25GB 笔记本上运行 7440 亿参数大模型的工程全貌。涵盖 MoE 稀疏推理、NVMe 流式专家、MLA 注意力、MTP 推测解码等核心技术的完整解析。
C语言
MoE
大模型
NVMe
量化
GPU
深度学习
GLM-5.2
推理引擎
推测解码
LLM 推理服务引擎深度拆解:从 PagedAttention 到 PD 分离,把 GPU 榨干的七层优化栈
编程
LLM 推理服务引擎深度拆解:从 PagedAttention 到 PD 分离,把 GPU 榨干的七层优化栈
2026-07-30 21:49:19 +0800 CST
view 122
深度拆解 LLM 推理服务的七层优化栈:PagedAttention 分页显存与写时复制、连续批处理消灭队头阻塞、前缀缓存命中率实操、Chunked Prefill 与 PD 分离决策、KV Cache 分层复用的拉取/重算临界点、投机解码加速比数学与失效场景、量化与并行选型。附大量可运行代码、压测骨架、调优顺序与七个常见误区。
LLM推理
vLLM
SGLang
PagedAttention
PD分离
KV Cache
前缀缓存
投机解码
Chunked Prefill
性能优化
WorldMonitor 深度解剖:68k Stars 的开源全球情报仪表板——无框架 TypeScript、三级缓存、CII 评分模型与 281 个 Proto 的契约工程
编程
WorldMonitor 深度解剖:68k Stars 的开源全球情报仪表板——无框架 TypeScript、三级缓存、CII 评分模型与 281 个 Proto 的契约工程
2026-07-25 12:46:01 +0800 CST
view 218
深度拆解 GitHub 68k Stars 开源项目 WorldMonitor:无框架 TypeScript 与双地图引擎、500+ 信源三级缓存管道、CII 国家不稳定指数评分模型、281 个 Proto 契约工程、Tauri sidecar 安全边界与 MCP Agent 集成。
WorldMonitor
开源
TypeScript
deck.gl
Protobuf
MCP
Tauri
数据聚合
态势感知
AI Agent
大模型部署太慢?这个超级引擎帮你搞定!SGLang速通指南
编程
大模型部署太慢?这个超级引擎帮你搞定!SGLang速通指南
2026-04-22 09:27:57 +0800 CST
view 835
DeepSeek官方推荐!SGLang高性能大模型推理框架速通指南,RadixAttention前缀缓存、零开销调度、OpenAI API兼容,性能碾压vLLM。
SGLang
大模型推理
DeepSeek
开源
vLLM
WebGPU 深度解析:当浏览器真正拥有「显卡驱动」——从 WGSL 计算着色器到浏览器端 AI 推理的完整实战指南
编程
WebGPU 深度解析:当浏览器真正拥有「显卡驱动」——从 WGSL 计算着色器到浏览器端 AI 推理的完整实战指南
2026-07-07 12:44:09 +0800 CST
view 273
深度解析WebGPU图形与计算API:WGSL计算着色器实战、浏览器端AI推理、渲染管线优化、生产级应用场景,从架构原理到完整代码示例的全面指南。
WebGPU
WGSL
Compute Shader
GPU
Browser AI
Rendering
WebGL
万字深度解析 LMCache:当 LLM 推理遇见「KV 缓存革命」——从 Transformer 注意力机制到多层存储分级、从 vLLM/SGLang 集成到生产级 PD 拆分的完整技术指南(2026)
编程
万字深度解析 LMCache:当 LLM 推理遇见「KV 缓存革命」——从 Transformer 注意力机制到多层存储分级、从 vLLM/SGLang 集成到生产级 PD 拆分的完整技术指南(2026)
2026-07-02 08:42:52 +0800 CST
view 341
深度解析 LMCache 开源项目:LLM 推理 KV 缓存管理层,涵盖架构设计、多级存储、Multiprocess 模式、非前缀复用、PD 拆分等核心技术,15+ 可运行代码示例。
LMCache
LLM推理
KV缓存
vLLM
SGLang
AI推理优化
GPU优化
分布式缓存
SGLang 深度实战:当 RadixAttention 重新定义 LLM 推理——从架构原理到生产部署的完整工程指南(2026)
编程
SGLang 深度实战:当 RadixAttention 重新定义 LLM 推理——从架构原理到生产部署的完整工程指南(2026)
2026-07-20 17:18:01 +0800 CST
view 286
深度解析SGLang推理框架核心技术:RadixAttention基数树KV缓存、连续批处理与CPU-GPU调度重叠、约束解码结构化输出、CVE-2026-5760安全漏洞修复、生产部署实战,以及与vLLM的完整对比选型指南。
SGLang
LLM
RadixAttention
PagedAttention
推理优化
Python
深度学习
向量检索
Agent
RAG
vLLM
CVE
Rust
高性能计算
ZCode 3.0深度解析:自研Agent内核如何重构国产AI编程体验
编程
ZCode 3.0深度解析:自研Agent内核如何重构国产AI编程体验
2026-07-07 20:50:43 +0800 CST
view 226
测试
ZCode
智谱
GLM-5.2
AI编程
国产工具
CloakBrowser 深度实战:当反爬虫战争进入「内核级隐身」——从 C++ 源码补丁到 Browser Fingerprint 完全伪造的生产级完全指南(2026)
编程
CloakBrowser 深度实战:当反爬虫战争进入「内核级隐身」——从 C++ 源码补丁到 Browser Fingerprint 完全伪造的生产级完全指南(2026)
2026-06-14 00:46:29 +0800 CST
view 555
CloakBrowser 深度实战:基于 C++ 源码级修改的隐身 Chromium 浏览器,通过 30+ 个内核级指纹补丁实现对 Cloudflare Turnstile、Akamai Bot Manager 等反爬虫系统的完全绕过。
CloakBrowser
浏览器指纹
反爬虫
Chromium
Playwright
Puppeteer
WebGL
Canvas
GLM-OCR 深度解析:0.9B 参数的文档理解小钢炮,OmniDocBench 拿下 94.62 分的秘密
编程
GLM-OCR 深度解析:0.9B 参数的文档理解小钢炮,OmniDocBench 拿下 94.62 分的秘密
2026-05-13 22:15:56 +0800 CST
view 593
GLM-OCR是智谱AI推出的0.9B参数文档理解多模态模型,凭借布局感知两阶段流水线和GRPO强化学习,在OmniDocBench v1.5以94.62分领先。本文深度解析其CogViT架构、MTP解码加速、印章识别技术及完整部署实战。
GLM-OCR,智谱AI,OCR,多模态模型,文档理解
Qwen3.6-27B开源:270亿稠密模型如何用单卡性能打穿3970亿MoE旗舰——从架构革命到本地编程助手实战
编程
Qwen3.6-27B开源:270亿稠密模型如何用单卡性能打穿3970亿MoE旗舰——从架构革命到本地编程助手实战
2026-07-08 00:47:14 +0800 CST
view 677
深度解析阿里开源Qwen3.6-27B:270亿参数稠密模型全面超越3970亿MoE旗舰的技术原理、混合注意力架构、编程基准实测、本地部署实战与Claude Code协同工作流。
Qwen3.6
开源大模型
AI编程
本地部署
vLLM
SGLang
Chrome 新API:HTML-in-Canvas,颠覆传统html2canvas
编程
Chrome 新API:HTML-in-Canvas,颠覆传统html2canvas
2026-05-28 13:35:26 +0800 CST
view 981
HTML-in-Canvas是WICG推出的Chrome原生Web API,让DOM内容直接渲染到Canvas,保留完整交互与语义,彻底取代html2canvas。支持layoutsubtree、drawElementImage、GPU全场景适配。
Chrome
Canvas
HTML-in-Canvas
WebGL
前端
WICG
新API
WebGPU
无障碍
Cursor 3 深度实战:多 Agent 并行如何重新定义编程范式——从 Glass 界面到 Composer 2 自研模型的全链路架构解析
编程
Cursor 3 深度实战:多 Agent 并行如何重新定义编程范式——从 Glass 界面到 Composer 2 自研模型的全链路架构解析
2026-05-06 07:36:46 +0800 CST
view 785
Cursor 3 代号 Glass,将 IDE 降级为备选界面,以 Agent 控制台为核心。深度解析多 Agent 并行架构、/worktree 隔离、/best-of-n 模型竞标、Composer 2 自研模型、Cloud Handoff 云端流转,以及与 Claude Code、TRAE SOLO 的竞品对比。
Cursor
AI编程
Agent
多Agent并行
Composer 2
Glass
LMCache 深度拆解:当 KV Cache 变成可复用资产——LLM 推理的「免费午餐」完整指南
编程
LMCache 深度拆解:当 KV Cache 变成可复用资产——LLM 推理的「免费午餐」完整指南
2026-07-14 18:47:11 +0800 CST
view 183
深度拆解 LMCache 项目:从 Transformer Attention 机制出发,详细讲解 KV Cache 原理、三层存储架构、生产部署实战、Docker Compose 配置、CacheGen 压缩算法、PD 分离、跨实例 KV Cache 共享,以及与 vLLM/SGLang 的集成,配完整代码示例与性能调优指南。实测 DeepSeek 多轮对话 3~5 倍 TTFT 改善。
LMCache
KV Cache
LLM推理
vLLM
SGLang
推理优化
DeepSeek
分布式缓存
GLM-5.2 深度实战:国产开源模型首次在编程能力上超越GPT-5.5——从架构原理到生产部署的完整指南
编程
GLM-5.2 深度实战:国产开源模型首次在编程能力上超越GPT-5.5——从架构原理到生产部署的完整指南
2026-06-27 05:43:51 +0800 CST
view 1085
2026年6月智谱AI发布GLM-5.2,登顶开源权重模型榜首,在SWE-bench Pro编程基准上超越GPT-5.5。本文深度解析GLM-5.2的MoE架构、IndexShare长上下文技术、编程实战代码、性能优化和生产部署。
GLM-5.2
智谱AI
开源模型
编程能力
AI模型
MoE架构
长上下文
Valkey 深度实战:当开源缓存撕掉 Redis 商业面具——从异步I/O到百万QPS、从GLIDE客户端到生产迁移的完全指南(2026)
编程
Valkey 深度实战:当开源缓存撕掉 Redis 商业面具——从异步I/O到百万QPS、从GLIDE客户端到生产迁移的完全指南(2026)
2026-06-19 11:57:00 +0800 CST
view 419
Valkey深度实战:从Redis商业许可证变更引发的开源革命,到异步I/O线程+Prefetch+MAA实现百万QPS,从GLIDE多语言客户端到RedisShake零停机迁移的完全指南
Valkey
Redis
缓存
异步IO
GLIDE
数据库
性能优化
SGLang 深度实战:新一代 LLM 编程与推理框架——从 RadixAttention 原理到 Agent 系统生产部署
编程
SGLang 深度实战:新一代 LLM 编程与推理框架——从 RadixAttention 原理到 Agent 系统生产部署
2026-05-06 17:37:39 +0800 CST
view 800
深度解析 SGLang 推理框架的 RadixAttention 原理、DSL 编程范式、正则约束解码,以及在 Agent 系统和多轮对话场景的生产部署实践。
SGLang
LLM
推理加速
Agent
RadixAttention
结构化生成
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
4
5
6
7
8
...
60
下一页