程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Valkey 9.0 深度实战:当开源社区重塑内存数据库——从异步 IO 到原子槽位迁移的生产级完全指南(2026)
编程
Valkey 9.0 深度实战:当开源社区重塑内存数据库——从异步 IO 到原子槽位迁移的生产级完全指南(2026)
2026-06-06 00:06:38 +0800 CST
view 467
Valkey从Redis分叉两年后的深度实战:8.0异步IO线程+数据预取+MAA实现单节点120万QPS,9.0原子槽位迁移+集群多数据库+哈希字段过期支持2000节点集群
Valkey
Redis
内存数据库
开源
缓存
DwarfStar 4 深度实战:当 Redis 之父用 C 语言重新发明本地推理——从磁盘 KV 一等公民到 284B 模型跑进 MacBook 的工程完全指南(2026)
编程
DwarfStar 4 深度实战:当 Redis 之父用 C 语言重新发明本地推理——从磁盘 KV 一等公民到 284B 模型跑进 MacBook 的工程完全指南(2026)
2026-06-14 09:48:41 +0800 CST
view 1092
Redis之父antirez的ds4项目深度解析:非对称2-bit量化、磁盘KV缓存一等公民、session_sync增量推理、方向引导、分布式推理的工程实战指南
ds4
DwarfStar
本地推理
DeepSeek
MoE
KV缓存
antirez
Metal
量化
万字深度解析 LMCache:当 LLM 推理遇见 KV Cache 革命——从 TTFT 优化到跨引擎 KV 复用、从 GPU/CPU/Disk 三级存储到分布式 P2P 共享的完整技术指南(2026)
编程
万字深度解析 LMCache:当 LLM 推理遇见 KV Cache 革命——从 TTFT 优化到跨引擎 KV 复用、从 GPU/CPU/Disk 三级存储到分布式 P2P 共享的完整技术指南(2026)
2026-07-03 03:14:31 +0800 CST
view 347
深度解析LMCache KV Cache管理层:从TTFT优化原理、GPU/CPU/Disk三级存储架构、跨引擎KV复用、分布式P2P共享,到与vLLM深度集成的生产级部署实战,含完整代码和性能调优指南。
LMCache
LLM推理
KV Cache
vLLM
TTFT优化
GPU优化
AI推理加速
分布式缓存
百万上下文从「奢侈品」变「日用品」:DeepSeek V4 CSA/HCA 混合注意力架构深度解析
编程
百万上下文从「奢侈品」变「日用品」:DeepSeek V4 CSA/HCA 混合注意力架构深度解析
2026-07-21 16:47:21 +0800 CST
view 222
深度解析 DeepSeek V4 的 CSA/HCA 混合注意力架构,涵盖压缩稀疏注意力、重度压缩注意力、流形约束超连接等核心创新,配有 Python 代码示例与工程价值判断。
DeepSeek
V4
CSA
HCA
注意力机制
MoE
KV缓存
长上下文
大模型架构
TurboQuant 深度实战:Google 的 KV 缓存压缩算法完全指南(2026)
编程
TurboQuant 深度实战:Google 的 KV 缓存压缩算法完全指南(2026)
2026-06-08 20:52:38 +0800 CST
view 464
2026年3月Google Research在ICLR 2026发表TurboQuant算法,将LLM的KV缓存压缩至3-bit,实现6倍内存缩减和8倍推理加速。本文深入剖析TurboQuant的技术原理,并提供生产级部署指南。
TurboQuant
KV缓存压缩
LLM推理优化
量化算法
Google Research
ICLR2026
Valkey 深度实战:当 Redis 走向限制性许可,Linux 基金会如何用一个分支重写内存数据库游戏规则——架构、集群与平滑迁移完全指南(2026)
编程
Valkey 深度实战:当 Redis 走向限制性许可,Linux 基金会如何用一个分支重写内存数据库游戏规则——架构、集群与平滑迁移完全指南(2026)
2026-07-22 03:45:56 +0800 CST
view 188
2026 Valkey 深度实战:从 Redis 许可证变更到 Linux 基金会分叉,拆解单线程命令执行+多线程IO、数据结构编码、Cluster 16384槽、9.0原子槽位迁移与哈希字段过期,配 Python/Go/Lua 实战与平滑迁移方案。
Valkey
Redis
内存数据库
键值存储
集群
高可用
平滑迁移
缓存
Valkey 完全指南:从 Redis 许可证地震到生产级内存数据库——单线程内核、Cluster 槽位与零停机迁移的工程师视角(2026)
编程
Valkey 完全指南:从 Redis 许可证地震到生产级内存数据库——单线程内核、Cluster 槽位与零停机迁移的工程师视角(2026)
2026-07-22 03:46:32 +0800 CST
view 193
2026 Valkey 深度实战:从 Redis 许可证变更到 Linux 基金会分叉,拆解单线程命令执行+多线程IO、数据结构编码、Cluster 16384槽、9.0原子槽位迁移与哈希字段过期,配 Python/Go/Lua 实战与平滑迁移方案。
Valkey
Redis
内存数据库
键值存储
集群
高可用
平滑迁移
缓存
vLLM 深度实战:当 LLM 推理遇上 PagedAttention——从 KV 缓存管理到生产级高并发服务的完全指南(2026)
编程
vLLM 深度实战:当 LLM 推理遇上 PagedAttention——从 KV 缓存管理到生产级高并发服务的完全指南(2026)
2026-06-08 22:52:24 +0800 CST
view 749
深度解析vLLM推理框架的核心原理、PagedAttention创新机制、分布式推理架构,以及生产环境部署的最佳实践。
vLLM
PagedAttention
LLM推理
KV缓存
分布式推理
2026 年 vLLM 推理服务实战:PagedAttention 原理、分布式部署与性能调优完全指南
编程
2026 年 vLLM 推理服务实战:PagedAttention 原理、分布式部署与性能调优完全指南
2026-06-08 22:53:03 +0800 CST
view 470
深度解析vLLM推理框架的核心原理、PagedAttention创新机制、分布式推理架构,以及生产环境部署的最佳实践。
vLLM
PagedAttention
LLM推理
KV缓存
分布式推理
CVE-2026-31431 Copy Fail深度解析:Linux内核零拷贝页缓存污染与本地提权完整指南
编程
CVE-2026-31431 Copy Fail深度解析:Linux内核零拷贝页缓存污染与本地提权完整指南
2026-07-27 01:12:18 +0800 CST
view 501
深度解析2026年最热Linux内核漏洞CVE-2026-31431(Copy Fail):从AF_ALG加密接口、splice()零拷贝机制到authencesn写入原理,完整拆解攻击链,提供检测、修复和生产环境防御方案。
CVE
Linux内核
内核漏洞
本地提权
AF_ALG
splice
页缓存
安全漏洞
零拷贝
权限提升
Valkey 9.1 深度拆解:AI 智能体自动化代码回迁、Provenance Guard 信任链与 RDMA 网络层——Redis 最佳平替的终极进化
编程
Valkey 9.1 深度拆解:AI 智能体自动化代码回迁、Provenance Guard 信任链与 RDMA 网络层——Redis 最佳平替的终极进化
2026-08-03 01:13:30 +0800 CST
view 158
深度拆解Valkey9.1:AI智能体自动化代码回迁、Provenance Guard信任链、RDMA网络层突破、2000节点集群扩展,附完整Redis迁移指南与性能对比分析
Valkey
Redis
开源
内存数据库
AI智能体
RDMA
集群
缓存
向量搜索
供应链安全
Redis和Memcached有什么区别?
综合
Redis和Memcached有什么区别?
2024-11-18 17:57:13 +0800 CST
view 1536
Redis和Memcached是流行的内存数据缓存系统,主要区别在于数据结构、持久化、事务支持、数据过期策略、淘汰策略、网络协议、集群支持和扩展性。Memcached适合简单缓存需求,而Redis则支持复杂数据结构和持久化,适用于实时数据分析和会话管理等场景。选择取决于具体应用需求。
数据库
缓存
技术比较
开发工具
TriAttention深度解析:MIT韩松团队如何用三角函数让单卡4090跑出百万Token上下文
编程
TriAttention深度解析:MIT韩松团队如何用三角函数让单卡4090跑出百万Token上下文
2026-04-17 10:15:58 +0800 CST
view 703
2026年4月,MIT、英伟达、浙江大学联合发布TriAttention,用三角函数建模注意力距离偏好,实现KV缓存10.7倍压缩,让单卡4090跑出百万Token上下文。
AI
大模型
Transformer
注意力机制
KV缓存
长上下文
模型优化
论文解读
2026
Go 标准库即将支持自动ETag:静态文件缓存终于不用手写了
编程
Go 标准库即将支持自动ETag:静态文件缓存终于不用手写了
2026-05-21 16:30:11 +0800 CST
view 613
Go团队接受提案#60940,在io/fs中新增HashFileInfo接口,让embed.FS和net/http.FileServer自动生成和校验ETag,Go 1.27起静态文件服务不再需要手动管理HTTP缓存。
Go语言
标准库
ETag
HTTP缓存
Go1.27
io/fs
embed
Web服务
当 Redis 之父遇上 DeepSeek V4 Flash:ds4.c 如何用 900 行代码重写本地大模型推理
编程
当 Redis 之父遇上 DeepSeek V4 Flash:ds4.c 如何用 900 行代码重写本地大模型推理
2026-07-15 18:15:32 +0800 CST
view 307
Redis创始人antirez开源ds4.c:用C语言+Metal GPU手写DeepSeek V4 Flash推理引擎,26 tok/s性能,2-bit MoE量化,KV缓存磁盘分层管理
ds4.c
DeepSeek V4 Flash
Metal推理
Redis之父
MoE量化
KV缓存分层
oMLX 深度解析:Apple Silicon 原生的本地大模型推理服务器——从分层 KV 缓存到菜单栏级 AI 编码伴侣
编程
oMLX 深度解析:Apple Silicon 原生的本地大模型推理服务器——从分层 KV 缓存到菜单栏级 AI 编码伴侣
2026-05-21 22:30:11 +0800 CST
view 916
深入解析 oMLX 的分层 KV 缓存架构(热 RAM + 冷 SSD)、Copy-on-Write 优化、与 Claude Code 的深度集成,以及 Apple Silicon 原生的推理性能优化。
oMLX
Apple Silicon
本地大模型
KV缓存
MLX
推理服务器
vLLM 深度拆解:当大模型推理学会「分页注意力」——PagedAttention、连续批处理与 V1 引擎如何重写 GPU 推理服务的心智模型
编程
vLLM 深度拆解:当大模型推理学会「分页注意力」——PagedAttention、连续批处理与 V1 引擎如何重写 GPU 推理服务的心智模型
2026-07-16 04:19:16 +0800 CST
view 246
从工程师视角深度拆解 vLLM:PagedAttention 分页注意力、连续批处理、V1 引擎架构、KV Cache 管理、量化与投机解码,配 OpenAI 兼容服务、引导解码与生产调优实战。
vLLM
PagedAttention
连续批处理
大模型推理
GPU推理服务
KV缓存
V1引擎
用 Obsidian + Claude 整了个 AI 记忆外挂:claude-obsidian 深度测评
编程
用 Obsidian + Claude 整了个 AI 记忆外挂:claude-obsidian 深度测评
2026-07-04 16:22:16 +0800 CST
view 485
claude-obsidian是GitHub上8.5K Stars的开源AI知识引擎,将PDF/文本自动整理为wiki知识图谱,hot.md持久化跨会话记忆,autoresearch三轮自主研究+归档,支持PARA/LYT/Zettelkasten四种知识组织方法论,MIT协议数据不锁死。
Obsidian
Claude
AI第二大脑
知识图谱
claude-obsidian
hot缓存
autoresearch
PARA
LYT
Zettelkasten
Markdown
MIT
开源
MIT黑科技:TriAttention如何用三角函数让大模型「记住」超长上下文
编程
MIT黑科技:TriAttention如何用三角函数让大模型「记住」超长上下文
2026-04-18 12:45:10 +0800 CST
view 1025
深度解析MIT/NVIDIA/浙大联合发布的TriAttention技术,用三角函数预测注意力分布,实现KV Cache智能压缩,让超长上下文推理成为可能
大模型
注意力机制
KV缓存
Transformer
深度学习
AI优化
eBPF 深度实战:当Linux内核成为可编程平台——从XDP加速到生产级可观测性的完全指南(2026)
编程
eBPF 深度实战:当Linux内核成为可编程平台——从XDP加速到生产级可观测性的完全指南(2026)
2026-06-13 00:17:30 +0800 CST
view 754
深入剖析eBPF架构原理、开发实战、性能优化和生产部署,涵盖XDP、CO-RE、libbpf、BCC等核心技术
eBPF
Linux内核
可观测性
网络性能
XDP
BPF
性能优化
React Compiler 深度解析:让 React 终于学会「自动优化」的编译器魔法
编程
React Compiler 深度解析:让 React 终于学会「自动优化」的编译器魔法
2026-05-12 02:15:08 +0800 CST
view 647
深度解析React Compiler(React Forget)的工作原理:通过静态分析自动推导依赖关系、自动插入useMemo/useCallback记忆化代码、构建数据流图与活性分析算法、Babel插件实现细节、与手动优化性能对比,附Vite/Next.js集成指南与渐进式迁移策略
React,React Compiler,性能优化,自动记忆化,useMemo,useCallback,React.memo,Babel插件,静态分析,前端性能
Capo.js:你的head排序对了吗?一行代码检测出来
案例
Capo.js:你的head排序对了吗?一行代码检测出来
2026-05-09 06:37:27 +0800 CST
view 539
Capo.js开源工具:检测HTML head元素排序是否合理,11级权重体系量化排序规则,零依赖6kB Gzip,Chrome扩展装上就能用,程序化API适合CI集成
前端性能
head排序
性能优化
零依赖
Chrome扩展
ct.css
MySQL数据库的36条军规
编程
MySQL数据库的36条军规
2024-11-18 16:46:25 +0800 CST
view 1856
本文总结了MySQL数据库的36条军规,涵盖了核心军规、字段类军规、索引类军规、SQL类军规和约定类军规。每条军规背后都有实战经验,强调了性能优化和合理使用数据库的原则,如避免复杂运算、合理控制数据量、谨慎添加索引等,以提升数据库的效率和稳定性。
数据库
性能优化
开发规范
PostgreSQL 18 深度实战:从异步I/O到增量备份——全球最强开源数据库的九大革命性升级与生产级实践
编程
PostgreSQL 18 深度实战:从异步I/O到增量备份——全球最强开源数据库的九大革命性升级与生产级实践
2026-05-22 12:18:04 +0800 CST
view 664
PostgreSQL 18 深度解析:异步I/O、多列索引跳过扫描、虚拟生成列、UUIDv7、内置增量备份、JSON_TABLE、OAuth 2.0认证、逻辑复制冲突日志、全面可观测性——附生产级代码实战与升级指南
PostgreSQL
数据库
云原生
性能优化
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
3
4
5
6
7
...
41
下一页