程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
zvec 深度实战:把向量数据库塞进进程里——从 ANN 算法、HNSW 图索引到混合检索与十亿级向量的完整指南(2026)
编程
zvec 深度实战:把向量数据库塞进进程里——从 ANN 算法、HNSW 图索引到混合检索与十亿级向量的完整指南(2026)
2026-07-09 00:48:06 +0800 CST
view 309
阿里巴巴开源的进程内向量数据库 zvec:从余弦相似度、ANN、HNSW 图索引、IVF、乘积量化到混合检索与 RAG 落地的完整工程拆解,附可运行 Python 代码。
向量数据库
ANN
HNSW
zvec
RAG
近似最近邻
MELT架构深度解析:高通如何让AI"深度思考"不再耗尽内存——循环Transformer的内存革命
编程
MELT架构深度解析:高通如何让AI"深度思考"不再耗尽内存——循环Transformer的内存革命
2026-05-19 13:46:15 +0800 CST
view 503
高通AI研究院提出的MELT架构通过门控机制让循环Transformer的内存消耗保持恒定,无论思考多少轮。本文深度解析其架构原理、数学推导、训练策略与性能实测。
AI
Transformer
内存优化
深度推理
高通
Bun 深度拆解:当 Anthropic 用 AI 让 Bun 用 Rust 重写了自己——一门 JS 运行时如何用 96 万行代码和 99.8% 通过率重写"AI编程代写"的心智模型
编程
Bun 深度拆解:当 Anthropic 用 AI 让 Bun 用 Rust 重写了自己——一门 JS 运行时如何用 96 万行代码和 99.8% 通过率重写"AI编程代写"的心智模型
2026-07-15 13:16:06 +0800 CST
view 191
深度拆解 Anthropic 收购后,Bun 在 9 天内用 Claude Code 重写 96 万行 Zig 代码为 Rust 的全过程:迁移策略、测试结果、10000+ unsafe 代码块的争议,以及 AI 编程进入基础设施重写阶段的工程启示。
Bun
Rust
Zig
JavaScript
AI编程
Claude
系统编程
代码迁移
unsafe
性能优化
Bun 用 Claude 在 6 天内重写 96 万行 Rust:AI 驱动的大规模代码迁移深度解析——从 Zig 到 Rust 的工程实践、unsafe 争议与信任危机
编程
Bun 用 Claude 在 6 天内重写 96 万行 Rust:AI 驱动的大规模代码迁移深度解析——从 Zig 到 Rust 的工程实践、unsafe 争议与信任危机
2026-05-29 06:08:35 +0800 CST
view 774
深度解析 Bun 从 Zig 到 Rust 的 AI 驱动大规模代码迁移:6天96万行代码、13000个unsafe块的争议、社区信任危机与项目出走,以及AI重写软件的方法论与风险
Bun
Rust
Zig
AI编程
代码迁移
unsafe
Claude Code
LLM 推理框架选型实战:vLLM、TensorRT-LLM、TGI、DeepSpeed-MII 深度对比与生产部署指南
编程
LLM 推理框架选型实战:vLLM、TensorRT-LLM、TGI、DeepSpeed-MII 深度对比与生产部署指南
2026-07-03 13:49:04 +0800 CST
view 426
深度对比 vLLM 0.5、TensorRT-LLM 1.8、TGI 2.0、DeepSpeed-MII 0.9 四大推理框架,从核心技术原理、性能数据、成本账本到生产部署实战,帮你做出正确的框架选型决策。
LLM
vLLM
TensorRT-LLM
TGI
DeepSpeed
推理优化
大模型部署
GPU优化
Rust 1.95 深度实战:cfg_select! 宏、let chains 守卫与标准库全面升级,从语言特性到工程落地的完整指南
编程
Rust 1.95 深度实战:cfg_select! 宏、let chains 守卫与标准库全面升级,从语言特性到工程落地的完整指南
2026-04-26 13:44:08 +0800 CST
view 658
Rust 1.95深度解析:cfg_select!宏替代cfg-if、match if let守卫实战、PowerPC内联汇编、标准库API稳定化与兼容性变更,附完整代码示例
Rust
cfg_select
let chains
内联汇编
标准库
跨平台
Rust 1.95 新特性全解:从 cfg_select! 到 match if let 守卫的工程实战
编程
Rust 1.95 新特性全解:从 cfg_select! 到 match if let 守卫的工程实战
2026-04-26 13:44:55 +0800 CST
view 738
Rust 1.95深度解析:cfg_select!宏替代cfg-if、match if let守卫实战、PowerPC内联汇编、标准库API稳定化与兼容性变更,附完整代码示例
Rust
cfg_select
let chains
内联汇编
标准库
跨平台
Unsloth 深度拆解:当 LLM 微调学会「省显存」——2倍速+70%显存节省背后的 QLoRA 工程革命
编程
Unsloth 深度拆解:当 LLM 微调学会「省显存」——2倍速+70%显存节省背后的 QLoRA 工程革命
2026-07-15 17:47:08 +0800 CST
view 220
深度拆解Unsloth技术栈:QLoRA量化原理、4-bit NF4精度机制、Triton内核重写、8-bit Adam优化器、梯度检查点优化,以及从Notebook到Ollama/vLLM生产部署的完整工程路径,含完整代码实战
Unsloth
LLM微调
QLoRA
LoRA
4-bit量化
深度学习
模型训练
Unsloth实战:当QLoRA让27B模型在RTX 4090上跑起来——从Qwen3.5微调到Ollama部署的完整工程链
编程
Unsloth实战:当QLoRA让27B模型在RTX 4090上跑起来——从Qwen3.5微调到Ollama部署的完整工程链
2026-07-15 17:48:36 +0800 CST
view 204
深度拆解Unsloth技术栈:QLoRA量化原理、4-bit NF4精度机制、Triton内核重写、8-bit Adam优化器、梯度检查点优化,以及从Notebook到Ollama/vLLM生产部署的完整工程路径,含完整代码实战
Unsloth
LLM微调
QLoRA
LoRA
4-bit量化
深度学习
模型训练
稀疏注意力架构革命:2026年长上下文大模型核心技术解析
编程
稀疏注意力架构革命:2026年长上下文大模型核心技术解析
2026-07-09 08:45:09 +0800 CST
view 382
深入解析2026年稀疏注意力技术革命,涵盖SubCube、CSA/HCA、MSA三大架构的技术原理、代码实现与实战指南,探讨长上下文大模型的最新发展。
AI
大模型
Transformer
稀疏注意力
LongContext
DeepSeek
MiniMax
TriAttention深度解析:MIT韩松团队如何用三角函数让单卡4090跑出百万Token上下文
编程
TriAttention深度解析:MIT韩松团队如何用三角函数让单卡4090跑出百万Token上下文
2026-04-17 10:15:58 +0800 CST
view 692
2026年4月,MIT、英伟达、浙江大学联合发布TriAttention,用三角函数建模注意力距离偏好,实现KV缓存10.7倍压缩,让单卡4090跑出百万Token上下文。
AI
大模型
Transformer
注意力机制
KV缓存
长上下文
模型优化
论文解读
2026
TensorRT-LLM 1.0 深度实战:当 PyTorch 架构成为默认体验,NVIDIA 的 LLM 推理引擎正式走向成熟
编程
TensorRT-LLM 1.0 深度实战:当 PyTorch 架构成为默认体验,NVIDIA 的 LLM 推理引擎正式走向成熟
2026-07-22 10:46:37 +0800 CST
view 168
深度解析 TensorRT-LLM 1.0:PyTorch 架构正式稳定、LLM API 稳定化、多模态 VLM 原生支持、Qwen3 MoE 优化、LoRA 生产级管理、trtllm-serve 推理服务化,配完整部署实战代码。
TensorRT-LLM
LLM推理
GPU加速
PyTorch
NVIDIA
深度学习
模型部署
推理优化
JetBrains 2026 全线产品深度解析:ACP 注册表内置 AI 智能体、MCP 服务器、Recap/Insights——传统 IDE 的「绝地反击」
编程
JetBrains 2026 全线产品深度解析:ACP 注册表内置 AI 智能体、MCP 服务器、Recap/Insights——传统 IDE 的「绝地反击」
2026-05-15 09:18:50 +0800 CST
view 872
JetBrains 2026全线IDE发布:ACP注册表让Codex/Claude Agent等智能体内置IDE、MCP服务器暴露IDE代码理解能力、Recap和Insights主动式AI辅助、Git工作树人机并行开发。深度解析6大IDE核心特性与AI时代战略。
JetBrains,IntelliJ IDEA,ACP,MCP,AI Agent,IDE
pgvector 深度拆解:当关系数据库学会「向量检索」——HNSW/IVFFlat 索引原理、PostgreSQL 18 AIO 加持与 RAG 工程实战
编程
pgvector 深度拆解:当关系数据库学会「向量检索」——HNSW/IVFFlat 索引原理、PostgreSQL 18 AIO 加持与 RAG 工程实战
2026-07-16 01:17:53 +0800 CST
view 243
从工程师视角深度拆解 pgvector:HNSW/IVFFlat 索引原理、PostgreSQL 18 AIO 对向量检索的加持、一条生产级 RAG 链路实战与性能优化,澄清"PG18 原生向量搜索"的常见误解。
pgvector
PostgreSQL
向量检索
HNSW
RAG
AI数据库
Qwen3.8深度拆解:2.4万亿参数稀疏MoE架构的技术革命,从模型设计到开源落地的全链路复盘
编程
Qwen3.8深度拆解:2.4万亿参数稀疏MoE架构的技术革命,从模型设计到开源落地的全链路复盘
2026-08-11 10:55:36 +0800 CST
view 18
深度拆解阿里Qwen3.8的2.4万亿参数稀疏MoE架构:专家池设计、负载均衡、混合注意力机制、100万Token上下文、编程能力突破、开源生态影响与生产部署指南
Qwen3.8
大模型
MoE架构
稀疏激活
开源AI
千问
AI编程
深度学习
Transformer
Kimi K2.6开源:13小时编码与300子Agent集群,国产大模型抢滩长程编程高地
编程
Kimi K2.6开源:13小时编码与300子Agent集群,国产大模型抢滩长程编程高地
2026-04-27 14:52:59 +0800 CST
view 865
深度解析月之暗面开源的Kimi K2.6模型:13小时不间断编码、300子Agent集群协作、5天自主运行的技术架构与实测案例分析
Kimi K2.6
开源模型
长程编程
AI Agent
国产大模型
Moonshot AI
Agent集群
编程助手
MiniMax H3 深度拆解:全模态生成模型的「统一理解」革命——当 AI 学会像导演一样「看画面、听声音、读脚本」后,2K 视频创作的底层逻辑被彻底重写
编程
MiniMax H3 深度拆解:全模态生成模型的「统一理解」革命——当 AI 学会像导演一样「看画面、听声音、读脚本」后,2K 视频创作的底层逻辑被彻底重写
2026-08-03 07:12:16 +0800 CST
view 290
深度拆解MiniMax H3全模态生成模型三大核心架构:Contextual Omni Representation统一表征、H3-VAE音视频联合编码、H3-Omni Transformer理解-生成异构训练,附完整代码示例、API实战与性能对比分析
MiniMax
H3
全模态
视频生成
MoE
VAE
2K视频
V2V Motion Transfer
AI视频
多模态
PostgreSQL × DuckDB 深度拆解:一个实例如何同时搞定 OLTP、OLAP 和 AI 向量检索?
编程
PostgreSQL × DuckDB 深度拆解:一个实例如何同时搞定 OLTP、OLAP 和 AI 向量检索?
2026-07-27 09:12:43 +0800 CST
view 148
深度拆解腾讯云 PostgreSQL × DuckDB 一库多态集成方案:从列式存储原理、向量化执行机制、查询路由策略到 RAG 场景实战,附代码示例与性能对比数据。
PostgreSQL
DuckDB
OLAP
向量化执行
AI数据库
RAG
向量检索
HNSW
列式存储
云原生数据库
PostgreSQL 18 原生向量搜索深度解析:从内核原理到生产级 RAG 实战(2026)
编程
PostgreSQL 18 原生向量搜索深度解析:从内核原理到生产级 RAG 实战(2026)
2026-07-04 07:44:46 +0800 CST
view 385
深度解析 PostgreSQL 18 原生向量搜索特性:内核级向量计算、HNSW/IVFFlat 索引优化、混合查询执行计划、Python 完整代码实战、性能基准测试与生产部署最佳实践。(2026)
PostgreSQL 18
向量搜索
向量数据库
RAG
AI
Embedding
HNSW
PostgreSQL
语义检索
数据库
PostgreSQL 18 核心技术深度解析:从异步 I/O 到虚拟生成列,一次看懂 2026 年最重磅的数据库升级
编程
PostgreSQL 18 核心技术深度解析:从异步 I/O 到虚拟生成列,一次看懂 2026 年最重磅的数据库升级
2026-07-10 01:17:33 +0800 CST
view 386
深度解析 PostgreSQL 18 核心技术:异步 I/O 子系统提升 3 倍性能、uuidv7() 解决分布式 ID 时间有序性、虚拟生成列、Vital Constraints 企业级有效期约束,配完整代码示例与迁移指南。
PostgreSQL
数据库
PostgreSQL 18
异步I/O
uuidv7
OAuth
生成列
Skip Scan
Temporal Constraints
性能优化
LLM 推理的显存战争:从 PagedAttention 到统一内存架构——KV Cache 管理五世代深度解析(2026)
编程
LLM 推理的显存战争:从 PagedAttention 到统一内存架构——KV Cache 管理五世代深度解析(2026)
2026-06-15 11:18:23 +0800 CST
view 515
深度解析大模型推理中 KV Cache 管理的五世代演进:从连续分配到 PagedAttention,再到异构缓存、分布式 KV 和统一混合内存架构。结合 vLLM、SGLang、TensorRT-LLM 给出生产环境选型指南。
LLM
大模型
KVCache
PagedAttention
vLLM
SGLang
TensorRT
推理优化
显存管理
分布式
MiniMax H3 开源视频模型架构深度拆解:从 Contextual Omni Representation 到 H3-Omni Transformer 的全链路工程解析
编程
MiniMax H3 开源视频模型架构深度拆解:从 Contextual Omni Representation 到 H3-Omni Transformer 的全链路工程解析
2026-08-11 14:32:39 +0800 CST
view 17
深度拆解 MiniMax H3 开源视频模型三层模块架构:Contextual Omni Representation、H3-Omni Transformer、H3-VAE,以及 FL2VA 与 Ref2VA 的技术差异、INT8 量化优化与本地部署实战
MiniMax H3
视频生成
开源AI
扩散模型
多模态
H3-Omni Transformer
TimesFM 深度实战:当 Google Research 把基础模型带进时间序列——从预训练解码器到零样本推理、从多周期建模到生产级预测完全指南(2026)
编程
TimesFM 深度实战:当 Google Research 把基础模型带进时间序列——从预训练解码器到零样本推理、从多周期建模到生产级预测完全指南(2026)
2026-06-21 03:24:16 +0800 CST
view 546
TimesFM 2.5深度解析:Google Research开源的时间序列基础模型,200M参数、16K上下文、零样本推理。从Patch机制、RevIN归一化到LoRA微调、生产部署,10000字完整技术指南。
TimesFM
时间序列预测
Google Research
基础模型
零样本推理
Transformer
概率预测
Pyrefly 深度解析:Facebook 用 Rust 重写 Python 类型检查器,185万行/秒的速度意味着什么?
编程
Pyrefly 深度解析:Facebook 用 Rust 重写 Python 类型检查器,185万行/秒的速度意味着什么?
2026-07-27 13:16:46 +0800 CST
view 144
深度解析 Facebook 出品的 Pyrefly:Rust 实现的 Python 类型检查器,每秒检查 185 万行代码,比 Pyright 快 15 倍。涵盖架构设计、性能优化、Tensor Shapes、AI 编程集成,附实战指南与竞品对比。
Python
类型检查器
Rust
Meta
Facebook
Pyright
Mypy
LSP
AI编程
Tensor Shapes
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
9
10
11
12
13
...
77
下一页