程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
李彦宏的AI新度量衡:Token是成本DAA才是价值(Create2026深度复盘)
编程
李彦宏的AI新度量衡:Token是成本DAA才是价值(Create2026深度复盘)
2026-05-16 17:25:28 +0800 CST
view 632
2026年5月百度Create2026,李彦宏提出DAA(日活智能体数)替代Token成为AI时代新度量衡。深度解析这一概念的战略深意,以及百度DuMate、秒哒、伐谋等产品矩阵的技术内核。
百度
DAA
AI Agent
Create2026
DuMate
秒哒
伐谋
智能体
AI时代度量衡
超级个体
Kimi K3 深度拆解:2.8万亿参数开源MoE霸主的工程革命,从注意力机制到Infra全链路解析
编程
Kimi K3 深度拆解:2.8万亿参数开源MoE霸主的工程革命,从注意力机制到Infra全链路解析
2026-07-29 07:45:23 +0800 CST
view 274
深度拆解 Kimi K3:2.8万亿参数开源MoE霸主的完整架构解析,涵盖 KDA 注意力机制、Stable LatentMoE、FlashKDA 高性能算子、MoonEP 通信库、AgentENV 训练沙箱,附代码实战与性能评测。
Kimi K3
MoE架构
KDA
Attention Residuals
FlashKDA
AgentENV
MoonEP
开源大模型
长上下文
代码生成
vLLM 与 SGLang 深度横评:两种推理范式的工程哲学对决
编程
vLLM 与 SGLang 深度横评:两种推理范式的工程哲学对决
2026-07-24 06:14:45 +0800 CST
view 308
深度对比vLLM与SGLang两大LLM推理引擎:PagedAttention vs RadixAttention,Continuous Batching原理,吞吐与延迟实战选型指南
vLLM
SGLang
LLM推理
PagedAttention
RadixAttention
Continuous Batching
GPU优化
推理引擎
大模型推理引擎 2026 终极对决:vLLM vs SGLang,从 PagedAttention 到 RadixAttention,一次把 LLM 部署讲透(深度实战)
编程
大模型推理引擎 2026 终极对决:vLLM vs SGLang,从 PagedAttention 到 RadixAttention,一次把 LLM 部署讲透(深度实战)
2026-07-13 05:12:59 +0800 CST
view 264
深度对比 vLLM 与 SGLang 两大 LLM 推理引擎:从 KV Cache、PagedAttention、RadixAttention、连续批处理、分块预填充、推测解码、P/D 分离到量化部署,配可直接运行的生产级代码与基准测试。
vLLM
SGLang
LLM推理
大模型部署
PagedAttention
RadixAttention
sqlite-vec 深度解析:零依赖的 SQLite 向量搜索扩展如何用一个 .so 文件让嵌入式数据库拥有百万级向量检索能力——从 vec0 虚拟表架构到 RAG/语义搜索生产级实战的完整指南
编程
sqlite-vec 深度解析:零依赖的 SQLite 向量搜索扩展如何用一个 .so 文件让嵌入式数据库拥有百万级向量检索能力——从 vec0 虚拟表架构到 RAG/语义搜索生产级实战的完整指南
2026-07-07 04:13:20 +0800 CST
view 407
深度解析sqlite-vec:纯C编写的零依赖SQLite向量搜索扩展,支持float/int8/binary三种向量类型、L2/cosine/hamming/jaccard四种距离度量、IVF近似搜索索引。从vec0虚拟表架构原理到Python/Go/Node.js多语言实战,涵盖RAG系统构建、FTS5混合检索、WASM浏览器运行、MCP协议集成,含完整性能基准与ChromaDB/Qdrant/Milvus对比分析。
sqlite-vec
SQLite
向量搜索
RAG
向量数据库
嵌入式
语义搜索
AI Agent
开源
WWDC 2026 开发者深度实战:当苹果生态迎来三重地震——Swift 6 严格并发、macOS 27 告别 Intel、Siri AI 开发框架与折叠屏适配的生产级完全指南
编程
WWDC 2026 开发者深度实战:当苹果生态迎来三重地震——Swift 6 严格并发、macOS 27 告别 Intel、Siri AI 开发框架与折叠屏适配的生产级完全指南
2026-06-18 10:27:33 +0800 CST
view 393
WWDC 2026开发者实战指南:Swift 6严格并发迁移、macOS 27告别Intel、Siri AI四套开发框架、折叠屏iPhone Ultra适配、Liquid Glass设计体系的生产级完全指南
Swift 6
WWDC 2026
macOS 27
iOS 27
Swift concurrency
Apple Intelligence
Siri AI
Core AI
App Intents
Foundation Models
折叠屏
iPhone Ultra
Liquid Glass
Apple Silicon
LLM推理引擎深度实战:从PagedAttention到生产级部署,万字长文吃透2026年最关键的AI基础设施
编程
LLM推理引擎深度实战:从PagedAttention到生产级部署,万字长文吃透2026年最关键的AI基础设施
2026-06-27 12:44:29 +0800 CST
view 385
2026年LLM推理引擎深度实战:从PagedAttention、连续批处理、量化技术到生产级K8s部署,万字长文覆盖vLLM、SGLang、TensorRT-LLM、TGI四大框架架构原理与实测对比
LLM推理
vLLM
PagedAttention
SGLang
推理优化
TensorRT-LLM
生产部署
KV Cache
量化
KV Cache 显存优化深度解析:从 PagedAttention 到 2026 年最新压缩技术演进
编程
KV Cache 显存优化深度解析:从 PagedAttention 到 2026 年最新压缩技术演进
2026-08-01 15:47:00 +0800 CST
view 153
从第一性原理深度剖析 KV Cache 显存困境,系统拆解 PagedAttention 核心原理,对比 vLLM/TensorRT-LLM/SGLang 三大推理框架技术路线,涵盖 FP8/INT4 量化、前缀缓存、StreamingLLM 等 2026 年最新压缩技术,含完整代码示例与生产调优指南。
KV Cache
PagedAttention
vLLM
TensorRT-LLM
SGLang
LLM推理
GPU优化
显存优化
量化
深度学习
sqlite-vec 深度实战:当 SQLite 遇见向量搜索,AI 应用的轻量级记忆系统从此有了标准答案(2026)
编程
sqlite-vec 深度实战:当 SQLite 遇见向量搜索,AI 应用的轻量级记忆系统从此有了标准答案(2026)
2026-07-22 01:16:13 +0800 CST
view 191
深度解析 sqlite-vec:一个纯C实现的SQLite向量搜索扩展,让SQLite直接支持语义搜索。涵盖核心架构、HNSW索引原理、SQL API完全指南、Python实战案例(知识库检索系统、AI Agent长期记忆、RAG系统)、性能优化、常见问题解决方案以及LangChain/LlamaIndex生态集成。
sqlite-vec
SQLite
向量搜索
AI应用
语义检索
RAG
Embedding
HNSW
AI Agent
LLM 推理的显存战争:从 PagedAttention 到统一内存架构——KV Cache 管理五世代深度解析(2026)
编程
LLM 推理的显存战争:从 PagedAttention 到统一内存架构——KV Cache 管理五世代深度解析(2026)
2026-06-15 11:18:23 +0800 CST
view 527
深度解析大模型推理中 KV Cache 管理的五世代演进:从连续分配到 PagedAttention,再到异构缓存、分布式 KV 和统一混合内存架构。结合 vLLM、SGLang、TensorRT-LLM 给出生产环境选型指南。
LLM
大模型
KVCache
PagedAttention
vLLM
SGLang
TensorRT
推理优化
显存管理
分布式
WWDC 2026深度解析:苹果AI战略全面重构,Siri从语音助手进化为智能体 —— 从系统架构到开发者机遇的完全指南
编程
WWDC 2026深度解析:苹果AI战略全面重构,Siri从语音助手进化为智能体 —— 从系统架构到开发者机遇的完全指南
2026-06-09 18:15:56 +0800 CST
view 577
WWDC 2026正式发布全新Siri AI,从技术架构到开发者生态全面解析苹果AI战略反击战
WWDC
Apple
Siri
AI
iOS
macOS
App Intents
Apple Intelligence
Claude Memory Compiler 深度解析:当 AI 编程助手第一次拥有「编译器思维」的记忆系统
编程
Claude Memory Compiler 深度解析:当 AI 编程助手第一次拥有「编译器思维」的记忆系统
2026-04-10 03:35:31 +0800 CST
view 959
claude-memory-compiler 把 AI 对话当作源代码,用 LLM 编译成结构化知识库,让 Claude Code 拥有跨会话记忆能力
Claude Code
AI Agent
Knowledge Management
LLM
Memory System
GreptimeDB 深度实战:当可观测性告别「三件套」——从宽事件统一引擎到存算分离、Flow 流处理与 PB 级日检索亚秒的生产级完全指南(2026)
编程
GreptimeDB 深度实战:当可观测性告别「三件套」——从宽事件统一引擎到存算分离、Flow 流处理与 PB 级日检索亚秒的生产级完全指南(2026)
2026-06-17 10:58:30 +0800 CST
view 485
GreptimeDB深度实战:从宽事件统一模型到存算分离架构、Flow流处理引擎、SQL+PromQL双查询、PB级亚秒检索的完整生产级指南
GreptimeDB
可观测性
时序数据库
Rust
OpenTelemetry
GreptimeDB 深度拆解:从「三套系统」到 Observability 2.0 —— Rust 列存引擎、存算分离架构与宽事件统一查询实战
编程
GreptimeDB 深度拆解:从「三套系统」到 Observability 2.0 —— Rust 列存引擎、存算分离架构与宽事件统一查询实战
2026-07-31 07:44:49 +0800 CST
view 202
深度拆解 GreptimeDB:一个用 Rust 编写的 Observability 2.0 数据库,统一存储指标、日志、链路。详解宽事件模型、列存引擎、存算分离架构、Flow 流处理引擎,以及从 Prometheus+Loki 迁移实战。
GreptimeDB
可观测性
Rust
时序数据库
OpenTelemetry
列存引擎
存算分离
云原生
Shannon 深度解析:完全自主 AI 黑客的技术内幕——96.15% 成功率的白盒渗透测试革命
编程
Shannon 深度解析:完全自主 AI 黑客的技术内幕——96.15% 成功率的白盒渗透测试革命
2026-05-18 21:19:51 +0800 CST
view 799
Shannon 以 96.15% 的成功率刷新 XBOW 基准测试,成为首个真正可用的自主 AI 黑客工具。本文深入剖析其技术架构、核心算法、实战案例。
AI Security
Penetration Testing
GitHub Trending
Shannon
Autonomous AI
Pyrefly 深度解析:Facebook 用 Rust 重写 Python 类型检查器,185万行/秒的速度意味着什么?
编程
Pyrefly 深度解析:Facebook 用 Rust 重写 Python 类型检查器,185万行/秒的速度意味着什么?
2026-07-27 13:16:46 +0800 CST
view 153
深度解析 Facebook 出品的 Pyrefly:Rust 实现的 Python 类型检查器,每秒检查 185 万行代码,比 Pyright 快 15 倍。涵盖架构设计、性能优化、Tensor Shapes、AI 编程集成,附实战指南与竞品对比。
Python
类型检查器
Rust
Meta
Facebook
Pyright
Mypy
LSP
AI编程
Tensor Shapes
DataBuff深度解析:AI原生OpenTelemetry APM如何重新定义可观测性
编程
DataBuff深度解析:AI原生OpenTelemetry APM如何重新定义可观测性
2026-07-23 07:44:51 +0800 CST
view 208
深度解析DataBuff AI原生OpenTelemetry APM:从三组件极简架构到七层AIOps能力,多Agent协同根因分析、自动巡检、SSH运维修复,让APM从看得见进化到会诊断会修。
APM
OpenTelemetry
AI
可观测性
DataBuff
多Agent
分布式追踪
AIOps
OpenClaw 310k Star 全链路工程架构深度拆解:从 Gateway 控制平面到 Pi Loop 执行闭环
编程
OpenClaw 310k Star 全链路工程架构深度拆解:从 Gateway 控制平面到 Pi Loop 执行闭环
2026-08-11 13:56:35 +0800 CST
view 46
深度拆解 OpenClaw 310k Star 全链路工程架构:从 Gateway 控制平面、SessionKey 并发模型、Pi Loop 执行闭环到生产部署实战,含完整代码示例与 15 条踩坑清单。
OpenClaw
AI Agent
架构设计
Gateway
SessionKey
Pi Loop
并发控制
本地优先
Node.js
WebSocket
给 AI Agent 装上生产级可观测性:用 OpenTelemetry 把 LLM 工作流从黑盒变白盒
编程
给 AI Agent 装上生产级可观测性:用 OpenTelemetry 把 LLM 工作流从黑盒变白盒
2026-07-10 11:47:48 +0800 CST
view 295
深度解析2026年AI工程化最关键方向——AI Agent可观测性,涵盖OpenTelemetry LLM语义约定、MCP协议链路追踪、OpenLIT全链路平台,附生产级Go代码实现
AI Agent
OpenTelemetry
LLM
可观测性
生产级
Go
链路追踪
Token优化
Qwen3.8 深度拆解:当阿里巴巴用 2.4 万亿参数 MoE 架构决定「干掉所有编程助手」——从 Gated DeltaNet 混合注意力到 100 万上下文 Token 的 Agent-First 大模型工程哲学
编程
Qwen3.8 深度拆解:当阿里巴巴用 2.4 万亿参数 MoE 架构决定「干掉所有编程助手」——从 Gated DeltaNet 混合注意力到 100 万上下文 Token 的 Agent-First 大模型工程哲学
2026-08-04 09:16:35 +0800 CST
view 106
深度拆解阿里巴巴2.4万亿参数Qwen3.8大模型:稀疏MoE架构、Gated DeltaNet混合注意力、100万上下文Token、编程+办公双引擎、完整部署代码与性能基准对比
Qwen3.8
阿里巴巴
MoE
大模型开源
2.4万亿参数
Gated DeltaNet
混合注意力
Agent
编程助手
千问办公
开源模型
vLLM
IntelliJ IDEA 2026.1 深度解析:IDE 的战略升维——从代码编辑器到 AI Agent 开放平台
编程
IntelliJ IDEA 2026.1 深度解析:IDE 的战略升维——从代码编辑器到 AI Agent 开放平台
2026-05-09 23:43:15 +0800 CST
view 825
IntelliJ IDEA 2026.1深度解析:ACP协议开放AI Agent平台、Codex/Cursor/Claude多Agent协作、Spring运行时洞察、Java 26首日支持、虚拟线程调试工具链等核心新特性全剖析
IntelliJ IDEA
JetBrains
Java
Kotlin
AI Agent
ACP协议
IDE
编程工具
Spring
虚拟线程
JetBrains 2026 全线产品深度解析:ACP 注册表内置 AI 智能体、MCP 服务器、Recap/Insights——传统 IDE 的「绝地反击」
编程
JetBrains 2026 全线产品深度解析:ACP 注册表内置 AI 智能体、MCP 服务器、Recap/Insights——传统 IDE 的「绝地反击」
2026-05-15 09:18:50 +0800 CST
view 884
JetBrains 2026全线IDE发布:ACP注册表让Codex/Claude Agent等智能体内置IDE、MCP服务器暴露IDE代码理解能力、Recap和Insights主动式AI辅助、Git工作树人机并行开发。深度解析6大IDE核心特性与AI时代战略。
JetBrains,IntelliJ IDEA,ACP,MCP,AI Agent,IDE
Vision-Agents 深度实战:用Stream构建多模态AI Agent——从实时视频理解到边缘计算低延迟的完全指南(2026)
编程
Vision-Agents 深度实战:用Stream构建多模态AI Agent——从实时视频理解到边缘计算低延迟的完全指南(2026)
2026-06-03 15:17:28 +0800 CST
view 631
深入解析 GetStream 开源的 Vision-Agents 框架,从架构设计、视频处理管道、多模态LLM集成、RAG知识库、MCP工具调用到Kubernetes生产部署的完整实战指南
Vision-Agents
GetStream
多模态AI
视频AI
Agent
WebRTC
低延迟
RAG
TriAttention深度解析:用三角函数革命性压缩KV Cache,让长推理从「显存地狱」中脱困
编程
TriAttention深度解析:用三角函数革命性压缩KV Cache,让长推理从「显存地狱」中脱困
2026-05-17 04:14:18 +0800 CST
view 630
深入解析MIT韩松团队提出的TriAttention方法,利用Pre-RoPE空间Q/K集中性和三角函数级数实现革命性的KV Cache压缩,在AIME25上以3072 KV budget达到与Full Attention持平的40.8%准确率,同时实现10.7倍KV显存压缩和2.5-6.3倍吞吐量提升。
LLM
KV Cache
TriAttention
MIT
英伟达
浙大
长推理
KV压缩
三角函数
RoPE
Attention优化
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
51
52
53
54
55
...
143
下一页