程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
FlashPrefill 深度解析:当瞬时注意力遇上 GPU 原语——从 O(N²) 困境到 27 倍速的工程革命
编程
FlashPrefill 深度解析:当瞬时注意力遇上 GPU 原语——从 O(N²) 困境到 27 倍速的工程革命
2026-04-15 17:20:25 +0800 CST
view 789
深度解析中科院与腾讯微信联合研发的 FlashPrefill 如何通过即时注意力模式发现和动态阈值筛选,将 25.6 万字符长文本处理速度提升 27.78 倍,同时保持近乎完美的精度。
LLM推理优化
FlashAttention
GPU计算
长文本处理
注意力机制
Transformer
深度学习
DFlash 深度解析:块扩散模型如何让 LLM 推理加速 6 倍——2026 投机解码完全指南
编程
DFlash 深度解析:块扩散模型如何让 LLM 推理加速 6 倍——2026 投机解码完全指南
2026-05-28 19:39:07 +0800 CST
view 890
深入解析 DFlash 块扩散投机解码方案:如何让 Qwen3-8B 实现 6 倍无损加速,超越 EAGLE-3 与 llama.cpp,附 SGLang/vLLM/MLX 完整部署指南。
LLM推理
投机解码
块扩散
DFlash
推理加速
Transformer优化
GPU
CUDA
SGLang
vLLM
百度 Unlimited OCR 深度解读:R-SWA 如何将 KV Cache 压成常数,5天 GitHub Star 破万的端到端 OCR 新范式
编程
百度 Unlimited OCR 深度解读:R-SWA 如何将 KV Cache 压成常数,5天 GitHub Star 破万的端到端 OCR 新范式
2026-06-27 09:15:20 +0800 CST
view 222
百度开源 Unlimited OCR,5天 GitHub Star 破万。本文深度解析其核心创新 R-SWA(Reference Sliding Window Attention),如何将解码器 KV Cache 从线性增长压成常数,OmniDocBench v1.6 刷榜 SOTA(93.92%),30B 总参/5B 激活,32K 超长上下文,一次前向全稿转录,附完整代码实战。
Unlimited OCR
R-SWA
KV Cache
MoE
端到端 OCR
百度
深度学习
Transformer
文档识别
OCR
Pulumi 深度实战:当基础设施即代码终于学会「说人话」——从 HCL 方言困境、资源图到自动化 API 与策略即代码的生产级完全指南(2026)
编程
Pulumi 深度实战:当基础设施即代码终于学会「说人话」——从 HCL 方言困境、资源图到自动化 API 与策略即代码的生产级完全指南(2026)
2026-07-21 14:27:26 +0800 CST
view 220
2026 深度实战 Pulumi:从 HCL 方言困境、资源图与引擎架构,到 Go/TypeScript/Python 三栈代码实战、自动化 API、策略即代码与性能优化的生产级完全指南。
Pulumi
基础设施即代码
IaC
HCL
Terraform
OpenTofu
Go
TypeScript
Python
自动化API
策略即代码
云原生
Microsoft DocumentDB 深度解析:基于 PostgreSQL 的开源 MongoDB 兼容引擎——从 BSON 原生存储到协议网关、从性能基准到生产部署的完整技术指南(2026)
编程
Microsoft DocumentDB 深度解析:基于 PostgreSQL 的开源 MongoDB 兼容引擎——从 BSON 原生存储到协议网关、从性能基准到生产部署的完整技术指南(2026)
2026-07-03 07:13:57 +0800 CST
view 254
深度解析 Microsoft DocumentDB:基于 PostgreSQL 的开源 MongoDB 兼容引擎,从 BSON 原生存储、协议网关架构、性能基准测试到生产部署的完整技术指南(2026)。
DocumentDB
PostgreSQL
MongoDB
BSON
NoSQL
开源
数据库
微软
Linux Foundation
性能基准
Linux 7.0内核Rust转正实战:从零编写你的第一个Rust内核驱动程序
编程
Linux 7.0内核Rust转正实战:从零编写你的第一个Rust内核驱动程序
2026-04-25 03:31:43 +0800 CST
view 916
深度解析Linux 7.0内核Rust转正:从架构原理到环境搭建,从零编写完整的Rust字符设备驱动,涵盖内存安全模型、C互操作、性能优化和调试策略。
Rust
Linux内核
驱动开发
内核编程
Rust for Linux
微信收款自动通知服务器:不用 Android 开发也能定制自己的 App
编程
微信收款自动通知服务器:不用 Android 开发也能定制自己的 App
2026-06-14 19:44:09 +0800 CST
view 394
基于SmsForwarder开源项目的微信收款自动通知方案,利用安卓通知监听服务20ms转发,无需修改微信/Root/截图,零封号风险,支持GitHub Actions一键定制编译APK。
SmsForwarder
微信收款
通知监听
Android
开源
GitHub Actions
无需Root
短信转发
AI编程
MELT架构深度解析:高通如何让AI"深度思考"不再耗尽内存——循环Transformer的内存革命
编程
MELT架构深度解析:高通如何让AI"深度思考"不再耗尽内存——循环Transformer的内存革命
2026-05-19 13:46:15 +0800 CST
view 505
高通AI研究院提出的MELT架构通过门控机制让循环Transformer的内存消耗保持恒定,无论思考多少轮。本文深度解析其架构原理、数学推导、训练策略与性能实测。
AI
Transformer
内存优化
深度推理
高通
稀疏注意力架构革命:2026年长上下文大模型核心技术解析
编程
稀疏注意力架构革命:2026年长上下文大模型核心技术解析
2026-07-09 08:45:09 +0800 CST
view 384
深入解析2026年稀疏注意力技术革命,涵盖SubCube、CSA/HCA、MSA三大架构的技术原理、代码实现与实战指南,探讨长上下文大模型的最新发展。
AI
大模型
Transformer
稀疏注意力
LongContext
DeepSeek
MiniMax
TriAttention深度解析:MIT韩松团队如何用三角函数让单卡4090跑出百万Token上下文
编程
TriAttention深度解析:MIT韩松团队如何用三角函数让单卡4090跑出百万Token上下文
2026-04-17 10:15:58 +0800 CST
view 695
2026年4月,MIT、英伟达、浙江大学联合发布TriAttention,用三角函数建模注意力距离偏好,实现KV缓存10.7倍压缩,让单卡4090跑出百万Token上下文。
AI
大模型
Transformer
注意力机制
KV缓存
长上下文
模型优化
论文解读
2026
Qwen3.8深度拆解:2.4万亿参数稀疏MoE架构的技术革命,从模型设计到开源落地的全链路复盘
编程
Qwen3.8深度拆解:2.4万亿参数稀疏MoE架构的技术革命,从模型设计到开源落地的全链路复盘
2026-08-11 10:55:36 +0800 CST
view 24
深度拆解阿里Qwen3.8的2.4万亿参数稀疏MoE架构:专家池设计、负载均衡、混合注意力机制、100万Token上下文、编程能力突破、开源生态影响与生产部署指南
Qwen3.8
大模型
MoE架构
稀疏激活
开源AI
千问
AI编程
深度学习
Transformer
Linux 7.1 内核深度解析:NTFS 驱动四年重构终成正果,40 年 i486 架构正式谢幕
编程
Linux 7.1 内核深度解析:NTFS 驱动四年重构终成正果,40 年 i486 架构正式谢幕
2026-04-27 15:22:09 +0800 CST
view 696
深度解析Linux 7.1内核两大里程碑:历时四年的全新NTFS驱动正式合入主线,实现原生读写、性能提升35%-110%;服役40年的i486架构正式退役。从技术架构到性能实测,全面剖析这场内核层面的新旧交替。
Linux
内核
NTFS
文件系统
i486
操作系统
性能优化
iomap
folio
MiniMax H3 开源视频模型架构深度拆解:从 Contextual Omni Representation 到 H3-Omni Transformer 的全链路工程解析
编程
MiniMax H3 开源视频模型架构深度拆解:从 Contextual Omni Representation 到 H3-Omni Transformer 的全链路工程解析
2026-08-11 14:32:39 +0800 CST
view 22
深度拆解 MiniMax H3 开源视频模型三层模块架构:Contextual Omni Representation、H3-Omni Transformer、H3-VAE,以及 FL2VA 与 Ref2VA 的技术差异、INT8 量化优化与本地部署实战
MiniMax H3
视频生成
开源AI
扩散模型
多模态
H3-Omni Transformer
TimesFM 深度实战:当 Google Research 把基础模型带进时间序列——从预训练解码器到零样本推理、从多周期建模到生产级预测完全指南(2026)
编程
TimesFM 深度实战:当 Google Research 把基础模型带进时间序列——从预训练解码器到零样本推理、从多周期建模到生产级预测完全指南(2026)
2026-06-21 03:24:16 +0800 CST
view 548
TimesFM 2.5深度解析:Google Research开源的时间序列基础模型,200M参数、16K上下文、零样本推理。从Patch机制、RevIN归一化到LoRA微调、生产部署,10000字完整技术指南。
TimesFM
时间序列预测
Google Research
基础模型
零样本推理
Transformer
概率预测
TimesFM 2.5 深度解析:当时间序列预测终于学会零样本
编程
TimesFM 2.5 深度解析:当时间序列预测终于学会零样本
2026-04-08 16:35:10 +0800 CST
view 1139
Google TimesFM 2.5 时间序列预测基础模型深度解析:200M参数零样本预测,16k上下文,Decoder-only Transformer架构,Patch分词,Monash基准测试击败监督模型
时间序列
机器学习
Google
Transformer
当 OpenAI 掷出 60 万美元:Rust 如何从系统编程语言变成 AI 基础设施的底层操作系统
编程
当 OpenAI 掷出 60 万美元:Rust 如何从系统编程语言变成 AI 基础设施的底层操作系统
2026-06-21 07:57:04 +0800 CST
view 740
OpenAI 以白金会员身份加入 Rust 基金会并投入 60 万美元,从收购 Astral 到 Rust 重写 Codex CLI,深度分析 Rust 如何成为 AI 时代底层基础设施的核心语言。
Rust
OpenAI
Rust Foundation
Astral
uv
Ruff
Codex CLI
TIOBE
RustConf 2026
Maintainers Fund
SubCube 深度实战:亚二次稀疏注意力 SSA 如何打破 Transformer 的 O(n²) 铁律——1200万 Token 时代从架构原理到生产级部署的完全指南(2026)
编程
SubCube 深度实战:亚二次稀疏注意力 SSA 如何打破 Transformer 的 O(n²) 铁律——1200万 Token 时代从架构原理到生产级部署的完全指南(2026)
2026-05-31 08:21:47 +0800 CST
view 691
Subquadratic发布的SubQ模型采用SSA亚二次稀疏注意力架构,实现1200万Token上下文窗口,在MRCR v2基准测试中碾压GPT-5.5。本文从架构原理、基准分析、代码实战到生产部署全面解读这场注意力革命。
SSA
Subquadratic
SubQ
Transformer
注意力机制
长上下文
RAG
稀疏注意力
AI架构
大模型
DuckDB 深度实战:从向量化执行引擎到 Quack 客户端-服务端,一只鸭子如何把整个 Lakehouse 吞进同一个进程
编程
DuckDB 深度实战:从向量化执行引擎到 Quack 客户端-服务端,一只鸭子如何把整个 Lakehouse 吞进同一个进程
2026-07-10 13:46:21 +0800 CST
view 312
从向量化执行引擎到 Quack 客户端-服务端与 DuckLake,深度拆解 DuckDB 如何从进程内 OLAP 进化成完整 Lakehouse 平台,附可运行代码与性能对决。
DuckDB
OLAP
向量化执行
列存数据库
Lakehouse
DuckLake
Quack
数据分析
SQLite for Analytics
MIT黑科技:TriAttention如何用三角函数让大模型「记住」超长上下文
编程
MIT黑科技:TriAttention如何用三角函数让大模型「记住」超长上下文
2026-04-18 12:45:10 +0800 CST
view 1019
深度解析MIT/NVIDIA/浙大联合发布的TriAttention技术,用三角函数预测注意力分布,实现KV Cache智能压缩,让超长上下文推理成为可能
大模型
注意力机制
KV缓存
Transformer
深度学习
AI优化
hermes-agent 深度拆解:当 AI Agent 决定记住你是谁——一个 130K Star 的开源框架如何用 Personal Memory 和闭环学习重新定义自进化 Agent 的终极形态
编程
hermes-agent 深度拆解:当 AI Agent 决定记住你是谁——一个 130K Star 的开源框架如何用 Personal Memory 和闭环学习重新定义自进化 Agent 的终极形态
2026-08-04 21:45:58 +0800 CST
view 87
深度拆解130K Star开源AI Agent框架hermes-agent:Personal Memory三层记忆架构、闭环自学习机制、FTS5全文检索、可插拔上下文压缩、17+平台网关、子Agent委托机制,附完整架构分析与代码示例
hermes-agent
NousResearch
AI Agent
Personal Memory
闭环学习
自进化Agent
开源
Python
SQLite
FTS5
记忆系统
Agent框架
谷歌 I/O 2026 全景深度解析:从 Gemini 3.5 Flash 到 Antigravity 2.0,从 93 个 Agent 造 OS 到 Spark 全天候个人助手——一场重新定义开发者工作流的架构革命
编程
谷歌 I/O 2026 全景深度解析:从 Gemini 3.5 Flash 到 Antigravity 2.0,从 93 个 Agent 造 OS 到 Spark 全天候个人助手——一场重新定义开发者工作流的架构革命
2026-06-17 06:29:30 +0800 CST
view 588
从 Gemini 3.5 Flash 的 289 tokens/秒到 Antigravity 2.0 的 93 个 Agent 造 OS,从 Spark 的 7×24 小时自主运转到 Omni 的任意输入直出视频——谷歌 I/O 2026 全景技术深度解析
Google I/O 2026
Gemini 3.5 Flash
Antigravity 2.0
AI Agent
Gemini Spark
Gemini Omni
Apache Flink 3.0 深度解析:从实时计算引擎到 Agent Native 基础设施——Agentic Streaming、Flink Agents 与多模态数据湖的完整实战指南
编程
Apache Flink 3.0 深度解析:从实时计算引擎到 Agent Native 基础设施——Agentic Streaming、Flink Agents 与多模态数据湖的完整实战指南
2026-07-06 06:42:31 +0800 CST
view 561
深度解析Apache Flink 3.0 Agent Native架构:从Cloud Native到Agent Native的范式转换、Agentic Streaming流水线架构、Flink Agents事件驱动智能体框架、Apache Paimon 2.0多模态数据湖、Apache Fluss 1.0实时上下文层与MCP Gateway、CPU+GPU混合调度、淘宝闪购与小红书生产实战。含Java/Python完整代码示例。
Apache Flink
Flink Agents
Agent Native
Agentic Streaming
实时计算
AI Agent
多模态数据湖
Apache Paimon
Apache Fluss
Meta-Harness 深度拆解:当 AI 编程进入「多 Agent 并行时代」——Databricks Omnigent、Zed ACP、Vercel HarnessAgent 三大开源方案如何用「Harness 之上的 Harness」重新定义 Agent 工程化的终极形态
编程
Meta-Harness 深度拆解:当 AI 编程进入「多 Agent 并行时代」——Databricks Omnigent、Zed ACP、Vercel HarnessAgent 三大开源方案如何用「Harness 之上的 Harness」重新定义 Agent 工程化的终极形态
2026-08-05 12:44:41 +0800 CST
view 170
深度拆解2026年最热AI工程化范式Meta-Harness:Databricks Omnigent、Zed ACP、Vercel HarnessAgent三大开源方案如何用Harness之上的Harness重新定义多Agent编排与治理
Meta-Harness
Omnigent
ACP
HarnessAgent
Agent编排
多Agent
Databricks
Vercel
Cloudflare
RUFLO
Page Agent 深度解析:阿里开源的「页内 GUI Agent」如何用 DOM 脱水替代截图识别——从一行 CDN 到生产级 Web 自动化的完整实战指南
编程
Page Agent 深度解析:阿里开源的「页内 GUI Agent」如何用 DOM 脱水替代截图识别——从一行 CDN 到生产级 Web 自动化的完整实战指南
2026-07-06 19:14:49 +0800 CST
view 576
深度解析阿里巴巴开源的Page Agent:纯前端JavaScript GUI Agent,通过DOM脱水技术将页面转为文本,让文本大模型精准操作网页。从架构原理到生产实战,含完整代码示例与安全避坑指南。
Page Agent
GUI Agent
阿里巴巴
DOM
浏览器自动化
AI Agent
TypeScript
开源
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
5
6
7
8
9
...
57
下一页