程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Eternal Software Initiative 深度实战:当 Subleq+ 单指令虚拟机想要保存软件 1000 年——从 50 行 C 参考 VM 到 LLVM 后端与 Linux 胶囊
编程
Eternal Software Initiative 深度实战:当 Subleq+ 单指令虚拟机想要保存软件 1000 年——从 50 行 C 参考 VM 到 LLVM 后端与 Linux 胶囊
2026-06-20 15:29:51 +0800 CST
view 276
Eternal Software Initiative 深度解析:一条指令的 Subleq+ 计算机、LLVM 后端、Linux 胶囊与千年软件保存的工程实践。
Eternal Software Initiative
Subleq
软件保存
LLVM
Linux 胶囊
Context Engineering:超越 Prompt Engineering 的 AI 工程新范式
编程
Context Engineering:超越 Prompt Engineering 的 AI 工程新范式
2026-07-05 01:47:09 +0800 CST
view 187
深入探讨Context Engineering的核心概念、架构设计、上下文压缩技术和生产环境最佳实践。
AI工程
Context Engineering
Prompt Engineering
大模型
上下文管理
Loop Engineering(循环工程)万字深度解析:2026年最火的AI开发范式——从Prompt到自主循环的系统架构革命
编程
Loop Engineering(循环工程)万字深度解析:2026年最火的AI开发范式——从Prompt到自主循环的系统架构革命
2026-06-30 17:12:21 +0800 CST
view 304
2026年6月AI圈最火的新概念:Loop Engineering(循环工程)万字深度解析。从Prompt Engineering到自主循环的四代范式跃迁,六块积木核心架构拆解,完整代码实战与Token优化策略
Loop Engineering
AI Agent
Prompt Engineering
自动化
AI开发
万字拆解 Loop Engineering:当 AI 开发从写提示词进化到设计循环系统——2026年最值得掌握的编程范式
编程
万字拆解 Loop Engineering:当 AI 开发从写提示词进化到设计循环系统——2026年最值得掌握的编程范式
2026-06-30 17:13:12 +0800 CST
view 295
2026年6月AI圈最火的新概念:Loop Engineering(循环工程)万字深度解析。从Prompt Engineering到自主循环的四代范式跃迁,六块积木核心架构拆解,完整代码实战与Token优化策略
Loop Engineering
AI Agent
Prompt Engineering
自动化
AI开发
Loop Engineering 完全指南:从 Prompt 设计者到循环架构师的范式跃迁——当 AI 编程进入系统设计时代(2026)
编程
Loop Engineering 完全指南:从 Prompt 设计者到循环架构师的范式跃迁——当 AI 编程进入系统设计时代(2026)
2026-07-04 14:44:21 +0800 CST
view 333
万字深度解析 Loop Engineering:2026年AI编程新范式,从Claude Code /loop到openloop开源框架,从五种循环模式到生成器-评估器-规划器三体架构,从成本模型到生产级部署,完整技术指南。
Loop Engineering
AI编程
Claude Code
循环工程
Agent
Prompt Engineering
系统设计
Tailwind CSS v4 深度拆解:当 CSS 框架用 Rust 引擎重写配置——@theme、级联层与原生 CSS 如何重写前端样式心智模型
编程
Tailwind CSS v4 深度拆解:当 CSS 框架用 Rust 引擎重写配置——@theme、级联层与原生 CSS 如何重写前端样式心智模型
2026-07-15 13:56:03 +0800 CST
view 144
深度拆解 Tailwind CSS v4:Rust 重写的 Oxide 引擎、CSS-first 的 @theme 配置、级联层与原生 CSS 特性如何重写前端样式心智模型,配完整迁移与性能实战。
Tailwind CSS v4
Oxide
CSS-first
@theme
前端工程化
级联层
原生CSS
Vite
Free Claude Code:让Claude Code接入任意模型,打破Anthropic绑定
编程
Free Claude Code:让Claude Code接入任意模型,打破Anthropic绑定
2026-04-29 12:20:38 +0800 CST
view 1256
Free Claude Code是让Claude Code接入任意模型的代理层项目,打破Anthropic绑定,支持NVIDIA NIM/OpenRouter/DeepSeek/Ollama/LM Studio等后端,适合想降成本或本地部署AI编程环境的人。
Claude Code
AI编程
开源工具
OpenRouter
DeepSeek
Ollama
LM Studio
AI Coding
Anthropic
KTransformers 深度拆解:一块 RTX 5090 跑 100B+ 大模型,CPU/GPU 异构推理凭什么改写 LLM 本地部署规则
编程
KTransformers 深度拆解:一块 RTX 5090 跑 100B+ 大模型,CPU/GPU 异构推理凭什么改写 LLM 本地部署规则
2026-07-24 07:44:31 +0800 CST
view 96
KTransformers 通过 CPU/GPU 异构计算,让一块 RTX 5090(32GB 显存)能跑起 100B+ MoE 大模型,且无需量化压缩,保持原精度 FP16。实测比 llama.cpp Q8_0 快 4.5 倍。本文深度拆解其专家细粒度卸载、异步预取、DMA 优化等核心技术,以及实战部署指南。
KTransformers
LLM推理
MoE
异构计算
DeepSeek
SGLang
CPU Offload
本地部署
GPU优化
稀疏注意力架构革命:2026年长上下文大模型核心技术解析
编程
稀疏注意力架构革命:2026年长上下文大模型核心技术解析
2026-07-09 08:45:09 +0800 CST
view 270
深入解析2026年稀疏注意力技术革命,涵盖SubCube、CSA/HCA、MSA三大架构的技术原理、代码实现与实战指南,探讨长上下文大模型的最新发展。
AI
大模型
Transformer
稀疏注意力
LongContext
DeepSeek
MiniMax
DSpark:DeepSeek联手北大「投机解码」登顶,推理速度飙升85%背后真相
编程
DSpark:DeepSeek联手北大「投机解码」登顶,推理速度飙升85%背后真相
2026-06-29 13:45:21 +0800 CST
view 307
深度解析DeepSeek联合北京大学发布的DSpark置信度调度投机解码框架,剖析半自回归候选生成、动态验证调度、硬件感知前缀缓存三大核心创新
DeepSeek
DSpark
投机解码
大模型推理
置信度调度
Speculative Decoding
DSpark深度解析:DeepSeek联合北大开源的推测解码框架——半自回归生成+置信度调度如何让大模型推理速度飙升85%
编程
DSpark深度解析:DeepSeek联合北大开源的推测解码框架——半自回归生成+置信度调度如何让大模型推理速度飙升85%
2026-07-06 07:43:51 +0800 CST
view 386
深度解析DeepSeek联合北京大学开源的DSpark推测解码推理加速框架:半自回归生成架构解决后缀衰减、置信度调度验证机制避免算力浪费、单用户生成速度提升60%-85%、吞吐量最高暴涨661%。含完整代码实战与性能基准测试。
DSpark
DeepSeek
推测解码
Speculative Decoding
推理加速
半自回归
置信度调度
大模型推理
大模型部署太慢?这个超级引擎帮你搞定!SGLang速通指南
编程
大模型部署太慢?这个超级引擎帮你搞定!SGLang速通指南
2026-04-22 09:27:57 +0800 CST
view 747
DeepSeek官方推荐!SGLang高性能大模型推理框架速通指南,RadixAttention前缀缓存、零开销调度、OpenAI API兼容,性能碾压vLLM。
SGLang
大模型推理
DeepSeek
开源
vLLM
LMCache 深度拆解:当 KV Cache 变成可复用资产——LLM 推理的「免费午餐」完整指南
编程
LMCache 深度拆解:当 KV Cache 变成可复用资产——LLM 推理的「免费午餐」完整指南
2026-07-14 18:47:11 +0800 CST
view 136
深度拆解 LMCache 项目:从 Transformer Attention 机制出发,详细讲解 KV Cache 原理、三层存储架构、生产部署实战、Docker Compose 配置、CacheGen 压缩算法、PD 分离、跨实例 KV Cache 共享,以及与 vLLM/SGLang 的集成,配完整代码示例与性能调优指南。实测 DeepSeek 多轮对话 3~5 倍 TTFT 改善。
LMCache
KV Cache
LLM推理
vLLM
SGLang
推理优化
DeepSeek
分布式缓存
DeepSeek-TUI 深度实战:Rust 打造的终端原生 AI 编程智能体——从 10K Star 爆火到生产级 Coding Agent 架构全链路解析
编程
DeepSeek-TUI 深度实战:Rust 打造的终端原生 AI 编程智能体——从 10K Star 爆火到生产级 Coding Agent 架构全链路解析
2026-05-08 11:08:11 +0800 CST
view 1063
深度解析 DeepSeek-TUI:Rust 打造的终端原生 AI 编程智能体,16K+ Star、登顶 GitHub Trending,从架构设计到生产级实战的全链路解析
DeepSeek-TUI
Rust
AI编程
Agent
Coding
Copilot
TileLang + TileKernels 深度解析:DeepSeek 如何用 Python 写出让 GPU 逼近理论性能上限的 GPU 内核
编程
TileLang + TileKernels 深度解析:DeepSeek 如何用 Python 写出让 GPU 逼近理论性能上限的 GPU 内核
2026-04-28 10:55:20 +0800 CST
view 661
深度剖析 DeepSeek 开源的 TileLang DSL 和 TileKernels GPU 内核库:从 GEMM 到 MoE,从 TVM 编译基础设施到生产级量化内核,揭示用 Python 写接近硬件极限性能 GPU 代码的秘密。
TileLang
GPU内核
DeepSeek
高性能计算
CUDA
GEMM
MoE
量化
TVM
开源项目
ClickHouse 深度实战:当实时 OLAP 撞上次世代列式引擎——MergeTree、稀疏索引与向量化执行如何重写数据分析心智模型
编程
ClickHouse 深度实战:当实时 OLAP 撞上次世代列式引擎——MergeTree、稀疏索引与向量化执行如何重写数据分析心智模型
2026-07-15 04:11:41 +0800 CST
view 141
从工程师视角深度拆解 ClickHouse:列存、向量化执行、MergeTree 引擎家族、稀疏主键索引、跳过索引与物化视图,配 Docker/SQL/Python/Go 实战与性能调优指南。
ClickHouse
MergeTree
列式存储
向量化执行
稀疏索引
实时数仓
OLAP
物化视图
ClickHouse Keeper
Pascal Editor 深度实战:当 WebGPU 遇见 3D 建筑可视化——从浏览器零安装到生产级架构的完全指南(2026)
编程
Pascal Editor 深度实战:当 WebGPU 遇见 3D 建筑可视化——从浏览器零安装到生产级架构的完全指南(2026)
2026-06-16 15:34:34 +0800 CST
view 291
Pascal Editor 是一个基于 WebGPU 和 React Three Fiber 构建的开源 3D 建筑编辑器,运行在浏览器中无需安装。本文深度解析其 Monorepo 架构、场景状态管理、WebGPU 渲染管线、CSG 布尔运算和性能优化策略。
WebGPU
Three.js
React Three Fiber
Pascal Editor
3D编辑器
Turborepo
Bun
Monorepo
CSG
前端工程化
KTransformers 深度拆解:单张 4090 跑满血 DeepSeek-R1 671B,清华团队如何用 CPU/GPU 异构推理实现 28 倍加速
编程
KTransformers 深度拆解:单张 4090 跑满血 DeepSeek-R1 671B,清华团队如何用 CPU/GPU 异构推理实现 28 倍加速
2026-07-29 09:44:03 +0800 CST
view 12
深度拆解清华开源的 KTransformers:MoE 稀疏性卸载、AMX/Marlin 高性能算子、CUDA Graph 与 YAML 注入框架四层架构,单张 4090 跑满血 DeepSeek-R1 671B,附完整部署实战与性能调优清单。
KTransformers
异构推理
MoE
DeepSeek
AMX
CUDA Graph
大模型部署
性能优化
开源
Meetily 深度解析:16K Stars 的 Rust 隐私优先 AI 会议助手如何用 Parakeet/Whisper 实时转录 + Ollama 本地摘要让企业会议数据永远不出设备——从 Tauri 架构到生产级部署的完整实战指南
编程
Meetily 深度解析:16K Stars 的 Rust 隐私优先 AI 会议助手如何用 Parakeet/Whisper 实时转录 + Ollama 本地摘要让企业会议数据永远不出设备——从 Tauri 架构到生产级部署的完整实战指南
2026-07-07 05:42:52 +0800 CST
view 222
深度解析GitHub 16K+ Stars的Meetily隐私优先AI会议助手:基于Rust+Tauri架构,集成Whisper/Parakeet双引擎实时转录、说话人分离、Ollama本地LLM摘要生成。100%本地处理,数据永远不出设备。从架构原理到生产级部署实战,含完整代码示例与竞品对比分析。
Meetily
Rust
隐私优先
AI会议助手
语音转录
Whisper
Parakeet
Ollama
Tauri
开源
OpenAI Codex 开放第三方模型接入:AI 编程工具的「开放生态」革命——从Responses API到DeepSeek/Claude/国产模型全攻略(2026)
编程
OpenAI Codex 开放第三方模型接入:AI 编程工具的「开放生态」革命——从Responses API到DeepSeek/Claude/国产模型全攻略(2026)
2026-06-19 10:28:00 +0800 CST
view 1115
2026年6月OpenAI宣布Codex支持接入任何第三方模型。本文深度解析Responses API与Chat Completions的核心差异、第三方模型接入的技术原理与实战配置、CC Switch本地路由方案,以及从「模型绑定」到「模型中立」的行业生态转变。
OpenAI
Codex
AI编程
Responses API
DeepSeek
Claude
GitHub Copilot
OpenScreen 深度解析:当开源撕掉屏幕录制的高价标签,开发者终于不用再被 Screen Studio 收割
编程
OpenScreen 深度解析:当开源撕掉屏幕录制的高价标签,开发者终于不用再被 Screen Studio 收割
2026-04-10 02:23:58 +0800 CST
view 1096
深入解析OpenScreen:26K Stars的GitHub开源录屏工具,用Electron+FFmpeg技术栈复现Screen Studio全部核心功能,包括自动缩放、运动模糊、背景虚化等。跨平台支持macOS/Windows/Linux,完全免费开源。
OpenScreen
Screen Studio
Electron
FFmpeg
开源录屏
桌面应用
TypeScript
百度 Unlimited OCR 开源:用常数级 KV Cache 一次性吃下整本书
编程
百度 Unlimited OCR 开源:用常数级 KV Cache 一次性吃下整本书
2026-06-29 06:14:12 +0800 CST
view 326
百度开源 Unlimited OCR 模型,用常数级 KV Cache 解决长文档识别难题。30亿参数端到端架构,推理仅激活5亿参数,单次前向识别几十页文档,OmniDocBench v1.6 总分93.92%刷新SOTA。
OCR
开源
百度
DeepSeek
端到端
长文档
开源追上闭源!OpenRouter 2026开源F4深度解析:DeepSeek GLM MiniMax NVIDIA谁才是你的菜
编程
开源追上闭源!OpenRouter 2026开源F4深度解析:DeepSeek GLM MiniMax NVIDIA谁才是你的菜
2026-06-29 07:42:37 +0800 CST
view 378
OpenRouter 2026年6月发布最值得关注的4个开源模型:DeepSeek V4 Flash极致性价比、GLM 5.2智力天花板、MiniMax M3原生多模态、NVIDIA Nemotron企业级部署。本文从架构、性能、成本、场景四维度深度解析,助你做出正确技术选型。
AI
开源模型
DeepSeek
GLM
MiniMax
NVIDIA
技术选型
2026年大模型推理框架横评:vLLM 0.5 vs TGI 2.0 vs TensorRT-LLM 1.8 vs DeepSpeed-MII 0.9
编程
2026年大模型推理框架横评:vLLM 0.5 vs TGI 2.0 vs TensorRT-LLM 1.8 vs DeepSpeed-MII 0.9
2026-07-10 17:44:16 +0800 CST
view 303
深度对比2026年四大主流LLM推理框架:vLLM 0.5、TGI 2.0、TensorRT-LLM 1.8、DeepSpeed-MII 0.9,涵盖PagedAttention、FP8量化、ZeRO-3、连续批处理等核心技术原理,配生产级代码示例与实测性能数据。
LLM
vLLM
TensorRT-LLM
TGI
DeepSpeed
推理优化
量化
AI部署
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
7
8
9
10
11
...
93
下一页