程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
MarkItDown 深度实战:当文档转换学会了「LLM 优先」——从 15 万 Star 爆款到 RAG 预处理生产级全链路完全指南(2026)
编程
MarkItDown 深度实战:当文档转换学会了「LLM 优先」——从 15 万 Star 爆款到 RAG 预处理生产级全链路完全指南(2026)
2026-06-15 06:19:28 +0800 CST
view 570
微软 MarkItDown 15万Star深度实战:从架构解析、全格式转换、RAG预处理流水线、插件开发到生产部署的完全指南
MarkItDown
RAG
文档转换
LLM
Python
Lark AgentX:逆向飞书协议 + MCP函数调用,免申请Bot直接跑AI Agent
编程
Lark AgentX:逆向飞书协议 + MCP函数调用,免申请Bot直接跑AI Agent
2026-06-15 07:46:19 +0800 CST
view 380
Lark AgentX开源项目:用飞书账号做AI Agent,逆向WebSocket+Protobuf协议实时收消息,MCP函数调用框架自动选择tool,Docker Compose一键部署,免申请Bot零配置开箱即用。
Lark AgentX
飞书
MCP
AI Agent
逆向协议
Function Call
开源
Python
VMark深度解析:为AI时代打造的本地优先Markdown编辑器
编程
VMark深度解析:为AI时代打造的本地优先Markdown编辑器
2026-04-27 20:09:26 +0800 CST
view 1135
VMark是李笑来打造的AI原生Markdown编辑器,基于Tauri v2构建,支持MCP协议集成Claude Code/Codex等AI工具,三种编辑模式、中文排版优化、多光标编辑,本地优先无遥测。
Markdown
AI
开源工具
写作工具
Rust
异步 Rust 的未来之战:Tokio 调度器深度解析——从协作式调度到多线程负载均衡
编程
异步 Rust 的未来之战:Tokio 调度器深度解析——从协作式调度到多线程负载均衡
2026-06-15 18:48:40 +0800 CST
view 480
深入解析 Tokio 调度器架构:从 Future 状态机本质、Work-Stealing 无锁队列,到多线程负载均衡、生产级性能调优,结合 Tonic 加入 gRPC 等 2026 年生态新动态
Rust
async
Tokio
异步编程
Work-Stealing
调度器
编程
MarkItDown 深度实战:当文档处理遇上 LLM 时代——从格式转换到 RAG 数据预处理的完全指南(2026)
2026-06-10 02:49:00 +0800 CST
view 666
深度解析微软开源的MarkItDown工具,如何将PDF、Word、Excel、PPT等15+种格式一键转换为LLM友好的Markdown,涵盖架构原理、代码实战、RAG集成、性能优化到生产级部署。
MarkItDown
文档转换
RAG
Python
微软
AI工具
用 Obsidian + Claude 整了个 AI 记忆外挂:claude-obsidian 深度测评
编程
用 Obsidian + Claude 整了个 AI 记忆外挂:claude-obsidian 深度测评
2026-07-04 16:22:16 +0800 CST
view 484
claude-obsidian是GitHub上8.5K Stars的开源AI知识引擎,将PDF/文本自动整理为wiki知识图谱,hot.md持久化跨会话记忆,autoresearch三轮自主研究+归档,支持PARA/LYT/Zettelkasten四种知识组织方法论,MIT协议数据不锁死。
Obsidian
Claude
AI第二大脑
知识图谱
claude-obsidian
hot缓存
autoresearch
PARA
LYT
Zettelkasten
Markdown
MIT
开源
Loop Engineering深度解析:从Prompt到循环——2026年AI工程第四次范式跃迁的完整实战指南
编程
Loop Engineering深度解析:从Prompt到循环——2026年AI工程第四次范式跃迁的完整实战指南
2026-07-06 01:43:41 +0800 CST
view 504
深度解析Loop Engineering——2026年6月引爆AI圈的第四次工程范式跃迁。从Prompt到Context到Harness到Loop的完整演进、五大核心模块(Discover/Plan/Execute/Verify/Iterate)架构设计、完整Python代码实战、生产环境部署指南。
Loop Engineering
AI Agent
Prompt Engineering
Context Engineering
Harness Engineering
Python
自动化
工程范式
Loop Engineering vs Harness Engineering:2026年AI编程范式大决裂——从"手写提示词"到"设计循环系统"的工程真相
编程
Loop Engineering vs Harness Engineering:2026年AI编程范式大决裂——从"手写提示词"到"设计循环系统"的工程真相
2026-07-20 16:17:37 +0800 CST
view 249
2026年最热AI编程新范式:Loop Engineering vs Harness Engineering深度解析。从Prompt Engineering到Context Engineering,再到Loop Engineering,完整讲述AI编程三次范式转移,配生产级Python代码实现
Loop Engineering
Harness Engineering
AI编程
Agent
Prompt Engineering
Context Engineering
自动化测试
代码质量
DeepSeek-TUI:终端里的 Claude Code,Rust 重写让 AI 编程助手轻到飞起
编程
DeepSeek-TUI:终端里的 Claude Code,Rust 重写让 AI 编程助手轻到飞起
2026-05-11 14:25:25 +0800 CST
view 639
DeepSeek-TUI由美国独立开发者Hunter Bown用Rust编写,是DeepSeek版的Claude Code。支持1M token上下文、流式推理可视化、Plan/Agent/YOLO三种模式、MCP协议、LSP诊断。成本仅为Claude Code的1/10,MIT开源,单二进制无运行时依赖。
DeepSeek-TUI,Hunter Bown,Rust,Claude Code替代,终端AI助手,AI编程,Agent模式,YOLO模式,DeepSeek V4,MCP协议
万字深度解析 DeepSeek V4:当 1.6 万亿参数遇见 DSA 稀疏注意力——开源大模型如何让 API 账单暴降 95%(2026)
编程
万字深度解析 DeepSeek V4:当 1.6 万亿参数遇见 DSA 稀疏注意力——开源大模型如何让 API 账单暴降 95%(2026)
2026-07-01 07:13:58 +0800 CST
view 416
2026年4月DeepSeek V4发布,1.6万亿参数+百万上下文+SWE-Bench 80.6%,API成本暴降95%。深度解析DSA稀疏注意力、MoE架构、生产级部署实战。
DeepSeek V4
DSA 稀疏注意力
MoE 架构
百万上下文
开源大模型
API 成本优化
大模型部署
Agent 能力
SWE-Bench
DeepSeek
Loop Engineering 深度解析:2026 年 AI 工程范式从 Prompt 到 Loop 的四阶跃迁——Boris Cherny 和 Peter Steinberger 联手定义的 Agent 循环工程实战指南
编程
Loop Engineering 深度解析:2026 年 AI 工程范式从 Prompt 到 Loop 的四阶跃迁——Boris Cherny 和 Peter Steinberger 联手定义的 Agent 循环工程实战指南
2026-07-07 08:13:00 +0800 CST
view 376
深度解析2026年AI工程范式从Prompt到Loop的四阶跃迁:Loop Engineering循环工程的核心概念、六块积木架构、47次实验验证数据、完整生产级实战。涵盖自动化调度、Git Worktree并行、Skill持久化、MCP连接器、子Agent审查、记忆系统,含完整代码示例与未来展望。
Loop Engineering
循环工程
AI Agent
Prompt Engineering
Harness Engineering
Claude Code
OpenClaw
多Agent编排
AI编程
工程范式
DeepGEMM 深度解析:DeepSeek 开源的 FP8 GEMM 内核如何重塑 AI 推理性能边界
编程
DeepGEMM 深度解析:DeepSeek 开源的 FP8 GEMM 内核如何重塑 AI 推理性能边界
2026-04-21 05:16:09 +0800 CST
view 1090
深入剖析 DeepSeek 开源的 DeepGEMM 库:从 FP8 精度革命到 1550 TFLOPS 性能突破,揭秘现代 AI 推理基础设施的底层优化技术
DeepGEMM
FP8
DeepSeek
CUDA
AI推理
GPU优化
GEMM
TensorCore
DeepSeek DeepGEMM 2026年4月重磅更新:Mega MoE融合算子、FP4精度与极致性能优化
编程
DeepSeek DeepGEMM 2026年4月重磅更新:Mega MoE融合算子、FP4精度与极致性能优化
2026-04-23 08:41:45 +0800 CST
view 784
深度解析DeepSeek DeepGEMM 2026年4月重大更新:Mega MoE融合算子(dispatch+Linear+SwiGLU+Combine五合一,NVLink通信与Tensor Core计算重叠)、FP8xFP4 GEMM、FP4 Indexer、PDL调度优化与JIT加速,附完整代码实战。
DeepGEMM
DeepSeek
GPU优化
CUDA
FP8
FP4
MoE
AI Infra
高性能计算
NVIDIA
ClickHouse 深度拆解:当列式存储开始吞掉数据仓库——从 MergeTree 引擎家族到向量化执行与 SharedMergeTree 云原生的完全指南(2026)
编程
ClickHouse 深度拆解:当列式存储开始吞掉数据仓库——从 MergeTree 引擎家族到向量化执行与 SharedMergeTree 云原生的完全指南(2026)
2026-08-13 02:44:57 +0800 CST
view 23
2026 年 ClickHouse 年化收入破 2.5 亿美元。本文从列式存储本质讲起,拆解 MergeTree 引擎家族、稀疏主键与向量化执行管线,用可运行的实时事件分析系统(AggregatingMergeTree+物化视图+原生JSON+SharedMergeTree)落地,并给出 15 条生产踩坑清单。
ClickHouse
MergeTree
列式存储
向量化执行
SharedMergeTree
OLAP
实时分析
物化视图
Neon 深度拆解:Serverless Postgres 的存储计算分离架构——从 Safekeeper 到 Pageserver,手写一个生产级分支数据库引擎
编程
Neon 深度拆解:Serverless Postgres 的存储计算分离架构——从 Safekeeper 到 Pageserver,手写一个生产级分支数据库引擎
2026-08-03 03:12:43 +0800 CST
view 115
深度拆解Neon Serverless Postgres架构:存储计算分离设计、WAL流转路径重设计、Safekeeper持久化、Pageserver懒加载与LSM-tree引擎、Copy-on-Write零拷贝分支,附完整Rust实现代码与生产部署指南
Neon
PostgreSQL
Serverless
存储计算分离
WAL
Pageserver
Safekeeper
Copy-on-Write
LSM-tree
Rust
数据库
ClickHouse 深度实战:当实时 OLAP 撞上次世代列式引擎——MergeTree、稀疏索引与向量化执行如何重写数据分析心智模型
编程
ClickHouse 深度实战:当实时 OLAP 撞上次世代列式引擎——MergeTree、稀疏索引与向量化执行如何重写数据分析心智模型
2026-07-15 04:11:41 +0800 CST
view 200
从工程师视角深度拆解 ClickHouse:列存、向量化执行、MergeTree 引擎家族、稀疏主键索引、跳过索引与物化视图,配 Docker/SQL/Python/Go 实战与性能调优指南。
ClickHouse
MergeTree
列式存储
向量化执行
稀疏索引
实时数仓
OLAP
物化视图
ClickHouse Keeper
KTransformers 深度拆解:单张 4090 跑满血 DeepSeek-R1 671B,清华团队如何用 CPU/GPU 异构推理实现 28 倍加速
编程
KTransformers 深度拆解:单张 4090 跑满血 DeepSeek-R1 671B,清华团队如何用 CPU/GPU 异构推理实现 28 倍加速
2026-07-29 09:44:03 +0800 CST
view 207
深度拆解清华开源的 KTransformers:MoE 稀疏性卸载、AMX/Marlin 高性能算子、CUDA Graph 与 YAML 注入框架四层架构,单张 4090 跑满血 DeepSeek-R1 671B,附完整部署实战与性能调优清单。
KTransformers
异构推理
MoE
DeepSeek
AMX
CUDA Graph
大模型部署
性能优化
开源
KTransformers 深度拆解:一块 RTX 5090 跑 100B+ 大模型,CPU/GPU 异构推理凭什么改写 LLM 本地部署规则
编程
KTransformers 深度拆解:一块 RTX 5090 跑 100B+ 大模型,CPU/GPU 异构推理凭什么改写 LLM 本地部署规则
2026-07-24 07:44:31 +0800 CST
view 228
KTransformers 通过 CPU/GPU 异构计算,让一块 RTX 5090(32GB 显存)能跑起 100B+ MoE 大模型,且无需量化压缩,保持原精度 FP16。实测比 llama.cpp Q8_0 快 4.5 倍。本文深度拆解其专家细粒度卸载、异步预取、DMA 优化等核心技术,以及实战部署指南。
KTransformers
LLM推理
MoE
异构计算
DeepSeek
SGLang
CPU Offload
本地部署
GPU优化
Meetily 深度解析:16K Stars 的 Rust 隐私优先 AI 会议助手如何用 Parakeet/Whisper 实时转录 + Ollama 本地摘要让企业会议数据永远不出设备——从 Tauri 架构到生产级部署的完整实战指南
编程
Meetily 深度解析:16K Stars 的 Rust 隐私优先 AI 会议助手如何用 Parakeet/Whisper 实时转录 + Ollama 本地摘要让企业会议数据永远不出设备——从 Tauri 架构到生产级部署的完整实战指南
2026-07-07 05:42:52 +0800 CST
view 335
深度解析GitHub 16K+ Stars的Meetily隐私优先AI会议助手:基于Rust+Tauri架构,集成Whisper/Parakeet双引擎实时转录、说话人分离、Ollama本地LLM摘要生成。100%本地处理,数据永远不出设备。从架构原理到生产级部署实战,含完整代码示例与竞品对比分析。
Meetily
Rust
隐私优先
AI会议助手
语音转录
Whisper
Parakeet
Ollama
Tauri
开源
稀疏注意力架构革命:2026年长上下文大模型核心技术解析
编程
稀疏注意力架构革命:2026年长上下文大模型核心技术解析
2026-07-09 08:45:09 +0800 CST
view 391
深入解析2026年稀疏注意力技术革命,涵盖SubCube、CSA/HCA、MSA三大架构的技术原理、代码实现与实战指南,探讨长上下文大模型的最新发展。
AI
大模型
Transformer
稀疏注意力
LongContext
DeepSeek
MiniMax
Redis之父antirez亲自下场!为DeepSeek V4 Flash打造专属推理引擎,Mac上跑出468 token/s
案例
Redis之父antirez亲自下场!为DeepSeek V4 Flash打造专属推理引擎,Mac上跑出468 token/s
2026-05-10 08:40:22 +0800 CST
view 831
Redis之父antirez亲自下场!为DeepSeek V4 Flash打造专属推理引擎ds4.c,C+Metal从头编写,Mac Studio M3 Ultra上预填充468 token/s。关键优化:非对称量化(MoE专家层2-bit)、KV缓存搬硬盘、内置OpenAI/Anthropic双API。128GB Mac可跑,专为coding agent优化。
DeepSeek
AI推理
Mac
Redis
antirez
Metal
本地推理
MoE
GGUF
C语言
Apple Silicon
Claude Code
OpenAI API
Anthropic API
Redis之父的「孤注一掷」:ds4.c如何让284B参数模型在128GB MacBook上跑起来
编程
Redis之父的「孤注一掷」:ds4.c如何让284B参数模型在128GB MacBook上跑起来
2026-07-11 16:17:33 +0800 CST
view 272
Redis之父 Salvatore Sanfilippo 2026年5月发布的新项目 ds4.c,专为 DeepSeek V4 Flash + Apple Silicon Metal 打造本地推理引擎,8000行代码实现2.5倍性能提升。本文深度解析其架构设计、Graph Executor、KV Cache页式管理与Metal Shader实现。
推理引擎
Apple Silicon
DeepSeek
Metal
Redis
ds4.c
DwarfStar 4 深度拆解:当 Redis 之父决定「干掉全部通用推理引擎」——一个专用 MoE 推理栈如何用 2-Bit 量化和磁盘 KV 缓存在 MacBook 上跑出 26 tok/s
编程
DwarfStar 4 深度拆解:当 Redis 之父决定「干掉全部通用推理引擎」——一个专用 MoE 推理栈如何用 2-Bit 量化和磁盘 KV 缓存在 MacBook 上跑出 26 tok/s
2026-08-04 22:46:33 +0800 CST
view 122
深度拆解Redis创始人antirez打造的DwarfStar 4本地推理引擎:专用MoE推理栈、非对称2-Bit量化、磁盘KV缓存、SSD流式加载、多机流水线并行,在128GB MacBook上跑出26 tok/s的284B模型推理
DwarfStar
Redis
antirez
DeepSeek
MoE
本地推理
LLM
推理引擎
2-Bit量化
KV缓存
Apple Metal
CUDA
开源
ds4 深度实战:当 Redis 之父用纯 C 重写本地推理引擎——从 KV 缓存磁盘持久化到 Metal 极致优化的完全指南
编程
ds4 深度实战:当 Redis 之父用纯 C 重写本地推理引擎——从 KV 缓存磁盘持久化到 Metal 极致优化的完全指南
2026-06-11 07:51:35 +0800 CST
view 1029
Redis之父antirez新作ds4深度解析:非对称2-bit量化、KV缓存磁盘持久化、Metal极致优化,284B模型在MacBook上跑出26 tok/s的完全指南
ds4
DeepSeek
本地推理
Metal
KV缓存
量化
antirez
Redis
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
5
6
7
8
9
...
70
下一页