程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
stop-slop 深度实战:让 AI 写作告别"机器味"——从 AI Tells 识别到零痕迹输出的完全指南(2026)
编程
stop-slop 深度实战:让 AI 写作告别"机器味"——从 AI Tells 识别到零痕迹输出的完全指南(2026)
2026-06-02 15:55:21 +0800 CST
view 925
深度解析 stop-slop 项目,系统性移除 AI 写作痕迹的实战指南,涵盖规则体系、评分标准、实战集成与完整代码示例。
AI写作
stop-slop
LLM
提示工程
技术写作
vLLM 0.17 深度实战:PagedAttention与连续批处理如何把GPU吞吐量提升4倍——从KV Cache原理到生产级大模型推理部署完全指南(2026)
编程
vLLM 0.17 深度实战:PagedAttention与连续批处理如何把GPU吞吐量提升4倍——从KV Cache原理到生产级大模型推理部署完全指南(2026)
2026-06-11 03:17:21 +0800 CST
view 937
深度解析vLLM推理引擎的PagedAttention原理、连续批处理、量化优化,以及从零搭建生产级高并发部署的完整实战指南(2026版)
vLLM
PagedAttention
大模型推理
GPU优化
AI部署
Onyx 深度解析:当开源AI平台把「企业级能力」变成「一键部署」
编程
Onyx 深度解析:当开源AI平台把「企业级能力」变成「一键部署」
2026-04-10 07:36:00 +0800 CST
view 555
Onyx 是 26k+ stars 的开源AI平台,提供 Agentic RAG、Deep Research、Custom Agents、MCP 等企业级能力。本文深度解析其架构设计、核心功能和部署实战,是私有AI部署的标准答案。
Onyx
开源AI
RAG
企业AI
LLM平台
LLM 驱动的自动化漏洞挖掘:从 AIxVuln 到 Wiz 实战,多 Agent 如何重塑安全攻防体系
编程
LLM 驱动的自动化漏洞挖掘:从 AIxVuln 到 Wiz 实战,多 Agent 如何重塑安全攻防体系
2026-05-23 06:17:17 +0800 CST
view 557
深入解析 LLM 驱动的自动化漏洞挖掘技术,从 AIxVuln 多 Agent 架构到 Wiz 发现 GitHub CVE-2026-3854 的实战案例,覆盖架构设计、代码实战、性能优化与安全边界
AI安全
漏洞挖掘
LLM
多Agent
Docker沙箱
Wiz
GitHub
CVE
Everything Claude Code (ECC) 深度实战:当AI编程助手拥有48位专家团队成员——从182个Skill到Token优化、从MCP集成到生产级部署的完全指南(2026)
编程
Everything Claude Code (ECC) 深度实战:当AI编程助手拥有48位专家团队成员——从182个Skill到Token优化、从MCP集成到生产级部署的完全指南(2026)
2026-06-22 09:25:50 +0800 CST
view 907
Everything Claude Code (ECC) 是2026年GitHub最火的AI编程项目,近20万Star。本文深度解析ECC的六大核心模块、48个专业Agent、182个工作流Skill,以及Token优化、MCP集成、生产级部署等实战内容。
Claude Code
AI编程
ECC
Agent
LLM
大模型推理框架 2026 终极对决:vLLM 0.5 vs TGI 2.0 vs TensorRT-LLM 1.8 vs DeepSpeed-MII 0.9——从架构内核、性能基准到成本防线的生产级全景解析
编程
大模型推理框架 2026 终极对决:vLLM 0.5 vs TGI 2.0 vs TensorRT-LLM 1.8 vs DeepSpeed-MII 0.9——从架构内核、性能基准到成本防线的生产级全景解析
2026-07-11 13:14:24 +0800 CST
view 339
深度拆解2026年四大主流LLM推理框架(vLLM 0.5、TGI 2.0、TensorRT-LLM 1.8、DeepSpeed-MII 0.9)的技术内核,通过统一性能基准测试,量化对比吞吐量、延迟、成本等核心指标,提供不同场景的技术选型建议和实战代码示例。
大模型
推理优化
vLLM
TensorRT
性能调优
成本控制
生产部署
OpenClaw 深度解析:重塑个人 AI 助手范式的开源架构革命——从 Gateway 到 Skill 生态的全链路技术拆解
编程
OpenClaw 深度解析:重塑个人 AI 助手范式的开源架构革命——从 Gateway 到 Skill 生态的全链路技术拆解
2026-06-30 03:44:16 +0800 CST
view 611
深度解析OpenClaw个人AI助手框架:从Gateway控制面、多通道消息路由、Skill技能生态、MCP协议集成、安全模型、会话管理到生产级部署,附完整代码示例与架构决策分析。
OpenClaw
个人AI助手
开源AI
AI Agent
MCP协议
Gateway架构
Skill生态
多通道接入
本地部署
AI自动化
Headroom深度解析:AI Agent上下文压缩层的架构革命——Token成本暴降95%与可逆压缩的完整实战指南
编程
Headroom深度解析:AI Agent上下文压缩层的架构革命——Token成本暴降95%与可逆压缩的完整实战指南
2026-07-05 21:12:46 +0800 CST
view 437
深度解析Headroom上下文压缩中间层:六大压缩算法(SmartCrusher/CodeCompressor/Kompress-base/ImageCompressor/IntelligentContext/CacheAligner)、CCR可逆压缩、跨Agent记忆共享、KV Cache命中率优化。含完整代码实战、基准测试对比、竞品分析与生产部署指南。
Headroom
AI Agent
上下文压缩
Token优化
CCR
可逆压缩
Context Engineering
KV Cache
LLM
Python
LiteRT-LM:Google端侧大模型推理引擎的革命性架构——从TensorFlow Lite的困境到LLM原生推理的全链路解析
编程
LiteRT-LM:Google端侧大模型推理引擎的革命性架构——从TensorFlow Lite的困境到LLM原生推理的全链路解析
2026-04-19 22:17:39 +0800 CST
view 1109
深入解析Google LiteRT-LM端侧LLM推理引擎的核心架构:分层内存池、KV Cache量化、算子融合、WebGPU运行时。与TensorFlow Lite、llama.cpp、MLX横向对比,提供生产级部署实战指南。
Google
端侧AI
LiteRT-LM
WebGPU
量化
KV Cache
TensorFlow Lite
LLM推理
从"Vibe Coding"到"工程级约束":Agent Skills 如何重塑 AI 编码的生产力范式
编程
从"Vibe Coding"到"工程级约束":Agent Skills 如何重塑 AI 编码的生产力范式
2026-05-16 17:48:12 +0800 CST
view 631
Agent Skills是Google Cloud AI总监Addy Osmani开源的生产级工程技能框架,为AI编码代理注入资深工程师的工作纪律。本文深度解析其六阶段开发流程、反合理化机制、三大铁律,以及在Claude Code/Cursor中的落地实践。
Agent Skills
Addy Osmani
AI编程
Claude Code
Cursor
Ollama 深度实战:当本地大模型部署成为事实标准——从一行命令跑 Llama/Qwen/DeepSeek 到生产级 API 兼容与多语言接入完全指南(2026)
编程
Ollama 深度实战:当本地大模型部署成为事实标准——从一行命令跑 Llama/Qwen/DeepSeek 到生产级 API 兼容与多语言接入完全指南(2026)
2026-06-11 05:47:01 +0800 CST
view 555
本文深入讲解Ollama的原理、实战部署、性能优化,帮助开发者快速掌握本地大模型部署能力
Ollama
本地大模型
AI部署
Go语言
Python
60行CLAUDE.md,25K Stars:Karpathy揭示的LLM编程四大致命陷阱与工程解法
编程
60行CLAUDE.md,25K Stars:Karpathy揭示的LLM编程四大致命陷阱与工程解法
2026-04-19 23:44:59 +0800 CST
view 932
深度解析GitHub 25K Stars项目forrestchang/andrej-karpathy-skills,揭示LLM编程工具的四大系统性缺陷,详解Karpathy四大编码原则在工程实践中的落地方法。
Claude Code
LLM
AI编程
Karpathy
工程实践
chromem-go:纯 Go 嵌入式向量数据库,像 SQLite 一样给应用加上 RAG
编程
chromem-go:纯 Go 嵌入式向量数据库,像 SQLite 一样给应用加上 RAG
2026-07-05 22:24:58 +0800 CST
view 329
纯Go、零依赖、可嵌入的向量数据库。10万篇文档40毫秒查询,内置9种嵌入模型,支持Ollama本地离线运行,适合Go应用快速集成RAG能力。
Go
向量数据库
RAG
chromem-go
AI
嵌入式
Ollama
语义搜索
OpenTelemetry 深度实战:当可观测性终于有了统一标准——从三大信号模型、Collector 管线到 eBPF 零侵入采集的生产级完全指南
编程
OpenTelemetry 深度实战:当可观测性终于有了统一标准——从三大信号模型、Collector 管线到 eBPF 零侵入采集的生产级完全指南
2026-07-11 15:44:43 +0800 CST
view 299
深度拆解 OpenTelemetry 的 Signals 信号模型、OTLP 协议、语义约定与上下文传播,剖析 Collector 接收-处理-导出管线与 Agent/Gateway 部署拓扑,配 Go/Python/Java 手动与自动埋点、Collector 配置与 eBPF 零侵入采集实战,并给出尾部采样、基数治理与成本优化方案。
OpenTelemetry
可观测性
分布式追踪
OpenTelemetry Collector
eBPF
云原生
APM
分布式系统
Tabby 深度实战:用一台消费级 GPU 搭好团队私有的"Copilot"
编程
Tabby 深度实战:用一台消费级 GPU 搭好团队私有的"Copilot"
2026-07-24 01:46:45 +0800 CST
view 176
深度实战 TabbyML/tabby 自托管 AI 编程助手:三层架构与 llama-server 独立化重构、消费级 GPU 模型选型、Repository Context 语法感知 RAG 索引、FIM Prompt 拼装原理、systemd/nginx 生产部署、压测与 Prometheus 监控全套方案。
Tabby
AI编程
代码补全
自托管
llama.cpp
RAG
Rust
GPU
开源
Copilot
MarkItDown 深度拆解:微软如何用一个 Converter 注册表吃掉 RAG 60% 的脏活
编程
MarkItDown 深度拆解:微软如何用一个 Converter 注册表吃掉 RAG 60% 的脏活
2026-07-29 07:13:55 +0800 CST
view 187
深度拆解微软开源的 MarkItDown:Converter 注册表架构、StreamInfo 三重类型探测、PPTX 视觉排序、多模态 LLM 图片描述、MCP 集成与自定义插件开发,附 RAG 批量入库流水线实战与生产避坑指南。
MarkItDown
RAG
文档预处理
Markdown
LLM
MCP
Python
开源
Hermes Agent 自进化架构深度解析:五个阶段闭环学习系统如何让 AI Agent 真正「越用越聪明」
编程
Hermes Agent 自进化架构深度解析:五个阶段闭环学习系统如何让 AI Agent 真正「越用越聪明」
2026-07-24 02:15:32 +0800 CST
view 211
深度解析 Hermes Agent 的五大阶段闭环学习系统:Execute-Trigger-Review-Persist-Evolve。涵盖三层记忆架构、GRPO 强化学习内化、Tool Search 上下文优化,以及与 OpenClaw 的工程路线对比。
Hermes Agent
Nous Research
AI Agent
自进化
闭环学习系统
Skill
Memory
GRPO
OpenClaw
MCP
DwarfStar 4 深度拆解:当 Redis 之父决定「干掉全部通用推理引擎」——一个专用 MoE 推理栈如何用 2-Bit 量化和磁盘 KV 缓存在 MacBook 上跑出 26 tok/s
编程
DwarfStar 4 深度拆解:当 Redis 之父决定「干掉全部通用推理引擎」——一个专用 MoE 推理栈如何用 2-Bit 量化和磁盘 KV 缓存在 MacBook 上跑出 26 tok/s
2026-08-04 22:46:33 +0800 CST
view 112
深度拆解Redis创始人antirez打造的DwarfStar 4本地推理引擎:专用MoE推理栈、非对称2-Bit量化、磁盘KV缓存、SSD流式加载、多机流水线并行,在128GB MacBook上跑出26 tok/s的284B模型推理
DwarfStar
Redis
antirez
DeepSeek
MoE
本地推理
LLM
推理引擎
2-Bit量化
KV缓存
Apple Metal
CUDA
开源
编程
MarkItDown 深度实战:当微软用 Python 把「文档地狱」变成 Markdown 乐园——从多格式解析到 RAG 知识库落地的生产级完全指南(2026)
2026-06-16 23:52:04 +0800 CST
view 453
微软开源MarkItDown深度实战:从多格式文档解析到RAG知识库落地的完全指南,涵盖PDF/Word/Excel/PPT转换、LangChain/LlamaIndex集成、性能优化与安全防护
MarkItDown
Python
RAG
文档转换
Markdown
LLM
知识库
微软
AI Agent
LangChain
字节跳动开源的 Go Agent 框架,10K+ Stars 填补 Go 无 LangChain 的空白
编程
字节跳动开源的 Go Agent 框架,10K+ Stars 填补 Go 无 LangChain 的空白
2026-07-05 22:29:19 +0800 CST
view 300
字节跳动CloudWeGo团队开源的Go-first LLM应用框架,组合优于继承、流式优先、Agent原生,支持五种协作模式和五种人机交互模式。
Go
AI
Agent
字节跳动
Eino
LangChain
LLM
开源
LightRAG 深度拆解:当 RAG 决定「干掉全部纯向量检索」——一个 38K Star 的知识图谱引擎如何用实体-关系双层检索重新定义检索增强生成的终极形态
编程
LightRAG 深度拆解:当 RAG 决定「干掉全部纯向量检索」——一个 38K Star 的知识图谱引擎如何用实体-关系双层检索重新定义检索增强生成的终极形态
2026-08-04 23:15:13 +0800 CST
view 117
深度拆解38K Star开源RAG框架LightRAG:实体-关系双层检索架构、六种检索模式、Neo4j/PostgreSQL可插拔存储、RRF融合排序算法、多模态支持,附完整代码实战与性能基准对比
LightRAG
知识图谱
RAG
向量检索
EMNLP
Python
LLM
检索增强生成
HKUDS
开源
VibeVoice 深度解析:微软如何用 7.5Hz 超低帧率暴力破解 90 分钟长语音合成——开源语音 AI 的技术革命
编程
VibeVoice 深度解析:微软如何用 7.5Hz 超低帧率暴力破解 90 分钟长语音合成——开源语音 AI 的技术革命
2026-05-10 23:20:20 +0800 CST
view 734
深度解析微软开源语音 AI 项目 VibeVoice 的技术架构——从 7.5Hz 超低帧率分词器到 Next-Token Diffusion 框架,一次性处理 90 分钟多说话人音频的革命性突破。
VibeVoice
语音AI
TTS
ASR
微软
开源模型
LLM
扩散模型
Bun 深度拆解:当 JavaScript 运行时开始「吞噬」工具链——从内置无头浏览器自动化、cron 定时调度到 All-in-One 工程哲学的全景(2026)
编程
Bun 深度拆解:当 JavaScript 运行时开始「吞噬」工具链——从内置无头浏览器自动化、cron 定时调度到 All-in-One 工程哲学的全景(2026)
2026-07-18 09:13:24 +0800 CST
view 186
2026年7月Bun把无头浏览器自动化和cron定时调度内置进运行时。深度拆解其Zig+JavaScriptCore底座、全家桶哲学、浏览器驱动与cron调度架构,含完整代码实战与性能优化。
Bun
JavaScript 运行时
无头浏览器
浏览器自动化
cron 定时任务
All-in-One
前端工程化
Zig
JavaScriptCore
OpenCodeReview 深度拆解:当阿里巴巴决定「干掉 AI 代码审查的全部噪声」——一个 18.7K Star 的 Go 工具如何用确定性工程 × Agent 混合架构重新定义代码审查的终极形态
编程
OpenCodeReview 深度拆解:当阿里巴巴决定「干掉 AI 代码审查的全部噪声」——一个 18.7K Star 的 Go 工具如何用确定性工程 × Agent 混合架构重新定义代码审查的终极形态
2026-08-05 00:44:59 +0800 CST
view 132
深度拆解阿里巴巴开源AI代码审查工具OpenCodeReview:确定性工程×Agent混合架构、行级精度评论定位、1/9 Token消耗、18.7K Star背后的架构设计与实战部署指南
OpenCodeReview
阿里巴巴
代码审查
AI Code Review
Go语言
LLM
Agent
静态分析
CI/CD
GitHub Actions
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
12
13
14
15
16
...
30
下一页