程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Deer-Go:字节Deer-Flow的Go移植,深度研究Agent全拆解
代码
Deer-Go:字节Deer-Flow的Go移植,深度研究Agent全拆解
2026-07-03 06:30:35 +0800 CST
view 251
deer-go是字节跳动deer-flow的Go移植版,采用8节点多Agent团队架构,支持结构化Plan JSON驱动研究流程、BackgroundInvestigator预搜索、Human计划审批、CheckPoint断点续跑,专为深度研究场景设计。
AI
Agent
字节跳动
Go语言
开源
深度研究
Eino
企业级AI
云原生
LLM
OpenAI Jalapeño 芯片深度解析:从"借道英伟达"到"自建帝国",一颗"辣椒"如何重塑 AI 算力格局
编程
OpenAI Jalapeño 芯片深度解析:从"借道英伟达"到"自建帝国",一颗"辣椒"如何重塑 AI 算力格局
2026-06-27 10:43:27 +0800 CST
view 315
2026年6月24日OpenAI发布首款自研AI推理芯片Jalapeño,从架构设计到流片仅用9个月。本文深度解析这颗ASIC的技术架构、数据流设计、AI辅助芯片工程、对英伟达的影响以及整个AI算力产业格局的重塑。
OpenAI,Jalapeño,AI芯片,ASIC,博通,Broadcom,LLM推理,AI基础设施,半导体,大模型
AI Agent 工具链安全:从 Prompt 注入到工具滥用的完整攻防实战指南
编程
AI Agent 工具链安全:从 Prompt 注入到工具滥用的完整攻防实战指南
2026-07-08 08:50:06 +0800 CST
view 519
一文讲透 AI Agent 面临的六大攻击向量、四层防御架构、三个生产级防御框架,附完整代码示例与红蓝对抗实战经验。
AI Agent
安全
Prompt注入
LLM安全
攻防实战
OpenVINO 2026.3 深度拆解:从 MoE 磁盘卸载到 FP8 量化,Intel 的端侧 AI 推理全家桶又升级了
编程
OpenVINO 2026.3 深度拆解:从 MoE 磁盘卸载到 FP8 量化,Intel 的端侧 AI 推理全家桶又升级了
2026-08-10 11:46:27 +0800 CST
view 56
深度拆解 Intel OpenVINO 2026.3 四大核心更新:MoE 磁盘卸载让 300B 模型跑在 16GB 机器上、Linux 懒加载消除权重复制、FP8 量化新能力、三条 GenAI 新流水线,配完整代码实战与性能数据对比
OpenVINO
Intel
AI推理
MoE
FP8量化
端侧部署
NNCF
LLM
CPU推理
Rolldown 1.0 深度拆解:当 Vite 的「双引擎架构」终于合二为一——Rust 打包器如何用 10-30 倍性能碾压全场
编程
Rolldown 1.0 深度拆解:当 Vite 的「双引擎架构」终于合二为一——Rust 打包器如何用 10-30 倍性能碾压全场
2026-08-10 12:15:02 +0800 CST
view 47
深度拆解 Rolldown 1.0:Vite 8 默认引擎如何用 Rust 重写 JavaScript 打包器,10-30 倍性能提升、Rollup 插件生态完全兼容、Oxc 编译器集成,从架构原理到生产实战完整解析
Rolldown
Vite
Vite8
Rust
打包器
JavaScript
TypeScript
Oxc
前端工具链
1.58-bit 大模型极限量化实战:从 BitNet 三值权重到单颗 CPU 跑起 100B 模型
编程
1.58-bit 大模型极限量化实战:从 BitNet 三值权重到单颗 CPU 跑起 100B 模型
2026-07-21 16:20:29 +0800 CST
view 219
2026极限量化实战:BitNet三值权重、absmean/absmax量化、BitLinear实现、带宽数学与bitnet.cpp内核优化,单CPU跑100B模型。
BitNet
1.58-bit
大模型量化
LLM
端侧推理
bitnet.cpp
Karpathy 四原则深度实战:当 AI 编程助手学会「克制」——从错误率 41% 到 3% 的生产级完全指南(2026)
编程
Karpathy 四原则深度实战:当 AI 编程助手学会「克制」——从错误率 41% 到 3% 的生产级完全指南(2026)
2026-06-06 09:38:11 +0800 CST
view 547
前 Tesla AI 总监 Karpathy 提炼的四条 AI 编程原则,如何在 6 周内让 30 个代码库错误率从 41% 降到 3%。深入剖析 Think Before Coding、Simplicity First、Surgical Changes、Goal-Driven Execution 四原则的底层逻辑与实战应用。
AI编程
Claude Code
Karpathy
LLM
编码原则
BitNet 深度实战:微软 32K Star 的 1-bit LLM 推理框架——从三值量化原理到 CPU 原生推理的全链路架构解析
编程
BitNet 深度实战:微软 32K Star 的 1-bit LLM 推理框架——从三值量化原理到 CPU 原生推理的全链路架构解析
2026-05-07 03:35:48 +0800 CST
view 589
深度解析微软 BitNet 1-bit LLM 推理框架,从三值量化数学原理到 bitnet.cpp 内核优化,再到 CPU 原生推理实战部署的全链路架构解析
BitNet
1-bit LLM
量化
CPU推理
微软
编程
Headroom 深度实战:当 AI Agent 学会「上下文压缩」——从 Token 暴降 95% 原理到生产级实践的完全指南(2026)
2026-06-08 17:53:16 +0800 CST
view 816
Headroom 是一个专为 AI Agent 设计的开源上下文压缩中间层,实测节省 60-95% Token,精度保留率高达 97%。本文从架构原理、六大压缩算法、MCP集成到生产级部署全面深度解析。涵盖 ContentRouter、SmartCrusher、可逆缓存等核心技术,配完整 Python 代码示例。适合 Claude Code、Cursor、LangChain 等工具链用户。Apache 2.0 开源可商用。
AI Agent,Token优化,上下文压缩,Headroom,LLM,Python,上下文管理,AI编程,生产实践
Headroom深度实战:当AI Agent学会「上下文减肥」——从60-95% Token压缩到零精度损失的工程完全指南(2026)
编程
Headroom深度实战:当AI Agent学会「上下文减肥」——从60-95% Token压缩到零精度损失的工程完全指南(2026)
2026-06-14 19:18:14 +0800 CST
view 525
全面拆解Headroom上下文压缩工具的原理、架构、接入方式与生产实践,解决AI Agent开发的Token成本与上下文窗口痛点
AI Agent
上下文压缩
Headroom
Token优化
LLM
Bun SIMD 深度实战:当 JavaScript 运行时拥抱 CPU 向量指令——从 Buffer.indexOf 2倍提速到 CRC32 20倍飞跃的生产级完全指南(2026)
编程
Bun SIMD 深度实战:当 JavaScript 运行时拥抱 CPU 向量指令——从 Buffer.indexOf 2倍提速到 CRC32 20倍飞跃的生产级完全指南(2026)
2026-06-08 18:28:13 +0800 CST
view 604
Bun 2026 SIMD深度实战:从Buffer.indexOf 2倍提速到CRC32 20倍飞跃,Mimalloc v3多线程内存分配,FastStringifier JSON加速,生产级迁移指南
Bun
SIMD
JavaScript
性能优化
AVX2
CRC32
Mimalloc
Headroom深度实战:AI Agent上下文压缩完全指南——60-95% Token节省的零精度损失方案(2026)
编程
Headroom深度实战:AI Agent上下文压缩完全指南——60-95% Token节省的零精度损失方案(2026)
2026-06-14 19:19:54 +0800 CST
view 550
全面拆解Headroom上下文压缩工具的原理、架构、接入方式与生产实践,解决AI Agent开发的Token成本与上下文窗口痛点
AI Agent
上下文压缩
Headroom
Token优化
LLM
MCP 深度拆解:当 AI Agent 学会「插拔」——Model Context Protocol 如何用 JSON-RPC 2.0 重写 AI 工具调用的心智模型
编程
MCP 深度拆解:当 AI Agent 学会「插拔」——Model Context Protocol 如何用 JSON-RPC 2.0 重写 AI 工具调用的心智模型
2026-07-15 09:42:17 +0800 CST
view 244
从工程师视角深度拆解 MCP 协议:三大核心原语、传输层机制(stdio/SSE)、Python/TypeScript SDK 实战、生产架构设计,以及它对 AI Agent 生态的深远影响。
MCP
Model Context Protocol
JSON-RPC
AI Agent
Tool Calling
Docs2KG:用大模型把PDF、邮件、Excel统一建成知识图谱,让企业沉睡知识激活
编程
Docs2KG:用大模型把PDF、邮件、Excel统一建成知识图谱,让企业沉睡知识激活
2026-04-16 19:04:26 +0800 CST
view 793
Docs2KG是AI4WA开源的知识图谱构建框架,用大模型将PDF、邮件、Excel等异构文档统一抽取为知识三元组,构建统一知识图谱,支持问答和推理分析。
知识图谱
AI
LLM
PDF
RAG
知识管理
开源
FastGPT:27.2K Star零代码构建企业级AI知识库,可视化工作流+多模态文档一站搞定
编程
FastGPT:27.2K Star零代码构建企业级AI知识库,可视化工作流+多模态文档一站搞定
2026-04-16 19:06:53 +0800 CST
view 1077
FastGPT是环界云团队开源的AI知识库问答系统(27.2K Stars),零代码构建私有知识库,支持可视化工作流编排和多模态文档解析,支持GPT/Claude等任意LLM模型。
AI
知识库
FastGPT
RAG
开源
LLM
工作流
Dify
Dify:92K Star开源LLM应用平台,零代码构建生产级AI工作流,Docker一键部署
编程
Dify:92K Star开源LLM应用平台,零代码构建生产级AI工作流,Docker一键部署
2026-04-16 19:09:32 +0800 CST
view 1163
Dify是开源的LLM应用开发平台(92K Stars),零代码构建生产级AI应用,支持可视化工作流编排和知识库管理,服务超过2000个团队,已完成3000万美元融资。
AI
LLM
Dify
工作流
RAG
开源
知识库
可视化编排
Karpathy的AI编程心法:用一份CLAUDE.md把AI助手从「会写代码」变成「会做工程」
编程
Karpathy的AI编程心法:用一份CLAUDE.md把AI助手从「会写代码」变成「会做工程」
2026-07-03 13:12:27 +0800 CST
view 564
一份不到70行的CLAUDE.md文件在GitHub斩获14.9万Star。本文深度解析Andrej Karpathy总结的四条AI编程核心原则。
AI编程
Claude Code
LLM
软件开发
Karpathy
当 WASM 遇上 WebGPU:浏览器端 AI 推理的第三次革命——用 Web 技术重写本地智能的心智模型
编程
当 WASM 遇上 WebGPU:浏览器端 AI 推理的第三次革命——用 Web 技术重写本地智能的心智模型
2026-07-15 14:17:19 +0800 CST
view 295
深度拆解 2026 年 WebGPU、WASM 与 WebNN 融合技术:三层计算模型、WGSL 编写、GEMM 量化推理、KV Cache、算子融合,配完整代码与性能基准。
WebGPU
WASM
WebNN
浏览器AI
WGSL
端侧推理
WebLLM
前端工程化
OpenTelemetry 深度实战:从 SDK 埋点、W3C 上下文传播到 Collector 流水线、尾部采样与全链路关联的工程全解(2026)
编程
OpenTelemetry 深度实战:从 SDK 埋点、W3C 上下文传播到 Collector 流水线、尾部采样与全链路关联的工程全解(2026)
2026-07-22 04:44:03 +0800 CST
view 200
OpenTelemetry 深度实战:从 SDK 手动埋点、W3C 上下文传播到 Collector 流水线、尾部采样与全链路关联,配 Go/Python 代码与生产级 Collector 配置,覆盖采样策略与基数控制等性能优化。
OpenTelemetry
可观测性
分布式追踪
OTLP
Collector
W3C
尾部采样
Zig 0.16 深度拆解:当一门系统语言决定把「I/O」做成可替换接口——从 Io vtable 到 Future/Group/Batch 与 Cancelation 的全链路架构手术
编程
Zig 0.16 深度拆解:当一门系统语言决定把「I/O」做成可替换接口——从 Io vtable 到 Future/Group/Batch 与 Cancelation 的全链路架构手术
2026-08-11 01:53:32 +0800 CST
view 31
深度拆解 Zig 0.16.0「I/O as an Interface」:为什么把 Io 做成和 Allocator 一样的显式依赖、async 与 concurrent 的语义分野、Cancelation 如何进入错误集、Threaded/Evented/Uring 四种实现选型,附 Juicy Main 与 Thread.Pool 迁移实战、增量编译与新 ELF 链接器性能数据、十条踩坑清单。
Zig
Zig 0.16
std.Io
异步IO
并发模型
函数染色
io_uring
Cancelation
增量编译
ELF链接器
LLVM
系统编程
LangChain4j:把LangChain的能力带入Java世界,一个库搞定LLM集成、RAG、Agent
编程
LangChain4j:把LangChain的能力带入Java世界,一个库搞定LLM集成、RAG、Agent
2026-04-16 19:11:21 +0800 CST
view 753
LangChain4j是Java世界的LangChain,简化Java应用集成大语言模型,支持OpenAI/Claude/DeepSeek等模型,提供RAG、Agent、Tool Calling、Memory等完整能力,Apache 2.0协议。
Java
LangChain
AI
LLM
RAG
Agent
开源
工具调用
GitHub Copilot 首次接入开源模型 Kimi K2.7 Code:从 MoE 架构到私有化部署的完整技术解析
编程
GitHub Copilot 首次接入开源模型 Kimi K2.7 Code:从 MoE 架构到私有化部署的完整技术解析
2026-07-03 14:13:50 +0800 CST
view 952
2026年7月3日,GitHub Copilot首次接入开源模型Kimi K2.7 Code。万字深度解析MoE架构、MLA注意力机制、30% Token优化技术原理、Copilot集成方案、私有化部署实战与成本分析。
Kimi K2.7 Code
GitHub Copilot
MoE
开源模型
AI编程
MoonshotAI
vLLM
模型部署
OpenTelemetry 深度实战:从三大信号模型、Collector 管线、W3C 上下文传播到尾部采样与 eBPF 无侵入埋点的生产级可观测性完全指南(2026)
编程
OpenTelemetry 深度实战:从三大信号模型、Collector 管线、W3C 上下文传播到尾部采样与 eBPF 无侵入埋点的生产级可观测性完全指南(2026)
2026-07-09 05:43:14 +0800 CST
view 426
从原理到落地的 OpenTelemetry 长文:讲清 traces/metrics/logs 三大信号模型、OTLP 协议、Collector 接收-处理-导出管线,手写 Go/Python 埋点与跨进程 W3C Trace Context 传播,配置尾部采样与 eBPF 零代码埋点,并给出采样、批处理、基数的生产级性能优化清单。
OpenTelemetry
可观测性
分布式追踪
Collector
eBPF
Headroom 深度解析:如何让 LLM Token 消耗减少 60-95% 而质量不降——2026 年 AI Agent 上下文压缩完全指南
编程
Headroom 深度解析:如何让 LLM Token 消耗减少 60-95% 而质量不降——2026 年 AI Agent 上下文压缩完全指南
2026-06-15 01:49:57 +0800 CST
view 637
深度解析 GitHub Trending 2026 榜首项目 Headroom,详解如何让 LLM Token 消耗减少 60-95% 而回答质量不降,含完整代码示例与生产成本优化方案。
LLM
Token压缩
AI Agent
上下文工程
Headroom
Python
Rust
成本优化
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
84
85
86
87
88
...
115
下一页