程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Google LangExtract 深度解析:用 LLM 从非结构化文本精准提取结构化信息——28K Star 的谷歌开源利器架构内幕
编程
Google LangExtract 深度解析:用 LLM 从非结构化文本精准提取结构化信息——28K Star 的谷歌开源利器架构内幕
2026-05-18 18:48:34 +0800 CST
view 423
Google LangExtract 深度解析,28K Star 开源项目,用 LLM 从非结构化文本中精准提取结构化信息,支持源文本定位、幻觉检测、交互式可视化
LLM
信息提取
Google
开源项目
NLP
Python
编程
微软 MarkItDown 深度剖析:20+ 格式一键转 Markdown 的架构设计与工程实践(2026)
2026-06-14 03:47:23 +0800 CST
view 467
深入解析微软MarkItDown工具,探讨其如何将各类文档转换为LLM友好的Markdown格式,涵盖架构设计、源码解析、20+格式支持实战、LLM数据管线集成、性能优化及生产级部署。
MarkItDown
微软
文档转换
LLM
Markdown
AI工作流
RAG
Hermes Agent 深度解析:当 AI Agent 学会"自我进化"——从 Nous Research 到下一代智能体运行时的范式革命
编程
Hermes Agent 深度解析:当 AI Agent 学会"自我进化"——从 Nous Research 到下一代智能体运行时的范式革命
2026-04-15 01:55:19 +0800 CST
view 913
深度解析 Hermes Agent:从 Nous Research 开源的 6 万 Star 项目,拆解其四层记忆系统、KEPA 学习闭环、自动技能生成机制,并与 OpenClaw 进行全方位对比。
AI Agent
Hermes Agent
Nous Research
OpenClaw
人工智能
机器学习
自我进化
开源项目
OpenViking 深度实战:火山引擎开源上下文数据库——让 AI Agent 拥有「记忆」的技术革命(2026 完全指南)
编程
OpenViking 深度实战:火山引擎开源上下文数据库——让 AI Agent 拥有「记忆」的技术革命(2026 完全指南)
2026-05-26 14:41:18 +0800 CST
view 691
OpenViking 是火山引擎开源的上下文数据库,专为 AI Agent 设计,通过虚拟文件系统(viking:// 协议)管理项目资源、用户偏好和会话状态,支持三级上下文加载和 HNSW 向量检索,让 AI Agent 真正拥有长期记忆能力。
AI Agent
OpenViking
上下文管理
火山引擎
向量数据库
OpenClaw
记忆系统
MCP
保护你的 Shell 脚本:Shell 脚本高效加密指南
综合
保护你的 Shell 脚本:Shell 脚本高效加密指南
2024-11-19 07:28:17 +0800 CST
view 2270
本文介绍了两种常见的Shell脚本加密工具:SHC和gzexe。SHC提供高等级的加密,适合需要严格安全性的场景,而gzexe适用于安全性要求不高的情况。文章详细说明了SHC的安装、使用方法及其生成的加密脚本的执行方式,同时也介绍了gzexe的加密和解密操作,帮助用户根据需求选择合适的加密方式。
Shell脚本
安全
加密工具
Gemma 4 12B 深度实战:当 Google 把「无编码器多模态」塞进 16GB 笔记本——从统一架构原理到生产级本地 Agent 的完全指南(2026)
编程
Gemma 4 12B 深度实战:当 Google 把「无编码器多模态」塞进 16GB 笔记本——从统一架构原理到生产级本地 Agent 的完全指南(2026)
2026-06-14 04:46:45 +0800 CST
view 414
深度解析 Google DeepMind Gemma 4 12B 的无编码器统一多模态架构,从原理到代码实战,涵盖 llama.cpp 部署、量化策略、Agent 工作流和生产级架构设计(2026)。
Gemma 4
Google DeepMind
多模态
本地部署
Agent
llama.cpp
开源大模型
Headroom 深度实战:当 AI Agent 学会「上下文节食」——从 Token 经济学到生产级压缩架构的完全指南(2026)
编程
Headroom 深度实战:当 AI Agent 学会「上下文节食」——从 Token 经济学到生产级压缩架构的完全指南(2026)
2026-06-14 05:18:40 +0800 CST
view 357
Headroom深度实战:从Token经济学到生产级压缩架构,详解6种压缩算法、CCR可逆机制、四种集成模式,附完整代码示例和生产落地指南。
Headroom
LLM
Token压缩
AI Agent
上下文优化
Python
Rust
用AI做失败复盘:一张提示词,让核心问题自动浮现
资讯
用AI做失败复盘:一张提示词,让核心问题自动浮现
2026-04-23 21:28:06 +0800 CST
view 547
本文探讨了失败复盘的正确方法,指出常见复盘误区(归咎外部、情绪化分析),并介绍了一套AI提示词,通过六步结构化流程(接收结果、澄清边界、确认动机、提取核心事实、单线深入、点出核心)引导用户从模糊感受转向具体事实,找到真正导致失败的行为断裂点。提示词设计为中立复盘引导者,不猜测心理,只基于事实链分析。实测在DeepSeek上效果理想,强调信息越具体分析越精准。
提示词工程
AI工具
复盘方法论
DeepSeek
LLM应用
自我提升
结构化思维
GraphQL Federation 3.0 深度实战:当API聚合遇见超级图革命,从架构原理到生产级网关部署完全指南
编程
GraphQL Federation 3.0 深度实战:当API聚合遇见超级图革命,从架构原理到生产级网关部署完全指南
2026-07-02 15:52:36 +0800 CST
view 188
深度解析 GraphQL Federation 3.0 的架构原理、超级图设计模式、生产级部署与性能优化,含完整代码实战
GraphQL
Federation
API网关
微服务
Apollo
后端架构
ReAct 框架深度解析:AI Agent 的「思考-行动-观察」循环,从字符串解析到原生 Tool Calling 的演进
编程
ReAct 框架深度解析:AI Agent 的「思考-行动-观察」循环,从字符串解析到原生 Tool Calling 的演进
2026-05-14 01:14:23 +0800 CST
view 586
ReAct框架是AI Agent的核心架构范式,通过Thought-Action-Observation循环实现智能推理与行动。本文深度解析其从字符串解析到原生Tool Calling的演进历程、LangGraph状态机架构、代码实战及最佳实践。
ReAct,AI Agent,TAO循环,Function Calling,LangGraph,大语言模型,深度学习,Python,机器学习,智能体
Qwen3.6-27B开源:270亿稠密模型如何用单卡性能打穿3970亿MoE旗舰——从架构革命到本地编程助手实战
编程
Qwen3.6-27B开源:270亿稠密模型如何用单卡性能打穿3970亿MoE旗舰——从架构革命到本地编程助手实战
2026-07-08 00:47:14 +0800 CST
view 479
深度解析阿里开源Qwen3.6-27B:270亿参数稠密模型全面超越3970亿MoE旗舰的技术原理、混合注意力架构、编程基准实测、本地部署实战与Claude Code协同工作流。
Qwen3.6
开源大模型
AI编程
本地部署
vLLM
SGLang
Flowise 深度实战:当 LangChain 遇上低代码——从架构原理到生产级 AI 工作流完全指南(2026)
编程
Flowise 深度实战:当 LangChain 遇上低代码——从架构原理到生产级 AI 工作流完全指南(2026)
2026-06-05 20:08:17 +0800 CST
view 348
Flowise 是一个开源的、可视化的低代码工具,专门用来构建基于大语言模型的应用程序或智能体(AI Agent)。本文深入剖析 Flowise 的架构设计、核心组件、实战案例,并提供生产级部署的最佳实践。
Flowise
LangChain
低代码
AI Agent
LLM
Vera 深度拆解:当编程语言为 AI 原生化而生——一个专为 LLM 打造的零幻觉代码生成范式
编程
Vera 深度拆解:当编程语言为 AI 原生化而生——一个专为 LLM 打造的零幻觉代码生成范式
2026-07-14 15:17:06 +0800 CST
view 131
深度拆解 Vera:专为 LLM 设计的编程语言,用 De Bruijn 索引消除命名歧义,Z3 SMT 强制契约验证,纯函数优先,编译为 WebAssembly,从根本上解决 LLM 编程的可信度问题。
Vera
编程语言
LLM
WebAssembly
Z3
契约验证
De Bruijn
代数效应
AI编程
零幻觉
TinyGo 深度拆解:用 Go 写嵌入式和 WebAssembly,LLVM 后端是怎么做到的
编程
TinyGo 深度拆解:用 Go 写嵌入式和 WebAssembly,LLVM 后端是怎么做到的
2026-07-21 08:08:11 +0800 CST
view 57
TinyGo(15K Star)用LLVM后端将Go代码编译到Arduino/ESP32/STM32/RISC-V/WebAssembly,二进制小到几KB。goroutine/channel在嵌入式运行(编译时栈分配)、machine包统一硬件抽象层、死代码消除压缩Wasm到几十KB,是Go官方编译器的补充。
TinyGo
Go
嵌入式
WebAssembly
LLVM
Arduino
ESP32
goroutine
微控制器
编译器
开源
XY-Serve 深度实战:当昇腾 NPU 终于学会「驯服动态负载」——从元原语分解、Token级调度到 Attention/Linear 双内核优化的完整工程指南(2026)
编程
XY-Serve 深度实战:当昇腾 NPU 终于学会「驯服动态负载」——从元原语分解、Token级调度到 Attention/Linear 双内核优化的完整工程指南(2026)
2026-07-21 08:20:26 +0800 CST
view 48
华为联合清华大学开源的 XY-Serve 论文被 ASPLOS 2026 录用,解决了 NPU 上高效运行动态 LLM 负载的核心挑战。吞吐量提升95%,Attention 内核提速21.5%,Linear 内核提速14.6%。
XY-Serve
华为昇腾
NPU
LLM推理
Meta-Attention
虚拟填充
动态负载
ASPLOS
AI基础设施
FlashPrefill 深度解析:当瞬时注意力遇上 GPU 原语——从 O(N²) 困境到 27 倍速的工程革命
编程
FlashPrefill 深度解析:当瞬时注意力遇上 GPU 原语——从 O(N²) 困境到 27 倍速的工程革命
2026-04-15 17:20:25 +0800 CST
view 659
深度解析中科院与腾讯微信联合研发的 FlashPrefill 如何通过即时注意力模式发现和动态阈值筛选,将 25.6 万字符长文本处理速度提升 27.78 倍,同时保持近乎完美的精度。
LLM推理优化
FlashAttention
GPU计算
长文本处理
注意力机制
Transformer
深度学习
Headroom 深度实战:当 AI Agent 学会压缩上下文——从 Token 暴降 60-95% 到生产级工程落地的完全指南(2026)
编程
Headroom 深度实战:当 AI Agent 学会压缩上下文——从 Token 暴降 60-95% 到生产级工程落地的完全指南(2026)
2026-06-19 10:57:59 +0800 CST
view 545
深度拆解 Headroom 上下文压缩中间层架构设计与生产级落地
Headroom
AI Agent
上下文压缩
Token优化
LLM
MoneyPrinterTurbo 深度拆解:一个关键词如何端到端跑出一条高清短视频——AI 视频生成流水线的工程内幕
编程
MoneyPrinterTurbo 深度拆解:一个关键词如何端到端跑出一条高清短视频——AI 视频生成流水线的工程内幕
2026-07-14 19:41:50 +0800 CST
view 155
从 LLM 脚本、Pexels 素材检索、Edge TTS 配音、字幕生成到 FFmpeg 合成,深度拆解 MoneyPrinterTurbo 的端到端 AI 视频生成流水线架构,并附可运行核心代码与规模化性能优化。
MoneyPrinterTurbo
AI视频生成
短视频自动化
FFmpeg
LLM
TTS
Python
内容创作
Llama 4 MoE 架构深度解析:从混合专家到万亿参数的技术革命
编程
Llama 4 MoE 架构深度解析:从混合专家到万亿参数的技术革命
2026-05-28 16:37:41 +0800 CST
view 315
深入解析 Meta Llama 4 的 MoE 混合专家架构原理,探讨其如何以 17B 激活参数撬动万亿级算力,并提供完整的本地部署实战指南。
Llama4
MoE
混合专家
开源大模型
本地部署
Meta
人工智能
深度学习
The AI Scientist v2 深度实战:当 AI 开始独立做科研并发表论文——从 Agentic Tree Search 到 ICLR 研讨会录用的完全指南(2026)
编程
The AI Scientist v2 深度实战:当 AI 开始独立做科研并发表论文——从 Agentic Tree Search 到 ICLR 研讨会录用的完全指南(2026)
2026-06-27 06:46:04 +0800 CST
view 253
2026年Sakana AI开发的The AI Scientist v2生成了首篇通过ICLR同行评审的AI论文。本文深度解析其Agentic Tree Search架构、六大核心Agent、代码实战、生产部署与ICLR论文完整生成过程。
AI Scientist v2
Sakana AI
自动化科研
Agentic Tree Search
ICLR
Bun 2026 深度解析:重构 JavaScript 工具链的野心——性能、体验、生态三维发力,建立全新范式
编程
Bun 2026 深度解析:重构 JavaScript 工具链的野心——性能、体验、生态三维发力,建立全新范式
2026-05-14 04:14:38 +0800 CST
view 608
Bun 2026深度解析:v1.3.6-v1.3.9密集迭代重构JavaScript工具链,Bun.password密码哈希内置、Bun.sqlite SQLite集成内置、Bun.shell跨平台Shell脚本、性能比Node.js 22快4倍,生态三维发力建立全新范式。
Bun2026,JavaScript工具链,性能优化,生态重构,Bun.password,Bun.sqlite,Bun.shell
DFlash 深度实战:当扩散模型遇上推测解码——从原理到生产级 LLM 推理加速完全指南(2026)
编程
DFlash 深度实战:当扩散模型遇上推测解码——从原理到生产级 LLM 推理加速完全指南(2026)
2026-06-06 01:38:49 +0800 CST
view 575
DFlash(Block Diffusion for Flash Speculative Decoding)是ZLab于2026年提出的LLM推理加速框架,用块扩散模型替代传统自回归草稿模型,实现6倍以上无损加速。
LLM推理加速
推测解码
扩散模型
块扩散
DFlash
ZLab
大模型优化
ClickHouse 深度实战:把 PB 级实时分析塞进一台服务器——从 MergeTree 存储引擎、稀疏索引到物化视图流的完整指南(2026)
编程
ClickHouse 深度实战:把 PB 级实时分析塞进一台服务器——从 MergeTree 存储引擎、稀疏索引到物化视图流的完整指南(2026)
2026-07-08 05:41:58 +0800 CST
view 168
从 MergeTree 存储引擎、稀疏索引数学、物化视图流式语义到生产级写入、异步删除与性能调优,系统讲透 ClickHouse 如何把 PB 级实时分析塞进一台服务器。
ClickHouse
OLAP
MergeTree
物化视图
性能优化
VibeVoice 深度解析:微软如何用连续语音Tokenizer和Next-Token Diffusion重塑语音AI边界
编程
VibeVoice 深度解析:微软如何用连续语音Tokenizer和Next-Token Diffusion重塑语音AI边界
2026-04-15 22:19:22 +0800 CST
view 692
深度解析微软VibeVoice开源语音AI全家桶:7.5Hz连续Tokenizer如何压缩60分钟音频,Next-Token Diffusion如何驱动90分钟对话合成,附完整代码实战与性能对比。
VibeVoice
微软
语音AI
ASR
TTS
Diffusion
LLM
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
43
44
45
46
47
...
67
下一页