程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
BitNet 1.58-bit:微软如何用三个值就让大模型在 CPU 上飞奔
编程
BitNet 1.58-bit:微软如何用三个值就让大模型在 CPU 上飞奔
2026-05-11 13:55:11 +0800 CST
view 709
微软开源BitNet 1.58-bit大模型推理框架,2B参数模型仅需0.4GB内存、29ms/token推理速度。核心创新:训练时量化、-1/0/+1三值权重、位运算加速,精度损失<5%却比INT4表现更好。纯CPU运行,71%能耗降低。
BitNet,1.58bit,微软,大模型量化,1bit LLM,CPU推理,bitnet.cpp,训练时量化,位运算加速,模型压缩
编程
MarkItDown 深度实战:当微软用Python重写文档预处理——从转换器链到LLM集成的生产级完全指南(2026)
2026-06-12 13:48:19 +0800 CST
view 608
深度剖析微软开源的MarkItDown工具,详解其转换器链架构、插件系统、LLM集成和大规模文档处理性能优化,提供15个完整代码示例和生产级部署方案。
MarkItDown
文档预处理
LLM
RAG
Python
微软
CLEAR 深度实战:当浙大+腾讯+北大联手破解AI推理「算力浪费」难题——从理性放弃机制到生产级LLM推理优化完全指南(2026)
编程
CLEAR 深度实战:当浙大+腾讯+北大联手破解AI推理「算力浪费」难题——从理性放弃机制到生产级LLM推理优化完全指南(2026)
2026-06-12 14:20:52 +0800 CST
view 605
深度解析 ICML 2026 接收的 CLEAR 推理优化方法。浙江大学、腾讯、北京大学联合提出:对没有希望的问题理性放弃,把算力集中到能解决的问题上。包含完整 Python 实现、vLLM/SGLang 集成、生产级部署指南。
LLM
推理优化
ICML 2026
CLEAR
算力分配
百度Unlimited-OCR深度解析:R-SWA常量KV缓存如何让OCR一口气吃下几十页文档——从单图解析到多页PDF的完整实战指南
编程
百度Unlimited-OCR深度解析:R-SWA常量KV缓存如何让OCR一口气吃下几十页文档——从单图解析到多页PDF的完整实战指南
2026-07-06 11:16:05 +0800 CST
view 403
深度解析百度开源Unlimited-OCR:13K+ Stars,R-SWA常量KV缓存让端到端OCR模型在32K上下文下一次性转录几十页文档。从架构设计到vLLM/SGLang生产部署完整实战指南。
Unlimited-OCR
百度
R-SWA
OCR
KV缓存
文档解析
长文档
vLLM
omlx:Mac 本地 LLM 推理的终极方案——从菜单栏管理到 SSD 缓存的完整工程实践
编程
omlx:Mac 本地 LLM 推理的终极方案——从菜单栏管理到 SSD 缓存的完整工程实践
2026-07-24 17:17:27 +0800 CST
view 257
深度解析 omlx:专为 Mac 优化的本地 LLM 推理服务器,通过连续批处理、分层 KV Cache、SSD 缓存和菜单栏管理,实现便捷与控制兼得的推理体验。涵盖技术架构、性能调优、RAG 实战和最佳实践。
LLM
Mac
Apple Silicon
推理优化
本地部署
omlx
MarkItDown 深度解析:微软10万星开源工具如何重塑 LLM 时代的文档处理范式
编程
MarkItDown 深度解析:微软10万星开源工具如何重塑 LLM 时代的文档处理范式
2026-04-21 05:47:35 +0800 CST
view 792
深度解析微软开源工具MarkItDown:如何将PDF、Word、Excel等20+格式转换为结构化Markdown,为LLM和RAG场景提供高质量的文档预处理方案。涵盖架构设计、实战代码、性能优化与生产部署最佳实践。
MarkItDown
文档转换
LLM
RAG
Python
开源工具
微软
Headroom 深度实战:当 AI Agent 的 Token 账单被压缩 90%——从六大压缩算法到 CCR 可逆存储、跨 Agent 记忆与 KV Cache 命中率优化的生产级完全指南(2026)
编程
Headroom 深度实战:当 AI Agent 的 Token 账单被压缩 90%——从六大压缩算法到 CCR 可逆存储、跨 Agent 记忆与 KV Cache 命中率优化的生产级完全指南(2026)
2026-06-17 15:22:23 +0800 CST
view 841
Headroom 是开源上下文压缩中间层,六大算法覆盖 JSON/代码/文本/图片,CCR 可逆存储,跨 Agent 记忆,实测节省 60-95% Token,精度保留 97%。
Headroom
AI Agent
Token优化
LLM
上下文压缩
Vera 编程语言深度解析:当一门语言从设计之初就为 LLM 而生
编程
Vera 编程语言深度解析:当一门语言从设计之初就为 LLM 而生
2026-06-17 16:27:35 +0800 CST
view 394
深度解析 Vera 编程语言——一门从设计之初就专为 LLM 编写的编程语言,涵盖强制合约验证、结构引用、效果类型系统、WebAssembly 编译等核心技术。
编程语言
AI编程
LLM
形式化验证
WebAssembly
Z3
万字深度解析:Andrej Karpathy 的 Vibe Coding 与 CLAUDE.md——70行配置文件如何重新定义AI辅助编程(2026)
编程
万字深度解析:Andrej Karpathy 的 Vibe Coding 与 CLAUDE.md——70行配置文件如何重新定义AI辅助编程(2026)
2026-07-01 00:43:10 +0800 CST
view 242
Andrej Karpathy的CLAUDE.md(70行6万Star)和Vibe Coding理念深度解析,四大核心原则、完整实战、工具集成与避坑指南,约12000字
VibeCoding
ClaudeMD
AI辅助编程
Karpathy
软件工程
LLM
代码生成
最佳实践
MarkItDown 深度解析:微软 137K+ Stars 的万能文档转 Markdown 引擎——从插件架构到 RAG 生产流水线的完整实战指南
编程
MarkItDown 深度解析:微软 137K+ Stars 的万能文档转 Markdown 引擎——从插件架构到 RAG 生产流水线的完整实战指南
2026-07-06 13:44:29 +0800 CST
view 290
深度解析微软AutoGen团队开源的MarkItDown文档转Markdown工具:137K+ Stars,支持20+种格式(PDF/Word/PPT/Excel/图片/音频/YouTube),插件架构、LLM图像描述、Azure Content Understanding结构化字段提取、RAG生产流水线实战。含完整代码示例与性能优化方案。
MarkItDown
微软
文档转换
Markdown
LLM
RAG
Python
开源
Skills 生态深度拆解:当 AI Agent 决定「用 Markdown 替代 JSON-RPC」——从 Karpathy 的防坑指南到万星 Skills 仓库,一个被 10 万+ 开发者采用的新范式如何重新定义 Agent 工程化的终极形态
编程
Skills 生态深度拆解:当 AI Agent 决定「用 Markdown 替代 JSON-RPC」——从 Karpathy 的防坑指南到万星 Skills 仓库,一个被 10 万+ 开发者采用的新范式如何重新定义 Agent 工程化的终极形态
2026-08-05 16:17:58 +0800 CST
view 226
深度拆解2026年AI Agent开发新范式Skills生态:Karpathy行为约束型Skills、Pocock工作流型Skills、SKILL.md架构设计、MCP vs Skills vs CLI三大范式对比,附完整生产级Skills构建实战与Token预算管理指南
Skills
AI Agent
MCP
Karpathy
Claude Code
LLM
Agent工程化
SKILL.md
提示工程
开源
ZTools 深度解析:uTools 终于有靠谱开源平替了,Electron 38 + LMDB + 插件热重载
编程
ZTools 深度解析:uTools 终于有靠谱开源平替了,Electron 38 + LMDB + 插件热重载
2026-05-17 12:50:14 +0800 CST
view 930
uTools 开源平替 ZTools 深度解析:Electron 38.5 + LMDB + WebContentsView 架构,插件热重载、超级面板、MCP Server、AI 集成,MIT 协议免费开源。
ZTools
uTools
Electron
桌面效率
开源
LMDB
插件
µP 深度拆解:当调参侠终于破解 scaling 诅咒——从最大更新参数化到万亿参数大模型超参迁移的工程全貌(2026)
编程
µP 深度拆解:当调参侠终于破解 scaling 诅咒——从最大更新参数化到万亿参数大模型超参迁移的工程全貌(2026)
2026-07-19 08:43:41 +0800 CST
view 241
深度拆解微软/ OpenAI 的 µP(最大更新参数化)理论:从 Tensor Programs 数学框架、为什么标准参数化失效、到 PyTorch mup 库完整实战代码,含 Transformer 层、AdamW 配置、跨尺度超参数迁移验证与生产级 Pipeline。
µP
Max Update Parametrization
超参数迁移
Tensor Programs
深度学习
Transformer
LLM训练
AdamW
mup
微软
Agent TARS 深度解析:字节跳动开源的「视觉-行动」双引擎 GUI Agent——从 UI-TARS 模型架构到计算机控制的完整技术内幕
编程
Agent TARS 深度解析:字节跳动开源的「视觉-行动」双引擎 GUI Agent——从 UI-TARS 模型架构到计算机控制的完整技术内幕
2026-05-17 14:14:17 +0800 CST
view 897
深入解析字节跳动开源的 Agent TARS / UI-TARS-Desktop 多模态 GUI Agent 技术栈,从底层视觉语言模型到三层感知-规划-执行 Pipeline,配详细代码示例和实战案例。
AI Agent
GUI自动化
字节跳动
多模态
UI-TARS
计算机视觉
VLM
MCP
Python
TradingAgents 深度实战:从 78.7k Star 的多智能体交易框架到量化投研工程化完全指南
编程
TradingAgents 深度实战:从 78.7k Star 的多智能体交易框架到量化投研工程化完全指南
2026-05-24 06:38:48 +0800 CST
view 1253
深度拆解 TradingAgents 多智能体交易框架的架构设计,从 LangGraph 状态图编排到结构化辩论机制,完整代码实战指南
AI Agent
量化交易
LangGraph
多智能体
LLM
colibrì 深度拆解:当1300行纯C在25GB笔记本上跑起744B大模型——纯C运行时、MoE稀疏激活与智谱GLM-5.2的工程奇迹(2026)
编程
colibrì 深度拆解:当1300行纯C在25GB笔记本上跑起744B大模型——纯C运行时、MoE稀疏激活与智谱GLM-5.2的工程奇迹(2026)
2026-07-19 09:14:11 +0800 CST
view 1044
纯C语言实现的大模型推理引擎,仅用1300行代码在25GB内存笔记本上运行744B参数的GLM-5.2 MoE模型,含完整代码示例与技术解析
C语言
GLM-5.2
MoE
大模型推理
量化
AVX2
MLA注意力
推测解码
Apple Silicon
万字深度解析 Microsoft VibeVoice:当开源遇上前沿语音AI——从 TTS 到 ASR 的全栈语音合成与识别技术革命(2026)
编程
万字深度解析 Microsoft VibeVoice:当开源遇上前沿语音AI——从 TTS 到 ASR 的全栈语音合成与识别技术革命(2026)
2026-07-01 04:12:36 +0800 CST
view 334
2026年Microsoft Research开源VibeVoice,支持90分钟TTS连续生成、60分钟ASR单次处理。深度解析Next-Token Diffusion架构、7.5Hz超低频Tokenizer、多说话人建模与vLLM推理加速。
VibeVoice
Microsoft
TTS
ASR
语音AI
开源
Next-Token Diffusion
LLM
Diffusion
React Compiler 迁移 Rust 深度拆解:当 Meta 决定「用 Rust 重写前端编译器」——从 TypeScript 到 Arena 分配,一个 3 倍性能提升的移植如何用 LLM 辅助重写重新定义前端工具链的终极形态
编程
React Compiler 迁移 Rust 深度拆解:当 Meta 决定「用 Rust 重写前端编译器」——从 TypeScript 到 Arena 分配,一个 3 倍性能提升的移植如何用 LLM 辅助重写重新定义前端工具链的终极形态
2026-08-05 20:14:26 +0800 CST
view 116
深度拆解Meta将React Compiler从TypeScript重写为Rust:Arena分配、索引数据结构、Turbopack零拷贝集成,3-10倍性能提升,LLM辅助重写的争议与反思
React Compiler
Rust
TypeScript
前端工具链
Meta
Turbopack
Babel
编译器
性能优化
LLM
AI Scientist-v2 深度解析:当人工智能学会「从零开始做科研」——Agentic Tree Search 如何改写科学发现的游戏规则
编程
AI Scientist-v2 深度解析:当人工智能学会「从零开始做科研」——Agentic Tree Search 如何改写科学发现的游戏规则
2026-04-12 15:55:06 +0800 CST
view 1017
AI Scientist-v2 由 Sakana AI 联合牛津大学等机构研发,于 2026 年正式发表于 Nature,首次实现端到端科研自动化。其核心创新 Agentic Tree Search 让 AI 在 ML 领域生成论文通过 ICLR Workshop 双盲评审,获 6.33 分高于 55% 人类投稿。本文全面解析其系统架构、核心算法与未来方向。
AI Scientist
Sakana AI
Agentic Tree Search
科研自动化
AI Agent
LLM
Nature
Understand Anything 深度实战:当知识图谱颠覆代码理解——从多智能体管道到可交互代码地图的完整指南(2026)
编程
Understand Anything 深度实战:当知识图谱颠覆代码理解——从多智能体管道到可交互代码地图的完整指南(2026)
2026-06-17 21:26:38 +0800 CST
view 605
Understand Anything 将任意代码库转化为交互式知识图谱,用多智能体管道解决代码理解难题。本文深度解析其架构设计与实战应用。
AI
LLM
代码分析
知识图谱
GitHub
Claude
多智能体
万字深度解析 Andrej Karpathy Skills:当 AI 编程遇见行为约束——从 CLAUDE.md 四原则到生产级 AI 编码工作流的工程化实践(2026)
编程
万字深度解析 Andrej Karpathy Skills:当 AI 编程遇见行为约束——从 CLAUDE.md 四原则到生产级 AI 编码工作流的工程化实践(2026)
2026-07-01 05:13:58 +0800 CST
view 334
2026年Andrej Karpathy Skills在GitHub狂揽11.7万Star。深度解析CLAUDE.md四核心原则:先思考再编码、简洁性优先、精准修改、目标驱动执行,以及生产级AI编程工作流工程化实践。
Andrej Karpathy Skills
CLAUDE.md
AI编程
Vibe Coding
LLM
行为约束
AI Agent
Cursor
Claude Opus 5 深度拆解:性能逼近 Fable 5、价格减半,一次重新定义「性价比旗舰」的行业地震
编程
Claude Opus 5 深度拆解:性能逼近 Fable 5、价格减半,一次重新定义「性价比旗舰」的行业地震
2026-07-30 13:46:00 +0800 CST
view 143
深度拆解 Anthropic Claude Opus 5:性能逼近旗舰 Fable 5,价格却只有一半。涵盖 ARC-AGI 3 三倍领先、IMO 42/42 满分、自我验证能力、多 Agent 协作(5.9x 加速)、安全架构重构与开发者迁移指南。
Claude Opus 5
Anthropic
AI大模型
LLM
评测对比
Frontier-Bench
ARC-AGI
多Agent协作
安全架构
开发者实战
TradingAgents 深度拆解:当 AI 决定「用多智能体模拟一整家华尔街交易公司」——从 LangGraph 图引擎到多空辩论机制,一个 31.9K Star 的开源框架如何用「七个角色吵出一个交易决策」重新定义金融 AI 的终极形态
编程
TradingAgents 深度拆解:当 AI 决定「用多智能体模拟一整家华尔街交易公司」——从 LangGraph 图引擎到多空辩论机制,一个 31.9K Star 的开源框架如何用「七个角色吵出一个交易决策」重新定义金融 AI 的终极形态
2026-08-05 20:46:07 +0800 CST
view 113
深度拆解TradingAgents多智能体金融交易框架:7个AI角色模拟华尔街交易公司、LangGraph图引擎编排、多空辩论机制、多数据源集成、68.5%准确率,附完整代码实战与生产部署指南
TradingAgents
Multi-Agent
LLM
金融交易
LangGraph
AI Agent
开源
量化交易
多智能体
Tauric Research
万字深度解析 AI-Scientist-v2:当AI成为首席研究员——自动化科学发现的范式革命与工程化实践(2026)
编程
万字深度解析 AI-Scientist-v2:当AI成为首席研究员——自动化科学发现的范式革命与工程化实践(2026)
2026-07-01 05:43:08 +0800 CST
view 294
深度解析SakanaAI的AI-Scientist-v2系统:首个通过顶级会议评审的AI生成论文系统,涵盖Agentic Tree Search算法、系统架构、代码实战与性能分析
AI-Scientist-v2
自动化科学发现
Agentic Tree Search
LLM Agent
SakanaAI
科学研究自动化
AI研究
开源项目
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
11
12
13
14
15
...
21
下一页