程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
OpenDuck 深度拆解:把 MotherDuck 开源化——DuckDB「差分存储 + 混合执行」云边协同架构与自托管实战
编程
OpenDuck 深度拆解:把 MotherDuck 开源化——DuckDB「差分存储 + 混合执行」云边协同架构与自托管实战
2026-07-31 05:44:28 +0800 CST
view 128
深度拆解开源项目 OpenDuck:把 MotherDuck 验证过的差分存储、混合执行、ATTACH 原生体验拆成可自托管开源形态。含 catalog 级集成原理、四大构件源码边界、plan splitting 与 bridge operator 数据流、完整 PoC 实战、自定义后端协议实现与生产化清单。
OpenDuck
DuckDB
MotherDuck
差分存储
混合执行
数据库
云原生
开源
Arrow
数据分析
Mozilla Thunderbolt 深度解析:Haystack + ACP/MCP 驱动的「主权 AI 客户端」架构设计与工程实战
编程
Mozilla Thunderbolt 深度解析:Haystack + ACP/MCP 驱动的「主权 AI 客户端」架构设计与工程实战
2026-04-22 16:02:39 +0800 CST
view 791
Mozilla发布开源AI客户端Thunderbolt,基于Haystack框架,支持ACP/MCP双协议,主打自托管、数据主权与隐私保护。深度解析其架构设计与Docker部署实战。
Mozilla
Thunderbolt
Haystack
ACP
MCP
AI客户端
RAG
开源
Mozilla Thunderbolt 深度解析:Haystack + ACP/MCP 驱动的「主权 AI 客户端」架构设计与工程实践
编程
Mozilla Thunderbolt 深度解析:Haystack + ACP/MCP 驱动的「主权 AI 客户端」架构设计与工程实践
2026-04-22 16:03:28 +0800 CST
view 846
Mozilla发布开源AI客户端Thunderbolt,基于Haystack框架,支持ACP/MCP双协议,主打自托管、数据主权与隐私保护。深度解析其架构设计与Docker部署实战。
Mozilla
Thunderbolt
Haystack
ACP
MCP
AI客户端
RAG
开源
LLaDA2.2 深度拆解:全球首个大规模 Agentic 扩散模型——Levenshtein 编辑 + L-EBPO 如何打破自回归垄断
编程
LLaDA2.2 深度拆解:全球首个大规模 Agentic 扩散模型——Levenshtein 编辑 + L-EBPO 如何打破自回归垄断
2026-07-31 10:46:00 +0800 CST
view 138
全球首个大规模 Agentic 扩散模型深度拆解,详解 Levenshtein 编辑范式、L-EBPO 强化学习算法与 BlockRouting 128K 长上下文工程实践,对比自回归模型 Agent 能力评测。
扩散语言模型
Agentic AI
Levenshtein编辑
L-EBPO
蚂蚁集团
MoE架构
128K上下文
开源模型
AI Agent
强化学习
万字深度解析 DeepSeek V4:当 1.6T 开源模型遇见「架构效率革命」——从 mHC 稳压机制到 CSA/HCA 稀疏注意力、从 FP4 量化到 Muon 优化器的完整技术指南(2026)
编程
万字深度解析 DeepSeek V4:当 1.6T 开源模型遇见「架构效率革命」——从 mHC 稳压机制到 CSA/HCA 稀疏注意力、从 FP4 量化到 Muon 优化器的完整技术指南(2026)
2026-07-02 06:43:56 +0800 CST
view 340
DeepSeek V4 技术架构深度解析:从 mHC 流形约束超连接、CSA/HCA 混合稀疏注意力、FP4 量化感知训练到 Muon 优化器,完整拆解 1.6T 开源模型如何用架构创新把 1M token 推理效率提升到 V3.2 的 10%。
DeepSeek V4
大模型架构
MoE
CSA/HCA 注意力
FP4 量化
mHC
AI 开源
长上下文
腾讯混元 Hy3 正式版深度解析:快慢思考融合的 MoE 架构与开发者实战指南
编程
腾讯混元 Hy3 正式版深度解析:快慢思考融合的 MoE 架构与开发者实战指南
2026-07-07 14:15:18 +0800 CST
view 588
深度解析腾讯混元 Hy3 正式版的技术架构,涵盖 MoE 混合专家、快慢思考融合机制、256K 上下文、Agent 能力等核心特性,并提供 API 调用与 SDK 集成的完整实战指南。
MoE架构
快慢思考
腾讯混元
Hy3
AI大模型
混合专家
Agent
开发者工具
万字深度解析百度 Unlimited-OCR:当端到端OCR遇见R-SWA革命,从逐页失忆到40页文档一口气解析(2026)
编程
万字深度解析百度 Unlimited-OCR:当端到端OCR遇见R-SWA革命,从逐页失忆到40页文档一口气解析(2026)
2026-07-02 10:46:07 +0800 CST
view 298
深度解析百度2026年开源的Unlimited-OCR模型:3B参数的端到端OCR系统,R-SWA机制实现常数级KV缓存,OmniDocBench 93.92% SOTA评分,可一口气解析40页文档
Unlimited-OCR
百度
OCR
R-SWA
MoE
CLIP
端到端
长文档处理
深度学习
多模态
DwarfStar 4 深度实战:当 Redis 之父手写 AI 推理引擎——从 284B MoE 模型塞进 MacBook 到生产级本地 Agent 的完全指南(2026)
编程
DwarfStar 4 深度实战:当 Redis 之父手写 AI 推理引擎——从 284B MoE 模型塞进 MacBook 到生产级本地 Agent 的完全指南(2026)
2026-06-13 20:17:57 +0800 CST
view 766
Redis之父antirez新作DwarfStar 4深度解析:专为DeepSeek V4 Flash打造的本地推理引擎,非对称2-bit量化、磁盘KV缓存、Metal图执行、分布式推理、方向引导,MacBook上284B模型跑出26 tok/s的完全指南
ds4
DwarfStar
DeepSeek
本地推理
Metal
MoE
量化
KV缓存
R-SWA如何让OCR「过目不忘」:百度Unlimited-OCR的KV缓存革命与40页长文档解析实战(2026)
编程
R-SWA如何让OCR「过目不忘」:百度Unlimited-OCR的KV缓存革命与40页长文档解析实战(2026)
2026-07-02 10:47:12 +0800 CST
view 397
深度解析百度2026年开源的Unlimited-OCR模型:3B参数的端到端OCR系统,R-SWA机制实现常数级KV缓存,OmniDocBench 93.92% SOTA评分,可一口气解析40页文档
Unlimited-OCR
百度
OCR
R-SWA
MoE
CLIP
端到端
长文档处理
深度学习
多模态
GitHub Copilot 接入 Kimi K2.7 Code 深度解读:开源模型的登堂入座与 AI 编程格局重塑
编程
GitHub Copilot 接入 Kimi K2.7 Code 深度解读:开源模型的登堂入座与 AI 编程格局重塑
2026-07-07 20:12:44 +0800 CST
view 297
2026年7月,GitHub Copilot 首次接入开源模型 Kimi K2.7 Code。本文从技术原理、模型架构、性能实测、开发者体验、格局影响等多维度,深度解析这一里程碑事件的真实含义。
GitHub Copilot
Kimi K2.7
AI编程
开源模型
编程助手
Moonshot AI
月之暗面
AI Agent
Qwen3.8 深度实战:2.4T MoE 巨兽来了——从 Preview API 接入、函数调用到本地部署与微调的完整工程指南(2026)
编程
Qwen3.8 深度实战:2.4T MoE 巨兽来了——从 Preview API 接入、函数调用到本地部署与微调的完整工程指南(2026)
2026-07-21 01:43:04 +0800 CST
view 362
2026年Qwen3.8深度实战:2.4T MoE架构原理、Preview API接入、流式调用、函数调用、RAG检索增强、vLLM/SGLang本地部署与QLoRA微调的完整工程指南
Qwen3.8
MoE
大模型部署
函数调用
QLoRA
vLLM
通义千问
2026
Claude Fable 5深度解析:Anthropic"神话级"模型的编程能力实测与技术架构
编程
Claude Fable 5深度解析:Anthropic"神话级"模型的编程能力实测与技术架构
2026-07-07 21:13:57 +0800 CST
view 428
Claude Fable 5是Anthropic史上第一个面向公众的Mythos级模型,在SWE-bench Verified上创下95%的最高分记录。本文深度解析其自适应思考机制、百万Token上下文、128K输出等技术架构,以及与Opus 4.8的选型对比和开发者选型指南。
Claude Fable 5
Anthropic
AI编程
模型评测
SWE-bench
MoE
HarmonyOS 6 深度实战:ArkTS + ArkUI + AI 原生——从架构原理到生产级应用开发完全指南(2026)
编程
HarmonyOS 6 深度实战:ArkTS + ArkUI + AI 原生——从架构原理到生产级应用开发完全指南(2026)
2026-06-05 15:07:15 +0800 CST
view 954
从ArkTS语言设计到ArkUI声明式框架,从Aspect AOP到系统级AI集成,全面解析HarmonyOS 6的生产级应用开发
HarmonyOS
ArkTS
ArkUI
鸿蒙开发
AI原生
方舟编译器
微软Build 2026震撼发布:7款MAI自研模型全解析——从"OpenAI金主"到"模型自研商"的战略革命
编程
微软Build 2026震撼发布:7款MAI自研模型全解析——从"OpenAI金主"到"模型自研商"的战略革命
2026-06-26 19:44:06 +0800 CST
view 621
深度解析微软在Build 2026发布的7款MAI自研模型:从MAI-Thinking-1的MoE架构创新到MAI-Orion的性能怪兽,从"不蒸馏"训练哲学到成本直降10倍的商业逻辑,万字长文带你读懂微软AI战略的惊险跳跃。
MAI
微软
Build2026
MoE
自研模型
AI战略
Azure
推理模型
DeepSeek V4 技术架构深度解析:从万亿参数 MoE 到百万 token 上下文的工程实践(2026)
编程
DeepSeek V4 技术架构深度解析:从万亿参数 MoE 到百万 token 上下文的工程实践(2026)
2026-07-07 23:16:31 +0800 CST
view 320
深入解析 DeepSeek V4 的四大核心技术:MoE 分层专家路由、CSA/HCA/mHC 三层混合注意力、Engram 记忆架构、国产算力适配方案
MoE架构
百万上下文
Engram记忆
国产AI
深度求索
大模型
DSA
CSA
推理优化
AirLLM深度拆解:用分层流式推理打破显存壁垒——从4GB显卡跑通70B大模型的工程极限到MoE时代的新坐标
编程
AirLLM深度拆解:用分层流式推理打破显存壁垒——从4GB显卡跑通70B大模型的工程极限到MoE时代的新坐标
2026-08-09 08:42:54 +0800 CST
view 102
深度拆解AirLLM:用分层流式推理打破显存壁垒,从4GB显卡跑通70B大模型的工程原理到MoE时代的新坐标,配完整代码示例与实战指南。
AirLLM
LLM推理
显存优化
MoE
Transformer
Python
AI部署
腾讯混元 Hy3 preview 开源:295B 参数、推理提效 40%,姚顺雨首秀交卷
资讯
腾讯混元 Hy3 preview 开源:295B 参数、推理提效 40%,姚顺雨首秀交卷
2026-04-23 21:18:45 +0800 CST
view 951
2026年4月23日,腾讯发布并开源新一代大模型混元Hy3preview,总参数295B、激活参数21B的MoE架构,支持256K超长上下文,推理效率提升40%,API最低1.2元/百万tokens。在复杂推理、代码与Agent能力上表现突出,接近GPT-5.4级别,数学推理创国内最高纪录。已接入腾讯云、元宝等多条产品线,并上架TokenHub。
人工智能
大模型
腾讯
开源
MoE
推理
代码生成
Agent
云计算
OpenMontage 深度实战:全球首个开源 AI Agent 视频制作系统
编程
OpenMontage 深度实战:全球首个开源 AI Agent 视频制作系统
2026-06-27 01:14:57 +0800 CST
view 799
2026年6月GitHub Trending榜首项目OpenMontage深度解析:全球首个开源AI Agent视频制作系统,12条管线、52个工具、500+技能。
OpenMontage
AI Agent
视频制作
开源
Agentic
GitHub Trending
百度 Unlimited OCR 深度实战:告别「越生成越慢」,一次性解析整本书的 OCR 革命
编程
百度 Unlimited OCR 深度实战:告别「越生成越慢」,一次性解析整本书的 OCR 革命
2026-06-27 02:13:37 +0800 CST
view 557
深度解析百度2026年6月开源的Unlimited OCR模型,介绍其R-SWA机制如何解决长文档OCR的KV cache线性增长问题,包含完整实战代码和性能优化技巧。
Unlimited OCR
百度
OCR
深度学习
MoE
R-SWA
长文档解析
DeepSeek V4 深度技术解析:从 MoE 架构到百万上下文的生产级实战指南
编程
DeepSeek V4 深度技术解析:从 MoE 架构到百万上下文的生产级实战指南
2026-07-08 01:51:46 +0800 CST
view 347
深度解析DeepSeek V4的MoE架构、DSA稀疏注意力、百万Token上下文、国产算力适配等核心技术,配完整API接入代码与成本优化指南
DeepSeek-V4
MoE架构
DSA稀疏注意力
大模型
AI编程
开源模型
百万上下文
华为昇腾
万字深度解析百度 Unlimited OCR:当长文档解析遇见 R-SWA 革命——从常数级 KV Cache 到 40 页一次性识别的完整技术指南(2026)
编程
万字深度解析百度 Unlimited OCR:当长文档解析遇见 R-SWA 革命——从常数级 KV Cache 到 40 页一次性识别的完整技术指南(2026)
2026-07-02 18:16:20 +0800 CST
view 598
深度解析百度 Unlimited OCR 的 R-SWA 参考滑动窗口注意力机制,将 KV Cache 从线性增长压至常数级;3B MoE 解码器架构、DeepEncoder 视觉编码器;完整本地部署代码、KV Cache 监控脚本与 SGLang 生产推理优化指南。OmniDocBench v1.6 综合得分 93.92%,端到端 OCR 新 SOTA。
OCR
R-SWA
KV Cache
MoE
百度
长文档解析
Transformer
深度学习
Python
性能优化
AI 原生前端开发 2026 深度解析:LLM-as-Compiler、编译时语义理解、声明式 UI 合成——前端开发的范式革命
编程
AI 原生前端开发 2026 深度解析:LLM-as-Compiler、编译时语义理解、声明式 UI 合成——前端开发的范式革命
2026-05-14 03:40:08 +0800 CST
view 692
2026年奇点智能技术大会正式提出AI原生前端开发范式,LLM不再只是辅助工具而是编译过程的一部分。深度解析LLM-as-Compiler、编译时语义理解、声明式UI合成及Vite5.4+插件调用本地MoE模型的技术实现。
AI原生前端,LLM-as-Compiler,编译时语义理解,声明式UI合成,Vite5.4,MoE模型
GLM-5.2 深度实战:国产开源模型首次在编程能力上超越GPT-5.5——从架构原理到生产部署的完整指南
编程
GLM-5.2 深度实战:国产开源模型首次在编程能力上超越GPT-5.5——从架构原理到生产部署的完整指南
2026-06-27 05:43:51 +0800 CST
view 1131
2026年6月智谱AI发布GLM-5.2,登顶开源权重模型榜首,在SWE-bench Pro编程基准上超越GPT-5.5。本文深度解析GLM-5.2的MoE架构、IndexShare长上下文技术、编程实战代码、性能优化和生产部署。
GLM-5.2
智谱AI
开源模型
编程能力
AI模型
MoE架构
长上下文
Llama 4 MoE 架构深度解析:从混合专家到万亿参数的技术革命
编程
Llama 4 MoE 架构深度解析:从混合专家到万亿参数的技术革命
2026-05-28 16:37:41 +0800 CST
view 419
深入解析 Meta Llama 4 的 MoE 混合专家架构原理,探讨其如何以 17B 激活参数撬动万亿级算力,并提供完整的本地部署实战指南。
Llama4
MoE
混合专家
开源大模型
本地部署
Meta
人工智能
深度学习
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
20
21
22
23
24
...
74
下一页