程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
LongCat-2.0 深度解析:美团万亿参数 MoE 大模型如何用国产算力 + LSA 稀疏注意力 + 零计算专家打造 Agentic Coding 王者——从架构原理到生产级实战的完整指南
编程
LongCat-2.0 深度解析:美团万亿参数 MoE 大模型如何用国产算力 + LSA 稀疏注意力 + 零计算专家打造 Agentic Coding 王者——从架构原理到生产级实战的完整指南
2026-07-07 00:13:46 +0800 CST
view 326
深度解析美团开源的LongCat-2.0万亿参数MoE大模型:50K国产卡全流程训练、LSA稀疏注意力实现1M超长上下文、零计算专家动态激活33B-56B、MOPD多专家融合、SWE-bench Pro 59.5超越GPT-5.5。从架构原理到生产级实战的完整指南。
LongCat-2.0
美团
MoE
万亿参数
国产算力
LSA稀疏注意力
Agentic Coding
开源大模型
插件化 Agent 框架新范式:DeepSeek Harness Cordis 架构深度拆解
编程
插件化 Agent 框架新范式:DeepSeek Harness Cordis 架构深度拆解
2026-08-14 16:18:17 +0800 CST
view 190
深度拆解 DeepSeek Harness 的 Cordis 插件架构,探讨"一切皆插件"如何重新定义 AI Agent 的执行层,对比 Claude Code、Cline 等竞品,附完整代码实战
DeepSeek Harness
Cordis
AI Agent
插件架构
Vibe Coding
AI Coding
大模型框架
TypeScript
Qwen3.8-Max 深度拆解:当阿里决定「用 2.4 万亿参数只激活 4%」——从稀疏 MoE 路由到混合注意力分层,一个 PaperBench 全球第一的旗舰模型如何用「极致稀疏化 + 自主进化」重新定义国产大模型的终极形态
编程
Qwen3.8-Max 深度拆解:当阿里决定「用 2.4 万亿参数只激活 4%」——从稀疏 MoE 路由到混合注意力分层,一个 PaperBench 全球第一的旗舰模型如何用「极致稀疏化 + 自主进化」重新定义国产大模型的终极形态
2026-08-06 06:42:51 +0800 CST
view 272
深度拆解阿里Qwen3.8-Max旗舰大模型:2.4T MoE架构、混合注意力分层、16天自主编程、125小时论文复现,PaperBench全球第一的技术内幕
Qwen3.8-Max
MoE
混合注意力
大模型
阿里千问
AI Agent
PaperBench
自主编程
2026年端侧AI千亿参数突破深度解析:从量化技术到NPU架构,手机如何跑赢云端大模型
编程
2026年端侧AI千亿参数突破深度解析:从量化技术到NPU架构,手机如何跑赢云端大模型
2026-04-22 03:52:11 +0800 CST
view 917
深度解析2026年端侧AI千亿参数突破的技术原理:从INT4量化到MoE架构,从存算一体NPU到动态内存优化,揭示手机如何跑赢云端大模型的核心工程密码。
AI
端侧AI
大模型
量化
NPU
万字深度解析百度 Unlimited OCR:当 R-SWA 注意力机制让端到端 OCR 一次性解析数十页文档——从架构设计到生产级部署完整指南(2026)
编程
万字深度解析百度 Unlimited OCR:当 R-SWA 注意力机制让端到端 OCR 一次性解析数十页文档——从架构设计到生产级部署完整指南(2026)
2026-07-01 15:43:34 +0800 CST
view 332
2026年6月百度开源Unlimited OCR深度解析:R-SWA参考滑动窗口注意力机制将KV Cache压为常数,3B参数(500M激活)在OmniDocBench以93.92%刷新SOTA,单次解析40+页文档。从架构设计到生产级部署完整技术指南。
Unlimited-OCR
R-SWA
百度
端到端OCR
大模型
MoE
DeepEncoder
性能优化
开源项目
Python
Anthropic 在 Claude 内部发现了"意识前厅":J空间如何重写 AI 可解释性与安全格局
编程
Anthropic 在 Claude 内部发现了"意识前厅":J空间如何重写 AI 可解释性与安全格局
2026-07-13 15:14:42 +0800 CST
view 237
2026年7月Anthropic重磅论文解读:Claude内部自发涌现的J空间(雅可比空间)与人类全局工作空间高度相似,从神经科学理论到五大因果实验,从AI可解释性突破到安全范式革命,一次把大模型内部黑箱讲透。
Claude
Anthropic
J空间
全局工作空间
AI可解释性
AI安全
大模型
意识科学
Transformer
AGI
红队测试
LangGraph 深度实战:从状态机架构到生产级 Multi-Agent 编排的完整指南(2026)
编程
LangGraph 深度实战:从状态机架构到生产级 Multi-Agent 编排的完整指南(2026)
2026-06-04 18:45:17 +0800 CST
view 663
2026年最全面的LangGraph实战指南:从状态机架构原理到生产级Multi-Agent协作系统开发,包含完整代码示例与电商智能客服案例。
LangGraph
Multi-Agent
AI Agent
Python
大模型
美团 LongCat-2.0 深度解析:1.6 万亿参数 MoE 大模型如何在五万卡国产算力上跑通全流程——从 LSA 稀疏注意力到 MOPD 多类型专家架构的完整技术剖析
编程
美团 LongCat-2.0 深度解析:1.6 万亿参数 MoE 大模型如何在五万卡国产算力上跑通全流程——从 LSA 稀疏注意力到 MOPD 多类型专家架构的完整技术剖析
2026-07-07 10:14:22 +0800 CST
view 338
深度解析美团LongCat-2.0万亿参数MoE大模型:1.6T总参数/48B激活、LSA稀疏注意力实现1M原生上下文、N-gram Embedding 135B参数强化代码理解、MOPD三类专家动态调度、五万卡国产算力全流程训练。SWE-bench Pro 59.5超GPT-5.5,从架构原理到生产级实战的完整技术剖析。
LongCat-2.0
美团
MoE
大模型
国产算力
LSA
稀疏注意力
N-gram Embedding
MOPD
开源
Kimi K3 深度拆解:2.8万亿参数开源MoE旗舰的架构革命与工程极限
编程
Kimi K3 深度拆解:2.8万亿参数开源MoE旗舰的架构革命与工程极限
2026-07-31 09:42:32 +0800 CST
view 242
深度拆解 Kimi K3 的三项核心架构创新:KDA 混合线性注意力、Attention Residuals、Stable LatentMoE。涵盖 O(n) 长上下文建模原理、极端稀疏 MoE 工程实践、FlashKDA 高性能 CUDA 优化、MoonEP 通信库,以及 2.8T 参数的显存墙分析与 Ollama/vLLM 本地部署指南。
Kimi K3
Moonshot AI
MoE
大模型
开源
KDA
Attention Residuals
Stable LatentMoE
深度学习
编程Agent
GPT-5.6技术深度解析:Sol/Terra/Luna三档模型架构与实战对比
编程
GPT-5.6技术深度解析:Sol/Terra/Luna三档模型架构与实战对比
2026-07-02 06:14:06 +0800 CST
view 686
深入解析OpenAI最新发布的GPT-5.6系列模型,涵盖Sol/Terra/Luna三档架构设计、技术原理、实战应用与性能对比,为开发者提供全面的选型指南。
AI
GPT-5.6
大模型
OpenAI
人工智能
深度学习
万字深度解析 DeepSeek V4:当 1.6T 开源模型遇见「架构效率革命」——从 mHC 稳压机制到 CSA/HCA 稀疏注意力、从 FP4 量化到 Muon 优化器的完整技术指南(2026)
编程
万字深度解析 DeepSeek V4:当 1.6T 开源模型遇见「架构效率革命」——从 mHC 稳压机制到 CSA/HCA 稀疏注意力、从 FP4 量化到 Muon 优化器的完整技术指南(2026)
2026-07-02 06:43:56 +0800 CST
view 364
DeepSeek V4 技术架构深度解析:从 mHC 流形约束超连接、CSA/HCA 混合稀疏注意力、FP4 量化感知训练到 Muon 优化器,完整拆解 1.6T 开源模型如何用架构创新把 1M token 推理效率提升到 V3.2 的 10%。
DeepSeek V4
大模型架构
MoE
CSA/HCA 注意力
FP4 量化
mHC
AI 开源
长上下文
MiniMax M2.7 深度解析:当 AI 模型开始自己训练自己——从自我进化架构到软件工程能力全面评测
编程
MiniMax M2.7 深度解析:当 AI 模型开始自己训练自己——从自我进化架构到软件工程能力全面评测
2026-04-13 19:57:01 +0800 CST
view 1505
MiniMax M2.7 开源模型深度解析:自我进化架构、SWE-Pro 56.22% 软件工程能力、OpenRoom 多模态交互、本地部署方案与开源协议争议全面剖析。
AI
大模型
MiniMax
自我进化
开源
SWE-Pro
腾讯混元 Hy3 正式版深度解析:快慢思考融合的 MoE 架构与开发者实战指南
编程
腾讯混元 Hy3 正式版深度解析:快慢思考融合的 MoE 架构与开发者实战指南
2026-07-07 14:15:18 +0800 CST
view 629
深度解析腾讯混元 Hy3 正式版的技术架构,涵盖 MoE 混合专家、快慢思考融合机制、256K 上下文、Agent 能力等核心特性,并提供 API 调用与 SDK 集成的完整实战指南。
MoE架构
快慢思考
腾讯混元
Hy3
AI大模型
混合专家
Agent
开发者工具
Agent 能力哪家强?2026 年 8 月主流大模型 Terminal Bench 横向评测:数据、趋势与选型指南
编程
Agent 能力哪家强?2026 年 8 月主流大模型 Terminal Bench 横向评测:数据、趋势与选型指南
2026-08-15 17:19:35 +0800 CST
view 67
2026年8月最新Terminal Bench 2.1评测数据横评:Kimi K3/DeepSeek V4-Pro/Claude Opus 4.8等六大模型在五大维度的真实表现差异,配选型决策框架与成本效益分析
Terminal Bench
AI Agent
评测基准
大模型对比
Kimi
DeepSeek
Claude
Fable 5
选型指南
Kimi K3深度解析:2.8万亿参数、MoE架构与开源大模型的工程拐点(2026完整版)
编程
Kimi K3深度解析:2.8万亿参数、MoE架构与开源大模型的工程拐点(2026完整版)
2026-07-21 01:14:29 +0800 CST
view 547
深度解析月之暗面Kimi K3:2.8万亿参数MoE架构、KDA混合注意力机制、AttnRes残差设计、Mooncake分离式推理与90%缓存命中率,附完整API接入代码与工程落地指南。
Kimi K3
MoE
KDA
开源大模型
Mooncake
长上下文
注意力机制
AI编程
Agent
Qwen3.8 深度实战:2.4T MoE 巨兽来了——从 Preview API 接入、函数调用到本地部署与微调的完整工程指南(2026)
编程
Qwen3.8 深度实战:2.4T MoE 巨兽来了——从 Preview API 接入、函数调用到本地部署与微调的完整工程指南(2026)
2026-07-21 01:43:04 +0800 CST
view 404
2026年Qwen3.8深度实战:2.4T MoE架构原理、Preview API接入、流式调用、函数调用、RAG检索增强、vLLM/SGLang本地部署与QLoRA微调的完整工程指南
Qwen3.8
MoE
大模型部署
函数调用
QLoRA
vLLM
通义千问
2026
LiteLLM深度解析:统一调用100+大模型的AI网关SDK架构设计与实战
编程
LiteLLM深度解析:统一调用100+大模型的AI网关SDK架构设计与实战
2026-04-23 21:13:57 +0800 CST
view 1067
LiteLLM是一个统一调用100+大模型API的AI网关SDK,旨在解决大模型API碎片化问题。它采用OpenAI格式作为统一接口,支持PythonSDK和ProxyServer双引擎架构。
AI基础设施
大模型开发
API网关
Python开发
系统架构
性能优化
安全防护
开源项目
MiniMax M3 深度实战:当稀疏注意力打破百万 Token 墙——从 MSA 架构原理到 1M 上下文工程实践、原生多模态与 Agent 集群的生产级完全指南(2026)
编程
MiniMax M3 深度实战:当稀疏注意力打破百万 Token 墙——从 MSA 架构原理到 1M 上下文工程实践、原生多模态与 Agent 集群的生产级完全指南(2026)
2026-06-19 07:26:01 +0800 CST
view 449
深度解析MiniMax M3的自研MSA稀疏注意力架构,从KV outer gather Q设计到1M上下文工程实践,包含代码示例、性能优化和部署指南
MiniMax
M3
MSA
稀疏注意力
1M上下文
多模态
Agent
大模型
DeepSeek-V4预览版深度解析:MoE架构+百万上下文+1.6T参数,开源旗舰模型全面升级
编程
DeepSeek-V4预览版深度解析:MoE架构+百万上下文+1.6T参数,开源旗舰模型全面升级
2026-04-24 17:19:28 +0800 CST
view 914
2026年4月24日DeepSeek发布V4预览版,总参1.6T/284B,激活49B/13B,100万Token上下文,DSA稀疏注意力,兼容OpenAI+Anthropic双协议,昇腾与寒武纪Day 0适配,深度解析其架构与API用法。
DeepSeek
V4
MoE
大模型
开源
Kimi K3 架构深度解析:从第一性原理吃透 2.8 万亿参数 MoE 模型的三层核心创新
编程
Kimi K3 架构深度解析:从第一性原理吃透 2.8 万亿参数 MoE 模型的三层核心创新
2026-08-01 14:17:55 +0800 CST
view 289
深度解析 Kimi K3 的三大架构创新:KDA 混合线性注意力、Attention Residuals 注意力残差、Stable LatentMoE 分位数均衡路由,从第一性原理配代码示例吃透 2.8 万亿参数 MoE 模型。
Kimi
K3
MoE
KDA
AttnRes
StableLatentMoE
LLM
开源大模型
GLM-5.2 深度实战:当国产大模型拿下 Code Arena 全球第一——从 744B MoE 架构到 1M 上下文、从 DSA 稀疏注意力到 Agentic Engineering 的生产级完全指南(2026)
编程
GLM-5.2 深度实战:当国产大模型拿下 Code Arena 全球第一——从 744B MoE 架构到 1M 上下文、从 DSA 稀疏注意力到 Agentic Engineering 的生产级完全指南(2026)
2026-06-19 15:54:07 +0800 CST
view 727
2026年6月17日,智谱AI正式开源GLM-5.2,在Code Arena拿下全球可用模型第一。本文深度解析744B MoE架构、DSA稀疏注意力、1M上下文实现原理,并提供完整代码实战指南。
GLM-5.2
大模型
AI编程
智谱AI
MoE架构
稀疏注意力
CodeArena
Qwen3.8-2.4T-A95B 深度实战:2.4万亿参数MoE旗舰模型首次开源——从512专家细粒度路由到多芯部署全链路拆解
编程
Qwen3.8-2.4T-A95B 深度实战:2.4万亿参数MoE旗舰模型首次开源——从512专家细粒度路由到多芯部署全链路拆解
2026-08-16 15:16:00 +0800 CST
view 49
深度拆解阿里Qwen3.8-2.4T-A95B旗舰开源MoE模型:2.4万亿参数、512专家细粒度路由、95B稀疏激活、原生262K上下文可扩展至100万Token、9芯FlagOS适配,从架构原理到vLLM部署全链路实战。
Qwen3.8
MoE架构
开源大模型
混合专家
细粒度路由
512专家
长上下文
多芯部署
FlagOS
国产AI芯片
百万上下文从「奢侈品」变「日用品」:DeepSeek V4 CSA/HCA 混合注意力架构深度解析
编程
百万上下文从「奢侈品」变「日用品」:DeepSeek V4 CSA/HCA 混合注意力架构深度解析
2026-07-21 16:47:21 +0800 CST
view 237
深度解析 DeepSeek V4 的 CSA/HCA 混合注意力架构,涵盖压缩稀疏注意力、重度压缩注意力、流形约束超连接等核心创新,配有 Python 代码示例与工程价值判断。
DeepSeek
V4
CSA
HCA
注意力机制
MoE
KV缓存
长上下文
大模型架构
Claude Opus 5 深度解析:Anthropic 的「性价比核弹」,如何以半价性能碾压旗舰
编程
Claude Opus 5 深度解析:Anthropic 的「性价比核弹」,如何以半价性能碾压旗舰
2026-07-26 12:44:04 +0800 CST
view 201
2026年7月24日Anthropic发布Claude Opus 5,性能逼近Fable 5但价格砍半。本文深度解析其Self-Verification、多智能体协作、基准测试真相,并提供生产部署实战代码。
Claude Opus 5
Anthropic
AI大模型
编程能力
多智能体
Self-Verification
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
10
11
12
13
14
...
25
下一页