程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
开源模型 相关技术文章
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
Google 开源 TranslateGemma:55 种语言翻译模型,还能直接看图翻译
资讯
Google 开源 TranslateGemma:55 种语言翻译模型,还能直接看图翻译
2026-09-12 09:47:05
Google 开源专为翻译任务调优的 TranslateGemma 模型(4B/12B/27B),覆盖 55 种语言,12B 版本性能超越 27B 且可在消费级显卡运行,支持直接翻译图像中的文字,可在手机、笔记本上部署出私有版 Google 翻译。
TranslateGemma
Gemma
机器翻译
多模态
开源模型
Open-Sora 2.0 开源 11B 视频模型:权重和训练代码全放开,20 万美元训完
编程
Open-Sora 2.0 开源 11B 视频模型:权重和训练代码全放开,20 万美元训完
2026-09-11 23:46:26
Open-Sora 2.0 是潞晨科技开源的 11B 视频生成模型,T2V/I2V 共用权重,支持 256px 与 768px。本文整理它的版本时间线、安装与权重下载命令、推理参数(aspect_ratio、num_frames、offload、motion score)、H100/H800 上的耗时显存实测表,以及 VBench 评测结论与几个容易踩的参数限制。
Open-Sora
视频生成
Diffusion
开源模型
CUDA
PyTorch
前沿 LLM API 价格五个月未动,8 月却变动三次:一家实验室将费率提高了两倍
资讯
前沿 LLM API 价格五个月未动,8 月却变动三次:一家实验室将费率提高了两倍
2026-09-06 03:11:18
前沿LLM API价格在5个月稳定后,8月份发生了三次显著变动:一家实验室降价、另一家调整定价结构、第三家将费率提高两倍。文章分析了价格结构性粘性的原因、三次变动的具体情况和背景,以及对LLM定价趋势的重新思考(价格分化加剧、定价结构灵活化、成本透明度提升、价格战可能到来),并给出了开发者和企业的应对建议。
LLM
API定价
大模型
AI
价格趋势
成本优化
多模型策略
开源模型
MiniMax H3 开源视频模型:ComfyUI 安装部署与使用笔记
编程
MiniMax H3 开源视频模型:ComfyUI 安装部署与使用笔记
2026-08-31 07:31:27
MiniMax 官方开源的全模态视频生成系统 H3 的安装与使用笔记:支持文本/图片/视频/音频输入,输出 2K、15 秒带音频轨视频;含 ComfyUI 节点安装、工作流搭法与踩坑点。
MiniMax
H3
视频生成
ComfyUI
开源模型
AIGC
后训练Scaling的工程奇迹:GLM-5.3 如何用同一基座把编程和网络安全能力推到开源第一
编程
后训练Scaling的工程奇迹:GLM-5.3 如何用同一基座把编程和网络安全能力推到开源第一
2026-08-17 11:48:04
深度拆解智谱GLM-5.3:同一7430亿参数基座,通过后训练Scaling将编程能力推至开源第一、CyberGym漏洞发现开源第一。全面覆盖IndexShare/SAO/Slime三层工程架构、多币种代码示例、安全漏洞审计演示与横向对比。
GLM-5.3
大模型
后训练Scaling
网络安全
漏洞发现
智谱AI
编程能力
开源模型
Qwen3.8 深度拆解:当阿里巴巴用 2.4 万亿参数 MoE 架构决定「干掉所有编程助手」——从 Gated DeltaNet 混合注意力到 100 万上下文 Token 的 Agent-First 大模型工程哲学
编程
Qwen3.8 深度拆解:当阿里巴巴用 2.4 万亿参数 MoE 架构决定「干掉所有编程助手」——从 Gated DeltaNet 混合注意力到 100 万上下文 Token 的 Agent-First 大模型工程哲学
2026-08-04 09:16:35
深度拆解阿里巴巴2.4万亿参数Qwen3.8大模型:稀疏MoE架构、Gated DeltaNet混合注意力、100万上下文Token、编程+办公双引擎、完整部署代码与性能基准对比
Qwen3.8
阿里巴巴
MoE
大模型开源
2.4万亿参数
Gated DeltaNet
混合注意力
Agent
编程助手
千问办公
开源模型
vLLM
Kimi K3 深度拆解:当月之暗面决定「干掉所有开源对手」——2.8 万亿参数、百万上下文与三大 Infra 开源如何重新定义开源大模型的天花板
编程
Kimi K3 深度拆解:当月之暗面决定「干掉所有开源对手」——2.8 万亿参数、百万上下文与三大 Infra 开源如何重新定义开源大模型的天花板
2026-08-04 05:42:36
深度拆解Kimi K3 2.8万亿参数MoE开源大模型:KDA混合线性注意力、Stable LatentMoE 896专家架构、百万Token上下文、三大Infra开源(MoonEP/FlashKDA/AgentEnv),附完整代码示例与性能基准对比
Kimi K3
月之暗面
MoE
大模型开源
2.8万亿参数
KDA注意力
FlashKDA
MoonEP
AgentEnv
开源模型
LLaDA2.2 深度拆解:全球首个大规模 Agentic 扩散模型——Levenshtein 编辑 + L-EBPO 如何打破自回归垄断
编程
LLaDA2.2 深度拆解:全球首个大规模 Agentic 扩散模型——Levenshtein 编辑 + L-EBPO 如何打破自回归垄断
2026-07-31 10:46:00
全球首个大规模 Agentic 扩散模型深度拆解,详解 Levenshtein 编辑范式、L-EBPO 强化学习算法与 BlockRouting 128K 长上下文工程实践,对比自回归模型 Agent 能力评测。
扩散语言模型
Agentic AI
Levenshtein编辑
L-EBPO
蚂蚁集团
MoE架构
128K上下文
开源模型
AI Agent
强化学习
DeepSeek V4 深度技术解析:从 MoE 架构到百万上下文的生产级实战指南
编程
DeepSeek V4 深度技术解析:从 MoE 架构到百万上下文的生产级实战指南
2026-07-08 01:51:46
深度解析DeepSeek V4的MoE架构、DSA稀疏注意力、百万Token上下文、国产算力适配等核心技术,配完整API接入代码与成本优化指南
DeepSeek-V4
MoE架构
DSA稀疏注意力
大模型
AI编程
开源模型
百万上下文
华为昇腾
GitHub Copilot 接入 Kimi K2.7 Code 深度解读:开源模型的登堂入座与 AI 编程格局重塑
编程
GitHub Copilot 接入 Kimi K2.7 Code 深度解读:开源模型的登堂入座与 AI 编程格局重塑
2026-07-07 20:12:44
2026年7月,GitHub Copilot 首次接入开源模型 Kimi K2.7 Code。本文从技术原理、模型架构、性能实测、开发者体验、格局影响等多维度,深度解析这一里程碑事件的真实含义。
GitHub Copilot
Kimi K2.7
AI编程
开源模型
编程助手
Moonshot AI
月之暗面
AI Agent
GitHub Copilot 接入首个开源模型:Kimi K2.7 Code 深度解析,一次打破 AI 编程格局的历史性事件
编程
GitHub Copilot 接入首个开源模型:Kimi K2.7 Code 深度解析,一次打破 AI 编程格局的历史性事件
2026-07-07 15:13:58
深度解析 GitHub Copilot 首次接入开源模型 Kimi K2.7 Code 的技术细节、架构设计、性能表现与生态影响,探讨开源编程模型的崛起与中国AI国际化的新路径。
GitHub Copilot
Kimi K2.7
AI编程
开源模型
月之暗面
Kimi Code
AI工具
编程助手
Kimi K2.7 Code 深度解析:万亿参数 MoE 编程模型如何用 MLA 注意力和反过度思考机制成为 GitHub Copilot 首个开源模型——从架构设计到生产部署的完整实战指南
编程
Kimi K2.7 Code 深度解析:万亿参数 MoE 编程模型如何用 MLA 注意力和反过度思考机制成为 GitHub Copilot 首个开源模型——从架构设计到生产部署的完整实战指南
2026-07-06 12:13:00
深度解析月之暗面Kimi K2.7 Code:1.1万亿参数MoE架构、MLA多头潜在注意力、384专家动态路由、token消耗降30%、MCP Mark Verified 81.1分反超Opus 4.8。GitHub Copilot首个开源模型,含完整API接入与本地部署实战。
Kimi K2.7 Code
MoE
MLA
GitHub Copilot
开源模型
编程模型
月之暗面
Moonshot AI
Kimi K2.7 Code 接入 GitHub Copilot:开源代码模型的里程碑时刻
编程
Kimi K2.7 Code 接入 GitHub Copilot:开源代码模型的里程碑时刻
2026-07-05 13:12:17
GitHub Copilot首次接入开源模型Kimi K2.7 Code的技术深度解析,从MoE架构、MLA注意力机制、性能基准到实战体验和私有化部署方案,全面拆解这一里程碑事件对开发者的意义。
Kimi K2.7 Code
GitHub Copilot
开源模型
MoE
AI编程
代码模型
月之暗面
GitHub Copilot 首次接入开源模型:AI编程工具的开放生态拐点
编程
GitHub Copilot 首次接入开源模型:AI编程工具的开放生态拐点
2026-07-05 09:12:53
GitHub Copilot 首次接入开源模型 Kimi K2.7 Code,标志着AI编程工具从封闭走向开放。本文深度分析 K2.7 Code 的技术架构、Benchmark 表现、成本优势及实操指南。
AI编程
GitHub Copilot
Kimi K2.7
开源模型
MCP
历史的分水岭:GitHub Copilot 接入 Kimi K2.7 Code,开源编程模型的登堂入室
编程
历史的分水岭:GitHub Copilot 接入 Kimi K2.7 Code,开源编程模型的登堂入室
2026-07-04 13:44:27
深度解析Kimi K2.7 Code接入GitHub Copilot:从技术架构、性能测试到开源生态影响,全面解读这起开源编程模型登堂入室的历史性事件
Kimi K2.7 Code
GitHub Copilot
开源模型
AI编程
MoE架构
字节跳动
GitHub Copilot 首次接入开源模型 Kimi K2.7 Code:从 MoE 架构到私有化部署的完整技术解析
编程
GitHub Copilot 首次接入开源模型 Kimi K2.7 Code:从 MoE 架构到私有化部署的完整技术解析
2026-07-03 14:13:50
2026年7月3日,GitHub Copilot首次接入开源模型Kimi K2.7 Code。万字深度解析MoE架构、MLA注意力机制、30% Token优化技术原理、Copilot集成方案、私有化部署实战与成本分析。
Kimi K2.7 Code
GitHub Copilot
MoE
开源模型
AI编程
MoonshotAI
vLLM
模型部署
DeepSeek V4 Flash 深度解析:MoE架构如何重塑大模型推理效率
编程
DeepSeek V4 Flash 深度解析:MoE架构如何重塑大模型推理效率
2026-06-30 09:46:12
2026年,大模型战场迎来最激烈的性能竞赛。DeepSeek V4 Flash以2840亿总参数、130亿激活参数、百万token上下文支持,横扫开源模型性能榜单。本文从开发者视角出发,深入剖析其MoE架构设计、推理优化策略、国产算力适配,以及如何在实际项目中用好这个'性价比之王'。
MoE架构
DeepSeek
V4 Flash
大模型
AI推理
开源模型
Python
代码优化
DeepSeek V4 Flash 深度解析:284B总参、13B激活的MoE开源模型,凭什么成为2026年度「性价比之王」?
编程
DeepSeek V4 Flash 深度解析:284B总参、13B激活的MoE开源模型,凭什么成为2026年度「性价比之王」?
2026-06-29 22:12:39
深度解析DeepSeek V4 Flash架构:CSA/HCA混合注意力、MoE细粒度路由、DSpark推测解码技术,附完整部署代码与Benchmark对比
DeepSeek
V4
MoE
开源模型
AI推理
DSpark
CSA
大模型
开源追上闭源!OpenRouter 2026开源F4深度解析:DeepSeek GLM MiniMax NVIDIA谁才是你的菜
编程
开源追上闭源!OpenRouter 2026开源F4深度解析:DeepSeek GLM MiniMax NVIDIA谁才是你的菜
2026-06-29 07:42:37
OpenRouter 2026年6月发布最值得关注的4个开源模型:DeepSeek V4 Flash极致性价比、GLM 5.2智力天花板、MiniMax M3原生多模态、NVIDIA Nemotron企业级部署。本文从架构、性能、成本、场景四维度深度解析,助你做出正确技术选型。
AI
开源模型
DeepSeek
GLM
MiniMax
NVIDIA
技术选型
GLM-5.2 深度实战:国产开源模型首次在编程能力上超越GPT-5.5——从架构原理到生产部署的完整指南
编程
GLM-5.2 深度实战:国产开源模型首次在编程能力上超越GPT-5.5——从架构原理到生产部署的完整指南
2026-06-27 05:43:51
2026年6月智谱AI发布GLM-5.2,登顶开源权重模型榜首,在SWE-bench Pro编程基准上超越GPT-5.5。本文深度解析GLM-5.2的MoE架构、IndexShare长上下文技术、编程实战代码、性能优化和生产部署。
GLM-5.2
智谱AI
开源模型
编程能力
AI模型
MoE架构
长上下文
MiniMax M3 开源旗舰深度实战:当 428B 参数遇上自研 MSA 稀疏注意力——从百万级上下文到 SWE-Bench 超越 GPT-5.5、从 ICLR 论文自主复现到 CUDA 算子 9.4× 加速的生产级完全指南(2026)
编程
MiniMax M3 开源旗舰深度实战:当 428B 参数遇上自研 MSA 稀疏注意力——从百万级上下文到 SWE-Bench 超越 GPT-5.5、从 ICLR 论文自主复现到 CUDA 算子 9.4× 加速的生产级完全指南(2026)
2026-06-22 18:23:16
MiniMax M3 是 2026 年首个同时集齐百万级上下文、顶尖编程能力、原生多模态的开源旗舰大模型。本文深度拆解其自研 MSA 稀疏注意力架构、基准测试数据、API 实战调用、本地部署方案,以及三个震撼的真实案例复盘。
MiniMax M3
MSA稀疏注意力
大模型
开源模型
AI编程
GLM-5.2 深度实战:当开源编程模型首次摸到 Opus 4.8 的天花板——从 753B MoE 架构到 1M 无损上下文、从 DSA 稀疏注意力到国产算力 Day-0 部署的生产级完全指南(2026)
编程
GLM-5.2 深度实战:当开源编程模型首次摸到 Opus 4.8 的天花板——从 753B MoE 架构到 1M 无损上下文、从 DSA 稀疏注意力到国产算力 Day-0 部署的生产级完全指南(2026)
2026-06-20 15:52:19
GLM-5.2 开源深度解析:753B MoE 架构、1M 无损上下文、DSA 稀疏注意力、生产级部署完全指南
AI
开源模型
GLM
智谱
编程工具
MoE
大模型
DiffusionGemma 深度实战:当谷歌用图像扩散的逻辑重塑文本生成——从离散扩散原理到 4 倍推理加速的生产级完全指南(2026)
编程
DiffusionGemma 深度实战:当谷歌用图像扩散的逻辑重塑文本生成——从离散扩散原理到 4 倍推理加速的生产级完全指南(2026)
2026-06-17 23:28:33
2026年6月谷歌开源DiffusionGemma,26B MoE参数仅激活3.8B,通过离散扩散实现4倍推理加速。本文从原理、架构、代码实战、性能优化全面深度解析这一范式级创新。
DiffusionGemma
谷歌
文本扩散
MoE
AI推理
Gemma
开源模型
离散扩散
并行生成
深度学习
DiffusionGemma 深度实战:当文本生成告别逐字蹦字——从离散扩散到 1100 tokens/s 的生产级完全指南(2026)
编程
DiffusionGemma 深度实战:当文本生成告别逐字蹦字——从离散扩散到 1100 tokens/s 的生产级完全指南(2026)
2026-06-16 07:18:07
Google DeepMind 开源 DiffusionGemma 离散文本扩散模型深度实战:从并行去噪原理到 1100 tokens/s 推理,完整代码示例与 Agent 构建
DiffusionGemma
文本扩散
离散扩散
LLM
开源模型
Google DeepMind
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
python
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
上一页
1
2
下一页
共 2 页
到第
页
确定