程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Rust在人工智能生成内容(AIGC)领域的应用
编程
Rust在人工智能生成内容(AIGC)领域的应用
2024-11-18 13:48:25 +0800 CST
view 1993
本文探讨了Rust在人工智能生成内容(AIGC)领域的应用,强调其安全性、高性能和并发性等优势。通过介绍Tch-rs和Rust-Bert等库,展示了Rust在深度学习和生成模型中的实际使用案例,包括神经网络和生成对抗网络(GAN)的实现。Rust的特性使其成为开发复杂AIGC项目的理想选择。
编程语言
人工智能
深度学习
生成模型
Rust
Stanford CS336 深度实战:从零实现大语言模型——数据清洗、Transformer 架构、FlashAttention 系统优化到 RL 对齐的完全指南(2026)
编程
Stanford CS336 深度实战:从零实现大语言模型——数据清洗、Transformer 架构、FlashAttention 系统优化到 RL 对齐的完全指南(2026)
2026-06-02 20:14:38 +0800 CST
view 485
Stanford CS336 课程深度解读:从零实现大语言模型,覆盖 Tokenizer、Transformer、FlashAttention-2、FSDP 分布式训练、Scaling Law、Common Crawl 数据清洗去重、SFT 与 GRPO 对齐,配完整代码示例。
LLM
Transformer
Stanford CS336
FlashAttention
PyTorch
AI工程
分布式训练
强化学习
tinygrad 深度解析:从零构建轻量级深度学习框架——比PyTorch更hackable,比JAX更简洁
编程
tinygrad 深度解析:从零构建轻量级深度学习框架——比PyTorch更hackable,比JAX更简洁
2026-05-01 09:05:59 +0800 CST
view 568
从Tensor抽象到IR编译全栈解析,tinygrad轻量级深度学习框架深度实战
tinygrad
深度学习
框架
PyTorch
JAX
vLLM 深度实战:从 PagedAttention 到 Speculative Decoding——2026年大模型推理引擎内核架构完全指南
编程
vLLM 深度实战:从 PagedAttention 到 Speculative Decoding——2026年大模型推理引擎内核架构完全指南
2026-05-23 18:44:14 +0800 CST
view 542
2026年深度长文,从PagedAttention分页思想、Continuous Batching调度算法、Speculative Decoding并行验证机制到CUDA Kernel底层实现,全面拆解vLLM推理引擎内核架构,附生产级部署实战与框架横向对比。
vLLM
PagedAttention
Continuous Batching
Speculative Decoding
GPU推理
大模型部署
深度学习
CUDA
Unsloth 深度实战:从 Triton 内核优化到 70% 显存压缩——2026 年 LLM 本地微调的工业级完全指南
编程
Unsloth 深度实战:从 Triton 内核优化到 70% 显存压缩——2026 年 LLM 本地微调的工业级完全指南
2026-05-23 20:00:37 +0800 CST
view 463
深度剖析 Unsloth 如何通过手写 Triton 内核、智能显存管理和 LoRA/QLoRA 优化,实现训练速度 2-5 倍提升、显存占用降低 70% 的技术奇迹。
LLM
微调
Unsloth
LoRA
深度学习
Rust开发笔记 | Rust的交互式Shell
编程
Rust开发笔记 | Rust的交互式Shell
2024-11-18 19:55:44 +0800 CST
view 1950
Rust是一种系统编程语言,以其内存安全和所有权模型受到欢迎。虽然Rust标准分发不内置REPL,但第三方工具`evcxr_repl`提供了交互式编程环境,允许开发者快速测试和实验Rust代码。通过REPL,用户可以即时执行代码、探索数据类型、处理错误,并获得反馈,极大地促进了学习和开发效率。
编程语言
开发工具
学习资源
Rust
百度 Unlimited-OCR 深度解析:R-SWA 注意力机制如何用 3B 参数打爆百亿模型
编程
百度 Unlimited-OCR 深度解析:R-SWA 注意力机制如何用 3B 参数打爆百亿模型
2026-06-30 16:16:03 +0800 CST
view 221
2026年6月百度开源Unlimited-OCR深度解析:R-SWA参考滑动窗口注意力机制将KV Cache从线性增长压成常数,3B MoE模型用500M激活参数在OmniDocBench上以93.92%总分刷新SOTA,打爆Qwen3-VL 72B和Gemini 2.5 Pro。万字长文从架构原理到代码实战全覆盖。
Unlimited-OCR
端到端OCR
R-SWA
百度
注意力机制
大模型
MoE
深度学习
AI开源
文档解析
fsner是一个功能强大的Python库,专注于实体识别和关系抽取,广泛应用于自然语言处理领域
综合
fsner是一个功能强大的Python库,专注于实体识别和关系抽取,广泛应用于自然语言处理领域
2024-11-18 19:51:42 +0800 CST
view 1624
fsner是一个功能强大的Python库,专注于实体识别和关系抽取,广泛应用于自然语言处理领域。本文介绍了fsner的安装、基本用法、高级用法及实际案例,展示了如何使用fsner进行实体识别和关系抽取,包括自定义实体和关系的添加。通过这些示例,开发者可以快速掌握fsner的使用,提升NLP项目的效率。
Python库
自然语言处理
机器学习
NumPy是Python中一个强大的库,专为高效的数值计算而设计,广泛应用于数据科学、机器学习和科学计算
综合
NumPy是Python中一个强大的库,专为高效的数值计算而设计,广泛应用于数据科学、机器学习和科学计算
2024-11-18 10:22:10 +0800 CST
view 1577
NumPy是Python中一个强大的库,专为高效的数值计算而设计,广泛应用于数据科学、机器学习和科学计算。本文介绍了NumPy的安装方法、基本用法和高级特性,包括数组创建、数组操作、广播和高级索引等。NumPy在图像处理等实际应用中也表现出色,是Python程序员和数据科学家必备的工具。
编程
数据科学
机器学习
科学计算
Python
Hermes Agent 深度实战:当 AI Agent 学会「自我进化」——从闭环学习架构到 70+ 工具链、从 SQLite+FTS5 记忆引擎到 20 平台网关的生产级完全指南(2026)
编程
Hermes Agent 深度实战:当 AI Agent 学会「自我进化」——从闭环学习架构到 70+ 工具链、从 SQLite+FTS5 记忆引擎到 20 平台网关的生产级完全指南(2026)
2026-06-23 04:54:49 +0800 CST
view 294
2026 年 2 月,Nous Research 发布的 Hermes Agent 凭借「自我进化」能力引爆 GitHub。本文从架构设计、记忆系统、技能自进化、多平台网关、工具链集成等维度,深度拆解这款「越用越聪明」的开源 AI Agent 框架(约 22000 字)。
AI Agent
开源
Python
机器学习
自动化
综合
使用OpenAI文本嵌入模型的全面指南
2024-11-18 11:26:06 +0800 CST
view 2254
本文提供了关于使用OpenAI文本嵌入模型的全面指南,涵盖向量嵌入的定义、应用场景及模型选择。向量嵌入能够将非结构化数据转换为机器可处理的向量表示,广泛应用于语义搜索、推荐系统等。文中还介绍了如何使用OpenAI的嵌入模型生成向量嵌入,并与ZillizCloud集成,以实现高效的语义搜索。
人工智能
机器学习
数据处理
技术指南
开发者资源
AReaL 2.0 深度解析:蚂蚁联合清华港科大开源的 Agent 自演进引擎——在线强化学习如何让智能体「越用越强」的完整实战指南
编程
AReaL 2.0 深度解析:蚂蚁联合清华港科大开源的 Agent 自演进引擎——在线强化学习如何让智能体「越用越强」的完整实战指南
2026-07-06 14:44:28 +0800 CST
view 312
深度解析蚂蚁联合清华港科大开源的AReaL 2.0在线强化学习基础设施:ATDP轨迹协议、Agentic Data Proxy、Agent Evolution Control Plane三根支柱架构、微服务化Online RL工作流、KPop稳定化策略、防reward hacking机制、Hermes/Claude Code Agent训练实战、AReaL-SEA在τ²-bench超越GPT-5。含完整代码示例与Docker部署指南。
AReaL
Agent自演进
在线强化学习
Online RL
蚂蚁
清华大学
智能体
开源
Thinc是一个轻量级的Python机器学习库,专为自然语言处理设计,简化模型的创建、训练和部署
编程
Thinc是一个轻量级的Python机器学习库,专为自然语言处理设计,简化模型的创建、训练和部署
2024-11-18 13:18:03 +0800 CST
view 1751
Thinc是一个轻量级的Python机器学习库,专为自然语言处理设计,简化模型的创建、训练和部署。它基于PyTorch和CycleHub,提供简洁的接口,支持文本分类、序列标注、命名实体识别等任务。Thinc旨在让更多开发者能够使用机器学习,通过简单的API快速构建功能强大的模型。
机器学习
自然语言处理
Python库
Python 实现验证码识别:使用 Ddddocr 库
综合
Python 实现验证码识别:使用 Ddddocr 库
2024-11-18 18:38:02 +0800 CST
view 2693
本文介绍了`ddddocr`库的使用,该库是一个基于`pytorch`和`onnxruntime`的开源OCR工具,专注于验证码和图片文字识别。提供了安装方法、基本使用示例、目标检测功能以及高级特性,如滑块检测和自定义模型导入。通过简单的代码示例,开发者可以快速实现OCR识别和目标检测,适合处理各种验证码场景。
Python
OCR
图像处理
机器学习
开源
智谱 slime 深度实战:当 RL 后训练终于有了工业级「炼丹炉」——从 Megatron+SGLang 三模块联调到 GLM-5.2 两天完成 OPD 后训练的生产级完全指南(2026)
编程
智谱 slime 深度实战:当 RL 后训练终于有了工业级「炼丹炉」——从 Megatron+SGLang 三模块联调到 GLM-5.2 两天完成 OPD 后训练的生产级完全指南(2026)
2026-06-23 07:54:24 +0800 CST
view 350
2026年6月智谱开源RL后训练框架slime,支撑GLM-5.2仅用2天完成OPD后训练。本文深度解析其三模块架构、原生引擎透传设计、PD分离、增量权重同步等核心技术,附完整生产级部署实战代码。
强化学习
RL训练
slime框架
智谱AI
GLM-5.2
Megatron
SGLang
后训练
开源框架
生产级部署
µP 深度拆解:当调参侠终于破解 scaling 诅咒——从最大更新参数化到万亿参数大模型超参迁移的工程全貌(2026)
编程
µP 深度拆解:当调参侠终于破解 scaling 诅咒——从最大更新参数化到万亿参数大模型超参迁移的工程全貌(2026)
2026-07-19 08:43:41 +0800 CST
view 89
深度拆解微软/ OpenAI 的 µP(最大更新参数化)理论:从 Tensor Programs 数学框架、为什么标准参数化失效、到 PyTorch mup 库完整实战代码,含 Transformer 层、AdamW 配置、跨尺度超参数迁移验证与生产级 Pipeline。
µP
Max Update Parametrization
超参数迁移
Tensor Programs
深度学习
Transformer
LLM训练
AdamW
mup
微软
万字深度解析百度 Unlimited OCR:当 R-SWA 遇见 MoE——3B 参数如何碾压端到端 OCR 全场(2026)
编程
万字深度解析百度 Unlimited OCR:当 R-SWA 遇见 MoE——3B 参数如何碾压端到端 OCR 全场(2026)
2026-07-01 03:42:17 +0800 CST
view 255
2026年6月百度开源Unlimited OCR,5天GitHub Star破万。深度解析R-SWA注意力机制、MoE架构、16倍视觉Token压缩,以及为何能将KV Cache从线性增长压成常数。
Unlimited OCR
OCR
R-SWA
MoE
百度
深度学习
计算机视觉
文档识别
KV Cache
VibeVoice深度解析:微软如何用7.5Hz超低帧率Tokenizer突破语音AI的「超长上下文」困境
编程
VibeVoice深度解析:微软如何用7.5Hz超低帧率Tokenizer突破语音AI的「超长上下文」困境
2026-04-12 14:25:53 +0800 CST
view 756
深入解析微软VibeVoice开源语音AI框架,探讨其7.5Hz超低帧率Tokenizer、LLM+Diffusion混合架构如何突破60分钟ASR和90分钟TTS的长上下文困境,附完整工程实践代码。
语音AI
ASR
TTS
VibeVoice
微软
开源
深度学习
Python中的shapley-regression库,重点在于如何安装、使用及其在机器学习模型中的应用
综合
Python中的shapley-regression库,重点在于如何安装、使用及其在机器学习模型中的应用
2024-11-19 05:02:08 +0800 CST
view 1764
本文介绍了Python中的shapley-regression库,重点在于如何安装、使用及其在机器学习模型中的应用。通过计算SHAP值,用户可以理解特征对模型预测的贡献,并利用可视化工具展示这些信息。文章涵盖了库的基本用法和高级用法,包括模型训练、SHAP值计算和特征重要性的可视化,适用于房价预测等实际案例。
数据分析
机器学习
模型解释
patmlkit是一个专为数据分析与机器学习设计的Python库
综合
patmlkit是一个专为数据分析与机器学习设计的Python库
2024-11-18 15:51:33 +0800 CST
view 1575
patmlkit是一个专为数据分析与机器学习设计的Python库,提供数据预处理、模型训练、评估与优化的高效功能。本文介绍了如何安装和使用patmlkit,包括数据标准化、模型选择与训练、网格搜索参数调优以及模型评估。无论是初学者还是经验丰富的数据科学家,patmlkit都能帮助快速完成机器学习任务。
Python
数据科学
机器学习
库
工具
DiffusionGemma 深度实战:当谷歌用图像扩散的逻辑重塑文本生成——从离散扩散原理到 4 倍推理加速的生产级完全指南(2026)
编程
DiffusionGemma 深度实战:当谷歌用图像扩散的逻辑重塑文本生成——从离散扩散原理到 4 倍推理加速的生产级完全指南(2026)
2026-06-17 23:28:33 +0800 CST
view 460
2026年6月谷歌开源DiffusionGemma,26B MoE参数仅激活3.8B,通过离散扩散实现4倍推理加速。本文从原理、架构、代码实战、性能优化全面深度解析这一范式级创新。
DiffusionGemma
谷歌
文本扩散
MoE
AI推理
Gemma
开源模型
离散扩散
并行生成
深度学习
Hermes Agent 深度实战:自进化 AI Agent 的三层记忆架构与 Skill 自动生成完全指南(下篇)
编程
Hermes Agent 深度实战:自进化 AI Agent 的三层记忆架构与 Skill 自动生成完全指南(下篇)
2026-06-04 04:45:35 +0800 CST
view 455
下篇:深入讲解 Nudge Engine 定时复盘、强化学习从经验中学习、完整代码实战(从零搭建自进化 Agent)、与其他框架对比、生产级最佳实践、性能优化策略。
Hermes Agent
自进化
AI Agent
Nudge Engine
强化学习
代码实战
pycm:一个强大的混淆矩阵库
综合
pycm:一个强大的混淆矩阵库
2024-11-18 16:17:54 +0800 CST
view 1846
pycm是一个用于生成和分析混淆矩阵的Python库,能够自动计算多种评估指标并提供可视化功能。本文介绍了pycm的安装、基本用法和高级用法,包括如何生成混淆矩阵、导出结果以及支持多标签和多类别分类的功能。通过实际案例展示了如何使用pycm评估机器学习模型的性能,是数据科学家和机器学习工程师的重要工具。
机器学习
数据科学
模型评估
工具
dsnd-prob-vd是一个专为数据科学和机器学习开发的Python库
综合
dsnd-prob-vd是一个专为数据科学和机器学习开发的Python库
2024-11-17 15:00:38 +0800 CST
view 1628
dsnd-prob-vd是一个专为数据科学和机器学习开发的Python库,提供数据处理、概率计算和可视化功能。本文介绍了该库的安装、基本用法、高级用法及实际案例,帮助用户快速掌握如何使用该库进行数据分析。通过示例代码,用户可以学习如何导入数据、处理数据、进行统计分析和绘制可视化图表。
数据科学
机器学习
Python库
数据处理
可视化
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
2
3
4
5
6
...
23
下一页