程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
LLM 推理优化全景实战:从 PagedAttention 到投机解码——让大模型推理成本下降 70% 的技术革命(2026)
编程
LLM 推理优化全景实战:从 PagedAttention 到投机解码——让大模型推理成本下降 70% 的技术革命(2026)
2026-05-30 15:42:55 +0800 CST
view 466
深度解析 LLM 推理优化的核心技术:PagedAttention 内存管理革命、投机解码加速策略、INT4/FP8 量化技术、MoE 架构优化,从架构原理到代码实战,让大模型推理成本下降 70%。
LLM
推理优化
vLLM
PagedAttention
投机解码
量化
MoE
百度 Unlimited OCR 深度解析:R-SWA 如何让长文档 OCR 从"逐页煎熬"走向"一次搞定"
编程
百度 Unlimited OCR 深度解析:R-SWA 如何让长文档 OCR 从"逐页煎熬"走向"一次搞定"
2026-06-28 14:13:06 +0800 CST
view 360
深度解析百度 Unlimited OCR 的 R-SWA 参考滑动窗口注意力机制,如何将 KV Cache 从线性增长压到常数,使长文档 OCR 性能恒定不衰减。含完整架构分析、训练配方、性能基准和实战代码。
Unlimited OCR
R-SWA
OCR
端到端
百度
文档识别
KV Cache
MoE
DeepEncoder
长文档处理
ds4 深度解析:Redis 作者的最后一战?—— DwarfStar 4 本地推理引擎的技术革命
编程
ds4 深度解析:Redis 作者的最后一战?—— DwarfStar 4 本地推理引擎的技术革命
2026-05-15 17:47:40 +0800 CST
view 702
深入解析 antirez(Redis 作者)新开源项目 ds4:DwarfStar 4 本地推理引擎,专门为 DeepSeek V4 Flash 打造,支持 Metal/CUDA 后端,2-bit 量化可在 96GB 内存 MacBook 上运行 284B 参数模型。
AI推理
本地部署
DeepSeek
Redis
Apple Silicon
CUDA
Metal
MoE
量化
智谱 GLM-5.1 深度解析:当开源模型突破「8小时自治」临界点
编程
智谱 GLM-5.1 深度解析:当开源模型突破「8小时自治」临界点
2026-04-09 00:53:51 +0800 CST
view 1372
2026年4月8日智谱发布GLM-5.1,744B参数MIT开源,SWE-bench Pro 58.4分超越Claude Opus 4.6,全球首个支持8小时长程自治的开源模型。
GLM-5.1
智谱AI
开源大模型
MoE
SWE-bench
长程自治
LLM
DeepSeek V4 深度解析:百万token上下文的技术革命,让开源模型站上全球之巅
编程
DeepSeek V4 深度解析:百万token上下文的技术革命,让开源模型站上全球之巅
2026-04-28 08:19:25 +0800 CST
view 618
深度解析 DeepSeek V4:混合注意力机制、MoE 架构、100万token 上下文、Agent 能力,从技术原理到部署实战,全面剖析开源模型新天花板
DeepSeek
AI大模型
开源
长上下文
MoE
混合注意力
Agent
TileLang + TileKernels 深度解析:DeepSeek 如何用 Python 写出让 GPU 逼近理论性能上限的 GPU 内核
编程
TileLang + TileKernels 深度解析:DeepSeek 如何用 Python 写出让 GPU 逼近理论性能上限的 GPU 内核
2026-04-28 10:55:20 +0800 CST
view 570
深度剖析 DeepSeek 开源的 TileLang DSL 和 TileKernels GPU 内核库:从 GEMM 到 MoE,从 TVM 编译基础设施到生产级量化内核,揭示用 Python 写接近硬件极限性能 GPU 代码的秘密。
TileLang
GPU内核
DeepSeek
高性能计算
CUDA
GEMM
MoE
量化
TVM
开源项目
Google Gemma 4 深度解析:当开源AI进入「逐层嵌入平行化」时代
编程
Google Gemma 4 深度解析:当开源AI进入「逐层嵌入平行化」时代
2026-04-09 04:54:56 +0800 CST
view 889
Google于2026年4月发布Gemma 4开源模型系列,首次全面切换Apache 2.0许可证,搭载Per-Layer Embedding架构创新,26B MoE以3.8B激活参数击败Qwen3-235B。本文深度解析PLE架构、稀疏激活机制与全规格产品矩阵。
Gemma 4
Google
开源模型
Apache 2.0
MoE
Per-Layer Embedding
NVIDIA Cosmos 3 全模态物理AI深度解读:当世界模型从「纸上谈兵」走向「具身智能」——从 MoT 架构革命到万亿级合成数据的工业级落地指南(2026)
编程
NVIDIA Cosmos 3 全模态物理AI深度解读:当世界模型从「纸上谈兵」走向「具身智能」——从 MoT 架构革命到万亿级合成数据的工业级落地指南(2026)
2026-06-16 16:15:52 +0800 CST
view 326
2026年6月英伟达开源 Cosmos 3 全模态世界模型,本文从 MoT 架构、SILA 数据引擎、训练配方、推理部署四个维度进行程序员视角的深度解读,配代码示例与性能对比,探讨物理AI开发者的新机遇。
NVIDIA
Cosmos 3
物理AI
世界模型
MoT架构
具身智能
开源
机器人
NVIDIA Cosmos 3 深度实战:当世界模型学会「理解、生成、模拟、行动」——从 MoT 混合架构到物理 AI 全链路的生产级完全指南(2026)
编程
NVIDIA Cosmos 3 深度实战:当世界模型学会「理解、生成、模拟、行动」——从 MoT 混合架构到物理 AI 全链路的生产级完全指南(2026)
2026-06-15 01:18:03 +0800 CST
view 578
2026年6月英伟达发布全球首款全模态物理AI世界模型Cosmos 3。本文从MoT混合架构、代码实战、Agent Skills工作流、性能分析、生产部署五个维度,带你彻底搞懂这个被业界定义为物理AI产业「安卓时刻」的技术突破。
NVIDIA
Cosmos 3
物理AI
世界模型
MoT架构
机器人
自动驾驶
深度学习
AI Agent
仿真
Go 1.27 的小对象分配革命:当编译器学会为每个尺寸定制 malloc
编程
Go 1.27 的小对象分配革命:当编译器学会为每个尺寸定制 malloc
2026-07-05 16:38:18 +0800 CST
view 148
Go 1.27编译器为小于80字节的小对象生成尺寸特化分配代码,绕过mallocgc通用路径,直接内联分配逻辑。小对象分配延迟降低约30%,整体免费1%性能提升,无需改代码。解析Swiss Tables/Green Tea GC/栈分配的基础建设如何促成这一优化。
Go
Go 1.27
编译器
性能优化
内存管理
malloc
小对象分配
尺寸特化
mallocgc
GreenTeaGC
SwissTables
栈分配
GOEXPERIMENT
Elixir 1.19 深度实战:从类型系统飞跃到编译速度4倍提升——2026年函数式编程的性能革命完全指南
编程
Elixir 1.19 深度实战:从类型系统飞跃到编译速度4倍提升——2026年函数式编程的性能革命完全指南
2026-05-24 09:09:31 +0800 CST
view 469
Elixir v1.19.0 深度解析:类型系统推断飞跃、编译速度最高4倍提升、OTP 28支持、OpenChain供应链安全认证。从架构原理到生产级代码实战,全面掌握这次重大更新。
Elixir
Phoenix
BEAM
OTP28
函数式编程
Go 1.23 深度解析:性能认知革命与云原生范式的深度适配
编程
Go 1.23 深度解析:性能认知革命与云原生范式的深度适配
2026-05-12 02:28:37 +0800 CST
view 521
深度解析Go 1.23的核心突破:性能认知框架从被动调优转向主动设计、GC P99停顿降低37%(启用gcplineline)、泛型约束简化(T语法)、net/http HTTP/3统一收口、strings/bytes包零分配优化、Windows UTF-8原生支持、GOEXPERIMENT特性(gcplineline/fieldtrack/bignum/rtmlock)、零拷贝切片操作unsafe.String/slice
Go1.23,性能优化,GC,泛型,HTTP/3,标准库,Windows,GOEXPERIMENT,零拷贝,云原生
uv 深度实战:一个 Rust 二进制如何统一 Python 工具链——从 pip 到 poetry 再到 pyenv,一次把 Python 包管理讲透(2026)
编程
uv 深度实战:一个 Rust 二进制如何统一 Python 工具链——从 pip 到 poetry 再到 pyenv,一次把 Python 包管理讲透(2026)
2026-07-14 05:42:24 +0800 CST
view 88
深度拆解 uv:从 Python 工具链碎片化史、Rust 架构(全局缓存/PubGrub 求解/python-build-standalone/uv.lock),到 uv init/add/sync/run/python/uvx/workspaces 全命令实战、CI 与 Docker 多阶段加速,配完整可运行代码与 Astral 生态版图、避坑指南。
uv
Python
包管理
Astral
Rust
依赖管理
Poetry
pyenv
pip
AI Agent 记忆系统 2026 深度拆解:从向量检索到「记忆即基础设施」,一次把长期记忆架构讲透
编程
AI Agent 记忆系统 2026 深度拆解:从向量检索到「记忆即基础设施」,一次把长期记忆架构讲透
2026-07-13 09:44:53 +0800 CST
view 176
深度拆解AI Agent记忆系统2026最新架构:从向量检索、MemGPT层级管理、Graphiti知识图谱到Mem0「记忆即基础设施」实践,配可运行代码与性能横评。
AI Agent
Memory
Mem0
向量检索
知识图谱
RAG
MemGPT
Graphiti
长期记忆
Agent架构
6G通感算智融合架构深度解析:当通信基站进化为「超级智能体」——从协议栈到底层原理的完全指南(2026)
编程
6G通感算智融合架构深度解析:当通信基站进化为「超级智能体」——从协议栈到底层原理的完全指南(2026)
2026-06-09 19:51:27 +0800 CST
view 472
深度解析6G通感算智融合架构:太赫兹通信、通感一体化ISAC、天地一体组网、算力网络协同。含代码示例和架构分析。
6G
通信技术
通感算智融合
ISAC
太赫兹
天地一体
边缘计算
网络架构
低轨卫星
MIMO
小米 MiMo Code 深度解析:从 Max Mode 到四层记忆体系,一次把国产 AI Coding Agent 讲透(2026 深度长文)
编程
小米 MiMo Code 深度解析:从 Max Mode 到四层记忆体系,一次把国产 AI Coding Agent 讲透(2026 深度长文)
2026-07-13 15:43:45 +0800 CST
view 181
深度拆解小米 MiMo Code AI编程助手:从 Max Mode 多采样决策、四层记忆体系、Dynamic Workflow 到插件生态,配完整代码示例与性能基准。
MiMo Code
AI编程助手
Coding Agent
Max Mode
四层记忆体系
OpenCode
MiMo
Bun
TypeScript
AI编程
编程
使用 Go 构建一个简单的负载均衡器
2024-11-19 06:02:08 +0800 CST
view 1837
本文介绍了如何使用Go语言实现一个简单的轮询负载均衡器。负载均衡器通过将流量分配到多个服务器,确保系统的高可用性和可扩展性。文章详细讲解了负载均衡器的结构、轮询算法的实现、健康检查机制以及请求处理的代码示例,帮助读者理解负载均衡器的工作原理。
软件开发
网络编程
系统架构
Agent-Memory 深度解析:当 AI Agent 终于学会「从错误中进化」
编程
Agent-Memory 深度解析:当 AI Agent 终于学会「从错误中进化」
2026-04-09 07:13:25 +0800 CST
view 696
Agent-Memory是一个开源的自进化记忆治理系统,旨在解决传统AIAgent的“会话即遗忘”问题,使其能够从经验中主动学习并改进行为策略。系统通过五层核心组件(事件层、策略层、决策层、治理层、主机内存发布层)实现学习闭环,强调记忆与学习的本质区别,并与GitNexus、MemPalace形成“执行→记忆→进化”的完整能力图谱。项目支持优雅降级和容量护栏设计,适用于长期运行的自动化Agent,推动AI从工具向伙伴进化。
人工智能
开源项目
机器学习
自动化系统
软件架构
template-vue3-gin-fullstack:Vue3+Go Gin前后端分离全栈项目模板,开箱即用
案例
template-vue3-gin-fullstack:Vue3+Go Gin前后端分离全栈项目模板,开箱即用
2026-05-09 10:27:01 +0800 CST
view 464
template-vue3-gin-fullstack:一款基于Vue3+Go Gin的前后端分离全栈项目模板。技术栈涵盖Vue3.4+TypeScript5+Vite5+Pinia+TailwindCSS前端,以及Go1.22+Gin1.9+GORM+PostgreSQL+Redis+JWT+Zap后端。目录分层清晰(Handler/Service/Repository),JWT认证、Swagger文档、GitHub Actions CI/CD全部配好,clone即可开写业务代码。
全栈模板
Vue3
Go Gin
前后端分离
TypeScript
项目架构
CI/CD
GitHub Actions
PostgreSQL
Redis
JWT
Anthropic Claude Science深度解析:多智能体架构如何重塑科研工作流
编程
Anthropic Claude Science深度解析:多智能体架构如何重塑科研工作流
2026-07-05 06:14:18 +0800 CST
view 214
深入解析Anthropic Claude Science的技术架构与工程实现,探讨多智能体协作如何重塑科研工作流。
AI
多智能体
Claude
Anthropic
科研工具
Agent架构
Temporal 深度实战:当分布式工作流从「工程噩梦」变成「写代码一样简单」
编程
Temporal 深度实战:当分布式工作流从「工程噩梦」变成「写代码一样简单」
2026-06-16 08:51:07 +0800 CST
view 283
深入解析 Temporal 分布式工作流引擎:从原理、架构到 Go/TS 生产级实战,涵盖 Workflow 确定性、Activity 设计、Signal/Query、补偿事务、性能优化等核心内容
Temporal
分布式
工作流
Go
微服务
架构设计
Rust 编写微服务网关与零信任实践:2026 云原生安全架构完全指南
编程
Rust 编写微服务网关与零信任实践:2026 云原生安全架构完全指南
2026-05-22 19:45:39 +0800 CST
view 416
深度解析如何使用 Rust 构建高性能、内存安全的微服务网关,并结合零信任理念落地云原生安全实践。包含完整代码示例、架构设计、性能基准测试和企业级案例。
Rust
微服务
零信任
云原生
安全架构
wasm-pack 1.0 深度解析:Rust WASM 端侧计算的内存管理与性能调优实战
编程
wasm-pack 1.0 深度解析:Rust WASM 端侧计算的内存管理与性能调优实战
2026-04-19 08:16:43 +0800 CST
view 605
深度解析 wasm-pack 1.0 发布后 Rust WASM 的内存管理与性能调优实战,涵盖零拷贝传递、内存泄漏防护、WebGPU 结合等技术要点。
WebAssembly
wasm-pack
Rust
性能优化
内存管理
WebGPU
前端架构
Linux 7.1 内核 NTFS 驱动深度解析:3.6 万行代码如何完成 NTFS 的「四年复活」
编程
Linux 7.1 内核 NTFS 驱动深度解析:3.6 万行代码如何完成 NTFS 的「四年复活」
2026-05-09 15:46:09 +0800 CST
view 615
2026年4月17日Linux 7.1内核正式合并全新NTFS驱动,由Namjae Jeon历时四年重构完成,超过3.6万行代码。本文深入解析NTFS文件系统核心设计(MFT、LCN/VCN、LogFile日志机制、B+树目录索引),对比历代Linux NTFS方案的缺陷,剖析新驱动的现代内核架构(iomap、folio),性能测试数据及实际迁移指南。
Linux内核
NTFS
文件系统
内核驱动
文件系统架构
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
2
3
4
5
6
...
16
下一页