程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
浏览器AI 相关技术文章
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
WebLLM:用 WebGPU 把 LLM 跑进浏览器,以及几个容易被忽略的实现细节
编程
WebLLM:用 WebGPU 把 LLM 跑进浏览器,以及几个容易被忽略的实现细节
2026-10-07 00:04:02
WebLLM 是浏览器内 LLM 推理引擎,靠 WebGPU 在本地跑 Llama/Qwen/Mistral 等模型,兼容 OpenAI API。这篇按 README 梳理接入流程与几处易踩的工程细节:四种缓存后端的选择与 opfs 报错、Service Worker 引擎的 handler 顶层实例化与心跳保活、SRI 完整性校验、自定义模型字段,以及从源码编译 TVMjs 时为什么不能用最新 emcc。
Browser
AI
浏览器AI
WebLLM
WebGPU
浏览器侧推理
gemma-gem:Chrome 扩展本地运行 Gemma 4,还能操作网页
编程
gemma-gem:Chrome 扩展本地运行 Gemma 4,还能操作网页
2026-09-05 19:00:02
介绍 gemma-gem 这个 Chrome 扩展:将 Google Gemma 4 模型通过 WebGPU 在浏览器本地运行,无需 API Key,内置 6 个浏览器工具可读取页面、点击元素、填写表单、执行 JavaScript,支持 E2B/E4B 模型切换和思考模式,适合隐私敏感场景。
gemma-gem
Gemma 4
Chrome扩展
WebGPU
浏览器AI
本地推理
Transformers.js:浏览器端直接跑700多个AI模型,无需后端服务器
编程
Transformers.js:浏览器端直接跑700多个AI模型,无需后端服务器
2026-09-05 18:44:40
介绍 Transformers.js 这个浏览器端机器学习库:基于 ONNX Runtime 在客户端运行 Transformer 模型,覆盖 NLP、CV、音频和多模态任务,支持 700 多个模型,无需服务器部署,Star 数已破万。
Transformers.js
浏览器AI
机器学习
JavaScript
WebAssembly 3.0 深度实战:64位地址空间 + GC + 组件模型——从浏览器沙箱到通用计算平台的终极进化
编程
WebAssembly 3.0 深度实战:64位地址空间 + GC + 组件模型——从浏览器沙箱到通用计算平台的终极进化
2026-08-16 16:47:10
深度拆解 WebAssembly 3.0 三大核心特性:64位地址空间打破4GB内存天花板、原生GC让Kotlin/Python告别臃肿运行时、组件模型+WA
WebAssembly
Wasm 3.0
Wasm64
WasmGC
组件模型
WASI 3.0
WASIP2
WIT
边缘计算
浏览器AI
Serverless
插件系统
Timeline Studio 深度实战:浏览器正在成为最强大的 AI 视频工作站——从 WebCodecs、WebGPU 到 ONNX 推理的全栈架构解析
编程
Timeline Studio 深度实战:浏览器正在成为最强大的 AI 视频工作站——从 WebCodecs、WebGPU 到 ONNX 推理的全栈架构解析
2026-07-22 13:20:35
深度拆解 Timeline Studio(ai-video-editor):纯浏览器端 AI 视频编辑器。涵盖 WebCodecs、WebGPU、ONNX Runtime Web 推理引擎、Chrome Gemini Nano、多轨时间线架构、Codex Agent Skill,配完整代码示例与性能优化指南。
WebCodecs
WebGPU
ONNX
浏览器AI
视频编辑
Whisper
React
前端工程
ONNX Runtime
离线优先
WebGPU 计算管线深度拆解:当浏览器开始「直接调用 GPU 算力」——从 WGSL 计算着色器、Storage Buffer 到浏览器端 GPGPU 与 AI 推理的工程全貌(2026)
编程
WebGPU 计算管线深度拆解:当浏览器开始「直接调用 GPU 算力」——从 WGSL 计算着色器、Storage Buffer 到浏览器端 GPGPU 与 AI 推理的工程全貌(2026)
2026-07-19 02:43:47
深度拆解 WebGPU 计算管线:从 WGSL 计算着色器、Storage Buffer、workgroup 共享内存,到矩阵乘法 tiling、图像卷积、真实 GPU 基准对比,并落地浏览器端大模型推理(WebLLM/ONNX Runtime Web)。
WebGPU
GPGPU
WGSL
计算管线
浏览器AI
GPU计算
当 WASM 遇上 WebGPU:浏览器端 AI 推理的第三次革命——用 Web 技术重写本地智能的心智模型
编程
当 WASM 遇上 WebGPU:浏览器端 AI 推理的第三次革命——用 Web 技术重写本地智能的心智模型
2026-07-15 14:17:19
深度拆解 2026 年 WebGPU、WASM 与 WebNN 融合技术:三层计算模型、WGSL 编写、GEMM 量化推理、KV Cache、算子融合,配完整代码与性能基准。
WebGPU
WASM
WebNN
浏览器AI
WGSL
端侧推理
WebLLM
前端工程化
谷歌 LiteRT.js 深度实战:当 WebAssembly + WebGPU 重写 TensorFlow.js 的心脏,浏览器 AI 推理提速 3 倍背后的技术真相
编程
谷歌 LiteRT.js 深度实战:当 WebAssembly + WebGPU 重写 TensorFlow.js 的心脏,浏览器 AI 推理提速 3 倍背后的技术真相
2026-07-11 14:16:10
2026年7月谷歌发布LiteRT.js,用WebAssembly+WebGPU/WebNN替代TensorFlow.js的JavaScript内核,M4 MacBook Pro上推理速度提升3倍。本文深度拆解架构设计、性能优化原理、迁移路径与实战代码。
LiteRT.js
WebGPU
WebNN
WebAssembly
TensorFlow.js
浏览器AI
机器学习
前端
LiteRT.js 深度解析:Google 为什么要在 2026 年"革"掉 TensorFlow.js 的命?
编程
LiteRT.js 深度解析:Google 为什么要在 2026 年"革"掉 TensorFlow.js 的命?
2026-07-10 12:18:19
2026年7月9日Google发布LiteRT.js取代TensorFlow.js,WebGPU+WebNN+WebAssembly三剑合璧带来3倍性能提升。本文深度剖析底层架构、与TensorFlow.js的全面对比、生产级代码示例及性能调优实战。
LiteRT.js
TensorFlow.js
WebGPU
WebNN
WebAssembly
浏览器AI
前端机器学习
性能优化
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
python
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调