程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
本地AI 相关技术文章
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
Parlor:本地端到端语音视觉 AI 助手,M3 Pro 即可实时运行
编程
Parlor:本地端到端语音视觉 AI 助手,M3 Pro 即可实时运行
2026-09-05 19:00:05
介绍 Parlor 这个本地语音视觉 AI 助手:用 Gemma 4 E2B 做多模态理解、Kokoro 做语音合成,在 Apple Silicon 或 Linux GPU 上实现实时对话,支持随时打断、整句边说边播、多语言混合,完全本地运行无需 API Key,9 天获 1.5K Star。
Parlor
本地AI
语音助手
多模态
Gemma 4
Kokoro
Apple Silicon
Ollama App:连接本地AI模型的跨平台聊天客户端,数据完全离线
编程
Ollama App:连接本地AI模型的跨平台聊天客户端,数据完全离线
2026-09-05 18:58:25
介绍Ollama App这款基于Flutter开发的跨平台AI客户端,可连接本地运行的Ollama服务器,所有对话数据仅在局域网内传输不上传云端,支持Windows、Linux、Android,具备语音聊天和模型下载功能,GitHub已获1K Star。
Ollama App
本地AI
Flutter
跨平台客户端
LocalAI:兼容OpenAI API的本地AI运行方案,无需GPU即可跑大模型,28.6K Star
编程
LocalAI:兼容OpenAI API的本地AI运行方案,无需GPU即可跑大模型,28.6K Star
2026-09-05 18:58:02
介绍LocalAI这个完全开源的OpenAI替代方案,遵循OpenAI API规范,可在普通消费级硬件上无需GPU运行大语言模型、图像和音频生成,支持LLaMA、Stable Diffusion等多种模型,数据全部本地处理,GitHub已获28.6K Star。
LocalAI
本地AI
OpenAI兼容
大语言模型
Muse Glimmer 30B 深度拆解:Meta「真开源」旗舰Agent模型如何用一块显卡颠覆本地AI工作流
编程
Muse Glimmer 30B 深度拆解:Meta「真开源」旗舰Agent模型如何用一块显卡颠覆本地AI工作流
2026-08-14 09:44:53
深度拆解Meta开源的Muse Glimmer 30B端侧Agent模型:从稠密Transformer架构、1.8B ViT-G/14视觉编码器,到4-bit GGUF量化、DFlash推测性解码,再到Ollama一键部署、配完整代码实战与15条生产踩坑清单
Muse Glimmer
Meta
Agent模型
本地AI
开源LLM
量化部署
Function Calling
多模态
Rust + ACP + MCP:Block 开源的 Goose 如何用三层架构重塑本地 AI Agent——开源、可扩展、任意 LLM 的命令行分身深度拆解
编程
Rust + ACP + MCP:Block 开源的 Goose 如何用三层架构重塑本地 AI Agent——开源、可扩展、任意 LLM 的命令行分身深度拆解
2026-08-08 14:16:43
深度拆解 Block 开源的 Goose:Rust 编写的本地 AI Agent 框架,Linux 基金会托管,支持 15+ LLM 提供商、70+ MCP 扩展。剖析 Rust + Tokio + Axum 高性能运行时、三层汉堡架构、ACP/MCP 协议关系、五大实战场景、安全隐私机制。
Goose
AI Agent
Rust
MCP
ACP
本地AI
Linux Foundation
Goose 深度拆解:当 Block 决定「把 AI Agent 变成你的命令行分身」——Rust + ACP + MCP 三层架构如何重新定义本地 AI 执行Agent的终极形态
编程
Goose 深度拆解:当 Block 决定「把 AI Agent 变成你的命令行分身」——Rust + ACP + MCP 三层架构如何重新定义本地 AI 执行Agent的终极形态
2026-08-08 14:16:12
深度拆解 Block 开源的 Goose:Rust 编写的本地 AI Agent 框架,Linux 基金会托管,支持 15+ LLM 提供商、70+ MCP 扩展。剖析 Rust + Tokio + Axum 高性能运行时、三层汉堡架构、ACP/MCP 协议关系、五大实战场景、安全隐私机制,以及与 Claude Code、Devin 的横向对比。
Goose
AI Agent
Rust
MCP
ACP
本地AI
Linux Foundation
微软给 Node.js 发了张 Windows「原生通行证」:动态 WinRT 语言投影深度拆解——从 .winmd 元数据到 Phi Silica 本地 AI 调用
编程
微软给 Node.js 发了张 Windows「原生通行证」:动态 WinRT 语言投影深度拆解——从 .winmd 元数据到 Phi Silica 本地 AI 调用
2026-07-30 12:44:31
深度拆解微软 2026 年 7 月发布的 Node.js 动态 WinRT 语言投影:.winmd 元数据驱动、共享运行时架构、免编译调用 Windows 原生 API,附 Electron 原生通知与 Phi Silica 本地 AI 实战,及与 NodeRT/FFI/N-API 路线对比。
Node.js
WinRT
Electron
语言投影
Windows开发
Phi Silica
本地AI
N-API
TypeScript
微软
本地优先的 AI 会议助手工程实战:从实时流式 ASR 到零云端 LLM 摘要全链路拆解
编程
本地优先的 AI 会议助手工程实战:从实时流式 ASR 到零云端 LLM 摘要全链路拆解
2026-07-10 04:42:09
以 GitHub Trending 榜首 Meetily 为引,从零手搓本地优先的 AI 会议助手:麦克风采集、Silero VAD 切句、faster-whisper 流式转写、pyannote 说话人分离、Ollama 本地 LLM 摘要,含可运行代码与量化/延迟/内存优化。
本地AI
会议助手
语音识别
Whisper
Ollama
隐私计算
实时转录
SQLite-Vec 深度实战:当嵌入式数据库学会了向量搜索——从本地 RAG 到端侧 AI 应用的生产级完全指南(2026)
编程
SQLite-Vec 深度实战:当嵌入式数据库学会了向量搜索——从本地 RAG 到端侧 AI 应用的生产级完全指南(2026)
2026-06-21 10:26:56
SQLite-Vec 完全指南:让嵌入式数据库拥有向量搜索能力。从架构原理到代码实战,详解本地 RAG 系统、向量索引优化、端侧部署方案,附带完整可运行代码。
SQLite
向量数据库
RAG
AI
嵌入式数据库
sqlite-vec
本地AI
llama.cpp 深度实战:当 C/C++ 重写遇见端侧 LLM 推理——从 GGUF 量化到 Apple Silicon 38 tokens/s 的生产级完全指南(2026)
编程
llama.cpp 深度实战:当 C/C++ 重写遇见端侧 LLM 推理——从 GGUF 量化到 Apple Silicon 38 tokens/s 的生产级完全指南(2026)
2026-06-16 01:17:28
llama.cpp 是端侧 LLM 推理的事实标准(180K+ Stars)。本文从源码架构、GGUF 格式、量化方法、跨平台后端、生产部署、性能优化到 DeepSeek V4 Flash 实战,全方位讲解本地 AI 推理。
llama.cpp
GGUF
量化
端侧推理
本地AI
C/C++
Apple Silicon
Odysseus 深度实战:当 AI 工作空间学会「自托管」——从 PewDiePie 55K Star 爆款到本地私有 AI 全链路生产级完全指南[2026 年 6 月]
编程
Odysseus 深度实战:当 AI 工作空间学会「自托管」——从 PewDiePie 55K Star 爆款到本地私有 AI 全链路生产级完全指南[2026 年 6 月]
2026-06-15 05:19:17
2026年5月底PewDiePie开源Odysseus自托管AI工作空间,48小时23K+Star。本文从架构、部署、实战、安全四个维度,完整拆解这款本地私有AI全链路生产级完全指南。
AI
自托管
开源
GitHub
Odysseus
本地AI
MCP协议
Odysseus 深度实战:当 AI 工作空间学会「自托管」——从 PewDiePie 55K Star 爆款到本地私有 AI 全链路生产级完全指南(2026)
编程
Odysseus 深度实战:当 AI 工作空间学会「自托管」——从 PewDiePie 55K Star 爆款到本地私有 AI 全链路生产级完全指南(2026)
2026-06-15 05:17:47
2026年5月底PewDiePie开源Odysseus自托管AI工作空间,48小时23K+Star。本文从架构、部署、实战、安全四个维度完整拆解。
AI
自托管
开源
GitHub
Odysseus
本地AI
MCP
Odysseus 深度实战:当 YouTuber 之王用 Python 重写「AI 工作台」——从 FastAPI 微服务到 MCP Agent 与 ChromaDB 记忆系统的生产级完全指南(2026)
编程
Odysseus 深度实战:当 YouTuber 之王用 Python 重写「AI 工作台」——从 FastAPI 微服务到 MCP Agent 与 ChromaDB 记忆系统的生产级完全指南(2026)
2026-06-14 15:50:01
深度剖析 PewDiePie 开源的 Odysseus 自托管 AI 工作空间:从 FastAPI 微服务架构到 MCP Agent 系统与 ChromaDB 记忆系统,含完整部署实战与性能优化指南
Odysseus
self-hosted
AI workspace
FastAPI
MCP
ChromaDB
Agent
自托管
本地AI
Deep Research
DiffusionGemma 深度实战:当文本扩散重新定义本地AI推理——从'打字机'到'印刷机'的4倍速架构革命
编程
DiffusionGemma 深度实战:当文本扩散重新定义本地AI推理——从'打字机'到'印刷机'的4倍速架构革命
2026-06-12 17:21:39
2026年6月Google发布DiffusionGemma,首个生产级文本扩散大模型,本地推理速度提升4倍。本文深入剖析其从自回归到并行生成的架构革命,附完整代码实战。
DiffusionGemma
文本扩散
本地AI
Gemma
大模型推理
扩散模型
Python
Ollama
Google AI Edge Gallery 深度实战:让 Mac/Android 离线运行 Gemma 3——从原理到生产级本地 AI 部署完全指南(2026)
编程
Google AI Edge Gallery 深度实战:让 Mac/Android 离线运行 Gemma 3——从原理到生产级本地 AI 部署完全指南(2026)
2026-06-04 21:14:37
深入剖析 Google AI Edge Gallery 的技术架构、Gemma 模型家族、端侧部署全流程,并通过完整代码示例,带你从零构建一个生产级本地 AI 应用。
Google AI Edge Gallery
本地AI
Gemma模型
端侧推理
Mac AI
Android AI
OpenHuman 深度实战:Rust+Tauri 构建本地优先的 AI 桌面助手——Memory Tree 持久记忆与 118+ 集成完全指南(2026)
编程
OpenHuman 深度实战:Rust+Tauri 构建本地优先的 AI 桌面助手——Memory Tree 持久记忆与 118+ 集成完全指南(2026)
2026-05-30 21:11:41
OpenHuman 用 Rust+Tauri 构建本地优先的 AI 桌面助手,通过 Memory Tree 持久记忆和 118+ 集成让 Agent 拥有跨会话长期记忆。本文从架构原理到生产级部署完整拆解。
OpenHuman
Rust
Tauri
AI桌面助手
Memory Tree
知识图谱
本地AI
Local-File-Organizer 深度解析:3K Stars 本地 AI 文件整理,Llama3.2+LLaVA 完全离线运行
编程
Local-File-Organizer 深度解析:3K Stars 本地 AI 文件整理,Llama3.2+LLaVA 完全离线运行
2026-05-15 12:22:33
深入解析 3K Stars 的 Local-File-Organizer:基于 Llama3.2 3B + LLaVA-v1.6 双模型的本地 AI 文件整理工具,使用 Nexa SDK 实现 100% 离线推理,自动识别文件内容、智能分类重命名、支持图片视觉分析和文档内容解析,零数据外泄。
Local-File-Organizer
AI文件整理
Llama3
LLaVA
本地AI
隐私
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
python
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调