资源Soup:4GB 笔记本 GPU 微调 8B 模型的开源新方案 辉哥 发布于 2026-08-05 收录于 免费资源与机会📌 微调 8B 大模型的最低门槛,被一个开源项目拉到了 4GB 显存——普通笔记本 GPU 就能跑。这不是魔法,是 layer streaming 技术。看完这篇,你可以在自己的电脑上微调一个专属模型。 ...
资源本地语音 Agent 从零搭:用开源模型跑通语音对话 辉哥 发布于 2026-07-31 收录于 免费资源与机会📌 一句话导读:不想把语音交给云端?Hugging Face 的 speech-to-speech 项目让你用开源模型在本地跑通「听→想→说」全链路,隐私和成本都留在自己机器上。 ...
AILM Studio Bionic 上手:零成本部署你自己的 AI Agent 辉哥 发布于 2026-07-19 收录于 实用工具与脚本📌 2026 年 7 月 17 日发布,LM Studio Bionic 把 AI Agent 从「有钱人俱乐部」(一次任务 $2-5)变成了「自己电脑上免费跑」的东西。支持 GLM 5.2、Kimi K2.7、Qwen 等开源模型,编程、文档处理、复杂研究全搞定。 ...
AI2026本地部署LLM实战:从硬件选型到推理全链路 辉哥 发布于 2026-07-12 收录于 AI 智能体实践📌 本地跑大模型不是省钱——是为了数据不出本机。这篇从GPU怎么选到框架怎么配,一篇文章让你在本机跑起生产可用的大模型。 ...
资源GLM-5.2 零成本部署指南:从 Cloudflare Workers AI 到本地 RTX 4090 辉哥 发布于 2026-06-27 收录于 免费资源与机会写在前面 2026年6月17日,智谱正式上线并开源了GLM-5.2——这意味着你能零成本拿到Code Arena全球盲测第一名的模型能力。本文不罗嗦,直接给你三条上桌路径。 ...
资源普通显卡玩转LTX-2.3免费本地音视频生成 辉哥 发布于 2026-03-26 收录于 免费资源与机会LTX-2.3-GGUF 是以色列 Lightricks 开源的 19B/22B 级原生音视频同步生成模型 LTX-2.3 的 GGUF 量化版,核心价值是用 8–12GB 显存就能本地跑通高质量文生视频/图生视频+同步音频,大幅降低硬件门槛,质量损失极小。 ...
AI手把手教程:在Windows和Ubuntu上部署高性能本地AI大模型引擎llama.cpp 辉哥 发布于 2026-03-16 收录于 实用工具与脚本llama.cpp 是轻量级、高性能的本地 LLM 推理引擎,纯 C/C++ 实现,无冗余依赖,支持 GGUF 模型量化、多硬件加速(CPU/GPU)、多模态推理,是本地部署翻译 / 对话类 LLM 的核心工具。 ...