平替猎人 4 月前 开源研习社 成长 Ollama 0.5 跑 DeepSeek-R1 显存占用实测 刚在 8G 显存卡上用 Ollama 0.5 试跑 DeepSeek-R1 7B Q4,加载完直接吃掉 7.6G,生成第一句就崩到 OOM。有人试过更低量化版本的配置吗?比如 Q3_K_S?感觉 8G 卡根本跑不动官方推荐的 7B 模型,还是得换 GGUF 量化版? 阅读更多 1 1 289 1条讨论
深夜改BUG 4 月前 开源研习社 绽放 把 Whisper 弄成实时语音转文字了 花了两天把 OpenAI Whisper 的 large-v3 部署到本地 GPU 上,配合 silero-vad 做语音活动检测,延迟大概 500ms 左右。之前以为得用付费 API 才能做到实时,没想到开源版自己搭也挺稳的。有踩过坑的兄弟没?我主要卡在模型加载时的显存优化上——你们是用 FP16 还是 INT8 量化的?GitHub 链接:github.com/openai/whisperVAD 组件:github.com/snakers4/silero-vad 阅读更多 5 6 516 6条讨论
法务别找我 4 月前 开源研习社 绽放 私藏个能白嫖的AI抠图工具 最近扒拉到一个叫 rembg 的开源项目,Python 写的,一行命令就能本地跑图片去背景。效果比那些在线收费的还干净,github 搜 rembg 就有,部署就 pip install,适合不想交智商税的朋友。 阅读更多 5 6 437 6条讨论
摸鱼不划水 4 月前 开源研习社 成长 Stable Diffusion WebUI 显存爆了咋整 刚试了 automatic1111 的 webui,8G 显存跑 512x512 都能爆,服了。翻了半天 issue 说加 --medvram 能苟一苟,试了确实能跑但慢得想骂人。有老哥肉身踩过坑不?求个靠谱优化姿势。 阅读更多 1 2 430 2条讨论
Debug到秃头 4 月前 开源研习社 绽放 用 Ollama 跑 Qwen2.5 结果内存炸了 搞了个双卡4090,本地部署 Qwen2.5 32B,Ollama 0.5.4 启动直接占用 48G 显存,跑单轮对话就OOM。查日志发现是默认 context_length 设了 8192,改成2048后降到了36G,能跑但慢。有老哥试过 vLLM + 量化版本吗?求个能稳定跑32B的配置。 阅读更多 4 1 268 1条讨论
下次一定改 4 月前 开源研习社 成长 试了OpenCV的onnx推理,比想象中快 把之前训练的yolov8模型转成onnx,用OpenCV DNN模块直接在C++里跑推理,比用Python快了一截。有人试过用GPU加速吗?我试了OpenVINO后端但报了个段错误。代码在这:https://github.com/opencv/opencv_zoo/tree/master/models/object_detection_yolov8 阅读更多 5 1 494 1条讨论
paper难产中 4 月前 开源研习社 绽放 跑个RAG小项目玩玩,有坑记录一下 试了试 LangChain 的 RAPTOR 项目,想搞个多层次的摘要检索,结果文档递归切得太碎,召回反而下降了。官方给的例子是 PDF,换成自己爬的网页数据,还得加个 Markdown 解析器。GitHub 地址:https://github.com/parthsarthi03/raptor,有谁跑过这坑?实验还没跑完,先来吐个槽。 阅读更多 4 1 398 1条讨论
Momo摸鱼画手 4 月前 开源研习社 绽放 SD WebUI 又报错了? 看到个叫 ComfyUI 的节点式工具,跟 WebUI 思路完全不一样,有人试过吗?部署踩坑多不多? 阅读更多 5 3 513 3条讨论
谨言慎行plus 4 月前 开源研习社 成长 WhisperX转写50分钟播客,时间戳对不上 试了WhisperX做语音转写带说话人分离,docker跑起来挺顺,但长音频时间戳总偏移几秒。官方说支持batch处理,我改了下参数还是偏。https://github.com/m-bain/whisperX 有人遇到过这种对齐问题吗? 阅读更多 5 3 522 3条讨论
路过点个赞 4 月前 开源研习社 绽放 用SillyTavern跑本地大模型,踩了个坑 最近试了下SillyTavern这个开源项目,用来跟本地跑的大模型聊天,支持多种后端。部署其实挺简单,拉个docker-compose文件就行。结果我卡在API地址配置上了,默认的localhost在容器里跑不通,改成host网络模式就解决了。项目地址:github.com/SillyTavern/SillyTavern,要是你也搞过这个,求个字符画配置的坑点 阅读更多 2 1 336 1条讨论
P值小于0.05 4 月前 开源研习社 绽放 给模型加RAG,试了LangChain+Qdrant 最近在搞本地知识库,用LangChain搭了个RAG流水线,向量库选了Qdrant,docker跑起来挺快。GitHub上有个叫 langchain-chatchat 的项目,部署脚本直接拉镜像就行,少踩点坑。传送门踩坑点:Qdrant默认端口6333容易和别的服务冲突,改成6334就稳了。另外文档分块chunk_size设512效果比1024好,样本量200+测试结果,F1高了0.03。想搞多轮对话还得自己接memory,有点烦。 阅读更多 5 6 493 6条讨论
十万加在逃 4 月前 开源研习社 绽放 自建AI图库:Ollama+ComfyUI 最近在搞本地部署的AI图库,主要是用Ollama跑模型+ComfyUI做节点编排,比在线工具自由多了。项目地址:https://github.com/ollama/ollama 配合ComfyUI的教程网上挺多,但部署时卡在显卡驱动上,折腾了两天才跑通。有老哥踩过这个坑没? 阅读更多 4 4 354 4条讨论
粉笔没落灰 4 月前 开源研习社 绽放 刚搭了个AI改作文的小工具 班上孩子作文老写不好,我琢磨着搭个本地AI批改,试了试Open-WebUI搭本地大模型,感觉还行。GitHub上有个叫TeachMate的项目,能基于LLaMA跑作文评分和修改建议,部署用Docker挺顺的,就是中文支持得调一下prompt。链接:https://github.com/iuricode/TeachMate 有坑分享:记得多写几个样例让模型学,不然评语太模板化。 阅读更多 3 5 378 5条讨论
甲方爸爸醒醒 4 月前 开源研习社 成长 折腾了三天,终于搞定了这个AI图片放大项目 最近在搞一个叫Real-ESRGAN的开源项目,专门用来把模糊老照片放大修复的。GitHub链接:https://github.com/xinntao/Real-ESRGAN。装的时候踩了个坑,Python版本得3.8以上,不然依赖报错。我是用conda建虚拟环境装的,然后下预训练模型,跑起来效果还行,就是显存吃挺狠。想搞个本地版的可以试试这个顺序:先装torch,再装依赖,最后下模型文件。有兄弟遇到过类似问题吗? 阅读更多 5 1 353 1条讨论
甲方爸爸醒醒 4 月前 开源研习社 成长 手残党也能跑的AI抠图项目 刚试了briaai的RMBG v1.4,开源模型把图片背景抠得贼干净。部署就一个pip install加几行Python代码,MacBook都能跑。GitHub搜RMBG-1.4就能找到,别下错那个2.0的商用版。我测试时发现输入图片别太大,不然内存直接炸。 阅读更多 3 4 486 4条讨论