Debug到秃头 2 月前 开源研习社 绽放 用 Ollama 跑 Qwen2.5 结果内存炸了 搞了个双卡4090,本地部署 Qwen2.5 32B,Ollama 0.5.4 启动直接占用 48G 显存,跑单轮对话就OOM。查日志发现是默认 context_length 设了 8192,改成2048后降到了36G,能跑但慢。有老哥试过 vLLM + 量化版本吗?求个能稳定跑32B的配置。 阅读更多 4 1 250 1条讨论
下次一定改 2 月前 开源研习社 成长 试了OpenCV的onnx推理,比想象中快 把之前训练的yolov8模型转成onnx,用OpenCV DNN模块直接在C++里跑推理,比用Python快了一截。有人试过用GPU加速吗?我试了OpenVINO后端但报了个段错误。代码在这:https://github.com/opencv/opencv_zoo/tree/master/models/object_detection_yolov8 阅读更多 5 1 479 1条讨论
paper难产中 2 月前 开源研习社 绽放 跑个RAG小项目玩玩,有坑记录一下 试了试 LangChain 的 RAPTOR 项目,想搞个多层次的摘要检索,结果文档递归切得太碎,召回反而下降了。官方给的例子是 PDF,换成自己爬的网页数据,还得加个 Markdown 解析器。GitHub 地址:https://github.com/parthsarthi03/raptor,有谁跑过这坑?实验还没跑完,先来吐个槽。 阅读更多 4 1 383 1条讨论
Momo摸鱼画手 2 月前 开源研习社 绽放 SD WebUI 又报错了? 看到个叫 ComfyUI 的节点式工具,跟 WebUI 思路完全不一样,有人试过吗?部署踩坑多不多? 阅读更多 5 3 498 3条讨论
谨言慎行plus 2 月前 开源研习社 成长 WhisperX转写50分钟播客,时间戳对不上 试了WhisperX做语音转写带说话人分离,docker跑起来挺顺,但长音频时间戳总偏移几秒。官方说支持batch处理,我改了下参数还是偏。https://github.com/m-bain/whisperX 有人遇到过这种对齐问题吗? 阅读更多 5 3 505 3条讨论
路过点个赞 2 月前 开源研习社 绽放 用SillyTavern跑本地大模型,踩了个坑 最近试了下SillyTavern这个开源项目,用来跟本地跑的大模型聊天,支持多种后端。部署其实挺简单,拉个docker-compose文件就行。结果我卡在API地址配置上了,默认的localhost在容器里跑不通,改成host网络模式就解决了。项目地址:github.com/SillyTavern/SillyTavern,要是你也搞过这个,求个字符画配置的坑点 阅读更多 2 1 320 1条讨论
P值小于0.05 2 月前 开源研习社 成长 给模型加RAG,试了LangChain+Qdrant 最近在搞本地知识库,用LangChain搭了个RAG流水线,向量库选了Qdrant,docker跑起来挺快。GitHub上有个叫 langchain-chatchat 的项目,部署脚本直接拉镜像就行,少踩点坑。传送门踩坑点:Qdrant默认端口6333容易和别的服务冲突,改成6334就稳了。另外文档分块chunk_size设512效果比1024好,样本量200+测试结果,F1高了0.03。想搞多轮对话还得自己接memory,有点烦。 阅读更多 5 6 476 6条讨论
十万加在逃 2 月前 开源研习社 绽放 自建AI图库:Ollama+ComfyUI 最近在搞本地部署的AI图库,主要是用Ollama跑模型+ComfyUI做节点编排,比在线工具自由多了。项目地址:https://github.com/ollama/ollama 配合ComfyUI的教程网上挺多,但部署时卡在显卡驱动上,折腾了两天才跑通。有老哥踩过这个坑没? 阅读更多 4 4 339 4条讨论
粉笔没落灰 2 月前 开源研习社 绽放 刚搭了个AI改作文的小工具 班上孩子作文老写不好,我琢磨着搭个本地AI批改,试了试Open-WebUI搭本地大模型,感觉还行。GitHub上有个叫TeachMate的项目,能基于LLaMA跑作文评分和修改建议,部署用Docker挺顺的,就是中文支持得调一下prompt。链接:https://github.com/iuricode/TeachMate 有坑分享:记得多写几个样例让模型学,不然评语太模板化。 阅读更多 3 5 360 5条讨论
甲方爸爸醒醒 2 月前 开源研习社 成长 折腾了三天,终于搞定了这个AI图片放大项目 最近在搞一个叫Real-ESRGAN的开源项目,专门用来把模糊老照片放大修复的。GitHub链接:https://github.com/xinntao/Real-ESRGAN。装的时候踩了个坑,Python版本得3.8以上,不然依赖报错。我是用conda建虚拟环境装的,然后下预训练模型,跑起来效果还行,就是显存吃挺狠。想搞个本地版的可以试试这个顺序:先装torch,再装依赖,最后下模型文件。有兄弟遇到过类似问题吗? 阅读更多 5 1 338 1条讨论
甲方爸爸醒醒 2 月前 开源研习社 成长 手残党也能跑的AI抠图项目 刚试了briaai的RMBG v1.4,开源模型把图片背景抠得贼干净。部署就一个pip install加几行Python代码,MacBook都能跑。GitHub搜RMBG-1.4就能找到,别下错那个2.0的商用版。我测试时发现输入图片别太大,不然内存直接炸。 阅读更多 3 4 472 4条讨论
周末补作业 2 月前 开源研习社 成长 刚试了个开源语音克隆,效果还行 就这个叫“GPT-SoVITS”的项目,昨天在GitHub上看到的,自己搭了个环境试了试。 我拿自己录了几句正常说话的声音训了大概半小时,生成出来的rap片段音色还原度能到七八成吧,就是情绪控制还差点意思。 有搞过的老哥没?你们数据集一般清多久的能稳? 阅读更多 4 2 231 2条讨论