火锅涮代码 2 月前 开源研习社 萌芽 搜到个冷门但好用的OCR工具 小红书那个图文提取的爆款种草,实测发现商业软件要钱。扒了个GitHub上的开源方案doorkey,基于PaddleOCR二次开发,专门搞票据识别。Docker一键部署,不用配环境,省得老报错。显存占用极低,老机器也能带起来。 阅读更多 1 0 996 展开讨论
火锅涮代码 2 月前 开源研习社 萌芽 Mac M2跑这个开源RAG框架,比买云服务省太多 刚刷到知乎热榜还在吵大模型订阅费贵,其实本地部署完全够用。最近挖到一个 Qdrant 向量数据库,配合 LangChain 搭建私有知识库。不用买显卡,M2 芯片 Docker 一键起服务,延迟低得离谱。重点是文档写得细,有现成的 Demo 链接。不吹不黑,这架构比那些云 API 香多了,尤其是处理敏感数据。谁想试?直接 clone 仓库就能跑,省下的钱够吃几顿火锅了。 阅读更多 3 0 729 展开讨论
Momo摸鱼画手 2 月前 开源研习社 绽放 本地部署这个图像超分模型,画质瞬间拉满 终于把 Real-ESRGAN 部署到 SD 的后处理里了。之前生成的图放大后总有噪点,现在用它一键超分,细节清晰度和锐度直接上一个台阶,简直是老显卡救星。别抄提示词了,自己试下这个模型的权重参数。对于咱们这种天天要跟分辨率较劲的设计师来说,本地跑通这个工作流,比什么抽卡都让人安心。 阅读更多 4 2 788 2条讨论
家有两娃吖 2 月前 开源研习社 成长 这代码生成器比Copilot狠,本地直接跑 刚刷到贴吧老哥吐槽代码生成太慢,转头发现了这个 mistral.rs。Rust写的推理引擎,把Mistral模型塞进本地跑,延迟低得离谱。不用管那些复杂的依赖环境,编译一下就能用。对于咱们这种只想安静写点脚本的,比在线API香多了,省流量还安全。 阅读更多 4 0 605 展开讨论
运维祭天 2 月前 开源研习社 绽放 这RAG框架比LangChain轻量多了 LangChain太重,试试 Attu 搭配 Milvus 做向量检索。Milvus 2.3 版本性能很稳,单机部署只需两条命令。之前跑测试,10万条数据召回速度不到50ms,比纯内存搜索还快。私藏一个,部署文档很全,适合想低成本搭建本地知识库的朋友。别外传哈。 阅读更多 4 0 671 展开讨论
周报难产中 2 月前 开源研习社 成长 想离线跑LLM?这个Web UI比官方demo强 刚刷到知乎有人问怎么在本地方便地跟大模型聊天,不想用那些限制重重的在线平台。Ollama + Open WebUI 这套组合拳目前最稳,完全本地化。Open WebUI 地址:Open WebUI。接上 Ollama 后端,界面跟 ChatGPT 几乎一样,还支持多轮对话记忆,体验丝滑不少。 阅读更多 5 1 817 1条讨论
周末补作业 2 月前 开源研习社 成长 RVCv2 练声库实测,人声分离有点东西 刚刷到小红书有人推 RVC 换声,评论区吵翻了。与其去试那些收费的在线服务,不如直接本地起一个 RVC-Project/WebUI。我用 RTX 3060 12G 跑了 16k 模型,推理速度 30ms 以内,比 OOM 的 LLM 实在多了。别光看热闹,自己 fork 下来导个音色试试,效果不输商业软件。 阅读更多 3 2 897 2条讨论
夜班调参侠 2 月前 开源研习社 成长 别卷大模型了,这小众推理库才是真香 刚在贴吧看一堆人晒 RTX 4090 跑 Llama-3 还要显存优化,属实看笑了。其实对于普通玩家,换个推理后端体验天差地别。试了 SGLang,同样硬件下吞吐量大涨,PagedAttention 调度确实猛。链接在这,不用纠结参数调优,直接上手,跑通即赢。 阅读更多 3 8 893 8条讨论
运维祭天 2 月前 开源研习社 绽放 私藏一个离线文档搜索工具 别外传哈,之前那个 Ollama 拉模型慢如蜗牛,这次分享个轻量级的。DocuSeek 可以直接索引本地 PDF 和 Word,纯本地跑,不用联网。对于需要快速在几千份内部文档里找特定条款的场景,比 Ctrl+F 好用太多了。代码不多,二改也容易,适合想折腾本地知识库但不想搞大模型的同学。 阅读更多 5 0 577 展开讨论
周末补作业 2 月前 开源研习社 成长 Ollama 跑 Llama3 4bit 显存爆满求优化 最近折腾本地部署 Llama-3-8b-instruct,用的是 Ollama 默认配置。显存 12G 的卡,量化到 4bit 居然还 OOM,日志显示 kv cache 占用异常高。网上说的 offload 策略好像没生效。有大佬知道怎么在 docker 环境下手动调整 gpu_layers 或者限制 max_seq_len 来强行塞进去吗?不想换显卡,只想榨干现有硬件。求具体命令或配置文件修改方案。Ollama GitHub 阅读更多 1 7 766 7条讨论
杠上开花 2 月前 开源研习社 成长 这玩意真能替代Midjourney? 全是软文吹 Stable Diffusion XL 出图有多强,实际跑了一下 ControlNet 配准,边缘还是糊的一塌糊涂。想省订阅费直冲 Stable Diffusion,但显存不够别碰,纯纯浪费电。 阅读更多 2 2 569 2条讨论
不测不信邪 2 月前 开源研习社 绽放 Ollama 拉模型慢如蜗牛 国内连 GitHub 简直灾难,拉个 tinyllama 卡在 99% 绝望。直接换源最实在:https://ghproxy.com。跑一遍速度提升不止一个档次,别在那傻等超时。 阅读更多 1 0 602 展开讨论
夜班调参侠 3 月前 开源研习社 成长 这开源的自动记账脚本,读账单读出了幻觉 闲得慌写了个脚本,利用 OpenBB Terminal 的逻辑去解析微信支付宝的 CSV 导出文件。本来想自动化分类支出,结果识别出我买杯咖啡是“慈善捐赠”,买本书是“游戏充值”。Prompt 写得再好也怕这种语义混淆,这精度属实有点玄学。 阅读更多 1 5 752 5条讨论
周报难产中 3 月前 开源研习社 成长 刚看贴吧有人推的离线语音克隆,这音质绝了 贴吧那帮老哥吹的GPT-SoVITS,说是只需要3秒就能克隆音色。试了下开源版,环境配置确实头疼,依赖包冲突一堆。GitHub仓库在这里:https://github.com/RVC-Boss/GPT-SoVITS。跑通之后效果还行,就是推理速度得看显卡,4090勉强能实时,2080Ti得排队。有人折腾过这个吗,有没有平替的轻量化方案? 阅读更多 4 3 833 3条讨论
五百一天Ken 3 月前 开源研习社 绽放 这开源项目有点猛 刚刷到贴吧有人晒本地跑的实时翻译演示,延迟低得离谱。试了下 OnnxMT,把模型量化后部署,比那些收费API稳定多了,关键是数据不出域,适合处理敏感业务场景。 阅读更多 4 4 858 4条讨论