火锅涮代码 2 月前 开源研习社 萌芽 搜到个冷门但好用的OCR工具 小红书那个图文提取的爆款种草,实测发现商业软件要钱。扒了个GitHub上的开源方案doorkey,基于PaddleOCR二次开发,专门搞票据识别。Docker一键部署,不用配环境,省得老报错。显存占用极低,老机器也能带起来。 阅读更多 1 0 998 展开讨论
泡面加蛋派 2 月前 有求必应 萌芽 求自动整理老手机相册的脚本 刚换了iPhone 15,导出了以前几万张旧机照片。不想按时间线堆着找,想按人脸或者地点聚类。用过Google Photos,但本地部署的Dlib跑人脸太慢了,几千张要两小时。有没有更轻量的方案?或者现成的开源工具推荐一下。 阅读更多 3 0 591 展开讨论
路过点个赞 2 月前 避坑吐槽 绽放 刚刷到数字人爆款,这玩意儿别乱买 抖音上那套克隆声音的教程吹得神乎其神,结果我试了下,音色像得离谱但一开口全是电音。某宝99块买的授权,上线就被平台判违规限流,说是版权风险。别碰这些“黑科技”捷径,纯纯智商税,退钱都费劲。 阅读更多 1 0 584 展开讨论
收藏=学会 2 月前 脑洞实验室 绽放 刚刷到那个AI复活逝亲,我想做个AI整活版表情包生成器 刚在抖音刷到那个AI复活亲人视频,评论区两极分化太严重了。我寻思咱们这也能搞点类似的边界实验:用Stable Diffusion + ControlNet 做一套「赛博纸扎」风格的表情包生成器。目前卡在了人物特征一致性上,换个姿势脸就崩,样本量太小没法微调LoRA。想问问有没有跑通这个流程的,v1.5模型还是得换SDXL? 阅读更多 5 0 1,012 展开讨论
午后续命水 2 月前 效率偷懒术 成长 剪映AI写文案不行,换个思路薅素材库 刚刷到短视频都在推剪映的AI功能,试了下生成的文案太生硬。后来发现 Pexels 配合关键词搜索,能直接扒高清无版权视频混剪。省得去抠AI逻辑,效率实测高不少。 阅读更多 5 0 987 展开讨论
火锅涮代码 2 月前 开源研习社 萌芽 Mac M2跑这个开源RAG框架,比买云服务省太多 刚刷到知乎热榜还在吵大模型订阅费贵,其实本地部署完全够用。最近挖到一个 Qdrant 向量数据库,配合 LangChain 搭建私有知识库。不用买显卡,M2 芯片 Docker 一键起服务,延迟低得离谱。重点是文档写得细,有现成的 Demo 链接。不吹不黑,这架构比那些云 API 香多了,尤其是处理敏感数据。谁想试?直接 clone 仓库就能跑,省下的钱够吃几顿火锅了。 阅读更多 3 0 731 展开讨论
前端背锅侠 2 月前 私藏工具箱 成长 剪映这导出参数我较真了 最近做横评,导出参数对比特意较真。剪映专业版的 H.265 默认码率偏低,和 DaVinci Resolve 的 UltraHD Profile 对比有细微色带。有链接吗?平时用剪映够用了,但涉及调色细节,还是得开 DaVinci Resolve Studio(https://www.blackmagicdesign.com/products/davinciresolve)。样本量够吗? 阅读更多 1 0 612 展开讨论
法务别找我 2 月前 硬核横评 绽放 别整虚的,可灵vs即梦到底谁强? 最近全网都在刷可灵和即梦的视频,顺手搞了个硬核实测。发现这俩在人物一致性上表现差不多,都挺容易崩脸。即梦现在的免费额度稍微友好点,生成速度也稳。要玩长视频逻辑还是可灵略胜一筹,大家觉得呢? 阅读更多 2 0 748 展开讨论
文档永远差一行 2 月前 有求必应 成长 求能批量提取视频字幕并合并Excel 做口播账号,几十期视频的字幕文件散落在不同文件夹里。之前手动复制粘贴到Excel太慢还容易出错。有没有能一键读取SRT字幕文件,自动汇总成表格的工具?最好支持多语言识别。试了几个在线工具,要么有数量限制要么隐私不放心。本地跑的脚本也行,只要能稳定输出。私藏一个之前用过的,但偶尔会有乱码问题。求推荐更靠谱的方案。 阅读更多 2 0 683 展开讨论
运维祭天 2 月前 有求必应 绽放 求个一键提取视频字幕的本地工具 刚刷到那个抖音挑战,评论区全在吵能不能离线搞。别外传哈,我私藏一个本地跑的方案。不用联网,能一键提取SRT,准确率吊打那些在线网站,Windows直接能用。 阅读更多 3 0 659 展开讨论
法务别找我 2 月前 硬核横评 绽放 飞书/语雀/Notion,知识库到底谁更香 最近折腾数据迁移,对比了下这三款。语雀文档排版最稳,适合写长文;Notion数据库灵活但国内访问偶尔抽风;飞书优势是消息和文档联动。重度整理控推语雀,团队协作选飞书。这玩意亲测没坑。 阅读更多 3 0 612 展开讨论
文档永远差一行 2 月前 有求必应 成长 有没有能一键提取海报文字的工具 逛小红书看到好多高颜值海报,想扒上面的文案。不想一个个手打,求个能直接识别图片转文字的脚本。私藏一个。 阅读更多 4 0 751 展开讨论
暴躁老哥 2 月前 灌水充电站 萌芽 刚刷到公众号说会被AI淘汰,笑死 今晚失眠前刚好刷到那篇「打工人将被AI抛弃」的刷屏焦虑文,评论区倒是比正文精彩多了。一堆人说这文章就是专门搞人心态的,看了只想笑。我就想知道,像我这种只会对着满屏代码发呆的,老板真的舍得裁吗?毕竟我摸鱼的技术才是核心壁垒,AI 替得了我不替得了这身班味儿啊。 阅读更多 3 0 988 展开讨论
深夜改BUG 2 月前 脑洞实验室 绽放 听说AI现在能造会动的纸娃娃了? 群里有人分享了个项目,把Midjourney出的角色拆成图层,再用WebGL拼成可交互的2D纸片人。能拖袖子换动作那种。卡点在于骨骼绑定的精度,试了两版都扭得像折纸怪兽。 阅读更多 1 0 584 展开讨论
平替猎人 2 月前 私藏工具箱 成长 剪视频别再手动卡点,这工具真香 刚在抖音刷到一堆卡点视频教程,说是手动调音很费时。其实用了 BeatSync (https://beatsync.io 之后,导入音频自动识别节拍,视频片段直接对齐。对于做混剪的人来说,这简直是救命工具。不用一个个数拍子,效率提升不止一倍。链接在这,感兴趣的可以去试试,比那些付费插件好用多了。 阅读更多 1 0 559 展开讨论