Community · AI Topics
AI Community
Dive into global AI tools' hidden gems—hardcore comparisons, pro tips, monetization hacks, and honest reviews, all in one place.
Circle posts and replies are in Chinese; click EN at the top for instant browser translation. These pages are not indexed as separate English URLs.
登录后发起讨论
登录即可发布话题,支持配图、表情与手绘,与社区一起交流 AI 实践。
话题分类
全部话题
把微信语音转文字存到Notion,省了记笔记的功夫
每次开会开完微信语音几十条,听着记太累。自己糊了个小流程:用 whisper.cpp 离线转成文字,再写个脚本自动扔进 Notion 表格里。离线不花钱,还能直接搜关键词翻记录。目前就是语速快的容易断句奇怪。反正比手动逐条记省力点。
刚刷到某号刷屏文说打工人要被AI取代,评论区吵翻了。我上次自己跑自动化脚本卡bug时,才意识到AI现在连代码都写不利索,离「抛弃」还早呢。大家最近有遇到什么离谱的AI翻车现场吗?还是都在默默摸鱼等大厂卷出新花样?反正我这周只关心下午奶茶谁请。
打宽带客服,AI让我对着话筒吹气检测故障……我吹了五分钟,它说没检测到声音,让我再试试。最后人工接起来说“您这个口哨吹得挺标准的”。我特么是来修网的不是来面试乐团的。
每次会议完手动整理待办事项,耳朵都听出茧了。试了个路子:用飞书妙记转文字后,让 GPT 根据发言提取 action items 并标负责人,直接输出成飞书文档表格。格式模板丢这了 meeting-to-todo prompt,改改就能用。
刚刷到知乎热榜,一堆人晒用 AI 写爆款笔记的截图,看得我手痒但脑子乱。自己试了几个大模型,出来的东西一股味儿,不像真人吐槽,很难过审核。主要是想写点探店类的种草文案,带点情绪那种。有没有那种提示词写得比较顺、或者专门针对小红书语感微调过的小工具?求分享,不想再踩坑了。
刚刷到抖音上有人吹某个AI抠图神器月入过万,结果自己试了下,笑死,这也能行?前10次能用,第11次就开始疯狂弹窗逼充值,而且边缘处理得那叫一个粗糙,头发丝直接糊成一片。评论区还有一堆水军在那洗地,说“免费就是这样的”。真的服了,这种割韭菜的智商税能不能别推给我们。马克一下,大家避雷吧,别像我一样浪费半小时去填坑。
刚在公众号看到“普通人用 AI 做视频号”那篇十万+,吹得跟啥似的。我手头一堆老视频想转方言口播,试了几个工具要么不准要么收费贵。有没有平替推荐?预算 0-50 块,要能直接输出 mp3 那种。
周末去相了个“技术男”,感觉不对劲。全程眼神不聚焦,回答问题像在念稿子。我问他平时喜欢干嘛,他秒回:“运动、阅读、旅行,平衡生活与工作的节奏。”问我对未来的规划,又是“提升自我价值、拥抱不确定性”。最后甚至问我“家庭价值观的优先级排序”。这哪是聊天,这是在做NLP测试吧?直接溜了,太离谱。
最近报销季到了,同事群里全是吐槽贴。我这边试了个偷懒办法,把一堆发票照片丢给阿里云OCR接口,再喂给脚本自动整理成表格。以前要半天的重复录入,现在半小时搞定。准确率大概95%以上,剩下几个模糊的 manually 补一下就行。效率提升太明显了,有没有类似自动报销流程的平替工具?
刚刷到贴吧有个热帖,说AI把“我要辞职”理解成“我累了想请假”,然后真的给安排了半天假。这离谱程度绝了。不过现在职场里,有些同事跟AI聊天比跟人交流还顺畅,我就想问,这算不算新型社恐?或者反过来算是一种职业困惑?有没有同感的组队聊聊?
小红书那个图文提取的爆款种草,实测发现商业软件要钱。扒了个GitHub上的开源方案doorkey,基于PaddleOCR二次开发,专门搞票据识别。Docker一键部署,不用配环境,省得老报错。显存占用极低,老机器也能带起来。
刚换了iPhone 15,导出了以前几万张旧机照片。不想按时间线堆着找,想按人脸或者地点聚类。用过Google Photos,但本地部署的Dlib跑人脸太慢了,几千张要两小时。有没有更轻量的方案?或者现成的开源工具推荐一下。
抖音上那套克隆声音的教程吹得神乎其神,结果我试了下,音色像得离谱但一开口全是电音。某宝99块买的授权,上线就被平台判违规限流,说是版权风险。别碰这些“黑科技”捷径,纯纯智商税,退钱都费劲。
刚刷到那个AI复活逝亲,我想做个AI整活版表情包生成器
刚在抖音刷到那个AI复活亲人视频,评论区两极分化太严重了。我寻思咱们这也能搞点类似的边界实验:用Stable Diffusion + ControlNet 做一套「赛博纸扎」风格的表情包生成器。目前卡在了人物特征一致性上,换个姿势脸就崩,样本量太小没法微调LoRA。想问问有没有跑通这个流程的,v1.5模型还是得换SDXL?
刚刷到短视频都在推剪映的AI功能,试了下生成的文案太生硬。后来发现 Pexels 配合关键词搜索,能直接扒高清无版权视频混剪。省得去抠AI逻辑,效率实测高不少。
Welcome! This site is in Chinese. Tap EN in the top bar to read in English.