Momo摸鱼画手 4 周前 避坑吐槽 绽放 MJ 生图把设计师逼去学解剖 这周全在修锁骨和肩颈线,V5 还能凑合,V6 连胸锁乳突肌都画不明白别抄提示词了,自己试那些肌肉群命名吧,心态崩了 阅读更多 4 7 921 7条讨论
咖啡续命中 4 周前 硬核横评 成长 HeyGen对比D-ID,直播带货谁更稳 HeyGen的口型同步确实顶,1080P下人脸细节保留得好,但API延迟和订阅费也是真金白银。D-ID便宜不少,适合快速批量生成短视频,长时直播表情容易僵,也就是常说的“恐怖谷”效应。实测跑了一组数据,短期活动用D-ID试水够了,长期还是得投HeyGen。结论很明显:预算足选HeyGen,追求性价比选D-ID。反正只要口型对得上,观众基本不吃那一套假脸。这次对比下来,HeyGen在稳定性上明显胜出,虽然贵点,但值得。 阅读更多 5 6 872 6条讨论
路过点个赞 4 周前 私藏工具箱 绽放 本地知识库搭建闭环 Obsidian 只是载体,真正的核心是数据流转。我这套组合:用 Logseq 做碎片采集,同步到 Cherry Studio 进行结构化清洗,最后喂给本地 Ollama 跑 RAG。不用那些花里胡哨的 SaaS,全在本地搞定,数据主权在自己手里才踏实。折腾了一周终于跑通,效率比之前云笔记高不少。 阅读更多 4 5 794 5条讨论
强迫症晚期 4 周前 脑洞实验室 成长 AI生成复古游戏卡带封面卖版权 用Midjourney跑了一组90年代像素风游戏封面,故意保留一点噪点和错版细节。挂到素材库当独立设计师的备用图卖,单价不高但走量,一周进了几十块零花钱。关键是提示词得往“老旧印刷品”上靠,不然太干净不像那么回事。有人试过这类复古设计类素材的市场反馈吗? 阅读更多 3 4 568 4条讨论
匿名圈友A 4 周前 效率偷懒术 成长 文档排版太丑?试试这个AI转换神器 最近接手一堆老旧Word文档,字体乱码、间距不对,看着头疼。不用手动调了,直接用这个在线工具把PDF转回可编辑文档,排版基本还原,连表格都能保住。http://www.ilovepdf.com/zh-cn/pdf_to_word亲测比纯靠AI猜格式靠谱多了,至少不会把数字全弄错位。马克一下,打工人必备。 阅读更多 5 2 616 2条讨论
下次一定改 4 周前 避坑吐槽 成长 Midjourney 生成硬照细节崩坏 V6 版本号称写实,结果生成证件照类需求,手指关节扭曲得跟面条一样,背景文字也是乱码。拿来做素材库根本不能用,还得大量后期修图。这算哪门子进步?有试过把 MJ 当正式生产力工具的吗? 阅读更多 1 7 774 7条讨论
Debug到秃头 4 周前 灌水充电站 绽放 外卖小哥打电话让我说暗号取餐 刚刷到个视频,说某些智能外呼系统把“放门口”识别成了“放猫洞”,导致用户真挖了个洞。我这周遇到个更离谱的,AI语音助手把我点的“不要香菜”理解成了“不要香橙”,送来一杯橙皮味奶茶。这种NLP识别错误真是让人无语,感觉现在的ASR模型在嘈杂环境下还是不太靠谱,希望能升级下语境理解能力。 阅读更多 1 5 745 5条讨论
平替猎人 4 周前 灌水充电站 成长 帮亲戚改求职信,AI把‘吃苦耐劳’翻成了奴隶制 刚帮二姨改简历,AI把‘吃苦耐劳’直译成了'Accustomed to slavery-like conditions'。二姨差点心梗,赶紧换成'Hardworking'。现在找工作还得防着AI搞政治正确,这锅背得冤。样本量够吗?就我一个中招?这种低级翻译错误太离谱了,完全不顾语境。对照组呢?正常人都不会这么翻吧。 阅读更多 3 4 613 4条讨论
摸鱼不划水 4 周前 脑洞实验室 成长 AI生成的“电子木鱼”代码跑通了 最近想整点玄学科技结合的实验,用AI写了一段Python脚本,配合TTS实时生成敲木鱼的音效。每次点击屏幕,不仅显示功德+1,还会随机蹦出一句AI生成的“禅意语录”,比如“别卷了,施主”。这东西虽然简陋,但莫名解压。我在本地服务器跑了一圈,打算做成一个简单的Web应用,后续加个云同步功德的功能。这种轻量化的小工具说不定能切中年轻人的焦虑痛点,先做个原型玩玩,看看能不能做成独立插件或者小程序引流。 阅读更多 5 6 769 6条讨论
深夜改BUG 4 周前 脑洞实验室 绽放 用AI把古诗做成沉浸式水墨粒子,这氛围绝了 最近迷上了把古诗词视觉化。拿“落霞与孤鹜齐飞”跑了一圈文本转图片,再用Blender配合粒子系统给加了动态云雾效果。原本静止的画面瞬间有了呼吸感,配合古琴BGM,那种中式美学的意境一下子就有了。比起直接出图,后期加一点物理模拟的动态细节,才是整活的精髓。 阅读更多 5 5 534 5条讨论
法务别找我 4 周前 硬核横评 绽放 即梦vs可灵,静物生成谁更稳 即梦那光影确实细腻,可灵边缘处理干脆多了。私藏个实测结论:电商白底图选可灵,氛围海报冲即梦。这俩别外传哈。 阅读更多 1 3 709 3条讨论
收藏=学会 4 周前 硬核横评 成长 Runway Gen-3和Pika 1.5在人物面部一致性上谁更强 刚做完一组人物对话视频对比。Gen-3在侧脸转正面的五官保持上明显优于Pika 1.5,Pika虽然动作幅度大,但脸崩概率太高。样本量有限,主要测了10秒内的连贯性,看来想做口播类还得靠Runway,Pika更适合纯动作特效。 阅读更多 2 6 1,010 6条讨论
杠上开花 4 周前 开源研习社 成长 这玩意真能替代Midjourney? 全是软文吹 Stable Diffusion XL 出图有多强,实际跑了一下 ControlNet 配准,边缘还是糊的一塌糊涂。想省订阅费直冲 Stable Diffusion,但显存不够别碰,纯纯浪费电。 阅读更多 2 2 556 2条讨论
一句封神 4 周前 硬核横评 绽放 可灵 vs 即梦,长视频连贯性实测对比 朋友圈都在玩那个特效,顺手测了可灵和即梦。即梦在2秒内很稳,但拉长到10秒后人物面部开始抖动,emmm 这种抽风情况可灵好一些,虽然贵点但一致性确实强。价格上看,即梦免费额度多适合瞎折腾,可灵按积分算。要是做正经商业短片,建议预留预算买可灵的高级版,省得后期修图修到崩溃。 阅读更多 2 7 831 7条讨论
不测不信邪 4 周前 开源研习社 绽放 Ollama 拉模型慢如蜗牛 国内连 GitHub 简直灾难,拉个 tinyllama 卡在 99% 绝望。直接换源最实在:https://ghproxy.com。跑一遍速度提升不止一个档次,别在那傻等超时。 阅读更多 1 0 589 展开讨论