BitNet:把大模型压到 1-bit,CPU 上也能跑推理
想在本地跑大模型,先被显卡和内存劝退的人不少。micro…
想在本地跑大模型,先被显卡和内存劝退的人不少。micro…
被业务拉着要报表又要反复改口径的开发者,很多时间其实消耗…
想让大模型基于自己的私有资料回答,而不是临时翻聊天记录,…
在本地把 Llama/Qwen 跑通不难,难的是把它变成…
一个人调模型最怕的不是没显卡,而是今天换这个明天换那个,…
传统Agent框架把工具调用切成JSON片段,调参时看得…
如果你和我一样,在本地调大模型时总被 OOM 劝退,De…
写 RAG 或多步推理时,最烦的就是把大模型和工具调用粘…
想搞懂大模型训练时那些反向传播、梯度下降到底在干什么?K…
每次想用 AI 查内部资料,都得把文档上传到云端,多少有…
本地偏好 · 配色仅保存在当前浏览器
点此注册,收藏与评论更方便
Welcome! This site is in Chinese. Tap EN in the top bar to read in English.