跳到内容

晚上好,辛苦一天了,放松一下吧。

DeepSeek-R1 开源推理模型:纯 RL 让大模型学会反思,效果直逼 o1

遇到复杂推理题时,很多模型要么直接猜答案,要么绕来绕去不…

R1-V:用强化学习让VLM学会视觉定位,无需手工标注

想让视觉语言模型(VLM)不仅看懂图片,还能精准指出目标…

Welcome! This site is in Chinese. Tap EN in the top bar to read in English.