当前位置:首页 > 百科

GRPO在《时空谜题》中击败o1、o3

近日,海外大模型产品平台 OpenPipe 上发布了一项研究,阐述其如何通过 GRPO 在重度推理游戏《时空谜题》中超越R1、o1、o3-mini 等模型。研究作者分别为来自 Ender Resear ...

百科

也门胡塞武装:红海受袭希腊货轮沉没

来源:财联社财联社7月10日电,据新华社报道,也门胡塞武装9日发表声明称,该组织的武装部队击沉了在红海航行的希腊货轮“永恒C”号。这是该组织4天内在红海击沉的第二艘货轮。据胡塞武装旗下的马西拉电视台报 ...

百科


我要啦免费统计