当前位置:首页 > 全瓜

GRPO在《时空谜题》中击败o1、o3

近日,海外大模型产品平台 OpenPipe 上发布了一项研究,阐述其如何通过 GRPO 在重度推理游戏《时空谜题》中超越R1、o1、o3-mini 等模型。研究作者分别为来自 Ender Resear ...

全瓜

“南京红老头”已被警方抓获

来源:法治日报[南京红姐被抓]记者从警方相关人士处了解到,网上盛传的南京60岁大叔男扮女装与1691名男性发生亲密行为并拍下“约会”视频的涉事男子网上被称为“红老头”)已经被公安机关抓获。其中,网上传 ...

全瓜

拓元智慧完成近亿元人民币Pre

作者 | 赖文昕编辑 | 陈彩娴近日,拓元智慧X-Era AI)宣布成功完成 Pre-A 轮融资,融资金额接近一亿人民币。此轮融资由粤科金融集团、鹏城愿景基金、红鸟启航基金等投资机构共同参与。早在 2 ...

全瓜

清程极智 CEO 汤雄超:训推一体机并非 AI Infra 的未来

早在超算时代,清华大学高性能计算研究中心便一直是解决算力需求相关软件问题的行家。“目前 AI Infra 赛道几家国内厂商中,只有我们有过十万台服务器的超大规模国产算力集群的使用和调优经验。”汤雄超向 ...

全瓜


我要啦免费统计