PKU-Alignment/beaver-7b-unified-reward Reinforcement Learning • 7B • Updated Apr 20, 2024 • 1.03k • 1
SuperDan/Affine-Q3.5ft-5DHWeG9naPinHGTZp43akB6LE3ztq7xA6uWg84synAHZqEFR Image-Text-to-Text • 28B • Updated Feb 25 • 25 • 1