SafeSci Data and safety-enhanced LLMs via finetuning.
Zhu Xiangyang
yyy127
AI & ML interests
None yet
Recent Activity
updated a dataset 4 days ago
yyy127/SafeSci submitted a paper 2 months ago
Emergent Misalignment Can Be Induced by Sycophancy and Reversed via Alignment GatingOrganizations
None yet