dllm. dLLM: Simple Diffusion Language Modeling
2.7kmodpo. [ACL'24] Beyond One-Preference-Fits-All Alignment: Multi-Objective Direct Preference Optimization
101weak-to-strong-search. [NeurIPS'24] Weak-to-Strong Search: Align Large Language Models via Searching over Small Language Models
67emulated-disalignment. [ACL'24, Outstanding Paper] Emulated Disalignment: Safety Alignment for Large Language Models May Backfire!
39visual-stitching. [NeurIPS'25] VLMs Can Aggregate Scattered Training Patches
14cs285-homework-fall2021. Assignment Solutions for Berkeley CS 285: Deep Reinforcement Learning (Fall 2021)
8INTENT. [UIST'22] INTENT: Interactive Tensor Transformation Synthesis
7oocr. Python
1