
Steering toxicity through a retrieval datastore rather than model weights means you can update what counts as harmful by editing data, with no retraining and no access to the parameters.
articleBam Just Like That Simple And Efficient Parameter Upcycling For Mixture Of Experts 2024 08 15
articleMultilingual Arbitrage Optimizing Data Pools To Accelerate Multilingual Progress 2024 08 28
articleOne Tokenizer To Rule Them All Emergent Language Plasticity Via Multilingual Tokenizers 2025 05 30
articleInclude Evaluating Multilingual Language Understanding With Regional Knowledge 2024 11 29
articleReducing Toxicity in Language ModelsLilian Weng
articleFantastic Adaptive Taxonomies and How to Use ThemMert Cemri, Andrei Cojocaru, Melissa Pan, Shu Liu, Shubham Agarwal, Alexander Krentsel, Jay Tang, Kannan Ramchandran, Joseph E. Gonzalez, Matei Zaharia, Alex Dimakis, Ion Stoica
articleHow Much Memory Does Your Agent Actually Need?huggingface.coChecking sign-in…
Loading comments…