Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Showing 451-467 of 467 papers (page 16 of 16)路 58 ms
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Fast Model Editing at Scale Antoine Bosselut, Charles Lin, Chelsea Finn, Christopher D. Manning Published: 2021-10-21Area: Model EditingCitations: 491 Tags: ai-safety, empirical, model-editing | 2021-10-21 | Model Editing | ai-safety, empirical, model-editing | E6 / R3 (95%) | 491 |
| DExperts: Decoding-Time Controlled Text Generation with Experts and Anti-Experts Alisa Liu, Chandra Bhagavatula, Maarten Sap, Noah A. Smith Published: 2021-05-07Area: Model EditingCitations: 459 Tags: ai-safety, empirical, model-editing | 2021-05-07 | Model Editing | ai-safety, empirical, model-editing | E6 / R4 (94%) | 459 |
| Editing Factual Knowledge in Language Models Ivan Titov, Nicola De Cao, Wilker Aziz Published: 2021-04-16Area: Model EditingCitations: 636 Tags: ai-safety, empirical, model-editing | 2021-04-16 | Model Editing | ai-safety, empirical, model-editing | E5 / R3 (93%) | 636 |
| Modifying Memories in Transformer Models Ankit Singh Rawat, Chen Zhu, Daliang Li, Felix Yu Published: 2020-12-01Area: Model EditingCitations: 256 Tags: ai-safety, empirical, model-editing | 2020-12-01 | Model Editing | ai-safety, empirical, model-editing | E6 / R3 (94%) | 256 |
| Editable Neural Networks Anton Sinitsin, Artem Babenko, Dmitriy Pyrkin, Sergei Popov Published: 2020-04-01Area: Model EditingCitations: 204 Tags: ai-safety, empirical, model-editing | 2020-04-01 | Model Editing | ai-safety, empirical, model-editing | E5 / R3 (95%) | 204 |
| A Simple Yet Effective Method for Non-Refusing Context Relevant Fine-grained Safety Steering in LLMs Amrita Bhattacharjee, Christopher Parisien, Shaona Ghosh, Yftah Ziser Published: -Area: Model EditingCitations: 2 Tags: ai-safety, empirical, model-editing | - | Model Editing | ai-safety, empirical, model-editing | E6 / R3 (95%) | 2 |
| EMMU: Efficient Information-Level Multimodal Machine Unlearning with High Model Fidelity Jiahui Hou, Jie Zhang, Tie Xiao, Xiang-Yang Li Published: -Area: Model EditingCitations: - Tags: ai-safety, empirical, model-editing | - | Model Editing | ai-safety, empirical, model-editing | E5 / R3 (93%) | - |
| GAIA-UL: Surgical Unlearning of Visual Knowledge via Causally-Guided Orthogonalization Jinghan Xu, Kaixuan Zhang, Qixuan Cai, Wenyu Qu Published: -Area: Model EditingCitations: - Tags: ai-safety, empirical, model-editing | - | Model Editing | ai-safety, empirical, model-editing | E5 / R3 (95%) | - |
| Lock on Target! Precision Unlearning via Directional Control Feng Guo, Ran Le, Ruixiang Feng, Shen Gao Published: -Area: Model EditingCitations: 1 Tags: ai-safety, empirical, model-editing | - | Model Editing | ai-safety, empirical, model-editing | E6 / R4 (96%) | 1 |
| Machine Unlearning Across Scales: Evaluation of Optimization Methods on Language Models Amartya Hatua, Trung T. Nguyen Published: -Area: Model EditingCitations: - Tags: ai-safety, empirical, model-editing, safety-evaluation | - | Model Editing | ai-safety, empirical, model-editing, safety-evaluation | E6 / R3 (95%) | - |
| Mitigating Privacy Seesaw in Large Language Models: Augmented Privacy Neuron Editing via Activation Patching Deyi Xiong, Shaoyang Xu, Weilong Dong, Xinwei Wu Published: -Area: Model EditingCitations: 12 Tags: ai-safety, empirical, model-editing | - | Model Editing | ai-safety, empirical, model-editing | E5 / R3 (95%) | 12 |
| Nexus scissor: enhance open-access language model safety by connection pruning Peihua Mai, Ran Yan, Yan Pang, Youjia Yang Published: -Area: Model EditingCitations: - Tags: adversarial-robustness, ai-safety, empirical, model-editing | - | Model Editing | adversarial-robustness, ai-safety, empirical, model-editing | E5 / R3 (95%) | - |
| Robustness of Edited Neural Networks Charles Godfrey, Cody Nizinski, Davis Brown, Henry Kvinge Published: -Area: Model EditingCitations: 8 Tags: ai-safety, empirical, model-editing | - | Model Editing | ai-safety, empirical, model-editing | E6 / R3 (95%) | 8 |
| Selective LLM Unlearning via SAE-Based Token Importance Score Dong Woo Lee, In Jae Kim, Ji Young Shin, Jung Hun Lim Published: -Area: Model EditingCitations: - Tags: ai-safety, empirical, model-editing | - | Model Editing | ai-safety, empirical, model-editing | E5 / R2 (94%) | - |
| Towards a Unified Paradigm of Concept Editing in Large Language Models Dan Shi, Deyi Xiong, Renren Jin, Xinwei Wu Published: -Area: Model EditingCitations: - Tags: ai-safety, empirical, model-editing | - | Model Editing | ai-safety, empirical, model-editing | E6 / R3 (96%) | - |
| Towards Safe Concept Transfer of Multi-Modal Diffusion via Causal Representation Editing Bingjie Wang, Jie Zhang, Junxiao Wang, Peiran Dong Published: -Area: Model EditingCitations: 3 Tags: ai-safety, empirical, model-editing | - | Model Editing | ai-safety, empirical, model-editing | E5 / R3 (94%) | 3 |
| Unlearning in Large Language Models: We Are Not There Yet Alberto Blanco-Justicia, Benet Manzanares-Salor, David S谩nchez, Josep Domingo-Ferrer Published: -Area: Model EditingCitations: 2 Tags: ai-safety, model-editing, survey | - | Model Editing | ai-safety, model-editing, survey | E3 / R1 (97%) | 2 |