p7cs.IR

Category

cs.IR

322 papers

AttSum: Joint Learning of Focusing and Summarization with Neural Attention

Ziqiang Cao, Wenjie Li, Sujian Li, Furu Wei, Yanran Li

1604.00125

Oscar: Object-Semantics Aligned Pre-training for Vision-Language Tasks

Xiujun Li, Xi Yin, Chunyuan Li, Pengchuan Zhang, Xiaowei Hu, Lei Zhang, Lijuan Wang, Houdong Hu, Li Dong, Furu Wei, Yejin Choi, Jianfeng Gao

2004.06165

Large Language Models are not Fair Evaluators

Peiyi Wang, Lei Li, Liang Chen, Zefan Cai, Dawei Zhu, Binghuai Lin, Yunbo Cao, Qi Liu, Tianyu Liu, Zhifang Sui

2305.17926

ColBERT: Efficient and Effective Passage Search via Contextualized Late Interaction over BERT

Omar Khattab, Matei Zaharia

2004.12832

Approximate Nearest Neighbor Negative Contrastive Learning for Dense Text Retrieval

Lee Xiong, Chenyan Xiong, Ye Li, Kwok-Fung Tang, Jialin Liu, Paul Bennett, Junaid Ahmed, Arnold Overwijk

2007.00808

Differentiable Prompt Makes Pre-trained Language Models Better Few-shot Learners

Ningyu Zhang, Luoqiu Li, Xiang Chen, Shumin Deng, Zhen Bi, Chuanqi Tan, Fei Huang, Huajun Chen

2108.13161

In-Context Retrieval-Augmented Language Models

Ori Ram, Yoav Levine, Itay Dalmedigos, Dor Muhlgay, Amnon Shashua, Kevin Leyton-Brown, Yoav Shoham

2302.00083

Understanding the Behaviors of BERT in Ranking

Yifan Qiao, Chenyan Xiong, Zhenghao Liu, Zhiyuan Liu

1904.07531

Question Answering as an Automatic Evaluation Metric for News Article Summarization

Matan Eyal, Tal Baumel, Michael Elhadad

1906.00318

Re2G: Retrieve, Rerank, Generate

Michael Glass, Gaetano Rossiello, Md Faisal Mahbub Chowdhury, Ankita Rajaram Naik, Pengshan Cai, Alfio Gliozzo

2207.06300

Autoregressive Search Engines: Generating Substrings as Document Identifiers

Michele Bevilacqua, Giuseppe Ottaviano, Patrick Lewis, Wen-tau Yih, Sebastian Riedel, Fabio Petroni

2204.10628

Concrete Sentence Spaces for Compositional Distributional Models of Meaning

Edward Grefenstette, Mehrnoosh Sadrzadeh, Stephen Clark, Bob Coecke, Stephen Pulman

1101.0309

TICO-19: the Translation Initiative for Covid-19

Antonios Anastasopoulos, Alessandro Cattelan, Zi-Yi Dou, Marcello Federico, Christian Federman, Dmitriy Genzel, Francisco Guzmán, Junjie Hu, Macduff Hughes, Philipp Koehn, Rosie Lazar, Will Lewis, Graham Neubig, Mengmeng Niu, Alp Öktem, Eric Paquin, Grace Tang, Sylwia Tur

2007.01788

KILT: a Benchmark for Knowledge Intensive Language Tasks

Fabio Petroni, Aleksandra Piktus, Angela Fan, Patrick Lewis, Majid Yazdani, Nicola De Cao, James Thorne, Yacine Jernite, Vladimir Karpukhin, Jean Maillard, Vassilis Plachouras, Tim Rocktäschel, Sebastian Riedel

2009.02252

Transformer Memory as a Differentiable Search Index

Yi Tay, Vinh Q. Tran, Mostafa Dehghani, Jianmo Ni, Dara Bahri, Harsh Mehta, Zhen Qin, Kai Hui, Zhe Zhao, Jai Gupta, Tal Schuster, William W. Cohen, Donald Metzler

2202.06991

Autoregressive Entity Retrieval

Nicola De Cao, Gautier Izacard, Sebastian Riedel, Fabio Petroni

2010.00904

Query2doc: Query Expansion with Large Language Models

Liang Wang, Nan Yang, Furu Wei

2303.07678

CCNet: Extracting High Quality Monolingual Datasets from Web Crawl Data

Guillaume Wenzek, Marie-Anne Lachaux, Alexis Conneau, Vishrav Chaudhary, Francisco Guzmán, Armand Joulin, Edouard Grave

1911.00359

Answers Unite! Unsupervised Metrics for Reinforced Summarization Models

Thomas Scialom, Sylvain Lamprier, Benjamin Piwowarski, Jacopo Staiano

1909.01610

Pretrained Transformers for Text Ranking: BERT and Beyond

Jimmy Lin, Rodrigo Nogueira, Andrew Yates

2010.06467

Long Range Arena: A Benchmark for Efficient Transformers

Yi Tay, Mostafa Dehghani, Samira Abnar, Yikang Shen, Dara Bahri, Philip Pham, Jinfeng Rao, Liu Yang, Sebastian Ruder, Donald Metzler

2011.04006

Document Ranking with a Pretrained Sequence-to-Sequence Model

Rodrigo Nogueira, Zhiying Jiang, Jimmy Lin

2003.06713

SemEval-2017 Task 3: Community Question Answering

Preslav Nakov, Doris Hoogeveen, Lluís Màrquez, Alessandro Moschitti, Hamdy Mubarak, Timothy Baldwin, Karin Verspoor

1912.00730

End-to-End Open-Domain Question Answering with BERTserini

Wei Yang, Yuqing Xie, Aileen Lin, Xingyu Li, Luchen Tan, Kun Xiong, Ming Li, Jimmy Lin

1902.01718

Dirichlet belief networks for topic structure learning

He Zhao, Lan Du, Wray Buntine, Mingyuan Zhou

1811.00717

Bias in Bios: A Case Study of Semantic Representation Bias in a High-Stakes Setting

Maria De-Arteaga, Alexey Romanov, Hanna Wallach, Jennifer Chayes, Christian Borgs, Alexandra Chouldechova, Sahin Geyik, Krishnaram Kenthapadi, Adam Tauman Kalai

1901.09451

Pre-training for Ad-hoc Retrieval: Hyperlink is Also You Need

Zhengyi Ma, Zhicheng Dou, Wei Xu, Xinyu Zhang, Hao Jiang, Zhao Cao, Ji-Rong Wen

2108.09346

Practical and Optimal LSH for Angular Distance

Alexandr Andoni, Piotr Indyk, Thijs Laarhoven, Ilya Razenshteyn, Ludwig Schmidt

1509.02897

Rethink Training of BERT Rerankers in Multi-Stage Retrieval Pipeline

Luyu Gao, Zhuyun Dai, Jamie Callan

2101.08751

B-PROP: Bootstrapped Pre-training with Representative Words Prediction for Ad-hoc Retrieval

Xinyu Ma, Jiafeng Guo, Ruqing Zhang, Yixing Fan, Yingyan Li, Xueqi Cheng

2104.09791

Discovering Discrete Latent Topics with Neural Variational Inference

Yishu Miao, Edward Grefenstette, Phil Blunsom

1706.00359

Equity of Attention: Amortizing Individual Fairness in Rankings

Asia J. Biega, Krishna P. Gummadi, Gerhard Weikum

1805.01788

Group based Personalized Search by Integrating Search Behaviour and Friend Network

Yujia Zhou, Zhicheng Dou, Bingzheng Wei, Ruobing Xievand Ji-Rong Wen

2111.12618

PROP: Pre-training with Representative Words Prediction for Ad-hoc Retrieval

Xinyu Ma, Jiafeng Guo, Ruqing Zhang, Yixing Fan, Xiang Ji, Xueqi Cheng

2010.10137

Scalable Recommendation with Poisson Factorization

Prem Gopalan, Jake M. Hofman, David M. Blei

1311.1704

Improving Passage Retrieval with Zero-Shot Question Generation

Devendra Singh Sachan, Mike Lewis, Mandar Joshi, Armen Aghajanyan, Wen-tau Yih, Joelle Pineau, Luke Zettlemoyer

2204.07496

In-context Learning with Retrieved Demonstrations for Language Models: A Survey

Man Luo, Xin Xu, Yue Liu, Panupong Pasupat, Mehran Kazemi

2401.11624

Learning to Retrieve Passages without Supervision

Ori Ram, Gal Shachaf, Omer Levy, Jonathan Berant, Amir Globerson

2112.07708

Deep Learning for Hate Speech Detection in Tweets

Pinkesh Badjatiya, Shashank Gupta, Manish Gupta, Vasudeva Varma

1706.00188

From Standard Summarization to New Tasks and Beyond: Summarization with Manifold Information

Shen Gao, Xiuying Chen, Zhaochun Ren, Dongyan Zhao, Rui Yan

2005.04684

ScisummNet: A Large Annotated Corpus and Content-Impact Models for Scientific Paper Summarization with Citation Networks

Michihiro Yasunaga, Jungo Kasai, Rui Zhang, Alexander R. Fabbri, Irene Li, Dan Friedman, Dragomir R. Radev

1909.01716

Fairness of Exposure in Rankings

Ashudeep Singh, Thorsten Joachims

1802.07281

FA*IR: A Fair Top-k Ranking Algorithm

Meike Zehlike, Francesco Bonchi, Carlos Castillo, Sara Hajian, Mohamed Megahed, Ricardo Baeza-Yates

1706.06368

Ranking with Fairness Constraints

L. Elisa Celis, Damian Straszak, Nisheeth K. Vishnoi

1704.06840

Multi-Stage Document Ranking with BERT

Rodrigo Nogueira, Wei Yang, Kyunghyun Cho, Jimmy Lin

1910.14424

Multiview Deep Learning for Predicting Twitter Users' Location

Tien Huu Do, Duc Minh Nguyen, Evaggelia Tsiligianni, Bruno Cornelis, Nikos Deligiannis

1712.08091

Fair and Diverse DPP-based Data Summarization

L. Elisa Celis, Vijay Keswani, Damian Straszak, Amit Deshpande, Tarun Kathuria, Nisheeth K. Vishnoi

1802.04023

Auditing Search Engines for Differential Satisfaction Across Demographics

Rishabh Mehrotra, Ashton Anderson, Fernando Diaz, Amit Sharma, Hanna Wallach, Emine Yilmaz

1705.10689

CEDR: Contextualized Embeddings for Document Ranking

Sean MacAvaney, Andrew Yates, Arman Cohan, Nazli Goharian

1904.07094

Simple Applications of BERT for Ad Hoc Document Retrieval

Wei Yang, Haotian Zhang, Jimmy Lin

1903.10972

A Systematic Classification of Knowledge, Reasoning, and Context within the ARC Dataset

Michael Boratko, Harshit Padigela, Divyendra Mikkilineni, Pritish Yuvraj, Rajarshi Das, Andrew McCallum, Maria Chang, Achille Fokoue-Nkoutche, Pavan Kapanipathi, Nicholas Mattei, Ryan Musa, Kartik Talamadupula, Michael Witbrock

1806.00358

Modeling Documents with Deep Boltzmann Machines

Nitish Srivastava, Ruslan R Salakhutdinov, Geoffrey E. Hinton

1309.6865

Deep Coevolutionary Network: Embedding User and Item Features for Recommendation

Hanjun Dai, Yichen Wang, Rakshit Trivedi, Le Song

1609.03675

Learning Groupwise Multivariate Scoring Functions Using Deep Neural Networks

Qingyao Ai, Xuanhui Wang, Sebastian Bruch, Nadav Golbandi, Michael Bendersky, Marc Najork

1811.04415

User Intent Prediction in Information-seeking Conversations

Chen Qu, Liu Yang, Bruce Croft, Yongfeng Zhang, Johanne R. Trippas, Minghui Qiu

1901.03489

Faithful to the Original: Fact Aware Neural Abstractive Summarization

Ziqiang Cao, Furu Wei, Wenjie Li, Sujian Li

1711.04434

Detection and Resolution of Rumours in Social Media: A Survey

Arkaitz Zubiaga, Ahmet Aker, Kalina Bontcheva, Maria Liakata, Rob Procter

1704.00656

Topic Models Conditioned on Arbitrary Features with Dirichlet-multinomial Regression

David Mimno, Andrew McCallum

1206.3278

DeepTileBars: Visualizing Term Distribution for Neural Information Retrieval

Zhiwen Tang, Grace Hui Yang

1811.00606

NPRF: A Neural Pseudo Relevance Feedback Framework for Ad-hoc Information Retrieval

Canjia Li, Yingfei Sun, Ben He, Le Wang, Kai Hui, Andrew Yates, Le Sun, Jungang Xu

1810.12936

MultiCQA: Zero-Shot Transfer of Self-Supervised Text Matching Models on a Massive Scale

Andreas Rücklé, Jonas Pfeiffer, Iryna Gurevych

2010.00980

Selective Weak Supervision for Neural Information Retrieval

Kaitao Zhang, Chenyan Xiong, Zhenghao Liu, Zhiyuan Liu

2001.10382

What Are You Token About? Dense Retrieval as Distributions Over the Vocabulary

Ori Ram, Liat Bezalel, Adi Zicher, Yonatan Belinkov, Jonathan Berant, Amir Globerson

2212.10380

Unsupervised Dense Information Retrieval with Contrastive Learning

Gautier Izacard, Mathilde Caron, Lucas Hosseini, Sebastian Riedel, Piotr Bojanowski, Armand Joulin, Edouard Grave

2112.09118

SGPT: GPT Sentence Embeddings for Semantic Search

Niklas Muennighoff

2202.08904

SPLADE v2: Sparse Lexical and Expansion Model for Information Retrieval

Thibault Formal, Carlos Lassance, Benjamin Piwowarski, Stéphane Clinchant

2109.10086

Large Dual Encoders Are Generalizable Retrievers

Jianmo Ni, Chen Qu, Jing Lu, Zhuyun Dai, Gustavo Hernández Ábrego, Ji Ma, Vincent Y. Zhao, Yi Luan, Keith B. Hall, Ming-Wei Chang, Yinfei Yang

2112.07899

Phrase Retrieval Learns Passage Retrieval, Too

Jinhyuk Lee, Alexander Wettig, Danqi Chen

2109.08133

Deep Relevance Ranking Using Enhanced Document-Query Interactions

Ryan McDonald, Georgios-Ioannis Brokos, Ion Androutsopoulos

1809.01682

Simple Entity-Centric Questions Challenge Dense Retrievers

Christopher Sciavolino, Zexuan Zhong, Jinhyuk Lee, Danqi Chen

2109.08535

Unsupervised Corpus Aware Language Model Pre-training for Dense Passage Retrieval

Luyu Gao, Jamie Callan

2108.05540

Domain-matched Pre-training Tasks for Dense Retrieval

Barlas Oğuz, Kushal Lakhotia, Anchit Gupta, Patrick Lewis, Vladimir Karpukhin, Aleksandra Piktus, Xilun Chen, Sebastian Riedel, Wen-tau Yih, Sonal Gupta, Yashar Mehdad

2107.13602

End-to-End Training of Multi-Document Reader and Retriever for Open-Domain Question Answering

Devendra Singh Sachan, Siva Reddy, William Hamilton, Chris Dyer, Dani Yogatama

2106.05346

Statistically Significant Detection of Linguistic Change

Vivek Kulkarni, Rami Al-Rfou, Bryan Perozzi, Steven Skiena

1411.3315

Efficient Transformers: A Survey

Yi Tay, Mostafa Dehghani, Dara Bahri, Donald Metzler

2009.06732

CodeSearchNet Challenge: Evaluating the State of Semantic Code Search

Hamel Husain, Ho-Hsiang Wu, Tiferet Gazit, Miltiadis Allamanis, Marc Brockschmidt

1909.09436

WorldTree: A Corpus of Explanation Graphs for Elementary Science Questions supporting Multi-Hop Inference

Peter A. Jansen, Elizabeth Wainwright, Steven Marmorstein, Clayton T. Morrison

1802.03052

A Deep Look into Neural Ranking Models for Information Retrieval

Jiafeng Guo, Yixing Fan, Liang Pang, Liu Yang, Qingyao Ai, Hamed Zamani, Chen Wu, W. Bruce Croft, Xueqi Cheng

1903.06902

Determinantal point processes for machine learning

Alex Kulesza, Ben Taskar

1207.6083

Community detection in graphs

Santo Fortunato

0906.0612

Order-Planning Neural Text Generation From Structured Data

Lei Sha, Lili Mou, Tianyu Liu, Pascal Poupart, Sujian Li, Baobao Chang, Zhifang Sui

1709.00155

Graph Convolutional Neural Networks for Web-Scale Recommender Systems

Rex Ying, Ruining He, Kaifeng Chen, Pong Eksombatchai, William L. Hamilton, Jure Leskovec

1806.01973

Joint Copying and Restricted Generation for Paraphrase

Ziqiang Cao, Chuwei Luo, Wenjie Li, Sujian Li

1611.09235

Learning a Deep Listwise Context Model for Ranking Refinement

Qingyao Ai, Keping Bi, Jiafeng Guo, W. Bruce Croft

1804.05936

Response Ranking with Deep Matching Networks and External Knowledge in Information-seeking Conversation Systems

Liu Yang, Minghui Qiu, Chen Qu, Jiafeng Guo, Yongfeng Zhang, W. Bruce Croft, Jun Huang, Haiqing Chen

1805.00188

TF-Ranking: Scalable TensorFlow Library for Learning-to-Rank

Rama Kumar Pasumarthi, Sebastian Bruch, Xuanhui Wang, Cheng Li, Michael Bendersky, Marc Najork, Jan Pfeifer, Nadav Golbandi, Rohan Anil, Stephan Wolf

1812.00073

DeepRank: A New Deep Architecture for Relevance Ranking in Information Retrieval

Liang Pang, Yanyan Lan, Jiafeng Guo, Jun Xu, Jingfang Xu, Xueqi Cheng

1710.05649

Analyzing and Characterizing User Intent in Information-seeking Conversations

Chen Qu, Liu Yang, W. Bruce Croft, Johanne R. Trippas, Yongfeng Zhang, Minghui Qiu

1804.08759

Neural Ranking Models with Weak Supervision

Mostafa Dehghani, Hamed Zamani, Aliaksei Severyn, Jaap Kamps, W. Bruce Croft

1704.08803

Learning to Match Using Local and Distributed Representations of Text for Web Search

Bhaskar Mitra, Fernando Diaz, Nick Craswell

1610.08136

A Deep Relevance Matching Model for Ad-hoc Retrieval

Jiafeng Guo, Yixing Fan, Qingyao Ai, W. Bruce Croft

1711.08611

Wide & Deep Learning for Recommender Systems

Heng-Tze Cheng, Levent Koc, Jeremiah Harmsen, Tal Shaked, Tushar Chandra, Hrishi Aradhye, Glen Anderson, Greg Corrado, Wei Chai, Mustafa Ispir, Rohan Anil, Zakaria Haque, Lichan Hong, Vihan Jain, Xiaobing Liu, Hemal Shah

1606.07792

Neural Matching Models for Question Retrieval and Next Question Prediction in Conversation

Liu Yang, Hamed Zamani, Yongfeng Zhang, Jiafeng Guo, W. Bruce Croft

1707.05409

A Neural Autoregressive Approach to Collaborative Filtering

Yin Zheng, Bangsheng Tang, Wenkui Ding, Hanning Zhou

1605.09477

Collaborative Deep Learning for Recommender Systems

Hao Wang, Naiyan Wang, Dit-Yan Yeung

1409.2944

Using Word Embeddings for Automatic Query Expansion

Dwaipayan Roy, Debjyoti Paul, Mandar Mitra, Utpal Garain

1606.07608

MTEB: Massive Text Embedding Benchmark

Niklas Muennighoff, Nouamane Tazi, Loïc Magne, Nils Reimers

2210.07316

CIDEr: Consensus-based Image Description Evaluation

Ramakrishna Vedantam, C. Lawrence Zitnick, Devi Parikh

1411.5726

Re-evaluating Evaluation in Text Summarization

Manik Bhandari, Pranav Gour, Atabak Ashfaq, Pengfei Liu, Graham Neubig

2010.07100

Tevatron: An Efficient and Flexible Toolkit for Dense Retrieval

Luyu Gao, Xueguang Ma, Jimmy Lin, Jamie Callan

2203.05765

Scaling Deep Contrastive Learning Batch Size under Memory Limited Setup

Luyu Gao, Yunyi Zhang, Jiawei Han, Jamie Callan

2101.06983

Summaformers @ LaySumm 20, LongSumm 20

Sayar Ghosh Roy, Nikhil Pinnaparaju, Risubh Jain, Manish Gupta, Vasudeva Varma

2101.03553

Improving Efficient Neural Ranking Models with Cross-Architecture Knowledge Distillation

Sebastian Hofstätter, Sophia Althammer, Michael Schröder, Mete Sertkan, Allan Hanbury

2010.02666

Learning text representation using recurrent convolutional neural network with highway layers

Ying Wen, Weinan Zhang, Rui Luo, Jun Wang

1606.06905

Entity Linking in 100 Languages

Jan A. Botha, Zifei Shan, Daniel Gillick

2011.02690

Extractive Adversarial Networks: High-Recall Explanations for Identifying Personal Attacks in Social Media Posts

Samuel Carton, Qiaozhu Mei, Paul Resnick

1809.01499

Task-Oriented Query Reformulation with Reinforcement Learning

Rodrigo Nogueira, Kyunghyun Cho

1704.04572

WikiHow: A Large Scale Text Summarization Dataset

Mahnaz Koupaee, William Yang Wang

1810.09305

Black-box Generation of Adversarial Text Sequences to Evade Deep Learning Classifiers

Ji Gao, Jack Lanchantin, Mary Lou Soffa, Yanjun Qi

1801.04354

Revealing the Importance of Semantic Retrieval for Machine Reading at Scale

Yixin Nie, Songhe Wang, Mohit Bansal

1909.08041

ISEEQ: Information Seeking Question Generation using Dynamic Meta-Information Retrieval and Knowledge Graphs

Manas Gaur, Kalpa Gunaratna, Vijay Srinivasan, Hongxia Jin

2112.07622

Recommender AI Agent: Integrating Large Language Models for Interactive Recommendations

Xu Huang, Jianxun Lian, Yuxuan Lei, Jing Yao, Defu Lian, Xing Xie

2308.16505

Passage Re-ranking with BERT

Rodrigo Nogueira, Kyunghyun Cho

1901.04085

PACRR: A Position-Aware Neural IR Model for Relevance Matching

Kai Hui, Andrew Yates, Klaus Berberich, Gerard de Melo

1704.03940

Overcoming catastrophic forgetting in neural networks

Brandon Shuen Yi Loke, Filippo Quadri, Gabriel Vivanco, Maximilian Casagrande, Saúl Fenollosa

2507.10485

RocketQA: An Optimized Training Approach to Dense Passage Retrieval for Open-Domain Question Answering

Yingqi Qu, Yuchen Ding, Jing Liu, Kai Liu, Ruiyang Ren, Wayne Xin Zhao, Daxiang Dong, Hua Wu, Haifeng Wang

2010.08191

COIL: Revisit Exact Lexical Match in Information Retrieval with Contextualized Inverted List

Luyu Gao, Zhuyun Dai, Jamie Callan

2104.07186

Offline bilingual word vectors, orthogonal transformations and the inverted softmax

Samuel L. Smith, David H. P. Turban, Steven Hamblin, Nils Y. Hammerla

1702.03859

Mr. TyDi: A Multi-lingual Benchmark for Dense Retrieval

Xinyu Zhang, Xueguang Ma, Peng Shi, Jimmy Lin

2108.08787

Text Embeddings by Weakly-Supervised Contrastive Pre-training

Liang Wang, Nan Yang, Xiaolong Huang, Binxing Jiao, Linjun Yang, Daxin Jiang, Rangan Majumder, Furu Wei

2212.03533

Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge

Peter Clark, Isaac Cowhey, Oren Etzioni, Tushar Khot, Ashish Sabharwal, Carissa Schoenick, Oyvind Tafjord

1803.05457

A Survey of Hallucination in Large Foundation Models

Vipula Rawte, Amit Sheth, Amitava Das

2309.05922

Findings of the 2016 WMT Shared Task on Cross-lingual Pronoun Prediction

Liane Guillou, Christian Hardmeier, Preslav Nakov, Sara Stymne, Jörg Tiedemann, Yannick Versley, Mauro Cettolo, Bonnie Webber, Andrei Popescu-Belis

1911.12091

Quasar: Datasets for Question Answering by Search and Reading

Bhuwan Dhingra, Kathryn Mazaitis, William W. Cohen

1707.03904

Local Self-Attention over Long Text for Efficient Document Retrieval

Sebastian Hofstätter, Hamed Zamani, Bhaskar Mitra, Nick Craswell, Allan Hanbury

2005.04908

Precise Zero-Shot Dense Retrieval without Relevance Labels

Luyu Gao, Xueguang Ma, Jimmy Lin, Jamie Callan

2212.10496

FiD-Light: Efficient and Effective Retrieval-Augmented Text Generation

Sebastian Hofstätter, Jiecao Chen, Karthik Raman, Hamed Zamani

2209.14290

Embedding-based Retrieval in Facebook Search

Jui-Ting Huang, Ashish Sharma, Shuying Sun, Li Xia, David Zhang, Philip Pronin, Janani Padmanabhan, Giuseppe Ottaviano, Linjun Yang

2006.11632

Informer: Beyond Efficient Transformer for Long Sequence Time-Series Forecasting

Haoyi Zhou, Shanghang Zhang, Jieqi Peng, Shuai Zhang, Jianxin Li, Hui Xiong, Wancai Zhang

2012.07436

Improving Topic Models with Latent Feature Word Representations

Dat Quoc Nguyen, Richard Billingsley, Lan Du, Mark Johnson

1810.06306

Get Your Vitamin C! Robust Fact Verification with Contrastive Evidence

Tal Schuster, Adam Fisch, Regina Barzilay

2103.08541

Hate Speech Detection and Racial Bias Mitigation in Social Media based on BERT model

Marzieh Mozafari, Reza Farahbakhsh, Noel Crespi

2008.06460

Reinforcement Learning for Relation Classification from Noisy Data

Jun Feng, Minlie Huang, Li Zhao, Yang Yang, Xiaoyan Zhu

1808.08013

OBELICS: An Open Web-Scale Filtered Dataset of Interleaved Image-Text Documents

Hugo Laurençon, Lucile Saulnier, Léo Tronchon, Stas Bekman, Amanpreet Singh, Anton Lozhkov, Thomas Wang, Siddharth Karamcheti, Alexander M. Rush, Douwe Kiela, Matthieu Cord, Victor Sanh

2306.16527

The CL-SciSumm Shared Task 2018: Results and Key Insights

Kokil Jaidka, Michihiro Yasunaga, Muthu Kumar Chandrasekaran, Dragomir Radev, Min-Yen Kan

1909.00764

The Web Is Your Oyster - Knowledge-Intensive NLP against a Very Large Web Corpus

Aleksandra Piktus, Fabio Petroni, Vladimir Karpukhin, Dmytro Okhonko, Samuel Broscheit, Gautier Izacard, Patrick Lewis, Barlas Oğuz, Edouard Grave, Wen-tau Yih, Sebastian Riedel

2112.09924

Counterfactual Reasoning and Learning Systems

Léon Bottou, Jonas Peters, Joaquin Quiñonero-Candela, Denis X. Charles, D. Max Chickering, Elon Portugaly, Dipankar Ray, Patrice Simard, Ed Snelson

1209.2355

Contextualizing Citations for Scientific Summarization using Word Embeddings and Domain Knowledge

Arman Cohan, Nazli Goharian

1705.08063

Variational Deep Semantic Hashing for Text Documents

Suthee Chaidaroon, Yi Fang

1708.03436

Item2Vec: Neural Item Embedding for Collaborative Filtering

Oren Barkan, Noam Koenigstein

1603.04259

A survey of embedding models of entities and relationships for knowledge graph completion

Dat Quoc Nguyen

1703.08098

MS MARCO: A Human Generated MAchine Reading COmprehension Dataset

Payal Bajaj, Daniel Campos, Nick Craswell, Li Deng, Jianfeng Gao, Xiaodong Liu, Rangan Majumder, Andrew McNamara, Bhaskar Mitra, Tri Nguyen, Mir Rosenberg, Xia Song, Alina Stoica, Saurabh Tiwary, Tong Wang

1611.09268

Import2vec - Learning Embeddings for Software Libraries

Bart Theeten, Frederik Vandeputte, Tom Van Cutsem

1904.03990

Dynamic Poisson Factorization

Laurent Charlin, Rajesh Ranganath, James McInerney, David M. Blei

1509.04640

Summary Level Training of Sentence Rewriting for Abstractive Summarization

Sanghwan Bae, Taeuk Kim, Jihoon Kim, Sang-goo Lee

1909.08752

Query Expansion with Locally-Trained Word Embeddings

Fernando Diaz, Bhaskar Mitra, Nick Craswell

1605.07891

SemEval-2016 Task 3: Community Question Answering

Preslav Nakov, Lluís Màrquez, Alessandro Moschitti, Walid Magdy, Hamdy Mubarak, Abed Alhakim Freihat, James Glass, Bilal Randeree

1912.01972

Federated Meta-Learning with Fast Convergence and Efficient Communication

Fei Chen, Mi Luo, Zhenhua Dong, Zhenguo Li, Xiuqiang He

1802.07876

MultiFC: A Real-World Multi-Domain Dataset for Evidence-Based Fact Checking of Claims

Isabelle Augenstein, Christina Lioma, Dongsheng Wang, Lucas Chaves Lima, Casper Hansen, Christian Hansen, Jakob Grue Simonsen

1909.03242

SamToNe: Improving Contrastive Loss for Dual Encoder Retrieval Models with Same Tower Negatives

Fedor Moiseev, Gustavo Hernandez Abrego, Peter Dornbach, Imed Zitouni, Enrique Alfonseca, Zhe Dong

2306.02516

Making a MIRACL: Multilingual Information Retrieval Across a Continuum of Languages

Xinyu Zhang, Nandan Thakur, Odunayo Ogundepo, Ehsan Kamalloo, David Alfonso-Hermelo, Xiaoguang Li, Qun Liu, Mehdi Rezagholizadeh, Jimmy Lin

2210.09984

Continuous Representation of Location for Geolocation and Lexical Dialectology using Mixture Density Networks

Afshin Rahimi, Timothy Baldwin, Trevor Cohn

1708.04358

Relevance-based Word Embedding

Hamed Zamani, W. Bruce Croft

1705.03556

Neural Information Retrieval: A Literature Review

Ye Zhang, Md Mustafizur Rahman, Alex Braylan, Brandon Dang, Heng-Lu Chang, Henna Kim, Quinten McNamara, Aaron Angert, Edward Banner, Vivek Khetan, Tyler McDonnell, An Thanh Nguyen, Dan Xu, Byron C. Wallace, Matthew Lease

1611.06792

A Dataset for Movie Description

Anna Rohrbach, Marcus Rohrbach, Niket Tandon, Bernt Schiele

1501.02530

REST: Retrieval-Based Speculative Decoding

Zhenyu He, Zexuan Zhong, Tianle Cai, Jason D. Lee, Di He

2311.08252

BEIR: A Heterogenous Benchmark for Zero-shot Evaluation of Information Retrieval Models

Nandan Thakur, Nils Reimers, Andreas Rücklé, Abhishek Srivastava, Iryna Gurevych

2104.08663

Recurrent Generative Adversarial Networks for Proximal Learning and Automated Compressive Image Recovery

Morteza Mardani, Hatef Monajemi, Vardan Papyan, Shreyas Vasanawala, David Donoho, John Pauly

1711.10046

Hyperbolic Representation Learning for Fast and Efficient Neural Question Answering

Yi Tay, Luu Anh Tuan, Siu Cheung Hui

1707.07847

A Hierarchical Framework for Relation Extraction with Reinforcement Learning

Ryuichi Takanobu, Tianyang Zhang, Jiexi Liu, Minlie Huang

1811.03925

Self-Supervised Hyperboloid Representations from Logical Queries over Knowledge Graphs

Nurendra Choudhary, Nikhil Rao, Sumeet Katariya, Karthik Subbian, Chandan K. Reddy

2012.13023

Metric Learning for Adversarial Robustness

Chengzhi Mao, Ziyuan Zhong, Junfeng Yang, Carl Vondrick, Baishakhi Ray

1909.00900

Promptagator: Few-shot Dense Retrieval From 8 Examples

Zhuyun Dai, Vincent Y. Zhao, Ji Ma, Yi Luan, Jianmo Ni, Jing Lu, Anton Bakalov, Kelvin Guu, Keith B. Hall, Ming-Wei Chang

2209.11755

What's Cookin'? Interpreting Cooking Videos using Text, Speech and Vision

Jonathan Malmaud, Jonathan Huang, Vivek Rathod, Nick Johnston, Andrew Rabinovich, Kevin Murphy

1503.01558

Deeper Text Understanding for IR with Contextual Neural Language Modeling

Zhuyun Dai, Jamie Callan

1905.09217

Man is to Person as Woman is to Location: Measuring Gender Bias in Named Entity Recognition

Ninareh Mehrabi, Thamme Gowda, Fred Morstatter, Nanyun Peng, Aram Galstyan

1910.10872

Beyond 512 Tokens: Siamese Multi-depth Transformer-based Hierarchical Encoder for Long-Form Document Matching

Liu Yang, Mingyang Zhang, Cheng Li, Michael Bendersky, Marc Najork

2004.12297

ChatGPT versus Traditional Question Answering for Knowledge Graphs: Current Status and Future Directions Towards Knowledge Graph Chatbots

Reham Omar, Omij Mangukiya, Panos Kalnis, Essam Mansour

2302.06466

Simplified TinyBERT: Knowledge Distillation for Document Retrieval

Xuanang Chen, Ben He, Kai Hui, Le Sun, Yingfei Sun

2009.07531

LLMRec: Benchmarking Large Language Models on Recommendation Task

Junling Liu, Chao Liu, Peilin Zhou, Qichen Ye, Dading Chong, Kang Zhou, Yueqi Xie, Yuwei Cao, Shoujin Wang, Chenyu You, Philip S. Yu

2308.12241

Do LLMs Understand User Preferences? Evaluating LLMs On User Rating Prediction

Wang-Cheng Kang, Jianmo Ni, Nikhil Mehta, Maheswaran Sathiamoorthy, Lichan Hong, Ed Chi, Derek Zhiyuan Cheng

2305.06474

Measuring Emotions in the COVID-19 Real World Worry Dataset

Bennett Kleinberg, Isabelle van der Vegt, Maximilian Mozes

2004.04225

NAIST COVID: Multilingual COVID-19 Twitter and Weibo Dataset

Zhiwei Gao, Shuntaro Yada, Shoko Wakamiya, Eiji Aramaki

2004.08145

Billion-scale similarity search with GPUs

Jeff Johnson, Matthijs Douze, Hervé Jégou

1702.08734

Overview of the TREC 2020 deep learning track

Nick Craswell, Bhaskar Mitra, Emine Yilmaz, Daniel Campos

2102.07662

Can ChatGPT Write a Good Boolean Query for Systematic Review Literature Search?

Shuai Wang, Harrisen Scells, Bevan Koopman, Guido Zuccon

2302.03495

Joint Constrained Learning for Event-Event Relation Extraction

Haoyu Wang, Muhao Chen, Hongming Zhang, Dan Roth

2010.06727

Evaluating Verifiability in Generative Search Engines

Nelson F. Liu, Tianyi Zhang, Percy Liang

2304.09848

Bridging the Gap Between Indexing and Retrieval for Differentiable Search Index with Query Generation

Shengyao Zhuang, Houxing Ren, Linjun Shou, Jian Pei, Ming Gong, Guido Zuccon, Daxin Jiang

2206.10128

Integrating Document Clustering and Topic Modeling

Pengtao Xie, Eric P. Xing

1309.6874

Joint Reasoning for Temporal and Causal Relations

Qiang Ning, Zhili Feng, Hao Wu, Dan Roth

1906.04941

Recent Advances in Deep Learning Based Dialogue Systems: A Systematic Survey

Jinjie Ni, Tom Young, Vlad Pandelea, Fuzhao Xue, Erik Cambria

2105.04387

CogCompTime: A Tool for Understanding Time in Natural Language Text

Qiang Ning, Ben Zhou, Zhili Feng, Haoruo Peng, Dan Roth

1906.04940

Cross Temporal Recurrent Networks for Ranking Question Answer Pairs

Yi Tay, Luu Anh Tuan, Siu Cheung Hui

1711.07656

A Dual Embedding Space Model for Document Ranking

Bhaskar Mitra, Eric Nalisnick, Nick Craswell, Rich Caruana

1602.01137

SemEval-2015 Task 10: Sentiment Analysis in Twitter

Sara Rosenthal, Saif M Mohammad, Preslav Nakov, Alan Ritter, Svetlana Kiritchenko, Veselin Stoyanov

1912.02387

Understanding Capacity-Driven Scale-Out Neural Recommendation Inference

Michael Lui, Yavuz Yetim, Özgür Özkan, Zhuoran Zhao, Shin-Yeh Tsai, Carole-Jean Wu, Mark Hempstead

2011.02084

Variational Autoencoders for Collaborative Filtering

Dawen Liang, Rahul G. Krishnan, Matthew D. Hoffman, Tony Jebara

1802.05814

Investigating the Successes and Failures of BERT for Passage Re-Ranking

Harshith Padigela, Hamed Zamani, W. Bruce Croft

1905.01758

Generation-Augmented Retrieval for Open-domain Question Answering

Yuning Mao, Pengcheng He, Xiaodong Liu, Yelong Shen, Jianfeng Gao, Jiawei Han, Weizhu Chen

2009.08553

A Study of MatchPyramid Models on Ad-hoc Retrieval

Liang Pang, Yanyan Lan, Jiafeng Guo, Jun Xu, Xueqi Cheng

1606.04648

Generic Intent Representation in Web Search

Hongfei Zhang, Xia Song, Chenyan Xiong, Corby Rosset, Paul N. Bennett, Nick Craswell, Saurabh Tiwary

1907.10710

Understanding BERT Rankers Under Distillation

Luyu Gao, Zhuyun Dai, Jamie Callan

2007.11088

Knowledge-Based Trust: Estimating the Trustworthiness of Web Sources

Xin Luna Dong, Evgeniy Gabrilovich, Kevin Murphy, Van Dang, Wilko Horn, Camillo Lugaresi, Shaohua Sun, Wei Zhang

1502.03519

Retrieval-Enhanced Machine Learning

Hamed Zamani, Fernando Diaz, Mostafa Dehghani, Donald Metzler, Michael Bendersky

2205.01230

A Hierarchical Recurrent Encoder-Decoder For Generative Context-Aware Query Suggestion

Alessandro Sordoni, Yoshua Bengio, Hossein Vahabi, Christina Lioma, Jakob G. Simonsen, Jian-Yun Nie

1507.02221

GPT-4V(ision) is a Generalist Web Agent, if Grounded

Boyuan Zheng, Boyu Gou, Jihyung Kil, Huan Sun, Yu Su

2401.01614

IRGAN: A Minimax Game for Unifying Generative and Discriminative Information Retrieval Models

Jun Wang, Lantao Yu, Weinan Zhang, Yu Gong, Yinghui Xu, Benyou Wang, Peng Zhang, Dell Zhang

1705.10513

A BERT-Based Transfer Learning Approach for Hate Speech Detection in Online Social Media

Marzieh Mozafari, Reza Farahbakhsh, Noel Crespi

1910.12574

Learning Dense Representations for Entity Retrieval

Daniel Gillick, Sayali Kulkarni, Larry Lansing, Alessandro Presta, Jason Baldridge, Eugene Ie, Diego Garcia-Olano

1909.10506

Learning Topic Models - Going beyond SVD

Sanjeev Arora, Rong Ge, Ankur Moitra

1204.1956

Seq2Slate: Re-ranking and Slate Optimization with RNNs

Irwan Bello, Sayali Kulkarni, Sagar Jain, Craig Boutilier, Ed Chi, Elad Eban, Xiyang Luo, Alan Mackey, Ofer Meshi

1810.02019

Controlling Fairness and Bias in Dynamic Learning-to-Rank

Marco Morik, Ashudeep Singh, Jessica Hong, Thorsten Joachims

2005.14713

Efficient Document Re-Ranking for Transformers by Precomputing Term Representations

Sean MacAvaney, Franco Maria Nardini, Raffaele Perego, Nicola Tonellotto, Nazli Goharian, Ophir Frieder

2004.14255

Privacy in Search Logs

Michaela Goetz, Ashwin Machanavajjhala, Guozhang Wang, Xiaokui Xiao, Johannes Gehrke

0904.0682

A Symmetric Dual Encoding Dense Retrieval Framework for Knowledge-Intensive Visual Question Answering

Alireza Salemi, Juan Altmayer Pizzorno, Hamed Zamani

2304.13649

Content-Based Citation Recommendation

Chandra Bhagavatula, Sergey Feldman, Russell Power, Waleed Ammar

1802.08301

Explaining Predictions of Non-Linear Classifiers in NLP

Leila Arras, Franziska Horn, Grégoire Montavon, Klaus-Robert Müller, Wojciech Samek

1606.07298

TREC-COVID: Constructing a Pandemic Information Retrieval Test Collection

Ellen Voorhees, Tasmeer Alam, Steven Bedrick, Dina Demner-Fushman, William R Hersh, Kyle Lo, Kirk Roberts, Ian Soboroff, Lucy Lu Wang

2005.04474

Aspect-based Document Similarity for Research Papers

Malte Ostendorff, Terry Ruas, Till Blume, Bela Gipp, Georg Rehm

2010.06395

Overview of the TREC 2019 deep learning track

Nick Craswell, Bhaskar Mitra, Emine Yilmaz, Daniel Campos, Ellen M. Voorhees

2003.07820

The Expando-Mono-Duo Design Pattern for Text Ranking with Pretrained Sequence-to-Sequence Models

Ronak Pradeep, Rodrigo Nogueira, Jimmy Lin

2101.05667

Document Expansion by Query Prediction

Rodrigo Nogueira, Wei Yang, Jimmy Lin, Kyunghyun Cho

1904.08375

Transfer Learning Approaches for Building Cross-Language Dense Retrieval Models

Suraj Nair, Eugene Yang, Dawn Lawrie, Kevin Duh, Paul McNamee, Kenton Murray, James Mayfield, Douglas W. Oard

2201.08471

PAIR: Leveraging Passage-Centric Similarity Relation for Improving Dense Passage Retrieval

Ruiyang Ren, Shangwen Lv, Yingqi Qu, Jing Liu, Wayne Xin Zhao, QiaoQiao She, Hua Wu, Haifeng Wang, Ji-Rong Wen

2108.06027

Scientific Article Summarization Using Citation-Context and Article's Discourse Structure

Arman Cohan, Nazli Goharian

1704.06619

End-to-End Retrieval in Continuous Space

Daniel Gillick, Alessandro Presta, Gaurav Singh Tomar

1811.08008

MedSTS: A Resource for Clinical Semantic Textual Similarity

Yanshan Wang, Naveed Afzal, Sunyang Fu, Liwei Wang, Feichen Shen, Majid Rastegar-Mojarad, Hongfang Liu

1808.09397

EXAMS: A Multi-Subject High School Examinations Dataset for Cross-Lingual and Multilingual Question Answering

Momchil Hardalov, Todor Mihaylov, Dimitrina Zlatkova, Yoan Dinkov, Ivan Koychev, Preslav Nakov

2011.03080

Deep Learning for Sentiment Analysis : A Survey

Lei Zhang, Shuai Wang, Bing Liu

1801.07883

Neural Collaborative Filtering

Xiangnan He, Lizi Liao, Hanwang Zhang, Liqiang Nie, Xia Hu, Tat-Seng Chua

1708.05031

Few-Shot Named Entity Recognition: A Comprehensive Study

Jiaxin Huang, Chunyuan Li, Krishan Subudhi, Damien Jose, Shobana Balakrishnan, Weizhu Chen, Baolin Peng, Jianfeng Gao, Jiawei Han

2012.14978

A Neural Corpus Indexer for Document Retrieval

Yujing Wang, Yingyan Hou, Haonan Wang, Ziming Miao, Shibin Wu, Hao Sun, Qi Chen, Yuqing Xia, Chengmin Chi, Guoshuai Zhao, Zheng Liu, Xing Xie, Hao Allen Sun, Weiwei Deng, Qi Zhang, Mao Yang

2206.02743

Thinking about GPT-3 In-Context Learning for Biomedical IE? Think Again

Bernal Jiménez Gutiérrez, Nikolas McNeal, Clay Washington, You Chen, Lang Li, Huan Sun, Yu Su

2203.08410

Asymmetric LSH (ALSH) for Sublinear Time Maximum Inner Product Search (MIPS)

Anshumali Shrivastava, Ping Li

1405.5869

A SUPER* Algorithm to Optimize Paper Bidding in Peer Review

Tanner Fiez, Nihar B. Shah, Lillian Ratliff

2007.07079

Reasoning with Language Model Prompting: A Survey

Shuofei Qiao, Yixin Ou, Ningyu Zhang, Xiang Chen, Yunzhi Yao, Shumin Deng, Chuanqi Tan, Fei Huang, Huajun Chen

2212.09597

Factor Graph Attention

Idan Schwartz, Seunghak Yu, Tamir Hazan, Alexander Schwing

1904.05880

Learning from LDA using Deep Neural Networks

Dongxu Zhang, Tianyi Luo, Dong Wang, Rong Liu

1508.01011

MMSearch: Benchmarking the Potential of Large Models as Multi-modal Search Engines

Dongzhi Jiang, Renrui Zhang, Ziyu Guo, Yanmin Wu, Jiayi Lei, Pengshuo Qiu, Pan Lu, Zehui Chen, Chaoyou Fu, Guanglu Song, Peng Gao, Yu Liu, Chunyuan Li, Hongsheng Li

2409.12959

Large Language Models are Zero-Shot Rankers for Recommender Systems

Yupeng Hou, Junjie Zhang, Zihan Lin, Hongyu Lu, Ruobing Xie, Julian McAuley, Wayne Xin Zhao

2305.08845

TAPAS: Weakly Supervised Table Parsing via Pre-training

Jonathan Herzig, Paweł Krzysztof Nowak, Thomas Müller, Francesco Piccinno, Julian Martin Eisenschlos

2004.02349

A Hierarchical Model for Data-to-Text Generation

Clément Rebuffel, Laure Soulier, Geoffrey Scoutheeten, Patrick Gallinari

1912.10011

Generating Representative Headlines for News Stories

Xiaotao Gu, Yuning Mao, Jiawei Han, Jialu Liu, Hongkun Yu, You Wu, Cong Yu, Daniel Finnie, Jiaqi Zhai, Nicholas Zukoski

2001.09386

Taxonomy Completion via Triplet Matching Network

Jieyu Zhang, Xiangchen Song, Ying Zeng, Jiaze Chen, Jiaming Shen, Yuning Mao, Lei Li

2101.01896

TVR: A Large-Scale Dataset for Video-Subtitle Moment Retrieval

Jie Lei, Licheng Yu, Tamara L. Berg, Mohit Bansal

2001.09099

On the complexity of nonnegative matrix factorization

Stephen A. Vavasis

0708.4149

Evolution of Semantic Similarity -- A Survey

Dhivya Chandrasekaran, Vijay Mago

2004.13820

On the Factory Floor: ML Engineering for Industrial-Scale Ads Recommendation Models

Rohan Anil, Sandra Gadanho, Da Huang, Nijith Jacob, Zhuoshu Li, Dong Lin, Todd Phillips, Cristina Pop, Kevin Regan, Gil I. Shamir, Rakesh Shivanna, Qiqi Yan

2209.05310

Overview of the TREC 2022 Fair Ranking Track

Michael D. Ekstrand, Graham McDonald, Amifa Raj, Isaac Johnson

2302.05558

Automated MeSH Term Suggestion for Effective Query Formulation in Systematic Reviews Literature Search

Shuai Wang, Harrisen Scells, Bevan Koopman, Guido Zuccon

2209.08687

Neural Code Search Revisited: Enhancing Code Snippet Retrieval through Natural Language Intent

Geert Heyman, Tom Van Cutsem

2008.12193

CoaCor: Code Annotation for Code Retrieval with Reinforcement Learning

Ziyu Yao, Jayavardhan Reddy Peddamail, Huan Sun

1904.00720

Machine Translation Evaluation Meets Community Question Answering

Francisco Guzmán, Lluís Màrquez, Preslav Nakov

1912.02998

The Benchmark Lottery

Mostafa Dehghani, Yi Tay, Alexey A. Gritsenko, Zhe Zhao, Neil Houlsby, Fernando Diaz, Donald Metzler, Oriol Vinyals

2107.07002

NaturalProofs: Mathematical Theorem Proving in Natural Language

Sean Welleck, Jiacheng Liu, Ronan Le Bras, Hannaneh Hajishirzi, Yejin Choi, Kyunghyun Cho

2104.01112

Scalable Text and Link Analysis with Mixed-Topic Link Models

Yaojia Zhu, Xiaoran Yan, Lise Getoor, Cristopher Moore

1303.7264

UKP-Athene: Multi-Sentence Textual Entailment for Claim Verification

Andreas Hanselowski, Hao Zhang, Zile Li, Daniil Sorokin, Benjamin Schiller, Claudia Schulz, Iryna Gurevych

1809.01479

Centaur: A Chiplet-based, Hybrid Sparse-Dense Accelerator for Personalized Recommendations

Ranggi Hwang, Taehun Kim, Youngeun Kwon, Minsoo Rhu

2005.05968

SemanticZ at SemEval-2016 Task 3: Ranking Relevant Answers in Community Question Answering Using Semantic Similarity Based on Fine-tuned Word Embeddings

Todor Mihaylov, Preslav Nakov

1911.08743

LP-MusicCaps: LLM-Based Pseudo Music Captioning

SeungHeon Doh, Keunwoo Choi, Jongpil Lee, Juhan Nam

2307.16372

Interpretable & Time-Budget-Constrained Contextualization for Re-Ranking

Sebastian Hofstätter, Markus Zlabinger, Allan Hanbury

2002.01854

Fairness in Recommendation Ranking through Pairwise Comparisons

Alex Beutel, Jilin Chen, Tulsee Doshi, Hai Qian, Li Wei, Yi Wu, Lukasz Heldt, Zhe Zhao, Lichan Hong, Ed H. Chi, Cristos Goodrow

1903.00780

Improved Asymmetric Locality Sensitive Hashing (ALSH) for Maximum Inner Product Search (MIPS)

Anshumali Shrivastava, Ping Li

1410.5410

Let's measure run time! Extending the IR replicability infrastructure to include performance aspects

Sebastian Hofstätter, Allan Hanbury

1907.04614

Comparing Fair Ranking Metrics

Amifa Raj, Michael D. Ekstrand

2009.01311

Efficient Image Retrieval via Decoupling Diffusion into Online and Offline Processing

Fan Yang, Ryota Hinami, Yusuke Matsui, Steven Ly, Shin'ichi Satoh

1811.10907

LLMRec: Large Language Models with Graph Augmentation for Recommendation

Wei Wei, Xubin Ren, Jiabin Tang, Qinyong Wang, Lixin Su, Suqi Cheng, Junfeng Wang, Dawei Yin, Chao Huang

2311.00423

Markov Determinantal Point Processes

Raja Hafiz Affandi, Alex Kulesza, Emily B. Fox

1210.4850

Seed-driven Document Ranking for Systematic Reviews: A Reproducibility Study

Shuai Wang, Harrisen Scells, Ahmed Mourad, Guido Zuccon

2112.04090

Interest-aware Message-Passing GCN for Recommendation

Fan Liu, Zhiyong Cheng, Lei Zhu, Zan Gao, Liqiang Nie

2102.10044

Improving the Domain Adaptation of Retrieval Augmented Generation (RAG) Models for Open Domain Question Answering

Shamane Siriwardhana, Rivindu Weerasekera, Elliott Wen, Tharindu Kaluarachchi, Rajib Rana, Suranga Nanayakkara

2210.02627

Hierarchical Temporal Convolutional Networks for Dynamic Recommender Systems

Jiaxuan You, Yichen Wang, Aditya Pal, Pong Eksombatchai, Chuck Rosenberg, Jure Leskovec

1904.04381

Deep Interest Evolution Network for Click-Through Rate Prediction

Guorui Zhou, Na Mou, Ying Fan, Qi Pi, Weijie Bian, Chang Zhou, Xiaoqiang Zhu, Kun Gai

1809.03672

QUILL: Query Intent with Large Language Models using Retrieval Augmentation and Multi-stage Distillation

Krishna Srinivasan, Karthik Raman, Anupam Samanta, Lingrui Liao, Luca Bertelli, Mike Bendersky

2210.15718

Session-based Recommendations with Recurrent Neural Networks

Balázs Hidasi, Alexandros Karatzoglou, Linas Baltrunas, Domonkos Tikk

1511.06939

Cross-Modal Interaction Networks for Query-Based Moment Retrieval in Videos

Zhu Zhang, Zhijie Lin, Zhou Zhao, Zhenxin Xiao

1906.02497

Large Language Models for Information Retrieval: A Survey

Yutao Zhu, Huaying Yuan, Shuting Wang, Jiongnan Liu, Wenhan Liu, Chenlong Deng, Haonan Chen, Zheng Liu, Zhicheng Dou, Ji-Rong Wen

2308.07107

LightGNN: Simple Graph Neural Network for Recommendation

Guoxuan Chen, Lianghao Xia, Chao Huang

2501.03228

On Symmetric and Asymmetric LSHs for Inner Product Search

Behnam Neyshabur, Nathan Srebro

1410.5518

Cross-Domain Image Retrieval with Attention Modeling

Xin Ji, Wei Wang, Meihui Zhang, Yang Yang

1709.01784

CenterCLIP: Token Clustering for Efficient Text-Video Retrieval

Shuai Zhao, Linchao Zhu, Xiaohan Wang, Yi Yang

2205.00823

Collaborative Filtering with Recurrent Neural Networks

Robin Devooght, Hugues Bersini

1608.07400

Learning Mixtures of Submodular Shells with Application to Document Summarization

Hui Lin, Jeff A. Bilmes

1210.4871

STEAM: Self-Supervised Taxonomy Expansion with Mini-Paths

Yue Yu, Yinghao Li, Jiaming Shen, Hao Feng, Jimeng Sun, Chao Zhang

2006.10217

Fast Matrix Factorization for Online Recommendation with Implicit Feedback

Xiangnan He, Hanwang Zhang, Min-Yen Kan, Tat-Seng Chua

1708.05024

From Little Things Big Things Grow: A Collection with Seed Studies for Medical Systematic Review Literature Search

Shuai Wang, Harrisen Scells, Justin Clark, Bevan Koopman, Guido Zuccon

2204.03096

Federated Collaborative Filtering for Privacy-Preserving Personalized Recommendation System

Muhammad Ammad-ud-din, Elena Ivannikova, Suleiman A. Khan, Were Oyomno, Qiang Fu, Kuan Eeik Tan, Adrian Flanagan

1901.09888

When Large Language Models Meet Personalization: Perspectives of Challenges and Opportunities

Jin Chen, Zheng Liu, Xu Huang, Chenwang Wu, Qi Liu, Gangwei Jiang, Yuanhao Pu, Yuxuan Lei, Xiaolong Chen, Xingmei Wang, Defu Lian, Enhong Chen

2307.16376

Are We Really Making Much Progress? A Worrying Analysis of Recent Neural Recommendation Approaches

Maurizio Ferrari Dacrema, Paolo Cremonesi, Dietmar Jannach

1907.06902

Table2Vec: Neural Word and Entity Embeddings for Table Population and Retrieval

Li Deng, Shuo Zhang, Krisztian Balog

1906.00041

Topic Discovery via Latent Space Clustering of Pretrained Language Model Representations

Yu Meng, Yunyi Zhang, Jiaxin Huang, Yu Zhang, Jiawei Han

2202.04582

Graph Bottlenecked Social Recommendation

Yonghui Yang, Le Wu, Zihan Wang, Zhuangzhuang He, Richang Hong, Meng Wang

2406.08214

Knowledge Graph Retrieval-Augmented Generation for LLM-based Recommendation

Shijie Wang, Wenqi Fan, Yue Feng, Shanru Lin, Xinyu Ma, Shuaiqiang Wang, Dawei Yin

2501.02226

Exposing Paid Opinion Manipulation Trolls

Todor Mihaylov, Ivan Koychev, Georgi Georgiev, Preslav Nakov

2109.13726

Evaluating Stochastic Rankings with Expected Exposure

Fernando Diaz, Bhaskar Mitra, Michael D. Ekstrand, Asia J. Biega, Ben Carterette

2004.13157

Deep Cross-Modal Hashing

Qing-Yuan Jiang, Wu-Jun Li

1602.02255

SemEval-2015 Task 3: Answer Selection in Community Question Answering

Preslav Nakov, Lluís Màrquez, Walid Magdy, Alessandro Moschitti, James Glass, Bilal Randeree

1911.11403

Much Ado About Gender: Current Practices and Future Recommendations for Appropriate Gender-Aware Information Access

Christine Pinney, Amifa Raj, Alex Hanna, Michael D. Ekstrand

2301.04780

Retrieval-Augmented Purifier for Robust LLM-Empowered Recommendation

Liangbo Ning, Wenqi Fan, Qing Li

2504.02458

Large Language Models as Zero-Shot Conversational Recommenders

Zhankui He, Zhouhang Xie, Rahul Jha, Harald Steck, Dawen Liang, Yesu Feng, Bodhisattwa Prasad Majumder, Nathan Kallus, Julian McAuley

2308.10053

Generating Extractive Summaries of Scientific Paradigms

Vahed Qazvinian, Dragomir R. Radev, Saif M. Mohammad, Bonnie Dorr, David Zajic, Michael Whidby, Taesun Moon

1402.0556

To Interpolate or not to Interpolate: PRF, Dense and Sparse Retrievers

Hang Li, Shuai Wang, Shengyao Zhuang, Ahmed Mourad, Xueguang Ma, Jimmy Lin, Guido Zuccon

2205.00235

On the Effect of Low-Frequency Terms on Neural-IR Models

Sebastian Hofstätter, Navid Rekabsaz, Carsten Eickhoff, Allan Hanbury

1904.12683

SemEval-2014 Task 9: Sentiment Analysis in Twitter

Sara Rosenthal, Preslav Nakov, Alan Ritter, Veselin Stoyanov

1912.02990

End-to-End ASR-free Keyword Search from Speech

Kartik Audhkhasi, Andrew Rosenberg, Abhinav Sethy, Bhuvana Ramabhadran, Brian Kingsbury

1701.04313

A Contextual-Bandit Approach to Personalized News Article Recommendation

Lihong Li, Wei Chu, John Langford, Robert E. Schapire

1003.0146

Fairness in Ranking: A Survey

Meike Zehlike, Ke Yang, Julia Stoyanovich

2103.14000

Synthesizer: Rethinking Self-Attention in Transformer Models

Yi Tay, Dara Bahri, Donald Metzler, Da-Cheng Juan, Zhe Zhao, Che Zheng

2005.00743

Into the Unknown Unknowns: Engaged Human Learning through Participation in Language Model Agent Conversations

Yucheng Jiang, Yijia Shao, Dekun Ma, Sina J. Semnani, Monica S. Lam

2408.15232

A Generic Coordinate Descent Framework for Learning from Implicit Feedback

Immanuel Bayer, Xiangnan He, Bhargav Kanagal, Steffen Rendle

1611.04666

A Comparison of Word Embeddings for the Biomedical Natural Language Processing

Yanshan Wang, Sijia Liu, Naveed Afzal, Majid Rastegar-Mojarad, Liwei Wang, Feichen Shen, Paul Kingsbury, Hongfang Liu

1802.00400

Optimizing Generalized PageRank Methods for Seed-Expansion Community Detection

Pan Li, Eli Chien, Olgica Milenkovic

1905.10881

SemEval-2013 Task 2: Sentiment Analysis in Twitter

Preslav Nakov, Zornitsa Kozareva, Alan Ritter, Sara Rosenthal, Veselin Stoyanov, Theresa Wilson

1912.06806

Pseudo-Relevance Feedback for Multiple Representation Dense Retrieval

Xiao Wang, Craig Macdonald, Nicola Tonellotto, Iadh Ounis

2106.11251

Knowledge Graph Convolutional Networks for Recommender Systems

Hongwei Wang, Miao Zhao, Xing Xie, Wenjie Li, Minyi Guo

1904.12575

Adapting Large Language Models by Integrating Collaborative Semantics for Recommendation

Bowen Zheng, Yupeng Hou, Hongyu Lu, Yu Chen, Wayne Xin Zhao, Ming Chen, Ji-Rong Wen

2311.09049

Policy Learning for Fairness in Ranking

Ashudeep Singh, Thorsten Joachims

1902.04056

Estimating Position Bias without Intrusive Interventions

Aman Agarwal, Ivan Zaitsev, Xuanhui Wang, Cheng Li, Marc Najork, Thorsten Joachims

1812.05161

Reducing Disparate Exposure in Ranking: A Learning To Rank Approach

Meike Zehlike, Carlos Castillo

1805.08716

A Framework for Optimizing Paper Matching

Laurent Charlin, Richard S. Zemel, Craig Boutilier

1202.3706

Inductive Matrix Completion Based on Graph Neural Networks

Muhan Zhang, Yixin Chen

1904.12058

LCSTS: A Large Scale Chinese Short Text Summarization Dataset

Baotian Hu, Qingcai Chen, Fangze Zhu

1506.05865

A Semi-automatic Method for Efficient Detection of Stories on Social Media

Soroush Vosoughi, Deb Roy

1605.05134

Cross-type Biomedical Named Entity Recognition with Deep Multi-Task Learning

Xuan Wang, Yu Zhang, Xiang Ren, Yuhao Zhang, Marinka Zitnik, Jingbo Shang, Curtis Langlotz, Jiawei Han

1801.09851

Demonstrate-Search-Predict: Composing retrieval and language models for knowledge-intensive NLP

Omar Khattab, Keshav Santhanam, Xiang Lisa Li, David Hall, Percy Liang, Christopher Potts, Matei Zaharia

2212.14024

ColBERTv2: Effective and Efficient Retrieval via Lightweight Late Interaction

Keshav Santhanam, Omar Khattab, Jon Saad-Falcon, Christopher Potts, Matei Zaharia

2112.01488

The Power of Noise: Redefining Retrieval for RAG Systems

Florin Cuconasu, Giovanni Trappolini, Federico Siciliano, Simone Filice, Cesare Campagnano, Yoelle Maarek, Nicola Tonellotto, Fabrizio Silvestri

2401.14887

Hindsight: Posterior-guided training of retrievers for improved open-ended generation

Ashwin Paranjape, Omar Khattab, Christopher Potts, Matei Zaharia, Christopher D. Manning

2110.07752

The highD Dataset: A Drone Dataset of Naturalistic Vehicle Trajectories on German Highways for Validation of Highly Automated Driving Systems

Robert Krajewski, Julian Bock, Laurent Kloeker, Lutz Eckstein

1810.05642

Unbiased Learning to Rank with Unbiased Propensity Estimation

Qingyao Ai, Keping Bi, Cheng Luo, Jiafeng Guo, W. Bruce Croft

1804.05938

Effective Evaluation using Logged Bandit Feedback from Multiple Loggers

Aman Agarwal, Soumya Basu, Tobias Schnabel, Thorsten Joachims

1703.06180