{"as_of":"2026-08-10T03:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:38a2b52fcaf6be66fa3d5a42b6bbed8078b9ede17c7e883dee497876c086b4dc","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T04:08:52.401981Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:26:50.289327Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T15:26:55.832369Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"cited_work":{"arxiv_id":"2502.03699","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.03699","snapshot_observed_at":"2026-08-07T15:26:55.832369Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","venue":"cs.CL","work_id":"48287252-8e15-42ae-87b0-e1262610ac90","year":2025},"citing_paper":{"arxiv_id":"2505.15117","last_updated":"2025-05-21T05:09:43Z","snapshot_observed_at":"2026-08-09T16:48:40.808805Z","submitted_at":"2025-05-21T05:09:43Z","title":"An Empirical Study on Reinforcement Learning for Reasoning-Search Interleaved LLM Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:26:50.289327Z"},"links":{"cited_paper":"/paper/2502.03699","citing_paper":"/paper/2505.15117"},"observation_digest":"sha256:cbdfef20012eeb18b29a0bac25d11b6cee6bd2233f513817933b59f212bdfd86","observation_id":"717a137d-4795-4d92-aa45-2f3bd6b12ce5","resolution":{"observed_at":"2026-08-07T15:26:55.887278Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.03699/citation-record","integrity":"/paper/2502.03699/integrity","json":"/paper/2502.03699/citation-record.json","paper":"/paper/2502.03699"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-09T04:08:50.955917Z","title":"L., Almeida, D., Altenschmidt, J., Altman, S., Anadkat, S., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:50.955917Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:7acb3dfff937c516120c919b1bbeeed870ed68736fd178cd95b9fa0dea76a81f","observation_id":"76fe5319-e7fa-4d24-af88-a2e61e644c49","resolution":{"observed_at":"2026-08-09T04:08:50.955917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:08:53.394730Z","title":"w. current","venue":null,"work_id":"ff61a488-d93d-4cdc-9e9f-26c2d2951746","year":2023},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:52.347293Z"},"links":{"citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:eede4656f4b99d5033be71632e3e9cb9471755f8b625ec3f6a87a094ecc7cb64","observation_id":"73d84378-cb7f-4400-888a-ea88aea6d08b","resolution":{"observed_at":"2026-08-09T04:08:53.399702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:08:53.785581Z","title":"As the number (N) of retrieved responses increases, the retrieval recall increases","venue":null,"work_id":"b1730415-1e67-4efe-ab82-97d21d8cfae0","year":2024},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:52.236912Z"},"links":{"citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:179025597a5011a5e39281289537040e4ff72394968cfaa67a9e6ef6b16d98dd","observation_id":"54c53931-f9ee-4c86-9d6a-57b05da0f170","resolution":{"observed_at":"2026-08-09T04:08:53.789885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:08:53.806864Z","title":"in-batch negatives","venue":null,"work_id":"3d85c39d-6c70-4700-8569-d378dd28b76c","year":2021},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:52.230261Z"},"links":{"citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:fd84fd5ee2c30a4c66db5bcd6459430fa98e5569e61ab9afc1cad11cdd31bc49","observation_id":"42601634-a9db-45d0-a53f-55ca2c825252","resolution":{"observed_at":"2026-08-09T04:08:53.851481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:08:53.420879Z","title":"For AlpacaEval2, we report the result with both opensource LLM evaluator alpaca eval llama3 70b fn and GPT4 evaluator alpaca eval gpt4 turbo fn","venue":null,"work_id":"12b7e14c-3edb-453b-93cb-85c83af12407","year":2024},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:52.255049Z"},"links":{"citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:3d93a45fc60c429efa429198f3b14f111d538ed0c689b794f484e4ce8a09a7e1","observation_id":"8e4bfde4-bb0d-4683-a010-175cf8146e34","resolution":{"observed_at":"2026-08-09T04:08:53.564744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04475","last_updated":"2025-03-10T09:27:03Z","snapshot_observed_at":"2026-07-06T17:56:23.317089Z","submitted_at":"2024-04-06T02:29:02Z","title":"Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04475","snapshot_observed_at":"2026-08-09T04:08:51.424076Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.424076Z"},"links":{"cited_paper":"/paper/2404.04475","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:cf4199f3cac0cd0767857c9c888e1ed4bedb0e182f75ac0191f0afe07e50f2e0","observation_id":"c1f5c3d6-53c7-4d0b-b26c-70b1f98de59e","resolution":{"observed_at":"2026-08-09T04:08:51.424076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01306","last_updated":"2024-11-19T18:12:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-02T10:53:36Z","title":"KTO: Model Alignment as Prospect Theoretic Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01306","snapshot_observed_at":"2026-08-09T04:08:51.433852Z","title":"Kto: Model alignment as prospect theoretic optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.433852Z"},"links":{"cited_paper":"/paper/2402.01306","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:353f4bab24a42e8efd47a7ca19c7e7bfa89dab459fe6bdc27fc1fe2e5e34f8a3","observation_id":"7f899329-eeeb-4975-a10f-9638b1848321","resolution":{"observed_at":"2026-08-09T04:08:51.433852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04792","last_updated":"2024-02-29T20:59:17Z","snapshot_observed_at":"2026-08-09T00:20:15.609286Z","submitted_at":"2024-02-07T12:31:13Z","title":"Direct Language Model Alignment from Online AI Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04792","snapshot_observed_at":"2026-08-09T04:08:51.439639Z","title":"Direct language model alignment from online ai feedback.arXiv preprint arXiv:2402.04792,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.439639Z"},"links":{"cited_paper":"/paper/2402.04792","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:806e436179fab0f1a86dbfa0efa60218452405fc5689436273d7426eed12c220","observation_id":"c124081d-487d-4d44-9c0f-09880e7e44e4","resolution":{"observed_at":"2026-08-09T04:08:51.439639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.01969","last_updated":"2020-03-25T22:53:51Z","snapshot_observed_at":"2026-08-06T17:07:51.579968Z","submitted_at":"2019-04-22T02:18:00Z","title":"Poly-encoders: Transformer Architectures and Pre-training Strategies for Fast and Accurate Multi-sentence Scoring","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.01969","snapshot_observed_at":"2026-08-09T04:08:51.444744Z","title":"Poly-encoders: Transformer architectures and pre-training strategies for fast and accurate multi-sentence scoring","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.444744Z"},"links":{"cited_paper":"/paper/1905.01969","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:af90bc4ea68627107a765b80b9a63167f7f42feedd71159d0e5485c59f5a4390","observation_id":"863b84ed-5a22-4b9b-8a23-d8a3220b1db1","resolution":{"observed_at":"2026-08-09T04:08:51.444744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-09T04:08:51.463091Z","title":"Q., Sablayrolles, A., Mensch, A., Bamford, C., Chaplot, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.463091Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:7b1035dd5cab544a3fd019aa4e6e81817d1a269ccc6b282b8560da931264c4eb","observation_id":"fb7a7fe1-8661-4954-9ac5-d6a5b9cc41c6","resolution":{"observed_at":"2026-08-09T04:08:51.463091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04906","last_updated":"2020-09-30T21:27:13Z","snapshot_observed_at":"2026-07-06T09:11:26.109763Z","submitted_at":"2020-04-10T04:53:17Z","title":"Dense Passage Retrieval for Open-Domain Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04906","snapshot_observed_at":"2026-08-09T04:08:51.562157Z","title":"Dense passage retrieval for open-domain question answering","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.562157Z"},"links":{"cited_paper":"/paper/2004.04906","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:365a9f52e5aa4ff34fc0431d4d45928298a03b450cfa6f7a90f60320fd2d596e","observation_id":"ba1bd6fa-dce3-4982-a340-cdfec74cdcc9","resolution":{"observed_at":"2026-08-09T04:08:51.562157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13787","last_updated":"2024-06-08T16:40:12Z","snapshot_observed_at":"2026-08-02T18:11:57.036767Z","submitted_at":"2024-03-20T17:49:54Z","title":"RewardBench: Evaluating Reward Models for Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13787","snapshot_observed_at":"2026-08-09T04:08:51.669984Z","title":"Y ., Chandu, K., Dziri, N., Kumar, S., Zick, T., Choi, Y ., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.669984Z"},"links":{"cited_paper":"/paper/2403.13787","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:189ad73447cd425f04dd6d205a3b416f4aefac14f9f5ed9d6f2b0f63f9ad34ac","observation_id":"385d2405-60e4-462c-b6a5-1595e6ad2afd","resolution":{"observed_at":"2026-08-09T04:08:51.669984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14851","last_updated":"2025-03-04T08:38:34Z","snapshot_observed_at":"2026-07-06T18:04:13.083818Z","submitted_at":"2024-04-23T09:05:37Z","title":"From Matching to Generation: A Survey on Generative Information Retrieval","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14851","snapshot_observed_at":"2026-08-09T04:08:51.714428Z","title":"From matching to generation: A sur- vey on generative information retrieval","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.714428Z"},"links":{"cited_paper":"/paper/2404.14851","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:7328156d31298b7e65953f3313c732f0b99eac2f9bcdaeb55a87d9a4a7fb9177","observation_id":"829c2c00-7db5-49f3-a51a-747a545cc2d7","resolution":{"observed_at":"2026-08-09T04:08:51.714428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14734","last_updated":"2024-11-01T20:05:19Z","snapshot_observed_at":"2026-08-03T02:02:15.325394Z","submitted_at":"2024-05-23T16:01:46Z","title":"SimPO: Simple Preference Optimization with a Reference-Free Reward","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14734","snapshot_observed_at":"2026-08-09T04:08:51.741471Z","title":"Ranked list truncation for large language model-based re-ranking","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.741471Z"},"links":{"cited_paper":"/paper/2405.14734","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:df9ce274508e3338aa4f7af0e2b5a4173e94ba4c876c5ed72a5314651451c0b4","observation_id":"bde4c4a1-91de-42ed-ac10-3695cbf60e06","resolution":{"observed_at":"2026-08-09T04:08:51.741471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.04085","last_updated":"2020-04-14T14:57:40Z","snapshot_observed_at":"2026-08-02T11:18:37.014004Z","submitted_at":"2019-01-13T23:27:58Z","title":"Passage Re-ranking with BERT","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.04085","snapshot_observed_at":"2026-08-09T04:08:51.777482Z","title":"and Cho, K","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.777482Z"},"links":{"cited_paper":"/paper/1901.04085","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:bf6d64a7420ce168075412ff0f68088a8c5ec11222cc7eec61587e8d5162f2ae","observation_id":"8ed1b2e7-df5c-42be-a1f5-9480b05bf95e","resolution":{"observed_at":"2026-08-09T04:08:51.777482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.06713","last_updated":"2020-03-14T22:29:50Z","snapshot_observed_at":"2026-08-07T22:52:48.176856Z","submitted_at":"2020-03-14T22:29:50Z","title":"Document Ranking with a Pretrained Sequence-to-Sequence Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.06713","snapshot_observed_at":"2026-08-09T04:08:51.791525Z","title":"Document ranking with a pretrained sequence-to-sequence model","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.791525Z"},"links":{"cited_paper":"/paper/2003.06713","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:ecbf57d5b05a6ab39872099396fe8c0873d71428358b5504e6ebb7a63df0c3be","observation_id":"2d353fc4-1597-4cc9-9813-e0681c393432","resolution":{"observed_at":"2026-08-09T04:08:51.791525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19159","last_updated":"2024-09-09T04:39:31Z","snapshot_observed_at":"2026-08-08T10:19:27.268855Z","submitted_at":"2024-03-28T06:03:47Z","title":"Disentangling Length from Quality in Direct Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19159","snapshot_observed_at":"2026-08-09T04:08:51.815624Z","title":"Disentan- gling length from quality in direct preference optimiza- tion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.815624Z"},"links":{"cited_paper":"/paper/2403.19159","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:2a686142cf12a139425e651b217e449ee9def828d5905540e1658b5d69ef06db","observation_id":"ec8409b5-0173-49ee-9f53-106c5931d72c","resolution":{"observed_at":"2026-08-09T04:08:51.815624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.08191","last_updated":"2021-05-12T07:52:32Z","snapshot_observed_at":"2026-08-10T00:16:14.730838Z","submitted_at":"2020-10-16T06:54:05Z","title":"RocketQA: An Optimized Training Approach to Dense Passage Retrieval for Open-Domain Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.08191","snapshot_observed_at":"2026-08-09T04:08:51.824811Z","title":"X., Dong, D., Wu, H., and Wang, H","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.824811Z"},"links":{"cited_paper":"/paper/2010.08191","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:07d7a77d029bcb477bf43df6d0841c92e4eceeee8d2668f4bc1b7b2387f5b935","observation_id":"855c5902-532f-4aab-85f1-7ec604c04db5","resolution":{"observed_at":"2026-08-09T04:08:51.824811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-09T04:08:51.864748Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.864748Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:5f61320c38776e3b9aabc0405016e10b166bdc90c7aa8956eb9803fb6c2bfdbb","observation_id":"caeada24-616c-401f-9508-afbefbb737ad","resolution":{"observed_at":"2026-08-09T04:08:51.864748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14622","last_updated":"2024-07-19T18:38:25Z","snapshot_observed_at":"2026-07-06T18:49:16.284410Z","submitted_at":"2024-07-19T18:38:25Z","title":"BOND: Aligning LLMs with Best-of-N Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14622","snapshot_observed_at":"2026-08-09T04:08:51.973560Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.973560Z"},"links":{"cited_paper":"/paper/2407.14622","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:b62499087792ed952e5c8caa6daf8bed373954a8efc576b738e87b91a4001f20","observation_id":"780ebc08-f491-4ed6-803c-edc08895bff9","resolution":{"observed_at":"2026-08-09T04:08:51.973560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-09T04:08:52.034749Z","title":"I., Burnell, R., Bai, L., Gulati, A., Tanzer, G., Vincent, D., Pan, Z., Wang, S., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:52.034749Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:a5b564c055fbfe0d0b88b86018ce40614a00b059ef8a1fd76ea26f4f39f17dca","observation_id":"10b2bfe1-2e97-43ff-84ea-926ff5b48a99","resolution":{"observed_at":"2026-08-09T04:08:52.034749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-09T04:08:52.072899Z","title":"Self-consistency im- proves chain of thought reasoning in language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:52.072899Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:8e2917644b00e04a9db34b93fcc67f4b93df3f71d66dfae1523322c0e7852a68","observation_id":"f63c5adc-abad-494f-8605-abccd89c4418","resolution":{"observed_at":"2026-08-09T04:08:52.072899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12966","last_updated":"2023-07-24T17:44:58Z","snapshot_observed_at":"2026-07-06T15:57:57.167169Z","submitted_at":"2023-07-24T17:44:58Z","title":"Aligning Large Language Models with Human: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12966","snapshot_observed_at":"2026-08-09T04:08:52.078672Z","title":"Aligning large language models with human: A survey","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:52.078672Z"},"links":{"cited_paper":"/paper/2307.12966","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:a8f0b258a6333e5edcd7af7cdd829f752a2a98e19ba06c5c9040857f119d07c1","observation_id":"818504ca-51be-4dbd-bcb2-03e2a091b13b","resolution":{"observed_at":"2026-08-09T04:08:52.078672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08417","last_updated":"2024-06-03T01:28:06Z","snapshot_observed_at":"2026-07-06T17:16:13.055978Z","submitted_at":"2024-01-16T15:04:51Z","title":"Contrastive Preference Optimization: Pushing the Boundaries of LLM Performance in Machine Translation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08417","snapshot_observed_at":"2026-08-09T04:08:52.094738Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:52.094738Z"},"links":{"cited_paper":"/paper/2401.08417","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:da8722f337de6114b313a8156eb078786b5dcb2943108080dc9e9c2b6b778fc2","observation_id":"7f7339df-a957-4429-9187-a0870b3f8513","resolution":{"observed_at":"2026-08-09T04:08:52.094738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05302","last_updated":"2023-10-07T07:01:26Z","snapshot_observed_at":"2026-08-09T04:25:12.977504Z","submitted_at":"2023-04-11T15:53:40Z","title":"RRHF: Rank Responses to Align Language Models with Human Feedback without tears","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05302","snapshot_observed_at":"2026-08-09T04:08:52.104766Z","title":"Rrhf: Rank responses to align language mod- els with human feedback without tears","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:52.104766Z"},"links":{"cited_paper":"/paper/2304.05302","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:43d6fe9a1994beba9534791b055a446a314b70446c72fa433bfd4e72ec7a2253","observation_id":"2968a6cf-ff46-4227-a412-69d962d63f3f","resolution":{"observed_at":"2026-08-09T04:08:52.104766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:08:53.955384Z","title":"Curriculum learning for dense retrieval distillation","venue":null,"work_id":"22923d4a-7c5a-4f10-bb0c-be0d15751dc4","year":1979},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:52.117272Z"},"links":{"citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:7eadb7f8af2dded11cfd24332049dba1d1a47e54dda709c30827e08fa842c578","observation_id":"d911d71a-bd4d-4443-9239-5ab309c3d01e","resolution":{"observed_at":"2026-08-09T04:08:54.024718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10425","last_updated":"2023-05-17T17:57:10Z","snapshot_observed_at":"2026-08-02T06:11:08.013358Z","submitted_at":"2023-05-17T17:57:10Z","title":"SLiC-HF: Sequence Likelihood Calibration with Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10425","snapshot_observed_at":"2026-08-09T04:08:52.221810Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:52.221810Z"},"links":{"cited_paper":"/paper/2305.10425","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:12c1a5b37925e99b6fb588fffd8172177aad6f62832c7b9821edd618774da4aa","observation_id":"ff55ae22-d549-4c47-bb36-1e8685b45293","resolution":{"observed_at":"2026-08-09T04:08:52.221810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:08:53.697160Z","title":"We consider two base models: Mistral-7b-base and Mistral-7b-it","venue":null,"work_id":"6be8cc24-0c82-4b32-b456-228bfba5c716","year":2024},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:52.246868Z"},"links":{"citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:231aecae31ef8ae182715550818435decf52d9413f467e78f28aaf7d22a138d1","observation_id":"7d544be6-869f-4a5c-a40a-fa75e9e1658a","resolution":{"observed_at":"2026-08-09T04:08:53.774929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:08:53.243722Z","title":"We generate 4/6/8/10 responses with the LLM and score the responses with the off-the-shelf reward model (Dong et al., 2024)","venue":null,"work_id":"be08b19d-c5af-4a50-97d6-5ee107ae3c27","year":2024},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:52.401981Z"},"links":{"citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:6e84ea82830ab72faa87dc0870b5752fe0b5d159ca6257de50cbd0a1c545f4ec","observation_id":"74668662-f023-4d21-8c85-9e044b489e73","resolution":{"observed_at":"2026-08-09T04:08:53.345216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:08:51.155101Z","title":"D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":1952,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.155101Z"},"links":{"citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:f01f4c2027506b3e82925b7050f10bb30f89d6ff0e56a43e926d92bdf14c4e8d","observation_id":"d11b961d-6358-4b2e-bf97-52626eef8fbe","resolution":{"observed_at":"2026-08-09T04:08:51.155101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.00808","last_updated":"2020-10-20T22:17:19Z","snapshot_observed_at":"2026-08-06T15:45:53.027828Z","submitted_at":"2020-07-01T23:15:56Z","title":"Approximate Nearest Neighbor Negative Contrastive Learning for Dense Text Retrieval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.00808","snapshot_observed_at":"2026-08-09T04:08:52.086973Z","title":"Approximate nearest neigh- bor negative contrastive learning for dense text retrieval","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:52.086973Z"},"links":{"cited_paper":"/paper/2007.00808","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:6c60cc68406fcf7f1bcd664aff4a2b0f8fb58a08c114137f184705a85852359b","observation_id":"c721f883-1ae1-43dc-9f9e-aa39314a6c33","resolution":{"observed_at":"2026-08-09T04:08:52.086973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-09T04:08:51.177806Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.177806Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:2c9313bfdd079ccf9ed1787b32b31cb46e756229b6bedbec1aabb69b7e76f5c8","observation_id":"bdb5b3ed-d9ff-4cd1-9f16-1847d43020e8","resolution":{"observed_at":"2026-08-09T04:08:51.177806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-09T04:08:51.192884Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.192884Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:029881111be4b551ce01f22a3e9b58e6e221d1d2a6eedad18c907a1bb2c42d97","observation_id":"d32c006a-4cd4-4c32-9c59-53719ade133b","resolution":{"observed_at":"2026-08-09T04:08:51.192884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06767","last_updated":"2023-12-01T14:28:06Z","snapshot_observed_at":"2026-08-07T04:02:54.504761Z","submitted_at":"2023-04-13T18:22:40Z","title":"RAFT: Reward rAnked FineTuning for Generative Foundation Model Alignment","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06767","snapshot_observed_at":"2026-08-09T04:08:51.251439Z","title":"Raft: Re- ward ranked finetuning for generative foundation model alignment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.251439Z"},"links":{"cited_paper":"/paper/2304.06767","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:d0652a108bd3798e6b190745d156de103e060bca737237efce24b91c9b42b1ce","observation_id":"d7679d1e-e52f-465b-9e9c-008b54927d1f","resolution":{"observed_at":"2026-08-09T04:08:51.251439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-09T04:08:51.808118Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.808118Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:6602572d55269055458499f260423ca490fc039ab54bfae430459e67e9f22dea","observation_id":"813c0465-420d-40b7-b806-df77bd1c0e38","resolution":{"observed_at":"2026-08-09T04:08:51.808118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-09T04:08:52.133724Z","title":"X., Zhou, K., Li, J., Tang, T., Wang, X., Hou, Y ., Min, Y ., Zhang, B., Zhang, J., Dong, Z., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:52.133724Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:edf1519f0d07aafb53e20985022eeec134127c9433835e935f5dd540a0ea8767","observation_id":"e3d3ef6e-1b92-4c03-a865-6301d853366a","resolution":{"observed_at":"2026-08-09T04:08:52.133724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01878","last_updated":"2025-01-24T19:13:34Z","snapshot_observed_at":"2026-07-06T17:24:37.090243Z","submitted_at":"2024-02-02T20:08:10Z","title":"LiPO: Listwise Preference Optimization through Learning-to-Rank","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01878","snapshot_observed_at":"2026-08-09T04:08:51.724809Z","title":"Lipo: Listwise preference optimization through learning- to-rank","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.724809Z"},"links":{"cited_paper":"/paper/2402.01878","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:f15fb8318292a59a6b3c3460b73174f12e37ec048b364ba801ae8edfbe4073df","observation_id":"8b1e524f-e854-4e74-b820-d5a26e47e936","resolution":{"observed_at":"2026-08-09T04:08:51.724809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07863","last_updated":"2024-11-12T11:18:43Z","snapshot_observed_at":"2026-08-07T08:32:00.916309Z","submitted_at":"2024-05-13T15:50:39Z","title":"RLHF Workflow: From Reward Modeling to Online RLHF","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07863","snapshot_observed_at":"2026-08-09T04:08:51.365242Z","title":"Rlhf workflow: From reward modeling to online rlhf","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.365242Z"},"links":{"cited_paper":"/paper/2405.07863","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:56e11a65ef132c505ef140ea917ab6dde3710b5dec693a16637ce27aea53e434","observation_id":"f51955d9-5e2b-4572-bf71-eefcf0854e34","resolution":{"observed_at":"2026-08-09T04:08:51.365242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-09T04:08:51.055689Z","title":"Training a helpful and harmless assistant with rein- forcement learning from human feedback","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.055689Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:761a736c1303943a1916426e87634c2b1b9ff4b28ca0b1783c911ea4278de1df","observation_id":"11a89aed-cdc5-4984-ab27-839566a6f2c2","resolution":{"observed_at":"2026-08-09T04:08:51.055689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06565","last_updated":"2024-10-12T14:13:27Z","snapshot_observed_at":"2026-07-06T18:28:20.634381Z","submitted_at":"2024-06-03T05:47:05Z","title":"MixEval: Deriving Wisdom of the Crowd from LLM Benchmark Mixtures","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06565","snapshot_observed_at":"2026-08-09T04:08:51.755786Z","title":"Accessed: 2025- 01-16","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-09T04:08:51.755786Z"},"links":{"cited_paper":"/paper/2406.06565","citing_paper":"/paper/2502.03699"},"observation_digest":"sha256:4623a9d418d16a34ff2efb070da3283bbe1cf4677260ffe225a294209947d6ea","observation_id":"7120ae5c-e864-4839-b264-e5eee69331c8","resolution":{"observed_at":"2026-08-09T04:08:51.755786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.03699","last_updated":"2025-07-23T21:26:26Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T04:26:07.182723Z","submitted_at":"2025-02-06T01:22:06Z","title":"LLM Alignment as Retriever Optimization: An Information Retrieval Perspective"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 1 inbound Pith citation observation for arXiv:2502.03699."}