{"as_of":"2026-08-16T19:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:996b20eee10a1858af03c79e18f5be5d680922398e15744ed54100db3c2bab59","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T22:51:45.854198Z","state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.00560/citation-record","integrity":"/paper/2501.00560/integrity","json":"/paper/2501.00560/citation-record.json","paper":"/paper/2501.00560"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:51:46.027322Z","title":null,"venue":null,"work_id":"21a4d179-05b6-4faf-9359-12240489aaa7","year":null},"citing_paper":{"arxiv_id":"2501.00560","last_updated":"2025-02-11T10:02:55Z","snapshot_observed_at":"2026-08-15T05:53:29.917943Z","submitted_at":"2024-12-31T17:46:51Z","title":"Re-evaluating Automatic LLM System Ranking for Alignment with Human Preference","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T22:51:45.836933Z"},"links":{"citing_paper":"/paper/2501.00560"},"observation_digest":"sha256:c1ba0bf50b179121fcd31573738a2d1d9fd38a6702173aefb46143b2442bd131","observation_id":"bd654b90-80ff-4576-92c1-9a81974aee74","resolution":{"observed_at":"2026-08-10T22:51:46.031621Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:51:46.013040Z","title":null,"venue":null,"work_id":"5b358dfc-ef2b-4c70-88b3-ab818d875e99","year":null},"citing_paper":{"arxiv_id":"2501.00560","last_updated":"2025-02-11T10:02:55Z","snapshot_observed_at":"2026-08-15T05:53:29.917943Z","submitted_at":"2024-12-31T17:46:51Z","title":"Re-evaluating Automatic LLM System Ranking for Alignment with Human Preference","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T22:51:45.841536Z"},"links":{"citing_paper":"/paper/2501.00560"},"observation_digest":"sha256:e0938e6d60aa6fc0a40c651432d611169ac1556947390632c6b7120f47af8ca0","observation_id":"7dbe37c6-a164-4350-b8d4-858adbb92a23","resolution":{"observed_at":"2026-08-10T22:51:46.017241Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:51:45.998264Z","title":null,"venue":null,"work_id":"1dcf2a14-ae9b-4c95-ac47-e300d01c7aa5","year":null},"citing_paper":{"arxiv_id":"2501.00560","last_updated":"2025-02-11T10:02:55Z","snapshot_observed_at":"2026-08-15T05:53:29.917943Z","submitted_at":"2024-12-31T17:46:51Z","title":"Re-evaluating Automatic LLM System Ranking for Alignment with Human Preference","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T22:51:45.845572Z"},"links":{"citing_paper":"/paper/2501.00560"},"observation_digest":"sha256:dde93c4bf41029839dd1899a80c1aef5cfb0e4c40f031fb2b5a1d9402c0f0a51","observation_id":"b29d9375-b0f4-444f-87dd-eeec607c2bc9","resolution":{"observed_at":"2026-08-10T22:51:46.003326Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:51:46.053306Z","title":"In Proceedings of the 18th Con- ference of the European Chapter of the Association for Computational Linguistics, EACL 2024 - Volume 1: Long Papers, St","venue":null,"work_id":"66c9e0d0-7ac7-4462-9cfc-56d5f793c2d2","year":2024},"citing_paper":{"arxiv_id":"2501.00560","last_updated":"2025-02-11T10:02:55Z","snapshot_observed_at":"2026-08-15T05:53:29.917943Z","submitted_at":"2024-12-31T17:46:51Z","title":"Re-evaluating Automatic LLM System Ranking for Alignment with Human Preference","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T22:51:45.815819Z"},"links":{"citing_paper":"/paper/2501.00560"},"observation_digest":"sha256:6976532dd39ba06e88bbf32d6969230c5d3de36c499f5eb1b0a51cc2bc851bc4","observation_id":"b649136d-6675-48e7-bfe4-73cd6d1bb762","resolution":{"observed_at":"2026-08-10T22:51:46.059595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06565","last_updated":"2024-10-12T14:13:27Z","snapshot_observed_at":"2026-08-16T13:46:53.335278Z","submitted_at":"2024-06-03T05:47:05Z","title":"MixEval: Deriving Wisdom of the Crowd from LLM Benchmark Mixtures","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06565","snapshot_observed_at":"2026-08-10T22:51:45.820775Z","title":"CoRR, abs/2406.06565","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.00560","last_updated":"2025-02-11T10:02:55Z","snapshot_observed_at":"2026-08-15T05:53:29.917943Z","submitted_at":"2024-12-31T17:46:51Z","title":"Re-evaluating Automatic LLM System Ranking for Alignment with Human Preference","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T22:51:45.820775Z"},"links":{"cited_paper":"/paper/2406.06565","citing_paper":"/paper/2501.00560"},"observation_digest":"sha256:435d8ebeeb13d8fb772bc89571d5294cf2ade3ab553c757b2e50b8bd1f7d5d39","observation_id":"082c3b24-4b68-4219-8160-83facebafea4","resolution":{"observed_at":"2026-08-10T22:51:45.820775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:51:46.041092Z","title":"poor quality","venue":null,"work_id":"7b2e5b33-7165-4fba-aa42-ea1929601b7e","year":1930},"citing_paper":{"arxiv_id":"2501.00560","last_updated":"2025-02-11T10:02:55Z","snapshot_observed_at":"2026-08-15T05:53:29.917943Z","submitted_at":"2024-12-31T17:46:51Z","title":"Re-evaluating Automatic LLM System Ranking for Alignment with Human Preference","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T22:51:45.831591Z"},"links":{"citing_paper":"/paper/2501.00560"},"observation_digest":"sha256:234b87555abe50ce94652693d788be160b4a55fa2e7e8fa82f61a283e9cede80","observation_id":"38645a52-7bed-43fe-806f-d945404d69b1","resolution":{"observed_at":"2026-08-10T22:51:46.045190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:51:45.983632Z","title":null,"venue":null,"work_id":"714d93f6-6dc9-4625-8bed-6a47a7554bf7","year":null},"citing_paper":{"arxiv_id":"2501.00560","last_updated":"2025-02-11T10:02:55Z","snapshot_observed_at":"2026-08-15T05:53:29.917943Z","submitted_at":"2024-12-31T17:46:51Z","title":"Re-evaluating Automatic LLM System Ranking for Alignment with Human Preference","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T22:51:45.849730Z"},"links":{"citing_paper":"/paper/2501.00560"},"observation_digest":"sha256:1ff194d2b9d1cb6323cc7bffe13ef03bc3e1da9d550335e7ca06148a3ea7403a","observation_id":"d33d4cd8-361f-4452-9221-1ac1d36e1970","resolution":{"observed_at":"2026-08-10T22:51:45.988333Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:51:45.968866Z","title":null,"venue":null,"work_id":"4e741f1e-8db3-4683-843f-f5f4f3debdcd","year":null},"citing_paper":{"arxiv_id":"2501.00560","last_updated":"2025-02-11T10:02:55Z","snapshot_observed_at":"2026-08-15T05:53:29.917943Z","submitted_at":"2024-12-31T17:46:51Z","title":"Re-evaluating Automatic LLM System Ranking for Alignment with Human Preference","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T22:51:45.854198Z"},"links":{"citing_paper":"/paper/2501.00560"},"observation_digest":"sha256:67bae5fb23cb8ce5197ed078974fbcccf3a9add521e2c2912b0d1c4ecc0d8682","observation_id":"1ea2b6f3-5e1f-443a-b91f-1f5a23fc5fbf","resolution":{"observed_at":"2026-08-10T22:51:45.974353Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14483","last_updated":"2025-02-17T16:21:10Z","snapshot_observed_at":"2026-08-15T20:18:08.421152Z","submitted_at":"2024-11-19T20:16:26Z","title":"Ranking Unraveled: Recipes for LLM Rankings in Head-to-Head AI Combat","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14483","snapshot_observed_at":"2026-08-10T22:51:45.801126Z","title":"Biometrika, 39(3-4):324–345","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.00560","last_updated":"2025-02-11T10:02:55Z","snapshot_observed_at":"2026-08-15T05:53:29.917943Z","submitted_at":"2024-12-31T17:46:51Z","title":"Re-evaluating Automatic LLM System Ranking for Alignment with Human Preference","version":2},"reference_index":1952,"source":"pdf_text","source_observed_at":"2026-08-10T22:51:45.801126Z"},"links":{"cited_paper":"/paper/2411.14483","citing_paper":"/paper/2501.00560"},"observation_digest":"sha256:5d2a0468919d8420cbf9903ec0e6a6e6f65712c18f55281ace7064b82cc0b8ed","observation_id":"50be9836-8e8d-4c41-a469-89c5026fa4b9","resolution":{"observed_at":"2026-08-10T22:51:45.801126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-08-16T18:57:50.930866Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-10T22:51:45.825812Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.00560","last_updated":"2025-02-11T10:02:55Z","snapshot_observed_at":"2026-08-15T05:53:29.917943Z","submitted_at":"2024-12-31T17:46:51Z","title":"Re-evaluating Automatic LLM System Ranking for Alignment with Human Preference","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-10T22:51:45.825812Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2501.00560"},"observation_digest":"sha256:b87a99ea04625c671155b271a55daf6b16200e5d52f132e64c7dc7952d35c895","observation_id":"74680828-3254-44c4-98b2-cb4ef5a4f344","resolution":{"observed_at":"2026-08-10T22:51:45.825812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13787","last_updated":"2024-06-08T16:40:12Z","snapshot_observed_at":"2026-08-16T14:07:56.582345Z","submitted_at":"2024-03-20T17:49:54Z","title":"RewardBench: Evaluating Reward Models for Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13787","snapshot_observed_at":"2026-08-10T22:51:45.811041Z","title":"CoRR, abs/2403.13787","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.00560","last_updated":"2025-02-11T10:02:55Z","snapshot_observed_at":"2026-08-15T05:53:29.917943Z","submitted_at":"2024-12-31T17:46:51Z","title":"Re-evaluating Automatic LLM System Ranking for Alignment with Human Preference","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-10T22:51:45.811041Z"},"links":{"cited_paper":"/paper/2403.13787","citing_paper":"/paper/2501.00560"},"observation_digest":"sha256:2bbcb3fa611954d9dd37cf0ca03d671ab1215363bbff6c6e961919713beb7df1","observation_id":"f29b4d73-98fa-4bda-8836-6a20f766ed5b","resolution":{"observed_at":"2026-08-10T22:51:45.811041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-10T22:51:45.806392Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.00560","last_updated":"2025-02-11T10:02:55Z","snapshot_observed_at":"2026-08-15T05:53:29.917943Z","submitted_at":"2024-12-31T17:46:51Z","title":"Re-evaluating Automatic LLM System Ranking for Alignment with Human Preference","version":2},"reference_index":6052,"source":"pdf_text","source_observed_at":"2026-08-10T22:51:45.806392Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2501.00560"},"observation_digest":"sha256:fa6770fcc2ac1501eb0f28df901712328563b3217bd4ee40bfec8c0126df0e29","observation_id":"271d9820-784c-460e-abbd-2ffefc3299dd","resolution":{"observed_at":"2026-08-10T22:51:45.806392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.00560","last_updated":"2025-02-11T10:02:55Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T05:53:29.917943Z","submitted_at":"2024-12-31T17:46:51Z","title":"Re-evaluating Automatic LLM System Ranking for Alignment with Human Preference"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":9,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 0 inbound Pith citation observations for arXiv:2501.00560."}