{"as_of":"2026-08-11T10:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:faebe40ca8e22dd8640f3079b552e97f610523cadfc315184d9ed65eab74bdc2","coverage":[{"denominator":11,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T15:19:01.309104Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:31:00.001334Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T14:43:58.335104Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.14296","last_updated":"2025-01-24T07:33:39Z","snapshot_observed_at":"2026-08-10T15:12:45.282582Z","submitted_at":"2025-01-24T07:33:39Z","title":"Multi-stage Large Language Model Pipelines Can Outperform GPT-4o in Relevance Assessment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14296","snapshot_observed_at":"2026-08-07T14:31:00.001334Z","title":"Schnabel, Johanne R","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18688","last_updated":"2025-08-25T14:01:55Z","snapshot_observed_at":"2026-08-10T11:56:38.609518Z","submitted_at":"2025-05-24T13:19:03Z","title":"Large Language Models in the Task of Automatic Validation of Text Classifier Predictions","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:31:00.001334Z"},"links":{"cited_paper":"/paper/2501.14296","citing_paper":"/paper/2505.18688"},"observation_digest":"sha256:40f1e9640cbde5781dec35a722f6c72e0622ec396120431b53e7f4ee04511198","observation_id":"5a07de35-388b-415a-a0f9-79f19c4ac1ec","resolution":{"observed_at":"2026-08-07T14:31:00.001334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14296","last_updated":"2025-01-24T07:33:39Z","snapshot_observed_at":"2026-08-10T15:12:45.282582Z","submitted_at":"2025-01-24T07:33:39Z","title":"Multi-stage Large Language Model Pipelines Can Outperform GPT-4o in Relevance Assessment","version":1},"cited_work":{"arxiv_id":"2501.14296","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.14296","snapshot_observed_at":"2026-08-06T14:43:58.335104Z","title":"Multi-stage Large Language Model Pipelines Can Outperform GPT-4o in Relevance Assessment","venue":"cs.IR","work_id":"763b7aee-c3d4-4e7b-a932-20f2af8bad31","year":2025},"citing_paper":{"arxiv_id":"2507.18044","last_updated":"2025-07-24T02:45:03Z","snapshot_observed_at":"2026-08-08T01:23:41.457224Z","submitted_at":"2025-07-24T02:45:03Z","title":"Synthetic Data Generation for Phrase Break Prediction with Large Language Model","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:58.263199Z"},"links":{"cited_paper":"/paper/2501.14296","citing_paper":"/paper/2507.18044"},"observation_digest":"sha256:3fba054f8e482cf462250096649f3861abe53009fba45aeadf30127a37bc5681","observation_id":"230f0533-fcec-4b05-ba69-87b8accca1b6","resolution":{"observed_at":"2026-08-06T14:43:58.338469Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.14296/citation-record","integrity":"/paper/2501.14296/integrity","json":"/paper/2501.14296/citation-record.json","paper":"/paper/2501.14296"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:01.502735Z","title":null,"venue":null,"work_id":"119c0f90-cb72-424c-8e95-0dd9a13a9a95","year":2024},"citing_paper":{"arxiv_id":"2501.14296","last_updated":"2025-01-24T07:33:39Z","snapshot_observed_at":"2026-08-10T15:12:45.282582Z","submitted_at":"2025-01-24T07:33:39Z","title":"Multi-stage Large Language Model Pipelines Can Outperform GPT-4o in Relevance Assessment","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:01.259114Z"},"links":{"citing_paper":"/paper/2501.14296"},"observation_digest":"sha256:019bbd90e9ed8319f1fe53131504dbd10a25a98e996bedcd17889534e7e09f76","observation_id":"d2dd6df6-9cac-4078-b18b-4d7f2b5391d4","resolution":{"observed_at":"2026-08-10T15:19:01.508069Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:01.487736Z","title":"Voorhees, and Ian Soboroff","venue":null,"work_id":"03d8743e-a7f2-48b7-a45c-66e9f4da5434","year":2023},"citing_paper":{"arxiv_id":"2501.14296","last_updated":"2025-01-24T07:33:39Z","snapshot_observed_at":"2026-08-10T15:12:45.282582Z","submitted_at":"2025-01-24T07:33:39Z","title":"Multi-stage Large Language Model Pipelines Can Outperform GPT-4o in Relevance Assessment","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:01.264326Z"},"links":{"citing_paper":"/paper/2501.14296"},"observation_digest":"sha256:da630c9f36a67fe3210c7266f584ede7869f607cebd3fe352bd561d8b89d67ae","observation_id":"bea5a6c1-dcde-4fb9-a69c-95fcad2426e3","resolution":{"observed_at":"2026-08-10T15:19:01.492445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:01.470818Z","title":null,"venue":null,"work_id":"f18f609f-aec9-4751-b8e4-3564496b3fb1","year":2020},"citing_paper":{"arxiv_id":"2501.14296","last_updated":"2025-01-24T07:33:39Z","snapshot_observed_at":"2026-08-10T15:12:45.282582Z","submitted_at":"2025-01-24T07:33:39Z","title":"Multi-stage Large Language Model Pipelines Can Outperform GPT-4o in Relevance Assessment","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:01.269198Z"},"links":{"citing_paper":"/paper/2501.14296"},"observation_digest":"sha256:988428690d74aca12a095b3803e6e755c219d6e8e6fd9505a5c6ef45250b985d","observation_id":"fad2b0a8-4ccc-4e25-9597-09e6f0c09ad9","resolution":{"observed_at":"2026-08-10T15:19:01.476177Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:01.444577Z","title":null,"venue":null,"work_id":"b68c126a-29c5-4c29-93ed-f117467519ba","year":2024},"citing_paper":{"arxiv_id":"2501.14296","last_updated":"2025-01-24T07:33:39Z","snapshot_observed_at":"2026-08-10T15:12:45.282582Z","submitted_at":"2025-01-24T07:33:39Z","title":"Multi-stage Large Language Model Pipelines Can Outperform GPT-4o in Relevance Assessment","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:01.273985Z"},"links":{"citing_paper":"/paper/2501.14296"},"observation_digest":"sha256:5e058814c095ae51e208ad8091e9f35fd37b955dadadbc0ac030e37756fd7983","observation_id":"619723c5-648e-4c5f-99e6-f73ae0c4c7eb","resolution":{"observed_at":"2026-08-10T15:19:01.448899Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:01.430183Z","title":null,"venue":null,"work_id":"a38998a4-7b42-4648-988b-a481971b9f0c","year":null},"citing_paper":{"arxiv_id":"2501.14296","last_updated":"2025-01-24T07:33:39Z","snapshot_observed_at":"2026-08-10T15:12:45.282582Z","submitted_at":"2025-01-24T07:33:39Z","title":"Multi-stage Large Language Model Pipelines Can Outperform GPT-4o in Relevance Assessment","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:01.278667Z"},"links":{"citing_paper":"/paper/2501.14296"},"observation_digest":"sha256:7aa5a2521de39fb926cdaff82a5b86a19af6e1bff33d4c2987f5170e1ae7f3a5","observation_id":"fc1da27e-3d1a-4abf-a072-d8ed35f8fe4a","resolution":{"observed_at":"2026-08-10T15:19:01.434673Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:01.401641Z","title":null,"venue":null,"work_id":"290c1801-d75c-4012-a2dd-a080b0e2b7c2","year":2024},"citing_paper":{"arxiv_id":"2501.14296","last_updated":"2025-01-24T07:33:39Z","snapshot_observed_at":"2026-08-10T15:12:45.282582Z","submitted_at":"2025-01-24T07:33:39Z","title":"Multi-stage Large Language Model Pipelines Can Outperform GPT-4o in Relevance Assessment","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:01.288620Z"},"links":{"citing_paper":"/paper/2501.14296"},"observation_digest":"sha256:81958211f9202daa3017e3514d528a9d332113ffb1e6c56191b521ddf9693d67","observation_id":"bf399a4e-3747-462e-ac6e-ac93afe38f9d","resolution":{"observed_at":"2026-08-10T15:19:01.406121Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:01.386765Z","title":null,"venue":null,"work_id":"4381c1da-d9f7-42da-8164-b4bb99a515a7","year":2024},"citing_paper":{"arxiv_id":"2501.14296","last_updated":"2025-01-24T07:33:39Z","snapshot_observed_at":"2026-08-10T15:12:45.282582Z","submitted_at":"2025-01-24T07:33:39Z","title":"Multi-stage Large Language Model Pipelines Can Outperform GPT-4o in Relevance Assessment","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:01.293412Z"},"links":{"citing_paper":"/paper/2501.14296"},"observation_digest":"sha256:34b9a21e97053ba4be18dd65392905c0d1b116ba8406de7262551219863d214d","observation_id":"d7d6b61f-4c44-47e7-b4e6-b96a6a891013","resolution":{"observed_at":"2026-08-10T15:19:01.391508Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06519","last_updated":"2024-06-10T17:58:29Z","snapshot_observed_at":"2026-08-06T17:10:43.700110Z","submitted_at":"2024-06-10T17:58:29Z","title":"UMBRELA: UMbrela is the (Open-Source Reproduction of the) Bing RELevance Assessor","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06519","snapshot_observed_at":"2026-08-10T15:19:01.298408Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14296","last_updated":"2025-01-24T07:33:39Z","snapshot_observed_at":"2026-08-10T15:12:45.282582Z","submitted_at":"2025-01-24T07:33:39Z","title":"Multi-stage Large Language Model Pipelines Can Outperform GPT-4o in Relevance Assessment","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:01.298408Z"},"links":{"cited_paper":"/paper/2406.06519","citing_paper":"/paper/2501.14296"},"observation_digest":"sha256:a5b72ed0389f428784d87a0e0ae0baa0ed67d818dec7566cb1636dc28596f877","observation_id":"fa85362c-fafb-47bd-a761-5c992578f605","resolution":{"observed_at":"2026-08-10T15:19:01.298408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:01.304353Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.14296","last_updated":"2025-01-24T07:33:39Z","snapshot_observed_at":"2026-08-10T15:12:45.282582Z","submitted_at":"2025-01-24T07:33:39Z","title":"Multi-stage Large Language Model Pipelines Can Outperform GPT-4o in Relevance Assessment","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:01.304353Z"},"links":{"citing_paper":"/paper/2501.14296"},"observation_digest":"sha256:237f1bdc1a2a987d29e43e94b213f8036a7bf07d2d6d3a0871111830a4201e3b","observation_id":"052c5493-1504-4ca9-b7ab-61b3037d0773","resolution":{"observed_at":"2026-08-10T15:19:01.304353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:01.358948Z","title":"Shane Culpepper, Falk Scholer, and Paul Thomas","venue":null,"work_id":"8c5ed358-1625-43e3-92da-e4280bdb1e84","year":2024},"citing_paper":{"arxiv_id":"2501.14296","last_updated":"2025-01-24T07:33:39Z","snapshot_observed_at":"2026-08-10T15:12:45.282582Z","submitted_at":"2025-01-24T07:33:39Z","title":"Multi-stage Large Language Model Pipelines Can Outperform GPT-4o in Relevance Assessment","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:01.309104Z"},"links":{"citing_paper":"/paper/2501.14296"},"observation_digest":"sha256:275cf1d226ea16733344162274fb2e346ffb4bd8255a3714593dddb8d7a88b4b","observation_id":"8c977d79-12de-4c87-a3ab-368fb4686a14","resolution":{"observed_at":"2026-08-10T15:19:01.365684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:19:01.415855Z","title":null,"venue":null,"work_id":"c7a42a7f-7038-4617-9bcf-231cb43d55c0","year":null},"citing_paper":{"arxiv_id":"2501.14296","last_updated":"2025-01-24T07:33:39Z","snapshot_observed_at":"2026-08-10T15:12:45.282582Z","submitted_at":"2025-01-24T07:33:39Z","title":"Multi-stage Large Language Model Pipelines Can Outperform GPT-4o in Relevance Assessment","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-10T15:19:01.283905Z"},"links":{"citing_paper":"/paper/2501.14296"},"observation_digest":"sha256:3bbd09599e4f82bb81e34b39635f6078460a1f0488d2b97d6d93934caf610951","observation_id":"16bde970-20a3-4ad1-8f6f-418d7b102371","resolution":{"observed_at":"2026-08-10T15:19:01.420325Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.14296","last_updated":"2025-01-24T07:33:39Z","latest_version":1,"primary_category":"cs.IR","snapshot_observed_at":"2026-08-10T15:12:45.282582Z","submitted_at":"2025-01-24T07:33:39Z","title":"Multi-stage Large Language Model Pipelines Can Outperform GPT-4o in Relevance Assessment"},"reference_resolution":{"displayed":11,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":11},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 11 of 11 outbound references and 2 inbound Pith citation observations for arXiv:2501.14296."}