{"as_of":"2026-08-10T08:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7c2a55726e9b641514c13d803b234f12d06067615601438bb75323a996f4567a","coverage":[{"denominator":64,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":64,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T00:15:07.863827Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T08:12:56.432410Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18251","snapshot_observed_at":"2026-08-03T08:12:56.432410Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.18006","last_updated":"2026-05-27T15:28:35Z","snapshot_observed_at":"2026-08-03T08:12:50.069385Z","submitted_at":"2026-01-25T21:52:30Z","title":"PEAR: Pairwise Evaluation for Automatic Relative Scoring in Machine Translation","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-03T08:12:56.432410Z"},"links":{"cited_paper":"/paper/2501.18251","citing_paper":"/paper/2601.18006"},"observation_digest":"sha256:7f01bc4ea4820b949233b5c8f40ebd7cd7b6dfec0bc65f68e6259f5e664a1693","observation_id":"e76662ab-abe5-4fcd-a17c-4d486d4138f4","resolution":{"observed_at":"2026-08-03T08:12:56.432410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.18251/citation-record","integrity":"/paper/2501.18251/integrity","json":"/paper/2501.18251/citation-record.json","paper":"/paper/2501.18251"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.620959Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.620959Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:3857051f6f13dc4bfd75b1b6c117c2f1a46cb96a83feb60f6b28b21740803525","observation_id":"5291ffab-b8a3-4585-8314-2586d383e78d","resolution":{"observed_at":"2026-08-10T00:15:07.620959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.625068Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.625068Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:bc1a36d88dceca6553e492b93dd0b4cb2660d4e517bd4c01be8bccd9ca728fdb","observation_id":"ac11c1c2-f379-4a36-a4e8-a4630da23bcd","resolution":{"observed_at":"2026-08-10T00:15:07.625068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.629309Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.629309Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:1ecafb72fc8cc6f2b5b3afe08fee27c3f2a4a8e32960a4b4c548d6ccef7cd88e","observation_id":"9f7482b6-4175-4cbc-a11e-19dbc649799f","resolution":{"observed_at":"2026-08-10T00:15:07.629309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.632982Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.632982Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:af4ffd358713fb512594ccc42b6b4266f88fadac92d320015d885c63d494ac6d","observation_id":"941dec75-8490-4f24-b7de-907f1c2e1bd4","resolution":{"observed_at":"2026-08-10T00:15:07.632982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.636880Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.636880Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:986eef59599466ecaee5b9a8a9c1b3dd8942c26f362eeb7f1bdf5bb9026f075c","observation_id":"a136cf00-b0a5-4bbc-807b-56876510086a","resolution":{"observed_at":"2026-08-10T00:15:07.636880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.640883Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.640883Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:1b987964bf56e5ba1929083e7ed898bd7d9e43067218ef7183ff8e565cb993b7","observation_id":"1b0c6e3a-a63e-4e94-919f-cae11d292a1e","resolution":{"observed_at":"2026-08-10T00:15:07.640883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.645252Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.645252Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:f092b517db4c9a9098173827fcf02b3538f23ca80896303e48cfdd9fcd430550","observation_id":"24934da6-e031-47ed-9469-33668f79fce0","resolution":{"observed_at":"2026-08-10T00:15:07.645252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.649074Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.649074Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:0ae4b258140b8264f316cabcbdb5120415d8930eae12f097850303198575c02b","observation_id":"3dd3e08f-182a-4c1f-b4df-dfdb8fb247c4","resolution":{"observed_at":"2026-08-10T00:15:07.649074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.emnlp-main.767","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"095fc797-758c-4967-a69b-e637e517db78","year":2022},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.652954Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:b822a013bf93f136eb0e5d38b81806f8d97938702c792194ef1e32f5ea2d379f","observation_id":"1375c7b6-6ae6-4690-968f-528add5f2366","resolution":{"observed_at":"2026-08-10T00:15:08.058542Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.657008Z","title":"Fabbri, Wojciech Kry \\'s ci \\'n ski, Bryan McCann, Caiming Xiong, Richard Socher, and Dragomir Radev","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.657008Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:504f50340a1a2704e42d5635434070fb1d3b5024e5fc8ef67c8b682b02db51bc","observation_id":"4cdf5321-74e7-49ff-ae7b-0b54dc343c06","resolution":{"observed_at":"2026-08-10T00:15:07.657008Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:08.790882Z","title":null,"venue":null,"work_id":"2040a87e-caac-4eff-8bf5-b8cc42a51dbb","year":2024},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.661117Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:478daa5f46d05658e07bc3b5ceabb855e4978d1d474981fe4012bd887d2e940f","observation_id":"19d61532-cd4c-4b36-b1fe-2eb353b50940","resolution":{"observed_at":"2026-08-10T00:15:08.794361Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08008","last_updated":"2025-05-29T13:16:05Z","snapshot_observed_at":"2026-08-04T13:03:20.610282Z","submitted_at":"2024-04-10T01:26:24Z","title":"Sample-Efficient Human Evaluation of Large Language Models via Maximum Discrepancy Competition","version":2},"cited_work":{"arxiv_id":"2404.08008","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.08008","snapshot_observed_at":"2026-08-10T00:15:08.576588Z","title":"Sample-Efficient Human Evaluation of Large Language Models via Maximum Discrepancy Competition","venue":"cs.LG","work_id":"c6f83841-72ec-48c4-9990-560269a336ab","year":2024},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.664839Z"},"links":{"cited_paper":"/paper/2404.08008","citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:420a085f554bba18716c225cd462b88ed4470c1d27ad45364704272428847066","observation_id":"1a7703c4-1431-44e7-943e-ea4f41d6a674","resolution":{"observed_at":"2026-08-10T00:15:08.580963Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:08.781154Z","title":null,"venue":null,"work_id":"ecb98661-e784-48c7-9899-63d097b80f4f","year":1935},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.668904Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:a8d965e6b9c6acbce354e604e9bdb7cb089c7dc22fe58e20d9cdaac8e1a82c17","observation_id":"106ec775-0e25-4751-a2e6-a4d1fcd29a2e","resolution":{"observed_at":"2026-08-10T00:15:08.784558Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.672598Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.672598Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:ee9eae5f426b5df2aaeed7be21bdb7ac44ab471a8f18b3cc7a0399cac742bc77","observation_id":"97ddc2e7-98c2-4cb6-995c-4e8966cad2ce","resolution":{"observed_at":"2026-08-10T00:15:07.672598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:08.771527Z","title":null,"venue":null,"work_id":"a68c334d-b3e7-4c36-a0c1-9f971728b5a6","year":2022},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.676360Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:5ca8d6263dd5d2b4d9afc5c5b0a80364f2cb5105eb499a493c845fd3948b8dee","observation_id":"a646be9a-86f0-47a2-aab5-9199a6f34381","resolution":{"observed_at":"2026-08-10T00:15:08.774901Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:08.761906Z","title":null,"venue":null,"work_id":"dad200f9-4806-49a4-bcf4-1e4cf64e5036","year":2021},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.680165Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:5a53f0e4fcb95949e5524aab3c67c21a43a99d0636ac9a1d453d7ce1ef9533c1","observation_id":"d310ab8b-86c4-4d87-aa33-75f70b2dd2a5","resolution":{"observed_at":"2026-08-10T00:15:08.765309Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.683880Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.683880Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:d9485abe9b507dbe4fbc1cd881d7bcabe30a8350cc3afb44bf03b37314cbffc3","observation_id":"0d598735-b052-4efe-bfd4-281814fdaec2","resolution":{"observed_at":"2026-08-10T00:15:07.683880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.687596Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.687596Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:4d235de13c5bbf2d2a2634ac3b103b466e42e0b934ba6d028cd0286bfe200b9b","observation_id":"eb10b733-020e-45ca-a084-44a4eab57a86","resolution":{"observed_at":"2026-08-10T00:15:07.687596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.691606Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.691606Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:452e0372b349d8ff9147212aafca77472a571cb5e9c616e41977afd74409faea","observation_id":"8136c64b-de1b-468a-9108-78a198b6cf26","resolution":{"observed_at":"2026-08-10T00:15:07.691606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.08707","last_updated":"2019-10-19T05:45:36Z","snapshot_observed_at":"2026-08-03T17:47:19.513376Z","submitted_at":"2019-10-19T05:45:36Z","title":"Introduction to Coresets: Accurate Coresets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.08707","snapshot_observed_at":"2026-08-10T00:15:07.695467Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.695467Z"},"links":{"cited_paper":"/paper/1910.08707","citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:2c6dc50c6b2bc1282d84dbd3a3f2d291acd08f459a4922047eca8a832484610d","observation_id":"aee9204c-af2f-4e70-b756-3bd8e9bec8dd","resolution":{"observed_at":"2026-08-10T00:15:07.695467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03983","last_updated":"2024-10-04T23:52:28Z","snapshot_observed_at":"2026-07-06T19:28:12.480864Z","submitted_at":"2024-10-04T23:52:28Z","title":"MetricX-24: The Google Submission to the WMT 2024 Metrics Shared Task","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03983","snapshot_observed_at":"2026-08-10T00:15:07.699430Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.699430Z"},"links":{"cited_paper":"/paper/2410.03983","citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:4e34bbb69cd547117560cd23cb09c1ba94b3bf75a655ad8ae49363bdf9c5c050","observation_id":"dda3a4e4-571d-4bbb-917f-18643f2583b4","resolution":{"observed_at":"2026-08-10T00:15:07.699430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.703258Z","title":null,"venue":null,"work_id":null,"year":1975},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.703258Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:39deaef1fe31731da8592a864e6d87bebe60bc3ed7a6aa3dd8cf0ba8a8da7dce","observation_id":"bb4d3489-3dc3-4999-90f8-2c5d847ce513","resolution":{"observed_at":"2026-08-10T00:15:07.703258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.707024Z","title":null,"venue":null,"work_id":null,"year":1938},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.707024Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:2c34f45eed57cf82091eb3035a06568f322aac1d36cfc7670b5a41941d4e77d4","observation_id":"f13eb43a-0f64-434c-9c5e-99d0fbafe481","resolution":{"observed_at":"2026-08-10T00:15:07.707024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.714082Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.714082Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:c9655b02c4b76a275f5212024db6e851790e47b7c87742352dc341fedd6d8b55","observation_id":"98bc3c48-1373-440d-a6ee-1401d5f6be28","resolution":{"observed_at":"2026-08-10T00:15:07.714082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19884","last_updated":"2024-07-29T11:01:17Z","snapshot_observed_at":"2026-07-06T18:53:13.875335Z","submitted_at":"2024-07-29T11:01:17Z","title":"Preliminary WMT24 Ranking of General MT Systems and LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19884","snapshot_observed_at":"2026-08-10T00:15:07.717766Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.717766Z"},"links":{"cited_paper":"/paper/2407.19884","citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:c367eb754bcc0a0c01d86fb2fbe26ed89049af7da61af4425a4616bc33cd6807","observation_id":"3683a433-f20e-4259-a866-92f6136253dc","resolution":{"observed_at":"2026-08-10T00:15:07.717766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:08.751957Z","title":null,"venue":null,"work_id":"66085bb6-faa9-4b37-b4cc-bdbcff7731bd","year":2022},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.722701Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:6ab968c64a10854ffc84a16d8f79cd26706ef4de2cd3f8559d82f82be4cbbcfd","observation_id":"abf411df-078a-40e7-8dc5-1f1e876d02c8","resolution":{"observed_at":"2026-08-10T00:15:08.755404Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.727265Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.727265Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:bc93f7c6c757530ffd5bf53e3500dd79fea9a28027d0c502233158ad69d07543","observation_id":"a9baa1c0-db43-44a4-aa63-26fee3ae7af0","resolution":{"observed_at":"2026-08-10T00:15:07.727265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.731226Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.731226Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:361f77ed4673cb783fcf81e498118d051f4e367e2ded3e27813893d6b1093252","observation_id":"29bf7deb-8360-475e-be39-01c88fdec28c","resolution":{"observed_at":"2026-08-10T00:15:07.731226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2022.1250","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:08.467589Z","title":null,"venue":null,"work_id":"e070214d-df25-4f13-a850-73914240e255","year":2023},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.734967Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:707a89542c3d23af639f07dffa46bf121c19336bedbb8ef060a5c835fbc50b97","observation_id":"ab330d8a-cbbf-4064-abec-e88b864355c6","resolution":{"observed_at":"2026-08-10T00:15:08.474611Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:08.742130Z","title":null,"venue":null,"work_id":"8abc1dae-1e0e-442c-a166-7af857a2ca94","year":2019},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.738871Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:07e566c690f165f9313d09cf824286d872fa604d4555f79f10f96e4ef83f3487","observation_id":"c1d1f26a-5cda-490a-837a-f0a2edb5a3e8","resolution":{"observed_at":"2026-08-10T00:15:08.745416Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08351","last_updated":"2025-02-28T08:14:49Z","snapshot_observed_at":"2026-07-06T18:44:45.459377Z","submitted_at":"2024-07-11T10:03:47Z","title":"AutoBencher: Towards Declarative Benchmark Construction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08351","snapshot_observed_at":"2026-08-10T00:15:07.742534Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.742534Z"},"links":{"cited_paper":"/paper/2407.08351","citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:3efb8a14d6a9f794666cff08a8bd80785f3a637f3644742b4e52b873e463c8d6","observation_id":"9f3de85f-4175-4b05-b402-8c477802c8cf","resolution":{"observed_at":"2026-08-10T00:15:07.742534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05952","last_updated":"2024-10-08T12:08:46Z","snapshot_observed_at":"2026-07-06T19:29:42.190813Z","submitted_at":"2024-10-08T12:08:46Z","title":"Active Evaluation Acquisition for Efficient LLM Benchmarking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05952","snapshot_observed_at":"2026-08-10T00:15:07.746254Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.746254Z"},"links":{"cited_paper":"/paper/2410.05952","citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:bfa88fefc5be5b76402bdde09839e718f997b0d055e6c7b2bd1756b927b31bc4","observation_id":"7acf7fb7-4d2e-4254-84e1-4d6ef655cc7c","resolution":{"observed_at":"2026-08-10T00:15:07.746254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.750211Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.750211Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:f3e2d2280f4fecdbd16ff0a3511f101e1bf942675fa923a474db0fe17c4b8300","observation_id":"5ae1cddb-8d2d-4fa7-a1b9-4848b2998e8d","resolution":{"observed_at":"2026-08-10T00:15:07.750211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:08.732086Z","title":null,"venue":null,"work_id":"c7d1af60-bf57-43aa-8bb1-101e54bfa916","year":2014},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.754106Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:7628b063e0dec52999f28ca345f7b79c63332143db08942f030c258c866a1f3d","observation_id":"59c8ebc3-38f1-492c-9ddb-957038f15955","resolution":{"observed_at":"2026-08-10T00:15:08.735516Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:08.721919Z","title":null,"venue":null,"work_id":"f636641f-409c-41f3-b83d-463d64c26d05","year":2008},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.757774Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:63ea48fb10ad9b01098b68cbb5fa01f0af1aa1aa878321c26b1f76af4bd3d096","observation_id":"7502475a-fd70-420d-8802-8b36c739f667","resolution":{"observed_at":"2026-08-10T00:15:08.725509Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.761279Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.761279Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:b560f7e01a6665296d03793a0692aac56f300493df1c0b1f30b0b64c34646463","observation_id":"db718776-c5a6-4eda-956d-57054352fb7f","resolution":{"observed_at":"2026-08-10T00:15:07.761279Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.acl-long.242","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"8641bfd8-944a-42e2-a400-65e0e201afa8","year":2021},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.764979Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:6ecc81a34b6a335da84956c21d057eb40af48bdbbe0128153bfc1a39b73b71c2","observation_id":"2ce3924e-bc31-4ba3-bbd8-2d07a58ec152","resolution":{"observed_at":"2026-08-10T00:15:07.975125Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.768756Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.768756Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:2901159efb24ff1902d5cb289840c319e97c92fd59dae75c98a793fbf15bad40","observation_id":"762cf8dc-caa4-40d7-92db-7c24a16fd799","resolution":{"observed_at":"2026-08-10T00:15:07.768756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06565","last_updated":"2024-10-12T14:13:27Z","snapshot_observed_at":"2026-07-06T18:28:20.634381Z","submitted_at":"2024-06-03T05:47:05Z","title":"MixEval: Deriving Wisdom of the Crowd from LLM Benchmark Mixtures","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06565","snapshot_observed_at":"2026-08-10T00:15:07.772181Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.772181Z"},"links":{"cited_paper":"/paper/2406.06565","citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:5e43ced7d6245c5ef14a059064d3229fde8f924d1b04fb60b10468d6c82cc02c","observation_id":"6358db70-4ec3-4681-aa24-5c684c816f7e","resolution":{"observed_at":"2026-08-10T00:15:07.772181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.775933Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.775933Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:544a2a2ac5d6e3be8335fd59991dfd08188eb9cccb9d9adf484307d8865c9e12","observation_id":"18912063-3c8e-4409-a8de-5d7044db46c6","resolution":{"observed_at":"2026-08-10T00:15:07.775933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.779572Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.779572Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:922436d156d2149bd71391fbc8afbae35401f76079a821e419f2b2462db4f33e","observation_id":"545d1207-1b10-49ac-8594-5d761b266f6b","resolution":{"observed_at":"2026-08-10T00:15:07.779572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:08.711280Z","title":null,"venue":null,"work_id":"e417b0ed-030d-4ad6-ada8-4e64d87eb3fa","year":2022},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.783660Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:2476abc17d7092a2584edbaa3a72adb71c7ced2436ed27a3d4d48ae18398fecf","observation_id":"b54ea257-6616-464b-a46c-35b281734f51","resolution":{"observed_at":"2026-08-10T00:15:08.715396Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.787239Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.787239Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:ebe6d539e2027f3cc6d9163ff38b12e983dfc5cc252ddb0e90409fe1afbce160","observation_id":"c8766068-1747-413f-804f-a576352a3fb0","resolution":{"observed_at":"2026-08-10T00:15:07.787239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14992","last_updated":"2024-05-26T22:27:23Z","snapshot_observed_at":"2026-08-05T12:01:06.707349Z","submitted_at":"2024-02-22T22:05:23Z","title":"tinyBenchmarks: evaluating LLMs with fewer examples","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14992","snapshot_observed_at":"2026-08-10T00:15:07.790961Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.790961Z"},"links":{"cited_paper":"/paper/2402.14992","citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:7081ba3d71937df3e4d8f2a9f5584f0018b19a0d17212374513c4ae14a2a8d69","observation_id":"282a87bb-b6b2-48ba-853b-9f484c82bb83","resolution":{"observed_at":"2026-08-10T00:15:07.790961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.794875Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.794875Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:411468d3b30c7e061ba384831900a8a8e26bfd80a20ccc65793a03fecb471006","observation_id":"d5e9b363-513c-4d7e-a2b1-ab00cfe22aef","resolution":{"observed_at":"2026-08-10T00:15:07.794875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.798735Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.798735Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:55601d21ab11e17ee0cc4ad4ba7072985cf4eb5312d9fa5daf12867ba217ab0b","observation_id":"3f4740dd-1eb4-49a6-b9d0-e17c9459ecf5","resolution":{"observed_at":"2026-08-10T00:15:07.798735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.802297Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.802297Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:37ba566bbac682386452245f3ae270c523b6aefec274e9efaa298a2e65deb482","observation_id":"ca903653-74c7-49fd-b4b5-fdffb6810812","resolution":{"observed_at":"2026-08-10T00:15:07.802297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.806024Z","title":"Lalor, Robin Jia, and Jordan Boyd-Graber","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.806024Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:134ec1650d8ba447135fc18731709abe9bfe18002c64dac25307459d15baa115","observation_id":"17068c39-2558-4d38-b763-6b90199008bc","resolution":{"observed_at":"2026-08-10T00:15:07.806024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07967","last_updated":"2024-06-12T07:44:36Z","snapshot_observed_at":"2026-08-08T17:35:42.188279Z","submitted_at":"2024-06-12T07:44:36Z","title":"Better than Random: Reliable NLG Human Evaluation with Constrained Active Sampling","version":1},"cited_work":{"arxiv_id":"2406.07967","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.07967","snapshot_observed_at":"2026-08-10T00:15:08.306357Z","title":"Better than Random: Reliable NLG Human Evaluation with Constrained Active Sampling","venue":"cs.CL","work_id":"ca925c20-4a02-4f7a-9ba2-fc85c98f94de","year":2024},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.809666Z"},"links":{"cited_paper":"/paper/2406.07967","citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:b25317bb46e10ae9febe443fe83f2b15bc58f4c1726a8a750a41a11ade5f26d6","observation_id":"fdac1568-e007-4d3e-9d76-29d55f964a26","resolution":{"observed_at":"2026-08-10T00:15:08.311152Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.813563Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.813563Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:2400351d6abb1d1c4f356b308af5c163786117ff488eab3cad6dd4d8b2e58db3","observation_id":"fc8cf440-a3fc-453e-8b1e-32000107af21","resolution":{"observed_at":"2026-08-10T00:15:07.813563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:08.700294Z","title":null,"venue":null,"work_id":"f7cf5966-fced-4e90-8b8a-1d40766da94c","year":1998},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.817239Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:9789b7646b183563bc6ac4f483ce87fe4eafc792e952660d4d225c79f56d27eb","observation_id":"eafa59e2-1f08-4af1-986d-73dc19b020be","resolution":{"observed_at":"2026-08-10T00:15:08.703924Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.820749Z","title":"Spearman","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.820749Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:f638c2b2cb0447d254cb03a77177c67c2719269f8d3198c9d97b5a95db707400","observation_id":"83f23fbd-caf7-42a3-acc6-10f4df9ba806","resolution":{"observed_at":"2026-08-10T00:15:07.820749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.824275Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.824275Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:3127b72f9e81d37eead4b61f711a8c95579e164f22409caa58d7175aebaf9920","observation_id":"21dcd353-d791-476c-9678-46be98eb8719","resolution":{"observed_at":"2026-08-10T00:15:07.824275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:08.689649Z","title":null,"venue":null,"work_id":"22d148d0-d5d4-46bd-858c-83cff3ddc372","year":2020},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.827628Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:718c36548a06251dc867927c9c547c8b2bcf450fe4d7a302059ca65545586b47","observation_id":"431fcfc4-501c-4910-a855-747d51f145e7","resolution":{"observed_at":"2026-08-10T00:15:08.693192Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:08.679010Z","title":null,"venue":null,"work_id":"f9c2e308-06f3-4e60-951e-bd4ee033e2b8","year":2024},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.831172Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:81b678e74c83d2b4da73f24631d583b7887cf1a6064c09b99052a705c31bc4f0","observation_id":"2da6e9ff-57d0-4ada-b227-e163c755a6b0","resolution":{"observed_at":"2026-08-10T00:15:08.682537Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:08.668719Z","title":null,"venue":null,"work_id":"920d38d4-c16e-41d3-8392-8e90f245d082","year":2015},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.834727Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:be5c699a9915906d825fb145a79944e365e2b74d8fc2549bba84b5310cb137a1","observation_id":"c79acf56-bb6a-4ae3-9972-0d125ad71205","resolution":{"observed_at":"2026-08-10T00:15:08.672383Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.00276","last_updated":"2020-03-16T17:19:23Z","snapshot_observed_at":"2026-07-06T08:54:17.194727Z","submitted_at":"2020-02-01T20:54:02Z","title":"Variational Item Response Theory: Fast, Accurate, and Expressive","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.00276","snapshot_observed_at":"2026-08-10T00:15:07.838032Z","title":"Davis, Benjamin W","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.838032Z"},"links":{"cited_paper":"/paper/2002.00276","citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:049dee2650e917ff18e49733d872177e6d33f621ca85a68fa405f45e1a3dd25d","observation_id":"18942da1-1093-41a9-9ad9-29bafe900fe8","resolution":{"observed_at":"2026-08-10T00:15:07.838032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-10T00:15:07.842028Z","title":"Weinberger, and Yoav Artzi","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.842028Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:98ff43062a46f30aae53643c459bfe2fc48808c806ae022e7264a04ca7ec7cc4","observation_id":"9da43c80-52bd-4bb1-8251-060772137489","resolution":{"observed_at":"2026-08-10T00:15:07.842028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.845684Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.845684Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:8a31dbc74dae6b1526fef32271579884e8d2b3d7709fd343cc7139ad92f3bbcc","observation_id":"02e04333-72a7-4789-8509-9563bba7f0a7","resolution":{"observed_at":"2026-08-10T00:15:07.845684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.849524Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.849524Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:8f9e7403ea892f73714402e2d496b3d5797e0c28d28030f8d3ed851c62334fd5","observation_id":"8c668288-be1f-4e1c-b4b0-5787bb234b20","resolution":{"observed_at":"2026-08-10T00:15:07.849524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.853090Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.853090Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:a641333e1c5c904881af56e51e82363247018faafa2af30d4dfd615d6f2d67ac","observation_id":"1fcc7960-5ab8-449a-8f63-3cc8a2964074","resolution":{"observed_at":"2026-08-10T00:15:07.853090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:07.856769Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.856769Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:94f4f43ae1133abf922cc2ce170073b6084512c45560b9d3ad7e1a7a9ecef53a","observation_id":"66019bc1-2a8a-4af3-876e-c18a9bd3fcc8","resolution":{"observed_at":"2026-08-10T00:15:07.856769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:15:08.657696Z","title":null,"venue":null,"work_id":"d5ce05d9-01a3-4674-884b-2c1a942eafb3","year":2025},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.860273Z"},"links":{"citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:d477ca6b54f32079b304ffe59df9d690ef5997d141d2a6705602fe8b3d8ddbc2","observation_id":"402bb702-df49-495b-91cc-a3d819926341","resolution":{"observed_at":"2026-08-10T00:15:08.661803Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14429","last_updated":"2025-07-07T22:42:38Z","snapshot_observed_at":"2026-08-07T18:02:26.008931Z","submitted_at":"2025-02-20T10:27:13Z","title":"Early-Exit and Instant Confidence Translation Quality Estimation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14429","snapshot_observed_at":"2026-08-10T00:15:07.863827Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-10T00:15:07.863827Z"},"links":{"cited_paper":"/paper/2502.14429","citing_paper":"/paper/2501.18251"},"observation_digest":"sha256:7c6fcb7b82d9e1cad553098c5e2d6981eac5f9df4139074103ea6dedca8ecedd","observation_id":"df5eae40-7d34-4082-b7ce-f11ac103fc03","resolution":{"observed_at":"2026-08-10T00:15:07.863827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.18251","last_updated":"2025-05-31T09:55:39Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T03:33:44.111074Z","submitted_at":"2025-01-30T10:33:26Z","title":"How to Select Datapoints for Efficient Human Evaluation of NLG Models?"},"reference_resolution":{"displayed":64,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":57,"verified_exact":5,"verified_fuzzy":0},"total_outbound_references":64},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 64 of 64 outbound references and 1 inbound Pith citation observation for arXiv:2501.18251."}