{"as_of":"2026-08-18T12:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:17d8cf460b4f7f02cf2f24a50ca705c77b23b5f0bf7dbefc0d76278fc2bb405a","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:08:47.091294Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.10736/citation-record","integrity":"/paper/2505.10736/integrity","json":"/paper/2505.10736/citation-record.json","paper":"/paper/2505.10736"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:49.259028Z","title":null,"venue":null,"work_id":"46164e55-b24f-4e64-96a9-8e66c304f079","year":2020},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:45.151923Z"},"links":{"citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:bae8fa14c41f29f1a58735a2eb47457d72eb50a955aafcc43e3e50e05c67fe76","observation_id":"fdb698c2-6a71-4938-8b32-0255bd990568","resolution":{"observed_at":"2026-08-15T21:08:49.329095Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16827","last_updated":"2024-08-02T17:59:31Z","snapshot_observed_at":"2026-08-16T14:15:11.706978Z","submitted_at":"2024-02-26T18:54:35Z","title":"A Survey on Data Selection for Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16827","snapshot_observed_at":"2026-08-15T21:08:45.160118Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:45.160118Z"},"links":{"cited_paper":"/paper/2402.16827","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:719ab5feed3b16a32f04983fc9ffc729db5330ef085daec7c199ca9c9a22f666","observation_id":"becbba86-6f86-4847-b8ad-a970a62a2c65","resolution":{"observed_at":"2026-08-15T21:08:45.160118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:49.212830Z","title":null,"venue":null,"work_id":"bb9ae52d-679f-461a-9333-486434d0f2bf","year":2002},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:45.166750Z"},"links":{"citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:9ee8cce5e3889a86b470cac951f365850e3d6d64c27ac80004ab1c145498619b","observation_id":"f8da7fb6-85fb-4fd9-af64-62f0de3f71e6","resolution":{"observed_at":"2026-08-15T21:08:49.237886Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:45.173184Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:45.173184Z"},"links":{"citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:ac72ee003dfab453468b02a77e7508d5a24de66b214c01e796a46f34d9ae524c","observation_id":"04f487f4-639f-4d82-a1fd-ded5679fbd48","resolution":{"observed_at":"2026-08-15T21:08:45.173184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:49.130517Z","title":null,"venue":null,"work_id":"5bd64c77-a8ba-4321-8075-32f0bc1485ee","year":2023},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:45.262401Z"},"links":{"citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:590af4198a2f6deefe8163f385829b3a7da2c3cff325d9c0779a24c1045a04f6","observation_id":"fc0822f3-4712-4a97-b41c-bd04e421cf5c","resolution":{"observed_at":"2026-08-15T21:08:49.175297Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1203.3472","last_updated":"2012-03-15T11:17:56Z","snapshot_observed_at":"2026-08-15T08:54:57.050408Z","submitted_at":"2012-03-15T11:17:56Z","title":"Super-Samples from Kernel Herding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1203.3472","snapshot_observed_at":"2026-08-15T21:08:45.312117Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:45.312117Z"},"links":{"cited_paper":"/paper/1203.3472","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:eb590cd9964eaafe72cd1da919d60c75ae91139a3906204ab3cdb31496ea4df6","observation_id":"f7dae928-bfcf-49a0-bed2-22685fc8a1c7","resolution":{"observed_at":"2026-08-15T21:08:45.312117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.11829","last_updated":"2020-10-27T00:52:20Z","snapshot_observed_at":"2026-08-15T14:35:34.584882Z","submitted_at":"2019-06-26T23:01:47Z","title":"Selection via Proxy: Efficient Data Selection for Deep Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.11829","snapshot_observed_at":"2026-08-15T21:08:45.320302Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:45.320302Z"},"links":{"cited_paper":"/paper/1906.11829","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:5381e2b3c477a6888c9d05107302f8aebada39bde0208c931201fa645a2262a3","observation_id":"a57bab15-3861-42b3-8cc8-f45be1d04e3a","resolution":{"observed_at":"2026-08-15T21:08:45.320302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12548","last_updated":"2022-10-22T15:21:46Z","snapshot_observed_at":"2026-08-16T16:57:50.526540Z","submitted_at":"2022-05-25T07:50:31Z","title":"RLPrompt: Optimizing Discrete Text Prompts with Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12548","snapshot_observed_at":"2026-08-15T21:08:45.421780Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:45.421780Z"},"links":{"cited_paper":"/paper/2205.12548","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:730e8ef7b2250bfcfc342fc7313969f3b03abd14ee33423e4ce69da09cf63586","observation_id":"e82a0709-eb30-4058-af32-21c08e0610a4","resolution":{"observed_at":"2026-08-15T21:08:45.421780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.09841","last_updated":"2018-02-27T12:02:33Z","snapshot_observed_at":"2026-08-17T13:02:52.058962Z","submitted_at":"2018-02-27T12:02:33Z","title":"Adversarial Active Learning for Deep Networks: a Margin Based Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.09841","snapshot_observed_at":"2026-08-15T21:08:45.500962Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:45.500962Z"},"links":{"cited_paper":"/paper/1802.09841","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:d53377547e8de09051b07dbbe5e6977c9f784bb47e55e1e82e633871fb6b226b","observation_id":"3f3645a7-6335-47a2-b784-9422bc2aa3d4","resolution":{"observed_at":"2026-08-15T21:08:45.500962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16797","last_updated":"2023-09-28T19:01:07Z","snapshot_observed_at":"2026-08-14T11:37:32.461743Z","submitted_at":"2023-09-28T19:01:07Z","title":"Promptbreeder: Self-Referential Self-Improvement Via Prompt Evolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16797","snapshot_observed_at":"2026-08-15T21:08:45.537546Z","title":"Promptbreeder: Self-referential self-improvement via prompt evolution (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:45.537546Z"},"links":{"cited_paper":"/paper/2309.16797","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:97ced03fe3af7d92b865339772e199a705e6dda0392beab5007cb1be9926e37f","observation_id":"97f014f6-b0ce-448b-a7e6-8969fe648b78","resolution":{"observed_at":"2026-08-15T21:08:45.537546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08532","last_updated":"2025-05-01T11:56:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-15T16:50:09Z","title":"EvoPrompt: Connecting LLMs with Evolutionary Algorithms Yields Powerful Prompt Optimizers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08532","snapshot_observed_at":"2026-08-15T21:08:45.546308Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:45.546308Z"},"links":{"cited_paper":"/paper/2309.08532","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:634dc80b0c465316bea4d4155a020cbcc95d9747ddc000258be780a2279b371c","observation_id":"46eabe59-fa2f-4ecf-b349-439980cb2cd6","resolution":{"observed_at":"2026-08-15T21:08:45.546308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:45.634522Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:45.634522Z"},"links":{"citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:cf9f2a379037e12c94093765b2dfc9d0958ee138c9855af8051a3d9e9d30cdd2","observation_id":"ee426de1-24c4-477b-8db2-0f7708f60632","resolution":{"observed_at":"2026-08-15T21:08:45.634522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14189","last_updated":"2025-05-30T14:12:54Z","snapshot_observed_at":"2026-08-16T13:50:22.690678Z","submitted_at":"2024-05-23T05:31:41Z","title":"Efficient Universal Goal Hijacking with Semantics-guided Prompt Organization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14189","snapshot_observed_at":"2026-08-15T21:08:45.649648Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:45.649648Z"},"links":{"cited_paper":"/paper/2405.14189","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:0b619d77a591e4250a2f823d02162ace0bf17cd126e8067e1aa970f0a2e13e3f","observation_id":"4fa4642a-95dd-4c61-a24f-a0c887afda78","resolution":{"observed_at":"2026-08-15T21:08:45.649648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10504","last_updated":"2025-05-19T06:17:42Z","snapshot_observed_at":"2026-08-17T08:55:09.180473Z","submitted_at":"2024-06-15T04:54:26Z","title":"Task Facet Learning: A Structured Approach to Prompt Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10504","snapshot_observed_at":"2026-08-15T21:08:45.717835Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:45.717835Z"},"links":{"cited_paper":"/paper/2406.10504","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:439a82cb12dab625584a4f90a43abaa3a81c8458ad0a5cafcce8b62b8a0af997","observation_id":"c9403401-8470-4c28-ae56-a1cb5b9b9657","resolution":{"observed_at":"2026-08-15T21:08:45.717835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.02200","last_updated":"2020-04-05T13:46:16Z","snapshot_observed_at":"2026-08-18T06:02:43.241377Z","submitted_at":"2020-04-05T13:46:16Z","title":"Confident Coreset for Active Learning in Medical Image Analysis","version":1},"cited_work":{"arxiv_id":"2004.02200","doi":null,"metadata_source":"pith","pith_arxiv_id":"2004.02200","snapshot_observed_at":"2026-08-15T21:08:47.764315Z","title":"Confident Coreset for Active Learning in Medical Image Analysis","venue":"cs.CV","work_id":"0c9d3b58-d086-403e-9766-a5a041eb2eee","year":2020},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:45.725463Z"},"links":{"cited_paper":"/paper/2004.02200","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:74e583b2d279c463664781a33ebdaf57a9273bac801fc614e49b6e98a8314079","observation_id":"3abb6e08-4da3-4929-b099-bd4bcb7375aa","resolution":{"observed_at":"2026-08-15T21:08:47.839120Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:45.733087Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:45.733087Z"},"links":{"citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:fede4b4c64e47354ac49318e20e0ea9e9883188d39747dd31cc5e262f29c890e","observation_id":"967d4a45-0ea5-4a0e-82f1-ef4af418374b","resolution":{"observed_at":"2026-08-15T21:08:45.733087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02476","last_updated":"2023-09-05T14:06:33Z","snapshot_observed_at":"2026-08-16T16:57:02.904636Z","submitted_at":"2023-09-05T14:06:33Z","title":"Optimal Sample Selection Through Uncertainty Estimation and Its Application in Deep Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02476","snapshot_observed_at":"2026-08-15T21:08:45.841314Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:45.841314Z"},"links":{"cited_paper":"/paper/2309.02476","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:8f6b72a48b3cb558bfdc5cdaa842654775164b64d3d962a6eef0919c729e5c07","observation_id":"929b9bb0-213f-4ba3-9107-cf34bd76702e","resolution":{"observed_at":"2026-08-15T21:08:45.841314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:48.878467Z","title":null,"venue":null,"work_id":"24a9a08d-ab5e-43f4-94c5-20ec32e758b1","year":2021},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:45.884277Z"},"links":{"citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:d1828c87467ab26735eecd8f236a32143c4cd8df3e25771a06e9ac32837d8082","observation_id":"2d720f93-19c2-41dc-81d4-e7bec1da49c8","resolution":{"observed_at":"2026-08-15T21:08:48.902697Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:45.974517Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:45.974517Z"},"links":{"citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:56c3af757c717ff1f4e1ed581c917f9451bf0f148a6f97a2ee1419385a152a08","observation_id":"c2bdf39c-b920-47ff-8697-544dcd55a9d8","resolution":{"observed_at":"2026-08-15T21:08:45.974517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:46.024422Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:46.024422Z"},"links":{"citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:957d93fc8bb7860b8ad947f1320c2bdf1b09695db12de7e7880d706645657ba6","observation_id":"d3634353-e02c-43a8-aae4-53451f49be3b","resolution":{"observed_at":"2026-08-15T21:08:46.024422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.03764","last_updated":"2021-09-08T16:40:18Z","snapshot_observed_at":"2026-08-16T17:58:01.411236Z","submitted_at":"2021-09-08T16:40:18Z","title":"Active Learning by Acquiring Contrastive Examples","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.03764","snapshot_observed_at":"2026-08-15T21:08:46.030607Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:46.030607Z"},"links":{"cited_paper":"/paper/2109.03764","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:f472310a89e5683cb2efea3c4412382da3b451f4153b01727ad37cd9b0f62722","observation_id":"f0805446-b1c2-41dc-b9a1-16db12793ee3","resolution":{"observed_at":"2026-08-15T21:08:46.030607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03563","last_updated":"2024-09-05T14:19:45Z","snapshot_observed_at":"2026-08-16T13:21:03.297429Z","submitted_at":"2024-09-05T14:19:45Z","title":"100 instances is all you need: predicting the success of a new LLM on unseen data by testing on a few instances","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03563","snapshot_observed_at":"2026-08-15T21:08:46.069427Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:46.069427Z"},"links":{"cited_paper":"/paper/2409.03563","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:e4fa9d357a83d2c820b95a78d8eb4d2acb1ed35680d17ba82fc364379af79538","observation_id":"a53c8169-a05e-4f10-a958-77e1b9311bfb","resolution":{"observed_at":"2026-08-15T21:08:46.069427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:48.675301Z","title":null,"venue":null,"work_id":"68203725-af29-4eb2-b329-e9fe0a1992a9","year":2021},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:46.110102Z"},"links":{"citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:ae7a2239924148d8212761c7da6313c49986bd984d978a21f8eba46650163a76","observation_id":"0649a8b1-0119-4ac9-9bdf-e1a88bfb537b","resolution":{"observed_at":"2026-08-15T21:08:48.764058Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14992","last_updated":"2024-05-26T22:27:23Z","snapshot_observed_at":"2026-08-17T02:59:38.954198Z","submitted_at":"2024-02-22T22:05:23Z","title":"tinyBenchmarks: evaluating LLMs with fewer examples","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14992","snapshot_observed_at":"2026-08-15T21:08:46.116666Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:46.116666Z"},"links":{"cited_paper":"/paper/2402.14992","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:a2d03396b2626c0da9bb1a9624a4b9b452320e97d669dbab28e8ab4579d74f55","observation_id":"6abe9604-0898-4f4a-a764-db9bffa04569","resolution":{"observed_at":"2026-08-15T21:08:46.116666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03495","last_updated":"2023-10-19T04:37:25Z","snapshot_observed_at":"2026-08-16T15:35:36.835145Z","submitted_at":"2023-05-04T15:15:22Z","title":"Automatic Prompt Optimization with \"Gradient Descent\" and Beam Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.03495","snapshot_observed_at":"2026-08-15T21:08:46.207594Z","title":"gradient descent","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:46.207594Z"},"links":{"cited_paper":"/paper/2305.03495","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:13501b67e011c7e5568f9c9c12e732d7fdb9292b5307b059c910ae5219d7863a","observation_id":"68c6f579-4b73-4c96-a89c-7fa29cd3b437","resolution":{"observed_at":"2026-08-15T21:08:46.207594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:48.584449Z","title":null,"venue":null,"work_id":"6c3355d3-f532-45f3-b262-b1f79a2ccf93","year":2017},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:46.292643Z"},"links":{"citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:0b316e7eeb6ef748304f82fe541f1b3c43a1df7a893972a3d3b99f8b34f2eafd","observation_id":"9304d62b-8f34-42a1-aa30-07551831dabd","resolution":{"observed_at":"2026-08-15T21:08:48.656923Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10084","last_updated":"2019-08-27T08:50:17Z","snapshot_observed_at":"2026-08-14T05:02:11.716316Z","submitted_at":"2019-08-27T08:50:17Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10084","snapshot_observed_at":"2026-08-15T21:08:46.391741Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:46.391741Z"},"links":{"cited_paper":"/paper/1908.10084","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:928684604e97d6267e08c4169da87f186cf13767b344bb1501427f77968e1ac3","observation_id":"f0125ce7-bd1a-480a-b056-b8817cff4f90","resolution":{"observed_at":"2026-08-15T21:08:46.391741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.00489","last_updated":"2018-06-01T10:17:23Z","snapshot_observed_at":"2026-08-16T13:51:24.988660Z","submitted_at":"2017-08-01T19:50:53Z","title":"Active Learning for Convolutional Neural Networks: A Core-Set Approach","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.00489","snapshot_observed_at":"2026-08-15T21:08:46.398642Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:46.398642Z"},"links":{"cited_paper":"/paper/1708.00489","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:ee0135d5c63b02de80347259357558899aed04666a0fa1c824904733accc1ba4","observation_id":"7fa6ca6e-9ab1-44ad-bebc-ab9877d86ef8","resolution":{"observed_at":"2026-08-15T21:08:46.398642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:48.477519Z","title":null,"venue":null,"work_id":"e9143df8-0389-4d21-a1cd-6f4e4f81384a","year":2020},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:46.404071Z"},"links":{"citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:dc613e77be124ff2a8e0044b7edc2675ecf794afdc146601fd06dfe971d9fb8b","observation_id":"a885d317-e090-46d2-b1b3-09f829acbe28","resolution":{"observed_at":"2026-08-15T21:08:48.563914Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.05159","last_updated":"2019-11-15T17:08:30Z","snapshot_observed_at":"2026-08-16T19:44:25.767623Z","submitted_at":"2018-12-12T21:24:15Z","title":"An Empirical Study of Example Forgetting during Deep Neural Network Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.05159","snapshot_observed_at":"2026-08-15T21:08:46.470263Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:46.470263Z"},"links":{"cited_paper":"/paper/1812.05159","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:f186a483b0a025b927b83d9ca6b2d5ecf8d10610d9cad84634e66a542b590f4b","observation_id":"ec5aeb86-0ae1-4621-b711-2e20184fb56b","resolution":{"observed_at":"2026-08-15T21:08:46.470263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08638","last_updated":"2024-02-18T21:37:47Z","snapshot_observed_at":"2026-08-16T15:00:38.056848Z","submitted_at":"2023-09-14T17:45:51Z","title":"Anchor Points: Benchmarking Models with Much Fewer Examples","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08638","snapshot_observed_at":"2026-08-15T21:08:46.539418Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:46.539418Z"},"links":{"cited_paper":"/paper/2309.08638","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:b6f4661f21eaefb2cd3318d639c39ed80b45111dde95afd5e5a4826a1e1e20e9","observation_id":"880a68df-56a8-4e17-9744-8ed3c31a3048","resolution":{"observed_at":"2026-08-15T21:08:46.539418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:48.417024Z","title":null,"venue":null,"work_id":"019bcc31-4948-45c6-bfb4-f5627e5260bc","year":2018},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:46.617421Z"},"links":{"citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:f499aaaacf37d7f4cb219be703c7c19c41b24fdf224954ebe74edbf636b4eb67","observation_id":"47b47f51-37ec-426f-8a33-b0471e40ecaa","resolution":{"observed_at":"2026-08-15T21:08:48.459157Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.00648","last_updated":"2017-05-01T18:20:47Z","snapshot_observed_at":"2026-08-14T21:03:34.693171Z","submitted_at":"2017-05-01T18:20:47Z","title":"\"Liar, Liar Pants on Fire\": A New Benchmark Dataset for Fake News Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.00648","snapshot_observed_at":"2026-08-15T21:08:46.623696Z","title":"liar, liar pants on fire","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:46.623696Z"},"links":{"cited_paper":"/paper/1705.00648","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:375e8545762af7d6f2247455f7ff11738dda47bb829290998953730b34b4560c","observation_id":"f18b0cb6-53b2-40ea-add9-9986a47c7082","resolution":{"observed_at":"2026-08-15T21:08:46.623696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:46.630311Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:46.630311Z"},"links":{"citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:ca6b320281eb1b6125ff3a42911f98a8575daaa23ffd39844154ac3e0bd0628f","observation_id":"dd03d039-b190-457b-a32d-b5e0a402d607","resolution":{"observed_at":"2026-08-15T21:08:46.630311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03409","last_updated":"2024-04-15T07:50:32Z","snapshot_observed_at":"2026-08-15T09:21:11.223719Z","submitted_at":"2023-09-07T00:07:15Z","title":"Large Language Models as Optimizers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03409","snapshot_observed_at":"2026-08-15T21:08:46.677735Z","title":"Le, Denny Zhou, and Xinyun Chen","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:46.677735Z"},"links":{"cited_paper":"/paper/2309.03409","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:d86ea3352fbff2c636ea86fe4f469b26533679b79475f9d727113c129afada6d","observation_id":"e6030d55-fd56-4b90-8823-d0094f7a8e63","resolution":{"observed_at":"2026-08-15T21:08:46.677735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02151","last_updated":"2024-05-05T05:04:49Z","snapshot_observed_at":"2026-08-16T15:10:52.856326Z","submitted_at":"2023-08-04T06:14:23Z","title":"Retroformer: Retrospective Large Language Agents with Policy Gradient Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02151","snapshot_observed_at":"2026-08-15T21:08:46.705488Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:46.705488Z"},"links":{"cited_paper":"/paper/2308.02151","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:6f37b714eabbc28ee80bb1fbb3a7c3e6d841c91f8a3fc1bed21455fa09e63442","observation_id":"5078c01b-bbcd-4c12-a041-e024a5cc104b","resolution":{"observed_at":"2026-08-15T21:08:46.705488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:48.333863Z","title":null,"venue":null,"work_id":"997086f9-884a-4475-b700-82b753ee7cde","year":2004},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:46.712768Z"},"links":{"citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:de85af180ddb551e4f9c456b519ec2fe6a0e567e5ef4abb151e2e419f9f352e5","observation_id":"01f3d289-8db2-426c-8ac4-55c77d653cb6","resolution":{"observed_at":"2026-08-15T21:08:48.378702Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11890","last_updated":"2022-11-21T22:38:20Z","snapshot_observed_at":"2026-08-16T16:14:22.650884Z","submitted_at":"2022-11-21T22:38:20Z","title":"TEMPERA: Test-Time Prompting via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.11890","snapshot_observed_at":"2026-08-15T21:08:46.821013Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:46.821013Z"},"links":{"cited_paper":"/paper/2211.11890","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:d41e51afe4758b63100f4a7a601b1a79be3ac63f175457646508858731891012","observation_id":"58c76913-35af-45f4-a988-b43349a20ece","resolution":{"observed_at":"2026-08-15T21:08:46.821013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-emnlp.659","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:47.210908Z","title":null,"venue":null,"work_id":"152ddd31-d4b2-419d-8fd3-907d05bb8c62","year":2023},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:46.829163Z"},"links":{"citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:a237d5bcc31028193a9a8a467e9edfcee6bd35ae5591dabff32642c25f9f36e6","observation_id":"bcd2c9e3-2e9c-41df-999c-b3ed66a53694","resolution":{"observed_at":"2026-08-15T21:08:47.308306Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:48.218677Z","title":null,"venue":null,"work_id":"81ec0825-215f-4735-a4e4-44d0a7a8aa68","year":2022},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:46.837162Z"},"links":{"citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:0e0ab36f3dff98da766d9250cfab9d0a81ed9807e9c705412f456f4c75eeb555","observation_id":"4092c3f0-2f1a-47bd-a327-bdd68d4509b6","resolution":{"observed_at":"2026-08-15T21:08:48.244094Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06167","last_updated":"2025-01-07T03:59:37Z","snapshot_observed_at":"2026-08-16T14:53:39.617251Z","submitted_at":"2023-10-09T21:36:21Z","title":"Predictable Artificial Intelligence","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06167","snapshot_observed_at":"2026-08-15T21:08:46.925854Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:46.925854Z"},"links":{"cited_paper":"/paper/2310.06167","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:51b0657f7c8a3bc776a79c5de5f26edb041fa896e7c9cdfc37a598453bf7b5a9","observation_id":"fb5314c8-f3d5-45a1-9896-f1f134b83120","resolution":{"observed_at":"2026-08-15T21:08:46.925854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01910","last_updated":"2023-03-10T17:20:17Z","snapshot_observed_at":"2026-08-17T11:53:58.758448Z","submitted_at":"2022-11-03T15:43:03Z","title":"Large Language Models Are Human-Level Prompt Engineers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01910","snapshot_observed_at":"2026-08-15T21:08:46.936065Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:46.936065Z"},"links":{"cited_paper":"/paper/2211.01910","citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:20e827c44f4f03851758750ceba3510877380fdfec62455d80e62e4c3da0f8a4","observation_id":"bf9a77ae-772a-4cf1-a33f-c1bbc1b4f41d","resolution":{"observed_at":"2026-08-15T21:08:46.936065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:47.045425Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:47.045425Z"},"links":{"citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:3fa12de68d1c06fc785aa8379bacc4dd277a0d65a3e42433899ed4283da782f6","observation_id":"c3f059eb-766d-4a61-95e2-af5f4c04e2d3","resolution":{"observed_at":"2026-08-15T21:08:47.045425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:47.084080Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:47.084080Z"},"links":{"citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:3c2e2be83795c598881a8e83cd26baceb2c6e65238fc70bac6632735efc42460","observation_id":"af9c4d93-6f9e-4cd6-9aa2-faacdd53b0d0","resolution":{"observed_at":"2026-08-15T21:08:47.084080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:48.100507Z","title":null,"venue":null,"work_id":"44ada495-0ed1-4908-96dd-59ab8a012491","year":2024},"citing_paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T21:08:47.091294Z"},"links":{"citing_paper":"/paper/2505.10736"},"observation_digest":"sha256:8c1517fc17760d2d69c13fe478b8a9091e9386d2ef31f569cc7186924e82d41f","observation_id":"2f501037-58b3-4d81-bd50-db54aaeb94df","resolution":{"observed_at":"2026-08-15T21:08:48.171504Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.10736","last_updated":"2025-08-18T18:02:26Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-18T00:24:06.532913Z","submitted_at":"2025-05-15T22:41:30Z","title":"Model Performance-Guided Evaluation Data Selection for Effective Prompt Optimization"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2505.10736."}