{"as_of":"2026-08-11T11:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e90aeb01629d75ccfd592dea650e99a036af4de79c90da4733fd9dd33a158878","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T18:48:15.774746Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.16704/citation-record","integrity":"/paper/2605.16704/integrity","json":"/paper/2605.16704/citation-record.json","paper":"/paper/2605.16704"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/s0022-0000(03","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"doi: https://doi.org/10.1016/S0022-0000(03 )00025-4","venue":null,"work_id":"c9defe31-db1e-438f-be6a-b5bf19dc78f7","year":null},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:eb158d684b41042886cc4a205c0a4fbba8a3114bd421c12151d36aa8aef48193","observation_id":"5486d487-4eb6-41eb-93c0-2796dcdb32a0","resolution":{"observed_at":"2026-05-20T18:48:52.732430Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-23T22:22:49.009758+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T22:22:49.009758+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A marketplace for data: An algorithmic solution","venue":null,"work_id":"ea8dc1fc-0765-4ea1-b3f0-f344e40a78fd","year":2019},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:e0e16814f67d111172de15f9709252dc1495cafeda45fecd30ffbd66e17e200c","observation_id":"2a5e5b6b-f03d-42b2-9431-df75c75f8227","resolution":{"observed_at":"2026-05-20T18:48:53.571763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02737","last_updated":"2025-02-04T21:43:16Z","snapshot_observed_at":"2026-08-10T04:07:56.506438Z","submitted_at":"2025-02-04T21:43:16Z","title":"SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model","version":1},"cited_work":{"arxiv_id":"2502.02737","doi":"10.48550/arxiv.2502.02737","metadata_source":"pith","pith_arxiv_id":"2502.02737","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model","venue":"cs.CL","work_id":"8472f581-14d4-40f8-8189-62ed8b470c4e","year":2025},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/2502.02737","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:326b5025795e1d5ed139e7ad699a1e8039a3dd778bd7b3110588f4d2638b60f6","observation_id":"5ef17865-4e54-4a1a-b767-2b70f4f3b9ff","resolution":{"observed_at":"2026-05-20T18:48:53.245618Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-14T07:19:40.857163+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T07:19:40.857163+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1508.05326","last_updated":"2015-08-21T16:17:01Z","snapshot_observed_at":"2026-08-10T11:52:49.214145Z","submitted_at":"2015-08-21T16:17:01Z","title":"A large annotated corpus for learning natural language inference","version":1},"cited_work":{"arxiv_id":"1508.05326","doi":"10.48550/arxiv.1508.05326","metadata_source":"pith","pith_arxiv_id":"1508.05326","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A large annotated corpus for learning natural language inference","venue":"cs.CL","work_id":"c7bde334-463e-4827-a444-d90b456da346","year":2015},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/1508.05326","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:6434ae902d7f17daa1e16881065f1c91612bfeb2fc6208f47912ac788321c7aa","observation_id":"c30f583e-2239-4e81-b67e-d4244bbb7ac9","resolution":{"observed_at":"2026-05-20T18:48:53.202546Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:5034918f876707e0f7c0d13570bfc95069629db6e7851de26004e36bcede62a7","observation_id":"1c4de37f-4a8e-4fb6-b592-6c513e39857b","resolution":{"observed_at":"2026-05-20T18:48:53.205927Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dai, Q., Zhang, D., Ma, J","venue":null,"work_id":"e3e12462-b9fb-430d-9f50-1f95dabd17dc","year":2023},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:ce9409b84700b7bbd786459106fc37e0a6b6043d2138be1b00e3cddaf6a8106f","observation_id":"3ae85a1c-19db-497e-9efb-97513e7f2344","resolution":{"observed_at":"2026-05-20T18:48:53.602322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"records/1260860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T14:47:14.558044Z","title":"He, B., Yin, L., Zhen, H.-L., Liu, S., Wu, H., Zhang, X., Yuan, M., and Ma, C","venue":null,"work_id":"e7e9d443-273d-4722-8ec7-59adb893de0e","year":2024},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:07b05d71a4a6638fdf6378f8418828cf0a622b82b259aaac1c49d906d373abd7","observation_id":"c455ffb0-2a5f-4609-b6bc-7788d85bb56a","resolution":{"observed_at":"2026-05-20T18:48:53.240281Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Okapi: Instruction-tuned large language models in multiple languages with reinforce- ment learning from human feedback","venue":null,"work_id":"c84f86c0-88fa-4144-bace-ee99537eab29","year":2023},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:735b6149a4e972a74289d479376b6b110ca3a7976a0d1067d9f864e7ee1480ef","observation_id":"f85ba263-3885-4353-b5e8-de4f107e7682","resolution":{"observed_at":"2026-05-20T18:48:53.598621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15124","last_updated":"2025-04-14T22:39:09Z","snapshot_observed_at":"2026-08-10T16:05:13.426341Z","submitted_at":"2024-11-22T18:44:04Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","version":5},"cited_work":{"arxiv_id":"2411.15124","doi":"10.48550/arxiv.2411.15124","metadata_source":"pith","pith_arxiv_id":"2411.15124","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","venue":"cs.CL","work_id":"28c9dbea-056a-48c2-8000-85f809827e45","year":2024},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/2411.15124","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:13ddd16bddeb36ea6be908319fa6d0161827b103fa8fd578a6d9560622ee8f54","observation_id":"1f64225b-a868-46f8-86ac-eef8fb83d779","resolution":{"observed_at":"2026-05-20T18:48:53.231305Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-23T21:53:00.522112+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T21:53:00.522112+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Roth, D","venue":null,"work_id":"9df78194-293b-46fc-a51d-caf72ef04e70","year":2002},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:7eb1e56b8d370e94dab0f583b88d526130b434b1078bbdd8aec60b9a990e1827","observation_id":"c3ed8b78-557f-4e21-9735-0d3cf5883bbd","resolution":{"observed_at":"2026-05-20T18:48:53.600523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"stable/2975974","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T02:59:26.025874Z","title":"URL http://www.jstor.org/stable/2975974","venue":null,"work_id":"d12e0fa9-009e-41d0-915f-84bc79c7afac","year":1952},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:51b6973409d4821fdbca46b47aadb350625d9cb927266845d883286ae4ce4ebd","observation_id":"9ab3895c-a50b-4df1-b261-75c368867329","resolution":{"observed_at":"2026-05-20T18:48:53.242990Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04531","last_updated":"2025-07-08T14:57:13Z","snapshot_observed_at":"2026-08-07T15:49:06.484872Z","submitted_at":"2025-05-07T16:04:45Z","title":"Overcoming Data Scarcity in Generative Language Modelling for Low-Resource Languages: A Systematic Review","version":2},"cited_work":{"arxiv_id":"2505.04531","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.04531","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Nikolov, N","venue":null,"work_id":"f25ef44f-e38e-411e-aab7-e93afbdebd8a","year":null},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/2505.04531","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:531fde94d76f720b2412bdcf06da7e90911319edc2455eb740c73a0dc894e1f5","observation_id":"8bd0ecb1-20ba-42e4-b17a-0c94d67949f1","resolution":{"observed_at":"2026-05-20T18:48:53.216847Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-task trans- fer matters during instruction-tuning","venue":null,"work_id":"ec491923-20d1-4da7-983b-19584cf0d3c2","year":2024},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:273cb66b14c83c65c1e846be914f1b59cdd26f56a6c4122f0f4c9ceac7f34803","observation_id":"c94b508e-ec66-4845-bacd-41e70eaf6dfa","resolution":{"observed_at":"2026-05-20T18:48:53.594706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"B., and Liang, P","venue":null,"work_id":"94086669-3b69-4711-9088-4cb9e76e2274","year":2019},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:9ff055246379532c47c76d3f83fa9a7c9e08aadd7fc972e97114cfff1936b571","observation_id":"13c97524-9c42-4a54-94e2-a62a9a439fc7","resolution":{"observed_at":"2026-05-20T18:48:53.596665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"cs/0409058","last_updated":"2004-09-29T20:34:04Z","snapshot_observed_at":"2026-07-07T03:06:00.568661Z","submitted_at":"2004-09-29T20:34:04Z","title":"A Sentimental Education: Sentiment Analysis Using Subjectivity Summarization Based on Minimum Cuts","version":1},"cited_work":{"arxiv_id":"cs/0409058","doi":null,"metadata_source":"pith","pith_arxiv_id":"cs/0409058","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A Sentimental Education: Sentiment Analysis Using Subjectivity Summarization Based on Minimum Cuts","venue":"cs.CL","work_id":"080594cf-24d0-44e2-94ba-9180ea8181e8","year":2004},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/cs/0409058","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:939f42db6277d1a951d93fcd6e986df8675b72cea4974d46cb6bbd68475d7edf","observation_id":"ca8775a2-88d4-4509-9c6d-ccffdc9b6c51","resolution":{"observed_at":"2026-05-20T18:48:53.199990Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.15115","doi":"10.1145/3581783.3612503","metadata_source":"pith","pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5 Technical Report","venue":"cs.CL","work_id":"d8432992-4980-4a81-85c7-9fa2c2b87f85","year":2024},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:16f8cb1f9d149ec6ecf1ced9db44c8d5e4b914f381963166a07699cab5f803df","observation_id":"914416a4-0e65-4966-9567-523b771f472e","resolution":{"observed_at":"2026-05-20T18:48:53.228215Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Gurevych, I","venue":null,"work_id":"63f6b786-ac95-4137-8ec8-05280716f671","year":2019},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:78ddb426db00d7765c2bd003f5bcba4d65d15f28b33dfda4db3c7d8795310b79","observation_id":"f95e4dad-c887-4447-8cfb-8e69b0f47a03","resolution":{"observed_at":"2026-05-20T18:48:53.592457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:680320a88605ea7fd98a2aaf75811a5b649cf33d5dc81b3e959bbc25e19889c2","observation_id":"1cc50248-64f6-4ccd-8a1b-0ac422722152","resolution":{"observed_at":"2026-05-20T18:48:53.208505Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01041","last_updated":"2019-07-01T19:48:34Z","snapshot_observed_at":"2026-08-02T06:57:43.679573Z","submitted_at":"2019-07-01T19:48:34Z","title":"Natural Language Understanding with the Quora Question Pairs Dataset","version":1},"cited_work":{"arxiv_id":"1907.01041","doi":null,"metadata_source":"pith","pith_arxiv_id":"1907.01041","snapshot_observed_at":"2026-07-04T15:59:56.631835Z","title":"Natural Language Understanding with the Quora Question Pairs Dataset","venue":"cs.CL","work_id":"ad8b6d5c-eebf-43aa-be24-bea526cc96a9","year":2019},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/1907.01041","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:9c144915457b5f548b5cdfe644745d0336eb7bd0ef0c0e1bc0a8ca3adf76ef19","observation_id":"20f41529-c651-47a7-9cda-fd9dc8be2a50","resolution":{"observed_at":"2026-05-20T18:48:53.197075Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"D., Ng, A","venue":null,"work_id":"b667696e-a5a0-42dc-b785-7f4e013ace7a","year":2013},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:9c88c513194468891aef7951b8839573fb44848b226711788fefd5c75928f704","observation_id":"44bc7e76-0b49-4d19-a49d-90306d920d82","resolution":{"observed_at":"2026-05-20T18:48:53.586058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s12532-020-00179-2","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"author Banjac, G","venue":"Mathematical Programming Computation","work_id":"48ac5695-312b-4bd5-95d6-f41f038922b3","year":2020},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:89905be2ffab1fc985bf315fb43ad2cf29bb8ff52c0c25fc95061406d8116fd6","observation_id":"8d087620-dc1a-4462-88ed-f7fe469f5159","resolution":{"observed_at":"2026-05-20T18:48:52.725358Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-08T15:08:18.222328+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T15:08:18.222328+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":"2503.19786","doi":"10.1007/978-3-540-48085-3_36","metadata_source":"pith","pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 3 Technical Report","venue":"cs.CL","work_id":"f93e08bf-9e96-409b-8ac6-b8385fd17fd7","year":2025},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:1ebb94028c96400cb9096499314937f5e32bc7c7e6a6119c2a5b67a0f11e8ac6","observation_id":"71a29ee8-a5a7-4437-9bab-db93c4955708","resolution":{"observed_at":"2026-05-20T18:48:53.237200Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-07-06T06:34:26.609892Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":"1804.07461","doi":null,"metadata_source":"pith","pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-07-04T09:19:44.134394Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","venue":"cs.CL","work_id":"1bb6fb0c-482d-43cf-94a8-ed18f72a5563","year":2018},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:ffa3299890996b0c6bf0d7d3a520d9167b0f6f22bc88399e45398715447cf459","observation_id":"0dcfbd67-79ba-4b11-bc3c-4dad9bcd7c7c","resolution":{"observed_at":"2026-05-20T18:48:53.249095Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.12471","last_updated":"2019-10-01T18:41:05Z","snapshot_observed_at":"2026-07-06T06:42:15.167440Z","submitted_at":"2018-05-31T13:52:06Z","title":"Neural Network Acceptability Judgments","version":3},"cited_work":{"arxiv_id":"1805.12471","doi":null,"metadata_source":"pith","pith_arxiv_id":"1805.12471","snapshot_observed_at":"2026-07-09T21:16:34.237758Z","title":"Neural Network Ac- ceptability Judgments","venue":"cs.CL","work_id":"ee6536e2-986a-4e85-877b-cd6cf6b9219e","year":2018},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/1805.12471","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:f3b56f9beab32e72538f2f9efe10d806168694ec8d97ded713ba4731b42923d1","observation_id":"0a8f9126-3ffa-4e7f-ab2a-a67307063f6e","resolution":{"observed_at":"2026-05-20T18:48:53.219618Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.05426","last_updated":"2018-02-19T19:19:51Z","snapshot_observed_at":"2026-08-11T00:55:53.228136Z","submitted_at":"2017-04-18T17:10:13Z","title":"A Broad-Coverage Challenge Corpus for Sentence Understanding through Inference","version":4},"cited_work":{"arxiv_id":"1704.05426","doi":"10.18653/v1/n18-1101","metadata_source":"pith","pith_arxiv_id":"1704.05426","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"A Broad-Coverage Challenge Corpus for Sentence Understanding through Inference","venue":"cs.CL","work_id":"9737cdf0-fd48-4485-ab04-c8ec9386e782","year":2017},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/1704.05426","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:3e35fe086334480eb77dc47bef1248ead8cb99ca71e42fb61b5b4382e83fa4c4","observation_id":"9e60c4ff-c7bd-430e-8f98-45e957775454","resolution":{"observed_at":"2026-05-20T18:48:53.222382Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-10T21:38:27.627913+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T21:38:27.627913+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:8f715dd9bc71e342ffabc49eb0ae799eb604fd3f706d62441f299af427f35e8e","observation_id":"30cbd602-0570-4e51-bf21-2b98b61b353d","resolution":{"observed_at":"2026-05-20T18:48:53.225464Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":"2311.07911","doi":"10.48550/arxiv.2311.07911","metadata_source":"pith","pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Instruction-Following Evaluation for Large Language Models","venue":"cs.CL","work_id":"3aa06177-125a-4f5a-8f4a-8070c5986c26","year":2023},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:5b1b0d6003d1fb103663f0c2ec1fe90cd4e82a2dac8b2e4558bdefb643f0ebc6","observation_id":"2e9e1ee7-ac20-47e2-8027-e49dac1b6a10","resolution":{"observed_at":"2026-05-20T18:48:53.233995Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3888cabf-93ed-4e9f-9d03-67480bf63dc8","year":2019},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:8939e88197e623647c5dbb79aeaeb6ac369c5876b7abf7831d5f735342951b55","observation_id":"685a3276-c38a-47ed-b3b0-52a4255ef81d","resolution":{"observed_at":"2026-05-20T18:48:53.579949Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2c81d4f4-ad2a-42dc-86c7-cf6a255b4318","year":2023},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:22630d26fa1410d598ef1cb5155d705a209a9d91c352d35960234debaa0ad2e1","observation_id":"40d04146-8de5-482f-ac66-b704897cca3e","resolution":{"observed_at":"2026-05-20T18:48:53.581883Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"We select the language set in Tab","venue":null,"work_id":"c71df20b-bd2b-4954-a7a1-b39fb2169e2d","year":2025},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:f9d0b25f2eaf483a67d8d2fb5fdc7e5399eb5a9b0ccfb42e03e68cc9006886ba","observation_id":"d227019f-b817-491f-a569-68d425884c5c","resolution":{"observed_at":"2026-05-20T18:48:53.583619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ea8ebf8e-db89-4c4e-ba61-1623c2f7e688","year":2025},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:2670438576c2713ead5a8f1a873371474e81e5f39dfb5162dfff9df5d924d95e","observation_id":"5ee0f0e1-01cb-4ee8-ae2c-1690e6b8ba55","resolution":{"observed_at":"2026-05-20T18:48:53.587937Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Data Valuation Baselines G.1","venue":null,"work_id":"1366f9c4-b1f3-45d8-96d6-31ae0b36a476","year":2016},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:fbd7f06ff59f1aaba9e0f03b09916d349d66b66f6a03169c1e9c0b35bfd41857","observation_id":"34e3573d-6972-4378-a650-c1233cecda01","resolution":{"observed_at":"2026-05-20T18:48:53.578041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ac0d8289-feb8-4713-81ac-451484d666cd","year":2022},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:9aa6897a375e71376645960e40a589c2998a79ab5e0fba5c134255d5023cef6b","observation_id":"af6619e2-e807-4214-a31f-fa9d0ae82650","resolution":{"observed_at":"2026-05-20T18:48:53.576188Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Because Acs has signed entries, each row r is implemented via two auxiliary subsets whose difference realizes the signed measurement","venue":null,"work_id":"202d5e93-61e5-4c01-b303-9058e571d67e","year":2003},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:e99e307249918ad7dcf2ab754d320d04b77e5217b8b737065ccc39de279c9317","observation_id":"9bd3e295-8f8b-4ee2-a124-8cfd2be54ec2","resolution":{"observed_at":"2026-05-20T18:48:53.573976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9646.1245","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b562f7d2-a50f-4f78-bd65-9f4c0b30ada0","year":null},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:e7bb55f48367c68ebbe782c4f616fcf017ccaa0e5b3aa63bf8da62caa9a09050","observation_id":"77eb7ff5-c3b1-497b-bae7-1026dad752da","resolution":{"observed_at":"2026-05-20T18:48:53.213805Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6796.9095","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3, non-uniform softmax weighting leads to lower absolute performance for all methods in this setting","venue":null,"work_id":"9deed4c7-9e0c-497b-bba5-f84396e856b6","year":2018},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:a9c4fec548ab57fc92c81657055aa4d7e91ef86239d8744d3f492cfeac29deaf","observation_id":"6f867b37-d9d9-489c-94cb-8252eac71d3d","resolution":{"observed_at":"2026-05-20T18:48:53.211163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The same valuation scores are used across budgets, and larger budgets move training farther from the local Taylor approximation","venue":null,"work_id":"df1278d6-326f-4a05-92fc-cf17220eb657","year":2019},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:ed273a646ae61e5d6a53e838459b3b033209a96ac060ef65403f9c028911e91a","observation_id":"5906251f-5707-4066-8093-5e3a795498d3","resolution":{"observed_at":"2026-05-20T18:48:53.590470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-02T10:46:05.193093Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":1,"metadata_mismatch":5,"parse_uncertain":0,"unresolved":3,"verified_exact":16,"verified_fuzzy":12},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2605.16704."}