{"as_of":"2026-08-13T18:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7e9740fd5371c87aa39d1361d274251ec077731881bb0ef2ad5be542859e9e78","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:37:09.300569Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.10288/citation-record","integrity":"/paper/2506.10288/integrity","json":"/paper/2506.10288/citation-record.json","paper":"/paper/2506.10288"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.673750Z","title":null,"venue":null,"work_id":"b4f0812c-c442-4590-a5de-08536971b884","year":2024},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.114224Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:5162a4b20cc07a83e6400fc15b8e849b8e4b6d7a581d3b47af4c43cbdec3b0f8","observation_id":"df4e11c0-f54a-49fb-aa27-f92666091e6a","resolution":{"observed_at":"2026-08-07T04:37:11.679134Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.651345Z","title":null,"venue":null,"work_id":"e7ed125a-6d82-4d76-8391-86fa68a41616","year":2002},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.156102Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:0bbbbabc6a61cb0e9fde7c446ca24945fef83abbb9b3a7231ed9192738ef06b6","observation_id":"65479b54-8ceb-4a9c-903b-69f1a1711ae5","resolution":{"observed_at":"2026-08-07T04:37:11.658302Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-13T10:57:21.545059Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-07T04:37:06.226403Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.226403Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:331bb15e7a6660ff50b1dfa9a96c6c4e63866dfb35da54dbad8af724c74283ab","observation_id":"08b7ce6f-70e8-4e2e-a172-63c699e58f94","resolution":{"observed_at":"2026-08-07T04:37:06.226403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.632802Z","title":null,"venue":null,"work_id":"196fbb12-72bd-4905-b73e-3888babb1f63","year":2019},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.296774Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:4802da521ab6f505feb303922b314a64f60cc51dabb5aa06d57c5fcdf96e8c46","observation_id":"faf3c16c-b1e9-4612-8a9e-88f9cc486220","resolution":{"observed_at":"2026-08-07T04:37:11.638741Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:06.384844Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.384844Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:8a76283972a256627c76e44b0f4540f96045e13e51b418f2e7a301b3e34a850a","observation_id":"961c0bfe-c3a1-4baa-a6d3-db5ee2918cc9","resolution":{"observed_at":"2026-08-07T04:37:06.384844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T04:37:06.449634Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.449634Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:02f31d9390533f281efbfd4fe6a054de9be61ad302964688e81fbecda5bdd2e4","observation_id":"a2e129c0-9dca-4513-a456-bf220e3b9162","resolution":{"observed_at":"2026-08-07T04:37:06.449634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.602645Z","title":null,"venue":null,"work_id":"186bfe3a-2afe-43e5-a1e8-b61302ddb7be","year":2024},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.496014Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:6be8c765ab10d47aa34215bcb8f221baa506112b1589735bdc7dd3389cc447e9","observation_id":"b1a7c554-93ad-46dd-a667-a84d1fef4b9c","resolution":{"observed_at":"2026-08-07T04:37:11.607715Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:06.562807Z","title":"Gonzalez, Ion Stoica, and Eric P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.562807Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:4556f7b4f643d7e0fbe9d76db4c91bde2a6bac1579196ed23c7f66aec132d37d","observation_id":"a89fac9d-dc25-45ab-aef6-60aa283567a1","resolution":{"observed_at":"2026-08-07T04:37:06.562807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.568458Z","title":null,"venue":null,"work_id":"bcdcde7b-bafa-45ca-98c6-d62939e8bac0","year":2020},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.631406Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:4e7d2d897adcd6c9fb767c5ae29c0703af9643ace2de9ad7a2878eb7880abfea","observation_id":"9fc0fb34-09be-4bc4-980b-726a8abb8aa8","resolution":{"observed_at":"2026-08-07T04:37:11.573590Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T04:37:06.690020Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.690020Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:83bed8af42a94662401bbb92e78ad679df84de6a821b0a3a899e0e0d5e1c2e8a","observation_id":"6301be37-9f1d-4ec7-afb9-4658ad9faf78","resolution":{"observed_at":"2026-08-07T04:37:06.690020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.550193Z","title":null,"venue":null,"work_id":"8fb24a20-7e75-4238-addb-51355babf14e","year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.773060Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:efb735e8f7924d008b37d8c2f86995f331a5d1a80ae4165972e6eb154618fa9b","observation_id":"8145d598-946e-44d3-9202-e8dc8511f45a","resolution":{"observed_at":"2026-08-07T04:37:11.555948Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.530317Z","title":null,"venue":null,"work_id":"eabbe9d1-092a-4b63-ad8e-b45da08b6085","year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.810078Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:7ca6c44a791c7ca60d0d6827836a858ac18ac87dc075b706099f42c1ad647661","observation_id":"18b72c50-c6f0-4f17-bfb1-567e97f20db5","resolution":{"observed_at":"2026-08-07T04:37:11.535903Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.511559Z","title":null,"venue":null,"work_id":"651d17e0-0118-4194-ab82-85adf2c7ca23","year":2024},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.868618Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:92932e39b2e821a7902b6cb587408d6aceb44f7dd9af7c9d1322f0e783e6e1d9","observation_id":"dc6c4c28-6c3f-4f03-a758-639dbf999698","resolution":{"observed_at":"2026-08-07T04:37:11.516676Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.489551Z","title":null,"venue":null,"work_id":"6748e796-ba08-4e80-9d30-011b750021af","year":2024},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.975047Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:94208e66dd447a5613d9df508d06cf0d36de2c8a3a3aecca2ff62ccc1a7a1631","observation_id":"61172610-e31a-4b7b-aab5-7a6241e65146","resolution":{"observed_at":"2026-08-07T04:37:11.498492Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08114","last_updated":"2023-03-14T17:47:25Z","snapshot_observed_at":"2026-08-13T18:36:32.335569Z","submitted_at":"2023-03-14T17:47:25Z","title":"Simfluence: Modeling the Influence of Individual Training Examples by Simulating Training Runs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08114","snapshot_observed_at":"2026-08-07T04:37:07.062387Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.062387Z"},"links":{"cited_paper":"/paper/2303.08114","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:1e26ed000dfd4c5b0b48a34fc005573809abb81b9bf19a2bc7ae6ced0ad50d6e","observation_id":"97adf9dc-8b66-410b-abf6-5114cd7a7516","resolution":{"observed_at":"2026-08-07T04:37:07.062387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.459912Z","title":null,"venue":null,"work_id":"c00cc172-068e-41bc-8ded-d12137591c06","year":1974},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.141095Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:d34f847e3fe16da8b528c3c9a3322b65c8ac64caf09ae48ceaf25362e1131dd8","observation_id":"81fefc11-8a33-4f76-a77d-0b8ef9fb22de","resolution":{"observed_at":"2026-08-07T04:37:11.466211Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.394830Z","title":null,"venue":null,"work_id":"bf879bb4-ad6f-4c99-868e-dc2eab69cbd6","year":1979},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.192199Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:079fbda6c95724e98e53513e96a3951c2e63bdab88a898ebbdcf596421f2c562","observation_id":"9f3a3e30-0521-4b0a-bef9-5f7ae90b7618","resolution":{"observed_at":"2026-08-07T04:37:11.406443Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15846","last_updated":"2024-06-18T13:16:36Z","snapshot_observed_at":"2026-08-13T00:23:04.360515Z","submitted_at":"2024-04-24T12:51:14Z","title":"From Complex to Simple: Enhancing Multi-Constraint Complex Instruction Following Ability of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15846","snapshot_observed_at":"2026-08-07T04:37:07.323094Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.323094Z"},"links":{"cited_paper":"/paper/2404.15846","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:a7b30f747f9a13f2f284be00c4995a0c87c50601b259ca5acb49f0aabfd50321","observation_id":"32cdd0de-2abb-4cbb-a09d-f93446123463","resolution":{"observed_at":"2026-08-07T04:37:07.323094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:07.376714Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.376714Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:d06136b03fe49eb729d9dd97a080e4448fc439779bc563d1754739a84e60a70c","observation_id":"bd565edd-119c-4ec2-88bd-53458e1dc298","resolution":{"observed_at":"2026-08-07T04:37:07.376714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.339297Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen - Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":"5a6531aa-1a4d-400d-a256-4377e431a10d","year":2022},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.487073Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:a9bada602dac340ecce7ac32785fce6aec088b23460597075dab10aa5aaa2c5d","observation_id":"6b9ba8ba-a775-4d65-885c-631b47816d17","resolution":{"observed_at":"2026-08-07T04:37:11.349444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.00622","last_updated":"2022-02-01T18:15:24Z","snapshot_observed_at":"2026-08-13T16:48:58.882699Z","submitted_at":"2022-02-01T18:15:24Z","title":"Datamodels: Predicting Predictions from Training Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.00622","snapshot_observed_at":"2026-08-07T04:37:07.529636Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.529636Z"},"links":{"cited_paper":"/paper/2202.00622","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:17a858575bc9f72f4c6fd981588fdb7544d53b7935a3789f21f2311dfa29d951","observation_id":"6415c1dd-76b9-4ad8-bea5-b82eb2c27afd","resolution":{"observed_at":"2026-08-07T04:37:07.529636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.304560Z","title":"o pf, Yannic Kilcher, Dimitri von R \\","venue":null,"work_id":"2a1c381a-ad0a-4212-ac7d-4a8f90c1af2d","year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.599652Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:a18718f1981ffb0db4a2a7f2a3dc5a3c1eaca55acc369810d6bc84e982022f32","observation_id":"e5906dc7-45d6-43fb-ab4b-2506d7ebabfc","resolution":{"observed_at":"2026-08-07T04:37:11.317634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.281647Z","title":null,"venue":null,"work_id":"6d0fe9fc-8f6b-46b6-ba06-b2f8b5113a48","year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.703498Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:fd45a086e12c45c16253052c96534272fdcae5790ab10171dd5b612f236b03e1","observation_id":"7a1e9d28-07a2-4c1d-9544-5bba26a38e4d","resolution":{"observed_at":"2026-08-07T04:37:11.287636Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07840","last_updated":"2024-10-03T17:56:12Z","snapshot_observed_at":"2026-08-13T00:32:34.904780Z","submitted_at":"2024-04-11T15:27:56Z","title":"On Training Data Influence of GPT Models","version":3},"cited_work":{"arxiv_id":"2404.07840","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.07840","snapshot_observed_at":"2026-08-07T04:37:09.595224Z","title":"On Training Data Influence of GPT Models","venue":"cs.CL","work_id":"e5b7be6c-0c67-4c4b-a7ce-ba6142013241","year":2024},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.755069Z"},"links":{"cited_paper":"/paper/2404.07840","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:db93a2719d5631f148c7ad12662daf0e0a79c9f65bf516603a6cb8ce6fd9847e","observation_id":"c11286b3-e458-449a-8a2d-2bc6af9b4751","resolution":{"observed_at":"2026-08-07T04:37:09.688569Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.260780Z","title":"Le, Barret Zoph, Jason Wei, and Adam Roberts","venue":null,"work_id":"5e711bc2-d687-4746-bf9b-7c2840a05e71","year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.855541Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:5fa6c5f01497992f2e6230fdefd3ecc0b6da7ee9353231c3369c6bf91a73c9ce","observation_id":"8dced5ae-3f04-4745-8079-98d3d6bcee12","resolution":{"observed_at":"2026-08-07T04:37:11.266370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00533","last_updated":"2024-02-01T06:10:00Z","snapshot_observed_at":"2026-08-13T14:48:06.714027Z","submitted_at":"2023-10-01T00:52:24Z","title":"SELF: Self-Evolution with Language Feedback","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00533","snapshot_observed_at":"2026-08-07T04:37:07.906797Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.906797Z"},"links":{"cited_paper":"/paper/2310.00533","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:9fb63b16d4cd4e8cad196c60c8be07149e60c017c2f77fdc10016d56763eb625","observation_id":"6395f6dc-145c-40b2-95f7-9a8944569be9","resolution":{"observed_at":"2026-08-07T04:37:07.906797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07074","last_updated":"2023-08-15T07:37:32Z","snapshot_observed_at":"2026-08-13T17:50:20.399423Z","submitted_at":"2023-08-14T11:16:28Z","title":"#InsTag: Instruction Tagging for Analyzing Supervised Fine-tuning of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07074","snapshot_observed_at":"2026-08-07T04:37:08.020597Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.020597Z"},"links":{"cited_paper":"/paper/2308.07074","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:f8bd46dce67ea04ca4ca9cf78ede0cdc57f692c6a69c00129ec2cff9de094da8","observation_id":"115596c1-3ea2-4d5d-96d6-837772734955","resolution":{"observed_at":"2026-08-07T04:37:08.020597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.113174Z","title":null,"venue":null,"work_id":"8c323234-39de-4ae2-9673-609a62f4cf2a","year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.078684Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:e082f467cef2ec6b1fb60ed987486f5f54a3eaf9ecc91b6c0f44691aa07dba0a","observation_id":"b760bc22-39c7-4e5b-bad8-cf7955d9388f","resolution":{"observed_at":"2026-08-07T04:37:11.189192Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03277","last_updated":"2023-04-06T17:58:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-06T17:58:09Z","title":"Instruction Tuning with GPT-4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03277","snapshot_observed_at":"2026-08-07T04:37:08.187154Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.187154Z"},"links":{"cited_paper":"/paper/2304.03277","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:7c41b4d6bfad16c0a1daf339f17fe1c4353ebc4413bfd853083b53073349a309","observation_id":"13d1dec7-047b-4c64-95a9-eabb9a96c322","resolution":{"observed_at":"2026-08-07T04:37:08.187154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:10.922871Z","title":null,"venue":null,"work_id":"7eb88e28-be1c-40a8-96ae-dbc7735b2d8d","year":2020},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.248011Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:8e448c4f34c9295dad282caca2efdef8935a3cf0e8720e24691ed3637c152d71","observation_id":"4088cd49-ed96-4063-b688-d79961be1da6","resolution":{"observed_at":"2026-08-07T04:37:11.004836Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:08.337330Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.337330Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:1a5162fb4b70af16a59da2bfc22d0706b6451fe622260dc5331a6fd2df3abc1b","observation_id":"c32394f1-12aa-4ba0-9872-df76d5da4b11","resolution":{"observed_at":"2026-08-07T04:37:08.337330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:08.412798Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.412798Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:cc223edb893d47fd3e41a52c4feb7a982a029ceebb3fee0eac19354e1a3a485d","observation_id":"b6929635-699e-4b7c-af54-a8b38eabee1f","resolution":{"observed_at":"2026-08-07T04:37:08.412798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T04:37:08.515317Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.515317Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:4d8ab1e1bd499e5cb4f9bcae6036c36aeb931cecf8e94b27a085f1d41e6a1691","observation_id":"ba0461d1-4765-4569-a1f2-cad05ab07a62","resolution":{"observed_at":"2026-08-07T04:37:08.515317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09168","last_updated":"2023-10-24T06:55:17Z","snapshot_observed_at":"2026-08-13T05:49:46.787895Z","submitted_at":"2023-10-13T15:03:15Z","title":"Explore-Instruct: Enhancing Domain-Specific Instruction Coverage through Active Exploration","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09168","snapshot_observed_at":"2026-08-07T04:37:08.594090Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.594090Z"},"links":{"cited_paper":"/paper/2310.09168","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:6147cfe2aa2344d447622d20c609a12a334f6c45b4efb9ab07fc62c780323865","observation_id":"65486530-44bb-4534-95d2-cd0e4126eb44","resolution":{"observed_at":"2026-08-07T04:37:08.594090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:10.667408Z","title":null,"venue":null,"work_id":"9d9ea3e4-a8f7-4271-b3b0-eb993616fd2c","year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.664828Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:b3f0daa324ba9461a7745c124b78e8c7a271f20138571148695c0134a2c0ac64","observation_id":"96f2f03d-25f6-40a3-9e9d-1ad87ac402ea","resolution":{"observed_at":"2026-08-07T04:37:10.753964Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01700","last_updated":"2024-08-02T03:56:35Z","snapshot_observed_at":"2026-08-13T05:10:38.748868Z","submitted_at":"2023-12-04T07:42:16Z","title":"Data Management For Training Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.01700","snapshot_observed_at":"2026-08-07T04:37:08.755456Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.755456Z"},"links":{"cited_paper":"/paper/2312.01700","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:d11cd1d94130c516e733ef18f037d74697e70e38e01531bcdb70548d19f1fb9a","observation_id":"6849e10f-3a3d-43ad-8d27-7245f7a51d00","resolution":{"observed_at":"2026-08-07T04:37:08.755456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:10.410554Z","title":null,"venue":null,"work_id":"70441ee0-bcc4-4260-be1e-1006ba53b4ce","year":2025},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.808699Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:59af843eb171fbe48c5816f2b876277b7084c50035ddfd52da010b7bc4184e85","observation_id":"098a270b-3ebc-4751-be17-280bfc283018","resolution":{"observed_at":"2026-08-07T04:37:10.547483Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:10.192571Z","title":null,"venue":null,"work_id":"4b0b08fb-cebc-4d03-84ef-5c9e53406320","year":2024},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.900684Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:96187080162d76bda96a8e2e3cceaeee0c59aa066d4ea3763b86fb09209ac3ce","observation_id":"9c8a63a5-3bee-41b9-9141-fd0f41d2f540","resolution":{"observed_at":"2026-08-07T04:37:10.298488Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05696","last_updated":"2024-02-29T03:04:22Z","snapshot_observed_at":"2026-08-13T15:18:42.160030Z","submitted_at":"2023-08-10T16:58:51Z","title":"A Preliminary Study of the Intrinsic Relationship between Complexity and Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05696","snapshot_observed_at":"2026-08-07T04:37:08.992402Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.992402Z"},"links":{"cited_paper":"/paper/2308.05696","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:a1200ab202ca497b8842bee69ad1dcb44c05efb9756be5c741d9db0c04438970","observation_id":"f1ad3954-a342-46fb-b99a-ceb6310123be","resolution":{"observed_at":"2026-08-07T04:37:08.992402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:09.959439Z","title":null,"venue":null,"work_id":"4ff021c0-a0bf-4d6b-b48f-7e839d9d2d65","year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:09.095070Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:843a28f09b230e3b184e721665b92aa647978d605eccc0ad7213186afe574d24","observation_id":"539e672a-9b12-40a4-8325-f7cabb12433a","resolution":{"observed_at":"2026-08-07T04:37:10.053475Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:09.201199Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:09.201199Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:c1cbab530a2ce7777c3bf98658a4dee822d8f3c3444185b3345c5cfcc037c023","observation_id":"b25c08a3-5188-4db1-b47b-fa9dd2a105ba","resolution":{"observed_at":"2026-08-07T04:37:09.201199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:09.300569Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:09.300569Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:99c50e4ed5a4bd2697810740b21aeedf3860562d81ff01e679e5f6b727109eab","observation_id":"81d477b1-84c1-404e-be90-6596cf6c66e3","resolution":{"observed_at":"2026-08-07T04:37:09.300569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T02:52:09.932045Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":1,"verified_fuzzy":3},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2506.10288."}