{"as_of":"2026-08-12T15:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:45bf570e2e62f1df0f2e797bb1d589a5a45037fec0c5a7e6c259677430ae0d74","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T16:33:10.502177Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-23T01:03:26.037233Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-23T01:05:16.527345Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.09990","last_updated":"2024-12-13T09:23:58Z","snapshot_observed_at":"2026-08-11T16:26:06.667667Z","submitted_at":"2024-12-13T09:23:58Z","title":"Small Language Model as Data Prospector for Large Language Model","version":1},"cited_work":{"arxiv_id":"2412.09990","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09990","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Small language model as data prospector for large language model","venue":null,"work_id":"79383629-4611-45ec-a0a1-0e6dc9a8822c","year":2024},"citing_paper":{"arxiv_id":"2503.08223","last_updated":"2026-04-09T15:28:27Z","snapshot_observed_at":"2026-07-06T20:50:33.513259Z","submitted_at":"2025-03-11T09:41:29Z","title":"Will LLMs Scaling Hit the Wall? Breaking Barriers via Distributed Resources on Massive Edge Devices","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-23T01:03:26.037233Z"},"links":{"cited_paper":"/paper/2412.09990","citing_paper":"/paper/2503.08223"},"observation_digest":"sha256:0dfdebf44f8bbb61b696065d61a8d375c5733ad47b64b813eca1d39d0df503a0","observation_id":"ccdda23a-90e3-4cc8-ba52-d2b53fc1f73d","resolution":{"observed_at":"2026-05-23T01:05:16.529736Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.09990/citation-record","integrity":"/paper/2412.09990/integrity","json":"/paper/2412.09990/citation-record.json","paper":"/paper/2412.09990"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-11T16:33:10.419660Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09990","last_updated":"2024-12-13T09:23:58Z","snapshot_observed_at":"2026-08-11T16:26:06.667667Z","submitted_at":"2024-12-13T09:23:58Z","title":"Small Language Model as Data Prospector for Large Language Model","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T16:33:10.419660Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2412.09990"},"observation_digest":"sha256:087b96eb7b63dedc0cb68f96f7e8b0ca001a220e892fcd1e9f4223ffed8d8428","observation_id":"e1022d41-beaa-4678-9a5a-b45b3f5d2ae6","resolution":{"observed_at":"2026-08-11T16:33:10.419660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18058","last_updated":"2024-11-02T11:08:49Z","snapshot_observed_at":"2026-08-12T05:26:08.658219Z","submitted_at":"2024-03-26T19:24:18Z","title":"COIG-CQIA: Quality is All You Need for Chinese Instruction Fine-tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18058","snapshot_observed_at":"2026-08-11T16:33:10.425160Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09990","last_updated":"2024-12-13T09:23:58Z","snapshot_observed_at":"2026-08-11T16:26:06.667667Z","submitted_at":"2024-12-13T09:23:58Z","title":"Small Language Model as Data Prospector for Large Language Model","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T16:33:10.425160Z"},"links":{"cited_paper":"/paper/2403.18058","citing_paper":"/paper/2412.09990"},"observation_digest":"sha256:05c8877281a1a828e0b57c2c78a1f218ce1063f85cd5e13df115f6028a0cdf56","observation_id":"30cf924f-98f6-467b-a5ff-a8233da790d3","resolution":{"observed_at":"2026-08-11T16:33:10.425160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-10T18:54:23.520792Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-11T16:33:10.430133Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09990","last_updated":"2024-12-13T09:23:58Z","snapshot_observed_at":"2026-08-11T16:26:06.667667Z","submitted_at":"2024-12-13T09:23:58Z","title":"Small Language Model as Data Prospector for Large Language Model","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T16:33:10.430133Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2412.09990"},"observation_digest":"sha256:f5e09d08c71be21f4fb232bd6d288a21a80eb58d4a1ebba77b450f40e851c798","observation_id":"4a31ad4a-7136-45e8-8b5c-14b1d658da55","resolution":{"observed_at":"2026-08-11T16:33:10.430133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:10.798202Z","title":null,"venue":null,"work_id":"6761002d-850a-4b54-80f0-8d5c2be61aa4","year":2024},"citing_paper":{"arxiv_id":"2412.09990","last_updated":"2024-12-13T09:23:58Z","snapshot_observed_at":"2026-08-11T16:26:06.667667Z","submitted_at":"2024-12-13T09:23:58Z","title":"Small Language Model as Data Prospector for Large Language Model","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T16:33:10.435486Z"},"links":{"citing_paper":"/paper/2412.09990"},"observation_digest":"sha256:70e2d9d926db030a6a65747f6d466d7c392fb58c9c28fc2df1c7c3f4022a288d","observation_id":"1c82ed51-a496-4f82-a8e8-828c50636227","resolution":{"observed_at":"2026-08-11T16:33:10.802930Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11416","last_updated":"2022-12-06T21:39:48Z","snapshot_observed_at":"2026-07-06T14:08:18.855958Z","submitted_at":"2022-10-20T16:58:32Z","title":"Scaling Instruction-Finetuned Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11416","snapshot_observed_at":"2026-08-11T16:33:10.440064Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09990","last_updated":"2024-12-13T09:23:58Z","snapshot_observed_at":"2026-08-11T16:26:06.667667Z","submitted_at":"2024-12-13T09:23:58Z","title":"Small Language Model as Data Prospector for Large Language Model","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T16:33:10.440064Z"},"links":{"cited_paper":"/paper/2210.11416","citing_paper":"/paper/2412.09990"},"observation_digest":"sha256:bd722281814d88ec8f67781b929bbd1984875000ec9d26343ef866be74da24c9","observation_id":"ae95652c-81bf-4f9f-a2cb-2022723abd26","resolution":{"observed_at":"2026-08-11T16:33:10.440064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10559","last_updated":"2023-05-15T11:45:12Z","snapshot_observed_at":"2026-08-09T08:03:27.441735Z","submitted_at":"2022-12-20T18:58:48Z","title":"Why Can GPT Learn In-Context? Language Models Implicitly Perform Gradient Descent as Meta-Optimizers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10559","snapshot_observed_at":"2026-08-11T16:33:10.445070Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09990","last_updated":"2024-12-13T09:23:58Z","snapshot_observed_at":"2026-08-11T16:26:06.667667Z","submitted_at":"2024-12-13T09:23:58Z","title":"Small Language Model as Data Prospector for Large Language Model","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T16:33:10.445070Z"},"links":{"cited_paper":"/paper/2212.10559","citing_paper":"/paper/2412.09990"},"observation_digest":"sha256:f31c102c796678694c132fa8d140c00082890b8ffc2c6766faf6ebb85c523827","observation_id":"372eb0b4-0541-4972-a825-6f81ed2cc410","resolution":{"observed_at":"2026-08-11T16:33:10.445070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-11T16:33:10.450379Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09990","last_updated":"2024-12-13T09:23:58Z","snapshot_observed_at":"2026-08-11T16:26:06.667667Z","submitted_at":"2024-12-13T09:23:58Z","title":"Small Language Model as Data Prospector for Large Language Model","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T16:33:10.450379Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2412.09990"},"observation_digest":"sha256:86a9c1557f30dab73da7147e3e29e049b0c448610c938a9c4e278f16c8ff7366","observation_id":"4d87c0c2-8c69-4dd3-9cd8-25ecea6af80d","resolution":{"observed_at":"2026-08-11T16:33:10.450379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14742","last_updated":"2023-03-26T14:49:37Z","snapshot_observed_at":"2026-08-10T23:26:46.121459Z","submitted_at":"2023-03-26T14:49:37Z","title":"Exploring the Impact of Instruction Data Scaling on Large Language Models: An Empirical Study on Real-World Use Cases","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14742","snapshot_observed_at":"2026-08-11T16:33:10.455171Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09990","last_updated":"2024-12-13T09:23:58Z","snapshot_observed_at":"2026-08-11T16:26:06.667667Z","submitted_at":"2024-12-13T09:23:58Z","title":"Small Language Model as Data Prospector for Large Language Model","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T16:33:10.455171Z"},"links":{"cited_paper":"/paper/2303.14742","citing_paper":"/paper/2412.09990"},"observation_digest":"sha256:89b7ce0272d2a534a6d53d34ecb217a1b1ff60716a9497f88966bd7d7a0ee052","observation_id":"0e65850f-50da-44d9-8bcf-c04404a94663","resolution":{"observed_at":"2026-08-11T16:33:10.455171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.04387","last_updated":"2023-06-08T13:44:24Z","snapshot_observed_at":"2026-08-12T09:36:48.705293Z","submitted_at":"2023-06-07T12:35:37Z","title":"M$^3$IT: A Large-Scale Dataset towards Multi-Modal Multilingual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.04387","snapshot_observed_at":"2026-08-11T16:33:10.459872Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09990","last_updated":"2024-12-13T09:23:58Z","snapshot_observed_at":"2026-08-11T16:26:06.667667Z","submitted_at":"2024-12-13T09:23:58Z","title":"Small Language Model as Data Prospector for Large Language Model","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T16:33:10.459872Z"},"links":{"cited_paper":"/paper/2306.04387","citing_paper":"/paper/2412.09990"},"observation_digest":"sha256:9f96c5d6911c754f0d96e75f286f33943299dac50e5b7942018a6762677c1639","observation_id":"bf7444fb-3f1a-43e5-aceb-aac927384bea","resolution":{"observed_at":"2026-08-11T16:33:10.459872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:10.464326Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09990","last_updated":"2024-12-13T09:23:58Z","snapshot_observed_at":"2026-08-11T16:26:06.667667Z","submitted_at":"2024-12-13T09:23:58Z","title":"Small Language Model as Data Prospector for Large Language Model","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T16:33:10.464326Z"},"links":{"citing_paper":"/paper/2412.09990"},"observation_digest":"sha256:34194bcba85e61d94936096dbc79d28194f1803aeb3a1e65d98855b0bb6760c0","observation_id":"88ddba79-5a3c-4c24-861a-3aa4551ea2d6","resolution":{"observed_at":"2026-08-11T16:33:10.464326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10302","last_updated":"2024-06-03T13:46:16Z","snapshot_observed_at":"2026-08-05T20:16:00.044977Z","submitted_at":"2023-12-16T03:33:12Z","title":"One-Shot Learning as Instruction Data Prospector for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10302","snapshot_observed_at":"2026-08-11T16:33:10.468628Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09990","last_updated":"2024-12-13T09:23:58Z","snapshot_observed_at":"2026-08-11T16:26:06.667667Z","submitted_at":"2024-12-13T09:23:58Z","title":"Small Language Model as Data Prospector for Large Language Model","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T16:33:10.468628Z"},"links":{"cited_paper":"/paper/2312.10302","citing_paper":"/paper/2412.09990"},"observation_digest":"sha256:b28d1e22ec0d9c354469bc916daf42734d10e5ac2792007526415bfe21a354c4","observation_id":"a74213f2-4c1e-49db-85d1-f24027926658","resolution":{"observed_at":"2026-08-11T16:33:10.468628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T16:33:10.473237Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09990","last_updated":"2024-12-13T09:23:58Z","snapshot_observed_at":"2026-08-11T16:26:06.667667Z","submitted_at":"2024-12-13T09:23:58Z","title":"Small Language Model as Data Prospector for Large Language Model","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T16:33:10.473237Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.09990"},"observation_digest":"sha256:4ae8cad7f59a4d44823cfca3a2ff23de3261b4afc421d9d5b69ef3857e473993","observation_id":"d7d1c42a-40ac-4c76-8cea-a155904ec5c9","resolution":{"observed_at":"2026-08-11T16:33:10.473237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.04751","last_updated":"2023-10-30T20:36:20Z","snapshot_observed_at":"2026-08-12T07:43:19.105776Z","submitted_at":"2023-06-07T19:59:23Z","title":"How Far Can Camels Go? Exploring the State of Instruction Tuning on Open Resources","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.04751","snapshot_observed_at":"2026-08-11T16:33:10.477351Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09990","last_updated":"2024-12-13T09:23:58Z","snapshot_observed_at":"2026-08-11T16:26:06.667667Z","submitted_at":"2024-12-13T09:23:58Z","title":"Small Language Model as Data Prospector for Large Language Model","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T16:33:10.477351Z"},"links":{"cited_paper":"/paper/2306.04751","citing_paper":"/paper/2412.09990"},"observation_digest":"sha256:e50c7ef0f4c8394b0ac243929112118821789dea491da48f0fc43feb2b15be05","observation_id":"08ff23b2-a104-42fd-873b-e155250f089a","resolution":{"observed_at":"2026-08-11T16:33:10.477351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10560","last_updated":"2023-05-25T23:50:07Z","snapshot_observed_at":"2026-07-06T14:33:11.945106Z","submitted_at":"2022-12-20T18:59:19Z","title":"Self-Instruct: Aligning Language Models with Self-Generated Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10560","snapshot_observed_at":"2026-08-11T16:33:10.481306Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09990","last_updated":"2024-12-13T09:23:58Z","snapshot_observed_at":"2026-08-11T16:26:06.667667Z","submitted_at":"2024-12-13T09:23:58Z","title":"Small Language Model as Data Prospector for Large Language Model","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T16:33:10.481306Z"},"links":{"cited_paper":"/paper/2212.10560","citing_paper":"/paper/2412.09990"},"observation_digest":"sha256:e5cb91f697fe3666accec2f73963fb5b371542ff9179d74aa41d34c813ce1252","observation_id":"60808d7a-8a8b-4ab3-a1e8-ff1df1d03c4f","resolution":{"observed_at":"2026-08-11T16:33:10.481306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:10.773079Z","title":null,"venue":null,"work_id":"511c319f-10ba-4b18-b1db-5f21f929e58d","year":2022},"citing_paper":{"arxiv_id":"2412.09990","last_updated":"2024-12-13T09:23:58Z","snapshot_observed_at":"2026-08-11T16:26:06.667667Z","submitted_at":"2024-12-13T09:23:58Z","title":"Small Language Model as Data Prospector for Large Language Model","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T16:33:10.485389Z"},"links":{"citing_paper":"/paper/2412.09990"},"observation_digest":"sha256:93877644f09ec9b6e4feafbe4bd5e5283aa4ee1e78f91d5972b2ae6921db4ab6","observation_id":"d7fd0e2b-d464-4121-bb39-b64c89e2f3ff","resolution":{"observed_at":"2026-08-11T16:33:10.778711Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01196","last_updated":"2023-12-02T21:05:22Z","snapshot_observed_at":"2026-08-08T20:31:50.928074Z","submitted_at":"2023-04-03T17:59:09Z","title":"Baize: An Open-Source Chat Model with Parameter-Efficient Tuning on Self-Chat Data","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.01196","snapshot_observed_at":"2026-08-11T16:33:10.489111Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09990","last_updated":"2024-12-13T09:23:58Z","snapshot_observed_at":"2026-08-11T16:26:06.667667Z","submitted_at":"2024-12-13T09:23:58Z","title":"Small Language Model as Data Prospector for Large Language Model","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T16:33:10.489111Z"},"links":{"cited_paper":"/paper/2304.01196","citing_paper":"/paper/2412.09990"},"observation_digest":"sha256:b82cf05154ec5063e61f8752366cd8f237d8d141b334e1b985adb71bd335d3a0","observation_id":"ed9cf9c0-a0b9-4a09-b52d-3908cd101443","resolution":{"observed_at":"2026-08-11T16:33:10.489111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11206","last_updated":"2023-05-18T17:45:22Z","snapshot_observed_at":"2026-08-08T19:18:06.171048Z","submitted_at":"2023-05-18T17:45:22Z","title":"LIMA: Less Is More for Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11206","snapshot_observed_at":"2026-08-11T16:33:10.493125Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09990","last_updated":"2024-12-13T09:23:58Z","snapshot_observed_at":"2026-08-11T16:26:06.667667Z","submitted_at":"2024-12-13T09:23:58Z","title":"Small Language Model as Data Prospector for Large Language Model","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T16:33:10.493125Z"},"links":{"cited_paper":"/paper/2305.11206","citing_paper":"/paper/2412.09990"},"observation_digest":"sha256:5bc8d8c7931a6f0b4272d87dee568989be34456ac86fd0d52c0fa7d0899046a9","observation_id":"3326f2e4-3031-4a5d-a011-cd7b9ee69340","resolution":{"observed_at":"2026-08-11T16:33:10.493125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:10.497512Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09990","last_updated":"2024-12-13T09:23:58Z","snapshot_observed_at":"2026-08-11T16:26:06.667667Z","submitted_at":"2024-12-13T09:23:58Z","title":"Small Language Model as Data Prospector for Large Language Model","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T16:33:10.497512Z"},"links":{"citing_paper":"/paper/2412.09990"},"observation_digest":"sha256:cbc858db03fd1c295d1decdc3a0c133efef8d242be2a63a1998b50a906cbbffe","observation_id":"817bd649-a8e5-4347-9d74-12a800037960","resolution":{"observed_at":"2026-08-11T16:33:10.497512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:33:10.502177Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09990","last_updated":"2024-12-13T09:23:58Z","snapshot_observed_at":"2026-08-11T16:26:06.667667Z","submitted_at":"2024-12-13T09:23:58Z","title":"Small Language Model as Data Prospector for Large Language Model","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T16:33:10.502177Z"},"links":{"citing_paper":"/paper/2412.09990"},"observation_digest":"sha256:21ba0dffb2c7940c88b19dc303f9f7b820ff253d7a1a736f9af06ee1c66b28fe","observation_id":"933b90b6-ed8b-41d4-9cc3-08fbee6d50c7","resolution":{"observed_at":"2026-08-11T16:33:10.502177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.09990","last_updated":"2024-12-13T09:23:58Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T16:26:06.667667Z","submitted_at":"2024-12-13T09:23:58Z","title":"Small Language Model as Data Prospector for Large Language Model"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 1 inbound Pith citation observation for arXiv:2412.09990."}