{"as_of":"2026-08-21T17:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2435ec3d13ad0c12fc4d20b91509b3aeaf2c508c300f9710f6edc2ba8f5bb840","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T22:17:42.790137Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T15:43:12.690861Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T12:52:47.936710Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03679","snapshot_observed_at":"2026-08-05T15:43:12.690861Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19570","last_updated":"2025-08-27T05:04:07Z","snapshot_observed_at":"2026-08-09T05:32:43.331268Z","submitted_at":"2025-08-27T05:04:07Z","title":"Generative Models for Synthetic Data: Transforming Data Mining in the GenAI Era","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T15:43:12.690861Z"},"links":{"cited_paper":"/paper/2412.03679","citing_paper":"/paper/2508.19570"},"observation_digest":"sha256:e5a8117711ac0273ba9c9a2088b5a42037bf7f9914da819e1bd761aeac44c05a","observation_id":"b1dbf21a-397a-47f7-9126-0a21164927d5","resolution":{"observed_at":"2026-08-05T15:43:12.690861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"cited_work":{"arxiv_id":"2412.03679","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.03679","snapshot_observed_at":"2026-08-05T12:52:47.936710Z","title":"Evaluating Language Models as Synthetic Data Generators","venue":"cs.CL","work_id":"3c9eb0f7-d7fa-431a-a2af-686ff5f755ed","year":2024},"citing_paper":{"arxiv_id":"2509.01185","last_updated":"2025-09-04T17:22:16Z","snapshot_observed_at":"2026-08-16T01:45:49.060264Z","submitted_at":"2025-09-01T07:08:45Z","title":"Modular Techniques for Synthetic Long-Context Data Generation in Language Model Training and Evaluation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T12:52:47.635433Z"},"links":{"cited_paper":"/paper/2412.03679","citing_paper":"/paper/2509.01185"},"observation_digest":"sha256:53a3b7a4f4f19ff6218cbd5cedcb6eb9718afb3e103a77702a8f3dfe0cc547b7","observation_id":"f8e4fb39-e225-44b3-bf99-d4e8c0d65e5c","resolution":{"observed_at":"2026-08-05T12:52:47.942355Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.03679/citation-record","integrity":"/paper/2412.03679/integrity","json":"/paper/2412.03679/citation-record.json","paper":"/paper/2412.03679"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:42.569688Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.569688Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:0f3b0c90ab18d7d294828c71644afa53eee52393de3e4972d35f9dc890dcad5d","observation_id":"33ad2754-4767-4156-97b4-347ae0d7c65d","resolution":{"observed_at":"2026-08-11T22:17:42.569688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:43.509355Z","title":"Claude 3.5 sonnet model card addendum","venue":null,"work_id":"f3243038-9cdc-4aca-af28-22394a12c03c","year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.575075Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:01d948b621c7e6262a8c59312306c735079967206bc2a089eb71832fcbd4c8b4","observation_id":"95dd5733-6fa2-44f4-94d9-828a89d12325","resolution":{"observed_at":"2026-08-11T22:17:43.514615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-15T17:40:38.050939Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-11T22:17:42.579452Z","title":"Program synthesis with large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.579452Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:a94f013824210c283cf6d39874f7f11acb0fc262279b1fffbfc46b4a890d9285","observation_id":"43e4570c-8554-418b-9c79-8b0be5fc2f57","resolution":{"observed_at":"2026-08-11T22:17:42.579452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:43.495984Z","title":"D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al","venue":null,"work_id":"24f68f91-bbf9-4a72-b391-22578a7e406d","year":2020},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.586188Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:1d6fb6ef95687ff9e06676f790e38a327f338357b99e86a5ee0514e79055170b","observation_id":"1e7b8c13-915e-4f5a-a229-b9814cc8077d","resolution":{"observed_at":"2026-08-11T22:17:43.500324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:42.589934Z","title":"A survey on evaluation of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.589934Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:518649718f61fad24decf92110870d2d9db5e16be6af8352f490575f8a741547","observation_id":"16b05f5f-003e-4b92-ab0c-fb7a9331b0d2","resolution":{"observed_at":"2026-08-11T22:17:42.589934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-20T20:50:23.483838Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-11T22:17:42.594460Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.594460Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:cd05b970ef0b28c8d1a4f43cedb938f3b81e740fcff0bf84d63c44286e673895","observation_id":"0c015cf2-a048-43a0-933e-697d94028af7","resolution":{"observed_at":"2026-08-11T22:17:42.594460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-11T22:17:42.598818Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.598818Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:7883034e4ec4706c942c88f5318bcf4a658eed2c5ec183453faec5aac202e18b","observation_id":"7a3c1d0c-c392-4d9e-9e77-e619a9e33697","resolution":{"observed_at":"2026-08-11T22:17:42.598818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05492","last_updated":"2024-06-07T15:51:08Z","snapshot_observed_at":"2026-08-20T20:08:04.817035Z","submitted_at":"2023-10-09T07:56:16Z","title":"How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05492","snapshot_observed_at":"2026-08-11T22:17:42.604209Z","title":"How abilities in large language models are affected by supervised fine-tuning data composition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.604209Z"},"links":{"cited_paper":"/paper/2310.05492","citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:7aedad7905043e58666d4ff630b714fb54c13803a951f27eb02ab05a0ec73468","observation_id":"944a104c-b2d5-4ac8-89b1-b6f180b95b50","resolution":{"observed_at":"2026-08-11T22:17:42.604209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T22:17:42.610125Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.610125Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:af14b43b2460b89c703047c94cf1149f443d4a4100cbb0a8ef23386d64c73834","observation_id":"594600ba-6f3c-421c-b74c-e8af2b740dd1","resolution":{"observed_at":"2026-08-11T22:17:42.610125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04475","last_updated":"2025-03-10T09:27:03Z","snapshot_observed_at":"2026-07-06T17:56:23.317089Z","submitted_at":"2024-04-06T02:29:02Z","title":"Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04475","snapshot_observed_at":"2026-08-11T22:17:42.615359Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.615359Z"},"links":{"cited_paper":"/paper/2404.04475","citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:0016440893ed1e2c4b2d42c23738d072bcc1050e9f049d376a7c87faa876d36a","observation_id":"00050036-8117-4f64-bd7b-778fa7ba162a","resolution":{"observed_at":"2026-08-11T22:17:42.615359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11644","last_updated":"2023-10-02T06:12:30Z","snapshot_observed_at":"2026-08-13T11:19:55.436754Z","submitted_at":"2023-06-20T16:14:25Z","title":"Textbooks Are All You Need","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11644","snapshot_observed_at":"2026-08-11T22:17:42.620046Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.620046Z"},"links":{"cited_paper":"/paper/2306.11644","citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:787de935d9c27b9afc014610fe982a6e7296905166a0efe3af2739b7c10ecffa","observation_id":"195f3afa-1c63-431c-a28c-29b23407f0be","resolution":{"observed_at":"2026-08-11T22:17:42.620046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19736","last_updated":"2023-11-25T17:35:12Z","snapshot_observed_at":"2026-08-20T11:16:58.983924Z","submitted_at":"2023-10-30T17:00:52Z","title":"Evaluating Large Language Models: A Comprehensive Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19736","snapshot_observed_at":"2026-08-11T22:17:42.625582Z","title":"Evaluating large language models: A comprehensive survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.625582Z"},"links":{"cited_paper":"/paper/2310.19736","citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:fb26fd059a1cc951629ff12d010ff0e14778c21ff17731a7e65b602d1c50cc40","observation_id":"bab42ba8-c35d-4cc3-8fd7-51d0647ecae7","resolution":{"observed_at":"2026-08-11T22:17:42.625582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:43.474824Z","title":"Measuring mathematical problem solving with the math dataset","venue":null,"work_id":"cd6cd429-71cb-43a6-83e2-67a26049a64c","year":2021},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.630273Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:4610f085d006d5ca259edf74dc9f24ea51c5d6d7c36ae73b096d4d8e5146e327","observation_id":"da5b93db-b078-410f-9e9d-fae597d9bdd4","resolution":{"observed_at":"2026-08-11T22:17:43.479773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10782","last_updated":"2022-05-22T09:22:37Z","snapshot_observed_at":"2026-08-16T21:45:21.900700Z","submitted_at":"2022-05-22T09:22:37Z","title":"Instruction Induction: From Few Examples to Natural Language Task Descriptions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10782","snapshot_observed_at":"2026-08-11T22:17:42.634690Z","title":"R., and Levy, O","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.634690Z"},"links":{"cited_paper":"/paper/2205.10782","citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:bc61e215bf1f8e9540ee4f491b97a26545915628c13fbfe621e03ae9fca5472b","observation_id":"8d9c00dc-4ed3-47d1-bb44-abdccf0ec347","resolution":{"observed_at":"2026-08-11T22:17:42.634690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:42.639288Z","title":"Unnatural instructions: Tuning language models with (almost) no human labor","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.639288Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:7604042b802223b54037bbc35efb305cfb6d107683914b3221f0fcca2d502094","observation_id":"8dbad316-0276-4d41-9bf1-b1bcaef4d180","resolution":{"observed_at":"2026-08-11T22:17:42.639288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-11T22:17:42.643235Z","title":"P., Perelman, A., Ramesh, A., Clark, A., Ostrow, A., Welihinda, A., Hayes, A., Radford, A., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.643235Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:2fa18a71f49b6fb4e84d4167eaa7f14ba2312462d851eefa413d294eae47469d","observation_id":"046b8588-a987-498c-ae0e-030d9a9f3927","resolution":{"observed_at":"2026-08-11T22:17:42.643235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:43.454181Z","title":"The cot collection: Improving zero-shot and few-shot learning of language models via chain-of-thought fine-tuning","venue":null,"work_id":"19dec745-11e4-4a0e-b11e-2a45ca25a52e","year":2023},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.647074Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:ba28a9abdbfba77b127550dc541e60fdc48c834f32a009b5579571b0f0958b7c","observation_id":"6e56eb8a-aa3c-4b10-9b83-32a942fbbf66","resolution":{"observed_at":"2026-08-11T22:17:43.458366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:43.440703Z","title":"J., Jang, Y., Chae, H., and Yeo, J","venue":null,"work_id":"f13d6080-9291-4a04-b5db-c1011724df0a","year":2023},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.651536Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:1bd6fb2c104b9c82a1bf0a4f91a1346bea770f6c3cf8bb4710656b72757bcfe0","observation_id":"7666c8da-dd40-46dc-ad19-4e01800b4c9f","resolution":{"observed_at":"2026-08-11T22:17:43.444855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:43.429765Z","title":"Y., Shin, J., Welleck, S., Neubig, G., Lee, M., Lee, K., and Seo, M","venue":null,"work_id":"ecd8a83b-6dda-4e85-a3b8-9d73bb9cc404","year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.655989Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:e21d043a7e5688da2e6ce5933acc51eca9ebe3ddcc317e241819ed77bace319d","observation_id":"72bb17d2-8df0-46d1-af06-41bd539ad79d","resolution":{"observed_at":"2026-08-11T22:17:43.433147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13787","last_updated":"2024-06-08T16:40:12Z","snapshot_observed_at":"2026-08-19T21:41:44.622958Z","submitted_at":"2024-03-20T17:49:54Z","title":"RewardBench: Evaluating Reward Models for Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13787","snapshot_observed_at":"2026-08-11T22:17:42.660036Z","title":"Y., Chandu, K., Dziri, N., Kumar, S., Zick, T., Choi, Y., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.660036Z"},"links":{"cited_paper":"/paper/2403.13787","citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:ac00bcb76647fcb63c859f52f5e7f4bb97545d798164cb20b7d2efd1826c34f4","observation_id":"b9251161-cb98-473a-927b-3e2923bfeb0f","resolution":{"observed_at":"2026-08-11T22:17:42.660036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11939","last_updated":"2024-10-14T18:11:58Z","snapshot_observed_at":"2026-08-21T06:07:47.921030Z","submitted_at":"2024-06-17T17:26:10Z","title":"From Crowdsourced Data to High-Quality Benchmarks: Arena-Hard and BenchBuilder Pipeline","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11939","snapshot_observed_at":"2026-08-11T22:17:42.664467Z","title":"E., and Stoica, I","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.664467Z"},"links":{"cited_paper":"/paper/2406.11939","citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:f3e7cbf107e5eda3230c08132551590c52bd3ba57b45cd34bcb42c52839cbc1c","observation_id":"bf27756e-c868-4022-897d-6918a600534a","resolution":{"observed_at":"2026-08-11T22:17:42.664467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14738","last_updated":"2024-11-22T05:17:18Z","snapshot_observed_at":"2026-08-19T23:08:07.822911Z","submitted_at":"2024-11-22T05:17:18Z","title":"Universal and Context-Independent Triggers for Precise Control of LLM Outputs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14738","snapshot_observed_at":"2026-08-11T22:17:42.668642Z","title":"Universal and context-independent triggers for precise control of llm outputs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.668642Z"},"links":{"cited_paper":"/paper/2411.14738","citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:7156171b563e5a85eafc9dde977c034e1d7bdedc0d0aebc2f2c3e13779896f1f","observation_id":"b48413b9-c263-4357-9b4b-423464317c1b","resolution":{"observed_at":"2026-08-11T22:17:42.668642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18451","last_updated":"2024-10-24T06:06:26Z","snapshot_observed_at":"2026-08-13T15:15:10.681693Z","submitted_at":"2024-10-24T06:06:26Z","title":"Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18451","snapshot_observed_at":"2026-08-11T22:17:42.672876Z","title":"Y., Zeng, L., Liu, J., Yan, R., He, J., Wang, C., Yan, S., Liu, Y., and Zhou, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.672876Z"},"links":{"cited_paper":"/paper/2410.18451","citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:37d7b0b4b85c9e1d8bc0345783ac41c9b0aa6410ae86964b891f54bc18c9718d","observation_id":"abbd0eb3-0e65-40b8-9832-a71f5f281618","resolution":{"observed_at":"2026-08-11T22:17:42.672876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:43.418093Z","title":"S., Wang, Y., and Zhang, L","venue":null,"work_id":"2c8cfc00-0fc0-498b-ba78-e1dbd8390b6e","year":2023},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.677857Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:b9859ba4aba0ceccef56d119e3fc231930e21d187fc84b0331f463af2df41388","observation_id":"0df4b114-d9d0-4278-8f44-5fbcb9b48e69","resolution":{"observed_at":"2026-08-11T22:17:43.422026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:43.406724Z","title":"Best practices and lessons learned on synthetic data","venue":null,"work_id":"eccd1391-b6b5-4d28-9e8a-74b8af4b2512","year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.681361Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:680c1889b55afb2736a63e3d643bcefb652431e648a320babb221c89832db9e0","observation_id":"d4b95646-4797-41f9-af2a-fc89e8ec71ec","resolution":{"observed_at":"2026-08-11T22:17:43.410288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:43.395730Z","title":"What makes good data for alignment? a comprehensive study of automatic data selection in instruction tuning","venue":null,"work_id":"4513bf94-95a7-4f9f-b676-93b7555729a5","year":2023},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.684853Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:ab9d9925e85cdaaaa1a1fd8dc65810a53e96bd07fab7cda7648b6d13d47852ba","observation_id":"d978c7cb-0e42-4560-ae7b-a3e4c0b2d942","resolution":{"observed_at":"2026-08-11T22:17:43.399378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:43.385070Z","title":"W., Tay, Y., Zhou, D., Le, Q","venue":null,"work_id":"6c8d6ee9-b79a-4087-bdab-cae538efa27b","year":2023},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.688909Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:a6fbaca215f7313724795036e305ff61c574a736cfba93aaf1b22fedbfb8d64c","observation_id":"06634d93-e4fa-4ce3-a8ae-0ec6e609f183","resolution":{"observed_at":"2026-08-11T22:17:43.388496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:43.371843Z","title":"Introducing meta llama 3: The most capable openly available llm to date","venue":null,"work_id":"36a5c130-d415-43b7-884c-7d20ac953391","year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.693121Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:2e51e054d065052ed6478a001b2341933c7b5e33ec56b12e91e5ac175e529934","observation_id":"0a96d054-4045-4552-9aa4-3dbbf51032da","resolution":{"observed_at":"2026-08-11T22:17:43.376377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:43.356876Z","title":"Cross-task generalization via natural language crowdsourcing instructions","venue":null,"work_id":"4bebdd9c-8494-4544-a994-829895b082a6","year":2022},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.696879Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:f0fdfcc2fcf4e967dc96af5f4cd3321392e7b25e35229d0a6e6d3c4b9120e09b","observation_id":"687e6f50-30c2-4071-8bc2-be266aa06e30","resolution":{"observed_at":"2026-08-11T22:17:43.363699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:43.342657Z","title":"Mteb: Massive text embedding benchmark","venue":null,"work_id":"aa9f93e4-ef93-49b3-8759-364bfa381adb","year":2014},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.700510Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:ae5c64c8b5793c99eb03744e1b63f676dca4169b982570139df027df7c9e218c","observation_id":"09599f1f-c83e-463e-8b42-ae8e0f0c9692","resolution":{"observed_at":"2026-08-11T22:17:43.347765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:43.330169Z","title":"S., Shen, S., Yong, Z","venue":null,"work_id":"dc110374-374b-4482-8ec9-92eb4d9213a0","year":2023},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.704444Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:5fa07117c4c207e849f8982693187ce95ca183c79e62f58f9626f5a9b19b3e4c","observation_id":"cc2d283d-a704-4151-bd17-15527faae4ea","resolution":{"observed_at":"2026-08-11T22:17:43.334381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02707","last_updated":"2023-06-05T08:58:39Z","snapshot_observed_at":"2026-08-09T03:29:22.849759Z","submitted_at":"2023-06-05T08:58:39Z","title":"Orca: Progressive Learning from Complex Explanation Traces of GPT-4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02707","snapshot_observed_at":"2026-08-11T22:17:42.708243Z","title":"Orca: Progressive learning from complex explanation traces of gpt-4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.708243Z"},"links":{"cited_paper":"/paper/2306.02707","citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:2c39e28a8df8009811e2003f9295499fb2a26e67935f2fddc3268d0dbcd6ed54","observation_id":"b06efdcd-f87b-4d7c-ba83-b1e3caf1b24d","resolution":{"observed_at":"2026-08-11T22:17:42.708243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:43.318126Z","title":"Mixeval: Deriving wisdom of the crowd from LLM benchmark mixtures","venue":null,"work_id":"f72ea2be-6e66-4d09-a742-690e04554996","year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.712538Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:f63754af53c6a6909c875673afc74dfcf750df6a0fad8d5ffe6afde13f3e7df0","observation_id":"579fa552-fd6e-4d87-a6f0-2ec01010cb04","resolution":{"observed_at":"2026-08-11T22:17:43.322094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:43.303348Z","title":"Leverage the Latest Open Models for Synthetic Data Generation with NVIDIA Nemotron-4-340B","venue":null,"work_id":"772db2a5-553f-4bc2-99a4-c3056cd718c6","year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.716695Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:cb078ed6ed0858595f1dc570107de328fef23587384beb17c1f18ad781765717","observation_id":"93def1ed-bf4e-486b-8093-3d23b0c7ca8f","resolution":{"observed_at":"2026-08-11T22:17:43.309404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:43.291080Z","title":"J., and Hashimoto, T","venue":null,"work_id":"2444b224-682f-4f8c-a7db-c866af3be3b6","year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.721993Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:ffe9ebfb50f90700e3c9c181d32e168df4657db65ac4d02d6dfea5ab01ace966","observation_id":"e89988d4-74fd-4d1d-b144-d5138375d3b4","resolution":{"observed_at":"2026-08-11T22:17:43.294427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11061","last_updated":"2024-08-07T19:32:59Z","snapshot_observed_at":"2026-08-18T09:59:50.891262Z","submitted_at":"2024-08-07T19:32:59Z","title":"StructuredRAG: JSON Response Formatting with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11061","snapshot_observed_at":"2026-08-11T22:17:42.726829Z","title":"B., Cardenas, E., Sharma, A., Trengrove, J., and van Luijt, B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.726829Z"},"links":{"cited_paper":"/paper/2408.11061","citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:680ff8eb2df2df38af21b5216191b52d35ef57a157bb1d96a6f3a27e83ad2cbb","observation_id":"7a43803c-c023-4f8c-a036-e3576bc2aca1","resolution":{"observed_at":"2026-08-11T22:17:42.726829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02442","last_updated":"2024-10-14T13:57:29Z","snapshot_observed_at":"2026-08-16T13:28:29.726326Z","submitted_at":"2024-08-05T13:08:24Z","title":"Let Me Speak Freely? A Study on the Impact of Format Restrictions on Performance of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02442","snapshot_observed_at":"2026-08-11T22:17:42.732147Z","title":"R., Wu, C.-K., Tsai, Y.-L., Lin, C.-Y., Lee, H.-y., and Chen, Y.-N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.732147Z"},"links":{"cited_paper":"/paper/2408.02442","citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:56f6c680e2913e3ba59f643b606316c86729b9143da07c6bef1b3308690a3450","observation_id":"e2fe7637-65c4-426c-b53f-6b68b1a196fe","resolution":{"observed_at":"2026-08-11T22:17:42.732147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:42.736633Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.736633Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:06332390db177a813b1cbc9b1ac4ea9cae6890105bd4abddd25f8b684545dbfc","observation_id":"9acbc3db-5856-498a-9ae8-093f04e6c16c","resolution":{"observed_at":"2026-08-11T22:17:42.736633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:42.740909Z","title":"Qwen2.5: A party of foundation models, September 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.740909Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:7a8ed95e9525cd98f17dbae5baefe4460f3618309fc2719315f2201f93552713","observation_id":"bca49219-18d5-4ceb-b2c3-51aafbeb8f2a","resolution":{"observed_at":"2026-08-11T22:17:42.740909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:43.265013Z","title":"Prompt2model: Generating deployable models from natural language instructions","venue":null,"work_id":"47fb1648-4a14-4c93-ba36-a128c3df4c66","year":2023},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.745075Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:9fa4c7590793d34209f83b3187ef1688a28f8d187ebf957a8633e1ff9bdc8205","observation_id":"b7af7163-42ff-464b-89d9-4317d8ef0ebc","resolution":{"observed_at":"2026-08-11T22:17:43.268621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:42.748808Z","title":"S., Arunkumar, A., Stap, D., et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.748808Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:607f55d21375aac9a4aa16fd0f4e68e70177c291c1763f50638723af6af30b69","observation_id":"d87ef1bf-0ac0-4b75-8224-832e1f3ad6d5","resolution":{"observed_at":"2026-08-11T22:17:42.748808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:43.246096Z","title":"A., Khashabi, D., and Hajishirzi, H","venue":null,"work_id":"4bfb6add-84f0-4f54-914d-23fc4b65ab20","year":2023},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.753030Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:d83e5361e323fa3ac5370161aea7148956afc37032cab2d437d4f4efe770e0ae","observation_id":"40a1efc5-4eed-4295-bb0c-a3b0107e7c5a","resolution":{"observed_at":"2026-08-11T22:17:43.249846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:42.758206Z","title":"W., Lester, B., Du, N., Dai, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.758206Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:df536dd3abbf2112a163539eb12c6c83ae2fe92b811a98dee57c2aa27fe993e1","observation_id":"43ab9403-95d6-4d4c-97af-53699b861a46","resolution":{"observed_at":"2026-08-11T22:17:42.758206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:43.223262Z","title":"Wizard LM : Empowering large pre-trained language models to follow complex instructions","venue":null,"work_id":"2ffa4243-0e1e-4e61-8754-130bc54d94ca","year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.762601Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:bf3d44a87bed60aefa6be79edb1d9bb983c000e58691999190b47696b41b9337","observation_id":"3beb33d4-e37a-4246-9214-3c7da17da208","resolution":{"observed_at":"2026-08-11T22:17:43.228008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08464","last_updated":"2024-10-07T01:45:38Z","snapshot_observed_at":"2026-08-20T09:53:02.008012Z","submitted_at":"2024-06-12T17:52:30Z","title":"Magpie: Alignment Data Synthesis from Scratch by Prompting Aligned LLMs with Nothing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08464","snapshot_observed_at":"2026-08-11T22:17:42.766737Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.766737Z"},"links":{"cited_paper":"/paper/2406.08464","citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:50658bf6e6bf369d96cbf58575f980909aaf6c00882c203e49fd879e363330f6","observation_id":"c5bddd7b-9eaa-48c6-be1f-a4a52ff6b0d7","resolution":{"observed_at":"2026-08-11T22:17:42.766737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07133","last_updated":"2025-02-26T18:10:05Z","snapshot_observed_at":"2026-08-18T07:57:34.346066Z","submitted_at":"2024-11-11T17:06:48Z","title":"Stronger Models are NOT Stronger Teachers for Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07133","snapshot_observed_at":"2026-08-11T22:17:42.771208Z","title":"Y., and Poovendran, R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.771208Z"},"links":{"cited_paper":"/paper/2411.07133","citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:91c7c10ca9d56538321263dee9aecce541950b552b74529918e11b6fdf857a57","observation_id":"b9602ff3-1d60-4ea9-a0f5-ed1e6452a33e","resolution":{"observed_at":"2026-08-11T22:17:42.771208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:42.775638Z","title":"Learning to mine aligned code and natural language pairs from stack overflow","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.775638Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:199a926237fd8e93b5536ccfb1ec41130165fff90b15ad4277d0e8839a7be8bd","observation_id":"64013046-f12a-4531-b3de-0cf9980d0f9d","resolution":{"observed_at":"2026-08-11T22:17:42.775638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:43.209322Z","title":"Mammoth: Building math generalist models through hybrid instruction tuning","venue":null,"work_id":"e8f5405d-8396-4f1f-abbb-6d00be82bdb6","year":2023},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.779277Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:82b05f331f61a96a800bb7c6251d58c39f5c4dc900451c8edfc03ee5c4fb2dc3","observation_id":"582dd6c1-3f76-44d6-aa3d-c8f204a52e55","resolution":{"observed_at":"2026-08-11T22:17:43.214350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:43.194907Z","title":"MA mmo TH 2: Scaling instructions from the web","venue":null,"work_id":"52f18f43-a9c7-44e9-80cc-70c947056edd","year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.782732Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:5cd19d4cd9a6ed9f0a80811c4ec2479a7dc9ec609f17d142bccf49c941bf11cf","observation_id":"fb2244ec-cdbd-4bf9-b474-a34caa413e3f","resolution":{"observed_at":"2026-08-11T22:17:43.200095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20535","last_updated":"2024-12-12T18:45:33Z","snapshot_observed_at":"2026-08-18T14:41:31.112356Z","submitted_at":"2024-05-30T23:20:25Z","title":"Unveiling the Impact of Coding Data Instruction Fine-Tuning on Large Language Models Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20535","snapshot_observed_at":"2026-08-11T22:17:42.786222Z","title":"Z., Ye, X., Yang, X., Chen, L., Wang, W","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.786222Z"},"links":{"cited_paper":"/paper/2405.20535","citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:80a1948ba0267d54eb80d9491b437beece3a279cdbad47e10273feaedba86927","observation_id":"73f717a3-22a9-4cc4-b302-a6b6ca6ad351","resolution":{"observed_at":"2026-08-11T22:17:42.786222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:17:42.790137Z","title":"Lima: Less is more for alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T22:17:42.790137Z"},"links":{"citing_paper":"/paper/2412.03679"},"observation_digest":"sha256:3a53ecab036dffef6f3061b243f41d235f4779d02d8c7d3a62d62a766d4a5d52","observation_id":"f9ebf507-8894-4ff7-89e9-8d5428b0746d","resolution":{"observed_at":"2026-08-11T22:17:42.790137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.03679","last_updated":"2025-09-01T19:04:20Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-18T01:11:12.092726Z","submitted_at":"2024-12-04T19:20:32Z","title":"Evaluating Language Models as Synthetic Data Generators"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 2 inbound Pith citation observations for arXiv:2412.03679."}