{"as_of":"2026-08-14T20:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a42a04d01993f596b3871d24833ab12a3dff2a137164d457bb08f5a6202d65cd","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T17:09:15.462034Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:08:04.002985Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T01:00:08.633531Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01697","snapshot_observed_at":"2026-08-07T15:08:04.002985Z","title":"Davis, Lingjiao Chen, Boris Hanin, Ion Stoica, Joseph E","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17134","last_updated":"2025-06-03T03:04:17Z","snapshot_observed_at":"2026-08-14T15:07:05.073392Z","submitted_at":"2025-05-22T04:05:02Z","title":"LongMagpie: A Self-synthesis Method for Generating Large-scale Long-context Instructions","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T15:08:04.002985Z"},"links":{"cited_paper":"/paper/2502.01697","citing_paper":"/paper/2505.17134"},"observation_digest":"sha256:53703214426b2fed1310461d59208c990640c208d3267bbcdbf4e62851649b90","observation_id":"5eac65fc-499a-4ab9-ae64-4d2af8ab00bd","resolution":{"observed_at":"2026-08-07T15:08:04.002985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01697","snapshot_observed_at":"2026-08-07T14:34:11.865218Z","title":"Gonzalez, and Matei Zaharia","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18485","last_updated":"2025-05-24T03:19:36Z","snapshot_observed_at":"2026-08-14T14:41:43.527231Z","submitted_at":"2025-05-24T03:19:36Z","title":"The Prompt is Mightier than the Example","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:11.865218Z"},"links":{"cited_paper":"/paper/2502.01697","citing_paper":"/paper/2505.18485"},"observation_digest":"sha256:61c9eb2a406feb259cd362efb334ae367c907ed257f75b787289fabbca2dfb74","observation_id":"2989eccf-5992-4b4d-b8ae-743be62803b9","resolution":{"observed_at":"2026-08-07T14:34:11.865218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01697","snapshot_observed_at":"2026-08-07T04:47:42.438433Z","title":"Gonzalez, and Matei Zaharia","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09659","last_updated":"2025-06-11T12:26:45Z","snapshot_observed_at":"2026-08-13T16:58:58.668529Z","submitted_at":"2025-06-11T12:26:45Z","title":"Intent Factored Generation: Unleashing the Diversity in Your Language Model","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:42.438433Z"},"links":{"cited_paper":"/paper/2502.01697","citing_paper":"/paper/2506.09659"},"observation_digest":"sha256:669ae1dfd92881ccab4813e34008e79d5ed4f727dd110627fda5936f84a0949b","observation_id":"ec2af6cb-b8cc-468b-98ec-7dafcabab294","resolution":{"observed_at":"2026-08-07T04:47:42.438433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"cited_work":{"arxiv_id":"2502.01697","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.01697","snapshot_observed_at":"2026-08-06T01:00:08.633531Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","venue":"cs.CL","work_id":"92e9177d-faa8-45c0-a5c4-342f83ce1265","year":2025},"citing_paper":{"arxiv_id":"2508.04063","last_updated":"2025-08-06T03:52:55Z","snapshot_observed_at":"2026-08-14T12:25:44.934110Z","submitted_at":"2025-08-06T03:52:55Z","title":"Fine-tuning for Better Few Shot Prompting: An Empirical Comparison for Short Answer Grading","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T01:00:07.506842Z"},"links":{"cited_paper":"/paper/2502.01697","citing_paper":"/paper/2508.04063"},"observation_digest":"sha256:4a531b3359a50079156a8f83934913363a0e0d71cfb41ebfa9d081602984e55b","observation_id":"7d61fdd7-b584-44bd-9dde-c07de86117bf","resolution":{"observed_at":"2026-08-06T01:00:08.723033Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.01697/citation-record","integrity":"/paper/2502.01697/integrity","json":"/paper/2502.01697/citation-record.json","paper":"/paper/2502.01697"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.15226","last_updated":"2024-10-22T18:54:23Z","snapshot_observed_at":"2026-08-12T22:19:23.407970Z","submitted_at":"2024-10-19T22:14:07Z","title":"On the Diversity of Synthetic Data and its Impact on Training Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15226","snapshot_observed_at":"2026-08-09T17:09:15.239770Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.239770Z"},"links":{"cited_paper":"/paper/2410.15226","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:80fa211a6849f941059447f496e0e68fb56fdc051ee581e72d8b6fa0727f19ba","observation_id":"544ba400-4f9c-4b3f-b138-ba2ac1574724","resolution":{"observed_at":"2026-08-09T17:09:15.239770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.04140","last_updated":"2023-06-07T04:27:09Z","snapshot_observed_at":"2026-08-13T11:22:56.590748Z","submitted_at":"2023-06-07T04:27:09Z","title":"Increasing Diversity While Maintaining Accuracy: Text Data Generation with Large Language Models and Human Interventions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.04140","snapshot_observed_at":"2026-08-09T17:09:15.245871Z","title":"Increasing diversity while maintaining accuracy: Text data generation with large language models and human interventions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.245871Z"},"links":{"cited_paper":"/paper/2306.04140","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:89bd768be8a9ac0d6d423a79e70b078c4064e6732e232b12e83d22aa572e7127","observation_id":"9033d16f-0fe9-4637-94c7-25a5e003a62f","resolution":{"observed_at":"2026-08-09T17:09:15.245871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-09T17:09:15.250957Z","title":"Training verifiers to solve math word problems, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.250957Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:ba16bd8654c4b9a345f36f3f66287d616ec15601762f2656549cf177e6e8b922","observation_id":"bb01b4c7-0fed-4fb4-bd8b-dbe4d0233021","resolution":{"observed_at":"2026-08-09T17:09:15.250957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-09T17:09:15.255560Z","title":"BERT: pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.255560Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:53021fdf95dd1d3978d3e793b265b29d476cd6949d74821de6e6dffaaaf7e57a","observation_id":"24d7c184-272a-40fc-858f-7dae6a35eeda","resolution":{"observed_at":"2026-08-09T17:09:15.255560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:16.289199Z","title":"The Llama 3 herd of models, 2024","venue":null,"work_id":"38fd9f10-fe61-4c7d-b737-39adf7e2dd5e","year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.259953Z"},"links":{"citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:f27338d9dc137959f635227ddae60dbda4f35d5a0772cdcfff9855b483fc88be","observation_id":"e5a00fd3-c0a0-4d6f-a07f-4750fa924888","resolution":{"observed_at":"2026-08-09T17:09:16.294389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11745","last_updated":"2024-10-15T16:22:49Z","snapshot_observed_at":"2026-08-12T22:22:34.706553Z","submitted_at":"2024-10-15T16:22:49Z","title":"Personas with Attitudes: Controlling LLMs for Diverse Data Annotation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11745","snapshot_observed_at":"2026-08-09T17:09:15.264507Z","title":"Personas with attitudes: Controlling LLMs for diverse data annotation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.264507Z"},"links":{"cited_paper":"/paper/2410.11745","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:72ffa0b70065769498e2ba3c3de6b287a6708f2768606b552f22afcccfcce2d1","observation_id":"ad28d8ab-fa0d-4b12-8341-b38925a23fed","resolution":{"observed_at":"2026-08-09T17:09:15.264507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16339","last_updated":"2025-01-08T20:11:59Z","snapshot_observed_at":"2026-08-14T04:22:20.981738Z","submitted_at":"2024-12-20T21:00:11Z","title":"Deliberative Alignment: Reasoning Enables Safer Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16339","snapshot_observed_at":"2026-08-09T17:09:15.269623Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.269623Z"},"links":{"cited_paper":"/paper/2412.16339","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:78880274f229183611e14ea1a61861a595c45099771c7a8e94e19ab740cbc2c9","observation_id":"b145b221-3dee-488f-b0c7-06e3d27e9764","resolution":{"observed_at":"2026-08-09T17:09:15.269623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-08-06T22:40:28.707813Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-08-09T17:09:15.274159Z","title":"Deepseek-coder: When the large language model meets programming--the rise of code intelligence","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.274159Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:97aba0a2fbf5e83210b5633b9e89dc850303db507b632c56e2d06fa0c369dc60","observation_id":"37eb2a8b-404a-474b-905c-900182f7e63c","resolution":{"observed_at":"2026-08-09T17:09:15.274159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09807","last_updated":"2024-04-16T15:57:11Z","snapshot_observed_at":"2026-08-13T05:23:57.279177Z","submitted_at":"2023-11-16T11:31:50Z","title":"The Curious Decline of Linguistic Diversity: Training Language Models on Synthetic Text","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09807","snapshot_observed_at":"2026-08-09T17:09:15.278911Z","title":"The curious decline of linguistic diversity: Training language models on synthetic text","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.278911Z"},"links":{"cited_paper":"/paper/2311.09807","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:968092c7e1586a3c8b4b270ac6e04d5749b98580b00480b0ceef39c68ac6c058","observation_id":"9e073b28-c120-49c2-aa09-604ca23051cc","resolution":{"observed_at":"2026-08-09T17:09:15.278911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:15.284177Z","title":"The curious case of neural text degeneration","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.284177Z"},"links":{"citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:e085c2d6414e07db35e97036e31d7eaa085cc8a44452b1e9b6330be3462c7c76","observation_id":"a5e414c0-d1da-46b2-8451-bef6e24ef5dc","resolution":{"observed_at":"2026-08-09T17:09:15.284177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-09T17:09:15.288860Z","title":"LoRA : Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.288860Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:6a3436c99561202876ccec60b1780c12f947137e9f6a20f416d592286ea688f4","observation_id":"4d6b588a-b842-4ea3-bfaa-87aab0bce7c8","resolution":{"observed_at":"2026-08-09T17:09:15.288860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-08-13T09:04:30.125777Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-09T17:09:15.293263Z","title":"LiveCodeBench : Holistic and contamination free evaluation of large language models for code, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.293263Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:360068e127b0f93086c427a749a47f579d20223a7c1fc0fae8696ef2258bbbe1","observation_id":"4021880c-bfe8-40aa-bc00-681ce0271200","resolution":{"observed_at":"2026-08-09T17:09:15.293263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.06146","last_updated":"2019-09-13T11:18:20Z","snapshot_observed_at":"2026-08-13T18:54:55.815938Z","submitted_at":"2019-09-13T11:18:20Z","title":"PubMedQA: A Dataset for Biomedical Research Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.06146","snapshot_observed_at":"2026-08-09T17:09:15.297509Z","title":"Cohen, and Xinghua Lu","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.297509Z"},"links":{"cited_paper":"/paper/1909.06146","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:aeb8cfc65518df2744feb3a1f9a53bc153c6a64e5e505e84a564574de01758be","observation_id":"e6fd6502-d8c3-4308-9d3f-57d2a29e0332","resolution":{"observed_at":"2026-08-09T17:09:15.297509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:15.301817Z","title":"The Enron corpus: A new dataset for email classification research","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.301817Z"},"links":{"citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:8eedc5fe47766116b10a6f91081dcc429361e7c2ee5d408a523f5761769b462b","observation_id":"392b8dae-7dae-4db8-aeb6-7a8b287be89b","resolution":{"observed_at":"2026-08-09T17:09:15.301817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18421","last_updated":"2024-07-25T22:42:36Z","snapshot_observed_at":"2026-08-12T23:14:30.784857Z","submitted_at":"2024-07-25T22:42:36Z","title":"Self-Directed Synthetic Dialogues and Revisions Technical Report","version":1},"cited_work":{"arxiv_id":"2407.18421","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.18421","snapshot_observed_at":"2026-08-09T17:09:15.979044Z","title":"Self-Directed Synthetic Dialogues and Revisions Technical Report","venue":"cs.CL","work_id":"fb1d9e16-d9c3-4670-9278-48954ffef08a","year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.306173Z"},"links":{"cited_paper":"/paper/2407.18421","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:a05a79545cbdf31ecd6683b25e733c2c876c097efa02a67933541d79a7d1bd49","observation_id":"e49c82fa-5d36-4c6f-9fad-c2d9e64c57ef","resolution":{"observed_at":"2026-08-09T17:09:15.985928Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13064","last_updated":"2024-02-20T15:00:35Z","snapshot_observed_at":"2026-08-13T04:14:27.645630Z","submitted_at":"2024-02-20T15:00:35Z","title":"Synthetic Data (Almost) from Scratch: Generalized Instruction Tuning for Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13064","snapshot_observed_at":"2026-08-09T17:09:15.310446Z","title":"Synthetic data (almost) from scratch: Generalized instruction tuning for language models, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.310446Z"},"links":{"cited_paper":"/paper/2402.13064","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:3caa849d9e185ff042d42dc6937427397d9288d6b759c8d0e99a9af30c9994a3","observation_id":"7eb51fd3-ac6b-4258-a53e-044a59a13164","resolution":{"observed_at":"2026-08-09T17:09:15.310446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02446","last_updated":"2024-07-02T17:22:54Z","snapshot_observed_at":"2026-08-12T23:30:14.038444Z","submitted_at":"2024-07-02T17:22:54Z","title":"Predicting vs. Acting: A Trade-off Between World Modeling & Agent Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02446","snapshot_observed_at":"2026-08-09T17:09:15.314869Z","title":"Predicting vs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.314869Z"},"links":{"cited_paper":"/paper/2407.02446","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:139c554a81ba554520655d826b7360b65b9f9209a19c5b50448bee7230acd25c","observation_id":"25b28f9f-fb3a-4572-a1ac-311991002502","resolution":{"observed_at":"2026-08-09T17:09:15.314869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.02336","last_updated":"2023-05-24T04:08:08Z","snapshot_observed_at":"2026-08-13T15:29:42.581391Z","submitted_at":"2022-06-06T03:38:36Z","title":"Making Large Language Models Better Reasoners with Step-Aware Verifier","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.02336","snapshot_observed_at":"2026-08-09T17:09:15.320000Z","title":"Making large language models better reasoners with step-aware verifier","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.320000Z"},"links":{"cited_paper":"/paper/2206.02336","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:86b29ab4f2637488ab730f71d44273b378c012fef333376d66f01848c44d9466","observation_id":"c7ff898d-718f-439d-ab05-dd5b082f5231","resolution":{"observed_at":"2026-08-09T17:09:15.320000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05463","last_updated":"2023-09-11T14:01:45Z","snapshot_observed_at":"2026-08-02T22:47:03.212781Z","submitted_at":"2023-09-11T14:01:45Z","title":"Textbooks Are All You Need II: phi-1.5 technical report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05463","snapshot_observed_at":"2026-08-09T17:09:15.324762Z","title":"Textbooks are all you need II : phi-1.5 technical report, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.324762Z"},"links":{"cited_paper":"/paper/2309.05463","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:63dac69c15efd61a2e76056675ef2f54fed06bfbaac206702605cd0866514f21","observation_id":"780c2aa7-08c0-4728-b188-dc22d8566f4a","resolution":{"observed_at":"2026-08-09T17:09:15.324762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07503","last_updated":"2024-08-10T20:46:47Z","snapshot_observed_at":"2026-08-13T00:32:55.965962Z","submitted_at":"2024-04-11T06:34:17Z","title":"Best Practices and Lessons Learned on Synthetic Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07503","snapshot_observed_at":"2026-08-09T17:09:15.329025Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.329025Z"},"links":{"cited_paper":"/paper/2404.07503","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:d0bca0c3fef11559b8f4af4da827a8914a4941b21d1528c8be3c8556d56bcc8f","observation_id":"68491292-2250-48ad-85d4-02cb81a42492","resolution":{"observed_at":"2026-08-09T17:09:15.329025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07088","last_updated":"2024-02-23T20:35:30Z","snapshot_observed_at":"2026-08-13T05:52:35.540957Z","submitted_at":"2023-10-11T00:01:41Z","title":"Diversity of Thought Improves Reasoning Abilities of LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07088","snapshot_observed_at":"2026-08-09T17:09:15.333815Z","title":"Diversity of thought improves reasoning abilities of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.333815Z"},"links":{"cited_paper":"/paper/2310.07088","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:050b2e86f96d46c5604903f40fd80dbec1dc7a88d3791ff34cdb84c1be1b8e32","observation_id":"e4375cc6-08b8-4683-b337-991ab3ce7c6b","resolution":{"observed_at":"2026-08-09T17:09:15.333815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:16.261757Z","title":"Sky-T1 : Train your own o1 preview model within \\ 450","venue":null,"work_id":"3d53973b-c6d4-4816-941d-90a21e17c91f","year":2025},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.338662Z"},"links":{"citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:99ff11a3f124a0f9b37368c270df2986982e888f100ea81c21baec92b59a158c","observation_id":"24cc36f4-ac9e-4e94-8c2a-fc5985da2af2","resolution":{"observed_at":"2026-08-09T17:09:16.266824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11704","last_updated":"2024-08-06T22:37:06Z","snapshot_observed_at":"2026-08-12T23:40:54.718397Z","submitted_at":"2024-06-17T16:25:04Z","title":"Nemotron-4 340B Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11704","snapshot_observed_at":"2026-08-09T17:09:15.343666Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.343666Z"},"links":{"cited_paper":"/paper/2406.11704","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:5152d06dac32e2dc597c76c50b4a74ab070478003d1ed7b7f37dd6454c40d70a","observation_id":"901ea479-15ff-4e3d-a9d6-3cb78658daa8","resolution":{"observed_at":"2026-08-09T17:09:15.343666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:16.245364Z","title":"New embedding models and API updates","venue":null,"work_id":"befe941f-78be-4951-80b1-4d5118942344","year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.348335Z"},"links":{"citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:b2322568501d47f96dc106f25bee31ee401501747e836c0cad5e8347a19f30c6","observation_id":"a951b623-fa39-456d-99ed-afa5f09e158f","resolution":{"observed_at":"2026-08-09T17:09:16.250040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-09T17:09:15.352761Z","title":"GPT-4 technical report, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.352761Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:8aca48ab2a6e8342087154fbdb8cdc0317edc3a09e2ef8c936aa716d55e45e41","observation_id":"0b2b5582-e43e-4314-889f-02f31a2cb24c","resolution":{"observed_at":"2026-08-09T17:09:15.352761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:16.230007Z","title":"Hello GPT -4o","venue":null,"work_id":"f71f4241-7ff2-4826-a1b6-e02e654df2cc","year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.359249Z"},"links":{"citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:1f24a17ac605c4a96de256564901ea85850e616bb252a3616f249ce1cef61587","observation_id":"827297e9-ae7d-4882-9975-e36474e612a6","resolution":{"observed_at":"2026-08-09T17:09:16.234816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15334","last_updated":"2023-05-24T16:48:11Z","snapshot_observed_at":"2026-08-14T14:07:14.900729Z","submitted_at":"2023-05-24T16:48:11Z","title":"Gorilla: Large Language Model Connected with Massive APIs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15334","snapshot_observed_at":"2026-08-09T17:09:15.364141Z","title":"Patil, Tianjun Zhang, Xin Wang, and Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.364141Z"},"links":{"cited_paper":"/paper/2305.15334","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:565ecffca2c091e08f4bfade71d5bd637f12056109bfcf4620ba051c3f888cea","observation_id":"5c76823b-3c36-44d4-8269-757774240fb5","resolution":{"observed_at":"2026-08-09T17:09:15.364141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:16.212512Z","title":"Pedregosa, G","venue":null,"work_id":"92964ea9-9cdb-4cfa-a67a-49352ab8777a","year":2011},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.369308Z"},"links":{"citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:bd7bcc62d5579f9ebd4f0665ff114a1c79d23146dc92e1a9e3019a1e5070e9ce","observation_id":"458081d4-843f-437b-b421-c7102a78779a","resolution":{"observed_at":"2026-08-09T17:09:16.218064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-09T17:09:15.374631Z","title":"Qwen2.5 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.374631Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:189fcdd8324d825710546521d98bde85a066870b5489f142a1645ee7b40fcb3a","observation_id":"702d81d7-265a-4afb-81ee-802c9b5735a3","resolution":{"observed_at":"2026-08-09T17:09:15.374631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15063","last_updated":"2023-11-08T18:12:03Z","snapshot_observed_at":"2026-08-13T11:08:53.773366Z","submitted_at":"2023-06-26T21:05:20Z","title":"Pretraining task diversity and the emergence of non-Bayesian in-context learning for regression","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15063","snapshot_observed_at":"2026-08-09T17:09:15.379020Z","title":"Pretraining task diversity and the emergence of non-bayesian in-context learning for regression, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.379020Z"},"links":{"cited_paper":"/paper/2306.15063","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:b3a190299d31ac9c913ab2e0fcaa1de465436542b4e50b2ecab056625f67d309","observation_id":"e102adaa-4e9b-4eef-9476-d01d69925c11","resolution":{"observed_at":"2026-08-09T17:09:15.379020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10084","last_updated":"2019-08-27T08:50:17Z","snapshot_observed_at":"2026-08-14T05:02:11.716316Z","submitted_at":"2019-08-27T08:50:17Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10084","snapshot_observed_at":"2026-08-09T17:09:15.383592Z","title":"Sentence- BERT : Sentence embeddings using S iamese BERT -networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.383592Z"},"links":{"cited_paper":"/paper/1908.10084","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:cca75e622bd7fa9f3e97a83c9b2c0aa7b06df6714a9de8aacb2b049eb5720781","observation_id":"68c2e63d-4415-4c43-a7e9-74e78600ec98","resolution":{"observed_at":"2026-08-09T17:09:15.383592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-13T04:09:48.076759Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-09T17:09:15.388084Z","title":"Markosyan, Manish Bhatt, Yuning Mao, Minqi Jiang, Jack Parker-Holder, Jakob Foerster, Tim Rocktäschel, and Roberta Raileanu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.388084Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:2c95b52c5d3510abab0ea5357509d934e3b268eabcb278b11fa25cb33427a9aa","observation_id":"6ffe84fd-eaf0-4e13-921e-e69b834f062a","resolution":{"observed_at":"2026-08-09T17:09:15.388084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01490","last_updated":"2024-07-19T10:45:21Z","snapshot_observed_at":"2026-08-12T23:31:04.510060Z","submitted_at":"2024-07-01T17:26:21Z","title":"LLM See, LLM Do: Guiding Data Generation to Target Non-Differentiable Objectives","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01490","snapshot_observed_at":"2026-08-09T17:09:15.392584Z","title":"LLM see, LLM do: Guiding data generation to target non-differentiable objectives, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.392584Z"},"links":{"cited_paper":"/paper/2407.01490","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:2149dd54c33e4de30c5f9145e034ec06c182982b8cc0bb878ba03a8201535beb","observation_id":"586ef5b8-853c-436a-a23a-623cdbf75e23","resolution":{"observed_at":"2026-08-09T17:09:15.392584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:15.397214Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.397214Z"},"links":{"citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:8c9d914054869bda4ccf78270660df8110753c37186ed543fda64ae6f64ceb38","observation_id":"938fd7e5-380d-415a-809f-0ed018152fb8","resolution":{"observed_at":"2026-08-09T17:09:15.397214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:15.401643Z","title":"Evaluating the evaluation of diversity in natural language generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.401643Z"},"links":{"citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:ba97204766a17c7f6e71542b5460b8e8333d869a8ec63823b69563eaea60b951","observation_id":"024b5d0b-e28d-42cb-90e1-4cdb6fe1978f","resolution":{"observed_at":"2026-08-09T17:09:15.401643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.04325","last_updated":"2024-06-04T22:09:46Z","snapshot_observed_at":"2026-08-13T13:57:03.619983Z","submitted_at":"2022-10-26T00:28:40Z","title":"Will we run out of data? Limits of LLM scaling based on human-generated data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.04325","snapshot_observed_at":"2026-08-09T17:09:15.405937Z","title":"Will we run out of data? limits of llm scaling based on human-generated data, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.405937Z"},"links":{"cited_paper":"/paper/2211.04325","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:cd5fe8ef733da8732003bb23d764602978feaf6e6383224836b9a81a43b04444","observation_id":"99900fa9-792c-4c23-ad14-0f4202cec919","resolution":{"observed_at":"2026-08-09T17:09:15.405937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03733","last_updated":"2024-10-18T23:53:07Z","snapshot_observed_at":"2026-08-12T22:50:29.764130Z","submitted_at":"2024-09-05T17:44:49Z","title":"Planning In Natural Language Improves LLM Search For Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03733","snapshot_observed_at":"2026-08-09T17:09:15.410799Z","title":"Planning in natural language improves LLM search for code generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.410799Z"},"links":{"cited_paper":"/paper/2409.03733","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:cc6f1e8a1b03e3d558046c384a1fa41b81e59ac13c773f310d6db9c1f19351c3","observation_id":"b9803525-502c-4b40-9174-1a87d9228f96","resolution":{"observed_at":"2026-08-09T17:09:15.410799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:16.196090Z","title":"Magicoder: Empowering code generation with OSS -instruct","venue":null,"work_id":"71fb3b9f-1e22-4f71-8993-dedede6e3da8","year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.415817Z"},"links":{"citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:60243a5dd9af5b05b03b9ca761b5d97343fcdf10c40e309cac62925fdfcc2627","observation_id":"0d142431-7588-4070-b671-6d039be6ea62","resolution":{"observed_at":"2026-08-09T17:09:16.200570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09038","last_updated":"2024-10-14T17:32:26Z","snapshot_observed_at":"2026-08-12T22:25:13.171333Z","submitted_at":"2024-10-11T17:54:14Z","title":"SimpleStrat: Diversifying Language Model Generation with Stratification","version":2},"cited_work":{"arxiv_id":"2410.09038","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09038","snapshot_observed_at":"2026-08-09T17:09:15.649551Z","title":"SimpleStrat: Diversifying Language Model Generation with Stratification","venue":"cs.CL","work_id":"203a62ad-c0ce-48b6-8a45-64c6b1ccc30a","year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.420749Z"},"links":{"cited_paper":"/paper/2410.09038","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:c670df2b8676a33cad8e210e6304802db8841f4c0eeb6f0bbc67c43670d8dd91","observation_id":"104c2e8a-7e1c-4db3-bac6-5a96f0ca35e9","resolution":{"observed_at":"2026-08-09T17:09:15.657418Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.09600","last_updated":"2018-09-25T17:28:20Z","snapshot_observed_at":"2026-08-11T10:35:06.989614Z","submitted_at":"2018-09-25T17:28:20Z","title":"HotpotQA: A Dataset for Diverse, Explainable Multi-hop Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.09600","snapshot_observed_at":"2026-08-09T17:09:15.425105Z","title":"Cohen, Ruslan Salakhutdinov, and Christopher D","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.425105Z"},"links":{"cited_paper":"/paper/1809.09600","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:998afe81ac9334b1b4bf32a50006c7a64edbc02d5b4afe1afd8505cba9f1ec02","observation_id":"2ea13239-fe82-4ffe-836b-95c6ff8c16f1","resolution":{"observed_at":"2026-08-09T17:09:15.425105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-13T10:57:13.012119Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12284","snapshot_observed_at":"2026-08-09T17:09:15.430065Z","title":"Kwok, Zhenguo Li, Adrian Weller, and Weiyang Liu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.430065Z"},"links":{"cited_paper":"/paper/2309.12284","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:4e212551cd8654933ea0a61a7369ab78ac91defddb71c31c625c2e6a3bdec962","observation_id":"78e7e278-1efe-4c4b-ae27-20f3223f0a22","resolution":{"observed_at":"2026-08-09T17:09:15.430065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-13T16:14:27.196956Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-09T17:09:15.435280Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.435280Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:eb80a410eaa8a8593f1052dc9a6db2c8badcc8ca5986fdf9dc7de0f357a04360","observation_id":"0e410b0d-eb4e-495a-828c-567b648cb6d6","resolution":{"observed_at":"2026-08-09T17:09:15.435280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07394","last_updated":"2024-06-13T07:19:06Z","snapshot_observed_at":"2026-08-12T23:45:25.243322Z","submitted_at":"2024-06-11T16:01:07Z","title":"Accessing GPT-4 level Mathematical Olympiad Solutions via Monte Carlo Tree Self-refine with LLaMa-3 8B","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07394","snapshot_observed_at":"2026-08-09T17:09:15.440023Z","title":"Accessing GPT -4 level mathematical olympiad solutions via Monte Carlo tree self-refine with LLaMa-3 8B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.440023Z"},"links":{"cited_paper":"/paper/2406.07394","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:f0356d78caac957ef7bbd3559032b3e4b0b09da608be77bb31cba36670644ca7","observation_id":"8ea1cc25-cc61-439b-a26e-3aa6baf3a731","resolution":{"observed_at":"2026-08-09T17:09:15.440023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:15.445251Z","title":"Improving diversity of commonsense generation by large language models via in-context learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.445251Z"},"links":{"citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:0d9d733d845362e39af6811b51aa9420cec35d3241337d6c48c8b9e417cd45b9","observation_id":"27b82581-9b8d-42d7-8ffd-de5e7d5c7ad4","resolution":{"observed_at":"2026-08-09T17:09:15.445251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10131","last_updated":"2024-06-05T17:27:51Z","snapshot_observed_at":"2026-08-13T00:53:38.526176Z","submitted_at":"2024-03-15T09:26:02Z","title":"RAFT: Adapting Language Model to Domain Specific RAG","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.10131","snapshot_observed_at":"2026-08-09T17:09:15.450446Z","title":"Patil, Naman Jain, Sheng Shen, Matei Zaharia, Ion Stoica, and Joseph E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.450446Z"},"links":{"cited_paper":"/paper/2403.10131","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:fb5c48a4fa8fb13c388db4bb724837271bc8107bb1c35fcb1c10d11d150ff2ff","observation_id":"df241338-3eb9-43d3-ac69-82ad2f9c04cd","resolution":{"observed_at":"2026-08-09T17:09:15.450446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-09T17:09:15.456381Z","title":"BERT score: Evaluating text generation with BERT","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.456381Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:58a0f68ea42a809524042fcdf8f8992c0cc0b583745c0cb92d89eeff99a262a0","observation_id":"371d0bbb-e1fa-437c-bc2c-84d4e7773a69","resolution":{"observed_at":"2026-08-09T17:09:15.456381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:09:16.180383Z","title":"Texygen: A benchmarking platform for text generation models","venue":null,"work_id":"ef93dd90-5349-4b50-b0ae-b0bd3ff938a1","year":2018},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.462034Z"},"links":{"citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:4069e1aa6e66e5c7058ce473a12d5011d2fd6be183532bc5ce69612fc7b1b735","observation_id":"efe1d1fb-afc7-4ee2-a5b4-5d47bcfc09c7","resolution":{"observed_at":"2026-08-09T17:09:16.184992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T14:40:58.119601Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":38,"verified_exact":1,"verified_fuzzy":7},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 4 inbound Pith citation observations for arXiv:2502.01697."}