{"as_of":"2026-08-09T06:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5dde40fa8f0b120e77be68017ecdc1b5bf33524c3ec00c28993c3b445ac5e68a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:07:31.396007Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T11:56:19.367802Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.05149","last_updated":"2024-12-06T16:06:08Z","snapshot_observed_at":"2026-07-06T20:02:53.153763Z","submitted_at":"2024-12-06T16:06:08Z","title":"Findings of the Second BabyLM Challenge: Sample-Efficient Pretraining on Developmentally Plausible Corpora","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05149","snapshot_observed_at":"2026-08-07T15:07:31.396007Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16277","last_updated":"2025-05-22T06:23:02Z","snapshot_observed_at":"2026-08-07T15:02:09.518255Z","submitted_at":"2025-05-22T06:23:02Z","title":"Spontaneous Speech Variables for Evaluating LLMs Cognitive Plausibility","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:07:31.396007Z"},"links":{"cited_paper":"/paper/2412.05149","citing_paper":"/paper/2505.16277"},"observation_digest":"sha256:1a6843f8c12d8b172bb5f6103f45e55aae00eb65eedda524bb941b478fceefb9","observation_id":"19e74139-6de6-4c6e-a948-673a6d49d24f","resolution":{"observed_at":"2026-08-07T15:07:31.396007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05149","last_updated":"2024-12-06T16:06:08Z","snapshot_observed_at":"2026-07-06T20:02:53.153763Z","submitted_at":"2024-12-06T16:06:08Z","title":"Findings of the Second BabyLM Challenge: Sample-Efficient Pretraining on Developmentally Plausible Corpora","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05149","snapshot_observed_at":"2026-08-07T13:06:34.434972Z","title":"In International Conference on Learning Representations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22757","last_updated":"2025-05-28T18:19:18Z","snapshot_observed_at":"2026-08-07T12:58:55.893679Z","submitted_at":"2025-05-28T18:19:18Z","title":"Pre-Training Curriculum for Multi-Token Prediction in Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:06:34.434972Z"},"links":{"cited_paper":"/paper/2412.05149","citing_paper":"/paper/2505.22757"},"observation_digest":"sha256:cbf04753eeaa667d03f4ab199699f26f3a8b762365ad8f41401966f8c939a1c7","observation_id":"de485d5f-83eb-45d1-80a1-984e362c6066","resolution":{"observed_at":"2026-08-07T13:06:34.434972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05149","last_updated":"2024-12-06T16:06:08Z","snapshot_observed_at":"2026-07-06T20:02:53.153763Z","submitted_at":"2024-12-06T16:06:08Z","title":"Findings of the Second BabyLM Challenge: Sample-Efficient Pretraining on Developmentally Plausible Corpora","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05149","snapshot_observed_at":"2026-08-05T17:56:34.763215Z","title":"Hu, Aaron Mueller, Candace Ross, Adina Williams, Tal Linzen, Chengxu Zhuang, Ryan Cotterell, Leshem Choshen, Alex Warstadt, and Ethan Gotlieb Wilcox","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.15475","last_updated":"2025-09-26T09:45:06Z","snapshot_observed_at":"2026-08-06T10:10:20.695762Z","submitted_at":"2025-08-21T11:53:34Z","title":"Influence-driven Curriculum Learning for Pre-training on Limited Data","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T17:56:34.763215Z"},"links":{"cited_paper":"/paper/2412.05149","citing_paper":"/paper/2508.15475"},"observation_digest":"sha256:3c8ddeb9ff35962b24983a2f90121ceaf42cf39adc19961eaf5a34d293081fbd","observation_id":"e03c4073-6aa3-44e0-b77b-0ba227b9440b","resolution":{"observed_at":"2026-08-05T17:56:34.763215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05149","last_updated":"2024-12-06T16:06:08Z","snapshot_observed_at":"2026-07-06T20:02:53.153763Z","submitted_at":"2024-12-06T16:06:08Z","title":"Findings of the Second BabyLM Challenge: Sample-Efficient Pretraining on Developmentally Plausible Corpora","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05149","snapshot_observed_at":"2026-08-05T11:47:20.011054Z","title":"Hu, Aaron Mueller, Candace Ross, Adina Williams, Tal Linzen, Chengxu Zhuang, Ryan Cotterell, Leshem Choshen, Alex Warstadt, and Ethan Gotlieb Wilcox","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02225","last_updated":"2025-09-02T11:43:21Z","snapshot_observed_at":"2026-08-07T22:07:57.987713Z","submitted_at":"2025-09-02T11:43:21Z","title":"Towards Fundamental Language Models: Does Linguistic Competence Scale with Model Size?","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T11:47:20.011054Z"},"links":{"cited_paper":"/paper/2412.05149","citing_paper":"/paper/2509.02225"},"observation_digest":"sha256:1b970511957f8d61140a1a4a778930fcc1bc25183106b1e9f72bf732fe214248","observation_id":"d9a985a3-f1e4-4ac2-af5e-9bfabdc2f79d","resolution":{"observed_at":"2026-08-05T11:47:20.011054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05149","last_updated":"2024-12-06T16:06:08Z","snapshot_observed_at":"2026-07-06T20:02:53.153763Z","submitted_at":"2024-12-06T16:06:08Z","title":"Findings of the Second BabyLM Challenge: Sample-Efficient Pretraining on Developmentally Plausible Corpora","version":1},"cited_work":{"arxiv_id":"2412.05149","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.05149","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2412.05149 , year=","venue":null,"work_id":"a8899dd6-902a-4e16-8866-1bc173e917e9","year":null},"citing_paper":{"arxiv_id":"2604.17930","last_updated":"2026-04-20T08:11:04Z","snapshot_observed_at":"2026-07-06T23:04:55.190916Z","submitted_at":"2026-04-20T08:11:04Z","title":"Heterogeneity in Formal Linguistic Competence of Language Models: Is Data the Real Bottleneck?","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-10T04:56:14.870058Z"},"links":{"cited_paper":"/paper/2412.05149","citing_paper":"/paper/2604.17930"},"observation_digest":"sha256:f76672ef46bf0108df634fcaac1ed8f219e04ca31e8f7caea6a945c0dc1cbdfe","observation_id":"2c81ff9c-fe2e-4f4f-a20e-d575984978ef","resolution":{"observed_at":"2026-05-10T11:05:09.426285Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05149","last_updated":"2024-12-06T16:06:08Z","snapshot_observed_at":"2026-07-06T20:02:53.153763Z","submitted_at":"2024-12-06T16:06:08Z","title":"Findings of the Second BabyLM Challenge: Sample-Efficient Pretraining on Developmentally Plausible Corpora","version":1},"cited_work":{"arxiv_id":"2412.05149","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.05149","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2412.05149 , year=","venue":null,"work_id":"a8899dd6-902a-4e16-8866-1bc173e917e9","year":null},"citing_paper":{"arxiv_id":"2604.18452","last_updated":"2026-04-20T16:10:28Z","snapshot_observed_at":"2026-07-06T23:05:17.639285Z","submitted_at":"2026-04-20T16:10:28Z","title":"ESsEN: Training Compact Discriminative Vision-Language Transformers in a Low-Resource Setting","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-10T04:28:38.775948Z"},"links":{"cited_paper":"/paper/2412.05149","citing_paper":"/paper/2604.18452"},"observation_digest":"sha256:4c998c61ac15e1fb671d7c5048ca7fb29de4730810e39f06ef460aac37e8b492","observation_id":"8f9535dc-a041-4ef9-877f-4b6ae1e0694b","resolution":{"observed_at":"2026-05-11T11:56:19.417820Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.05149/citation-record","integrity":"/paper/2412.05149/integrity","json":"/paper/2412.05149/citation-record.json","paper":"/paper/2412.05149"},"outbound":[],"paper":{"arxiv_id":"2412.05149","last_updated":"2024-12-06T16:06:08Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T20:02:53.153763Z","submitted_at":"2024-12-06T16:06:08Z","title":"Findings of the Second BabyLM Challenge: Sample-Efficient Pretraining on Developmentally Plausible Corpora"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2412.05149."}