{"as_of":"2026-08-19T12:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bad515211237d485a065abed7ce35ccdc0b7fedd8617ea87d7ebc367ce6a72bf","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T22:40:35.305558Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T17:10:39.851945Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-08T17:10:39.925827Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"cited_work":{"arxiv_id":"2412.03275","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.03275","snapshot_observed_at":"2026-08-08T17:10:39.925827Z","title":"AntLM: Bridging Causal and Masked Language Models","venue":"cs.CL","work_id":"fa6c9a7e-84a2-43e5-a4f3-149b84a3aea6","year":2024},"citing_paper":{"arxiv_id":"2502.06901","last_updated":"2025-02-09T20:02:05Z","snapshot_observed_at":"2026-08-14T13:24:47.283866Z","submitted_at":"2025-02-09T20:02:05Z","title":"Enabling Autoregressive Models to Fill In Masked Tokens","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-08T17:10:39.851945Z"},"links":{"cited_paper":"/paper/2412.03275","citing_paper":"/paper/2502.06901"},"observation_digest":"sha256:8a98d35eec2fccc54637a7c8180dce675302fdb4b4651cedc9c68575017c5b6f","observation_id":"07fc3082-f54e-4699-8617-996902045114","resolution":{"observed_at":"2026-08-08T17:10:39.931496Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03275","snapshot_observed_at":"2026-08-03T18:42:09.967950Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.04149","last_updated":"2026-07-22T06:17:13Z","snapshot_observed_at":"2026-08-15T06:38:00.133271Z","submitted_at":"2025-12-03T19:00:00Z","title":"Enhancing next token prediction based pre-training for jet foundation models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T18:42:09.967950Z"},"links":{"cited_paper":"/paper/2412.03275","citing_paper":"/paper/2512.04149"},"observation_digest":"sha256:a2f47d4c7fabb6082d55ccfabd2ca2214cbc07ac0f887d7fa4ab08007eddca5c","observation_id":"9ef2311d-c9ee-490b-89e1-d7ab9a440d7d","resolution":{"observed_at":"2026-08-03T18:42:09.967950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.03275/citation-record","integrity":"/paper/2412.03275/integrity","json":"/paper/2412.03275/citation-record.json","paper":"/paper/2412.03275"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:40:34.648718Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:34.648718Z"},"links":{"citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:66bb7f6061213f70d095dfe3df03f654d3e94cf331ca82a089623914001afad0","observation_id":"ea05ef11-203a-4691-a5b9-9a1ba6169391","resolution":{"observed_at":"2026-08-11T22:40:34.648718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:40:34.663576Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:34.663576Z"},"links":{"citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:6a9b142b63f76149874125222e051de8b4af066b75a54355e4a3120a2b814721","observation_id":"ef863c65-df52-4d84-85f4-b7657ae14b08","resolution":{"observed_at":"2026-08-11T22:40:34.663576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:40:37.349150Z","title":null,"venue":null,"work_id":"005e6a54-0399-410f-8bfb-b472605bea8f","year":2014},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:34.671985Z"},"links":{"citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:f9f9cc8dd1baa4fc331349cdc13c0ceda331d31d22f0e4313f74287998504808","observation_id":"c573bd37-a098-4e1d-8496-e94832097a0a","resolution":{"observed_at":"2026-08-11T22:40:37.358278Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:40:34.682954Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:34.682954Z"},"links":{"citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:c605cbcbbe1efeb986388a4e7673b56de10d14edb041bda53cbb15ac16970ef2","observation_id":"4ace2871-2f6b-4741-8dab-b1eaf49f6616","resolution":{"observed_at":"2026-08-11T22:40:34.682954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.02265","last_updated":"2023-11-07T21:36:11Z","snapshot_observed_at":"2026-08-18T19:58:50.093516Z","submitted_at":"2023-11-03T23:08:50Z","title":"Not all layers are equally as important: Every Layer Counts BERT","version":2},"cited_work":{"arxiv_id":"2311.02265","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.02265","snapshot_observed_at":"2026-08-11T22:40:36.654764Z","title":"Not all layers are equally as important: Every Layer Counts BERT","venue":"cs.CL","work_id":"7318ef07-39d7-4684-aa9c-94e33a92c109","year":2023},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:34.724757Z"},"links":{"cited_paper":"/paper/2311.02265","citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:c91e11587c7bd8d3e275dd1dd98717c470cc32453b765d5cb97fdc9db3d9b08c","observation_id":"bd68b762-3900-4346-bfea-672a0ccd19c8","resolution":{"observed_at":"2026-08-11T22:40:36.694760Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06214","last_updated":"2024-07-27T18:50:28Z","snapshot_observed_at":"2026-08-16T14:02:26.126213Z","submitted_at":"2024-04-09T11:04:50Z","title":"[Call for Papers] The 2nd BabyLM Challenge: Sample-efficient pretraining on a developmentally plausible corpus","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06214","snapshot_observed_at":"2026-08-11T22:40:34.756102Z","title":"Hu, Tal Linzen, Aaron Mueller, Candace Ross, Alex Warstadt, Ethan Wilcox, Adina Williams, and Chengxu Zhuang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:34.756102Z"},"links":{"cited_paper":"/paper/2404.06214","citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:104cfb04615c141f65213ec053792f236bbfafacf2ed905553e0cb367e2d286a","observation_id":"a946e5dc-6be2-4cd4-9c5a-de300ea1c0e9","resolution":{"observed_at":"2026-08-11T22:40:34.756102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-11T22:40:34.789280Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:34.789280Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:2ef71ec4bcbb5acc3daad610d7e9d385a66368c383042992523baaeea20a2980","observation_id":"fb1e3661-01a0-4d57-8581-65547fafd37c","resolution":{"observed_at":"2026-08-11T22:40:34.789280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:40:34.796992Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:34.796992Z"},"links":{"citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:a6e981855ed42aae02b58ccc61bfde08f4f478b9d0ea582608ca15c9486e8740","observation_id":"b792d7ab-7348-4419-aec1-48142367dad4","resolution":{"observed_at":"2026-08-11T22:40:34.796992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:40:34.811479Z","title":null,"venue":null,"work_id":null,"year":1990},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:34.811479Z"},"links":{"citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:18b58c5856983da6618072c40d2345a47da4b5ef85cdff04792a26233049ea22","observation_id":"e3bb17d2-e92e-4748-a220-6a9fea95d00a","resolution":{"observed_at":"2026-08-11T22:40:34.811479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:40:37.261919Z","title":null,"venue":null,"work_id":"ee9d2874-b905-4f39-bfcb-c8dc90b0b55f","year":2020},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:34.829200Z"},"links":{"citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:857c1f622a1df196ef3e7db33bcd9ef3d02524fef6b9ea790f9b9afb00606dfc","observation_id":"231c23d4-94ee-4d12-ab21-e7eb7a9b0a56","resolution":{"observed_at":"2026-08-11T22:40:37.269420Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.03654","last_updated":"2021-10-06T21:02:00Z","snapshot_observed_at":"2026-08-16T13:36:21.119762Z","submitted_at":"2020-06-05T19:54:34Z","title":"DeBERTa: Decoding-enhanced BERT with Disentangled Attention","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.03654","snapshot_observed_at":"2026-08-11T22:40:34.849646Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:34.849646Z"},"links":{"cited_paper":"/paper/2006.03654","citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:6a919636480a77dec3402bdbb1532dedecc149376165c889a08b86b1e22fb6c9","observation_id":"b965496d-22ad-4352-889a-ebe36e518a34","resolution":{"observed_at":"2026-08-11T22:40:34.849646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.09210","last_updated":"2023-02-18T02:11:36Z","snapshot_observed_at":"2026-08-17T05:42:24.349196Z","submitted_at":"2023-02-18T02:11:36Z","title":"How Good Are GPT Models at Machine Translation? A Comprehensive Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.09210","snapshot_observed_at":"2026-08-11T22:40:34.860678Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:34.860678Z"},"links":{"cited_paper":"/paper/2302.09210","citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:0e8f6a5ddb79c3af5dc24ad798baaada31367a65cb06b2179221de336ab46503","observation_id":"c344a0d5-6e7b-4a6b-b806-91b03fdfd528","resolution":{"observed_at":"2026-08-11T22:40:34.860678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.02301","last_updated":"2016-04-01T05:31:33Z","snapshot_observed_at":"2026-08-14T22:24:26.534698Z","submitted_at":"2015-11-07T04:36:20Z","title":"The Goldilocks Principle: Reading Children's Books with Explicit Memory Representations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.02301","snapshot_observed_at":"2026-08-11T22:40:34.876310Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:34.876310Z"},"links":{"cited_paper":"/paper/1511.02301","citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:2d139c152473bcf492dfd039fe9ccb2f58b7b268b3f8776df1ef495deda165f1","observation_id":"11cdb437-6484-4260-9bc5-fb05f08c85ac","resolution":{"observed_at":"2026-08-11T22:40:34.876310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:40:34.892174Z","title":null,"venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:34.892174Z"},"links":{"citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:8fb36eb230e10b8c58a544e0a12865f44ee0ce87c4cb136c5ca433a2893f7d8d","observation_id":"4144f4a3-9e02-4418-9041-9e6bc64b5448","resolution":{"observed_at":"2026-08-11T22:40:34.892174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:40:34.908808Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:34.908808Z"},"links":{"citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:5a5c06b0fa08a780680902f87b7a3bdfed7ee89d120582e20e5e8df1ab572fa2","observation_id":"f3d5a573-ea56-4c15-9027-9b67781a32b5","resolution":{"observed_at":"2026-08-11T22:40:34.908808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.11942","last_updated":"2020-02-09T03:00:18Z","snapshot_observed_at":"2026-08-18T01:27:11.590348Z","submitted_at":"2019-09-26T07:06:13Z","title":"ALBERT: A Lite BERT for Self-supervised Learning of Language Representations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.11942","snapshot_observed_at":"2026-08-11T22:40:34.916414Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:34.916414Z"},"links":{"cited_paper":"/paper/1909.11942","citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:53de3b46e7f2010aefd9b15d8afb74c4cf5b6f5f2dcd1cf8647002de28c8681b","observation_id":"52a0e94b-c41b-40bd-95d5-a805f2e0d2b4","resolution":{"observed_at":"2026-08-11T22:40:34.916414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:40:34.934757Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:34.934757Z"},"links":{"citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:3d289a881fa8ce0d82d8f38271b3a6b4ae1bf3534f00cb2c6df0d703b243f91f","observation_id":"666d7f07-6a96-4505-ab0c-c1e8fb961d8e","resolution":{"observed_at":"2026-08-11T22:40:34.934757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-08-16T14:33:50.657682Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-11T22:40:34.961937Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:34.961937Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:a9f2f1ff788ab5d410945d03d4034f48c698454dbf66f11f67bc78e818c67678","observation_id":"93110fb7-84ff-4b4d-936e-a3c9584fe442","resolution":{"observed_at":"2026-08-11T22:40:34.961937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:40:37.147283Z","title":null,"venue":null,"work_id":"04bd72c7-8c62-4c31-991e-cc8e8e12f47c","year":2020},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:34.974756Z"},"links":{"citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:d6413eae4e815884881841d50e2ad3335b1cad16ef0f9ad5168f1623f365dbf2","observation_id":"91a94192-2630-43f7-ac38-fc037bc64393","resolution":{"observed_at":"2026-08-11T22:40:37.157760Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:40:37.105025Z","title":null,"venue":null,"work_id":"97e92820-018b-480f-949f-69943dff384a","year":2000},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:35.004754Z"},"links":{"citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:24879192cf1d1174a69e431f7d1e3118b05eb35bc72606a83086a87c4fd02874","observation_id":"e6774c21-650a-4b0e-aa2c-73b3627f2659","resolution":{"observed_at":"2026-08-11T22:40:37.123629Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:40:37.042877Z","title":null,"venue":null,"work_id":"ca695ad9-8353-42da-9441-4f097598c4e6","year":2023},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:35.054763Z"},"links":{"citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:7e5039b31dee1ed13ae2eb82bc1b3be69f29c09dda75fff26c3a717fa4df8c33","observation_id":"aff77412-fae0-4ccb-b33a-87d72fe94fad","resolution":{"observed_at":"2026-08-11T22:40:37.057340Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:40:35.079895Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:35.079895Z"},"links":{"citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:8477ebca3331cb0d160c70f3614b080024b973eb600595a859a60c8aada880b7","observation_id":"22e2abd9-5de9-40e9-93d2-c676a5058305","resolution":{"observed_at":"2026-08-11T22:40:35.079895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:40:35.097654Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:35.097654Z"},"links":{"citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:a410c51cb2c515d740916c54c6f480713c2ce56431c9c87ee05809b03cade027","observation_id":"69fa31f9-a6d4-40d6-b031-f44bff00fe0a","resolution":{"observed_at":"2026-08-11T22:40:35.097654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:40:35.109749Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:35.109749Z"},"links":{"citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:3c8e0349ff1ad4b65f2fdeec170b1554d6871a23ebde0dc6d667668bcd9f9c80","observation_id":"20a90992-98ea-42e5-9f11-46cf6f5c0bb3","resolution":{"observed_at":"2026-08-11T22:40:35.109749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19420","last_updated":"2023-10-30T10:31:32Z","snapshot_observed_at":"2026-08-17T21:11:03.594042Z","submitted_at":"2023-10-30T10:31:32Z","title":"Mean BERTs make erratic language teachers: the effectiveness of latent bootstrapping in low-resource settings","version":1},"cited_work":{"arxiv_id":"2310.19420","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.19420","snapshot_observed_at":"2026-08-11T22:40:35.944838Z","title":"Mean BERTs make erratic language teachers: the effectiveness of latent bootstrapping in low-resource settings","venue":"cs.CL","work_id":"f382f54a-ae6b-4812-aa7f-fc242f3234b0","year":2023},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:35.144755Z"},"links":{"cited_paper":"/paper/2310.19420","citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:a2c7c10292d347cfd0a32f910dc87c5ccd37e4d5191af660b3040e154019d4ba","observation_id":"f2305f78-ce91-4656-91b7-6ce06ac07878","resolution":{"observed_at":"2026-08-11T22:40:35.956234Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09859","last_updated":"2023-05-05T23:59:35Z","snapshot_observed_at":"2026-08-16T15:47:27.799755Z","submitted_at":"2023-03-17T09:53:33Z","title":"Trained on 100 million words and still in shape: BERT meets British National Corpus","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09859","snapshot_observed_at":"2026-08-11T22:40:35.187195Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:35.187195Z"},"links":{"cited_paper":"/paper/2303.09859","citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:b544da4965b40947b68c0bce77f9979e919b3fe584e9ba59757d0491ee6d0fba","observation_id":"231257fe-643c-4e11-8d97-e050154cff3e","resolution":{"observed_at":"2026-08-11T22:40:35.187195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:40:36.927565Z","title":null,"venue":null,"work_id":"a6ff01a9-a0b3-41b9-90f4-73f525cb0f1d","year":2019},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:35.196797Z"},"links":{"citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:4b04a2b6bb72e350c6efb2435b7940714ba66773f62521dd7139d19464d00680","observation_id":"d4e55447-226a-433a-932e-1141e76d6988","resolution":{"observed_at":"2026-08-11T22:40:36.933326Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-08-11T06:21:56.129166Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-11T22:40:35.205733Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:35.205733Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:53099f88c0b184e4fc3accaed81aa5b6068789cab66551a39ffe09e4159dfafe","observation_id":"3162a2a5-cfee-4b8a-8aa7-afb06315aff3","resolution":{"observed_at":"2026-08-11T22:40:35.205733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.09456","last_updated":"2021-11-01T15:34:23Z","snapshot_observed_at":"2026-08-18T19:56:06.850141Z","submitted_at":"2021-10-18T16:47:45Z","title":"NormFormer: Improved Transformer Pretraining with Extra Normalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.09456","snapshot_observed_at":"2026-08-11T22:40:35.220454Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:35.220454Z"},"links":{"cited_paper":"/paper/2110.09456","citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:ce12e441af9273ad911383d08e0de7c94338ea0185c066f8f3ee465f901e9fec","observation_id":"d7398a0b-fb37-4b82-932d-65e3b60f8be7","resolution":{"observed_at":"2026-08-11T22:40:35.220454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:40:35.228708Z","title":null,"venue":null,"work_id":null,"year":1979},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:35.228708Z"},"links":{"citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:3c6647e61bd570c8286b2b142b263a9c0989b3e258919d53efca4542efa9ef4a","observation_id":"7c06de09-966c-47d4-a9d3-2e6a5dd6d596","resolution":{"observed_at":"2026-08-11T22:40:35.228708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:40:36.854756Z","title":null,"venue":null,"work_id":"49fd3c4e-0c2b-48e1-b56e-d97deeb4634e","year":2023},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:35.246257Z"},"links":{"citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:b3443b1e90c3b31ec6431acb4bd130cafc07748bd9b50cf2b309ea10b585aa58","observation_id":"525509d1-e683-4ffc-aafb-0b45a6b9afd7","resolution":{"observed_at":"2026-08-11T22:40:36.868590Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:40:35.254027Z","title":"cloze procedure","venue":null,"work_id":null,"year":1953},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:35.254027Z"},"links":{"citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:05ef3507a458911f18d02631c47091f64610024fd008f8c88b7d7324d071debf","observation_id":"af637057-fbe9-4afd-9eb1-28c107c2743a","resolution":{"observed_at":"2026-08-11T22:40:35.254027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02019","last_updated":"2023-10-24T17:58:42Z","snapshot_observed_at":"2026-08-19T11:16:08.250298Z","submitted_at":"2023-08-03T20:20:01Z","title":"Baby Llama: knowledge distillation from an ensemble of teachers trained on a small dataset with no performance penalty","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02019","snapshot_observed_at":"2026-08-11T22:40:35.263387Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:35.263387Z"},"links":{"cited_paper":"/paper/2308.02019","citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:46d993e35cadb8dcd4705c3eecce520f13ac7dbe9e9e6739a3a93b703ce01f15","observation_id":"c5b46c31-8e84-4a93-a34b-d85d6371dd6b","resolution":{"observed_at":"2026-08-11T22:40:35.263387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-11T22:40:35.273793Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:35.273793Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:15ef29bb898f9a7c264078db175b3a9c019cdcf02e6fdff3122558d1ff1a45fc","observation_id":"e0c8d834-9d67-4281-842d-886d79af4eeb","resolution":{"observed_at":"2026-08-11T22:40:35.273793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11796","last_updated":"2023-01-27T15:52:50Z","snapshot_observed_at":"2026-08-16T15:59:41.015785Z","submitted_at":"2023-01-27T15:52:50Z","title":"Call for Papers -- The BabyLM Challenge: Sample-efficient pretraining on a developmentally plausible corpus","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11796","snapshot_observed_at":"2026-08-11T22:40:35.280916Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:35.280916Z"},"links":{"cited_paper":"/paper/2301.11796","citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:9d4884deaa43eade860f822a9a5e12f245350a81d8f14c50c572d9ca4a1a3589","observation_id":"18572b9f-4bbe-4a09-9d84-5064ab7cb765","resolution":{"observed_at":"2026-08-11T22:40:35.280916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:40:36.785751Z","title":null,"venue":null,"work_id":"c57dc14a-f8d8-4105-a721-532ca0b3cb53","year":2023},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:35.297246Z"},"links":{"citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:7bb9778173ee6cf02fb54b30095472ad6dbeee4be6cddda31aeda072f8128e35","observation_id":"393020fe-917d-435b-a0f0-ed160b839b21","resolution":{"observed_at":"2026-08-11T22:40:36.796866Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.10205","last_updated":"2024-05-27T07:08:31Z","snapshot_observed_at":"2026-08-16T15:54:08.108332Z","submitted_at":"2023-02-20T12:57:12Z","title":"ChatIE: Zero-Shot Information Extraction via Chatting with ChatGPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.10205","snapshot_observed_at":"2026-08-11T22:40:35.305558Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T22:40:35.305558Z"},"links":{"cited_paper":"/paper/2302.10205","citing_paper":"/paper/2412.03275"},"observation_digest":"sha256:2b945d4981343c07cc94a362db055914ec4e1dd6d35397d231076718d1a42c16","observation_id":"28870a9d-4dd4-4733-a762-0ed3f25a8b29","resolution":{"observed_at":"2026-08-11T22:40:35.305558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.03275","last_updated":"2024-12-04T12:34:15Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-18T19:58:10.093197Z","submitted_at":"2024-12-04T12:34:15Z","title":"AntLM: Bridging Causal and Masked Language Models"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 2 inbound Pith citation observations for arXiv:2412.03275."}