{"as_of":"2026-08-22T21:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3c153b8f3876b150c0ca6d524bd83f6f5e06b18671be4e3bcb4bea4776710788","coverage":[{"denominator":77,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":77,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T16:21:01.384486Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03599/citation-record","integrity":"/paper/2608.03599/integrity","json":"/paper/2608.03599/citation-record.json","paper":"/paper/2608.03599"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.162894Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.162894Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:17912522f2d687d2e16466a093eb7dd3a1ecc26a4e4ce19d3c1ece7e3290dbb5","observation_id":"b84cc38c-0333-477d-9942-ca8a2c96778a","resolution":{"observed_at":"2026-08-05T16:21:01.162894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:02.067036Z","title":"2024 , eprint=","venue":null,"work_id":"e8b765c5-9d29-4a59-a167-e3063900fe81","year":2024},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.166049Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:6f9389ab400fe05bb578431629ab4c81c5b420efbb512422d752aaa4b9a1d1bb","observation_id":"1b5e06a2-be4a-4926-bcc8-47c0a61933dc","resolution":{"observed_at":"2026-08-05T16:21:02.070316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:02.058078Z","title":"2024 , eprint=","venue":null,"work_id":"85dde3c2-1188-4d73-87f4-ec13ec8439b9","year":2024},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.168874Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:6b458df2045e0a65b49ca1e5617a52343a98588ab2a64c2d7c6a08da09035eef","observation_id":"8f045842-b442-406a-873e-48c3df11e6b7","resolution":{"observed_at":"2026-08-05T16:21:02.061646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.171661Z","title":"Tokenizer Choice For LLM Training: Negligible or Crucial?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.171661Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:eca108db4171749088a14fb5252b22dd0de3b56ba8f459982ea9326f0ab5b145","observation_id":"80b7f3c9-e6a8-47c5-b771-8ce0895209c2","resolution":{"observed_at":"2026-08-05T16:21:01.171661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.174576Z","title":"Unsupervised Cross-lingual Representation Learning at Scale","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.174576Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:d9bb90b1d260c29c43ee16b23eb4fd591b3f6725a7a3fd506527ff623026621c","observation_id":"ad21ed23-24e1-49e1-9188-7bb5e47df9d0","resolution":{"observed_at":"2026-08-05T16:21:01.174576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.178593Z","title":"WECHSEL : Effective initialization of subword embeddings for cross-lingual transfer of monolingual language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.178593Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:da3a6b6c250d61dd56ca3246a8f06fd092d36d927f74466d457df77e910aa594","observation_id":"b88045fc-1070-4b92-8778-746822825a01","resolution":{"observed_at":"2026-08-05T16:21:01.178593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T16:21:01.182114Z","title":"arXiv preprint arXiv:2302.13971 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.182114Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:12a929a208466e2a973066a753bcf6ef8a07c1dff9e82345f2688bfc5cb93b52","observation_id":"0dc6612f-7583-48b5-ae75-1ee060907da5","resolution":{"observed_at":"2026-08-05T16:21:01.182114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-05T16:21:01.185167Z","title":"arXiv preprint arXiv:2307.09288 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.185167Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:2072994f0eb4bb9480e2be62b81f50abd1e840b157833b64bcc03fa481562f45","observation_id":"4a47940e-ec51-401a-b6e4-5f0d8e1c7334","resolution":{"observed_at":"2026-08-05T16:21:01.185167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-05T16:21:01.188633Z","title":"arXiv preprint arXiv:2407.21783 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.188633Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:338fffa1dca86d839165e76d6f9f65d4ed1376684313db75bf587ee0849cdb9c","observation_id":"596b93f8-f310-49d5-8252-8fbaf9245419","resolution":{"observed_at":"2026-08-05T16:21:01.188633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-05T16:21:01.191477Z","title":"arXiv preprint arXiv:2403.08295 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.191477Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:2e9f148e5c3f7cfa6bbb21ff96a73556b56d788d53a24a37ec52583e7b2aa378","observation_id":"8a0b934f-6559-420f-a50f-96453e9d93aa","resolution":{"observed_at":"2026-08-05T16:21:01.191477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-21T05:15:28.840279Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T16:21:01.195512Z","title":"arXiv preprint arXiv:2408.00118 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.195512Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:01946eeb6b766610fff01e5eaebdf4a111b233d977c64b71894dd8650e03a502","observation_id":"202014e2-43e6-410b-8f26-7e364ef3f132","resolution":{"observed_at":"2026-08-05T16:21:01.195512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-05T16:21:01.198640Z","title":"arXiv preprint arXiv:2503.19786 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.198640Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:c82867594b81fca2f407b24ec6dbde1a4388992a582b0ec5317de4cf5125979a","observation_id":"740a5483-0f48-4904-a8ed-f55afe6f6396","resolution":{"observed_at":"2026-08-05T16:21:01.198640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.202472Z","title":"Proceedings of the 62nd annual meeting of the association for computational linguistics (volume 1: Long papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.202472Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:2c8b888bf7c85e03aee58fc2ef53de926196a4df3b58ef00b912c6fbff7600e3","observation_id":"61b21d51-1c43-424b-8ec0-f55660adf84a","resolution":{"observed_at":"2026-08-05T16:21:01.202472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-08-16T17:36:35.256420Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-08-05T16:21:01.205142Z","title":"arXiv preprint arXiv:2412.13663 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.205142Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:0b9e95bc9de47b979142fc4fbdb755e807c72eba05a7852f8e948c0240e101d3","observation_id":"00335927-62b8-4d52-9611-c2fdcf3ca8fd","resolution":{"observed_at":"2026-08-05T16:21:01.205142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.207714Z","title":"Transactions of the association for computational linguistics , volume=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.207714Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:92359822c5d837722f825b851348eae6d4453a0a0c1d11852708c470a81d527b","observation_id":"04916253-92af-4668-8b79-ecbca3006728","resolution":{"observed_at":"2026-08-05T16:21:01.207714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10267","last_updated":"2025-06-04T12:57:58Z","snapshot_observed_at":"2026-08-16T12:50:25.088186Z","submitted_at":"2025-03-13T11:24:09Z","title":"An Expanded Massive Multilingual Dataset for High-Performance Language Technologies (HPLT)","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10267","snapshot_observed_at":"2026-08-05T16:21:01.210440Z","title":"arXiv preprint arXiv:2503.10267 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.210440Z"},"links":{"cited_paper":"/paper/2503.10267","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:8a33591ae45804ebff735ee8593003c6ccbd2b2400ba7b125d4ffd05e08eaa9a","observation_id":"7bf50d1b-36e7-4898-8a40-a0a1fdb16540","resolution":{"observed_at":"2026-08-05T16:21:01.210440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.213291Z","title":"FOCUS : Effective Embedding Initialization for Monolingual Specialization of Multilingual Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.213291Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:3229f8beb5df33d3fb98483e6db4a347d87a3e76b6bf0ebc5d76fc4de42b62ae","observation_id":"c482fa1e-e01a-46e8-be57-bde2c3647582","resolution":{"observed_at":"2026-08-05T16:21:01.213291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:02.040859Z","title":"Proceedings of the 2013 conference of the North American chapter of the association for computational linguistics: human language technologies , pages=","venue":null,"work_id":"9d07f3c4-3db7-45f1-a3a6-4871999a7acb","year":2013},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.216072Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:4f4eeb5fe7af8e7cd4536fd4127c231b05118ce4692aa9a689a2fcdedcaa247c","observation_id":"c3d3c0dd-def1-4b65-bb88-f80854fb809d","resolution":{"observed_at":"2026-08-05T16:21:02.043966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04303","last_updated":"2024-08-08T08:37:28Z","snapshot_observed_at":"2026-08-19T21:33:21.415627Z","submitted_at":"2024-08-08T08:37:28Z","title":"Trans-Tokenization and Cross-lingual Vocabulary Transfers: Language Adaptation of LLMs for Low-Resource NLP","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.04303","snapshot_observed_at":"2026-08-05T16:21:01.218661Z","title":"arXiv preprint arXiv:2408.04303 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.218661Z"},"links":{"cited_paper":"/paper/2408.04303","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:23c5485b192b8768431eb3901444b2e8672db73d5144e78256a97f41381f1dcb","observation_id":"cc312b04-0bb9-4e89-b639-5846c40d9dfd","resolution":{"observed_at":"2026-08-05T16:21:01.218661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.221435Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.221435Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:2734b673950e96dead34e698523ed1af5883ede9894fd0e5e804412268d17a63","observation_id":"1d44167d-48c2-4aa4-a3ea-bda4a1399e57","resolution":{"observed_at":"2026-08-05T16:21:01.221435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-05T16:21:01.224132Z","title":"arXiv preprint arXiv:2307.08691 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.224132Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:14cfa6dea0a03c5dc64f51ce4533520f970d45c968d1e47636954d50899dbab3","observation_id":"0fbe1a30-0ff5-43b9-8c07-148e1f2557be","resolution":{"observed_at":"2026-08-05T16:21:01.224132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:02.027439Z","title":"O pen S ubtitles2016: Extracting Large Parallel Corpora from Movie and TV Subtitles","venue":null,"work_id":"24a463da-7ecc-44bb-924e-17f4658014a1","year":2016},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.227480Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:d48a3859e98b09a750d12f34c8495bc6c284f0c71afb4864c45db0fbcfb15cd9","observation_id":"6801cac7-a630-4f0c-b127-21d5b1bcc197","resolution":{"observed_at":"2026-08-05T16:21:02.030512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T16:21:01.234183Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.234183Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:fa791e2ca0dbaa55361c090b9e639d5fb1e0754d7a94d5ac339f259d6f0ad0c8","observation_id":"dc0ad509-1145-4aed-872c-63e8e57a3cd3","resolution":{"observed_at":"2026-08-05T16:21:01.234183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.236987Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.236987Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:ab528515cfc02e4ec814c03f9f2ddf54f3309caa0d551e272f9f187ebe472af7","observation_id":"7c63bea4-8637-4464-ac56-299f049a4c41","resolution":{"observed_at":"2026-08-05T16:21:01.236987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04261","last_updated":"2024-12-05T15:41:06Z","snapshot_observed_at":"2026-08-13T14:49:22.470549Z","submitted_at":"2024-12-05T15:41:06Z","title":"Aya Expanse: Combining Research Breakthroughs for a New Multilingual Frontier","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04261","snapshot_observed_at":"2026-08-05T16:21:01.240437Z","title":"arXiv preprint arXiv:2412.04261 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.240437Z"},"links":{"cited_paper":"/paper/2412.04261","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:01ac3718b96a02a48219c14c074185b8ec54c1f84f90a2314c6218e4c8c67e51","observation_id":"e5004f0b-0fda-4919-bd19-8b03331b2c3d","resolution":{"observed_at":"2026-08-05T16:21:01.240437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10497","last_updated":"2025-05-26T17:20:21Z","snapshot_observed_at":"2026-08-16T12:50:19.312921Z","submitted_at":"2025-03-13T15:59:20Z","title":"MMLU-ProX: A Multilingual Benchmark for Advanced Large Language Model Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10497","snapshot_observed_at":"2026-08-05T16:21:01.243283Z","title":"arXiv preprint arXiv:2503.10497 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.243283Z"},"links":{"cited_paper":"/paper/2503.10497","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:f8bdf66221e1d13eef525619bbc18ddae0cd725384df6117de615080643b102e","observation_id":"a5ab1097-0f80-4c81-9db2-e2c56a476596","resolution":{"observed_at":"2026-08-05T16:21:01.243283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05486","last_updated":"2023-05-09T14:36:04Z","snapshot_observed_at":"2026-08-16T15:34:27.039404Z","submitted_at":"2023-05-09T14:36:04Z","title":"MAUPQA: Massive Automatically-created Polish Question Answering Dataset","version":1},"cited_work":{"arxiv_id":"2305.05486","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.05486","snapshot_observed_at":"2026-08-05T16:21:01.781145Z","title":"MAUPQA: Massive Automatically-created Polish Question Answering Dataset","venue":"cs.CL","work_id":"6acd0587-abda-4a2b-b7a3-2ef4d176c527","year":2023},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.246264Z"},"links":{"cited_paper":"/paper/2305.05486","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:8e1d5fd621f2b79ec9f8ae1586face363b50e7312ce69d7750aee27557e26197","observation_id":"891b2d50-c661-4aed-b097-d7d84f8fe7fe","resolution":{"observed_at":"2026-08-05T16:21:01.784503Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.248984Z","title":"1: A Polish Language Model--Development, Insights, and Evaluation , author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.248984Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:c4255b364ebfa94231b393a6fe8409f409d859b3223e0bdb9ff8368a41f6981a","observation_id":"44992e19-f1c8-4061-9fcd-f44632d77951","resolution":{"observed_at":"2026-08-05T16:21:01.248984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.251563Z","title":"Byte Latent Transformer: Patches Scale Better Than Tokens","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.251563Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:30ca1ad8cec82a834b074f2aa1ba7ed0d29354a3d97394badf09211e1a1e0854","observation_id":"48c2a8c1-d236-4d36-8fe0-ee79a3da4b8b","resolution":{"observed_at":"2026-08-05T16:21:01.251563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07955","last_updated":"2025-07-15T09:06:11Z","snapshot_observed_at":"2026-08-19T09:43:53.193377Z","submitted_at":"2025-07-10T17:39:37Z","title":"Dynamic Chunking for End-to-End Hierarchical Sequence Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.07955","snapshot_observed_at":"2026-08-05T16:21:01.254302Z","title":"arXiv preprint arXiv:2507.07955 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.254302Z"},"links":{"cited_paper":"/paper/2507.07955","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:f102b95f674abc1c7d7f702f955500a37d1d4b4560585c31f3d6f5a483574e9a","observation_id":"9cebbb5d-a838-4eec-99b5-915c34068861","resolution":{"observed_at":"2026-08-05T16:21:01.254302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.05628","last_updated":"2021-06-09T07:57:32Z","snapshot_observed_at":"2026-08-16T18:59:33.471552Z","submitted_at":"2020-12-10T12:27:16Z","title":"As Good as New. How to Successfully Recycle English GPT-2 to Make Models for Other Languages","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.05628","snapshot_observed_at":"2026-08-05T16:21:01.257362Z","title":"how to successfully recycle English GPT-2 to make models for other languages , author=","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.257362Z"},"links":{"cited_paper":"/paper/2012.05628","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:fcf15029c9ebee0151a93a58874b211e561e72fdf6bfc2da9ed0e621d21c0ecb","observation_id":"a587d2e5-c823-4d67-81d6-0599f3e25fb1","resolution":{"observed_at":"2026-08-05T16:21:01.257362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.260150Z","title":"Language Contamination Helps Explains the Cross-lingual Capabilities of E nglish Pretrained Models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.260150Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:d997b6d4608c5b3a2166573e2dd0a9ea5459bc925a152149cd0a644a7aa72b2f","observation_id":"3a5f20bc-cdc2-406c-a35c-fad2e8cd13fb","resolution":{"observed_at":"2026-08-05T16:21:01.260150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.263426Z","title":"Knowledge Neurons in Pretrained Transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.263426Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:a61cb2c12841cc3782732e422de59c4fcc1f06ea3dd68d6d7df53930d7bd1682","observation_id":"e91c1fe9-6640-4ac9-8940-ee1838760ce6","resolution":{"observed_at":"2026-08-05T16:21:01.263426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-long.207","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"T ok A lign: Efficient Vocabulary Adaptation via Token Alignment","venue":null,"work_id":"15c3f77b-ac62-4cce-aac1-5f80379fddcd","year":2025},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.266085Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:afff25e7a752eefb76cab6248a1902ed164cca83a396c997782e40b5b213d77f","observation_id":"92ef4383-3e68-4435-85d6-53940f836fb4","resolution":{"observed_at":"2026-08-05T16:21:01.473457Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:02.014260Z","title":"and Vuli\\'","venue":null,"work_id":"8f192cf9-b7bf-4554-9464-d0ebfc3b63c3","year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.268756Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:7e613f26e061383cf8da4c25a35932af7a42f2f5e52d4db3f30c1592163859f1","observation_id":"030befc0-a9ab-4537-b0ec-2f4aab692056","resolution":{"observed_at":"2026-08-05T16:21:02.017550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16867","last_updated":"2023-11-29T19:45:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T15:12:47Z","title":"The Falcon Series of Open Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16867","snapshot_observed_at":"2026-08-05T16:21:01.271388Z","title":"arXiv preprint arXiv:2311.16867 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.271388Z"},"links":{"cited_paper":"/paper/2311.16867","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:52b2cc6ae934940ce0f16c1aa202423768ae8f9c48f11732f737d7f40a0aa83c","observation_id":"db883cdf-bc94-43f2-ae21-bff64860efab","resolution":{"observed_at":"2026-08-05T16:21:01.271388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.274075Z","title":"Large Vocabulary Size Improves Large Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.274075Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:a31b910d70e725e8ba6164c1b2229733f12c87adbc7dbefbca5efe3577651665","observation_id":"4979cf81-5de4-4737-bc9e-dc5775f63727","resolution":{"observed_at":"2026-08-05T16:21:01.274075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.276862Z","title":"XLM - V : Overcoming the Vocabulary Bottleneck in Multilingual Masked Language Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.276862Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:53b8230c260c30af8636a3bb793117ba82959f16612b7d17fb0eb901b02ea019","observation_id":"c05447a6-f763-4b31-b977-94033afb0977","resolution":{"observed_at":"2026-08-05T16:21:01.276862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.279619Z","title":"On the Cross-lingual Transferability of Monolingual Representations","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.279619Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:8710e7e14d2033d3825d304e586c7f7bf57cd0f18d1932f534466b1321a2a135","observation_id":"0c59003a-8b8d-4a15-ab1d-32b232bfc68d","resolution":{"observed_at":"2026-08-05T16:21:01.279619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:02.005608Z","title":"Cross-lingual Transfer of Monolingual Models","venue":null,"work_id":"73f94a25-bc88-406e-982b-c52ab4a986d4","year":2022},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.282436Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:476dc868e7f9c19afcc5fee5a5b9d9d1a6d2251084632bdc1b4a147234bf6052","observation_id":"d0e94e2c-a751-45e1-98de-e03ddaaf2724","resolution":{"observed_at":"2026-08-05T16:21:02.008708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.285138Z","title":"OFA : A Framework of Initializing Unseen Subword Embeddings for Efficient Large-scale Multilingual Continued Pretraining","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.285138Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:c8c2edfb19254e572ffe094f25a986be5daca0f8edafc3d03acf2608dc4a6794","observation_id":"c546fb82-25bc-4d9c-9e21-9b343f60bdf1","resolution":{"observed_at":"2026-08-05T16:21:01.285138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03477","last_updated":"2023-10-05T11:45:29Z","snapshot_observed_at":"2026-08-18T18:55:49.027109Z","submitted_at":"2023-10-05T11:45:29Z","title":"Tik-to-Tok: Translating Language Models One Token at a Time: An Embedding Initialization Strategy for Efficient Language Adaptation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03477","snapshot_observed_at":"2026-08-05T16:21:01.287738Z","title":"arXiv preprint arXiv:2310.03477 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.287738Z"},"links":{"cited_paper":"/paper/2310.03477","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:cbd4fdeddcd3c3823b0a0fc2791ef9d97642a786515006ee9e5e7f1ac7585685","observation_id":"81a440b6-2571-4595-9fb3-0738d6ccb310","resolution":{"observed_at":"2026-08-05T16:21:01.287738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.290727Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 4: Student Research Workshop)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.290727Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:a1ee41020450a22ca9d8003ab62af7f4a83b4ea72908fb8e3a4718eeedbd6bd6","observation_id":"14f31a69-9209-4e00-b8aa-284c0b9f86e0","resolution":{"observed_at":"2026-08-05T16:21:01.290727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.293390Z","title":"G lo V e: Global Vectors for Word Representation","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.293390Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:ef434fefc758cb9265a3944e02db34d8ce2db52e9efa641d4ab08cbb8aca6d90","observation_id":"72a656ee-34b8-4802-b290-c807698f0fd1","resolution":{"observed_at":"2026-08-05T16:21:01.293390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.09626","last_updated":"2023-01-23T18:56:12Z","snapshot_observed_at":"2026-08-20T05:10:15.744030Z","submitted_at":"2023-01-23T18:56:12Z","title":"Efficient Language Model Training through Cross-Lingual and Progressive Transfer Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.09626","snapshot_observed_at":"2026-08-05T16:21:01.296837Z","title":"arXiv preprint arXiv:2301.09626 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.296837Z"},"links":{"cited_paper":"/paper/2301.09626","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:255bb901bf429cf8215bad59c3cb47f7bdb7e214dce543023b66542c018dcac8","observation_id":"69ed66f7-ee74-4f05-b147-d2ecfbc2ebd7","resolution":{"observed_at":"2026-08-05T16:21:01.296837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.299889Z","title":"Mini-Model Adaptation: Efficiently Extending Pretrained Models to New Languages via Aligned Shallow Training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.299889Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:f2412bfb165f0454c247576b0083cd23ce5fa227059474a7b0da55075f200ce9","observation_id":"cf8cc0e7-55ec-4e32-874d-ce8d274927cc","resolution":{"observed_at":"2026-08-05T16:21:01.299889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.997565Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"06ae0f8a-e8cc-4b14-91a4-0ba25c3f14e2","year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.302699Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:48abbbc09b2c13c0647c90472c7a4a6d39ab34c0bad150c0cfefa59322c6828f","observation_id":"3988e994-a9cf-4abd-9067-ea69768000e9","resolution":{"observed_at":"2026-08-05T16:21:02.000387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.305400Z","title":"Proceedings of the 40th International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.305400Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:47b41003e9bf7763fa4f8b0856acd6098773c8d361bbadc61f27caedd90a7dbe","observation_id":"f5642a25-a4dc-4769-869a-4bfd458cb07d","resolution":{"observed_at":"2026-08-05T16:21:01.305400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.983957Z","title":"Post \\#9194 on Telegram Channel Zaduha","venue":null,"work_id":"cfac14aa-9b15-40fa-8637-7103cf054b44","year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.308372Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:5fd52b840362c07e9ab9a36e1301b2f3f7401f7b8fbdb422cfc7dcd7c44e7ac1","observation_id":"ee3de748-96a4-46a5-8dac-8de76c50dfb1","resolution":{"observed_at":"2026-08-05T16:21:01.986875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.311017Z","title":"doi:10.5281/zenodo.12608602 , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.311017Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:b7bd8a820cb73f9240554af4c55555e680e1129c50205a2a7ca3c546301dd52c","observation_id":"3e87df09-1657-4af5-a5c6-323f66292797","resolution":{"observed_at":"2026-08-05T16:21:01.311017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.313844Z","title":"The Belebele Benchmark: a Parallel Reading Comprehension Dataset in 122 Language Variants","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.313844Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:08b9474bb9b19ed4c51b4ab5c52ac7045d3ca2fe4c6cd349c3b6e6ae0502ac0e","observation_id":"50ea3b68-7072-4dba-adaa-58f8da8b6ad7","resolution":{"observed_at":"2026-08-05T16:21:01.313844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.316571Z","title":"Global MMLU : Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.316571Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:27e9c6e67ac3a3a1c8200ad22d26015a037494cd13c9f40b9cce5fc1633bf10f","observation_id":"30a27b29-735e-4885-9a79-a629fe1d3b32","resolution":{"observed_at":"2026-08-05T16:21:01.316571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-05T16:21:01.319111Z","title":"arXiv preprint arXiv:2009.03300 , year=","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.319111Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:db7beeb6b353ce94292b8b66ee3bb51059887d7224d8b8640ddf99fa675a4094","observation_id":"f84f553b-4144-4414-9c27-db7169f9c335","resolution":{"observed_at":"2026-08-05T16:21:01.319111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.04672","last_updated":"2022-08-25T17:10:53Z","snapshot_observed_at":"2026-07-06T13:29:47.927628Z","submitted_at":"2022-07-11T07:33:36Z","title":"No Language Left Behind: Scaling Human-Centered Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.04672","snapshot_observed_at":"2026-08-05T16:21:01.321963Z","title":"2207.04672 , archiveprefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.321963Z"},"links":{"cited_paper":"/paper/2207.04672","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:8afae54e9c0f226c2fd3dce1ad4a071c05444a90ea60ce4ce063f2df54edcc77","observation_id":"e364a240-ce2b-4c2b-8f2c-d65eb34f3377","resolution":{"observed_at":"2026-08-05T16:21:01.321963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.971227Z","title":null,"venue":null,"work_id":"8afc759c-b896-4a18-8c0d-3300d920bd62","year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.324532Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:f2a7971902364e9f93c7508c803fa5610739c5b088408b9a4eda2aa9a55dfb2f","observation_id":"d206d75f-d37b-468e-8434-88a0c283e284","resolution":{"observed_at":"2026-08-05T16:21:01.974275Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.01382","last_updated":"2019-09-14T19:09:55Z","snapshot_observed_at":"2026-08-18T05:03:41.858758Z","submitted_at":"2019-02-04T18:48:45Z","title":"The FLoRes Evaluation Datasets for Low-Resource Machine Translation: Nepali-English and Sinhala-English","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.01382","snapshot_observed_at":"2026-08-05T16:21:01.327203Z","title":"arXiv preprint arXiv:1902.01382 , year=","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.327203Z"},"links":{"cited_paper":"/paper/1902.01382","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:a04124f32f29e7d755c0f9982360b44d067c0fdf084a115c6db48978c4cd2df2","observation_id":"c93f5651-7842-449a-b46c-6f89c30adddb","resolution":{"observed_at":"2026-08-05T16:21:01.327203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.329971Z","title":"On the Path to Make U krainian a High-Resource Language","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.329971Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:a5e7b0158cf438b45af29c0348bd44ffe2bd02b02f9b191cada8d322f36b87d5","observation_id":"42b0270e-b169-4dfd-9755-9a78e8928bae","resolution":{"observed_at":"2026-08-05T16:21:01.329971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-20T15:31:01.041088Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-05T16:21:01.332651Z","title":"arXiv preprint arXiv:2309.16609 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.332651Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:79638b0dfd363b0cd10d3506b89e60ab068707ec780ac5f9b0e2894aa376b574","observation_id":"c768bd2f-c9de-44ac-aed2-1333feadbfe9","resolution":{"observed_at":"2026-08-05T16:21:01.332651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.335192Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.335192Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:c00c403603440e2f00fa1c8c16f863e7d0eaaf70ee575f337a5969af5764dc3a","observation_id":"e0b9d699-f9b3-42d8-8093-d64ec426ca0c","resolution":{"observed_at":"2026-08-05T16:21:01.335192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.958105Z","title":"Proceedings of the 15th International Conference on Recent Advances in Natural Language Processing - Natural Language Processing in the Generative AI era , month =","venue":null,"work_id":"75857744-07f1-4a8e-af57-51aa2b708b08","year":2025},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.337925Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:dc2b433af804b14dd0570d288e95040929b17461c4b5613bc847dc04b2e8eb51","observation_id":"7171439d-dfa3-499b-aaf1-712a489293ee","resolution":{"observed_at":"2026-08-05T16:21:01.961196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05864","last_updated":"2025-03-03T14:30:07Z","snapshot_observed_at":"2026-08-21T12:44:02.977289Z","submitted_at":"2024-10-08T09:53:35Z","title":"From Tokens to Words: On the Inner Lexicon of LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05864","snapshot_observed_at":"2026-08-05T16:21:01.340525Z","title":"arXiv preprint arXiv:2410.05864 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.340525Z"},"links":{"cited_paper":"/paper/2410.05864","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:f92e18879d9b7143ea93224d94a4baea8d79c67ae2d6df02d8dd9f6c8bdcca36","observation_id":"5e1201c7-9dab-4df3-9929-d878879a25de","resolution":{"observed_at":"2026-08-05T16:21:01.340525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.950204Z","title":"The Fourteenth International Conference on Learning Representations , year=","venue":null,"work_id":"f1cd142a-235d-4d93-a88b-cabf6d37ac9b","year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.343253Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:646e44870c7f0554550b25ae873542d452c0b46612ecfc3009ed07a0ef67983a","observation_id":"ad5d53f3-6973-475f-bb3c-d629e0576476","resolution":{"observed_at":"2026-08-05T16:21:01.952972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.941775Z","title":"Forty-first International Conference on Machine Learning , year=","venue":null,"work_id":"9947c213-eb21-47ae-9f41-3bec1ba54794","year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.345899Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:c4fd7d8f987ce809f4ca47a616e4bb24e5af1c6d918c0827ef72474b806717dc","observation_id":"e10fa296-1f49-46b8-a6e4-efbb84d21f5b","resolution":{"observed_at":"2026-08-05T16:21:01.944846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.348448Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.348448Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:8831388e33c0b69593d523d4952bae63a5403d93c406c47ba4872d60ac1f15ae","observation_id":"b3445285-c3b7-4dd1-9b3a-6a61edf99da1","resolution":{"observed_at":"2026-08-05T16:21:01.348448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.350958Z","title":"Saiful and Mubasshir, Kazi and Li, Yuan-Fang and Kang, Yong-Bin and Rahman, M","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.350958Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:248f883550950fb7bbe5284c200cbb64220e5575d9e2a74acecd2369362fc9d8","observation_id":"3d75597c-11f9-4b17-a673-89794eef87c6","resolution":{"observed_at":"2026-08-05T16:21:01.350958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12404","last_updated":"2025-02-18T00:39:30Z","snapshot_observed_at":"2026-08-19T12:53:11.900805Z","submitted_at":"2025-02-18T00:39:30Z","title":"WMT24++: Expanding the Language Coverage of WMT24 to 55 Languages & Dialects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12404","snapshot_observed_at":"2026-08-05T16:21:01.353796Z","title":"2502.12404 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.353796Z"},"links":{"cited_paper":"/paper/2502.12404","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:e57c2fb1113273adc081c690e5e53560fc45733d119547ff9c74929ba5baf192","observation_id":"ce5c6476-d373-4766-a7a2-18a5bcb85498","resolution":{"observed_at":"2026-08-05T16:21:01.353796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.929125Z","title":"2018 , editor =","venue":null,"work_id":"1a07dbc8-8fed-40d5-b65a-dc14ad88ce27","year":2018},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.356547Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:edea8e7ad82c0b5e4779ccb9733ab89b9abf5254f39ee8ec80fc6bd619d1efa9","observation_id":"2931dd0c-0975-4ab0-8a08-6eb54bb572a2","resolution":{"observed_at":"2026-08-05T16:21:01.931937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.920823Z","title":null,"venue":null,"work_id":"8de30c5d-ad9b-4200-87fb-b68af4dbea8b","year":2026},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.359023Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:9bcfbad8cec3e3c57a896e7e07562f90d0f9664a9dd3e2d5092c44730386a343","observation_id":"33576aa9-2a39-4d10-8e48-d56ef9f811e8","resolution":{"observed_at":"2026-08-05T16:21:01.923526Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-05T16:21:01.361606Z","title":"arXiv preprint arXiv:1503.02531 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.361606Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:4d4b37eb10e9a4e73130c077794f9d6d53f6bd4ffbb2b3b21486050ab3fcd8b4","observation_id":"6487e22e-e8da-4138-8673-466aba0b3e89","resolution":{"observed_at":"2026-08-05T16:21:01.361606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.912532Z","title":null,"venue":null,"work_id":"895c4513-507f-4e10-8ade-b86de23359b7","year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.364198Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:6b7152648b32bebfb2e1d42b296b93d9ea1b03ed733734ce69640e8ee00635d7","observation_id":"6b79eea0-1912-40e8-a5fa-1d4fa857d683","resolution":{"observed_at":"2026-08-05T16:21:01.915612Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2026.findings-acl.2067","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.409103Z","title":"Recovered in Translation: Efficient Pipeline for Automated Translation of Benchmarks and Datasets","venue":null,"work_id":"b829288c-c762-47e2-9dfd-e4d99ef30c85","year":2026},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.366909Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:6b6ac5fff7dc02d74dc33d95e14630cc860df8e7e517fbf023de7e16d74dff6b","observation_id":"44ac07b8-c7bb-4342-9e8d-d48aebc9a356","resolution":{"observed_at":"2026-08-05T16:21:01.414310Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.370651Z","title":"arXiv preprint arXiv:2512.15586 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.370651Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:5e9490bd04003c33f25de5ea8d7674400f024ae93fba80f7d57593b2e01c6875","observation_id":"1afb7ab6-2875-4118-a7cc-a8c887885c81","resolution":{"observed_at":"2026-08-05T16:21:01.370651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.373298Z","title":"B y T 5: Towards a Token-Free Future with Pre-trained Byte-to-Byte Models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.373298Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:0de9b02d4a51f07fd76d85c8292793eac6950c2f647a515de14fffcca7d2dc7c","observation_id":"55e569fc-4b24-433a-902b-d4ff372483f8","resolution":{"observed_at":"2026-08-05T16:21:01.373298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.21954","last_updated":"2026-05-10T14:18:57Z","snapshot_observed_at":"2026-08-05T12:57:01.683426Z","submitted_at":"2025-10-24T18:27:36Z","title":"Model-Aware Tokenizer Transfer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.21954","snapshot_observed_at":"2026-08-05T16:21:01.376242Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.376242Z"},"links":{"cited_paper":"/paper/2510.21954","citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:5dda09091c9e62de8e9ff7e90837108c0a7680abcdbeef1cbda94b22b9e54660","observation_id":"f71265f7-83fb-4315-b54a-7a1d5fd7969d","resolution":{"observed_at":"2026-08-05T16:21:01.376242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.904357Z","title":"Universal","venue":null,"work_id":"eda6721f-bc32-4e82-ab11-067996a4cc24","year":null},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.379227Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:393248e96ac902adc0e86bb5e6a158efe7bf0ccc1f562c659417ff74b808aee8","observation_id":"60534f36-93a4-43ce-b61e-cd452b12605a","resolution":{"observed_at":"2026-08-05T16:21:01.907186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.896085Z","title":null,"venue":null,"work_id":"d7a879e3-7bb2-4664-a69e-9057163243e3","year":2025},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.381884Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:1690679d91e600168caf6a1878a408cf5b009690825e56bd17992e7b04dcb173","observation_id":"1bd894d1-46ba-4303-ada3-75938dbbe76b","resolution":{"observed_at":"2026-08-05T16:21:01.899001Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:21:01.887611Z","title":"Cross-Tokenizer","venue":null,"work_id":"a474cae3-dde4-44bf-a628-b18a6a147130","year":2026},"citing_paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-05T16:21:01.384486Z"},"links":{"citing_paper":"/paper/2608.03599"},"observation_digest":"sha256:b572eb4be5054fd386f7cd5595ef1b68052c81522d46a34d074a65df7ef6d5d2","observation_id":"659e2f4a-0cc0-47cb-9e35-ecc4ba002077","resolution":{"observed_at":"2026-08-05T16:21:01.890435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.03599","last_updated":"2026-08-04T12:51:21Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T13:34:36.904882Z","submitted_at":"2026-08-04T12:51:21Z","title":"Disentangling Language Modeling and Boundaries"},"reference_resolution":{"displayed":77,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":60,"verified_exact":2,"verified_fuzzy":14},"total_outbound_references":77},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 77 of 77 outbound references and 0 inbound Pith citation observations for arXiv:2608.03599."}