{"as_of":"2026-08-22T00:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8e681fea8d19c42e29358f269ac596a482b210e0b023816f5c52a16dacb50b8e","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:58:14.970827Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T22:58:06.361703Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-25T05:15:22.246413Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.06607","snapshot_observed_at":"2026-08-02T22:58:06.361703Z","title":"Training-free tokenizer transplantation via orthogonal matching pursuit","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.15382","last_updated":"2026-05-28T08:46:27Z","snapshot_observed_at":"2026-08-16T04:02:24.978329Z","submitted_at":"2026-02-17T06:31:53Z","title":"The Vision Wormhole: Latent-Space Communication in Heterogeneous Multi-Agent Systems","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-02T22:58:06.361703Z"},"links":{"cited_paper":"/paper/2506.06607","citing_paper":"/paper/2602.15382"},"observation_digest":"sha256:dac97f61b4919cc5f12eea126cd1c4748b52c537f26dff234dd50431a9587e70","observation_id":"58516bb2-ef18-4698-9005-a2189dbd1a73","resolution":{"observed_at":"2026-08-02T22:58:06.361703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"cited_work":{"arxiv_id":"2506.06607","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.06607","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Training-free tokenizer transplantation via orthogonal matching pursuit","venue":null,"work_id":"535c37bf-256d-43dc-a51e-9fc99f0ded09","year":2025},"citing_paper":{"arxiv_id":"2605.23645","last_updated":"2026-05-22T13:59:13Z","snapshot_observed_at":"2026-08-19T05:06:20.028956Z","submitted_at":"2026-05-22T13:59:13Z","title":"Learning Through Noise: Why Subliminal Learning Works and When It Fails","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-25T05:14:46.278482Z"},"links":{"cited_paper":"/paper/2506.06607","citing_paper":"/paper/2605.23645"},"observation_digest":"sha256:ad822806a0161ac0f7e276157bfbc3c63919976ecf101c353b38b0cb563cff62","observation_id":"61c90512-3b4d-44ec-83aa-a3edb2437f03","resolution":{"observed_at":"2026-05-25T05:15:22.248856Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.06607","snapshot_observed_at":"2026-08-01T23:50:15.197912Z","title":"Charles Goddard and Fernando Fernandes Neto","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15232","last_updated":"2026-07-16T17:32:38Z","snapshot_observed_at":"2026-08-19T01:31:35.031839Z","submitted_at":"2026-07-16T17:32:38Z","title":"In-Place Tokenizer Expansion for Pre-trained LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T23:50:15.197912Z"},"links":{"cited_paper":"/paper/2506.06607","citing_paper":"/paper/2607.15232"},"observation_digest":"sha256:15543775be428e68b06f7a9f04e64f4c47e6bfb8c9c15e36579592b00983ab16","observation_id":"0900b006-84b7-4846-a024-4497586a2d37","resolution":{"observed_at":"2026-08-01T23:50:15.197912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.06607/citation-record","integrity":"/paper/2506.06607/integrity","json":"/paper/2506.06607/citation-record.json","paper":"/paper/2506.06607"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.05109","last_updated":"2024-10-07T16:21:29Z","snapshot_observed_at":"2026-08-17T14:00:35.798553Z","submitted_at":"2024-02-07T18:58:50Z","title":"Hydra: Sequentially-Dependent Draft Heads for Medusa Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05109","snapshot_observed_at":"2026-08-07T05:58:14.817137Z","title":"Hydra: Sequentially-dependent draft heads for medusa decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.817137Z"},"links":{"cited_paper":"/paper/2402.05109","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:1560061c80a3c1402d46435c1eee1484bd14ae724b8975621105c6512b7baf13","observation_id":"928c284b-91da-460b-b551-475d37b43ba8","resolution":{"observed_at":"2026-08-07T05:58:14.817137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:14.822539Z","title":"On the cross-lingual transferability of monolingual representations","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.822539Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:bfc12afb6f5f4360edba9b74adbf22b392bab10818eb871b0867e456e4e949e8","observation_id":"033c0afc-f711-4761-a88a-fb940e2fc4d8","resolution":{"observed_at":"2026-08-07T05:58:14.822539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12030","last_updated":"2025-01-27T10:02:44Z","snapshot_observed_at":"2026-08-16T14:17:23.362933Z","submitted_at":"2024-02-19T10:37:29Z","title":"Towards Cross-Tokenizer Distillation: the Universal Logit Distillation Loss for LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12030","snapshot_observed_at":"2026-08-07T05:58:14.827341Z","title":"Towards cross-tokenizer distillation: the universal logit distillation loss for llms.arXiv preprint arXiv:2402.12030 , 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.827341Z"},"links":{"cited_paper":"/paper/2402.12030","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:5062ae08545c219a519cd5b8e1e98dcd391a62012f685c036763f19885977d55","observation_id":"50bed358-f5b1-4353-81a8-e557d93e5f8b","resolution":{"observed_at":"2026-08-07T05:58:14.827341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:14.832160Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.832160Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:6c1091907077337c7a0c0338df69279f65b074f672ca04851181a737f85be46e","observation_id":"68dff718-b5e4-4bf2-8118-67ccab72fa80","resolution":{"observed_at":"2026-08-07T05:58:14.832160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-07T05:58:14.836913Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.836913Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:eaf0183f9334c0894388f3a60fa0069252f06c946968e99d54d08283c2029cb2","observation_id":"e93cd026-41ca-47f7-ac29-7e11ab7c0c50","resolution":{"observed_at":"2026-08-07T05:58:14.836913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T05:58:14.841736Z","title":"Training verifiers to solve math word problems.arXiv preprint arXiv:2110.14168 , 2021","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.841736Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:657463c13e48139819cb4bb8b50e2738efa4e327cdcfbef9b1cd5f56a0f55188","observation_id":"1adc318c-a0b6-41b8-9e73-9f7171bec2d5","resolution":{"observed_at":"2026-08-07T05:58:14.841736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.04087","last_updated":"2018-01-30T14:41:51Z","snapshot_observed_at":"2026-08-19T18:44:27.052676Z","submitted_at":"2017-10-11T14:24:28Z","title":"Word Translation Without Parallel Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.04087","snapshot_observed_at":"2026-08-07T05:58:14.846758Z","title":"Word translation without parallel data, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.846758Z"},"links":{"cited_paper":"/paper/1710.04087","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:aaa2b3b931d0808f2a159c4f4377f27a9e878425e4cde91247791dabec5650e5","observation_id":"002667a8-3069-4df8-858b-b7b9ce5119b2","resolution":{"observed_at":"2026-08-07T05:58:14.846758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.05053","last_updated":"2018-09-13T16:39:53Z","snapshot_observed_at":"2026-08-15T09:55:18.674959Z","submitted_at":"2018-09-13T16:39:53Z","title":"XNLI: Evaluating Cross-lingual Sentence Representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.05053","snapshot_observed_at":"2026-08-07T05:58:14.851742Z","title":"Xnli: Evaluating cross-lingual sentence representations.arXiv preprint arXiv:1809.05053, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.851742Z"},"links":{"cited_paper":"/paper/1809.05053","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:1a1708016843222517b4630dd0ab59f4c4a1cc6b043393f71c6dd407ea61b2b0","observation_id":"8f7b7152-30c4-4cf0-b72d-9fdba98d6791","resolution":{"observed_at":"2026-08-07T05:58:14.851742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:14.856183Z","title":"FOCUS: Effective embedding initialization for mono- lingual specialization of multilingual models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.856183Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:8f77c844bed66358c3dc8968098f9bb6254894395f40be7f78ce2dc143374486","observation_id":"d692f897-be79-4db0-b2f0-5e665678b35b","resolution":{"observed_at":"2026-08-07T05:58:14.856183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:14.860161Z","title":"How contextual are contextualized word representations? Comparing the geometry of BERT, ELMo, and GPT-2 embeddings","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.860161Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:44afe98927168e83d89fb2ab66ff460f7a94a2d4229152ff2c2302003701281e","observation_id":"058c2288-36ac-4d8c-b7e3-4b2add9d4930","resolution":{"observed_at":"2026-08-07T05:58:14.860161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:14.864207Z","title":"A framework for few-shot language model evaluation, 12 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.864207Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:38f85e02c2c7dd472bfba3c788f628a80fdc01e3140cefca288a583bc57274ec","observation_id":"83f94599-70c4-4768-ae1c-fd9dd898640d","resolution":{"observed_at":"2026-08-07T05:58:14.864207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:14.868026Z","title":"Fast vocabulary transfer for language model compression","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.868026Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:94b778e133b69e7ab49eb4b5843609c541fe4e6c5c1e01cb079c7f3e3b93b0bf","observation_id":"eb999d92-3e15-4585-ba1e-728153a430bb","resolution":{"observed_at":"2026-08-07T05:58:14.868026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:14.872179Z","title":"Arcee‘s MergeKit: A toolkit for merg- ing large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.872179Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:6313a12eb3f6a6b0101e8ca6b7e040f15c16db9930833eea9611416bbffd4b11","observation_id":"85ef42d2-9731-4b2d-b562-0920a58f24cf","resolution":{"observed_at":"2026-08-07T05:58:14.872179Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T05:58:14.876220Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783 , 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.876220Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:74a36e6ac830d70bdf2a78aeb67829df44951040706dfe717b10acf9cd437895","observation_id":"9be117e3-aefd-490f-9b12-2d12162d9d26","resolution":{"observed_at":"2026-08-07T05:58:14.876220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T05:58:14.880047Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.880047Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:a43c2cf535669c7addb82b34fb339027e5717ba5353770557ce13c217fc4ce5a","observation_id":"0cacedb0-36f1-44c5-83d8-e8bb3bf565cc","resolution":{"observed_at":"2026-08-07T05:58:14.880047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:15.712674Z","title":"Initializing new word embeddings for pretrained language models, 2021","venue":null,"work_id":"935b34d3-22ac-4c07-897a-d37bd971e619","year":2021},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.884285Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:cf41cb882231a36130c60e4d9ce504e4dd728b01db693c4725aed0ca251ef119","observation_id":"69ea6c8f-7257-487d-aee5-9839d19ade88","resolution":{"observed_at":"2026-08-07T05:58:15.717650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-07T05:58:14.890598Z","title":"Distilling the knowledge in a neural network","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.890598Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:26b4aa008ff63948f876ea4b273e1add9658772634c6844809986fd2ca570bd4","observation_id":"b2b38b97-6d5b-467f-9704-8ad54edbe3a0","resolution":{"observed_at":"2026-08-07T05:58:14.890598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:15.698727Z","title":"Vocab transplantation tool (github repository), 2025","venue":null,"work_id":"239ad88c-7609-4ea7-b648-e78a388ada7e","year":2025},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.894720Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:b88383430ba18f8f7b780ba420f87884506d41f35331ec2b0f0e6348e4f61c99","observation_id":"b785e3ba-54eb-4948-92ed-72bfb5a036c4","resolution":{"observed_at":"2026-08-07T05:58:15.702868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00873","last_updated":"2025-02-02T18:55:26Z","snapshot_observed_at":"2026-08-17T22:25:22.595447Z","submitted_at":"2025-02-02T18:55:26Z","title":"Language Models Use Trigonometry to Do Addition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00873","snapshot_observed_at":"2026-08-07T05:58:14.898944Z","title":"Language models use trigonometry to do addition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.898944Z"},"links":{"cited_paper":"/paper/2502.00873","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:47d89b2e3c0583e1dd89ea4ecbeb3d2efb3be27914b34c137d28216a09c58f80","observation_id":"96148bfd-984b-4198-a023-be104c764a7c","resolution":{"observed_at":"2026-08-07T05:58:14.898944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:15.684641Z","title":"Cross-lingual alignment methods for multilingual BERT: A comparative study","venue":null,"work_id":"e17f4bb7-98cb-4d61-b64a-763596cb6acb","year":2020},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.903037Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:58f4c34717b4c2b38784784ab5dff2e2eb6dcd8d38371b228dd7e5e83fb76c89","observation_id":"e52b866a-3340-47cb-a1eb-06b9cf21705a","resolution":{"observed_at":"2026-08-07T05:58:15.689266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21073","last_updated":"2025-07-15T12:15:41Z","snapshot_observed_at":"2026-08-21T17:17:01.091972Z","submitted_at":"2025-03-27T01:17:06Z","title":"Shared Global and Local Geometry of Language Model Embeddings","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21073","snapshot_observed_at":"2026-08-07T05:58:14.907095Z","title":"Shared global and local geometry of language model embeddings, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.907095Z"},"links":{"cited_paper":"/paper/2503.21073","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:5e512ba7493c6579cc29daf87cd92bf7d801bb7e5a05961d8174326fb90dbbf8","observation_id":"bbe0ba58-9f38-4d09-804c-726e2b9f7f3b","resolution":{"observed_at":"2026-08-07T05:58:14.907095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:15.668108Z","title":"Fast inference from transformers via speculative decoding","venue":null,"work_id":"20f67453-d3bc-47a7-9bed-fe9a5ded2a5a","year":2023},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.911404Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:596135b4b0c7d75175be8c5c7af3faab21ec31574d90635f3ebc13b31b41628f","observation_id":"6260b57f-4983-4764-96fc-d944206bb7f9","resolution":{"observed_at":"2026-08-07T05:58:15.673296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11794","last_updated":"2025-04-21T17:48:15Z","snapshot_observed_at":"2026-08-19T17:37:52.818614Z","submitted_at":"2024-06-17T17:42:57Z","title":"DataComp-LM: In search of the next generation of training sets for language models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11794","snapshot_observed_at":"2026-08-07T05:58:14.915529Z","title":"Dimakis, Yair Carmon, Achal Dave, Ludwig Schmidt, and Vaishaal Shankar","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.915529Z"},"links":{"cited_paper":"/paper/2406.11794","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:ee59cd33ee9358ac0b01170ab067b4be0ae7fbc128d9240db1d440d92ed80589","observation_id":"11436aa8-83ae-40c2-b9d5-6952b54001ff","resolution":{"observed_at":"2026-08-07T05:58:14.915529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2016.77322","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:15.298456Z","title":null,"venue":null,"work_id":"685d5673-ae49-4c3e-bb30-454c75b39313","year":2016},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.919909Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:3878ed180c5d290d8aef8ee2bd02050bc42b77bff3c21f35ceaa855cb54b1038","observation_id":"9a3283ac-d4c3-4173-a85f-74defbd3e452","resolution":{"observed_at":"2026-08-07T05:58:15.306270Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1301.3781","last_updated":"2013-09-07T00:30:40Z","snapshot_observed_at":"2026-07-06T03:04:11.148340Z","submitted_at":"2013-01-16T18:24:43Z","title":"Efficient Estimation of Word Representations in Vector Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1301.3781","snapshot_observed_at":"2026-08-07T05:58:14.924229Z","title":"Efficient estimation of word representations in vector space.arXiv preprint arXiv:1301.3781 , 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.924229Z"},"links":{"cited_paper":"/paper/1301.3781","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:75ba48bcb8176592e275371f3cc5cd04722100fd8c02604157b5eb94fa3e7276","observation_id":"53fa2ef2-a747-4dc7-8151-ce117eb72c78","resolution":{"observed_at":"2026-08-07T05:58:14.924229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:15.652881Z","title":"WECHSEL: Effective initialization of subword embeddings for cross-lingual transfer of monolingual language models","venue":null,"work_id":"83a215c3-e5c3-4bcf-854d-74eed812bac2","year":2022},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.928584Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:fbcd4b4c6231f1e9509e1b7af9325bc5a87fee5dcfc30e59cf5a2e5aba33b4ae","observation_id":"eaeed1c2-c554-4b1b-9e84-03f3fc41b516","resolution":{"observed_at":"2026-08-07T05:58:15.657431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:14.936655Z","title":"Zero-shot tokenizer transfer, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.936655Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:7efb4bcbec36a3fbcc71cfd6547ded1bc1a9d555df53e2eb11d7d145a4416e73","observation_id":"3b6c7dec-344c-44f5-b291-015cdaace40d","resolution":{"observed_at":"2026-08-07T05:58:14.936655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:15.620780Z","title":"Efficient language model training through cross-lingual and progressive transfer learning, 2023","venue":null,"work_id":"4dfbfd82-4daa-4019-90b6-79c402196c2a","year":2023},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.942054Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:302d35af7d0920e2a9af9e5387896bc999173faab222c24c9b0f4c19f999ce82","observation_id":"1529d395-7d0f-43e9-bd9d-e4eeec4dfc35","resolution":{"observed_at":"2026-08-07T05:58:15.625219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06031","last_updated":"2016-06-20T09:37:17Z","snapshot_observed_at":"2026-08-17T07:59:38.221655Z","submitted_at":"2016-06-20T09:37:17Z","title":"The LAMBADA dataset: Word prediction requiring a broad discourse context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06031","snapshot_observed_at":"2026-08-07T05:58:14.946324Z","title":"The lambada dataset: Word prediction requiring a broad discourse context.arXiv preprint arXiv:1606.06031 , 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.946324Z"},"links":{"cited_paper":"/paper/1606.06031","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:59690ab8c7dbcb7990446f5b248daa9ac99a99aeb519e6d880b20453db4df7f8","observation_id":"61cd0f0b-9d1a-43b2-809c-d7615ae6066d","resolution":{"observed_at":"2026-08-07T05:58:14.946324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:15.606614Z","title":"Orthogonal matching pursuit: Recursive function approximation with applications to wavelet decomposition","venue":null,"work_id":"d59d24ac-bbc0-4d95-b770-1cc0bf61a5a3","year":1993},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.950608Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:4fb4b7f4db35efaac914a62f2b0b0de342db35febc2019974d081ddd977402ba","observation_id":"57eae1a3-9eb2-447d-af4c-fa6fa9fb8f69","resolution":{"observed_at":"2026-08-07T05:58:15.610757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:14.954395Z","title":"How good is your tokenizer? on the monolingual performance of multilingual language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.954395Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:f8905a4f31bd5c33545edf78d933fabf7aeb7dd7f6837f1a49f733ddfe22cee3","observation_id":"0eb52d75-ae71-4767-8486-2168da6bdc65","resolution":{"observed_at":"2026-08-07T05:58:14.954395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.04715","last_updated":"2018-10-09T11:54:10Z","snapshot_observed_at":"2026-08-15T23:32:13.180291Z","submitted_at":"2018-07-12T16:43:32Z","title":"Orthogonal Matching Pursuit for Text Classification","version":2},"cited_work":{"arxiv_id":"1807.04715","doi":null,"metadata_source":"pith","pith_arxiv_id":"1807.04715","snapshot_observed_at":"2026-08-07T05:58:15.121846Z","title":"Orthogonal Matching Pursuit for Text Classification","venue":"cs.LG","work_id":"c301e2e1-6b5f-49bd-be05-87c595df7768","year":2018},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.958446Z"},"links":{"cited_paper":"/paper/1807.04715","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:06b130898f6d589deb76f615d494bfecb113cb3958220b0e33c9745cb1355364","observation_id":"d71f6a70-baa0-4f9d-8445-9fb3ad3c5e84","resolution":{"observed_at":"2026-08-07T05:58:15.128555Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:15.592124Z","title":"Signal recovery from random measurements via orthogonal matching pursuit","venue":null,"work_id":"bb25fd4d-d886-487b-8b78-923b6270a2fc","year":2007},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.962653Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:1a039664fdb295f995b1eb31030f85989f0fd58c2deee61debbfc949cffdc3b0","observation_id":"06604c09-5ca9-4f70-8e1f-590a9c0ddda8","resolution":{"observed_at":"2026-08-07T05:58:15.596607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T05:58:14.966911Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.966911Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:9b661c897307e2e4a9bdcbb0116999c625c21af9e69cbed4b3e7b0e3d01f380a","observation_id":"f2a9598e-a5eb-4c34-ae0d-30251d72e3e0","resolution":{"observed_at":"2026-08-07T05:58:14.966911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.11828","last_updated":"2019-08-30T16:40:00Z","snapshot_observed_at":"2026-08-16T23:08:45.588249Z","submitted_at":"2019-08-30T16:40:00Z","title":"PAWS-X: A Cross-lingual Adversarial Dataset for Paraphrase Identification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.11828","snapshot_observed_at":"2026-08-07T05:58:14.970827Z","title":"Paws-x: A cross-lingual adversarial dataset for paraphrase identification.arXiv preprint arXiv:1908.11828 , 2019","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.970827Z"},"links":{"cited_paper":"/paper/1908.11828","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:a238640b8fd3e872f92b8ed79c19fdb3cb348cbef9ddd6fb7b34280b56584e7a","observation_id":"f3764f64-deaa-4e5a-a5bb-1a0ab93fe44e","resolution":{"observed_at":"2026-08-07T05:58:14.970827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:15.635178Z","title":"URL https://aclanthology.org/2022","venue":null,"work_id":"d7c5863f-6018-490c-8957-3763c6cc7452","year":2022},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.932518Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:50886f635559e60e449751bf1adbea0a18d295568313d22aab2e7856d7d3d378","observation_id":"810672fb-cb8b-4582-bb14-11b6cb802f4b","resolution":{"observed_at":"2026-08-07T05:58:15.639441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-21T09:05:25.415293Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":24,"verified_exact":1,"verified_fuzzy":9},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 3 inbound Pith citation observations for arXiv:2506.06607."}