{"as_of":"2026-08-10T03:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9e5a3c62eb1141aad075df6a4fc59bebbfc27eb7fba7cfbd392aa46f9faaa503","coverage":[{"denominator":78,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":78,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:06:28.332063Z","state":"measured"},{"denominator":81,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":81,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T22:58:07.981453Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T08:36:16.962123Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03523","snapshot_observed_at":"2026-08-02T22:58:07.981453Z","title":"Tokalign: Efficient vocabulary adaptation via token alignment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.15382","last_updated":"2026-05-28T08:46:27Z","snapshot_observed_at":"2026-08-03T23:19:36.572742Z","submitted_at":"2026-02-17T06:31:53Z","title":"The Vision Wormhole: Latent-Space Communication in Heterogeneous Multi-Agent Systems","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-02T22:58:07.981453Z"},"links":{"cited_paper":"/paper/2506.03523","citing_paper":"/paper/2602.15382"},"observation_digest":"sha256:deab34e366d9fad81cbce69e265760deff9471bcaaf9ff4bef9733f7adfb51e3","observation_id":"e4dda67d-1039-4a4b-8583-85c4ee2c1aeb","resolution":{"observed_at":"2026-08-02T22:58:07.981453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"cited_work":{"arxiv_id":"2506.03523","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.03523","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"TokAlign : Efficient vocabulary adaptation via token alignment","venue":null,"work_id":"b8e2648f-eeb1-4b45-8266-5700f55cc39f","year":2025},"citing_paper":{"arxiv_id":"2605.22005","last_updated":"2026-05-21T05:02:51Z","snapshot_observed_at":"2026-08-04T14:57:02.121312Z","submitted_at":"2026-05-21T05:02:51Z","title":"Check Your LLM's Secret Dictionary! Five Lines of Code Reveal What Your LLM Learned (Including What It Shouldn't Have)","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-22T08:35:02.870481Z"},"links":{"cited_paper":"/paper/2506.03523","citing_paper":"/paper/2605.22005"},"observation_digest":"sha256:bf6c96e031d0216f12b1fb21dbf6cafbe9e8d00b44e02e4840177ffcf3c8da07","observation_id":"421e5d99-9b60-40f8-9698-d85fe3bc8e85","resolution":{"observed_at":"2026-05-22T08:36:16.965373Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03523","snapshot_observed_at":"2026-08-01T23:50:15.766936Z","title":"arXiv:2506.03523","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15232","last_updated":"2026-07-16T17:32:38Z","snapshot_observed_at":"2026-08-08T07:20:48.656314Z","submitted_at":"2026-07-16T17:32:38Z","title":"In-Place Tokenizer Expansion for Pre-trained LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T23:50:15.766936Z"},"links":{"cited_paper":"/paper/2506.03523","citing_paper":"/paper/2607.15232"},"observation_digest":"sha256:5905cc9a4e9d9cfa70ab318e24b0f99f2d15505e423b26687cd3d5b30ad69849","observation_id":"c3e2d6db-0ba2-426c-8812-52262f7417e0","resolution":{"observed_at":"2026-08-01T23:50:15.766936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.03523/citation-record","integrity":"/paper/2506.03523/integrity","json":"/paper/2506.03523/citation-record.json","paper":"/paper/2506.03523"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.516974Z","title":"Jiang, Jia Deng, Stella Biderman, and Sean Welleck","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.516974Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:3e244aeed70008f5bb5f33a42fd0c29b9037c5fd5af4caf891cc87862b89f9bb","observation_id":"773716cd-bf3d-4b35-b025-58ee55a7c682","resolution":{"observed_at":"2026-08-07T11:06:27.516974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.525011Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.525011Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:d5c88f35ac5e1c91829eba9988c9d0671c43e78c9568d129caa05361defbdf07","observation_id":"7814e118-eeb4-48fb-a451-69ac8fa54558","resolution":{"observed_at":"2026-08-07T11:06:27.525011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:30.586187Z","title":null,"venue":null,"work_id":"06ab320a-53ed-434d-83bf-04d100eb8682","year":2003},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.539466Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:d52497e45fe8c6f7d35c940f26d86af774824a680e05c359b9800e9aa4f4ece5","observation_id":"4a134a6a-641f-47be-aa19-7e8503fa5dda","resolution":{"observed_at":"2026-08-07T11:06:30.593569Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.546148Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.546148Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:9b44f2ae526d37e9b0aa9a945f8a6766f39df15de83001a8195ebc9f7ced26eb","observation_id":"3cd710d3-f349-4b7e-bb21-3b428ad4d566","resolution":{"observed_at":"2026-08-07T11:06:27.546148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.552043Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.552043Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:89dac5f8378c5e7bc9271eb218d872d3017d4605953dab22851558e48c17d7d5","observation_id":"e9915c34-3a0b-47ef-b849-cd40e8ffbb9e","resolution":{"observed_at":"2026-08-07T11:06:27.552043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.04606","last_updated":"2017-06-19T17:41:07Z","snapshot_observed_at":"2026-07-06T05:03:45.255477Z","submitted_at":"2016-07-15T18:27:55Z","title":"Enriching Word Vectors with Subword Information","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.04606","snapshot_observed_at":"2026-08-07T11:06:27.558899Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.558899Z"},"links":{"cited_paper":"/paper/1607.04606","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:27936f156122ba80e659449083e96429e0ac447353e736886df6db7d98c7416b","observation_id":"1b1281d5-bde0-4a17-8a22-b9a5d704ca49","resolution":{"observed_at":"2026-08-07T11:06:27.558899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.567256Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.567256Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:25297750dac2ef9550f4c3176099f6ab5362c26b5f03dd03dbfaf15d628b3627","observation_id":"448dfec4-1da7-473e-b6b0-e3aa56d60c4e","resolution":{"observed_at":"2026-08-07T11:06:27.567256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.575761Z","title":"Chau, Lucy H","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.575761Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:8b34babd9867fd8b2847efda9cbb1813891d266f235893ab5ce837adcd80259a","observation_id":"cd6db50f-6cfe-4299-8af9-0160462b76a4","resolution":{"observed_at":"2026-08-07T11:06:27.575761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.3555","last_updated":"2014-12-11T06:46:53Z","snapshot_observed_at":"2026-08-03T11:40:51.182181Z","submitted_at":"2014-12-11T06:46:53Z","title":"Empirical Evaluation of Gated Recurrent Neural Networks on Sequence Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.3555","snapshot_observed_at":"2026-08-07T11:06:27.582703Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.582703Z"},"links":{"cited_paper":"/paper/1412.3555","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:6559985a29e7f68a55e12dd2337c1952713f93547dadd5a9efab1a94f60b73f3","observation_id":"18fa7bd1-754f-46b6-8aaa-38e2878b9f4b","resolution":{"observed_at":"2026-08-07T11:06:27.582703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.588168Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.588168Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:93047bdd78e4f633d0f277bfcadf6686636a6af071f39eb80727775700d32c4a","observation_id":"29649798-f8de-4ef8-a86f-534243627d74","resolution":{"observed_at":"2026-08-07T11:06:27.588168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-07T11:06:27.795046Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.795046Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:da418c3586a1bb2106a446bb29f012c427c192698f43535d5941b5fefa56fc8b","observation_id":"a1607f32-9a08-4652-a796-75a653cabd10","resolution":{"observed_at":"2026-08-07T11:06:27.795046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.802700Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.802700Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:78b4b758a9249bb2c1d2a627830fb3d5e19c6a1991832ab2c9ecdf823e870720","observation_id":"1e33a68e-b137-4142-ace1-7cc4352bdbe0","resolution":{"observed_at":"2026-08-07T11:06:27.802700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.809158Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.809158Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:d62dded56207b8bf0a7a0d1a7dad824a3cb25b9411b4946adb03f693365584fe","observation_id":"0260af9c-9f69-43ec-ac70-18fb72e7ee8a","resolution":{"observed_at":"2026-08-07T11:06:27.809158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.818436Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.818436Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:d735fc5bdb8e5e76f956e8c1c7b15ab17891cfb05d4887195ed247d730f31f62","observation_id":"0afcd93f-b5a9-4701-94ed-a5c792496bde","resolution":{"observed_at":"2026-08-07T11:06:27.818436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.823923Z","title":"Downey, Terra Blevins, Nora Goldfine, and Shane Steinert-Threlkeld","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.823923Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:9ae7f8856b1e6385e4e43df60756e94590b6dc7393868278c1946ce513d19704","observation_id":"85028644-7d77-4ccb-81fb-4136d2478bb1","resolution":{"observed_at":"2026-08-07T11:06:27.823923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-07T11:06:27.832070Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.832070Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:2a109328c72345826609a71be41a5bb86dfedaa30fd3aaa9c5e456fd61957eda","observation_id":"a67946bf-098c-4980-acf1-f516385e491c","resolution":{"observed_at":"2026-08-07T11:06:27.832070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.839741Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.839741Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:99efc428164af1b22d37a95d5ec082b0f5a4daab108abb2fc2db73a265050938","observation_id":"4ad0b997-5e3f-4e78-8366-a66039272e87","resolution":{"observed_at":"2026-08-07T11:06:27.839741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12793","last_updated":"2024-07-30T03:58:11Z","snapshot_observed_at":"2026-08-07T13:56:34.167869Z","submitted_at":"2024-06-18T16:58:21Z","title":"ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12793","snapshot_observed_at":"2026-08-07T11:06:27.846951Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.846951Z"},"links":{"cited_paper":"/paper/2406.12793","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:4ea855daa3662cfff2f6391c598455419de88a694c237d9cd758fa2543dad5a3","observation_id":"4eb3d6e8-6ea6-41c2-b70e-a541b0f9ab32","resolution":{"observed_at":"2026-08-07T11:06:27.846951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16607","last_updated":"2024-11-30T19:31:38Z","snapshot_observed_at":"2026-08-06T17:20:45.836739Z","submitted_at":"2024-07-23T16:13:22Z","title":"Data Mixture Inference: What do BPE Tokenizers Reveal about their Training Data?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16607","snapshot_observed_at":"2026-08-07T11:06:27.856130Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.856130Z"},"links":{"cited_paper":"/paper/2407.16607","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:7d723fbee32f7e2f73c392b96c5842ebaae41901621d394f77a2f3bdd1fbd7bf","observation_id":"9df92565-2a41-47f7-bcb1-195a6c33393d","resolution":{"observed_at":"2026-08-07T11:06:27.856130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.866833Z","title":null,"venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.866833Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:f1b31e38f922747861edd66bea4c90d902c29604b8c5121a66e48e805f32a19b","observation_id":"209719c1-0bb7-4a36-baf7-8129bc3369bb","resolution":{"observed_at":"2026-08-07T11:06:27.866833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-07T11:06:27.876641Z","title":"Rae, Oriol Vinyals, and Laurent Sifre","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.876641Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:3910333fa71bf2c957bba85165134fb703125d6d852628c4e583a6dff7611581","observation_id":"2d17fa1f-5c5d-4c3f-a66c-a873d81156b7","resolution":{"observed_at":"2026-08-07T11:06:27.876641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T11:06:27.882403Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.882403Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:c8416491baf77dd018b19fbea61fe8e3641aaf147870c0806920d85c84f58581","observation_id":"6b4da175-1596-4cb8-8ba8-c6704a5d834d","resolution":{"observed_at":"2026-08-07T11:06:27.882403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-07T11:06:27.888949Z","title":"Brown, Benjamin Chess, Rewon Child, Scott Gray, Alec Radford, Jeffrey Wu, and Dario Amodei","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.888949Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:dc670c1cbde00b34aa8a2e9c50fab02c42cc04e5aae5574d8aa8537ef2df4c07","observation_id":"5a69d92d-ee29-43d5-9e55-2a920f13ee4d","resolution":{"observed_at":"2026-08-07T11:06:27.888949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.893779Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.893779Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:686a8de1d4269dd2d3642f6772eb1c609ee7bd7f0e02c05a78385b33cd1d04bd","observation_id":"bdd11817-c892-41d0-be0a-2ecebb26dbda","resolution":{"observed_at":"2026-08-07T11:06:27.893779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:30.463073Z","title":null,"venue":null,"work_id":"9058ea76-e2a7-4d05-a8fd-f1395465a2a1","year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.899078Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:cf6628e0bba3a6c2f3aa4a35bafa66ac0f8b9d1da194d9527f1decf469cc0a1f","observation_id":"ebd6d28b-8a9e-4d90-88f9-9952829f4190","resolution":{"observed_at":"2026-08-07T11:06:30.470070Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.906007Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.906007Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:fd09a0e45d5eac1623b6cc5c4db42a10e6c65fbb0728f274b56a7d12689cf8bb","observation_id":"0071a950-4a8a-452c-9413-8515f41a811b","resolution":{"observed_at":"2026-08-07T11:06:27.906007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.912723Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.912723Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:4d112691c1fcf6c6fc34fa8382ca85a36484514f3390ae2b6155f422ad496db0","observation_id":"dcfb9a23-dd7c-4a9f-96ca-1fcd9a787141","resolution":{"observed_at":"2026-08-07T11:06:27.912723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.919075Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.919075Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:1d589d33d6a446148d380f61895ffc53cc5e5be3fcd81730fdeed5f5c18e80a7","observation_id":"ecd05808-f336-4988-9c57-a62fe9cc8f61","resolution":{"observed_at":"2026-08-07T11:06:27.919075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:30.427634Z","title":null,"venue":null,"work_id":"eff051db-5615-4888-868b-95a7f434089c","year":2017},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.924122Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:08224e6e4943e01d9f524c43df87748a3f7aa749a179a2f382bd9f182961fde6","observation_id":"e6b2cbef-246b-4944-b491-4cb89bdc21ed","resolution":{"observed_at":"2026-08-07T11:06:30.433870Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.928698Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.928698Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:f261f3c4f6df0032f0f52fb6907c540dd5ac9810f9f5daffd64a31d9d6841631","observation_id":"125dd11c-a1fd-4df3-8e5e-93a7ea96f7b8","resolution":{"observed_at":"2026-08-07T11:06:27.928698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.937667Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.937667Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:56907244d8a1da094d085ca584130ee3434b436cafc09b820288400b58403ff8","observation_id":"962e471c-fd21-47b9-97d8-024312e06b88","resolution":{"observed_at":"2026-08-07T11:06:27.937667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.944019Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.944019Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:5d758f59422cbc024fd573a18d702d5377e147d0a8ca2dc35c5f124815c169f7","observation_id":"b0a3ca72-7be9-4b62-8942-ea888715d7da","resolution":{"observed_at":"2026-08-07T11:06:27.944019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06089","last_updated":"2024-07-08T16:29:08Z","snapshot_observed_at":"2026-08-06T09:58:33.079020Z","submitted_at":"2024-07-08T16:29:08Z","title":"Merge, Ensemble, and Cooperate! A Survey on Collaborative Strategies in the Era of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06089","snapshot_observed_at":"2026-08-07T11:06:27.948757Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.948757Z"},"links":{"cited_paper":"/paper/2407.06089","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:02ecc51fdc2d171f7c6eaf2d336f73624b327773af1b1d9dd6e9b677251c9801","observation_id":"f49c2d29-a062-4047-af6a-41442b8866ac","resolution":{"observed_at":"2026-08-07T11:06:27.948757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:30.367311Z","title":null,"venue":null,"work_id":"27dd7cda-36f3-4820-adbe-cbfd72f76475","year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.958004Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:205c0815368358d481263b25e68a8d215920a74bc81509e2daaadecd59c46658","observation_id":"a1f0381b-d3de-4c6e-b74f-7b2c8e3fa9cf","resolution":{"observed_at":"2026-08-07T11:06:30.376214Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.970462Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.970462Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:5208b74153e6f749460d889a21ab8ad921ce27c02146d79e176aa04a9dcbf1d2","observation_id":"6c829665-dfbd-4ce5-a5ba-2aeae68bdbd6","resolution":{"observed_at":"2026-08-07T11:06:27.970462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.984356Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.984356Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:7b36a93f9bde16ef0cbe5f3d7a31260a9a6fea3cb8ca25c4e05055ec2989eb04","observation_id":"b0fa307d-92ca-493b-9a80-7bf1ad79f1c5","resolution":{"observed_at":"2026-08-07T11:06:27.984356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1301.3781","last_updated":"2013-09-07T00:30:40Z","snapshot_observed_at":"2026-07-06T03:04:11.148340Z","submitted_at":"2013-01-16T18:24:43Z","title":"Efficient Estimation of Word Representations in Vector Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1301.3781","snapshot_observed_at":"2026-08-07T11:06:27.990809Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.990809Z"},"links":{"cited_paper":"/paper/1301.3781","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:0a39359fe8f170c6dccddba7a746235ae72b07b514ab9e41b468105fc4fa658d","observation_id":"cbf01ff5-38ca-4006-a75b-7006b60d428e","resolution":{"observed_at":"2026-08-07T11:06:27.990809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1310.4546","last_updated":"2013-10-16T23:28:53Z","snapshot_observed_at":"2026-07-06T03:25:47.809707Z","submitted_at":"2013-10-16T23:28:53Z","title":"Distributed Representations of Words and Phrases and their Compositionality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1310.4546","snapshot_observed_at":"2026-08-07T11:06:27.998195Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.998195Z"},"links":{"cited_paper":"/paper/1310.4546","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:59bcc461bf459df1eb41d6e32d0d2b4c016c2a6f8941829c854d88e5366f4e90","observation_id":"550f997a-b4a5-4da4-8230-29896a2ebb68","resolution":{"observed_at":"2026-08-07T11:06:27.998195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.004225Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.004225Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:c85e4c9124be3be4e60f4e01c8791f2a66b148f84c36ccfdfa3e8d2f2d8fb612","observation_id":"1838336f-d053-439b-853a-b6a3f30d208b","resolution":{"observed_at":"2026-08-07T11:06:28.004225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.009815Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.009815Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:a257aacbf3bad33ad9fcdabb6c22133bec8c30048231761d036f83c00758b56a","observation_id":"8a8f6d9c-7fa8-4c1c-937f-3b27905f33e1","resolution":{"observed_at":"2026-08-07T11:06:28.009815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.015727Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.015727Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:4aca4632924ad0839c39f5f2ed2e10c0cc2cf09ca33eb149b7f47ce0210a72cf","observation_id":"60dccc4e-9800-48c4-a636-9b9213914097","resolution":{"observed_at":"2026-08-07T11:06:28.015727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:30.291641Z","title":null,"venue":null,"work_id":"9b495306-cf09-478b-bfed-d4e75e62f16b","year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.025227Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:45906636d328c57c125576c665f9953d90a1c8910b9e50aa67514f99c55c2a94","observation_id":"d728f4af-2d43-4ecc-9617-1e5016561efc","resolution":{"observed_at":"2026-08-07T11:06:30.304057Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.035808Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.035808Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:de0eab1a633d2ad776cc8c08726a3c9da13ad6ed8f03360af0678c5f6dbb5a89","observation_id":"d9551f98-deaa-4b06-ad09-d0dc32d0d6d3","resolution":{"observed_at":"2026-08-07T11:06:28.035808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:30.255720Z","title":null,"venue":null,"work_id":"a51a7ee8-686d-4468-8311-d60102c4849b","year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.043852Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:d59bb3503e0a5b4b3fb81017e44ca418fc62c4615f075020fa96dee2c03c047a","observation_id":"d2cb2548-f1c7-474f-a58b-37015e79fb74","resolution":{"observed_at":"2026-08-07T11:06:30.263720Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.050225Z","title":"Rossi, and Thien Huu Nguyen","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.050225Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:a20d7abeda0539b2649a318f75ed101c4deace8cc55f69ad5baa336f9dfd4f67","observation_id":"10f62dd1-ce18-424a-81f6-8be8b020e4c7","resolution":{"observed_at":"2026-08-07T11:06:28.050225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.09400","last_updated":"2023-09-17T23:49:10Z","snapshot_observed_at":"2026-07-06T16:19:41.722419Z","submitted_at":"2023-09-17T23:49:10Z","title":"CulturaX: A Cleaned, Enormous, and Multilingual Dataset for Large Language Models in 167 Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.09400","snapshot_observed_at":"2026-08-07T11:06:28.059185Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.059185Z"},"links":{"cited_paper":"/paper/2309.09400","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:93dab3a4457136ad90ea63feaa198dd3bb842f05e24aeda8b46f328d03b790e6","observation_id":"d26e90d6-4e49-4322-9b63-b76a565e415b","resolution":{"observed_at":"2026-08-07T11:06:28.059185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T11:06:28.065018Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.065018Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:6492640665ec3871d3dddf4a9348167b8f6d5410da0e800ba028315dfce6b1a9","observation_id":"22307517-d91c-40bf-83a1-9b141658c0b6","resolution":{"observed_at":"2026-08-07T11:06:28.065018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.072545Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.072545Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:aba649ebbd5f859f25257f378c111da1999075202f7e6d5422aa879fb1dbe181","observation_id":"cafa868c-e665-4297-9f9e-3e4901e12979","resolution":{"observed_at":"2026-08-07T11:06:28.072545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.080858Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.080858Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:e76aba14507516f9f4370235ebf3c955e8341971f8871d534333d4cfb0a8fc4d","observation_id":"3f05f72e-312c-4cdd-99fe-e29812332964","resolution":{"observed_at":"2026-08-07T11:06:28.080858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.088235Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.088235Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:d38a50d8f7b3636feff7574b7d5f33a6a0cf4678a21d22fc4978fb23d3d5f1c0","observation_id":"efbb8c1d-50c2-4e83-8c7d-88ee0d591e72","resolution":{"observed_at":"2026-08-07T11:06:28.088235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:30.163530Z","title":null,"venue":null,"work_id":"4d0834c2-e429-40ca-bec1-53814b710bef","year":2019},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.096891Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:9860fe3f049e80bcf20b240dd29bfe00df271c69c2679f0bd96d5203d635d654","observation_id":"108bdd21-05bf-49f8-9b87-85bd07c7ecfc","resolution":{"observed_at":"2026-08-07T11:06:30.170869Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.105550Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.105550Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:83ba17da43f17b8517d15fd2e5e289cca1435367c5acd6f739b4fcdedd3b4dc7","observation_id":"03958e7d-eb5c-4100-bc02-4c26eca0ace2","resolution":{"observed_at":"2026-08-07T11:06:28.105550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.111592Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.111592Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:dc6513a76ca7249c4498cb59b778b10ec526715df24e622bb188b048ef39499a","observation_id":"4d2bd9c4-0e56-4533-98da-7c16e76bcd57","resolution":{"observed_at":"2026-08-07T11:06:28.111592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05100","last_updated":"2023-06-27T09:57:58Z","snapshot_observed_at":"2026-08-04T18:56:03.233715Z","submitted_at":"2022-11-09T18:48:09Z","title":"BLOOM: A 176B-Parameter Open-Access Multilingual Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.05100","snapshot_observed_at":"2026-08-07T11:06:28.119268Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.119268Z"},"links":{"cited_paper":"/paper/2211.05100","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:ba16b1c0bb33688a8a3c157b6ea96c79274202be3f08402583af34a420605d0f","observation_id":"b07135c5-407b-465c-9781-d8663560e89c","resolution":{"observed_at":"2026-08-07T11:06:28.119268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.126065Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.126065Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:d8eaae1ced7ad5d41073459e08ce2683ae44a0cf0516af4411c92f8017ec38df","observation_id":"153e3fea-44a3-4221-adc0-01e4ae7b3a37","resolution":{"observed_at":"2026-08-07T11:06:28.126065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.131299Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.131299Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:dcaa87391d1083e9542f7dd8376ee20ef6ade5bd262993e12953bc6fc3aa6bc2","observation_id":"a61e2436-ee2f-4689-aa11-88dd38da8ef2","resolution":{"observed_at":"2026-08-07T11:06:28.131299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:30.114949Z","title":null,"venue":null,"work_id":"eb19613f-0a5a-4493-9f16-36ece846a4dc","year":2020},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.137833Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:cf9a0d07e0160e9376b2470027731fd90ecae49bd21551fb505b0ebb44969a40","observation_id":"93a1b02b-0af3-48fc-84bd-d36fd6018372","resolution":{"observed_at":"2026-08-07T11:06:30.122195Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-07T11:06:28.151263Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.151263Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:653a66ae1c400a46e1c160c8b24aba62133ca6f06c0f15c4d503cf3f2c93f01f","observation_id":"ef6ef9e4-2a2e-4217-9fec-8e17b4e41d5d","resolution":{"observed_at":"2026-08-07T11:06:28.151263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.161488Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.161488Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:06f969460f0ea588d0d85a9a91f6e782deafc81ade17b0e9b98c5173bd47f0c9","observation_id":"40f82bdd-db22-45eb-94a7-52a764adf58d","resolution":{"observed_at":"2026-08-07T11:06:28.161488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T11:06:28.173537Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.173537Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:e5305ba716e373be2c7d4838302ef65e337416b5cde9a7d969b31a24aa054683","observation_id":"2e1a56a8-8053-4b4a-9777-ee92703131af","resolution":{"observed_at":"2026-08-07T11:06:28.173537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T11:06:28.185682Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.185682Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:b95201d8e591226c0753beca5c021748659044e9ca421c98bc19104f615c3243","observation_id":"e289c0dd-d679-4ee6-8d3d-f00307982da8","resolution":{"observed_at":"2026-08-07T11:06:28.185682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.07306","last_updated":"2020-04-29T01:16:24Z","snapshot_observed_at":"2026-08-08T07:02:10.284809Z","submitted_at":"2020-02-18T00:22:54Z","title":"From English To Foreign Languages: Transferring Pre-trained Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.07306","snapshot_observed_at":"2026-08-07T11:06:28.194963Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.194963Z"},"links":{"cited_paper":"/paper/2002.07306","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:a6b44fb4ba538e12d4564273a08e114c098cb4245ed427d572ad7f32201b759b","observation_id":"8162b23e-5a3e-4c21-8dd4-af5796394e98","resolution":{"observed_at":"2026-08-07T11:06:28.194963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.204407Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.204407Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:5ed2bb955440a1007e3c194a6e9c7b451912356079f681d05953dc82bf794784","observation_id":"9a41635e-aa23-4107-af3b-4de48697d56d","resolution":{"observed_at":"2026-08-07T11:06:28.204407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v32i1.12031","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.450935Z","title":null,"venue":null,"work_id":"2a264f8b-5d88-4680-beab-c30c4357d609","year":2018},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.214523Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:c0123993e8e75d03914a47a02431708efbb943f8071d5b31e745712848ca32b1","observation_id":"040dd764-5d69-4e0e-ad8c-bb443754d4c3","resolution":{"observed_at":"2026-08-07T11:06:28.459079Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:30.092740Z","title":null,"venue":null,"work_id":"27c5ddb1-1c93-4ff3-a955-a0c559263f05","year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.222451Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:4bd16d6d3cdf1705aec181b83f423a907ac06411902fe16a6fb616536692c8a6","observation_id":"26d22473-6b68-4f0f-b4ab-1b9d4e4411e8","resolution":{"observed_at":"2026-08-07T11:06:30.098615Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19341","last_updated":"2023-10-30T08:31:47Z","snapshot_observed_at":"2026-08-06T06:09:43.812715Z","submitted_at":"2023-10-30T08:31:47Z","title":"Skywork: A More Open Bilingual Foundation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19341","snapshot_observed_at":"2026-08-07T11:06:28.236451Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.236451Z"},"links":{"cited_paper":"/paper/2310.19341","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:ab61cb47392ed2f4f5d02399c3c1001fc8239b185be7895dafc46576227bdbaf","observation_id":"4f0505ab-7599-4ea0-a285-c18c202b1064","resolution":{"observed_at":"2026-08-07T11:06:28.236451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.03771","last_updated":"2020-07-14T03:42:34Z","snapshot_observed_at":"2026-07-06T08:27:58.343233Z","submitted_at":"2019-10-09T03:23:22Z","title":"HuggingFace's Transformers: State-of-the-art Natural Language Processing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.03771","snapshot_observed_at":"2026-08-07T11:06:28.246726Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.246726Z"},"links":{"cited_paper":"/paper/1910.03771","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:5a0acbafa7d0d999f53073f4e0e56070584c0b642020cb50f984e6357cf434cc","observation_id":"82415b58-992f-4d89-b0c7-d6c61be2740e","resolution":{"observed_at":"2026-08-07T11:06:28.246726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.08144","last_updated":"2016-10-08T19:10:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-09-26T19:59:55Z","title":"Google's Neural Machine Translation System: Bridging the Gap between Human and Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.08144","snapshot_observed_at":"2026-08-07T11:06:28.253400Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.253400Z"},"links":{"cited_paper":"/paper/1609.08144","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:6d4007ce116a06064ef022b32ddf2894a7b71e66734bbdd4423e10ac516c0028","observation_id":"a08bfc6c-31d5-4bb8-a5bd-5afa9557c19e","resolution":{"observed_at":"2026-08-07T11:06:28.253400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.260265Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.260265Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:48703e656bdac6c594600f1755c5ff967fda8f856ecd1e3d5436db6733ee6380","observation_id":"123dd0e2-0bcc-4c3b-87ce-906c585a1a9c","resolution":{"observed_at":"2026-08-07T11:06:28.260265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:30.069190Z","title":null,"venue":null,"work_id":"c1a73bf9-1524-49bf-84f6-1424d9cc584e","year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.268052Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:5c9a222e5b62ad7fc2f6ae0de5364a0e683fd8a6df7b261d4d552a3921ab0d7f","observation_id":"51657537-7a7c-4902-99db-332a7330036b","resolution":{"observed_at":"2026-08-07T11:06:30.074126Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-07T11:06:28.276072Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.276072Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:c1408a7b43982f4b10e680b4889d9b61f128dd373226ec815724f1de878683b3","observation_id":"7ab9372f-3c88-4be1-8d07-a1be3d9dc1dc","resolution":{"observed_at":"2026-08-07T11:06:28.276072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18098","last_updated":"2023-11-21T11:01:24Z","snapshot_observed_at":"2026-07-06T15:34:44.280483Z","submitted_at":"2023-05-29T14:07:52Z","title":"BigTranslate: Augmenting Large Language Models with Multilingual Translation Capability over 100 Languages","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18098","snapshot_observed_at":"2026-08-07T11:06:28.281370Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.281370Z"},"links":{"cited_paper":"/paper/2305.18098","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:284eb8a628609835a7a82f260ad2407a128a59a2c983fe1357321cd73ebb82d3","observation_id":"150c806c-247f-4cc9-a8de-713c035d9176","resolution":{"observed_at":"2026-08-07T11:06:28.281370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.293569Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.293569Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:d5c07ef80c8b564fb939f3dd50c3459ea26d2c29603393b321befbc00cce16bb","observation_id":"493c65f1-5b4d-43f0-a6f6-1fd0fc4bad26","resolution":{"observed_at":"2026-08-07T11:06:28.293569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.300632Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.300632Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:3a8b51c89e19fbfa4e4e870962ec310db25c08441621da9b9ca750bcb310ccde","observation_id":"76bd9439-540a-4506-8835-44d232f9b2f5","resolution":{"observed_at":"2026-08-07T11:06:28.300632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02385","last_updated":"2024-06-04T02:05:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-04T17:54:59Z","title":"TinyLlama: An Open-Source Small Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02385","snapshot_observed_at":"2026-08-07T11:06:28.308034Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.308034Z"},"links":{"cited_paper":"/paper/2401.02385","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:1f0356cb8aa942a7370c82019970036128c08d652561d315328c2f2b66e07248","observation_id":"642da0be-7848-404d-a38e-c88656129059","resolution":{"observed_at":"2026-08-07T11:06:28.308034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.04948","last_updated":"2023-10-09T14:08:40Z","snapshot_observed_at":"2026-08-07T15:33:01.109380Z","submitted_at":"2023-08-09T13:32:06Z","title":"Extrapolating Large Language Models to Non-English by Aligning Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.04948","snapshot_observed_at":"2026-08-07T11:06:28.319125Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.319125Z"},"links":{"cited_paper":"/paper/2308.04948","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:8bd9d7f0997c838cfe6fbb224d011e6925bdbb170e7538dc2626edb19af96ce6","observation_id":"b964a25e-4a1b-4914-832a-d5423bccdf05","resolution":{"observed_at":"2026-08-07T11:06:28.319125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.325225Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.325225Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:418c6ad80f84a01808975ea49772e52258442281347625a8784f9250a848a93a","observation_id":"ce556af2-b395-4ca6-ab46-b551be43c398","resolution":{"observed_at":"2026-08-07T11:06:28.325225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.332063Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.332063Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:5536e8e1f21ab1fa4f593faedd22086c8abfd39a04f5b0c92b128f82a6f008d7","observation_id":"5f84288c-08ab-493c-95c9-5b2a24bf8c5c","resolution":{"observed_at":"2026-08-07T11:06:28.332063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T05:07:43.828141Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment"},"reference_resolution":{"displayed":78,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":77,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":78},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 78 of 78 outbound references and 3 inbound Pith citation observations for arXiv:2506.03523."}