{"as_of":"2026-08-09T07:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:85e20a78bc6d584d239aecde3973c681628ef5cbf6e29241442369ffffabd4b5","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:32:25.383880Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":29,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-08-07T14:32:25.383880Z","title":"Language model tokenizers introduce unfairness between languages","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18638","last_updated":"2025-05-29T17:11:54Z","snapshot_observed_at":"2026-08-08T01:26:51.326550Z","submitted_at":"2025-05-24T11:01:05Z","title":"Multilingual Question Answering in Low-Resource Settings: A Dzongkha-English Benchmark for Foundation Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:25.383880Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2505.18638"},"observation_digest":"sha256:1e43e9655a15a2ca63d06c2358ab2beaf2ebf0b7b47a032abd55036268f447ea","observation_id":"5493db6b-1d07-41e4-a038-85a36e15f45b","resolution":{"observed_at":"2026-08-07T14:32:25.383880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-08-07T13:12:00.875465Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22582","last_updated":"2025-05-28T16:54:53Z","snapshot_observed_at":"2026-08-08T01:29:39.987815Z","submitted_at":"2025-05-28T16:54:53Z","title":"Less, but Better: Efficient Multilingual Expansion for LLMs via Layer-wise Mixture-of-Experts","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T13:12:00.875465Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2505.22582"},"observation_digest":"sha256:69c66e66d5553e5bb0b1b21004fc8a6fce4474a229a2389e40e103086149fc25","observation_id":"1121a55b-fb62-46b6-b0d0-c893765cad1f","resolution":{"observed_at":"2026-08-07T13:12:00.875465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-08-07T11:15:43.589887Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03149","last_updated":"2025-06-03T17:59:47Z","snapshot_observed_at":"2026-08-09T03:37:08.646108Z","submitted_at":"2025-06-03T17:59:47Z","title":"Causal Estimation of Tokenisation Bias","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:15:43.589887Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2506.03149"},"observation_digest":"sha256:8031988a5fbba5d0c594845d3006d8e30413b29ad0b81f8d0aeaf7fda2d6b3d6","observation_id":"2108986b-cfda-40b9-b2b3-3d827f213f76","resolution":{"observed_at":"2026-08-07T11:15:43.589887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":"2305.15425","doi":"10.48550/arxiv.2305.15425","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","venue":"arXiv (Cornell University)","work_id":"4794e7c1-437b-4edd-a5f0-aa259547a9be","year":2023},"citing_paper":{"arxiv_id":"2601.14958","last_updated":"2026-05-08T04:01:13Z","snapshot_observed_at":"2026-07-06T22:42:26.083572Z","submitted_at":"2026-01-21T12:58:46Z","title":"Script Sensitivity: Benchmarking Language Models on Unicode, Romanized and Mixed-Script Sinhala","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T12:36:27.421985Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2601.14958"},"observation_digest":"sha256:d6620b5af214cc9c5a73d84db14e1045e5cf3c7d31597eeaa415d6af950d4311","observation_id":"a4448f31-a4c7-4396-90ac-f0d963686242","resolution":{"observed_at":"2026-05-16T12:37:53.013482Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":"2305.15425","doi":"10.48550/arxiv.2305.15425","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","venue":"arXiv (Cornell University)","work_id":"4794e7c1-437b-4edd-a5f0-aa259547a9be","year":2023},"citing_paper":{"arxiv_id":"2604.17512","last_updated":"2026-04-19T16:05:33Z","snapshot_observed_at":"2026-07-29T17:45:26.538909Z","submitted_at":"2026-04-19T16:05:33Z","title":"ONTO: A Token-Efficient Columnar Notation for LLM Input Optimization","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-10T05:21:56.826488Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2604.17512"},"observation_digest":"sha256:b7c432e80178d9f18f41227421aa4656f5735859b971fa385cb3f0e34ddeb4c7","observation_id":"487f9c6b-8106-4cad-9807-69ef24b82406","resolution":{"observed_at":"2026-05-10T09:23:37.781850Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":"2305.15425","doi":"10.48550/arxiv.2305.15425","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","venue":"arXiv (Cornell University)","work_id":"4794e7c1-437b-4edd-a5f0-aa259547a9be","year":2023},"citing_paper":{"arxiv_id":"2605.14890","last_updated":"2026-05-18T08:33:19Z","snapshot_observed_at":"2026-08-02T04:12:02.710800Z","submitted_at":"2026-05-14T14:35:05Z","title":"Tokenizer Fertility and Zero-Shot Performance of Foundation Models on Ukrainian Legal Text: A Comparative Study","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-20T21:08:44.929762Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2605.14890"},"observation_digest":"sha256:0c35559dc60faf4f0df8173a874aadfdaa4655c99389c6693ad4b561e1e916ef","observation_id":"f4f19e13-e5cb-451f-860c-91646d30f46c","resolution":{"observed_at":"2026-05-20T21:09:02.558978Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":"2305.15425","doi":"10.48550/arxiv.2305.15425","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","venue":"arXiv (Cornell University)","work_id":"4794e7c1-437b-4edd-a5f0-aa259547a9be","year":2023},"citing_paper":{"arxiv_id":"2605.16538","last_updated":"2026-05-15T18:33:46Z","snapshot_observed_at":"2026-07-06T23:27:38.955917Z","submitted_at":"2026-05-15T18:33:46Z","title":"LLMs in Qualitative Research: Opportunities, Limitations, and Practical Considerations","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-20T15:59:56.231210Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2605.16538"},"observation_digest":"sha256:c0e0790c83ff8c986eaffc8f7f430328f8129cd981f8e958d4921bbda8bf39db","observation_id":"54ff702d-6fd9-47d9-af6c-f107095d4e8e","resolution":{"observed_at":"2026-05-20T16:03:33.014552Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":"2305.15425","doi":"10.48550/arxiv.2305.15425","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","venue":"arXiv (Cornell University)","work_id":"4794e7c1-437b-4edd-a5f0-aa259547a9be","year":2023},"citing_paper":{"arxiv_id":"2605.22705","last_updated":"2026-05-26T17:59:39Z","snapshot_observed_at":"2026-07-06T23:32:59.663926Z","submitted_at":"2026-05-21T16:46:23Z","title":"Tokenization with Split Trees","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-22T05:48:29.391178Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2605.22705"},"observation_digest":"sha256:9b422384478e37dfecaa2aa72be7ea1f4de4ef7038db940119e116a3fad5d1cc","observation_id":"fb7e9804-4133-4a84-a9e0-8ffa26f9554d","resolution":{"observed_at":"2026-05-22T05:51:08.838187Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":"2305.15425","doi":"10.48550/arxiv.2305.15425","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","venue":"arXiv (Cornell University)","work_id":"4794e7c1-437b-4edd-a5f0-aa259547a9be","year":2023},"citing_paper":{"arxiv_id":"2605.24718","last_updated":"2026-05-23T20:13:44Z","snapshot_observed_at":"2026-08-07T15:18:00.875763Z","submitted_at":"2026-05-23T20:13:44Z","title":"The Tokenizer Tax Across 25 European Languages: Domain Invariance, Cross-Lingual Few-Shot Effects, and the Ukrainian Penalty","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T13:08:33.172423Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2605.24718"},"observation_digest":"sha256:cf393c07902108a1a6e1d6ad0aa309d46db77920ccce0ed696ec53667d02f12b","observation_id":"899c837d-d4cd-46af-94a5-8b9f213d26de","resolution":{"observed_at":"2026-06-30T13:14:40.909415Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":"2305.15425","doi":"10.48550/arxiv.2305.15425","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","venue":"arXiv (Cornell University)","work_id":"4794e7c1-437b-4edd-a5f0-aa259547a9be","year":2023},"citing_paper":{"arxiv_id":"2605.29379","last_updated":"2026-05-28T05:29:12Z","snapshot_observed_at":"2026-07-06T23:38:46.361360Z","submitted_at":"2026-05-28T05:29:12Z","title":"BrahmicTokenizer-131K: An Indic-Capable Drop-In Replacement for o200k_base","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-29T08:12:16.235649Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2605.29379"},"observation_digest":"sha256:b3aec4fddda40e86a2a445f36444f9823449e2e387b90284099110de108f3f4e","observation_id":"b2321e79-237a-41f1-a0db-c5d3bd003ee3","resolution":{"observed_at":"2026-06-29T08:13:14.768133Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-08-02T02:01:38.447490Z","title":"José Pombal, Dongkeun Yoon, Patrick Fernandes, Ian Wu, Seungone Kim, Ricardo Rei, Graham Neubig, and André F","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14480","last_updated":"2026-07-21T06:28:06Z","snapshot_observed_at":"2026-08-02T02:01:36.054949Z","submitted_at":"2026-07-16T01:53:09Z","title":"Lower-Resource, Higher Scores: Language Bias in LLM Evaluators","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T02:01:38.447490Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2607.14480"},"observation_digest":"sha256:4bd3dc05d1b9542f42e30b2793cc2ee6eeac37849bd20345ee991be3c90b3949","observation_id":"69bdf272-e63f-4d5d-9a5d-062dab6f10de","resolution":{"observed_at":"2026-08-02T02:01:38.447490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-07-31T23:49:11.023254Z","title":"Torr, and Adel Bibi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23319","last_updated":"2026-07-25T18:23:06Z","snapshot_observed_at":"2026-07-31T23:49:10.129985Z","submitted_at":"2026-07-25T18:23:06Z","title":"BHARATI: Morphology-Aware Tokenizers for Classical Indian Languages with Subword Fertility Analysis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-31T23:49:11.023254Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2607.23319"},"observation_digest":"sha256:ec46c2bc7235f0c67974d90de1fbc40f48da56bdd0564aea875d179783035c0f","observation_id":"8afba8f7-16bf-4d88-83a8-5fab1838c950","resolution":{"observed_at":"2026-07-31T23:49:11.023254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2305.15425/citation-record","integrity":"/paper/2305.15425/integrity","json":"/paper/2305.15425/citation-record.json","paper":"/paper/2305.15425"},"outbound":[],"paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2305.15425."}