{"as_of":"2026-08-14T01:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:87c47cd894947185de36839d24a5511ff7bf94a7576d9ba5715247e314c5928a","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:26:33.693932Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T23:21:22.456506Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T08:53:03.779632Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10641","snapshot_observed_at":"2026-08-05T23:21:22.456506Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.05468","last_updated":"2025-08-07T15:11:17Z","snapshot_observed_at":"2026-08-09T14:27:14.474056Z","submitted_at":"2025-08-07T15:11:17Z","title":"TASE: Token Awareness and Structured Evaluation for Multilingual Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T23:21:22.456506Z"},"links":{"cited_paper":"/paper/2506.10641","citing_paper":"/paper/2508.05468"},"observation_digest":"sha256:334a1688d59d6fe43106e562cfd31cbc2bef41bbe8fe1a50c2a149c77093a043","observation_id":"61f8c5a0-e402-42a5-85d0-f980a2004457","resolution":{"observed_at":"2026-08-05T23:21:22.456506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"cited_work":{"arxiv_id":"2506.10641","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.10641","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Inui, K","venue":null,"work_id":"8f884c07-2ea0-4fa5-9a34-176d9577e6b3","year":null},"citing_paper":{"arxiv_id":"2604.16037","last_updated":"2026-04-17T13:05:46Z","snapshot_observed_at":"2026-08-13T14:25:00.460900Z","submitted_at":"2026-04-17T13:05:46Z","title":"Stochasticity in Tokenisation Improves Robustness","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T08:49:55.126650Z"},"links":{"cited_paper":"/paper/2506.10641","citing_paper":"/paper/2604.16037"},"observation_digest":"sha256:47f0d42c84e7e9200307e69ed2898bea20dde943cf288bb54bc31bf940a10aed","observation_id":"54aa63ef-c5d2-4158-a03c-314999feb6f7","resolution":{"observed_at":"2026-05-10T08:53:03.781857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.10641/citation-record","integrity":"/paper/2506.10641/integrity","json":"/paper/2506.10641/citation-record.json","paper":"/paper/2506.10641"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:31.243767Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:31.243767Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:0371d9fbb590604586984162116764d327e606673bb7623ca34ac1b4eddd1ec1","observation_id":"378e16fa-98f8-4289-8074-df10ae9ef921","resolution":{"observed_at":"2026-08-07T04:26:31.243767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:31.314409Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:31.314409Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:0a229dacbfa39eaf7e451d427edaa53852a456fe0c0feab7b9d04f0707b0293e","observation_id":"aceadba6-d52d-41fa-86ab-662cc6afb66a","resolution":{"observed_at":"2026-08-07T04:26:31.314409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.15471","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:33.957437Z","title":null,"venue":null,"work_id":"ee444eb7-59b5-417e-9d1f-0de8b0039bd9","year":2025},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:31.411745Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:37e72a26f8f6df264f1c1568ddf8baedb2f8149a5d8de1849cbee187ae06fc26","observation_id":"0acb7c1c-28fb-4990-8a0c-90fd564c8b98","resolution":{"observed_at":"2026-08-07T04:26:33.961310Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:31.520808Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:31.520808Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:7b5a4c481220bb7e8352081f1259a4c135b055aba48efa59bc5c191f7807904f","observation_id":"29c031c0-611e-4b8f-899c-b91956ce386f","resolution":{"observed_at":"2026-08-07T04:26:31.520808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T04:26:31.653612Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:31.653612Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:4a35143d89792f8ce7b661ed1ddf61115ec55fa8ef3b293fcc25d60380edf48a","observation_id":"01fb045f-3589-4afc-9cc6-d9e8a92eadcd","resolution":{"observed_at":"2026-08-07T04:26:31.653612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:31.683263Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:31.683263Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:c28ae9a755d85ce34b9df80cfadda476e561314b3786a8106eafd09d9f78d650","observation_id":"f578a522-3f15-45a8-a12f-f9b2d2c7c182","resolution":{"observed_at":"2026-08-07T04:26:31.683263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18626","last_updated":"2024-12-19T22:47:08Z","snapshot_observed_at":"2026-08-11T11:23:54.929674Z","submitted_at":"2024-12-19T22:47:08Z","title":"Why Do Large Language Models (LLMs) Struggle to Count Letters?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18626","snapshot_observed_at":"2026-08-07T04:26:31.714015Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:31.714015Z"},"links":{"cited_paper":"/paper/2412.18626","citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:b46409bdb3cb3ae823ba80de1a319ed999a173e7012a61ce6d7d84d6fd971a44","observation_id":"8253a5a2-d16a-417e-9068-178de9b74344","resolution":{"observed_at":"2026-08-07T04:26:31.714015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:31.839142Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:31.839142Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:ccdea0c3369b5265c3ca84c5cdf9ae87c62d108c014ae0212187af666782bb1e","observation_id":"c11e9a75-7d09-4561-84f5-9f41c715724a","resolution":{"observed_at":"2026-08-07T04:26:31.839142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09808","last_updated":"2024-02-22T15:11:57Z","snapshot_observed_at":"2026-08-13T04:18:30.751463Z","submitted_at":"2024-02-15T09:14:53Z","title":"Knowledge of Pretrained Language Models on Surface Information of Tokens","version":2},"cited_work":{"arxiv_id":"2402.09808","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.09808","snapshot_observed_at":"2026-08-07T04:26:33.849540Z","title":"Knowledge of Pretrained Language Models on Surface Information of Tokens","venue":"cs.CL","work_id":"757316aa-0a7b-4e64-8c20-e87016fb30e9","year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:31.930401Z"},"links":{"cited_paper":"/paper/2402.09808","citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:814ca012a67c2fef35e7ced984ac1a42c94746304707316fea6e3a7f8d709700","observation_id":"fbeb45f7-a95b-48b1-88fa-6a2a46efd9f2","resolution":{"observed_at":"2026-08-07T04:26:33.852554Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:32.087450Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:32.087450Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:457e835a7830332fb198d3891dff2242a3d5e843314c51113a7ec3af9a667dc6","observation_id":"347fe4f6-bd3e-46fd-902c-fbed2d6bef78","resolution":{"observed_at":"2026-08-07T04:26:32.087450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:34.040093Z","title":null,"venue":null,"work_id":"fb389051-331c-4d89-b8b2-3eda4ecea7bd","year":2025},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:32.247345Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:590cb4ed8b5eaf74e915d44378b6f6df068b48f44a9f06d7a64020a41abb1868","observation_id":"878244f6-addd-4c31-b4cc-8660c49ce0b7","resolution":{"observed_at":"2026-08-07T04:26:34.043258Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:32.343817Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:32.343817Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:4c4c0b0108367f7e6f0448570cee551c36ecde53f3a6fd4c12b392e0b26f7bcc","observation_id":"c460caa5-2dc9-4cbd-9227-cb486d2ae284","resolution":{"observed_at":"2026-08-07T04:26:32.343817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-07T04:26:32.448062Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:32.448062Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:167b4e6cc0979fbbf0acd4f6d429693d8327bbf9f27987e67e98a3911c25a5df","observation_id":"eb92fc9c-cbd5-4a1d-8c42-3030878544e4","resolution":{"observed_at":"2026-08-07T04:26:32.448062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:32.558945Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:32.558945Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:5e508608830b926b8731aaa2edc3d8e50989b57247682662df79b21a1ed3267b","observation_id":"4b409dc4-cda9-495a-8400-4b1e3cab9f96","resolution":{"observed_at":"2026-08-07T04:26:32.558945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:34.026155Z","title":null,"venue":null,"work_id":"0e437477-51d2-49de-9159-46fa1559711e","year":2022},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:32.672657Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:3f77e36b6faa29c58d7b851ee176c2d757b454110d5c3a4dbef13310c0bf2139","observation_id":"f374de54-8bd9-4dcb-862a-c31513a37023","resolution":{"observed_at":"2026-08-07T04:26:34.029154Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:34.018051Z","title":"Llm360: Towards fully transparent open-source llms","venue":null,"work_id":"e3190026-e5c5-4a8f-a9e3-b9b890cb2e58","year":null},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:32.773231Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:4092de2e6065715ebef183cfb492457cc257b1696925a9fedc154cd7e3292818","observation_id":"7c6f9c18-abf7-44be-a22a-fdb001ea8e3e","resolution":{"observed_at":"2026-08-07T04:26:34.020786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.672","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"e1ba9f34-3d54-4cf5-a6a4-104d0ac534b4","year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:32.884147Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:bd89cf14cf9aca2a9d49dd7e297f49e48bc336a89185bf3b65d1891fd58b0270","observation_id":"1ebd722a-c43f-484b-a6c2-15f08eefd5e5","resolution":{"observed_at":"2026-08-07T04:26:33.734185Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:34.008821Z","title":"What does the knowledge neuron thesis have to do with knowledge? In The Twelfth International Conference on Learning Representations","venue":null,"work_id":"e229ad48-2d18-4fdf-8765-de9656d4ef04","year":null},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.002329Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:239a7164f5f170ee1634c0e5493b91ad3b648f38c52784faeeaa867efd188b1f","observation_id":"eac13e7a-8373-4bfe-9f11-50aac408741e","resolution":{"observed_at":"2026-08-07T04:26:34.012114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:33.999550Z","title":null,"venue":null,"work_id":"a1825ff5-6c97-45c8-ac3d-7f272e4c6f77","year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.119949Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:47e534e803305be7035a45cbb14523f3ba4ff23491ba44cf67c9df0438fa2559","observation_id":"6fcd29f1-3b56-4fd0-9a4d-90e3fc47d2f7","resolution":{"observed_at":"2026-08-07T04:26:34.002339Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-07T04:26:33.249209Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.249209Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:fd0dfa545a8bbdf18febe04a26ea0162f88171a787c245aaf5768abf47d2c87a","observation_id":"0f89f17c-d92b-409d-905a-e34a743ebed5","resolution":{"observed_at":"2026-08-07T04:26:33.249209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19669","last_updated":"2025-02-27T01:30:07Z","snapshot_observed_at":"2026-08-07T17:44:31.347763Z","submitted_at":"2025-02-27T01:30:07Z","title":"Investigating Neurons and Heads in Transformer-based LLMs for Typographical Errors","version":1},"cited_work":{"arxiv_id":"2502.19669","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.19669","snapshot_observed_at":"2026-08-07T04:26:33.821395Z","title":"Investigating Neurons and Heads in Transformer-based LLMs for Typographical Errors","venue":"cs.CL","work_id":"5f680383-020c-4d94-927a-4a19fd441f6e","year":2025},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.371720Z"},"links":{"cited_paper":"/paper/2502.19669","citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:0f638aafee9da05e25716112de0c1c5e62f5c99ec5c2537c65b51cd2f3667bfe","observation_id":"8b383fd9-a079-4158-836d-ecdf48d31005","resolution":{"observed_at":"2026-08-07T04:26:33.824675Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:33.489770Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.489770Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:1fd5e8d2ca6a960e5a430fe493b62add16dd5c7b920c9977d4a168fd476000a0","observation_id":"4b69dc70-7368-4cb1-9ce6-16d5555dd419","resolution":{"observed_at":"2026-08-07T04:26:33.489770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:33.602050Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.602050Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:19238faaf26b63500bace25f07665f5a17bd091d7f1ca7f1568609fd6f398dea","observation_id":"21fcc33b-fb1d-4986-a61e-975678a512e6","resolution":{"observed_at":"2026-08-07T04:26:33.602050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01714","last_updated":"2025-03-03T16:31:45Z","snapshot_observed_at":"2026-08-07T17:33:08.982744Z","submitted_at":"2025-03-03T16:31:45Z","title":"Word Form Matters: LLMs' Semantic Reconstruction under Typoglycemia","version":1},"cited_work":{"arxiv_id":"2503.01714","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.01714","snapshot_observed_at":"2026-08-07T04:26:33.809899Z","title":"Word Form Matters: LLMs' Semantic Reconstruction under Typoglycemia","venue":"cs.CL","work_id":"c8ec5028-7d01-4916-8d52-a9909529fede","year":2025},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.662516Z"},"links":{"cited_paper":"/paper/2503.01714","citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:b15fb62c4d4fbde59ab7acb80e6250eba6a65feeb0d2d35903908194cd5e3de0","observation_id":"62853d5d-6eaa-49cb-bedb-c9133444f316","resolution":{"observed_at":"2026-08-07T04:26:33.813364Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:33.986287Z","title":null,"venue":null,"work_id":"72e5c267-7ba0-4e21-908c-5942810921fe","year":2022},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.665939Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:0d568d3bc9b41c26857dba00a4fca9caad8f5ca7a14bca625998f3b16aad040f","observation_id":"0cf52350-a311-40e0-8ae5-8747f4c65c27","resolution":{"observed_at":"2026-08-07T04:26:33.989190Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01208","last_updated":"2025-01-26T03:20:09Z","snapshot_observed_at":"2026-08-12T22:32:55.153840Z","submitted_at":"2024-10-02T03:23:29Z","title":"StringLLM: Understanding the String Processing Capability of Large Language Models","version":3},"cited_work":{"arxiv_id":"2410.01208","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.01208","snapshot_observed_at":"2026-08-07T04:26:33.798726Z","title":"StringLLM: Understanding the String Processing Capability of Large Language Models","venue":"cs.CL","work_id":"f8685895-1658-424b-b1d8-532348ea99d6","year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.669016Z"},"links":{"cited_paper":"/paper/2410.01208","citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:1bb58615f2d67040570fbc52f10a3d3f0b3608b77aa2be6217b8b1df7f65f739","observation_id":"d0a9cbee-b8cf-4679-bcac-62548393b515","resolution":{"observed_at":"2026-08-07T04:26:33.801808Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:33.672546Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.672546Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:65ef69ce6cbc15a2ca43fab8a2f581eae0f7b82206be4732025cf88a41f6db6e","observation_id":"4a134eb2-2a02-4543-bac6-8797cba30682","resolution":{"observed_at":"2026-08-07T04:26:33.672546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:33.978103Z","title":null,"venue":null,"work_id":"935b93b9-6995-42b2-a839-fb187901f59e","year":2025},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.675707Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:5c5e1634848c1ba62cded705bef64336e8296861d657430160ac81ab5391522a","observation_id":"858fba64-5c06-4790-84cd-8fdc1f354e61","resolution":{"observed_at":"2026-08-07T04:26:33.981043Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08180","last_updated":"2025-03-27T16:07:18Z","snapshot_observed_at":"2026-08-12T04:16:25.054962Z","submitted_at":"2025-02-12T07:37:39Z","title":"Enhancing LLM Character-Level Manipulation via Divide and Conquer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08180","snapshot_observed_at":"2026-08-07T04:26:33.682038Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.682038Z"},"links":{"cited_paper":"/paper/2502.08180","citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:405dac4d6aad035b98df2e40af2e2f4c0a3a77fd1c10a5fee042e0c765ba6c1d","observation_id":"1c402b66-f3fe-41f8-8b49-955472013c6c","resolution":{"observed_at":"2026-08-07T04:26:33.682038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-14T01:02:36.177068Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"cited_work":{"arxiv_id":"2411.17679","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.17679","snapshot_observed_at":"2026-08-07T04:26:33.777023Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","venue":"cs.CL","work_id":"dcd97031-f396-4ebe-8145-669b7c2f9a24","year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.685177Z"},"links":{"cited_paper":"/paper/2411.17679","citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:876263dfed286da67e06ec59799749156afb436902f5c3538411dec64d9f2965","observation_id":"f6992535-03a2-49c8-9810-0ba54a03cabd","resolution":{"observed_at":"2026-08-07T04:26:33.781426Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T04:26:33.687905Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.687905Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:43e28a1b93f1c89e568a62707655157005e04565db66496a8ce279bceb72243b","observation_id":"fbb06023-a275-4336-9df3-0a0552725461","resolution":{"observed_at":"2026-08-07T04:26:33.687905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:33.690583Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.690583Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:ca5e7e639631b1c35a984391b2cc89b93d8beb8524237885a8a0e11aab01eaa9","observation_id":"f99b131c-5637-4e94-83c5-834ef548c64d","resolution":{"observed_at":"2026-08-07T04:26:33.690583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:33.693932Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.693932Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:1d23e55853efe767bff2de8bc051e2d9eaa4c77048fee8a5936100e65ea6f485","observation_id":"554d7b9b-828f-470c-b293-d0c9fbeb0677","resolution":{"observed_at":"2026-08-07T04:26:33.693932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":7,"verified_fuzzy":2},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 2 inbound Pith citation observations for arXiv:2506.10641."}