{"as_of":"2026-08-13T05:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:af6b5beda9b2ca0fbc23a48074deacde4707d2747e10e586f37a24e1678c641d","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T11:57:00.192496Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:26:33.685177Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T04:26:33.777023Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"cited_work":{"arxiv_id":"2411.17679","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.17679","snapshot_observed_at":"2026-08-07T04:26:33.777023Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","venue":"cs.CL","work_id":"dcd97031-f396-4ebe-8145-669b7c2f9a24","year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-10T10:30:53.166251Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.685177Z"},"links":{"cited_paper":"/paper/2411.17679","citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:d20a5d11f8c7ae003f01e4fa308a05afed2376b3a7aa4f4ceff966811c43ad92","observation_id":"f6992535-03a2-49c8-9810-0ba54a03cabd","resolution":{"observed_at":"2026-08-07T04:26:33.781426Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.17679/citation-record","integrity":"/paper/2411.17679/integrity","json":"/paper/2411.17679/citation-record.json","paper":"/paper/2411.17679"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:56:59.952541Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-12T11:56:59.952541Z"},"links":{"citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:772b00e85cb9b5539376977f574bb8940862ec2601a32d8f8b655e2fe316a52d","observation_id":"fa5ea587-6e5c-4d88-b42a-398af0c71044","resolution":{"observed_at":"2026-08-12T11:56:59.952541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:56:59.958663Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-12T11:56:59.958663Z"},"links":{"citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:766bf79e9ee7d7ae6756cdd0725e2a17f939cd9a2a73cf45333ad52cfea24b11","observation_id":"ca4da7a7-6169-4c2b-b61e-36198259463b","resolution":{"observed_at":"2026-08-12T11:56:59.958663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12288","last_updated":"2024-05-26T17:45:21Z","snapshot_observed_at":"2026-08-10T16:46:18.891275Z","submitted_at":"2023-09-21T17:52:19Z","title":"The Reversal Curse: LLMs trained on \"A is B\" fail to learn \"B is A\"","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12288","snapshot_observed_at":"2026-08-12T11:56:59.964292Z","title":"a is b\" fail to learn","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T11:56:59.964292Z"},"links":{"cited_paper":"/paper/2309.12288","citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:7af493d24ee2f89b1e5c2395b77c42e55f73f8ae1ddb6c50985db4e9d45b0bf0","observation_id":"b7dbb3ea-b2e7-4db1-9b8e-9b5360f28655","resolution":{"observed_at":"2026-08-12T11:56:59.964292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-12T11:56:59.969535Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-12T11:56:59.969535Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:ba791f6bb5b935f63af8b5f520a5b2c6dc5b505cd6884ad4db147c1abfaa4a94","observation_id":"4b1ea344-0e52-4a07-86fd-9e79443deb06","resolution":{"observed_at":"2026-08-12T11:56:59.969535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08939","last_updated":"2024-05-28T04:32:09Z","snapshot_observed_at":"2026-08-13T04:19:21.806858Z","submitted_at":"2024-02-14T04:50:18Z","title":"Premise Order Matters in Reasoning with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08939","snapshot_observed_at":"2026-08-12T11:56:59.974790Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-12T11:56:59.974790Z"},"links":{"cited_paper":"/paper/2402.08939","citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:2b929cdfb76fd397e41950ed498c84d98b48ccbeb102c7151329ed9574e1f3d5","observation_id":"d99f3cca-c569-4c95-842b-fb4e21f7ffa0","resolution":{"observed_at":"2026-08-12T11:56:59.974790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:56:59.980021Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-12T11:56:59.980021Z"},"links":{"citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:595b21988e553d2de55315f5b7f34f1bfeddff0878a40b709a76ed68cd19e69c","observation_id":"42d29c47-9872-47f9-95f1-408f19a314ed","resolution":{"observed_at":"2026-08-12T11:56:59.980021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:56:59.984919Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-12T11:56:59.984919Z"},"links":{"citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:f5ed87b9c468b2bb99bf560c2a6bcb2bd135b26e993aaa495fa99d6ebf8abc72","observation_id":"0f1edc79-0f9c-4aa4-bc88-3792a97ded8a","resolution":{"observed_at":"2026-08-12T11:56:59.984919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-12T11:56:59.990044Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-12T11:56:59.990044Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:537646c54c46c1f49aafd93f1086c5bce8da4ee99106918b40e582bb2aaca36d","observation_id":"d221b2b5-6f9f-4365-9b7e-cf78e58fa1e6","resolution":{"observed_at":"2026-08-12T11:56:59.990044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-12T11:56:59.995679Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-12T11:56:59.995679Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:8ac92ab87161b88763f43a8e58300e697ddedde88f13a90b9c28a236a0faea17","observation_id":"e6ff840c-412a-4599-a4cf-03c1542cc6cd","resolution":{"observed_at":"2026-08-12T11:56:59.995679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.03080","last_updated":"2020-11-05T20:06:50Z","snapshot_observed_at":"2026-08-08T15:45:56.132570Z","submitted_at":"2020-11-05T20:06:50Z","title":"EXAMS: A Multi-Subject High School Examinations Dataset for Cross-Lingual and Multilingual Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.03080","snapshot_observed_at":"2026-08-12T11:57:00.001264Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.001264Z"},"links":{"cited_paper":"/paper/2011.03080","citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:11655f9033f3f41985cf5f6156f5a187663d2c3fe73f9deea7fa35130072b7d0","observation_id":"22a74f22-1c08-4ef2-9e82-20818b9e6bd7","resolution":{"observed_at":"2026-08-12T11:57:00.001264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-10T12:35:09.020030Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-12T11:57:00.017329Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.017329Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:67fed5d2c83d50c862701189539b9e3fe69c3a2a4fddc80151c6b6a90b829fc0","observation_id":"ae6e4c7d-0bce-4b24-bda5-cdcb082bf32e","resolution":{"observed_at":"2026-08-12T11:57:00.017329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-12T11:57:00.026194Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.026194Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:baaa9ecae115b6d78515f61b333157c1f21ef750dc562168b503a640f38c701e","observation_id":"e19fa434-a936-4e1e-8fe8-245986afc44e","resolution":{"observed_at":"2026-08-12T11:57:00.026194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:00.867691Z","title":null,"venue":null,"work_id":"aa26f4f2-056b-4b16-9f49-dcf89bcd21ef","year":2024},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.031866Z"},"links":{"citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:19e250ac6f0f838b5cc03d2f613ef8b9996a9f9be09c7334970d734ba8e081ef","observation_id":"883de65d-70ec-42bf-b0f5-fec9de94be57","resolution":{"observed_at":"2026-08-12T11:57:00.872472Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:00.850415Z","title":null,"venue":null,"work_id":"a55872c2-4382-4600-8975-249180a6419c","year":2007},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.036919Z"},"links":{"citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:82b87efc17fe928805a68c1cc15f612ae76d99014110dfe3991d893d5f1380b6","observation_id":"1e9dd618-f98c-41af-b8bb-50fc1fd281e8","resolution":{"observed_at":"2026-08-12T11:57:00.855299Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-12T11:57:00.041983Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.041983Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:5f22dd34a45afa4c13daecdaf8eb0c7ae24cb6d2d180d3e34c3e5574cb99030d","observation_id":"aad2efe1-38d8-4abc-a0bc-f64d0a85f243","resolution":{"observed_at":"2026-08-12T11:57:00.041983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:00.834642Z","title":null,"venue":null,"work_id":"a12661f4-d916-4a6a-8bf9-c7d4fda86e13","year":2022},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.047234Z"},"links":{"citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:7799df3fee6dc2d4b3cb23d4a71a8c9053b5d778a51838f583811a85af7ac303","observation_id":"5f59c0f4-2fb3-47fc-a918-096364788f35","resolution":{"observed_at":"2026-08-12T11:57:00.839570Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:00.818407Z","title":null,"venue":null,"work_id":"2a39a24c-5557-4ffd-966d-fdc66c408609","year":2022},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.052151Z"},"links":{"citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:a0ee67db62690d1938807bcc038d6ec35ec9a4380fc71d9c8ffc861fd03bf7d4","observation_id":"70dfbe2c-7810-47b8-b8e3-32d648361130","resolution":{"observed_at":"2026-08-12T11:57:00.823384Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:00.057013Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.057013Z"},"links":{"citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:37a0cef24240e65f1416604cde1d18e08d9aaef7624208ddcca19f872d1302a1","observation_id":"37c5be3d-f173-422e-b83f-65b377b2ae99","resolution":{"observed_at":"2026-08-12T11:57:00.057013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.02608","last_updated":"2022-06-06T13:27:26Z","snapshot_observed_at":"2026-07-06T13:17:51.474784Z","submitted_at":"2022-06-06T13:27:26Z","title":"What do tokens know about their characters and how do they know it?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.02608","snapshot_observed_at":"2026-08-12T11:57:00.062443Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.062443Z"},"links":{"cited_paper":"/paper/2206.02608","citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:27bd3a7d536dbb14c04a5388f619a4c7ba217c5f7dabb2b5ea69ebfcb1ba96a8","observation_id":"21e5485c-de6c-4809-bdb7-afabc41e4594","resolution":{"observed_at":"2026-08-12T11:57:00.062443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:00.791293Z","title":"Miranda, Alisa Liu, Nouha Dziri, Shane Lyu, Yuling Gu, Saumya Malik, Victoria Graf, Jena D","venue":null,"work_id":"2f5b7376-e20e-470b-9b45-b34e1ef1bd98","year":2024},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.067832Z"},"links":{"citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:14030e6e09cfe650d8bd12094c3224e745efdc1c8fc844e75046136d3b3a6e6f","observation_id":"87b33bd2-33e3-411c-a394-843fd22a01dc","resolution":{"observed_at":"2026-08-12T11:57:00.796487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.10996","last_updated":"2022-10-20T03:42:35Z","snapshot_observed_at":"2026-07-06T14:08:02.973359Z","submitted_at":"2022-10-20T03:42:35Z","title":"Improving Chinese Spelling Check by Character Pronunciation Prediction: The Effects of Adaptivity and Granularity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.10996","snapshot_observed_at":"2026-08-12T11:57:00.072652Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.072652Z"},"links":{"cited_paper":"/paper/2210.10996","citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:9861711b48fb3676afc46c4c612d4561a6d277b8529d6350cf357471abb1c528","observation_id":"eda2b171-cac9-4722-b80d-52a1152f839c","resolution":{"observed_at":"2026-08-12T11:57:00.072652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16536","last_updated":"2024-10-26T16:27:46Z","snapshot_observed_at":"2026-08-12T23:36:14.101511Z","submitted_at":"2024-06-24T11:16:31Z","title":"C-LLM: Learn to Check Chinese Spelling Errors Character by Character","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16536","snapshot_observed_at":"2026-08-12T11:57:00.077819Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.077819Z"},"links":{"cited_paper":"/paper/2406.16536","citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:88a60755c1f04083e4241deb93909a767685094357b93d4845f8a4fdfcde0916","observation_id":"7ebf0de7-7ac4-4757-b3c2-eb8442eb0d3a","resolution":{"observed_at":"2026-08-12T11:57:00.077819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14783","last_updated":"2023-05-24T06:39:12Z","snapshot_observed_at":"2026-08-12T23:38:52.931688Z","submitted_at":"2023-05-24T06:39:12Z","title":"Disentangled Phonetic Representation for Chinese Spelling Correction","version":1},"cited_work":{"arxiv_id":"2305.14783","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.14783","snapshot_observed_at":"2026-08-12T11:57:00.406572Z","title":"Disentangled Phonetic Representation for Chinese Spelling Correction","venue":"cs.CL","work_id":"58e867ed-1f86-4695-9d37-4b5f0ef7274a","year":2023},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.082928Z"},"links":{"cited_paper":"/paper/2305.14783","citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:f300c9674864f409f54b14ba834ca98923de3edbeef2a722d5580143d78d0fc6","observation_id":"238200a8-e234-47f7-97d7-8951e69c30d3","resolution":{"observed_at":"2026-08-12T11:57:00.412597Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:00.774901Z","title":null,"venue":null,"work_id":"95818ca8-6222-4f52-87e4-7cf592806499","year":2024},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.087967Z"},"links":{"citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:51d26da3ceb03c754c679ebf84a99f03772b0e9bf312df7986fa0304992414a1","observation_id":"4f878f64-7929-4373-9412-10492f636e67","resolution":{"observed_at":"2026-08-12T11:57:00.779979Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:00.757898Z","title":null,"venue":null,"work_id":"88456c63-d607-40f5-a0c3-b0987faee371","year":2012},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.093156Z"},"links":{"citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:da1850c9d51fb77782205d3a81fbc7b0727fad9b3f05ae05d47d945eadb4505e","observation_id":"c7b819e8-be9f-420a-a15e-61982da87e9d","resolution":{"observed_at":"2026-08-12T11:57:00.763642Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1508.07909","last_updated":"2016-06-10T14:45:08Z","snapshot_observed_at":"2026-08-13T03:19:10.079224Z","submitted_at":"2015-08-31T16:37:31Z","title":"Neural Machine Translation of Rare Words with Subword Units","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1508.07909","snapshot_observed_at":"2026-08-12T11:57:00.098279Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.098279Z"},"links":{"cited_paper":"/paper/1508.07909","citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:18371adf46c9e5b7bb2bd2292effe1d5af8284e4257ee7c35ce019292a1d8222","observation_id":"0704bda8-50b0-413b-b47c-58b3a9d698e0","resolution":{"observed_at":"2026-08-12T11:57:00.098279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11357","last_updated":"2024-07-23T14:39:06Z","snapshot_observed_at":"2026-08-13T00:04:32.132525Z","submitted_at":"2024-05-18T18:08:58Z","title":"Large Language Models Lack Understanding of Character Composition of Words","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11357","snapshot_observed_at":"2026-08-12T11:57:00.103355Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.103355Z"},"links":{"cited_paper":"/paper/2405.11357","citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:132d0cbdac59ee9b2f532bc8b444515033f3c642696d3fce3985cf07c116f0f4","observation_id":"7c428d1c-8f66-4910-9c47-c3ced3047213","resolution":{"observed_at":"2026-08-12T11:57:00.103355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:00.741368Z","title":null,"venue":null,"work_id":"0f562cb6-f31f-4e4c-93d5-282672bafad3","year":2024},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.108622Z"},"links":{"citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:1472a6aa7632cd4657917eea6f31fa40b299b70494eeb5b41d19ae325cb9c818","observation_id":"3bdf6fd9-48cc-4545-89b0-e4c6f0ec3a6f","resolution":{"observed_at":"2026-08-12T11:57:00.746407Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11628","last_updated":"2023-10-17T23:34:39Z","snapshot_observed_at":"2026-08-13T05:47:14.299409Z","submitted_at":"2023-10-17T23:34:39Z","title":"Learn Your Tokens: Word-Pooled Tokenization for Language Modeling","version":1},"cited_work":{"arxiv_id":"2310.11628","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.11628","snapshot_observed_at":"2026-08-12T11:57:00.345320Z","title":"Learn Your Tokens: Word-Pooled Tokenization for Language Modeling","venue":"cs.CL","work_id":"d0f8d349-4ec7-4250-83c1-4e7afb0eb699","year":2023},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.113305Z"},"links":{"cited_paper":"/paper/2310.11628","citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:8a47a2e5646acb404e3f06e98a7ce4c782da21c7e0acd137870e97db3524a6e6","observation_id":"2e662c5e-8710-409d-a24a-bc889ba796ff","resolution":{"observed_at":"2026-08-12T11:57:00.350976Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:00.118560Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.118560Z"},"links":{"citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:fc77968ab10b782ab17624bbcf448115af05dd690e40f027fac145659e46d0cf","observation_id":"07f32173-e45b-443e-900c-d0c980dd41f7","resolution":{"observed_at":"2026-08-12T11:57:00.118560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:00.124538Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.124538Z"},"links":{"citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:959469d00fdc3c3a86420788f39bd2c49c25682e0c23612f3561a803e022cf13","observation_id":"dc64d204-0406-43b5-ba4c-31c25722edf9","resolution":{"observed_at":"2026-08-12T11:57:00.124538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:00.130161Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.130161Z"},"links":{"citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:7ec31f6e63f9d86aec5094164e16367b7626fae920914eaff397c45a570f4293","observation_id":"b016e7a3-650d-4868-9b85-5f5c8c7de7a8","resolution":{"observed_at":"2026-08-12T11:57:00.130161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:00.135236Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.135236Z"},"links":{"citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:43e8f8604e0eed6d226d6f6a48cff037f802ace855b27ba423df05161cb01787","observation_id":"8a84e136-488f-4699-8309-8ec907e1d50f","resolution":{"observed_at":"2026-08-12T11:57:00.135236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:00.141119Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.141119Z"},"links":{"citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:26ff743273b547871fd5ffdf063c3a83212d9df435c9617a3b8f2eaee3857538","observation_id":"8f7532cf-795a-4982-a57f-ca6b6ca9fd34","resolution":{"observed_at":"2026-08-12T11:57:00.141119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17721","last_updated":"2023-05-28T13:19:12Z","snapshot_observed_at":"2026-08-04T22:58:46.267324Z","submitted_at":"2023-05-28T13:19:12Z","title":"Rethinking Masked Language Modeling for Chinese Spelling Correction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17721","snapshot_observed_at":"2026-08-12T11:57:00.146935Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.146935Z"},"links":{"cited_paper":"/paper/2305.17721","citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:b8d697ede20c7fde62aa7cc0c027bb659b030a0988877e452fb3c13254817879","observation_id":"664b3f73-a742-4e8b-8dfd-fe507bff512d","resolution":{"observed_at":"2026-08-12T11:57:00.146935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:00.671025Z","title":null,"venue":null,"work_id":"721e8bd1-8c42-4b74-85cf-486a3ba8c2df","year":2013},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.151921Z"},"links":{"citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:c212fdcc76029faaf73435d7da06cbbffd81e71eef0b7c089c3e202155e6f4fa","observation_id":"6af87b1b-9ad2-4924-85b3-78d3d998365e","resolution":{"observed_at":"2026-08-12T11:57:00.677075Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14166","last_updated":"2025-02-06T22:38:32Z","snapshot_observed_at":"2026-08-12T22:20:23.659718Z","submitted_at":"2024-10-18T04:17:16Z","title":"LLM The Genius Paradox: A Linguistic and Math Expert's Struggle with Simple Word-based Counting Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14166","snapshot_observed_at":"2026-08-12T11:57:00.156580Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.156580Z"},"links":{"cited_paper":"/paper/2410.14166","citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:8ed8af5c365785bea1d609ecb8bfa6d7753448fe07480e53ffb6f97b61fc7624","observation_id":"9fc6c74a-3393-4683-a8bb-9ddcbe938fe9","resolution":{"observed_at":"2026-08-12T11:57:00.156580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:00.161741Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.161741Z"},"links":{"citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:c0ac0270e13f015eb895a09ea4f9026fae433b509926d3cf5dfcb03af542e5ad","observation_id":"27e481d5-19c3-47a1-a48d-ba3f0caf744d","resolution":{"observed_at":"2026-08-12T11:57:00.161741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-12T11:57:00.166498Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.166498Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:33cd5fcd84ef63a441c61c70d1ef3497b4de078bc2c4a52c64b758fab31bce40","observation_id":"4ebc9229-ffc5-416f-924c-3fe58f7b35d2","resolution":{"observed_at":"2026-08-12T11:57:00.166498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:00.645227Z","title":null,"venue":null,"work_id":"c9bb7d9d-4605-47d1-b4a7-d2456ec114e3","year":2003},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.171703Z"},"links":{"citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:635b2bc9072e67729f22a0f0b8334a74216bbafbcd2f17ed7a58e3681264edbd","observation_id":"98973577-f061-46bf-8305-8d54f40debc8","resolution":{"observed_at":"2026-08-12T11:57:00.650250Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13655","last_updated":"2023-07-25T17:02:38Z","snapshot_observed_at":"2026-07-06T15:58:23.846466Z","submitted_at":"2023-07-25T17:02:38Z","title":"A Comprehensive Evaluation and Analysis Study for Chinese Spelling Check","version":1},"cited_work":{"arxiv_id":"2307.13655","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.13655","snapshot_observed_at":"2026-08-12T11:57:00.267196Z","title":"A Comprehensive Evaluation and Analysis Study for Chinese Spelling Check","venue":"cs.CL","work_id":"cef98496-edfd-4e88-a8c2-4f3e6426f06c","year":2023},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.176425Z"},"links":{"cited_paper":"/paper/2307.13655","citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:df5165e3e2226de7dff47387796b85a56b2028e73a912140d863a6f9b393f711","observation_id":"cb98ca3d-24de-4cca-8b28-d9df2ebd8dd7","resolution":{"observed_at":"2026-08-12T11:57:00.274407Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:57:00.181959Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.181959Z"},"links":{"citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:6f148d46258ac4624d7fd089957c6fbf331d25363da77b69e527394e79d4f27e","observation_id":"0fc40a34-3c41-4ec8-9219-670998ebd815","resolution":{"observed_at":"2026-08-12T11:57:00.181959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13372","last_updated":"2024-06-27T22:44:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-20T08:08:54Z","title":"LlamaFactory: Unified Efficient Fine-Tuning of 100+ Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13372","snapshot_observed_at":"2026-08-12T11:57:00.187302Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.187302Z"},"links":{"cited_paper":"/paper/2403.13372","citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:e9d409c289ee86a0494bc0863fbe49c51dd77be43742871f00c9e01f5de7b21c","observation_id":"90b577b2-c3b8-453f-a83c-18da5953c044","resolution":{"observed_at":"2026-08-12T11:57:00.187302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-12T11:57:00.192496Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-12T11:57:00.192496Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2411.17679"},"observation_digest":"sha256:485b929423817e62e4f9fe6de2204d10bf4136b2161b864646094a57a55ca1f7","observation_id":"62a04d5c-e9ea-4ad5-83c5-b1028dbf9b0f","resolution":{"observed_at":"2026-08-12T11:57:00.192496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","latest_version":5,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T11:48:22.784591Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":40,"verified_exact":3,"verified_fuzzy":1},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 1 inbound Pith citation observation for arXiv:2411.17679."}