{"as_of":"2026-08-19T06:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b45a89646fcd5c1e8d7a7e7ec5b82674c03535e770beabef2ab044f2de422560","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T05:22:33.630625Z","state":"measured"},{"denominator":84,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":84,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":31,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:32:23.044552Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":1,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-11T05:32:16.568234Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.17395","last_updated":"2025-02-18T08:01:30Z","snapshot_observed_at":"2026-08-17T19:55:00.422509Z","submitted_at":"2024-12-23T08:47:42Z","title":"WarriorCoder: Learning from Expert Battles to Augment Code Large Language Models","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T05:32:16.568234Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2412.17395"},"observation_digest":"sha256:e91a7a8471f799f532c2ba59be6a5733c9b21f91f1394f07b5d4e1af59689ac2","observation_id":"61fd722c-90a8-4790-912b-def2dc6d2b0c","resolution":{"observed_at":"2026-08-11T05:32:16.568234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":"2502.03275","doi":"10.48550/arxiv.2502.03275","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":"ArXiv.org","work_id":"d863e729-c841-4f4e-b283-0b014ed4b795","year":2025},"citing_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-11T13:10:23.709172Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"reference_index":163,"source":"pdf_text","source_observed_at":"2026-05-14T01:29:56.480020Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2503.16419"},"observation_digest":"sha256:4ae35235cad98da8b04449983b3fdfe01d185bbdaa8da7ea49126f8e660019d2","observation_id":"640e2004-bcbf-4d6e-9007-13f08e5b1787","resolution":{"observed_at":"2026-05-14T01:29:56.842168Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-16T05:32:23.044552Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.20437","last_updated":"2025-04-29T05:27:02Z","snapshot_observed_at":"2026-08-16T13:52:59.503788Z","submitted_at":"2025-04-29T05:27:02Z","title":"GaLore 2: Large-Scale LLM Pre-Training by Gradient Low-Rank Projection","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-16T05:32:23.044552Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2504.20437"},"observation_digest":"sha256:26aeca461ac429e492f5676a2bb10c063353ddc3670f442ca77f22a628ff4b80","observation_id":"ca3e3816-92fd-4359-ad89-41f11e5cd87e","resolution":{"observed_at":"2026-08-16T05:32:23.044552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-07T14:27:39.873922Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.18962","last_updated":"2025-05-31T15:08:41Z","snapshot_observed_at":"2026-08-19T01:08:07.367254Z","submitted_at":"2025-05-25T03:35:49Z","title":"System-1.5 Reasoning: Traversal in Language and Latent Spaces with Dynamic Shortcuts","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:39.873922Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2505.18962"},"observation_digest":"sha256:eb1efadcdeccc4aaec35b7a3c8ac63a517d48226197fa8f36813ce9ffd896099","observation_id":"1b4f20bd-d0ef-4478-bcdd-19e9895222aa","resolution":{"observed_at":"2026-08-07T14:27:39.873922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-07T10:52:44.759130Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04182","last_updated":"2025-06-04T17:28:38Z","snapshot_observed_at":"2026-08-13T02:34:18.465840Z","submitted_at":"2025-06-04T17:28:38Z","title":"Long or short CoT? Investigating Instance-level Switch of Large Reasoning Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T10:52:44.759130Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2506.04182"},"observation_digest":"sha256:ee12c4434d1369915bab4e27f193eebbe615dda88cbf60ca27d58595083fd072","observation_id":"dd3660a6-87d6-4a84-9189-cf6483b32d49","resolution":{"observed_at":"2026-08-07T10:52:44.759130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-07T04:26:29.762250Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10716","last_updated":"2025-06-12T14:05:09Z","snapshot_observed_at":"2026-08-17T12:30:13.330618Z","submitted_at":"2025-06-12T14:05:09Z","title":"PREMISE: Scalable and Strategic Prompt Optimization for Efficient Mathematical Reasoning in Large Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:29.762250Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2506.10716"},"observation_digest":"sha256:34b90c5cb9f4ad6ae385939f85bdcde2d63656501a56508981e6c91968b321b1","observation_id":"0f847f77-a876-43b6-ae93-0b7bc9c5534f","resolution":{"observed_at":"2026-08-07T04:26:29.762250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-06T19:14:31.222528Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.06203","last_updated":"2025-07-10T16:43:36Z","snapshot_observed_at":"2026-08-07T04:57:37.201438Z","submitted_at":"2025-07-08T17:29:07Z","title":"A Survey on Latent Reasoning","version":2},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:31.222528Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2507.06203"},"observation_digest":"sha256:884b02c00ffd68ebf1650dbbe5139a5e07444dc9faf23105cc39881c07965fa8","observation_id":"5a901718-1f86-4f94-906e-05aa0011a166","resolution":{"observed_at":"2026-08-06T19:14:31.222528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-06T17:54:17.667598Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09662","last_updated":"2025-07-13T14:51:59Z","snapshot_observed_at":"2026-08-15T08:55:38.744613Z","submitted_at":"2025-07-13T14:51:59Z","title":"Towards Concise and Adaptive Thinking in Large Reasoning Models: A Survey","version":1},"reference_index":167,"source":"arxiv_source","source_observed_at":"2026-08-06T17:54:17.667598Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2507.09662"},"observation_digest":"sha256:f069b447321c993ab94b924be3c5e641610edc507bd8af8e069ba6dab60feec7","observation_id":"c00da6aa-09d5-45b5-8407-78a00ceea478","resolution":{"observed_at":"2026-08-06T17:54:17.667598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-05T11:39:36.734847Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning.arXiv preprint arXiv:2502.03275,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.02350","last_updated":"2025-09-02T14:16:02Z","snapshot_observed_at":"2026-08-16T00:20:00.216356Z","submitted_at":"2025-09-02T14:16:02Z","title":"Implicit Reasoning in Large Language Models: A Comprehensive Survey","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T11:39:36.734847Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2509.02350"},"observation_digest":"sha256:4562b31e1057e04a0f76b5fcccbde86806ede03db57f2a4ba6dcbce00f005d1c","observation_id":"46024e7b-6924-4273-84d2-f4f7a36fa9b2","resolution":{"observed_at":"2026-08-05T11:39:36.734847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-03T03:14:20.679669Z","title":"arXiv:2502.03275 [cs]","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.08783","last_updated":"2026-05-28T12:07:20Z","snapshot_observed_at":"2026-08-15T22:52:35.423292Z","submitted_at":"2026-02-09T15:25:12Z","title":"Dynamics Within Latent Chain-of-Thought: An Empirical Study of Causal Structure","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T03:14:20.679669Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2602.08783"},"observation_digest":"sha256:2c778ae7d5e2788d22fb955a2f051ccf3afc1d3d30e01e91b38eedca9f8ee581","observation_id":"3fb4d2ff-4add-4a13-8029-c7953fc8d524","resolution":{"observed_at":"2026-08-03T03:14:20.679669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":"2502.03275","doi":"10.48550/arxiv.2502.03275","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":"ArXiv.org","work_id":"d863e729-c841-4f4e-b283-0b014ed4b795","year":2025},"citing_paper":{"arxiv_id":"2604.08299","last_updated":"2026-04-19T12:06:32Z","snapshot_observed_at":"2026-08-15T03:15:42.885339Z","submitted_at":"2026-04-09T14:32:07Z","title":"SeLaR: Selective Latent Reasoning in Large Language Models","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-10T18:27:36.132030Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2604.08299"},"observation_digest":"sha256:501aec18991cacf8757f448bf7a35fd9a882a321a12d095e7376c448a693c469","observation_id":"bb630eea-1661-4da9-892f-08f59a7597f1","resolution":{"observed_at":"2026-05-11T00:35:49.673222Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":"2502.03275","doi":"10.48550/arxiv.2502.03275","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":"ArXiv.org","work_id":"d863e729-c841-4f4e-b283-0b014ed4b795","year":2025},"citing_paper":{"arxiv_id":"2604.17892","last_updated":"2026-05-11T03:02:30Z","snapshot_observed_at":"2026-08-12T22:16:31.802071Z","submitted_at":"2026-04-20T07:05:12Z","title":"LEPO: Latent Reasoning Policy Optimization for Large Language Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-10T05:45:50.406959Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2604.17892"},"observation_digest":"sha256:7e5ddf514643b6209a0e01668babe884d4502579ebb2a6fe452f1e325fc67ef7","observation_id":"9f11ffc6-9065-48f1-83eb-b0f656729a6b","resolution":{"observed_at":"2026-05-10T05:46:09.854017Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":"2502.03275","doi":"10.48550/arxiv.2502.03275","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":"ArXiv.org","work_id":"d863e729-c841-4f4e-b283-0b014ed4b795","year":2025},"citing_paper":{"arxiv_id":"2604.18486","last_updated":"2026-05-08T18:23:17Z","snapshot_observed_at":"2026-08-03T04:20:45.612992Z","submitted_at":"2026-04-20T16:37:22Z","title":"Xiaomi OneVL: One-Step Latent Reasoning and Planning with Vision-Language Explanation","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-10T05:42:41.112158Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2604.18486"},"observation_digest":"sha256:fcda2faa4013442b71b92523f6de129a5e0ebcb60a6ff272074a95e08d2353fb","observation_id":"458ad386-77eb-4307-ac26-308431d16fb8","resolution":{"observed_at":"2026-05-10T06:11:20.807177Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":"2502.03275","doi":"10.48550/arxiv.2502.03275","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":"ArXiv.org","work_id":"d863e729-c841-4f4e-b283-0b014ed4b795","year":2025},"citing_paper":{"arxiv_id":"2604.18486","last_updated":"2026-05-08T18:23:17Z","snapshot_observed_at":"2026-08-03T04:20:45.612992Z","submitted_at":"2026-04-20T16:37:22Z","title":"Xiaomi OneVL: One-Step Latent Reasoning and Planning with Vision-Language Explanation","version":3},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-12T00:54:23.508845Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2604.18486"},"observation_digest":"sha256:6015feaf467d1e85a9ec0100c269600f3ab612b08196724bbbdf310793b8f9cf","observation_id":"39c8e822-17f8-415c-a770-5d479634be57","resolution":{"observed_at":"2026-05-12T00:56:14.437815Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":"2502.03275","doi":"10.48550/arxiv.2502.03275","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":"ArXiv.org","work_id":"d863e729-c841-4f4e-b283-0b014ed4b795","year":2025},"citing_paper":{"arxiv_id":"2604.21027","last_updated":"2026-08-02T16:15:42Z","snapshot_observed_at":"2026-08-10T23:41:30.183421Z","submitted_at":"2026-04-22T19:18:36Z","title":"HypEHR: Hyperbolic Modeling of Electronic Health Records for Efficient Question Answering","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-05-09T23:51:47.724033Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2604.21027"},"observation_digest":"sha256:b6eb511e195edadc4ba1df0f3384ca45e4a5ea71d72a1ccd4bb655caa310b7c8","observation_id":"d817a5ec-5d8d-498e-8eb9-51047f5e3532","resolution":{"observed_at":"2026-05-09T23:54:45.630369Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":"2502.03275","doi":"10.48550/arxiv.2502.03275","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":"ArXiv.org","work_id":"d863e729-c841-4f4e-b283-0b014ed4b795","year":2025},"citing_paper":{"arxiv_id":"2604.26355","last_updated":"2026-08-17T17:12:36Z","snapshot_observed_at":"2026-08-19T05:22:11.461819Z","submitted_at":"2026-04-29T07:06:43Z","title":"Shorthand for Thought: Compressing LLM Reasoning via Entropy-Guided Supertokens","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-07T13:33:21.840958Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2604.26355"},"observation_digest":"sha256:4a0a45e432e5a392b1bd7a9b0361e3c6d18c5d0a91be4fb8ed0a8e2270819fd0","observation_id":"7dcf8f8e-4544-4113-adfe-80bd84298cc7","resolution":{"observed_at":"2026-05-12T08:51:25.736287Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":"2502.03275","doi":"10.48550/arxiv.2502.03275","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":"ArXiv.org","work_id":"d863e729-c841-4f4e-b283-0b014ed4b795","year":2025},"citing_paper":{"arxiv_id":"2605.06165","last_updated":"2026-05-07T12:51:49Z","snapshot_observed_at":"2026-08-17T00:27:13.360022Z","submitted_at":"2026-05-07T12:51:49Z","title":"Post Reasoning: Improving the Performance of Non-Thinking Models at No Cost","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-05-08T10:19:08.451445Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2605.06165"},"observation_digest":"sha256:e567fb5e78aae2357355b2a0ce500b559cde71ac205fe6d5d0e6b16de8768e9a","observation_id":"3c076905-8ec5-4128-83c4-7cbeda66898c","resolution":{"observed_at":"2026-05-11T20:06:09.549980Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":"2502.03275","doi":"10.48550/arxiv.2502.03275","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":"ArXiv.org","work_id":"d863e729-c841-4f4e-b283-0b014ed4b795","year":2025},"citing_paper":{"arxiv_id":"2605.14323","last_updated":"2026-05-14T03:35:46Z","snapshot_observed_at":"2026-08-14T17:46:50.177585Z","submitted_at":"2026-05-14T03:35:46Z","title":"Dynamic Latent Routing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-15T01:49:14.934586Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2605.14323"},"observation_digest":"sha256:82b9b3d9fbe59a6014918b7a07cbc6ed16d767f3408aaf6d854e03778743a1d1","observation_id":"cdbb3065-4e7d-4533-ae7f-743ec3fe8aff","resolution":{"observed_at":"2026-05-15T01:49:38.150490Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":"2502.03275","doi":"10.48550/arxiv.2502.03275","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":"ArXiv.org","work_id":"d863e729-c841-4f4e-b283-0b014ed4b795","year":2025},"citing_paper":{"arxiv_id":"2605.28600","last_updated":"2026-05-27T15:17:06Z","snapshot_observed_at":"2026-08-14T20:14:15.569517Z","submitted_at":"2026-05-27T15:17:06Z","title":"Transformers Provably Learn to Internalize Chain-of-Thought","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-29T14:29:10.010212Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2605.28600"},"observation_digest":"sha256:3533f473db489837624df6545cae73a4c7230a05a9b20a5397713dcf14e13c87","observation_id":"af822921-e6a3-4e57-a262-e1a7aa9ba682","resolution":{"observed_at":"2026-06-29T14:33:30.566297Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":"2502.03275","doi":"10.48550/arxiv.2502.03275","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":"ArXiv.org","work_id":"d863e729-c841-4f4e-b283-0b014ed4b795","year":2025},"citing_paper":{"arxiv_id":"2606.01532","last_updated":"2026-06-02T03:44:54Z","snapshot_observed_at":"2026-08-13T02:32:06.851856Z","submitted_at":"2026-06-01T01:28:42Z","title":"Rethinking the Role of Positional Encoding: Sliding-Window Transformers without PE Remain Turing Complete","version":2},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-06-28T15:48:48.046003Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2606.01532"},"observation_digest":"sha256:53d2631e5c0f83aa67c2533b0d28999ca9e07b101b37ad51be7fdba049f0aefd","observation_id":"c433f3cd-4aee-4557-b067-c6e1dc684535","resolution":{"observed_at":"2026-07-01T22:06:16.206369Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":"2502.03275","doi":"10.48550/arxiv.2502.03275","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":"ArXiv.org","work_id":"d863e729-c841-4f4e-b283-0b014ed4b795","year":2025},"citing_paper":{"arxiv_id":"2606.02248","last_updated":"2026-06-01T13:40:55Z","snapshot_observed_at":"2026-08-16T01:35:02.393592Z","submitted_at":"2026-06-01T13:40:55Z","title":"Geometric Latent Reasoning Induces Shorter Generations in LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T15:06:16.659461Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2606.02248"},"observation_digest":"sha256:63deb7676e1d72447b96c8f4421027a4b2dde20343757f94b193cc251336e110","observation_id":"67224aed-3f40-479f-9cef-9fc1c9b79d8f","resolution":{"observed_at":"2026-07-01T22:46:19.020444Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":"2502.03275","doi":"10.48550/arxiv.2502.03275","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":"ArXiv.org","work_id":"d863e729-c841-4f4e-b283-0b014ed4b795","year":2025},"citing_paper":{"arxiv_id":"2606.02842","last_updated":"2026-06-01T20:06:50Z","snapshot_observed_at":"2026-08-02T06:55:51.435821Z","submitted_at":"2026-06-01T20:06:50Z","title":"Spectral-Progressive Thought Flow for Lightweight Multimodal Reasoning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T15:40:05.730181Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2606.02842"},"observation_digest":"sha256:3fb874297dd31687a8244e98b4540ca0b3b5e9bff19dabe2b81f306d843ecf88","observation_id":"5d55168b-467e-4cc0-8d06-32255da5347f","resolution":{"observed_at":"2026-07-01T22:16:15.643472Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":"2502.03275","doi":"10.48550/arxiv.2502.03275","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":"ArXiv.org","work_id":"d863e729-c841-4f4e-b283-0b014ed4b795","year":2025},"citing_paper":{"arxiv_id":"2606.02871","last_updated":"2026-06-01T20:36:06Z","snapshot_observed_at":"2026-07-06T23:43:12.737017Z","submitted_at":"2026-06-01T20:36:06Z","title":"Adaptive Latent Agentic Reasoning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-28T14:24:22.855486Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2606.02871"},"observation_digest":"sha256:a48e28282313ee6dd63b2b6615745b65c14f5f550354809c8e90712d0dfd380a","observation_id":"32b647b4-fc87-4c0e-a04c-e3d7228e1b44","resolution":{"observed_at":"2026-07-01T23:26:22.313329Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":"2502.03275","doi":"10.48550/arxiv.2502.03275","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":"ArXiv.org","work_id":"d863e729-c841-4f4e-b283-0b014ed4b795","year":2025},"citing_paper":{"arxiv_id":"2606.05859","last_updated":"2026-06-04T08:30:53Z","snapshot_observed_at":"2026-08-07T17:54:19.981560Z","submitted_at":"2026-06-04T08:30:53Z","title":"TARPO: Token-Wise Latent-Explicit Reasoning via Action-Routing Policy Optimization","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-28T01:40:33.563280Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2606.05859"},"observation_digest":"sha256:bb21b6f24e7835f7febd8b95089fb88439e486f2fe39c6a26b6830d1b6881041","observation_id":"05e2947f-0417-468f-ab2f-759b1bf5806e","resolution":{"observed_at":"2026-07-02T12:56:57.572342Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":"2502.03275","doi":"10.48550/arxiv.2502.03275","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":"ArXiv.org","work_id":"d863e729-c841-4f4e-b283-0b014ed4b795","year":2025},"citing_paper":{"arxiv_id":"2606.07108","last_updated":"2026-06-08T06:45:26Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T10:02:19Z","title":"DyCon: Dynamic Reasoning Control via Evolving Difficulty Modeling","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-27T22:16:01.457276Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2606.07108"},"observation_digest":"sha256:db8a6854a6343a80469cb2e13484fbcea0306cb3ed7987d4fc28b24d63137171","observation_id":"91141922-d346-4e61-9185-59c300a867fc","resolution":{"observed_at":"2026-07-02T16:57:10.035720Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":"2502.03275","doi":"10.48550/arxiv.2502.03275","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":"ArXiv.org","work_id":"d863e729-c841-4f4e-b283-0b014ed4b795","year":2025},"citing_paper":{"arxiv_id":"2606.17924","last_updated":"2026-06-16T13:38:03Z","snapshot_observed_at":"2026-08-12T14:35:11.795811Z","submitted_at":"2026-06-16T13:38:03Z","title":"PearlVLA: Progressive Embodied Action-Plan Refinement in Latent Space","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-27T00:57:58.312567Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2606.17924"},"observation_digest":"sha256:1b23faf7dcd7122346c8ace2a104099f82a1b8ed91f015fd4a6a50d0c1c7cb42","observation_id":"3684e0bb-bbce-4634-bbec-4e6478a653ce","resolution":{"observed_at":"2026-07-03T20:58:58.504416Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":"2502.03275","doi":"10.48550/arxiv.2502.03275","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":"ArXiv.org","work_id":"d863e729-c841-4f4e-b283-0b014ed4b795","year":2025},"citing_paper":{"arxiv_id":"2606.21943","last_updated":"2026-06-20T08:20:41Z","snapshot_observed_at":"2026-08-15T21:55:25.625601Z","submitted_at":"2026-06-20T08:20:41Z","title":"Modularized Reinforcement Learning on LLMs: From MDP Creation to Exploration and Learning","version":1},"reference_index":183,"source":"pdf_text","source_observed_at":"2026-06-26T12:15:08.304150Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2606.21943"},"observation_digest":"sha256:48736d7f002fda24295b23f6897a7089f150c302cc017b201c8020377c8b8cc5","observation_id":"7c1c57b0-83f7-4998-b396-017b2dafdb1c","resolution":{"observed_at":"2026-07-04T07:59:40.755629Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":"2502.03275","doi":"10.48550/arxiv.2502.03275","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":"ArXiv.org","work_id":"d863e729-c841-4f4e-b283-0b014ed4b795","year":2025},"citing_paper":{"arxiv_id":"2606.29928","last_updated":"2026-06-29T08:05:16Z","snapshot_observed_at":"2026-08-05T15:17:05.244854Z","submitted_at":"2026-06-29T08:05:16Z","title":"Latent-CURE for Breast Cancer Diagnosis","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-30T06:11:00.336814Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2606.29928"},"observation_digest":"sha256:863e71345c20baca3502444229d4d8b1335ac1e5d4c892b78fc88b7f0ac7fb6a","observation_id":"469b44de-0523-4457-8925-df8a8127ff23","resolution":{"observed_at":"2026-06-30T06:14:19.197015Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-01T18:49:30.240588Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17188","last_updated":"2026-07-19T11:00:59Z","snapshot_observed_at":"2026-08-13T20:22:15.952538Z","submitted_at":"2026-07-19T11:00:59Z","title":"Is Your Model Thinking or Just Stagnating? PUMA: Diagnosing Reasoning Pathology via Phase-Momentum Alignment","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T18:49:30.240588Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2607.17188"},"observation_digest":"sha256:6c54cdcd3f1e1376b66584ad98bba748e191e4968cb8d3eab627ccd0b441ac20","observation_id":"4367c273-f75b-46c0-ab43-193bff4d5ac8","resolution":{"observed_at":"2026-08-01T18:49:30.240588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-01T04:14:45.940119Z","title":"Token assorted: Mixing latent and text tokens for improved language model reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22925","last_updated":"2026-07-24T21:32:48Z","snapshot_observed_at":"2026-08-18T21:19:07.523984Z","submitted_at":"2026-07-24T21:32:48Z","title":"Not All LLM Reasoning is Visible in the Chain-of-Thought","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-01T04:14:45.940119Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2607.22925"},"observation_digest":"sha256:0888140c4e7292bcdfb76b430de8aa26098b51e38cf3e69c9796e93ad30f6a0e","observation_id":"1de0688b-6c75-425a-9f0a-d845ef2b3df4","resolution":{"observed_at":"2026-08-01T04:14:45.940119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03275","snapshot_observed_at":"2026-08-15T15:12:34.074264Z","title":"arXiv preprint arXiv:2502.03275 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01593","last_updated":"2026-08-03T01:57:35Z","snapshot_observed_at":"2026-08-17T19:39:36.217813Z","submitted_at":"2026-08-03T01:57:35Z","title":"Latent Thought Credit: Multi-Answer Credit Assignment for Latent Reasoning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T15:12:34.074264Z"},"links":{"cited_paper":"/paper/2502.03275","citing_paper":"/paper/2608.01593"},"observation_digest":"sha256:7911e12959181e31a0731dfd9aa9ccc2f4981c232f3a1abd71ea1997991e2f41","observation_id":"8256d474-3a6e-4730-8d9f-48eac2aa2050","resolution":{"observed_at":"2026-08-15T15:12:34.074264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.03275/citation-record","integrity":"/paper/2502.03275/integrity","json":"/paper/2502.03275/citation-record.json","paper":"/paper/2502.03275"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:22:32.157885Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.157885Z"},"links":{"citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:236401c453a34fbe0c36e4808462de2d1cb45f75fcaaf65f7aa4404e0768e577","observation_id":"261944d7-10b3-45f3-810a-2e631b0a2cac","resolution":{"observed_at":"2026-08-09T05:22:32.157885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10631","last_updated":"2024-03-15T19:14:39Z","snapshot_observed_at":"2026-08-16T13:51:18.629241Z","submitted_at":"2023-10-16T17:54:07Z","title":"Llemma: An Open Language Model For Mathematics","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10631","snapshot_observed_at":"2026-08-09T05:22:32.218490Z","title":"D., McAleer, S., Jiang, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.218490Z"},"links":{"cited_paper":"/paper/2310.10631","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:b7420dcb181823c0c9b3f3ac651dcb24f054c23536573255f558e4df9acbebf3","observation_id":"19ade6b2-d19e-41e3-8ecb-530d9a374265","resolution":{"observed_at":"2026-08-09T05:22:32.218490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:22:35.075058Z","title":"R., Dale, D., et al","venue":null,"work_id":"563ad9d3-9db1-47c0-b027-cb9914c5d52e","year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.224538Z"},"links":{"citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:9130fce0a2d3ee184b902e7835db29f5b6af88077c20b0a58ee6d480caa92c87","observation_id":"4797e7af-7909-4acd-8a83-0a85882d8ff4","resolution":{"observed_at":"2026-08-09T05:22:35.098759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12588","last_updated":"2023-10-23T01:27:38Z","snapshot_observed_at":"2026-08-02T13:06:11.850456Z","submitted_at":"2022-11-22T21:06:00Z","title":"Program of Thoughts Prompting: Disentangling Computation from Reasoning for Numerical Reasoning Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.12588","snapshot_observed_at":"2026-08-09T05:22:32.237144Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.237144Z"},"links":{"cited_paper":"/paper/2211.12588","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:147a31e8ee2dd499c1f90f9be8f4717603bf7527ab76eab1d6e7a59c2a0f9af2","observation_id":"189cb0d7-f5da-449e-ada2-f19e0c4f5d1c","resolution":{"observed_at":"2026-08-09T05:22:32.237144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:22:35.017489Z","title":"Theoremqa: A theorem-driven question answering dataset","venue":null,"work_id":"e5bf79d2-ca65-4b7e-9789-a7c7563945cc","year":2023},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.242435Z"},"links":{"citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:16c7561404cde62ced009abd70feec960ff211bb1d778bac6c3fc4b2cca50dfd","observation_id":"de288457-7306-44ae-934c-0d66d3e1db23","resolution":{"observed_at":"2026-08-09T05:22:35.024715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:22:32.247316Z","title":"W., Hou, L., Longpre, S., Zoph, B., Tay, Y., Fedus, W., Li, Y., Wang, X., Dehghani, M., Brahma, S., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.247316Z"},"links":{"citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:f02cae7d821fcb82a99cec39b992378d6aff33da063d07fc8f50fa3169dab4e3","observation_id":"18491fff-c646-41e7-a2fa-1f79a9f682af","resolution":{"observed_at":"2026-08-09T05:22:32.247316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-09T05:22:32.258214Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.258214Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:36e1d8ecbb9d1341c8ab650d366cbd8c134ad869f13f912c7aab8ab68a6de9da","observation_id":"923ed978-23b6-4c69-91ab-9272a0658573","resolution":{"observed_at":"2026-08-09T05:22:32.258214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01460","last_updated":"2023-11-02T17:59:49Z","snapshot_observed_at":"2026-08-16T15:31:16.631395Z","submitted_at":"2023-11-02T17:59:49Z","title":"Implicit Chain of Thought Reasoning via Knowledge Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01460","snapshot_observed_at":"2026-08-09T05:22:32.302674Z","title":"Implicit chain of thought reasoning via knowledge distillation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.302674Z"},"links":{"cited_paper":"/paper/2311.01460","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:86704c7571d726f028dc9c391ac9ef5c9f1c0ac224e084ec50d4b6a3016554f8","observation_id":"8d0a1afb-1f5e-489b-89f0-2fe36efeafa6","resolution":{"observed_at":"2026-08-09T05:22:32.302674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14838","last_updated":"2024-05-23T17:54:14Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:54:14Z","title":"From Explicit CoT to Implicit CoT: Learning to Internalize CoT Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14838","snapshot_observed_at":"2026-08-09T05:22:32.374255Z","title":"From explicit cot to implicit cot: Learning to internalize cot step by step","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.374255Z"},"links":{"cited_paper":"/paper/2405.14838","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:23d2c203b2901c3d94be69e46d46c940799cd647a779157e46025b3328a4b6ba","observation_id":"b303da38-d47e-47af-b57f-c0a89250332a","resolution":{"observed_at":"2026-08-09T05:22:32.374255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-09T05:22:32.419674Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.419674Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:b13f3bf72ab784db2337fcd46586657adcddaa1f768270323e351404089d13d4","observation_id":"836f65b2-8b9e-44ab-b49c-b4aa438ca0c0","resolution":{"observed_at":"2026-08-09T05:22:32.419674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:22:34.981515Z","title":"L., Jian, L., Lin, B","venue":null,"work_id":"51c17b7b-1956-4451-922b-081ba4a7bf51","year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.504890Z"},"links":{"citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:dd9bf95f33838a763b8381e35e4f8c851af12be27120f93bfa688cf4cfeb5440","observation_id":"e29318c6-7b71-472e-b6fb-ef2dd59f222e","resolution":{"observed_at":"2026-08-09T05:22:34.988534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:22:34.963411Z","title":"Towards revealing the mystery behind chain of thought: a theoretical perspective","venue":null,"work_id":"a7ddc01b-8bb2-4c33-8749-0b2e85b9ac09","year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.550406Z"},"links":{"citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:d2866b16e91d730a931faa6f1ad51caf4753c140b7bb5b44df869d45bfe67fb6","observation_id":"c0334db6-baeb-4493-928f-851c5c12e1ab","resolution":{"observed_at":"2026-08-09T05:22:34.968884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03683","last_updated":"2024-04-01T06:50:52Z","snapshot_observed_at":"2026-08-17T18:41:15.883469Z","submitted_at":"2024-04-01T06:50:52Z","title":"Stream of Search (SoS): Learning to Search in Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03683","snapshot_observed_at":"2026-08-09T05:22:32.557993Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.557993Z"},"links":{"cited_paper":"/paper/2404.03683","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:70d618b7a186a9f6613f97de73aaf528a458f8abc29c4ccf11ffbabefd6b2bde","observation_id":"a12ab43b-3121-46b4-8fae-1bd2bc2ad424","resolution":{"observed_at":"2026-08-09T05:22:32.557993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-18T21:09:48.830937Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-09T05:22:32.565978Z","title":"S., Menon, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.565978Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:f60a96b3c7f1163cc15e11dd33898bc47eb27afb2fba18b5c1bbfa996a8439ef","observation_id":"ad26f8bf-777b-49bf-8912-6e541244df80","resolution":{"observed_at":"2026-08-09T05:22:32.565978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06769","last_updated":"2025-11-03T00:53:34Z","snapshot_observed_at":"2026-08-17T06:12:37.525438Z","submitted_at":"2024-12-09T18:55:56Z","title":"Training Large Language Models to Reason in a Continuous Latent Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06769","snapshot_observed_at":"2026-08-09T05:22:32.574089Z","title":"Training large language models to reason in a continuous latent space","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.574089Z"},"links":{"cited_paper":"/paper/2412.06769","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:8fc157432cf066569523c392a7203778a4372a6faa8bf07c12fcbd91c85cb252","observation_id":"bc077f06-4a9d-40aa-9ed9-4f25abeffd49","resolution":{"observed_at":"2026-08-09T05:22:32.574089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:22:34.942589Z","title":"E., Nilsson, N","venue":null,"work_id":"0dd67cba-0a41-4765-b9dc-2c6a3f747fd9","year":1968},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.585234Z"},"links":{"citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:4e5fdeedcabee7526c85af29d865ca1f2ff0b26c61914d06589b00c41327b0bc","observation_id":"ecf4406b-d843-4d99-bad9-58a7fee63a2a","resolution":{"observed_at":"2026-08-09T05:22:34.950664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14008","last_updated":"2024-06-06T13:19:44Z","snapshot_observed_at":"2026-08-03T03:39:09.398343Z","submitted_at":"2024-02-21T18:49:26Z","title":"OlympiadBench: A Challenging Benchmark for Promoting AGI with Olympiad-Level Bilingual Multimodal Scientific Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14008","snapshot_observed_at":"2026-08-09T05:22:32.594956Z","title":"L., Shen, J., Hu, J., Han, X., Huang, Y., Zhang, Y., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.594956Z"},"links":{"cited_paper":"/paper/2402.14008","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:c65f469217809672172e60270a715bfe0edcbe39c1dc30f28abe33bcbd5c8f21","observation_id":"e508001b-e826-4378-b987-2f3e1275ec73","resolution":{"observed_at":"2026-08-09T05:22:32.594956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:22:34.818393Z","title":"Measuring mathematical problem solving with the math dataset","venue":null,"work_id":"740e50ba-9c22-4e86-aaf1-612d2dbc56ef","year":null},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.603063Z"},"links":{"citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:8a80479d2d1fa1f6a3b505707dee6f3179b4a19a3f151ddd47adbca89f920151","observation_id":"a542b6c0-fa54-448e-8c9d-59eef10cce17","resolution":{"observed_at":"2026-08-09T05:22:34.874755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:22:32.624258Z","title":"Measuring mathematical problem solving with the math dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.624258Z"},"links":{"citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:4c90e739e8bb43b2575823e80307dd53e66ca675c7acfc7e95f57570e5099081","observation_id":"ca37edb0-095c-467e-8cd1-4ff688afc211","resolution":{"observed_at":"2026-08-09T05:22:32.624258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:22:34.635640Z","title":"Forward-backward reasoning in large language models for mathematical verification","venue":null,"work_id":"e89e49cc-7d60-437f-8c41-9c488d485b1e","year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.698651Z"},"links":{"citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:1134870bf4153bf074811cd1e16b24c402c904529f63a88c963061871ee959f9","observation_id":"e3f1f511-95b1-49c5-9ae6-03865ecc1d06","resolution":{"observed_at":"2026-08-09T05:22:34.715766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.10291","last_updated":"2023-01-24T11:09:30Z","snapshot_observed_at":"2026-08-19T03:54:50.039281Z","submitted_at":"2022-08-22T13:19:02Z","title":"Efficient Planning in a Compact Latent Action Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.10291","snapshot_observed_at":"2026-08-09T05:22:32.802915Z","title":"Efficient planning in a compact latent action space","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.802915Z"},"links":{"cited_paper":"/paper/2208.10291","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:878cfe16b76b66424f8632040149fe1b9dfd7273ca6e0409150645f969edee30","observation_id":"fddac71e-bc02-4c6f-9758-872749e1aebf","resolution":{"observed_at":"2026-08-09T05:22:32.802915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02682","last_updated":"2023-12-05T11:40:24Z","snapshot_observed_at":"2026-08-16T14:37:32.055894Z","submitted_at":"2023-12-05T11:40:24Z","title":"H-GAP: Humanoid Control with a Generalist Planner","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02682","snapshot_observed_at":"2026-08-09T05:22:32.863441Z","title":"H-gap: Humanoid control with a generalist planner","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.863441Z"},"links":{"cited_paper":"/paper/2312.02682","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:22555794f7674618a0aca9f261ab0cff2d883c168a8953b20d0d1d73696fc174","observation_id":"4e4569f9-5f34-4437-9d6c-442435268721","resolution":{"observed_at":"2026-08-09T05:22:32.863441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14045","last_updated":"2023-10-14T10:46:55Z","snapshot_observed_at":"2026-08-16T15:30:38.887435Z","submitted_at":"2023-05-23T13:14:59Z","title":"The CoT Collection: Improving Zero-shot and Few-shot Learning of Language Models via Chain-of-Thought Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14045","snapshot_observed_at":"2026-08-09T05:22:32.870675Z","title":"J., Kim, D., Jang, J., Ye, S., Shin, J., and Seo, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.870675Z"},"links":{"cited_paper":"/paper/2305.14045","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:dfc82bbd91aee34ec3061db9d2fe8e77802482c2fe97f017104d21e4967c401d","observation_id":"6cca35c4-060e-4932-a5e8-3a0e5209f7cd","resolution":{"observed_at":"2026-08-09T05:22:32.870675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:22:32.876998Z","title":"S., Reid, M., Matsuo, Y., and Iwasawa, Y","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.876998Z"},"links":{"citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:bbfce7d188f4198dc5fcd4a78e08d8cac2a486b6bef0f783371b57ae83d6f102","observation_id":"1bbafcd1-9f8b-44ee-acc3-3a02bca8967f","resolution":{"observed_at":"2026-08-09T05:22:32.876998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:22:34.604525Z","title":"Beyond a*: Better planning with transformers via search dynamics bootstrapping","venue":null,"work_id":"dd45a382-f853-4bd6-a9cb-a0469c961aa9","year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.883521Z"},"links":{"citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:e4caaf4025102ff7a529ffb972a10fb7bc73e2b06cb8156332b15043bdcd391c","observation_id":"695e60be-d961-4bf5-b8ad-705685d1d8e2","resolution":{"observed_at":"2026-08-09T05:22:34.611218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12875","last_updated":"2024-09-21T06:48:45Z","snapshot_observed_at":"2026-08-16T14:17:00.905070Z","submitted_at":"2024-02-20T10:11:03Z","title":"Chain of Thought Empowers Transformers to Solve Inherently Serial Problems","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12875","snapshot_observed_at":"2026-08-09T05:22:32.890490Z","title":"Chain of thought empowers transformers to solve inherently serial problems, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.890490Z"},"links":{"cited_paper":"/paper/2402.12875","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:df608387ec15c74daa644faf7a9271b3dd0d91889a9650564ecc9a425867b2a8","observation_id":"c89d6520-6513-417b-9bdd-559a394ef541","resolution":{"observed_at":"2026-08-09T05:22:32.890490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:22:34.540902Z","title":"Y., Bras, R","venue":null,"work_id":"80c3ad97-c985-40b3-8025-5287dfa105e2","year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.897309Z"},"links":{"citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:f05e670f733202e452930827b61f0fd2dcc6aefca756722e6d6296cf54f3ee40","observation_id":"f2a9ae31-3a5c-4c05-b7e8-0b6d25b44e3d","resolution":{"observed_at":"2026-08-09T05:22:34.576444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17747","last_updated":"2024-12-23T18:02:25Z","snapshot_observed_at":"2026-08-13T10:25:28.306021Z","submitted_at":"2024-12-23T18:02:25Z","title":"Deliberation in Latent Space via Differentiable Cache Augmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17747","snapshot_observed_at":"2026-08-09T05:22:32.903040Z","title":"Deliberation in latent space via differentiable cache augmentation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.903040Z"},"links":{"cited_paper":"/paper/2412.17747","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:d3d58af37827c20e5e5ef430145687ed7a663adc928373783749622d5fa63f87","observation_id":"069496ad-7457-4596-9059-f52753359572","resolution":{"observed_at":"2026-08-09T05:22:32.903040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:22:34.436748Z","title":"Finemath: the finest collection of mathematical content, 2024","venue":null,"work_id":"512cbebb-e727-4e3b-9faf-d110c2eb6c12","year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.937176Z"},"links":{"citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:c116331286f471679f9c611642ce65ddab83df3dad7e4cd453ffa8f36566286c","observation_id":"5a56bb5e-7fdc-4289-8e13-a983e2ac9239","resolution":{"observed_at":"2026-08-09T05:22:34.481424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00114","last_updated":"2021-11-30T21:32:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-11-30T21:32:46Z","title":"Show Your Work: Scratchpads for Intermediate Computation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00114","snapshot_observed_at":"2026-08-09T05:22:33.061214Z","title":"J., Gur-Ari, G., Michalewski, H., Austin, J., Bieber, D., Dohan, D., Lewkowycz, A., Bosma, M., Luan, D., et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.061214Z"},"links":{"cited_paper":"/paper/2112.00114","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:4f731ff90973054e1e5474fd0ed0a402f2d892a6fa245fadba6c8da28525d6b2","observation_id":"c866a5c8-0763-4af9-ac1e-23a262359024","resolution":{"observed_at":"2026-08-09T05:22:33.061214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09871","last_updated":"2024-12-13T05:33:32Z","snapshot_observed_at":"2026-08-15T13:45:11.226724Z","submitted_at":"2024-12-13T05:33:32Z","title":"Byte Latent Transformer: Patches Scale Better Than Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09871","snapshot_observed_at":"2026-08-09T05:22:33.078204Z","title":"Byte latent transformer: Patches scale better than tokens","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.078204Z"},"links":{"cited_paper":"/paper/2412.09871","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:69776a5e115fbc8b73d23c5bf49ed88847abf467ba36cbafce876426b2dca8b8","observation_id":"c8b92a72-72c2-4424-bec4-17a25157877c","resolution":{"observed_at":"2026-08-09T05:22:33.078204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15758","last_updated":"2024-04-24T09:30:00Z","snapshot_observed_at":"2026-08-18T06:15:55.315332Z","submitted_at":"2024-04-24T09:30:00Z","title":"Let's Think Dot by Dot: Hidden Computation in Transformer Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15758","snapshot_observed_at":"2026-08-09T05:22:33.083474Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.083474Z"},"links":{"cited_paper":"/paper/2404.15758","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:eafdb4a95c1bbc4199c8d0131ee79ab1bccde69e3055c91e1da0b9abc346304a","observation_id":"d8b59338-403d-40bd-8971-6425ee665355","resolution":{"observed_at":"2026-08-09T05:22:33.083474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:22:33.090077Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.090077Z"},"links":{"citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:d734a4b9245ac7a2a387cfbf8c7281f3318688456f1c563ca8d4e70639715320","observation_id":"7ae9496a-0921-47da-ad35-5ff8f3072e58","resolution":{"observed_at":"2026-08-09T05:22:33.090077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:22:33.095613Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.095613Z"},"links":{"citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:cd25d1c6943e1d76426b58660e844fa798f87fa875b224d229b4750672ee7128","observation_id":"a529de6e-c377-4ce3-9d20-ab6c5ef28747","resolution":{"observed_at":"2026-08-09T05:22:33.095613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01240","last_updated":"2023-03-02T03:54:28Z","snapshot_observed_at":"2026-08-16T16:27:11.895195Z","submitted_at":"2022-10-03T21:34:32Z","title":"Language Models Are Greedy Reasoners: A Systematic Formal Analysis of Chain-of-Thought","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.01240","snapshot_observed_at":"2026-08-09T05:22:33.100793Z","title":"and He, H","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.100793Z"},"links":{"cited_paper":"/paper/2210.01240","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:bc26d67474188410b7ffec7a73415d04ca212dd70e7b51531272ee302330b732","observation_id":"65165c19-4a92-4f70-8962-638099c0ea21","resolution":{"observed_at":"2026-08-09T05:22:33.100793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.01557","last_updated":"2019-04-02T17:26:41Z","snapshot_observed_at":"2026-08-14T16:52:50.428130Z","submitted_at":"2019-04-02T17:26:41Z","title":"Analysing Mathematical Reasoning Abilities of Neural Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.01557","snapshot_observed_at":"2026-08-09T05:22:33.105528Z","title":"Analysing mathematical reasoning abilities of neural models","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.105528Z"},"links":{"cited_paper":"/paper/1904.01557","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:237258b4dc8f52550daaa3b4663da9a8709e7bed1f092ebc868bd7e5bdbfbbc2","observation_id":"d28d43e8-c6eb-41d5-9ff7-e40918087a3f","resolution":{"observed_at":"2026-08-09T05:22:33.105528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09918","last_updated":"2025-07-11T03:52:42Z","snapshot_observed_at":"2026-08-16T13:09:53.102837Z","submitted_at":"2024-10-13T16:53:02Z","title":"Dualformer: Controllable Fast and Slow Thinking by Learning with Randomized Reasoning Traces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09918","snapshot_observed_at":"2026-08-09T05:22:33.111781Z","title":"Dualformer: Controllable fast and slow thinking by learning with randomized reasoning traces","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.111781Z"},"links":{"cited_paper":"/paper/2410.09918","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:7e54089441389a52c3559600cac19d43e7b212fbeb8ce167d9666b2a1ef76fd0","observation_id":"3595bde9-c9c6-4564-9c6a-2861762cf69b","resolution":{"observed_at":"2026-08-09T05:22:33.111781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20437","last_updated":"2025-04-29T05:27:02Z","snapshot_observed_at":"2026-08-16T13:52:59.503788Z","submitted_at":"2025-04-29T05:27:02Z","title":"GaLore 2: Large-Scale LLM Pre-Training by Gradient Low-Rank Projection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.20437","snapshot_observed_at":"2026-08-09T05:22:33.116839Z","title":"Galore 2: Large-scale llm pre-training by gradient low-rank projection","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.116839Z"},"links":{"cited_paper":"/paper/2504.20437","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:5bd3afcb666c49bc1d6afeb194ce13284a6b55e83fde92798ce6a3ebc1b2a252","observation_id":"6271ed04-48b0-4f08-9354-d7415b1682a5","resolution":{"observed_at":"2026-08-09T05:22:33.116839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02884","last_updated":"2024-03-05T11:42:59Z","snapshot_observed_at":"2026-08-16T14:12:41.871350Z","submitted_at":"2024-03-05T11:42:59Z","title":"MathScale: Scaling Instruction Tuning for Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02884","snapshot_observed_at":"2026-08-09T05:22:33.207513Z","title":"Mathscale: Scaling instruction tuning for mathematical reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.207513Z"},"links":{"cited_paper":"/paper/2403.02884","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:353ac80ee93448cf04b4bce7b627b8847025da850807b986ef3340305f5d7ab4","observation_id":"95ef10ee-acc7-4faf-b801-3a4096439203","resolution":{"observed_at":"2026-08-09T05:22:33.207513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13690","last_updated":"2024-12-23T17:32:21Z","snapshot_observed_at":"2026-08-16T13:41:56.955991Z","submitted_at":"2024-06-18T07:14:02Z","title":"DART-Math: Difficulty-Aware Rejection Tuning for Mathematical Problem-Solving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13690","snapshot_observed_at":"2026-08-09T05:22:33.286278Z","title":"Dart-math: Difficulty-aware rejection tuning for mathematical problem-solving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.286278Z"},"links":{"cited_paper":"/paper/2407.13690","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:43e007ecfb6cd6f22253c6c435fd4d7a55936d75d26eba14e4383b1fd2172f21","observation_id":"4f55b28b-20a2-4adb-92c4-026e1a8f59e0","resolution":{"observed_at":"2026-08-09T05:22:33.286278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:22:33.390145Z","title":"Neural discrete representation learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.390145Z"},"links":{"citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:a6655c96d0d6fa927dca8b0c4cb451f9a715ae8a3bfefada8aa39dae3e9d7a9a","observation_id":"02cbfcc0-b483-452e-96fd-ee7904e3d1f6","resolution":{"observed_at":"2026-08-09T05:22:33.390145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10200","last_updated":"2024-05-23T20:53:59Z","snapshot_observed_at":"2026-08-18T18:57:10.378740Z","submitted_at":"2024-02-15T18:55:41Z","title":"Chain-of-Thought Reasoning Without Prompting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10200","snapshot_observed_at":"2026-08-09T05:22:33.442997Z","title":"and Zhou, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.442997Z"},"links":{"cited_paper":"/paper/2402.10200","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:7518c3c1bd7926cb8564031eca747195351ff846a57dba5e75daf57e94184fbf","observation_id":"89263b00-304d-4ea4-9f8a-05a55bf49d47","resolution":{"observed_at":"2026-08-09T05:22:33.442997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-08-16T01:49:22.176843Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-09T05:22:33.448130Z","title":"Self-consistency improves chain of thought reasoning in language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.448130Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:701843a767ce425c3a77d03c5b89c5fc298b4ebd34cc0e7976743fd232e0ee98","observation_id":"467ae320-3ac3-4f24-a4c1-831e584e5a5c","resolution":{"observed_at":"2026-08-09T05:22:33.448130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05707","last_updated":"2024-08-06T19:53:17Z","snapshot_observed_at":"2026-08-16T14:53:49.538132Z","submitted_at":"2023-10-09T13:29:37Z","title":"Guiding Language Model Reasoning with Planning Tokens","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05707","snapshot_observed_at":"2026-08-09T05:22:33.453157Z","title":"Y., and Sordoni, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.453157Z"},"links":{"cited_paper":"/paper/2310.05707","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:6fbd4724f86bfa0747738a4541103ee5b79863df1bb0c2a0a9c68dbaa388bffe","observation_id":"38089244-ea72-4893-8b3c-42db39940a37","resolution":{"observed_at":"2026-08-09T05:22:33.453157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:22:34.322924Z","title":"V., Zhou, D., et al","venue":null,"work_id":"fcc03897-7aba-4394-8483-264e2c3351fc","year":2022},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.457926Z"},"links":{"citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:2c98cc42b17128e62885738316f1e09b3c4f2718d42730f1ec4d5d4d5500e553","observation_id":"7a4cc883-1ff5-444e-86cc-63b07f184d7a","resolution":{"observed_at":"2026-08-09T05:22:34.364199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:22:33.462351Z","title":"V., Zhou, D., et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.462351Z"},"links":{"citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:c9f84da110a3b5f3ad5f443c46e2aafe833c6a0a0cdbc14b8bc75fab7ba4876e","observation_id":"52e6cd49-af4d-45b3-a256-2b1ef945d4a9","resolution":{"observed_at":"2026-08-09T05:22:33.462351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05459","last_updated":"2025-03-05T13:57:56Z","snapshot_observed_at":"2026-08-16T13:11:45.819514Z","submitted_at":"2024-10-07T19:45:09Z","title":"From Sparse Dependence to Sparse Attention: Unveiling How Chain-of-Thought Enhances Transformer Sample Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05459","snapshot_observed_at":"2026-08-09T05:22:33.468853Z","title":"From sparse dependence to sparse attention: Unveiling how chain-of-thought enhances transformer sample efficiency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.468853Z"},"links":{"cited_paper":"/paper/2410.05459","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:fcad17b98aa378f03180467278a2f37fc011f8a0b008f05f235a1171e82620c2","observation_id":"d3743882-f94d-451a-bbc8-96d8964191d8","resolution":{"observed_at":"2026-08-09T05:22:33.468853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-09T05:22:33.473999Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.473999Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:b2c76a72ac1f2f5123beef739c587f69aead3d7960b7d7ff02b8debb1e24aa89","observation_id":"66b763e7-a1f5-40d1-b0f3-e11308d36d85","resolution":{"observed_at":"2026-08-09T05:22:33.473999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:22:33.479646Z","title":"Tree of thoughts: Deliberate problem solving with large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.479646Z"},"links":{"citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:5b194ed5ada34e55befa1858fde8eac68613fc03cd1979ab125763e94ff3ecd6","observation_id":"c1d3ebe6-37c8-478e-9495-995a9b9a2dbf","resolution":{"observed_at":"2026-08-09T05:22:33.479646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-13T10:57:13.012119Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12284","snapshot_observed_at":"2026-08-09T05:22:33.484399Z","title":"T., Li, Z., Weller, A., and Liu, W","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.484399Z"},"links":{"cited_paper":"/paper/2309.12284","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:01d2831ec706060b701dc13b12413a07e4927117baa1c16ca92ef94bd1955a17","observation_id":"2e29f93b-4891-4173-b5b3-31ea377478cd","resolution":{"observed_at":"2026-08-09T05:22:33.484399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06023","last_updated":"2024-07-24T18:40:36Z","snapshot_observed_at":"2026-08-17T02:05:35.367393Z","submitted_at":"2024-07-08T15:17:46Z","title":"Distilling System 2 into System 1","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06023","snapshot_observed_at":"2026-08-09T05:22:33.519990Z","title":"Distilling system 2 into system 1","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.519990Z"},"links":{"cited_paper":"/paper/2407.06023","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:7854e8203cefdd5760d3459d50f088d725bdea374013c944ef5d17cef2f82520","observation_id":"571742c2-1501-486e-abb1-1df06d46e972","resolution":{"observed_at":"2026-08-09T05:22:33.519990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05653","last_updated":"2023-10-03T02:48:42Z","snapshot_observed_at":"2026-08-18T06:58:51.738907Z","submitted_at":"2023-09-11T17:47:22Z","title":"MAmmoTH: Building Math Generalist Models through Hybrid Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05653","snapshot_observed_at":"2026-08-09T05:22:33.554899Z","title":"Mammoth: Building math generalist models through hybrid instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.554899Z"},"links":{"cited_paper":"/paper/2309.05653","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:a55ef3d9e27acbe2c2596ba4f3fc544c51c9fbab45790f07e0e9204fb3697858","observation_id":"655cb3fe-7512-44d5-906b-dd56e0aa0ad0","resolution":{"observed_at":"2026-08-09T05:22:33.554899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04669","last_updated":"2024-10-28T05:05:04Z","snapshot_observed_at":"2026-08-16T13:54:31.660780Z","submitted_at":"2024-05-07T21:03:51Z","title":"Towards a Theoretical Understanding of the 'Reversal Curse' via Training Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04669","snapshot_observed_at":"2026-08-09T05:22:33.630625Z","title":"Towards a theoretical understanding of the'reversal curse'via training dynamics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:33.630625Z"},"links":{"cited_paper":"/paper/2405.04669","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:4cc9debe9c0dec64feb397fb7427ecd504cbe47022cd03284e9392d0131b0d89","observation_id":"f0261e3f-3a43-4f74-9811-3ee00a9ba015","resolution":{"observed_at":"2026-08-09T05:22:33.630625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T02:33:47.410604Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 31 inbound Pith citation observations for arXiv:2502.03275."}