{"as_of":"2026-08-16T21:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fbd1974a680782ef0808e5505eec58661033c999919b5c70b0c7d6c4ff270f2c","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:30:10.366860Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.12387/citation-record","integrity":"/paper/2508.12387/integrity","json":"/paper/2508.12387/citation-record.json","paper":"/paper/2508.12387"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.14747","last_updated":"2023-12-20T06:50:20Z","snapshot_observed_at":"2026-08-16T14:49:49.147544Z","submitted_at":"2023-10-23T09:32:53Z","title":"MCC-KD: Multi-CoT Consistent Knowledge Distillation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.14747","snapshot_observed_at":"2026-08-15T17:30:09.997455Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:09.997455Z"},"links":{"cited_paper":"/paper/2310.14747","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:8f6c5e6a9bfd28a4187e502b6b30f89f402c100e133c3a92eac553d0eca1121a","observation_id":"8432d6b2-4b6a-497c-bace-101932d726fe","resolution":{"observed_at":"2026-08-15T17:30:09.997455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:30:10.006417Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.006417Z"},"links":{"citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:7b1cd184f5d917942b8b2cd81561116e2ca0c5cae09fcdb6b37014f11b14e6fd","observation_id":"8f640e9a-fbab-4c67-9d08-abd81a441dc8","resolution":{"observed_at":"2026-08-15T17:30:10.006417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17311","last_updated":"2023-11-29T02:07:09Z","snapshot_observed_at":"2026-08-16T16:45:56.159370Z","submitted_at":"2023-11-29T02:07:09Z","title":"Universal Self-Consistency for Large Language Model Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17311","snapshot_observed_at":"2026-08-15T17:30:10.012367Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.012367Z"},"links":{"cited_paper":"/paper/2311.17311","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:6b64a21df1bda93c7102a071d47a9bf2585970cdac701888d11ce1b684926bc0","observation_id":"6fa91cd9-ee7b-4a85-9d1e-ed8569a11dc9","resolution":{"observed_at":"2026-08-15T17:30:10.012367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:30:11.517918Z","title":null,"venue":null,"work_id":"f9eecc25-c941-4430-8862-a0fa350c1f71","year":2024},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.018584Z"},"links":{"citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:6741f78c275b964f4131e1d9bfb1a87c11d3931975b1df864a12be3985928f99","observation_id":"1e2aee67-d4b1-40b7-a6b9-5f8d6c987496","resolution":{"observed_at":"2026-08-15T17:30:11.523800Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-15T17:30:10.025196Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.025196Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:3101f74eb6a562246c7d04bd09dc9064275b3f6b3871be0e56f38eac02725554","observation_id":"8ddc747b-4e1a-4548-b861-f99b7614675f","resolution":{"observed_at":"2026-08-15T17:30:10.025196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-15T17:30:10.032031Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.032031Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:2213d1837b80efb682711821ad95c672031c8d4621ef701638ee9d7b2a40ddfa","observation_id":"2adfa126-7575-4906-b9f8-4f93a3ee4105","resolution":{"observed_at":"2026-08-15T17:30:10.032031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19842","last_updated":"2024-05-30T08:49:34Z","snapshot_observed_at":"2026-08-16T13:47:51.491649Z","submitted_at":"2024-05-30T08:49:34Z","title":"Improve Student's Reasoning Generalizability through Cascading Decomposed CoTs Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19842","snapshot_observed_at":"2026-08-15T17:30:10.039486Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.039486Z"},"links":{"cited_paper":"/paper/2405.19842","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:9731127913042a54749d549121b85802481107e9d72d75a26b1b021e32df7fa6","observation_id":"d60ea19f-685a-4960-9fe8-a93fd9afe398","resolution":{"observed_at":"2026-08-15T17:30:10.039486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13209","last_updated":"2024-05-21T21:24:34Z","snapshot_observed_at":"2026-08-16T13:50:49.636621Z","submitted_at":"2024-05-21T21:24:34Z","title":"Investigating Symbolic Capabilities of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13209","snapshot_observed_at":"2026-08-15T17:30:10.046467Z","title":"L.; and Mali, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.046467Z"},"links":{"cited_paper":"/paper/2405.13209","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:93ff1db5f24cbd45f68cf9db11f691ba5283144084a9b7ae0784dfa49b504718","observation_id":"f69e4fd5-e182-403a-a396-193db6ba8449","resolution":{"observed_at":"2026-08-15T17:30:10.046467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:30:11.489294Z","title":null,"venue":null,"work_id":"20ec3498-648b-4a6f-969a-7feef14681e2","year":2005},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.051819Z"},"links":{"citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:1e8e024ca755aacbf1ec8f26747c3f658d5b0fc004e49287a513045b2caf22c0","observation_id":"5bd4380b-62bf-44e2-b115-ea97a63a180b","resolution":{"observed_at":"2026-08-15T17:30:11.498581Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:30:10.057883Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.057883Z"},"links":{"citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:6ffdcdbf644c6a468e1b8defd2c7d2c9eff195cd792dbe37ced34c9cba8ccb53","observation_id":"6b6cf652-22fa-4e10-be71-e57b220a7bb0","resolution":{"observed_at":"2026-08-15T17:30:10.057883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-15T17:30:10.064832Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.064832Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:1fd1a7464503e6f061fd8dc5cc8df33db0995e7126e3313ac15d3fc6bce8f4b8","observation_id":"e440bc80-48a1-438c-8670-1d35ddf5c36a","resolution":{"observed_at":"2026-08-15T17:30:10.064832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:30:11.459676Z","title":null,"venue":null,"work_id":"d90c0624-5416-4a24-8cf5-d599c4b202ee","year":2024},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.070606Z"},"links":{"citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:ecae1fbab7f73bdc9cd86d5c882a7076fada4529bd1291ddb789600ba86f4627","observation_id":"c4f230cd-5547-4796-b405-5e7f9fc5bcbb","resolution":{"observed_at":"2026-08-15T17:30:11.466446Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15734","last_updated":"2023-05-25T05:35:11Z","snapshot_observed_at":"2026-08-16T15:29:53.666660Z","submitted_at":"2023-05-25T05:35:11Z","title":"On the Impact of Knowledge Distillation for Model Interpretability","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15734","snapshot_observed_at":"2026-08-15T17:30:10.076003Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.076003Z"},"links":{"cited_paper":"/paper/2305.15734","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:dd63b5a15a7837a2f5c75e64e892edba85a6d7b9fbc5c6eb2a6fbfa2ee8c8b34","observation_id":"5d8c221f-b28f-48ed-8b47-f016461849c1","resolution":{"observed_at":"2026-08-15T17:30:10.076003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-15T17:30:10.081962Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.081962Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:d3bdbfe05549c6c599e43655a473497f24c1a6b77e11cbf8b5a25a79a159e444","observation_id":"a4860222-7179-4dd9-b878-8de876ce840d","resolution":{"observed_at":"2026-08-15T17:30:10.081962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02301","last_updated":"2023-07-05T16:59:31Z","snapshot_observed_at":"2026-07-06T15:22:55.122322Z","submitted_at":"2023-05-03T17:50:56Z","title":"Distilling Step-by-Step! Outperforming Larger Language Models with Less Training Data and Smaller Model Sizes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02301","snapshot_observed_at":"2026-08-15T17:30:10.087366Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.087366Z"},"links":{"cited_paper":"/paper/2305.02301","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:a827aef737c8341712a43e4e81e1414e5213654fcdc146c3fec6a577f752bd3c","observation_id":"eca87bf4-5dff-4c63-9cac-8f6c546b1b10","resolution":{"observed_at":"2026-08-15T17:30:10.087366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-15T17:30:10.093473Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.093473Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:a8a0faf18364f74f24175dddb846e1da1342ad7505ac1c7671ad2ddbc7561b6c","observation_id":"5ce6bc4e-4f41-40c6-b904-87278c9c0d06","resolution":{"observed_at":"2026-08-15T17:30:10.093473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08763","last_updated":"2024-09-04T16:13:18Z","snapshot_observed_at":"2026-08-16T14:10:04.613423Z","submitted_at":"2024-03-13T17:58:57Z","title":"Simple and Scalable Strategies to Continually Pre-train Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08763","snapshot_observed_at":"2026-08-15T17:30:10.099822Z","title":"L.; Anthony, Q.; Lesort, T.; Belilovsky, E.; and Rish, I","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.099822Z"},"links":{"cited_paper":"/paper/2403.08763","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:a5f544ac92a43f17aa9cd61ae41680989b17aa030da72ff4ee13d2f75fee3dae","observation_id":"37f53f8d-f51c-490d-bc38-47243f20455b","resolution":{"observed_at":"2026-08-15T17:30:10.099822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-15T17:30:10.108597Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.108597Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:3a2f3f313e12e7e6bd2d12897c6101abefde7b51d39e600db6abe53a61d4be4b","observation_id":"efd70028-0b3f-47f5-9d93-3e5bfc7e3beb","resolution":{"observed_at":"2026-08-15T17:30:10.108597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-15T17:30:10.114480Z","title":"B.; Chess, B.; Child, R.; Gray, S.; Radford, A.; Wu, J.; and Amodei, D","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.114480Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:15feaeeaeb630ce68b82e3c0dbc3c4a2507eccaf650d74a35bea8c6fc1652dc0","observation_id":"ff61485d-33eb-4d24-8e62-4473686cfccb","resolution":{"observed_at":"2026-08-15T17:30:10.114480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14045","last_updated":"2023-10-14T10:46:55Z","snapshot_observed_at":"2026-08-16T15:30:38.887435Z","submitted_at":"2023-05-23T13:14:59Z","title":"The CoT Collection: Improving Zero-shot and Few-shot Learning of Language Models via Chain-of-Thought Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14045","snapshot_observed_at":"2026-08-15T17:30:10.119254Z","title":"J.; Kim, D.; Jang, J.; Ye, S.; Shin, J.; and Seo, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.119254Z"},"links":{"cited_paper":"/paper/2305.14045","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:8ddaa8ac3777025015896fd2f95f8f154781213ae13c4fac0c206b4ea18a468c","observation_id":"a7236b47-a1d3-460d-8c57-eabcea247270","resolution":{"observed_at":"2026-08-15T17:30:10.119254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19255","last_updated":"2024-07-02T03:46:03Z","snapshot_observed_at":"2026-08-16T14:14:06.180354Z","submitted_at":"2024-02-29T15:26:14Z","title":"GSM-Plus: A Comprehensive Benchmark for Evaluating the Robustness of LLMs as Mathematical Problem Solvers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19255","snapshot_observed_at":"2026-08-15T17:30:10.125206Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.125206Z"},"links":{"cited_paper":"/paper/2402.19255","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:8f6defccdb8e0c10ee185159e28336cf26b0e960c73fbcbe8aa128d6d0bb32ec","observation_id":"ce40e913-bef6-46b7-8b88-93710474b509","resolution":{"observed_at":"2026-08-15T17:30:10.125206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06726","last_updated":"2022-10-13T04:50:02Z","snapshot_observed_at":"2026-08-16T16:24:37.062581Z","submitted_at":"2022-10-13T04:50:02Z","title":"Explanations from Large Language Models Make Small Reasoners Better","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.06726","snapshot_observed_at":"2026-08-15T17:30:10.132783Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.132783Z"},"links":{"cited_paper":"/paper/2210.06726","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:a74acebffb81697646a471448d4205de26c46b92300e1a4d074aa1438338bb18","observation_id":"72803b75-f54f-42e2-ae6b-679d7e66dfd5","resolution":{"observed_at":"2026-08-15T17:30:10.132783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12082","last_updated":"2025-05-22T09:35:43Z","snapshot_observed_at":"2026-08-15T20:39:05.998045Z","submitted_at":"2025-05-17T16:53:14Z","title":"Model Merging in Pre-training of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12082","snapshot_observed_at":"2026-08-15T17:30:10.163726Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.163726Z"},"links":{"cited_paper":"/paper/2505.12082","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:37883cb45df128738049d6630f07ad1d6dab2a8afa9a44e523638b2b9b5f2bf5","observation_id":"d532f56f-1d36-4e14-a307-9d752f503eed","resolution":{"observed_at":"2026-08-15T17:30:10.163726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13183","last_updated":"2024-12-14T05:50:41Z","snapshot_observed_at":"2026-08-16T20:54:40.103768Z","submitted_at":"2024-09-20T03:23:20Z","title":"$\\textit{SKIntern}$: Internalizing Symbolic Knowledge for Distilling Better CoT Capabilities into Small Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13183","snapshot_observed_at":"2026-08-15T17:30:10.202314Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.202314Z"},"links":{"cited_paper":"/paper/2409.13183","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:a6e2e11d700168d034e59fe019bcb6fcfe62c994c30929b1cd0ee1cfb0bd877c","observation_id":"9cdbfe87-a25c-4528-81e5-64f0d3799ae5","resolution":{"observed_at":"2026-08-15T17:30:10.202314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:30:10.208928Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.208928Z"},"links":{"citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:8d4c0c2f05a564f491f67b3eecc4d37bfa517cfc00877e520dd5ba285ec6b158","observation_id":"f158f0e1-900f-44fb-82f0-f9a9af57a7da","resolution":{"observed_at":"2026-08-15T17:30:10.208928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09214","last_updated":"2024-04-07T19:17:53Z","snapshot_observed_at":"2026-08-16T14:42:57.664473Z","submitted_at":"2023-11-15T18:56:23Z","title":"Mind's Mirror: Distilling Self-Evaluation Capability and Comprehensive Thinking from Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09214","snapshot_observed_at":"2026-08-15T17:30:10.216030Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.216030Z"},"links":{"cited_paper":"/paper/2311.09214","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:29b34c2759bd244faf4530a3d9bd1e0515349857d84689b34ef467032019066c","observation_id":"dce8a3a3-818d-47c0-8276-c3770c2480a0","resolution":{"observed_at":"2026-08-15T17:30:10.216030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:30:10.222024Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.222024Z"},"links":{"citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:409aa3826d9152b180cc4da7dc4bb288e650db4973d458210e6be1360432db2e","observation_id":"2a29cc3b-2bae-4c45-b852-7083dd8091f0","resolution":{"observed_at":"2026-08-15T17:30:10.222024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.05250","last_updated":"2016-10-11T02:42:36Z","snapshot_observed_at":"2026-08-15T14:23:50.348670Z","submitted_at":"2016-06-16T16:36:00Z","title":"SQuAD: 100,000+ Questions for Machine Comprehension of Text","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.05250","snapshot_observed_at":"2026-08-15T17:30:10.228110Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.228110Z"},"links":{"cited_paper":"/paper/1606.05250","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:98721a8c3eb9b5f811fe45b85fc18376a5600527131cf30a0750bbb767af1c79","observation_id":"80340091-be7f-4bd1-abaa-4ee8b83eb3ae","resolution":{"observed_at":"2026-08-15T17:30:10.228110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:30:11.398911Z","title":null,"venue":null,"work_id":"24defe92-185d-48fa-8557-14aa166e2c35","year":2025},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.234315Z"},"links":{"citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:619a81f014c7f0a92d66efa7e077c020dff88fea73df89b232adb9a5f74e854b","observation_id":"739bd6f1-b775-42ab-be4d-6ee58d00d90e","resolution":{"observed_at":"2026-08-15T17:30:11.411147Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.00489","last_updated":"2018-06-01T10:17:23Z","snapshot_observed_at":"2026-08-16T13:51:24.988660Z","submitted_at":"2017-08-01T19:50:53Z","title":"Active Learning for Convolutional Neural Networks: A Core-Set Approach","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.00489","snapshot_observed_at":"2026-08-15T17:30:10.243928Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.243928Z"},"links":{"cited_paper":"/paper/1708.00489","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:85262b512b730f784416e2e4d159e44600fc610dde963732cedb336aa215f4bf","observation_id":"878e4188-55bf-4e77-a1ef-a89b59af5b45","resolution":{"observed_at":"2026-08-15T17:30:10.243928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08146","last_updated":"2024-10-10T17:31:23Z","snapshot_observed_at":"2026-08-13T20:49:59.656333Z","submitted_at":"2024-10-10T17:31:23Z","title":"Rewarding Progress: Scaling Automated Process Verifiers for LLM Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08146","snapshot_observed_at":"2026-08-15T17:30:10.251490Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.251490Z"},"links":{"cited_paper":"/paper/2410.08146","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:07099714295cfd18a6d48e64324ae02e3077d9ddcbd13daaa742f6f91a867763","observation_id":"f3776c99-b666-4ffb-acb3-8a308e1797a1","resolution":{"observed_at":"2026-08-15T17:30:10.251490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-15T17:30:10.261498Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.261498Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:e325bb4cf178e571911873ed9bd3332bd0f47d8bdd648ac00413f0c84466a58f","observation_id":"143b60e9-9fad-474d-b27d-b569c6246724","resolution":{"observed_at":"2026-08-15T17:30:10.261498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:30:10.267698Z","title":"A.; Abid, A.; Fisch, A.; Brown, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.267698Z"},"links":{"citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:a6da316d5d5bb7573be53a0719e074391243d99a510b2ce675da1bd7bb29e753","observation_id":"24c9c5b6-544f-4ad0-88ce-436cde86f6a2","resolution":{"observed_at":"2026-08-15T17:30:10.267698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-15T17:30:10.276856Z","title":"W.; Chowdhery, A.; Le, Q","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.276856Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:3e91eb807dd07d0fe25020d829c1ccc3bae84b1deb9a5d9cb6f01b124ec13319","observation_id":"8e60cab9-2d9e-415a-9590-5a3a96fc5387","resolution":{"observed_at":"2026-08-15T17:30:10.276856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-15T17:30:10.285920Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.285920Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:d1979b4334b4f706bf944b47156cac9eae15c00ccff286cd038bb11a160b1aec","observation_id":"39009085-8a5a-43f4-b847-496c1bef439b","resolution":{"observed_at":"2026-08-15T17:30:10.285920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12845","last_updated":"2024-06-18T17:58:28Z","snapshot_observed_at":"2026-08-16T13:41:43.608449Z","submitted_at":"2024-06-18T17:58:28Z","title":"Interpretable Preferences via Multi-Objective Reward Modeling and Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12845","snapshot_observed_at":"2026-08-15T17:30:10.291665Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.291665Z"},"links":{"cited_paper":"/paper/2406.12845","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:19553f76ac6fa4f9f1e20242c7569957b34367dcf5a851b19720c26647f03cc0","observation_id":"b2f2421b-99d1-4ea6-aaee-26f7de7dea2e","resolution":{"observed_at":"2026-08-15T17:30:10.291665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-08-16T01:49:22.176843Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-15T17:30:10.298033Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.298033Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:633a7835804c795deb48a7d97a31641b6ce6dce257acdaf7fb56f641e160b67f","observation_id":"a68d2bfc-8f75-42e3-8380-e6c34325ab38","resolution":{"observed_at":"2026-08-15T17:30:10.298033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:30:10.303249Z","title":"V.; Zhou, D.; et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.303249Z"},"links":{"citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:b9b820b3ad76c3e5ad5d61220d2168000ebc37dd41bc4f24b1e3c88aebddf9be","observation_id":"e32ed6e3-1c5b-42f6-a4a4-6e4ee7b7cdbd","resolution":{"observed_at":"2026-08-15T17:30:10.303249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.24198","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:30:10.670585Z","title":null,"venue":null,"work_id":"e5fa5384-9595-4579-bf39-f9effd523e0f","year":2025},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.313356Z"},"links":{"citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:77d192e9ef9682e38116e05cf9e96ba5d3acf78ae607f5282f4129b28fab37a9","observation_id":"166a238d-5d8c-4071-8861-3695b7761c84","resolution":{"observed_at":"2026-08-15T17:30:10.685464Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00497","last_updated":"2024-06-29T17:16:04Z","snapshot_observed_at":"2026-08-16T13:38:29.659906Z","submitted_at":"2024-06-29T17:16:04Z","title":"LLMs-as-Instructors: Learning from Errors Toward Automating Model Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00497","snapshot_observed_at":"2026-08-15T17:30:10.319553Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.319553Z"},"links":{"cited_paper":"/paper/2407.00497","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:c2be5b90b5c1e945ba18f199e20ac83ad09c5f764dbb97fd12df652e113193be","observation_id":"0ca5fcd7-cc00-45bf-bc93-c9780812a81b","resolution":{"observed_at":"2026-08-15T17:30:10.319553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01825","last_updated":"2023-09-13T03:57:29Z","snapshot_observed_at":"2026-08-16T18:17:11.146813Z","submitted_at":"2023-08-03T15:34:01Z","title":"Scaling Relationship on Learning Mathematical Reasoning with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01825","snapshot_observed_at":"2026-08-15T17:30:10.331861Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.331861Z"},"links":{"cited_paper":"/paper/2308.01825","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:67502d26c747451d0b9e35e2aae5c21c849df16cb2d321c43ed5c015a0f7985e","observation_id":"fe457447-e8ca-4eae-a665-dc163fefc2e8","resolution":{"observed_at":"2026-08-15T17:30:10.331861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01668","last_updated":"2025-06-14T09:58:51Z","snapshot_observed_at":"2026-08-15T08:53:40.360260Z","submitted_at":"2025-01-03T06:50:06Z","title":"CoT-based Synthesizer: Enhancing LLM Performance through Answer Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01668","snapshot_observed_at":"2026-08-15T17:30:10.340136Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.340136Z"},"links":{"cited_paper":"/paper/2501.01668","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:4e48ccaf87f4df974c1f9223690b4038aa677ddcba86e9c91bb2136ca6239659","observation_id":"f1f0bda7-5e68-4f86-a0c2-ad79bb686e11","resolution":{"observed_at":"2026-08-15T17:30:10.340136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07052","last_updated":"2025-07-30T16:00:53Z","snapshot_observed_at":"2026-08-16T14:43:55.614616Z","submitted_at":"2023-11-13T03:36:18Z","title":"Towards the Law of Capacity Gap in Distilling Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07052","snapshot_observed_at":"2026-08-15T17:30:10.347134Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.347134Z"},"links":{"cited_paper":"/paper/2311.07052","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:7623b9011afbe07f23f0cb5684b9ec58b73ff75d367e7d9cf6103e5f343d42df","observation_id":"5b09c08b-0b53-4b17-8b80-040962e910e2","resolution":{"observed_at":"2026-08-15T17:30:10.347134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09641","last_updated":"2025-04-13T16:32:49Z","snapshot_observed_at":"2026-08-16T12:41:36.226591Z","submitted_at":"2025-04-13T16:32:49Z","title":"TinyLLaVA-Video-R1: Towards Smaller LMMs for Video Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09641","snapshot_observed_at":"2026-08-15T17:30:10.352493Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.352493Z"},"links":{"cited_paper":"/paper/2504.09641","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:3bc80ba8aa38f3acbc8216f9ce38b202bc19a0ef56e9231c497e9c5c704997e9","observation_id":"b782d167-d4c3-44e2-8bf8-c9b727fbe744","resolution":{"observed_at":"2026-08-15T17:30:10.352493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06364","last_updated":"2023-09-18T14:23:02Z","snapshot_observed_at":"2026-08-07T12:51:50.861720Z","submitted_at":"2023-04-13T09:39:30Z","title":"AGIEval: A Human-Centric Benchmark for Evaluating Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06364","snapshot_observed_at":"2026-08-15T17:30:10.358136Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.358136Z"},"links":{"cited_paper":"/paper/2304.06364","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:bb20837236ba8581b043ac7623b1dbda368b7ab0c59f893b41b8006920cfb176","observation_id":"6dd2f60a-b4a4-4803-8b55-5ed589bf5855","resolution":{"observed_at":"2026-08-15T17:30:10.358136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.00650","last_updated":"2021-02-01T05:53:04Z","snapshot_observed_at":"2026-08-16T18:48:40.832994Z","submitted_at":"2021-02-01T05:53:04Z","title":"Rethinking Soft Labels for Knowledge Distillation: A Bias-Variance Tradeoff Perspective","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.00650","snapshot_observed_at":"2026-08-15T17:30:10.366860Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T17:30:10.366860Z"},"links":{"cited_paper":"/paper/2102.00650","citing_paper":"/paper/2508.12387"},"observation_digest":"sha256:98ec31c4c2705caf307df5be0de52db876ae4a1dffb2737f4c3dde406deaef43","observation_id":"69358d05-724e-4983-8aca-6792ff0d6fba","resolution":{"observed_at":"2026-08-15T17:30:10.366860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.12387","last_updated":"2025-08-17T14:50:23Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T13:53:05.201184Z","submitted_at":"2025-08-17T14:50:23Z","title":"ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:2508.12387."}