{"as_of":"2026-08-19T16:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c81073bcc00dc1f50ecffd49b10fdf99db263bf3f1f5c97b4ec371769c1992d9","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:47:30.778992Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.20993/citation-record","integrity":"/paper/2505.20993/integrity","json":"/paper/2505.20993/citation-record.json","paper":"/paper/2505.20993"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-16T14:57:46.371369Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-08-07T13:47:24.624633Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction.arXiv preprint arXiv:2309.14316, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:24.624633Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:da1ee18326c5ad388ab2a7126825b26546dbe18f71f4e4a3751d74196e498112","observation_id":"77669f41-c167-40fb-88cb-742e12c3eb62","resolution":{"observed_at":"2026-08-07T13:47:24.624633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14402","last_updated":"2024-07-16T10:33:12Z","snapshot_observed_at":"2026-08-19T12:43:23.613812Z","submitted_at":"2023-09-25T17:50:41Z","title":"Physics of Language Models: Part 3.2, Knowledge Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14402","snapshot_observed_at":"2026-08-07T13:47:24.678987Z","title":"Physics of language models: Part 3.2, knowledge manipula- tion.arXiv preprint arXiv:2309.14402, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:24.678987Z"},"links":{"cited_paper":"/paper/2309.14402","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:350b1313e68b41719fc1ab50bf7cfc1b131329365d4f01be3c9a387fc6ec5591","observation_id":"55e856c7-db6e-4c6f-a896-1412ca79a6e5","resolution":{"observed_at":"2026-08-07T13:47:24.678987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05405","last_updated":"2024-04-08T11:11:31Z","snapshot_observed_at":"2026-08-16T14:02:46.982560Z","submitted_at":"2024-04-08T11:11:31Z","title":"Physics of Language Models: Part 3.3, Knowledge Capacity Scaling Laws","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05405","snapshot_observed_at":"2026-08-07T13:47:24.755626Z","title":"Physics of language models: Part 3.3, knowledge capacity scaling laws.arXiv preprint arXiv:2404.05405, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:24.755626Z"},"links":{"cited_paper":"/paper/2404.05405","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:78ae90d98ca6128d8ed11cc72da325a0f9ec3bbaef9ecd50b28b2e00c01d7409","observation_id":"6f112d02-2bfd-4ede-9044-a566f22c6636","resolution":{"observed_at":"2026-08-07T13:47:24.755626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-08-15T04:53:45.483331Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-07T13:47:24.855390Z","title":"Layer normalization.arXiv preprint arXiv:1607.06450, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:24.855390Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:ca7df9ec958a44ab8a6cea0e22a99b8b8cf74d4322b4104b5f7d03fdb6e38ba6","observation_id":"16afb019-3eed-4473-8272-41ca8b68d353","resolution":{"observed_at":"2026-08-07T13:47:24.855390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T13:47:24.912754Z","title":"Qwen technical report.arXiv preprint arXiv:2309.16609, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:24.912754Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:e0bebd03df4a617fb0cc4de977e8adef4f74bb07aaf54a0dc4e03365d73c329c","observation_id":"23b2176d-4e82-425e-b8f6-2866d3ff9d2b","resolution":{"observed_at":"2026-08-07T13:47:24.912754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:25.069604Z","title":"Language models are few-shot learners.Advances in neural information processing systems, 33:1877–1901, 2020","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:25.069604Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:d304c0ece05d5e071777d1d4ea45f3a4bb36285e4f58bbdf8ce3e25790ae8c19","observation_id":"0e78677b-d749-4156-97ad-df0e180273ac","resolution":{"observed_at":"2026-08-07T13:47:25.069604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-08-07T13:47:25.192447Z","title":"Palm: Scaling language modeling with pathways.arXiv preprint arXiv:2204.02311, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:25.192447Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:90cddec2198575354aa0c73ed4b2c1e41e775e6bcdd09a566ea82c2acd886c39","observation_id":"f956631e-ccf7-4c9e-b442-8946d512c008","resolution":{"observed_at":"2026-08-07T13:47:25.192447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:32.038205Z","title":"Deep reinforcement learning from human preferences","venue":null,"work_id":"a596f4d2-2b50-479f-891b-5a7e8162c807","year":2017},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:25.355526Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:b06ab41e98cc04fbeb397fa9d5544a6be6c8aa9c7a94d30ee99030f8f65d7e47","observation_id":"3b07cbc9-2fe7-4eb5-bd37-4acc7e6ba60d","resolution":{"observed_at":"2026-08-07T13:47:32.118884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11416","last_updated":"2022-12-06T21:39:48Z","snapshot_observed_at":"2026-08-18T19:51:48.688199Z","submitted_at":"2022-10-20T16:58:32Z","title":"Scaling Instruction-Finetuned Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11416","snapshot_observed_at":"2026-08-07T13:47:25.493364Z","title":"Scaling instruction-finetuned language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:25.493364Z"},"links":{"cited_paper":"/paper/2210.11416","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:abf0314f63bd115f359f676887f6a8ede5a06bc63fb3ec0460efc96d69141719","observation_id":"76a9c62a-db9e-42db-9c6c-268e6b526357","resolution":{"observed_at":"2026-08-07T13:47:25.493364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:25.663234Z","title":"The language model evaluation harness, 07 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:25.663234Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:ca5c9a2f3909dda0ee31b0b5ee9a2d77c1a4a5fd1c504ccf1b8019123b01beb5","observation_id":"538f4554-f4af-4177-9424-1cfb588c36d4","resolution":{"observed_at":"2026-08-07T13:47:25.663234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.14913","last_updated":"2021-09-05T17:32:27Z","snapshot_observed_at":"2026-08-13T01:11:33.500647Z","submitted_at":"2020-12-29T19:12:05Z","title":"Transformer Feed-Forward Layers Are Key-Value Memories","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.14913","snapshot_observed_at":"2026-08-07T13:47:25.795656Z","title":"Transformer feed-forward layers are key-value memories.arXiv preprint arXiv:2012.14913, 2021","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:25.795656Z"},"links":{"cited_paper":"/paper/2012.14913","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:1a484128b9151b5a8aabb99f56ddd3cdcfb0fe194dc5fcc250a5d582f35b310e","observation_id":"35203ada-1183-40bf-bb23-db69617bd102","resolution":{"observed_at":"2026-08-07T13:47:25.795656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T13:47:25.908214Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:25.908214Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:682ed3b8b657cf6dfffd843166c07b440cd3d764d3b615b23dcf4cd93a937e6f","observation_id":"57d631bd-940d-4bb4-a26d-94866e5818a6","resolution":{"observed_at":"2026-08-07T13:47:25.908214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T13:47:26.007593Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:26.007593Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:5000836ec25915c80f4bb7950ebb524f2bcbc5540850d1425c76ee64aeae10cd","observation_id":"c7ec514e-d42c-4b3e-b9e6-ab71b275919e","resolution":{"observed_at":"2026-08-07T13:47:26.007593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-08-06T22:40:28.707813Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-08-07T13:47:26.097333Z","title":"Deepseek-coder: When the large language model meets programming–the rise of code intelligence.arXiv preprint arXiv:2401.14196, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:26.097333Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:fdf57bc8b825238976444bd2624e17c7ea98b3e9933442f806fcc3c3c49f7d20","observation_id":"6526c668-c881-48fa-8a4f-e764fa798f23","resolution":{"observed_at":"2026-08-07T13:47:26.097333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:26.164284Z","title":"A structural probe for finding syntax in word representations","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:26.164284Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:fa93424ddef04868a0700fe00e2f1837b724d1b4b51f729fba2414678bedc456","observation_id":"d57bea06-c005-4779-8f3f-6f73cb935acf","resolution":{"observed_at":"2026-08-07T13:47:26.164284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:31.865593Z","title":"Transformer quality in linear time","venue":null,"work_id":"d68aa6e3-f054-42a1-8af8-8bb0a2a1ff66","year":2022},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:26.248397Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:a70a71f811dc028c20e0d09386a0525ad3de3ac372b1feadc96ba972ee75041e","observation_id":"a6b67b36-161a-4aa8-9b42-736a8be2d767","resolution":{"observed_at":"2026-08-07T13:47:31.943650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-07T13:47:26.344745Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:26.344745Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:bb06b48798c89218e57670e232d4d8267d6f2d678b0efda00fd07af773520bee","observation_id":"9404bb06-8c59-4963-a31b-5bede295ce9d","resolution":{"observed_at":"2026-08-07T13:47:26.344745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-08-19T11:46:55.171293Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T13:47:26.450679Z","title":"Openai o1 system card.arXiv preprint arXiv:2412.16720, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:26.450679Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:e8051b03df6999d81c4ed1393b0f06605ad101b246586245c45f03603d950cc2","observation_id":"a92aa6b2-df33-4a1f-a0a6-14bed57ae34d","resolution":{"observed_at":"2026-08-07T13:47:26.450679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:31.685348Z","title":"Aime 2024 dataset","venue":null,"work_id":"9e59cf0b-3ec4-4e02-b2bf-7fc3c17c9aa6","year":2024},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:26.641950Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:42a53ba56c6ac94cd03a29c4a2e9bf0e82a65945c5ece62690c241fc53c53e98","observation_id":"46473601-accf-49e8-8151-3b11b46f4197","resolution":{"observed_at":"2026-08-07T13:47:31.781356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:26.791888Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:26.791888Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:83709bfa9e95ae06649fdec79801ac422e18bb70703e2c060349cd42c3a670de","observation_id":"c7873328-d311-4e15-93de-13dcae1fbd32","resolution":{"observed_at":"2026-08-07T13:47:26.791888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-07T13:47:26.914583Z","title":"Scaling laws for neural language models.arXiv preprint arXiv:2001.08361, 2020","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:26.914583Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:eaf704251a4e5e3abbc53309ab9476715bd7a08ebea0fc1984d929032854c020","observation_id":"a08b6bea-a8e2-4b2f-a94c-8b9f16c56159","resolution":{"observed_at":"2026-08-07T13:47:26.914583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:27.072927Z","title":"Natural questions: a benchmark for question answering research.Transactions of the Association for Computational Linguistics, 7:453–466, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:27.072927Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:4619ce023886c4abd033cf74c386e8e1b4125c2c56381b55b90c08b52cf0607c","observation_id":"d744b9d3-7208-4b3a-b03e-6c69eddc6a02","resolution":{"observed_at":"2026-08-07T13:47:27.072927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:27.243545Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:27.243545Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:ef2e377b8627cfdc9678731800575501e8f8e4705016f71df67f6e9162ddc2b9","observation_id":"05eebde5-217a-4e5a-a942-1a43d401d6b0","resolution":{"observed_at":"2026-08-07T13:47:27.243545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:27.357354Z","title":"Locating and editing factual associations in gpt.Advances in neural information processing systems, 35:17359–17372, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:27.357354Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:b3fed44caf17490b6618c6ef640467c03f257a14b7e35b63956fa9946255209d","observation_id":"790bb079-e538-4293-abbb-8c2952537878","resolution":{"observed_at":"2026-08-07T13:47:27.357354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-08-17T11:00:39.333660Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-07T13:47:27.471116Z","title":"s1: Simple test-time scaling.arXiv preprint arXiv:2501.19393, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:27.471116Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:c070c89952a82161d0ed27d4b17cc5d4b0ea5f9ebfc5c21c9f13214f7a529346","observation_id":"1d462011-07bb-4801-85eb-52ea02e07e5b","resolution":{"observed_at":"2026-08-07T13:47:27.471116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1602.06023","last_updated":"2016-08-26T16:13:13Z","snapshot_observed_at":"2026-08-14T22:09:41.573524Z","submitted_at":"2016-02-19T02:04:18Z","title":"Abstractive Text Summarization Using Sequence-to-Sequence RNNs and Beyond","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1602.06023","snapshot_observed_at":"2026-08-07T13:47:27.605528Z","title":"Abstractive text sum- marization using sequence-to-sequence rnns and beyond.arXiv preprint arXiv:1602.06023, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:27.605528Z"},"links":{"cited_paper":"/paper/1602.06023","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:5471fbd2f1dcca2be1a880e25c664e145bc1f0f4e1b343b9c14c16d03aa7a1ec","observation_id":"f278091a-edae-4c81-9c8c-a70845b48c9d","resolution":{"observed_at":"2026-08-07T13:47:27.605528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1808.08745","last_updated":"2018-08-27T09:08:18Z","snapshot_observed_at":"2026-08-14T18:36:49.421687Z","submitted_at":"2018-08-27T09:08:18Z","title":"Don't Give Me the Details, Just the Summary! Topic-Aware Convolutional Neural Networks for Extreme Summarization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.08745","snapshot_observed_at":"2026-08-07T13:47:27.756683Z","title":"Don’t give me the details, just the summary! topic-aware convolutional neural networks for extreme summarization.arXiv preprint arXiv:1808.08745, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:27.756683Z"},"links":{"cited_paper":"/paper/1808.08745","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:c194d6c2cc9ed1c124f60d0b447fbf7c2c7f319323f356d06011f26b29a7a73d","observation_id":"487c46fb-91ac-4517-9ce8-93468f423a98","resolution":{"observed_at":"2026-08-07T13:47:27.756683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-07T13:47:27.901823Z","title":"Training language models to follow instructions with human feedback.arXiv preprint arXiv:2203.02155, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:27.901823Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:9f59747b2c1f3eccd0ce8b686a047dfdf2cf4bca28d99252e265c693a24757c6","observation_id":"772acc8d-e0ed-4740-bcd4-15973c10a3b2","resolution":{"observed_at":"2026-08-07T13:47:27.901823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:28.088761Z","title":"Language models are unsupervised multitask learners.OpenAI blog, 1(8):9, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:28.088761Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:cb2ab73603835503cc327f18c43ad8a04478e7646be9b7bb2c91b508e0f0080e","observation_id":"1615f6ce-752d-44ea-8092-719a5b7cefb2","resolution":{"observed_at":"2026-08-07T13:47:28.088761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:28.202466Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:28.202466Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:3f6e88b3946e2bf7daed9a423ad796400216fde8e3dad4ae70eff42e1134b115","observation_id":"6513d4a9-7b40-4753-9048-81b292eab7d7","resolution":{"observed_at":"2026-08-07T13:47:28.202466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:28.279472Z","title":"Zero: Memory optimiza- tions toward training trillion parameter models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:28.279472Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:8ef2d9c02e6e2ff198ddfc7e325dd30ca4740d9044b30f4f60151b48405f7c24","observation_id":"1d9c83d3-0b94-45f9-9752-da730b22d677","resolution":{"observed_at":"2026-08-07T13:47:28.279472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.05250","last_updated":"2016-10-11T02:42:36Z","snapshot_observed_at":"2026-08-17T14:32:22.468812Z","submitted_at":"2016-06-16T16:36:00Z","title":"SQuAD: 100,000+ Questions for Machine Comprehension of Text","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.05250","snapshot_observed_at":"2026-08-07T13:47:28.396444Z","title":"Squad: 100,000+ questions for machine comprehension of text.arXiv preprint arXiv:1606.05250, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:28.396444Z"},"links":{"cited_paper":"/paper/1606.05250","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:5f458f8e0db2ed90076874257391c665214ed15dcedb9baaf8699468ff9c6121","observation_id":"23bbd5ee-539a-4574-9273-afced8c71bbb","resolution":{"observed_at":"2026-08-07T13:47:28.396444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:28.464962Z","title":"Deepspeed: System optimizations enable training deep learning models with over 100 billion parameters","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:28.464962Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:149420385f6af2b570857e34d6027604a9bb1691bede2ffe419935a5d6fd6ecc","observation_id":"d96b7ba3-347b-417b-9acc-d4c29d5687d2","resolution":{"observed_at":"2026-08-07T13:47:28.464962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03002","last_updated":"2023-12-03T20:53:41Z","snapshot_observed_at":"2026-08-19T13:44:13.603211Z","submitted_at":"2023-12-03T20:53:41Z","title":"The mechanistic basis of data dependence and abrupt learning in an in-context classification task","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03002","snapshot_observed_at":"2026-08-07T13:47:28.549745Z","title":"The mechanistic basis of data dependence and abrupt learning in an in-context classification task.arXiv preprint arXiv:2312.03002, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:28.549745Z"},"links":{"cited_paper":"/paper/2312.03002","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:7b66395dc34dee3554ae59913db1d92bcf2fc287dafd251cc00a0f234892a5a2","observation_id":"950eddb8-c341-4a38-8a4e-0a214ddec4b5","resolution":{"observed_at":"2026-08-07T13:47:28.549745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04761","last_updated":"2023-02-09T16:49:57Z","snapshot_observed_at":"2026-07-06T14:50:07.491434Z","submitted_at":"2023-02-09T16:49:57Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04761","snapshot_observed_at":"2026-08-07T13:47:28.633238Z","title":"Tool- former: Language models can teach themselves to use tools.arXiv preprint arXiv:2302.04761, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:28.633238Z"},"links":{"cited_paper":"/paper/2302.04761","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:e708fe00ccc78e7a059c83ba147f5c85f4d671ca45fb37bb337e58b275f11884","observation_id":"db5fb179-7aad-4d40-bd83-0590fa768dc7","resolution":{"observed_at":"2026-08-07T13:47:28.633238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T13:47:28.708526Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:28.708526Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:6b288bc3c5d991d44dad947f9d2eea550e0a054418b28402c8c6cb57634e255a","observation_id":"b32b02d2-68c3-4fc3-ba5b-cb681d4b3e85","resolution":{"observed_at":"2026-08-07T13:47:28.708526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T13:47:28.800385Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models.arXiv preprint arXiv:2402.03300, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:28.800385Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:d53b5ba46c40ae25707652982e2de64e9c2092f00388f0ae34c4cf0bfdcb6b8e","observation_id":"ea66fc28-bf33-4d36-b9a2-a785ebb4e587","resolution":{"observed_at":"2026-08-07T13:47:28.800385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:28.927468Z","title":"Roformer: Enhanced transformer with rotary position embedding.Neurocomputing, 568:127063, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:28.927468Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:108ff27626efb71cf4572dc842d6ae2626828da8a86bc6db2b10c6680871c9b1","observation_id":"625ec01b-3389-4c84-aec7-3e07aa2fabee","resolution":{"observed_at":"2026-08-07T13:47:28.927468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-08-15T22:38:53.825110Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-07T13:47:29.015912Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:29.015912Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:414cb34389d562de90ee00694cf333dc3b298e88c768a3cfa601d90a2e8ba452","observation_id":"d5713037-a29d-423c-bf5b-d68e5a559267","resolution":{"observed_at":"2026-08-07T13:47:29.015912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:29.122167Z","title":"QwQ-32B: Embracing the Power of Reinforcement Learning, March 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:29.122167Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:d9c3c06948e5a7444cc20bd5472f080d7701d09bdecc5439c40cab0cd7c88aa2","observation_id":"a915bc97-4c15-4a4c-a220-53e14de63428","resolution":{"observed_at":"2026-08-07T13:47:29.122167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T13:47:29.253806Z","title":"Llama: Open and efficient foundation language models.arXiv preprint arXiv:2302.13971, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:29.253806Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:706972de872abfafbc3a8f791f9cc9716ab194cd31fc6840711a7fd80b5eaf1d","observation_id":"9c98f776-9920-4f11-9b0e-09fda579b3c4","resolution":{"observed_at":"2026-08-07T13:47:29.253806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T13:47:29.347634Z","title":"Llama 2: Open foundation and fine-tuned chat models.arXiv preprint arXiv:2307.09288, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:29.347634Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:aa42bd9c983a11b4f7acd7a797c9098016de6fd2fd44e8abffd715aa16c63710","observation_id":"aaf4adad-0b7f-4e3b-b0a4-94f6abcd97d3","resolution":{"observed_at":"2026-08-07T13:47:29.347634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:29.454118Z","title":"Attention is all you need.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:29.454118Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:79eca8f6fd8faafec53f2625e1eb09a85c84e2f2de2bdce73462168b74446a2a","observation_id":"abb096ab-1dc4-4289-bdc9-9be6b47cd701","resolution":{"observed_at":"2026-08-07T13:47:29.454118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04284","last_updated":"2019-06-18T19:42:31Z","snapshot_observed_at":"2026-08-14T23:42:11.415122Z","submitted_at":"2019-06-07T13:58:49Z","title":"Analyzing the Structure of Attention in a Transformer Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.04284","snapshot_observed_at":"2026-08-07T13:47:29.564033Z","title":"Analyzing the structure of attention in a transformer language model.arXiv preprint arXiv:1906.04284, 2019","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:29.564033Z"},"links":{"cited_paper":"/paper/1906.04284","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:a418f01f943af07e40e50b152b66f405eb48e80c8bdff6b9ce77398c9afa9642","observation_id":"4469a898-7bae-4833-a8f2-9177657715f0","resolution":{"observed_at":"2026-08-07T13:47:29.564033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-08-16T01:49:22.176843Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-07T13:47:29.685237Z","title":"Self-consistency improves chain of thought reasoning in language models.arXiv preprint arXiv:2203.11171, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:29.685237Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:cd2913873b0b06cb4b096eef4c0c1e10fd29905babf1f41b7189926fbcec2c9c","observation_id":"fa770ff0-fdef-4baa-a2c8-f076ce87e907","resolution":{"observed_at":"2026-08-07T13:47:29.685237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10560","last_updated":"2023-05-25T23:50:07Z","snapshot_observed_at":"2026-08-17T06:16:40.579073Z","submitted_at":"2022-12-20T18:59:19Z","title":"Self-Instruct: Aligning Language Models with Self-Generated Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10560","snapshot_observed_at":"2026-08-07T13:47:29.756977Z","title":"Self-instruct: Aligning language models with self-generated instruc- tions.arXiv preprint arXiv:2212.10560, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:29.756977Z"},"links":{"cited_paper":"/paper/2212.10560","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:8e3b9b98074134de98d0f9d4a59c4689c5ec58419f81aca3c0a7bcc4e650309a","observation_id":"aeef9f74-6ff1-4123-b262-84ce4547d92d","resolution":{"observed_at":"2026-08-07T13:47:29.756977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-17T00:14:01.413100Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-07T13:47:29.827906Z","title":"Emergent abilities of large language models.arXiv preprint arXiv:2206.07682, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:29.827906Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:a29b27cbae32cf8309637d5ea857815b1c1bf1bc7baab964cdd194e64c00e033","observation_id":"579ce010-cb2f-4bf5-9f5b-89d4cda66837","resolution":{"observed_at":"2026-08-07T13:47:29.827906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-08-13T07:04:41.220509Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-07T13:47:29.952370Z","title":"Chain-of-thought prompting elicits reasoning in large language models.arXiv preprint arXiv:2201.11903, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:29.952370Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:37d245d4062da95f83235810cc166fcad3a0ad2023b17c3536e715d42810d46d","observation_id":"a48acdd5-5b4d-457d-875d-800835a61bce","resolution":{"observed_at":"2026-08-07T13:47:29.952370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:31.377884Z","title":null,"venue":null,"work_id":"286504f0-43f9-4a01-98a9-3b79af896479","year":2020},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:30.021371Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:5b6f141468ff6160ed61f19937ed7c5f872c3baf594f3083215aaeaadfa17583","observation_id":"a7a1e557-55b2-4048-addc-15e258a0e983","resolution":{"observed_at":"2026-08-07T13:47:31.504773Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.08144","last_updated":"2016-10-08T19:10:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-09-26T19:59:55Z","title":"Google's Neural Machine Translation System: Bridging the Gap between Human and Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.08144","snapshot_observed_at":"2026-08-07T13:47:30.111332Z","title":"Google’s neural machine translation system: Bridging the gap between human and machine translation.arXiv preprint arXiv:1609.08144, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:30.111332Z"},"links":{"cited_paper":"/paper/1609.08144","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:03a47997dc441ce73fd0d715201ea52d5cf72bc6bba39396ce4f9c50b8025ffc","observation_id":"3bf64778-3d8a-4aa9-bb19-0ef691507091","resolution":{"observed_at":"2026-08-07T13:47:30.111332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:30.199921Z","title":"Qwen3 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:30.199921Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:ce95a392699141bb24b504ec2f139ad22cc6ad16ae4e4c30ba92872e44e181bb","observation_id":"672aecf7-59f0-4c11-9d0e-c9384872401d","resolution":{"observed_at":"2026-08-07T13:47:30.199921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T13:47:30.385722Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:30.385722Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:a2b3e42ebef461470b4e1d19dcf6f32fe784d12991c9d1632d6468b2e685c506","observation_id":"af7e55bc-a736-48fe-a1a0-4f91129163dd","resolution":{"observed_at":"2026-08-07T13:47:30.385722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-08-17T18:51:13.219936Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-07T13:47:30.494845Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:30.494845Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:6d4b608b680ee0635d98d7a8c7289c6354bc0d09b60074f5297cda7d62838c52","observation_id":"179123ed-0508-40c4-be52-42873490cf41","resolution":{"observed_at":"2026-08-07T13:47:30.494845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:30.644570Z","title":"Simplerl-zoo: Investigating and taming zero reinforcement learning for open base models in the wild, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:30.644570Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:438ca03fcfb3f58025727a830c63f454e0589fc4e3d272bda125739adffffa18","observation_id":"72f78c0d-a16e-4278-b6c2-547478ded6a5","resolution":{"observed_at":"2026-08-07T13:47:30.644570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10625","last_updated":"2023-04-16T22:08:08Z","snapshot_observed_at":"2026-08-16T05:27:41.446467Z","submitted_at":"2022-05-21T15:34:53Z","title":"Least-to-Most Prompting Enables Complex Reasoning in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10625","snapshot_observed_at":"2026-08-07T13:47:30.778992Z","title":"Least-to-most prompting enables complex reasoning in large language models.arXiv preprint arXiv:2205.10625, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:30.778992Z"},"links":{"cited_paper":"/paper/2205.10625","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:9ec79ad6d2fcfd40ecbcf16890afa281f33ca4ce844b1a1a9328ab3c21ff8f9f","observation_id":"6a200537-80a8-422b-84fc-27bfe6553f86","resolution":{"observed_at":"2026-08-07T13:47:30.778992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-19T12:08:16.651740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":52,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 0 inbound Pith citation observations for arXiv:2505.20993."}