{"as_of":"2026-08-10T16:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d98f391f9bfb9c35c5f0f2553310b5dd21089b554c8bc1befeb1a89e6ddd4285","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:08:44.455938Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T01:13:11.483599Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T20:38:56.094620Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"cited_work":{"arxiv_id":"2505.22635","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22635","snapshot_observed_at":"2026-07-03T20:38:56.094620Z","title":"arXiv preprint arXiv:2505.22635 , year=","venue":null,"work_id":"a2696a80-6e4e-4af4-bfe2-07f4e2054bbb","year":null},"citing_paper":{"arxiv_id":"2606.18089","last_updated":"2026-07-05T17:40:26Z","snapshot_observed_at":"2026-07-12T13:34:39.011240Z","submitted_at":"2026-06-16T15:55:28Z","title":"From Reasoning Traces to Reusable Modules: Understanding Compositional Generalization in Language Model Reasoning","version":1},"reference_index":146,"source":"arxiv_source","source_observed_at":"2026-06-27T01:13:11.483599Z"},"links":{"cited_paper":"/paper/2505.22635","citing_paper":"/paper/2606.18089"},"observation_digest":"sha256:f55f6fc0be416b0916d36a310c821034a76b355c00be7a49cc2e9e348e0683ee","observation_id":"1dcca12c-4b39-48e6-b2d3-d6751215a7bd","resolution":{"observed_at":"2026-07-03T20:38:56.095961Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.22635/citation-record","integrity":"/paper/2505.22635/integrity","json":"/paper/2505.22635/citation-record.json","paper":"/paper/2505.22635"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:55.266925Z","title":"Compositional reasoning in early childhood","venue":null,"work_id":"8e0542a5-5fa7-4a73-8cd3-c523d74dfdb7","year":2016},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:31.745228Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:e0fc2e2b22e03c1454a664bbe85f95de48b8dc19ba08053c0389584442cd210b","observation_id":"c28948ff-3978-43d8-9761-68b6febabeed","resolution":{"observed_at":"2026-08-07T13:08:55.388805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:54.974469Z","title":"Werchan, Anne G.E","venue":null,"work_id":"ab4f5a53-2850-447c-bc56-8e895fe4f08b","year":2015},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:31.786777Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:7bfe27d1a15653730570a6481c4d7dcbe751aa0f130923b08c5811fbb5ea0b40","observation_id":"ec8a5817-9056-456d-aadb-fe5ee28edeb6","resolution":{"observed_at":"2026-08-07T13:08:55.105284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:54.718511Z","title":"Meta-learning to compositionally generalize","venue":null,"work_id":"d0740165-6369-4eeb-a982-7045d7ece04c","year":2021},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:31.889534Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:820524433ef5a515f3dfbc2de43f0591224f917596a7797f7d96ef32e6e7f119","observation_id":"e02937ee-42fb-4f4d-8a8a-97f875b7b175","resolution":{"observed_at":"2026-08-07T13:08:54.846396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:54.439803Z","title":"Hwang, Soumya Sanyal, Xiang Ren, Allyson Ettinger, Zaid Harchaoui, and Yejin Choi","venue":null,"work_id":"c06cce92-7d9c-4e38-9517-2be04210ce06","year":2023},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:31.992562Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:40922ca43874383dca0a76a64ada05a388671ea7e7cb2e7eb7b047fcbbd3e460","observation_id":"f59cf1d3-097c-46b7-b2b2-cfc9a41370de","resolution":{"observed_at":"2026-08-07T13:08:54.577639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T13:08:32.114264Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:32.114264Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:bd2048c05c6ee4cae8934c8e7f3501808f0bc879d955d445752b03013262401e","observation_id":"0d1082ed-57f1-4d28-a2eb-40f625a5ddb4","resolution":{"observed_at":"2026-08-07T13:08:32.114264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:32.267560Z","title":"QwQ-32B: Embracing the Power of Reinforcement Learning, March 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:32.267560Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:e708c972ae7352aa9d6512f85f4245a4302326464d2ef59c34702da5866ad54a","observation_id":"8e8f0f72-2c6f-4d03-9b94-b75acfb6abda","resolution":{"observed_at":"2026-08-07T13:08:32.267560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:54.184344Z","title":"Easy-to-hard generalization: Scalable alignment beyond human supervision","venue":null,"work_id":"98cb28b0-2f22-4d51-abca-629ddcac5643","year":2024},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:32.411814Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:d872039f01828b39e9edc75805f7784708d74477638ed25e06bf39042ecdd36f","observation_id":"039126cc-ed04-4952-b393-54e363e75dd7","resolution":{"observed_at":"2026-08-07T13:08:54.280669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:53.911615Z","title":"The unreasonable effectiveness of easy training data for hard tasks","venue":null,"work_id":"6d1ec923-b460-4413-9cfe-c48fef2a7d90","year":2024},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:32.538189Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:70d848d9a7b7c242d1870f55c1566bdad0daafea061df22aa8a762ac49fdc455","observation_id":"e55323f0-aab2-4f24-aaed-4e4685a950ec","resolution":{"observed_at":"2026-08-07T13:08:54.040112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:32.632804Z","title":"Chi, Quoc V Le, and Denny Zhou","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:32.632804Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:384ee92f9f2854bc8d35035f0fc6370b598865fe5e6844b05efe18c11d8334d9","observation_id":"049ab1d7-c511-485e-956c-adec79317438","resolution":{"observed_at":"2026-08-07T13:08:32.632804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:53.638714Z","title":"Large language models are zero-shot reasoners","venue":null,"work_id":"196cc28f-7467-483a-a418-3b798c8950ee","year":2022},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:32.720556Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:37667f56377e70b9f9bd7edc340b1c042bfb9b4dcc021daffbf0f0f4cfc351e2","observation_id":"eba5c8bd-c28c-407f-8efa-58ac3f28ec80","resolution":{"observed_at":"2026-08-07T13:08:53.753189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-07T13:08:32.818804Z","title":"s1: Simple test-time scaling.arXiv preprint arXiv:2501.19393, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:32.818804Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:04839180117749f0e8a3d614c1d9751bc0e35fcbbf5f02cd99324d69f08dcb73","observation_id":"5a0ca13f-cc1b-43e2-b701-9a8f783dd992","resolution":{"observed_at":"2026-08-07T13:08:32.818804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:53.355264Z","title":"Merging Models with Fisher-Weighted Averaging","venue":null,"work_id":"a5986f02-963f-4544-bb5b-5e2ff27a8b2f","year":2022},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:33.010653Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:dddd9af49ef79112ab43952d5caeb4ece7d44a66abd2bb8fcc62ded9eb48ed70","observation_id":"d5b596b5-2886-448f-9675-e08f634b64dd","resolution":{"observed_at":"2026-08-07T13:08:53.475820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:53.043975Z","title":"TIES-merging: Resolving interference when merging models","venue":null,"work_id":"ad939230-d188-4815-8720-30496e96f898","year":2023},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:33.151617Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:0b316cd3a4d0537173a0b5761b16083b12d21fe307d5a04bf76b9f9e0208a476","observation_id":"5ee0f428-e733-4f69-a961-63fdbe666b35","resolution":{"observed_at":"2026-08-07T13:08:53.193050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:52.755557Z","title":"STaR: Bootstrapping Reasoning With Reasoning","venue":null,"work_id":"e7a4301b-5ea1-425d-ad29-ca30e59db536","year":2022},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:33.252440Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:b28c21200e25bee7a4f8e3d9156617feb77cc362bcb32fd6616d609cd6723776","observation_id":"1118c4c5-608d-403a-a6fe-966aca19a3a6","resolution":{"observed_at":"2026-08-07T13:08:52.920195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:33.682704Z","title":"RAFT: Reward ranked finetuning for generative foundation model alignment.Transactions on Machine Learning Research, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:33.682704Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:e2855872c9a035c86139ca59ced31e4c536fb9360fb11fd6cc005a5c5567e11e","observation_id":"aae50283-a55b-492a-b66f-36dd053a5e85","resolution":{"observed_at":"2026-08-07T13:08:33.682704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:52.440369Z","title":"Scaling relationship on learning mathematical reasoning with large language models","venue":null,"work_id":"8c22d004-07b6-462a-b7d6-242982405bd5","year":2024},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:35.125936Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:6ed8a5c81feddf3e9557920f6fa866e8de7aad0af1d86bc8c75984fb410c7799","observation_id":"4284b2bf-6ff9-4fc0-a923-4c3c3384789c","resolution":{"observed_at":"2026-08-07T13:08:52.593241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:52.142502Z","title":"The unreliability of explanations in few-shot prompting for textual reasoning","venue":null,"work_id":"f3a38bd0-d5c8-481f-85e3-387d9b6bbbc5","year":2022},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:35.241092Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:d890f75072a53e013ff22e8ba3c35415330907e215adfffdc7e6f92dcb8c8835","observation_id":"0c0cf8a2-a711-467c-8f1c-dae898e927ed","resolution":{"observed_at":"2026-08-07T13:08:52.276989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:51.851681Z","title":"SKILL-MIX: a flexible and expandable family of evaluations for AI models","venue":null,"work_id":"2c535835-9c27-4bad-b9a4-2968f291e277","year":2024},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:35.310945Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:0ce6ad87363a0a2fe5f13e3a5b3ecaa408516efee237041f04144055292dc4e9","observation_id":"49ba6899-b7f4-464a-b06c-b325f9e5053a","resolution":{"observed_at":"2026-08-07T13:08:51.970607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:35.361630Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:35.361630Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:4f710de7328ecf8d0e912b8a09ee9a745f4a89ad3f0aa025dcb4cb7fe8606713","observation_id":"f9164d15-b095-4b1a-a91d-0067f0f1b28e","resolution":{"observed_at":"2026-08-07T13:08:35.361630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T13:08:35.476119Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:35.476119Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:5d9c41c7976cbce5b9b667c1a20cb2813784012ce52254f53d69dd43d2967def","observation_id":"fc42454a-3d34-46f6-8c4a-3d7ca19474b9","resolution":{"observed_at":"2026-08-07T13:08:35.476119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:51.542734Z","title":"Can models learn skill composition from examples? InThe Thirty-eighth Annual Conference on Neural Information Processing Systems, 2024","venue":null,"work_id":"1381cfd1-01ab-4ef5-bc05-4f185bf1bdc5","year":2024},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:35.615291Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:8f801e79554aa4396a6738d7862fc87882876cc8503e345cdd79498d952b5bbd","observation_id":"681e5d8d-5346-41a6-a6db-059f338cab1c","resolution":{"observed_at":"2026-08-07T13:08:51.716691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T13:08:35.702537Z","title":"Llama 2: Open foundation and fine-tuned chat models.arXiv preprint arXiv:2307.09288, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:35.702537Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:4a1406df876292013eb3a35d2c1599b68fca8859883cfd0530caeb3358c0dc28","observation_id":"43f2a4da-0c6c-4bfb-a96e-bff8cc63a6f4","resolution":{"observed_at":"2026-08-07T13:08:35.702537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T13:08:35.757977Z","title":"Qwen2.5 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:35.757977Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:4814b5ce2c8543b3eade46220e214028e383316d17fc3d40c7b06809e5a4225c","observation_id":"8a2ba458-d582-46aa-b00d-54edf6309ce6","resolution":{"observed_at":"2026-08-07T13:08:35.757977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:35.851036Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:35.851036Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:6dd89d1bdfcaa2ccb3981862f2400e71f169244c102c4bab8caf46f61d4bd3e8","observation_id":"b0189fd2-8664-4b40-be36-cd2be435fa2d","resolution":{"observed_at":"2026-08-07T13:08:35.851036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14838","last_updated":"2024-05-23T17:54:14Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:54:14Z","title":"From Explicit CoT to Implicit CoT: Learning to Internalize CoT Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14838","snapshot_observed_at":"2026-08-07T13:08:35.930049Z","title":"From Explicit CoT to Implicit CoT: Learning to Internalize CoT Step by Step .arXiv preprint arXiv:2405.14838, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:35.930049Z"},"links":{"cited_paper":"/paper/2405.14838","citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:a0f24678c97c6ec278f2de484476dc3a3ebf12b1300eda8a27701037377355e9","observation_id":"0bcc12b1-8edf-427b-a2f5-73ae639ee9b0","resolution":{"observed_at":"2026-08-07T13:08:35.930049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06769","last_updated":"2025-11-03T00:53:34Z","snapshot_observed_at":"2026-08-07T06:05:27.895209Z","submitted_at":"2024-12-09T18:55:56Z","title":"Training Large Language Models to Reason in a Continuous Latent Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06769","snapshot_observed_at":"2026-08-07T13:08:35.979493Z","title":"Training large language models to reason in a continuous latent space.arXiv preprint arXiv:2412.06769, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:35.979493Z"},"links":{"cited_paper":"/paper/2412.06769","citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:225bc453fefb39ef935ba4f2f26b7bda63bf524e7059b57598207bf32dde5f0a","observation_id":"95421e71-a70d-4eea-b9ba-586085a1a82d","resolution":{"observed_at":"2026-08-07T13:08:35.979493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:51.231466Z","title":"Fodor and Zenon W","venue":null,"work_id":"74914fd3-89f3-46ae-ae9b-c6721c6cfc9d","year":1988},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:36.051325Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:25d8f3609c24cef86fd0ec92fab53ed889bd2faec6d05fffc3ca1f12f4e7baa3","observation_id":"5c383963-19af-428f-9596-bff8b41ce6ec","resolution":{"observed_at":"2026-08-07T13:08:51.366599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:50.876724Z","title":"Lake and Marco Baroni","venue":null,"work_id":"6b52f335-4e63-47cd-8653-7576beb43ba6","year":2023},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:36.110741Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:4d0ed62fa3a4e83386d11e0cfe26498af6746cbe82f181d3d0f113a6ef03028b","observation_id":"331c5e8e-bf3f-4859-821f-cc611dfe1234","resolution":{"observed_at":"2026-08-07T13:08:51.064761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:50.546129Z","title":"Limits of transformer language models on learning to compose algorithms","venue":null,"work_id":"363a2749-b2df-472b-8d20-171b3fc7bf20","year":2024},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:36.167137Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:b5515f0250b63e9abf2bd4ea2d4d7c9d3d95a213ec3d7db1242829aa713728c1","observation_id":"4ee53a95-ff5c-47a6-b664-bb7f5390172c","resolution":{"observed_at":"2026-08-07T13:08:50.700699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:50.271081Z","title":"COGS: A compositional generalization challenge based on semantic interpretation","venue":null,"work_id":"a5ec08fa-2013-4298-a123-f6d41803574c","year":2020},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:36.230442Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:d5c3263f027c02d1428326b036a3af1eaf6b51faa9fd3c006e81547ea4bcf2c7","observation_id":"a2cca020-8f54-49c6-b3ad-32b381b03e1a","resolution":{"observed_at":"2026-08-07T13:08:50.382080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:49.964668Z","title":"Generalization without systematicity: On the compositional skills of sequence-to-sequence recurrent networks","venue":null,"work_id":"f5a7e870-8117-43c4-a21f-9c7739aa0454","year":2018},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:36.301343Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:07ee4f3ab462b534930d96e4847a4a5592c522378b129df8f0d4bb491ab62cba","observation_id":"1874d6de-49a4-40ba-9538-fad26a638c0e","resolution":{"observed_at":"2026-08-07T13:08:50.084312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:49.666711Z","title":"Learning to recombine and resample data for compositional generalization","venue":null,"work_id":"ed4e4afe-d896-414f-bd60-f9bd7ff563b2","year":2021},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:36.371949Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:b54f390d68483fc752df3568e9ba88057206e2a4f48d3810322947008dd6140e","observation_id":"a33b8a97-df3e-4436-aa07-fc5a633d98c3","resolution":{"observed_at":"2026-08-07T13:08:49.838040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:49.400461Z","title":"Compositional semantic parsing with large language models","venue":null,"work_id":"13967d04-7fff-4d6c-8bac-7f418bb36f83","year":2023},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:36.427345Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:8624decefc2be7fc85d6f95bb961e31e5342247e4b11452583e64d41dafc8fe1","observation_id":"2d31f34b-5384-4342-a0ac-ed3df7cfdeda","resolution":{"observed_at":"2026-08-07T13:08:49.515567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:36.491582Z","title":"Chain of thought empowers transformers to solve inherently serial problems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:36.491582Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:bc90dfb67265fa5c1c7418c698f6e7c080b944f3de206a8e2f657e64fae7d5da","observation_id":"061fb0b0-8de4-491d-b5ef-3f31665c3af0","resolution":{"observed_at":"2026-08-07T13:08:36.491582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:49.150581Z","title":"Dissecting chain-of-thought: Compositionality through in-context filtering and learning","venue":null,"work_id":"2318648b-faf4-4ce2-ac0c-381e13d56994","year":2023},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:36.643593Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:2ad54cb08686ea4f75a6d9aa2d53f0548cd4910478962a7b1465fe40af575a93","observation_id":"321f54fc-fed6-4214-993b-7708ae025723","resolution":{"observed_at":"2026-08-07T13:08:49.264046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:48.765088Z","title":"Skills-in-context: Unlocking compositionality in large language models","venue":null,"work_id":"3e44a188-edb1-48a7-9e15-451e866eb644","year":2024},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:36.797992Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:80ab5ac22d33bf456a664b1897930b6e4102459685d456e7eb6ff8a441cf1930","observation_id":"336b633b-f13e-408f-b557-5030fc248593","resolution":{"observed_at":"2026-08-07T13:08:48.973246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11698","last_updated":"2024-06-17T16:14:11Z","snapshot_observed_at":"2026-07-06T18:32:19.794373Z","submitted_at":"2024-06-17T16:14:11Z","title":"Meta Reasoning for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11698","snapshot_observed_at":"2026-08-07T13:08:37.151860Z","title":"Meta reasoning for large language models.arXiv preprint arXiv:2406.11698, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:37.151860Z"},"links":{"cited_paper":"/paper/2406.11698","citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:4590255baf384d6d81ff1b3fa8b1eca295fef0975ce51a237682fe88d0988d4f","observation_id":"951e515f-63c7-4b50-898e-a241a22e60ce","resolution":{"observed_at":"2026-08-07T13:08:37.151860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:48.495291Z","title":"Decomposed prompting: A modular approach for solving complex tasks","venue":null,"work_id":"2f719b5e-29ba-472f-974d-7b9d33879289","year":2023},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:37.340947Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:32e06bb3a136bc426427f9114b4ef8e548c1cf7a6ef7df441340d90c6e293e25","observation_id":"b2cb64f5-d061-4e23-8558-bb794d5681fb","resolution":{"observed_at":"2026-08-07T13:08:48.579622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:48.273421Z","title":"Diverse demonstrations improve in-context compositional generalization","venue":null,"work_id":"4cbaf230-e578-4bf1-973a-39ee7f793af2","year":2023},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:37.865977Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:3b2e561371be26925c22776a9a0324fe69f1eabca5e060c405821108409a7951","observation_id":"3d8f011e-24ec-433b-8000-cefb33765723","resolution":{"observed_at":"2026-08-07T13:08:48.385068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:48.152174Z","title":"Complementary explanations for effective in-context learning","venue":null,"work_id":"25dedd09-b641-4ff8-9bc9-fc1a98d8af2f","year":2023},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:41.448606Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:251ba86d502eb3d6c1e56fed4eece8ade39058e0ce1561745d2f1286ebf131ef","observation_id":"4bbe9f52-e63d-479c-94d1-a60541ef81e6","resolution":{"observed_at":"2026-08-07T13:08:48.195451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:47.988926Z","title":"To CoT or not to CoT? Chain-of-thought helps mainly on math and symbolic reasoning","venue":null,"work_id":"f965eb76-c78e-4de7-a5a8-360fae4fede2","year":2025},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:41.591331Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:107d154b416e3958fcedbe6b76aad024b6bc430d3516822e291941730ce409e9","observation_id":"8d9274d1-f1df-427b-ae28-ab87bf9a84a4","resolution":{"observed_at":"2026-08-07T13:08:48.098066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:47.767750Z","title":"Knowledge crosswords: Geometric knowledge reasoning with large language models","venue":null,"work_id":"f7e2643e-0628-4d59-95c1-eeba73fc8ca1","year":2024},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:41.697201Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:fade37703bd4a0aceed4c1665a91e10defb6182a3c745b0d1d6ede0625debf24","observation_id":"21581ee1-40e7-4501-9f29-ab2e6774e801","resolution":{"observed_at":"2026-08-07T13:08:47.895722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:41.809213Z","title":"LongProc: Benchmarking Long-Context Language Models on Long Procedural Generation.arXiv preprint arXiv:2501.05414, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:41.809213Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:3ad939aa14883e0c460364dd1e6dddf61ce108121ddec963423bc2d3c72036e6","observation_id":"3a14807c-6bb2-429b-8be9-f29b3232bcdc","resolution":{"observed_at":"2026-08-07T13:08:41.809213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:47.645167Z","title":"Curriculum learning","venue":null,"work_id":"e2d490b0-516f-4b5b-b977-f23909f7855a","year":2009},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:41.937283Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:73bacc2473e2bfdc9f2e4d23453d6a62dca93ff8e47041be4c3b90aa61f4d473","observation_id":"2e1a8ce8-e4d4-47e0-a3a8-87fe7353e0f0","resolution":{"observed_at":"2026-08-07T13:08:47.701266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:47.491688Z","title":"Merging by matching models in task parameter subspaces.Transactions on Machine Learning Research, 2024","venue":null,"work_id":"c3aaa1dc-43ce-424f-8839-6583f1656afa","year":2024},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:42.052247Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:9ae7e5700fa875295815a21f98cbb966af00d2677f8977494dde3ebf1519c515","observation_id":"cf5d7e6c-c782-4f50-9d86-44b96b32db0d","resolution":{"observed_at":"2026-08-07T13:08:47.592643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:42.139534Z","title":"Editing models with task arithmetic","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:42.139534Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:1d24dd655414bb3a9dab306f7a5e4a25f3d46077123af2023bc2501da52a3115","observation_id":"d0e16545-9cb3-472b-95f7-b85a7c2ec5f9","resolution":{"observed_at":"2026-08-07T13:08:42.139534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20641","last_updated":"2025-05-23T02:41:43Z","snapshot_observed_at":"2026-08-07T16:35:15.231599Z","submitted_at":"2025-03-26T15:34:37Z","title":"Unlocking Efficient Long-to-Short LLM Reasoning with Model Merging","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20641","snapshot_observed_at":"2026-08-07T13:08:42.297824Z","title":"Unlocking efficient long-to-short llm reasoning with model merging.arXiv preprint arXiv:2503.20641, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:42.297824Z"},"links":{"cited_paper":"/paper/2503.20641","citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:dad8402d71febfcb3f35401452e2560b4c9d359fc29361c3af0862e32ede8e91","observation_id":"1afad7da-1f0d-4265-b3ea-2c729940ee0a","resolution":{"observed_at":"2026-08-07T13:08:42.297824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-07T13:08:42.408863Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:42.408863Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:6e845d952622ee9e18074833f65f071b2b4b7056f881dbd2dded9320219cbb84","observation_id":"84fe46b5-81cf-4e01-b8ee-995fd08eab51","resolution":{"observed_at":"2026-08-07T13:08:42.408863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09601","last_updated":"2025-02-13T18:52:36Z","snapshot_observed_at":"2026-08-08T03:37:50.177168Z","submitted_at":"2025-02-13T18:52:36Z","title":"CoT-Valve: Length-Compressible Chain-of-Thought Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09601","snapshot_observed_at":"2026-08-07T13:08:42.546680Z","title":"CoT-Valve: Length-Compressible Chain-of-Thought Tuning.arXiv preprint arXiv:2502.09601, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:42.546680Z"},"links":{"cited_paper":"/paper/2502.09601","citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:3e79c2119e116580c730507baa580c348c9dccad53e017553235046d97094b9f","observation_id":"a6fda2f0-cd4e-49df-b132-d872d03bd14b","resolution":{"observed_at":"2026-08-07T13:08:42.546680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18314","last_updated":"2024-09-26T21:44:20Z","snapshot_observed_at":"2026-07-06T19:23:06.818254Z","submitted_at":"2024-09-26T21:44:20Z","title":"Realistic Evaluation of Model Merging for Compositional Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18314","snapshot_observed_at":"2026-08-07T13:08:42.701796Z","title":"Realistic evaluation of model merging for compositional generalization.arXiv preprint arXiv:2409.18314, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:42.701796Z"},"links":{"cited_paper":"/paper/2409.18314","citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:3c65e46741b4b12d3599b56d51a8964ac166e2bab56db21c2db607ca4abb817e","observation_id":"b334f828-1f50-431c-b1db-13db07f1700f","resolution":{"observed_at":"2026-08-07T13:08:42.701796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:47.333658Z","title":"LoFiT: Localized Fine-tuning on LLM Representations","venue":null,"work_id":"c0693385-e67a-4927-a72c-bca983edf40a","year":2024},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:42.831227Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:75e57bfdccaeb0d84c2d38d37133c052f15069afa12491efeda64239526d08a1","observation_id":"f0256edb-9d02-471d-89a2-6c59c6d176e4","resolution":{"observed_at":"2026-08-07T13:08:47.426336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:47.221636Z","title":"Transformer-squared: Self-adaptive LLMs","venue":null,"work_id":"a31bba4d-8ddd-4557-8a25-491f304d7ec7","year":2025},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:42.932497Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:e2eb1060a3b537a29b9428e6001a076f1cb463a93bc90a3a3423d8f119cca43a","observation_id":"c24ac618-2f05-4b0e-ba9e-ee19fb203733","resolution":{"observed_at":"2026-08-07T13:08:47.260415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:43.066945Z","title":"OpenWebText Corpus","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:43.066945Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:d1b8bb2b60a506cc13481229a863291305e606c5e2248b56e6fcc86a0f706bb6","observation_id":"54373513-e41b-482d-a159-a13100ff860d","resolution":{"observed_at":"2026-08-07T13:08:43.066945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:47.022219Z","title":"Curator: A Tool for Synthetic Data Creation","venue":null,"work_id":"721c7ef4-71d0-4acb-9e70-c1643012fd95","year":2025},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:43.194372Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:8c55e7248a3383b61e3ac4f160cc966de4853f14db3c23f9b92889cbc26665df","observation_id":"38a130cd-af87-410a-85fe-9a1f3856c0c2","resolution":{"observed_at":"2026-08-07T13:08:47.101984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:43.348378Z","title":"LlamaFactory: Unified efficient fine-tuning of 100+ language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:43.348378Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:87e0e9605d724e54c41b3afcbf0313dddd5c8ed7f706fd32ff10879ce1a5a634","observation_id":"cbfcd55a-b1a8-4f0e-a16f-d8e91cebfbbb","resolution":{"observed_at":"2026-08-07T13:08:43.348378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:46.842928Z","title":"15 Table 4: Performance of atomic CoT models fine-tuned on different variants of proxy prefix on Llama 2-7B","venue":null,"work_id":"27cab18b-0d5c-4edd-a58a-31c3b36e5fb0","year":null},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:43.425374Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:1b65c4581f23ad7bff46a2636bd922a1605bdb400fbb076430992cd09570307d","observation_id":"737c94f1-0239-4fc4-b1d6-78b99b4f6814","resolution":{"observed_at":"2026-08-07T13:08:46.920062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:46.564428Z","title":"This is because the rhetorical and literay skills have the least overlap while other categories have more (e.g","venue":null,"work_id":"63136b33-a456-45f9-8673-d026718d1f15","year":null},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:43.571509Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:a558c96d2b2f1ccf16f5098077f3739792cf3eb6503fe5ce61bbfa0eed9c58b8","observation_id":"83b9d7db-3eca-4a64-9c9d-3b0dd33684da","resolution":{"observed_at":"2026-08-07T13:08:46.674131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:46.307021Z","title":null,"venue":null,"work_id":"374533f4-9923-41f3-b748-061ce8db43b6","year":null},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:43.661614Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:e43a75e5a7387980e868f3ccf602016b30288b857a116b7c1268e27ccda2747f","observation_id":"7174952e-a5a9-4a03-bab6-fe9083f1ecbd","resolution":{"observed_at":"2026-08-07T13:08:46.405687Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:46.042809Z","title":"To ensure reproducibility of our results, we use a public test set collected by [22]","venue":null,"work_id":"efead408-74ed-460d-87c4-6cee84cf1783","year":null},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:43.833123Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:7ab13438921c4e79d3b6fba5064e482f02a145df22e1cae75a8e415f2da8e569","observation_id":"36533d95-2232-4d87-aa1d-86842a9951b8","resolution":{"observed_at":"2026-08-07T13:08:46.166008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:45.798069Z","title":"The hall was filled with a deafening silence","venue":null,"work_id":"fae16b81-ac63-4653-b408-8a3e8d0c3a62","year":null},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:43.972958Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:1569848e439f411e9d7f3df5dfa911e12c0b626f2953066a6a0f0ed163812f45","observation_id":"5d52c5f2-87d2-4f8e-875b-62550d13da54","resolution":{"observed_at":"2026-08-07T13:08:45.918916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:45.563636Z","title":null,"venue":null,"work_id":"e9ef5f6e-2717-477a-84b2-f1d406c843b1","year":null},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:44.071572Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:88f00d4157c1298f81561fcdf4134b814ede360fca3fb7caacf153730a4e99e5","observation_id":"ea271320-8927-42ad-92cf-839794688b0b","resolution":{"observed_at":"2026-08-07T13:08:45.663456Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:45.314580Z","title":null,"venue":null,"work_id":"622a7410-372a-470a-afe9-94700a7bed09","year":null},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:44.181557Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:a4e5e258b7525ece2ffac401e435526734ec7e7a9e56a195115a075e9d23acce","observation_id":"7424c374-3461-41da-a9de-e8ff164cc6d3","resolution":{"observed_at":"2026-08-07T13:08:45.430234Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:45.062036Z","title":"This is a common error for Composable models combined with model merging","venue":null,"work_id":"f881124a-73d4-4381-83e6-a9a2004e4f97","year":null},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:44.284480Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:71ea4122c4d05bd177ecd7f3be342659e09eb911879425aa38bfdea376ed0f15","observation_id":"39074bd4-19e2-4cee-a595-7d3c8f3c71d9","resolution":{"observed_at":"2026-08-07T13:08:45.179031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:44.828512Z","title":"Merge” stands for model merging; “MTL","venue":null,"work_id":"56962a95-1cbe-435d-9615-474113c4f487","year":null},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:44.455938Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:eba75b983b3b0bbdcc02ddc1e44b2b19d7ca3501ac4e153b0068112eeded4045","observation_id":"c6e15940-e8e5-4dfc-9a95-ffed1c0cc79c","resolution":{"observed_at":"2026-08-07T13:08:44.918162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:08:36.985095Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:36.985095Z"},"links":{"citing_paper":"/paper/2505.22635"},"observation_digest":"sha256:29ca3c03f425c5352bdb7df2b297851f9891215722452fac45877c1bcff91bc8","observation_id":"36c18835-0be9-4a27-bd3b-d0864bf17a50","resolution":{"observed_at":"2026-08-07T13:08:36.985095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.22635","last_updated":"2025-05-28T17:51:10Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T01:10:15.066342Z","submitted_at":"2025-05-28T17:51:10Z","title":"Learning Composable Chains-of-Thought"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":0,"verified_fuzzy":39},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 1 inbound Pith citation observation for arXiv:2505.22635."}