{"as_of":"2026-08-09T18:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:efc3b4a893c43501398765b8ab36bfdff9a3090a28dd907283fd2da6ba8b0959","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":31,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:34:07.541003Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":"2502.19187","doi":"10.48550/arxiv.2502.19187","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Big-bench extra hard","venue":"ArXiv.org","work_id":"a39d2b40-bc37-45e9-9ef3-82fdb24cdc60","year":2025},"citing_paper":{"arxiv_id":"2504.19678","last_updated":"2026-03-06T19:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-28T11:08:22Z","title":"From LLM Reasoning to Autonomous AI Agents: A Comprehensive Review","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-15T02:57:37.873567Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2504.19678"},"observation_digest":"sha256:e4eeed72d8249011f0656a747f0ca822852e137037c84b8c8eb77cff190629a1","observation_id":"1e22fd9f-ce59-403f-9f87-77c97a994e24","resolution":{"observed_at":"2026-05-15T02:57:38.353786Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-07T15:34:07.541003Z","title":"Jain, Virginia Aglietti, Disha Jindal, Peter Chen, Nishanth Dikkala, Gladys Tyen, Xin Liu, Uri Shalit, Silvia Chiappa, Kate Olszewska, Yi Tay, Vinh Q","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14652","last_updated":"2025-06-09T17:40:25Z","snapshot_observed_at":"2026-08-08T07:13:10.579807Z","submitted_at":"2025-05-20T17:41:33Z","title":"General-Reasoner: Advancing LLM Reasoning Across All Domains","version":5},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:07.541003Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2505.14652"},"observation_digest":"sha256:bb7eb55017d706800beb01db94dbf07fe9fc6d41f4856e0c44d4df8e476ecc87","observation_id":"7abd6682-5d79-4dbe-8f1b-764533b579b5","resolution":{"observed_at":"2026-08-07T15:34:07.541003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-07T14:55:16.192399Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16998","last_updated":"2025-05-22T17:57:23Z","snapshot_observed_at":"2026-08-07T14:49:30.596587Z","submitted_at":"2025-05-22T17:57:23Z","title":"Do Large Language Models Excel in Complex Logical Reasoning with Formal Language?","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:16.192399Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2505.16998"},"observation_digest":"sha256:571577ef819e75318a24f3a01429419598efa0361b8dea804e65ad0ddc075bfb","observation_id":"eb7e8847-5ffd-44c6-9aa3-af7f4a129e46","resolution":{"observed_at":"2026-08-07T14:55:16.192399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-07T14:44:34.218264Z","title":"Jain, Virginia Aglietti, Disha Jindal, Peter Chen, Nishanth Dikkala, Gladys Tyen, Xin Liu, Uri Shalit, Silvia Chiappa, Kate Olszewska, Yi Tay, Vinh Q","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.18102","last_updated":"2026-05-30T13:29:55Z","snapshot_observed_at":"2026-08-07T14:33:15.240605Z","submitted_at":"2025-05-23T16:57:34Z","title":"CapBencher: Give Your LLM Benchmark a Built-in Alarm for Test-Set Overfitting","version":7},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:34.218264Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2505.18102"},"observation_digest":"sha256:030ea0208294d75399fdcc7514915c8b01847b6a522b8e58f7f6e0d5672c687a","observation_id":"4f86518a-073f-4ddd-bdd5-8a3e01d618af","resolution":{"observed_at":"2026-08-07T14:44:34.218264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-07T14:14:32.717640Z","title":"Mehran Kazemi, Bahare Fatemi, Hritik Bansal, John Palowitch, Chrysovalantis Anastasiou, San- ket Vaibhav Mehta, Lalit K Jain, Virginia Aglietti, Disha Jindal, Peter Chen, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19641","last_updated":"2025-06-04T05:08:08Z","snapshot_observed_at":"2026-08-07T14:07:26.838295Z","submitted_at":"2025-05-26T07:59:36Z","title":"SynLogic: Synthesizing Verifiable Reasoning Data at Scale for Learning Logical Reasoning and Beyond","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:14:32.717640Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2505.19641"},"observation_digest":"sha256:89294ebaab22ceaa6fca6bb5e1c43229d8ade7be137b34853ee91238b991c4d5","observation_id":"28e58b02-1e23-4a62-afba-442c3ec3094a","resolution":{"observed_at":"2026-08-07T14:14:32.717640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-07T11:13:53.511955Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03295","last_updated":"2025-06-05T03:25:20Z","snapshot_observed_at":"2026-08-07T11:04:19.054997Z","submitted_at":"2025-06-03T18:35:52Z","title":"Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:13:53.511955Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2506.03295"},"observation_digest":"sha256:cadfee7ead55e31c4f7aaab62a719bdfde44a90d9e0a1e111e9495ea7ded2422","observation_id":"dab77a8c-5779-48ce-9821-740a9524f26c","resolution":{"observed_at":"2026-08-07T11:13:53.511955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-06T21:55:08.585573Z","title":"Jain, Virginia Aglietti, Disha Jindal, Peter Chen, Nishanth Dikkala, Gladys Tyen, Xin Liu, Uri Shalit, Silvia Chiappa, Kate Olszewska, Yi Tay, Vinh Q","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23274","last_updated":"2026-05-26T11:19:37Z","snapshot_observed_at":"2026-08-06T21:45:00.363997Z","submitted_at":"2025-06-29T15:01:01Z","title":"Real-Time Progress Prediction in Reasoning Language Models","version":4},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T21:55:08.585573Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2506.23274"},"observation_digest":"sha256:46389aed3cd25411a46e55947a6f5025c3bf2d0aded7fd22750a606b87bfa281","observation_id":"757417b5-63df-4558-ae92-acedc68f49aa","resolution":{"observed_at":"2026-08-06T21:55:08.585573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-07T05:07:40.349660Z","title":"BIG-Bench extra hard,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00004","last_updated":"2025-07-10T17:08:40Z","snapshot_observed_at":"2026-08-08T16:04:02.052629Z","submitted_at":"2025-06-10T14:47:48Z","title":"A Theory of Inference Compute Scaling: Reasoning through Directed Stochastic Skill Search","version":2},"reference_index":204,"source":"pdf_text","source_observed_at":"2026-08-07T05:07:40.349660Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2507.00004"},"observation_digest":"sha256:895c395b541ff4c815a5067e051f3e23280cef52ab925e1beece5c6cacdb32e2","observation_id":"f8e50d8c-0241-45b1-ab33-318d1ddbc40f","resolution":{"observed_at":"2026-08-07T05:07:40.349660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-06T18:16:42.770379Z","title":"Jain, Virginia Aglietti, Disha Jindal, Peter Chen, Nishanth Dikkala, Gladys Tyen, Xin Liu, Uri Shalit, Silvia Chiappa, Kate Olszewska, Yi Tay, Vinh Q","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08924","last_updated":"2025-07-18T09:31:19Z","snapshot_observed_at":"2026-08-07T23:55:32.686302Z","submitted_at":"2025-07-11T17:56:32Z","title":"From KMMLU-Redux to KMMLU-Pro: A Professional Korean Benchmark Suite for LLM Evaluation","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T18:16:42.770379Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2507.08924"},"observation_digest":"sha256:fc66d7ee648681ef58e859cc4e052e5d054a0567d43af4da749f95e2a4c6cbea","observation_id":"f347257f-16a5-479d-89cd-7c123902c146","resolution":{"observed_at":"2026-08-06T18:16:42.770379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":"2502.19187","doi":"10.48550/arxiv.2502.19187","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Big-bench extra hard","venue":"ArXiv.org","work_id":"a39d2b40-bc37-45e9-9ef3-82fdb24cdc60","year":2025},"citing_paper":{"arxiv_id":"2507.10722","last_updated":"2026-04-10T03:29:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-14T18:43:05Z","title":"Bridging Brains and Machines: A Unified Frontier in Neuroscience, Artificial Intelligence, and Neuromorphic Systems","version":2},"reference_index":163,"source":"pdf_text","source_observed_at":"2026-05-19T04:37:33.928616Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2507.10722"},"observation_digest":"sha256:4b67c9a18b3e0495589316b41816f67c16f06087824f5220d182eee94c1e094e","observation_id":"b58082f3-69fe-46e9-8724-3a756e89cf61","resolution":{"observed_at":"2026-05-19T04:42:04.974566Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":"2502.19187","doi":"10.48550/arxiv.2502.19187","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Big-bench extra hard","venue":"ArXiv.org","work_id":"a39d2b40-bc37-45e9-9ef3-82fdb24cdc60","year":2025},"citing_paper":{"arxiv_id":"2507.12549","last_updated":"2026-04-28T23:40:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-16T18:01:26Z","title":"The Serial Scaling Hypothesis","version":4},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-19T04:08:11.344622Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2507.12549"},"observation_digest":"sha256:1abce7c6b48e4a6d5ef0611cdd1fe909608f7a41dada4cf2c19d1641df41987e","observation_id":"525b72be-22f4-478c-837d-5394d13c17d0","resolution":{"observed_at":"2026-05-19T04:12:01.955842Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-06T12:48:07.971609Z","title":"arXiv preprint arXiv:2502.19187","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21476","last_updated":"2025-07-29T03:44:43Z","snapshot_observed_at":"2026-08-09T05:51:49.231984Z","submitted_at":"2025-07-29T03:44:43Z","title":"Which LLMs Get the Joke? Probing Non-STEM Reasoning Abilities with HumorBench","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T12:48:07.971609Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2507.21476"},"observation_digest":"sha256:99a577178bc8bb7d4e67f1f54c17472ea44bf1a3bf71f9a348f179c2389f672e","observation_id":"62bbde9c-ac16-4bc1-92d8-1c737c8671eb","resolution":{"observed_at":"2026-08-06T12:48:07.971609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":"2502.19187","doi":"10.48550/arxiv.2502.19187","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Big-bench extra hard","venue":"ArXiv.org","work_id":"a39d2b40-bc37-45e9-9ef3-82fdb24cdc60","year":2025},"citing_paper":{"arxiv_id":"2507.23009","last_updated":"2026-05-11T11:47:15Z","snapshot_observed_at":"2026-07-06T22:05:22.373440Z","submitted_at":"2025-07-30T18:14:35Z","title":"Position: Stop Evaluating AI with Human Tests, Develop Principled, AI-specific Tests instead","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-19T02:12:48.586913Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2507.23009"},"observation_digest":"sha256:d0bd370fe538181adbb9421efcabaa2cfe27420eb85f0dc57646b0057009aaa8","observation_id":"68e54fea-97ac-4c93-bd86-39cd9a0f4fb6","resolution":{"observed_at":"2026-05-19T02:12:55.785825Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":"2502.19187","doi":"10.48550/arxiv.2502.19187","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Big-bench extra hard","venue":"ArXiv.org","work_id":"a39d2b40-bc37-45e9-9ef3-82fdb24cdc60","year":2025},"citing_paper":{"arxiv_id":"2508.08636","last_updated":"2026-05-20T08:06:05Z","snapshot_observed_at":"2026-08-04T03:35:42.053775Z","submitted_at":"2025-08-12T05:00:00Z","title":"InternBootcamp Technical Report: Boosting LLM Reasoning with Verifiable Task Scaling","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-21T22:33:09.674822Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2508.08636"},"observation_digest":"sha256:b63bd958d0f060d0e9791c8775fef3a6fba82d7549d93e80be5f4512aa78c9ba","observation_id":"72ebc64b-5e92-417b-804f-dfd571453004","resolution":{"observed_at":"2026-05-21T22:34:24.026350Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-05T18:08:40.834563Z","title":"D.; Aglietti, V.; Jindal, D.; Chen, P.; Dikkala, N.; Tyen, G.; Liu, X.; Shalit, U","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.15180","last_updated":"2026-05-28T16:12:56Z","snapshot_observed_at":"2026-08-05T18:08:30.380618Z","submitted_at":"2025-08-21T02:36:16Z","title":"PuzzleClone: A DSL-Powered Framework for Synthesizing Verifiable Data","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T18:08:40.834563Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2508.15180"},"observation_digest":"sha256:f84f3e28c46ac0af2e9f6f8ac968555443faebbd663d758d7367a798728aa445","observation_id":"8b2e1b14-a71e-47b6-804f-b2a0955f44f9","resolution":{"observed_at":"2026-08-05T18:08:40.834563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-05T14:35:50.806216Z","title":"Aitor Lewkowycz, Anders Andreassen, David Dohan, Ethan Dyer, Henryk Michalewski, Vinay Ra- masesh, Ambrose Slone, Cem Anil, Imanol Schlag, Theo Gutman-Solo, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21188","last_updated":"2025-09-02T16:27:24Z","snapshot_observed_at":"2026-08-09T18:15:22.003522Z","submitted_at":"2025-08-28T20:02:10Z","title":"Mirage or Method? How Model-Task Alignment Induces Divergent RL Conclusions","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T14:35:50.806216Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2508.21188"},"observation_digest":"sha256:0a61a30c778e29c228ecf11b3b9aa71ffae7a04b3ac300981d957323e21e006e","observation_id":"920baffd-8102-4ed6-a9a0-9c5665ef8fb3","resolution":{"observed_at":"2026-08-05T14:35:50.806216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-04T19:48:48.964322Z","title":"Big-bench extra hard,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09097","last_updated":"2025-09-11T02:16:34Z","snapshot_observed_at":"2026-08-09T15:40:26.494904Z","submitted_at":"2025-09-11T02:16:34Z","title":"DP-FedLoRA: Privacy-Enhanced Federated Fine-Tuning for On-Device Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T19:48:48.964322Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2509.09097"},"observation_digest":"sha256:fee24e7c8ae8fd902872655104af564e88f0b2185178d3c13de38e61d82d2835","observation_id":"fba4441d-5e24-41df-b266-a4e9756fcbd5","resolution":{"observed_at":"2026-08-04T19:48:48.964322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-04T16:07:31.880939Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.16679","last_updated":"2025-09-20T13:11:28Z","snapshot_observed_at":"2026-08-04T16:07:24.699834Z","submitted_at":"2025-09-20T13:11:28Z","title":"Reinforcement Learning Meets Large Language Models: A Survey of Advancements and Applications Across the LLM Lifecycle","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-04T16:07:31.880939Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2509.16679"},"observation_digest":"sha256:2c491eb5404d8d5fb6783967f2aaf9ba6e7c9aa56c685b18611e0a1797730130","observation_id":"5ff89a9f-4a92-4457-9983-5683a446d207","resolution":{"observed_at":"2026-08-04T16:07:31.880939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":"2502.19187","doi":"10.48550/arxiv.2502.19187","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Big-bench extra hard","venue":"ArXiv.org","work_id":"a39d2b40-bc37-45e9-9ef3-82fdb24cdc60","year":2025},"citing_paper":{"arxiv_id":"2510.14420","last_updated":"2026-04-14T13:37:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T08:24:44Z","title":"Instructions are all you need: Self-supervised Reinforcement Learning for Instruction Following","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T06:54:21.052326Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2510.14420"},"observation_digest":"sha256:84040b30cfda43a22317f434fa8f25a3b9a7a93c563f458da78ed8d62eceef34","observation_id":"ff9ca1ad-82bb-41f4-8021-9346ea726981","resolution":{"observed_at":"2026-05-18T06:56:01.585103Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":"2502.19187","doi":"10.48550/arxiv.2502.19187","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Big-bench extra hard","venue":"ArXiv.org","work_id":"a39d2b40-bc37-45e9-9ef3-82fdb24cdc60","year":2025},"citing_paper":{"arxiv_id":"2511.09907","last_updated":"2026-05-08T08:34:38Z","snapshot_observed_at":"2026-07-06T22:35:41.533403Z","submitted_at":"2025-11-13T03:08:51Z","title":"Learning to Pose Problems: Reasoning-Driven and Solver-Adaptive Data Synthesis","version":5},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-17T22:59:48.260121Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2511.09907"},"observation_digest":"sha256:ea79195169429ed3442fc057fe347afdb5ef0fa1ff772902682765ee4b151196","observation_id":"3414d351-c086-43d3-a653-39a06647375d","resolution":{"observed_at":"2026-05-17T23:00:25.507895Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":"2502.19187","doi":"10.48550/arxiv.2502.19187","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Big-bench extra hard","venue":"ArXiv.org","work_id":"a39d2b40-bc37-45e9-9ef3-82fdb24cdc60","year":2025},"citing_paper":{"arxiv_id":"2604.07593","last_updated":"2026-06-17T23:58:56Z","snapshot_observed_at":"2026-07-13T08:26:43.817939Z","submitted_at":"2026-04-08T20:51:00Z","title":"Too long; didn't solve","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T17:29:25.830962Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2604.07593"},"observation_digest":"sha256:f883a110c37d5341e44149f9e01388ff531840c3a8a17e138a40748f89db5f7f","observation_id":"262e58f0-d614-47dd-a1d8-0cc99518eb4c","resolution":{"observed_at":"2026-05-11T06:41:42.966189Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-07-13T08:26:49.097626Z","title":"ArXiv:2502.19187","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.07593","last_updated":"2026-06-17T23:58:56Z","snapshot_observed_at":"2026-07-13T08:26:43.817939Z","submitted_at":"2026-04-08T20:51:00Z","title":"Too long; didn't solve","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T08:26:49.097626Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2604.07593"},"observation_digest":"sha256:b6e6c5f174f16785b93daed3a7dbf762e014d0a48963b5755cffc7ece9871d21","observation_id":"af3a7a04-df78-4956-a6e3-4b5c252b217f","resolution":{"observed_at":"2026-07-13T08:26:49.097626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":"2502.19187","doi":"10.48550/arxiv.2502.19187","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Big-bench extra hard","venue":"ArXiv.org","work_id":"a39d2b40-bc37-45e9-9ef3-82fdb24cdc60","year":2025},"citing_paper":{"arxiv_id":"2604.16646","last_updated":"2026-04-17T19:02:54Z","snapshot_observed_at":"2026-07-06T23:03:57.199731Z","submitted_at":"2026-04-17T19:02:54Z","title":"Agentic Frameworks for Reasoning Tasks: An Empirical Study","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T08:24:51.573913Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2604.16646"},"observation_digest":"sha256:774d6e1eb9f5f30a7a743986d323da81c9fcd429c120ac7596b6ea469285bf0d","observation_id":"55b65bfc-9684-4b7a-a584-ced511ec03d4","resolution":{"observed_at":"2026-05-10T09:08:26.177810Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":"2502.19187","doi":"10.48550/arxiv.2502.19187","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Big-bench extra hard","venue":"ArXiv.org","work_id":"a39d2b40-bc37-45e9-9ef3-82fdb24cdc60","year":2025},"citing_paper":{"arxiv_id":"2605.05851","last_updated":"2026-05-07T08:24:54Z","snapshot_observed_at":"2026-08-04T15:23:48.540297Z","submitted_at":"2026-05-07T08:24:54Z","title":"Hypothesis generation and updating in large language models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-08T14:43:56.125546Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2605.05851"},"observation_digest":"sha256:6aeed7b6f636835482af213d3a5d52092a6b5740255e949aa5139685020e734d","observation_id":"c8c91847-9a8f-442d-8c80-6c4a83d67baa","resolution":{"observed_at":"2026-05-08T21:14:12.648060Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":"2502.19187","doi":"10.48550/arxiv.2502.19187","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Big-bench extra hard","venue":"ArXiv.org","work_id":"a39d2b40-bc37-45e9-9ef3-82fdb24cdc60","year":2025},"citing_paper":{"arxiv_id":"2606.03800","last_updated":"2026-07-07T21:08:01Z","snapshot_observed_at":"2026-08-08T12:21:41.888056Z","submitted_at":"2026-06-02T15:48:28Z","title":"Trading Human Curation for Synthetic Augmentation in RLVR","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T11:10:06.685591Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2606.03800"},"observation_digest":"sha256:ddc856e97053eac7ff8984ec73e3daabb34bd94be70c9c78dc7d17c6e1ac3d16","observation_id":"9453ea26-0d61-4ffa-855b-c66cd20a4537","resolution":{"observed_at":"2026-07-02T02:16:26.172298Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-07-12T15:15:09.675778Z","title":"BIG-Bench Extra Hard","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.03800","last_updated":"2026-07-07T21:08:01Z","snapshot_observed_at":"2026-08-08T12:21:41.888056Z","submitted_at":"2026-06-02T15:48:28Z","title":"Trading Human Curation for Synthetic Augmentation in RLVR","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-12T15:15:09.675778Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2606.03800"},"observation_digest":"sha256:51651d509a2be47e231b65ea1cbacd78e58eb7b2555c5ef0d9a4795f80b5354d","observation_id":"1f92c4b6-1373-4289-801e-80a71a97f175","resolution":{"observed_at":"2026-07-12T15:15:09.675778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":"2502.19187","doi":"10.48550/arxiv.2502.19187","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Big-bench extra hard","venue":"ArXiv.org","work_id":"a39d2b40-bc37-45e9-9ef3-82fdb24cdc60","year":2025},"citing_paper":{"arxiv_id":"2606.15079","last_updated":"2026-06-13T03:21:49Z","snapshot_observed_at":"2026-07-06T23:52:28.557859Z","submitted_at":"2026-06-13T03:21:49Z","title":"Ling and Ring 2.6 Technical Report: Efficient and Instant Agentic Intelligence at Trillion-Parameter Scale","version":1},"reference_index":196,"source":"arxiv_source","source_observed_at":"2026-07-02T22:10:59.568675Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2606.15079"},"observation_digest":"sha256:016acf7e18dcf38786cd78f202edfbc5ca518d392ff7871e74db2a387a2e6717","observation_id":"5edf16bd-706a-439c-8d55-eec16a58dea3","resolution":{"observed_at":"2026-07-02T22:17:25.662736Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":"2502.19187","doi":"10.48550/arxiv.2502.19187","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Big-bench extra hard","venue":"ArXiv.org","work_id":"a39d2b40-bc37-45e9-9ef3-82fdb24cdc60","year":2025},"citing_paper":{"arxiv_id":"2606.30774","last_updated":"2026-06-29T18:06:36Z","snapshot_observed_at":"2026-07-07T00:04:34.491408Z","submitted_at":"2026-06-29T18:06:36Z","title":"What Drives Interactive Improvement from Feedback?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-01T02:36:20.649687Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2606.30774"},"observation_digest":"sha256:98e7e9a27031d6b5aa56e6cba1ae0ee930e8f482151cd7b00f01e2eec7e97385","observation_id":"6d765560-0150-4a8f-8aa0-663e6a371c68","resolution":{"observed_at":"2026-07-01T12:05:43.484641Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-07-12T07:10:06.281832Z","title":"Kazemi, B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.02770","last_updated":"2026-07-02T21:08:53Z","snapshot_observed_at":"2026-08-09T14:18:19.682421Z","submitted_at":"2026-07-02T21:08:53Z","title":"Gemma 4 Technical Report","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-12T07:10:06.281832Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2607.02770"},"observation_digest":"sha256:e35ab85c00109d0466116acd6cfacc6d0ee5d58a834e1e0e589d7da162c9f4dd","observation_id":"f61e585a-de91-4fa7-a9a9-671c044eb43c","resolution":{"observed_at":"2026-07-12T07:10:06.281832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-07-14T03:48:31.314623Z","title":"V., Jain, L","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11696","last_updated":"2026-07-13T15:29:24Z","snapshot_observed_at":"2026-08-03T00:28:12.685505Z","submitted_at":"2026-07-13T15:29:24Z","title":"Think Through a Bottleneck: Hourglass Reasoning for Rigorous Induction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T03:48:31.314623Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2607.11696"},"observation_digest":"sha256:bc45ae2f2c98b734a331e7f220a09c194bf134409e13679cf908e52d7d8d67e8","observation_id":"72a0b73d-67eb-43be-86bf-886bb74949aa","resolution":{"observed_at":"2026-07-14T03:48:31.314623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19187","snapshot_observed_at":"2026-08-06T04:30:40.572955Z","title":"Jain, Virginia Aglietti, Disha Jindal, Peter Chen, Nishanth Dikkala, Gladys Tyen, Xin Liu, Uri Shalit, Silvia Chiappa, Kate Olszewska, Yi Tay, Vinh Q","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05139","last_updated":"2026-08-05T17:57:16Z","snapshot_observed_at":"2026-08-09T12:43:19.697158Z","submitted_at":"2026-08-05T17:57:16Z","title":"Toward Skill-Native LLMs: Skill Entropy for Benchmarking and Training Long-Horizon Reasoning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T04:30:40.572955Z"},"links":{"cited_paper":"/paper/2502.19187","citing_paper":"/paper/2608.05139"},"observation_digest":"sha256:eceb2f2fd3fb9cfadb9ad71a45f88bb040ff011c5b9b9c032f723b1a135b4792","observation_id":"79592456-402e-4e60-bf62-d166c363c77b","resolution":{"observed_at":"2026-08-06T04:30:40.572955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.19187/citation-record","integrity":"/paper/2502.19187/integrity","json":"/paper/2502.19187/citation-record.json","paper":"/paper/2502.19187"},"outbound":[],"paper":{"arxiv_id":"2502.19187","last_updated":"2025-05-06T15:11:32Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T17:46:00.833139Z","submitted_at":"2025-02-26T14:50:50Z","title":"BIG-Bench Extra Hard"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 31 inbound Pith citation observations for arXiv:2502.19187."}