{"as_of":"2026-08-09T14:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7626d28e2d118c22aba4d18d61272a79ee67e6fc8c4e20dbe393809966c91795","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:46:47.252660Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-02T19:18:43.558804Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T19:27:18.669942Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-09T09:01:48.720270Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"cited_work":{"arxiv_id":"2507.04766","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.04766","snapshot_observed_at":"2026-07-02T19:27:18.669942Z","title":"ABench -physics: Benchmarking physical reasoning in LLMs via high-difficulty and dynamic physics problems","venue":null,"work_id":"0610f529-1573-4d00-b3cf-6c419661cd96","year":2025},"citing_paper":{"arxiv_id":"2507.12549","last_updated":"2026-04-28T23:40:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-16T18:01:26Z","title":"The Serial Scaling Hypothesis","version":4},"reference_index":136,"source":"arxiv_source","source_observed_at":"2026-05-19T04:08:11.344622Z"},"links":{"cited_paper":"/paper/2507.04766","citing_paper":"/paper/2507.12549"},"observation_digest":"sha256:1271c472f1dedc16a17413929cb22831b433341b700e28f136279e7b99233087","observation_id":"2f406b00-1d5c-4b74-9b81-672ae2b611f1","resolution":{"observed_at":"2026-05-19T04:12:02.412715Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-09T09:01:48.720270Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"cited_work":{"arxiv_id":"2507.04766","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.04766","snapshot_observed_at":"2026-07-02T19:27:18.669942Z","title":"ABench -physics: Benchmarking physical reasoning in LLMs via high-difficulty and dynamic physics problems","venue":null,"work_id":"0610f529-1573-4d00-b3cf-6c419661cd96","year":2025},"citing_paper":{"arxiv_id":"2602.07064","last_updated":"2026-04-07T13:49:35Z","snapshot_observed_at":"2026-08-03T13:22:02.057620Z","submitted_at":"2026-02-05T14:04:51Z","title":"OmniFysics: Towards Physical Intelligence Evolution via Omni-Modal Signal Processing and Network Optimization","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-16T07:09:46.254851Z"},"links":{"cited_paper":"/paper/2507.04766","citing_paper":"/paper/2602.07064"},"observation_digest":"sha256:d2dd0ef2d8063a2e709c48251d67f56ba54a5403a7c939e54cd9d2b4f28f4ff3","observation_id":"04f8db6c-c683-4fec-8c61-fa4b0631a96b","resolution":{"observed_at":"2026-05-16T07:10:43.003448Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-09T09:01:48.720270Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"cited_work":{"arxiv_id":"2507.04766","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.04766","snapshot_observed_at":"2026-07-02T19:27:18.669942Z","title":"ABench -physics: Benchmarking physical reasoning in LLMs via high-difficulty and dynamic physics problems","venue":null,"work_id":"0610f529-1573-4d00-b3cf-6c419661cd96","year":2025},"citing_paper":{"arxiv_id":"2604.17928","last_updated":"2026-04-20T08:09:01Z","snapshot_observed_at":"2026-07-06T23:04:55.190916Z","submitted_at":"2026-04-20T08:09:01Z","title":"HEALing Entropy Collapse: Enhancing Exploration in Few-Shot RLVR via Hybrid-Domain Entropy Dynamics Alignment","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-10T05:23:08.478393Z"},"links":{"cited_paper":"/paper/2507.04766","citing_paper":"/paper/2604.17928"},"observation_digest":"sha256:60accf9b9631d4c185ad1897e27dc9051407843572c1856a5e5117aa2e1b87ef","observation_id":"095c7482-0d13-4dd6-8ba0-4d34e4f0e6bd","resolution":{"observed_at":"2026-05-10T05:25:55.207987Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-09T09:01:48.720270Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"cited_work":{"arxiv_id":"2507.04766","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.04766","snapshot_observed_at":"2026-07-02T19:27:18.669942Z","title":"ABench -physics: Benchmarking physical reasoning in LLMs via high-difficulty and dynamic physics problems","venue":null,"work_id":"0610f529-1573-4d00-b3cf-6c419661cd96","year":2025},"citing_paper":{"arxiv_id":"2604.18936","last_updated":"2026-04-21T00:21:05Z","snapshot_observed_at":"2026-07-06T23:05:39.724237Z","submitted_at":"2026-04-21T00:21:05Z","title":"Fine-Tuning Small Reasoning Models for Quantum Field Theory","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T03:23:18.770963Z"},"links":{"cited_paper":"/paper/2507.04766","citing_paper":"/paper/2604.18936"},"observation_digest":"sha256:e84de49a56251ed47cd40f521e40ec8460bc82a51e46e6c161f66b964e933556","observation_id":"f4d33857-0e27-44f5-b732-8cdc706cd056","resolution":{"observed_at":"2026-05-11T12:31:05.880212Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-09T09:01:48.720270Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"cited_work":{"arxiv_id":"2507.04766","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.04766","snapshot_observed_at":"2026-07-02T19:27:18.669942Z","title":"ABench -physics: Benchmarking physical reasoning in LLMs via high-difficulty and dynamic physics problems","venue":null,"work_id":"0610f529-1573-4d00-b3cf-6c419661cd96","year":2025},"citing_paper":{"arxiv_id":"2607.00276","last_updated":"2026-06-30T23:52:15Z","snapshot_observed_at":"2026-08-09T09:31:38.270841Z","submitted_at":"2026-06-30T23:52:15Z","title":"Testing Frontier Large Language Models' Physics Literacy in Parallel Physical Worlds","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-07-02T19:18:43.558804Z"},"links":{"cited_paper":"/paper/2507.04766","citing_paper":"/paper/2607.00276"},"observation_digest":"sha256:0baf548891d3862c94d984cc4724ffd0d764e1691cd4cb14a22a3350b6f67534","observation_id":"0bd84f15-e67c-4653-b850-3e00f017f2d4","resolution":{"observed_at":"2026-07-02T19:27:18.671496Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.04766/citation-record","integrity":"/paper/2507.04766/integrity","json":"/paper/2507.04766/citation-record.json","paper":"/paper/2507.04766"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:46:45.993866Z","title":"Wei Chow, Jiageng Mao, Boyi Li, Daniel Seita, Vitor Guizilini, and Yue Wang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-09T09:01:48.720270Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:45.993866Z"},"links":{"citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:654fc7fd94eedabadee9fd936d560ca4ad661970a2a9a746882a620c7c6e73f1","observation_id":"366d4e26-50fd-412b-ae7c-30086fc83dfb","resolution":{"observed_at":"2026-08-06T19:46:45.993866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15815","last_updated":"2025-02-19T19:00:00Z","snapshot_observed_at":"2026-08-07T23:28:55.289287Z","submitted_at":"2025-02-19T19:00:00Z","title":"Theoretical Physics Benchmark (TPBench) -- a Dataset and Study of AI Reasoning Capabilities in Theoretical Physics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.15815","snapshot_observed_at":"2026-08-06T19:46:46.076892Z","title":"DeepSeek Team","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-09T09:01:48.720270Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:46.076892Z"},"links":{"cited_paper":"/paper/2502.15815","citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:9c922fdd33f42062f8550895cf89a594d9597c6ced34abe0cebffa1cee9be688","observation_id":"c8b86f07-ca5b-4d9d-8e89-b2ed5c81c600","resolution":{"observed_at":"2026-08-06T19:46:46.076892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.13013","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:46:47.841102Z","title":"doi: https://doi.org/ 10.1016/j.neucom.2025.130135","venue":null,"work_id":"fdcd6172-c237-4fc9-9f95-d336cdbe3110","year":2025},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-09T09:01:48.720270Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:46.270101Z"},"links":{"citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:054f2b613e2b3f944b851b5178709119296dbd3aac449324765e91a111eca483","observation_id":"7013b9e3-3921-4428-939c-f4e2f8f6a8e9","resolution":{"observed_at":"2026-08-06T19:46:47.891352Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:46:48.226647Z","title":"FOLIO: Natural language rea- soning with first-order logic","venue":null,"work_id":"780d341a-33d6-4506-8e31-611219278427","year":2024},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-09T09:01:48.720270Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:46.395337Z"},"links":{"citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:587ea49f7f723803060a3ba291071b30199a422fb10b33b992da5b0e6a677762","observation_id":"7a4121c9-67c4-4957-b120-e64d8bf63467","resolution":{"observed_at":"2026-08-06T19:46:48.334150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:46:46.537021Z","title":"doi: 10.18653/v1/2024.emnlp-main.1229","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-09T09:01:48.720270Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:46.537021Z"},"links":{"citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:6212fc9da32a5e9679c75d08ba7ecf570fea230962cc1617bbc242a32b9c62db","observation_id":"67350f8a-0c2c-48d6-9fa2-dd4b2cf5111d","resolution":{"observed_at":"2026-08-06T19:46:46.537021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:46:46.747606Z","title":"doi: 10.18653/v1/2024.inlg-main.45","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-09T09:01:48.720270Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:46.747606Z"},"links":{"citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:142d1d3f80faf8a5898e52ab539a6ac21f435da09a7afc4b829fceb8ac06e16b","observation_id":"bfab19bc-cc6f-43f7-b089-aa3d61d37328","resolution":{"observed_at":"2026-08-06T19:46:46.747606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15720","last_updated":"2024-06-22T03:32:09Z","snapshot_observed_at":"2026-07-06T18:35:17.953523Z","submitted_at":"2024-06-22T03:32:09Z","title":"Scaling Laws for Fact Memorization of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15720","snapshot_observed_at":"2026-08-06T19:46:46.924233Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-09T09:01:48.720270Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:46.924233Z"},"links":{"cited_paper":"/paper/2406.15720","citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:c4a8e33837e8e2180c1196aaf853e9eac819ad8ec4b87e128370c925be0def85","observation_id":"3b0430dd-2d52-4545-bbce-a5629b15bb01","resolution":{"observed_at":"2026-08-06T19:46:46.924233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23123","last_updated":"2025-03-04T06:22:40Z","snapshot_observed_at":"2026-08-08T11:18:18.405211Z","submitted_at":"2024-10-30T15:31:54Z","title":"On Memorization of Large Language Models in Logical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23123","snapshot_observed_at":"2026-08-06T19:46:47.076281Z","title":"Xin Xu, Qiyun Xu, Tong Xiao, Tianhao Chen, Yuchen Yan, Jiaxin Zhang, Shizhe Diao, Can Yang, and Yang Wang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-09T09:01:48.720270Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:47.076281Z"},"links":{"cited_paper":"/paper/2410.23123","citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:08d8b7927e34c6eb3a6305757e94ec4cab8ad8f0376056db3e323d9be1f6f5e7","observation_id":"c671e83f-dfbe-4f54-879e-20e84ffe51d9","resolution":{"observed_at":"2026-08-06T19:46:47.076281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10885","last_updated":"2025-04-15T05:29:31Z","snapshot_observed_at":"2026-08-07T16:05:40.179437Z","submitted_at":"2025-04-15T05:29:31Z","title":"PuzzleBench: A Fully Dynamic Evaluation Framework for Large Multimodal Models on Puzzle Solving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10885","snapshot_observed_at":"2026-08-06T19:46:47.159833Z","title":"Shenghe Zheng, Qianjia Cheng, Junchi Yao, Mengsong Wu, Haonan He, Ning Ding, Yu Cheng, Shuyue Hu, Lei Bai, Dongzhan Zhou, Ganqu Cui, and Peng Ye","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-09T09:01:48.720270Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:47.159833Z"},"links":{"cited_paper":"/paper/2504.10885","citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:05afc6c7705766ee68fd81ef712e8f5f51ffcee427a984828e95a946b0e6c028","observation_id":"f9e6973e-1feb-42c8-a658-315215162874","resolution":{"observed_at":"2026-08-06T19:46:47.159833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.00022","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:46:47.495346Z","title":null,"venue":null,"work_id":"d9e8999a-18a8-427f-8783-55ce26b989ae","year":null},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-09T09:01:48.720270Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:47.252660Z"},"links":{"citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:3e687ca1245fba64aaa3ed75d616a56d50e93a6e9142d216cd3ad1ba511b4b22","observation_id":"9262265c-c4f4-4c98-af63-dab4f8330d40","resolution":{"observed_at":"2026-08-06T19:46:47.574250Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16074","last_updated":"2025-05-18T14:13:34Z","snapshot_observed_at":"2026-08-07T16:00:09.967849Z","submitted_at":"2025-04-22T17:53:29Z","title":"PHYBench: Holistic Evaluation of Physical Perception and Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16074","snapshot_observed_at":"2026-08-06T19:46:46.994892Z","title":"Phybench: Holistic evaluation of physical perception and reasoning in large language models, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-09T09:01:48.720270Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":1949,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:46.994892Z"},"links":{"cited_paper":"/paper/2504.16074","citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:fbbf756070f0931558ccc6d3bc232039679712666462c810fb33732e05bb6f96","observation_id":"bc12a3de-5e3b-4c8c-9447-ab0a6ee1263d","resolution":{"observed_at":"2026-08-06T19:46:46.994892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-09T10:28:06.906299Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-06T19:46:46.663755Z","title":"Mea- suring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-09T09:01:48.720270Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:46.663755Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:3c2588667071e1518659e01476528ac131089ed38d10d46094595da525378acd","observation_id":"c5971dd2-b937-4500-9f91-8ada7c7b0506","resolution":{"observed_at":"2026-08-06T19:46:46.663755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.05656","last_updated":"2019-08-15T17:58:32Z","snapshot_observed_at":"2026-08-08T13:30:06.897676Z","submitted_at":"2019-08-15T17:58:32Z","title":"PHYRE: A New Benchmark for Physical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.05656","snapshot_observed_at":"2026-08-06T19:46:45.813127Z","title":"Simin Chen, Yiming Chen, Zexin Li, Yifan Jiang, Zhongwei Wan, Yixin He, Dezhi Ran, Tianle Gu, Haizhou Li, Tao Xie, and Baishakhi Ray","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-09T09:01:48.720270Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:45.813127Z"},"links":{"cited_paper":"/paper/1908.05656","citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:7342e8fcb0a0849e9704d54b1efa825a764c129e6eb25b551ee936cb170f5c66","observation_id":"0acbb38f-5b74-4fb7-b294-337de28fb99f","resolution":{"observed_at":"2026-08-06T19:46:45.813127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:46:48.109295Z","title":null,"venue":null,"work_id":"6862b1a5-1975-4249-82df-f6da7b1f1fc8","year":2007},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-09T09:01:48.720270Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:46.825760Z"},"links":{"citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:2b72c6392f6f580d8e14b582d051c0387469f3cf1f6a869d7e2a7f8bbc278158","observation_id":"18446ae8-3f71-4341-b934-4988a13c8564","resolution":{"observed_at":"2026-08-06T19:46:48.147555Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14644","last_updated":"2024-06-20T18:07:26Z","snapshot_observed_at":"2026-07-06T18:34:29.513732Z","submitted_at":"2024-06-20T18:07:26Z","title":"Unveiling the Spectrum of Data Contamination in Language Models: A Survey from Detection to Remediation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14644","snapshot_observed_at":"2026-08-06T19:46:46.159536Z","title":"Jingzhe Ding, Yan Cen, and Xinyuan Wei","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-09T09:01:48.720270Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:46.159536Z"},"links":{"cited_paper":"/paper/2406.14644","citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:bd7d3a41a822a9583c604ac03771dfc8c5694d0da710a01d07bfc7f56d9e1c8b","observation_id":"15023179-5139-48d3-a2d3-5aa25b6eb74e","resolution":{"observed_at":"2026-08-06T19:46:46.159536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:46:48.428452Z","title":"Have llms advanced enough? a challenging problem solving benchmark for large language models","venue":null,"work_id":"c2b7a0a9-997d-43d9-a40f-7b6aeeacd8a5","year":2023},"citing_paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","snapshot_observed_at":"2026-08-09T09:01:48.720270Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T19:46:45.710892Z"},"links":{"citing_paper":"/paper/2507.04766"},"observation_digest":"sha256:9084182014837bc862af62c5f379a0d6c5a5a4204a94e9844e51c20b6da428ee","observation_id":"f7dd8d17-15c7-4a1e-8ea9-afe81603cae1","resolution":{"observed_at":"2026-08-06T19:46:48.488531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.04766","last_updated":"2025-07-07T08:43:56Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T09:01:48.720270Z","submitted_at":"2025-07-07T08:43:56Z","title":"ABench-Physics: Benchmarking Physical Reasoning in LLMs via High-Difficulty and Dynamic Physics Problems"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":12,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 5 inbound Pith citation observations for arXiv:2507.04766."}