{"as_of":"2026-08-12T07:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:069d82b3c02a8953f189f143315e23914f97426348c054acd362d9e69df2b8e9","coverage":[{"denominator":61,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T04:39:03.692877Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.07437/citation-record","integrity":"/paper/2608.07437/integrity","json":"/paper/2608.07437/citation-record.json","paper":"/paper/2608.07437"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1305.2016","last_updated":"2018-04-28T10:26:12Z","snapshot_observed_at":"2026-07-06T03:13:00.659828Z","submitted_at":"2013-05-09T06:51:33Z","title":"Stability analysis of fluid flows using Lagrangian Perturbation Theory (LPT): application to the plane Couette flow","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1305.2016","snapshot_observed_at":"2026-08-10T04:39:03.400189Z","title":"Wasserstein and Nicole A","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.400189Z"},"links":{"cited_paper":"/paper/1305.2016","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:51131dc33c76e7369f4df1947e00d639473d4c887e88c105ce3bdfb00b9ed57b","observation_id":"02ee2bb2-7fe8-4c06-b2ee-ce4641c13f46","resolution":{"observed_at":"2026-08-10T04:39:03.400189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07209","last_updated":"2025-05-19T09:44:19Z","snapshot_observed_at":"2026-08-04T10:05:13.497222Z","submitted_at":"2023-06-12T16:12:56Z","title":"Data-Copilot: Bridging Billions of Data and Humans with Autonomous Workflow","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07209","snapshot_observed_at":"2026-08-10T04:39:03.405648Z","title":"Data-copilot: Bridging billions of data and humans with autonomous workflow.arXiv preprint arXiv:2306.07209, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.405648Z"},"links":{"cited_paper":"/paper/2306.07209","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:a16485d69979b3dcfa7292fc62f1f5d504fc666f2b2a37490e52dc60575f1ac8","observation_id":"f153cbbe-5435-4fe6-bc70-a6848ac07d3b","resolution":{"observed_at":"2026-08-10T04:39:03.405648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:03.410767Z","title":"Deepanalyze: Agentic large language models for autonomous data science.arXiv preprint arXiv:2510.16872, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.410767Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:993577ad84caecfd14d6a323050d63c142b3dfa59433b4167872c44c5d586410","observation_id":"0d367f4e-3feb-4514-9909-6a82962ea663","resolution":{"observed_at":"2026-08-10T04:39:03.410767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.747597Z","title":"Data interpreter: An llm agent for data science","venue":null,"work_id":"9a844a32-6a23-4307-9926-07c7e7f5c142","year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.415655Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:327e3a81cb76cf5e527d3b0dc4137411dc0eba8c08bdd71304f4761b53785011","observation_id":"bb3088c0-b3fa-4f21-b3ac-6010955f896f","resolution":{"observed_at":"2026-08-10T04:39:04.752551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.731790Z","title":"Infiagent-dabench: Evaluating agents on data analysis tasks,","venue":null,"work_id":"bfcb9cc0-070f-4fb7-b5cb-7c1e3434481d","year":null},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.420634Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:7236bcd1dd0780d18d14674436b403d0a4de1322d2161023da70002085bf755f","observation_id":"3688e365-d990-471c-8239-cf1a285070ff","resolution":{"observed_at":"2026-08-10T04:39:04.736770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23719","last_updated":"2025-06-30T10:49:21Z","snapshot_observed_at":"2026-08-11T05:06:41.954885Z","submitted_at":"2025-06-30T10:49:21Z","title":"DABstep: Data Agent Benchmark for Multi-step Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23719","snapshot_observed_at":"2026-08-10T04:39:03.430946Z","title":"Dabstep: Data agent benchmark for multi-step reasoning.arXiv preprint arXiv:2506.23719, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.430946Z"},"links":{"cited_paper":"/paper/2506.23719","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:797e804d88c4ae358b2efd0dabfb7f7390326632d8671d75abf45a71e5b2baa7","observation_id":"644faab7-ad14-4c37-b046-38a7b75ab743","resolution":{"observed_at":"2026-08-10T04:39:03.430946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:03.436223Z","title":"DA-code: Agent data science code gen- eration benchmark for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.436223Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:f3a4dbb2157ce21e929bfb55e26f32da6eee547e0cae40b2920e4704aca81951","observation_id":"d847d5b0-9d18-44da-930c-7c95e024f0b1","resolution":{"observed_at":"2026-08-10T04:39:03.436223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.715404Z","title":"Are large language models good statisticians?Advances in Neural Information Processing Systems, 37:62697–62731, 2024","venue":null,"work_id":"8b1622dc-1e5a-417d-ab94-a36fae02223f","year":2024},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.441812Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:d7480e7a315143c1db205a038b1ac46257494eaa3df566631e26dc17c93c20ca","observation_id":"0a10aadc-bd13-43fb-ab13-3168d2574294","resolution":{"observed_at":"2026-08-10T04:39:04.720970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03629","last_updated":"2023-03-10T01:00:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-06T01:00:32Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03629","snapshot_observed_at":"2026-08-10T04:39:03.446928Z","title":"React: Synergizing reasoning and acting in language models.arXiv preprint arXiv:2210.03629, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.446928Z"},"links":{"cited_paper":"/paper/2210.03629","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:6c399a1a6b8cc342e38eb84d16164d8133da141b1b2853d42e5aa86fa8d510a3","observation_id":"9ff204ad-749c-48ef-a97b-da696b13364a","resolution":{"observed_at":"2026-08-10T04:39:03.446928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.698968Z","title":"Ds-1000: A natural and reliable benchmark for 12 data science code generation","venue":null,"work_id":"4bdf21c0-0b2e-4e65-a790-25be9aeb5f98","year":2023},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.452234Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:0e4fcf13bf1fd2b22822e510fcdaa8ca3e19e38bdcc931f3aa078c96bc99768e","observation_id":"4ebded3c-7ce2-497e-a8ad-eeff6bf9b079","resolution":{"observed_at":"2026-08-10T04:39:04.704281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05507","last_updated":"2024-03-11T07:57:59Z","snapshot_observed_at":"2026-07-06T17:13:59.073342Z","submitted_at":"2024-01-10T19:04:00Z","title":"InfiAgent-DABench: Evaluating Agents on Data Analysis Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05507","snapshot_observed_at":"2026-08-10T04:39:03.457120Z","title":"Infiagent-dabench: Evaluating agents on data analysis tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.457120Z"},"links":{"cited_paper":"/paper/2401.05507","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:e001a135f461eeb1be5d08ba8ad99b4c43b3add77af0200adb122dcc16e7f37c","observation_id":"c9f45c4b-e365-44ce-94b6-d9d21dcce73d","resolution":{"observed_at":"2026-08-10T04:39:03.457120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13897","last_updated":"2025-02-19T17:31:51Z","snapshot_observed_at":"2026-08-07T18:04:25.069863Z","submitted_at":"2025-02-19T17:31:51Z","title":"DataSciBench: An LLM Agent Benchmark for Data Science","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13897","snapshot_observed_at":"2026-08-10T04:39:03.461634Z","title":"Datascibench: An llm agent benchmark for data science","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.461634Z"},"links":{"cited_paper":"/paper/2502.13897","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:9ac3239ad8eceab6d0dc94ecb05591afcc0ecf04235d11c9f3c6d85361da2960","observation_id":"b7b4fe64-9111-4aac-8e71-5a507dd9ac22","resolution":{"observed_at":"2026-08-10T04:39:03.461634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07095","last_updated":"2025-02-26T11:57:30Z","snapshot_observed_at":"2026-08-06T21:08:58.653035Z","submitted_at":"2024-10-09T17:34:27Z","title":"MLE-bench: Evaluating Machine Learning Agents on Machine Learning Engineering","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07095","snapshot_observed_at":"2026-08-10T04:39:03.466801Z","title":"Mle-bench: Evaluating machine learning agents on machine learning engineering.arXiv preprint arXiv:2410.07095, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.466801Z"},"links":{"cited_paper":"/paper/2410.07095","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:4cf427db7aa13b4cc25922d29683baf26d7252fc327a8fafcd58bf2ab0666b13","observation_id":"c1557f8b-cbf6-4f32-a05c-31576141a4ab","resolution":{"observed_at":"2026-08-10T04:39:03.466801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05307","last_updated":"2024-03-08T13:34:20Z","snapshot_observed_at":"2026-08-11T08:54:24.413748Z","submitted_at":"2024-03-08T13:34:20Z","title":"Tapilot-Crossing: Benchmarking and Evolving LLMs Towards Interactive Data Analysis Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05307","snapshot_observed_at":"2026-08-10T04:39:03.471639Z","title":"Tapilot-crossing: Benchmarking and evolving llms towards interactive data analysis agents.arXiv preprint arXiv:2403.05307, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.471639Z"},"links":{"cited_paper":"/paper/2403.05307","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:8fa56e79cdd9d4c06cb991c3debc062f11b4fef274a005a5740a42b9b5e158c7","observation_id":"9a176489-9d48-4993-bd21-04ab319deee1","resolution":{"observed_at":"2026-08-10T04:39:03.471639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18223","last_updated":"2025-06-06T06:33:47Z","snapshot_observed_at":"2026-08-09T04:33:54.887419Z","submitted_at":"2025-05-23T09:37:52Z","title":"IDA-Bench: Evaluating LLMs on Interactive Guided Data Analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18223","snapshot_observed_at":"2026-08-10T04:39:03.476630Z","title":"Ida-bench: Evaluating llms on interactive guided data analysis.arXiv preprint arXiv:2505.18223, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.476630Z"},"links":{"cited_paper":"/paper/2505.18223","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:35aed3a992cfd3208d70de46e0357c12957ec80b7ea28c8b148085faa61acb0c","observation_id":"8837324d-564e-4c35-8c3a-42f6175dc1af","resolution":{"observed_at":"2026-08-10T04:39:03.476630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:03.481558Z","title":"Fact or fiction: Verifying scientific claims","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.481558Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:e4442d1f3095d0adb391ded5a978f32d4985c9217cd3cf64c21e4ef54f50ddb5","observation_id":"30637093-fa4e-4b87-9771-5515245c4045","resolution":{"observed_at":"2026-08-10T04:39:03.481558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.673544Z","title":"Sciclaimhunt: A large dataset for evidence-based scientific claim verification","venue":null,"work_id":"e2f339bb-e585-4fef-8c94-56098b6ed3ae","year":null},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.486856Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:91591a06a5ff60511c3f3fa8ae9383ce3a46551c895198a6a190774abeef010e","observation_id":"d8348684-9385-4de9-a54d-6444071f1631","resolution":{"observed_at":"2026-08-10T04:39:04.678309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.658820Z","title":"Musciclaims: Multimodal scientific claim verifi- cation","venue":null,"work_id":"248e986b-2106-4d96-af88-2f0a1d966ed9","year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.491749Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:6534a49464eb62a072823f096a2fb6b22a07961b9059ec7cd7d2b256e0263b58","observation_id":"967c7018-a6b1-49aa-9c25-6282fef5ebaf","resolution":{"observed_at":"2026-08-10T04:39:04.663704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.643636Z","title":"Investi- gating the reproducibility of the social and behavioural sciences.Nature, 652(8108):126–134, 2026","venue":null,"work_id":"7ea99d08-4000-4add-8934-cb12d0b6b36f","year":2026},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.496445Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:cdbe5531f97d579a17e37cd1cde4f6ee5b92a395ddd3a12ad6ca65dfc976e957","observation_id":"75554491-30c5-42cb-bed5-39805595e3d7","resolution":{"observed_at":"2026-08-10T04:39:04.648515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:03.500807Z","title":"Towards end-to-end automation of ai research.Nature, 651(8107):914–919, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.500807Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:a7c0246c44e1162293a064adf899f3dc487f7634a9326b44071d4b0ae7d6caf8","observation_id":"2e9418d9-cd96-49f7-b8f7-bbdd9163863e","resolution":{"observed_at":"2026-08-10T04:39:03.500807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18705","last_updated":"2025-05-24T13:54:38Z","snapshot_observed_at":"2026-08-11T18:24:31.152241Z","submitted_at":"2025-05-24T13:54:38Z","title":"AI-Researcher: Autonomous Scientific Innovation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18705","snapshot_observed_at":"2026-08-10T04:39:03.505323Z","title":"Ai-researcher: Autonomous scientific innovation.arXiv preprint arXiv:2505.18705, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.505323Z"},"links":{"cited_paper":"/paper/2505.18705","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:2f270c2909ed0e5bfc12113112c840d0344d8aa8bd8955a62a247012d4ad5c72","observation_id":"bb557469-8e70-4498-822e-5276a4c060ee","resolution":{"observed_at":"2026-08-10T04:39:03.505323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08066","last_updated":"2025-04-10T18:44:41Z","snapshot_observed_at":"2026-08-10T03:18:36.275195Z","submitted_at":"2025-04-10T18:44:41Z","title":"The AI Scientist-v2: Workshop-Level Automated Scientific Discovery via Agentic Tree Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08066","snapshot_observed_at":"2026-08-10T04:39:03.509944Z","title":"The ai scientist-v2: Workshop-level automated scientific discovery via agentic tree search.arXiv preprint arXiv:2504.08066, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.509944Z"},"links":{"cited_paper":"/paper/2504.08066","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:562ead79be63a0e30e27cde0a6d3609fbd555f647195a581013707223a477e07","observation_id":"2e96c553-6fcf-4e65-aa12-39d281943fde","resolution":{"observed_at":"2026-08-10T04:39:03.509944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.615876Z","title":"Development economics field experiments (dfeep)","venue":null,"work_id":"0e613022-4cae-4cce-a6a6-a097d8bea8ce","year":2026},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.514880Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:1e0d5f1a729560f6c389c26682213574df6d6c4ebdae72deb1774856d5c07eab","observation_id":"7097c805-7d63-451c-8122-a5b98befa13a","resolution":{"observed_at":"2026-08-10T04:39:04.620868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.599663Z","title":"The cbio cancer genomics portal: an open platform for exploring multidimensional cancer genomics data.Cancer discovery, 2(5):401–404, 2012","venue":null,"work_id":"6b575d35-db63-46b4-bee9-7e6ae05507df","year":2012},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.519472Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:5c56f78ec86fa2fbc73a00bf02c2fcbbffc6e686e8473515a692a7a6b537c653","observation_id":"7af7ec38-d793-45e9-ade6-72a95d998e44","resolution":{"observed_at":"2026-08-10T04:39:04.605005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.583703Z","title":"Integrative analysis of complex cancer genomics and clinical profiles using the cbioportal.Science signal- ing, 6(269):pl1–pl1, 2013","venue":null,"work_id":"9e48aa45-e1fb-4da5-842f-ff4349919a0c","year":2013},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.524397Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:c23cee8ea5fbb864fec97e7058e6c5cc017865d9d65fbbafa889a64842f04527","observation_id":"ba341f71-2d39-4448-8fd2-9d69c49fc373","resolution":{"observed_at":"2026-08-10T04:39:04.588856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16100","last_updated":"2025-05-22T01:02:21Z","snapshot_observed_at":"2026-08-08T09:18:44.401175Z","submitted_at":"2025-05-22T01:02:21Z","title":"BioDSA-1K: Benchmarking Data Science Agents for Biomedical Research","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16100","snapshot_observed_at":"2026-08-10T04:39:03.528813Z","title":"Biodsa-1k: Benchmarking data science agents for biomedical research, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.528813Z"},"links":{"cited_paper":"/paper/2505.16100","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:e05e9c26bbf9a54332ab055cc8c006ab53b30b0736f84087d87e8201f132029e","observation_id":"5b5ffc14-a414-42a7-b78d-11cf301e6476","resolution":{"observed_at":"2026-08-10T04:39:03.528813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.568157Z","title":null,"venue":null,"work_id":"6918af45-45a6-4eae-937e-abcd2e71bcb4","year":2024},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.533331Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:b71a8e2ca5ca84fa539261ea557ed7a60d198bfe4ad13aa079d36a15bb8da18b","observation_id":"06e28d36-989a-43de-885b-022acebdf441","resolution":{"observed_at":"2026-08-10T04:39:04.573011Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.551911Z","title":"Introducing claude sonnet 4.6.https://www.anthropic.com/news/ claude-sonnet-4-6, February 2026","venue":null,"work_id":"0a3ae8f5-722b-4903-81e0-175cfa6fcc62","year":2026},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.537708Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:4d5dbd9689404cb4105fdb19f7c1cf77075cacd4de4f4475327aa15201a29e1f","observation_id":"3509a304-b336-450a-a2e1-85062991a107","resolution":{"observed_at":"2026-08-10T04:39:04.556765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:03.542160Z","title":"Executable code actions elicit better llm agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.542160Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:871ccdd67c99863b849bb529d065a3b99a23522e0c3b74eeaf8cd8ae4d09373a","observation_id":"d71be0a8-203a-4c60-a02d-d6a67a1c3ce9","resolution":{"observed_at":"2026-08-10T04:39:03.542160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-10T04:39:03.546532Z","title":"Dapo: An open-source llm reinforcement learning system at scale.arXiv preprint arXiv:2503.14476, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.546532Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:da8f27430b01ab44468f0e452fc9cd4d651d2bbd6ca8a658a9183902723d1dff","observation_id":"50d4aaaa-401c-49ae-be49-6e26115c50f2","resolution":{"observed_at":"2026-08-10T04:39:03.546532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-10T04:39:03.550965Z","title":"Qwen2.5-coder technical report, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.550965Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:85bf6e1e223e163e3ea6ef399d99dbea02fd7d6231335ec7883e57d2b1e0c07a","observation_id":"da19215c-905d-4a00-b296-589b5f48acdf","resolution":{"observed_at":"2026-08-10T04:39:03.550965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:03.555768Z","title":"Introducing gpt-5.4.https://openai.com/index/introducing-gpt-5-4/, March","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.555768Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:e55b6727e982b8004820703291344fa2be8291f61c74d4d325559ae975f476f0","observation_id":"26ec706c-2bf8-4b48-8181-2fbbf363f3cb","resolution":{"observed_at":"2026-08-10T04:39:03.555768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.507739Z","title":"Deepseek-v4: Towards highly efficient million-token context intelligence","venue":null,"work_id":"593c00e0-2dff-4057-8a31-29461bfeea8b","year":2026},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.564690Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:58589cc829e98e6d6d252148f38de26f770a2590074f258147d1aad17256a257","observation_id":"71e73ab9-e116-4aed-86a6-0400ae6b77c6","resolution":{"observed_at":"2026-08-10T04:39:04.512901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.491215Z","title":"Introducing gpt-oss.https://openai.com/index/introducing-gpt-oss/, 2025","venue":null,"work_id":"e86a663a-f685-4f8a-b4c6-7c047f479160","year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.569100Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:81cfc95e07e853145e47a115ab4ea1c31c9678f53a5e95cf5e4674c0cdeef888","observation_id":"8c37b627-0242-4fa6-a6dc-129a9b438cbd","resolution":{"observed_at":"2026-08-10T04:39:04.496607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.475835Z","title":"Qwen3-coder-30b-a3b-instruct.https://huggingface.co/Qwen/ Qwen3-Coder-30B-A3B-Instruct, 2025","venue":null,"work_id":"d16dd485-05e6-4656-af50-7934a421aa17","year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.573317Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:4c50c5604c3b4ac9cc8c9da557e0b7e96a510bb4c18f9723f147dbd712023c58","observation_id":"6402fc39-cc60-48fe-9bb9-27fbc343b7b8","resolution":{"observed_at":"2026-08-10T04:39:04.480535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-10T04:39:03.577579Z","title":"Qwen3 technical report.arXiv preprint arXiv:2505.09388, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.577579Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:306e617be4a7466b218e9de0606ae1f8867b824bd97328b1589b3f68f0ec5991","observation_id":"df0caddc-0ea6-49f8-8c9c-80b35a7704a1","resolution":{"observed_at":"2026-08-10T04:39:03.577579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:03.582193Z","title":"Scaling generalist data- analytic agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.582193Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:a9d786b6ac356380dbd42fafd7175779b2356b0c516e70a8a924be1061965c4e","observation_id":"38312006-f686-462e-ae24-0e77b00ab9de","resolution":{"observed_at":"2026-08-10T04:39:03.582193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.460895Z","title":"Accessed: 2026-05-06","venue":null,"work_id":"0f318399-8f59-45a3-9ed0-f14257f01721","year":2026},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.586686Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:236b33c1286226bdcec3e93dcc3b95fdf6b920572a961d23ee91414d1095f97c","observation_id":"c8b03bf1-d1ee-4461-a21f-d5d7b661b266","resolution":{"observed_at":"2026-08-10T04:39:04.465596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17651","last_updated":"2023-05-25T19:13:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-30T18:30:01Z","title":"Self-Refine: Iterative Refinement with Self-Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17651","snapshot_observed_at":"2026-08-10T04:39:03.591340Z","title":"Self-refine: Iterative refinement with self-feedback, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.591340Z"},"links":{"cited_paper":"/paper/2303.17651","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:a524ca8446313564714d2eda39514a18e79d81d82723cc0d35d10032d3a30cd7","observation_id":"e7de4fcd-e169-406b-91ea-3254483e4b57","resolution":{"observed_at":"2026-08-10T04:39:03.591340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.445605Z","title":"Reflexion: Language agents with verbal reinforcement learning.Advances in neural informa- tion processing systems, 36:8634–8652, 2023","venue":null,"work_id":"a2097fe3-32b4-4a9c-9271-6ee7fc7d1472","year":2023},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.596337Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:8e49c65ce460a6fceab51925fae9711a1ed33275c465ff4d5825e164ed017cde","observation_id":"c44e2879-0050-436a-96b8-0081c40c9409","resolution":{"observed_at":"2026-08-10T04:39:04.450651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-08-11T16:01:36.938012Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-10T04:39:03.600566Z","title":"Voyager: An open-ended embodied agent with large language models.arXiv preprint arXiv:2305.16291, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.600566Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:673010c5927900a19ab64b5d3037f5276b8164d2a3588738b21b78623f6dc731","observation_id":"d7ab10fe-dee9-4e4b-be02-276bb43b150b","resolution":{"observed_at":"2026-08-10T04:39:03.600566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.429693Z","title":"Swe-agent: Agent-computer interfaces enable automated soft- ware engineering.Advances in Neural Information Processing Systems, 37:50528–50652, 2024","venue":null,"work_id":"ea6f5e4d-1bc6-4060-bc81-dbbfee3cd07b","year":2024},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.605328Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:2ccf70e330094e36445204bac4bc6ddda7193ab419300916d19b124026dc99cc","observation_id":"c65ef131-db0a-42f3-ae75-2e46db8a5d69","resolution":{"observed_at":"2026-08-10T04:39:04.434898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-10T04:39:03.609725Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.609725Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:4c439097570de751e8b5b685db63e4d5d9338bb161832d3a5431ed37bf646de5","observation_id":"000e14c4-7303-4d23-bcd9-1596e22aecd7","resolution":{"observed_at":"2026-08-10T04:39:03.609725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:03.614383Z","title":"Training language models to follow instructions with human feedback.Advances in neural information processing systems, 35:27730–27744, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.614383Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:501708b7767aa97080ed649975bcaefc9d898f2973804a4a3d0bc7671e682135","observation_id":"c488ede0-f512-4ae6-9050-0a36aa648941","resolution":{"observed_at":"2026-08-10T04:39:03.614383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:03.618872Z","title":"Direct preference optimization: Your language model is secretly a reward model.Advances in neural information processing systems, 36:53728–53741, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.618872Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:486ecf8215964158a87e61f6330cbe8c80a14e9eab14365fb0fff71447a163c9","observation_id":"aaa26ca6-40be-4162-acf0-908c80fce4d3","resolution":{"observed_at":"2026-08-10T04:39:03.618872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-10T04:39:03.623408Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models.arXiv preprint arXiv:2402.03300, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.623408Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:e04df77c7bc5fde97e64bf375a3ef09768592fe1b3c7b0987e92004d87f2affa","observation_id":"ba795ca9-c6bf-41fb-af74-c838cfb26782","resolution":{"observed_at":"2026-08-10T04:39:03.623408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-10T04:39:03.628209Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.628209Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:4495552d7ccd7b461b68dc5fdc6841794cca6d802f83ec933b018fdda8faf937","observation_id":"53f52013-4298-4d13-9832-06e4463ba865","resolution":{"observed_at":"2026-08-10T04:39:03.628209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23383","last_updated":"2025-03-30T10:16:25Z","snapshot_observed_at":"2026-08-11T03:04:58.028847Z","submitted_at":"2025-03-30T10:16:25Z","title":"ToRL: Scaling Tool-Integrated RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23383","snapshot_observed_at":"2026-08-10T04:39:03.633077Z","title":"Torl: Scaling tool-integrated rl.arXiv preprint arXiv:2503.23383, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.633077Z"},"links":{"cited_paper":"/paper/2503.23383","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:9eb70596eac36b113976652b260c1a0503751143d77c8879049c637bb8527229","observation_id":"3c61b79c-030c-42a0-88ff-cbac19d0b4fb","resolution":{"observed_at":"2026-08-10T04:39:03.633077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11536","last_updated":"2025-04-17T16:46:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-15T18:10:22Z","title":"ReTool: Reinforcement Learning for Strategic Tool Use in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11536","snapshot_observed_at":"2026-08-10T04:39:03.637815Z","title":"Retool: Reinforcement learning for strategic tool use in llms.arXiv preprint arXiv:2504.11536, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.637815Z"},"links":{"cited_paper":"/paper/2504.11536","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:fb08f949e986127f60dfd896f117acf4c12173626205ee511d4224d5c95f0f1a","observation_id":"e6ce7ab3-ca53-44a0-960d-951f42109cd4","resolution":{"observed_at":"2026-08-10T04:39:03.637815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13958","last_updated":"2025-04-16T21:45:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-16T21:45:32Z","title":"ToolRL: Reward is All Tool Learning Needs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13958","snapshot_observed_at":"2026-08-10T04:39:03.642514Z","title":"Toolrl: Reward is all tool learning needs.arXiv preprint arXiv:2504.13958, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.642514Z"},"links":{"cited_paper":"/paper/2504.13958","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:a042c71f881099c0e41f0db9c9b4ae198f7aa6f5e67c568303d71013ef8f0ecf","observation_id":"3a6b4ba9-845b-4056-be59-28eb4a5da243","resolution":{"observed_at":"2026-08-10T04:39:03.642514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11425","last_updated":"2025-06-20T23:32:06Z","snapshot_observed_at":"2026-08-10T01:18:20.076393Z","submitted_at":"2025-06-13T02:46:53Z","title":"Agent-RLVR: Training Software Engineering Agents via Guidance and Environment Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11425","snapshot_observed_at":"2026-08-10T04:39:03.647525Z","title":"Agent- rlvr: Training software engineering agents via guidance and environment rewards.arXiv preprint arXiv:2506.11425, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.647525Z"},"links":{"cited_paper":"/paper/2506.11425","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:b35993acacb260c044186d13b5f8d343221a623a06e220dd39d0441bda50f668","observation_id":"ca4ee6f6-5d92-472b-95e6-2c5810b604f1","resolution":{"observed_at":"2026-08-10T04:39:03.647525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.394957Z","title":"Effects of cognitive behavioral therapy and cash transfers on older persons living alone in india: a randomized trial.Annals of internal medicine, 176(5):632–641, 2023","venue":null,"work_id":"d8df34d3-d964-4034-8f1e-e7694973ef35","year":2023},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.652822Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:40071331fede8a57cc625e0c9dccc870f72d3d156fefedf7c6d0f6341ff5ca94","observation_id":"65e2fbaa-1e39-42b7-8721-101cae37630c","resolution":{"observed_at":"2026-08-10T04:39:04.399794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.379725Z","title":"Genomic characterization of metastatic patterns from prospective clinical sequenc- ing of 25,000 patients.Cell, 185(3):563–575, 2022","venue":null,"work_id":"3de8aec1-8a72-4911-bc3f-413c2e6fc5ae","year":2022},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.657534Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:5ee1e5599b56dd63dda678a378997495515c401b2effa40e71ecb7b794b5f5e6","observation_id":"5b30023b-5725-4082-80ba-ac74832d7b4f","resolution":{"observed_at":"2026-08-10T04:39:04.384842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.364517Z","title":"The support prognostic model: Objective estimates of survival for seriously ill hospitalized adults.Annals of internal medicine, 122(3):191–203, 1995","venue":null,"work_id":"785e5ebd-e657-4609-b73e-9565bd601aec","year":1995},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.662098Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:4aba5ebb16b3dec1a9fe40f380e99e57d8d30b39e4439ae5efe80b213436ce29","observation_id":"5254a881-e8a1-488e-9cd5-2826d602f635","resolution":{"observed_at":"2026-08-10T04:39:04.369442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13372","last_updated":"2024-06-27T22:44:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-20T08:08:54Z","title":"LlamaFactory: Unified Efficient Fine-Tuning of 100+ Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13372","snapshot_observed_at":"2026-08-10T04:39:03.667845Z","title":"Llamafactory: Unified efficient fine-tuning of 100+ language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.667845Z"},"links":{"cited_paper":"/paper/2403.13372","citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:a50bc09f2f88b1eb67b271ea04239822db96f831c3bfe5e24550319562314ec9","observation_id":"f15cf1cd-b341-43da-b393-5e0ccc2186a6","resolution":{"observed_at":"2026-08-10T04:39:03.667845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.348350Z","title":"claim”: “drug improves patient outcome","venue":null,"work_id":"47df8088-c380-4fca-8730-57c147441231","year":2023},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.672908Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:fa5acc1b5ed20f0de09abb1cff07fec488e80106e6f853820ef9c745aaefc257","observation_id":"8c18f6e8-df20-41d5-b0d1-6c30635501c6","resolution":{"observed_at":"2026-08-10T04:39:04.353710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.332181Z","title":null,"venue":null,"work_id":"dc247a35-8e12-45e4-88c5-dc3e5c6bcddc","year":null},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.678589Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:bd1220a8de019bf66476b78115407d0cc11b3828d0d0a836d99afc16edc8b943","observation_id":"adbe0b92-7e51-427f-8525-b05ec970620f","resolution":{"observed_at":"2026-08-10T04:39:04.336736Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.317398Z","title":null,"venue":null,"work_id":"19358603-bf3e-4a28-9937-6b397ba6dd5b","year":null},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.683802Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:a999c418ab65177289d162286cefa5a02566bfb4b96c667680af79cf5f57623f","observation_id":"ddf3d3cd-3bf0-42c1-b65d-4b12483816bc","resolution":{"observed_at":"2026-08-10T04:39:04.322049Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.301738Z","title":null,"venue":null,"work_id":"f09b6cea-0284-4007-b11f-bc20fe63c508","year":null},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.688424Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:1d7ddfcd4069e4dc4f43d411736049c63d5e8cd39036945d7c32d7dfe93f7af0","observation_id":"93bd0286-2b0f-47e0-8e6b-13789a89d806","resolution":{"observed_at":"2026-08-10T04:39:04.306832Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:04.285042Z","title":null,"venue":null,"work_id":"3399728e-7f1a-43b8-b627-00783188269f","year":null},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.692877Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:dce88e7ddd339f1f978bfb9152c60195c2c4d164907171e6d6a26330d68d5fb1","observation_id":"507ce3fc-5327-40f6-b266-2abf02d2f7e1","resolution":{"observed_at":"2026-08-10T04:39:04.290784Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:39:03.560376Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-10T04:39:03.560376Z"},"links":{"citing_paper":"/paper/2608.07437"},"observation_digest":"sha256:2dfcb7da3a038bca80a1e45f2dac0b9fb7a47682a1fa0f86bf1906b0f59385de","observation_id":"163b0ec8-d481-4081-8989-a5e184270d91","resolution":{"observed_at":"2026-08-10T04:39:03.560376Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.07437","last_updated":"2026-08-07T17:22:00Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-12T07:12:06.318886Z","submitted_at":"2026-08-07T17:22:00Z","title":"Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing"},"reference_resolution":{"displayed":61,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":39,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":61},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 0 inbound Pith citation observations for arXiv:2608.07437."}