{"as_of":"2026-08-15T06:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9333f766e46d73d36c8cf0eb6cbe32be8112b79e8406d2f668dc137a83e4980c","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T03:54:11.805387Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T04:18:05.046139Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-11T04:18:05.490656Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-14T12:46:48.254424Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"cited_work":{"arxiv_id":"2607.09322","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.09322","snapshot_observed_at":"2026-08-11T04:18:05.490656Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","venue":"cs.AI","work_id":"c51bd84b-17ba-46d6-9723-ecfb96556bf7","year":2026},"citing_paper":{"arxiv_id":"2608.07796","last_updated":"2026-08-07T22:39:13Z","snapshot_observed_at":"2026-08-14T10:36:41.368811Z","submitted_at":"2026-08-07T22:39:13Z","title":"CliniCARE-Bench: Clinical Calibrated Audit of Medical Reasoning in EHR","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T04:18:05.046139Z"},"links":{"cited_paper":"/paper/2607.09322","citing_paper":"/paper/2608.07796"},"observation_digest":"sha256:d8de4dec7959032123453c71a1c041405b393aa23f1b3e9d5cf8e02948fe8c81","observation_id":"6b953d02-81ef-47eb-b079-2255cc91aa7c","resolution":{"observed_at":"2026-08-11T04:18:05.497141Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2607.09322/citation-record","integrity":"/paper/2607.09322/integrity","json":"/paper/2607.09322/citation-record.json","paper":"/paper/2607.09322"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.19413","last_updated":"2025-04-28T01:46:35Z","snapshot_observed_at":"2026-08-14T23:23:31.683130Z","submitted_at":"2025-04-28T01:46:35Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19413","snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"arXiv preprint arXiv:2504.19413 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-14T12:46:48.254424Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"cited_paper":"/paper/2504.19413","citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:8b355e8c29e96b5275538536a2ec6b9f62626418e28c3bfec417715dab8e1b10","observation_id":"c2dc38c9-bdc1-4e7b-8961-534e6ede89a9","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-14T12:46:48.254424Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:0ac5643b352767a17b3607602527d32e87fc05fdb737dda0190af32e02d728b2","observation_id":"28d8a0e3-5c05-4c54-9ba4-d1888d6d36a7","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-14T12:46:48.254424Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:0d07b3d04c00e8c2023b1ad0ceb91ebea2e4643e62bbfefa2509e85ecf7aa12c","observation_id":"9b1a0c8c-5a39-4331-aa4d-3e96d3ba3be8","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"Journal of medical Internet research 27, e84120 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-14T12:46:48.254424Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:b07afdafb86b5f42b586fc803bebd33588106ff2a16ad007fb13f8cad228b101","observation_id":"71f76bde-a72e-49e4-8407-3fab2c8dcce8","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-08-14T09:25:42.723726Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06654","snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-14T12:46:48.254424Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"cited_paper":"/paper/2404.06654","citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:835de3919c0a2710dc7288f46815c6070b4200f6029c0e0bf5fc95d04c11865e","observation_id":"0bf90271-06f2-4de6-b820-f1e188789564","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"NEJM AI p","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-14T12:46:48.254424Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:fb39607add31794d2ef4974123ffe1c6f88f194a2aed362524a936ccb27db52c","observation_id":"f0f38a46-759d-4f96-8a0b-d64f15ac5029","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"PhysioNet (Oct 2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-14T12:46:48.254424Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:42ae593090f844f9072ae44ec531d6f67a54370fd3096846f2373978c0a5697a","observation_id":"82dda204-1e89-4c0c-b6a7-cf6f494e0323","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.07040","last_updated":"2017-12-19T16:48:05Z","snapshot_observed_at":"2026-08-14T20:02:05.578419Z","submitted_at":"2017-12-19T16:48:05Z","title":"The NarrativeQA Reading Comprehension Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.07040","snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-14T12:46:48.254424Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"cited_paper":"/paper/1712.07040","citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:064288d7c0b96bd7306ded1724de73523e2b51b0dc3330c876c940a59d760287","observation_id":"9b5a0c37-3660-428a-87d4-636e8b001b28","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"Advances in Neural Information Processing Systems 35, 15589–15601 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-14T12:46:48.254424Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:168f3c649d922de60a486be77d7920ffef9c1109ef10f8c65e165704b1ff6dce","observation_id":"7d106ae4-3c01-43c2-b565-11a61e6529d8","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17657","last_updated":"2025-06-16T06:25:31Z","snapshot_observed_at":"2026-08-12T22:16:56.885270Z","submitted_at":"2024-10-23T08:19:18Z","title":"ReflecTool: Towards Reflection-Aware Tool-Augmented Clinical Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17657","snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-14T12:46:48.254424Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"cited_paper":"/paper/2410.17657","citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:95084428688edbbf25015ee44aac4596b36d1c6ed3792a4a87bae41dce4530cb","observation_id":"ccbd14d6-5ced-4988-890d-f5e5a86af649","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03172","last_updated":"2023-11-20T23:09:34Z","snapshot_observed_at":"2026-07-06T15:51:12.179086Z","submitted_at":"2023-07-06T17:54:11Z","title":"Lost in the Middle: How Language Models Use Long Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03172","snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"Xu et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-14T12:46:48.254424Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"cited_paper":"/paper/2307.03172","citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:2ca2524a4d889698d8537e1c779f5b9d444eead8b6dc455a2aec88298ce6f308","observation_id":"12c92b9d-138e-4f9e-989f-b1932c4b5d59","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17753","last_updated":"2024-02-27T18:42:31Z","snapshot_observed_at":"2026-08-13T02:36:36.245972Z","submitted_at":"2024-02-27T18:42:31Z","title":"Evaluating Very Long-Term Conversational Memory of LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17753","snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"arXiv preprint arXiv:2402.17753 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-14T12:46:48.254424Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"cited_paper":"/paper/2402.17753","citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:5ef976e8cba1c2c4c46790fc1ec16553e4797a2f8a312b228aa8c25ed0b3a7bd","observation_id":"ab4aa5d5-7d36-45c2-98df-64383f0f16bf","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"https://developers.openai.com/api/docs/models/gpt- 5-mini (2026), accessed 22 Feb 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-14T12:46:48.254424Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:6b95ef498373f03957787c9af84720c299ddf35e6f495a2c76eadef93d2121ae","observation_id":"faaa1bf4-56e8-4a62-a837-9eafcb49ecec","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"https://developers.openai.com/api/docs/models/text- embedding-3-small (2026), accessed 22 Feb 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-14T12:46:48.254424Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:bd174fe5e90d60beea8a910d78abc08897d3b46c1abb77d6ea72c7b6e1b4cd96","observation_id":"70e9150b-08d4-491c-b4dd-941c922a4ddb","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-14T12:46:48.254424Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:994bce3503dc05443816d1b039b65c5a21127c4d5a0913e1a89eb06c7d75ae51","observation_id":"d8dcca31-e913-427f-ab89-399fad0e1c7f","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"https://qwen.ai/blog?id=qwen3 (2024), accessed: 22 Feb 2026","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-14T12:46:48.254424Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:9ea1092eff8e668e06d9c9dd8e2a955f417d1b4634fea21021c48b5b1150e910","observation_id":"936a5c28-b295-4068-b876-b2adf1a71291","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07960","last_updated":"2025-05-25T02:19:37Z","snapshot_observed_at":"2026-07-30T08:34:47.046912Z","submitted_at":"2024-05-13T17:38:53Z","title":"AgentClinic: a multimodal agent benchmark to evaluate AI in simulated clinical environments","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07960","snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-14T12:46:48.254424Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"cited_paper":"/paper/2405.07960","citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:c76f9d962945dc18e386280069967705145b9adb1792d71907d64315374237b0","observation_id":"dc345ca6-188b-488c-81de-58a74508ceb7","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-14T12:46:48.254424Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:d8d865ee5ae7dbef65becabda8411e9a18abb4924f7d7a411ae22e1563169e12","observation_id":"570233fe-6d1d-48d5-94fb-843e3950cecf","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10813","last_updated":"2025-03-04T22:19:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-14T17:59:44Z","title":"LongMemEval: Benchmarking Chat Assistants on Long-Term Interactive Memory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10813","snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"https://arxiv.org/abs/2410.10813 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-14T12:46:48.254424Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"cited_paper":"/paper/2410.10813","citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:c74ca624a7b713a0d3c945fa5c58168d7b5799a3732218bdc27b5f328b5d72a4","observation_id":"feaafc4f-d5aa-46e7-a84b-b8207ae98d3f","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"In: Conference on Empirical Methods in Natural Language Processing (EMNLP) (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-14T12:46:48.254424Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:a80316f7856ae2c251378d754981b3a223f4826b8f374d330229bf4338e90702","observation_id":"0777cc87-ae87-4d29-bf74-8ca3aa481b63","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-14T12:46:48.254424Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 1 inbound Pith citation observation for arXiv:2607.09322."}