{"as_of":"2026-08-11T07:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ca0d7e06100688b813533f0ef038872e2cff26d249c659e5074333d85167639d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T04:22:52.006834Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T06:43:10.331084Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.06331","last_updated":"2024-07-03T10:13:56Z","snapshot_observed_at":"2026-08-08T03:10:08.397194Z","submitted_at":"2024-06-10T14:47:04Z","title":"MedExQA: Medical Question Answering Benchmark with Multiple Explanations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06331","snapshot_observed_at":"2026-08-11T04:22:52.006834Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18947","last_updated":"2025-03-28T23:37:45Z","snapshot_observed_at":"2026-08-11T04:16:30.346604Z","submitted_at":"2024-12-25T16:51:29Z","title":"MedHallBench: A New Benchmark for Assessing Hallucination in Medical Large Language Models","version":4},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T04:22:52.006834Z"},"links":{"cited_paper":"/paper/2406.06331","citing_paper":"/paper/2412.18947"},"observation_digest":"sha256:7e78301ddae6e493ce29137bc4bc814a784fb77951ed2e4b578f525c042e09cb","observation_id":"009a210e-faa4-4f71-b2de-e818d5809a10","resolution":{"observed_at":"2026-08-11T04:22:52.006834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06331","last_updated":"2024-07-03T10:13:56Z","snapshot_observed_at":"2026-08-08T03:10:08.397194Z","submitted_at":"2024-06-10T14:47:04Z","title":"MedExQA: Medical Question Answering Benchmark with Multiple Explanations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06331","snapshot_observed_at":"2026-08-07T14:39:46.910566Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:46.910566Z"},"links":{"cited_paper":"/paper/2406.06331","citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:be3476159fa00c135c187fa96c260b9c1a242bef9b55245382075b37b2cd86df","observation_id":"8331722b-b271-4f08-baaf-bc7ae2e6c368","resolution":{"observed_at":"2026-08-07T14:39:46.910566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06331","last_updated":"2024-07-03T10:13:56Z","snapshot_observed_at":"2026-08-08T03:10:08.397194Z","submitted_at":"2024-06-10T14:47:04Z","title":"MedExQA: Medical Question Answering Benchmark with Multiple Explanations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06331","snapshot_observed_at":"2026-08-07T13:33:40.204720Z","title":"MedExQA: Medical question answering benchmark with multiple explanations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21503","last_updated":"2025-05-27T17:59:50Z","snapshot_observed_at":"2026-08-09T10:47:12.114164Z","submitted_at":"2025-05-27T17:59:50Z","title":"Silence is Not Consensus: Disrupting Agreement Bias in Multi-Agent LLMs via Catfish Agent for Clinical Decision Making","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:33:40.204720Z"},"links":{"cited_paper":"/paper/2406.06331","citing_paper":"/paper/2505.21503"},"observation_digest":"sha256:db19da676fd4ebce974c3fcdb851d04ffd2b792b1f04641f08145451362b1055","observation_id":"840a9aee-0103-4034-9cc7-08e2094eff3c","resolution":{"observed_at":"2026-08-07T13:33:40.204720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06331","last_updated":"2024-07-03T10:13:56Z","snapshot_observed_at":"2026-08-08T03:10:08.397194Z","submitted_at":"2024-06-10T14:47:04Z","title":"MedExQA: Medical Question Answering Benchmark with Multiple Explanations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06331","snapshot_observed_at":"2026-08-07T13:15:58.263719Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:58.263719Z"},"links":{"cited_paper":"/paper/2406.06331","citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:5cd3eff5b133567f7bb2dce7f2f9b54d66aca04804a1e5f78cf98eaa4597d49a","observation_id":"9f3f7833-6bc2-49ff-96b8-04d12c84cac7","resolution":{"observed_at":"2026-08-07T13:15:58.263719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06331","last_updated":"2024-07-03T10:13:56Z","snapshot_observed_at":"2026-08-08T03:10:08.397194Z","submitted_at":"2024-06-10T14:47:04Z","title":"MedExQA: Medical Question Answering Benchmark with Multiple Explanations","version":2},"cited_work":{"arxiv_id":"2406.06331","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06331","snapshot_observed_at":"2026-06-29T06:43:10.331084Z","title":"arXiv preprint arXiv:2406.06331 , year=","venue":null,"work_id":"db5d3e5c-770e-4a4d-bfec-66f1c610e331","year":2024},"citing_paper":{"arxiv_id":"2604.20263","last_updated":"2026-04-22T07:10:45Z","snapshot_observed_at":"2026-08-02T22:57:04.207646Z","submitted_at":"2026-04-22T07:10:45Z","title":"AROMA: Augmented Reasoning Over a Multimodal Architecture for Virtual Cell Genetic Perturbation Modeling","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-05-09T23:07:51.076618Z"},"links":{"cited_paper":"/paper/2406.06331","citing_paper":"/paper/2604.20263"},"observation_digest":"sha256:afb249f11ec0e5015213f8e0cb40e512a4071d56b34301d612ea3e1e06089196","observation_id":"f4206f00-7e82-4c72-bd38-a53bb995c248","resolution":{"observed_at":"2026-05-09T23:09:26.744295Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06331","last_updated":"2024-07-03T10:13:56Z","snapshot_observed_at":"2026-08-08T03:10:08.397194Z","submitted_at":"2024-06-10T14:47:04Z","title":"MedExQA: Medical Question Answering Benchmark with Multiple Explanations","version":2},"cited_work":{"arxiv_id":"2406.06331","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06331","snapshot_observed_at":"2026-06-29T06:43:10.331084Z","title":"arXiv preprint arXiv:2406.06331 , year=","venue":null,"work_id":"db5d3e5c-770e-4a4d-bfec-66f1c610e331","year":2024},"citing_paper":{"arxiv_id":"2605.18111","last_updated":"2026-05-18T09:20:32Z","snapshot_observed_at":"2026-08-01T02:32:00.542289Z","submitted_at":"2026-05-18T09:20:32Z","title":"How Good LLMs Are at Answering Bangla Medical Visual Questions? Dataset and Benchmarking","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-20T10:59:27.010954Z"},"links":{"cited_paper":"/paper/2406.06331","citing_paper":"/paper/2605.18111"},"observation_digest":"sha256:aa26f50ce501131ade1634c43751fd9e44d3379c49704dd34dcb33086c853abc","observation_id":"ff65055c-2306-4b75-8859-507df4433507","resolution":{"observed_at":"2026-05-20T11:03:13.841217Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06331","last_updated":"2024-07-03T10:13:56Z","snapshot_observed_at":"2026-08-08T03:10:08.397194Z","submitted_at":"2024-06-10T14:47:04Z","title":"MedExQA: Medical Question Answering Benchmark with Multiple Explanations","version":2},"cited_work":{"arxiv_id":"2406.06331","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06331","snapshot_observed_at":"2026-06-29T06:43:10.331084Z","title":"arXiv preprint arXiv:2406.06331 , year=","venue":null,"work_id":"db5d3e5c-770e-4a4d-bfec-66f1c610e331","year":2024},"citing_paper":{"arxiv_id":"2605.30637","last_updated":"2026-05-28T22:38:26Z","snapshot_observed_at":"2026-07-06T23:39:53.132531Z","submitted_at":"2026-05-28T22:38:26Z","title":"EHRBench: An Automated and Reliable EHR-based Benchmark for Clinical Decision Making with LLMs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-29T06:41:06.828814Z"},"links":{"cited_paper":"/paper/2406.06331","citing_paper":"/paper/2605.30637"},"observation_digest":"sha256:07e035bc03240a21311196a3984fd9bb32b3e0c783101c5c6c4a3c7146aba7f3","observation_id":"665b1604-7557-4c46-a161-b421f6d7707c","resolution":{"observed_at":"2026-06-29T06:43:10.332403Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06331","last_updated":"2024-07-03T10:13:56Z","snapshot_observed_at":"2026-08-08T03:10:08.397194Z","submitted_at":"2024-06-10T14:47:04Z","title":"MedExQA: Medical Question Answering Benchmark with Multiple Explanations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06331","snapshot_observed_at":"2026-07-12T00:24:45.348343Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03720","last_updated":"2026-07-04T05:53:57Z","snapshot_observed_at":"2026-08-07T00:07:33.934853Z","submitted_at":"2026-07-04T05:53:57Z","title":"Between Knowledge and Care: A Mixed-Methods Evaluation of Generative AI for T2DM Self-Management from Patient and Physician Perspectives","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-12T00:24:45.348343Z"},"links":{"cited_paper":"/paper/2406.06331","citing_paper":"/paper/2607.03720"},"observation_digest":"sha256:eb9b9ccc1b226bc64469f16136a6b441d278916337dd75fb4f4f806b569f6618","observation_id":"b1948ae0-5462-4dc6-ab3c-328015b895d2","resolution":{"observed_at":"2026-07-12T00:24:45.348343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.06331/citation-record","integrity":"/paper/2406.06331/integrity","json":"/paper/2406.06331/citation-record.json","paper":"/paper/2406.06331"},"outbound":[],"paper":{"arxiv_id":"2406.06331","last_updated":"2024-07-03T10:13:56Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T03:10:08.397194Z","submitted_at":"2024-06-10T14:47:04Z","title":"MedExQA: Medical Question Answering Benchmark with Multiple Explanations"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2406.06331."}