{"as_of":"2026-08-18T00:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1a63572f773356f96fa8ad0d7b1be22ff0651af85bdb280dcde5eac2550c9dd7","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:39:42.506184Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:21:13.443456Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T23:21:14.448985Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"cited_work":{"arxiv_id":"2506.11114","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.11114","snapshot_observed_at":"2026-08-15T23:21:14.448985Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","venue":"cs.CL","work_id":"d24f1011-eabb-400e-8987-f7cf6d91c0d4","year":2025},"citing_paper":{"arxiv_id":"2505.04921","last_updated":"2025-07-06T14:40:27Z","snapshot_observed_at":"2026-08-15T23:15:46.193892Z","submitted_at":"2025-05-08T03:35:23Z","title":"Perception, Reason, Think, and Plan: A Survey on Large Multimodal Reasoning Models","version":2},"reference_index":292,"source":"arxiv_source","source_observed_at":"2026-08-15T23:21:13.443456Z"},"links":{"cited_paper":"/paper/2506.11114","citing_paper":"/paper/2505.04921"},"observation_digest":"sha256:6d2825edbf0b071e9fce0d83cbe828e3c92957a7b2b2dd5060d7d6184f8c0b4d","observation_id":"be2dbc15-0c43-4ea1-85ab-a6312380732f","resolution":{"observed_at":"2026-08-15T23:21:14.454515Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.11114/citation-record","integrity":"/paper/2506.11114/integrity","json":"/paper/2506.11114/citation-record.json","paper":"/paper/2506.11114"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:45.350284Z","title":null,"venue":null,"work_id":"c8352d96-a58f-4154-83c6-2cef43682a77","year":2025},"citing_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:40.369014Z"},"links":{"citing_paper":"/paper/2506.11114"},"observation_digest":"sha256:7edd180cdaf352e9b0dc75a5f744f255dca88c2bf3b8b07caad75fab44820dc3","observation_id":"060c174e-c991-4b8e-87d0-2019120b2618","resolution":{"observed_at":"2026-08-07T05:39:45.354572Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:45.334931Z","title":"Computer software (2024),https://acrobat","venue":null,"work_id":"300819a9-764a-4856-929f-7ba675d6143a","year":2024},"citing_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:40.467025Z"},"links":{"citing_paper":"/paper/2506.11114"},"observation_digest":"sha256:6d77379fbeb242affb5f6b2b1dafc360d0c73bc5b8bccaa78a761da8f26379a7","observation_id":"27856649-cae8-4e56-911f-f832df18cab1","resolution":{"observed_at":"2026-08-07T05:39:45.340053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:45.319431Z","title":"Clinical Anatomy38(2), 186–199 (2025)","venue":null,"work_id":"c2446fb9-75af-43c0-a16e-5ec80bd1eeef","year":2025},"citing_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:40.638781Z"},"links":{"citing_paper":"/paper/2506.11114"},"observation_digest":"sha256:ddebd2df70f2bc33d928e9ba937a7a91ccc7e5be3aeb85afecf8dd3bfb281411","observation_id":"96fda058-952c-40bf-8a73-30b661501932","resolution":{"observed_at":"2026-08-07T05:39:45.323735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:45.303065Z","title":null,"venue":null,"work_id":"546cf536-2f1a-463e-a685-f303bb31462b","year":2025},"citing_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:40.809202Z"},"links":{"citing_paper":"/paper/2506.11114"},"observation_digest":"sha256:6d620ca5decfd9e17270cf87a9836673db9b9c25facc0c7ea48c80c8ace433c0","observation_id":"3795bcb1-f27c-41a8-91e8-033cfa954105","resolution":{"observed_at":"2026-08-07T05:39:45.307733Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:45.239603Z","title":"ishiyaku-dental.jp/, accessed: 2025-06-05","venue":null,"work_id":"6d9e0ade-810c-4193-9c54-9b6eb15013bd","year":2025},"citing_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:41.025291Z"},"links":{"citing_paper":"/paper/2506.11114"},"observation_digest":"sha256:6fdf6852e38c021225eb5aaa22acce5229ae4f332dfc6907cbbf1c02c5711a89","observation_id":"b5464ab6-122e-485f-b741-99726d5abbfe","resolution":{"observed_at":"2026-08-07T05:39:45.292741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:44.977132Z","title":null,"venue":null,"work_id":"7f9188c1-c5d1-47a6-bc3b-7ce4b06947b7","year":2025},"citing_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:41.204662Z"},"links":{"citing_paper":"/paper/2506.11114"},"observation_digest":"sha256:d46721cb7fca3d10403a7e9ad2840ad44887ca8f1b36cc2ec5584997c49ae93c","observation_id":"464a702b-addd-466d-9fb8-246070c98a74","resolution":{"observed_at":"2026-08-07T05:39:45.088649Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:44.698933Z","title":"mynavi.jp/conts/kokushi_kouryaku/, accessed: 2025-06-05 KokushiMD-10 9","venue":null,"work_id":"b25ed07f-e590-4ad2-b7ba-f391a1e03538","year":2025},"citing_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:41.344767Z"},"links":{"citing_paper":"/paper/2506.11114"},"observation_digest":"sha256:4f5946c5b262bb827220b6fe951071c10293ec0775bb4ccff59d52d387f02967","observation_id":"94858ee3-b033-4a99-ad26-05bfe244faa4","resolution":{"observed_at":"2026-08-07T05:39:44.891693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:41.416728Z","title":"Applied Sciences11(14), 6421 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:41.416728Z"},"links":{"citing_paper":"/paper/2506.11114"},"observation_digest":"sha256:a402622c055e299a59314188a15fa96c0286a2bb7a143149949288f756be8f63","observation_id":"9b2af865-a51f-4637-9c95-60be196d77d3","resolution":{"observed_at":"2026-08-07T05:39:41.416728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18027","last_updated":"2023-04-05T07:53:37Z","snapshot_observed_at":"2026-08-16T15:43:46.612932Z","submitted_at":"2023-03-31T13:04:47Z","title":"Evaluating GPT-4 and ChatGPT on Japanese Medical Licensing Examinations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18027","snapshot_observed_at":"2026-08-07T05:39:41.561909Z","title":"arXiv preprint arXiv:2303.18027 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:41.561909Z"},"links":{"cited_paper":"/paper/2303.18027","citing_paper":"/paper/2506.11114"},"observation_digest":"sha256:1ba58e60f519e8eb34ba27c6e5e36cc4357bdfddb76c8851ffde165585ffc3b1","observation_id":"15ea280b-ca5b-4968-bfa2-489e37eabb39","resolution":{"observed_at":"2026-08-07T05:39:41.561909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:44.373853Z","title":"Advances in Neural Information Processing Systems 36, 52430–52452 (2023)","venue":null,"work_id":"e46fdc3c-9d96-4821-a688-63137913e717","year":2023},"citing_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:41.728068Z"},"links":{"citing_paper":"/paper/2506.11114"},"observation_digest":"sha256:a79f1cc293a5e81736609fd2df20b2cefd75262dbe5effd7b10fb6c96c81e85e","observation_id":"6eb9a93d-b5df-4203-8c67-3eb414012bdd","resolution":{"observed_at":"2026-08-07T05:39:44.516979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:44.164129Z","title":null,"venue":null,"work_id":"62f811e2-d4c8-4359-9223-7cddef9bf312","year":2025},"citing_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:41.844522Z"},"links":{"citing_paper":"/paper/2506.11114"},"observation_digest":"sha256:1cf9f218e4e49dd3571693d4e5bce7df2727f968a593c4b5cd2a9a6f48521aa4","observation_id":"25469ee5-777c-4eff-81d7-19685c55b6de","resolution":{"observed_at":"2026-08-07T05:39:44.269056Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:43.897189Z","title":"html, accessed 2025-06-07","venue":null,"work_id":"8a64cf65-d717-4ada-a019-49b9bdeeacd6","year":2025},"citing_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:41.879923Z"},"links":{"citing_paper":"/paper/2506.11114"},"observation_digest":"sha256:303c8c62bfb96e12c66b715ab31916076e6b3f7d1efb13032e5b9f00dc0c383a","observation_id":"71c0fcb2-ec5c-4f2f-a345-4377efcd3715","resolution":{"observed_at":"2026-08-07T05:39:44.016572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:43.599716Z","title":null,"venue":null,"work_id":"8ea27b4d-50ca-46fd-a7c8-659ed1def76d","year":2024},"citing_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:41.927605Z"},"links":{"citing_paper":"/paper/2506.11114"},"observation_digest":"sha256:9c8bf3108f04f560c29808a1a2fdabb4447a49e2b46938860ebfa30bc82561b1","observation_id":"88b648ca-0929-4668-a34f-202c24122b8a","resolution":{"observed_at":"2026-08-07T05:39:43.756452Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:43.564760Z","title":"JJDEA40, 3–10 (2024)","venue":null,"work_id":"df378c90-496d-4e8d-b018-a72d62bb2054","year":2024},"citing_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:41.989459Z"},"links":{"citing_paper":"/paper/2506.11114"},"observation_digest":"sha256:0d94a660180e72bfb47448edb5b0c57f0c0b490527b06c57577ea3d30c2b1d53","observation_id":"fed79d2e-52f3-4942-8150-f4e0437c148a","resolution":{"observed_at":"2026-08-07T05:39:43.589654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:43.409853Z","title":null,"venue":null,"work_id":"db040cd5-b1f3-478b-9698-0f52daf507f2","year":2025},"citing_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:42.034777Z"},"links":{"citing_paper":"/paper/2506.11114"},"observation_digest":"sha256:fe285c2067cfe9e59c0a95d89eb98143a5921d54b807d778ed56e3dccacba3fe","observation_id":"7494be47-5966-49ea-8042-2d749708eb89","resolution":{"observed_at":"2026-08-07T05:39:43.479864Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:43.257211Z","title":"In: Conference on health, inference, and learning","venue":null,"work_id":"31cda731-2ae6-4782-81d7-b32c9b635fbc","year":2022},"citing_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:42.087521Z"},"links":{"citing_paper":"/paper/2506.11114"},"observation_digest":"sha256:f0f702d681a1a3a4fd5523415fdc6c14dc5047d67f994c7cc7954b503af72a32","observation_id":"13117dba-ec30-4cf4-aeca-4b095e4f3f0c","resolution":{"observed_at":"2026-08-07T05:39:43.328755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:43.112495Z","title":"guppy.jp/, accessed: 2025-06-05","venue":null,"work_id":"63ab0b12-9287-4d88-a969-847647479107","year":2025},"citing_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:42.148285Z"},"links":{"citing_paper":"/paper/2506.11114"},"observation_digest":"sha256:b63f4b22f6ae908de68e05d80fc536a34f85358c72cdba45102e169dfa4f8aff","observation_id":"46ab7c81-32c5-40c9-a13c-d56e4dcf76c1","resolution":{"observed_at":"2026-08-07T05:39:43.154140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:42.193816Z","title":"Bell System Technical Journal27(3), 379–423 (1948)","venue":null,"work_id":null,"year":1948},"citing_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:42.193816Z"},"links":{"citing_paper":"/paper/2506.11114"},"observation_digest":"sha256:73d763d6cc8424af413fa759ec4efbc283a47b3e14f6d33e73e71497b7dc7a8e","observation_id":"79da25e9-5225-4eaa-afb2-ec965edc9699","resolution":{"observed_at":"2026-08-07T05:39:42.193816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:42.968882Z","title":"Scientific Reports14(1), 9330 (2024)","venue":null,"work_id":"d8eafc0f-d28e-4af3-aaf1-853d4871b781","year":2024},"citing_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:42.253208Z"},"links":{"citing_paper":"/paper/2506.11114"},"observation_digest":"sha256:24c42ffb7c99681c638b26f9302c40edb2878cceb467ccfe7808ad3d55ffa5b0","observation_id":"fc12455e-3dac-4895-a750-c48eaca57604","resolution":{"observed_at":"2026-08-07T05:39:43.040530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16661","last_updated":"2025-09-09T13:48:45Z","snapshot_observed_at":"2026-08-08T13:43:21.439277Z","submitted_at":"2025-05-22T13:27:37Z","title":"A Japanese Language Model and Three New Evaluation Benchmarks for Pharmaceutical NLP","version":2},"cited_work":{"arxiv_id":"2505.16661","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.16661","snapshot_observed_at":"2026-08-07T05:39:42.600572Z","title":"A Japanese Language Model and Three New Evaluation Benchmarks for Pharmaceutical NLP","venue":"cs.CL","work_id":"1f98d0d5-a380-4cd3-9ffa-14e21c966d73","year":2025},"citing_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:42.317690Z"},"links":{"cited_paper":"/paper/2505.16661","citing_paper":"/paper/2506.11114"},"observation_digest":"sha256:b22074735990be2ba52d8d3dc9b939a3e094787592edac5fa864a550af8b5ad4","observation_id":"7798c562-97c6-46ae-a591-2a1f0aa362b5","resolution":{"observed_at":"2026-08-07T05:39:42.647730Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:42.830846Z","title":"JMIR medical education9(1), e48002 (2023)","venue":null,"work_id":"3f18367e-b114-4d15-8f8b-ae3c439ecb76","year":2023},"citing_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:42.396218Z"},"links":{"citing_paper":"/paper/2506.11114"},"observation_digest":"sha256:3f6fc7c7826f4d8fd27024630299c25573b4c7e3c44904e5a3172784d8ca3ac3","observation_id":"f3a30e7f-1d35-4b32-93e0-0085db6287a8","resolution":{"observed_at":"2026-08-07T05:39:42.891688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:39:42.725950Z","title":"Advances in Neural Information Processing Systems35, 24824–24837 (2022)","venue":null,"work_id":"ac9e1e54-29ef-407b-b404-21f8df70d519","year":2022},"citing_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:42.448581Z"},"links":{"citing_paper":"/paper/2506.11114"},"observation_digest":"sha256:9ab61065e46b539387d393c7ca5ee28c16982b3f1dff2ad3f64517ea7052a2a8","observation_id":"dceb8435-7d19-409c-bbb2-7283f6464edb","resolution":{"observed_at":"2026-08-07T05:39:42.767195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02900","last_updated":"2025-07-10T08:33:52Z","snapshot_observed_at":"2026-08-16T13:28:19.033963Z","submitted_at":"2024-08-06T02:09:35Z","title":"MedTrinity-25M: A Large-scale Multimodal Dataset with Multigranular Annotations for Medicine","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02900","snapshot_observed_at":"2026-08-07T05:39:42.506184Z","title":"arXiv preprint arXiv:2408.02900 (2024),https: //arxiv.org/abs/2408.02900, accessed 8 Jun 2025","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:39:42.506184Z"},"links":{"cited_paper":"/paper/2408.02900","citing_paper":"/paper/2506.11114"},"observation_digest":"sha256:80691c6317226fa036f612e665ee1461ab329dae0385dbb29a04f9ade0e44369","observation_id":"4c4cdb70-7b00-4997-831d-c99d919ca950","resolution":{"observed_at":"2026-08-07T05:39:42.506184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.11114","last_updated":"2025-06-09T02:26:02Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T17:57:55.173390Z","submitted_at":"2025-06-09T02:26:02Z","title":"KokushiMD-10: Benchmark for Evaluating Large Language Models on Ten Japanese National Healthcare Licensing Examinations"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":12},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 1 inbound Pith citation observation for arXiv:2506.11114."}