{"as_of":"2026-08-12T14:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2acb6d3f47f644ab6b3dfdeee3fb4cd4d48176ace2d4cb80705c241de5428126","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:47:18.089814Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.13790/citation-record","integrity":"/paper/2506.13790/integrity","json":"/paper/2506.13790/citation-record.json","paper":"/paper/2506.13790"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2206.04615","last_updated":"2023-06-12T17:51:15Z","snapshot_observed_at":"2026-07-06T13:19:12.109592Z","submitted_at":"2022-06-09T17:05:34Z","title":"Beyond the Imitation Game: Quantifying and extrapolating the capabilities of language models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04615","snapshot_observed_at":"2026-08-07T04:47:17.997316Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:17.997316Z"},"links":{"cited_paper":"/paper/2206.04615","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:4b892fb767af74c41df1f820c48ead591078554b25fb6bd4a4ac2cc5c2acae9f","observation_id":"515b9af0-e0cb-483d-a53b-8e470be481d7","resolution":{"observed_at":"2026-08-07T04:47:17.997316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06823","last_updated":"2024-11-11T09:31:46Z","snapshot_observed_at":"2026-08-10T09:45:14.971591Z","submitted_at":"2024-11-11T09:31:46Z","title":"Large Language Model in Medical Informatics: Direct Classification and Enhanced Text Representations for Automatic ICD Coding","version":1},"cited_work":{"arxiv_id":"2411.06823","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.06823","snapshot_observed_at":"2026-08-07T04:47:18.371209Z","title":"Large Language Model in Medical Informatics: Direct Classification and Enhanced Text Representations for Automatic ICD Coding","venue":"cs.LG","work_id":"34893e09-7ae9-46e6-a0a0-72444a8fd85d","year":2024},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.001490Z"},"links":{"cited_paper":"/paper/2411.06823","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:464eb9d6f39bdd114174dc2e2cb6c757eb6ee34579762d406cfbeba352ccb51f","observation_id":"c94917ea-8bb7-453c-8480-42d323205069","resolution":{"observed_at":"2026-08-07T04:47:18.380851Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06552","last_updated":"2023-11-13T12:38:00Z","snapshot_observed_at":"2026-07-06T16:30:29.783501Z","submitted_at":"2023-10-10T11:56:48Z","title":"Automated clinical coding using off-the-shelf large language models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06552","snapshot_observed_at":"2026-08-07T04:47:18.004914Z","title":"S., Kascenas, A., Lok, P., Liakata, M., and O'Neil, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.004914Z"},"links":{"cited_paper":"/paper/2310.06552","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:da6ab03043b3e9f47918c9e01e108dc4166d604cbab77064f1749a81290a3300","observation_id":"25ca01e7-cd56-4f69-b036-04bc8ee9c5b0","resolution":{"observed_at":"2026-08-07T04:47:18.004914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.008910Z","title":"D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.008910Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:a99868a4d45fee95b0a35582086d727380ccd24604dd36ed5946ab0463f6ad06","observation_id":"98ff3bf9-d929-4ca1-b338-843240bfabd2","resolution":{"observed_at":"2026-08-07T04:47:18.008910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04226","last_updated":"2023-03-07T20:36:13Z","snapshot_observed_at":"2026-08-10T21:02:39.542314Z","submitted_at":"2023-03-07T20:36:13Z","title":"A Comprehensive Survey of AI-Generated Content (AIGC): A History of Generative AI from GAN to ChatGPT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04226","snapshot_observed_at":"2026-08-07T04:47:18.011925Z","title":"S., and Sun, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.011925Z"},"links":{"cited_paper":"/paper/2303.04226","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:3a4d4f87437bff4950cc5ccb58531a86388f7ab38ad140eb26b8c86ea0e4da59","observation_id":"f0a069d9-389c-4f9c-bfc5-ef28c79e0ca8","resolution":{"observed_at":"2026-08-07T04:47:18.011925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-08-07T04:47:18.015342Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.015342Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:10ac2619ab3407d5c0254474e6e7c2284182204285661394d8cec46f0a0fe4b1","observation_id":"5c20ff77-eb65-4dfd-8876-1ceb460c72b2","resolution":{"observed_at":"2026-08-07T04:47:18.015342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.531303Z","title":null,"venue":null,"work_id":"fe098edf-c28a-4012-824d-6b072a734fd5","year":2020},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.018921Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:0af65e28bc4c3f4b060b0ddf42c7268290a507ece334cd2075284e70723566f8","observation_id":"76a817a4-4fc0-49a5-8343-ddf76abd9208","resolution":{"observed_at":"2026-08-07T04:47:18.534353Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-07T04:47:18.021758Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.021758Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:eaf6c965784449dea1869a2fdedd82a9dd5a66b817e39a7467e39a7a46bb3617","observation_id":"8181321a-3273-4a7e-9703-6124463aac58","resolution":{"observed_at":"2026-08-07T04:47:18.021758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.521526Z","title":null,"venue":null,"work_id":"7271df1c-3710-40b3-92fb-224ebeb54394","year":2023},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.024777Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:6f08338a6d14de2b1a43934568f576e1f65999cb9d1c87782e73e9c5f7040a5b","observation_id":"706dadd2-271f-4412-b247-894223f4cb74","resolution":{"observed_at":"2026-08-07T04:47:18.525022Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03970","last_updated":"2022-10-08T08:37:44Z","snapshot_observed_at":"2026-07-06T14:02:32.637793Z","submitted_at":"2022-10-08T08:37:44Z","title":"KG-MTT-BERT: Knowledge Graph Enhanced BERT for Multi-Type Medical Text Classification","version":1},"cited_work":{"arxiv_id":"2210.03970","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.03970","snapshot_observed_at":"2026-08-07T04:47:18.315864Z","title":"KG-MTT-BERT: Knowledge Graph Enhanced BERT for Multi-Type Medical Text Classification","venue":"cs.CL","work_id":"83883221-abe3-4a75-aa9e-cf1f73a479cb","year":2022},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.027497Z"},"links":{"cited_paper":"/paper/2210.03970","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:2ce096541768e7051488235c70991718a14b2bb65f2a805f0d8cf305c32a8f40","observation_id":"ad01dd9b-1a8b-4236-9ad1-15515ca6102e","resolution":{"observed_at":"2026-08-07T04:47:18.320567Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-10T12:35:09.020030Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T04:47:18.030278Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.030278Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:f31a273339b83ebfd260a7e180dc73daed461994682fd6af22549707c10c467a","observation_id":"d7ec89bf-6c0b-43a8-989c-31ea1e04be74","resolution":{"observed_at":"2026-08-07T04:47:18.030278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-07T04:47:18.034739Z","title":"N., et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.034739Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:9151ebf4536bdc91d2ea5e8d7712d0f894fd7609c27c099fe29bcfa49e11a140","observation_id":"a593e703-acda-4513-8cde-781110510a29","resolution":{"observed_at":"2026-08-07T04:47:18.034739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.511669Z","title":null,"venue":null,"work_id":"68bd7ef3-66f5-41ae-8ff8-f01eb4b4feb1","year":2025},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.037464Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:92d2bf396c48c37cdd4175ae81c37bc0d85ecba22ca50e6500d07d891484c9a1","observation_id":"724d74b9-b986-4d39-93fd-1e761a2c6918","resolution":{"observed_at":"2026-08-07T04:47:18.514570Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12849","last_updated":"2024-07-06T06:58:51Z","snapshot_observed_at":"2026-08-10T06:30:40.337811Z","submitted_at":"2024-07-06T06:58:51Z","title":"Large language models are good medical coders, if provided with tools","version":1},"cited_work":{"arxiv_id":"2407.12849","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.12849","snapshot_observed_at":"2026-08-07T04:47:18.283747Z","title":"Large language models are good medical coders, if provided with tools","venue":"cs.IR","work_id":"b87a6ecd-ad0e-435e-957a-61fb7f80b1bc","year":2024},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.040148Z"},"links":{"cited_paper":"/paper/2407.12849","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:a0757ff9e57a2c6da4b5cd4eef22ceb12e5059e9171dd389c8ee143bf96aae95","observation_id":"858e0aec-dfe5-44d8-95dc-a5b9fd582e3f","resolution":{"observed_at":"2026-08-07T04:47:18.287099Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09110","last_updated":"2023-10-01T21:44:23Z","snapshot_observed_at":"2026-08-10T23:10:13.900680Z","submitted_at":"2022-11-16T18:51:34Z","title":"Holistic Evaluation of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09110","snapshot_observed_at":"2026-08-07T04:47:18.042981Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.042981Z"},"links":{"cited_paper":"/paper/2211.09110","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:f5693b5aad188066466597ad1cdc928820d3547d787a3874f2daf62e2b88e16a","observation_id":"51ec63c1-4f0b-4b96-94f9-a00835c174b3","resolution":{"observed_at":"2026-08-07T04:47:18.042981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06435","last_updated":"2024-10-17T01:10:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-12T20:01:52Z","title":"A Comprehensive Overview of Large Language Models","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06435","snapshot_observed_at":"2026-08-07T04:47:18.045941Z","title":"U., Qiu, S., Saqib, M., Anwar, S., Usman, M., Akhtar, N., Barnes, N., and Mian, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.045941Z"},"links":{"cited_paper":"/paper/2307.06435","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:ba3ca380c0ec64c1166203d33d2896793412b9a523abf8aeb323637ecdd9e43b","observation_id":"64835f72-9593-43a5-ac45-635a35268ecc","resolution":{"observed_at":"2026-08-07T04:47:18.045941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.502758Z","title":"Norddrg specification, url: https://nordcase.org/","venue":null,"work_id":"4536c797-348a-4a64-8fb6-f65403a4935a","year":2025},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.048743Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:1fdadf6695b20923ac8ec81cc62356033d30e499762afd17e1e1d501361e7d14","observation_id":"eca5baa8-3d39-4a87-85bc-9a48fb5e34e0","resolution":{"observed_at":"2026-08-07T04:47:18.505630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.493835Z","title":"E., Rossi, M., Hui, W., Virtanen, V., and Bragge, J","venue":null,"work_id":"1a5c47fc-6b23-436b-9391-eac759f09b38","year":2020},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.051398Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:0bfba6564ad115ec2cddac79110e1586d7464ffebd751a8954ec4f370b105dd1","observation_id":"93518a54-1235-4272-b398-3379e7673b57","resolution":{"observed_at":"2026-08-07T04:47:18.496622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.484787Z","title":null,"venue":null,"work_id":"49111d6c-ce25-422a-a3a1-b22383e9dc18","year":2024},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.054163Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:ec3458658e07b5d338cd5a2a2398408772d382dc30ab7c640cb0405109a9f12a","observation_id":"3f2a5257-e0c2-4c52-b1a6-cbdaa92f45c8","resolution":{"observed_at":"2026-08-07T04:47:18.487933Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.476235Z","title":null,"venue":null,"work_id":"821cae8d-3f89-4b45-9ff9-96582f147e59","year":2024},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.056970Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:c42e5d5d9afdf2553bf66af4f4cd1d573b647a87f475b1b63c2ce8ac442f1fa6","observation_id":"8a0ecc40-b408-465a-8fad-a03c444d4215","resolution":{"observed_at":"2026-08-07T04:47:18.478964Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.059547Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.059547Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:6f767ea09a1cbca7f48776dc639c65188edff67e6f4711964266488cd692f74e","observation_id":"f54c6b6f-d567-46ce-9f93-6d0cca99cd40","resolution":{"observed_at":"2026-08-07T04:47:18.059547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21124","last_updated":"2024-07-30T18:33:05Z","snapshot_observed_at":"2026-07-06T18:54:41.705593Z","submitted_at":"2024-07-30T18:33:05Z","title":"Zero Shot Health Trajectory Prediction Using Transformer","version":1},"cited_work":{"arxiv_id":"2407.21124","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.21124","snapshot_observed_at":"2026-08-07T04:47:18.249464Z","title":"Zero Shot Health Trajectory Prediction Using Transformer","venue":"cs.LG","work_id":"4e08feff-1892-425a-b7ef-758e2283a9ab","year":2024},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.062146Z"},"links":{"cited_paper":"/paper/2407.21124","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:90f3a8180c2e1fc5f02d184a1358ef5ae8e15e739d618b01e0223b62bbbb089f","observation_id":"2084bc1f-c49c-426d-9219-66f44dad12ec","resolution":{"observed_at":"2026-08-07T04:47:18.254806Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T04:47:18.064980Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.064980Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:c3aa36d36e5ce66b04c7dac1190ebb0ad7fdef6436da4f1c5a9e653678324665","observation_id":"de4be81f-1f9a-4f3c-b049-72aff053aa76","resolution":{"observed_at":"2026-08-07T04:47:18.064980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.067520Z","title":"N., Kaiser, ., and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.067520Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:88f2693b56b031cceb3e8b556c225bd7ef1b30959703c8e0b9b517ec495aaff2","observation_id":"80c47429-3c67-45f5-bb50-1609f0c6ebfd","resolution":{"observed_at":"2026-08-07T04:47:18.067520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.455257Z","title":null,"venue":null,"work_id":"68e1504d-761c-4108-825a-da1facf4eaf9","year":2019},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.070258Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:be640c3598eaddb64f6edc3430350fdcdcfec07ad95e7cd7ab4e357b0670d5c2","observation_id":"1b1fcbd5-2791-42c1-9d97-b10dae9525fe","resolution":{"observed_at":"2026-08-07T04:47:18.458299Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.438560Z","title":null,"venue":null,"work_id":"0409d291-e050-4843-b2eb-84b49a34746f","year":2018},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.072883Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:ab6fd8038802a686f85a0d3655b477698d5ad656b0721568d3ece2265f0feb61","observation_id":"a9ad48ce-647e-4790-8e7e-9617b7c9b383","resolution":{"observed_at":"2026-08-07T04:47:18.446912Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.075336Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.075336Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:c32e6e9199c24959c09d31d915bbed7d47df9257ebb2d0140724c80e9e38c8b0","observation_id":"1016ed56-20b4-42e5-9443-c65c4dd29ce4","resolution":{"observed_at":"2026-08-07T04:47:18.075336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01234","last_updated":"2023-10-18T13:40:12Z","snapshot_observed_at":"2026-08-05T00:17:41.596395Z","submitted_at":"2023-10-02T14:23:50Z","title":"Back-Propagation Optimization and Multi-Valued Artificial Neural Networks for Highly Vivid Structural Color Filter Metasurfaces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01234","snapshot_observed_at":"2026-08-07T04:47:18.078257Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.078257Z"},"links":{"cited_paper":"/paper/2310.01234","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:18ef8ec809a0810652d7aba8682d13f0eba91229a285ad7b6465f1bc3aff340f","observation_id":"a633e670-b955-464e-bba5-9e2ba0737daf","resolution":{"observed_at":"2026-08-07T04:47:18.078257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.421089Z","title":null,"venue":null,"work_id":"0522e14b-aaa8-49f3-ab47-debd0ec6dc13","year":2023},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.081450Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:718acd53fe419d30608ac4affe31eadf734a1b6a5ec5c8c820327c73b358eebd","observation_id":"9cd76605-2022-42e1-9752-dd2cd1669153","resolution":{"observed_at":"2026-08-07T04:47:18.427000Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:47:18.404526Z","title":null,"venue":null,"work_id":"9072f3aa-4f30-4e72-9531-d1f8c848ad51","year":1999},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.084183Z"},"links":{"citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:7ae4dc7bf3738e598d5ccb11fde79398d22919e4e8efe0f75b5b770fb671d0de","observation_id":"aaaadb01-e9f4-4254-8684-2c78d9e7e90f","resolution":{"observed_at":"2026-08-07T04:47:18.412518Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-07T04:47:18.087129Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.087129Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:f865069c80e53ad3786bec5eb08977034d3e84e2050d7298409b0f35d220fa49","observation_id":"313537b3-6259-43e4-a80b-c68f4cbabfe5","resolution":{"observed_at":"2026-08-07T04:47:18.087129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05685","snapshot_observed_at":"2026-08-07T04:47:18.089814Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:18.089814Z"},"links":{"cited_paper":"/paper/2306.05685","citing_paper":"/paper/2506.13790"},"observation_digest":"sha256:3ff1a7298527369e7d215139376039792315d939d5aeca8174d92dfdceffcc72","observation_id":"54b5d437-ff84-44ff-b5d4-724fb0e255d3","resolution":{"observed_at":"2026-08-07T04:47:18.089814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.13790","last_updated":"2025-08-20T13:47:47Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-10T01:31:14.540393Z","submitted_at":"2025-06-11T11:40:11Z","title":"The NordDRG AI Benchmark for Large Language Models"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":26,"verified_exact":3,"verified_fuzzy":2},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2506.13790."}