{"as_of":"2026-08-15T23:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ab9ca40ec98528c556425ded259d7f3a5636c9de3b182f08a560247155bc2e56","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:03:00.734118Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T12:13:26.877796Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.07688","last_updated":"2024-06-03T08:14:45Z","snapshot_observed_at":"2026-08-13T22:08:30.518564Z","submitted_at":"2024-02-12T14:53:28Z","title":"CyberMetric: A Benchmark Dataset based on Retrieval-Augmented Generation for Evaluating LLMs in Cybersecurity Knowledge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07688","snapshot_observed_at":"2026-08-11T14:04:52.247233Z","title":"A., Jain, R., Bisztray, T., and Debbah, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15265","last_updated":"2024-12-23T11:06:56Z","snapshot_observed_at":"2026-08-15T09:51:52.809342Z","submitted_at":"2024-12-17T03:03:44Z","title":"Chinese SafetyQA: A Safety Short-form Factuality Benchmark for Large Language Models","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T14:04:52.247233Z"},"links":{"cited_paper":"/paper/2402.07688","citing_paper":"/paper/2412.15265"},"observation_digest":"sha256:e781f1975e7804ce55468c329bdcfa6b8e0da20d9aec935afda7a896f8fd61f5","observation_id":"33e472e4-b258-493c-b30a-664313e2f358","resolution":{"observed_at":"2026-08-11T14:04:52.247233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07688","last_updated":"2024-06-03T08:14:45Z","snapshot_observed_at":"2026-08-13T22:08:30.518564Z","submitted_at":"2024-02-12T14:53:28Z","title":"CyberMetric: A Benchmark Dataset based on Retrieval-Augmented Generation for Evaluating LLMs in Cybersecurity Knowledge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07688","snapshot_observed_at":"2026-08-15T21:03:00.734118Z","title":"arXiv preprint arXiv:2402.07688 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11565","last_updated":"2025-05-24T03:07:23Z","snapshot_observed_at":"2026-08-15T20:57:36.484564Z","submitted_at":"2025-05-16T08:40:09Z","title":"ACSE-Eval: Can LLMs threat model real-world cloud infrastructure?","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T21:03:00.734118Z"},"links":{"cited_paper":"/paper/2402.07688","citing_paper":"/paper/2505.11565"},"observation_digest":"sha256:c822d3adf92107520789778d4e0d488fe74873bf1823101cbe5e0ff2162d95e0","observation_id":"1c4f3760-6060-4832-82e2-3b20d32836e0","resolution":{"observed_at":"2026-08-15T21:03:00.734118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07688","last_updated":"2024-06-03T08:14:45Z","snapshot_observed_at":"2026-08-13T22:08:30.518564Z","submitted_at":"2024-02-12T14:53:28Z","title":"CyberMetric: A Benchmark Dataset based on Retrieval-Augmented Generation for Evaluating LLMs in Cybersecurity Knowledge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07688","snapshot_observed_at":"2026-08-07T13:55:16.074470Z","title":"Cybermetric: A benchmark dataset for evaluating large language models knowledge in cybersecurity,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20630","last_updated":"2025-05-27T02:16:27Z","snapshot_observed_at":"2026-08-13T17:57:38.433929Z","submitted_at":"2025-05-27T02:16:27Z","title":"SV-TrustEval-C: Evaluating Structure and Semantic Reasoning in Large Language Models for Source Code Vulnerability Analysis","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:16.074470Z"},"links":{"cited_paper":"/paper/2402.07688","citing_paper":"/paper/2505.20630"},"observation_digest":"sha256:a3144dd4e26499c27c01d0125cf90fc6429e6489ac9f36b219d2467516b4ada8","observation_id":"b4d33c2e-9f31-47a8-9b8c-9f4f12074890","resolution":{"observed_at":"2026-08-07T13:55:16.074470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07688","last_updated":"2024-06-03T08:14:45Z","snapshot_observed_at":"2026-08-13T22:08:30.518564Z","submitted_at":"2024-02-12T14:53:28Z","title":"CyberMetric: A Benchmark Dataset based on Retrieval-Augmented Generation for Evaluating LLMs in Cybersecurity Knowledge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07688","snapshot_observed_at":"2026-08-07T04:52:00.964558Z","title":"Cybermetric: A benchmark dataset for evaluating large language models knowledge in cybersecurity.arXiv preprint arXiv:2402.07688, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09420","last_updated":"2025-06-11T06:08:13Z","snapshot_observed_at":"2026-08-09T00:55:40.500387Z","submitted_at":"2025-06-11T06:08:13Z","title":"A Call for Collaborative Intelligence: Why Human-Agent Systems Should Precede AI Autonomy","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:00.964558Z"},"links":{"cited_paper":"/paper/2402.07688","citing_paper":"/paper/2506.09420"},"observation_digest":"sha256:145de1d8bc24e6efc1b892d9e93ebf6068de44aa19e7e2392a14e709ca9c36f2","observation_id":"e5476660-c479-4587-a8a3-f1d1bbf5073d","resolution":{"observed_at":"2026-08-07T04:52:00.964558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07688","last_updated":"2024-06-03T08:14:45Z","snapshot_observed_at":"2026-08-13T22:08:30.518564Z","submitted_at":"2024-02-12T14:53:28Z","title":"CyberMetric: A Benchmark Dataset based on Retrieval-Augmented Generation for Evaluating LLMs in Cybersecurity Knowledge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07688","snapshot_observed_at":"2026-08-06T23:35:05.975106Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17644","last_updated":"2025-06-21T08:56:20Z","snapshot_observed_at":"2026-08-13T21:49:03.364541Z","submitted_at":"2025-06-21T08:56:20Z","title":"Measuring and Augmenting Large Language Models for Solving Capture-the-Flag Challenges","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T23:35:05.975106Z"},"links":{"cited_paper":"/paper/2402.07688","citing_paper":"/paper/2506.17644"},"observation_digest":"sha256:a6ae997816244aaa4d623944b52fc26aa3793e2e6849f96cd8c7ab57e326e68c","observation_id":"7a79103d-b8de-4a37-8e5e-96ceec3b28e6","resolution":{"observed_at":"2026-08-06T23:35:05.975106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07688","last_updated":"2024-06-03T08:14:45Z","snapshot_observed_at":"2026-08-13T22:08:30.518564Z","submitted_at":"2024-02-12T14:53:28Z","title":"CyberMetric: A Benchmark Dataset based on Retrieval-Augmented Generation for Evaluating LLMs in Cybersecurity Knowledge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07688","snapshot_observed_at":"2026-08-04T09:40:27.499437Z","title":"Cybermetric: A benchmark dataset for evaluating large language models knowledge in cybersecurity.arXiv preprint arXiv:2402.07688,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.14113","last_updated":"2026-07-01T15:47:10Z","snapshot_observed_at":"2026-08-12T13:49:44.210830Z","submitted_at":"2025-10-15T21:34:58Z","title":"Toward Cybersecurity-Expert Small Language Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T09:40:27.499437Z"},"links":{"cited_paper":"/paper/2402.07688","citing_paper":"/paper/2510.14113"},"observation_digest":"sha256:1ae7fe8dba186a4869fb561eb5f6ea851f73be2083ebf1edefad3e8665195153","observation_id":"c3df7809-948b-4c09-870c-f03c3475cdef","resolution":{"observed_at":"2026-08-04T09:40:27.499437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07688","last_updated":"2024-06-03T08:14:45Z","snapshot_observed_at":"2026-08-13T22:08:30.518564Z","submitted_at":"2024-02-12T14:53:28Z","title":"CyberMetric: A Benchmark Dataset based on Retrieval-Augmented Generation for Evaluating LLMs in Cybersecurity Knowledge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07688","snapshot_observed_at":"2026-07-13T09:27:26.581889Z","title":"CyberMetric: A benchmark dataset for evaluating large language models knowledge in cybersecurity,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.05439","last_updated":"2026-06-30T01:08:02Z","snapshot_observed_at":"2026-07-22T23:19:06.197639Z","submitted_at":"2026-04-07T05:19:59Z","title":"Scale-free congestion clusters in large-scale traffic networks: a continuum modeling study","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-13T09:27:26.581889Z"},"links":{"cited_paper":"/paper/2402.07688","citing_paper":"/paper/2604.05439"},"observation_digest":"sha256:67801fd7c08f1c803f1cc851ec97d5b3828e113cfb39a3ce77c0a7f4141bb43b","observation_id":"22beb45a-bdeb-450a-9897-39e20bb5387f","resolution":{"observed_at":"2026-07-13T09:27:26.581889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07688","last_updated":"2024-06-03T08:14:45Z","snapshot_observed_at":"2026-08-13T22:08:30.518564Z","submitted_at":"2024-02-12T14:53:28Z","title":"CyberMetric: A Benchmark Dataset based on Retrieval-Augmented Generation for Evaluating LLMs in Cybersecurity Knowledge","version":2},"cited_work":{"arxiv_id":"2402.07688","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.07688","snapshot_observed_at":"2026-06-29T12:13:26.877796Z","title":"CyberMetric: A benchmark dataset for evaluating large language models knowledge in cybersecurity","venue":null,"work_id":"4973749e-a7f5-4c8c-95b1-0d789241826a","year":2024},"citing_paper":{"arxiv_id":"2604.05440","last_updated":"2026-04-07T05:22:25Z","snapshot_observed_at":"2026-08-13T04:31:10.794994Z","submitted_at":"2026-04-07T05:22:25Z","title":"LanG -- A Governance-Aware Agentic AI Platform for Unified Security Operations","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-10T19:53:05.325203Z"},"links":{"cited_paper":"/paper/2402.07688","citing_paper":"/paper/2604.05440"},"observation_digest":"sha256:eef8de2d8def12f12bf3d2ce098543416b1d00ed1e6c07ea102671add20d69b4","observation_id":"9543e35c-6174-4138-a8c3-81976a8aecf8","resolution":{"observed_at":"2026-05-10T22:25:51.431008Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07688","last_updated":"2024-06-03T08:14:45Z","snapshot_observed_at":"2026-08-13T22:08:30.518564Z","submitted_at":"2024-02-12T14:53:28Z","title":"CyberMetric: A Benchmark Dataset based on Retrieval-Augmented Generation for Evaluating LLMs in Cybersecurity Knowledge","version":2},"cited_work":{"arxiv_id":"2402.07688","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.07688","snapshot_observed_at":"2026-06-29T12:13:26.877796Z","title":"CyberMetric: A benchmark dataset for evaluating large language models knowledge in cybersecurity","venue":null,"work_id":"4973749e-a7f5-4c8c-95b1-0d789241826a","year":2024},"citing_paper":{"arxiv_id":"2604.19533","last_updated":"2026-04-23T17:59:02Z","snapshot_observed_at":"2026-08-13T07:46:39.008677Z","submitted_at":"2026-04-21T14:53:23Z","title":"Cyber Defense Benchmark: Agentic Threat Hunting Evaluation for LLMs in SecOps","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T02:23:56.777888Z"},"links":{"cited_paper":"/paper/2402.07688","citing_paper":"/paper/2604.19533"},"observation_digest":"sha256:daa4e292904020a1c36b3f80f0df79fa335060a73dc99e96ec0da84d6c16d5ea","observation_id":"c466733a-76f9-4862-8270-38b85169ffa9","resolution":{"observed_at":"2026-05-11T13:06:02.859959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07688","last_updated":"2024-06-03T08:14:45Z","snapshot_observed_at":"2026-08-13T22:08:30.518564Z","submitted_at":"2024-02-12T14:53:28Z","title":"CyberMetric: A Benchmark Dataset based on Retrieval-Augmented Generation for Evaluating LLMs in Cybersecurity Knowledge","version":2},"cited_work":{"arxiv_id":"2402.07688","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.07688","snapshot_observed_at":"2026-06-29T12:13:26.877796Z","title":"CyberMetric: A benchmark dataset for evaluating large language models knowledge in cybersecurity","venue":null,"work_id":"4973749e-a7f5-4c8c-95b1-0d789241826a","year":2024},"citing_paper":{"arxiv_id":"2605.28146","last_updated":"2026-05-27T08:29:28Z","snapshot_observed_at":"2026-08-04T10:57:53.122170Z","submitted_at":"2026-05-27T08:29:28Z","title":"Cybersecurity AI (CAI) Dataset","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T12:07:49.656453Z"},"links":{"cited_paper":"/paper/2402.07688","citing_paper":"/paper/2605.28146"},"observation_digest":"sha256:51c2e15c089d033a917246069e3210362f77e28fd9ce5dce118c400cbbbfa380","observation_id":"27707ee9-35a7-4e53-8b8d-058ee486ea93","resolution":{"observed_at":"2026-06-29T12:13:26.879232Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07688","last_updated":"2024-06-03T08:14:45Z","snapshot_observed_at":"2026-08-13T22:08:30.518564Z","submitted_at":"2024-02-12T14:53:28Z","title":"CyberMetric: A Benchmark Dataset based on Retrieval-Augmented Generation for Evaluating LLMs in Cybersecurity Knowledge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07688","snapshot_observed_at":"2026-07-12T03:57:47.560737Z","title":"Cyber- Metric: A benchmark dataset based on retrieval-augmented generation for evaluating LLMs in cybersecurity knowledge,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03233","last_updated":"2026-07-03T11:42:29Z","snapshot_observed_at":"2026-08-13T15:39:13.004372Z","submitted_at":"2026-07-03T11:42:29Z","title":"Agentic and Generative AI for Open-Source Intelligence and Cyber Investigations: Taxonomy, Evaluation, Challenges, and Future Directions","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-12T03:57:47.560737Z"},"links":{"cited_paper":"/paper/2402.07688","citing_paper":"/paper/2607.03233"},"observation_digest":"sha256:ba25872f5c095539aaf3923c7a7dc6a735201b1a94afd32aead8a0c95634b2c9","observation_id":"60c72e94-c0ec-4823-a9c0-766365907f03","resolution":{"observed_at":"2026-07-12T03:57:47.560737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07688","last_updated":"2024-06-03T08:14:45Z","snapshot_observed_at":"2026-08-13T22:08:30.518564Z","submitted_at":"2024-02-12T14:53:28Z","title":"CyberMetric: A Benchmark Dataset based on Retrieval-Augmented Generation for Evaluating LLMs in Cybersecurity Knowledge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07688","snapshot_observed_at":"2026-08-02T14:07:59.382149Z","title":"2402.07688 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20448","last_updated":"2026-05-13T15:26:50Z","snapshot_observed_at":"2026-08-15T16:38:23.418466Z","submitted_at":"2026-05-13T15:26:50Z","title":"Domyn-Small: A European 10B Reasoning Language Model","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-02T14:07:59.382149Z"},"links":{"cited_paper":"/paper/2402.07688","citing_paper":"/paper/2607.20448"},"observation_digest":"sha256:6985f65893242e2f98242f80907c680e602a76f9ab6fbbd62ea14a048df99a25","observation_id":"7d2948a5-2c5f-4e72-9694-a7aa6f1f5348","resolution":{"observed_at":"2026-08-02T14:07:59.382149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07688","last_updated":"2024-06-03T08:14:45Z","snapshot_observed_at":"2026-08-13T22:08:30.518564Z","submitted_at":"2024-02-12T14:53:28Z","title":"CyberMetric: A Benchmark Dataset based on Retrieval-Augmented Generation for Evaluating LLMs in Cybersecurity Knowledge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07688","snapshot_observed_at":"2026-08-01T10:23:21.194170Z","title":"Cyber- metric: A benchmark dataset based on retrieval-augmented generation for evaluating llms in cybersecurity knowledge.arXiv preprint arXiv:2402.07688, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-11T02:19:29.595764Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:21.194170Z"},"links":{"cited_paper":"/paper/2402.07688","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:58187634734961e5b0952a5bba9ee5f053428a839cc00bb2d2b6d1e8c7f9272c","observation_id":"a1347f63-ea6a-451e-ab4b-6f7f93fa301d","resolution":{"observed_at":"2026-08-01T10:23:21.194170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.07688/citation-record","integrity":"/paper/2402.07688/integrity","json":"/paper/2402.07688/citation-record.json","paper":"/paper/2402.07688"},"outbound":[],"paper":{"arxiv_id":"2402.07688","last_updated":"2024-06-03T08:14:45Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-13T22:08:30.518564Z","submitted_at":"2024-02-12T14:53:28Z","title":"CyberMetric: A Benchmark Dataset based on Retrieval-Augmented Generation for Evaluating LLMs in Cybersecurity Knowledge"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 13 inbound Pith citation observations for arXiv:2402.07688."}