{"as_of":"2026-08-23T10:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c2128649679ac05eda611aeae311db91bfe707205efcfbdbdcdaf3a5cd8268ad","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T17:41:26.749626Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.10744/citation-record","integrity":"/paper/2509.10744/integrity","json":"/paper/2509.10744/citation-record.json","paper":"/paper/2509.10744"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:41:24.324388Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:24.324388Z"},"links":{"citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:7f943ae0001c1384e36f9043b17316cf00be65125ba36ba966cd436ad2ba52a7","observation_id":"8486a350-9521-4f10-84f8-264e20c14bf8","resolution":{"observed_at":"2026-08-04T17:41:24.324388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:41:24.392622Z","title":"2023.RADIATION AND CAN- CER BIOLOGY STUDY GUIDE","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:24.392622Z"},"links":{"citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:73916d3f1973a4903275aad9e419574f15f80c11d0054d3d2b43c710484ca3e2","observation_id":"42f280f6-3db1-4a6f-b8b0-d8da1ce95671","resolution":{"observed_at":"2026-08-04T17:41:24.392622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:41:24.466641Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:24.466641Z"},"links":{"citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:ca4cad3082decd73abf7c971b43c619f196eb89e09ddcbc86baafda25744669e","observation_id":"2723ce5c-c6d4-474e-854d-4209523dabdd","resolution":{"observed_at":"2026-08-04T17:41:24.466641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-20T15:31:01.041088Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-04T17:41:24.542294Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:24.542294Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:3418dbf90b672d62b54f915a52294619625013cbcfd52c2ead5e179e95b50028","observation_id":"9ed580f0-67bd-44f9-ab7b-ad35badd4874","resolution":{"observed_at":"2026-08-04T17:41:24.542294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.ijrobp.2024.07.1346","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Beattie, S","venue":"International Journal of Radiation Oncology*Biology*Physics","work_id":"9cc073b0-cf71-4bb9-b5ee-e09d568ae3f0","year":2024},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:24.599332Z"},"links":{"citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:d71094711c63dac7f44c4d07423f2af4ceb7bd5b705ab6410a2a1c6bf963ad35","observation_id":"38455af8-88ef-45e3-b4cc-7a583862dd47","resolution":{"observed_at":"2026-08-04T17:44:06.657194Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:41:24.693090Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:24.693090Z"},"links":{"citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:b89ef2089452f7e710500df4f1a8c43d06fb648ca9bfcfb0f53665a1a3535933","observation_id":"4361f049-0e8b-407b-a518-08ab7e77b44d","resolution":{"observed_at":"2026-08-04T17:41:24.693090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:41:24.730975Z","title":"2024.Science and Engineering Indicators 2024: The State of U.S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:24.730975Z"},"links":{"citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:052372123031a48b57d75065f2b456075f4111154c0207fbac5511fc1b3b6f84","observation_id":"3180879f-8562-4e9e-aceb-d2f3dc9be986","resolution":{"observed_at":"2026-08-04T17:41:24.730975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:41:24.794393Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:24.794393Z"},"links":{"citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:19d4d6029e0d953cc0987e5bef79499d489df63aabb6e9149234a73b1f638ba9","observation_id":"989a7007-af5a-41f5-b050-a7c96927f59e","resolution":{"observed_at":"2026-08-04T17:41:24.794393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08281","last_updated":"2025-10-23T09:36:08Z","snapshot_observed_at":"2026-07-31T05:45:37.385210Z","submitted_at":"2024-01-16T11:12:36Z","title":"The Faiss library","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08281","snapshot_observed_at":"2026-08-04T17:41:24.828179Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:24.828179Z"},"links":{"cited_paper":"/paper/2401.08281","citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:14fc3445a935477e1acbe6344ed09730ac59a010b2171afecd75219b1cf3d949","observation_id":"a6c64ead-25fc-4b2d-9c18-e5671b6153c4","resolution":{"observed_at":"2026-08-04T17:41:24.828179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:41:24.900523Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:24.900523Z"},"links":{"citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:d5565524ebc13b037d53d87e5c6dc74fb8b2e53b75ba39b51379e73003e644c6","observation_id":"4048d7d2-cec4-4399-aee4-bdcb8c762105","resolution":{"observed_at":"2026-08-04T17:41:24.900523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-04T17:41:24.955443Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:24.955443Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:fb3d2963cdfb3cf7c088bc55af963f36170a205a84f8f58f8d250a054b29bb5b","observation_id":"c675e996-8c89-482c-aac3-1b4f477fddc5","resolution":{"observed_at":"2026-08-04T17:41:24.955443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:41:25.057261Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:25.057261Z"},"links":{"citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:892ef820925d909ef07c1255bc4e8e18d14cc2c73a5cfe839b9fea82e54a110b","observation_id":"62aebe7e-b7c5-4516-ad99-d2d10bb53810","resolution":{"observed_at":"2026-08-04T17:41:25.057261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-04T17:41:25.150748Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:25.150748Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:80b68d3c0425566291d6d74eda7c2a95f9c23858422aaa6daa6b93379ab0a0d6","observation_id":"e6a80fa6-8f8a-4100-b825-882ace8c95dc","resolution":{"observed_at":"2026-08-04T17:41:25.150748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:41:25.253320Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:25.253320Z"},"links":{"citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:7f9782572b19def3283efdbca9fa219d17e00f7857065539b7ed403c5ec97e5e","observation_id":"12cefcf7-075d-48fd-b8d9-25def0368f62","resolution":{"observed_at":"2026-08-04T17:41:25.253320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T20:30:34.016254Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-04T17:41:25.356677Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:25.356677Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:0808f7c779d5c098fcd6f3c4970b9b548c553180156bbe363cac24151925d0e5","observation_id":"f1e518fe-2069-408d-915c-6c20be29c67d","resolution":{"observed_at":"2026-08-04T17:41:25.356677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:41:25.470163Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:25.470163Z"},"links":{"citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:330873cef5ab20a96c441d174c678bf9c194447cb6013363d41dfd340b3de24d","observation_id":"d27d0ddc-3885-4cf0-9321-4380fbebe63a","resolution":{"observed_at":"2026-08-04T17:41:25.470163Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:41:25.555929Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:25.555929Z"},"links":{"citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:5e7f432325e5ea794ab0fadef81665156f3e1ea45e837914a45e8a6cde783770","observation_id":"3d437974-6ad9-4d14-bf0f-ffd8a2cb1c7f","resolution":{"observed_at":"2026-08-04T17:41:25.555929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:41:25.608152Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:25.608152Z"},"links":{"citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:3cd59881ac310ae5fcb16cde3197f7dca3062e2f56bd92f45fdd2cd3a8df1dd7","observation_id":"84c28f20-78fa-4c01-b41e-8b6ed0414fdd","resolution":{"observed_at":"2026-08-04T17:41:25.608152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:41:25.685924Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:25.685924Z"},"links":{"citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:c1bd55f78a493432b775011a35cf0cd45f06e411852613af054eafedcd840fb2","observation_id":"8a08fa86-f3d1-48a8-b5bc-162b2240f87e","resolution":{"observed_at":"2026-08-04T17:41:25.685924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00838","last_updated":"2024-06-07T21:59:52Z","snapshot_observed_at":"2026-08-17T12:46:02.488423Z","submitted_at":"2024-02-01T18:28:55Z","title":"OLMo: Accelerating the Science of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00838","snapshot_observed_at":"2026-08-04T17:41:25.771827Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:25.771827Z"},"links":{"cited_paper":"/paper/2402.00838","citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:f5fb56e72777c3e74eb4412145addb9dd2b097f74c7cbba39350708d86cde84b","observation_id":"9c914f5a-12a2-4d9f-9177-e6e9d074ff7c","resolution":{"observed_at":"2026-08-04T17:41:25.771827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-21T17:04:32.090035Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-04T17:41:25.884961Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:25.884961Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:17ec063870023ce6bce717d0b1aa272d925db56136c6814bd91b533105b65d49","observation_id":"fe18cd74-ba37-409d-8e09-481a06146177","resolution":{"observed_at":"2026-08-04T17:41:25.884961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.01435","last_updated":"2025-04-23T18:38:41Z","snapshot_observed_at":"2026-08-18T12:15:41.407160Z","submitted_at":"2025-04-23T18:38:41Z","title":"AdaParse: An Adaptive Parallel PDF Parsing and Resource Scaling Engine","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.01435","snapshot_observed_at":"2026-08-04T17:41:26.013320Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:26.013320Z"},"links":{"cited_paper":"/paper/2505.01435","citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:552452c2c7df02c6dc2beb08bbc72ad83874c68314ed3339309a13cabf986834","observation_id":"7439b183-a787-42a9-8c11-efce408a164a","resolution":{"observed_at":"2026-08-04T17:41:26.013320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-04T17:41:26.134486Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:26.134486Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:da57a82928f0260e5553fb3aea058ab72f175af24d8190d4c11b82bf0345cd16","observation_id":"090749f7-9de1-42a0-8109-3e0e569522a0","resolution":{"observed_at":"2026-08-04T17:41:26.134486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11194","last_updated":"2024-11-08T22:00:26Z","snapshot_observed_at":"2026-08-18T06:12:24.862268Z","submitted_at":"2024-07-15T19:28:14Z","title":"AstroMLab 1: Who Wins Astronomy Jeopardy!?","version":2},"cited_work":{"arxiv_id":"2407.11194","doi":"10.48550/arxiv.2407.11194","metadata_source":"pith","pith_arxiv_id":"2407.11194","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"AstroMLab 1: Who Wins Astronomy Jeopardy!?","venue":"astro-ph.IM","work_id":"2dc9124a-6c02-41fc-bb33-05cc0bd2843f","year":2024},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:26.265139Z"},"links":{"cited_paper":"/paper/2407.11194","citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:d575d36a7482646d73460622c4a4a609ded35be2ee43ec02f9f6b67a269a333d","observation_id":"dcd6ef8f-2025-4bdb-bd5d-88e958fd75f3","resolution":{"observed_at":"2026-08-04T17:44:06.150232Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:41:26.408422Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:26.408422Z"},"links":{"citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:7da89567a6132d8ac1752fa408ae823bffacfb4cdde07fe43efc320a6d24accf","observation_id":"cc4e81db-6201-47b3-8dab-57b9685da8b5","resolution":{"observed_at":"2026-08-04T17:41:26.408422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:41:26.633666Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:26.633666Z"},"links":{"citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:ad01d41ae8174bf050cdce35d4e41d344d42d12d7bde68086f895a8d8053e7aa","observation_id":"d1ec3a66-d79d-44e4-8d7e-513ba62d7d8e","resolution":{"observed_at":"2026-08-04T17:41:26.633666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02385","last_updated":"2024-06-04T02:05:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-04T17:54:59Z","title":"TinyLlama: An Open-Source Small Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02385","snapshot_observed_at":"2026-08-04T17:41:26.749626Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:26.749626Z"},"links":{"cited_paper":"/paper/2401.02385","citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:37273b63df6a4c0ccefdb4d4486995a614e3cd360a6b2093dbd7a810a454c859","observation_id":"c24f4045-7edf-465f-b4bf-a04bb640e1fb","resolution":{"observed_at":"2026-08-04T17:41:26.749626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:41:26.516157Z","title":"InExtended Semantic Web Conference","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:26.516157Z"},"links":{"citing_paper":"/paper/2509.10744"},"observation_digest":"sha256:ff23afa5aff9822cce904d812b86154a5499fbcd2e4dddf334a8e6d0b09ea8e3","observation_id":"7c317ed6-eaf3-4c24-9754-50e0d01248c6","resolution":{"observed_at":"2026-08-04T17:41:26.516157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.10744","last_updated":"2025-09-12T23:22:49Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-18T12:16:19.826721Z","submitted_at":"2025-09-12T23:22:49Z","title":"Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2509.10744."}