{"as_of":"2026-08-15T23:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:257ec0050164274443868aadfbc6e9fae00d5eb4c2b55894918bb753fd6701c4","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T20:42:27.195151Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T12:59:51.091008Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T05:57:41.426801Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"cited_work":{"arxiv_id":"2508.10137","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.10137","snapshot_observed_at":"2026-07-03T05:57:41.426801Z","title":"mscore: a m ultilingual and scalable benchmark for s kill-based co mmonsense re asoning","venue":null,"work_id":"6d7f449c-ea03-41b8-a6d0-888043a6f385","year":2025},"citing_paper":{"arxiv_id":"2606.11470","last_updated":"2026-08-10T19:13:02Z","snapshot_observed_at":"2026-08-14T23:09:31.705348Z","submitted_at":"2026-06-09T21:59:37Z","title":"The Periodic Table of LLM Reasoning: A Structured Survey of Reasoning Paradigms, Methods, and Failure Modes","version":1},"reference_index":178,"source":"arxiv_source","source_observed_at":"2026-06-27T12:59:51.091008Z"},"links":{"cited_paper":"/paper/2508.10137","citing_paper":"/paper/2606.11470"},"observation_digest":"sha256:71c5bf05b938c8a7a8816b7ad68a9473f47d92134dafe842089d1183d19a7355","observation_id":"14f148a7-b8c3-4265-82fe-6a1a416bb639","resolution":{"observed_at":"2026-07-03T05:57:41.428645Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.10137/citation-record","integrity":"/paper/2508.10137/integrity","json":"/paper/2508.10137/citation-record.json","paper":"/paper/2508.10137"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:42:30.272891Z","title":null,"venue":null,"work_id":"39d034bc-7c49-4bc8-af89-57640c8d5f09","year":null},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:25.636950Z"},"links":{"citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:fbb4170f2940fde3d99798e010d034f8daa106f9001347cd76b462630ba5d9f0","observation_id":"bce2d7fa-f96c-4cba-a48a-39b5dc5605c2","resolution":{"observed_at":"2026-08-05T20:42:30.357979Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:42:30.156876Z","title":"COMMONSENSE CONTEXT","venue":null,"work_id":"32f8c11d-55ad-45af-9953-b0274c36c1ce","year":null},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:25.746966Z"},"links":{"citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:57cd90b2f2f9d6bc2f913fe70ab11d2a55e9e8c28f1067b55ca464a1a7614221","observation_id":"7968b32f-1de5-4890-b3c3-3cbdac3fef08","resolution":{"observed_at":"2026-08-05T20:42:30.214965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:42:30.042745Z","title":"REASONING PROCESS","venue":null,"work_id":"424da7fe-c9c7-4bbc-8d50-38774afe8991","year":null},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:25.837953Z"},"links":{"citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:6f4cc44bcd87b879dd355423997734d6836810a7ccf6b02c5837cf0849a67789","observation_id":"5cbc49ba-e814-479b-b638-82b7e5979d63","resolution":{"observed_at":"2026-08-05T20:42:30.102456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:42:29.916677Z","title":"commonsense_context","venue":null,"work_id":"e7f13c9a-159f-4c75-a126-6677c73210a3","year":null},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:25.955126Z"},"links":{"citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:efff86f3f9d6ecebde2d00788c02b8050dd7749a2c61023a30dcb772667e5973","observation_id":"21f3e96c-fa0b-494c-8678-5162cf37cd95","resolution":{"observed_at":"2026-08-05T20:42:29.981757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:42:29.285878Z","title":"REASONING PROCESS","venue":null,"work_id":"a972e870-dab8-405c-a787-0d9abd990a85","year":null},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:26.274857Z"},"links":{"citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:19ac68ac18dca32afdefb00afe096b064a51bfa5887b05c95996fadbda6e4853","observation_id":"af03883c-c81a-4aa4-9d2b-aa3687ed94f6","resolution":{"observed_at":"2026-08-05T20:42:29.329534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:42:29.174813Z","title":"commonsense_context","venue":null,"work_id":"fc90cb2f-5704-41e3-8926-da450094783b","year":null},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:26.350467Z"},"links":{"citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:a1dc22ae1be3eeb82a9dbb224331156bea874c350a9316bb6f174a61cb722b68","observation_id":"34b9b8d1-453c-40a4-b841-7bfa16fbfd30","resolution":{"observed_at":"2026-08-05T20:42:29.229183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:42:29.802960Z","title":null,"venue":null,"work_id":"e23b9202-faf9-487e-8b1e-eaaf9c365c1a","year":null},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:26.014953Z"},"links":{"citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:d62fa084f22c5ef6c98f2004fcb70b8e9692600b16ee6458c7070e22ae4d8fc7","observation_id":"4d574ce2-60c9-4318-bd91-67fd9d6ea4c8","resolution":{"observed_at":"2026-08-05T20:42:29.852447Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:42:29.648136Z","title":"COMMONSENSE CONTEXT","venue":null,"work_id":"b00f0682-4dcd-4e8b-9f95-20314d845509","year":null},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:26.087125Z"},"links":{"citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:623fd0454f77c85afee9abb9dbbc643166b791766eb19cf111a344a84124196f","observation_id":"653882ee-1ba6-4dde-9acd-dca283cdd9d0","resolution":{"observed_at":"2026-08-05T20:42:29.711514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:42:29.496641Z","title":"EXPANDED COMMONSENSE CONTEXT","venue":null,"work_id":"282bafc0-e17a-4126-991d-e90a31e411e2","year":null},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:26.154662Z"},"links":{"citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:7069a6d3d61feb1d239c474af721a6ec69c18c1af3ec3923eca3155ea778606d","observation_id":"3867baad-b984-4f58-8085-5ed3b53efcb6","resolution":{"observed_at":"2026-08-05T20:42:29.563002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:42:29.383048Z","title":null,"venue":null,"work_id":"a2054178-ee42-4ff1-8688-77c0d74928f8","year":null},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:26.223068Z"},"links":{"citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:b7bd07f459a4648dae5227b3b922b93a79ed3f908c6277a18aebac9e129ca4cd","observation_id":"47c17f4a-a912-419c-a6aa-88f55bcdc00c","resolution":{"observed_at":"2026-08-05T20:42:29.435796Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:42:29.075310Z","title":"commonsense_context","venue":null,"work_id":"b650a3ab-4725-4b5c-8197-7f0680211207","year":null},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:26.469662Z"},"links":{"citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:05c2a7fde9a1633e9c2d642527b461ab4fc6e833ef459d1d55d281b088568305","observation_id":"eb47895f-fdb4-4ab2-a1c0-63d278f0b6b5","resolution":{"observed_at":"2026-08-05T20:42:29.113686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:42:28.937871Z","title":"commonsense_question","venue":null,"work_id":"90a8cda2-edc2-40e4-92a9-121913bcf8ef","year":null},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:26.541375Z"},"links":{"citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:d6b254c4e1fa6b1d4f7da34f633fb937891a5447e5d1196c07f029a00b8eacb1","observation_id":"d4d587f2-05ce-43ad-9f3d-1825cb7b199b","resolution":{"observed_at":"2026-08-05T20:42:28.995264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:42:28.786362Z","title":"commonsense_question","venue":null,"work_id":"95ae43c9-3fdd-40b4-9039-c285641f1070","year":null},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:26.600193Z"},"links":{"citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:056b73c6e219740a7a08824da8d0ec6e0321c9208d3284437cd3ee4759e39530","observation_id":"fa310c38-59dd-440c-9163-652ca0d33f50","resolution":{"observed_at":"2026-08-05T20:42:28.870024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:42:28.636929Z","title":"REASONING PROCESS","venue":null,"work_id":"6df07236-c0c9-4c1c-8642-96f884dd623b","year":null},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:26.652163Z"},"links":{"citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:e54b56da3d96b0d77f0664775d42bc790e12711ea9d757a1564eed291a94fc44","observation_id":"363cbcda-f5c2-47b3-8b87-147494ac359c","resolution":{"observed_at":"2026-08-05T20:42:28.688199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:42:28.491558Z","title":null,"venue":null,"work_id":"4944f91d-6d07-4ae0-8987-fd23daf59567","year":null},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:26.693061Z"},"links":{"citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:2225443d0ebeecb604a128859a0cdd09f2fa2691cd7ac6c7a6aa3a467935fdf5","observation_id":"0106ab19-81a3-4029-9547-dcc87e608f7a","resolution":{"observed_at":"2026-08-05T20:42:28.547953Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:42:28.346897Z","title":"reasoning","venue":null,"work_id":"5dbbcf7b-168a-47e4-b2b8-3a9bb000fd07","year":null},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:26.803982Z"},"links":{"citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:1a85bf03ae7303f61f39cb6469879dd775f03e4bca26099d612029dd68b7e049","observation_id":"56890621-6f15-4662-a16f-caad9b6a36c2","resolution":{"observed_at":"2026-08-05T20:42:28.403940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:42:28.208170Z","title":null,"venue":null,"work_id":"c79f8838-6dab-4221-948a-08c95c482f0b","year":null},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:26.870788Z"},"links":{"citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:7380fdb3c4f9d0249baac5f0f17b95ebdb4de2ccfbe870309494f25f2855bad4","observation_id":"55971b25-24e9-4cbc-a6f8-ac9381f8d212","resolution":{"observed_at":"2026-08-05T20:42:28.263384Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:42:28.057993Z","title":"COMMONSENSE CONTEXT","venue":null,"work_id":"f8db90a1-01f3-4d49-b5ba-119845949c7f","year":null},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:26.926137Z"},"links":{"citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:f73514bf34808494f19351ce5c62a681aab5f653652c8626ec47f5bfd13c9c20","observation_id":"935278bb-579c-47eb-9c6a-2f1fe716fb28","resolution":{"observed_at":"2026-08-05T20:42:28.114713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:42:27.886086Z","title":"Commonsense Question","venue":null,"work_id":"a60e6101-df2a-426a-88c0-ba9c74542d8d","year":null},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:26.990822Z"},"links":{"citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:39d6bd57e3dc25e564660417eec33e39c4063f4decf60b94188a1b19738c30e3","observation_id":"6a35c21b-eafa-4190-9469-406a0f0dd67b","resolution":{"observed_at":"2026-08-05T20:42:27.965972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:42:27.732623Z","title":"Two of which should be plausible options","venue":null,"work_id":"5a89f75b-a87a-4ba5-83bc-19370da2fccb","year":null},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:27.043702Z"},"links":{"citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:ddd6873e1026320acdad9f59d39ae446805fa9c6dcf07c15dd9526cad5015e42","observation_id":"061a0f9e-0563-49f4-abd0-467ccd556d83","resolution":{"observed_at":"2026-08-05T20:42:27.787805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:42:27.554262Z","title":"REASONING PROCESS","venue":null,"work_id":"e9f4b045-f0fe-4d01-aa1b-629e13f88476","year":null},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:27.127824Z"},"links":{"citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:10b9d815ee0cc9094b108859f4af5a3d51f9d3451478e9abff61d676042c5187","observation_id":"461071f7-42ce-43de-821e-d733510dd029","resolution":{"observed_at":"2026-08-05T20:42:27.635417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:42:27.392631Z","title":"commonsense_context","venue":null,"work_id":"9edab120-b703-42eb-be1f-5a070c21e669","year":null},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:27.195151Z"},"links":{"citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:ab22b0dddd59d0310cc0fb062ec7c325aa5e5ad613d14d9e72af0df185118315","observation_id":"ee3e8e39-420a-4ab3-b096-7303fd360591","resolution":{"observed_at":"2026-08-05T20:42:27.477393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-08-14T11:38:51.383664Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-05T20:42:25.278716Z","title":"Niklas Muennighoff, Zitong Yang, Weijia Shi, Xiang Lisa Li, Li Fei-Fei, Hannaneh Hajishirzi, Luke Zettlemoyer, Percy Liang, Emmanuel J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:25.278716Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:218e71e9a70ef0a00de04f17b0179d9c44eeec8586a98d1c6ba8587947a58bbd","observation_id":"d2e03c0c-1e7e-4511-91a8-3413961853e4","resolution":{"observed_at":"2026-08-05T20:42:25.278716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:42:25.384777Z","title":"Mirac Suzgun, Nathan Scales, Nathanael Schärli, Sebastian Gehrmann, Yi Tay, Hyung Won Chung, Aakanksha Chowdhery, Quoc V","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":604,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:25.384777Z"},"links":{"citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:79692ab2055720081e1fdd45da2292f9c85e2449090f48ad2e18ebd07d91386d","observation_id":"1c57d11a-19b6-45e9-a64a-b4545c014074","resolution":{"observed_at":"2026-08-05T20:42:25.384777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14405","last_updated":"2024-11-25T17:57:55Z","snapshot_observed_at":"2026-08-12T15:10:50.113705Z","submitted_at":"2024-11-21T18:37:33Z","title":"Marco-o1: Towards Open Reasoning Models for Open-Ended Solutions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14405","snapshot_observed_at":"2026-08-05T20:42:25.531473Z","title":"inductive_reasoning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":824,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:25.531473Z"},"links":{"cited_paper":"/paper/2411.14405","citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:a07d57bf8387de11c6a47aacc20c0c0cca3d6ddaafc934c71db2ab00f2ac8ffe","observation_id":"fe9a17e4-9563-4ca7-b102-62f4fde08823","resolution":{"observed_at":"2026-08-05T20:42:25.531473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-05T20:42:25.167561Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:25.167561Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:a2093a1237d967c05f5fbf372b5518708c1a184a9f722af647b00af4926fdbf5","observation_id":"c12f0c06-c8db-46df-9880-63f9bf97c52f","resolution":{"observed_at":"2026-08-05T20:42:25.167561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-05T20:42:25.375339Z","title":"URL https://doi.org/10.48550/arXiv.2408","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T20:42:25.375339Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2508.10137"},"observation_digest":"sha256:d1420f81fd56a127ba91b76aae46ae003e2812cc9c74f3d7227f0ec0ee403ff8","observation_id":"9cb56f62-586d-4c64-976a-2878c805e411","resolution":{"observed_at":"2026-08-05T20:42:25.375339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.10137","last_updated":"2025-08-13T18:59:02Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T01:20:19.772392Z","submitted_at":"2025-08-13T18:59:02Z","title":"mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":17},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 1 inbound Pith citation observation for arXiv:2508.10137."}