{"as_of":"2026-08-19T04:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:965ce398f52dc9f2d4368b0576ef95a92577e59c790aa344f7734cf90496a21a","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:42:07.631907Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:33:12.754141Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T08:59:42.593762Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00662","snapshot_observed_at":"2026-08-15T20:33:12.754141Z","title":"Deepcritic: Deliberate critique with large language models.arXiv preprint arXiv:2505.00662, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12744","last_updated":"2025-05-19T06:00:14Z","snapshot_observed_at":"2026-08-17T20:30:55.214558Z","submitted_at":"2025-05-19T06:00:14Z","title":"Incentivizing Multimodal Reasoning in Large Models for Direct Robot Manipulation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T20:33:12.754141Z"},"links":{"cited_paper":"/paper/2505.00662","citing_paper":"/paper/2505.12744"},"observation_digest":"sha256:1d1d1850e2c898c3cdf7111a8cf6b37fb31e2f9f2226f5eb8d3cd4efaf48d28a","observation_id":"7ad22a85-1b4c-49bd-8103-98a1074fff65","resolution":{"observed_at":"2026-08-15T20:33:12.754141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00662","snapshot_observed_at":"2026-08-07T15:15:42.269555Z","title":"Deepcritic: Deliberate critique with large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15804","last_updated":"2025-07-10T17:36:35Z","snapshot_observed_at":"2026-08-15T01:57:06.575191Z","submitted_at":"2025-05-21T17:57:38Z","title":"STAR-R1: Spatial TrAnsformation Reasoning by Reinforcing Multimodal LLMs","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:42.269555Z"},"links":{"cited_paper":"/paper/2505.00662","citing_paper":"/paper/2505.15804"},"observation_digest":"sha256:fad8b680f0b7bfdf8c8fa0149a526b703e42be18449f164b2902e5372624a3ae","observation_id":"a6d0a0dc-20a9-4b37-b7ad-11ab42174270","resolution":{"observed_at":"2026-08-07T15:15:42.269555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00662","snapshot_observed_at":"2026-08-06T15:47:33.218455Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.15024","last_updated":"2025-07-20T16:19:51Z","snapshot_observed_at":"2026-08-15T06:24:01.751486Z","submitted_at":"2025-07-20T16:19:51Z","title":"RefCritic: Training Long Chain-of-Thought Critic Models with Refinement Feedback","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T15:47:33.218455Z"},"links":{"cited_paper":"/paper/2505.00662","citing_paper":"/paper/2507.15024"},"observation_digest":"sha256:ec8c143497648c7203f1e68b16d011b2bb8009f1af0de52e540114b75aa8291f","observation_id":"294f5c9b-2f2c-4f5c-84ac-77f27ec6074b","resolution":{"observed_at":"2026-08-06T15:47:33.218455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.00662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.00662","snapshot_observed_at":"2026-07-04T08:59:42.593762Z","title":"Deepcritic: Deliberate critique with large language models","venue":null,"work_id":"c6b99d3d-9e56-4e97-85fd-32313514513d","year":2025},"citing_paper":{"arxiv_id":"2605.15113","last_updated":"2026-05-18T19:19:17Z","snapshot_observed_at":"2026-08-15T21:20:33.403754Z","submitted_at":"2026-05-14T17:27:34Z","title":"Learning from Language Feedback via Variational Policy Distillation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-20T20:34:36.764090Z"},"links":{"cited_paper":"/paper/2505.00662","citing_paper":"/paper/2605.15113"},"observation_digest":"sha256:3b62f83faff6f772a5d1895ada4decae6a80135f7cd979fb6f95bc2c57416b57","observation_id":"0adfb6db-1cd0-4732-b701-6c23138684ff","resolution":{"observed_at":"2026-05-20T20:39:00.278336Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.00662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.00662","snapshot_observed_at":"2026-07-04T08:59:42.593762Z","title":"Deepcritic: Deliberate critique with large language models","venue":null,"work_id":"c6b99d3d-9e56-4e97-85fd-32313514513d","year":2025},"citing_paper":{"arxiv_id":"2606.01249","last_updated":"2026-06-17T04:44:10Z","snapshot_observed_at":"2026-08-12T03:28:30.781632Z","submitted_at":"2026-05-31T14:04:51Z","title":"Trust Region On-Policy Distillation","version":3},"reference_index":166,"source":"arxiv_source","source_observed_at":"2026-06-28T17:38:50.313305Z"},"links":{"cited_paper":"/paper/2505.00662","citing_paper":"/paper/2606.01249"},"observation_digest":"sha256:cafaa9435950f0fb47cddd1ded8c851d98431f8dc5c4af4c66a9958f9d510195","observation_id":"77ea421a-ac94-4d5a-967e-d6d653576187","resolution":{"observed_at":"2026-07-01T20:56:13.195536Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.00662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.00662","snapshot_observed_at":"2026-07-04T08:59:42.593762Z","title":"Deepcritic: Deliberate critique with large language models","venue":null,"work_id":"c6b99d3d-9e56-4e97-85fd-32313514513d","year":2025},"citing_paper":{"arxiv_id":"2606.22600","last_updated":"2026-06-26T02:45:32Z","snapshot_observed_at":"2026-08-08T07:09:29.965305Z","submitted_at":"2026-06-21T17:20:21Z","title":"On the Position Bias of On-Policy Distillation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-26T10:45:16.028763Z"},"links":{"cited_paper":"/paper/2505.00662","citing_paper":"/paper/2606.22600"},"observation_digest":"sha256:793ccce7e529b8078d8c1a3102ec8e10174606a59d65976aedd3f8eb16b3fd86","observation_id":"e9dfcf63-bd6a-4d79-881c-fefce6088ff4","resolution":{"observed_at":"2026-07-04T08:59:42.595312Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.00662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.00662","snapshot_observed_at":"2026-07-04T08:59:42.593762Z","title":"Deepcritic: Deliberate critique with large language models","venue":null,"work_id":"c6b99d3d-9e56-4e97-85fd-32313514513d","year":2025},"citing_paper":{"arxiv_id":"2606.22600","last_updated":"2026-06-26T02:45:32Z","snapshot_observed_at":"2026-08-08T07:09:29.965305Z","submitted_at":"2026-06-21T17:20:21Z","title":"On the Position Bias of On-Policy Distillation","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-29T05:14:12.795412Z"},"links":{"cited_paper":"/paper/2505.00662","citing_paper":"/paper/2606.22600"},"observation_digest":"sha256:15780e130182968027fca67edfd3b0f8e8045c11c0dcf4ba0749aad63b740da6","observation_id":"b1822564-c25c-469d-a5c0-99b73532b58e","resolution":{"observed_at":"2026-06-29T18:13:49.287630Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00662","snapshot_observed_at":"2026-08-06T04:30:44.844166Z","title":"DeepCritic: Deliberate critique with large language models.arXiv preprint arXiv:2505.00662, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05139","last_updated":"2026-08-05T17:57:16Z","snapshot_observed_at":"2026-08-16T00:16:25.626489Z","submitted_at":"2026-08-05T17:57:16Z","title":"Toward Skill-Native LLMs: Skill Entropy for Benchmarking and Training Long-Horizon Reasoning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T04:30:44.844166Z"},"links":{"cited_paper":"/paper/2505.00662","citing_paper":"/paper/2608.05139"},"observation_digest":"sha256:5ca8d83a9043634fd0a7aaede3e6a97a8acd7ed0dbf638438a2cbccc87d94407","observation_id":"4be92d90-751e-4fa9-88f4-907765b67579","resolution":{"observed_at":"2026-08-06T04:30:44.844166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.00662/citation-record","integrity":"/paper/2505.00662/integrity","json":"/paper/2505.00662/citation-record.json","paper":"/paper/2505.00662"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-16T04:42:07.317706Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.317706Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:b7dc9530c830a640c6a658a9e8cc8ba4d269f07abb712f0e80c06fe32da8b96e","observation_id":"e42d56a4-ed69-4971-9198-49baa36b08d5","resolution":{"observed_at":"2026-08-16T04:42:07.317706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.03540","last_updated":"2022-11-11T20:17:18Z","snapshot_observed_at":"2026-07-06T14:15:17.474527Z","submitted_at":"2022-11-04T17:03:49Z","title":"Measuring Progress on Scalable Oversight for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.03540","snapshot_observed_at":"2026-08-16T04:42:07.324494Z","title":"Measuring progress on scalable oversight for large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.324494Z"},"links":{"cited_paper":"/paper/2211.03540","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:4b86f45e1321def0c311ee8de6d7dcfdda30110f88d2d4db87715d2809dd159b","observation_id":"97709941-4e7e-403b-8b0e-d25b482973ae","resolution":{"observed_at":"2026-08-16T04:42:07.324494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:08.740092Z","title":"Weak-to-strong generalization: eliciting strong capabilities with weak supervision","venue":null,"work_id":"d05500ae-2e40-4f49-ae4d-92390ddb48ff","year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.330356Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:3d145f199d48b54bb0cd2ba9a3b7f94c4277ccea767a1778a59e8d86727ef5fc","observation_id":"974dbcc6-c96d-4fde-8125-1a26d0070a00","resolution":{"observed_at":"2026-08-16T04:42:08.745240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-16T04:42:07.335493Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.335493Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:60fb2d5059f71dfe0bf68c581ffcbe3f0ea5d5b3f6379c6d936a0fa98fe2e90c","observation_id":"58091933-36c6-4c93-8183-71165a77637c","resolution":{"observed_at":"2026-08-16T04:42:07.335493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01456","last_updated":"2025-09-26T09:25:31Z","snapshot_observed_at":"2026-08-17T04:59:59.434643Z","submitted_at":"2025-02-03T15:43:48Z","title":"Process Reinforcement through Implicit Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01456","snapshot_observed_at":"2026-08-16T04:42:07.340445Z","title":"Process reinforcement through implicit rewards","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.340445Z"},"links":{"cited_paper":"/paper/2502.01456","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:25d5c19f62b3e4275f51539ca158daeb7b5157c00f85966d39eeda51016c998b","observation_id":"834a1e4a-85ab-415e-953f-d961c5e5d81d","resolution":{"observed_at":"2026-08-16T04:42:07.340445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:08.720927Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning, 1 2025","venue":null,"work_id":"12cdde49-5085-4fe4-9afe-1634880b0217","year":2025},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.345722Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:022f2a5b1c43ee896c819f338d5c43b3efa67f94a33bd7ed125187242038e9bf","observation_id":"94cf3d7d-e678-41fb-9ac3-b0e1ed4250ab","resolution":{"observed_at":"2026-08-16T04:42:08.727785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14024","last_updated":"2024-10-18T06:59:24Z","snapshot_observed_at":"2026-08-17T20:26:15.867804Z","submitted_at":"2024-06-20T06:42:27Z","title":"LLM Critics Help Catch Bugs in Mathematics: Towards a Better Mathematical Verifier with Natural Language Feedback","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14024","snapshot_observed_at":"2026-08-16T04:42:07.350521Z","title":"Llm critics help catch bugs in mathematics: Towards a better mathematical verifier with natural language feedback","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.350521Z"},"links":{"cited_paper":"/paper/2406.14024","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:b797c9df3da383a4be23043ae3021c80b27009e346a9d4edc039698a2cceab4b","observation_id":"f1964553-28bf-472a-b7f9-3e833c5e482a","resolution":{"observed_at":"2026-08-16T04:42:07.350521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07985","last_updated":"2024-12-24T04:04:30Z","snapshot_observed_at":"2026-08-16T19:47:24.627230Z","submitted_at":"2024-10-10T14:39:33Z","title":"Omni-MATH: A Universal Olympiad Level Mathematic Benchmark For Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07985","snapshot_observed_at":"2026-08-16T04:42:07.357477Z","title":"Omni-math: A universal olympiad level mathematic benchmark for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.357477Z"},"links":{"cited_paper":"/paper/2410.07985","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:bd72c02ef4887ca4f2965cc315b9b5f8f314202ac6dbd71e518186e482f357f0","observation_id":"4cb44d9c-21ac-4edb-8823-fc9806cb49c2","resolution":{"observed_at":"2026-08-16T04:42:07.357477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:07.363469Z","title":"Did aristotle use a laptop? a question answering benchmark with implicit reasoning strategies","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.363469Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:efc5c7d34ea151ba9c31f5e2faa7e49c1e7664e66d1d448b896a6713bd198ee3","observation_id":"7ada40ff-c93d-4c04-8283-0d75bf02d69e","resolution":{"observed_at":"2026-08-16T04:42:07.363469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-13T06:43:22.011336Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-16T04:42:07.368099Z","title":"A survey on llm-as-a-judge","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.368099Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:9fe222c0dceb4c1a3fef107f2f3cfc7bbaabb881024845ab13a19ab25c042e18","observation_id":"f4fd0dfa-5f83-4b1e-9743-9523b5310af5","resolution":{"observed_at":"2026-08-16T04:42:07.368099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:07.373472Z","title":"Olympiadbench: A challenging benchmark for promoting agi with olympiad-level bilingual multimodal scientific problems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.373472Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:39890b7595bd1acaf90c4a6c112b7dae889a6dc6d09066dfee1ba1e86b679772","observation_id":"86df7ff2-6425-4b53-a235-f777e8d1aef3","resolution":{"observed_at":"2026-08-16T04:42:07.373472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:07.378980Z","title":"Measuring mathematical problem solving with the MATH dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.378980Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:b63b2922c566f413f027d8c0eb4a9915ee4f4d6ed7bb14e4ede709f8a4acc227","observation_id":"afa0f929-3068-408e-b4d8-5e08b9962d8a","resolution":{"observed_at":"2026-08-16T04:42:07.378980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24290","last_updated":"2025-07-05T09:01:04Z","snapshot_observed_at":"2026-08-12T18:49:18.486177Z","submitted_at":"2025-03-31T16:36:05Z","title":"Open-Reasoner-Zero: An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.24290","snapshot_observed_at":"2026-08-16T04:42:07.384330Z","title":"Open-reasoner-zero: An open source approach to scaling up reinforcement learning on the base model, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.384330Z"},"links":{"cited_paper":"/paper/2503.24290","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:d5d89fe3ce3ab708d0bd0b8bcbfb61c964a8847bbd8e8282e1eb7995c6703c41","observation_id":"2ed360aa-ba13-4d0d-867d-da9a2c1792e8","resolution":{"observed_at":"2026-08-16T04:42:07.384330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-16T04:42:07.389372Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.389372Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:c3ab317c81f922f4a4ad3441e21a0d57538150e2155c202161e66555dbae938e","observation_id":"ed949d4b-fa91-4c34-b842-1edb570e7e07","resolution":{"observed_at":"2026-08-16T04:42:07.389372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-16T04:42:07.394077Z","title":"Gpt-4o system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.394077Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:86c800d5246ce3cd5256b394c7475d5abf74fc4b0f848bd16e371047738eb5b3","observation_id":"eaa2dc00-54d4-4ff4-8b56-14596bd123ed","resolution":{"observed_at":"2026-08-16T04:42:07.394077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:07.398733Z","title":"SWE-bench: Can language models resolve real-world github issues? In The Twelfth International Conference on Learning Representations , 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.398733Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:9ae99f539a38ebc93e5011e9f70c36765b1b3c95e385b49ded556a0ac765c6ed","observation_id":"396c3529-11e2-46cf-a865-73c2399f4c04","resolution":{"observed_at":"2026-08-16T04:42:07.398733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:07.403127Z","title":"CritiqueLLM: Towards an informative critique generation model for evaluation of large language model generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.403127Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:548a04aa6944de96c5958361afcc9e181bc55345da2087b53f6583e0d1d7ab68","observation_id":"fb363920-1f2e-4432-b755-767485c1fcc0","resolution":{"observed_at":"2026-08-16T04:42:07.403127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18629","last_updated":"2024-06-26T17:43:06Z","snapshot_observed_at":"2026-08-06T00:24:52.274888Z","submitted_at":"2024-06-26T17:43:06Z","title":"Step-DPO: Step-wise Preference Optimization for Long-chain Reasoning of LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18629","snapshot_observed_at":"2026-08-16T04:42:07.407517Z","title":"Step- dpo: Step-wise preference optimization for long-chain reasoning of llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.407517Z"},"links":{"cited_paper":"/paper/2406.18629","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:4b31718cf9d7524e5ea4c409140062102ac3c3b6c3c757a43e8e9307de630f51","observation_id":"7c81debc-3edb-4cd7-b1ab-dfbd6175ec03","resolution":{"observed_at":"2026-08-16T04:42:07.407517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:08.647831Z","title":"Criticeval: Evaluating large-scale language model as critic","venue":null,"work_id":"9e2c0fd7-cc68-4159-a5a0-1dcb89199d9b","year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.414533Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:1b7418c0063e59f1a53171e01bc737a7fb2afbcfdcdb9a99d5c96b3c2a59390e","observation_id":"9e30f58a-6ea0-49e9-a8db-0ffef06400cb","resolution":{"observed_at":"2026-08-16T04:42:08.653006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:07.419993Z","title":"Numinamath: The largest public dataset in ai4maths with 860k pairs of competition math problems and solutions.Hugging Face repository, 13, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.419993Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:ee0d620ed6eba2c1e02d1026a2067a34ee96d565d3956d1532f9be2a94b36208","observation_id":"999f43f7-7c61-4f52-b32c-4b86dd9ae24c","resolution":{"observed_at":"2026-08-16T04:42:07.419993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:07.424948Z","title":"Let’s verify step by step","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.424948Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:3760ff15da8fcc3d7b25b0c7049722c315930b46160c4f21a81f7a825a307d3b","observation_id":"5da94829-b43a-4a47-82f0-61d7e8de933b","resolution":{"observed_at":"2026-08-16T04:42:07.424948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:08.609049Z","title":"Criticbench: Benchmarking llms for critique-correct reasoning","venue":null,"work_id":"5baae08a-90f6-40f5-abcd-ded9fffc779c","year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.429629Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:1b0fd6fd11060211cc2be9efba2bc4c008a934b669c697c255e20cd5d004b224","observation_id":"ecdd6e85-1949-4ec4-a055-f6f4d0187513","resolution":{"observed_at":"2026-08-16T04:42:08.613842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-18T18:18:37.449517Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-16T04:42:07.434620Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.434620Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:d72efaab53e18c58c7142741c0946b4cfbd186595de6d488d212ebb723abb069","observation_id":"0f19ef65-55ac-4db3-821e-0d069bf55d2d","resolution":{"observed_at":"2026-08-16T04:42:07.434620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04815","last_updated":"2023-10-07T14:12:15Z","snapshot_observed_at":"2026-08-18T09:48:57.383431Z","submitted_at":"2023-10-07T14:12:15Z","title":"Critique Ability of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04815","snapshot_observed_at":"2026-08-16T04:42:07.439664Z","title":"Critique ability of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.439664Z"},"links":{"cited_paper":"/paper/2310.04815","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:1dcc42d656a9d9f70b430d964963a4001845c9f04bfd694202e3f23b79fc30e4","observation_id":"bdaaf89d-ae88-44ef-855b-7de8c552d2b9","resolution":{"observed_at":"2026-08-16T04:42:07.439664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:08.593572Z","title":"Large language models surpass human experts in predicting neuroscience results","venue":null,"work_id":"1545126a-540e-44b1-93f9-5e57f0e421e3","year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.444552Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:87d1988b52959dd59493bccf0fe27e1b26ef79b8524556f0d4da9420bdbf18f0","observation_id":"c81d4b88-4319-4aed-88e1-39143338ec4e","resolution":{"observed_at":"2026-08-16T04:42:08.598780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:07.449197Z","title":"Self-refine: Iterative refinement with self-feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.449197Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:ffd1cf560f9536f3ca679bf188fc7166c20ec3871b1494deee4483c109c56804","observation_id":"20d355a4-f854-4e18-93d0-8d46c969a5a2","resolution":{"observed_at":"2026-08-16T04:42:07.449197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00215","last_updated":"2024-06-28T19:53:17Z","snapshot_observed_at":"2026-08-16T13:38:37.638259Z","submitted_at":"2024-06-28T19:53:17Z","title":"LLM Critics Help Catch LLM Bugs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00215","snapshot_observed_at":"2026-08-16T04:42:07.455016Z","title":"Llm critics help catch llm bugs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.455016Z"},"links":{"cited_paper":"/paper/2407.00215","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:e39a69fa187eb718ca4ac6b5ebdc2e9560194e08a3b304968d8d32e91bee1063","observation_id":"16947f13-c97c-49be-be09-eb5680b7a1da","resolution":{"observed_at":"2026-08-16T04:42:07.455016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:08.566133Z","title":"Introducing llama 3.1: Our most capable models to date","venue":null,"work_id":"e8509dd6-04d8-4177-ade1-91cc9c6d3605","year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.460454Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:ffe79c54dd0401febbcbdcdea08b0321d17117d828540a19a09208e121a98bc2","observation_id":"7e4b7420-ac85-46f0-9add-751533ef5f31","resolution":{"observed_at":"2026-08-16T04:42:08.571744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:08.550922Z","title":"Gpt-4 technical report","venue":null,"work_id":"e4149547-cd20-47e9-bcd7-254fc7a20a23","year":2023},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.467324Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:3fad2074c3e82aae4a2de98baac8372b4d0613c5cada9d42e471af902739b924","observation_id":"51b3585a-3780-4ce6-a985-b0df45b861ee","resolution":{"observed_at":"2026-08-16T04:42:08.555738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:08.533800Z","title":"Learning to reason with llms, 2024","venue":null,"work_id":"7fd524ba-4b70-40cb-9444-4541585ccc72","year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.472929Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:4c66300c89bda728ff19b0323f0d8900c2d83cb0760718a6f59b7c89d5a9a833","observation_id":"2263a578-60f4-4b7a-9483-504e085311bd","resolution":{"observed_at":"2026-08-16T04:42:08.539101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:07.477945Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.477945Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:e490e3f9e12c8c857ce0f516caf91b5a3b7f18ad6eebed0b22e1265f61e04fac","observation_id":"43493cf3-7a27-4d1a-b6c9-8aa9d60ebfa6","resolution":{"observed_at":"2026-08-16T04:42:07.477945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:08.506315Z","title":null,"venue":null,"work_id":"5bbf504f-96bf-440f-a509-1872df7a1a84","year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.483087Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:df2efb62f8897e8f0c45bb8fbad4dff7a809fa55d156537e378f4ab6466d9437","observation_id":"e6a338c6-d337-4365-86f1-3d9fc6a08dfa","resolution":{"observed_at":"2026-08-16T04:42:08.511696Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-18T14:12:03.598270Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-16T04:42:07.487682Z","title":"Gpqa: A graduate-level google-proof q&a benchmark","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.487682Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:6a09e1125f70505d30e23a15be6d71c7ec4bc24bd2d75b58d08fee623c55cefa","observation_id":"68b51c03-b63e-4cc7-8d6a-2a362ba22fc1","resolution":{"observed_at":"2026-08-16T04:42:07.487682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-08-18T03:59:39.242039Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-16T04:42:07.492622Z","title":"Code llama: Open foundation models for code","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.492622Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:0a694f3bbabd286525468ffc556af58af0f5d4333102c90ff0aa381e07da5e54","observation_id":"414be28f-41b5-4703-9fe1-20279d941be3","resolution":{"observed_at":"2026-08-16T04:42:07.492622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.05802","last_updated":"2022-06-14T01:16:24Z","snapshot_observed_at":"2026-08-17T23:43:35.193190Z","submitted_at":"2022-06-12T17:40:53Z","title":"Self-critiquing models for assisting human evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.05802","snapshot_observed_at":"2026-08-16T04:42:07.498292Z","title":"Self-critiquing models for assisting human evaluators","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.498292Z"},"links":{"cited_paper":"/paper/2206.05802","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:75d01e1c703a5152be7b2b9d00e12a10d1187f4be355ab958f625ca91c54d445","observation_id":"862ad342-2e92-4109-a88c-87d879528ab0","resolution":{"observed_at":"2026-08-16T04:42:07.498292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-16T04:42:07.503803Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.503803Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:f0f007a1a2ce96d2ec93d1fd5c85683fe53c7f32f379dde22744e6c0456a48bf","observation_id":"7b4398c8-083e-449a-80fa-388a1e743476","resolution":{"observed_at":"2026-08-16T04:42:07.503803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19256","last_updated":"2024-10-02T04:01:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-28T06:20:03Z","title":"HybridFlow: A Flexible and Efficient RLHF Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19256","snapshot_observed_at":"2026-08-16T04:42:07.508780Z","title":"Hybridflow: A flexible and efficient rlhf framework","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.508780Z"},"links":{"cited_paper":"/paper/2409.19256","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:4709b22fa12b99f28e7961d2a5d02972caade4be2b047e7ba9b5178faed38394","observation_id":"252de94a-084e-4b9e-a2c1-3bcbb4c1fb6c","resolution":{"observed_at":"2026-08-16T04:42:07.508780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05727","last_updated":"2025-08-04T02:14:13Z","snapshot_observed_at":"2026-08-17T10:36:22.614613Z","submitted_at":"2025-01-10T05:51:52Z","title":"Self-Evolving Critique Abilities in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.05727","snapshot_observed_at":"2026-08-16T04:42:07.514164Z","title":"Enabling scalable oversight via self-evolving critic","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.514164Z"},"links":{"cited_paper":"/paper/2501.05727","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:b5212cff66ce0b66bfd4253411110e2e876a0c4f8cdb4d84e4cc139d370ac2f3","observation_id":"e08fd443-e38d-4a79-8748-886103911a6e","resolution":{"observed_at":"2026-08-16T04:42:07.514164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.14275","last_updated":"2022-11-25T18:19:44Z","snapshot_observed_at":"2026-08-01T02:16:43.109337Z","submitted_at":"2022-11-25T18:19:44Z","title":"Solving math word problems with process- and outcome-based feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.14275","snapshot_observed_at":"2026-08-16T04:42:07.520370Z","title":"Solving math word problems with process-and outcome-based feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.520370Z"},"links":{"cited_paper":"/paper/2211.14275","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:fc5be46e5620df218dfa5f0a5a5b57aaef8afe34439f4d095ef437555c3a9458","observation_id":"4eeb2d92-23d1-471c-b2a0-9f6a5df4b901","resolution":{"observed_at":"2026-08-16T04:42:07.520370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:07.526357Z","title":"Math-shepherd: Verify and reinforce llms step-by-step without human annotations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.526357Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:d1dc30041296988e770dd82e2339f3822397a6d8964215cbe82f60c1b5aeaa1f","observation_id":"c04e9fba-3e72-44ac-8210-4af93296e8de","resolution":{"observed_at":"2026-08-16T04:42:07.526357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:07.531677Z","title":"Chi, Sharan Narang, Aakanksha Chowdhery, and Denny Zhou","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.531677Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:c45c5f0d8de9700a97f1d24d608f3a5a4f4f0d6308b22c6ea2249567a0ac6e4f","observation_id":"e5e53525-f12a-4b5f-b6d7-a937858a5c34","resolution":{"observed_at":"2026-08-16T04:42:07.531677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19594","last_updated":"2024-07-30T01:38:06Z","snapshot_observed_at":"2026-08-16T13:30:25.003501Z","submitted_at":"2024-07-28T21:58:28Z","title":"Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19594","snapshot_observed_at":"2026-08-16T04:42:07.537404Z","title":"Meta-rewarding language models: Self-improving alignment with llm-as-a-meta-judge","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.537404Z"},"links":{"cited_paper":"/paper/2407.19594","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:27afc92f156cd28c83c3d19be9f1bb72c8facf7f5c6c1f4b098e624bac531344","observation_id":"4e2ab938-56c2-4a43-937b-90c45b2b7bd2","resolution":{"observed_at":"2026-08-16T04:42:07.537404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:07.543491Z","title":"Scaling inference computation: Compute-optimal inference for problem-solving with language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.543491Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:0b310449d1fad0d3f84cb341a662eeccd2345bc209a60a5ea938664b0f42c3c1","observation_id":"8970a22a-d1f2-417a-9064-b1a31b231a7f","resolution":{"observed_at":"2026-08-16T04:42:07.543491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16579","last_updated":"2024-11-25T17:11:54Z","snapshot_observed_at":"2026-08-12T12:55:35.142701Z","submitted_at":"2024-11-25T17:11:54Z","title":"Enhancing LLM Reasoning via Critique Models with Test-Time and Training-Time Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16579","snapshot_observed_at":"2026-08-16T04:42:07.548871Z","title":"Enhancing llm reasoning via critique models with test-time and training-time supervision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.548871Z"},"links":{"cited_paper":"/paper/2411.16579","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:6258a6034b93f7f674c071563b59bad474a035743152435062a9299ad6da7ef8","observation_id":"f05c4ddc-291c-42be-9d43-0b10c6a9e8a7","resolution":{"observed_at":"2026-08-16T04:42:07.548871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:07.554782Z","title":"Teaching language models to critique via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.554782Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:9d3cb5da5e54a52656efcad604c08b4a57cd073e580d949bfb0857c993a8bacb","observation_id":"5c3e3503-df2d-442f-b5ac-f3c754546b83","resolution":{"observed_at":"2026-08-16T04:42:07.554782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:08.459212Z","title":"An implementation of generative prm, 2024","venue":null,"work_id":"4ade330b-9c93-4e1e-8efe-0072b4f3a070","year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.559632Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:53fef8a1b16a1c1bafdebc01615bc7d950c6c311ac9225618d5975bb59a1d354","observation_id":"44e5e0e3-c221-4b39-81ab-fc65524dd9dc","resolution":{"observed_at":"2026-08-16T04:42:08.464111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:07.564784Z","title":"An implementation of generative prm","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.564784Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:cbea122a768e7f2054d6e98497a9a2b8484c39f345806513719101488afe4a46","observation_id":"96d41639-67de-44bb-ae50-0a44c4202d45","resolution":{"observed_at":"2026-08-16T04:42:07.564784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-08-17T18:51:13.219936Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-16T04:42:07.571613Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.571613Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:2c2953744a98a15b74e0f93dcc3338dd8345878ab986851759f9b7010af579a7","observation_id":"aa0bb897-b685-47ce-a3da-7324de9580db","resolution":{"observed_at":"2026-08-16T04:42:07.571613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11431","last_updated":"2025-02-28T13:43:17Z","snapshot_observed_at":"2026-08-17T04:07:17.690389Z","submitted_at":"2024-06-17T11:36:39Z","title":"Super(ficial)-alignment: Strong Models May Deceive Weak Models in Weak-to-Strong Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11431","snapshot_observed_at":"2026-08-16T04:42:07.576514Z","title":"Super (ficial)-alignment: Strong models may deceive weak models in weak-to-strong generalization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.576514Z"},"links":{"cited_paper":"/paper/2406.11431","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:89f6b298b1a2c434f8b6f76b469c53b787a7865cc06fdc3110959951847d7778","observation_id":"04121c85-a2ec-4fce-afe8-8696e9dc1d72","resolution":{"observed_at":"2026-08-16T04:42:07.576514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:07.581313Z","title":"Towards thinking-optimal scaling of test-time compute for llm reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.581313Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:fb05474be7316f58c0bf4530977f7c0209bba12552eb825d2d2b4925ece6bf4e","observation_id":"651ff0c2-1952-4f53-9df8-672228e0031a","resolution":{"observed_at":"2026-08-16T04:42:07.581313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:08.426812Z","title":"Metamath: Bootstrap your own mathematical questions for large language models","venue":null,"work_id":"7a589309-3207-4785-b4e7-baaf3c2ea990","year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.585986Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:41ba2d182003a5a535b9a1e100029054190d6743457d6a0aeee074ab3efb4042","observation_id":"3aff4f65-2a08-4fac-81ce-af5f7bdf339a","resolution":{"observed_at":"2026-08-16T04:42:08.432337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10020","last_updated":"2025-03-28T00:06:51Z","snapshot_observed_at":"2026-08-15T01:20:08.134494Z","submitted_at":"2024-01-18T14:43:47Z","title":"Self-Rewarding Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10020","snapshot_observed_at":"2026-08-16T04:42:07.590588Z","title":"Self-rewarding language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.590588Z"},"links":{"cited_paper":"/paper/2401.10020","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:ce925b08d0f284db2a655aebb051805da86ab2b52b36a5af530c3339678566bc","observation_id":"47a06cc0-8abd-4003-a8b6-86a8ea8635c7","resolution":{"observed_at":"2026-08-16T04:42:07.590588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17080","last_updated":"2024-06-05T04:05:42Z","snapshot_observed_at":"2026-08-16T14:31:08.951193Z","submitted_at":"2023-12-28T15:49:43Z","title":"MR-GSM8K: A Meta-Reasoning Benchmark for Large Language Model Evaluation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17080","snapshot_observed_at":"2026-08-16T04:42:07.595607Z","title":"Mr-gsm8k: A meta- reasoning benchmark for large language model evaluation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.595607Z"},"links":{"cited_paper":"/paper/2312.17080","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:edb178a7fd92015936c522e2658c65ffadd5045bbbf3d6f4cb07273fa44356f2","observation_id":"e57c6abf-80d9-40b1-9b90-c4595c6e3bee","resolution":{"observed_at":"2026-08-16T04:42:07.595607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06559","last_updated":"2025-05-26T14:03:32Z","snapshot_observed_at":"2026-08-14T07:02:14.518172Z","submitted_at":"2024-12-09T15:11:40Z","title":"ProcessBench: Identifying Process Errors in Mathematical Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06559","snapshot_observed_at":"2026-08-16T04:42:07.600475Z","title":"Processbench: Identifying process errors in mathematical reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.600475Z"},"links":{"cited_paper":"/paper/2412.06559","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:46b7c4fa8ab891d6443878a9c5a4556e6d7c5cfc42fec9aad0fc0d8ac04a6911","observation_id":"db65d28f-b8d7-4bdd-9896-2e52600b7259","resolution":{"observed_at":"2026-08-16T04:42:07.600475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:08.408987Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena","venue":null,"work_id":"a2a3a4b8-c36e-44ce-925f-7f5a24bbb93e","year":2023},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.605348Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:e9a340b0c3b6b3949ecdbb2132fad67759a1fd04db9df5c1e527fc4ea72fde68","observation_id":"57ff0c52-adc4-4134-a911-bedbda4c35c1","resolution":{"observed_at":"2026-08-16T04:42:08.415325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16326","last_updated":"2025-06-11T02:01:02Z","snapshot_observed_at":"2026-08-18T16:46:10.900711Z","submitted_at":"2024-08-29T08:02:09Z","title":"Critic-CoT: Boosting the reasoning abilities of large language model via Chain-of-thoughts Critic","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16326","snapshot_observed_at":"2026-08-16T04:42:07.611186Z","title":"#### The correctness of Step <current_step> is: \\boxed{1|-1}","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.611186Z"},"links":{"cited_paper":"/paper/2408.16326","citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:e8fc108e88ee5d1d5c7b466ff97678c281394575442556254350c02be295b1fa","observation_id":"67ebcffe-0f8f-462b-a129-f234fbadc9c7","resolution":{"observed_at":"2026-08-16T04:42:07.611186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:08.392963Z","title":null,"venue":null,"work_id":"5a513491-3d97-4e55-a11f-229e45a08c66","year":null},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.617044Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:75f87f453775bed8a47d3206c60a67e887bc7d6889e84072095fe143060cf4b4","observation_id":"2bd3c7c6-1689-44fa-a671-286c4057c856","resolution":{"observed_at":"2026-08-16T04:42:08.397944Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:08.375683Z","title":null,"venue":null,"work_id":"d5680f7e-e731-4c11-a37d-90a2b3376ffc","year":null},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.621954Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:9324908e08393eb9b72748e989835c45a364518b73d92a21b578900c845941e1","observation_id":"78dafb33-6032-45bf-8069-b20d261107b8","resolution":{"observed_at":"2026-08-16T04:42:08.380893Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:08.358245Z","title":null,"venue":null,"work_id":"b1b7b495-5f0f-458f-8d32-63f474ac05fd","year":null},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.627321Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:1567095e55cced29c7348cde9deab092b2388aeaab1c1ee761327db259cc8424","observation_id":"9b9d03c9-3229-416b-a452-e3ab2c57deb0","resolution":{"observed_at":"2026-08-16T04:42:08.363218Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:08.341199Z","title":"erroneous","venue":null,"work_id":"0ba6646a-d657-478e-97ae-61ead9b073f7","year":null},"citing_paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:07.631907Z"},"links":{"citing_paper":"/paper/2505.00662"},"observation_digest":"sha256:06a76819fd32d1ab78436675c3bbdb0060dc5b601de67972b440cc085926b650","observation_id":"c5a96f44-7a9c-4d60-8628-311264c86cca","resolution":{"observed_at":"2026-08-16T04:42:08.347199Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.00662","last_updated":"2025-05-01T17:03:17Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T19:48:04.887471Z","submitted_at":"2025-05-01T17:03:17Z","title":"DeepCritic: Deliberate Critique with Large Language Models"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":48,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 8 inbound Pith citation observations for arXiv:2505.00662."}