{"as_of":"2026-08-10T06:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e185b36bda1385fb4d4232ece8c57bc35349efff86eb16bc4aab7d44a32b08da","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T05:08:12.800621Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T17:17:44.826139Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-28T17:22:25.112597Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"cited_work":{"arxiv_id":"2508.02186","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.02186","snapshot_observed_at":"2026-06-28T17:22:25.112597Z","title":"FailureCasesAreBetterLearnedButBoundarySaysSorry:Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","venue":null,"work_id":"c608dd86-1ccf-4d50-a1c2-bee734a330fa","year":2025},"citing_paper":{"arxiv_id":"2606.01437","last_updated":"2026-05-31T20:17:13Z","snapshot_observed_at":"2026-08-01T21:00:36.921047Z","submitted_at":"2026-05-31T20:17:13Z","title":"CEAR: Certified Ensemble Adversarial Robustness in DNNs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T17:17:44.826139Z"},"links":{"cited_paper":"/paper/2508.02186","citing_paper":"/paper/2606.01437"},"observation_digest":"sha256:5fbb8fefbc2244d350674ff55ddb673164a409e2db551a8b12aa8455877a5d6b","observation_id":"351497bb-0519-4a31-bf97-51810c72946f","resolution":{"observed_at":"2026-06-28T17:22:25.114443Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.02186/citation-record","integrity":"/paper/2508.02186/integrity","json":"/paper/2508.02186/citation-record.json","paper":"/paper/2508.02186"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-06T05:08:10.190896Z","title":"Openai o1 system card,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:10.190896Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:6e7595004de634f65de2d4dea104e1ae1ee26ca1b62e73323952dfe8b0cba93c","observation_id":"521ba75a-1329-4cd3-8f8d-ac40f3e50fdb","resolution":{"observed_at":"2026-08-06T05:08:10.190896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T05:08:10.256798Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:10.256798Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:9319b0a13dd68eeb86e213ff096e9b113c9486024d26bc8353044bfd8a6825da","observation_id":"40eaebf6-edc1-49c4-91ca-0bf36c606893","resolution":{"observed_at":"2026-08-06T05:08:10.256798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-06T05:08:10.374721Z","title":"Do not think that much for 2+ 3=? on the overthinking of o1-like llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:10.374721Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:7727cf8fab6cdb07880544bcc6107dcd843f0766553a1a2fcd9fc7119fa90e4c","observation_id":"d1eaec9f-8804-40ec-999b-ae1ddea56737","resolution":{"observed_at":"2026-08-06T05:08:10.374721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-07T04:27:23.738927Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-06T05:08:10.498742Z","title":"Stop overthinking: A survey on efficient reasoning for large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:10.498742Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:136204e9383b88dc49c0c6cd0a0ad7dc43011b8823e052f77c040c081f11296c","observation_id":"a327b30d-25c0-410c-ac2a-6739cbc9a188","resolution":{"observed_at":"2026-08-06T05:08:10.498742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"cited_work":{"arxiv_id":"2506.12353","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.12353","snapshot_observed_at":"2026-08-06T05:08:13.018927Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","venue":"cs.CL","work_id":"fabd6448-6a85-4741-9d54-4f5fa5f6c36b","year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:10.593722Z"},"links":{"cited_paper":"/paper/2506.12353","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:ec0c5fe867353c318d1a61a0d0adc4936b7546531ff16f98de95ba8ab67fd2b7","observation_id":"a2230aad-aa95-4a74-98f9-df858b7527ff","resolution":{"observed_at":"2026-08-06T05:08:13.098887Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:15.278343Z","title":"On reasoning strength planning in large reasoning models,","venue":null,"work_id":"a8323d3e-97ec-45f7-9370-752eb02676f9","year":2026},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:10.679983Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:12acd0b4549a90f4882e5a5a652fdab900f83defa484212c153fbd3f1b0e00f9","observation_id":"fab89506-7469-4de6-ab70-cddda240ce39","resolution":{"observed_at":"2026-08-06T05:08:15.343009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08343","last_updated":"2025-06-18T14:43:36Z","snapshot_observed_at":"2026-08-07T08:58:45.702180Z","submitted_at":"2025-06-10T01:54:04Z","title":"Wait, We Don't Need to \"Wait\"! Removing Thinking Tokens Improves Reasoning Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08343","snapshot_observed_at":"2026-08-06T05:08:10.743319Z","title":"Wait, we don’t need to","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:10.743319Z"},"links":{"cited_paper":"/paper/2506.08343","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:ddfce893fb3a213ac9355f24fd078fa8d936623c414e34d780a2313498df6838","observation_id":"5ed0d81d-c867-47f4-adfa-3c9d21dd653a","resolution":{"observed_at":"2026-08-06T05:08:10.743319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18585","last_updated":"2025-02-18T16:51:53Z","snapshot_observed_at":"2026-08-09T22:51:48.255703Z","submitted_at":"2025-01-30T18:58:18Z","title":"Thoughts Are All Over the Place: On the Underthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18585","snapshot_observed_at":"2026-08-06T05:08:10.807715Z","title":"Thoughts are all over the place: On the underthinking of o1-like llms,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:10.807715Z"},"links":{"cited_paper":"/paper/2501.18585","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:903438ffe9553c7d125832e8a554c956a3b04e3d57cbf2ec2d7cb0a4fdf96890","observation_id":"8858b52a-37b7-43a8-8586-e097cd95e7ea","resolution":{"observed_at":"2026-08-06T05:08:10.807715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12570","last_updated":"2025-01-29T03:11:03Z","snapshot_observed_at":"2026-08-08T03:22:47.699927Z","submitted_at":"2025-01-22T01:35:11Z","title":"O1-Pruner: Length-Harmonizing Fine-Tuning for O1-Like Reasoning Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12570","snapshot_observed_at":"2026-08-06T05:08:10.890536Z","title":"O1-pruner: Length-harmonizing fine-tuning for o1-like reasoning pruning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:10.890536Z"},"links":{"cited_paper":"/paper/2501.12570","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:2653d2bab185d8823d9a7f1aca81b12434d8d069b9f8c5b1a4ba1ed6231bcb1b","observation_id":"485334e8-46cf-4e65-9298-00594d41d28e","resolution":{"observed_at":"2026-08-06T05:08:10.890536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:15.143486Z","title":"Training language models to reason effi- ciently,","venue":null,"work_id":"e5e5da95-d3f9-4359-bc4f-4aed4974bfac","year":2026},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:10.976446Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:552db922b3ede65966dcd81e2cbf2390dd9e593f809ee990552be9f4f45b768f","observation_id":"d05e6839-a82d-400a-8666-1d909cd41412","resolution":{"observed_at":"2026-08-06T05:08:15.210401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:11.039341Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:11.039341Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:3fdd6336238c610d156510bf3cd657d856c74f1ac0c35ca2ebecb1d8d7e78e79","observation_id":"9c2925d9-1ba6-46d9-beec-995c06c1c312","resolution":{"observed_at":"2026-08-06T05:08:11.039341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:14.929263Z","title":"Reasoning with language model prompting: A survey,","venue":null,"work_id":"7ec28c98-f0b7-4d1d-ac13-834b3c6a2a71","year":2023},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:11.105283Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:0aff780b78147362d76ef7dade7e216614ba59d0f922153efd152f206bb536da","observation_id":"1fb219ad-9146-41ce-8b08-f42b54d63bdd","resolution":{"observed_at":"2026-08-06T05:08:15.034304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:14.735379Z","title":"Dast: Difficulty-adaptive slow-thinking for large reasoning models,","venue":null,"work_id":"5cbac596-f5af-4546-bb59-8b4aad6cf96f","year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:11.229103Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:743abff2978eb573df27d6fa1c9de19efd9bf06baf0faccac035177e2e65c0e2","observation_id":"88ebd071-3832-41d0-b71f-3cda71f6fc44","resolution":{"observed_at":"2026-08-06T05:08:14.806853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.03234","last_updated":"2025-05-21T15:26:54Z","snapshot_observed_at":"2026-08-08T01:11:17.971354Z","submitted_at":"2025-04-04T07:34:01Z","title":"Think When You Need: Self-Adaptive Chain-of-Thought Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.03234","snapshot_observed_at":"2026-08-06T05:08:11.326869Z","title":"Think when you need: Self-adaptive chain- of-thought learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:11.326869Z"},"links":{"cited_paper":"/paper/2504.03234","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:bc9c054ef1ab4165850118f8fd10352e36e6eb37b419a293984742fa75700964","observation_id":"ded8afa0-bb66-4199-8e42-bfb85be62ee5","resolution":{"observed_at":"2026-08-06T05:08:11.326869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:14.521824Z","title":"Token-budget- aware llm reasoning,","venue":null,"work_id":"07f6cfc2-7e0c-4ca2-bbe6-a7e722b6e899","year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:11.416967Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:20db9d91be8cd7ce50554532ac27bdd101be9aa5444e1ffef9881518fdd93cee","observation_id":"7eca2c49-f8f5-4cb1-8350-007051668f10","resolution":{"observed_at":"2026-08-06T05:08:14.624532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:14.381836Z","title":"Can language models learn to skip steps?","venue":null,"work_id":"f1cfa920-e69b-406d-bf80-f38892cda1c1","year":2024},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:11.510538Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:ad1367305e82dd26ac8f66abb57db7c196d257db3aa91deab7f17ede2ab47826","observation_id":"cd454ec8-313d-4a27-aefd-16d204ee7e9e","resolution":{"observed_at":"2026-08-06T05:08:14.482819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:14.222604Z","title":"Cot-valve: Length- compressible chain-of-thought tuning,","venue":null,"work_id":"c9510fed-f74b-4d6b-a06d-fc0a3d548e6a","year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:11.581910Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:2f105d6f2d31947cdce77a5a523508accf685df6de21173f2b8f8ba46f7c8ead","observation_id":"f6c42539-1989-485b-9672-74ad5a52148b","resolution":{"observed_at":"2026-08-06T05:08:14.306792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:14.075673Z","title":"Data-efficient rein- forcement learning for complex nonlinear systems,","venue":null,"work_id":"b73af954-dda8-4e31-b7ca-00a045067008","year":2023},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:11.695318Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:7a2f3e125eed38267c4c417926ebdc7d1f8637e82d3eabe6e4679bec9fe642dd","observation_id":"dc59d6e1-9e2a-43e6-a6ce-631fc02fa798","resolution":{"observed_at":"2026-08-06T05:08:14.144549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-06T05:08:11.793313Z","title":"Kimi k1. 5: Scaling reinforcement learning with llms,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:11.793313Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:083a9750de1d46faf8a7f26c9ee6ff3faf61cc14747dddb40ee0e1706e41e078","observation_id":"c2c3d6d9-8ffb-4831-a490-47ee413b30a5","resolution":{"observed_at":"2026-08-06T05:08:11.793313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01296","last_updated":"2025-04-02T01:59:26Z","snapshot_observed_at":"2026-07-30T08:40:23.849282Z","submitted_at":"2025-04-02T01:59:26Z","title":"ThinkPrune: Pruning Long Chain-of-Thought of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.01296","snapshot_observed_at":"2026-08-06T05:08:11.890551Z","title":"Thinkprune: Pruning long chain-of-thought of llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:11.890551Z"},"links":{"cited_paper":"/paper/2504.01296","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:11052750d6ed8f114ae0ab803b29663f2be362422b8083f4b5961165cdffda84","observation_id":"90cb4fe0-b8d8-4a98-adc4-35de0af72969","resolution":{"observed_at":"2026-08-06T05:08:11.890551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14755","last_updated":"2025-09-11T02:13:24Z","snapshot_observed_at":"2026-08-07T00:07:24.304900Z","submitted_at":"2025-06-17T17:50:16Z","title":"Optimizing Length Compression in Large Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.14755","snapshot_observed_at":"2026-08-06T05:08:11.949845Z","title":"Optimizing length compression in large reasoning models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:11.949845Z"},"links":{"cited_paper":"/paper/2506.14755","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:9147203c8a4eeca491926f2f17c2124f6f788e85f3ea2c7628032eac146f18ac","observation_id":"e4466a45-860c-4843-ac05-09dab89649c4","resolution":{"observed_at":"2026-08-06T05:08:11.949845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:13.928341Z","title":"Learn to reason efficiently with adaptive length-based reward shaping,","venue":null,"work_id":"7b7d9cde-1af3-4b3d-a24c-5306bdd7b3ef","year":2026},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:12.039740Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:ff48baa25cc7900beb121280c491175d512f846c610bd0294a4dd4f1da19cb8e","observation_id":"d6915e61-61a0-4f32-a12b-f985863a2d14","resolution":{"observed_at":"2026-08-06T05:08:14.016628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:13.752373Z","title":"A survey on reinforcement learning for recommender systems,","venue":null,"work_id":"6e7502bb-da48-4e04-99b6-80907130fddf","year":2023},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:12.135163Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:9a879378bd4322cb29531f2be98572da6ac962525c95b89c00409f3a41e38860","observation_id":"9801a469-2c31-4c57-9b23-11cecbb294cf","resolution":{"observed_at":"2026-08-06T05:08:13.855457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-04T22:55:15.345443Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-06T05:08:12.229405Z","title":"Gpqa: A graduate-level google-proof q&a benchmark,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:12.229405Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:f8db3e9a79bdc92e07407bb4f126c4078449f681409ad3c01a6f5c30b3bc28af","observation_id":"adcddd72-8f26-4a80-82e7-625eca13fe55","resolution":{"observed_at":"2026-08-06T05:08:12.229405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:13.592698Z","title":"Livecodebench: Holistic and contamination free evaluation of large language models for code,","venue":null,"work_id":"23d19cda-8302-4d18-8983-668c56e93018","year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:12.320141Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:1977fd99e11918c8ba1874350eee9275ce9d8b327732f057e17dfd79d6cca863","observation_id":"0a138f5a-c56c-491b-9adc-c90a4f345df9","resolution":{"observed_at":"2026-08-06T05:08:13.680744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:12.403992Z","title":"Hybridflow: A flexible and efficient rlhf framework,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:12.403992Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:516fe4d444afe0c7d12295d1dd4dd99128e69b27610af8de713cf17048a524a9","observation_id":"3b018bbb-1ba5-45df-a54a-81943378ccf4","resolution":{"observed_at":"2026-08-06T05:08:12.403992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T05:08:12.506419Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:12.506419Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:f0735fe2508f957b788b8cc0ade2efdf71f2c9186b46ba12e2d6b2525ce40ddb","observation_id":"d80eb73d-4078-4f53-a4f7-a30aba153225","resolution":{"observed_at":"2026-08-06T05:08:12.506419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:13.378329Z","title":"Deepscaler: Surpassing o1-preview with a 1.5 b model by scaling rl,","venue":null,"work_id":"e1e377e5-4df8-4cd8-a9a3-d98a5abd430c","year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:12.567366Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:48670fd79e33ce9645b480b7c466d2c8cf146859a4d6d039f27bc4077ace5931","observation_id":"31478fc7-1122-402e-a4c7-8698150747b5","resolution":{"observed_at":"2026-08-06T05:08:13.513040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T05:08:12.656410Z","title":"Training verifiers to solve math word problems,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:12.656410Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:833bac8f37519eb1ea2e1eee685c1ca9bdb7c0093cca367a400dc7a4504be63f","observation_id":"63786440-f1d6-4606-b1ff-0d1a3c1875ed","resolution":{"observed_at":"2026-08-06T05:08:12.656410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-06T05:08:12.721234Z","title":"Measuring mathematical problem solving with the math dataset,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:12.721234Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:3c53a989e4eb0dad185d4bc70d0c20a988a8e61410d4c8b83b040935ae7fe6d0","observation_id":"6e2aa0cd-210c-4cb7-a7ed-892c32d24fc0","resolution":{"observed_at":"2026-08-06T05:08:12.721234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:13.212942Z","title":"Mind the gap: Bridging thought leap for improved chain-of-thought tuning,","venue":null,"work_id":"6bfaa9d2-7268-4711-9d6f-134af308c842","year":2026},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:12.800621Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:5d3b7d29f19c68959f78aab00f2268f6965eba4b8504f314cd295792fa510fd0","observation_id":"a0524808-5450-43a3-a900-f615b561182c","resolution":{"observed_at":"2026-08-06T05:08:13.277511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":1,"verified_fuzzy":13},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 1 inbound Pith citation observation for arXiv:2508.02186."}