{"as_of":"2026-08-19T04:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:564ff3d247e623b968cb8f5b9106ca9554db144057521de33369b9f1dbd2c713","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-08T22:25:35.119625Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T07:07:43.937980Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.05861","snapshot_observed_at":"2026-08-01T07:07:43.937980Z","title":"Vl-rethinker: Incentivizing self-reflection of vision-language models with reinforcement learning.Advances in Neural Information Processing Systems, 38:30865–30891, 2026a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21556","last_updated":"2026-07-23T17:37:37Z","snapshot_observed_at":"2026-08-12T17:06:14.400229Z","submitted_at":"2026-07-23T17:37:37Z","title":"Visual Contrastive Self-Distillation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T07:07:43.937980Z"},"links":{"cited_paper":"/paper/2607.05861","citing_paper":"/paper/2607.21556"},"observation_digest":"sha256:007088ca6c2b05cdba906f4c855b5eac0b5c9f3fc13a29f477e9db59072d14fd","observation_id":"015346d0-d947-4438-ae35-7f953e4d6a52","resolution":{"observed_at":"2026-08-01T07:07:43.937980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.05861/citation-record","integrity":"/paper/2607.05861/integrity","json":"/paper/2607.05861/citation-record.json","paper":"/paper/2607.05861"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.12041","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.486149Z","title":"Improving text-to-image generation with input-side inference-time scaling.arXiv preprint arXiv:2510.12041, 2025a","venue":null,"work_id":"8b20ed2b-c54e-4f90-8c12-b96ee3f41bd3","year":null},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:f33ba9f8e9e39a9816f58ed68685f82bcdc8d12617bf3cff41d57067284bba38","observation_id":"f78885e2-a5d1-43c7-bcb4-82db19fde026","resolution":{"observed_at":"2026-07-08T22:25:39.488004Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:4c2dda2adefbd7ed4b7ad7a9ac71e29d1968a642c896e2822bdb7f80291b3010","observation_id":"4172036c-25e3-4fa3-a7d6-3ce61867d503","resolution":{"observed_at":"2026-07-08T22:25:39.498423Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.07968","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.513727Z","title":"Simpleqa verified: A reliable factuality benchmark to measure parametric knowledge","venue":null,"work_id":"3d4a65f9-9e86-4917-93c9-2ddb7dc78553","year":2026},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:c5e5c97bda0fdab9161decec2a02de773a0f5657fb17256e11e8c9bf9e65e07a","observation_id":"439de9c2-ba8c-4d7a-babb-2af5d81b7bc4","resolution":{"observed_at":"2026-07-08T22:25:39.515791Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.23392","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.499990Z","title":"Your models have thought enough: Training large reasoning models to stop overthinking.arXiv preprint arXiv:2509.23392,","venue":null,"work_id":"34a3fd7c-9f90-41d9-9a6a-3aec784129a4","year":null},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:531c3f7962160a5ddf75114df00adf2f05bc10274229b55320e5d5362783586b","observation_id":"378ae87d-3737-4926-9fb5-67d5ee7c0ad9","resolution":{"observed_at":"2026-07-08T22:25:39.502352Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09543","last_updated":"2023-03-24T09:17:17Z","snapshot_observed_at":"2026-08-16T03:03:21.512563Z","submitted_at":"2021-11-18T06:48:00Z","title":"DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing","version":4},"cited_work":{"arxiv_id":"2111.09543","doi":"10.48550/arxiv.2111.09543","metadata_source":"pith","pith_arxiv_id":"2111.09543","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing","venue":"cs.CL","work_id":"480bf7dd-7121-4d1f-8b53-7cc6ce479835","year":2021},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2111.09543","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:0fe5a63372a5eaae3851570abba78ebd2c5d348e5f7d2bbfce2d1264a70bd1ca","observation_id":"5626b2da-b009-4083-a6a5-b40232e5cb46","resolution":{"observed_at":"2026-07-08T22:25:39.512464Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-10T18:38:12.96464+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T18:38:12.96464+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-10T17:58:02.856512Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":"2501.11651","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-07-08T22:25:39.474855Z","title":"Advancing language model reasoning through reinforcement learning and inference scaling.arXiv preprint arXiv:2501.11651","venue":"cs.LG","work_id":"5285cf94-5260-4da6-9f74-84d71071d5be","year":2025},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:7cf736a3848cb40ac7a87920ebe57fecae468a85685f15525109faa8711782ab","observation_id":"212e8307-e81a-479c-a1aa-106cd0950245","resolution":{"observed_at":"2026-07-08T22:25:39.476832Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":"2412.16720","doi":"10.48550/arxiv.2412.16720","metadata_source":"pith","pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"OpenAI o1 System Card","venue":"cs.AI","work_id":"68d3c334-0fc9-49e3-b7b0-a69afae933e2","year":2024},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:743d8090d27003ceddde8f4b826dc5636998a11eb91d668319229de899dca20a","observation_id":"79c9d6de-ad71-41fa-b4ea-f910e311639d","resolution":{"observed_at":"2026-07-08T22:25:39.519029Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.05164","last_updated":"2026-08-08T06:26:16Z","snapshot_observed_at":"2026-08-13T23:15:38.974751Z","submitted_at":"2026-04-06T20:48:51Z","title":"Not All Turns Are Equally Hard: Adaptive Thinking Budgets For Efficient Multi-Turn Reasoning in Agents","version":3},"cited_work":{"arxiv_id":"2604.05164","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.05164","snapshot_observed_at":"2026-07-08T22:25:39.523993Z","title":"Not All Turns Are Equally Hard: Adaptive Thinking Budgets For Efficient Multi-Turn Reasoning","venue":"cs.LG","work_id":"12526b58-abd0-4150-b6f7-ebe97866b15d","year":2026},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2604.05164","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:86483bc9e9cb8a48cfe3c84b35deb34feed11916fc6415e946b5c19172ab7146","observation_id":"97309de7-fb92-4a8f-9b92-3f424bfca6ce","resolution":{"observed_at":"2026-07-08T22:25:39.525478Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.578171Z","title":null,"venue":null,"work_id":"4eaa8d8a-98f3-4d32-88ef-6e6a443520bd","year":2019},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:47dea8316d1236f2691937dc800bbd95d609b60a08f00355ae85be752c1017da","observation_id":"ef48be6c-b42c-4735-bc2a-826ba7a60f0c","resolution":{"observed_at":"2026-07-08T22:25:39.579426Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.579776Z","title":null,"venue":null,"work_id":"bb08629b-74a3-4cb6-8149-13c977839d6e","year":2020},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:dc538e694afcd8be909017355653003156f11c63c4bf2f1ac10d971ae4303a2b","observation_id":"4e574cb2-ac5b-4bed-b051-d2b58a9a6bfb","resolution":{"observed_at":"2026-07-08T22:25:39.581612Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:df2978c2eb8bd13d14841f4ca0ed09d5d679917d098006ad9d7aa7392c9bf0ac","observation_id":"14bb2cb9-c0cb-4a25-8be8-8f4093ddb6df","resolution":{"observed_at":"2026-07-08T22:25:39.521701Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00127","last_updated":"2025-04-30T18:48:06Z","snapshot_observed_at":"2026-08-16T04:48:18.978901Z","submitted_at":"2025-04-30T18:48:06Z","title":"Between Underthinking and Overthinking: An Empirical Study of Reasoning Length and correctness in LLMs","version":1},"cited_work":{"arxiv_id":"2505.00127","doi":"10.48550/arxiv.2505.00127","metadata_source":"pith","pith_arxiv_id":"2505.00127","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Betweenunderthinkingandoverthinking: Anempiricalstudyofreasoninglengthandcorrectnessinllms.arXivpreprint","venue":"cs.CL","work_id":"b686084f-7501-4f71-bba5-86b60b1504f7","year":2025},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2505.00127","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:dfe4e6d4ba4a0eb743b36cba14336243f1845a8e3844ab9dfb78835269c97c04","observation_id":"ae6a39f5-3cca-4c85-af88-d055964d0cfc","resolution":{"observed_at":"2026-07-08T22:25:39.495002Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12886","last_updated":"2025-05-19T09:16:40Z","snapshot_observed_at":"2026-08-15T20:22:03.928200Z","submitted_at":"2025-05-19T09:16:40Z","title":"Detection and Mitigation of Hallucination in Large Reasoning Models: A Mechanistic Perspective","version":1},"cited_work":{"arxiv_id":"2505.12886","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.12886","snapshot_observed_at":"2026-07-08T22:25:39.515388Z","title":"arXiv preprint arXiv:2505.12886 , year=","venue":"cs.AI","work_id":"d1d6c48e-cd65-4a3e-a441-d1763a509d45","year":2025},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2505.12886","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:8d11720863f75b3609e3867b06a7e4b1bf6098d956aa829c168a0a7e289e8222","observation_id":"11939e0f-e700-4b7a-896e-822373b2318d","resolution":{"observed_at":"2026-07-08T22:25:39.516771Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"cited_work":{"arxiv_id":"2506.18237","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.18237","snapshot_observed_at":"2026-07-08T22:25:39.517114Z","title":"Adapthink: Adaptive thinking pref- erences for reasoning language model","venue":"cs.LG","work_id":"7604f65a-25dd-4e1b-ab08-765d419b68e1","year":2025},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2506.18237","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:54d30faaf08a6f6d59c8d6b71f3d5dab79f70bb100cad47110a917664d12c12b","observation_id":"3131f75a-e836-4b65-9e7d-5f7bd9109e76","resolution":{"observed_at":"2026-07-08T22:25:39.518829Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.27332","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.482773Z","title":"Unsafe by reciprocity: How generation-understanding coupling undermines safety in unified multimodal models.arXiv preprint arXiv:2603.27332,","venue":null,"work_id":"6813a34d-fbd4-4858-90c0-86bfc2f29da8","year":null},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:52a9ef61fe78c4410d287288dc1d028f9cc2a0128774eebfacfb2bb2f13e866a","observation_id":"e5bc2b48-05af-47df-9f1d-0dd8583bdf76","resolution":{"observed_at":"2026-07-08T22:25:39.484751Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-08-16T01:49:22.176843Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":"2203.11171","doi":"10.1101/2025.04.03.646459","metadata_source":"pith","pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","venue":"cs.CL","work_id":"8c6d5a6b-b5cc-4105-9c84-9c34bb9375bb","year":2022},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:02fb916cd5d6179c1aa8fc60d43bfc1485b8f509a4e2849d27486fe4ca86f0bd","observation_id":"26238231-4439-42e6-b9b2-6e29b052237f","resolution":{"observed_at":"2026-07-08T22:25:39.508664Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-05-21T18:52:42.88633+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T18:52:42.88633+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04368","last_updated":"2024-11-07T01:58:42Z","snapshot_observed_at":"2026-08-17T10:08:57.374438Z","submitted_at":"2024-11-07T01:58:42Z","title":"Measuring short-form factuality in large language models","version":1},"cited_work":{"arxiv_id":"2411.04368","doi":"10.48550/arxiv.2411.04368","metadata_source":"pith","pith_arxiv_id":"2411.04368","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measuring short-form factuality in large language models","venue":"cs.CL","work_id":"f8e490ab-7057-43fb-8c6d-06fc603836c7","year":2024},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2411.04368","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:f94d161837bc60f0496e208fdfe58ad857d0c2aab053e44c38ad8530eea8f5ce","observation_id":"d1dda002-d588-4465-9f9e-8b1129edf6d2","resolution":{"observed_at":"2026-07-08T22:25:39.472828Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:0b9b6250b94675408adabdf54fd1cbb2a990e58ca58901fb7c4113fb93149181","observation_id":"3ddcd1b4-7d39-4b69-9707-b3622cd61e72","resolution":{"observed_at":"2026-07-08T22:25:39.494724Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.582048Z","title":"Hotpotqa: A dataset for diverse, explainable multi-hop question answering","venue":null,"work_id":"a40e5111-5d02-4fc6-bc6a-7b205825fff3","year":2018},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:a746469640c7ebe062a1f57bfeb38a4a1a2ca86fb5fa8d06638f3d991c85d1a5","observation_id":"dc8f9468-bfc5-4825-9119-4b989cd0c30f","resolution":{"observed_at":"2026-07-08T22:25:39.583408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-14T17:02:28.739687Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:92622b2186ad01fd641fe53e5cb09606899558e03d3421b5c729007f0156b35c","observation_id":"5d2ff7b9-f1d2-465b-bcd3-d1115e9ac8f4","resolution":{"observed_at":"2026-07-08T22:25:39.514165Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.17587","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.471373Z","title":"Hallurnn: Mitigating hallucinations via recurrent cross-layer reasoning in large vision-language models","venue":null,"work_id":"721e46d6-f130-41f3-812e-4b0e41c89d2c","year":2025},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:d118fc1ba0ea3f00ca15ae6d6fb4bdbf66838845f8d36eacf1729ed0be3759f2","observation_id":"c6683de8-a772-4165-857f-8bd5b86c4256","resolution":{"observed_at":"2026-07-08T22:25:39.473432Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.573829Z","title":"Unraveling hallucination in large reasoning models: A topological perspective","venue":null,"work_id":"36c2d375-fb1a-4a4d-8882-82670e5d97e8","year":2025},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:50abb219c8b8ef3bbc432b50294b4e01b25f1ff9bea2edf854afd505f7f71e6a","observation_id":"96dae197-bff3-4abd-8b7a-dada2a6c2ff1","resolution":{"observed_at":"2026-07-08T22:25:39.575179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09797","last_updated":"2024-10-07T04:28:04Z","snapshot_observed_at":"2026-08-16T15:39:13.160910Z","submitted_at":"2023-04-19T16:29:48Z","title":"Progressive-Hint Prompting Improves Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":"2304.09797","doi":"10.48550/arxiv.2304.09797","metadata_source":"pith","pith_arxiv_id":"2304.09797","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Progressive-hint prompting improves reasoning in large language models","venue":"cs.CL","work_id":"9aa19a03-b5e5-4a8b-9a9b-c8f38d16c7d2","year":2023},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2304.09797","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:f303afd1d7d3732b62014a7d5d5ec3e649644a14fabadf33f11ddb30b8a96fbb","observation_id":"1a8b30ef-032d-4beb-99f5-a9cdfb02e038","resolution":{"observed_at":"2026-07-08T22:25:39.491495Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.03845","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.503631Z","title":"Parallel-probe: Towards efficient parallel thinking via 2d probing","venue":null,"work_id":"7d1cb8bf-5ba0-4eb3-8438-48cfad80c8ea","year":2026},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:ce4f0eb9d46f348fdc8e28d60121e2e2c9f049b2b336cea070cb0c020dd00c5d","observation_id":"06880647-70f8-45c1-84dd-bd54ffdf7cbb","resolution":{"observed_at":"2026-07-08T22:25:39.505727Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.582246Z","title":"A”, “B”, or “C","venue":null,"work_id":"43bbff17-f1d4-4132-ab8a-02cf93ec89a9","year":1998},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:f06ef13f7cc7ca4c272661b78fba24272e07d0b1d002b8448005418c987417cc","observation_id":"92d0ab6c-4e9d-4e3a-8c3d-ea00a32bdf90","resolution":{"observed_at":"2026-07-08T22:25:39.583597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.577981Z","title":"it is possible that","venue":null,"work_id":"a79d64d0-5e2c-4a4c-8eb9-c13ea5c7bb32","year":2025},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:8d7cc99d50303030e348ad69b1a45381c6f47c0e0331bd0449c5c40d0d20bad4","observation_id":"b13bbe99-e567-4f84-b560-4a158f8b55aa","resolution":{"observed_at":"2026-07-08T22:25:39.579230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:25:39.584137Z","title":null,"venue":null,"work_id":"a9fac354-154d-4dbb-a5d7-ba01e949b882","year":2021},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:9ff4b1a61803720ac1d85ee1d8b2f9a15356de94059f4be345671eda6e030aff","observation_id":"7a77d263-d036-4094-8f32-6d536bf31ae0","resolution":{"observed_at":"2026-07-08T22:25:39.586035Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":2,"verified_exact":19,"verified_fuzzy":4},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 1 inbound Pith citation observation for arXiv:2607.05861."}