{"as_of":"2026-08-14T21:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6616afe1e40d3384675c1f227413807ed58b5456306c3ee76f9b360839fad047","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T06:23:36.558304Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T23:27:32.645757Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-11T23:27:33.239830Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"cited_work":{"arxiv_id":"2601.22900","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.22900","snapshot_observed_at":"2026-08-11T23:27:33.239830Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","venue":"cs.AI","work_id":"31a684ff-715a-4f20-a491-249bc316e15e","year":2026},"citing_paper":{"arxiv_id":"2608.09109","last_updated":"2026-08-10T04:27:58Z","snapshot_observed_at":"2026-08-14T18:51:11.596420Z","submitted_at":"2026-08-10T04:27:58Z","title":"Different Feedback, Different Updates: Selective Self-Learning from User Interactions for Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T23:27:32.645757Z"},"links":{"cited_paper":"/paper/2601.22900","citing_paper":"/paper/2608.09109"},"observation_digest":"sha256:f6cd73846421514a895bbba2546eaed1a7dd1d9cc3387f0aa44fe73c11824c25","observation_id":"06f62b64-f665-46e8-a1f2-1cfca9c3763d","resolution":{"observed_at":"2026-08-11T23:27:33.244435Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2601.22900/citation-record","integrity":"/paper/2601.22900/integrity","json":"/paper/2601.22900/citation-record.json","paper":"/paper/2601.22900"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:33.604990Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:33.604990Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:b0f31b6c36b3378cead2410da272d7c528eab1bbcb8cbeb7c6ba1c190a882793","observation_id":"9cefae43-278d-4f2d-bf9b-26435b37dd92","resolution":{"observed_at":"2026-08-03T06:23:33.604990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:33.702476Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:33.702476Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:6cb719ff55aa27a32901c696b3bcfe2877b77cf9423b2904c320a64dd59a47a4","observation_id":"39808f75-d686-4975-b68e-79e1dfb4720f","resolution":{"observed_at":"2026-08-03T06:23:33.702476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:33.837001Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:33.837001Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:8a2068d878b8286f0db9d4017188b3365f7467c69d8941aaffc8988c26278272","observation_id":"d7018b70-7633-4544-b1c0-69a81084532d","resolution":{"observed_at":"2026-08-03T06:23:33.837001Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:34.015583Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:34.015583Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:fffc81e1b11c66748f81a4c2e2947f5e75ef7a4609af8406e3207e218720ac01","observation_id":"23a76f03-07a1-4066-a006-8e58f3aa03c0","resolution":{"observed_at":"2026-08-03T06:23:34.015583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:34.113533Z","title":"= <final answer>’ inside <feedback>.)\\n - You MAY include tiny snippets (a short identity, a one-line correction),\\n but avoid long derivations or long equations in <feedback>.\\n","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:34.113533Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:c66b3785f4ef7042501f8b76f42b6ea1cd3920d67f815dd968b977e867fbc1db","observation_id":"9a52a348-46ea-4808-919b-8e4973d06bea","resolution":{"observed_at":"2026-08-03T06:23:34.113533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:34.295625Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:34.295625Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:23926edd5d5a30f935233c81f261b6e85bcb9b8ddb1efc0b429a61cf793f9a80","observation_id":"2fd936f3-d15e-4e22-9d72-b744531ef22a","resolution":{"observed_at":"2026-08-03T06:23:34.295625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:34.451969Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:34.451969Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:4109f8757ee4591746ff8d91aa0073d904f1aad7dad0d461285cdd6a3b5d035f","observation_id":"641b4ea2-6f17-4862-817b-1b5daa71fd5e","resolution":{"observed_at":"2026-08-03T06:23:34.451969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:34.589801Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:34.589801Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:60791dd2b2ccef5ecf9615d8572a0edece379f88064097645ad49204f37f9e30","observation_id":"d2b62e70-85b8-4c26-adcc-d68cd01d0def","resolution":{"observed_at":"2026-08-03T06:23:34.589801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:34.796716Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:34.796716Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:501d4abf8ee4d22d6365ecf3a4a1100aa12aa2766c53cc49db67adf8f078e102","observation_id":"a69218a3-0eed-4330-87e6-b1003b24cecb","resolution":{"observed_at":"2026-08-03T06:23:34.796716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:34.918930Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:34.918930Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:2f5d672a9d577d5141147266c6a1e32537ef6553df02e6e5369c1f28699e94f7","observation_id":"3ac0aa15-0fac-49c2-89bf-e2bb33accfd3","resolution":{"observed_at":"2026-08-03T06:23:34.918930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:35.070519Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:35.070519Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:d3a8b7be5f9b3c3d9afde47c2e503969ca96d2d5bf3ca12e8ebfdf9fbbcad241","observation_id":"afdb0b6d-24d4-475c-ac52-e69265380952","resolution":{"observed_at":"2026-08-03T06:23:35.070519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:35.470102Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:35.470102Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:777b56e633d6b1864606ad00d0af7cead702575d176bfbef255710a99aebe5e0","observation_id":"a23b851c-55e9-452d-8ab8-4b36d0463768","resolution":{"observed_at":"2026-08-03T06:23:35.470102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:35.615914Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:35.615914Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:85bee4af5bad56abaa28a197210d97c54a241f56cdf739aad5a0b591fa175c0e","observation_id":"be49c4c1-f94c-40f4-9c2e-0d3b87be2e1a","resolution":{"observed_at":"2026-08-03T06:23:35.615914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:35.679814Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:35.679814Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:b11b016fa1a50fa8300cc1e86c016495b385aaf25bc1196398f2e349cbd408be","observation_id":"bd0a76b0-391f-4067-bb9f-881d475c0ebf","resolution":{"observed_at":"2026-08-03T06:23:35.679814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:35.766817Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:35.766817Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:68ef75e51a122f48847309db6c2d51cffd155efeee5b4c650b27a4a009695362","observation_id":"5714db7b-b9eb-41de-a31b-afebac613415","resolution":{"observed_at":"2026-08-03T06:23:35.766817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:35.845672Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:35.845672Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:686998ea4064122afea3137ee53aef28ce8456fb5d217cb7b1ce53ebeca2e5b8","observation_id":"3b1d3473-6fe2-4b39-8013-20ff19281333","resolution":{"observed_at":"2026-08-03T06:23:35.845672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:35.915756Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:35.915756Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:7ba8fb73a11b71fef2767bee67a103b315cf71141d1ad563b184391342a6a533","observation_id":"3c0eb349-cd56-40be-88ee-8b8e95beb06e","resolution":{"observed_at":"2026-08-03T06:23:35.915756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:36.006834Z","title":"SFT/RAFT system prompt and CITL-FT initial prompt You are a reasoning assistant.\\n Solve the problem step by step.\\n\\n Output format (must follow exactly):\\n","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:36.006834Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:0e18c50b93fbb9ce50c3d618a7f4d53aa4104301bc38ceebbf832820d97834d6","observation_id":"514016a6-2573-49dc-88bc-6b4cb1684cd8","resolution":{"observed_at":"2026-08-03T06:23:36.006834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:36.071017Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:36.071017Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:23b5cca52e2a956d04f5f54e5f720ffbb41b2266419d5a51e726fc1b98d92496","observation_id":"577a79cf-900d-4da7-8c73-40f546814446","resolution":{"observed_at":"2026-08-03T06:23:36.071017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:36.224133Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:36.224133Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:ecbb202b4700b957bed75d693366999602f82ebd71b6a8f9d52e98f6d151a2c5","observation_id":"6aac5df6-7992-41f9-b3e8-e06468f823f4","resolution":{"observed_at":"2026-08-03T06:23:36.224133Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:36.285742Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:36.285742Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:a4141a95b69e7a9b9c6e51e7c52ff80fa1856a1d1391268dd0f370d557acd1b9","observation_id":"b98c1b9e-9888-40c3-9cc6-306851cf896e","resolution":{"observed_at":"2026-08-03T06:23:36.285742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:36.357177Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:36.357177Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:477cb6fe5209f8fddafa1f237c7237ddd98750aaff0fdd04b79cec770da96e44","observation_id":"438ab60f-2539-4e78-93bd-ceb78d9abdf8","resolution":{"observed_at":"2026-08-03T06:23:36.357177Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:36.442551Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:36.442551Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:f335f4db96e489c2b6fc60e112ddf4751748d062980f7bad52c8153069916295","observation_id":"8de2b3af-f033-4009-8cfb-b94c3b9c45ba","resolution":{"observed_at":"2026-08-03T06:23:36.442551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T06:23:36.558304Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T06:23:36.558304Z"},"links":{"citing_paper":"/paper/2601.22900"},"observation_digest":"sha256:ca173629a19e5306213dfa0bacc9be4c9d32537ff5b085179e7875ade1c3974f","observation_id":"c622e5a2-ba65-4ea6-8014-6331d6ba94e9","resolution":{"observed_at":"2026-08-03T06:23:36.558304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2601.22900","last_updated":"2026-05-30T11:40:38Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T01:46:22.354879Z","submitted_at":"2026-01-30T12:19:54Z","title":"MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":2,"unresolved":21,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 1 inbound Pith citation observation for arXiv:2601.22900."}