{"as_of":"2026-08-17T19:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2ad5a653cec23fe8279a8de670355d947c9a9bbcc32f2fd63f1c4200d57afa26","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T05:30:31.417206Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.05292/citation-record","integrity":"/paper/2509.05292/integrity","json":"/paper/2509.05292/citation-record.json","paper":"/paper/2509.05292"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.00201","last_updated":"2025-07-31T23:01:14Z","snapshot_observed_at":"2026-08-15T22:41:04.603294Z","submitted_at":"2025-07-31T23:01:14Z","title":"RecoMind: A Reinforcement Learning Framework for Optimizing In-Session User Satisfaction in Recommendation Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.00201","snapshot_observed_at":"2026-08-05T05:30:31.262162Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.262162Z"},"links":{"cited_paper":"/paper/2508.00201","citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:c7674d7de13033f2b68f1db5b36e0f9194641dbd67c35db65b840f13ce92ccad","observation_id":"d2dbd2c8-c9ec-4aa8-b86d-246a475c313c","resolution":{"observed_at":"2026-08-05T05:30:31.262162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.897683Z","title":null,"venue":null,"work_id":"f127e816-f376-4887-8049-fc0e8361826f","year":1983},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.266222Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:316a48edd608d7aa0b47f77d32ad1a21e7fbca488d72cfc889c7c2561a44ec85","observation_id":"47134fcb-73ca-4021-af76-9078686dfc9f","resolution":{"observed_at":"2026-08-05T05:30:31.900397Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.269847Z","title":"Charles, D","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.269847Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:94c1a794842589159f503049dc641f92bb01b9ca04dcdd773a9f91e0846aeb28","observation_id":"58c6ef39-d5b7-4590-80a4-916ec471334d","resolution":{"observed_at":"2026-08-05T05:30:31.269847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.273444Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.273444Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:1f6a154f9d9d41ec300cd45dafbc97fb1cc5970d4efb4ee6c7b4959dcfebd1f2","observation_id":"c8d8a259-643e-4afb-a7bc-c2bbe07a8ad5","resolution":{"observed_at":"2026-08-05T05:30:31.273444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.277130Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.277130Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:6d15ff1f1ae5ea029223bc536b403cfd94cd338b8c776934abb79d7c41369634","observation_id":"ce1b55e8-b00f-42f7-affb-fef1d2b40f63","resolution":{"observed_at":"2026-08-05T05:30:31.277130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.863200Z","title":null,"venue":null,"work_id":"60820bed-b42c-4b17-8bad-abd0f074dcab","year":2016},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.283892Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:b502d18b970293b42a24f8d915904b0f92a67f39ade1ffe07366e6a3ecb3ff5b","observation_id":"c2825e65-75ba-47d7-be5b-2ee44c28cb6f","resolution":{"observed_at":"2026-08-05T05:30:31.867791Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.287363Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.287363Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:e136a55dad8540598dd1af9783010776c1bd7b3972d69898c515087cf8a9696f","observation_id":"25a78291-daf2-4bb4-b448-57aec4029ccd","resolution":{"observed_at":"2026-08-05T05:30:31.287363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.846889Z","title":null,"venue":null,"work_id":"1c3a0af5-89b3-4506-9378-a7aa7ef5f144","year":2018},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.291766Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:c92ba00149104d4563521e2311591a731ee328e8e4451e0bed869dee2cd0c73c","observation_id":"8dc7649a-038d-4d17-90e4-3873bbad5d8b","resolution":{"observed_at":"2026-08-05T05:30:31.850525Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.836719Z","title":null,"venue":null,"work_id":"baa312bf-6825-4ae7-abc2-b4af16369ed9","year":2017},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.295166Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:c3288a6c3c18bc044f122304f45788a614605285fb7898e27ce624c1253e8826","observation_id":"f71737dc-e5be-42ea-903b-77213b165590","resolution":{"observed_at":"2026-08-05T05:30:31.840128Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.825975Z","title":null,"venue":null,"work_id":"0715b39f-bea3-479e-b0e6-5fa7f85e52fe","year":2014},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.299293Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:ecf13e14a5dbda3cdb01dd21926b74c645a97d2eaa47d3310b2214d662137cc4","observation_id":"03bc7d0d-3f8b-4c81-8cc6-9eea248a13e5","resolution":{"observed_at":"2026-08-05T05:30:31.830031Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.816073Z","title":null,"venue":null,"work_id":"25ca1ce8-cd5e-4cf5-bfd3-d01ce5c99d80","year":2018},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.302708Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:3bb358b67b1dcb8fcc19a383c0a443d62dce78363188848dbb10dae269b4319c","observation_id":"47ad0a1f-a78e-4132-b1af-5e8c558bf7ef","resolution":{"observed_at":"2026-08-05T05:30:31.819376Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.805158Z","title":null,"venue":null,"work_id":"ddbc7cbb-37e0-4476-8f54-fce65d7c67bc","year":2015},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.306054Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:eab9a8cee4fbd9de4f2cd5e45b48eb6de146febabf8a9731f21a7c0348affdf4","observation_id":"867db65d-8714-4562-a8d7-21d504a61221","resolution":{"observed_at":"2026-08-05T05:30:31.808727Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.794002Z","title":null,"venue":null,"work_id":"7a0433de-3eea-4880-87cb-1a5d0437a3a8","year":2018},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.310681Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:ba26471cc570e4dbfab29a9608728c800f0d3f0a0e751fc9e795fac09cc91c0a","observation_id":"7d221c9d-3a7c-45d5-b816-e3f1cb60b41c","resolution":{"observed_at":"2026-08-05T05:30:31.797415Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.782640Z","title":null,"venue":null,"work_id":"17c46ab0-afed-408f-a90b-64371818f4fb","year":2015},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.314186Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:bd42712c27e737329836ed920863565872a29a2311fedece376c3f10e85d5992","observation_id":"6b9db0f1-aff9-4f4d-8bfa-44812a903f2a","resolution":{"observed_at":"2026-08-05T05:30:31.786444Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.770360Z","title":null,"venue":null,"work_id":"3bb05529-6540-41dd-9177-7176860ccb0b","year":2022},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.317545Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:c57b82eaf06eed7f5b60291bc370161dac9d5ea0a862759d45987c32c5671da6","observation_id":"414e7448-9071-4f48-b487-41d843da9674","resolution":{"observed_at":"2026-08-05T05:30:31.774244Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07663","last_updated":"2022-09-27T21:58:20Z","snapshot_observed_at":"2026-08-16T16:32:08.190380Z","submitted_at":"2022-09-16T00:58:16Z","title":"Monolith: Real Time Recommendation System With Collisionless Embedding Table","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07663","snapshot_observed_at":"2026-08-05T05:30:31.320766Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.320766Z"},"links":{"cited_paper":"/paper/2209.07663","citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:73413e2a9b6cd1dd0e67cdd1f3cf035043e9ef9963b34d7ec711d5acff43994e","observation_id":"3933ef2b-3d2e-43ff-9480-749cb2a613e9","resolution":{"observed_at":"2026-08-05T05:30:31.320766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.758069Z","title":null,"venue":null,"work_id":"741fd3c7-7014-476f-89c4-c149a9c8364c","year":2017},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.324262Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:db3284540f35d4c3df832893e47ba291e865eac502816b6785bee57d63ad898c","observation_id":"84145b36-f4e7-41a9-b68f-8ea0d9dd9244","resolution":{"observed_at":"2026-08-05T05:30:31.762385Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.746065Z","title":null,"venue":null,"work_id":"32eace03-c935-4c02-8b25-7b6a1009dd18","year":2010},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.327570Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:ae899a4db8e43ccd7087c9b7e5795ca6ee39b722c5d5ad7e7ec409ed2409ae95","observation_id":"a94053b0-c596-43f8-9f46-cda613f7f8d3","resolution":{"observed_at":"2026-08-05T05:30:31.749887Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1808.00720","last_updated":"2018-09-14T11:58:09Z","snapshot_observed_at":"2026-08-14T18:45:12.084753Z","submitted_at":"2018-08-02T09:13:18Z","title":"RecoGym: A Reinforcement Learning Environment for the problem of Product Recommendation in Online Advertising","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.00720","snapshot_observed_at":"2026-08-05T05:30:31.331145Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.331145Z"},"links":{"cited_paper":"/paper/1808.00720","citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:562642b48f7d67dd939791e44229984d0a2ac010e4086f54c0110bfb44ec75c9","observation_id":"29f41471-6aec-4878-bb88-0efbf70983e0","resolution":{"observed_at":"2026-08-05T05:30:31.331145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.334929Z","title":"Rosenblatt","venue":null,"work_id":null,"year":1958},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.334929Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:62e636829c87d20ac4a5ff74a266f5d39f9f720c3129f555a6c19cc123498e1e","observation_id":"975893d5-a647-4bfb-8836-f86e32841d9e","resolution":{"observed_at":"2026-08-05T05:30:31.334929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.735188Z","title":null,"venue":null,"work_id":"2fc4f5b9-0e5f-4e68-bf15-1b8bb2d44e5d","year":2018},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.338278Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:5bc0ba6fb787e3657366ce0f5ee494532dd232df717fd48efd1d486c64a406a1","observation_id":"12f553ee-b2bc-4774-92ea-a72c20e7bc57","resolution":{"observed_at":"2026-08-05T05:30:31.738967Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.724211Z","title":"1984.Temporal credit assignment in reinforcement learning","venue":null,"work_id":"a160a549-b979-448d-b6ed-75c1ad3924ed","year":1984},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.341559Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:7b6eada9d627cf35cb1e975681bbdaaede2a7a17084adca6b053e5b5e6ff211b","observation_id":"4a4d4b7b-a031-4149-a11d-8bcf930e3546","resolution":{"observed_at":"2026-08-05T05:30:31.728205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.344794Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.344794Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:a6de8be99d365e9ff8c459e394ef77e49fa5c193ea0ea0bf7e68f63e6a19c570","observation_id":"efa4e5ba-ae6f-46c2-b4b7-279eab08513b","resolution":{"observed_at":"2026-08-05T05:30:31.344794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.708044Z","title":null,"venue":null,"work_id":"434e5802-2f30-4bf6-81ba-3f98bc5271ad","year":2023},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.348652Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:d4f56948f3a34d91dd8cc7157b4a5fdcf5c757541027e1bd7caf7e222daabd38","observation_id":"1411ef85-8440-4880-b5f4-56ca75ee24f4","resolution":{"observed_at":"2026-08-05T05:30:31.711560Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.352339Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.352339Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:cf371fb67d27d761dad979abceaff7fd4ff3528a35e874c96419a6dbc59f1d65","observation_id":"2be04e54-3b59-4614-af1e-2c6f6ad95ef1","resolution":{"observed_at":"2026-08-05T05:30:31.352339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.356475Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.356475Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:1b07c276ea03bc3df018746a069c9583980697ea11d7ab20ad5def3f2b1c6434","observation_id":"a1444093-e47b-4c0a-8777-5581d93dc45e","resolution":{"observed_at":"2026-08-05T05:30:31.356475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.359767Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.359767Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:2604be4ca0ef8efc07583e6f22416b0ecfb5092201dfb0a7c386d5ac6a5de1a8","observation_id":"385b8985-7d8a-4b53-91f1-67d37ea3b541","resolution":{"observed_at":"2026-08-05T05:30:31.359767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.680361Z","title":"1987.Reinforcement-learning connectionist systems","venue":null,"work_id":"8054eda2-2f87-4f5a-a8a3-72cf4f4cd4a1","year":1987},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.363193Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:aac186d7ae70cd07ce82281796b531b2edf0ac97c765a6666a2795d47242a447","observation_id":"96f4ce8c-7c49-49ff-a45e-cc0325a48ac3","resolution":{"observed_at":"2026-08-05T05:30:31.684111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.366972Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.366972Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:ad683ad9da0df1e4ebf3f7e777762925f64d9c2072e857a8e4020bec0d9c31a7","observation_id":"6b85f7ff-8703-43bd-9594-3158a41fc07d","resolution":{"observed_at":"2026-08-05T05:30:31.366972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.664031Z","title":null,"venue":null,"work_id":"cbdb93ca-cc69-4265-a70a-7bc2af9faf66","year":1977},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.370984Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:a138b5bf62b61c436a81f8a1213326d70537488ab0753e7d3fe0158c52ed47df","observation_id":"47b17142-8cef-44f8-b131-38c92ad8482a","resolution":{"observed_at":"2026-08-05T05:30:31.667419Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.374809Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.374809Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:3883f4a3c5f09eaea50ca8714cb692fd43d6a92452e72721aee72107a3f2ec9d","observation_id":"acaa94d3-ba75-467d-97e8-d2b8714ee220","resolution":{"observed_at":"2026-08-05T05:30:31.374809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.644603Z","title":null,"venue":null,"work_id":"26ba56af-7a47-472f-9da4-3870255d43a8","year":2021},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.378556Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:fe29af6fad73638b37e587841d187b01756e3c8795bb873f4820a38a2e860436","observation_id":"c04006be-cd1a-49cf-90bc-09b783f1d381","resolution":{"observed_at":"2026-08-05T05:30:31.649866Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.382096Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.382096Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:176c0936d40efb9c130d611746ac3dd301d42346ef1dd02a9615e356f203b156","observation_id":"382f3390-793d-4a50-980a-eb6924516473","resolution":{"observed_at":"2026-08-05T05:30:31.382096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17152","last_updated":"2024-05-06T02:05:45Z","snapshot_observed_at":"2026-08-16T20:04:50.187441Z","submitted_at":"2024-02-27T02:37:37Z","title":"Actions Speak Louder than Words: Trillion-Parameter Sequential Transducers for Generative Recommendations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17152","snapshot_observed_at":"2026-08-05T05:30:31.385487Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.385487Z"},"links":{"cited_paper":"/paper/2402.17152","citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:a83f7a0245d592f7730c827ff14f08d07f1b0bbf5458c0ea89b951d15f94e37e","observation_id":"6ccddf19-27af-4dde-8257-ff9c820ec5e4","resolution":{"observed_at":"2026-08-05T05:30:31.385487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.634049Z","title":null,"venue":null,"work_id":"86666562-365e-4ec4-a443-6004a01e5dee","year":2018},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.389445Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:a79772d093d6bfdbc54c856a418b0e702380b41fbfc956f4f1adfbfbcf150947","observation_id":"2b58fd15-37c5-466c-a161-7fe35805c734","resolution":{"observed_at":"2026-08-05T05:30:31.637542Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.394050Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.394050Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:25f0015eb64e959cba29b693934a6c1945e5536fba35d52e5bdd0be637fff5bd","observation_id":"0d1db9dc-463b-4408-86f5-24bfb72ec1a6","resolution":{"observed_at":"2026-08-05T05:30:31.394050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.615616Z","title":"Deep reinforcement learning for search, recommendation, and online advertising: a survey","venue":null,"work_id":"66e7767c-2aba-4234-a3a0-dfd6ab60fa25","year":2019},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.398600Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:6c68d2dfa364a2520882e6eb0e599318d98b428b0000d514d831eca26b7a1bf8","observation_id":"5e122a06-5f13-427d-92f6-56724a00de73","resolution":{"observed_at":"2026-08-05T05:30:31.619456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.402492Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.402492Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:644205be98332e711dfb449d28e1a2828c4559aa52dba448fa07f7ef69dd9017","observation_id":"bb38321f-1fa2-44ac-a111-7dc9a95a2c5f","resolution":{"observed_at":"2026-08-05T05:30:31.402492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.405592Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.405592Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:df155ea21cbe002cc9dbfa96b0aa13339d8bf9fe56b50194d03b2501758f8222","observation_id":"ab8ce50b-f6f5-4115-8e6b-1826f8985a5b","resolution":{"observed_at":"2026-08-05T05:30:31.405592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.592108Z","title":null,"venue":null,"work_id":"45a5ce44-6abe-4f65-a75c-c9d8b2b75055","year":null},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.409046Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:9579b07a4834266aad4ebc738b2b890435200389c93c4fcdf98d650785d5aadd","observation_id":"2eb88476-28a0-427f-bb6a-23ad30504de1","resolution":{"observed_at":"2026-08-05T05:30:31.595828Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.564514Z","title":null,"venue":null,"work_id":"9ccbcc24-4ab1-4312-ab49-25bc82a3e381","year":2018},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.417206Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:d437f9f189fb20e3c1350533cf27c6efcc75601fdc1cd9c631443754a1ef081b","observation_id":"c4ec5258-eb2f-40f3-ad3c-fc1f421e1f1e","resolution":{"observed_at":"2026-08-05T05:30:31.569567Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.280505Z","title":"InProceedings of the 1st workshop on deep learning for recommender systems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.280505Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:2d86bbef6f6bbecd0e0973862414b690e5c128982457e7e92c06ec7729ef1a25","observation_id":"a199e549-a6e0-4552-a035-cd72dda05b9d","resolution":{"observed_at":"2026-08-05T05:30:31.280505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:30:31.578809Z","title":"InProceedings of the 26th ACM SIGKDD International Conference on Knowledge Discovery & Data Mining","venue":null,"work_id":"15e07d17-06f1-44fa-aa4b-536099a3a2bb","year":null},"citing_paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-05T05:30:31.413365Z"},"links":{"citing_paper":"/paper/2509.05292"},"observation_digest":"sha256:e9e281eafe6ec13385a8c0d8a3be2d08595bac33d47d2d2b2067e14967e6a41b","observation_id":"e64a2954-ab28-4c6f-8f40-cfe655b1de64","resolution":{"observed_at":"2026-08-05T05:30:31.584089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.05292","last_updated":"2025-09-05T17:57:45Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T14:20:44.437978Z","submitted_at":"2025-09-05T17:57:45Z","title":"Deep Reinforcement Learning for Ranking Utility Tuning in the Ad Recommender System at Pinterest"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2509.05292."}