{"as_of":"2026-08-10T07:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1e9cf2b0cd14a6f8674768c192360efc28da087523b9e784ec6ba11524c9b404","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T14:06:43.111839Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.18910/citation-record","integrity":"/paper/2607.18910/integrity","json":"/paper/2607.18910/citation-record.json","paper":"/paper/2607.18910"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:34.790136Z","title":"Mehdi Afsar, Trafford Crump, and Behrouz Far","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:34.790136Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:e2f912e0528bb5e95411702119dbd02160c0e7a283af33d7838ce9060fd266d6","observation_id":"10fc4361-5eaa-4017-b0b1-766cc14f0023","resolution":{"observed_at":"2026-08-01T14:06:34.790136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:34.968800Z","title":"Aggarwal, Alexander Hinneburg, and Daniel A","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:34.968800Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:577212974607cb64c622b63e7e8eda1e503e53d81aa3adf4a16324485db54c43","observation_id":"a6bb69c8-205d-46db-961d-b007f5343cf9","resolution":{"observed_at":"2026-08-01T14:06:34.968800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:35.094038Z","title":"Deep reinforcement learning: A brief survey.IEEE Signal Processing Magazine, 34(6):26–38, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:35.094038Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:f6f840f0e866850a98431680746c1560a8ed564b6ab73163f939fd458354805b","observation_id":"51dc4d18-0719-41f9-b279-26e43aee17d0","resolution":{"observed_at":"2026-08-01T14:06:35.094038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:35.255716Z","title":"A framework for behavioural cloning","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:35.255716Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:264c8fde418ea77787554dac471b5b1d3625e6119c9161c077d7dfe3c3993de5","observation_id":"754678c3-a19e-4e47-aaee-c6c236df6135","resolution":{"observed_at":"2026-08-01T14:06:35.255716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:35.420552Z","title":"Representation learning: A review and new perspectives.IEEE Transactions on Pattern Analysis and Machine Intelligence, 35(8): 1798–1828, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:35.420552Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:387a3bd6f8b2aad094f2b6d39382f35a0e2ad179b01bd50d454400868eb76db6","observation_id":"c7dad470-dc30-4f16-911d-3535893bb8ce","resolution":{"observed_at":"2026-08-01T14:06:35.420552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:35.554125Z","title":"Modeling delayed feedback in display advertising","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:35.554125Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:be92a7042cd049e49fe6993488be6e8ed1fb71f6c5ba3e2d30770c19fd9f7f5a","observation_id":"d0e8b32d-a6c8-43b6-8890-dcf256f26420","resolution":{"observed_at":"2026-08-01T14:06:35.554125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:35.696363Z","title":"Decision transformer: reinforcement learning via sequence modeling","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:35.696363Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:92796af26f0ad3cc5d1a5b4238ddd68115ad9b8695fe2afbf3a1e99fc0d33fb3","observation_id":"37275e7b-3f8b-4284-8750-1e6ebe6230fa","resolution":{"observed_at":"2026-08-01T14:06:35.696363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:35.818038Z","title":"Reinforcement learning for non- stationary markov decision processes: the blessing of (more) optimism","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:35.818038Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:8b0ded8d798afba5b6477e7c706f93d5b3d2fd9a3862746c6bcf99a2993fb856","observation_id":"4f3eadb2-c9f9-4357-a3b9-14e063eb10fb","resolution":{"observed_at":"2026-08-01T14:06:35.818038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:35.985156Z","title":"Cover and Joy A","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:35.985156Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:f785d8a30686b1e3651aa55728b76c41c59ac9587efefacc5f44476f4736448f","observation_id":"83372737-db84-40ad-a7a5-b6692fd5fbb7","resolution":{"observed_at":"2026-08-01T14:06:35.985156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:36.191198Z","title":"Transformer-XL: Attentive language models beyond a fixed-length context","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:36.191198Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:d0b8692a6f28fdf5a0cf8a2172703db0bd89d296a8b1c001826be76effc6beaa","observation_id":"423189fa-a54c-44b3-83b4-812558cfd1bb","resolution":{"observed_at":"2026-08-01T14:06:36.191198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:36.381621Z","title":"Donti, Brandon Amos, and J","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:36.381621Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:9a448b8ccdc2f30be4535b3db77f5aecd557d97aee51dbe81b041ce380d70299","observation_id":"f4932f4b-4e68-4554-a313-b59f827cda62","resolution":{"observed_at":"2026-08-01T14:06:36.381621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:36.552420Z","title":"predict, then optimize","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:36.552420Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:90575fa378f28d84f35ae5b6d1ab3194ea3eec9bb1bb42a73375edb5b81a8693","observation_id":"026d515e-4dac-46dc-95d4-84a23d552ed4","resolution":{"observed_at":"2026-08-01T14:06:36.552420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:36.685299Z","title":"Dai, and Quoc V","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:36.685299Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:8c53b08c7e672d30e2a161a6ec9a5290ec93f82fc2aa97c076ab56255ad68922","observation_id":"78b86788-2332-4cab-8e01-8829d990855a","resolution":{"observed_at":"2026-08-01T14:06:36.685299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:36.800135Z","title":"Maxwell Harper and Joseph A","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:36.800135Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:63428fd4ead796a47b2ba5ead2055a839745fdfddec848f42522e26be0f72621","observation_id":"7bef5cc6-54ba-439f-9299-ce4a2bd9e92a","resolution":{"observed_at":"2026-08-01T14:06:36.800135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:37.000749Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:37.000749Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:9198d764213574730ec40b4c9514413574b9e2a4f197f21b262fdebc990b4992","observation_id":"14632ef7-645e-431c-a24e-0d42c41ffb04","resolution":{"observed_at":"2026-08-01T14:06:37.000749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:37.192270Z","title":"Neural collaborative filtering","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:37.192270Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:9251f4cc4e7959f5804859b984dbaf5a5a78a024ef9ac1ffe67aa5224de796cf","observation_id":"3f42681e-4031-4b92-9ecc-d9318fceaac9","resolution":{"observed_at":"2026-08-01T14:06:37.192270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:37.400266Z","title":"Distilling the knowledge in a neural network,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:37.400266Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:511fd41d2ea107256673846a0111c2a6db2a45700160bc453a178e76b694f49a","observation_id":"35c245e6-c207-4ad2-ade2-fd2059a6e5a3","resolution":{"observed_at":"2026-08-01T14:06:37.400266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:37.654476Z","title":"Multilayer feedforward networks are universal approximators.Neural Networks, 2(5):359–366, 1989","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:37.654476Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:c31c59b4a70daf5739bda50081c4feb9e017f9a4b25da6e956352260a5a7de34","observation_id":"e3275146-14d6-40f3-ae51-bb50e72bbbf9","resolution":{"observed_at":"2026-08-01T14:06:37.654476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:37.765793Z","title":"Arbitrary style transfer in real-time with adaptive instance normalization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:37.765793Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:cd92c8f58724f9fd99853f73f08acae7a6a58b422248f02157ccf685ebe3b057","observation_id":"504fb872-c3f7-43f8-b7b3-f332ff3b218d","resolution":{"observed_at":"2026-08-01T14:06:37.765793Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:37.894028Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:37.894028Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:e119cc016570f1aa8a90ee321683d397aa111563b9b3a15f93072043a971bd5d","observation_id":"5938d0fe-5f27-4f0d-a7a8-49333f06c13f","resolution":{"observed_at":"2026-08-01T14:06:37.894028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:38.028577Z","title":"Littman, and Anthony R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:38.028577Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:16c2b411fa879d8be207d7574946e69e08f5201661595d3e8c29ae6d4de5175b","observation_id":"9a0f88e7-9f37-4735-b760-d37ff9f81797","resolution":{"observed_at":"2026-08-01T14:06:38.028577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:38.332567Z","title":"Self-attentive sequential recommendation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:38.332567Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:89e2c08d87b6e6f808c0e25ed1bc079326c9f860bd207477ec1910541b8b1b24","observation_id":"4791ac7b-3dca-45dd-86b1-35274e9aa7e4","resolution":{"observed_at":"2026-08-01T14:06:38.332567Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:38.460482Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:38.460482Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:b4788d7f9afb0b45e37941bd5622dee045e2488200c6fe6f57af624c0174b0d0","observation_id":"d245d95c-307f-470b-bc3a-d0dfebae7a01","resolution":{"observed_at":"2026-08-01T14:06:38.460482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:38.695486Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:38.695486Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:ebe278f9219ddc22f0d13892f57b130df36e4489108fdcdf16930041d77a70f8","observation_id":"c7de051b-ea4b-4088-bc1d-dde0b3d5e7e5","resolution":{"observed_at":"2026-08-01T14:06:38.695486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.ejor.2013.10.060","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kolm, Reha Tütüncü, and Frank J","venue":"European Journal of Operational Research","work_id":"b925ea5a-e54b-4c9a-9a35-9a359c263465","year":2014},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:38.818042Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:ed1f185520852338ea5c67d36652bf3d1af2ae1ddb50ffd8c299a9cc620b2ba9","observation_id":"93496c11-c606-43e0-b6e7-1823ed32a0be","resolution":{"observed_at":"2026-08-01T14:08:34.297345Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:38.928965Z","title":"Celi, Omar Badawi, Anthony C","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:38.928965Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:9d399a9a57f6c516fcad6813240b3a27a04f41807f527b039221d4a595a718b3","observation_id":"74bb85c3-5dbf-49bd-9e07-70d2a3792cb9","resolution":{"observed_at":"2026-08-01T14:06:38.928965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:38.997142Z","title":"Offline reinforcement learning with implicit q-learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:38.997142Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:ceaad4685389b1d7587b19c0c0ba57b3c1f59ec80da6c08b89964e87ad73a80c","observation_id":"e070413e-2c5e-4a04-b427-0ef8d87d7ea2","resolution":{"observed_at":"2026-08-01T14:06:38.997142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:39.076820Z","title":"In-context reinforcement learning with algorithm distillation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:39.076820Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:1f6de25402021b9cc3ef95c50c7a328f17200770fa9c43fd7798011158d4bac1","observation_id":"d90a6cc6-6a1c-4ee5-995b-4049577b64cb","resolution":{"observed_at":"2026-08-01T14:06:39.076820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:39.238848Z","title":"LeCun, Léon Bottou, Genevieve B","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:39.238848Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:1f3d90f29e91e11389c361a8b8b5aa0d9e239aac3367f7a2e526bc4225579e2e","observation_id":"6480fa5b-b240-4598-bb6a-c35a7d73cff5","resolution":{"observed_at":"2026-08-01T14:06:39.238848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:39.318760Z","title":"Robust performance hypothesis testing with the sharpe ratio","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:39.318760Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:de05ffa08000f77f945ff98cf6ee67e801f720142df8dfb1f679900e100a6a21","observation_id":"ec3f3517-fbcc-410b-8f4d-c4975185e4f6","resolution":{"observed_at":"2026-08-01T14:06:39.318760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:39.448265Z","title":"Context-aware dynamics model for generalization in model-based reinforcement learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:39.448265Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:360766ded8d11e4bc2332f8e8511a459952e65c67353339b5eb3adc8c6f47ccc","observation_id":"efc56a55-57ac-4326-b195-565c2bc98ebc","resolution":{"observed_at":"2026-08-01T14:06:39.448265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:39.570494Z","title":"End-to-end training of deep visuomotor policies.J","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:39.570494Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:5f33a7dffef8e23f63a03904d9461d50fda9a02c0a0a3cb69d108fdc009a3eaa","observation_id":"a971e0dc-510f-4e27-a4ba-e16eebe49c8b","resolution":{"observed_at":"2026-08-01T14:06:39.570494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:39.700590Z","title":"A survey on transformers in reinforcement learning.Transactions on Machine Learning Research,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:39.700590Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:312d0ae6fa66c41974aabad9c29ff3fdf47348f03770a7fb4459cba85a5e2bc5","observation_id":"3ec5ffc7-ffdb-49f7-b165-77199f7adacc","resolution":{"observed_at":"2026-08-01T14:06:39.700590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:39.952665Z","title":"Decision-focused learning: Foundations, state of the art, benchmark and future opportunities.J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:39.952665Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:06b25bb02376697fdfeba16352cee67877caabadd2b65bb11367b913469b9287","observation_id":"38ef0900-131b-4712-ba29-d720b2f2682d","resolution":{"observed_at":"2026-08-01T14:06:39.952665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:40.080583Z","title":"Causal transformer for estimating counterfactual outcomes","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:40.080583Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:ab152111272eb6c04150361fbd34659ea48bfbb93f4a988a3b5797d17f87f7e2","observation_id":"a5347fa5-0546-41f1-a801-3212a0cfcbed","resolution":{"observed_at":"2026-08-01T14:06:40.080583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:40.210736Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:40.210736Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:70ca1348508e03438386dd2ac01da81923fc6d07aa8d14fed9996c8c807de086","observation_id":"0a2e5207-f7fa-4c24-a558-d1eedaa82b01","resolution":{"observed_at":"2026-08-01T14:06:40.210736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:40.344610Z","title":"Ng, Daishi Harada, and Stuart J","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:40.344610Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:de5385b1c46608710f051c456ac4aa2d6c394ef02538fba15723f34025a69cef","observation_id":"02971a72-b9ca-4d7f-b56a-556ac6deb40f","resolution":{"observed_at":"2026-08-01T14:06:40.344610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:39.819856Z","title":"URL https://openreview.net/forum?id=r30yuDPvf2","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:39.819856Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:8b483b6c388fa872eeec5f281a5cfa6a7e76fea5754c89ff504f93dfc8f69886","observation_id":"0b216fd8-9534-4dea-ac02-7bfb94c40d83","resolution":{"observed_at":"2026-08-01T14:06:39.819856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:40.575348Z","title":"Francis Song, Jack W","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:40.575348Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:3369e92c3b06a4ecac5308997a7bc04c26a8fed410ee8467bcdf355519fc4ce8","observation_id":"f09d3c4c-865b-496b-9338-feb4fb6c53d0","resolution":{"observed_at":"2026-08-01T14:06:40.575348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:40.651584Z","title":"Semantic image synthesis with spatially-adaptive normalization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:40.651584Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:cb620cf2e2c1550caf93366746a6ef4e701fc05593d2da6a7e6ca98967a458bb","observation_id":"40eea765-1c3a-4c5a-8c99-2c70df5cc3a5","resolution":{"observed_at":"2026-08-01T14:06:40.651584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:40.712408Z","title":"Film: visual reasoning with a general conditioning layer","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:40.712408Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:02fe56aca73996654eaf9642d3700492518f841eb41179e7699256ee9b75bf6a","observation_id":"1276cf1a-cc9a-4bf5-a1e2-2f82b15bf126","resolution":{"observed_at":"2026-08-01T14:06:40.712408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:40.768119Z","title":"Differentiation of blackbox combinatorial solvers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:40.768119Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:4c82a15f7e99740e1bbc9769322404bfffc175939a9b5b69ee481e751faf67a0","observation_id":"c093ee51-4f8a-4c2a-83f0-410b05aada1b","resolution":{"observed_at":"2026-08-01T14:06:40.768119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:40.468062Z","title":"The econometrics of financial markets.Journal of Empirical Finance, 3(1): 15–102, 1996","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:40.468062Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:b19e308e5003af2521fbed5cbc603213f1cc129b0fa93a83623ac7684909c5c9","observation_id":"5cef375a-aa98-4c47-9e39-3d5edddb36c5","resolution":{"observed_at":"2026-08-01T14:06:40.468062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:40.872611Z","title":"A reduction of imitation learning and structured prediction to no-regret online learning","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:40.872611Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:3ed50e5b30fa42cb0e24d695f8f6698db5e81806ec2fef24ae1b11026b701ddf","observation_id":"b74ed2b4-dafb-4fd3-a8fd-0114f2c9fcfa","resolution":{"observed_at":"2026-08-01T14:06:40.872611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:40.953497Z","title":"McGraw-Hill, New York, 3 edition, 1976","venue":null,"work_id":null,"year":1976},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:40.953497Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:538c8ae21796060b9dcbc5b4c0662aecb9e5477fe6b13d347782d40ec2860e10","observation_id":"48337fb3-519d-4198-b6c0-329f9884d3bb","resolution":{"observed_at":"2026-08-01T14:06:40.953497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:41.103501Z","title":"Rumelhart, Geoffrey E","venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:41.103501Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:cdbb9f2609934f6c725cd26f50f31aea3346842b627c2849eea391b056f4becd","observation_id":"d04accd7-f2f9-4740-8d1e-96337fd79db9","resolution":{"observed_at":"2026-08-01T14:06:41.103501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07071","last_updated":"2025-08-13T15:48:10Z","snapshot_observed_at":"2026-08-06T21:10:35.884042Z","submitted_at":"2024-10-09T17:15:30Z","title":"Retrieval-Augmented Decision Transformer: External Memory for In-context RL","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07071","snapshot_observed_at":"2026-08-01T14:06:41.227276Z","title":"Retrieval-augmented decision transformer: External memory for in-context rl","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:41.227276Z"},"links":{"cited_paper":"/paper/2410.07071","citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:be21b25e7135e99406ebd556e675008c1d63b0f9ff39481d617e3b6f3d0bd2c8","observation_id":"821bb1f5-0399-45cb-bc5f-b44a9b91d3fd","resolution":{"observed_at":"2026-08-01T14:06:41.227276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:40.820653Z","title":"Pomerleau","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:40.820653Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:aaafca40429f7a11babf5479ef9267ead99648df8e9a2ba2f45a987589c9d027","observation_id":"e9727a6c-1488-4bc1-8a27-e69239533547","resolution":{"observed_at":"2026-08-01T14:06:40.820653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:41.509754Z","title":null,"venue":null,"work_id":null,"year":1948},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:41.509754Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:abf83cb16d2710cddcf28f88d92600b0f8028669b4617703115ec88800481cb5","observation_id":"8a5dd56f-0f8f-47b9-8001-ff964a3e4126","resolution":{"observed_at":"2026-08-01T14:06:41.509754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:41.656750Z","title":"Bert4rec: Se- quential recommendation with bidirectional encoder representations from transformer","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:41.656750Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:0569d77a2b356d86eb2a86410a7e63091a83fe9dfc173de749026e878cbc7063","observation_id":"f0d6a6cd-76cb-4771-8163-bafb87eec2da","resolution":{"observed_at":"2026-08-01T14:06:41.656750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:41.774028Z","title":"Sutton and Andrew G","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:41.774028Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:29929702c2601ff0330b72a049cbbecef3f3f98d0eaab93c67bb0292b9e27cc7","observation_id":"14c34623-80e6-4720-8670-185d772ef349","resolution":{"observed_at":"2026-08-01T14:06:41.774028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:41.956506Z","title":"Gomez, Łukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:41.956506Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:6a40393be565aed746fb9d8f4f80feccdb09391c4d393ec177b3954f7c1877d7","observation_id":"d9debca5-c9bc-4f6b-9085-5121934b640c","resolution":{"observed_at":"2026-08-01T14:06:41.956506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-01T14:06:41.373780Z","title":"Proximal policy optimization algorithms, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:41.373780Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:957cb4d40fc77cc173efcbdc63a417c85f44cd855f0f545b12ed4f3a7d68ce84","observation_id":"7805ec46-110f-421e-a880-15b6ebd1777f","resolution":{"observed_at":"2026-08-01T14:06:41.373780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:42.214658Z","title":"Continual test-time domain adaptation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:42.214658Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:86f2151703dab4b122c91ee4b6aa231147efc7ead1a8fcac6841eb0475a18ae3","observation_id":"b39a9066-bd86-43fa-9dd9-a2098828b6ec","resolution":{"observed_at":"2026-08-01T14:06:42.214658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:42.360024Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:42.360024Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:806fdbe91b54a196620cba1018d997b4d47e9bd0522a92d986071eb763997409","observation_id":"7883627a-630e-410e-99a9-3be14f3df07a","resolution":{"observed_at":"2026-08-01T14:06:42.360024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:42.471445Z","title":"Melding the data-decisions pipeline: decision- focused learning for combinatorial optimization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:42.471445Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:24ad03579a7f70122e7e18604a47a79fc4d10bc28cd569df99caab380db7d522","observation_id":"173bb087-6740-41f0-9000-e3b5885bbce2","resolution":{"observed_at":"2026-08-01T14:06:42.471445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:42.599763Z","title":"Elastic decision transformer","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:42.599763Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:ff98332eccd7de3da1d1876ab2b1decf226659679849c97b15631db4d3606a87","observation_id":"ee352680-caa8-45ce-96a5-11bc85cb4461","resolution":{"observed_at":"2026-08-01T14:06:42.599763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:42.070186Z","title":"Tent: Fully test-time adaptation by entropy minimization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:42.070186Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:769d88cc8504772a8652f4e7bcd8d929582ff045de2a80c9971d96b0bb7de04a","observation_id":"975a2c01-5db1-4102-a9a6-a37dfaf853f2","resolution":{"observed_at":"2026-08-01T14:06:42.070186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:42.788573Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:42.788573Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:5aa18a587633e428dd37656e1321d4fb83c2907e87271a19cb25467989984b0e","observation_id":"adef5907-eaf2-414d-9cb9-a7ecbd64fc94","resolution":{"observed_at":"2026-08-01T14:06:42.788573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:42.868711Z","title":"Are transformers universal approximators of sequence-to-sequence functions? InInternational Conference on Learning Representations, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:42.868711Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:fb81139ef4d6a04481ab3e18838efdaadff3389b210fbb9df6f48a291dddd16a","observation_id":"7e3df373-b6a8-49e8-a87b-e2875b92f078","resolution":{"observed_at":"2026-08-01T14:06:42.868711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:42.923556Z","title":"A survey of autonomous driving from a deep learning perspective.ACM Comput","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:42.923556Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:2b564da3401ec3bf20e210e077ef81bfe8fdbbd70652e383c8f7adcc66e7a64f","observation_id":"38fdcbd2-a3b9-421d-9fa6-c026ebc3b178","resolution":{"observed_at":"2026-08-01T14:06:42.923556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:43.001713Z","title":"Online decision transformer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:43.001713Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:5aa77bc7743a348fe070e895eb46c75ec4a6fb0fecaed5ed5528e9a1ec44707d","observation_id":"5dd1303f-97f2-4332-b25a-10c2dd387039","resolution":{"observed_at":"2026-08-01T14:06:43.001713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:42.727395Z","title":"Download historical data in Yahoo Finance","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:42.727395Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:009c193a805c12630924831d3d66ea2bf237fb1ce481756ab951cf21099a13e3","observation_id":"87d22444-1d68-495b-aae1-fab742735271","resolution":{"observed_at":"2026-08-01T14:06:42.727395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:43.111839Z","title":"UE & regime lr","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:43.111839Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:c4ceb5f17fd353a75db02d3e46e0114c5925324a97560f334d8eaef1f6b207f0","observation_id":"1cd5c40d-0a22-48b1-926c-ae855f30b716","resolution":{"observed_at":"2026-08-01T14:06:43.111839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:38.204829Z","title":"doi: https://doi.org/10.1016/S0004-3702(98)00023-X","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":1998,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:38.204829Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:ea5f856cba3b6766ae74df36a9f892c44d2a65c4ca9af79bf9b541e7d85acc12","observation_id":"700f5f5f-abfe-4473-873e-0d43acf81dc8","resolution":{"observed_at":"2026-08-01T14:06:38.204829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:38.567279Z","title":"doi: https://doi.org/10.1016/j.eswa.2010.10.027","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":2011,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:38.567279Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:09ce8ac11ac49f51ad7ae7e8805fa34ad2bce49f7e7924106a59f7403e66077b","observation_id":"e13a3687-94af-47b0-b456-af19a8992208","resolution":{"observed_at":"2026-08-01T14:06:38.567279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-01T14:06:37.582275Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:37.582275Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:1d897069cf9c93d35b17e2d39d0601e45fdc398aec0da612453c52574ced48c8","observation_id":"ec7f1430-ea46-46cf-be9e-7ad75f5e15d9","resolution":{"observed_at":"2026-08-01T14:06:37.582275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:06:39.144476Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-01T14:06:39.144476Z"},"links":{"citing_paper":"/paper/2607.18910"},"observation_digest":"sha256:4d350154d167de693ed3e6fedb8194291304358b79538fb69b7b4fd75edd9867","observation_id":"899aea78-33ae-4986-88d5-e740cc9a2cc9","resolution":{"observed_at":"2026-08-01T14:06:39.144476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.18910","last_updated":"2026-07-21T09:52:23Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-02T04:00:55.069225Z","submitted_at":"2026-07-21T09:52:23Z","title":"Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":65,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 0 inbound Pith citation observations for arXiv:2607.18910."}