Pith. sign in

Paper Citation Record · LEDGER

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning

As of 9 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 1 inbound Pith citation observation for arXiv:2505.19769.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.19769 v2

Coverage vector

measured 55 of 55 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T14:12:39.980717Z

measured 56 of 56 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-05-21T14:07:10.387869Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-21T14:10:13.290156Z

Reference resolution

55 of 55 outbound references displayed

  • verified exact0
  • verified fuzzy49
  • unresolved6
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 27024c23-bf04-4f95-940f-23bed71c8ed5 · outbound

This paper cites Reinforcement learning control of a flexible two-link manipulator: An experimental investiga- tion,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Reinforcement learning control of a flexible two-link manipulator: An experimental investiga- tion,

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:48.980192Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:36.075020Z digest=sha256:389b13f2eb8b6cd2470551fe4e6a1178bb59b64148d876ee9895f2e6a285e04c

Observation 1abc96b1-5307-4a78-b372-3c4875891862 · outbound

This paper cites A hierarchical deep reinforcement learning framework for 6-dof ucav air-to-air combat,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning A hierarchical deep reinforcement learning framework for 6-dof ucav air-to-air combat,

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:48.786602Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:36.140710Z digest=sha256:dd40786afbe2708dabd478b7a4c07f15cdce548b324a2160449123033ef2583a

Observation 225c0f0c-5c41-4fbc-9909-df8e35703d79 · outbound

This paper cites Conrft: A reinforced fine-tuning method for vla models via consistency policy,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Conrft: A reinforced fine-tuning method for vla models via consistency policy,

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:48.668624Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:36.212152Z digest=sha256:32b676696592bf99837f4dc829f2c16bbce4a7f123fc59e8e75b57a31451f216

Observation 14bdcf12-d5af-4640-95fb-450e6caad0a4 · outbound

This paper cites End-to-end robotic rein- forcement learning without reward engineering,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning End-to-end robotic rein- forcement learning without reward engineering,

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:48.464203Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:36.286207Z digest=sha256:32ef7e51eb29ab4d672810a0f143e1879ba994bae51a5108912fc58ff19053b0

Observation 8eee8e24-f7e1-4009-b36e-a37673c1e7d2 · outbound

This paper cites Deep learning in robotics: Survey on model structures and training strategies,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Deep learning in robotics: Survey on model structures and training strategies,

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:48.293567Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:36.381085Z digest=sha256:2e248746d0e771c015cc9cab91520a379bab223f53b1930ca9c45b2a451508e5

Observation c56853e9-357e-4fdb-9f96-d96174c16464 · outbound

This paper cites Deep reinforcement learning-based automatic exploration for navigation in unknown environment,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Deep reinforcement learning-based automatic exploration for navigation in unknown environment,

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:48.109248Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:36.453689Z digest=sha256:84b5c287d383ea1af901e33dfb5c4f50227df4acc08f57cc724781ed1d6f63a9

Observation d46f445b-e656-431f-adc1-abe139950ee4 · outbound

This paper cites Reward design with language models,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Reward design with language models,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:47.912083Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:36.556922Z digest=sha256:a87593c8a8da20f2ba091892bc1e012426aae06ec4a483478d1bc3be77d6c09e

Observation b501e6ce-83e3-458f-9aa3-add038e931a7 · outbound

This paper cites A survey of inverse reinforcement learning: Challenges, methods and progress,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning A survey of inverse reinforcement learning: Challenges, methods and progress,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:47.760505Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:36.638152Z digest=sha256:a5f39e1e951c8c1798cc8bc96adcf32e5fa5c8695b85e773fc4a2a62fd5146b8

Observation 7da671b2-4475-4e32-99d6-66747769b72d · outbound

This paper cites Concrete Problems in AI Safety.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Concrete Problems in AI Safety

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-07T14:12:36.725785Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:12:36.725785Z digest=sha256:6f1242209692d889fc92a6e2bee0a26f9b7e821e14131a22027dba08ee62345a

Observation c3cbd773-c63e-4274-929f-098bf17c90eb · outbound

This paper cites VIP: towards universal visual reward and representation via value-implicit pre-training,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning VIP: towards universal visual reward and representation via value-implicit pre-training,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:49.073408Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:36.788123Z digest=sha256:97187222a8f4545e29f6ee6e1d1d88493cfb106398114ef5e1cda4646e864cfc

Observation 825f694e-f6b6-4ed6-9990-55202c3d94f6 · outbound

This paper cites Robot fine-tuning made easy: Pre-training rewards and policies for autonomous real-world reinforcement learning,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Robot fine-tuning made easy: Pre-training rewards and policies for autonomous real-world reinforcement learning,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:47.356268Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:36.977314Z digest=sha256:4d26517950d9f3ce9e4ae0689348b3dd3f64b4279c5931f4dcbd33660ef3c3cf

Observation 596ccf72-8360-4465-a1e6-5a2919135b43 · outbound

This paper cites Roboclip: One demonstration is enough to learn robot policies,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Roboclip: One demonstration is enough to learn robot policies,

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:47.158266Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:37.075374Z digest=sha256:f46c0a26c2eb36009c2d57689a022b4e0782235f22561d1e207b347422eda23f

Observation 76f78089-5877-4bfa-9fb6-a977c136a0d6 · outbound

This paper cites RL-VLM-F: reinforcement learning from vision language foundation model feedback,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning RL-VLM-F: reinforcement learning from vision language foundation model feedback,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:46.963585Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:37.154300Z digest=sha256:dc9c638b4cbee1f97d793b5d8070923ef4af74c13ae1896c7f42a850160ad2f7

Observation e7b7cd0a-ab1a-42a6-943f-d3d1263da7e7 · outbound

This paper cites Video diffusion models,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Video diffusion models,

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-07T14:12:37.242406Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:12:37.242406Z digest=sha256:8a87fc28c565a3e5b202d168b2d579c3822c84658c15057e165718a6934f873a

Observation cb591e85-a4c9-451c-bdfe-29f39d0749d3 · outbound

This paper cites Imagen Video: High Definition Video Generation with Diffusion Models.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Imagen Video: High Definition Video Generation with Diffusion Models

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-07T14:12:37.325571Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:12:37.325571Z digest=sha256:f1aade371cc9358986f87cdeb2828fd39a205a573fbe55aa21ab39bf4cc9a755

Observation f5b35545-33cc-4a89-a8ef-6156b2b944a0 · outbound

This paper cites Learning universal policies via text-guided video generation,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Learning universal policies via text-guided video generation,

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:46.835479Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:37.372947Z digest=sha256:bd1c4d02cd9135c544953e61ba2ed3692ff78cbf4d6f910d74954631a209a42b

Observation 34755670-cc72-4d5b-96d0-f8eeb95c7bf3 · outbound

This paper cites Learning to act from actionless videos through dense correspondences,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Learning to act from actionless videos through dense correspondences,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:46.646711Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:37.415391Z digest=sha256:56abf6c0f2c08910195dd42da4acfab95a7fa42cd54f101377dbe631985693b1

Observation 30648508-4028-4a03-b905-5a8c9fae517c · outbound

This paper cites Learning interactive real-world simu- lators,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Learning interactive real-world simu- lators,

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:46.467102Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:37.493384Z digest=sha256:828a21925f3abf9496c9e69083b7c2f4fe94321539ddf29cc431395cab3f5746

Observation 3a26a60b-4bf6-4682-a7ff-9bfef229619d · outbound

This paper cites Any-point trajectory modeling for policy learning,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Any-point trajectory modeling for policy learning,

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:46.275066Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:37.557884Z digest=sha256:4bfeba57e67bc183892b8a14d9832244787d8973468dccb4847440401eef8dd7

Observation e1c6dba3-f10f-4dc2-897a-232876ce1fe9 · outbound

This paper cites Reinforcement Learning with Foundation Priors: Let the Embodied Agent Efficiently Learn on Its Own.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Reinforcement Learning with Foundation Priors: Let the Embodied Agent Efficiently Learn on Its Own

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-07T14:12:37.630387Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:12:37.630387Z digest=sha256:fa044fe5b70a4f4968d33a73c737c2e70bae7bc75ef6af5f03b1f74595b9d557

Observation 3354cdda-7796-4340-a7eb-7ce23412e17a · outbound

This paper cites Video prediction models as rewards for reinforcement learning,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Video prediction models as rewards for reinforcement learning,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:46.086688Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:37.705385Z digest=sha256:e55e696a4573b189ab17eccc6723ad4c0e17ff6ec49eb87c26d66bea8b3f32e7

Observation bcb3a6e7-552d-493a-91a3-dab15c6ec1ae · outbound

This paper cites Diffusion reward: Learning rewards via conditional video diffusion,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Diffusion reward: Learning rewards via conditional video diffusion,

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:45.862965Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:37.785627Z digest=sha256:a8cc046ea9eee3dd89595f2a3ab87859e1816d6f8343918cbf1331296c8bb265

Observation 4e6c10ec-2b98-40fc-8f91-d205cd41a0c0 · outbound

This paper cites Stabilizing diffusion model for robotic control with dynamic programming and transition feasibility,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Stabilizing diffusion model for robotic control with dynamic programming and transition feasibility,

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:45.680178Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:37.870665Z digest=sha256:8f897d1327d583d447c61cade4d3c51930d43fd6c9548a93b08a9abd134a5068

Observation 1a1cc20f-eb0e-48bd-8f7f-2541f323aaa2 · outbound

This paper cites Decision making with visualizations: a cognitive framework across disciplines,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Decision making with visualizations: a cognitive framework across disciplines,

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:45.475153Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:37.934175Z digest=sha256:e4f6ffe75f90a85d9def963a6a09047d68376d638627186fe63ec96432dc90f8

Observation b90ebe25-2d59-47f3-8a65-4c6ca05b7ec9 · outbound

This paper cites MAT: Morphological adaptive trans- former for universal morphology policy learning,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning MAT: Morphological adaptive trans- former for universal morphology policy learning,

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:45.227371Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:38.018053Z digest=sha256:8045ae0c696cfc402011012e7d881487f720d582935c0dc93a060575a4dd3aab

Observation ed71ba69-0257-41dc-98c5-54dc3feab07a · outbound

This paper cites Boosting continuous control with consistency policy,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Boosting continuous control with consistency policy,

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:45.039267Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:38.057875Z digest=sha256:30b87352b430619a63560daec2355cc981a381de2698ccfd91a6d8c6ac90fbae

Observation 8626712b-1b7e-47e5-888b-bd508010bb37 · outbound

This paper cites Proximal policy optimization with policy feedback,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Proximal policy optimization with policy feedback,

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:44.844818Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:38.145685Z digest=sha256:8a61355bfd0cd41f0a3218667ecef40006f804d96f8c20bf977123e1ece50fd4

Observation 16c2e37e-f51c-466b-aa1a-d8b76582137c · outbound

This paper cites Interactive language: Talking to robots in real time,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Interactive language: Talking to robots in real time,

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:44.578228Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:38.213119Z digest=sha256:07671c336a71cffd882951beb820f46f6e11d911c84662933915c45ff476757c

Observation 43fb337f-fa29-4fc4-9474-ed9ebcc4b697 · outbound

This paper cites The surprising effectiveness of representation learning for visual imitation,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning The surprising effectiveness of representation learning for visual imitation,

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:44.369110Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:38.310805Z digest=sha256:784053988cf26a939300286a6bc57ab9d17c571e0f96b9214f8ed64862d3e7d9

Observation 523292ed-9b83-4171-a46b-47684c13c040 · outbound

This paper cites Watch and act: Learning robotic manipulation from visual demonstration,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Watch and act: Learning robotic manipulation from visual demonstration,

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:44.200187Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:38.394180Z digest=sha256:cd35cffb6af81f297fb4890a2cbafb6a72598f147578b4488bf09470bc05e68e

Observation b15d748d-8a0a-425d-8dbe-0eefc7f996d5 · outbound

This paper cites Apprenticeship learning via inverse reinforce- ment learning,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Apprenticeship learning via inverse reinforce- ment learning,

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:44.022355Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:38.453525Z digest=sha256:329a2682d0fc3a1a26daa533146bdf28c4b46eae7c03abb9bb2bddd76047bc7e

Observation e410135c-a395-471f-80fa-cc2e501c6dd1 · outbound

This paper cites Guided cost learning: Deep inverse optimal control via policy optimization,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Guided cost learning: Deep inverse optimal control via policy optimization,

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:43.811499Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:38.499364Z digest=sha256:cc2586175bb158388e154b4cbf937f84bb6b4bb526a30fc0375f45280242294a

Observation 8a3aab42-5c1e-403f-b2e3-1050e03c649f · outbound

This paper cites XIRL: cross-embodiment inverse reinforcement learning,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning XIRL: cross-embodiment inverse reinforcement learning,

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:43.592043Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:38.562239Z digest=sha256:94b12fc16e6e309d30a22f181e80edba8c87ae94b4cb773cbcaf552ecb428970

Observation 208e572a-6a09-43ea-a329-27ac0f909880 · outbound

This paper cites Unsupervised perceptual rewards for imitation learning,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Unsupervised perceptual rewards for imitation learning,

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:43.363278Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:38.602327Z digest=sha256:e98d34b1e7ab3a3fcbfccafaa67d4e129391261657642f4965ea16dbcad8c6e2

Observation f8b2f30f-c960-40f3-befa-a3bfe6ce27b6 · outbound

This paper cites Learning generalizable robotic reward functions from.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Learning generalizable robotic reward functions from

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:43.157022Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:38.636347Z digest=sha256:d79f3f033e35372120fac9b57e95e48e45791f985db9553dce28a6b74825126a

Observation 594138cd-4e9a-40e8-b77a-858a9245ce68 · outbound

This paper cites Can pre-trained text-to-image models generate visual goals for reinforcement learning?.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Can pre-trained text-to-image models generate visual goals for reinforcement learning?

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:42.973285Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:38.677455Z digest=sha256:33aded4fecdf535484063dbeddd70e209c62680ea475e0caec70845494e1ba28

Observation 90b5adef-e3bb-4709-9b87-4e6f5eaaddad · outbound

This paper cites Language instructed reinforcement learning for human-ai coordination,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Language instructed reinforcement learning for human-ai coordination,

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:42.802993Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:38.713140Z digest=sha256:5b91a2ef1d98d4dac0e26b846b9f11aec15ac71ff1e17356ab0888b86e9aa272

Observation 4bc8b726-a2ce-4e53-a4b9-3fad6a2b9833 · outbound

This paper cites Language to rewards for robotic skill synthesis,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Language to rewards for robotic skill synthesis,

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:42.666517Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:38.770906Z digest=sha256:8964c354fae379238a39a8d38aa04b8e44b7d0cdff21e32b8dde73c29938ff0b

Observation 158d2f3b-1ed7-4a32-9688-514c3968db6f · outbound

This paper cites Robogen: Towards unleashing infinite data for automated robot learning via generative simulation,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Robogen: Towards unleashing infinite data for automated robot learning via generative simulation,

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:42.579438Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:38.841534Z digest=sha256:d25da2d8fc93ed04f1bf0b8514cc4ddd50bb5743a8076100c67f12502b383d87

Observation 3b267ee1-508a-4082-a601-92184463a9b2 · outbound

This paper cites Eureka: Human-level reward design via coding large language models,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Eureka: Human-level reward design via coding large language models,

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:42.509950Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:38.898442Z digest=sha256:b039dfab742ad4cd18544415f726683095a0a72b4606e421659d0995b860f92f

Observation 31f54546-38a7-49ca-9b49-c7675c8da5d8 · outbound

This paper cites Vision-language models as success detectors,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Vision-language models as success detectors,

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:42.404777Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:38.938950Z digest=sha256:65fb9fddb018e6e5cf0b21af528fbd65daaf3e3d4da3248641e1f768a47022f4

Observation 7c2d1506-22b4-4b15-9929-f653089ed579 · outbound

This paper cites Guiding pretraining in reinforcement learning with large language models,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Guiding pretraining in reinforcement learning with large language models,

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:42.230637Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:38.985497Z digest=sha256:b192e38a02194882f74148def3fe2f2fba947b754186e3453e6cb88f7c12b493

Observation aafd8bb6-9e97-4c32-a0d7-c954245f4438 · outbound

This paper cites Vision-language models are zero-shot reward models for reinforcement learning,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Vision-language models are zero-shot reward models for reinforcement learning,

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:42.156413Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:39.036230Z digest=sha256:497b7bbbb2065c252e63ef52adda5ce9e7f8845fdc25c0d742ffb59a7ef1bddd

Observation 9f6e7692-a622-497e-b82a-dc2409268921 · outbound

This paper cites LIV: language-image representations and rewards for robotic control,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning LIV: language-image representations and rewards for robotic control,

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:42.046295Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:39.105570Z digest=sha256:e1b115256cba15bcaddfe54f1b26209ede0c34fac74aedc1ad61abfe03e2b7fb

Observation 9511828c-f62d-4486-9488-6da528c69c60 · outbound

This paper cites Llmscenario: Large language model driven scenario generation,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Llmscenario: Large language model driven scenario generation,

Reference 47

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:41.759632Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:39.202104Z digest=sha256:49e32234809d5e0760fbb7e9f2cf5642da6e40582bdfa6ef757d33508c63b0dd

Observation 1ae77ca1-1927-4e32-9360-ba9b95853b56 · outbound

This paper cites Zero-Shot Robotic Manipulation with Pretrained Image-Editing Diffusion Models.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Zero-Shot Robotic Manipulation with Pretrained Image-Editing Diffusion Models

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-07T14:12:39.269432Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:12:39.269432Z digest=sha256:06db2572c66a487bc8f9ea0ddc9d8c52607f4b41ae900fbc7701aace3fe8066d

Observation d21e32e1-5bce-4843-90c4-0721f22ba25d · outbound

This paper cites Denoising diffusion implicit models,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Denoising diffusion implicit models,

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:41.510138Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:39.364186Z digest=sha256:2e0a0573d5393d49a1bc6b9cf356593d80c4dd59d328e14fa0f9c60d41be28c4

Observation ccc18db5-19c4-420e-924e-28ccc8f14de0 · outbound

This paper cites Taming transformers for high- resolution image synthesis,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Taming transformers for high- resolution image synthesis,

Reference 50

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:41.358889Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:39.441829Z digest=sha256:a4f1925bd77b9461f7f3a6c33b796892020f9e10a86124418e717a16bcaf3fec

Observation fb8dedd4-20e4-4fdc-8dba-e18dfc216d01 · outbound

This paper cites Exploration by random network distillation,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Exploration by random network distillation,

Reference 51

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:41.189959Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:39.528360Z digest=sha256:695894936e29640c48490db861885160ae5f2e21e122bff8d5453923d20cc0f6

Observation e74a59dc-86ef-468c-b20e-0455c97b71e1 · outbound

This paper cites Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Meta-world: A benchmark and evaluation for multi-task and meta reinforcement learning,

Reference 52

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:40.969274Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:39.628179Z digest=sha256:9d210770b93b7ccfdb2859c5ca43099901eb07e1019cc016c64ff0911c63c445

Observation 0d2eb78e-a383-4876-ad14-476908a4ada9 · outbound

This paper cites Learning transferable visual models from natural language supervi- sion,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Learning transferable visual models from natural language supervi- sion,

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:47.571243Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:39.707397Z digest=sha256:ca076c2115bd01b85137c716cc82cec3d8b09fe9eab610f657f4628eb9a2f557

Observation d859a0c4-18ee-4edd-a98c-5bd354ebe924 · outbound

This paper cites Mastering visual continuous control: Improved data-augmented reinforcement learning,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Mastering visual continuous control: Improved data-augmented reinforcement learning,

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:40.768703Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:39.778904Z digest=sha256:248df9b90d4c4c36eaaf6a74771c1c24190670c261376d645e64cea8ccb5b1e8

Observation 317c1489-65bc-4a26-9f5b-844fd14b6e39 · outbound

This paper cites Precise and Dexterous Robotic Manipulation via Human-in-the-Loop Reinforcement Learning.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Precise and Dexterous Robotic Manipulation via Human-in-the-Loop Reinforcement Learning

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-07T14:12:39.869877Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:12:39.869877Z digest=sha256:de265a87726575c7a0aade6dabe6cdd5babc89b9a05dd134982b4273c85922ef

Observation 83a06b74-1583-4d1f-9d23-e07fc8b507cc · outbound

This paper cites Con- trolvideo: Training-free controllable text-to-video generation,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Con- trolvideo: Training-free controllable text-to-video generation,

Reference 56

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:40.468780Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:39.930879Z digest=sha256:eb7cb2f4788ab0f40d0ec732b53626fdc7e290ea36d4733e5565282c7ee94a97

Observation 242fe782-a447-48be-b781-d5e518ed0b1d · outbound

This paper cites Ldr: Learning discrete representa- tion to improve noise robustness in multiagent tasks,.

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning Ldr: Learning discrete representa- tion to improve noise robustness in multiagent tasks,

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T14:12:40.214633Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T14:12:39.980717Z digest=sha256:89f23b8b8b582b14c3a41b55f965da1f4579665a99077108ec857dd03f2e48eb

Pith citing papers

Observation 8c6c6ecb-c957-4102-8fde-ac21f52f0c8e · inbound

Towards Long-Lived Robots: Continual Learning VLA Models via Reinforcement Fine-Tuning cites this paper.

Towards Long-Lived Robots: Continual Learning VLA Models via Reinforcement Fine-Tuning TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning

Reference 12

Resolution
verified exact
arxiv_id, observed 2026-05-21T14:10:13.292099Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-21T14:07:10.387869Z digest=sha256:8eae771c4147303361d0d6c0de97998bf2efdb17074ef83985ce1ea22f49b3f4