Pith. sign in

Paper Citation Record · LEDGER

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks

As of 13 August 2026, this Paper Citation Record lists 74 of 74 outbound references and 0 inbound Pith citation observations for arXiv:2411.17030.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2411.17030 v1

Coverage vector

measured 74 of 74 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-12T12:41:12.121854Z

measured 74 of 74 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-12T06:34:41.77262+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

74 of 74 outbound references displayed

  • verified exact0
  • verified fuzzy55
  • unresolved17
  • parse uncertain1
  • malformed identifier1
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 87a76538-db03-4cf3-9019-3a399722a007 · outbound

This paper cites Bevbert: Multimodal map pre-training for language-guided navigation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Bevbert: Multimodal map pre-training for language-guided navigation

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.998682Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.872337Z digest=sha256:4fb39beca4ddaef681e730f28c4cbda2a74fac7c33edb8335a8fb966b404aab6

Observation f1347bfa-b0b5-45a9-a855-7036e6eb5aab · outbound

This paper cites Etpnav: Evolving topo- logical planning for vision-language navigation in continuous environments.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Etpnav: Evolving topo- logical planning for vision-language navigation in continuous environments

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.986898Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.876375Z digest=sha256:a3fdcd7e3e7b020936b0fb6db09ea9ce427ee11de33fe95b51444771dde95c03

Observation 4011b6c3-a942-4e00-9a57-48c24476a8e8 · outbound

This paper cites Vision-and-language navigation: Interpreting visually-grounded navigation instructions in real environments.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Vision-and-language navigation: Interpreting visually-grounded navigation instructions in real environments

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-12T12:41:11.879942Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T12:41:11.879942Z digest=sha256:bc495b21b77a44a6a86a579a4a18e2b7a1b8e993de2b664b49b6cffe753747ce

Observation e22bb210-cc39-45d2-a090-9f82370aeffd · outbound

This paper cites Scanqa: 3d question answering for spatial scene understanding.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Scanqa: 3d question answering for spatial scene understanding

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.970597Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.883947Z digest=sha256:47d110a3607c4c888ce2a91761aa1044528feba230728e06b6a45d42f8d1c716

Observation 82a71666-756a-4d72-ab5c-0c9a3acaae83 · outbound

This paper cites Matterport3d: Learning from rgb-d data in indoor environments.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Matterport3d: Learning from rgb-d data in indoor environments

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.960308Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.887606Z digest=sha256:0d4cdfc1957d1c2d6c328ebce374475cedfc379373f05aa0fdd2832c80039a30

Observation 231eda7a-b2a6-41d2-8a83-027011731b0c · outbound

This paper cites Object goal navigation using goal-oriented semantic exploration.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Object goal navigation using goal-oriented semantic exploration

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.950337Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.891276Z digest=sha256:1427affce62ddb5cac1dd3c1be6ee94b7ebcc4baf644b05ade0ba047e4f94155

Observation b8969db9-f9b6-4a6c-9882-b91b6b68fba7 · outbound

This paper cites Scanrefer: 3d object localization in rgb-d scans using natural language.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Scanrefer: 3d object localization in rgb-d scans using natural language

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.939810Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.895050Z digest=sha256:91461d18ce07054c2a946397f48a69540d204cfb150093f8e179f7d1feeb4c57

Observation 08e26698-f732-412f-b8db-f817edb853fb · outbound

This paper cites Weakly- supervised multi-granularity map learning for vision-and- language navigation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Weakly- supervised multi-granularity map learning for vision-and- language navigation

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.929169Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.898655Z digest=sha256:a82e11bb21ee86715dc7fd4d90d515f9e3b70aec60f9774655bd092db7b65293

Observation c13ec763-50d5-4cf2-9c2b-5672480a839f · outbound

This paper cites History aware multimodal transformer for vision- and-language navigation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks History aware multimodal transformer for vision- and-language navigation

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.918415Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.901828Z digest=sha256:e3700cd3381c8a954e50c718db3fa7a77c6a8d3061967eac9c5f3f9361f3236b

Observation 2fdb889f-afea-430b-bf38-2bb66f3dd500 · outbound

This paper cites Think global, act lo- cal: Dual-scale graph transformer for vision-and-language navigation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Think global, act lo- cal: Dual-scale graph transformer for vision-and-language navigation

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.906552Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.905101Z digest=sha256:b42666a19b62e0e1c0374f1f56893d9f6aa907bbbb2d74618bc7ec330ae01b28

Observation d395aad0-111f-4b6a-8f98-b241d1e41279 · outbound

This paper cites Grounded 3D-LLM with Referent Tokens.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Grounded 3D-LLM with Referent Tokens

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-12T12:41:11.908299Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T12:41:11.908299Z digest=sha256:14d800219672088a7ec003ceeef81fc1e4e33e635fb63fd4bc009a3f5fef9f4b

Observation c428f878-7a90-4f20-b4e0-3ebcb61cef6c · outbound

This paper cites Scannet: Richly-annotated 3d reconstructions of indoor scenes.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Scannet: Richly-annotated 3d reconstructions of indoor scenes

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.895912Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.912314Z digest=sha256:bbe1fbd868ff8caf6ab1703befad037ce8005c5c45996b07efef4bb665e03423

Observation 869cafd9-f504-4133-968f-6511437b6efc · outbound

This paper cites Embodied question answering.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Embodied question answering

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.885249Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.915604Z digest=sha256:c535f29502dcec1594db84c2370daf06da84601be139e7190ec6858d9c5914bb

Observation 1885f780-6d26-43a1-98d4-9af56a37c413 · outbound

This paper cites Scene-LLM: Extending Language Model for 3D Visual Understanding and Reasoning.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Scene-LLM: Extending Language Model for 3D Visual Understanding and Reasoning

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-12T12:41:11.918948Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T12:41:11.918948Z digest=sha256:c18ab814b6b05b49163a5be5fd03acc2a0edb2a2e30976c3c14e25f51806c398

Observation dec94811-4fb1-4952-ae31-51e3319b9022 · outbound

This paper cites Cows on pasture: Base- lines and benchmarks for language-driven zero-shot object navigation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Cows on pasture: Base- lines and benchmarks for language-driven zero-shot object navigation

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.873615Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.922474Z digest=sha256:0234ce84c96fc93040c13aadc61345728f29e9b89cbed35accfa81070eadae28

Observation 76e0c43a-b69d-4c27-833f-ab0f65af864f · outbound

This paper cites Cross-modal map learning for vision and language navigation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Cross-modal map learning for vision and language navigation

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.862860Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.925637Z digest=sha256:fc4cf699ef0bd353dd6c5f8f18b6fbfaafa451f9642136d786b88d7a1c27fc0d

Observation 32b708a5-5cbd-40d2-b21f-123e5ac94c43 · outbound

This paper cites Navigating to objects in the real world.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Navigating to objects in the real world

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-12T12:41:11.928995Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T12:41:11.928995Z digest=sha256:c31fbdf77df3696ff58892ee6bbc01db0009ccfa0c1d911503dacb5321baa8e4

Observation 8ca44bc9-4fdb-402d-88a8-ff3e0ce14c12 · outbound

This paper cites Mask r-cnn.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Mask r-cnn

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-12T12:41:11.932150Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T12:41:11.932150Z digest=sha256:c328ac7c479b6de977db6dffd9e4b74e63b66ed23ed5f477fdfec231d5c739e4

Observation 73872888-fe33-4669-bc14-3c9fecb41c28 · outbound

This paper cites Vln bert: A recurrent vision-and- language bert for navigation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Vln bert: A recurrent vision-and- language bert for navigation

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.837099Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.935910Z digest=sha256:47f2f2732c8ddf72dcf8942c2c19cf15cdd97569d4b9e13e260cb4b5b8fbe1e9

Observation d89b78d0-aa78-4caa-b59e-d6dbafd2157e · outbound

This paper cites Bridg- ing the gap between learning in discrete and continuous envi- ronments for vision-and-language navigation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Bridg- ing the gap between learning in discrete and continuous envi- ronments for vision-and-language navigation

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.825192Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.939141Z digest=sha256:735ea9477d664002ef702595be10d564a81fb715c8c95b8605125010666bed0b

Observation e9182e90-2f7b-42b1-8c19-7c45b0e82725 · outbound

This paper cites Learning naviga- tional visual representations with semantic map supervision.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Learning naviga- tional visual representations with semantic map supervision

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.813560Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.942155Z digest=sha256:a8725775f538755ef4cf74117733bf4a548c0c38f4acf6cc6560b2c7f7934aed

Observation 13d47039-932d-4663-a2f5-c1e7792a0eed · outbound

This paper cites An embodied generalist agent in 3d world.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks An embodied generalist agent in 3d world

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.802173Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.945471Z digest=sha256:5ff04105e9f764b1678ca0fae42365181c1bfbec61ae1fc0367c02a5b3c0af4a

Observation 4e10c0c2-b6b6-4435-a834-97ae2aa92747 · outbound

This paper cites Sceneverse: Scaling 3d vision-language learning for grounded scene un- derstanding.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Sceneverse: Scaling 3d vision-language learning for grounded scene un- derstanding

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.790379Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.948651Z digest=sha256:b233e6200a97e4581064325683d0674528211feb4af3c88e212e1b35c2facb57

Observation 363fd063-7f4b-491e-979a-f2b99222bfa5 · outbound

This paper cites Lerf: Language embedded radiance fields.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Lerf: Language embedded radiance fields

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.779274Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.951760Z digest=sha256:5f34f6790c617bd95b82443b61312d9e67ff1719d2eab921cb6f1715d65f143c

Observation 734d25ef-28dc-4fd6-95c4-bb9503c799b8 · outbound

This paper cites Segment any- thing.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Segment any- thing

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-12T12:41:11.955360Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T12:41:11.955360Z digest=sha256:9e61ff488fecb05018a3bb6ec8a3884d8c1642306264335db6db42c43a9d31ec

Observation ee853e66-ad70-4388-9196-920578050de5 · outbound

This paper cites Sim-2-sim transfer for vision- and-language navigation in continuous environments.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Sim-2-sim transfer for vision- and-language navigation in continuous environments

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.762076Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.958517Z digest=sha256:e9390a6a3d4240c9bf1eece825a5d5dbf7a613d10c7fcc2b36a5fa279cb3a87f

Observation 506da9f3-d1b5-4441-8e94-95f7f2d6f240 · outbound

This paper cites Beyond the nav-graph: Vision-and-language navigation in continuous environments.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Beyond the nav-graph: Vision-and-language navigation in continuous environments

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-12T12:41:11.961691Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T12:41:11.961691Z digest=sha256:a353b2cd8f202879aa8ff27c6d037ca81c015bb0380aa921599b645d807488f7

Observation b078446b-ad7f-45a0-a848-99aa3d927147 · outbound

This paper cites Renderable neural radiance map for visual navigation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Renderable neural radiance map for visual navigation

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.733876Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.968341Z digest=sha256:981e49e3a48129e1d76c91bb032c4375a12a0d979edfebbf89065c8cde1d81f7

Observation 5c93262a-6c93-4592-a97b-2e991490be2e · outbound

This paper cites Less is more: Clipbert for video-and-language learning via sparse sampling.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Less is more: Clipbert for video-and-language learning via sparse sampling

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.723406Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.971725Z digest=sha256:609a27a40418662489b5f6e173328872ac31fa993b069f7565a77e28541fd2e5

Observation 9814a060-b2f8-4963-b14c-b1e8c3005b1a · outbound

This paper cites Blip- 2: Bootstrapping language-image pre-training with frozen image encoders and large language models.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Blip- 2: Bootstrapping language-image pre-training with frozen image encoders and large language models

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-12T12:41:11.974912Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T12:41:11.974912Z digest=sha256:fcffd453d495740d2b73c39240b57031ebd8d200940487fbe94612a094433a2d

Observation 80dec119-ca83-433d-ae63-8da5493d4f70 · outbound

This paper cites Grounded language-image pre-training.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Grounded language-image pre-training

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.706517Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.978223Z digest=sha256:6bda9cf1d7fcd84ff386e8b1ddd0164a8d789f4668fc99c0cada35031a35e5c3

Observation 96f7fa9f-6812-4373-9edf-e19d74043d10 · outbound

This paper cites Bird’s- eye-view scene graph for vision-language navigation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Bird’s- eye-view scene graph for vision-language navigation

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.695814Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.981613Z digest=sha256:12a0391196fb65f7723990f5c82cd70e57638b5fde43abdb663c30f1377d48d0

Observation a6a11262-f324-4279-940d-6c9f6ac64e3d · outbound

This paper cites Vision-language navigation with energy-based policy.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Vision-language navigation with energy-based policy

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.683914Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.985225Z digest=sha256:f9bc3cc4d5449f9c561a994b57dbbbb01efeb260f84fe77696a3a0eac3f059ae

Observation 2f963d95-0fbe-4569-9e28-cd0474b56ffb · outbound

This paper cites V olumetric envi- ronment representation for vision-language navigation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks V olumetric envi- ronment representation for vision-language navigation

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.672126Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.988628Z digest=sha256:83c0e091edf6dacf14cb23c5aaffe2c1ad3e2698ced7286742bddd828de7f213

Observation d922b81b-96af-4e65-9622-4ba1d5d98a3b · outbound

This paper cites Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-12T12:41:11.992187Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T12:41:11.992187Z digest=sha256:e55d94e79c56b46c1e50fc7f4f1ebb4577441df1ce7f389b764da6e43461e827

Observation 6eaef7e8-4f0b-4f82-a952-fa7b0c0f42d4 · outbound

This paper cites Instructnav: Zero-shot system for generic instruction navigation in unexplored environment.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Instructnav: Zero-shot system for generic instruction navigation in unexplored environment

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.661182Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.995710Z digest=sha256:6b89315dfd4ba6ba3b4f4fc05311e8426f8e5570a73d3b79c1c86b4955927a61

Observation 3af6b1bc-3dd0-4d51-85e6-a82ddbdd8796 · outbound

This paper cites Sqa3d: Situated question answering in 3d scenes.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Sqa3d: Situated question answering in 3d scenes

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.649709Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.998993Z digest=sha256:64bc7e9a0b0da81189631f878e89e0e60c4b2d0a038631f88b32524287f10619

Observation acabc30d-ae47-41bc-822a-2efb0c3c2ae6 · outbound

This paper cites Rec- tifier nonlinearities improve neural network acoustic models.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Rec- tifier nonlinearities improve neural network acoustic models

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.638752Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.002258Z digest=sha256:f70a77f36c964d16d6d2af34c83e7f488659c25de56c8d0e79f182f9ae39b68a

Observation b219f52c-18d2-4a73-9c1c-d1b6b7334312 · outbound

This paper cites Zson: Zero-shot object-goal navigation using multimodal goal embeddings.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Zson: Zero-shot object-goal navigation using multimodal goal embeddings

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-12T12:41:12.005584Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T12:41:12.005584Z digest=sha256:84755b6ae6f022443e5ae76c6059f9c1b563ddc2bc35dbb59155d37be1c6d8fd

Observation 8f1cc444-c362-4453-8cf2-638a197fb633 · outbound

This paper cites Openeqa: Embodied question answering in the era of foundation models.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Openeqa: Embodied question answering in the era of foundation models

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.622137Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.009453Z digest=sha256:dcdeeb8d55b9d6b6ba4f593437ed38cf1ddd53a6d2c25dd619c5fd70929937a4

Observation 43b429da-8ac1-439c-a8d4-b5ecc2147b59 · outbound

This paper cites Nerf: Representing scenes as neural radiance fields for view syn- thesis.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Nerf: Representing scenes as neural radiance fields for view syn- thesis

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-12T12:41:12.012861Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T12:41:12.012861Z digest=sha256:1ccbfb3b79d2bac3d2501b3fd6f49fc5ac83044ada4dad6951977c5d91e387bb

Observation 799e14c3-c2b6-45c3-97a3-c889cc582bef · outbound

This paper cites Dinov2: Learning robust visual features without supervision.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Dinov2: Learning robust visual features without supervision

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.605027Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.016089Z digest=sha256:db6a2b8ec722d0c865365c4fbead424ca620721af25c0408e0836408829cac86

Observation 0660d706-73e8-4c6c-8ad2-570514e5ff43 · outbound

This paper cites Hop+: History-enhanced and order-aware pre-training for vision-and-language navigation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Hop+: History-enhanced and order-aware pre-training for vision-and-language navigation

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.594285Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.019609Z digest=sha256:a61ff5cc906274f250d5290199e9e049dbd0ebc0297a76aa0038e4e6f6aa3ecb

Observation 4bc9e5cb-477f-485f-8bdb-6e86c9f83573 · outbound

This paper cites Learning Generalizable Feature Fields for Mobile Manipulation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Learning Generalizable Feature Fields for Mobile Manipulation

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-12T12:41:12.022955Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T12:41:12.022955Z digest=sha256:36ac31d4c720711dcc06e1e3bbba1a122b242744c33a893b3ac5238fd3d9ac73

Observation 9029cb07-d3b0-41e2-9958-a4a5f6b4e352 · outbound

This paper cites Learning transferable visual models from natural language supervi- sion.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Learning transferable visual models from natural language supervi- sion

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-12T12:41:12.026703Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T12:41:12.026703Z digest=sha256:0b2d22bbed40a6f8a364dab747c638a6dcaa7e4e349e05abbc8c95471b5ccd6f

Observation f94223b8-6c9a-4f83-b735-5189b4c35249 · outbound

This paper cites Habitat-matterport 3d dataset (hm3d): 1000 large-scale 3d environments for embodied ai.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Habitat-matterport 3d dataset (hm3d): 1000 large-scale 3d environments for embodied ai

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.577550Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.029853Z digest=sha256:c6444daa2fdfc0aa031e153670ebd83c3f75bbe1f96d8d6ecfc48514dc0f7580

Observation 9f13ec18-5be7-4d83-8e1e-5953cc51592b · outbound

This paper cites Poni: Potential functions for objectgoal navigation with interaction- free learning.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Poni: Potential functions for objectgoal navigation with interaction- free learning

Reference 47

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.567723Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.033132Z digest=sha256:8779861f95c68a683c25ed1f3e73c49814b37b498d0ee45bd8a8003e4e19bd66

Observation 275dd167-0b4f-4ff0-a88c-3f515edf0292 · outbound

This paper cites Habitat: A platform for embodied ai research.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Habitat: A platform for embodied ai research

Reference 48

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.557450Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.036557Z digest=sha256:897785668eb1b081ea3a781f7aa755a5998d69089c29e8894a63f8edae235e6a

Observation 30efd223-28ce-48db-be1a-e388086bcf4a · outbound

This paper cites Distilled feature fields enable few-shot language-guided manipulation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Distilled feature fields enable few-shot language-guided manipulation

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.547216Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.040645Z digest=sha256:9944b1483d83e50c1b8c54f32c915ef70d219c840793e016082705807f36ed93

Observation 3a295e05-5e5f-4f1e-ae33-616a181d9ab5 · outbound

This paper cites Language- enhanced rnr-map: Querying renderable neural radiance field maps with natural language.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Language- enhanced rnr-map: Querying renderable neural radiance field maps with natural language

Reference 50

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.536766Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.043939Z digest=sha256:b9f3373dc684174cdcefde22af035310e9ffecdb96a265873eec215f44d03590

Observation 38570152-e3ba-45fe-b1f1-3103b9430c44 · outbound

This paper cites Nesf: Neural semantic fields for generalizable semantic segmentation of 3d scenes.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Nesf: Neural semantic fields for generalizable semantic segmentation of 3d scenes

Reference 51

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.526238Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.047825Z digest=sha256:e0906348cfeca1d88af0a312ddb26be92eddef2143d6200787ff258688f9c656

Observation 0c292a5f-4771-4abf-b773-dc6b58d0ac3e · outbound

This paper cites Yolov7: Trainable bag-of-freebies sets new state-of- the-art for real-time object detectors.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Yolov7: Trainable bag-of-freebies sets new state-of- the-art for real-time object detectors

Reference 52

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.514554Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.051271Z digest=sha256:abb362318db80d53fb0ef25223dca014b1224f7eaf9d0dbaabca68722deb0298

Observation e754e9da-692d-4d63-8c4f-1fd9d0d90841 · outbound

This paper cites Dreamwalker: Mental planning for continuous vision- language navigation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Dreamwalker: Mental planning for continuous vision- language navigation

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.504479Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.054825Z digest=sha256:60036b59979fd7425a598665e93c685b43e1121651ef76975626385563c80a5b

Observation 7ef24cfe-8734-4619-8497-4c8357801ad9 · outbound

This paper cites Vision-and-language naviga- tion via causal learning.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Vision-and-language naviga- tion via causal learning

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.493108Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.057945Z digest=sha256:06568b24abf9c970945bdd16e80432d50afec55676b729511b964facf1913c63

Observation c9637c06-818f-4736-9e5b-f8a8ebf87488 · outbound

This paper cites Scaling data generation in vision-and-language navigation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Scaling data generation in vision-and-language navigation

Reference 55

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.378148Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.061317Z digest=sha256:e82894edad62e55a4b6d49e4ea8abbadf1084c1a92c71d8e1468cd61969ac04a

Observation 797ef658-db03-4662-8867-767ab07b4058 · outbound

This paper cites Gridmm: Grid memory map for vision- and-language navigation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Gridmm: Grid memory map for vision- and-language navigation

Reference 56

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.367838Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.064542Z digest=sha256:73c25fb17ad4359f239166c79c90db72bf2b7ae4bd6d235d714ad8de56530fae

Observation 7f27c71e-ab7d-4931-92b5-81434c9ad481 · outbound

This paper cites Lookahead exploration with neural radiance representation for continuous vision-language navigation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Lookahead exploration with neural radiance representation for continuous vision-language navigation

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.357768Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.067942Z digest=sha256:9c146a3b93e5633a16893a3ea43de5fedd4b431650a5f2dd9dd6a9f65b5021e9

Observation 6c45ba32-515f-4d69-a2b9-2e2b267c89e8 · outbound

This paper cites Sim-to-real transfer via 3d feature fields for vision-and-language navigation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Sim-to-real transfer via 3d feature fields for vision-and-language navigation

Reference 58

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.346864Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.071256Z digest=sha256:529f9b7bbc5ab1b08a013b34f4155f1fe73e6848844ce2e8c17dff3ec55e8cee

Observation 0ed69188-07b2-48da-aa16-dd27c97f58b6 · outbound

This paper cites DD-PPO: Learning Near-Perfect PointGoal Navigators from 2.5 Billion Frames.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks DD-PPO: Learning Near-Perfect PointGoal Navigators from 2.5 Billion Frames

Reference 59

Resolution
unresolved
no resolver link, observed 2026-08-12T12:41:12.074625Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T12:41:12.074625Z digest=sha256:c7ebadbe3a3f0173f7f7ee18a6077761c4e4ee3408aa870a7c850f8021084d1f

Observation f260ae16-0bf0-4afc-bba2-23a88b0ccaed · outbound

This paper cites Habitat-matterport 3d semantics dataset.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Habitat-matterport 3d semantics dataset

Reference 60

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.336927Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.078457Z digest=sha256:50a9bae691c3e15e241f155309708c2b6ae978fdd2c52f7f52aff1c999d85025

Observation fa71a361-cad1-48f5-91c6-85029c07c25b · outbound

This paper cites Sg-nav: Online 3d scene graph prompting for llm-based zero- shot object navigation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Sg-nav: Online 3d scene graph prompting for llm-based zero- shot object navigation

Reference 61

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.327125Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.081615Z digest=sha256:8d6b1d597c6f63fefab9af7e384ecb86311eb2461abd9bccd83411136b8c3b53

Observation b40685bc-3f62-49ed-a08a-561e8dd76c41 · outbound

This paper cites Vlfm: Vision-language frontier maps for zero-shot semantic navigation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Vlfm: Vision-language frontier maps for zero-shot semantic navigation

Reference 62

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.316777Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.084976Z digest=sha256:fa10ee894541cbf19f25e5fa62463ab3f4792a0deeeec09b1d0e2742f42614e6

Observation a1bd8e4a-31d3-4df6-9ba7-00ac66e88785 · outbound

This paper cites Gamap: Zero-shot object goal navigation with multi-scale geometric-affordance guidance.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Gamap: Zero-shot object goal navigation with multi-scale geometric-affordance guidance

Reference 63

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.306045Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.088244Z digest=sha256:d5ffde1f15466ff35c94d288520c4bd275e3ab3d072643899d7d83d41c4416ef

Observation 7462ac0a-36cd-40e2-8cc9-e867d1b13a85 · outbound

This paper cites Gnfactor: Multi-task real robot learning with generalizable neural feature fields.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Gnfactor: Multi-task real robot learning with generalizable neural feature fields

Reference 64

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.295173Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.091402Z digest=sha256:78b03037e1719a44dc6396b80eb92873ef3d9263162a4a8366bd76b9a037666b

Observation 2c148112-3bef-49ce-bd06-f546961a116e · outbound

This paper cites Faster Segment Anything: Towards Lightweight SAM for Mobile Applications.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Faster Segment Anything: Towards Lightweight SAM for Mobile Applications

Reference 65

Resolution
unresolved
no resolver link, observed 2026-08-12T12:41:12.094566Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T12:41:12.094566Z digest=sha256:b7a585671e8e052b3b4643a8068f0600513eb9de9955c7fac84151fe45f64bbd

Observation 4120d482-e917-4997-adff-0b203aa3310c · outbound

This paper cites VLA-3D: A Dataset for 3D Semantic Scene Understanding and Navigation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks VLA-3D: A Dataset for 3D Semantic Scene Understanding and Navigation

Reference 66

Resolution
unresolved
no resolver link, observed 2026-08-12T12:41:12.098137Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T12:41:12.098137Z digest=sha256:98683486b0e2fd8b7c23e25decb0c81e1f1ec1e4d7847be58ad3039efab29e93

Observation 8aeaf061-8751-411e-a01c-9160b7a018b3 · outbound

This paper cites Navid: Video-based vlm plans the next step for vision-and-language navigation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Navid: Video-based vlm plans the next step for vision-and-language navigation

Reference 67

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.284146Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.102131Z digest=sha256:87337e5d5c16abb1053b8047160cb595c30221366e060ab409fc6265fc61e6de

Observation fa271cb0-fd70-420d-a31c-f992cd34dab4 · outbound

This paper cites Hierarchical object-to-zone graph for object navigation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Hierarchical object-to-zone graph for object navigation

Reference 68

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.273067Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.105441Z digest=sha256:cc554af8f8cdbb54d1b370a0a7b337db114e1c974c1c1266d31a8206c8bd9cfc

Observation 3f685f3c-5c53-4d7f-821c-010b9b0811ea · outbound

This paper cites Vision-and-Language Navigation Today and Tomorrow: A Survey in the Era of Foundation Models.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Vision-and-Language Navigation Today and Tomorrow: A Survey in the Era of Foundation Models

Reference 69

Resolution
unresolved
no resolver link, observed 2026-08-12T12:41:12.108676Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T12:41:12.108676Z digest=sha256:371b5e30d59f133075fa42663da796b3ecf40bf74ab47ba097c2048fbbc651f7

Observation 972c91b2-2fd4-46f2-9052-4f568cad6185 · outbound

This paper cites Structured3d: A large photo-realistic dataset for structured 3d modeling.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Structured3d: A large photo-realistic dataset for structured 3d modeling

Reference 70

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.261828Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.112252Z digest=sha256:53f1693972cf63e2151bacd6e8b7349003b9a19240b0d5711b6e5648747955ab

Observation 5b35027b-bcc9-4f56-8f6d-7fd025de0259 · outbound

This paper cites Esc: Ex- ploration with soft commonsense constraints for zero-shot object navigation.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Esc: Ex- ploration with soft commonsense constraints for zero-shot object navigation

Reference 71

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.251040Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.115389Z digest=sha256:03686f2943cffb80e7fc7036324d36f396387055d53fdb2f86976bf9a6067127

Observation 010eede6-6f5d-4f05-bb16-3215ce0de232 · outbound

This paper cites Target-driven visual navigation in indoor scenes using deep reinforcement learning.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Target-driven visual navigation in indoor scenes using deep reinforcement learning

Reference 72

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T12:41:12.240154Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.118655Z digest=sha256:f302ef560daa58a0a079b87ec88036b9d11aa36138b9ab37f8c79e24bd5d3b62

Observation b7cf2336-14b3-4f69-b85b-ac37afa3c1de · outbound

This paper cites 3d-vista: Pre-trained transformer for 3d vision and text alignment.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks 3d-vista: Pre-trained transformer for 3d vision and text alignment

Reference 73

Resolution
malformed identifier
raw_fallback, observed 2026-08-12T12:41:12.228653Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:12.121854Z digest=sha256:a19998dfc6a196b0e82187b3f0a1e9b8912c67ea72bf31fe3b79a295982aaf1a

Observation dbfdaba3-38a0-45a0-bee0-57375ecc9b91 · outbound

This paper cites an unresolved cited work.

g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Unresolved cited work

Reference 120

Resolution
parse uncertain
raw_fallback, observed 2026-08-12T12:41:12.744699Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-12T12:41:11.965153Z digest=sha256:5b00b1bfd7911a8f775f4c6eec6a6f0e24ba1e068678b045886bf7ec455439d8

Pith citing papers

No inbound Pith citation observations are available.