Pith. sign in

Paper Citation Record · LEDGER

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence

As of 7 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2505.24500.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.24500 v1

Coverage vector

measured 38 of 38 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T12:27:52.808169Z

measured 38 of 38 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

38 of 38 outbound references displayed

  • verified exact0
  • verified fuzzy7
  • unresolved31
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 19b10a2d-5766-43e4-baf5-9eeb9d2a81c2 · outbound

This paper cites SFT or RL? An Early Investigation into Training R1-Like Reasoning Large Vision-Language Models.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence SFT or RL? An Early Investigation into Training R1-Like Reasoning Large Vision-Language Models

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:48.099504Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:48.099504Z digest=sha256:9aa2517672c3f90154034a646b71de770afde1ea50bb252286201460d82bddd3

Observation 308dc582-050e-4727-b741-33d9c09ef9e0 · outbound

This paper cites SFT Memorizes, RL Generalizes: A Comparative Study of Foundation Model Post-training.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence SFT Memorizes, RL Generalizes: A Comparative Study of Foundation Model Post-training

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:48.257139Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:48.257139Z digest=sha256:29a3822e04660a70f21d35c424549af012e9c5f20aa23f75b24ea8d24f56a704

Observation 39d74bd7-4134-4130-aef8-714800e24531 · outbound

This paper cites DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:48.555039Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:48.555039Z digest=sha256:1e9c1f342a4bdcac3f86fac0b46ce2c8842ca14d5f8bdb2d6509d6507bb31b59

Observation 4fb164ae-8e0c-4378-893d-f0e5e985c877 · outbound

This paper cites Open-Reasoner-Zero: An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence Open-Reasoner-Zero: An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:48.797927Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:48.797927Z digest=sha256:e7b35618e54c0f377559c896a0961c93aab00dfc77035e8df1aa28b817635656

Observation 1093a78b-dfa2-4b22-995a-1f9a9b8871c8 · outbound

This paper cites QueryAgent: A Reliable and Efficient Reasoning Framework with Environmental Feedback-based Self-Correction.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence QueryAgent: A Reliable and Efficient Reasoning Framework with Environmental Feedback-based Self-Correction

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:48.938782Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:48.938782Z digest=sha256:7a15ffca13569229e9731ee63b734b044177d995fe34f24062fe1f39d8d0981f

Observation 6f3181d8-1738-40d3-9e36-d59e4c93e32f · outbound

This paper cites OpenAI o1 System Card.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence OpenAI o1 System Card

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:49.075144Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:49.075144Z digest=sha256:ad457870ff953737813a5f132e3b56e1fd0416f4799f170de49cc6b2b16ace01

Observation b7a8e223-9433-4d61-ad96-5bda5d2fa32a · outbound

This paper cites Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:49.228737Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:49.228737Z digest=sha256:526e60961131538898ef6d3858680dff2563eecbf5278cce6e7f20c379dfdda8

Observation 5d54a5a6-4a1b-4af1-a6cd-1ce9beb6e125 · outbound

This paper cites Perceptions to beliefs: Exploring precursory inferences for theory of mind in large language models.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence Perceptions to beliefs: Exploring precursory inferences for theory of mind in large language models

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:27:55.671442Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T12:27:49.386878Z digest=sha256:66397e5f8674505119d9c67db4374edee53c9d77c4ecc3947b3e28accaa09163

Observation 86bff7f8-0ddb-470d-8ee2-25c119f40e4e · outbound

This paper cites s1: Simple test-time scaling.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence s1: Simple test-time scaling

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:49.679902Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:49.679902Z digest=sha256:6da3fe8bec579db3588b3c350790c60291d5c0172273cbf073ca4eff003afe1e

Observation c307fdb2-94fb-47f7-965b-c555ddcb52af · outbound

This paper cites Explore Theory of Mind: Program-guided adversarial data generation for theory of mind reasoning.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence Explore Theory of Mind: Program-guided adversarial data generation for theory of mind reasoning

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:49.910942Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:49.910942Z digest=sha256:f6d31aa363b3ff41e9b4fdc01f6fa8c174adc9260ee6718230e96ffc476776b2

Observation c3fdab7c-ad12-4103-b3fe-b67b516ae7e2 · outbound

This paper cites DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:50.005114Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:50.005114Z digest=sha256:27bff454657d6900a2171c8dec5a9b10794a4e1b4c80c290930a7678de6e2f62

Observation 7eacdde7-166a-4f7c-9059-def5e592d386 · outbound

This paper cites HybridFlow: A Flexible and Efficient RLHF Framework.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence HybridFlow: A Flexible and Efficient RLHF Framework

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:50.102559Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:50.102559Z digest=sha256:4c11bb013d5fd89926ac3ec27f857b9fa5d0381ded179d13177e20ae4712e4eb

Observation e809d746-7890-44c6-bfc8-5b44b0404e16 · outbound

This paper cites ToMATO: Verbalizing the Mental States of Role-Playing LLMs for Benchmarking Theory of Mind.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence ToMATO: Verbalizing the Mental States of Role-Playing LLMs for Benchmarking Theory of Mind

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:50.270022Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:50.270022Z digest=sha256:af6eeae0e9c356b9bd9fb9062f0d7f60492c7c4623605b9f1fa02c5c15e526f0

Observation e5df7549-894f-46fc-8577-1c81973ef424 · outbound

This paper cites R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:50.567982Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:50.567982Z digest=sha256:d09717043e58f7209880489a93b9f73fbc56f1b2b57625235d706ee87936a61b

Observation 9edca75c-ed6c-4a03-ac76-063551775524 · outbound

This paper cites Climbing the ladder of reasoning: What llms can-and still can’t-solve after sft? arXiv preprint arXiv:2504.11741,.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence Climbing the ladder of reasoning: What llms can-and still can’t-solve after sft? arXiv preprint arXiv:2504.11741,

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:50.713881Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:50.713881Z digest=sha256:d272ac5b2beb32aaf44f7e3a32f3c64644102e56294a9a4e5685a1fd9af0c654

Observation e57198dc-bc3b-4e25-9d4e-e0450c9c8766 · outbound

This paper cites HelpSteer2: Open-source dataset for training top-performing reward models.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence HelpSteer2: Open-source dataset for training top-performing reward models

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:50.908285Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:50.908285Z digest=sha256:ddadd0cdfb9c3ae80c9b76c7b480c251a2a6fd9e0a6e994b82b61f0693c27538

Observation 1b5f4533-fe3b-4e24-8961-ccccea2f8de8 · outbound

This paper cites SWE-RL: Advancing LLM Reasoning via Reinforcement Learning on Open Software Evolution.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence SWE-RL: Advancing LLM Reasoning via Reinforcement Learning on Open Software Evolution

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:51.038674Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:51.038674Z digest=sha256:48947b1753fec2f7f4109d5b72581270d66745c9e60088b02b5eb525faa758b1

Observation 7474caf0-d8fe-4815-8c1d-71db8aaaefec · outbound

This paper cites Hi-tom: A benchmark for evaluating higher-order theory of mind reasoning in large language models.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence Hi-tom: A benchmark for evaluating higher-order theory of mind reasoning in large language models

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:27:55.090600Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T12:27:51.153523Z digest=sha256:8b64bce7e2100ef41c158e8429d37a832aa656eb671730e4a778fbfc1c97afb2

Observation 2c95a59f-4855-449a-a573-10761728cc9d · outbound

This paper cites GUI-R1 : A Generalist R1-Style Vision-Language Action Model For GUI Agents.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence GUI-R1 : A Generalist R1-Style Vision-Language Action Model For GUI Agents

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:51.290313Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:51.290313Z digest=sha256:ae57508c77783644893565b36341c671578d3d093578a2fd9087a70b3da3710f

Observation 1634f636-6489-4528-98a5-5373a857391d · outbound

This paper cites Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:51.421057Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:51.421057Z digest=sha256:f1bd44d7f2d28b3688723574637cc401a5c79d028a749e2b2228655442ff9941

Observation 28372f1e-66ef-40a4-a453-95af9b8631b5 · outbound

This paper cites Qwen2.5 Technical Report.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence Qwen2.5 Technical Report

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:51.563161Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:51.563161Z digest=sha256:4b9d2a8316211452c50062a6fc5d3259e3415b56299a76371c7c0faba34dc8c4

Observation e4451955-6d9b-420b-85b6-d8f8577955af · outbound

This paper cites LIMO: Less is More for Reasoning.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence LIMO: Less is More for Reasoning

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:51.686739Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:51.686739Z digest=sha256:efffb995dfcd1c570bc2ef0ab16ba19668d551b2125b132b68fddb0f530c9f12

Observation 1f316624-31ca-4996-a14e-5958a5b4f105 · outbound

This paper cites Z1: Efficient Test-time Scaling with Code.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence Z1: Efficient Test-time Scaling with Code

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:51.841949Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:51.841949Z digest=sha256:39ebb1b99763b7ec059a6eaa2feb3b08bad3195485683d24c138662efaab84c0

Observation 585c6ccc-11bf-434b-b600-bd8655e19a10 · outbound

This paper cites Scaling of Search and Learning: A Roadmap to Reproduce o1 from Reinforcement Learning Perspective.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence Scaling of Search and Learning: A Roadmap to Reproduce o1 from Reinforcement Learning Perspective

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:51.974700Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:51.974700Z digest=sha256:6fa9325c89ac01b8d3e05b991ac6a26a25912e2199fe8058dfe0a19b760e3fef

Observation f36ab083-ece6-43d4-b9c9-3f3f29937d35 · outbound

This paper cites Autotom: Automated bayesian inverse planning and model discovery for open-ended theory of mind.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence Autotom: Automated bayesian inverse planning and model discovery for open-ended theory of mind

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:52.105777Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:52.105777Z digest=sha256:8cb55e107a410acf388a279b9085d0a8ec775206da61ce86d80a102ba7168bc3

Observation fd96bd9b-3e57-4aa4-80ac-fe5d99d7b201 · outbound

This paper cites SOTOPIA: Interactive Evaluation for Social Intelligence in Language Agents.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence SOTOPIA: Interactive Evaluation for Social Intelligence in Language Agents

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:52.254318Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:52.254318Z digest=sha256:3c8ebdfba8774d9ae5872aa9cfb0e0304d523c0768d2e3991bacd71a3249c301

Observation 4f807b02-017d-4bed-a1be-c32a4eab9262 · outbound

This paper cites SWEET-RL: Training Multi-Turn LLM Agents on Collaborative Reasoning Tasks.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence SWEET-RL: Training Multi-Turn LLM Agents on Collaborative Reasoning Tasks

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:52.419144Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:52.419144Z digest=sha256:879c18b32918b33041e06e52b213304fe75379882a6033dc00049056abb01e3a

Observation fb1d23b2-1d90-41b0-b60f-9e45ef984190 · outbound

This paper cites The comparison results are shown in Table.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence The comparison results are shown in Table

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:27:54.888072Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T12:27:52.551126Z digest=sha256:4d10e19d01a944069ddf08d933db05b6e980d7c2cda371f0c5db3dac3a7df0ac

Observation 98b817c3-08ca-43c5-9bba-9f4ad29f3d62 · outbound

This paper cites What LLMs Can—and Still Can’t—Solve after SFT?.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence What LLMs Can—and Still Can’t—Solve after SFT?

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:27:54.535643Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T12:27:52.696376Z digest=sha256:d1ce30e5225ad073cf775df8f3ef14e70c9af4f52a8f36ebb7e9f3cf31b9e498

Observation dd47479f-7f0e-451e-a765-43ba4198eef4 · outbound

This paper cites budget forcing.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence budget forcing

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:27:54.170166Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T12:27:52.808169Z digest=sha256:31c3576a4fdd3140e7560d7ffa0a754820dfa358925a491ed82e11d5ddc2cfb8

Observation 43b977b2-7bc4-4a82-8d8b-6f534d1c1dde · outbound

This paper cites Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters

Reference 1996

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:50.446081Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:50.446081Z digest=sha256:bbfb3697960eb27b6196162be98b6a8ae8e98e5e9f85e05463c1dd3f428258ab

Observation d8dc670e-9460-401a-9bd4-a8a430bd1ccf · outbound

This paper cites Revisiting the evaluation of theory of mind through question answering.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence Revisiting the evaluation of theory of mind through question answering

Reference 2011

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:27:55.491641Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T12:27:49.528985Z digest=sha256:2d00355081f8f793ea137a6c322f5fcea2231dd1ee98ebd48ef787704ec17359

Observation c181eec8-6d4f-42e4-a4f9-56e8da5edba2 · outbound

This paper cites Video-R1: Reinforcing Video Reasoning in MLLMs.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence Video-R1: Reinforcing Video Reasoning in MLLMs

Reference 2013

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:48.392575Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:48.392575Z digest=sha256:1edbe7a370c47ef290a208b0ea82320f47eae53ced7bac880db66287bb7c4b19

Observation 257d3a63-41ab-44bc-afab-438bd05e1d94 · outbound

This paper cites Relation-r1: Cognitive chain-of-thought guided reinforcement learning for unified relational comprehension.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence Relation-r1: Cognitive chain-of-thought guided reinforcement learning for unified relational comprehension

Reference 2019

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:49.594703Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:49.594703Z digest=sha256:cda6b68c8169f618bc6159b19b4718b78d3a157e6a2e06eb652e4dd5ce8b7158

Observation 0f1ef408-6abe-4356-bada-9bfd8f90590e · outbound

This paper cites Social iqa: Common- sense reasoning about social interactions.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence Social iqa: Common- sense reasoning about social interactions

Reference 2020

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:27:55.299794Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T12:27:49.824323Z digest=sha256:e46028f1e5a8cdaaf769ee0229371b1d2219ddb9f8f9a80118cc5fa838bae479

Observation ae8e3374-ad35-4ae9-bc01-3de7c29f3cb3 · outbound

This paper cites Mutual Reasoning Makes Smaller LLMs Stronger Problem-Solvers.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence Mutual Reasoning Makes Smaller LLMs Stronger Problem-Solvers

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:49.740854Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:49.740854Z digest=sha256:cbb50f88af5bdc18dbe4e9a7ac67b9972dbe8eba096ff5ca35f62482d9874a61

Observation f67b7fdd-adbd-4450-a8c8-0c4c883b535a · outbound

This paper cites Large Language Monkeys: Scaling Inference Compute with Repeated Sampling.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence Large Language Monkeys: Scaling Inference Compute with Repeated Sampling

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:48.037680Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:48.037680Z digest=sha256:00083daff5927d2874a13fb594187101cc4afc48069b7bdd13c47283f56f5dbb

Observation 6e6e6052-e199-4952-ad4f-924d4dfd415b · outbound

This paper cites GenCLS++: Pushing the Boundaries of Generative Classification in LLMs Through Comprehensive SFT and RL Studies Across Diverse Datasets.

TimeHC-RL: Temporal-aware Hierarchical Cognitive Reinforcement Learning for Enhancing LLMs' Social Intelligence GenCLS++: Pushing the Boundaries of Generative Classification in LLMs Through Comprehensive SFT and RL Studies Across Diverse Datasets

Reference 2025

Resolution
unresolved
no resolver link, observed 2026-08-07T12:27:48.666190Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:27:48.666190Z digest=sha256:e2a69e97198b30c90d8e73f22ef8f7afd4d58856a092ae74be1a2d5515a3505c

Pith citing papers

No inbound Pith citation observations are available.