arXiv Artificial IntelligenceTowards Understanding Pause Token Fine-Tuning Dynamics: A Mode Retention Perspective
arXiv:2609.04489v1 Announce Type: cross Abstract: Pause-token methods improve LLM reasoning by inserting…
Curated from international AI laboratories, specialist publications and technology outlets. Last update: 3 hours ago.
arXiv Artificial IntelligencearXiv:2609.04489v1 Announce Type: cross Abstract: Pause-token methods improve LLM reasoning by inserting…
arXiv Artificial IntelligencearXiv:2609.04485v1 Announce Type: cross Abstract: We evaluate three open-weight LLMs (Gemma3-12B from the…
arXiv Artificial IntelligencearXiv:2609.04484v1 Announce Type: cross Abstract: This paper investigates structural priming in language…
arXiv Artificial IntelligencearXiv:2609.04463v1 Announce Type: cross Abstract: In many forms of reasoning, including arithmetic reasoning…
arXiv Artificial IntelligencearXiv:2609.04461v1 Announce Type: cross Abstract: Foundation models are beginning to reshape brain-signal…
arXiv Artificial IntelligencearXiv:2609.04453v1 Announce Type: cross Abstract: Expert pruning reduces the memory and serving cost of…
arXiv Artificial IntelligencearXiv:2609.04442v1 Announce Type: cross Abstract: Large language models deployed in high-stakes settings…
arXiv Artificial IntelligencearXiv:2609.04415v1 Announce Type: cross Abstract: Learning rich medical concept representations is essential…
arXiv Artificial IntelligencearXiv:2609.04409v1 Announce Type: cross Abstract: Multilingual language models often produce inconsistent…
arXiv Artificial IntelligencearXiv:2609.04384v1 Announce Type: cross Abstract: Chinese online comments often convey social meaning through…
arXiv Artificial IntelligencearXiv:2609.04383v1 Announce Type: cross Abstract: Real-world dynamics are inherently compositional: multiple…
arXiv Artificial IntelligencearXiv:2609.04381v1 Announce Type: cross Abstract: Recognizing specific objects onboarded without a labeled…