← Back to all news
OpenAI Blog July 28, 2022

Efficient training of language models to fill in the middle

Read the original on OpenAI Blog →

The Flow has not summarised this story yet — read it at OpenAI Blog.

  • llms

Related stories

OpenAI Blog
Jul 7, 2021

Evaluating large language models trained on code

llms
More like this →
arXiv AI
Jul 24

Understanding and Accelerating the Training of Masked Diffusion Language Models

arXiv:2605. 13026v2 Announce Type: replace-cross Abstract: Masked diffusion models (MDMs) have emerged as a promising alternative to autoregressive models (ARMs) for language modeling.

By Chunsan Hong, Sanghyun Lee, Chieh-Hsin Lai, Satoshi Hayakawa, Yuhta Takida, Yuki Mitsufuji, Seungryong Kim, Jong Chul Ye
llmsdiffusionbenchmarkssafety
More like this →
arXiv Machine Learning
Jun 25

Improved Large Language Diffusion Models

arXiv:2606. 25331v1 Announce Type: cross Abstract: Modern large language models are predominantly trained with autoregressive factorization and causal attention.

By Shen Nie, Qiyang Min, Shaoxuan Xu, Zihao Huang, Yuxuan Song, Yong Shan, Yankai Lin, Wayne Xin Zhao, Chongxuan Li, Ji-Rong Wen
llmsdiffusionfine-tuningbenchmarks
More like this →
OpenAI Blog
Jan 27, 2022

Aligning language models to follow instructions

llms
More like this →
Hugging Face Trending Papers
Jun 17

Dango: A Strictly L1-Only Large Language Model for Studying Second Language Acquisition

We introduce Dango, a 1. 8B-parameter large language model designed for controlled studies of L1-to-L2 (Japanese-to-English) transfer in second language acquisition (SLA).

llmsfine-tuning
More like this →
Hugging Face Trending Papers
Jul 23

DONDO: Open w2v-BERT Speech-Recognition Base Models for African Languages

We present DONDO, a family of open, permissively licensed automatic speech recognition (ASR) base models for African languages, built on the w2v-BERT 2. 0 self-supervised speech encoder.

fine-tuningmultimodal
More like this →