AI product
Mercury is Inception’s family of diffusion-based language models for generating text and code. Unlike autoregressive language models that generate tokens sequentially, Mercury generates discrete tokens in parallel to improve inference scaling, hardware utilization on standard GPUs, and latency. The models target production serving and latency-sensitive applications such as voice agents, with quality comparable to speed-optimized models from frontier laboratories while generating outputs significantly faster.
2 uses taken from transcripts — each links to the moment in the video.
Diffusion-based language models for text and code generation. They are described as comparable in quality to speed-optimized models from frontier labs while being significantly faster, supporting production serving and voice-agent applications.
Inception's diffusion-based language models, served to production customers for faster text generation.
1 in the library.