Az Inception Labs bemutatta a Mercury 2-t, az első diffúzió-alapú nyelvi érvelési modellt, amely párhuzamos finomítással dolgozik a szokásos szóról-szóra generálás helyett.

A hagyományos nyelvi modellekkel ellentétben a Mercury 2 egyszerre finomít több szövegrészletet – hasonlóan egy szerkesztőhöz, aki az egész vázlatot átdolgozza, nem pedig egyes szavakra koncentrál. A modell Nvidia Blackwell GPU-kon 1009 tokent generál másodpercenként mindössze 1,7 másodperc végződés-késleltetéssel. Ez ötször gyorsabb a hagyományos modelleknél: a Gemini 3 Flash 14,4, a Claude Haiku 4,5 pedig 23,4 másodpercet igényel érvelési módban.

Az árazás 0,25 dollár millió input tokenenként és 0,75 dollár millió output tokenenként. A 128K kontextusablakot és eszközhasználatot támogató modell kifejezetten alacsony késleltetésű alkalmazásokhoz készült: hangasszisztensek, kódolóeszközök és keresőrendszerek számára.