Nemotron 3 Embed vs Nemotron TwoTower
Вердикт
Две открытые модели NVIDIA с одинаковой фамилией, которые делают принципиально разные вещи — и это как раз тот случай, когда путаница стоит дорого. Nemotron 3 Embed ищет: превращает документы в векторы, чтобы находить нужное по смыслу. Писать текст она не умеет вообще. TwoTower наоборот — генерирует текст, причём в 2,4 раза быстрее обычных моделей за счёт диффузионного подхода. Если строите поиск по своей базе знаний или RAG — нужна первая. Если нужен быстрый генератор ответов — вторая. В полноценной RAG-системе они, по сути, работают в паре: одна находит нужные куски документов, вторая пишет по ним ответ.
| Nemotron 3 Embed | Nemotron TwoTower | |
|---|---|---|
| Что делает | Ищет по смыслу (эмбеддинги) | Пишет текст |
| Размер | 8B и 1,14B | 30B (MoE, на базе Nemotron-3-Nano) |
| Главный результат | 1-е место RTEB — 78,5% | В 2,42 раза быстрее генерация |
| Контекст | 32K токенов | Как у базовой модели |
| Веса | Открытые | Открытые (лицензия NVIDIA Nemotron) |
| Когда брать | Поиск по документам, RAG | Быстрая генерация ответов |