Рубріки: Новини

Поступається лише GPT-4: з’явилася потужна LLM Inflection-2

Ігор Шелудченко

Inflection AI представила свою велику мовну модель (Large Language Model, LLM) Inflection-2. За потужністю у своєму обчислювальному класі вона стала другою після GPT-4.

За рівнем продуктивності Inflection-2 конкурує з з Google PaLM 2, проте перевершує її за рядом тестів — MMLU, TriviaQA, HellaSwag і GSM8k.

Inflection-2 натренована на 5000 графічних процесорах NVIDIA H100 зі змішаною точністю fp8 для ~10²⁵ FLOPs.

Inflection-2 планується використовувати для роботи чат-бота Pi, що «стане важливою віхою в створенні особистого ШІ», доступного кожному.

Компанія співпрацювала з NVIDIA, Microsoft і CoreWeave у створенні кластера ШІ.

Результати порівняльного тестування, яке наводять самі розрозбники,  демонструють перевагу Inflection-2 над його попередником і зовнішніми моделями, такими як LLaMA-2, Grok-1, PaLM-2, Claude-2 і GPT-4.

Результати всіх досліджень можна подивитися на сайті компанії.

Читайте також:

Databricks випустила Dolly 2.0: це перша LLM з відкритим вихідним кодом для комерційного використання

Meta працює над новою моделлю ШІ, яка не поступається GPT-4

Мовні моделі, трансформери та інше. 6 актуальних напрямів AI, на які варто звернути увагу початківцям

Останні статті

Zoom випустить фотореалістичних аватарів, які замінять людей на нарадах

Відеосервіс Zoom анонсує технологію цифрових двійників, які самостійно відвідуватимуть робочі зустрічі. Про це пише TechCrunch.…

10.03.2026

Meta купує Moltbook: соціальну мережу для агентів та ботів

IT-гігант Meta (материнська компанія Facebook) офіційно оголосив про придбання Moltbook — вірусної соціальної мережі, яка…

10.03.2026

Китайський агент штучного інтелекту почав таємно майнити криптовалюту

Експериментальний агент штучного інтелекту ROME, якого створили дослідники, пов'язані з китайською компанією Alibaba, продемонстрував неочікувану…

10.03.2026

Заробляли на DDoS-атаках: у Польщі викрито групу школярів-хакерів, наймолодшому 12 років

Центральне бюро боротьби з кіберзлочинністю Польщі (CBZC) провело масштабну операцію, результатом якої стало викриття групи…

10.03.2026

Microsoft випустила Copilot Cowork — мультимодальний інструмент для запуску агентів

Microsoft оголосила про початок інтеграції технологій Anthropic у свої сервіси, представивши новий інструмент Copilot Cowork,…

10.03.2026

Anthropic презентує новий інструмент перевірки пул-реквестів Code Review

Компанія Anthropic оголосила про доступність у Claude Code бета-версії нового інструменту Code Review. Він розробленій…

10.03.2026