Рубріки: Новини

Тайвань включається в боротьбу за штучний інтелект. Foxconn випускає власну LLM-модель

Дмитро Сімагін

Тайванська компанія Foxconn, відома збиранням iPhone та інших продуктів Apple, анонсувала свою першу велику мовну модель під назвою FoxBrain. Як повідомляє Neowin, її було навчено за допомогою лише 120 графічних процесорів H100 від Nvidia.

Нова LLM-модель базується на архітектурі Meta Llama 3.1 та має 70 мільярдів параметрів, отриманих з використанням дистиляції. Дистиляція моделі передбачає використання батьківської моделі та навчання «дочірньої» моделі на основі її відповідей. 

Хоча Foxconn визнає, що її модель не така потужна, як китайська DeepSeek-R1, але її загальна продуктивність дуже близька до світових стандартів. Компанія вже пообіцяла, що в майбутньому FoxBrain стане «відкритою та доступною для всіх».

Доктор Юнг Ху-Лі, директор Дослідницького центру штучного інтелекту в Науково-дослідному інституті Хон Хай, заявив:

«Наша модель FoxBrain використала дуже ефективну стратегію, зосереджуючись на оптимізації процесу навчання, а не на сліпому накопиченні обчислювальної потужності. Завдяки ретельно розробленим методам навчання та оптимізації ресурсів ми успішно побудували локальну модель ШІ з потужними можливостями аргументації».

Навчання моделі FoxBrain на 120 графічних процесорів Nvidia H100 тривало приблизно чотири тижні. Для цього Foxconn змогла згенерувати 98 млрд токенів високоякісних даних попереднього навчання традиційною китайською мовою з довжиною контекстного вікна 128 тис. токенів.

Відомо, що компанія Foxconn не тільки збирає гаджети для Apple, але й виробляє сервери зі штучним інтелектом для Nvidia. Партнерство Foxconn і Nvidia не є новим: обидві компанії працюють і над іншими спільними проектами, включаючи будівництво найбільшого у світі заводу з виробництва графічних процесорів Blackwell.

Останні статті

Gmail додає наскрізне шифрування на відправку електронних листів будь-кому

Google оголошує, що користувачі Gmail тепер можуть надсилати електронні листи з наскрізним шифруванням будь-кому, навіть…

03.10.2025

Кількість IT-вакансій в Україні за квартал зросла на 12%. Це рекордний показник з початку війни

У третьому кварталі (липень, серпень, вересень) на сервісі пошуку роботи jobs.dou.ua опублікувано 20899 IT-вакансій. Це…

03.10.2025

Google вимагає по $25 з кожного Android-розробника «за верифікацію». Але будуть виключення

Представники Google розкрили додаткові подробиці майбутньої верифікації Android-розробників, яка почнеться в 2026 році. За реєстрацію…

03.10.2025

Python-розробники отримали можливість імпортувати в Excel бібліотеки на свій вибір

Microsoft анонсувала нову потужну функцію для Python-розробників у Microsoft Excel для Windows: редагування ініціалізації. Вона…

03.10.2025

В інструмент кодування Jules додали інтерфейс командного рядка та публічний API

Google додає в Jules інтерфейс командного рядка та публічний API, що дозволяє цьому інструменту кодування…

03.10.2025

Хакери зламали приватні репозиторії Red Hat на GitHub

Хакерське угруповання Crimson Collective зламало приватні GitHub-репозиторії компанії Red Hat, яка займається розробкою корпоративного програмного…

02.10.2025