Рубріки: Новини

Тайвань включається в боротьбу за штучний інтелект. Foxconn випускає власну LLM-модель

Дмитро Сімагін

Тайванська компанія Foxconn, відома збиранням iPhone та інших продуктів Apple, анонсувала свою першу велику мовну модель під назвою FoxBrain. Як повідомляє Neowin, її було навчено за допомогою лише 120 графічних процесорів H100 від Nvidia.

Нова LLM-модель базується на архітектурі Meta Llama 3.1 та має 70 мільярдів параметрів, отриманих з використанням дистиляції. Дистиляція моделі передбачає використання батьківської моделі та навчання «дочірньої» моделі на основі її відповідей. 

Хоча Foxconn визнає, що її модель не така потужна, як китайська DeepSeek-R1, але її загальна продуктивність дуже близька до світових стандартів. Компанія вже пообіцяла, що в майбутньому FoxBrain стане «відкритою та доступною для всіх».

Доктор Юнг Ху-Лі, директор Дослідницького центру штучного інтелекту в Науково-дослідному інституті Хон Хай, заявив:

«Наша модель FoxBrain використала дуже ефективну стратегію, зосереджуючись на оптимізації процесу навчання, а не на сліпому накопиченні обчислювальної потужності. Завдяки ретельно розробленим методам навчання та оптимізації ресурсів ми успішно побудували локальну модель ШІ з потужними можливостями аргументації».

Навчання моделі FoxBrain на 120 графічних процесорів Nvidia H100 тривало приблизно чотири тижні. Для цього Foxconn змогла згенерувати 98 млрд токенів високоякісних даних попереднього навчання традиційною китайською мовою з довжиною контекстного вікна 128 тис. токенів.

Відомо, що компанія Foxconn не тільки збирає гаджети для Apple, але й виробляє сервери зі штучним інтелектом для Nvidia. Партнерство Foxconn і Nvidia не є новим: обидві компанії працюють і над іншими спільними проектами, включаючи будівництво найбільшого у світі заводу з виробництва графічних процесорів Blackwell.

Останні статті

«Штраф до 500 тисяч рублів або позбавлення волі до 6 років»: росіян будуть карати за стріми з українською грою S.T.A.L.K.E.R 2

Російська Генпрокуратура визнала «небажаною» діяльність української геймдев-студії GSC Game World, яка відома розробкою серії постапокаліптичних…

19.11.2025

«Відмовився переходити на українську»: програмісти з Азії видають себе за українців, але діалог викриває брехню

Підшукуючи кандидатів на посаду розробника проекту з AI-автоматизації, Project Manager Анастасія Кирнична була сильно здивована,…

19.11.2025

У 2025 році жінки відкрили в Україні 8011 ФОП з КВЕДом «Комп’ютерне програмування»

З початку 2025 року українські жінки відкрили 8011 ФОП з КВЕДом «Комп’ютерне програмування», що становить…

19.11.2025

Google розробляє версію AI Studio для мобільного вайб-кодування

Незабаром Google випустить мобільну версію AI Studio. Популярна платформа для вайб-кодування на базі Gemini з'явиться…

19.11.2025

Gemini 3 Pro від Google стає новим лідером в кодуванні, випередивши Claude Sonnet 4.5

Компанія Google випустила нову мультимодальну LLM-модель Gemini 3 Pro, яку вже названо найпотужнішою з усіх…

19.11.2025

Лінус Торвальдс не проти вайб-кодингу, але не для професійної розробки

Творець Linux і Git Лінус Торвальдс заявив на саміті Linux Foundation Open Source Summit у…

18.11.2025