Chińscy naukowcy przechodzą od inferencji do trenowania modeli AI na akceleratorach Huawei
Chińskie układy scalone Huawei pomyślnie zakończyły dalsze szkolenie modelu DeepSeek‑V4‑Pro
*Zgodnie z informacją South China Morning Post, w Chinach udało się zastosować układy scalone Huawei Ascend 910C do pełnego dopracowania dużego modelu AI DeepSeek‑V4‑Pro. Jest to ważny krok w rozwoju krajowego sektora półprzewodników, który dąży do przejścia od prostego inferencji do złożonego uczenia się w warunkach zaostrzenia amerykańskich sankcji.*
Co się stało
EtapOpisUruchomienie projektuGrupa badawcza z Huawei Technologies i partnerów (Instytut Dróg Kołowych Shenzhen, Kampus Harbin Institute of Technology Shenzhen, Instytut Badawczy Big Data Shenzhen) rozpoczęła pracę w celu wytrenowania modelu DeepSeek‑V4‑Pro. SkalaModel zawiera 1,6 biliona parametrów i został uruchomiony na klastrze z co najmniej 1000 układami Ascend 910C.Dalsze szkoleniePełne „parametryczne” dopasowanie: cała architektura modelu została zaktualizowana bez kompromisów, a nie tylko poszczególne warstwy.
Dlaczego to ważne
* Do niedawna chińskie układy scalone były skutecznie wykorzystywane do inferencji – procesu, w którym model po prostu odpowiada na zapytania.
* Teraz, dzięki nowemu projektowi, model może samorefleksyjnie się korygować podczas pracy, co dodaje „złożonych przejść i pętli” do wcześniej jednostronnego przepływu danych. To zwiększa wymagania obliczeniowe i komunikacyjne, ale sprawia, że system jest bardziej autonomiczny.
Oczekiwane wyniki
* Rząd Shenzhen ogłosił, że badanie pomoże zwiększyć samowystarczalność chińskiej branży sztucznej inteligencji i wzmocni pozycję krajowych mikrochipów w warunkach zewnętrznych ograniczeń.
Komentarze (0)
Podziel się swoją opinią — prosimy o uprzejmość i trzymanie się tematu.
Zaloguj się, aby komentować