Meta udostępnia Llama 3.2 jako open source
Meta udostępniła Llama 3.2 publicznie, dodając model o 70 miliardach parametrów. Kod można pobrać z GitHub lub Hugging Face.
Model został wytrenowany na zbiorze danych składającym się z 2,5 biliona tokenów. Meta oferuje trzy rozmiary dostosowane do różnych obciążeń:
- 8 B
- 30 B
- 70 B
Wszystkie trzy działają na nowoczesnych procesorach GPU i układach LPU. Nowa architektura zmniejsza zapotrzebowanie na moc obliczeniową o 22%, co przekłada się na niższe koszty i mniejsze zużycie energii.
Dlaczego ma to znaczenie dla Ciebie
- Niższe koszty – Startupy i programiści mogą teraz uruchamiać duże modele bez ogromnych budżetów.
- Lepsza wydajność – Benchmarki pokazują, że Llama 3.2 wyprzedza kilku konkurentów open-source w zadaniach rozumowania i wielojęzycznych.
- Wolność komercyjna – Licencja Apache 2.0 pozwala na wdrażanie modelu w biznesie bez konieczności płacenia tantiem.
- Szybkość sprzętowa – Model działa 1,8 × szybciej na układach takich jak NVIDIA H100 i Groq LPU.
Meta przeznacza 150 milionów dolarów na fundusz wspierający projekty oparte na Llama 3.2, wypychając rozwój AI z zamkniętych laboratoriów do społeczności.
Źródło: https://dev.to/techpulse01239/meta-ai-unveils-llama-32-open-source-release-70b-model-3bhb
Opcjonalna społeczność edukacyjna: https://t.me/GyaanSetuAi
