Meta udostępnia Llama 3.2 jako open source

Meta udostępniła Llama 3.2 publicznie, dodając model o 70 miliardach parametrów. Kod można pobrać z GitHub lub Hugging Face.

Model został wytrenowany na zbiorze danych składającym się z 2,5 biliona tokenów. Meta oferuje trzy rozmiary dostosowane do różnych obciążeń:

  • 8 B
  • 30 B
  • 70 B

Wszystkie trzy działają na nowoczesnych procesorach GPU i układach LPU. Nowa architektura zmniejsza zapotrzebowanie na moc obliczeniową o 22%, co przekłada się na niższe koszty i mniejsze zużycie energii.

Dlaczego ma to znaczenie dla Ciebie

  • Niższe koszty – Startupy i programiści mogą teraz uruchamiać duże modele bez ogromnych budżetów.
  • Lepsza wydajność – Benchmarki pokazują, że Llama 3.2 wyprzedza kilku konkurentów open-source w zadaniach rozumowania i wielojęzycznych.
  • Wolność komercyjna – Licencja Apache 2.0 pozwala na wdrażanie modelu w biznesie bez konieczności płacenia tantiem.
  • Szybkość sprzętowa – Model działa 1,8 × szybciej na układach takich jak NVIDIA H100 i Groq LPU.

Meta przeznacza 150 milionów dolarów na fundusz wspierający projekty oparte na Llama 3.2, wypychając rozwój AI z zamkniętych laboratoriów do społeczności.

Źródło: https://dev.to/techpulse01239/meta-ai-unveils-llama-32-open-source-release-70b-model-3bhb

Opcjonalna społeczność edukacyjna: https://t.me/GyaanSetuAi