Результаты поиска

Материал из MachineLearning.

По запросу «Llama»

Перейти к: навигация, поиск

Страницы с названием «Llama» не существует.

Для получения более подробной информации о поиске на страницах проекта, см. справочный раздел.

Ниже показаны 15 результатов, начиная с № 1.


Просмотреть (предыдущие 20) (следующие 20) (20 | 50 | 100 | 250 | 500)

Нет совпадений в названиях статей

Совпадения в текстах статей

  1. Нейросеть (21 133 байта)
    60: ... современных LLM: GPT, Claude, Gemini, Llama, DeepSeek. Однако их главный не...
    113: ...развитие открытых моделей (Llama, DeepSeek, Qwen), делающих передов...
  2. Большая языковая модель (34 506 байт)
    8: ...ких систем, как GPT, Claude, Gemini, Llama, DeepSeek и Qwen. Они рассматрива...
    81: === Llama 4 (Meta) ===
    82: ...продолжающее линию Llama 2 и 3. Llama 4 доступна в широком диапаз...
    102: | Llama 4 || Meta || Открытые веса || Тек...
  3. Двойной спуск (49 365 байт)
    121: ...х LLM (таких как [[GPT|GPT-4]] или [[Llama]]) на гигантских корпусах т...
  4. Закон масштабирования нейронных сетей (27 690 байт)
    21: ...обучения (модели семейств [[LLaMA]], [[Mistral]] и [[Gemma]] стали замет...
    59: ...е модели нового поколения (LLaMA-7B на 1T токенов, Mistral-7B, Gemma) и...
    84: * [[LLaMA]]
  5. Квантование нейронных сетей (27 481 байт)
    132: ... используемый в экосистеме llama.cpp для запуска квантованны...
    163: ... квантованных LLM на CPU через llama.cpp.
  6. Фундаментальная модель (47 646 байт)
    163: После появления семейств Llama, Mistral, Gemma и других открытых ...
    280: * [[Llama]];
  7. Позиционное кодирование (8877 байт)
    28: ...дов, применяется в моделях LLaMA, GPT-NeoX и стал фактическим ст...
  8. RAG (16 812 байт)
    45: ...екодер (T5, BART) или decoder-only (GPT, LLaMA).
  9. Глубокое обучение (21 502 байта)
    54: ...ыковых моделей (GPT, Claude, Gemini, Llama, DeepSeek). Однако их главный не...
  10. Генеративная модель (24 683 байта)
    105: ...ыковых моделей (GPT, Claude, Gemini, Llama) и всё чаще используются дл...
  11. Малые языковые модели (14 896 байт)
    48: ... также компактные версии '''Llama''', '''Qwen''' и '''Mistral'''. Ветвь ра...
  12. Авторегрессионная модель (26 377 байт)
    60: ... семейства GPT (GPT-3], GPT-4, GPT-4o), LLaMA, Mistral и множество других ис...
  13. Позитивные и негативные сценарии развития ИИ (21 794 байта)
    12: ...елей семейства GPT, Gemini, Claude, Llama и DeepSeek на базе архитектуры ...
  14. Эффект края (15 560 байт)
    47: ...дели семейства GPT, Claude, PaLM и Llama.
  15. Адаптация низкого ранга (LoRA) (21 017 байт)
    81: ... позволил дообучить модель LLaMA-65B на одной видеокарте с 48 Г...
    106: ...ткрытых моделей (таких как LLaMA, Falcon, Mistral). LoRA позволил энту...
    111: ...и для обучения LLM (Axolotl, Unsloth, LLaMA-Factory) используют LoRA как мет...

Просмотреть (предыдущие 20) (следующие 20) (20 | 50 | 100 | 250 | 500)



Искать в пространствах имён:

Показывать перенаправления
Искать