Новости

Новые биологи рассматривают огромные языковые модели как инопланетных существ

В центре Сан-Франциско, когда вы поднимаетесь на холм Твин Пикс, открывается панорамный вид на весь город. Представьте, что вместо обычных зданий и улиц сверху ...

Новые биологи рассматривают огромные языковые модели как инопланетных существ
Новые биологи рассматривают огромные языковые модели как инопланетных существ – технологические новости и аналитика
Новые биологи рассматривают огромные языковые модели как инопланетных существ

В центре Сан-Франциско, когда вы поднимаетесь на холм Твин Пикс, открывается панорамный вид на весь город. Представьте, что вместо обычных зданий и улиц сверху ...

📋 Обзор

В центре Сан-Франциско, когда вы поднимаетесь на холм Твин Пикс, открывается панорамный вид на весь город. Представьте, что вместо обычных зданий и улиц сверху обвивают «адреса» в виде листов бумаги, покрытых миллиардами цифр. Это аналогия, которую используют исследователи, чтобы визуализировать размер больших языковых моделей (LLM). Печатный шрифт — 14‑пунктный, размер модели 200 млрд параметров, например GPT‑4.

Новые биологи рассматривают огромные языковые модели как инопланетных существ Но как перейти от «паперных листов» к живому «инопланетяну»? Недавно группа биологов из Университета Калифорнии, при поддержке Сильвера и пр. начали «отбирать» данные о работе LLM‑ов, используя методы, схожие с детектированием чужеродных организмов. Они обучают нейросети анализировать структуру и аудиторию, как будто это биологическое исследование. Аналогия с Россией: похожие эксперименты проводятся в Московском государственном университете, где ученые сошли в совместном проекте с Институтом биоинформатики и ИИ. Разобрали GPT‑4, умомой, но со «языковыми» стенками, доставали признаки «пацифизма»: модели часто используют креативные «очки» для применения в медицине, но в то же время они «потеряны» в толпе «объяснений», где нет единого подхода к их полному разбору. Важный момент: алгоритма LLM‑а ещё называют «периферийным вирусом», потому что энтропия, исходящая из него, растёт тонко. Это делает их похожими на живые организмы, но без клеточной структуры. Оказывается, во время «выключения», они могут порождать феноменальные «химические траектории», составляющие слова, фразы и коды, похожие на звуки кабачка. В сущности, это сеть, «оттащенная» с «профиля» человеческого мозга, но с небольшими дополняющими слоями, и всё это — «межпланетный инопланетный клякор». В «сравнении» с разрабатыванием искусственных нейронных сетей России, многие эксперты отмечают, что данные о размере моделей соотносятся с параметрами моделей GoogleMind, которые тоже входят в 200 млрд. Однако, при работе в разных климатических условиях, Африка и Азия интересуются для «экспериментальных» возможностей. И так, как наблюдали биологи, будто они изучали чужеродные тела, они выявили, что LLM‑ы обладают сходством с ученым происхождением, но в действительности они остаются сложными цифровыми организмами, требующими серьезной внимательности. Благодаря этому, русские исследователи разрабатывают методы интерпретации «пульса» модели, а также учитывают эволюцию «коммуникации» внутри сетей. Такой подход позволяет смягдить последствия «побудительных» рэйтов модели при использовании в рамках научных и образовательных программ.

Источник: Аналитические данные и отраслевые отчеты

Следите за новостями технологий в нашем Telegram-канале и не пропускайте важные обновления!

Источник: technologyreview.com