Все новости
Ежедневный обзор

Главные новости ИИ и GPU за день

2 практических материалов об ИИ и GPU, опубликованных в нашем Telegram-канале 2026-10-07.

8 октября 2026

Главные новости ИИ и GPU за день
Искусственный интеллект1/2

ИИ нашёл свежую ссылку — а новость старая?

ИИ нашёл свежую ссылку — а новость старая?

Вы просите ИИ собрать новости за неделю, а в подборке оказывается прошлогодний релиз. У ссылки стоит свежая дата, и всё выглядит убедительно. Проверять стоит дату события, а не только страницы.

Google поясняет: дата возле результата поиска — его оценка того, когда страницу опубликовали или обновили. В рекомендациях отдельно сказано, что эти даты относятся к странице, а не к описанным событиям. Поэтому обновлённый обзор сам по себе не доказывает, что модель только что вышла.

Для помощника с веб-поиском задайте три отдельные даты. Готовый prompt: Собери новости за [период]. Для каждой открой первоисточник. Раздели дату события, публикации и обновления страницы; отсутствующие пометь «не указана». Дай ссылку и короткую цитату, подтверждающую дату события. Не включай старое событие лишь из-за обновления страницы.

Так вы сможете проверить, почему материал попал в подборку, не перечитывая весь обзор. Если дату события подтвердить не удалось, не заменяйте её датой из поиска: отметьте неопределённость.

Свежесть страницы и свежесть события проверяйте отдельно.

Искусственный интеллект2/2

Gemma 4 E4B: большой context не удлиняет аудио

Gemma 4 E4B: большой context не удлиняет аудио

Вы хотите расшифровать запись встречи локально и выбираете модель с большим context — объёмом входных данных. Но для Gemma 4 E4B сначала стоит проверить длину звука. Google DeepMind выпустила эту модель 2 апреля 2026 года: это не сегодняшняя новинка.

У версии google/gemma-4-E4B-it открытые веса под Apache 2.0. Она принимает текст, изображения и аудио, отвечает текстом. В официальной карточке для E4B указан context 128K tokens, а для аудио — максимум 30 секунд. Большое окно для tokens не означает, что можно передать целую встречу одним аудиофайлом.

Для первого теста возьмите короткую запись и подготовьте фрагменты по паузам, каждый не длиннее 30 секунд. Передавайте их по одному, сохраняйте начало каждого фрагмента и собирайте расшифровку по порядку. Сначала сверьте текст со звуком, затем измерьте время обработки и пиковую VRAM — память GPU — на выбранном сервере.

Так вы проверите весь путь от записи до текста, а не только загрузку модели. Разрез посреди слова может испортить расшифровку: прослушайте стыки фрагментов.

Для аудио проверяйте лимит в секундах отдельно от размера context.