Все новости
Ежедневный обзор

Главные новости ИИ и GPU за день

2 практических материалов об ИИ и GPU, опубликованных в нашем Telegram-канале 2026-10-11.

12 октября 2026

Главные новости ИИ и GPU за день
Искусственный интеллект1/2

Nemotron Parse 2.0: не потеряйте распознанную диаграмму

Nemotron Parse 2.0: не потеряйте распознанную диаграмму

Вы обновили модель разбора документов, но диаграмма из отчёта всё равно не попала в базу знаний. Не спешите менять GPU: сначала проверьте, не теряется ли результат уже после ответа модели.

NVIDIA выпустила Nemotron Parse 2.0 3 августа 2026 года. Она превращает изображение страницы в текст с координатами и типами элементов. В отличие от v1.2, у неё есть отдельный тип Chart для диаграмм. Поэтому при обновлении стоит проверить не только веса, но и код, который разбирает ответ.

Возьмите страницу с абзацем, таблицей и диаграммой. Сохраните сырой ответ модели и сравните его с записью, которая дошла до поиска. Если Chart есть в ответе, но исчез после обработки, проверьте список разрешённых типов. Добавьте обработку Chart и тест: область и её содержимое должны сохраняться, а не молча отбрасываться как неизвестные.

Если блок теряется в вашем коде, более мощный GPU это не исправит. Само наличие Chart не гарантирует верность извлечённых чисел: сверьте их с исходной диаграммой.

После смены модели проверяйте весь путь данных, а не только красивый сырой ответ.

Искусственный интеллект2/2

ИИ сверяет названия: одинаковый вид — не одинаковый текст

ИИ сверяет названия: одинаковый вид — не одинаковый текст

Вы попросили ИИ найти повторы в двух списках, а знакомое название оказалось «новым». Прежде чем искать ошибку в выводах, попросите проверить, как записаны буквы. Внешнего сходства для сравнения строк недостаточно.

Документация Python объясняет: один знак Unicode может быть записан готовой буквой или сочетанием буквы с отдельным значком. Нормализация NFC приводит канонически равнозначные записи к общей форме. В нашей проверке два варианта Café не совпали до NFC и совпали после неё: в одном é была одним символом, в другом — e с отдельным ударением.

Для сверки названий дайте ИИ такой запрос: Сравни названия через Python. Сохрани исходные строки. Создай отдельные ключи сравнения через unicodedata.normalize('NFC', text). Покажи совпадения, появившиеся после нормализации. Не меняй регистр, пробелы и алфавит. Не удаляй записи; если код не запускался, скажи об этом.

Просмотрите найденные пары перед объединением: одинаковое название ещё не означает одну организацию. NFC не превращает похожие латинскую a и кириллическую а в одну букву. Это отдельная проверка, а не повод молча заменять символы.

Сравнивайте подготовленные копии строк, а исходные значения сохраняйте.