Smartomica AI Education · AI для жизни и медицины · Блок 2
Работа с PDF и документами на иврите
20 страниц на иврите → понятное резюме на русском за минуты
Раздаточный материал занятия 2.6: промпт-набор из 7 промптов, чек-лист сверки, таблица инструментов, словари иврита для проверки AI, протокол обезличивания, бесплатное распознавание сканов и правила для медицинских документов.
Занятие 2.6Марина БродскаяЛимиты, ссылки и правовой блок проверены 11.08.2026
Экспресс-алгоритм: пять шагов
Один и тот же порядок для письма из битуах леуми, договора аренды и больничной выписки
1
Определить типтекст или скан: тест Ctrl+F за 10 секунд
2
ОбезличитьФИО, теудат-зеут, адреса убрать до загрузки
3
Загрузитьинструмент под задачу, таблица ниже
4
Промпт-каркасиз набора занятия, а не «переведи мне»
5
Сверитьцифры, имена, номера, сроки - по оригиналу
Тест 10 секунд. Откройте PDF и нажмите Ctrl+F (на Mac: Cmd+F). Слово из документа находится поиском - есть текстовый слой, AI прочитает его без ошибок распознавания. Не находится и текст не выделяется мышкой - это скан: работаем по разделу «Сканы и фото» ниже.
Поправка для иврита. Поиск по ивриту иногда не срабатывает даже там, где текстовый слой есть: мешают огласовки, лигатуры и кодировка старых PDF. Поэтому решает не поиск, а выделение мышкой: текст выделяется и копируется - слой есть; выделяется прямоугольником, как картинка - это скан.
Куда загружать: четыре инструмента
Лимиты меняются часто - сверено 11.08.2026 по официальной документации вендоров
до 512 MB на файл; текст до 2 млн токенов; картинки до 20 MB. Free: 3 файла в день, платные тарифы: до 80 файлов за 3 часа. В Projects: 20 файлов (Plus), 40 (Pro / Business)
фото страниц читает хорошо; PDF-скан без текстового слоя может не разобрать - тогда грузите как фото
до 500 MB на файл, до 20 файлов на чат, PDF до 1000 страниц. Внутри Project - 30 MB на файл
PDF до 100 страниц «видит» страницы целиком: текст, печати, таблицы, подписи. Со 101-й страницы - только текстовый слой, картинки и печати игнорируются
Что поменялось с прошлого потока. NotebookLM теперь называется Gemini Notebook: адрес notebooklm.google работает, интерфейс тот же, добавилось выполнение кода для анализа данных. Лимит Claude на файл - не 30 MB, а 500 MB: 30 MB относятся только к файлам, положенным внутрь Project.
Google Translate: он давно не тот
Многие помнят его по 2015 году и зря списали со счетов. Но и переоценивать не надо
Что реально умеет
Режим «Документы»: целый файл сразу, с сохранением верстки. Форматы .pdf, .docx, .pptx, .xlsx, до 10 MB, PDF до 300 страниц - это больше, чем берут за раз Claude и Gemini
Вкладка «Изображения» на translate.google.com: загружаете фото или скан страницы - он распознает иврит и отдает перевод. Именно здесь его OCR работает хорошо, и это давно так
Перевод по фото в мобильном приложении и в Google Объективе: навел камеру на бланк - видишь русский текст поверх иврита, в реальном времени
Gemini-модели в переводе текста с 12.12.2025: идиомы, сленг, разговорные обороты стали заметно лучше
Живой перевод речи в наушниках, бета: более 70 языков. Для приема у врача и разговора в ведомстве
Чего он не делает
Путает две свои же вкладки. «Изображения» скан читают отлично, а вот «Документы» - нет: если загрузить туда PDF-скан, текст внутри картинок останется непереведенным. Скан гоните через «Изображения» постранично или через Gemini
Не структурирует. Он переводит, но не выделит сроки, суммы и то, что от вас требуется. Резюме и таблицы - работа промптов из набора
Не проверяет себя. Цитат и пометки «это моя интерпретация» не будет
Иврит пока вне списка языков, куда официально завезли Gemini-перевод: объявлено около 20 языков, иврита среди них нет. Список расширяется, проверяйте
Как встроить в рабочий процесс. Google Translate - это «быстро понять, о чем вообще письмо, за 30 секунд», и на этой задаче он сегодня очень хорош, включая сканы через вкладку «Изображения». Чего он по устройству не делает - не структурирует и не проверяет себя: сроки, суммы и требуемые действия он не выделит, цитат и пометки «это моя интерпретация» не даст. Поэтому дальше документ идет по алгоритму занятия: промпт 1, промпт 3, чек-лист.
Один документ, три перевода
Разбираем на занятии живьем. Таблица - чтобы вы могли повторить то же самое со своей выпиской
Точка сверки
Google Translate
ChatGPT, простая модель
Профессиональный переводчик
Диагноз
Препарат
Единица дозы
Дата контроля
Время и цена
30 секунд, бесплатно
2 минуты, бесплатно или по подписке
дни, деньги
Заполняйте по ходу разбора: совпало - ставьте плюс, разошлось - выписывайте, как именно.
Что обычно видно на таком сравнении
Google Translate схватывает смысл и не выдумывает, но переводит термин буквально и не размечает документ: где диагноз, где назначение - разбираться вам
Простая модель без промпта дает самый гладкий русский текст. Именно поэтому она опаснее всех: гладкость маскирует сглаженный термин и «поправленную» дозу, а выглядит это убедительнее правильного перевода
Переводчик-человек держит норму термина, сохраняет единицы и помечает спорное. И несет ответственность, которую ни один инструмент не несет
Правильный вывод из сравнения
Вывод не «человек лучше машины». Вывод в распределении задач:
Понять, о чем документ - Google Translate, 30 секунд
Структурировать и вытащить цифры - модель с промптом из набора плюс промпт 3 на цитаты
Подать официально, подписать, лечить по этому документу - человек: переводчик, врач, юрист
Ключевой момент занятия. Самый убедительно звучащий перевод и самый точный перевод - это, как правило, разные тексты.
Словари иврита: чем проверять AI
На эти источники можно ссылаться в споре с ведомством, врачом или переводчиком. На ответ чат-бота - нельзя
База терминов Академии языка иврит. Официально утвержденная терминология по отраслям, включая медицинские сборники (מונחים שונים ברפואה). Единственный источник в этом списке, который имеет нормативный статус: на него ссылаются в документах и переводах. Открывайте, когда AI дал термин, а вам нужно защитить формулировку
Reverso Context. Не определения, а живые примеры: как слово реально используется в парах иврит-русский и иврит-английский. Хорош против канцелярских оборотов
Медицинские аббревиатуры иврита одним списком. Не нормативный источник, но быстрый: сначала сюда, потом за подтверждением в базу Академии
Dicta - отдельная строка. Израильский академический проект (руководитель Моше Коппель), все инструменты бесплатны и открыты. Три вещи, полезные именно нам: Nakdan расставляет огласовки в ивритском тексте - это прямое лекарство от ловушки «одно написание, несколько чтений»; их OCR распознает иврит и дополнительно чинит ошибки распознавания по контексту; есть раскрытие аббревиатур. В 2024 Dicta выпустила открытую ивритскую языковую модель под лицензией Apache 2.0.
Правило ссылок. В ответе ведомству, в споре с переводчиком и в медицинском документе ссылаться можно на Академию языка иврит, «Кол Зхут», сайт ведомства и nevo.co.il. Морфикс, Милог и Reverso - рабочие инструменты, но это не аргумент в переписке. Ответ чат-бота аргументом не является никогда.
Что дать чат-боту и что взять разработчику
Первая группа - источники, которые можно вписать в промпт или в Project как «проверяй здесь». Вторая - то, что реально подключается в код
Официальный реестр препаратов: точное написание торгового наименования, действующее вещество, форма и дозировка. Правильный ответ на вопрос «а это точно тот препарат»
Открытые ивритские модели от Dicta: линейка DictaLM (в том числе 3.0), DictaBERT и специализированные модели вроде dictabert-ner для извлечения имен и сущностей. Это то, на чем строят локальную обработку ивритских документов без выгрузки наружу
Морфологический разбор и поиск по ивриту. YAP - парсер лаборатории ONLP, HebMorph - анализатор для поисковых движков. Нужны, когда надо не перевести, а искать и индексировать ивритские документы
Огласовки, OCR с исправлением по контексту, раскрытие аббревиатур - как веб-сервисы для человека и как модели для разработчика
Веб и открытые модели
Как это применить без единой строчки кода. Соберите в своем Project или Gem короткий список: база терминов Академии, реестр лекарств Минздрава, «Кол Зхут», сайт ведомства. И одну инструкцию: «когда сомневаешься в термине или названии препарата - не угадывай, скажи, в каком из этих источников это проверяется, и дай точный поисковый запрос на иврите». Это превращает бота из генератора в навигатор по источникам, а проверка остается за вами.
Промпт-набор занятия: 7 промптов
Копируйте кнопкой и сохраните весь набор в свой Project (Claude / ChatGPT) или Gem (Gemini) - занятие 2.4
Промпт 1 · Основное резюме
Когда: любой официальный документ, с которого начинаете
Ты - помощник по разбору официальных документов Израиля.
Прочитай приложенный документ на иврите и ответь на русском.
1. ЧТО ЭТО: тип документа, кто и кому отправил, дата - в две строки
2. СУТЬ: главное содержание в 5-7 пунктах
3. ЦИФРЫ: все суммы, даты, сроки и номера - таблицей
[что | значение | страница или раздел]
4. ЧТО ОТ МЕНЯ ТРЕБУЕТСЯ: конкретные действия и их сроки
5. НЕЯСНО: что в документе двусмысленно или не указано
ОГРАНИЧЕНИЯ:
- Экстраполяция и додумывание запрещены. Если параметра нет,
пиши "в документе не указано"
- Не подставляй типовые значения "как обычно бывает":
в каждом ведомстве бывает по-разному
- Ключевые термины дублируй на иврите в скобках
Промпт 2 · Цифры и сроки
Когда: письма с дедлайнами - битуах леуми, мас ахнаса, банк, страховая
Из приложенного документа на иврите выпиши только:
1. СРОКИ - таблицей:
[дата | что происходит | что мне делать | цитата на иврите]
2. СУММЫ - таблицей:
[сумма | за что | кто платит | цитата на иврите]
3. Номера дел и справок, телефоны, адреса офисов и приемные часы
Если срок задан как "X дней с даты письма" - посчитай точную
календарную дату. Дата письма: [ВСТАВЬТЕ ДАТУ].
Обязательно уточни по каждому сроку:
- дни календарные или рабочие
- от какой даты идет отсчет: письма, получения или решения
Даты пиши словом: "3 апреля 2026", не "03/04/2026".
Суммы дублируй прописью.
Ничего не добавляй от себя.
Промпт 3 · Проверка цитатами
Когда: всегда, вторым сообщением в том же чате после промпта 1 или 2
Теперь проверь сам себя. Для каждого пункта твоего резюме
и для каждого числового значения приведи точную цитату из
документа на иврите (1-2 предложения), номер страницы и абзаца.
Если прямой цитаты нет - пометь пункт так:
"ИНТЕРПРЕТАЦИЯ МОДЕЛИ: прямого подтверждения в тексте нет".
Промпт 4 · Объясни по-человечески + глоссарий
Когда: письмо, которое страшно открывать, или документ с незнакомыми терминами
Объясни этот документ так, как объяснил бы сосед-юрист за чашкой
кофе: простыми словами, на русском, без канцелярита. Не больше
10 предложений.
Затем дай глоссарий всех ключевых терминов документа таблицей:
[термин на иврите | как читается русскими буквами | что означает |
важен ли для моего случая]
Термины из глоссария пригодятся мне для звонка в ведомство -
не переводи их «примерно», сохраняй точное написание.
Промпт 5 · Сравнение двух версий
Когда: новый договор аренды, обновленный полис, изменившиеся условия банка
Приложены две версии одного документа: старая и новая.
Сравни их и дай таблицу изменений:
[пункт | было (цитата на иврите) | стало (цитата на иврите) |
что это меняет для меня | риск: низкий / средний / высокий]
Отдельными списками: что полностью убрали и что добавили нового.
В конце назови 3 изменения, на которые смотреть в первую очередь,
и объясни почему.
Промпт 6 · Черновик ответа на иврите
Когда: нужно оспорить, уточнить или подтвердить - основа занятия 2.7
На основе этого документа составь черновик ответа на иврите.
Цель письма: [оспорить решение / уточнить детали / запросить
документы / подтвердить получение - оставьте нужное].
Требования:
- официальный вежливый тон
- структура: номер дела и дата исходного письма, суть обращения,
конкретная просьба, ожидаемый срок ответа
- мои личные данные не выдумывай: оставь [ПЛЕЙСХОЛДЕРЫ]
- после каждого абзаца на иврите - его перевод на русский
- в конце: список документов, которые стоит приложить
Промпт 7 · Медицинская выписка
Когда: выписка, заключение, результаты - сначала обезличить!
// Перед загрузкой удалите: ФИО, теудат-зеут, адрес, точную дату
// рождения. Замена: "пациент М., 58 лет". Подробно - занятие 2.3.
Прочитай медицинскую выписку на иврите и составь
структурированное резюме на русском:
1. ДИАГНОЗЫ: на иврите + перевод + код МКБ (ICD) СТРОГО
в том виде, как он написан в документе. Если кода нет -
пиши "код не указан". Подбирать код самостоятельно
категорически запрещено
2. ЧТО ПРОВЕДЕНО: обследования, процедуры, операции - с датами
3. НАЗНАЧЕНИЯ: препараты и дозировки ТОЧНО как в оригинале,
латиницей или ивритом. НЕ заменяй на "русские аналоги".
Единицу дозы приведи и на иврите, и латиницей:
מ"ג = mg, מק"ג = mcg. Если единица нечитаема - пиши
[единица неразборчива], не угадывай
4. РЕКОМЕНДАЦИИ и ограничения
5. КОНТРОЛЬ: даты повторных визитов, анализов, к кому обратиться
Не интерпретируй результаты и не давай советов по лечению.
В конце допиши дословно:
"ВНИМАНИЕ: документ собран алгоритмом структуризации текста
и медицинским заключением не является. Обязательна сверка
с оригиналом и с лечащим врачом."
Как пользоваться набором. Промпт 1 - точка входа для любого документа. Промпт 3 отправляйте следом всегда: это ваш детектор галлюцинаций из занятия 2.5. Остальные - по ситуации. Сохраните все семь в один Project / Gem с инструкцией «отвечай на русском, термины дублируй на иврите» - и больше не вставляйте вручную.
Три микро-добавки, которые можно вписать в любой промпт.
1. «Даты пиши словом: 3 апреля 2026». Убирает путаницу израильского и американского формата.
2. «Числа с запятой читай как тысячи: 2,340 = две тысячи триста сорок». Убирает ошибку на порядок.
3. «Если символ или цифра нечитаемы - пиши [неразборчиво], не угадывай». Превращает молчаливую догадку в видимый пробел.
Двойная проверка, если цена ошибки высокая. Скопируйте ответ первой модели и отдайте второй: «Вот документ и вот чужое резюме. Найди в резюме утверждения, которых нет в документе, и все расхождения в цифрах, датах и именах. Отвечай списком». Две разные модели ошибаются по-разному - расхождение почти всегда указывает на реальную проблему.
Пять ловушек иврита для AI
Печатный иврит флагманские модели читают уверенно - ловушки всплывают на сканах, в таблицах и при копировании
Ловушка
В чем проблема
Что делать
Справа налево (RTL)
Порядок букв ломается при копировании в Word; цифры внутри строки идут слева направо: תוך 60 יום
Вставка «только текст», направление абзаца - справа налево (в Word: правые Ctrl+Shift)
Буквы-двойники
На нечетком скане путаются: ו ן י · ך ר · ח ה ת · ב כ - одна буква меняет слово и фамилию
Имена и номера сверять посимвольно с оригиналом
Нет огласовок
Одно написание - несколько чтений: ספר - книга, парикмахер или «посчитал». Модель выбирает по контексту и может ошибиться
Странный перевод слова - спросить: «какие еще значения у этого слова здесь возможны?»
Аббревиатуры с гершаим
קופ"ח (купат холим), ביה"ח (больница), ת"ז (теудат-зеут) - модель иногда «расшифровывает» неверно
В промпте: «аббревиатуры сохраняй в оригинале и давай расшифровку рядом»
Смесь направлений
Иврит + English + цифры в одной строке: первыми страдают таблицы, бланки и колонки сумм
Для таблиц просить вывод «таблицей маркдаун», суммы сверять по оригиналу
Шесть примеров, где ошибка стоит дорого
Проверьте эти шесть мест в любом резюме, прежде чем что-то делать по документу
Что в документе
Где ломается
Что писать в промпте
מ״ג и מק״ג
мг и мкг на иврите различаются одной буквой. На нечетком скане это доза в 1000 раз больше или меньше. Самая опасная ошибка в выписках
«дозировки выпиши цифрой и единицей как в оригинале, единицу продублируй на иврите и латиницей»
03/04/2026
в Израиле это 3 апреля, в американском формате - 4 марта. Модель, отвечающая по-русски, иногда переключается на американский разбор даты
«все даты пиши в формате: 3 апреля 2026, месяц словом»
2,340 ₪
запятая здесь - разделитель тысяч, а не десятичная дробь. Ошибка на порядок в сумме к оплате
«суммы дублируй прописью: две тысячи триста сорок шекелей»
60 ימים и 60 ימי עסקים
календарные дни или рабочие - разница до двух недель. Для дедлайна возражения это разница между «успел» и «не успел»
«для каждого срока укажи: дни календарные или рабочие, и от какой даты идет отсчет»
ערר и ערעור
AI переводит оба слова как «апелляция», но это разные процедуры и разные адресаты. По решению медкомиссии битуах леуми: ערר в апелляционную медкомиссию - 60 дней, потом ערעור только по правовому вопросу в суд по трудовым спорам - тоже 60 дней
«процедурные термины не переводи, оставь на иврите и добавь пояснение, куда именно подается»
אינו זכאי
отрицание. Одно короткое слово переворачивает смысл: «имеет право» превращается в «не имеет». На скане אינו легко теряется
«отдельным списком выпиши все, в чем документ отказывает, с цитатами»
Мини-тест на занятии. Возьмите свое резюме от AI и найдите в нем эти шесть мест. Если хоть одно не проверяется по оригиналу за 30 секунд - резюме сделано плохо, добавьте промпт 3.
Сканы и фото: если текст не выделяется
Для AI это картинка - модель «разглядывает» буквы, и качество снимка решает все
Порядок действий
Снимайте по 1-2 страницы, ровно, при дневном свете: без теней, пальцев и перспективы
Грузите в Gemini или ChatGPT. Gemini Notebook (бывший NotebookLM) сканы читает плохо
Сначала распознавание, потом смысл - промпт справа
Имена, цифры и номера сверяйте с оригиналом посимвольно
Рукопись, печати и факсы - главный источник ошибок. Результат считаем черновиком, каждую цифру - под сомнением.
Промпт для сканов
Двухшаговый: видно, что модель прочитала
Вот фото страниц документа на иврите
(страницы [1-2 из N]).
ШАГ 1: распознай текст и выведи его на иврите
как есть, без перевода. Места, где не уверен,
помечай [неразборчиво].
ШАГ 2: после моего "ок" переведи на русский и
сделай резюме: суть, все цифры и даты, что от
меня требуется.
Пункт «НЕЯСНО»: прочитан. Если там сроки или деньги - звонок в ведомство или вопрос специалисту
Лестница риска
Чем выше цена ошибки - тем меньше доверия к AI и тем обязательнее оригинал
НИЗКИЙ
Понять суть письма · глоссарий терминов · вопросы к приему · пересказ для семьи
Делаем свободно
СРЕДНИЙ
Черновик официального ответа · сравнение версий договора · заполнение бланков
AI пишет - вы проверяете каждую строку
ВЫСОКИЙ
Суммы и сроки подачи · дозировки · юридические обязательства · подпись под документом
Только сверка с оригиналом; при цене ошибки - юрист, врач, бухгалтер
Израиль, лето 2026: правила ужесточились
Три события, которые меняют не теорию, а вашу ежедневную практику
Что произошло
Факты
Что это значит для вас
Минздрав закрыл AI в больницах
Конец июня 2026: доступ к ChatGPT, Claude и Gemini заблокирован на компьютерах государственных больниц. Формулировка: киберриски и угроза раскрытия чувствительной медицинской информации. Предупреждение выходило еще в марте 2026
С рабочего компьютера в больнице публичных чатов больше нет. Учреждения переводят сотрудников на защищенные внутренние решения
Первый штраф по поправке 13
21.07.2026: купат холим «Меухедет» - 256 000 шек. Причина не утечка как таковая, а опоздание с сообщением регулятору о сбое, который открывал родственникам доступ к чужим медкартам. Сбой обнаружили в январе 2026, сигналы были с ноября 2025
Поправка 13 - не декларация. Санкция реальна, и срабатывает она даже за процедурное нарушение
Shadow AI остался
После блокировки врачи продолжают загружать материалы с личных телефонов. По опросу AMA (февраль 2025) 66% врачей в США сообщали об использовании AI в 2024 году против 38% годом раньше
Блокировка сети не отменяет загрузку, она уводит ее из-под контроля. Обезличивание перестало быть хорошим тоном и стало вашей личной страховкой
Практический вывод. Свои документы - разбирайте свободно. Чужие персональные данные в публичный чат не уходят никогда: ни с рабочего компьютера, ни с личного телефона. Перед рабочим использованием выясните политику своей организации - проект руководства Управления по защите приватности (май 2025) прямо требует от организаций письменной политики использования генеративного AI.
Протокол обезличивания: что убрать до загрузки
Две минуты работы. Выполняется до того, как файл ушел в чат, а не после
Шаг 1. Прямые идентификаторы - удалить
ФИО (שם פרטי ומשפחה)
[ПАЦИЕНТ] или «пациент М.»
Теудат-зеут (ת״ז)
[НОМЕР_УДОСТОВЕРЕНИЯ]
Адрес, телефон, email
удалить полностью
Точная дата рождения
заменить на возраст: «58 лет»
Шаг 2. Косвенные идентификаторы - тоже
Номера медкарты, личного дела, страхового полиса
Номер лицензии врача и его ФИО
Маленький населенный пункт или узкое отделение, по которым человека можно вычислить
Точные даты госпитализации и операции: оставляйте месяц и год
Важная поправка, о которой обычно забывают. Замена ФИО на плейсхолдер не делает документ анонимным. Связка «редкий диагноз + возраст + месяц + конкретное отделение конкретной больницы» опознает человека без всякого имени. Если после обезличивания такая связка осталась - либо убирайте еще, либо не загружайте. Это не паранойя: именно за обращение с чувствительными данными выписывают санкции по поправке 13.
Что говорит закон. Поправка 13 к Закону о защите приватности вступила в силу 14 августа 2025. Медицинские, генетические и биометрические данные отнесены к «информации особой чувствительности» (מידע בעל רגישות מיוחדת). Введена обязательная должность инспектора по защите приватности (ממונה על הגנת הפרטיות, DPO) для организаций, обрабатывающих такие данные в крупных объемах; организации, обрабатывающие данные более чем 100 000 субъектов, обязаны уведомить регулятора. Санкции - до миллионов шекелей, и первый прецедент уже есть.
Медицинские документы: отдельные правила
Для выписок, заключений и результатов обследований - поверх общего алгоритма
Обезличивание до загрузки: ФИО, теудат-зеут, дата рождения, адрес - долой. Замена: «пациент М., 58 лет». Чек-лист анонимизации - в занятии 2.3
Препараты и дозы не переводить: копировать как в оригинале, латиницей или ивритом. «Аналог по-русски» - источник опасных ошибок. Отдельно проверяйте единицы: מ״ג (мг) и מק״ג (мкг) различаются одной буквой
Пометка на каждом резюме: «AI-пересказ, требует сверки врача с оригиналом» - и для себя, и для родственников
Закон: поправка 13 к Закону о защите приватности (в силе с августа 2025) относит медицинские данные к особо чувствительным. Первый штраф по ней уже выписан: 256 000 шек. купе «Меухедет», 21.07.2026. За чужие данные отвечаете вы
Работа и дом - разные режимы: с рабочих компьютеров госбольниц публичные AI-чаты заблокированы с конца июня 2026. Для рабочих задач используйте то, что разрешено вашей организацией
mis.smartomica.org
Smartomica CSE (Clinical Synopsis Engine) - сервис медицинских переводов и саммари выписок. Создан именно под эту задачу: структура, термины, коды. Подписка бесплатна и открывает доступ к Блоку 2 курса.
Режим «Документы»: .pdf, .docx, .pptx, .xlsx до 10 MB, PDF до 300 страниц, верстка сохраняется. Текст внутри сканов и картинок не переводится. Для «понять о чем», не для точных цифр
База терминов Академии языка иврит, есть медицинские сборники - нормативный источник для спорных формулировок. Полный список словарей - в разделе «Словари иврита» выше
Smartomica CSE: медицинские переводы и саммари, пропуск в Блок 2
Домашнее задание
Обсудим результаты в начале занятия 2.7
Прогоните один реальный документ через промпт 1, затем промпт 3 (цитаты)
Сверьте все даты и суммы с оригиналом по чек-листу. Запишите, были ли расхождения и какие
Сохраните весь набор в свой Project / Gem (занятие 2.4), чтобы не вставлять заново
Отложите одно письмо, на которое нужно ответить - оно станет материалом занятия 2.7 «Деловая переписка на иврите и английском»
Не нашли расхождений? Отлично, метод работает. Нашли - вы только что окупили занятие: расхождение в дате или сумме, замеченное до отправки ответа, стоит дороже любого курса.
Для тех, кто хочет глубже: Хабр
Честно: готового «набора инструментов для иврита» на Хабре нет. Есть четыре материала, которые стоят времени
Перевод инженерной статьи Spotify про поддержку RTL. Лучшее объяснение, почему именно ломаются скобки, знаки препинания и обрезка текста, когда в одной строке иврит, латиница и цифры. Если хотите понимать нашу ловушку №1, а не просто знать о ней - читать это
Август 2024. Автор собрал свой OCR для иврита на PaddleOCR, потому что Tesseract справлялся плохо, а EasyOCR и MMOCR иврит не поддерживают. Полезный вывод для нас без всякого кода: классические OCR на иврите слабы, и именно поэтому мы идем в мультимодальные модели
Два текста про HebrewGlot: иврит как система корней и биньянов, а не список слов. Не про документы, но объясняет, откуда берутся словоформы, которых нет в словаре и которые AI переводит наугад
Короткий разбор кодировок. Пригодится, когда ивритский текст из старого PDF превращается в «кракозябры» и надо понять, чинится это или нет
Что взять из этого практикующему. Одну мысль: инструменты общего назначения на иврите работают хуже, чем на английском, и это свойство языка и данных, а не ваша ошибка. Отсюда все наши правила - двухшаговое распознавание, цитаты, посимвольная сверка имен и цифр.
Откуда цифры
Все данные раздатки проверены 11 августа 2026 по первоисточникам
Лимиты файлов: справочные центры OpenAI (File uploads FAQ), Claude (Upload files to Claude), Gemini Apps Help, Gemini Notebook Help.
Переименование NotebookLM в Gemini Notebook: официальный блог Google, 16.07.2026.
Блокировка AI-инструментов в госбольницах: сообщения израильских СМИ (N12, Ynet, Maariv), конец июня 2026, после предупреждения марта 2026.
Штраф «Меухедет» 256 000 шек.: решение Управления по защите приватности, публикации Globes и law.co.il, 21.07.2026.
Сроки ערר и ערעור: сайт «Битуах леуми», раздел апелляционных медкомиссий - 60 дней на каждом этапе.
Данные об использовании AI врачами: опрос American Medical Association, февраль 2025.
Поправка 13: вступление в силу 14.08.2025, «информация особой чувствительности», обязанность назначить инспектора по защите приватности, порог уведомления 100 000 субъектов - публикации израильских юридических фирм по тексту закона.
Google Translate: лимиты режима «Документы» - справка Google (10 MB, PDF до 300 страниц, .pdf/.docx/.pptx/.xlsx); Gemini-модели в переводе и живой перевод речи - блог Google от 12.12.2025.
Dicta: dicta.org.il, описание инструментов и открытой ивритской модели 2024 года.
Лимиты вендоров меняются без предупреждения. Если увидели расхождение - верьте официальной справке вендора, а не раздатке, и напишите мне: поправлю к следующему потоку.