AuraOverlay Скачать

механика, а не обещания

Нейросеть для собеседования: что происходит внутри

Между «интервьюер замолчал» и первой строкой на экране укладывается пара секунд. Внутри них — четыре шага: звук звонкараспознавание речиотбор репликиответ модели

macOS 14.2 и новее · Windows 10 и 11 · звонок настраивать не нужно

путь звука

Четыре шага между вопросом и первой строкой

Шаги идут строго друг за другом: следующий не может начаться, пока не закончился предыдущий. Поэтому общее ожидание — это не скорость самого медленного места, а сумма всех четырёх. Время в углу каждого шага отсчитывается от той секунды, когда интервьюер перестал говорить.

0 с Звук звонка Берётся системный вывод — ровно то, что слышите в наушниках вы. Zoom, Meet и Телемост об этом ничего не знают, настраивать в них нечего.
+0,3 с Распознавание речи Поток превращается в текст по ходу разговора. Реплика считается закрытой по паузе: на половину фразы отвечать нечем.
+0,01 с Отбор реплики Правила на вашем компьютере решают, вопрос это или вежливость. Шаг бесплатный и в интернет не ходит — оттого и почти мгновенный.
+0,9 с Ответ модели В модель уходит вопрос, несколько предыдущих реплик и ваше резюме. Текст возвращается потоком, а не целым куском в конце.

секунды

На что уходит ожидание

Самое долгое здесь — не нейросеть, а живой человек: отсчёт идёт только с той секунды, когда фраза закончилась. Полосы ниже — доли одного и того же ожидания, от паузы интервьюера до момента, когда ответ дочитан до конца.

интервьюер договаривает 0,8 с
распознан последний кусок 0,3 с
модель до первого слова 0,9 с
весь ответ дочитался 4 с

Это типичные числа, а не обещание. На медленном интернете, на длинном вопросе или когда модель перегружена, каждая полоса растягивается. Важнее другое: читать можно с первой строки, и четвёртую полосу целиком ждать не нужно — к тому моменту вы уже говорите.

отбор

Почему в модель уходит не каждая фраза

Первым текст реплики смотрит не нейросеть, а набор правил прямо в приложении: вопросительные слова, просьбы вроде «объясните» и «сравните», знак вопроса, похоже ли на законченную мысль. Это не стоит ни денег, ни заметного времени, и отсекает большую часть звонка ещё до того, как что-то уйдёт в сеть.

Реплика в звонкеРешениеПочему так
«Меня хорошо слышно?» не идёт дальше Вопрос по форме, но ответ на него вы скажете быстрее, чем успеет появиться окно.
«Сейчас пару слов про команду» не идёт дальше Обращения к вам нет, просьбы нет — интервьюер рассказывает, а не спрашивает.
«Объясните, зачем нужны индексы» уходит в модель Просьба к вам, фраза закончена, тема рабочая — ровно тот случай, ради которого всё и задумано.
«А если данных станет в сто раз больше?» уходит в модель Вопрос вдогонку сам по себе непонятен, поэтому к нему прикладываются предыдущие реплики.

Отсюда два следствия. Окно не дёргается на каждое «угу» — а значит, его можно держать открытым и не отвлекаться. И нагрузка на модель уходит только на те реплики, ради которых приложение ставили: чем меньше лишних обращений, тем быстрее приходят нужные.

честно

Где нейросеть ошибается

Ошибки у неё не случайные, а одни и те же, и знать их стоит заранее — тогда на звонке они не застают врасплох.

  • Слышит термины не так, как их пишут. Kafka в расшифровке становится «капчей», CI/CD — «си-ай-си-ди», gRPC — «джи-эр-пи-си». Словарь инструментов на сервере выправляет частое, но не всё: на редком названии ответ уедет в соседнюю тему.
  • Уверенно говорит неправду про ваш опыт. Спросите про проект, которого не было, — и модель назовёт его, укажет роль и сроки, ничем не выдав выдумку. Лечится одним: резюме и вакансия загружаются до звонка, и дальше ответ собирается из них.
  • Принимает паузу за конец вопроса. Если интервьюер задумался посреди фразы, реплика закроется рано. Продолжения приложение ждёт до полутора секунд, дольше — отвечает на услышанную половину.
  • Не знает о том, что не прозвучало вслух. Вопрос, написанный в чат звонка или показанный на слайде, для распознавания не существует. Для экрана есть отдельная клавиша, но нажимаете её вы.

вопросы

Коротко о главном

Как нейросеть понимает, что прозвучал вопрос?

Сначала текст реплики разбирают правила на вашем компьютере: вопросительное слово, просьба вроде «объясните» или «расскажите», знак вопроса, законченность фразы. Похожее на рабочий вопрос уходит дальше, в модель, а «сейчас подключится коллега» не уходит никуда.

Сколько времени проходит от конца фразы до первых слов ответа?

Обычно одна-две секунды. Меньшую часть этого времени занимает расшифровка последнего куска речи, большую — модель, пока она собирает начало ответа. Дальше текст идёт потоком, и читать его можно, не дожидаясь конца.

Почему подсказка приходит не на каждую реплику?

Потому что большая часть звонка — это не вопросы: приветствие, рассказ про команду, «вы меня слышите». Такие реплики отсеиваются на вашем компьютере и до модели не доходят. Так окно не мигает без дела, а нужные ответы приходят быстрее.

Откуда нейросеть знает про мой опыт?

Только из того, что вы загрузили до звонка: резюме и описание вакансии. Без них на вопрос про ваши проекты модель придумает правдоподобную историю — с названиями и сроками, которых не было. Это её обычное поведение, а не поломка.

Почему в расшифровке попадаются не те термины?

Английские названия в русской речи распознаются хуже всего: Kafka превращается в «капчу», CI/CD — в «си-ай-си-ди». Словарь инструментов на сервере выправляет частые случаи, но не все. Если подсказка пришла не про то, проще переспросить интервьюера — на звонке это выглядит нормально.

дальше

Разделы по теме

Посмотреть на это вживую

Первые 30 минут бесплатно — их хватает на один разговор. Дальше подписка по времени или пакет собеседований.

macOS 14.2 и новее · Windows 10 и 11