Python: задачки и вопросы
6.93K subscribers
1.35K photos
1 video
1 file
126 links
Вопросы и задачки для подготовки к собеседованиям и прокачки навыков

Разместить рекламу: @tproger_sales_bot

Правила общения: https://tprg.ru/rules

Другие каналы: @tproger_channels

Другие наши проекты: https://tprg.ru/media
Download Telegram
Python: задачки и вопросы
Развёрнутое пояснение:

1. Создаётся словарь tags с ключами api и db.

2. Запускается цикл for key in tags, который получает итератор ключей словаря.

3. Итератор запоминает ожидаемое количество элементов на момент начала обхода.

4. При первом же ключе api условие срабатывает и вызывается tags.pop(key), удаляя элемент из словаря.

5. Словарь изменил размер во время итерации, поэтому при следующей попытке получить следующий ключ интерпретатор обнаруживает рассогласование и возбуждает RuntimeError: dictionary changed size during iteration.

6. print(tags) не выполняется, потому что исключение прерывает выполнение.

Почему это важно: такая ошибка часто возникает при фильтрации или очистке словарей состояния, кэша или метрик. Правильный способ — собрать ключи для удаления в отдельный список и удалять после цикла, либо создавать новый словарь через dict comprehension. Это позволяет избежать неожиданного падения на проде при обработке логов, конфигов или счётчиков.
1
Please open Telegram to view this post
VIEW IN TELEGRAM
2
Python: задачки и вопросы
Развёрнутое пояснение:

1. Список logs содержит четыре кортежа: две записи api и две db, чередующиеся. 2. itertools.groupby не сортирует данные и не ищет все одинаковые ключи во всём списке: он формирует новую группу каждый раз, когда ключ очередного элемента отличается от ключа предыдущего. 3. Последовательность ключей в logs: api, db, api, db. Поэтому группы получаются такими: api с одной записью, db с одной записью, снова api с одной записью и снова db с одной записью. 4. В dict comprehension каждый ключ перезаписывается при повторном вхождении. Сначала 'api' получает список из одной ошибки, потом 'db' — один успех, затем 'api' зативается второй группой из одной успешной записи, и в конце 'db' перезаписывается группой с одной ошибкой. 5. В итоге groups['api'] — это список из одного кортежа [('api', 'ok')], а len от него равен 1.

Почему это важно: в аналитике логов и отчётах часто ожидают, что groupby сгруппирует все записи по ключу, как SQL GROUP BY, но в Python он работает только над отсортированными или уже упорядоченными данными. Если пропустить сортировку, группы дробятся, а при записи в словарь последняя группа затирает предыдущие с тем же ключом. Это приводит к тихой потере данных и неверным агрегатам.
2
Please open Telegram to view this post
VIEW IN TELEGRAM
2
Python: задачки и вопросы
Развёрнутое пояснение:

1. В памяти создаётся объект Tags, содержащий два ключа a и b.

2. Функция json.dumps начинает кодирование этого объекта.

3. Внутренний энкодер CPython сначала проверяет базовые типы: строки, числа, булевы значения, None, списки, кортежи и dict.

4. Tags наследует UserDict, который не является подклассом dict, поэтому объект не попадает в ветку для словарей.

5. Поскольку тип неизвестен энкодеру, вызывается функция default, переданная в аргументе default.

6. В default объект o имеет длину 2, поэтому возвращается строка tags:2.

7. json.dumps кодирует эту строку как JSON-строку, а print выводит tags:2.

Почему это важно: при сериализации пользовательских маппингов, таких как UserDict или ChainMap, нельзя рассчитывать, что json.dumps автоматически превратит их в обычный словарь. Это часто встречается при логировании, отправке конфигурации или сохранении состояния, когда кастомный контейнер оказывается строкой вместо JSON-объекта. Чтобы избежать сюрприза, передавайте данные через dict() или реализуйте собственный JSONEncoder.
1
Please open Telegram to view this post
VIEW IN TELEGRAM
1
Python: задачки и вопросы
Развёрнутое пояснение:

1. При определении функции ingest создаётся один объект множества set() и сохраняется как значение по умолчанию для параметра seen.

2. Первый вызов ingest(['a','b']) использует это же множество, добавляет в него 'a' и 'b' и возвращает len(seen), то есть 2.

3. Второй вызов ingest(['b','c']) получает уже непустое множество с элементами 'a' и 'b'. Добавляется только 'c', поэтому длина становится 3.

4. Переменная res получает кортеж (2, 3), а print(*res) выводит 2 3.

5. Правильный вариант — 2 3.

Почему это важно: изменяемое значение по умолчанию — частая ловушка при реализации кэшей, дедупликаторов, счётчиков и накопителей ошибок. В тесте, где функцию вызывают один раз, баг может не проявиться, а в проде при повторных вызовах общее изменяемое состояние искажает результат. Чтобы избежать этого, изменяемый объект создают внутри тела функции: seen=None, а внутри if seen is None: seen=set().
1
Please open Telegram to view this post
VIEW IN TELEGRAM
1
Python: задачки и вопросы
Развёрнутое пояснение:

1. from fractions import Fraction импортирует рациональное число.

2. Fraction(0.1) берёт не 1/10, а точное значение float 0.1 — дробь с большим знаменателем.

3. То же происходит с Fraction(0.2) и Fraction(0.3).

4. a + b вычисляет сумму двух таких двоичных дробей.

5. Эта сумма не равна дроби, полученной из float 0.3, потому что 0.1 + 0.2 ≠ 0.3 в двоичной плавающей арифметике.

6. Сравнение возвращает False.

Почему это важно: при финансовых расчётах и точных вычислениях Fraction следует создавать из строк или целых чисел, а не из float, иначе двоичные погрешности сохраняются в «точном» рациональном типе.
4
Как понять, что программисту пора в отпуск:
— на столе бардак;
— шорты не доставались с позапрошлого лета;
— чудится тифлинг;
— на вопрос «когда отдыхаешь?» отвечает «после релиза»;
— релиз был в феврале.

Сам он с места не сдвинется. Помогите Типичному Программисту собраться и улететь в отпуск в новой мини-игре!
Please open Telegram to view this post
VIEW IN TELEGRAM
3
Python: задачки и вопросы
Развёрнутое пояснение:

1. Внутри report создаётся объект map, который при обходе вычисляет len для каждой строки.

2. sum(sizes) проходит по всем элементам: 3 + 4 + 2 = 9. После этого итератор исчерпан.

3. list(sizes) пытается снова обойти тот же объект map, но элементов больше нет, поэтому valid = 0.

4. Функция возвращает кортеж (9, 0), который и печатается.

Почему это важно: в пайплайнах обработки логов или событий часто передают map, filter или генераторное выражение сразу в несколько агрегирующих функций, ожидая, что каждая из них прочитает данные заново. Из-за одноразовости итераторов это приводит к заниженным счётчикам, потере записей и нестабильным отчётам, пока данные не материализовать в список.
3
Please open Telegram to view this post
VIEW IN TELEGRAM
2
Python: задачки и вопросы
Развёрнутое пояснение:

1. При определении функции log_event создаётся один пустой список buffer, который используется как значение по умолчанию.

2. Первый вызов log_event со строкой timeout добавляет эту строку в общий список и возвращает его, результат сохраняется в переменную a.

3. Второй вызов log_event со строкой 403 использует тот же список buffer, добавляет строку 403 и возвращает его, результат сохраняется в переменную b.

4. Переменные a и b указывают на один и тот же объект, поэтому print(a, b) выводит ['timeout', '403'] ['timeout', '403'].

Почему это важно: изменяемый аргумент по умолчанию часто встречается в функциях-логгерах, кэширующих обёртках и накопителях метрик, но на деле он работает как глобальное состояние между вызовами. В многопоточном коде это создаёт состояние гонки, а в тестах — нестабильные результаты. Правильный паттерн: buffer=None и создание нового списка внутри функции.
1
Please open Telegram to view this post
VIEW IN TELEGRAM
1
Python: задачки и вопросы
Развёрнутое пояснение:

1. Создаётся список services = ['api', 'auth', 'db'].

2. Вызов dict.fromkeys(services, []) создаёт словарь, где каждому ключу присвоена ссылка на один и тот же пустой список, а не три независимых списка.

3. Выражение statuses['api'] возвращает этот общий список, а append('ok') изменяет его, добавляя строку 'ok'.

4. Поскольку все три ключа ссылаются на один изменённый объект, print выводит {'api': ['ok'], 'auth': ['ok'], 'db': ['ok']}.

Почему это важно: это классическая ловушка при инициализации словарей с изменяемыми значениями по умолчанию в конфигах, группировках или агрегации статусов. Вместо dict.fromkeys(..., []) используйте dict comprehension или defaultdict(list), чтобы каждый ключ получил свой независимый объект и неожиданные мутации не распространялись на соседние записи.
2
Please open Telegram to view this post
VIEW IN TELEGRAM
1
Python: задачки и вопросы
Развёрнутое пояснение:

1. Декоратор dataclass(frozen=True) генерирует для Client методы __init__, __repr__, __eq__ и __hash__.

2. __eq__ у frozen dataclass сравнивает все поля экземпляров. У a name='a', у b name='b', поэтому a!= b.

3. __hash__ тоже строится по всем полям, поэтому hash(a)!= hash(b).

4. Словарь cache размещает a и b в разные корзины. После cache[a] = 'old' и cache[b] = 'new' в словаре два элемента.

5. Обращение cache[a] возвращает значение, связанное с a, то есть 'old'. Итоговый вывод: old 2.

Почему это важно: dataclass часто используют как ключи dict или элементы set, и поведение зависит от того, какие поля входят в равенство. frozen=True решает проблему изменяемости, но не помогает, если логика идентичности подразумевает только часть полей. В реальном коде это приводит к дублям в кеше, утечке памяти и неверным попаданиям при поиске.
1
Please open Telegram to view this post
VIEW IN TELEGRAM
1
Python: задачки и вопросы
Развёрнутое пояснение:

1. Создаётся внутренний список ['', '', ''] — три пустые строки.

2. Выражение [внутренний_список] * 3 создаёт новый список из трёх элементов, но каждый элемент — это ссылка на один и тот же внутренний список, а не его независимая копия.

3. Присваивание grid[0][0] = 'X' изменяет первый элемент этого общего внутреннего списка, поэтому все три строки grid отображают одно и то же изменение.

4. print(grid) выводит [['X', '', ''], ['X', '', ''], ['X', '', '']].

Почему это важно: такая инициализация часто встречается при создании матриц, игровых полей, таблиц или двумерных кэшей. Если строки оказываются общим изменяемым объектом, мутация одной ячейки неожиданно распространяется на весь столбец или всю таблицу, что приводит к трудноуловимым багам. Правильный способ — создавать каждую строку отдельно, например, через списочное включение [['' for _ in range(3)] for _ in range(3)].
1