Не помню, рассказывал про свое микросоревнование с самим собой, или нет, беглый поиск по каналу ничего такого не нашел, поэтому рассказываю, тем более, есть повод!
Просто писать код - скучно, это уже давно доведено до автоматизма.
Поэтому я, по крайней мере, для pet project, изобретаю какие-нибудь ограничения, которым дополнительно должен удовлетворять код.
В #ix такое ограничение - это размер ядра(интерпретация пакетов и подготовка графа) в байтах.
Причем жестить нельзя - например, нельзя для этого сокращать имена функций, методов, и так далее.
Нужно мне длинное название метода - значит, будет длинное название! https://github.com/pg83/ix/blob/main/core/package.py#L261
(Кстати, немного в сторону - я обнаружил, что, в разных языках, я соблюдайю разные принципы именования. Например, в python это "короткие имена переменных, длинные(очень) имена методов и функций". Потому что типов нет, и иначе грепать становится невозможно)
Основные источники профита:
* Вынос кода из ядра в шаблоны. Это, кстати, хорошо по многим причинам - чем больше информации в шаблонах, и меньше в ядре, тем точнее uid ноды меняется в зависимости от фактических изменений результата.
* Поиск дублирующегося "смысла" (например, в какой-то момент мне довольно сильно помогло сократить размер понимание, что #realm/env - это точно такая же нода, как и любой прочий пакет, и обрабатывать ее надо тем же кодом)
Довольно долго я держал планку в 40к, при этом добавляя новые фичи, потом, полгода, держался на 50к, но вот последние месяца 2 - 3 забрался за 51, и оно никак не ужималось.
Сегодня я отыграл до 49к, бесплатно добавил новую команду "let", и очень рад этому факту!
"let" - это такой аналог "mut", который не перемещает глобальную симлинку на свежеподготовленный realm/env. Эта команда полезна, когда хочется перед переключением системы на новый root, посмотреть, чего там в нем таки лежит.
(напомню, что, по сути, мой корень - это симлинка на вот такой read only realm)
Как я это ужал?
Я отрефакторил команды mut/let/run/build в фасады к одной простой функции, которая умеет подготовить набор realm для заданной командной строки:
* let - это просто вызов этой функции
* mut - это let + несколько вызовов os.symlink()
Дальше интереснее:
* build - это интерпретация заданного command line в контексте создания нового эфемерного realm.
* run - это build, в финале которого еще запускаем одну команду в свежесозданном окружении.
https://github.com/pg83/ix/blob/main/core/cmd_realm.py#L27 - собственно, вот эти 5 функций, которые позволили мне стереть 1.5k кода!
Просто писать код - скучно, это уже давно доведено до автоматизма.
Поэтому я, по крайней мере, для pet project, изобретаю какие-нибудь ограничения, которым дополнительно должен удовлетворять код.
В #ix такое ограничение - это размер ядра(интерпретация пакетов и подготовка графа) в байтах.
Причем жестить нельзя - например, нельзя для этого сокращать имена функций, методов, и так далее.
Нужно мне длинное название метода - значит, будет длинное название! https://github.com/pg83/ix/blob/main/core/package.py#L261
(Кстати, немного в сторону - я обнаружил, что, в разных языках, я соблюдайю разные принципы именования. Например, в python это "короткие имена переменных, длинные(очень) имена методов и функций". Потому что типов нет, и иначе грепать становится невозможно)
Основные источники профита:
* Вынос кода из ядра в шаблоны. Это, кстати, хорошо по многим причинам - чем больше информации в шаблонах, и меньше в ядре, тем точнее uid ноды меняется в зависимости от фактических изменений результата.
* Поиск дублирующегося "смысла" (например, в какой-то момент мне довольно сильно помогло сократить размер понимание, что #realm/env - это точно такая же нода, как и любой прочий пакет, и обрабатывать ее надо тем же кодом)
Довольно долго я держал планку в 40к, при этом добавляя новые фичи, потом, полгода, держался на 50к, но вот последние месяца 2 - 3 забрался за 51, и оно никак не ужималось.
Сегодня я отыграл до 49к, бесплатно добавил новую команду "let", и очень рад этому факту!
"let" - это такой аналог "mut", который не перемещает глобальную симлинку на свежеподготовленный realm/env. Эта команда полезна, когда хочется перед переключением системы на новый root, посмотреть, чего там в нем таки лежит.
(напомню, что, по сути, мой корень - это симлинка на вот такой read only realm)
Как я это ужал?
Я отрефакторил команды mut/let/run/build в фасады к одной простой функции, которая умеет подготовить набор realm для заданной командной строки:
* let - это просто вызов этой функции
* mut - это let + несколько вызовов os.symlink()
Дальше интереснее:
* build - это интерпретация заданного command line в контексте создания нового эфемерного realm.
* run - это build, в финале которого еще запускаем одну команду в свежесозданном окружении.
https://github.com/pg83/ix/blob/main/core/cmd_realm.py#L27 - собственно, вот эти 5 функций, которые позволили мне стереть 1.5k кода!
GitHub
ix/core/package.py at main · pg83/ix
ix package manager. Contribute to pg83/ix development by creating an account on GitHub.
🔥10😱6👍4😁1🤯1
https://github.com/scandum/rotate
Интересная подборка про разные способы "провернуть"(поменять левую и правую часть с сохранением порядка в каждой из частей) массив.
У меня, когда в таком возникает нужда, в голову всегда приходит один и тот же алгоритм, который по ссылке назвали "Triple Reversal Rotation".
Он IMHO довольно естественно приходит в голову, когда про это задумываешься, и я даже и не знал, что есть что-то еще.
В #ix даже как-то возникла такая задача, потому что я принял не очень верное решение, что "верхние(элементы списка) переопределяют нижних", то есть, список зависимостей
А это, на самом деле, хоть и выглядит "естественно" для человека, порождает необходимость вот так вот "повертеть" массивчики в нескольких местах.
Например, вот тут - https://github.com/pg83/ix/blob/main/core/realm.py#L72-L73
Или вот тут, но тут сложнее заметить - https://github.com/pg83/ix/blob/main/core/package.py#L56
Интересная подборка про разные способы "провернуть"(поменять левую и правую часть с сохранением порядка в каждой из частей) массив.
У меня, когда в таком возникает нужда, в голову всегда приходит один и тот же алгоритм, который по ссылке назвали "Triple Reversal Rotation".
Он IMHO довольно естественно приходит в голову, когда про это задумываешься, и я даже и не знал, что есть что-то еще.
В #ix даже как-то возникла такая задача, потому что я принял не очень верное решение, что "верхние(элементы списка) переопределяют нижних", то есть, список зависимостей
{% block deps %}
A
B
C
{% endblock %}
превратится в "-I A/include -I B/include ..."А это, на самом деле, хоть и выглядит "естественно" для человека, порождает необходимость вот так вот "повертеть" массивчики в нескольких местах.
Например, вот тут - https://github.com/pg83/ix/blob/main/core/realm.py#L72-L73
Или вот тут, но тут сложнее заметить - https://github.com/pg83/ix/blob/main/core/package.py#L56
GitHub
GitHub - scandum/rotate: A collection of array rotation algorithms.
A collection of array rotation algorithms. Contribute to scandum/rotate development by creating an account on GitHub.
👍4🤯3🔥2🤔1
https://github.com/RomanHotsiy/commitgpt
"Automatically generate commit messages using ChatGPT"
Это мы используем.
"Automatically generate commit messages using ChatGPT"
Это мы используем.
GitHub
GitHub - RomanHotsiy/commitgpt: Automatically generate commit messages using ChatGPT
Automatically generate commit messages using ChatGPT - RomanHotsiy/commitgpt
👍12🍌4😐3👎1
https://www.opennet.ru/opennews/art.shtml?num=58249
Пишут, что нового кода в Android на Rust становится больше, а на С(и, в меньшей степени, на С++) - меньше.
Это, конечно, очень хорошо.
Думаю, вы уже знаете мою точку зрения, что, с точки зрения безопасности, современный С++(с RAII, контейнерами, и санитайзерами), на практике не сильно опаснее Rust(хотя Rust, конечно, сильно более хайповее!), но вот писать новый системный код на С - так себе идея.
Если честно, то мне, конечно, жаль, что гонку с С выиграл не С++, но и так неплохо получается.
Пишут, что нового кода в Android на Rust становится больше, а на С(и, в меньшей степени, на С++) - меньше.
Это, конечно, очень хорошо.
Думаю, вы уже знаете мою точку зрения, что, с точки зрения безопасности, современный С++(с RAII, контейнерами, и санитайзерами), на практике не сильно опаснее Rust(хотя Rust, конечно, сильно более хайповее!), но вот писать новый системный код на С - так себе идея.
Если честно, то мне, конечно, жаль, что гонку с С выиграл не С++, но и так неплохо получается.
www.opennet.ru
Около 21% нового компилируемого кода в Android 13 написано на языке Rust
Инженеры из компании Google подвели первые итоги внедрения в платформу Android поддержки разработки на языке Rust. В Android 13 примерно 21% от добавленного нового компилируемого кода написано на Rust, а 79% на C/C++. В репозитории AOSP (Android Open Source…
👍14💯3🥰2💩2
https://www.opennet.ru/opennews/art.shtml?num=58256
И вторая забавная новость.
Чуваки не могут поддерживать проект, потому что чувак с доступами не выходит на связь и не отвечает на звонки.
"Услугами FossHost пользовались такие открытые проекты, как GNOME, KDE, GNU Guix, Xiph.Org, Rocky Linux, Debian, OpenIndiana, Armbian, BlackArch, Qubes, FreeCAD, IP Fire, ActivityPub (W3), Manjaro, Whonix, QEMU, Xfce, Xubuntu, Ubuntu DDE и Ubuntu Unity. "
Я, на самом деле, не очень понимаю, о каких именно услугах идет речь, но не могу не повторить свою мысль, что код и прочую инфру желательно держать у больших инфраструктурных провайдеров.
Для души можно держать копию и даже мастер на небольшом хостинге, но 1 копия, из которой люди строят реальные пакеты, должна быть на большом хостинге.
Чтобы 1 человек не мог взять все ключи, и не помахать ручкой на прощание.
И вторая забавная новость.
Чуваки не могут поддерживать проект, потому что чувак с доступами не выходит на связь и не отвечает на звонки.
"Услугами FossHost пользовались такие открытые проекты, как GNOME, KDE, GNU Guix, Xiph.Org, Rocky Linux, Debian, OpenIndiana, Armbian, BlackArch, Qubes, FreeCAD, IP Fire, ActivityPub (W3), Manjaro, Whonix, QEMU, Xfce, Xubuntu, Ubuntu DDE и Ubuntu Unity. "
Я, на самом деле, не очень понимаю, о каких именно услугах идет речь, но не могу не повторить свою мысль, что код и прочую инфру желательно держать у больших инфраструктурных провайдеров.
Для души можно держать копию и даже мастер на небольшом хостинге, но 1 копия, из которой люди строят реальные пакеты, должна быть на большом хостинге.
Чтобы 1 человек не мог взять все ключи, и не помахать ручкой на прощание.
www.opennet.ru
Хостинг свободных проектов Fosshost прекращает работу из-за недоступности директора
Участники проекта Fosshost, безвозмездно предоставляющего виртуальные серверы для свободных проектов, объявили о невозможности дальнейшего предоставления услуг и ожидании скорого отключения серверов компании. Проблемы в Fosshost вызваны тем, что Томас Марки…
👍4😁4🤡3😢1
commit -m "better"
https://www.opennet.ru/opennews/art.shtml?num=58249 Пишут, что нового кода в Android на Rust становится больше, а на С(и, в меньшей степени, на С++) - меньше. Это, конечно, очень хорошо. Думаю, вы уже знаете мою точку зрения, что, с точки зрения безопасности…
Вытащу из комментариев.
https://crates.io/crates/fake-static
Баг в компиляторе Rust(висит с 15 года), позволяющий, без применения unsafe, произвольно менять lifetime.
Рекомендуется не использовать в проде! В целом, я всем тоже советую не использовать SEGFAULT в проде, да.
https://crates.io/crates/fake-static
Баг в компиляторе Rust(висит с 15 года), позволяющий, без применения unsafe, произвольно менять lifetime.
Рекомендуется не использовать в проде! В целом, я всем тоже советую не использовать SEGFAULT в проде, да.
👍9😁7🤡5
https://daniel.haxx.se/blog/2022/12/06/faster-base64-in-curl/
Тут вот автор curl решил похвастаться, как он ускорил свою же реализацию base64, в xy раз(даже не процентов!).
С точки зрения perf инженегра, это все, конечно, очень слабо:
* Нужно было не велосипедить, а соревноваться со state of the art, хотя бы https://github.com/lemire/fastbase64, или turbo base64.
* Соревновался он с линейным поиском символа в массиве 64 символов - "const char *p = strchr(base64, *s);"
* Таблицы - это для бенчмарков, в цикле. В реальном коде на современных процессорах лучше обращения к памяти не использовать.
Ну и, в любом случае, нужно было сделать зависимость от быстрой внешней либы для тех, кому надо, и оставить сколь угодно медленный случай для всех остальных, потому что где curl, а где base64.
Тут вот автор curl решил похвастаться, как он ускорил свою же реализацию base64, в xy раз(даже не процентов!).
С точки зрения perf инжене
* Нужно было не велосипедить, а соревноваться со state of the art, хотя бы https://github.com/lemire/fastbase64, или turbo base64.
* Соревновался он с линейным поиском символа в массиве 64 символов - "const char *p = strchr(base64, *s);"
* Таблицы - это для бенчмарков, в цикле. В реальном коде на современных процессорах лучше обращения к памяти не использовать.
Ну и, в любом случае, нужно было сделать зависимость от быстрой внешней либы для тех, кому надо, и оставить сколь угодно медленный случай для всех остальных, потому что где curl, а где base64.
GitHub
GitHub - lemire/fastbase64: SIMD-accelerated base64 codecs
SIMD-accelerated base64 codecs. Contribute to lemire/fastbase64 development by creating an account on GitHub.
🤡11👍5😁3🍌1
Мы тут с коллегами выясняли, зачем вдруг antlr стал зависеть от abseil.
Раскопали красивое.
https://github.com/antlr/antlr4/pull/3694/commits/41beb8fe3540114943cb4ee93dafcc170f143c61
"[C++] Introduce synchronization and container abstractions"
А вот так выглядит "container abstraction":
Лучшее предположение - что Гугл занес в antlr, чтобы они, зачем-то, начали использовать велосипед от Гугла, вместо общепринятого класса.
Потому что этот леденящий душу пиздец из макросов я не понимаю как еще объяснить.
Раскопали красивое.
https://github.com/antlr/antlr4/pull/3694/commits/41beb8fe3540114943cb4ee93dafcc170f143c61
"[C++] Introduce synchronization and container abstractions"
А вот так выглядит "container abstraction":
#if ANTLR4CPP_USING_ABSEILЯ не шучу.
#include "absl/container/flat_hash_map.h"
#else
#include <unordered_map>
#endif
Лучшее предположение - что Гугл занес в antlr, чтобы они, зачем-то, начали использовать велосипед от Гугла, вместо общепринятого класса.
Потому что этот леденящий душу пиздец из макросов я не понимаю как еще объяснить.
GitHub
[C++] Introduce synchronization and container abstractions by jcking · Pull Request #3694 · antlr/antlr4
In most cases the synchronization and container implementations provided by the C++ standard library are sufficient. However, there are some environments where users may wish to substitute other im...
🤡9😁4🔥3🐳3
commit -m "better"
Слушайте, ну мужик сказал - мужик сделал! #ix_run #dev_shell ... HOSTCC scripts/basic/fixdep HOSTCC scripts/kconfig/mconf.o HOSTCC scripts/kconfig/lxdialog/checklist.o HOSTCC scripts/kconfig/lxdialog/inputbox.o HOSTCC scripts/kconfig/lxdialog/menubox.o…
В контексте разработческих окружений.
https://www.opennet.ru/opennews/art.shtml?num=58269
Вот, еще один коллега хочет оседлать эту (витающую в воздухе) идею, про пакетный менеджер для разработки.
Что у нас тут интересного?
* Автор пытается делать релоцируемые на fs проекты, вместо content based address. "Пакеты размещаются в отдельном каталоге ~/.tea и не привязываются к абсолютным путям (могут быть перемещены)" Это интересно, но прямо реально сложно, и я пока не нашел у него механизмов, отвечающих за то, чтобы это делать "просто".
* Мякотка, описание сборочного скрипта. https://github.com/teaxyz/pantry.core/blob/main/projects/deno.land/package.yml#L22 - вот это выглядит так себе. Я как-то рассказывал, во что я погружал свою сборку. В yaml я ее тоже погружал, это несложно, потому что большинство того, что я использую - это списки и конкатенация списков. Выглядело это примерно так, как в tea, по ссылке. Проблема с inline shell скриптами, они, на мой вкус, что в yaml, что в языке nix, выглядят херово.
* Довольно богатая метаинформация, например, он знает, что deno умеет интерпретировать javascript/typescript - https://github.com/teaxyz/pantry.core/blob/main/projects/deno.land/package.yml#L11 Это интересно, хотя, с ходу, непонятно, что он с этим делает.
https://www.opennet.ru/opennews/art.shtml?num=58269
Вот, еще один коллега хочет оседлать эту (витающую в воздухе) идею, про пакетный менеджер для разработки.
Что у нас тут интересного?
* Автор пытается делать релоцируемые на fs проекты, вместо content based address. "Пакеты размещаются в отдельном каталоге ~/.tea и не привязываются к абсолютным путям (могут быть перемещены)" Это интересно, но прямо реально сложно, и я пока не нашел у него механизмов, отвечающих за то, чтобы это делать "просто".
* Мякотка, описание сборочного скрипта. https://github.com/teaxyz/pantry.core/blob/main/projects/deno.land/package.yml#L22 - вот это выглядит так себе. Я как-то рассказывал, во что я погружал свою сборку. В yaml я ее тоже погружал, это несложно, потому что большинство того, что я использую - это списки и конкатенация списков. Выглядело это примерно так, как в tea, по ссылке. Проблема с inline shell скриптами, они, на мой вкус, что в yaml, что в языке nix, выглядят херово.
* Довольно богатая метаинформация, например, он знает, что deno умеет интерпретировать javascript/typescript - https://github.com/teaxyz/pantry.core/blob/main/projects/deno.land/package.yml#L11 Это интересно, хотя, с ходу, непонятно, что он с этим делает.
www.opennet.ru
Создатель brew развивает новый пакетный менеджер tea
Макс Хауэлл (Max Howell), автор популярной на платформе macOS системы управления пакетами brew (Homebrew), развивает новый пакетный менеджер Tea, позиционируемый как продолжение развития brew, выходящее за рамки пакетного менеджера и предлагающее унифицированную…
👍3🔥1🤯1
https://www.phoronix.com/news/Linux-6.2-funsigned-char
Интересная (узким специалистам) новость, ядро Linux переходит на сборку с char == unsigned char по умолчанию.
Есть три возможных состояния:
* Везде signed
* Везде unsigned
* На разных платформах по разному
Самое гадкое - третье, потому что код имеет тенденцию разрабатываться на узком числе основных платформ, и под них и заточен. Поэтому при сборке и запуске на "других" платформах возможны артефакты**.
Наша монорепа фиксирует везде signed char, это nop на x86_64, и смена дефолта для linux-aarch64 (сюрприз, сюрприз, но там char unsigned по умолчанию).
В целом, я считаю, что unsigned по умолчанию лучше, просто потому что unsigned - это понятный тип, а signed - непонятное нечто. В нашей вселенной не бывает отрицательных чисел так-то! Но, если ты не контролируешь всю кодовую базу(например, тащишь код извне в contrib/), то unsigned char весьма сложно, если вообще не невозможно, пофорсить.
Пожелаем удачи ядру Линуса, особенно вспоминая его способ бороться с багами - https://en.wikipedia.org/wiki/Linus%27s_law
(TL;DR - падать и коркаться будет на наших компах)
Ну и, конечно, с заголовками, которые потребляет userspace, придется быть аккуратнее.
**: про один такой забавный случай - в следующей серии!
Интересная (узким специалистам) новость, ядро Linux переходит на сборку с char == unsigned char по умолчанию.
Есть три возможных состояния:
* Везде signed
* Везде unsigned
* На разных платформах по разному
Самое гадкое - третье, потому что код имеет тенденцию разрабатываться на узком числе основных платформ, и под них и заточен. Поэтому при сборке и запуске на "других" платформах возможны артефакты**.
Наша монорепа фиксирует везде signed char, это nop на x86_64, и смена дефолта для linux-aarch64 (сюрприз, сюрприз, но там char unsigned по умолчанию).
В целом, я считаю, что unsigned по умолчанию лучше, просто потому что unsigned - это понятный тип, а signed - непонятное нечто. В нашей вселенной не бывает отрицательных чисел так-то! Но, если ты не контролируешь всю кодовую базу(например, тащишь код извне в contrib/), то unsigned char весьма сложно, если вообще не невозможно, пофорсить.
Пожелаем удачи ядру Линуса, особенно вспоминая его способ бороться с багами - https://en.wikipedia.org/wiki/Linus%27s_law
(TL;DR - падать и коркаться будет на наших компах)
Ну и, конечно, с заголовками, которые потребляет userspace, придется быть аккуратнее.
**: про один такой забавный случай - в следующей серии!
Phoronix
Linux 6.2 Looks To Enable "-funsigned-char" To Better Deal With Buggy Code
Among the early pull requests sent out already ahead of the Linux 6.2 merge window opening next week is a change to enable '-funsigned-char' by default for Linux kernel builds
👍8😁5🔥3
Forwarded from ИА Панорама
«Спасибо, мы вам перезвоним»: Алексею Кудрину отказали в должности советника «Яндекса» после провала алгоритмической части интервью
Текст: Руслан Алиев
Текст: Руслан Алиев
ИА Панорама
«Спасибо, мы вам перезвоним»: Алексею Кудрину отказали в должности советника «Яндекса» после провала алгоритмической части интервью
Должность остаётся вакантной.
🤣28🔥22👍5🤡1
ИА Панорама
«Спасибо, мы вам перезвоним»: Алексею Кудрину отказали в должности советника «Яндекса» после провала алгоритмической части интервью Текст: Руслан Алиев
Пост для комментариев (а вдруг). В первый раз вижу такой интересный пост, который имеет ссылку на комментарии в оригинальном канале.
Продолжаю писать и улучшать документацию.
https://github.com/pg83/ix/blob/main/docs/KERNEL.md
Вот, буквы про сборку ядра. Пока на русском, лучше, чем ничего! Кстати, проект (с радостью!) примет помощь в переводе текстов!
https://github.com/pg83/ix/blob/main/docs/KERNEL.md
Вот, буквы про сборку ядра. Пока на русском, лучше, чем ничего! Кстати, проект (с радостью!) примет помощь в переводе текстов!
👍3😐3🔥2
Forwarded from Метаверсище и ИИще (Sergey Tsyptsyn ️️)
Ну, за эйчаров. И всех, кто пытается давать тесты соискателям.
Реальный кейс из коментов.
Обратите внимание, речь не идет о маркетологах или коучах.
Речь идет о программистах.
"Я прогнал его через тест, который мы обычно выдаем собеседуемым. Там ничего военного, обычная задачка на понимание принципов ООП и Питона.
Эта сволочь написала его почти идеально. Причем не так, как это бы сделал джуниор, а с пониманием тонкостей и очень компактно. Я сам, когда придумал этот тест и прошел его, был более многословен.
Была там и пара моментов, к которым можно было придраться, но эта сволочь исправила их после первой же моей просьбы, причем я сформулировал претензии только общими словами. В общем, такого кандидата я бы взял на работу не задумываясь. Что наводит на размышления. Скорее всего, придется придумывать другие тесты"
Спасибо, Саша.
Реальный кейс из коментов.
Обратите внимание, речь не идет о маркетологах или коучах.
Речь идет о программистах.
"Я прогнал его через тест, который мы обычно выдаем собеседуемым. Там ничего военного, обычная задачка на понимание принципов ООП и Питона.
Эта сволочь написала его почти идеально. Причем не так, как это бы сделал джуниор, а с пониманием тонкостей и очень компактно. Я сам, когда придумал этот тест и прошел его, был более многословен.
Была там и пара моментов, к которым можно было придраться, но эта сволочь исправила их после первой же моей просьбы, причем я сформулировал претензии только общими словами. В общем, такого кандидата я бы взял на работу не задумываясь. Что наводит на размышления. Скорее всего, придется придумывать другие тесты"
Спасибо, Саша.
👍7😁5😱4🤯1🤬1
commit -m "better"
https://www.phoronix.com/news/Linux-6.2-funsigned-char Интересная (узким специалистам) новость, ядро Linux переходит на сборку с char == unsigned char по умолчанию. Есть три возможных состояния: * Везде signed * Везде unsigned * На разных платформах по…
Обещанное про signed char vs. char vs. unsigned char
Есть такая программа - ragel. Она довольно известна узкому кругу коллег, используется для компиляции регулярок в state machine для целевого языка.
И есть в ней такой файлик - https://github.com/mikkelee/ragel/blob/ragel-6/ragel/common.cpp#L28, а в нем - перечисление всех целочисленных типов на машине, с диапазонами их значений.
Причем, что важно, char идет раньше unsigned char!
Я не буду давать ссылку на место конкретного использования, но оно используется так:
* Строим конечный автомат.
* Находим в этой табличке тип, который вместит весь наш state, и используем этот тип в кодогенерации.
linux-aarch64 - char == unsigned char, на linux-x86_64 char == signed char. char в этой табличке стоит раньше всех.
Поэтому ragel, скомпилированный для host == aarch64, берет в качестве базового типа char, а на x86_64 - unsigned char!
Таким образом, сгенерированный файл зависит не от target системы, а от host системы, для которой был скомпилирован ragel.
От этого ломается воспроизводимость, и лезут всякие subtle баги и предупреждения компилятора.
А, ну и еще, автор ragel сошел с ума, и для разработки седьмого рагеля запилил свой язык программирования - http://www.colm.net/open-source/colm/!
Я, к сожалению, не настолько заинтересован в седьмом рагеле, чтобы заниматься бутстрапом этого говна, потому что, в лучших традициях, colm использует ragel для токенизации, а как еще?
Есть такая программа - ragel. Она довольно известна узкому кругу коллег, используется для компиляции регулярок в state machine для целевого языка.
И есть в ней такой файлик - https://github.com/mikkelee/ragel/blob/ragel-6/ragel/common.cpp#L28, а в нем - перечисление всех целочисленных типов на машине, с диапазонами их значений.
Причем, что важно, char идет раньше unsigned char!
Я не буду давать ссылку на место конкретного использования, но оно используется так:
* Строим конечный автомат.
* Находим в этой табличке тип, который вместит весь наш state, и используем этот тип в кодогенерации.
linux-aarch64 - char == unsigned char, на linux-x86_64 char == signed char. char в этой табличке стоит раньше всех.
Поэтому ragel, скомпилированный для host == aarch64, берет в качестве базового типа char, а на x86_64 - unsigned char!
Таким образом, сгенерированный файл зависит не от target системы, а от host системы, для которой был скомпилирован ragel.
От этого ломается воспроизводимость, и лезут всякие subtle баги и предупреждения компилятора.
А, ну и еще, автор ragel сошел с ума, и для разработки седьмого рагеля запилил свой язык программирования - http://www.colm.net/open-source/colm/!
Я, к сожалению, не настолько заинтересован в седьмом рагеле, чтобы заниматься бутстрапом этого говна, потому что, в лучших традициях, colm использует ragel для токенизации, а как еще?
GitHub
ragel/ragel/common.cpp at ragel-6 · mikkelee/ragel
Ragel State Machine Compiler – unofficial mirror; official version at http://www.colm.net/open-source/ragel/ see also http://www.colm.net/ragel-now-maintained-by-colm-networks/ - mikkelee/ragel
😁9👍6🐳4🥴1