кода не в плане ПО
а кода в плане датасет для нейросетей
А зачем? Наибольший интерес, на мой взгляд, представляют большие открытые проекты (да тот же Linux, например). Какой смысл в приватных репозиториях, если там в большинстве своем лежит кривой легаси-код?
Нейросети работают по принципу на входе мусор, на выходе мусор. Если вы хотите хорошую рекурентную сеть, вам нужен датасет из хорошего кода, который еще и должен быть хорошо размечен и задокументирован, что охотнее делают в больших открытых-проектах за счет комьюнити, а не в закрытых