Quand j’étais à la fac les profs qui nous apprenait ces équations nous disaient qu’on était loin d’avoir une démonstration formelle (et ils s’en fichait pas mal, j’étais en filière technique). Et voilà où on en est aujourd’hui, c’est beau !

  • Bad
    link
    fedilink
    Français
    arrow-up
    6
    ·
    27 days ago

    Il y a un sujet de plagiat et de timing qui fait parler en ce moment aussi :

    Shortly before the announcement, Tristan Buckmaster (a New York University professor) and Levent Alpöge (a researcher at Anthropic) had reported advances in Euler equations, a related field.[4] A priority dispute started immediately.[14] Buckmaster said that OpenAI adopted their research methods to solve the problem and attempted to exclude Alpöge from a joint publication proposal. OpenAI denied this and stated that its model had independently solved the Euler problem with different methods.[13][4]

    Si OpenAI s’est nourri des éléments de recherche de Buckmaster (et Alpöge) sans leur consentement, ça peut complexifier la question de qui sera crédité pour la découverte et qui aura l’argent, et peut-être devenir la source d’une dispute judiciaire plus lourde.

    Affaire a suivre (déjà il faudrait que la preuve soit vérifiée dans un premier temps).

    • PatteBlancheOP
      link
      fedilink
      Français
      arrow-up
      4
      ·
      27 days ago

      Ils en parle dans l’article : OpenAI s’est empressé de dire (grands seigneurs) qu’ils renonçaient à l’argent.

    • keepthepace@tarte.nuage-libre.fr
      link
      fedilink
      Français
      arrow-up
      1
      ·
      26 days ago

      S’il fonctionne comme Claude, il y a une préférence (opt-out de mémoire?) pour le consentement. S’ils sont aux US, c’est légal.

      Je serais très surpris qu’OpenAI n’enregistre pas toutes les conversations, mais je pense que ce serait un risque un petit peu absurde de faire de l’entraînement sur celles où ils n’ont pas reçu le consentement, justement à cause de ce genre de trucs. Après, ce ne serait pas la première chose absurde et non éthique qu’OpenAI ait fait pour un coup de pub. Altman est probablement en mode après moi le déluge, il s’intéresse uniquement à son IPO. Pas impossible qu’il n’ait rien à foutre d’un jugement qui sera rendu deux ans après l’entrée en bourse.

      Ce qui est tout à fait possible aussi par contre, c’est que à la fois ce chercheur et OpenAI partent dans la même direction de façon indépendante. Tant qu’on n’aura pas d’obligation de publier les datasets d’entraînement, on aura ce genre de polémiques.

      Il y a beaucoup de propositions d’encadrement et de régulation qui n’ont pas trop de sens. Mais sur les datasets, ça permettrait de remettre à plat certaines choses comme le droit du copyright, comme le plagiat et le benchmarking.

      Le problème, c’est que leur sauce secrète est a priori pas mal dans le dataset de post-training. Mais on pourrait imaginer un mécanisme dans lequel ils montrent toutes les données sur lesquelles ils se sont entraînés et où ils ont le droit de publier un dataset plus gros que ce qu’ils ont effectivement utilisé afin de cacher leurs secrets commerciaux, mais qu’on puisse constater ce que le modèle a reçu en entrée.