Le souci c’est que Mistral n’est pas vraiment le plus doué de la famille.

  • Professeur Falken@jlai.luM
    link
    fedilink
    Français
    arrow-up
    8
    ·
    1 个月前

    Vrai titre :
    La direction générale du Trésor français obligée de débrancher le modèle d’IA chinois Qwen à cause de “réponses orientées” ou “biaisées”

  • Left as Center@jlai.luM
    link
    fedilink
    Français
    arrow-up
    2
    ·
    1 个月前

    1300 agents ont pu tester Qwen d’Alibaba

    L’expérimentation concernait une petite centaine d’agents sur les 1300 que compte la Direction générale du Trésor

    Tout l’article a des trucs comme ça. C’est dur a lire, pas clair.

    Mieux:

    https://www.lemonde.fr/pixels/article/2026/06/25/ia-le-test-d-un-modele-chinois-a-la-direction-generale-du-tresor-interrompu-a-cause-de-reponses-orientees-ou-biaisees_6715445_4408996.html

  • Ziggurat@jlai.lu
    link
    fedilink
    Français
    arrow-up
    1
    ·
    1 个月前

    Il y a des modèles pas biaisés ?

    Et il y a des usages sérieux de ces modèles ? C’est super pour jouer, mais ça reste pas terrible pour du taf sérieux non ?

    • Left as Center@jlai.luM
      link
      fedilink
      Français
      arrow-up
      1
      ·
      1 个月前

      Il y a des modèles pas biaisés ?

      Non. Mais certains moins que d’autre, et ça dépend de sujets. Les modèles chinois ont un trou autour des défaut chinois. Grok a un trou au niveau du mechahitler. Voilà voilà.

      Et il y a des usages sérieux de ces modèles ?

      Oui. Principalement du taf d’archiviste / recherche documentaire. Pré-qualification de dossiers aussi (genre au lieu de faire 2-3 pré études, tu peux en gérer 10) sur des sujets figés.

      C’est super pour jouer, mais ça reste pas terrible pour du taf sérieux non ?

      les modèles standards servent bien de brouillon, ou de chercheur d’aiguille dans une botte de foin. Faut toujours tout reverifier.

    • tnn (FX)@jlai.luOP
      link
      fedilink
      Français
      arrow-up
      1
      ·
      1 个月前

      Le problème c’est rarement les outils c’est la manière qu’on les gens de les utiliser.

    • Left as Center@jlai.luM
      link
      fedilink
      Français
      arrow-up
      1
      ·
      1 个月前

      Non, c’est un des gros qwen. Avec un focus sur des modèles plus efficaces par rapport a la concurrence.

    • tnn (FX)@jlai.luOP
      link
      fedilink
      Français
      arrow-up
      1
      ·
      1 个月前

      Mistral c’est le fleuron français de l’IA. donc c’est une bonne nouvelle pour la souveraineté que l’administration arrête de faire appel à des pays étrangers pour traiter ses données. Par contre, je l’appelle l’éjaculateur précoce, car il répond très vite et il est persuadé que sa première réponse est toujours la meilleure, du coup il fonce jusqu’à t’envoyer dans le mur.

  • one_old_coder@piefed.social
    link
    fedilink
    Français
    arrow-up
    0
    ·
    1 个月前

    Le souci c’est que Mistral n’est pas vraiment le plus doué de la famille.

    C’est mieux que rien il me semble. Et ils ne sont pas si à la ramasse que ça pour l’avoir essayé (j’ai honte oui).

    • tnn (FX)@jlai.luOP
      link
      fedilink
      Français
      arrow-up
      1
      ·
      1 个月前

      ca fait plusieurs fois que j’essaie, et j’ai l’impression que c’est même de pire en pire. ils ont beau rajouter des services et copier anthropic sur le design, je trouve qu’il y a un vrai problème de pertinence sur Mistral et parfois de compréhension qui le place avant les éditeurs américains et les modèles open source chinois. Après si c’est juste pour brosser un tableau rapide d’un sujet oui ca va. mais pour bosser avec, l’exigence n’est pas la même.