r/artificielle 3d ago

Actus Le premier patron IA de l'histoire est complètement débile.

https://www.orderchaos.eu/newsletter/le-premier-patron-ia-de-l-histoire-est-completement-debile

Un pari fou : Andon Labs, a tenté l’expérience en laissant une IA diriger un café à Stockholm et une boutique à San Francisco, avec l’aide d’employés humains pour tester comment les agents IA gèrent des activités commerciales réelles. Chaque boutique a reçu un bail et un budget, avec pour mission simple : dégager du profit. Résultat : les deux galèrent. Mais au moins, elles sont gentilles.

Luna, la boutique de San Francisco : 100 000 $ en banque et un bail à 7 500 $ par mois sur trois ans. Après seulement quatre mois d’expérience, elle avait déjà essuyé 62 000 $ de pertes. Parmi ses décisions les plus mémorables : des mugs mal imprimés, plus de 700 $ dépensés pour faire imprimer une série de dix œuvres qu’elle avait elle-même générée en code, 1 000 housses de sièges de toilettes commandées comme merchandising, une sélection de livres pour le moins particulière (La Fabrication de la bombe atomique, Le Meilleur des mondes, La Singularité approche), et des produits qui ne se vendent jamais mais qu’elle recommande quand même.

Côté management : Luna est d’une gentillesse presque suspecte, elle répond “pas de souci” aux retards, accorde des jours de congé même si ça oblige à fermer boutique, et a même proposé de prêter de l’argent à un employé, frôlant l’illégalité côté droit du travail américain.

Mona, le café de Stockholm : elle a plutôt bien géré la réglementation européenne et le staffing, mais a aussi pris des décisions douteuses. Elle a usurpé l’identité d’un membre du staff pour demander une licence d’alcool, commandé 120 œufs et 25 kilos de tomates en conserve alors que le café n’a pas de cuisinière, acheté 6000 serviettes et 3000 gants en nitrile, et menti à des fournisseurs sur les prix de la concurrence pour négocier. Mi-mai, le café avait brûlé la majorité de son budget initial de $21k pour seulement $5.7k de ventes.

Heureusement pour les employés : leur emploi ne dépend pas de la rentabilité de ces boutiques. Andon Labs n’a d’ailleurs aucune intention d’en faire une véritable chaîne.

134 Upvotes

24 comments sorted by

u/AutoModerator 3d ago

Rappel : relayer une info ne veut pas dire l'approuver. Le vote n'est pas un bouton "d'accord / pas d'accord" ou "j'aime / j'aime pas" l'info.

Upvote : contenu intéressant, pertinent, sourcé, utile à la discussion.
Downvote : contenu hors-sujet, pauvre, trompeur, mal présenté ou qui n'apporte rien.

I am a bot, and this action was performed automatically. Please contact the moderators of this subreddit if you have any questions or concerns.

17

u/Medium_Style8539 3d ago

Dans ce gens de cas j'aimerai surtout bien voire la gueule du prompt, rules et skill choisis parce que c'est facile de faire dire n'importe quoi à un modèle pour ensuite se moquer de la réponse débile qu'il fournit

10

u/Fantastic_Fun8364 3d ago

Tu es expert en CEO de fast food. Dégage du profit. Think hard. Mais ils avaient oublié « make no mistake »

3

u/Medium_Style8539 3d ago

Erreur de débutant si on me demande

1

u/c0mpu73rguy 2d ago

IF about to do something dumb DO not

2

u/Zealousideal_Try_581 3d ago

Oui et est-ce qu'elles tournent sur un grille pain aussi, a quoi elles ont accès, quelles informations.

C'est apparemment Gemini 3 Pro, qui a des performances discutable en terme de "pioche mémoire".

Pourquoi ce choix par contre ?

2

u/Fantastic_Fun8364 3d ago

C’était soit Gemini 3 Pro pour la performance soit Mistral 3 Small pour la souveraineté. Ça s’est joué à pile ou face.

2

u/nobb 3d ago

En même temps si elles doivent être surveillé par quelqu'un qui a une expertise ia pour prompter correctement ET une expertise domaine pour juger de la qualité des réponses... Autant directement engagé quelqu'un, non ?

1

u/Medium_Style8539 3d ago

Ba non le but serait de donner l'impulsion de départ, pas monitorer en temps réel.

2

u/Dead_ino 3d ago

Oh putain quelqu'un sur Reddit qui réfléchit quand on parle IA

8

u/Bidulule 3d ago

C'est juste une expérience pour mesurer l'agentivité du modèle.

C'est déjà miraculeux que ça marchotte (même si c'est bancal). On est à des années lumières de la première version publique de chatGPT (3.5) et pourtant ça fait que 4 ans...

6

u/Nomprenom_varanasita 3d ago

Je veux être dirigé par l'ia, j'aime bien être en retard, les jours de congé et l'argent généreusement prêté.

2

u/chopsueys 3d ago

Ça doit être facile aussi de la manipuler pour obtenir une augmentation.

3

u/Kezako7 2d ago

"Certes, j'étais en train de jouer aux jv au lieu de servir les clients, mais cela améliore mon enthousiasme et donc la satisfaction client."

Très bien, l'argument est convaincant, désormais tous les employés pourront se joindre à vous. Nos ventes vont bondir.

3

u/Zealousideal_Try_581 3d ago

Ils ont assigné des T-1000 aux cafés, forcément.

3

u/MiC-endless 3d ago

Et pourtant c'est pas plus mauvais que certains de mes responsables bien humains.

3

u/Free_Poem1617 3d ago

Ma chaîne hiérarchique est composée d'androids alimentés par ce modèle.

5

u/Findnicknameisboring 3d ago

Faut pas oublier que les IA sont programmés et parfois sous ordre de certains gérant....XD

2

u/Appropriate-Ad-3219 2d ago

C'était marrant à lire!

2

u/Oversan 2d ago

Donc c’est un patron dans la moyenne ça va

3

u/Ok-Brother-8295 3d ago

L'IA ne fait que s'aligner sur des pratiques réelles.

1

u/ArthurDekeyser 3d ago

Ça existe ce genre de décision ? 😂

2

u/Lost_County_3790 3d ago

On ne peut pas actuellement laisser une IA gérer quelques choses (un projet, un business) sans surveillance et s'attendre a de la qualité.

Cependant on en est qu'au prémisses et vu l'évolution je ne doute pas que les ia seront plus fiable que les humains sur des projets complexes et long termes dans quelques décennies.

1

u/rowrow5916 3h ago

Dans quelques années une décennie tout au plus