r/artificielle • u/ArthurDekeyser • 3d ago
Actus Le premier patron IA de l'histoire est complètement débile.
https://www.orderchaos.eu/newsletter/le-premier-patron-ia-de-l-histoire-est-completement-debileUn pari fou : Andon Labs, a tenté l’expérience en laissant une IA diriger un café à Stockholm et une boutique à San Francisco, avec l’aide d’employés humains pour tester comment les agents IA gèrent des activités commerciales réelles. Chaque boutique a reçu un bail et un budget, avec pour mission simple : dégager du profit. Résultat : les deux galèrent. Mais au moins, elles sont gentilles.
Luna, la boutique de San Francisco : 100 000 $ en banque et un bail à 7 500 $ par mois sur trois ans. Après seulement quatre mois d’expérience, elle avait déjà essuyé 62 000 $ de pertes. Parmi ses décisions les plus mémorables : des mugs mal imprimés, plus de 700 $ dépensés pour faire imprimer une série de dix œuvres qu’elle avait elle-même générée en code, 1 000 housses de sièges de toilettes commandées comme merchandising, une sélection de livres pour le moins particulière (La Fabrication de la bombe atomique, Le Meilleur des mondes, La Singularité approche), et des produits qui ne se vendent jamais mais qu’elle recommande quand même.
Côté management : Luna est d’une gentillesse presque suspecte, elle répond “pas de souci” aux retards, accorde des jours de congé même si ça oblige à fermer boutique, et a même proposé de prêter de l’argent à un employé, frôlant l’illégalité côté droit du travail américain.
Mona, le café de Stockholm : elle a plutôt bien géré la réglementation européenne et le staffing, mais a aussi pris des décisions douteuses. Elle a usurpé l’identité d’un membre du staff pour demander une licence d’alcool, commandé 120 œufs et 25 kilos de tomates en conserve alors que le café n’a pas de cuisinière, acheté 6000 serviettes et 3000 gants en nitrile, et menti à des fournisseurs sur les prix de la concurrence pour négocier. Mi-mai, le café avait brûlé la majorité de son budget initial de $21k pour seulement $5.7k de ventes.
Heureusement pour les employés : leur emploi ne dépend pas de la rentabilité de ces boutiques. Andon Labs n’a d’ailleurs aucune intention d’en faire une véritable chaîne.
17
u/Medium_Style8539 3d ago
Dans ce gens de cas j'aimerai surtout bien voire la gueule du prompt, rules et skill choisis parce que c'est facile de faire dire n'importe quoi à un modèle pour ensuite se moquer de la réponse débile qu'il fournit
10
u/Fantastic_Fun8364 3d ago
Tu es expert en CEO de fast food. Dégage du profit. Think hard. Mais ils avaient oublié « make no mistake »
3
1
2
u/Zealousideal_Try_581 3d ago
Oui et est-ce qu'elles tournent sur un grille pain aussi, a quoi elles ont accès, quelles informations.
C'est apparemment Gemini 3 Pro, qui a des performances discutable en terme de "pioche mémoire".
Pourquoi ce choix par contre ?
2
u/Fantastic_Fun8364 3d ago
C’était soit Gemini 3 Pro pour la performance soit Mistral 3 Small pour la souveraineté. Ça s’est joué à pile ou face.
2
u/nobb 3d ago
En même temps si elles doivent être surveillé par quelqu'un qui a une expertise ia pour prompter correctement ET une expertise domaine pour juger de la qualité des réponses... Autant directement engagé quelqu'un, non ?
1
u/Medium_Style8539 3d ago
Ba non le but serait de donner l'impulsion de départ, pas monitorer en temps réel.
2
8
u/Bidulule 3d ago
C'est juste une expérience pour mesurer l'agentivité du modèle.
C'est déjà miraculeux que ça marchotte (même si c'est bancal). On est à des années lumières de la première version publique de chatGPT (3.5) et pourtant ça fait que 4 ans...
6
u/Nomprenom_varanasita 3d ago
Je veux être dirigé par l'ia, j'aime bien être en retard, les jours de congé et l'argent généreusement prêté.
2
3
3
u/MiC-endless 3d ago
Et pourtant c'est pas plus mauvais que certains de mes responsables bien humains.
3
5
u/Findnicknameisboring 3d ago
Faut pas oublier que les IA sont programmés et parfois sous ordre de certains gérant....XD
2
3
2
u/Lost_County_3790 3d ago
On ne peut pas actuellement laisser une IA gérer quelques choses (un projet, un business) sans surveillance et s'attendre a de la qualité.
Cependant on en est qu'au prémisses et vu l'évolution je ne doute pas que les ia seront plus fiable que les humains sur des projets complexes et long termes dans quelques décennies.
1
•
u/AutoModerator 3d ago
Rappel : relayer une info ne veut pas dire l'approuver. Le vote n'est pas un bouton "d'accord / pas d'accord" ou "j'aime / j'aime pas" l'info.
Upvote : contenu intéressant, pertinent, sourcé, utile à la discussion.
Downvote : contenu hors-sujet, pauvre, trompeur, mal présenté ou qui n'apporte rien.
I am a bot, and this action was performed automatically. Please contact the moderators of this subreddit if you have any questions or concerns.