C’est Le pas de pasune newsletter hebdomadaire décomposant une histoire essentielle du monde de la technologie. Pour en savoir plus sur tout ce qui concerne l’IA, Suivez Hayden Field. Le Stepback arrive dans les boîtes de réception de nos abonnés à 8h du matin HE. Opter pour Le pas de pas ici.
Tout a commencé avec Jarvis Oui, que Jarvis de The Marvel Films.
Eh bien, peut-être que ce n’est pas commencer Avec l’assistant d’Iron Man d’Iron Man, mais le système fictif a définitivement aidé le concept d’un agent d’IA. Chaque fois que j’ai interviewé les gens de l’industrie de l’IA sur l’IA d’agence, ils indiquent souvent Jarvis comme exemple de l’outil d’IA idéal à bien des égards – celui qui sait ce que vous avez besoin avant de demander, peut analyser et trouver des idées dans de grandes bandes de données, et peut offrir des conseils stratégiques ou un point d’exécution sur certains aspects de votre entreprise. Les gens sont parfois en désaccord sur la définition exacte d’un agent d’IA, mais à la base, c’est un pas au-delà des chatbots en ce que c’est un système qui peut effectuer des tâches complexes en plusieurs étapes en votre nom sans avoir constamment besoin d’une communication va-et-vient avec vous. Il fait essentiellement sa propre liste de sous-tâches qu’il doit compléter afin d’atteindre votre objectif final préféré. Ce fantasme est plus proche d’être une réalité à bien des égards, mais en ce qui concerne l’utilité réelle pour l’utilisateur de tous les jours, il y a beaucoup de choses qui ne fonctionnent pas – et ne fonctionneront peut-être jamais.
Le terme «agent d’IA» existe depuis longtemps, mais il en particulier a commencé à tendance dans l’industrie technologique en 2023. C’était l’année de la concept des agents de l’IA; Le terme était sur les lèvres de chacun alors que les gens essayaient de surmonter l’idée et comment en faire une réalité, mais vous n’avez pas vu beaucoup de cas d’utilisation réussie. L’année suivante, 2024, était l’année de déploiement – Les gens mettaient vraiment le code sur le terrain et voyaient ce qu’il pouvait faire. (La réponse, à l’époque, n’était pas beaucoup. Et remplie d’un tas de messages d’erreur.)
Je peux identifier le battage médiatique autour des agents de l’IA se répandant sur une annonce spécifique: en février 2024, Klarna, une société fintech, a déclaré qu’après un mois, son assistant AI (alimenté par la technologie d’Openai) avait réussi les travaux de 700 agents du service client à temps plein et automatisé les deux tiers des discussions sur le service client de l’entreprise. Pendant des mois, ces statistiques sont apparues dans presque toutes les conversations de l’industrie de l’IA que j’avais eues.
Le battage médiatique ne s’est jamais éteint et dans les mois suivants, chaque PDG de Big Tech a semblé harceler à la durée de chaque appel de résultats. Les dirigeants d’Amazon, Meta, Google, Microsoft et une multitude d’autres sociétés ont commencé à parler de leur engagement à créer des agents d’IA utiles et réussis – et ont essayé de mettre leur argent là où leur bouche est pour y arriver.
La vision était qu’un jour, un agent d’IA pouvait tout faire, de réserver votre voyage pour générer des visuels pour vos présentations commerciales. L’outil idéal pourrait même, par exemple, trouver un bon moment et un bon endroit pour passer du temps avec un tas de vos amis qui travaillent avec tous vos calendriers, préférences alimentaires et restrictions alimentaires – puis réservez la réservation du dîner et créez un événement de calendrier pour tout le monde.
Parlons maintenant du «codage de l’IA» de tout cela: pendant des années, le codage de l’IA a été transport L’industrie de l’IA agentique. Si vous avez demandé à quelqu’un sur les cas d’utilisation réels, réussis et non annulants pour les agents de l’IA tout de suite Et pas conceptuellement dans un avenir pas trop lointain, ils indiquent le codage de l’IA – et c’était à peu près la seule chose concrète qu’ils pouvaient indiquer. De nombreux ingénieurs utilisent des agents d’IA pour le codage, et ils sont considérés comme objectivement assez bons. En fait, en fait, qu’à Microsoft et Google, jusqu’à 30% du code est maintenant écrit par des agents de l’IA. Et pour les startups comme Openai et Anthropic, qui brûlent en espèces à des taux élevés, l’un de leurs plus grands générateurs de revenus est les outils de codage de l’IA pour les clients d’entreprise.
Donc, jusqu’à récemment, le codage de l’IA a été le principal cas d’utilisation réel des agents de l’IA, mais évidemment, cela ne se pose pas pour le consommateur de tous les jours. La vision, rappelez-vous, a toujours été une sorte d’agent d’IA pour le «Everyman». Et nous ne sommes pas encore tout à fait là – mais en 2025, nous nous sommes rapprochés que nous ne l’avons jamais été auparavant.
En octobre dernier, Anthropic a lancé les choses en introduisant «l’utilisation de l’ordinateur», un outil qui a permis à Claude d’utiliser un ordinateur comme une puissance humaine – naviguer, rechercher, accéder à différentes plates-formes et accomplir des tâches complexes au nom d’un utilisateur. Le consensus général était que l’outil était un pas en avant pour la technologie, mais les avis ont déclaré que dans la pratique, il laissait beaucoup à désirer. Avance rapide jusqu’en janvier 2025, et Openai a publié l’opérateur, sa version de la même chose, et l’a facturé comme un outil pour remplir les formulaires, commander des produits d’épicerie, réserver des voyages et créer des mèmes. Encore une fois, en pratique, de nombreux utilisateurs ont convenu que l’outil était buggy, lent et pas toujours efficace. Mais encore une fois, ce fut une étape importante. Le mois suivant, OpenAI a publié Deep Research, un outil d’IA agentique qui pourrait compiler de longs rapports de recherche sur n’importe quel sujet pour un utilisateur, et qui a également fait avancer les choses. Certaines personnes ont déclaré que les rapports de recherche étaient plus impressionnants que le contenu, mais d’autres ont été sérieusement impressionnés. Et puis en juillet, OpenAI a combiné la recherche profonde et l’opérateur en un seul produit d’agent AI: l’agent Chatgpt. Était-ce mieux que la plupart des outils d’IA agentiques orientés aux consommateurs qui ont précédé? Absolument. Était-il toujours difficile de faire du travail avec succès dans la pratique? Absolument.
Il y a donc un long chemin à parcourir pour atteindre cette vision d’un agent d’IA idéal, mais en même temps, nous sommes techniquement plus proches que nous n’en avons jamais été auparavant. C’est pourquoi les entreprises technologiques mettent de plus en plus d’argent dans l’IA d’agence, en investissant dans un calcul supplémentaire, une recherche et un développement ou des talents. Google a récemment embauché le PDG de Winsurf, le cofondateur, et certains membres de l’équipe de R&D, en particulier pour aider Google à faire avancer ses projets d’agent d’IA. Et des entreprises comme Anthropic et Openai se précipitent les unes les autres sur l’échelle, l’échelle de l’échelle, pour introduire des fonctionnalités incrémentielles pour mettre ces agents entre les mains des consommateurs. (Anthropic, par exemple, vient d’annoncer une extension chromée pour Claude qui lui permet de fonctionner dans votre navigateur.)
Donc, ce qui se passe ensuite ensuite, c’est que nous verrons le codage de l’IA continuer à s’améliorer (et, malheureusement, à remplacer potentiellement les travaux de nombreux ingénieurs logiciels d’entrée de gamme). Nous verrons également les produits d’agent orientés vers le consommateur s’améliorer, probablement lentement mais sûrement. Et nous verrons des agents utilisés de plus en plus pour les applications des entreprises et du gouvernement, d’autant plus qu’Anthropic, OpenAI et XAI ont tous fait leurs débuts sur les plateformes d’IA spécifiques au gouvernement ces derniers mois.
Dans l’ensemble, attendez-vous à voir plus de faux départs, de départs et d’arrêts, et les fusions et acquisitions alors que le concours d’agent d’agent AI reprend (et la bulle de battage médiatique continue de ballon). Une question que nous devrons tous nous poser des mois: que voulons-nous réellement qu’un «agent d’IA» conceptuel puisse faire pour nous? Voulons-nous qu’ils ne remplacent que la logistique ou aussi les aspects humains plus personnels de la vie (c’est-à-dire, aidant à écrire un toast de mariage ou une note pour une livraison de fleurs)? Et à quel point sont-ils bons pour aider avec la logistique par rapport aux trucs personnels? (Réponse pour ce dernier: pas très bon pour le moment.)
- Outre le coût environnemental astronomique de l’IA – en particulier pour les grands modèles, qui sont ceux qui alimentent les efforts des agents de l’IA – il y a un éléphant dans la pièce. Et c’est l’idée que «l’IA plus intelligente qui peut faire n’importe quoi pour vous» n’est pas toujours bonne, surtout quand les gens veulent l’utiliser pour faire… de mauvaises choses. Des choses comme la création d’armes chimiques, biologiques, radiologiques et nucléaires (CBRN). Les meilleures sociétés d’IA se disent de plus en plus inquiètes des risques de cela. (Bien sûr, ils ne sont pas assez inquiets pour arrêter de construire.)
- Parlons de la réglementation de tout cela. Beaucoup de gens ont des craintes quant aux implications de l’IA, mais beaucoup ne sont pas pleinement conscients des dangers potentiels posés par des agents de l’IA ultra-stimulants, visant à plaider entre les mains de mauvais acteurs, à la fois aux États-Unis et à l’étranger (pensez: «hacking», escroqueries romanes, et plus). Les sociétés d’IA se disent en avance sur le risque avec les garanties volontaires qu’ils ont mises en œuvre. Mais beaucoup d’autres disent que cela peut être un cas pour une vérification externe de l’intestin.
0 commentairesSuivez les sujets et les auteurs De cette histoire pour voir plus comme ceci dans votre flux de page d’accueil personnalisé et pour recevoir des mises à jour par e-mail.
- Aiclose
IA
Les articles de ce sujet seront ajoutés à votre digestion par e-mail quotidienne et à votre flux de page d’accueil.
Plus de suivi
Voir tous les ai
- En colonne
Colonne
Les articles de ce sujet seront ajoutés à votre digestion par e-mail quotidienne et à votre flux de page d’accueil.
Plus de suivi
Voir toute la colonne
- Techniser
Technologie
Les articles de ce sujet seront ajoutés à votre digestion par e-mail quotidienne et à votre flux de page d’accueil.
Plus de suivi
Voir toutes les technologies
- Le StepbackClose
Le pas de pas
Les articles de ce sujet seront ajoutés à votre digestion par e-mail quotidienne et à votre flux de page d’accueil.
Plus de suivi
Voir tout le pas de pas
À ne pas manquer
