Mots-clés IA
Gratuit
Keywords AI (qui exploite actuellement la marque Respan) est une plateforme LLM pour les équipes d'ingénierie en IA. Il intègre le suivi des liens de production, les indicateurs de surveillance, l'évaluation en ligne/hors ligne, la gestion des versions rapides et la passerelle LLM unifiée dans le même flux de travail. Il convient aux équipes qui doivent gérer les coûts, la qualité et le routage des modèles.
Mots-clés Texte de l'outil IA
Paramètres et statistiques de base
La marque opérationnelle externe actuelle de Keywords AI est Respan. La page officielle de la marque indique que son entité juridique est Keywords AI, Inc., et que la marque et le produit utilisent Respan de manière uniforme ; par conséquent, cette entrée d'outil conserve le nom historique de l'outil Keywords AI et utilise Keywords AI (Respan) dans le texte pour faire référence au produit actuel. Les données structurées du site officiel décrivent le produit comme une plate-forme d'ingénierie d'IA qui unifie l'observabilité LLM, les évaluations, l'optimisation rapide et la passerelle LLM. La page de documentation définit en outre la structure de données de base comme span.
| Projet | Informations publiques actuelles |
|---|---|
| Positionnement du produit | Plateforme d'ingénierie IA pour les produits LLM et Agent |
| Structure des données de base | span, contient les entrées, les sorties, le modèle, les métriques et les métadonnées |
| Flux de travail principal | Tracer et surveiller, évaluer et optimiser, inviter et passer, itérer |
| Couverture de la passerelle | L'annotation des documents officiels prend en charge plus de 250 modèles |
| Écologie de l'intégration | annotation du changelog Aperçu de plus de 95 intégrations |
| SDK et accès | SDK Python, SDK TypeScript, API, ingestion OTLP/JSON, intégration de framework |
| Entreprises et marques | Mots-clés d'entité juridique AI, Inc., marque d'exploitation Respan |
| Informations fondatrices | Listes officielles de données structurées, date de fondation 2024, fondateur Hendrix Liu |
| Entrée du quai | Console Web et API |
Positionnement aux limites : Keywords AI (Respan) n'est pas un simple chatbot ou générateur d'invites, mais place le routage, les journaux, l'évaluation et le déploiement rapide des appels LLM dans le même projet. Il est plus adapté aux équipes qui exécutent déjà du trafic LLM/Agent en production ; les utilisateurs individuels ne disposant que de quelques expériences manuelles rapides ont généralement des difficultés à utiliser immédiatement ses capacités de suivi et d'évaluation.
Reconnaissance des utilisateurs et du marché
Approbation YC : Respan est inclus sur la page de l'entreprise Y Combinator et mutuellement vérifié avec les informations de l'entreprise sur le site officiel et la page de la marque. Pour l'approvisionnement ou l'évaluation technologique, la valeur de ce type de page d'entreprise publique n'est pas de prouver l'efficacité du produit, mais de confirmer l'identité de l'équipe, l'existence de l'entreprise et l'expérience d'un accélérateur externe.
Orientation de l'équipe d'ingénierie : le document officiel indique directement que l'objectif est que les équipes expédient des produits LLM et d'agent, et place les développeurs et les PM dans le même flux de travail. Cela signifie que ses principaux utilisateurs ne sont pas des auteurs individuels de Prompt, mais des équipes d'ingénierie produit qui doivent gérer conjointement les risques liés à la qualité, aux coûts, aux versions et au déploiement.
Signal d'approbation écologique : 2026-03-26 changelog public Aperçu de plus de 95 intégrations, couvrant les cadres d'agents, les SDK LLM, les agents de codage, les bases de données vectorielles et les fournisseurs de modèles. Ce chiffre montre qu'il est passé d'un outil de journalisation unique à une couche d'accès à l'ingénierie de l'IA plus complète, mais le nombre d'entreprises clientes, le nombre de clients payants et l'échelle des revenus n'ont pas été divulgués, et la pénétration commerciale ne peut pas être déduite sur cette base.
Avantage de coût
L’avantage en termes de coût de Keywords AI (Respan) n’est pas le « prix unitaire le plus bas », mais la réduction du transfert de données entre plusieurs ensembles d’outils. Une fois que span transporte simultanément les entrées, les sorties, le modèle, les indicateurs et les métadonnées, la surveillance, l'évaluation de la version d'invite et le routage de la passerelle peuvent réutiliser les mêmes données de production, réduisant ainsi les coûts de maintenance de l'équipe d'ingénierie pour créer des tables séparées pour les journaux, les ensembles d'évaluation, les alarmes et les déploiements.
Côté C/Individuel : la prise en charge de l'affichage du titre et de la description de la page de tarification commence à partir du plan gratuit, mais si les utilisateurs individuels ne disposent pas d'un véritable trafic LLM, d'ensembles de données ou de traces d'agent, ils peuvent principalement rencontrer des invites de console et une petite quantité de journaux d'appels, et la marge bénéficiaire est étroite. Le quota gratuit, les limites spécifiques et la facturation des dépassements sont soumis à la page officielle en temps réel.
Développeurs/API : Gateway prend en charge le routage de plus de 250 modèles via une seule API et fournit des solutions de secours, des tentatives, un équilibrage de charge et une mise en cache. Les coûts de développement proviennent principalement de l'accès au SDK, du remplacement de l'URL de base, de la configuration des métadonnées, de la maintenance des évaluateurs et de la gestion des délais de passerelle supplémentaires ; la documentation indique clairement que la passerelle ajoutera environ 50 à 150 ms de retard et que les liens à latence extrêmement faible doivent être évalués séparément.
Entreprise / Privatisé : les pages Entreprise, Réserver une démo, Support et Conformité indiquent qu'il s'agit d'un achat d'entreprise, mais des détails tels que les termes d'entreprise SSO, audit, conservation des données HIPAA BAA, hébergement régional et d'autres détails nécessitent une confirmation commerciale. Pour les entreprises, les coûts cachés se concentrent généralement sur la gouvernance des données, le modèle de collecte des factures des fournisseurs, l’élaboration de normes d’approbation et d’évaluation en ligne, plutôt que sur les frais d’abonnement à une seule plateforme.
Fonctions principales
- Observabilité LLM : affiche l'arborescence d'exécution de l'agent, l'appel de modèle, les entrées et sorties, le délai, le jeton de coût, le taux d'erreur et d'autres indicateurs via des traces, des étendues, des threads et des scores, ce qui convient au dépannage des fluctuations de qualité et des appels anormaux en production.
- Vues de surveillance et alertes : Description du document : Le tableau de bord peut afficher les requêtes, les jetons, la latence, le coût, les taux d'erreur et prend en charge l'enregistrement des vues et la configuration des moniteurs Slack/E-mail, qui sont utilisés pour convertir le dépannage quotidien de la vérification manuelle des journaux en vues de surveillance souscrites.
- Évaluations en ligne/hors ligne : l'évaluation prend en charge deux modes : le trafic de production en ligne et l'ensemble de tests hors ligne. Le juge LLM, l'inspection du code ou l'examen manuel peuvent être utilisés pour générer des scores, ce qui convient à la comparaison des versions rapides, des modèles et des combinaisons de configuration.
- Gestion des invites : prend en charge les versions de validation de modèles avec
{{variables}}, les tests sur le terrain de jeu et le déploiement de modifications sans code. Il convient pour supprimer Prompt de l'entrepôt de codes et le transmettre aux produits et projets pour une maintenance conjointe. - LLM Gateway : accédez à plusieurs modèles via une seule API et fournissez des sauvegardes automatiques des journaux, des tentatives, un équilibrage de charge et une mise en cache, adaptés au routage multimodèle, au changement de fournisseur et à la gestion des coûts/stabilité.
- Accès au framework et au SDK : le document officiel répertorie l'intégration du SDK OpenAI Agents, Vercel AI, Mastra, LangGraph et d'autres frameworks, et fournit Python, le SDK TypeScript et des chemins d'ingestion manuels, qui conviennent à une intégration progressive à partir du code existant.
Le point commun de ces capacités concerne la « redistribution des données de production ». Si l'équipe compare uniquement plusieurs invites hors ligne, un tableau ou un bloc-notes séparé suffit ; lorsque la version rapide, les performances en ligne, le coût du modèle et les commentaires des utilisateurs doivent être fermés, la valeur de la plate-forme de Keywords AI (Respan) sera plus évidente.
Evolution du modèle et de la version
Keywords AI (Respan) est un produit cloud itératif en continu qui n'a pas le grand nombre de versions sémantiques des logiciels de bureau traditionnels. Le contexte actuel de la version vérifiable provient principalement du journal des modifications officiel et de la page de la marque.
Version principale
- 2026-06-14 / Mises à jour groupées des invites : le dernier nœud public du journal des modifications, de nouvelles mises à jour par lots des invites, la prise en charge de la modification de plusieurs invites en même temps, ainsi que la configuration du modèle et la prise en charge des messages de validation ; tout en améliorant les performances de chargement des données Prompt et Playground.
- 2026-03-26 / Présentation de Respan CLI avec plus de 95 intégrations : présentation de
@respan/cliv0.6.0,respan Integraet lancement d'une présentation de l'intégration couvrant les cadres d'agents, les SDK LLM, les agents de codage, les bases de données vectorielles et les fournisseurs de modèles. - 2026-03-13 / Intégration OpenAI SDK TypeScript : Ajout de l'instrumentation automatique OpenAI SDK TypeScript, couvrant le streaming, les appels d'outils, les sorties multi-tours, structurées et les exemples d'API par lots.
- 2026-03-06 / SDK Python et TypeScript unifiés : La sortie des SDK Python et TypeScript unifiés, ainsi que l'intégration de Pydantic AI, indique que le produit commence à être plus systématiquement orienté vers le suivi du framework d'agent.
Marque et gamme de produits
Relation avec la marque : la page de la marque indique clairement que l'entité juridique est Keywords AI, Inc. et que la marque opérationnelle est Respan. L'affichage externe, les documents, les consoles et le matériel de marque sont tous basés sur Respan ; l'utilisation continue de Keywords AI dans le répertoire d'outils consiste à hériter des noms historiques et des habitudes de recherche des utilisateurs.
Modifications de la gamme de produits : la bannière supérieure du site officiel affiche Présentation de Respan Gateway, et le titre principal de la page d'accueil met l'accent sur l'acheminement, l'observation et l'évaluation de chaque appel LLM, indiquant que le produit est passé du « suivi/évaluation LLM » au flux de travail complet LLMOps de « passerelle + observabilité + évaluation + gestion des invites ».
Avantages techniques
modèle de données unifié span : toutes les interactions LLM sont stockées dans span, y compris les entrées, les sorties, le modèle, les métriques et les métadonnées. L'avantage du mécanisme est que les traces, les threads, les scores, les tableaux de bord, les évaluations et les données d'invite/passerelle peuvent être alignés, réduisant ainsi l'interruption de la « surveillance d'un ensemble d'ID, de l'évaluation d'un ensemble d'ID et des versions d'invite et d'un autre ensemble d'ID » ; il convient aux produits avec de longs flux de travail d'agent et de nombreux appels d'outils.
Évaluations basées sur les données de production : la documentation indique que les ensembles de données peuvent être créés à partir d'intervalles de production ou d'importations CSV, et que les évaluations en ligne peuvent être exécutées sur le trafic de production en direct. De cette manière, l’évaluation ne se limite pas à un ensemble d’échantillons statiques, mais peut intégrer le trafic réel des utilisateurs dans les contrôles de régression ; le coût est que l'équipe doit d'abord définir un évaluateur interprétable et un processus de révision manuel.
Lien de passerelle et d'observation : le trafic de la passerelle sera automatiquement enregistré et renvoyé vers le traçage, et les variables d'invite peuvent également apparaître dans les intervalles. L'effet mécanique est que les actions d'ingénierie de « routage/nouvelle tentative/mise en cache du modèle » peuvent être visualisées avec les résultats d'observation du « coût/délai/qualité de sortie », ce qui convient aux équipes utilisant plusieurs fournisseurs de modèles en parallèle.
Accès multi-entrées : SDK, intégrations de framework, OTLP, API JSON et Gateway coexistent, permettant aux équipes de diviser les chemins d'accès en fonction du risque : pour une faible intrusion, la trace peut être connectée en premier ; la passerelle peut être commutée lorsqu'un routage unifié est requis ; et l'instrumentation correspondante peut être utilisée lorsqu'il existe un cadre d'agent complexe. La limite de cet avantage est la suivante : plus l'accès est profond, plus la responsabilité de gouvernance est élevée, et la spécification des métadonnées et le modèle d'autorisation doivent être conçus simultanément.
Comment utiliser
Le chemin de mise en œuvre typique de Keywords AI (Respan) consiste d'abord à créer des données observables, puis à utiliser l'évaluation et Prompt/Gateway pour les optimiser.
| Entrée | Convient à la scène | Actions clés |
|---|---|---|
| Console Web | Afficher les traces, les métriques, les vues, les évaluations et les invites | Créer un compte, générer une clé API, afficher le tableau de bord |
| Intégrations SDK / Framework | Application LLM ou Agent existante | Installez le SDK Python/TypeScript, accédez au SDK OpenAI Agents, Vercel AI, Mastra, LangGraph, etc. |
| Ingestion manuelle | Système de journalisation existant ou lien personnalisé | Envoyer des traces/spans via OTLP ou API JSON |
| Passerelle LLM | Nécessite un routage multimodèle et une journalisation automatique | Remplacer l'URL de base, configurer le repli du modèle, réessayer, l'équilibrage de charge, la mise en cache |
| Gestion rapide | L'invite nécessite une gestion des versions et un déploiement sans code | Créez des modèles, soumettez des versions, testez dans l'aire de jeux et mettez en ligne |
Ordre recommandé : utilisez d'abord le traçage pour capturer un véritable lien commercial et confirmer que les entrées/sorties, la latence, le coût et les métadonnées peuvent être entièrement enregistrés ; puis échantillonnez les périodes de production pour former un ensemble de données et ajoutez un juge LLM, une inspection du code ou un examen manuel ; enfin, incluez la version stable de Prompt et le routage Gateway dans le déploiement. Cela évite une discussion prématurée sur les stratégies de routage des modèles lorsqu'il n'existe pas de base de données.
Prix des produits
La page Tarification affiche ouvertement les niveaux Gratuit, Pro et Entreprise et souligne dans la description de la page que vous pouvez commencer avec le plan gratuit et mettre à niveau lorsque vous avez besoin d'une assistance dédiée. La page publique ne fournit pas de manière constante toutes les conditions des contrats d'entreprise. Le quota spécifique, les sièges, l'utilisation, la période de rétention et le niveau de support doivent être soumis à la tarification officielle en temps réel et à la confirmation commerciale.
| Hiérarchie | Positionnement public | Focus sur les coûts |
|---|---|---|
| Gratuit | Utilisé pour démarrer l'accès et la vérification | Le quota gratuit, le volume d'appels, les membres de l'équipe et la période de conservation des données sont soumis à la page en temps réel |
| Pro | Pour les équipes produit/ingénierie en pleine croissance | Concentrez-vous sur l'utilisation des étendues/traces/évaluations, les autorisations des membres, les alertes et les limites fonctionnelles des invites/passerelles |
| Entreprise | Pour les équipes de mise à l’échelle et de conformité | Besoin de confirmer le SSO, l'audit, la conservation des données HIPAA BAA, le support SLA, la région et les conditions du contrat |
| Honoraires des fournisseurs LLM | Non équivalent aux abonnements plateforme | Les frais d'appel des modèles pour OpenAI, Anthropic, Google, Azure, etc. doivent toujours être comptabilisés séparément |
Méthode de comptabilisation des coûts : l'abonnement à la plateforme, les frais d'invocation du modèle, le délai supplémentaire de la passerelle, la conservation des journaux, les frais d'invocation de l'évaluateur et le temps de révision manuelle doivent être calculés ensemble lors de l'évaluation du coût total. En particulier, les évaluations en ligne et le juge LLM ajouteront de nouveaux appels de modèles. Sans stratégie d'échantillonnage, le coût d'évaluation peut augmenter rapidement avec le trafic de production.
Scénarios d'application
- Service client IA et surveillance de l'assistant intelligent : suivez plusieurs séries de sessions, d'appels d'outils et de qualité des réponses, et combinez des métriques et des alertes dimensionnelles par l'utilisateur pour découvrir des anomalies de coûts, des retards accrus ou des réponses échouées.
- Dépannage du flux de travail de l'agent : affichez l'étape de l'agent, l'appel de l'outil et l'appel LLM en fonction des intervalles parent-enfant, ce qui permet de localiser quelle étape de l'appel de l'outil expire et quelle sous-tâche provoque une sortie d'erreur.
- Itération de version Prompt : les chefs de produit et les ingénieurs comparent les différences de version via des modèles Prompt, des versions de validation, des terrains de jeu et des expériences pour réduire le risque de découvrir des régressions de qualité après la mise en ligne.
- Routage multimodèle et gouvernance des fournisseurs : gérez la saisie d'appels de plus de 250 modèles via Gateway et définissez le repli, les nouvelles tentatives, l'équilibrage de charge et la mise en cache entre les différents fournisseurs. Il convient aux équipes qui souhaitent réduire leur dépendance à un modèle unique.
- Applications d'IA dans les secteurs sensibles à la conformité : le site Web officiel affiche les instructions de conformité liées au RGPD et à la HIPAA, et mentionne que les organismes de santé peuvent utiliser l'accord de partenariat commercial ; des secteurs tels que le médical et la finance doivent encore revoir les conditions de traitement des données en fonction de leurs propres processus de conformité.
Ces scénarios reposent tous sur « des données en ligne suffisamment complètes ». Sans métadonnées stables, customer_identifier, version Prompt et balises commerciales, la plateforme peut enregistrer les appels, mais il est difficile de former une analyse interprétable de la qualité et des coûts.
Personnes concernées
- Équipe d'ingénierie de produits IA : il existe déjà un trafic LLM/Agent, et les appels, les coûts, les retards, les erreurs, l'évaluation de la qualité et les versions d'invite doivent être gérés de manière uniforme.
- Équipe Plateforme et Infrastructure : J'espère utiliser Gateway pour gérer les politiques de repli, de nouvelle tentative, de cache et de routage des fournisseurs multimodèles tout en conservant une surface d'observation unifiée.
- Chef de produit et responsable des invites : besoin de gérer les modèles, les versions, les expériences et les lancements d'invites sans modifications fréquentes du code.
- Équipe qualité et conformité : nécessité de constituer des enregistrements vérifiables sur la qualité des résultats, l'examen manuel, les scores d'évaluation, la conservation des données et les liens d'alarme.
Les limites de l'inadéquation sont également claires : seuls des tests d'invite ponctuels, aucun appel de production, aucune capacité d'accès technique ou des liaisons à faible latence inacceptables pour le nouveau délai de passerelle de 50 à 150 ms ne conviennent généralement pas comme premier choix. Ce type de scénario est plus approprié pour utiliser d'abord des journaux légers, des tables d'évaluation hors ligne ou un traçage direct du SDK, puis introduire la plate-forme complète lorsque l'entreprise entre dans la phase d'itération continue.
Résumé et Outlook
La principale compétitivité de Keywords AI (Respan) réside dans la division du cycle de vie des appels LLM en une seule entité : la trace de production enregistre les faits, la surveillance identifie les problèmes de coût et de stabilité, les évaluations mesurent la qualité de sortie, la gestion des invites gère les versions et la passerelle est responsable du routage multi-modèle et du reflow de déploiement. Comparé aux outils qui effectuent uniquement de l'observabilité ou une gestion rapide, il s'apparente davantage à la surface de contrôle technique des produits d'IA.
Il existe trois catégories principales de limitations actuelles : premièrement, la marque est passée de Keywords AI à Respan, et les noms historiques et les sites Web officiels actuels doivent être uniformément cartographiés dans la base de connaissances interne ; deuxièmement, les prix au niveau de l'entreprise, les plafonds d'utilisation, la conservation des données et les SLA ne sont pas entièrement divulgués et nécessitent une confirmation commerciale ; troisièmement, le délai supplémentaire de 50 à 150 ms de Gateway et les coûts d'évaluation du juge LLM affecteront les entreprises à haut débit, à faible latence ou sensibles aux coûts.
Les orientations dignes d'observation à l'avenir incluent : si la couverture du modèle de Respan Gateway continue de s'étendre, si les évaluations en ligne précipitent un modèle d'évaluation plus standard et si les 95+ intégrations continuent d'augmenter l'adaptation des cadres d'agents et des bases de données vectorielles traditionnels. Une approche plus prudente lors de la mise en œuvre consiste à sélectionner d'abord un lien commercial LLM représentatif pour un projet pilote à petite échelle, et à utiliser une à deux semaines pour vérifier le taux d'exhaustivité du suivi, la couverture des indicateurs clés, le coût de l'évaluation et l'efficacité des alarmes, puis à décider s'il convient d'étendre la gouvernance des invites et des passerelles au niveau de l'entreprise.
Informations de version
- Mises à jour groupées rapides :Le dernier nœud public du journal des modifications officiel ajoute la mise à jour par lots de Prompt et améliore les performances de chargement de Prompt et Playground.
- Respan CLI et présentation des intégrations :Le journal des modifications officiel expose Respan CLI, un aperçu de plus de 95 intégrations et couvre les catégories d'intégration telles que les cadres d'agents, les SDK LLM, les agents de codage, les bases de données vectorielles et les fournisseurs de modèles.
- SDK Python et TypeScript unifiés :Le journal des modifications officiel unifie publiquement les SDK Python et TypeScript et ajoute l'intégration de Pydantic AI pour suivre les opérations de l'agent.
Avis des utilisateurs