Premium
Services
Premium
Şevval Alper

Şevval Alper

Chercheuse en IA
19 Articles
Restez informé des dernières technologies B2B
Şevval est chercheuse en IA chez AIMultiple. Elle a une expérience de recherche préalable dans la génération de nombres pseudo-aléatoires à l’aide de systèmes chaotiques.

Intérêts de recherche

Şevval se concentre sur les outils de codage IA, les agents IA et les technologies quantiques.

Elle fait partie de l’équipe benchmark de AIMultiple, réalisant des évaluations et fournissant des informations pour aider les lecteurs à comprendre diverses technologies émergentes et leurs applications.

Expérience professionnelle

Elle a contribué à l’organisation et à l’encadrement des participants lors de trois événements « CERN International Masterclasses - hands-on particle physics » en Turquie, en travaillant aux côtés des enseignants pour faciliter l’apprentissage.

Formation

Şevval est titulaire d’une licence en physique de la Middle East Technical University.

Derniers articles de Şevval

Agentic AI
Benchmark
21 août

Benchmark des plateformes d'agents IA: Claude Managed Agents contre Google Vertex Agent Engine

Nous avons benchmarké 4 plateformes d'agents IA selon 3 dimensions : réalisation des tâches (10 tâches de codage × 3 exécutions), capacités spécifiques au harnais (pilotage, reconnexion, rappel de longue conversation, gestion de gros fichiers) et coût. Claude Managed Agents et Vertex AI Agent Engine atteignent toutes deux un taux de réussite de 100 % sur…

Agentic AI
Benchmark
21 août

MCP Benchmark: Meilleurs serveurs MCP pour l'accès Web

Nous avons évalué 8 serveurs MCP sur des tâches de recherche et extraction Web, ainsi que d'automatisation de navigateur, en exécutant 4 tâches différentes 5 fois sur tous les MCPs appropriés. Nous avons également effectué un test de charge impliquant 250 agents IA simultanés. *Les tâches de recherche et extraction Web sont exécutées avec le…

IA
Analyse
21 août

LLM Paramètres: GPT-5 High, Moyen, Bas et Minimal

Certains LLMs, comme la gamme OpenAI GPT-5, existent en différentes versions (par exemple, GPT-5, GPT-5-mini et GPT-5-nano) et avec divers réglages de paramètres, notamment haut, moyen, bas et minimal. Ci-dessous, nous explorons les différences entre ces versions de model en rassemblant leurs performances benchmark et les coûts d’exécution des benchmarks. Nous avons utilisé la famille…

IA
Benchmark
21 août

Meilleur éditeur de code IA: Cursor vs Windsurf vs Replit

Créer une application sans savoir coder est très tendance en ce moment. Mais ces outils peuvent-ils réellement créer et déployer une application ? Nous avons évalué 6 éditeurs de code IA sur 10 tâches de développement web réelles. Chaque tâche nécessitait des implémentations telles que le backend, le frontend, l’authentification et la gestion d’état. Nous…

IA
Benchmark
21 août

Benchmark de reconnaissance vocale: Deepgram vs. Whisper

Nous avons comparé les principaux fournisseurs de reconnaissance vocale (STT), en nous concentrant spécifiquement sur les applications de santé. Notre benchmark a utilisé des exemples réels pour évaluer la précision de la transcription dans des contextes médicaux, où la précision est cruciale. D’après les résultats du taux d’erreur de mots (WER) et du taux d’erreur…

IA
Benchmark
21 août

OCR Benchmark: Précision de l'extraction / capture de texte

La précision de l'OCR est essentielle pour de nombreuses tâches de traitement de documents, et les LLMs multimodaux SOTA offrent désormais une alternative à l'OCR. Nous avons benchmarké les principaux services d'OCR dans DeltOCR Bench pour identifier leurs niveaux de précision sur différents types de documents : Les noms complets des produits ci-dessus et leurs…

Logiciel d'entreprise
Analyse
21 août

Recuit quantique: informatique quantique pratique

Le recuit quantique est une technologie quantique prometteuse pour les entreprises confrontées à des problèmes d’optimisation urgents que les ordinateurs traditionnels ne peuvent pas résoudre rapidement. Il peut être utilisé pour résoudre des problèmes d’optimisation plus efficacement que les ordinateurs traditionnels. Cependant, il est encore principalement utilisé dans le monde universitaire, et davantage de R&D…

Agentic AI
Benchmark
11 août

Meilleurs harnais d'agent: Claude Code vs Codex

Les harnais d’agent servent de runtime de production pour les agents d’IA, avec des choix de conception qui créent des variations de performance sur des modèles sous-jacents identiques. Nous avons comparé 17 harnais d’agent sur 10 tâches de codage. Pour isoler le harnais plutôt que le modèle, nous avons exécuté chaque CLI agentique sur un…

IA
Évaluation en Monde Ouvert
29 juil

Top 8 des agents de codage IA open source

Lors de précédentes évaluations, nous avons benchmarké à la fois des CLI agentiques open source et propriétaires, en nous concentrant sur leurs performances dans les tâches de développement web, et certains agents open source ont obtenu des résultats aussi bons que les options payantes. Par conséquent, nous avons également listé les meilleurs agents de codage…