Şevval Alper
Intérêts de recherche
Şevval se concentre sur les outils de codage IA, les agents IA et les technologies quantiques.Elle fait partie de l’équipe benchmark de AIMultiple, réalisant des évaluations et fournissant des informations pour aider les lecteurs à comprendre diverses technologies émergentes et leurs applications.
Expérience professionnelle
Elle a contribué à l’organisation et à l’encadrement des participants lors de trois événements « CERN International Masterclasses - hands-on particle physics » en Turquie, en travaillant aux côtés des enseignants pour faciliter l’apprentissage.Formation
Şevval est titulaire d’une licence en physique de la Middle East Technical University.Derniers articles de Şevval
Benchmark de reconnaissance vocale: Deepgram vs. Whisper
Nous avons comparé les principaux fournisseurs de reconnaissance vocale (STT), en nous concentrant spécifiquement sur les applications de santé. Notre benchmark a utilisé des exemples réels pour évaluer la précision de la transcription dans des contextes médicaux, où la précision est cruciale. Sur la base des résultats du taux d'erreur de mots (WER) et du…
OCR Benchmark: Précision de l'extraction / capture de texte
La précision de l'OCR est essentielle pour de nombreuses tâches de traitement de documents, et les LLMs multimodaux SOTA offrent désormais une alternative à l'OCR. Nous avons benchmarké les principaux services d'OCR dans DeltOCR Bench pour identifier leurs niveaux de précision sur différents types de documents : Les noms complets des produits ci-dessus et leurs…
Recuit quantique: l'informatique quantique pratique
Le recuit quantique est une technologie quantique prometteuse pour les entreprises confrontées à des problèmes d’optimisation urgents que les ordinateurs traditionnels ne peuvent pas résoudre rapidement. Il peut être utilisé pour résoudre des problèmes d’optimisation plus efficacement que les ordinateurs traditionnels. Cependant, il est encore principalement utilisé dans le milieu universitaire, et davantage de R&D…
Benchmark des outils de revue de code IA
Avec l'utilisation accrue des outils de codage IA, les bases de code sont devenues plus vulnérables, ce qui a accru le besoin de revues de code efficaces. Pour y répondre, nous présentons RevEval (IA Code Review Eval), qui évalue les quatre principaux outils de revue de code IA sur 309 pull requests issues de dépôts…
Meilleurs harnais d'agent: Claude Code vs Codex
Les harnais d’agent servent de runtime de production pour les agents d’IA, avec des choix de conception qui créent des variations de performance sur des modèles sous-jacents identiques. Nous avons comparé 17 harnais d’agent sur 10 tâches de codage. Pour isoler le harnais plutôt que le modèle, nous avons exécuté chaque CLI agentique sur un…
Agentic IT: Can LLMs Design a Benchmark
We gave 12 large language models the job a benchmark team does: invent a benchmark, build it, run four models through it, and report the results. Each did it twice. None of the 24 attempts passed every criterion, and six of the rubric’s checks were passed by none of them. The two topics are text-to-SQL,…
VELC-Bench: Vérification sur le benchmark de contexte long
La capacité du modèle à localiser une métrique spécifique dans le contexte, à comparer sa valeur à une affirmation, et à la confirmer ou la rejeter. Cela teste la correspondance fine des valeurs dans des conditions de contexte long. Le modèle doit à la fois récupérer la valeur et effectuer une comparaison précise. Les modèles…
Automatisation MSP: Acronis, ConnectWise Automate & Rewst
Les fournisseurs de services gérés (MSP) gèrent une charge opérationnelle constante, incluant la gestion des tickets, la gestion des correctifs, l'intégration, la surveillance des alertes, le rapprochement des factures et les mises à jour de la documentation. Ces tâches sont nécessaires mais chronophages. L'automatisation change la donne en réduisant la charge de travail manuelle et…
Top 8 des agents de codage IA open source
Lors de précédentes évaluations, nous avons benchmarké à la fois des CLI agentiques open source et propriétaires, en nous concentrant sur leurs performances dans les tâches de développement web, et certains agents open source ont obtenu des résultats aussi bons que les options payantes. Par conséquent, nous avons également listé les meilleurs agents de codage…
Meilleures 10 Google Colab alternatives
Google Colaboratory est une plateforme populaire pour les scientifiques des données et les scientifiques en apprentissage automatique, mais ses limitations et sa tarification peuvent ne pas répondre à vos besoins. Plusieurs alternatives offrent des fonctionnalités et capacités uniques qui répondent à différents besoins et scénarios en science des données. Suivez les liens pour voir les…
Newsletter AIMultiple
Un e-mail gratuit par semaine contenant les dernières actualités technologiques B2B et des analyses d'experts pour accélérer la croissance de votre entreprise.