Services
Contactez-nous
Şevval Alper

Şevval Alper

Chercheuse en IA
21 Articles
Restez informé des dernières technologies B2B
Şevval est chercheuse en IA chez AIMultiple. Elle a une expérience de recherche préalable dans la génération de nombres pseudo-aléatoires à l’aide de systèmes chaotiques.

Intérêts de recherche

Şevval se concentre sur les outils de codage IA, les agents IA et les technologies quantiques.

Elle fait partie de l’équipe benchmark de AIMultiple, réalisant des évaluations et fournissant des informations pour aider les lecteurs à comprendre diverses technologies émergentes et leurs applications.

Expérience professionnelle

Elle a contribué à l’organisation et à l’encadrement des participants lors de trois événements « CERN International Masterclasses - hands-on particle physics » en Turquie, en travaillant aux côtés des enseignants pour faciliter l’apprentissage.

Formation

Şevval est titulaire d’une licence en physique de la Middle East Technical University.

Derniers articles de Şevval

IA
Benchmark
21 Août

Benchmark de reconnaissance vocale: Deepgram vs. Whisper

Nous avons comparé les principaux fournisseurs de reconnaissance vocale (STT), en nous concentrant spécifiquement sur les applications de santé. Notre benchmark a utilisé des exemples réels pour évaluer la précision de la transcription dans des contextes médicaux, où la précision est cruciale. Sur la base des résultats du taux d'erreur de mots (WER) et du…

IA
Benchmark
21 Août

OCR Benchmark: Précision de l'extraction / capture de texte

La précision de l'OCR est essentielle pour de nombreuses tâches de traitement de documents, et les LLMs multimodaux SOTA offrent désormais une alternative à l'OCR. Nous avons benchmarké les principaux services d'OCR dans DeltOCR Bench pour identifier leurs niveaux de précision sur différents types de documents : Les noms complets des produits ci-dessus et leurs…

Logiciel d'entreprise
Analyse
21 Août

Recuit quantique: l'informatique quantique pratique

Le recuit quantique est une technologie quantique prometteuse pour les entreprises confrontées à des problèmes d’optimisation urgents que les ordinateurs traditionnels ne peuvent pas résoudre rapidement. Il peut être utilisé pour résoudre des problèmes d’optimisation plus efficacement que les ordinateurs traditionnels. Cependant, il est encore principalement utilisé dans le milieu universitaire, et davantage de R&D…

IA
Benchmark
14 Août

Benchmark des outils de revue de code IA

Avec l'utilisation accrue des outils de codage IA, les bases de code sont devenues plus vulnérables, ce qui a accru le besoin de revues de code efficaces. Pour y répondre, nous présentons RevEval (IA Code Review Eval), qui évalue les quatre principaux outils de revue de code IA sur 309 pull requests issues de dépôts…

Agentic AI
Benchmark
11 Août

Meilleurs harnais d'agent: Claude Code vs Codex

Les harnais d’agent servent de runtime de production pour les agents d’IA, avec des choix de conception qui créent des variations de performance sur des modèles sous-jacents identiques. Nous avons comparé 17 harnais d’agent sur 10 tâches de codage. Pour isoler le harnais plutôt que le modèle, nous avons exécuté chaque CLI agentique sur un…

IA
Benchmark
11 Août

Agentic IT: Can LLMs Design a Benchmark

We gave 12 large language models the job a benchmark team does: invent a benchmark, build it, run four models through it, and report the results. Each did it twice. None of the 24 attempts passed every criterion, and six of the rubric’s checks were passed by none of them. The two topics are text-to-SQL,…

Agentic AI
Benchmark
10 Août

VELC-Bench: Vérification sur le benchmark de contexte long

La capacité du modèle à localiser une métrique spécifique dans le contexte, à comparer sa valeur à une affirmation, et à la confirmer ou la rejeter. Cela teste la correspondance fine des valeurs dans des conditions de contexte long. Le modèle doit à la fois récupérer la valeur et effectuer une comparaison précise. Les modèles…

Logiciel d'entreprise
Évaluation en Monde Ouvert
30 Juil

Automatisation MSP: Acronis, ConnectWise Automate & Rewst

Les fournisseurs de services gérés (MSP) gèrent une charge opérationnelle constante, incluant la gestion des tickets, la gestion des correctifs, l'intégration, la surveillance des alertes, le rapprochement des factures et les mises à jour de la documentation. Ces tâches sont nécessaires mais chronophages. L'automatisation change la donne en réduisant la charge de travail manuelle et…

IA
Évaluation en Monde Ouvert
29 Juil

Top 8 des agents de codage IA open source

Lors de précédentes évaluations, nous avons benchmarké à la fois des CLI agentiques open source et propriétaires, en nous concentrant sur leurs performances dans les tâches de développement web, et certains agents open source ont obtenu des résultats aussi bons que les options payantes. Par conséquent, nous avons également listé les meilleurs agents de codage…

Logiciel d'entreprise
Comparaison des Fonctionnalités
14 Juil

Meilleures 10 Google Colab alternatives

Google Colaboratory est une plateforme populaire pour les scientifiques des données et les scientifiques en apprentissage automatique, mais ses limitations et sa tarification peuvent ne pas répondre à vos besoins. Plusieurs alternatives offrent des fonctionnalités et capacités uniques qui répondent à différents besoins et scénarios en science des données. Suivez les liens pour voir les…