Premium
Servizi
Premium
Şevval Alper

Şevval Alper

Ricercatrice di IA
19 Articoli
Rimani aggiornato sulle novità tecnologiche B2B.
Şevval è una ricercatrice di IA presso AIMultiple. Ha precedenti esperienze di ricerca nella generazione di numeri pseudocasuali utilizzando sistemi caotici.

Interessi di ricerca

Şevval si concentra su strumenti di programmazione IA, agenti IA e tecnologie quantistiche.

Fa parte del team benchmark di AIMultiple, conducendo valutazioni e fornendo approfondimenti per aiutare i lettori a comprendere varie tecnologie emergenti e le loro applicazioni.

Esperienza professionale

Ha contribuito all'organizzazione e alla guida dei partecipanti in tre eventi “CERN International Masterclasses - hands-on particle physics” in Turchia, collaborando con il corpo docente per facilitare l'apprendimento.

Formazione

Şevval ha conseguito una laurea triennale in Fisica presso la Middle East Technical University.

Ultimi articoli di Şevval

IA agentica
Benchmark
21 ago

Benchmark delle piattaforme di agenti IA: Claude Managed Agents vs Google Vertex Agent Engine

Abbiamo confrontato 4 piattaforme di agenti IA su 3 dimensioni: completamento delle attività (10 attività di codifica × 3 esecuzioni), capacità specifiche dell'harness (steering, riconnessione, richiamo di conversazioni lunghe, gestione di file di grandi dimensioni) e costo. Claude Managed Agents e Vertex AI Agent Engine raggiungono entrambi tassi di superamento del 100% nella suite di…

IA agentica
Benchmark
21 ago

MCP Benchmark: I migliori server MCP per l'accesso al web

Abbiamo confrontato 8 MCP server in attività di ricerca e estrazione web, nonché di automazione del browser, eseguendo 4 diverse attività 5 volte su tutti i MCP idonei. Abbiamo anche eseguito un test di carico che ha coinvolto 250 agenti IA simultanei. *Le attività di ricerca ed estrazione web vengono eseguite con il server MCP…

IA
Approfondimento
21 ago

LLM Parameters: GPT-5 High, Medium, Low and Minimal

Alcuni LLM, come la famiglia GPT-5 di OpenAI, sono disponibili in diverse versioni (ad esempio, GPT-5, GPT-5-mini e GPT-5-nano) e con varie impostazioni dei parametri, tra cui alto, medio, basso e minimo. Di seguito, esploriamo le differenze tra queste versioni del modello raccogliendo le loro prestazioni sui benchmark e i costi per eseguire i benchmark.…

IA
Benchmark
21 ago

Miglior editor di codice IA: Cursor vs Windsurf vs Replit

Creare un'app senza competenze di programmazione è molto di tendenza in questo momento. Ma questi strumenti possono davvero creare e distribuire un'app con successo? Abbiamo sottoposto a benchmark 6 editor di codice IA in 10 sfide reali di sviluppo web. Ogni attività richiedeva implementazioni come backend, frontend, autenticazione e gestione dello stato. Abbiamo valutato la…

IA
Benchmark
21 ago

Benchmark Speech-to-Text: Deepgram vs. Whisper

Abbiamo valutato i principali fornitori di speech-to-text (STT), concentrandoci in particolare sulle applicazioni sanitarie. Il nostro benchmark ha utilizzato esempi reali per valutare l'accuratezza della trascrizione in contesti medici, dove la precisione è cruciale. Sulla base dei risultati sia del tasso di errore sulle parole (WER) sia del tasso di errore sui caratteri (CER), GPT-4o-transcribe…

IA
Benchmark
21 ago

OCR Confronto: Estrazione del testo / Accuratezza della cattura

OCR accuratezza è critica per molti processi di elaborazione documentale, e i modelli multi-modali SOTA LLM stanno ora offrendo un'alternativa al OCR. Abbiamo confrontato i principali servizi OCR in DeltOCR Bench per identificare i loro livelli di accuratezza in diversi tipi di documenti: I nomi completi dei prodotti sopra elencati e le loro versioni in…

Software aziendale
Approfondimento
21 ago

Ricottura quantistica: calcolo quantistico pratico

La ricottura quantistica è una tecnologia quantistica promettente per le aziende con problemi di ottimizzazione urgenti che i computer tradizionali non possono risolvere rapidamente. Può essere utilizzata per risolvere problemi di ottimizzazione in modo più efficace rispetto ai computer tradizionali. Tuttavia, è ancora utilizzata principalmente in ambito accademico e sono necessarie ulteriori attività di R&S…

IA agentica
Benchmark
11 ago

I Migliori Agent Harness: Claude Code vs Codex

Gli agent harness fungono da runtime di produzione per gli agenti IA, con scelte di progettazione che creano variazioni di performance tra modelli sottostanti identici. Abbiamo sottoposto a benchmark 17 agent harness su 10 attività di coding. Per isolare l'harness piuttosto che il modello, abbiamo eseguito ogni CLI agentic su un singolo modello di fondazione,…

IA
Valutazione in Mondo Aperto
29 lug

Top 8 Agenti di Codifica IA Open Source

In valutazioni precedenti, abbiamo confrontato sia le CLI agentiche open source che proprietarie, concentrandoci sulle loro prestazioni in attività di sviluppo web, e alcuni agenti open source hanno ottenuto risultati paragonabili alle opzioni a pagamento. Pertanto, abbiamo anche elencato i migliori agenti di codifica open source per gli utenti con problemi di privacy. Per la…