Servizi
Contattaci
Şevval Alper

Şevval Alper

Ricercatrice di IA
21 Articoli
Rimani aggiornato sulle novità tecnologiche B2B.
Şevval è una ricercatrice di IA presso AIMultiple. Ha precedenti esperienze di ricerca nella generazione di numeri pseudocasuali utilizzando sistemi caotici.

Interessi di ricerca

Şevval si concentra su strumenti di programmazione IA, agenti IA e tecnologie quantistiche.

Fa parte del team benchmark di AIMultiple, conducendo valutazioni e fornendo approfondimenti per aiutare i lettori a comprendere varie tecnologie emergenti e le loro applicazioni.

Esperienza professionale

Ha contribuito all'organizzazione e alla guida dei partecipanti in tre eventi “CERN International Masterclasses - hands-on particle physics” in Turchia, collaborando con il corpo docente per facilitare l'apprendimento.

Formazione

Şevval ha conseguito una laurea triennale in Fisica presso la Middle East Technical University.

Ultimi articoli di Şevval

IA
Benchmark
21 Ago

Benchmark Speech-to-Text: Deepgram vs. Whisper

Abbiamo valutato i principali fornitori di speech-to-text (STT), concentrandoci in particolare sulle applicazioni sanitarie. Il nostro benchmark ha utilizzato esempi reali per valutare l'accuratezza della trascrizione in contesti medici, dove la precisione è cruciale. Sulla base dei risultati sia del tasso di errore sulle parole (WER) sia del tasso di errore sui caratteri (CER), GPT-4o-transcribe…

IA
Benchmark
21 Ago

OCR Confronto: Estrazione del testo / Accuratezza della cattura

OCR accuratezza è critica per molti processi di elaborazione documentale, e i modelli multi-modali SOTA LLM stanno ora offrendo un'alternativa al OCR. Abbiamo confrontato i principali servizi OCR in DeltOCR Bench per identificare i loro livelli di accuratezza in diversi tipi di documenti: I nomi completi dei prodotti sopra elencati e le loro versioni in…

Software aziendale
Approfondimento
21 Ago

Ricottura quantistica: calcolo quantistico pratico

La ricottura quantistica è una tecnologia quantistica promettente per le aziende con problemi di ottimizzazione urgenti che i computer tradizionali non possono risolvere rapidamente. Può essere utilizzata per risolvere problemi di ottimizzazione in modo più efficace rispetto ai computer tradizionali. Tuttavia, è ancora utilizzata principalmente in ambito accademico e sono necessarie ulteriori attività di R&S…

IA
Benchmark
14 Ago

Benchmark degli strumenti di revisione del codice IA

Con il crescente utilizzo di strumenti di codifica IA, le codebase sono diventate più soggette a vulnerabilità, il che ha aumentato la necessità di revisioni del codice efficaci. Per affrontare questo, introduciamo RevEval (AI Code Review Eval), che confronta i quattro principali strumenti di revisione del codice IA su 309 pull request provenienti da repository…

IA agentica
Benchmark
11 Ago

I Migliori Agent Harness: Claude Code vs Codex

Gli agent harness fungono da runtime di produzione per gli agenti IA, con scelte di progettazione che creano variazioni di performance tra modelli sottostanti identici. Abbiamo sottoposto a benchmark 17 agent harness su 10 attività di coding. Per isolare l'harness piuttosto che il modello, abbiamo eseguito ogni CLI agentic su un singolo modello di fondazione,…

IA
Benchmark
11 Ago

Agentic IT: Can LLMs Design a Benchmark

We gave 12 large language models the job a benchmark team does: invent a benchmark, build it, run four models through it, and report the results. Each did it twice. None of the 24 attempts passed every criterion, and six of the rubric’s checks were passed by none of them. The two topics are text-to-SQL,…

IA agentica
Benchmark
10 Ago

VELC-Bench: Verifica su Benchmark a Contesto Lungo

La capacità del modello di individuare una metrica specifica nel contesto, confrontare il suo valore con un'affermazione e confermarla o respingerla. Questo testa il confronto preciso di valori in condizioni di contesto lungo. Il modello deve sia recuperare il valore sia eseguire un confronto preciso. I modelli sono testati nelle seguenti finestre di contesto: claude-fable-5…

Software aziendale
Valutazione in Mondo Aperto
30 Lug

Automazione MSP: Acronis, ConnectWise Automate e Rewst

I fornitori di servizi gestiti (MSP) gestiscono un carico operativo costante, che include gestione dei ticket, gestione delle patch, onboarding, monitoraggio degli avvisi, riconciliazione della fatturazione e aggiornamenti della documentazione. Si tratta di attività necessarie ma dispendiose in termini di tempo. L'automazione cambia la situazione riducendo il carico di lavoro manuale e il rischio di…

IA
Valutazione in Mondo Aperto
29 Lug

Top 8 Agenti di Codifica IA Open Source

In valutazioni precedenti, abbiamo confrontato sia le CLI agentiche open source che proprietarie, concentrandoci sulle loro prestazioni in attività di sviluppo web, e alcuni agenti open source hanno ottenuto risultati paragonabili alle opzioni a pagamento. Pertanto, abbiamo anche elencato i migliori agenti di codifica open source per gli utenti con problemi di privacy. Per la…

Software aziendale
Confronto delle Funzionalità
14 Lug

Le Migliori 10 Alternative a Google Colab

Google Colaboratory è una piattaforma popolare per data scientist e scienziati di machine learning, ma le sue limitazioni e i prezzi potrebbero non soddisfare le tue esigenze. Diverse alternative offrono funzionalità e capacità uniche che soddisfano diverse esigenze e scenari di data science. Segui i link per vedere le migliori alternative a Google Colab: Le…