'From 2nd to 32nd': Meta faked its AI benchmark score once, is it doing same with Muse Spark 1.1? - WION
'From 2nd to 32nd': Meta faked its AI benchmark score once, is it doing same with Muse Spark 1.1? WION
Topics: Benchmarks
Entities: Benchmarks
Source feed
218 items
'From 2nd to 32nd': Meta faked its AI benchmark score once, is it doing same with Muse Spark 1.1? WION
Topics: Benchmarks
Entities: Benchmarks
Houdini, Meet AI Agents: OpenAI reports unprecedented cyber incident during model evaluation Lewis Silkin
Topics: LLM Evaluation
Entities: LLM EvaluationOpenAI
OpenAI and Hugging Face reveal security incident during advanced model evaluation TahawulTech.com
Topics: LLM Evaluation
Entities: LLM EvaluationOpenAI
OpenAI And Hugging Face Investigate AI-Driven Security Incident During Model Evaluation Pulse 2.0
Topics: LLM Evaluation
Entities: LLM EvaluationOpenAI
Meta's Muse Spark edges past Google's Gemini on AI benchmark The Economic Times
Topics: Benchmarks
Entities: BenchmarksGeminiGoogle
New AI Benchmark Holds GPT-5.5 at 43% on Cross-Domain Reasoning Chains Tech Times
Topics: Benchmarks
Entities: Benchmarks
OpenAI and Hugging Face partner to address security incident during model evaluation OpenAI
Topics: LLM Evaluation
Entities: LLM EvaluationOpenAI
AI Benchmark Digest — 2026-07-20 Buttondown
Topics: Benchmarks
Entities: Benchmarks
Kimi K3 tops AI benchmark in a first for Chinese models Notebookcheck
Topics: Benchmarks
Entities: Benchmarks
Kimi K3 Highlights Limits of AI Benchmark Leaderboards BankInfoSecurity
Topics: Benchmarks
Entities: Benchmarks
OpenAI's GPT-5.6 Sol tops AI benchmark for pres... Pluang
Topics: Benchmarks
Entities: BenchmarksOpenAI
DevRev Open Sources Enterprise AI Benchmark Open Source For You
Topics: Benchmarks
Entities: Benchmarks