Funcionários da OpenAI publicamente acusam os resultados do teste Referência da Grok3 de serem enganosos

GoldenOctober2024

Geração do resumo em andamento

Em 23 de fevereiro, um funcionário da OpenAI acusou publicamente a empresa xAI de Elon Musk, dizendo que os resultados do teste Referência do mais recente modelo de IA Grok3 divulgado por ela eram enganosos. Em resposta, o cofundador da xAI, Igor Babushkin, insistiu que a empresa não estava errada. Os gráficos da xAI mostram que duas versões do Grok3 – Grok3 Reasoning Beta e Grok3 mini Reasoning – superaram o modelo atualmente mais forte disponível da OpenAI, o3-mini-high, no AIME 2025. No entanto, os funcionários da OpenAI foram rápidos em apontar na plataforma X que o gráfico da xAI não incluía a pontuação AIME 2025 de o3-mini-high sob condições "cons@64". Babushkin argumenta na plataforma X que a OpenAI publicou gráficos de teste de referência igualmente enganosos no passado. Embora esses gráficos sejam usados para comparar o desempenho de seus próprios modelos.

GROK-3.3%

XAI-0.1%

Ver original

O conteúdo é apenas para referência, não uma solicitação ou oferta. Nenhum aconselhamento fiscal, de investimento ou jurídico é fornecido. Consulte a isenção de responsabilidade para obter mais informações sobre riscos.

3 Curtidas

Recompensa
3
2
Compartilhar

Comentário

0/400

Sem comentários

Tema
#BTC#
192k Postagens
#ETH#
120k Postagens
#PI#
94k Postagens
4#GateioInto11#
76k Postagens
5#ContentStar#
64k Postagens
6#BOME#
59k Postagens
7#GT#
56k Postagens
8#DOGE#
53k Postagens
9#MAGA#
52k Postagens
10#SLERF#
51k Postagens

Marcar

sitemap