Claude 3 \ Anthropic vs Galactica

No confronto entre Claude 3 \ Anthropic vs Galactica, qual ferramenta AI Large Language Model (LLM) sai vitoriosa? Avaliamos avaliações, preços, alternativas, recursos, votos positivos e muito mais.

Quando colocamos Claude 3 \ Anthropic e Galactica lado a lado, qual emerge como o vencedor?

Vamos dar uma olhada mais de perto em Claude 3 \ Anthropic e Galactica, ambas são ferramentas alimentadas por inteligência artificial na categoria de large language model (llm), e veja o que os distingue. O número de votos positivos está acirrado tanto para Claude 3 \ Anthropic quanto para Galactica. Como outros usuários da aitools.fyi poderiam decidir o vencedor, a bola está agora em seu campo para votar e nos ajudar a determinar o vencedor.

Se sentindo rebelde? Vote e agite as coisas!

Claude 3 \ Anthropic

Claude 3 \ Anthropic

O que é Claude 3 \ Anthropic?

Claude 3 é a família de modelos de linguagem de terceira geração da Anthropic, lançada em março de 2024. Ela inclui três diferentes níveis: Haiku, para velocidade e custo; Sonnet, para desempenho equilibrado; e Opus, para a maior profundidade de raciocínio. Cada modelo tem como foco um compromisso diferente entre inteligência, latência e preço.

A família lida com tarefas de texto, código, análise e visão. Os modelos Claude 3 processam fotos, gráficos, diagramas técnicos e tabelas. No lançamento, suportam uma janela de contexto de 200 mil tokens, com entradas que ultrapassam 1 milhão de tokens disponíveis para clientes selecionados. Opus e Sonnet foram lançados na claude.ai e na API Claude em 159 países, seguidos logo após pelo Haiku.

A Anthropic construiu o Claude 3 usando métodos de segurança de IA Constitucional e diretrizes de Responsible Scaling Policy. Os modelos estão disponíveis através da API Claude, Amazon Bedrock e Google Cloud Vertex AI. Sonnet alimenta o nível gratuito em claude.ai, enquanto Opus está disponível para assinantes do Claude Pro.

Galactica

Galactica

O que é Galactica?

Cinco checkpoints de pesos abertos de 125M a 120B parâmetros oferecem aos pesquisadores um modelo de linguagem treinado em ciência, construído a partir de 106 bilhões de tokens selecionados em 48 milhões de artigos, livros didáticos, enciclopédias e bases de conhecimento. Galactica armazena, combina e raciocina através de modalidades incluindo LaTeX, código Python, fórmulas SMILES e sequências de aminoácidos dentro de uma arquitetura Transformer apenas com decodificador. A equipe Papers with Code da Meta disponibilizou os pesos para pesquisadores que desejam estudar como modelos de linguagem organizam o conhecimento científico.

Modelos de linguagem geral treinam em amplas varreduras da web onde conversas sociais podem dominar o orçamento de tokens. Galactica usou apenas fontes científicas de acesso aberto selecionadas, o que o artigo argumenta permitir treinar por múltiplas épocas sem overfitting. A Meta removeu a demonstração pública na web três dias após o lançamento em novembro de 2022, quando críticos mostraram citações e equações confiantes, porém fabricadas, então hoje você baixa checkpoints do Hugging Face em vez de conversar por uma interface hospedada.

Pesquisadores de aprendizado de máquina podem reproduzir números de benchmark do artigo do arXiv, incluindo 77,6% no PubMedQA e 52,9% no MedMCQA dev. Biólogos computacionais e químicos podem testar tarefas de anotação de proteínas e moléculas através dos tokens especializados do Galactica para sequências de aminoácidos e strings SMILES. Estudantes de pós-graduação explorando QA científico, predição de citações ou problemas matemáticos em texto podem experimentar tamanhos de até 120 bilhões de parâmetros sem treinar do zero.

Claude 3 \ Anthropic Votos positivos

8

Galactica Votos positivos

8

Claude 3 \ Anthropic Recursos principais

  • Três níveis de modelo (Haiku, Sonnet, Opus) permitem escolher o equilíbrio certo entre velocidade, custo e profundidade de raciocínio

  • Janela de contexto de 200K tokens no lançamento, com mais de 1M de tokens disponíveis para clientes empresariais selecionados

  • Suporte de visão para fotos, gráficos, tabelas, PDFs e diagramas técnicos

  • Respostas quase instantâneas do Haiku para chat ao vivo, auto-completar e tarefas de extração de dados

  • Disponível em claude.ai, na API Claude, Amazon Bedrock e Google Cloud Vertex AI

Galactica Recursos principais

  • Cinco pontos de verificação abrangem 125M, 1.3B, 6.7B, 30B e 120B parâmetros

  • Corpus de treinamento totaliza 106 bilhões de tokens em 48 milhões de artigos científicos

  • Pontua 68,2% em testes de equações LaTeX versus GPT-3 com 49,0%

  • Alcança 77,6% no PubMedQA e 52,9% no MedMCQA nos benchmarks de desenvolvimento

  • Modelo de 30B atinge 20,4% em MATH versus PaLM 540B com 8,8%

  • Tokens especiais cobrem citações, fórmulas SMILES e sequências de aminoácidos

Claude 3 \ Anthropic Categoria

    Large Language Model (LLM)

Galactica Categoria

    Large Language Model (LLM)

Claude 3 \ Anthropic Tipo de tarifação

    Freemium

Galactica Tipo de tarifação

    Free

Claude 3 \ Anthropic Tecnologias utilizadas

Next.js
Chakra UI
Ant Design
Amazon Web Services
Google Tag Manager
Font Awesome
Sanity
Ruby
GitHub
Emotion

Galactica Tecnologias utilizadas

jQuery
Ruby
Styled Components

Claude 3 \ Anthropic Tags

Large Language Models
Anthropic
Claude 3
Vision AI
Code Generation
Constitutional AI
Enterprise AI
API Platform

Galactica Tags

LaTeX Equations
Scientific Corpus
Open Weights
PubMedQA
MedMCQA
SMILES Chemistry
Decoder Transformer
Large Language Model
By Rishit