File size: 1,403 Bytes
9cb4eda
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
---
license: mit
language:
- pt
- en
tags:
- text-generation
- code-generation
- from-scratch
---

# Modelo de jogo da velha treinado do zero

Este é um pequeno modelo causal treinado a partir de pesos aleatórios para responder a pedidos de geração de código web, com foco em um jogo simples da velha. Ele não usa Qwen, Llama, GPT ou qualquer peso pré-treinado. O tokenizer também foi treinado localmente.

## Uso

```bash
python3 usar_gpt_zero.py --checkpoint modelo_jogo_zero_publicado_v2.pt --system "Você é um assistente local útil e educado." --pergunta "Crie um jogo simples da velha em HTML, CSS e JavaScript." --device cpu
```

O arquivo `jogo_gerado_pelo_modelo.html` é uma amostra gerada pelo checkpoint. A validação registra que o HTML abriu no navegador, alternou X e O e detectou uma vitória.

## Dados

O treinamento combinou diálogos curados deste projeto com um subconjunto filtrado do dataset `cfahlgren1/react-code-instructions`, publicado sob licença MIT: https://huggingface.co/datasets/cfahlgren1/react-code-instructions. O subconjunto foi usado para ampliar exemplos de aplicações web; os exemplos específicos da velha foram escritos para este projeto.

## Limitações

Este é um modelo educacional pequeno, com aproximadamente 751 mil parâmetros. Ele não é um assistente geral e pode produzir código incompleto para pedidos fora dos padrões aprendidos.