{"slug":"aayatai-com-chat-fast-16dd4b","title":"Pay-per-call LLM chat (Llama 3.2 3B)","host":"aayatai.com","method":"POST","resource":"https://aayatai.com/chat/fast","category":"other","description":"Pay-per-call LLM chat (Llama 3.2 3B): Fast, cheap model for classification, extraction, short answers and routing. No API key or account. POST JSON {\"prompt\": \"...\"} or OpenAI-style {\"messages\": [{\"role\": \"user\", \"content\": \"...\"}]}, optional \"system\", \"max_tokens\" (up to 1024), \"temperature\", \"json","price_listed":0.003,"price_asked":0.003,"state":"answering","state_label":"Answering","checks_7d":1,"answered_7d":1,"latency_ms_median":5445,"reported_calls_30d":1,"reported_payers_30d":1,"networks":["eip155:137","eip155:42161","eip155:8453","solana:5eykt4UsFv8P8NJdTREpY1vzqKqZKvdp"],"badge":"unverified","paid_checks_7d":0,"paid_ok_7d":0,"example_input":{"body":{"prompt":"In one sentence, what is the x402 payment protocol?"},"bodyType":"json","method":"POST","type":"http"},"output_schema":{"$schema":"https://json-schema.org/draft/2020-12/schema","properties":{"input":{"additionalProperties":false,"properties":{"body":{"properties":{"json":{"default":false,"description":"Ask for JSON-only output.","type":"boolean"},"max_tokens":{"description":"Most tokens to generate (default 512).","maximum":1024,"minimum":1,"type":"integer"},"messages":{"description":"Conversation so far, OpenAI style: [{role, content}].","items":{"properties":{"content":{"type":"string"},"role":{"enum":["system","user","assistant"],"type":"string"}},"type":"object"},"maxItems":50,"type":"array"},"prompt":{"description":"A single user message (use this or messages).","maxLength":20000,"type":"string"},"system":{"description":"System instructions.","maxLength":8000,"type":"string"},"temperature":{"default":0.3,"description":"Randomness, 0-2.","maximum":2,"minimum":0,"type":"number"}},"type":"object"},"bodyType":{"enum":["json","form-data","text"],"type":"string"},"method":{"enum":["POST"],"type":"string"},"type":{"const":"http","type":"string"}},"required":["type","method","bodyType","body"],"type":"object"},"output":{"properties":{"example":{"properties":{"model":{"type":"string"},"text":{"description":"The model's reply.","type":"string"},"usage":{"properties":{"completionTokens":{"type":["integer","null"]},"promptTokens":{"type":["integer","null"]}},"type":"object"}},"required":["text","model","usage"],"type":"object"},"type":{"type":"string"}},"required":["type"],"type":"object"}},"required":["input"],"type":"object"},"history":[{"day":"2026-09-28","reachable":true,"status":402,"valid_402":true,"asked_usdc":0.003,"price_match":true,"latency_ms":5445,"error":null}],"description_full":"Pay-per-call LLM chat (Llama 3.2 3B): Fast, cheap model for classification, extraction, short answers and routing. No API key or account. POST JSON {\"prompt\": \"...\"} or OpenAI-style {\"messages\": [{\"role\": \"user\", \"content\": \"...\"}]}, optional \"system\", \"max_tokens\" (up to 1024), \"temperature\", \"json\": true. Up to about 15,000 characters of English in. Failed calls are not charged.","last_updated":"2026-09-28T10:46:16.526Z","schemes":["exact"]}