기본 URL 및 인증
당사의 API는 OpenAI Chat Completions 표준을 따릅니다. 서비스에 접근하려면 클라이언트를 https://api.grokapikey.com/v1로 지정하고 고유한 API 키를 Authorization 헤더에 포함해야 합니다. 이메일과 비밀번호로 가입하는 즉시 키를 생성할 수 있습니다. 키는 생성 시 한 번만 표시되므로 안전하게 저장하십시오. 분실한 경우 대시보드에서 새 키를 다시 생성할 수 있으며, 이전 키는 즉시 무효화됩니다. 체험 계정에는 신용카드 연동이 필요하지 않습니다.
첫 번째 요청
연결성을 확인하기 위해 간단한 텍스트 프롬프트를 보내는 것으로 시작하십시오. 모델 식별자 uncensored과 함께 표준 chat/completions 엔드포인트를 사용하십시오. 다음 예시는 연결을 테스트하기 위한 기본 curl 명령어를 보여줍니다. 이는 인증이 정확하고 서비스가 응답하고 있음을 확인합니다. 그런 다음 이를 특정 애플리케이션 로직에 맞게 조정할 수 있습니다.
이 명령어를 실행하기 전에 YOUR_API_KEY을 실제 키로 바꿉니다.
curl https://api.grokapikey.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK 통합
Python 애플리케이션을 구축하는 경우 공식 openai 라이브러리를 사용하십시오. 클라이언트를 기본 URL과 API 키를 사용하도록 구성하십시오. 이를 통해 무검열 모델에 접근하면서도 익숙한 Python 관용구를 활용할 수 있습니다. 클라이언트는 직렬화 및 스트리밍을 자동으로 처리합니다. 엔드포인트와의 최적의 호환성을 위해 환경에 라이브러리의 최신 버전이 설치되어 있는지 확인하십시오.
from openai import OpenAI
client = OpenAI(base_url="https://api.grokapikey.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node.js SDK 통합
JavaScript 또는 TypeScript 프로젝트의 경우 Node.js OpenAI SDK는 별도의 설정 없이 바로 작동합니다. 구성 객체에서 apiKey 및 baseURL 속성을 설정하십시오. 이렇게 하면 모든 후속 요청이 당사 인프라를 통해 라우팅됩니다. 표준 async/await 패턴을 사용하여 응답을 처리할 수 있습니다. 이 접근 방식은 OpenAI를 통해 프록시하지 않고 직접 API 접근이 필요한 서버 측 애플리케이션이나 엣지 함수에 이상적입니다.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.grokapikey.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
스트리밍 응답
실시간 토큰 생성이 필요한 애플리케이션의 경우 요청 본문에 stream: true를 설정하여 스트리밍을 활성화하십시오. API는 부분 응답의 서버 전송 이벤트(SSE) 스트림을 반환합니다. 이는 사용자의 지각된 지연 시간을 줄이고 생성된 텍스트의 즉각적인 표시를 가능하게 합니다. 각 청크에는 응답의 델타가 포함됩니다. 클라이언트 코드에서 이러한 이벤트를 처리하여 UI를 단계적으로 업데이트하십시오. 스트리밍은 토큰을 정상적으로 소모하며 가격에 영향을 미치지 않습니다.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
한도, 오류 및 컨텍스트
각 API 키는 분당 300개의 요청과 최대 8 MB의 요청 본문 크기로 제한됩니다. 속도 제한을 초과하면 API가 429 상태 코드를 반환합니다. 몇 초 기다린 후 다시 시도하십시오. 401 오류는 유효하지 않거나 회수된 키를 의미하며, 402 오류는 선불 크레딧이 소진되었음을 의미합니다. 이 모델은 입력과 출력을 합쳐 100,000개의 토큰 컨텍스트 창을 지원합니다. 잘림을 피하려면 프롬프트가 이 제한 내에 들어오도록 하십시오. 콘텐츠 필터는 매우 최소한이지만, 미성년자가 포함된 성적 콘텐츠는 단호히 차단됩니다.