검색 결과

"openai" · 7개 기사 · Cloud/Infra

1
해커뉴스Cloud/Infra3422442026-06-24

OpenAI, Broadcom이 제작한 첫 맞춤형 칩 공개

OpenAI unveils its first custom chip, built by Broadcom

OpenAI가 Broadcom이 제작한 첫 맞춤형 칩을 공개. 대규모 AI 연산을 위한 하드웨어 내재화 전략을 강화하는 행보.

2
해커뉴스Cloud/Infra247902026-06-02

OpenAI frontier models와 Codex, 이제 AWS에서 사용 가능

OpenAI frontier models and Codex are now available on AWS

OpenAI의 frontier models와 Codex가 AWS에서 제공되기 시작함. 클라우드 고객은 AWS 환경에서 OpenAI 모델을 바로 연동할 수 있게 됨.

3
GeekNewsCloud/Infra512026-04-30

GoModel - Go로 작성된 고성능 AI 게이트웨이

GoModel - Go로 작성된 고성능 AI 게이트웨이

LiteLLM 유사 경량 AI 게이트웨이를 Go 단일 바이너리로 구현해 컨테이너 이미지 크기와 콜드스타트를 줄인 프로젝트. OpenAI, Anthropic, Gemini 등 여러 모델 제공자를 통합 지원.

4
GeekNewsCloud/Infra2026-08-14

GPT-5.6 Sol을 초당 750토큰으로 가속하는 Ultrafast Mode

GPT-5.6 Sol을 초당 750토큰으로 가속하는 Ultrafast Mode

Cerebras와 OpenAI가 API의 새 서비스 계층인 Ultrafast Mode를 일부 고객에게 제한 공개함. GPT-5.6 Sol에서 품질 저하 없이 초당 최대 750개 출력 토큰을 제공한다.

5
GeekNewsCloud/Infra2026-07-16

Show GN: Claude 공식 업타임 99.55%인데 6월 인시던트 45건 — 6월 AI 서비스 신뢰도 리포트

Show GN: Claude 공식 업타임 99.55%인데 6월 인시던트 45건 — 6월 AI 서비스 신뢰도 리포트

AIWatch가 Claude, OpenAI, Gemini 등 41개 AI 서비스의 업타임, 인시던트, 지연을 실시간 모니터링하는 6월 리포트를 공개함. Claude는 공식 업타임 99.55%였지만 6월 인시던트 45건이 보고됨.

6
GeekNewsCloud/Infra2026-06-25

Cafe24, LLM Router 공개

Cafe24, LLM Router 공개

Claude, Gemini, Qwen, Llama, DeepSeek 등 100개 이상 모델을 단일 엔드포인트로 호출하는 통합 LLM 인프라를 공개함. OpenAI 호환 API로 provider별 명세, 재시도, 스트리밍 차이를 한 번에 흡수하도록 설계.

7
GeekNewsCloud/Infra2026-06-02

OpenAI 프런티어 모델과 Codex가 이제 AWS에서 제공됨

OpenAI 프런티어 모델과 Codex가 이제 AWS에서 제공됨

OpenAI 프런티어 모델과 Codex가 AWS에서 정식 제공됨. 기존 보안, 컴플라이언스, 조달, 청구, 거버넌스 워크플로 안에서 프런티어 AI를 프로덕션에 도입할 수 있음.