Qwen3.5-Flash는 Alibaba Qwen3.5 시리즈의 속도 최적화 비전-언어 모델로, 하이브리드 선형 어텐션과 스파스 MoE 설계를 통해 높은 추론 처리량을 구현합니다. 텍스트 및 멀티모달 작업 모두에서 Qwen3 Flash 대비 유의미한 성능 향상을 보입니다. Context: 1M tokens, 출력: 64K. OpenAI 및 Anthropic 프로토콜로 이용 가능합니다.
컨텍스트 윈도우
1M
최대 출력 토큰
64K
출시일
2026-02-23
기능
비전Function Calling추론프롬프트 캐싱영상 입력
제공업체
Aliyun
지원 프로토콜
openaianthropic
Providers
Aliyun
입력 토큰
$0.1/M
출력 토큰
$0.4/M
캐시 읽기
$0.01/M
캐시 쓰기
$0.125/M
웹 검색
$0.01/R
Protocols
openai
/v1/chat/completions/v1/responsesanthropic
코드 예제
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.ai/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="bailian/qwen3.5-flash",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
벤치마크
LMArena ↗평가 항목: qwen3.5-flash
Qwen: Qwen3.5 Flash은(는) LMArena 텍스트 리더보드(스타일 컨트롤) 종합 카테고리에서 1398점을 기록했으며, 53,387건의 인간 선호 투표를 기반으로 374개 모델 중 129위입니다(업데이트: 2026-07-12).
| 카테고리 | Arena 점수 | 95% 신뢰구간 | 순위 | 투표 수 |
|---|---|---|---|---|
| 종합 | 1398 | 1394–1402 | 374개 중 129위 | 53,387 |
| 고난도 프롬프트 | 1415 | 1411–1420 | 374개 중 134위 | 34,166 |
| 코딩 | 1437 | 1431–1443 | 369개 중 134위 | 15,155 |
| 수학 | 1404 | 1393–1416 | 362개 중 117위 | 2,952 |
| 창작 | 1339 | 1332–1347 | 372개 중 155위 | 8,270 |
| 지시 이행 | 1382 | 1376–1388 | 374개 중 137위 | 16,970 |
| 중국어 | 1451 | 1438–1463 | 344개 중 101위 | 2,528 |
출처: LMArena · CC BY 4.0 · 업데이트 2026-07-12 · 평가 방법 ↗ · 순위는 LMArena 텍스트 리더보드(스타일 컨트롤)의 각 카테고리 내 비교이며, 점수는 제3자의 인간 선호 평가로 OFOX 공식 평가가 아닙니다.
관련 모델
자주 묻는 질문
Qwen: Qwen3.5 Flash은(는) Ofox.ai에서 입력 $0.1/M/백만 토큰, 출력 $0.4/M/백만 토큰입니다. 종량제, 월정액 없음.
Qwen: Qwen3.5 Flash은(는) 1M 토큰의 컨텍스트 윈도우와 최대 64K 토큰 출력을 지원하여, 대용량 문서 처리와 장기 대화가 가능합니다.
base URL을 https://api.ofox.ai/v1로 설정하고 Ofox API Key를 사용하면 됩니다. OpenAI 호환 API — 기존 코드에서 base URL과 API Key만 변경하면 됩니다.
Qwen: Qwen3.5 Flash은(는) 비전, Function Calling, 추론, 프롬프트 캐싱, 영상 입력 기능을 지원합니다. Ofox.ai 통합 API로 모든 기능에 접근하세요.