검색 결과
"qwen" · 49개 기사
Qwen3.8-Max: A New Bar for Coding and Cowork
Qwen3.8-Max: A New Bar for Coding and Cowork
Qwen 3.8 27B
Qwen 3.8 27B
Qwen 3.8 27B 모델이 공개됨. Hugging Face를 통해 FP8 가중치가 배포되며 오픈소스 LLM 라인업이 확장됨.
Qwen 3.8
Qwen 3.8
Alibaba Qwen 계열의 새 모델 버전이 공개됨. 대형 언어모델 라인업 업데이트 소식.
Qwen3.7-Max: 에이전트 프런티어
Qwen3.7-Max: The Agent Frontier
Qwen3.7-Max의 에이전트 성능과 활용 사례를 강조. 도구 사용, 추론, 장기 작업 수행에서의 성능을 전면에 내세움.
Qwen3.6-27B: 27B Dense Model의 플래그십급 코딩 성능
Qwen3.6-27B: Flagship-Level Coding in a 27B Dense Model
27B dense model로 플래그십급 코딩 성능을 내세움. 경량 파라미터 대비 개발 작업용 경쟁력을 강조.
Qwen-Image-3.0: 풍부한 콘텐츠, 진짜 같은 디테일, 깊은 지식
Qwen-Image-3.0: Rich Content, Authentic Details, Deep Knowledge
Qwen의 이미지 생성 모델 3.0 버전을 소개. 풍부한 장면 구성과 사실적인 디테일, 지식 기반 표현을 강조.
Qwen3.6-Max-Preview: 더 똑똑하고 더 날카롭지만 여전히 진화 중
Qwen3.6-Max-Preview: Smarter, Sharper, Still Evolving
Qwen3.6-Max-Preview가 향상된 추론과 응답 품질을 내세우며 공개됨. 프리뷰 단계인 만큼 추가 개선 여지가 남아 있음.
로컬 개발을 위한 Qwen 3.6 27B가 적정 지점
Qwen 3.6 27B is the sweet spot for local development
Qwen 3.6 27B를 로컬 개발용으로 쓰기 좋은 균형점으로 평가. 성능과 실행 부담 사이의 타협안으로 주목.
Qwen 3.8 27B는 뛰어나지만 기본값이 과도한 추론에 치우친다
Qwen 3.8 27B is excellent, but it defaults to overthinking things
Qwen 3.8 27B 모델의 성능은 높지만 기본 동작이 과도한 추론에 기운다는 평가. 속도와 응답 효율을 위한 튜닝 필요성이 부각됨.
Qwen3.8-2.4T
Qwen3.8-2.4T
Qwen의 새로운 2.4T 파라미터급 모델 공개. Hugging Face에 A95B 변형이 올라옴.
Qwen3.8 Max now ranked as the best overall model by agentic index
Qwen3.8 Max now ranked as the best overall model by agentic index
Qwen3.8 27B, Artificial Analysis에서 52점 기록
Qwen3.8 27B scores 52 on Artificial Analysis
Qwen3.8 27B가 Artificial Analysis 벤치마크에서 52점을 기록했다. 오픈 모델 성능 경쟁에서 상위권 추격 흐름이 이어지는 모습.
Kimi K3, Qwen 3.8, 그리고 Anthropic의 (잠재적) 흔들림
Kimi K3, Qwen 3.8, and Anthropic's (Potential) Unravelling
Kimi K3와 Qwen 3.8의 부상으로 프론티어 모델 경쟁 구도가 재편되는 흐름을 분석. Anthropic의 시장 지위와 경제성이 흔들릴 가능성을 짚음.
Orthrus-Qwen3: Qwen3에서 최대 7.8배 tokens/forward, 동일한 출력 분포
Orthrus-Qwen3: up to 7.8×tokens/forward on Qwen3, identical output distribution
Orthrus-Qwen3가 Qwen3에서 forward당 처리 토큰 수를 최대 7.8배까지 늘리면서 출력 분포를 동일하게 유지한다고 주장함. LLM 추론 효율 개선을 겨냥한 최적화 기법임.
Qwen-AgentWorld: 일반 에이전트를 위한 언어 세계 모델
Qwen-AgentWorld: Language World Models for General Agents
일반 에이전트를 위해 언어 기반 세계 모델을 제안하는 연구. 에이전트가 환경 상태와 행동 결과를 더 잘 예측하도록 설계된 접근임.
Qwen-Robot Suite: 물리 세계 지능을 위한 파운데이션 모델 세트
Qwen-Robot Suite: A Foundation Model Suite for Physical World Intelligence
Qwen-Robot Suite를 공개해 로봇과 물리 환경 이해를 위한 파운데이션 모델 구성을 제시. 실세계 지능과 로보틱스 적용을 겨냥함.
Qwen 3.7 Preview
Qwen 3.7 Preview
Alibaba의 Qwen이 새 프리뷰 버전을 공개했다. 차세대 모델 성능과 기능 개선을 예고하는 발표다.
Local Qwen은 Opus의 하위호환이 아니라 다른 도구
Local Qwen isn't a worse Opus, it's a different tool
로컬 Qwen을 Claude Opus의 대체재가 아니라 용도가 다른 도구로 보는 관점을 제시. 비용, 지연시간, 실행 환경에 따라 모델 선택 기준이 달라진다는 점을 강조.
RTX 5080와 RTX 3090 세팅: Qwen 3.6 27B Q8에서 80 tok/s
RTX 5080 and RTX 3090 Setup: 80 Tok/s on Qwen 3.6 27B Q8
RTX 5080과 RTX 3090 조합으로 Qwen 3.6 27B Q8 추론에서 초당 80 토큰 속도를 기록. 하드웨어 세팅과 성능 벤치마크를 공유한 글.
Show HN: Run an 80B Qwen in 4.3 GB of RAM on a Mac, and a 35B on an iPhone
Show HN: Run an 80B Qwen in 4.3 GB of RAM on a Mac, and a 35B on an iPhone
Rio de Janeiro 시정부 모델 Rio3.5, 최근 벤치마크에서 Qwen3.7 제쳐
Rio de Janeiro's city government model Rio3.5 beats Qwen3.7 in recent benchmarks
Rio de Janeiro 시정부 모델 Rio3.5가 최근 벤치마크에서 Qwen3.7보다 높은 성능을 기록했다는 주장. 지역 모델의 성능 경쟁력이 다시 부각됨.
Qwen 3:0.6B 같은 로컬 LLM을 질문 분류에 미세조정했더니 좋은 결과
Good results fine tuning a local LLM like Qwen 3:0.6B to categorize questions
작은 로컬 LLM을 질문 분류 작업에 미세조정해 유의미한 성능을 얻은 사례를 소개. 경량 모델도 적절한 데이터와 튜닝으로 실용적인 분류기를 만들 수 있음을 보여줌.
Qwen3.6-35B-A3B: 에이전틱 코딩 파워, 이제 모두에게 공개
Qwen3.6-35B-A3B: Agentic Coding Power, Now Open to All
알리바바 Qwen 팀이 Qwen3.6-35B-A3B를 오픈소스로 공개. MoE 아키텍처 기반의 에이전틱 코딩용 대규모 언어모델로 범용 활용을 겨냥.
Qwen3.5 모델 양자화, 왜 커뮤니티 버전은 성능이 떨어지나
Qwen3.5 모델 양자화, 왜 커뮤니티 버전은 성능이 떨어지나
커뮤니티가 배포한 MLX 포맷 Qwen3.5 양자화 모델에서 도구 호출 오류와 무의미한 출력 문제가 보고됐다. 양자화 품질과 배포 파이프라인 차이가 성능 격차로 이어지고 있다.
Qwen3.5 모델 양자화, 왜 커뮤니티 버전은 성능이 떨어지나
Qwen3.5 모델 양자화, 왜 커뮤니티 버전은 성능이 떨어지나
커뮤니티에서 배포한 Qwen3.5 양자화 모델의 성능 저하 원인이 기술적으로 규명되었습니다. Unsloth는 150개 이상의 벤치마크 실험을 통해 양자화 과정에서 발생하는 도구 호출 오류와 환각 현상의 원인을 분석하고 해결책을 제시했습니다.
Qwen 3.8 27B는 뛰어나지만 기본 설정에서 추론 시간이 지나치게 김
Qwen 3.8 27B는 뛰어나지만 기본 설정에서 지나치게 오래 추론함
Alibaba Qwen 3.8 27B는 비전 기능, 262,144토큰 컨텍스트, 17GB 양자화 파일로 노트북에서도 코드 작성과 도구 호출, 이미지 분석을 수행함. 다만 기본 추론 강도 xhigh가 단순 요청에도 과도하게 작동해 응답 지연이 커짐.
AI by Hand — 손으로 익히는 AI 수학·알고리즘·아키텍처
AI by Hand — 손으로 익히는 AI 수학·알고리듬·아키텍처
AI의 수학, 알고리즘, 아키텍처를 손으로 따라가며 학습하는 콘텐츠를 소개. Qwen 3.6, Gemma 4, OpenClaw, Google Ironwood TPU 등 최신 모델과 미세조정·강화학습 주제도 다룸.
Qwen 3.8 27B
Qwen 3.8 27B
Qwen3.8-27B-FP8은 이미지·영상 이해와 장기 에이전트 작업을 지원하는 270억 파라미터 밀집형 모델. FP8 양자화 가중치를 제공하며 기본 추론 모드는 요청별로 끌 수 있음.
Qwen3.8-27B, 17~19GB 메모리에서 4-bit 로컬 실행 가능
Qwen3.8-27B, 17~19GB 메모리에서 4-bit 로컬 실행 가능
Qwen3.8-27B가 Unsloth GGUF/NVFP4로 공개되며 개인 장비에서 4-bit 로컬 실행이 가능해짐. 비전, 추론, 256K 컨텍스트를 지원하고 YaRN으로 최대 1M 컨텍스트 확장도 가능.
Qwen3.8-27B 출시 예정
Qwen3.8-27B Upcoming release
한국 시간 8월 15일 00시 공개 예정인 Qwen3.8-27B 모델 소개 글. 벤치마크는 아직 미공개이며 확장 토큰 문맥 길이는 100만 토큰으로 표기됨.
Qwen3.8-2.4T-A95B 오픈 웨이트 공개
Qwen3.8-2.4T-A95B 오픈 웨이트 공개
Qwen이 Max급 최상위 모델 계열의 오픈 웨이트 버전을 공개. 총 2.4T 파라미터 중 95B를 토큰당 활성화하는 MoE 구조로 자체 인프라 운영이 가능해짐.
Unsloth, Qwen3.8 2.4T를 397GB로 줄여 로컬 실행 지원
Unsloth, Qwen3.8 2.4T를 397GB로 줄여 로컬 실행 지원
Unsloth가 Qwen3.8-2.4T-A95B의 GGUF 양자화 모델과 로컬 실행 가이드를 공개. BF16 4.89TB 원본을 Dynamic 1-bit 기준 397GB까지 줄여 로컬 구동 장벽을 낮춤.
Ask GN: Fable 5가 사실상 반쪽짜리 뇌임
Ask GN: Fable 5가 걍 반쪽짜리 뇌임
Fable 5가 간단한 배열 계산을 틀리고도 정답을 우기다가 나중에야 오류를 인정했다는 사용 후기. 로컬 Qwen 3.6 모델과 비교했을 때 코드와 계산 정확성이 크게 떨어졌다는 평가가 제기됐다.
Qwen3.8 Max, Agentic Index 종합 1위
Qwen3.8 Max가 도구 사용·계획·자율성·복합 문제 해결을 측정하는 Artificial AnalysisAgentic Index에서 종합 최고 모델로 평가됨Agentic Index는 특정 역량과 산업별 성능을 측정하는 Capability Indices 중 하나로, 총24개 모델을 비교함...
미국의 오픈 모델 패러독스
미국은 폐쇄형 프런티어 모델을 선도하지만 자국 모델의 출력을 합법적으로 학습에 활용하기 어려워,오픈 모델 계층에서는 중국 의존이 커지는 역설(Paradox)에 놓임신규 오픈 모델 미세조정·변형에서Qwen의 점유율은 2024년 1월 1%에서 2026년 2월 69%로 상승했...
Qwen3.8-Max: 코딩과 협업의 새로운 기준
Qwen3.5 아키텍처를 확장한Qwen3.8-Max가 2.4조 파라미터/활성 950억 파라미터 규모로 출시. Qwen 최초의 Max급 모델 가중치를 다음 주오픈소스로 공개할 예정코딩 계획을 그대로 수행하는 데 그치지 않고 실행 결과를 다음 시도에 반영하는자기 진화 ...
Isopolis - 샌프란시스코를 담은 등각 투영 픽셀 지도
Isopolis는 샌프란시스코의 동네와 명소부터 기업, 음식점, 이벤트까지 둘러볼 수 있는 등각 투영 픽셀 지도임Qwen Image Edit 2511을 3D Google Maps 렌더링으로 미세 조정해 이미지를 제작했으며, isometric.nyc와 드라마 Silicon Valley에서 영감을 받음...
Qwen-Image-3.0 - 풍부한 콘텐츠, 사실적 디테일, 깊이 있는 지식
Qwen-Image-3.0 - 풍부한 콘텐츠, 사실적 디테일, 깊이 있는 지식
Qwen-Image 시리즈의 3세대 이미지 생성 모델로, 보기 좋은 결과물보다 실제 생산성 작업 활용성을 목표로 함. 최대 4.5k 토큰 입력을 처리해 정보량이 많은 레이아웃과 복합 개념 이미지를 생성할 수 있음.
OpenCode의 성가시고 불안한 문제들
OpenCode의 성가시고 불안한 문제들
오픈소스 AI 코딩 에이전트 OpenCode를 로컬 Qwen3.6-27B로 시험한 결과, 도구 품질과 보안 설계가 실사용 중단 수준으로 지적됨. AGENTS.md 재로딩과 컨텍스트 가지치기, 모드 전환 등이 프롬프트 캐시와 동작 안정성을 해친다는 문제를 짚었다.
Kimi K3·Qwen 3.8과 Anthropic의 잠재적 균열
Kimi K3·Qwen 3.8과 Anthropic의 잠재적 균열
Moonshot Labs의 Kimi K3와 Alibaba의 Qwen 3.8이 Anthropic Fable 5에 근접한 성능을 보인다는 관측이 나옴. 수주 내 가중치 공개가 예고되며 최첨단 모델 경쟁이 폐쇄형에서 개방형으로 더 확장되는 흐름.
Qwen 3.8 출시
Qwen 3.8 출시
Alibaba Qwen이 2.4조 파라미터 규모의 Qwen3.8을 출시했고, 오픈 웨이트도 곧 공개할 예정이라고 밝힘. 선도 프런티어 모델과의 호환성을 내세우며 현재 가장 강력한 모델 중 하나라고 소개함.
Bonsai 27B - 휴대폰에서 실행되는 27B급 모델
Bonsai 27B - 휴대폰에서 실행되는 27B급 모델
PrismML이 Qwen3.6 27B 기반의 Bonsai 27B를 iPhone 메모리 한도에 맞춰 온디바이스 실행 가능하게 만듦. 도구 호출·비전·컴퓨터 사용을 지원하며, 가중치 압축 방식에 따라 용량과 품질을 달리하는 변형을 제시함.
Ornith-1.0 - 에이전트형 코딩을 위한 자기 개선 오픈소스 모델
Ornith-1.0 - 에이전트형 코딩을 위한 자기 개선 오픈소스 모델
에이전트형 코딩용 자기 개선 오픈소스 모델 Ornith-1.0이 공개됨. 9B부터 397B까지 여러 구성을 제공하며 강화학습 기반으로 솔루션과 스캐폴드까지 함께 개선하도록 설계됨.
Qwen 3.6 27B는 로컬 개발의 최적 지점
Qwen 3.6 27B는 로컬 개발의 최적 지점
Qwen 3.6 27B가 범용 작업에서 로컬 모델의 유력한 선택지로 평가됨. 느리지만 더 강한 dense 모델로서 창작과 코딩에서 제약 조건 준수 성능이 돋보임.
Cafe24, LLM Router 공개
Cafe24, LLM Router 공개
Claude, Gemini, Qwen, Llama, DeepSeek 등 100개 이상 모델을 단일 엔드포인트로 호출하는 통합 LLM 인프라를 공개함. OpenAI 호환 API로 provider별 명세, 재시도, 스트리밍 차이를 한 번에 흡수하도록 설계.
로컬 Qwen은 더 나쁜 Opus가 아니라 다른 도구다
로컬 Qwen은 더 나쁜 Opus가 아니라 다른 도구다
로컬 Qwen 3.6 27B는 고객 데이터나 내부 텔레메트리처럼 클라우드에 올리기 어려운 작업에서 실용적 가치를 보임. 최고 성능 모델과의 점수 경쟁보다 고정 비용, 개인정보 보호, 벤더 리스크 완화가 핵심 장점으로 제시됨.
Ask HN: 일상적인 코딩에서 Claude/GPT를 로컬 모델로 대체한 사람이 있나요?
Ask HN: 일상적인 코딩에서 Claude/GPT를 로컬 모델로 대체한 사람이 있나요?
데이터 프라이버시와 비용 절감을 이유로 클라우드 LLM 대신 로컬 모델을 쓰는 개발자 사례가 공유됨. 컨테이너화된 오프라인 코딩 하니스로 외부 네트워크 호출 없이 작업하는 흐름이 확산 중.
Alibaba Cloud Quen 컨퍼런스 2026 싱가포르 키노트 요약
알리바바 클라우드 Quen 컨퍼런스 2026 싱가포르 키노트 요약
싱가포르에서 열린 첫 Quen 컨퍼런스 키노트가 Alibaba Cloud의 에이전틱 AI 전환을 공식화함. 모델, 인프라, 도구, 생태계 전반의 변화가 파트너사 발표와 함께 제시됨.
Qwen3.7-Max: 에이전트 프런티어
Qwen3.7-Max: 에이전트 프런티어
Qwen3.7-Max는 코딩, 디버깅, 사무 자동화, 장기 자율 실행을 겨냥한 에이전트 중심 독점 모델로 소개됨. Terminal Bench 2.0-Terminus와 GPQA Diamond 등에서 경쟁력 있는 성능을 제시함.