검색 결과
"qwen" · 19개 기사 · GeekNews · AI/ML
Qwen3.6-35B-A3B: 에이전틱 코딩 파워, 이제 모두에게 공개
Qwen3.6-35B-A3B: Agentic Coding Power, Now Open to All
알리바바 Qwen 팀이 Qwen3.6-35B-A3B를 오픈소스로 공개. MoE 아키텍처 기반의 에이전틱 코딩용 대규모 언어모델로 범용 활용을 겨냥.
Qwen3.5 모델 양자화, 왜 커뮤니티 버전은 성능이 떨어지나
Qwen3.5 모델 양자화, 왜 커뮤니티 버전은 성능이 떨어지나
커뮤니티가 배포한 MLX 포맷 Qwen3.5 양자화 모델에서 도구 호출 오류와 무의미한 출력 문제가 보고됐다. 양자화 품질과 배포 파이프라인 차이가 성능 격차로 이어지고 있다.
Qwen3.5 모델 양자화, 왜 커뮤니티 버전은 성능이 떨어지나
Qwen3.5 모델 양자화, 왜 커뮤니티 버전은 성능이 떨어지나
커뮤니티에서 배포한 Qwen3.5 양자화 모델의 성능 저하 원인이 기술적으로 규명되었습니다. Unsloth는 150개 이상의 벤치마크 실험을 통해 양자화 과정에서 발생하는 도구 호출 오류와 환각 현상의 원인을 분석하고 해결책을 제시했습니다.
Qwen 3.8 27B는 뛰어나지만 기본 설정에서 추론 시간이 지나치게 김
Qwen 3.8 27B는 뛰어나지만 기본 설정에서 지나치게 오래 추론함
Alibaba Qwen 3.8 27B는 비전 기능, 262,144토큰 컨텍스트, 17GB 양자화 파일로 노트북에서도 코드 작성과 도구 호출, 이미지 분석을 수행함. 다만 기본 추론 강도 xhigh가 단순 요청에도 과도하게 작동해 응답 지연이 커짐.
AI by Hand — 손으로 익히는 AI 수학·알고리즘·아키텍처
AI by Hand — 손으로 익히는 AI 수학·알고리듬·아키텍처
AI의 수학, 알고리즘, 아키텍처를 손으로 따라가며 학습하는 콘텐츠를 소개. Qwen 3.6, Gemma 4, OpenClaw, Google Ironwood TPU 등 최신 모델과 미세조정·강화학습 주제도 다룸.
Qwen 3.8 27B
Qwen 3.8 27B
Qwen3.8-27B-FP8은 이미지·영상 이해와 장기 에이전트 작업을 지원하는 270억 파라미터 밀집형 모델. FP8 양자화 가중치를 제공하며 기본 추론 모드는 요청별로 끌 수 있음.
Qwen3.8-27B, 17~19GB 메모리에서 4-bit 로컬 실행 가능
Qwen3.8-27B, 17~19GB 메모리에서 4-bit 로컬 실행 가능
Qwen3.8-27B가 Unsloth GGUF/NVFP4로 공개되며 개인 장비에서 4-bit 로컬 실행이 가능해짐. 비전, 추론, 256K 컨텍스트를 지원하고 YaRN으로 최대 1M 컨텍스트 확장도 가능.
Qwen3.8-27B 출시 예정
Qwen3.8-27B Upcoming release
한국 시간 8월 15일 00시 공개 예정인 Qwen3.8-27B 모델 소개 글. 벤치마크는 아직 미공개이며 확장 토큰 문맥 길이는 100만 토큰으로 표기됨.
Qwen3.8-2.4T-A95B 오픈 웨이트 공개
Qwen3.8-2.4T-A95B 오픈 웨이트 공개
Qwen이 Max급 최상위 모델 계열의 오픈 웨이트 버전을 공개. 총 2.4T 파라미터 중 95B를 토큰당 활성화하는 MoE 구조로 자체 인프라 운영이 가능해짐.
Unsloth, Qwen3.8 2.4T를 397GB로 줄여 로컬 실행 지원
Unsloth, Qwen3.8 2.4T를 397GB로 줄여 로컬 실행 지원
Unsloth가 Qwen3.8-2.4T-A95B의 GGUF 양자화 모델과 로컬 실행 가이드를 공개. BF16 4.89TB 원본을 Dynamic 1-bit 기준 397GB까지 줄여 로컬 구동 장벽을 낮춤.
Ask GN: Fable 5가 사실상 반쪽짜리 뇌임
Ask GN: Fable 5가 걍 반쪽짜리 뇌임
Fable 5가 간단한 배열 계산을 틀리고도 정답을 우기다가 나중에야 오류를 인정했다는 사용 후기. 로컬 Qwen 3.6 모델과 비교했을 때 코드와 계산 정확성이 크게 떨어졌다는 평가가 제기됐다.
Qwen-Image-3.0 - 풍부한 콘텐츠, 사실적 디테일, 깊이 있는 지식
Qwen-Image-3.0 - 풍부한 콘텐츠, 사실적 디테일, 깊이 있는 지식
Qwen-Image 시리즈의 3세대 이미지 생성 모델로, 보기 좋은 결과물보다 실제 생산성 작업 활용성을 목표로 함. 최대 4.5k 토큰 입력을 처리해 정보량이 많은 레이아웃과 복합 개념 이미지를 생성할 수 있음.
Kimi K3·Qwen 3.8과 Anthropic의 잠재적 균열
Kimi K3·Qwen 3.8과 Anthropic의 잠재적 균열
Moonshot Labs의 Kimi K3와 Alibaba의 Qwen 3.8이 Anthropic Fable 5에 근접한 성능을 보인다는 관측이 나옴. 수주 내 가중치 공개가 예고되며 최첨단 모델 경쟁이 폐쇄형에서 개방형으로 더 확장되는 흐름.
Qwen 3.8 출시
Qwen 3.8 출시
Alibaba Qwen이 2.4조 파라미터 규모의 Qwen3.8을 출시했고, 오픈 웨이트도 곧 공개할 예정이라고 밝힘. 선도 프런티어 모델과의 호환성을 내세우며 현재 가장 강력한 모델 중 하나라고 소개함.
Bonsai 27B - 휴대폰에서 실행되는 27B급 모델
Bonsai 27B - 휴대폰에서 실행되는 27B급 모델
PrismML이 Qwen3.6 27B 기반의 Bonsai 27B를 iPhone 메모리 한도에 맞춰 온디바이스 실행 가능하게 만듦. 도구 호출·비전·컴퓨터 사용을 지원하며, 가중치 압축 방식에 따라 용량과 품질을 달리하는 변형을 제시함.
Ornith-1.0 - 에이전트형 코딩을 위한 자기 개선 오픈소스 모델
Ornith-1.0 - 에이전트형 코딩을 위한 자기 개선 오픈소스 모델
에이전트형 코딩용 자기 개선 오픈소스 모델 Ornith-1.0이 공개됨. 9B부터 397B까지 여러 구성을 제공하며 강화학습 기반으로 솔루션과 스캐폴드까지 함께 개선하도록 설계됨.
Qwen 3.6 27B는 로컬 개발의 최적 지점
Qwen 3.6 27B는 로컬 개발의 최적 지점
Qwen 3.6 27B가 범용 작업에서 로컬 모델의 유력한 선택지로 평가됨. 느리지만 더 강한 dense 모델로서 창작과 코딩에서 제약 조건 준수 성능이 돋보임.
로컬 Qwen은 더 나쁜 Opus가 아니라 다른 도구다
로컬 Qwen은 더 나쁜 Opus가 아니라 다른 도구다
로컬 Qwen 3.6 27B는 고객 데이터나 내부 텔레메트리처럼 클라우드에 올리기 어려운 작업에서 실용적 가치를 보임. 최고 성능 모델과의 점수 경쟁보다 고정 비용, 개인정보 보호, 벤더 리스크 완화가 핵심 장점으로 제시됨.
Qwen3.7-Max: 에이전트 프런티어
Qwen3.7-Max: 에이전트 프런티어
Qwen3.7-Max는 코딩, 디버깅, 사무 자동화, 장기 자율 실행을 겨냥한 에이전트 중심 독점 모델로 소개됨. Terminal Bench 2.0-Terminus와 GPQA Diamond 등에서 경쟁력 있는 성능을 제시함.