AI 모델 가격 인하 경쟁 격화...오픈AI·메타 최저가 공세
오픈AI가 GPT-5.6 Sol 가격을 입력 20%·출력 33% 인하하고 메타는 뮤즈 스파크 1.2를 오픈라우터 최저가로 내놓는 등 프론티어 모델 가격 인하 경쟁이 이어지고 있다. 출처 불명의 'Ox 알파'까지 하루 100조 토큰을 무상 제공하며 개발자·기업 고객 확보 경쟁이 한층 격화되는 모습이다.
근거 기사 6건
-
메타, '뮤즈 스파크 1.2' 오픈라우터에 현존 최저가로 할인
국내
AI타임스
메타가 오픈라우터에서 자사 플래그십 모델 '뮤즈 스파크 1.2'의 컨트리뷰터 요금제를 입력 100만 토큰당 0.10달러, 출력 0.20달러로 출시했다. 앞서 오픈AI도 오픈라우터에서 최신 모델을 반값에 제공하며 개발자·기업 고객 확보 경쟁을 촉발했고, 메타는 이보다 더 낮은 가격으로 대응했다.
-
GPT-5.6 Sol 가격 20% 인하
국내
긱뉴스(GeekNews)
GPT-5.6 제품군 최상위 모델 GPT-5.6 Sol의 API 가격이 100만 토큰당 입력 $4(20%↓), 출력 $20(33%↓)로 인하되며, 프로모션가는 최소 2026년 11월 21일까지 유지된다. 컨텍스트 창 105만 토큰, 최대 출력 12만8천 토큰이며, 입력이 27만2천 토큰을 넘으면 전체 요청에 입력 2배·출력 1.5배 요율이 적용된다.
-
GPT-5.6 Sol 모델 | OpenAI API
국내
긱뉴스(GeekNews)
OpenAI가 GPT-5.6 제품군 최상위 모델 'GPT-5.6 Sol'을 공개했다. 컨텍스트 창 105만 토큰, 최대 출력 12만8천 토큰을 지원하며, 가격은 100만 토큰당 입력 $4·캐시입력 $0.40·출력 $20으로 기존보다 입력 20%, 출력 33% 저렴해졌다(프로모션 가격은 2026년 11월 21일까지 유지). 단, 입력이 27만2천 토큰을 넘으면 요청 전체에 입력 2배·출력 1.5배 할증이 적용되며, 스트리밍·함수호출·MCP 등 주요 API 도구는 지원하나 파인튜닝·오디오·비디오는 미지원이다.
-
익명 'Ox 알파' 등장…코딩 성능·100조 토큰 무상 제공에 '발칵'
국내
AI타임스
오픈라우터에 출처 불명의 스텔스 모델 'Ox 알파'가 등장해 일주일간 하루 100조 토큰을 무상 제공하며 기존 최상위 모델들과 맞먹는 코딩·추론 성능을 보여 업계를 술렁이게 하고 있다. 최대 100만 토큰 컨텍스트와 13만1072 토큰 출력을 지원해 '제2의 딥시크 파동' 가능성이 거론된다.
-
GPT 5.6 Sol 20% price reduction
국내
Hacker News
GPT-5.6 Sol의 API 가격이 입력 토큰 기준 20%, 출력 토큰 기준 33% 인하되어 100만 토큰당 입력 $4·출력 $20으로 조정됐다(직전 세대 대비 캐시 입력 $0.40). 이 프로모션 가격은 최소 2026년 11월 21일까지 유지되며, 컨텍스트 윈도우 105만 토큰·최대 출력 12.8만 토큰을 지원한다.
-
오픈AI, 'GPT-5.6 솔'까지 가격 일시 인하...코덱스 사용자 2천만 돌파
국내
AI타임스
오픈AI가 최상위 모델 GPT-5.6 솔의 API·크레딧 가격을 향후 3개월간 20% 이상 한시 인하해 개발자·기업 고객을 겨냥한 B2B 공세를 강화했다. 인하 후 가격은 100만 토큰당 입력 4달러/출력 20달러이며, 챗GPT 구독 요금제에는 적용되지 않는다. 함께 코딩 도구 코덱스 사용자가 2천만 명을 돌파했다고 밝혔다.
코딩·자율 에이전트, 모델보다 '하네스'가 경쟁력 좌우
구글 안티그래비티 원격제어, 엔비디아 AVO, Munder Difflin 등 장시간 자율 실행을 관리하는 에이전트 하네스 기술이 잇따라 등장하며 모델 성능보다 제어 구조가 실전 성능을 가른다는 인식이 확산되고 있다. Anthropic의 Computer Use·Skills/Files API 정식 출시와 업스테이지 코드 솔라 등 코딩 에이전트 실용화 사례도 늘고 있다.
근거 기사 7건
-
JIT Compiling Code in 5μs
국내
Hacker News
AI 보조로 어셈블리를 직접 타겟팅하는 JIT 컴파일러를 손쉽게 구현할 수 있게 되면서, 기존 DB들이 LLVM이나 C/C++ 코드 생성 방식(높은 컴파일 시간이 한계)에 의존하던 문제를 우회할 새로운 기회가 열렸다. Rust 기반 신생 DB 'pgrust'는 이 방식으로 SQL 쿼리를 약 5마이크로초 만에 JIT 컴파일해, 일부가 아닌 모든 쿼리를 JIT 처리할 수 있게 됐다.
-
구글, '안티그래비티' 원격 제어 출시..."이동 중에도 AI 개발 계속"
국내
AI타임스
구글이 AI 개발 환경 '안티그래비티'에 웹브라우저 기반 에이전트 원격 제어 기능을 추가해, 개발자가 컴퓨터 앞을 떠나 있어도 코딩 에이전트의 리팩터링·테스트·빌드 오류 진단 작업을 모니터링하고 제어할 수 있게 됐다. 작업 범위 확대로 에이전트 실행 시간이 길어지는 문제를 해결하기 위한 조치다.
-
Munder Difflin - 나를 복제한 직원들로 사무실을 운영하는 에이전트 하네스
국내
긱뉴스(GeekNews)
Munder Difflin은 Claude Code, Codex, Copilot 등 12개 에이전트 CLI를 감싸 사용자의 업무 방식·도구·기억을 공유하는 복제 에이전트들을 로컬에서 상시 실행하는 무료 오픈소스 하네스로, 팀원별 복제 에이전트가 서로 메시지를 주고받아 업무를 인계하고 PR까지 열 수 있다. 개인용은 MIT 무료, PRO는 월 $39(24시간 샌드박스), Teams는 좌석당 월 $149로 암호화 팀 네트워크와 공유 지식 기반을 제공하며, 코드·키는 기본적으로 사용자 컴퓨터에 남는다.
-
"LLM보다 하네스가 핵심"…엔비디아 AVO, 장기 자율 AI 에이전트 가능성 입증
국내
AI타임스
엔비디아가 별도 지시 없이 낯선 환경을 탐색·해결하는 범용 에이전트 'AVO'로 ARC-AGI-3 벤치마크에서 성과를 냈으며, 핵심 요인은 LLM 자체가 아니라 계획·실행·시행착오를 장기간 관리하는 '하네스' 구조였다고 밝혔다. 이는 모델 성능 경쟁을 넘어 에이전트 제어 아키텍처가 자율 AI 성능을 좌우하는 요소로 부상했음을 시사한다.
-
“솔라 프로4로 코드 리뷰 가능”…업스테이지, ‘코드 솔라’ 공개
국내
AI타임스
업스테이지가 자사 '솔라 프로4' 모델 기반 AI 코드 리뷰어 '코드 솔라'를 공개했다. 깃허브 등 코드 저장소를 연결해 검토를 요청하면 자동으로 버그·보안·성능 이슈를 파악해 해당 코드 라인에 수정 제안을 남기는 방식이다.
-
소프트웨어가 더 이상 느릴 이유는 없다
국내
긱뉴스(GeekNews)
코딩 에이전트가 성능 최적화 비용을 크게 낮추면서, FRE 검색 엔진은 네이티브 AOT 컴파일 도입으로 장시간 검색 2~4배, 홀드아웃 쿼리 약 7% 속도 향상을 몇 분의 작업만으로 달성했다. Azul 게임 AI는 에이전트가 멀티스레딩과 반복 재작성·검증을 맡아 훨씬 적은 시간·컴퓨팅으로 기존 최강 AI를 넘어섰으며(속도 2배당 약 100 Elo 상승), ripgrep 개인 사용 패턴 맞춤 최적화도 홀드아웃에서 2% 개선을 보였다. 다만 과적합 위험이 있고 현재 모델은 벤치마크 설계를 사람이 해줘야 하는 한계가 있어, 고객·워크로드별 동적 맞춤 소프트웨어가 현실적 선택지로 부상하고 있다는 분석이다.
-
Computer Use와 Skills/Files API로 프로덕션 에이전트 구축하기
국내
긱뉴스(GeekNews)
Anthropic이 Claude Platform의 Computer Use·Browser Use Tool·Skills API·Files API를 정식 출시해 소프트웨어 조작부터 조직 지식 적용, 파일 생성까지 하나의 에이전트 워크플로로 통합했다. Computer Use는 한 턴에서 여러 동작을 처리하도록 개선됐고, Files API는 자동 만료·5배 높은 요청 한도·조직당 1TB 저장공간을 지원한다. 보험 청구 워크플로 테스트에서 최장 작업 시간이 32분에서 13분으로, 작업당 비용은 약 30% 줄었고 완료율 100%를 달성했다.
앤트로픽, 138조 IPO 추진하며 엔비디아 의존도 낮추기 착수
앤트로픽이 최대 1000억달러(약138조원) 조달, 기업가치 2조달러를 목표로 미국 IPO를 준비 중이며 구글 TPU 개발 주역을 영입해 자체 AI 칩 개발도 가속화하고 있다. 다만 IPO 서류에는 데이터센터 반발 여론과 오픈소스발 마진 압박이 핵심 리스크 요인으로 명시될 예정이다.
근거 기사 3건
-
앤트로픽, IPO서 138조 조달 목표…역대 최대 상장 기록 경신 전망
국내
AI타임스
앤트로픽이 미국 IPO를 통해 최대 1000억달러(약 138조원) 조달을 목표로 하며, 성사 시 기업가치는 2조달러(약 2760조원)로 평가될 전망이다. 이는 지난 5월 투자 라운드 평가액 9650억달러의 두 배를 넘는 수준이며, 역대 최대 공모 조달 기록 경신이 예상된다.
-
Anthropic IPO filing will show AI backlash as a risk factor, sources say
국내
Hacker News
Anthropic가 IPO 예비 프로스펙터스에서 데이터센터 반발 여론을 핵심 리스크 요인으로 명시할 예정이며, CFO 크리슈나 라오는 오픈소스 모델발 마진 압박과 데이터센터 건설 둔화 가능성에 대한 투자자 질문을 받고 있다. 6월 비밀리에 상장 신청을 한 Anthropic은 약 2조 달러 밸류에이션을 목표로 하며, 이는 SpaceX의 857억 달러 조달 기록을 넘어설 수 있다는 관측이다.
-
앤트로픽, 구글 TPU 주역 영입…자체 AI 칩 개발 가속
국내
AI타임스
앤스로픽이 구글 TPU 사업을 2013~2022년 창립·주도하며 7세대 칩 개발을 이끈 아미르 살렉을 자체 컴퓨팅 팀에 영입했다. 살렉은 이전에 엔비디아에서 SoC 설계 조직을 세웠고 구글 퇴사 후에는 사모펀드 세르베루스 캐피털 매니지먼트 수석 전무를 지냈다. 이번 영입은 앤스로픽이 엔비디아·구글 의존도를 낮추고 자체 AI 반도체 개발을 가속화하려는 행보로 풀이된다.
DRAM 품귀로 AI 서버값 급등...빅테크·스마트폰 시장 동반 충격
DRAM 수급난으로 엔비디아 AI 서버 가격이 최대 15% 이상 인상되며 빅테크의 데이터센터 확장 비용 부담이 커지고 있다. 같은 메모리 가격 급등 여파로 올해 글로벌 스마트폰 출하량도 14% 가까이 줄어들 전망이어서, 반도체 공급난이 AI·모바일 산업 전반에 파급되고 있다.
근거 기사 2건
-
메모리 폭등에 엔비디아 서버 최대 15% 인상...빅테크 부담 가중
국내
AI타임스
DRAM 수급난으로 엔비디아 AI 서버 가격이 내년 초 출하분부터 최대 15% 이상 인상되며, 베라 루빈·그레이스 블랙웰 탑재 시스템도 영향권이다. 마이크로소프트·구글·오라클 등 대형 데이터센터 운영사가 서버 제조사로부터 이 같은 인상 통보를 받았고, 삼성전자·SK하이닉스·마이크론의 증산도 AI발 고성능 메모리 수요를 따라가지 못하는 상황이다. 이는 빅테크의 AI 데이터센터 확장 비용 부담을 키우고, 자체 AI 칩 개발을 통한 엔비디아 의존도 축소 시도에도 메모리 공급망 안정성이 관건으로 떠올랐다.
-
카운터포인트 "올해 스마트폰 출하량 14%↓...삼성, 유일한 출하량 증가 전망"
국내
AI타임스
카운터포인트리서치는 올해 글로벌 스마트폰 출하량이 메모리 반도체 가격 급등과 경기 침체로 전년 대비 14.3% 감소할 것으로 전망했다. 저가 제품 중심의 중국 업체들이 특히 큰 타격을 받는 반면, 삼성전자는 주요 업체 중 유일하게 출하량이 증가하며 세계 1위 자리를 유지할 것으로 예상된다.
AI 기업 대상 규제·소송 압박에 '고지 없는 성능 저하' 논란까지
플로리다주가 챗GPT를 '공공 위해 요소'로 규정해달라며 오픈AI와 알트먼을 정조준하고, 오픈AI도 해킹 사고를 계기로 캘리포니아 AI 안전법 지지로 돌아서는 등 규제 압박이 커지고 있다. 동시에 Anthropic이 Claude Code의 추론 강도를 사용자 고지 없이 몰래 낮춘 정황이 확인되며 AI 서비스 신뢰 문제도 불거지고 있다.
근거 기사 4건
-
"AI 모델 해킹 사고 때문?"…오픈AI, 캘리포니아 AI 규제법 지지로 급선회
국내
AI타임스
오픈AI가 캘리포니아 AI 안전법안 SB 53에 대해 기존 반대 입장을 뒤집고, 훈련·평가 중인 최첨단 모델 모니터링 의무화 등 안전장치를 더 강화해야 한다는 입장으로 급선회했다. 최근 AI 모델 관련 해킹 사고가 배경으로 지목되며, 모델 개발 전 주기에 걸친 사이버 보안 보호 강화도 함께 요구했다.
-
Anthropic, Claude Code의 추론 노력 수준 축소를 A/B 테스트하는 것으로 보임
국내
긱뉴스(GeekNews)
Claude Code 2.1.236 이상 일부 Fable 5 세션에서 Anthropic이 서버 측 A/B 테스트로 추론 노력(reasoning effort) 수준을 임의로 낮추는 정황이 포착됐다. high를 설정해도 system<reasoning_effort>medium</reasoning_effort>이 삽입되거나 실제로 low reasoning으로 실행되는 사례가 보고됐으며, 이전 버전과 Opus 5는 대상에서 제외된다. 한 사용자는 품질 저하 상태에서 10일간 토큰 400달러를 소모했다고 밝히는 등, 고지 없는 유료 설정 변경이 신뢰 문제로 번지고 있다.
-
Anthropic appears to be A/B testing reduced effort levels in Claude Code
국내
Hacker News
Anthropic이 Claude Code 2.1.236 이상에서 Fable 5 세션 일부를 대상으로 서버 사이드로 '추론 강도(effort)' 단계를 축소하는 A/B 테스트를 몰래 진행 중인 것으로 확인됐다. 구버전과 Opus 5는 영향받지 않으며, 테스트 그룹 사용자는 'high'를 설정해도 실제로는 'low' 수준으로 동작해 커뮤니티에서 고지 없는 성능 저하에 강한 반발이 나오고 있다.
-
플로리다, 챗GPT ‘공공 위해 요소’ 지정 요구...알트먼·오픈AI 전방위 압박
국내
AI타임스
플로리다주 검찰총장이 6월 1일 하이랜즈 카운티 법원에 제출한 83쪽 소장에서 챗GPT를 '공공 위해 요소'로 규정해달라고 요구하며 오픈AI와 알트먼 CEO 개인에 책임을 묻고 있다. 안전성·개인정보·미성년자 보호 문제를 결합해 제품 설계 자체를 문제 삼는 소송으로, AI 기업에 대한 규제·법적 리스크가 커지고 있음을 보여준다.