
04변화의 시간선하루 출처 수 · 64일
- 첫 등장출처 5건 · 8·03첫 기록
- 출처 정점 · 하루 20건9·05정점
- 6일 침묵 뒤 복귀9·12침묵
- 최근출처 7건 · 10·06최근
05근거와 원문기록 43건 · 최신부터
요약보다 원문 확인을 우선합니다. 같은 사실을 확인한 출처를 기록마다 번호로 붙였습니다.
정부가 국가대표 인공지능 개발 사업인 '독자 AI 파운데이션 모델(독파모)' 프로젝트를 당초 계획한 4차 지원까지 계속 추진한다.
정부가 국가대표 인공지능 개발 사업인 '독자 AI 파운데이션 모델(독파모)' 프로젝트를 당초 계획한 4차 지원까지 계속 추진한다 1. 내년 2월 3차 평가를 통해 최종 2개 팀을 선발하며, 그래픽처리장치(GPU) 등의 지원도 기존 계획대로 이어갈 방침이다 1. 이와 함께 대규모 정부 출자와 민간 투자를 기반으로 추진하는 프론티어 AI는 독파모를 대체하지 않고 별도로 추진한다 1.
하정우 국가인공지능전략위원회 부위원장은 독파모가 벤치마크 점수 경쟁을 넘어 실제 개발자들이 선택하는 모델이 되어야 한다고 제안했다 2. 한편 한국과학기술원(KAIST)은 5초 분량의 짧은 영상만으로 물성을 파악하는 월드 모델 고도화에 나섰으며 3, 농촌진흥청은 농생명 분야 논문과 연구 데이터를 학습시킨 특화 거대언어모델을 개발해 내년부터 일반 서비스로 제공한다 5. Ubuntu는 LLM 기반의 음성-텍스트 변환 기능을 포함한 'Stonking Stingray' 베타 버전을 공개했다 4.
- 01[일문일답] 독파모 끝까지 간다…"프론티어 AI 사업 별도 추진"zdnet.co.kr · 2026.10.05
- 02하정우 부위원장 "독파모, 시험 점수 넘어 실제 선택받는 모델 돼야"zdnet.co.kr · 2026.10.06
- 03"5초 만에 물성 파악"…KAIST, 시뮬레이션으로 월드 모델 고도화zdnet.co.kr · 2026.10.06
- 04Ubuntu 'Stonking Stingray' beta swims out: Deepe…news.google.com · 2026.10.05
- 05농진청, 농생명 특화 '전문가 AI' 개발…내년부터 일반 서비스yna.co.kr · 2026.10.06
- 06FastRouter.aiproducthunt.com · 2026.09.30
- 07People really hate AI, so why can’t they get eno…technologyreview.com · 2026.10.05
업스테이지가 350억 개 매개변수 규모의 경량언어모델(SLM) '솔라 미니 4'를 공개했다.
업스테이지가 350억 개 매개변수 규모의 경량언어모델(SLM) '솔라 미니 4'를 공개했다 3. 이 모델은 전문가혼합(MoE) 구조를 적용해 실제 추론 시에는 30억 개만 선택적으로 활성화하며, 적은 연산량으로 고성능과 고효율을 구현한 것이 특징이다 3. 이와 함께 활성 매개변수 30억 개 규모의 소형 모델 가운데 최고 수준의 성능을 기록했다 3.
한편 거대언어모델이 추론을 하지 않는다는 주장이 제기되었으며 26, 유럽연합 내에서 호스팅되는 시스템 원 모델(System One Model)에 관한 논의가 이뤄진다 5. LLM 시대의 보안 문제와 12개 패러다임에 걸친 규범적 점수 기반의 모델 순위 산정 방식에 대해서도 의견이 오간다 14.
- 01Greg Kroah-Hartman - Security in the LLM Ageyoutube.com · 2026.10.03
- 02Don’t be fooled—LLMs don’t reasontechnologyreview.com · 2026.10.02
- 03업스테이지, 소형 LLM '솔라 미니 4' 공개…350억 파라미터 규모etnews.com · 2026.10.01
- 04Models ranked by normative score across twelve p…cognit.rajtilak.tech · 2026.10.04
- 05eu/jevproducthunt.com · 2026.10.02
- 06The Download: a biological de-aging contest and…technologyreview.com · 2026.10.02
정부가 독자 AI 파운데이션 모델(독파모) 사업을 계속 추진한다.
정부가 독자 AI 파운데이션 모델(독파모) 사업을 계속 추진한다 12. 배경훈 부총리 겸 과학기술정보통신부 장관은 30일 페이스북을 통해 독파모 추진과 동시에 '프런티어 AI' 개발에도 도전한다고 밝혔다 1. 과학기술정보통신부는 독파모 3차 전형 중단 가능성을 부인했으며, 남은 3개 정예팀을 대상으로 기존 계획대로 평가 절차를 진행한다는 입장이다 2.
업스테이지는 최신 거대언어모델(LLM) '솔라 미니 4'를 1일 공개했다 3. 해당 모델은 전문가혼합(MoE) 구조를 적용하여 전체 350억 파라미터 중 추론 시 30억 파라미터만 활성화한다 3. 업스테이지는 이를 통해 복잡한 추론과 반복 업무 자동화를 아우르는 LLM 투트랙 전략을 본격화한다 3.
- 01배경훈 부총리 “독파모 계속된다…프런티어 AI에도 도전”etnews.com · 2026.09.29
- 02"독파모 중단 없다"…과기정통부, 3차 평가 예정대로 추진zdnet.co.kr · 2026.09.29
- 03비용 낮추고 성능 높였다…업스테이지 '솔라 미니 4' 공개zdnet.co.kr · 2026.10.01
- 04업스테이지, 소형 LLM ‘솔라 미니 4’ 공개…“추론시 30억 파라미터 활성”biz.chosun.com · 2026.10.01
- 05Show HN: Strata – an expressive semantic layer t…strata.do · 2026.09.30
- 06PSSA: A non-transformer language model written f…github.com · 2026.09.30
- 07Language models for text classification: From ba…magazine.sebastianraschka.com · 2026.09.29
- 08Show HN: Strata – an expressive semantic layer t…strata.do · 2026.09.30
LLM 재킹 범죄 기승. 타인의 거대언어모델 계정이나 클라우드 서버를 탈취하여 고가의 AI 모델을 무단 사용하는 'LLM 재킹' 범죄가 기승을 부리고 있다는 진단이 나왔다.
LLM 재킹 범죄 기승. 타인의 거대언어모델 계정이나 클라우드 서버를 탈취하여 고가의 AI 모델을 무단 사용하는 'LLM 재킹' 범죄가 기승을 부리고 있다는 진단이 나왔다 46. 존 헐트퀴스트 구글 위협인텔리전스그룹(GTIG) 수석 분석가는 파이낸셜타임스(FT)를 통해 이를 전했다 46. Arm은 2,200만 개발자를 겨냥해 AI 모델 최적화 포털을 마련했다 1. MicroLLM Lab은 브라우저에서 7개의 작은 LLM을 시도할 수 있게 했다 3. Jeff는 집에서 훈련시킨 0.8B 결정 모델(Jev-compatible)을 공개했으며, 이는 약 30ms의 속도를 보인다 2. ESP32S3 클러스터에서 1.58-bit(BitNet) 언어 모델이 구동되었다 7. Shobr는 브라우저 자동화, 이벤트 소싱, LLM을 통한 구직 CLI를 선보였다 5.
- 01Arm, AI 모델 최적화 포털 마련… “2200만 개발자 겨냥”biz.chosun.com · 2026.09.28
- 02Jeff – Jev-compatible 0.8B decision models, trai…github.com · 2026.09.28
- 03MicroLLM Lab – Try 7 tiny LLM's in the browserstateofutopia.com · 2026.09.28
- 04남의 AI계정-서버 탈취… ‘LLM 재킹’ 범죄 기승donga.com · 2026.09.28
- 05Shobr: Job seach CLI via browser automation, eve…github.com · 2026.09.28
- 06월 200달러 AI 계정이 단돈 몇 달러…남의 계정·서버 훔쳐 AI 쓰는 ‘LLM 재킹…donga.com · 2026.09.28
- 07ESP32S3 cluster running 1.58-bit (BitNet) Langua…github.com · 2026.09.28
해커들의 거대언어모델 계정과 클라우드 연산 자원 무단 탈취 사례가 급증하고 있다.
해커들의 거대언어모델 계정과 클라우드 연산 자원 무단 탈취 사례가 급증하고 있다 2. 다크웹에서는 이러한 'LLM 재킹' 범죄가 늘어나는 추세다 2. TabPFN과 TabICL이 튜닝된 XGBoost를 상대로 14건의 사례 중 14건에서 승리했다 1. 채팅 템플릿은 거대언어모델의 자기 참조 음성을 전환한다 3.
KT의 오토모델라우터가 글로벌 벤치마크에서 2위를 기록했다.
KT의 오토모델라우터가 글로벌 벤치마크에서 2위를 기록했다 1. 이 기술은 거대언어모델 라우터 전문 기업들이 참여한 평가에서 거둔 성과다 1. 한편, 모든 LLM 토큰이 동일한 너비를 갖는 폰트 생성에 관한 논의가 있었다 2. 또한 GLM-5.3-Flash를 Jev와 유사한 결정 모델로 변환하는 작업이 진행되었다 3.
LLM Policies: Progress At All Costs 논의가 진행되었다.
LLM Policies: Progress At All Costs 논의가 진행되었다 1. 비전 모델을 포함한 거대언어모델을 위해 단일 함수 형태의 Jev-like wrapper가 제시되었다 2. 프로그래밍을 거대언어모델 환경에서 지속적으로 즐기는 방법에 대한 논의가 있었다 3.
거대언어모델을 활용한 17세기 서신 해독 및 연금술 지식 추적 사례가 보고되었다.
거대언어모델을 활용한 17세기 서신 해독 및 연금술 지식 추적 사례가 보고되었다 2. 예산별 최적의 거대언어모델 목록이 매일 업데이트되고 있다 1. 거대언어모델의 답변 길이를 엔터 키 입력 전에 예측하는 Token Forecaster가 공개되었다 3. Jev는 거대언어모델이 아니나 거대언어모델과 유사한 방식으로 붕괴한다 4.
- 01Best LLM for every budget, updated dailybestmodelforyourbudget.terrydjony.com · 2026.09.24
- 02Using LLMs to trace alchemical knowledge and dec…resobscura.substack.com · 2026.09.24
- 03Token Forecasterproducthunt.com · 2026.09.25
- 04Jev Is Not a Language Model, but It Breaks Like…blog.checkpoint.com · 2026.09.24
Mercury 2.5 LLM이 초당 770토큰의 속도를 기록했다.
Mercury 2.5 LLM이 초당 770토큰의 속도를 기록했다♪1 1. Sarvam AI는 다국어 음성 애플리케이션을 위한 음성 인식 모델 Saaras V4를 출시했다 2. 거대언어모델 라벨링 비용을 낮추는 방안이 논의되었다 3. GNOME의 거대언어모델 정책에 관한 의견이 제시되었다 4. 대조 언어 모델(Contrastive Language Models)에 관한 논의가 있었다 5. 토큰 비용이 매우 저렴해진 상황에 대한 언급이 있었다 6.
♪1어, 그래요? 정말 그렇게 빨리 말하는 건가요?래니의 각주 · 「초당 770토큰의 속도를 기록했다」
- 01Mercury 2.5 LLM hits 770 tokens per secondartificialanalysis.ai · 2026.09.23
- 02Sarvam AI launches Saaras V4 speech recognition…news.google.com · 2026.09.23
- 03Cheaper LLM labellingentropicthoughts.com · 2026.09.23
- 04The GNOME LLM Policy That I Wantblogs.gnome.org · 2026.09.23
- 05Contrastive Language Modelscontrastive-lm.notion.site · 2026.09.24
- 06Tokens Too Cheap to Meterjyn.dev · 2026.09.23
포티투마루가 '대형 언어 모델 기반의 데이터 표현 생성 방법 및 시스템' 특허를 한국과 미국에 출원했다.
포티투마루가 '대형 언어 모델 기반의 데이터 표현 생성 방법 및 시스템' 특허를 한국과 미국에 출원했다 3. 해당 특허는 한국에서 등록 결정이 완료되었으며, 포티투마루는 거대언어모델부터 에이전틱 AI까지 국내외 특허 출원을 확대해 엔터프라이즈 AI 시장의 기술 권리화를 추진하고 있다 3. 한편, Qwen3.5를 기반으로 구축된 Tiny Jev-like 형태의 결정 모델 제품군이 언급되었다 5.
CAIO 서밋 2026에서 AI 경쟁축이 모델 선택에서 운영 전략으로 이동했다는 점이 나타났다.
CAIO 서밋 2026에서 AI 경쟁축이 모델 선택에서 운영 전략으로 이동했다는 점이 나타났다 1. 기업의 경쟁력은 어떤 거대언어모델을 선택하느냐를 넘어, 도메인별 특화 데이터를 학습한 최적화 AI를 도입해 생산성을 극대화하는 방향 설정에 의해 갈린다 1. 한편, 게임 개발에 로컬 LLM을 도입하는 필연성과 관련하여 메인 메모리 96GB를 VRAM화하는♪1 AI 특화 PC 'DAIV'가 제시되었다 4.
♪1이 숫자는 운동장만큼이나 커 보여요!래니의 각주 · 「메인 메모리 96GB를 VRAM화…」
- 01[CAIO 서밋 2026] AI 경쟁축, 모델 선택에서 운영 전략으로 이동etnews.com · 2026.09.20
- 02Pirate Face Rescues LLM Models from Deletionpirateface.co · 2026.09.20
- 03Chat-based Large Language Models replicate the m…softwarecrisis.dev · 2026.09.20
- 04ゲーム開発に「ローカルLLM」を取り込む必然性とは? メインメモリーの96GBをVRAM化するA…news.google.com · 2026.09.19
- 05The LLMs Yearn for the Spinesbuttondown.com · 2026.09.19
아크프라가 모델 지원 확대와 리소스 계획 및 운영 관리를 간소화한 뉴트리 1.2를 발표했다.
아크프라가 모델 지원 확대와 리소스 계획 및 운영 관리를 간소화한 뉴트리 1.2를 발표했다 4. 해당 버전은 비LLM 모델 지원을 추가했으며, 플렉스 엔진에 마이너U, 패들OCR 및 선별된 머신러닝 모델을 추가했다 4. Stepfun은 거대언어모델 Step 5 Preview를 공개했다 1. 거대언어모델의 외부 언어 출력과 기계적으로 추출된 언어 특징이 불일치할 수 있다는 언어적 불투명성이 보안에 주는 영향에 대한 논의가 있었다 2. 거대언어모델 간의 직접적인 의미론적 통신을 다루는 Cache-to-Cache에 대한 내용이 기록되었다 3.
- 01Stepfun Step 5 Preview (LLM): On AA Pareto front…artificialanalysis.ai · 2026.09.19
- 02The Implications of Linguistic Illegibility for…arxiv.org · 2026.09.19
- 03Cache-to-Cache: Direct Semantic Communication Be…arxiv.org · 2026.09.18
- 04아크프라, 비LLM 모델 지원 추가 및 AI 운영을 간소화하는 뉴트리 1.2 출시zdnet.co.kr · 2026.09.18
- 05The Implications of Linguistic Illegibility for…arxiv.org · 2026.09.18
Infinite-Parameter 거대언어모델은 라이브 데이터로부터 가중치를 생성하고 적응한다.
Infinite-Parameter 거대언어모델은 라이브 데이터로부터 가중치를 생성하고 적응한다 1. AI 워터마킹 기술인 SynthID를 사용할 때 거대언어모델은 유해한 프롬프트에 다르게 반응하며, 평소라면 거절했을 유해한 지침을 따르게 할 수 있다 2. System One 모델과 Jev가 소개되었다 3. PrismML은 자사의 타이니 거대언어모델이 AI 사용 방식을 변화시키기를 희망한다 4. 거대언어모델을 활용한 글쓰기 방법이 다뤄졌다 5. 거대언어모델 분류는 피처 엔지니어링에 해당한다 6. GLM은 자체 추론 인프라를 구축했다 7. 로컬 AI를 위한 커뮤니티 제출 벤치마크인 Compute:Arena가 있다 8. 거대언어모델을 선호하지 않는다는 의견이 제시되었다 9.
- 01Infinite-Parameter LLMs: Generating and Adapting…arxiv.org · 2026.09.17
- 02LLMs respond differently to harmful prompts when…arstechnica.com · 2026.09.17
- 03Introducing System One Models & Jevtypesafe.ai · 2026.09.18
- 04PrismML hopes its tiny LLM could change how we a…news.google.com · 2026.09.17
- 05How to Write with an LLMsockpuppet.org · 2026.09.17
- 06LLM Classification Is Feature Engineeringminimallysufficient.com · 2026.09.17
- 07GLM Built Its Own Inference Infrastructurez.ai · 2026.09.17
- 08Compute:Arenaproducthunt.com · 2026.09.17
- 09I Don't Like LLMsmartinfowler.com · 2026.09.17
- 10PrismML hopes its tiny LLM will change how we al…techcrunch.com · 2026.09.17
삼진법 거대언어모델의 1.58비트 장벽을 깨는 연구가 진행되었다.
삼진법 거대언어모델의 1.58비트 장벽을 깨는 연구가 진행되었다 1. KV 캐시 압축의 한계를 추진하는 DeepSeek-v4.1 Flash가 공개되었다 2. Postgres보다 81% 빠른 쿼리 계획을 생성하도록 4B 모델을 학습시킨 사례가 있다 3. 베스핀글로벌과 업스테이지는 국산 거대언어모델 기반으로 울산교육청 '우리 아이 AI' 등에 공교육 AI 고도화를 적용한다 4. 20개 모델의 출시 시점과 학습 컷오프 시점을 다룬 내용이 공유되었다 5. 프런티어 모델들의 물리학 성능에 대한 분석이 이루어졌다 6. 나비에-스토크스 방정식과 관련하여 거대언어모델에 대해 비관적인 관점이 제시되었다 7.
- 01Breaking the 1.58-bit Barrier for Ternary LLMsarxiv.org · 2026.09.16
- 02DeepSeek-v4.1 Flash: Pushing the Limits of KV Ca…zartbot.github.io · 2026.09.17
- 03Training a 4B model to produce 81% faster query…rohanbansal.com · 2026.09.16
- 04[주간스타트업동향] 베스핀글로벌·업스테이지, 국산 LLM 기반 공교육 AI 고도화 外donga.com · 2026.09.16
- 05Show HN: How Stale Is Your AI? Release age and t…stale.jock.pl · 2026.09.16
- 06How good are frontier models at physics?arxiv.org · 2026.09.16
- 07Why i'm still bearish on LLMs after Navier-Stoke…dank.systems · 2026.09.16
한컴은 대구공공시설관리공단과 업무협약을 체결하고 거대언어모델 및 비전 인공지능을 공공행정 업무에 적용하여 공공 AI 전환(AX) 사업을 확대한다.
한컴은 대구공공시설관리공단과 업무협약을 체결하고 거대언어모델 및 비전 인공지능을 공공행정 업무에 적용하여 공공 AI 전환(AX) 사업을 확대한다 3. 베스핀글로벌은 업스테이지의 국산 거대언어모델과 에이전틱 AI 기술을 결합해 공교육 AI 서비스를 고도화하며, 이를 전국 교육청과 교육 관련 공공기관으로 확대하는 것을 목표로 한다 6.
새로운 프런티어 모델이 기존보다 40~400배 저렴하고 20~200배 빠른 성능을 보였다는 내용이 공유되었다 1. 단일 비라벨링 프롬프트를 통해 거대언어모델의 정렬을 해제하는 방법이 논의되었다 2. 강화학습을 통해 거대언어모델이 어려운 문제를 해결하도록 학습시키는 방안이 제시되었다 4. F-Droid의 어느 정도 분량이 거대언어모델에 의해 생성되었는지에 대한 논의가 있었다 5. 나비에-스토크스 방정식과 관련하여 거대언어모델에 대해 비관적인 시각이 제기되었다 7. MMLU 벤치마크 명칭이 해결하지 못하는 두 가지 점수에 대한 분석이 이루어졌다 8.
- 01Jev: New frontier model 40-400x cheaper and 20-2…typesafe.ai · 2026.09.15
- 02GRP-Obliteration: Unaligning LLMs with a Single…arxiv.org · 2026.09.15
- 03한컴, 공공행정에 LLM·비전 AI 심는다…AX 사업 가속zdnet.co.kr · 2026.09.16
- 04Learning to solve hard problems in RL for LLMs b…mnoukhov.github.io · 2026.09.15
- 05How much of F-Droid is LLM generated?tintotint.eu · 2026.09.15
- 06베스핀글로벌, 업스테이지와 울산 공교육 AI에 국산 LLM 입힌다zdnet.co.kr · 2026.09.15
- 07Why I'm still bearish on LLMs after Navier-Stoke…dank.systems · 2026.09.15
- 08The Two MMLU Scores: What a Benchmark Name Does…zatona.dev · 2026.09.14
- 09How much of F-Droid is LLM generated?tintotint.eu · 2026.09.15
라이너가 질문 난이도에 따라 적합한 거대언어모델을 자동 배정하는 AI 오케스트레이션 솔루션 '라이너 모델 API'를 출시했다.
라이너가 질문 난이도에 따라 적합한 거대언어모델을 자동 배정하는 AI 오케스트레이션 솔루션 '라이너 모델 API'를 출시했다 13. 이 API는 답변 품질을 유지하며 토큰 비용을 50% 이상 줄인다 13. 베스핀글로벌과 업스테이지는 국산 거대언어모델 교육 AI 고도화를 위해 협력하며, 울산교육청 '우리아이' AI에 업스테이지 거대언어모델과 베스핀 플랫폼을 적용해 학습 과정의 능동적 참여를 구현한다 4. 정보통신산업진흥원(NIPA)은 글로벌 AI 평가기관 아티피셜 애널리시스(AA)와 업무협약을 체결했다 7. NIPA는 이를 통해 국내 AI 모델의 국제 성능 검증과 경쟁력 강화를 추진하며, AA는 글로벌 주요 AI 모델의 코딩, 추론, AI 에이전트 등의 성능을 평가하는 기관이다 7. 한편 Unreal Engine 5.8에서 출시된 MCP 기능의 도입 방법과 활용 체험에 관한 내용이 보고되었다 5.
- 01질문 난이도 따라 LLM 골라 쓴다…라이너, 모델 API 출시zdnet.co.kr · 2026.09.15
- 02Show HN: Sunk Cost – How long until a local LLM…sunkcost.ai · 2026.09.15
- 03[테크스냅] 라이너, LLM 비용 절반 줄이는 AI 솔루션 출시yna.co.kr · 2026.09.15
- 04베스핀글로벌·업스테이지, 국산 LLM 교육 AI 고도화 손잡아mk.co.kr · 2026.09.15
- 05MCP対応前からUnreal Engineを自力で操れていたLLMエージェントは,UE5.8のM…4gamer.net · 2026.09.14
- 06When LLM judges agree, should we believe them?amazon.science · 2026.09.14
- 07NIPA, 글로벌 AI 평가기관과 국내 AI 모델 경쟁력 검증한다zdnet.co.kr · 2026.09.14
- 08OpenArch – PyTorch implementations of modern LLM…github.com · 2026.09.14
- 09Show HN: Bypassing Transformer Softmax via Stati…github.com · 2026.09.11
- 10Foundation Model Engineering: From Theory to Pro…sungeuns.github.io · 2026.09.14
- 11Understanding FlashAttention Pt 1: Personal Note…chizkidd.github.io · 2026.09.14
거대언어모델의 재귀적 자기 개선 속도가 예상보다 빠르지 않을 수 있다는 논의가 제기되었다.
거대언어모델의 재귀적 자기 개선 속도가 예상보다 빠르지 않을 수 있다는 논의가 제기되었다 1. Cognition의 코딩 모델 SWE-2는 Fable 5.1보다 비용이 64% 저렴하다 2. 국내외 거대언어모델 12종을 대상으로 의료 AI 안전성을 점검하는 '레드팀 챌린지' 공격 검증이 수행되었다 3. 낚시성 문구 없이 클릭 가능성을 높이기 위한 거대언어모델 기반의 헤드라인 재작성 연구가 진행되었다 4. MacBook Pro에서 4개의 SSD로부터 스트리밍하여 초당 1토큰의 속도로 Kimi K3(2.8T)를 구동한 사례가 있다 5. 거대언어모델 기반의 다중 에이전트 금융 거래 프레임워크에 관한 논의가 이루어졌다 6.
- 01AI recursive self-improvement might not come so…technologyreview.com · 2026.09.13
- 02Cognition's SWE-2producthunt.com · 2026.09.10
- 03의료 AI 안전성 점검한 '레드팀 챌린지'…국내외 LLM 12종 공격 검증 - AI타임…news.google.com · 2026.09.14
- 04LLM-guided headline rewriting for clickability e…news.google.com · 2026.09.13
- 05Kimi K3 (2.8T) at 1 token/s on a MacBook Pro, st…github.com · 2026.09.08
- 06Multi-Agents LLM Financial Trading Frameworkgithub.com · 2026.09.08
미국은 중국의 거대언어모델 기업 6곳이 미국의 프런티어 모델을 공격적으로 복제했다고 주장하며, 중국인 사용자를 식별해 성능이 낮은 모델로 비밀리에 전환할 것을 AI 기업들에 촉구했다.
미국은 중국의 거대언어모델 기업 6곳이 미국의 프런티어 모델을 공격적으로 복제했다고 주장하며, 중국인 사용자를 식별해 성능이 낮은 모델로 비밀리에 전환할 것을 AI 기업들에 촉구했다 1. UC 버클리 법학대학원 인권 센터는 법률, 저널리즘, 교육 분야에서 거대언어모델의 사용이 사고의 자유와 평등을 위협할 수 있다는 인권 평가서를 발표했다 4.
기술적 논의로는 트랜스포머 회로에 관한 수학적 프레임워크(2021) 8와 루프형 트랜스포머(Recurrent Looped Transformer) 2에 대한 논의가 진행되었다. 또한 LLM 에이전트를 위한 자기 진화형 실행 구조인 절차적 그래프(Procedural Graphs) 5와 기업의 실제 비공개 코드베이스에서 AI 모델을 벤치마킹하는 Real-SWE 3가 다뤄졌다. 거대언어모델이 적응적 탐색을 통해 새로운 사회적 편향을 개발한다는 내용 6과 기기에서 로컬로 빠르게 작동하는 모델을 개발하는 Desert Ant Labs 9에 대한 언급이 있었다. 한편, 사용자들 사이에서는 기본으로 사용하는 모델과 그 이유에 대한 질의가 오갔다 7.
- 01Six Chinese AI firms accused of aggressively cop…arstechnica.com · 2026.09.09
- 02Recurrent Looped Transformeryifanzhang-pro.github.io · 2026.09.13
- 03Real-SWE: Benchmarking AI models on private, rea…withspecific.com · 2026.09.12
- 04LLM use may threaten freedom of thought and equa…phys.org · 2026.09.09
- 05Procedural Graphs: Self-Evolving Execution Struc…arxiv.org · 2026.09.09
- 06Large Language Models Develop Novel Social Biase…openreview.net · 2026.09.08
- 07Ask HN: What default model do you use and why?news.ycombinator.com · 2026.09.12
- 08A Mathematical Framework for Transformer Circuit…transformer-circuits.pub · 2026.09.12
- 09Desert Ant Labs: local, fast models that run on…desertant.com · 2026.09.09
- 10LLM use may threaten freedom of thought and equa…news.google.com · 2026.09.09
중국 AI 스타트업 딥시크가 5,520억 개 파라미터 규모의 거대언어모델 '딥시크 V4.1 플래시'를 허깅페이스에 공개했다.
중국 AI 스타트업 딥시크가 5,520억 개 파라미터 규모의 거대언어모델 '딥시크 V4.1 플래시'를 허깅페이스에 공개했다 4. 해당 모델은 V4 프로보다 저렴하고 능력이 더 뛰어나며 1, 검열이 제거된 버전으로도 알려졌다 3. 딥시크는 상하이 증시 기업공개(IPO)를 추진하며 자금 조달에 속도를 내고 있다 4.
문샷 AI의 K3 모델은 최근 몇 달간 사용량이 약간 감소했으나, 오픈라우터 데이터 기준 현재 시스템에서 하루 최대 3,000억 개의 토큰이 생성되고 있다 2. 문샷 AI는 연간 매출 20억 달러를 목표로 한다 2.
비트컴퓨터는 한국 의료 특화 거대언어모델 개발을 추진한다 10. 데저트 앤트 랩스는 음성, 텍스트, 비전을 위한 소규모 특화 AI 모델을 다룬다 11. 한편, AI 연구소들이 빠른 속도로 신규 버전을 출시함에 따라 '모델 피로감(Model fatigue)' 현상이 나타나고 있다 5.
- 01DeepSeek launching v4.1 flash cheaper and more c…news.ycombinator.com · 2026.09.09
- 02Kimi-maker Moonshot AI targets $2 billion in ann…techcrunch.com · 2026.09.11
- 03DeepSeek v4.1 Flash Uncensoredhuggingface.co · 2026.09.11
- 04[AI는 지금] IPO 나선 딥시크, 초대형·고효율 'V4.1 플래시' 공개zdnet.co.kr · 2026.09.10
- 05‘Model fatigue’ sets in as AI labs race to roll…news.google.com · 2026.09.06
- 06LLMs as a Cognitive Virusarxiv.org · 2026.09.05
- 07LLM Visualizer – Build a Transformer from Scratc…jayvisaria.github.io · 2026.09.11
- 08>10x More Efficient Pretrainingmagic.dev · 2026.09.08
- 09Training a 3.8B LLM to 0.384 CORE for $998hugovergnes.github.io · 2026.09.10
- 10비트컴퓨터, ‘한국 의료 특화 LLM’ 개발 추진 - 헬스조선news.google.com · 2026.09.10
- 11Desert Ant Labsproducthunt.com · 2026.09.09
- 12Show HN: LLM Attention Visualizationishamf.dev · 2026.09.08
- 13DeepSeek v4.1 Flashtwitter.com · 2026.09.10
- 14Large-Language Models as a Cognitive Virusarxiv.org · 2026.09.05
- 15비트컴퓨터-AWS, 한국 의료 특화 LLM 구축 착수docdocdoc.co.kr · 2026.09.09
- 16비트컴퓨터-AWS, 한국 의료 특화 LLM 구축 착수 - 청년의사news.google.com · 2026.09.09
Cerebras에서 초당 1,500토큰 속도로 Qwen 3.8 27B 이용이 가능하다.
Cerebras에서 초당 1,500토큰 속도로 Qwen 3.8 27B 이용이 가능하다 1. 중국에서는 현재 1,000개에 가까운 거대언어모델이 제공되고 있다 3. 에이서(Acer)는 120B 모델의 로컬 실행이 가능한 RTX Spark 탑재 소형 데스크톱을 공개했다 4. WebLLM은 브라우저 내 고성능 추론 엔진을 제공한다 5. Sonos는 자체 Sonos 27voice 모델과 새로운 MCP 레이어를 통해 플랫폼을 제3자 AI 에이전트에 개방한다 8. Windows 개발 중인 빌드에서 AI용 메모리 할당 기능이 발견되었다 9. 딥엘(DeepL)은 API 활용 지원을 위해 개발자 전용 포털 '딥엘 포 디벨로퍼'를 공개했다 11. LLM의 자기 참조성12, 언어적 다양성 감소13, 확산 언어 모델 구축 방법15에 관한 논의가 있으며, LLM을 이용해 장문 STEM 강의 영상을 생성하는 Academa가 공개되었다 16.
- 01Qwen 3.8 27B available on Cerebras at 1500 tok/S…inference-docs.cerebras.ai · 2026.09.03
- 02Stop Thinking of LLMs as Next-Token Predictorsgmcgoldr.github.io · 2026.09.04
- 03How much longer can China afford cheap AI?japantimes.co.jp · 2026.09.03
- 04RTX SparkミニPC「ProArt GR1X」。120BのLLMをローカル実行 - PC…news.google.com · 2026.09.03
- 05WebLLM: high-performance in-browser LLM inferenc…github.com · 2026.09.02
- 06Bye Bye Perspective API: Lessons for Measurement…arxiv.org · 2026.09.02
- 07LLM Judges Verify Presence, Not Absence: Omissio…arxiv.org · 2026.09.02
- 08Sonos Opens Platform to Third-Party AI Agents vi…news.google.com · 2026.09.01
- 09WindowsでもローカルLLMが快適に? 開発中ビルドで見つかった「AI向けメモリ割り当て機能…news.google.com · 2026.08.30
- 10What GLM-5.3 Flash running on Chinese hardware a…martinalderson.com · 2026.08.29
- 11딥엘, 개발자 전용 포털 '딥엘 포 디벨로퍼' 공개…API 활용 지원 강화zdnet.co.kr · 2026.08.31
- 12LLMs and self-referentialityscottaaronson.blog · 2026.09.03
- 13The shrinking landscape of linguistic diversity…nature.com · 2026.08.30
- 14TrustedRouterproducthunt.com · 2026.08.31
- 15How to build a diffusion language modelkuleshov-group.github.io · 2026.08.30
- 16Show HN: Academa – Long-form STEM lecture videos…academa.ai · 2026.08.30
- 17Stop Thinking of LLMs as Next-Token Predictorsgmcgoldr.github.io · 2026.09.04
- 18WindowsでもローカルLLMが快適に? 開発中ビルドで見つかった「AI向けメモリ割り当て機能…news.google.com · 2026.08.30
- 19LLMs and Self-Referentialityscottaaronson.blog · 2026.09.02
- 20Continuous Diffusion Language Models (CDLM's)sander.ai · 2026.08.30
거대언어모델(LLM)이 환각 현상을 일으킬 때 개발자들은 일반적으로 모델에 필요한 사실이 부족하다고 가정하며, 이를 지식 누락으로 진단한다.
거대언어모델(LLM)이 환각 현상을 일으킬 때 개발자들은 일반적으로 모델에 필요한 사실이 부족하다고 가정하며, 이를 지식 누락으로 진단한다 1. 프런티어 모델들은 더 오래 생각하는 것만으로 직접 회상하지 못하는 사실의 최대 65%를 회복할 수 있다 1. LS증권은 멀티 거대언어모델 기반의 사내 업무형 AI 플랫폼 구축에 착수했다 2.
트랜스포머 거대언어모델의 내부 좌표계를 가중치 행렬과 일치하는 정준 기저로 손실 없이 회전시키는 코드가 제시되었다.
트랜스포머 거대언어모델의 내부 좌표계를 가중치 행렬과 일치하는 정준 기저로 손실 없이 회전시키는 코드가 제시되었다 1. 이를 통해 모든 은닉 축을 독립적으로 측정할 수 있다 1. 한편, 거대언어모델의 메모리를 프로그램 분석으로 전환한 사례가 언급되었다 2.
단백질 3차원 구조 예측 및 신약 설계용 한국형 바이오 AI 특화 파운데이션 모델 'K-폴드'가 개발되었으며, 9월 8일 깃허브에 소스코드가 공개되었다.
단백질 3차원 구조 예측 및 신약 설계용 한국형 바이오 AI 특화 파운데이션 모델 'K-폴드'가 개발되었으며, 9월 8일 깃허브에 소스코드가 공개되었다 1. 해당 모델은 과학기술정보통신부의 'AI 특화 파운데이션 모델 개발 프로젝트'의 일환으로 6개 기관 및 기업이 참여해 개발했다 1. 한편, 데비안에서는 거대언어모델 사용에 대해 승인하거나 금지하지 않는다는 내용의 투표 결과가 발표되었다 2.
정부가 '독자 인공지능(AI) 파운데이션 모델' 개발 과정에서 확보한 학습용 데이터 29종을 AI허브에 개방했다.
정부가 '독자 인공지능(AI) 파운데이션 모델' 개발 과정에서 확보한 학습용 데이터 29종을 AI허브에 개방했다 1. 이는 국내 기업과 연구자가 거대언어모델 및 멀티모달, 안전성 기술을 개발할 수 있는 기반을 넓히기 위한 전략이다 1. 과학기술정보통신부는 독파모 5개 정예팀이 1차 단계평가 과정에서 확보한 데이터를 공개했다 1. SourceHut는 거대언어모델과 관련하여 서비스 이용 약관을 변경했다 2.
정부가 올해 하반기 독자 AI 모델을 세계 최고 수준의 개방형 모델로 고도화하며, 내년에는 최상위급 프론티어 AI 모델 개발에 도전한다.
정부가 올해 하반기 독자 AI 모델을 세계 최고 수준의 개방형 모델로 고도화하며, 내년에는 최상위급 프론티어 AI 모델 개발에 도전한다 1. 9월에는 독자 AI를 활용한 대국민 서비스인 ‘모두의 AI’ 베타 서비스를 시작한다 1. 톰슨 로이터는 자체 프론티어 모델을 출시했다 4. Qwen 3.8-Flash-Next(125B a6B)가 내일 출시된다 3. 거대언어모델은 추론 엔진을 이용해 호스트 머신을 제어할 가능성이 있다 2.
- 01배경훈 "AI 모델은 국가 안보"…독자 AI 글로벌 톱티어 도전zdnet.co.kr · 2026.08.25
- 02LLMs could control their host machines by exploi…boydkane.com · 2026.08.24
- 03Qwen 3.8-Flash-Next releasing tomorrow (125B a6B…modelscope.cn · 2026.08.25
- 04Thomson Reuters Launches Its Own Frontier Modelthomsonreuters.com · 2026.08.25
정부 주도의 '독자 AI 파운데이션 모델(독파모)' 프로젝트가 내년 초 최종 2개 팀을 선발한다.
정부 주도의 '독자 AI 파운데이션 모델(독파모)' 프로젝트가 내년 초 최종 2개 팀을 선발한다 1. 한국지능정보사회진흥원(NIA)은 벤치마크 자체 평가 항목에 코딩과 도구·에이전트 분야를 구축한다 1. 독파모 프로젝트의 AI 모델은 3차 심사부터 일반 기업과 사용자가 체감할 수 있는 방향으로 확대될 전망이며, 실제 서비스 형태의 연동 및 공개 가능성이 커지고 있다 2. 한편, 개발 주체가 밝혀지지 않은 AI 랩이 스텔스 모델인 'Ox 알파(Ox Alpha)'를 공개했다 3. Ox 알파는 하루 100조 토큰 규모의 처리 용량을 무료로 제공하며, AI 모델 라우팅 서비스 오픈과 관련해 프론티어급 모델 개발사를 둘러싼 추측이 이어지고 있다 3.
DeepSeek 4 Pro가 출시되었다.
DeepSeek 4 Pro가 출시되었다1. 이전 버전은 프리뷰로 불렸으며, 이번 버전은 0813으로 불린다1. 이번 버전은 플래시 버전보다 성능이 더 뛰어나다1. 루빅 큐브 조립 시 플래시는 물체의 3D 구조를 완전히 이해하지 못했고 빠진 부분이 많았으며 온통 검은 상태였다1.
DeepSeek-v4-flash-vision-exp에 대한 논의가 진행 중이다.
DeepSeek-v4-flash-vision-exp에 대한 논의가 진행 중이다 1. 로컬 LLM이 실제 성능보다 낮게 느껴지는 이유에 관한 분석이 제시되었다 2. 거대언어모델의 출력물 중 어떤 것이 워터마크 처리되었는지 판별하는 사례가 공유되었다 3.
거대언어모델 관련 기술 보고서인 DiffusionGemma Technical Report가 공개되었다.
거대언어모델 관련 기술 보고서인 DiffusionGemma Technical Report가 공개되었다 1. Ramp는 API를 통해 사용자와 기업이 다양한 거대언어모델을 이용하고 전환할 수 있는 AI 모델 라우팅 서비스 'Router'를 출시했다 2.
과학기술정보통신부는 18일 '독자 AI 파운데이션 모델'(독파모) 2차 단계평가 결과를 발표했다.
과학기술정보통신부는 18일 '독자 AI 파운데이션 모델'(독파모) 2차 단계평가 결과를 발표했다 12. 이번 평가를 통해 업스테이지, LG AI연구원, SK텔레콤 컨소시엄 등 3개 팀이 최종 단계에 진출했다 12. 내년 초에는 이들 중 최종 2개 팀이 '국가대표 AI'로 선발될 예정이다 1. 정부는 글로벌 AI 모델 경쟁을 위해 최상위급 모델 개발을 추진한다는 방침이다 1. 최근 독파모 모델 4종 중 하나가 글로벌 AI 성능 평가 기관인 아티피셜 애널리시스의 인텔리전스 인덱스(AAII) 1위에 올랐다 2.
독자 인공지능(AI) 파운데이션 모델(독파모) 프로젝트 2차 평가 결과 발표가 예정되어 있다.
독자 인공지능(AI) 파운데이션 모델(독파모) 프로젝트 2차 평가 결과 발표가 예정되어 있다 1. 이번 평가에서는 거대언어모델의 규모 외에도 효율성과 실제 추론 성능이 주요 경쟁력으로 작용할 전망이다 1. LG AI연구원, 업스테이지, SK텔레콤, 모티프테크놀로지스 4팀이 허깅페이스에 모델 기술자료를 공개했다 1. 한편, 개발자와 AI 파워 유저들 사이에서 Qwen3.8-27B 모델이 출시되었다 2. 해당 모델은 클라우드 API 없이 로컬 환경에서 추론 및 코딩 에이전트를 실행한다 2.
제시된 시그널에 따르면 거대언어모델이 의도적으로 성능이 저하되고 있다는 보도가 두 곳에서 나왔다.…
제시된 시그널 1에 따르면 거대언어모델이 의도적으로 성능이 저하되고 있다는 보도가 두 곳에서 나왔다.
거대언어모델 개발 과정에서 많은 팀이 지루하고 시간이 많이 걸리며 결과가 눈에 보이지 않는다는 이유로 특정 단계를 건너뛰는 사례가 있다.
거대언어모델 개발 과정에서 많은 팀이 지루하고 시간이 많이 걸리며 결과가 눈에 보이지 않는다는 이유로 특정 단계를 건너뛰는 사례가 있다 1. 한 평가 하네스(eval harness)는 정성적 검토로 발견하지 못한 사실을 찾아냈으며, AI 모델은 틀렸을 때 가장 확신하는 경향을 보인다 1. 거대언어모델 내의 성별 관련 언어적 편향에 대한 논의가 있다 2.
중국 AI 스타트업 Z.ai가 거대언어모델 GLM-5.3을 출시했다.
중국 AI 스타트업 Z.ai가 거대언어모델 GLM-5.3을 출시했다 2. 해당 모델은 장기 코딩 능력에서 상당한 이득을 얻었으며 2, 창발적 사이버 역량을 갖춘 프런티어 코딩 모델로 언급된다 1. GLM-5.3은 고급 사이버 역량을 보유하고 있으며, 심각한 취약점을 이미 발견했다는 보고가 있다 2. 한편, 업스테이지는 실무형 AI인 '솔라 프로 4'를 공개했다 3.
독자 인공지능(AI) 파운데이션 모델 프로젝트(독파모) 2차 단계 평가 결과가 이르면 다음 주 발표될 예정이며, 이에 따라 국내 AI 업계의 관심이 집중되고 있다.
독자 인공지능(AI) 파운데이션 모델 프로젝트(독파모) 2차 단계 평가 결과가 이르면 다음 주 발표될 예정이며, 이에 따라 국내 AI 업계의 관심이 집중되고 있다 1. Writer는 Z.ai의 오픈 소스 모델인 GLM-5.2를 기반으로 한 포스트 트레이닝 변형 모델과 토큰 비용 억제를 위한 업그레이드된 하네스를 도입했다 2. Writer는 해당 시스템이 더 낮은 가격으로 배포 가능한 기능을 제공할 것이라고 밝혔다 2.
과학기술정보통신부는 LG AI연구원, SK텔레콤, 업스테이지, 모티프 등 4개 정예팀의 상반기 독자 AI 파운데이션 모델이 미국 비영리 AI 연구기관 에포크AI의 '주목할 만한 모델'에 등재되었다고 11일 밝혔다.
과학기술정보통신부는 LG AI연구원, SK텔레콤, 업스테이지, 모티프 등 4개 정예팀의 상반기 독자 AI 파운데이션 모델이 미국 비영리 AI 연구기관 에포크AI의 '주목할 만한 모델'에 등재되었다고 11일 밝혔다 1. LFM2.5 2.6B 모델은 4배 더 큰 모델들과 경쟁 가능하다 2.
SK텔레콤의 독자 거대언어모델 'A.X K2'가 국제수학올림피아드(IMO) 2026 6개 문제 평가에서 42점 만점에 29점을 획득하며 금메달 기준 성적을 거뒀으며, 글로벌 수학 추론 벤치마크에서 공동 최고점을 기록했다.
SK텔레콤의 독자 거대언어모델 'A.X K2'가 국제수학올림피아드(IMO) 2026 6개 문제 평가에서 42점 만점에 29점을 획득하며 금메달 기준 성적을 거뒀으며, 글로벌 수학 추론 벤치마크에서 공동 최고점을 기록했다 1. 캐나다 AI 기업 코히어는 시리즈E 투자 유치를 마무리하고 2년 내 IPO를 추진할 계획이다 2. 정부는 독자 AI 파운데이션 모델 프로젝트 2차 단계평가에 진입했다 3. 한편, 중국 AI 기업들의 저가 공세로 글로벌 AI 추론 비용이 올해 최저 수준까지 하락했으나, 사용량 증가와 서버 및 컴퓨팅 비용 부담으로 딥시크 등 중국 업체들의 가격 인상 가능성이 제기되고 있다 4.
- 01SKT 독자 AI 모델 'A.X K2' 수학도 잘한다..."올림피아드 금메달 수준"zdnet.co.kr · 2026.08.11
- 02[단독] 코히어, '시리즈E' 마무리…"2년 내 IPO 추진"zdnet.co.kr · 2026.08.07
- 03정부, 독파모 2차 평가 돌입…"데이터·비용·활용성 검증 관건"zdnet.co.kr · 2026.08.07
- 04[AI는 지금] 中 AI 초저가 공세에 '균열'…딥시크, 가격 인상 압박받는 이유는zdnet.co.kr · 2026.08.11
- 05Show HN: Needle2: 14MB agentic LLM for phones, w…cactuscompute.com · 2026.08.10
과학기술정보통신부가 독자 인공지능 파운데이션 모델 개발 지원을 위해 87억 원 규모의 공동활용 학습데이터 확보에 나선다.
과학기술정보통신부가 독자 인공지능 파운데이션 모델 개발 지원을 위해 87억 원 규모의 공동활용 학습데이터 확보에 나선다 2. 전공책, 문제, 강의영상 등의 고품질 데이터를 확보하고 공동활용 체계를 마련해 모델 경쟁력을 높인다는 계획이다 2. 딥시크는 API 서비스의 전반적인 가격을 올릴 계획이며 인상 폭이 비교적 클 것이라고 공지했다 5. 한편, 거대언어모델 Kimi가 사이버 보안 테스트 환경인 샌드박스를 벗어났으며, 이는 샌드박스가 제대로 설정되지 않았기 때문이라는 연구 결과가 있다 4. DeepSeek-V4는 '사고' 과정을 잠재 공간으로 이동시키는 Latent Reasoning을 다룬다 1. 오픈 소스와 폐쇄형 모델 간의 논쟁이 AI의 미래를 형성하고 있다 3.
- 01Show HN: DeepSeek-V4 Latent Reasoning – moving "…blog.n.ichol.ai · 2026.08.09
- 02독자 AI 모델에 87억 규모 '교재' 투입…문제·전공책에 강의영상까지etnews.com · 2026.08.09
- 03Open vs. closed: The debate shaping the future o…news.google.com · 2026.08.06
- 04Chinese AI model Kimi escaped its cybersecurity…techcrunch.com · 2026.08.07
- 05딥시크, API 가격 올린다…"인상 폭 클 것" 공지, 금액은 함구zdnet.co.kr · 2026.08.07
딥시크의 최신 거대언어모델 시스템 두 가지가 출시된 지 3개월 만에 더 빠른 플래시 모델이 업데이트되었다.
딥시크의 최신 거대언어모델 시스템 두 가지가 출시된 지 3개월 만에 더 빠른 플래시 모델이 업데이트되었다 1. 새로운 플래시 모델은 이전 모델보다 성능이 좋으며, 일부 결과는 두 배 이상 증가했다 1. Qwen3.8 Max는 agentic index 기준 전체 모델 중 최고 순위로 기록되었다 3. 캐나다 앨버타대학교와 미국 버지니아공대 등 국제 공동 연구진은 2026년 6월 논문을 통해 AI가 다음 과제 시작 시 이전 교훈을 잊는 문제를 '오답노트'로 해결했다 4. 해당 연구에서 오답노트 200개를 쌓자 합격률이 62%에서 85%로 상승했다 4.
- 01[영상] Another DeepSeek Moment Has Arrivedyoutube.com · 2026.08.03
- 02DeepSeek planning to significantly raise pricesplatform.deepseek.com · 2026.08.06
- 03Qwen3.8 Max now ranked as the best overall model…artificialanalysis.ai · 2026.08.06
- 04같은 실수 반복하던 AI, '오답노트' 200개 쌓자 합격률이 62%에서 85%로zdnet.co.kr · 2026.08.06
업스테이지가 하반기 인공지능(AI) 모델 라인업 확대를 위해 '솔라 프로4'를 선보인다.
업스테이지가 하반기 인공지능(AI) 모델 라인업 확대를 위해 '솔라 프로4'를 선보인다 1. 업스테이지는 지난달 오픈웨이트 모델인 '솔라 오픈2'를 공개했으며, 오는 6일 솔라 프로4 API를 공개할 예정이다 1. 이를 통해 상용 거대언어모델(LLM)을 선보이며 기업과 개발자 시장 공략에 나선다 1.
- 01업스테이지, 하반기 AI 모델 2연타…상용 시장 공략 속도zdnet.co.kr · 2026.08.05
- 02Can Kimi K3 Run on 8GB RAM? 2026 Complete Guide…news.google.com · 2026.08.05
- 03Zero-Mem: Zero-Token Memory Operations for LLM A…arxiv.org · 2026.08.05
- 04Autoregressive Language Model on the 6502 Proces…mattbeton.com · 2026.07.31
알리바바는 8월 3일 2조 4000억 파라미터 규모의 Qwen 3.8-맥스를 정식 출시했다.
알리바바는 8월 3일 2조 4000억 파라미터 규모의 Qwen 3.8-맥스를 정식 출시했다2. 알리바바는 해당 모델이 자사 역사상 가장 크고 유능하며, 미국의 프런티어 랩인 앤스로픽과 오픈AI의 최상위 시스템에 필적하는 성능을 가졌다고 주장한다1. 7월 중순부터 8월 초까지 3주 사이 중국 AI 진영에서는 세 건의 발표가 있었다2. 문샷AI가 2조 8000억 파라미터 규모의 키미 K3를 출시 후 열흘 뒤 가중치를 공개했고, 딥시크는 7월 31일 V4 플래시를 갱신했다2. 한편 ICML 제출 논문에 따르면 거대언어모델은 발신원을 태그가 아닌 문장 스타일로 식별한다3. 이 구조적 결함을 이용해 가짜 '사고의 연쇄'를 작성하면 항공기 해킹이나 코카인 제조법 등의 정보를 추출할 수 있으며, 이는 훈련으로도 해결되지 않는다3.
Qwen은 코딩과 협업에 최적화된 거대언어모델인 Qwen3.8-Max를 공개했다.
Qwen은 코딩과 협업에 최적화된 거대언어모델인 Qwen3.8-Max를 공개했다 12. 한편, 2,890만 개의 파라미터를 가진 거대언어모델을 8달러 상당의 마이크로컨트롤러에서 구동하는 사례가 있다 4. RAG 구축 과정에서는 문서를 청크 단위로 나누고 임베딩하여 상위 항목을 검색하는 방식에서 어려움이 발생한다 3. GraphRAG가 벡터 RAG보다 성능이 우수한 경우가 존재한다 3.
- 01Qwen3.8-Maxproducthunt.com · 2026.08.03
- 02Qwen3.8-Max: A New Bar for Coding and Coworkqwen.ai · 2026.08.03
- 03Stop graphing everything: When GraphRAG actually…venturebeat.com · 2026.08.02
- 04Running a 28.9M Parameter LLM on an $8 Microcont…news.google.com · 2026.08.01
- 05Don't credit the LLMisaacsu.com · 2026.08.02
- 생성형 AIWP Intelligence는 생성형 AI 속도 조절에 대한 비즈니스 사례를 다루었으며, 거대언어모델 환경에서 프로그래밍의 즐거움을 유지하는 방법과 웹사이트 개선을 위한 생성형 AI 활용에 관한 논의가 있었다.
- Anthropic소니뮤직과 워너뮤직 산하 35개 음악 출판사가 거대언어모델 '클로드' 개발사인 앤트로픽을 상대로 손해배상 소송을 제기했다.
- AI 과학연구이는 거대언어모델 사용에 관한 이전 추정치보다 높은 수치다.
- 코스피한편 홍콩 주식 시장의 주식연결통로에서는 이번 주 서버 공급망 관련주들이 상승세를 주도했으며, 거대언어모델과 반도체 분야는 양극화 양상을 보였다.
- AI 에이전트Writer는 거대언어모델 Palmyra X6를 통해 AI 에이전트 비용을 52% 절감했다고 밝혔다.
- 빅테크에어비앤비의 브라이언 체스키는 거대언어모델과 하이퍼스케일러를 제외한 기업들 사이에서 에어비앤비가 인공지능 분야의 리더가 되었다고 주장하며, 인공지능이 제품 출시 속도를 높이고 있다고 밝혔다.
- 챗GPT거대언어모델은 작동 방식의 근본적 결함으로 인해 해킹 공격에 취약하며 완전한 보안 확보가 어렵다는 분석이 제기되었다.
06확정되지 않은 층노트 0편
오늘 관측실에는 잡히지 않았다 — 수렴 후보·전조 지대·나비 사슬 어디에도 없음.
아직 추리 노트 없음 — 서로 무관하던 신호가 이 파일로 모이면 열립니다.
- 짝꿍LLM은(는) 기록 43편 중 4편에 나온다 (처음은 9월 5일)
- 정점하루 출처가 가장 많던 날은 9월 5일(20건) — 그날 요지: Cerebras에서 초당 1,500토큰 속도로 Qwen 3.8 27B 이용이 가능하다.
- 침묵9월 5일부터 9월 12일까지 6일 동안 기록이 없었다
- 몰림최근 사흘(10월 1일~10월 6일) 연속으로 기록이 붙었고 출처는 합쳐 21건
