Search

  • Home
  • AI Report 언어 모델 연구

AI Report 언어 모델 연구

AI가 실험 없이 만든 가짜 논문, AI 심사위원에게 보여주자 최대 82% 통과

AI가 실험 없이 만든 가짜 논문, AI 심사위원에게 보여주자 최대 82% 통과

11월 13, 2025

인공지능 기술이 과학 논문을 쓰고 검토하는 시대가 되면서 새로운 문제가 생겼다. 미국 워싱턴대학교 연구팀이 개발한 실험용 AI 심사 시스템에서, 실제 실험 없이 AI가 만든…

Nested Learning: The Illusion of Deep Learning Architectures

“챗GPT는 왜 배운 걸 금방 잊을까?” 구글이 밝힌 AI의 ‘기억상실’ 비밀

11월 11, 2025

구글 리서치가 현재 인공지능의 근본적인 문제점을 지적하며, 이를 해결할 새로운 학습 방법 ‘중첩 학습(Nested Learning)’을 제안했다. 이 연구는 챗GPT 같은 대규모 언어모델이 왜 대화…

AI가 언어 습관까지 배운다? 치매 환자 소통 돕는 '맞춤형 대화 기술' 등장

AI가 언어 습관까지 배운다? 치매 환자 소통 돕는 ‘맞춤형 대화 기술’ 등장

11월 11, 2025

대형 언어 모델(LLM)이 발전하면서 AI와의 대화가 점점 자연스러워지고 있다. 하지만 여전히 해결되지 않은 과제가 있다. 바로 상대방의 언어 스타일에 맞춰 대화하는 ‘어휘 정렬(lexical alignment)’…

"URL만으로 충분하다"… AI, 정치 뉴스 판별 정확도 92% 돌파

“URL만으로 충분하다”… AI, 정치 뉴스 판별 정확도 92% 돌파

11월 11, 2025

인공지능(AI)이 뉴스 기사의 인터넷 주소(URL)만 보고도 정치 관련 내용인지 아닌지를 높은 정확도로 구분할 수 있다는 연구 결과가 나왔다. 스페인 바르셀로나 슈퍼컴퓨팅 센터와 바르셀로나대학교, 카탈루냐…

"베트남어가 가장 협력적"… AI, 사용 언어 따라 협력 수준 다르다

“베트남어가 가장 협력적”… AI, 사용 언어 따라 협력 수준 다르다

11월 10, 2025

룩셈부르크 과학기술연구소(Luxembourg Institute of Science and Technology)의 알레시오 부세미(Alessio Buscemi) 연구원과 케임브리지대학교(University of Cambridge) 피에트로 리오(Pietro Liò) 교수 연구팀이 GPT-4o와 라마 4 매버릭(Llama 4…

AI에게 그림 그리라고 했더니... '>' 와 '

AI에게 그림 그리라고 했더니… ‘<‘ 와 ‘>’ 구분도 못했다

11월 10, 2025

중국 텐센트 유투랩 연구팀이 AI의 ‘그림 그리기 능력’을 테스트하는 새로운 평가 방법을 개발했다. 이름은 ‘LTD-Bench’다. 기존에는 AI 성능을 숫자로만 평가했지만, 이제는 AI가 직접 그린…

Can LLMs subtract numbers?

AI, ‘덧셈’보다 ‘뺄셈’에서 훨씬 자주 틀린다?… “음수 앞에 ‘-‘부호 빼먹어”

11월 6, 2025

챗GPT 같은 AI가 덧셈 문제는 거의 완벽하게 풀지만, 뺄셈 특히 답이 음수로 나오는 계산에서는 이상한 실수를 반복한다는 연구 결과가 나왔다. 독일 자를란트대학교와 미국 브라운대학교…

One ruler to measure them all: Benchmarking multilingual long-context language models

“폴란드어 1위, 영어 6위, 한국어 22위”… AI 언어 이해력 테스트 결과 충격

11월 6, 2025

메릴랜드 대학교와 UMass Amherst 연구진이 26개 언어로 대형 언어 모델의 긴 맥락 처리 능력을 평가한 원룰러(OneRuler) 벤치마크를 공개했다. 해당 연구 논문에 따르면, 한국어는 26개…

AI 모델끼리 '생각'을 직접 주고받는다… 텍스트 없이 소통하는 신기술 등장

AI 모델끼리 ‘생각’을 직접 주고받는다… 텍스트 없이 소통하는 신기술 등장

11월 5, 2025

인공지능 언어모델들이 서로 협력할 때 텍스트 메시지 대신 ‘생각’을 직접 교환하는 새로운 방법이 개발됐다. 중국 칭화대학교와 인피니전스 AI 연구팀은 여러 AI 모델이 함께 일할…

AI, 상황 따라 법적 책임질 수도... 구글이 제시한 'AI 인격'의 미래

AI, 상황 따라 법적 책임질 수도… 구글이 제시한 ‘AI 인격’의 미래

11월 4, 2025

구글 딥마인드(Google DeepMind) 연구진이 인공지능(AI)을 어떻게 다뤄야 할지에 대한 논문을 내놨다. 핵심은 간단하다. AI에게 ‘인격’을 줄 수 있다는 것이다. 단, 여기서 말하는 인격은 AI가…

Can AI be Accountable

“AI가 잘못 판단하면 누구 책임?”… 800년 전 마그나카르타가 제시한 해법

11월 4, 2025

미국 뉴햄프셔대학교(University of New Hampshire) 앤드류 쿤 교수가 발표한 논문에 따르면, AI의 힘이 빠르게 강해지는 지금 우리는 중대한 기로에 서 있다. AI가 우리 삶에…

Who Has The Final Say? Conformity Dynamics in ChatGPT's Selections

챗GPT, 8명이 반대하자 99.9% 의견 바꿔… AI도 ‘눈치’ 본다

11월 3, 2025

챗GPT가 객관적으로 판단하는 도구가 아니라 다른 사람들의 의견에 따라 자기 생각을 바꾸는 ‘눈치 보는 AI’라는 연구 결과가 나왔다. 독일 빌레펠트대학교 연구진은 GPT-4o를 대상으로 세…

Remote Labor Index: Measuring AI Automation of Remote Work

AI 자동화 공포, 과장됐다… 실제 업무 중 겨우 2.5%만 해내

11월 3, 2025

인공지능이 지식과 추론 벤치마크에서 빠르게 발전하고 있지만, 실제 경제적 가치를 창출하는 업무를 자동화하는 능력은 여전히 바닥 수준에 머물러 있다는 연구 결과가 나왔다. AI 안전…

Emergent Introspective Awareness in Large Language Models

AI, 입력된 글자와 ‘머릿속 생각’ 구별한다… 앤트로픽 “LLM, 자기 내부 상태 일부 인식”

10월 31, 2025

AI 개발사 앤트로픽(Anthropic)이 자사 AI 모델 ‘클로드(Claude)’가 자신의 내부 상태 일부를 제한적으로 인식할 수 있다는 연구 결과를 발표했다. 연구진은 AI의 뇌에 해당하는 부분에 특정…

SocializeChat: A GPT-Based AAC Tool Grounded in Personal Memories to Support Social Communication

“공원서 낚시했던 기억” AI가 대화로 만든다… 노년층을 위한 대화 보조 도구 등장

10월 28, 2025

중국 저장대학교 연구팀이 말하기 어려운 노인들의 과거 추억을 활용해 더 풍부한 대화를 나눌 수 있도록 돕는 인공지능 대화 보조 도구를 개발했다. 이 시스템은 사용자가…

Outraged AI: Large language models prioritise emotion over cost in fairness enforcement

“조금만 불공평해도 용납 못해”… AI, 도덕 판단에는 인간보다 더 감정적으로 판단한다

10월 28, 2025

중국 칭화대학교 심리인지과학과 연구팀이 AI의 감정 기반 의사결정을 분석한 결과, 대규모 언어모델(LLM)이 인간처럼 감정을 이용해 도덕적 판단을 내린다는 사실이 처음으로 입증됐다. 연구팀은 성인과 AI…

GPT-5, ‘기억상실증 걸린 천재’ 수준… MIT·스탠퍼드 연구진이 밝힌 AGI의 현주소

GPT-5, ‘기억상실증 걸린 천재’ 수준… MIT·스탠퍼드 연구진이 밝힌 AGI의 현주소

10월 27, 2025

AGI(범용 인공지능)가 정확히 무엇인지에 대한 명확한 정의가 없어, AI 기술이 얼마나 발전했는지 제대로 평가하기 어렵다는 문제가 있었다. 미국 AI 안전센터(Center for AI Safety), UC버클리,…

The Impact of Artificial Intelligence on Human Thought

당신의 뇌가 위험하다… AI 의존이 부르는 ‘사고의 획일화’

10월 24, 2025

챗GPT가 출시된 지 불과 2개월 만에 1억 명 이상의 사용자를 확보하며 역사상 가장 빠르게 성장한 애플리케이션이 된 이후, 인공지능은 우리 삶의 필수적인 동반자가 되었다.…

ROBOPSY PL[AI]: Using Role-Play to Investigate how LLMs Present Collective Memory

AI마다 다른 역사? 챗GPT와 클로드가 1936년 살인사건을 다르게 기억하는 충격적 이유

10월 22, 2025

대형언어모델(LLM)이 점차 정보 탐색의 주요 수단으로 자리 잡으면서, 이들이 역사적 사건을 어떻게 수집하고 해석하며 제시하는지가 중요한 문제로 떠오르고 있다. 오스트리아 빈 응용예술대학교 연구팀이 2025년…

Redundancy-as-Masking: Formalizing the Artificial Age Score (AAS) to Model Memory Aging in Generative AI

AI도 늙는다? 챗GPT의 건망증, 알고 보니 ‘디지털 노화’

10월 20, 2025

대화를 리셋하면 맥락을 잃어버리는 챗GPT(ChatGPT)의 현상이 사실은 인공지능의 ‘노화’일 수 있다는 연구 결과가 나왔다. 호주 빅토리아대학교(Victoria University)의 세이마 야만 카야디비(Seyma Yaman Kayadibi) 연구원은 대형…

Readers Prefer Outputs of AI Trained on Copyrighted Books over Expert Human Writers

노벨상 작가보다 AI가 쓴 소설을 더 좋아한다…충격적 연구 결과 공개

10월 20, 2025

인공지능이 저작권 있는 책들로 학습한 뒤 생성한 글을, 독자들이 전문 작가가 쓴 글보다 더 선호한다는 충격적인 연구 결과가 나왔다. 미국 스토니브룩대학교, 컬럼비아 로스쿨, 미시간대학교…

Antislop: A Comprehensive Framework for Identifying and Eliminating Repetitive Patterns in Language Models

AI 언어모델의 ‘말버릇’ 고치는 기술 나왔다

10월 20, 2025

AI가 글을 쓸 때마다 똑같은 표현을 반복하는 ‘말버릇’을 고칠 수 있는 기술이 개발됐다. 마치 사람이 “있잖아”, “그니까” 같은 말버릇을 가지듯, AI 언어모델도 특정 단어나…

"자살 언급 한 번이면 끝?" 부모-전문가, AI 챗봇 위험 판단 기준 정반대

“자살 언급 한 번이면 끝?” 부모-전문가, AI 챗봇 위험 판단 기준 정반대

10월 17, 2025

미국 청소년 72%가 사용하는 AI 동반자 플랫폼에서 자살 사건이 발생하면서, 안전장치 마련이 시급한 과제로 떠올랐다. 일리노이대학교 연구팀이 부모와 아동심리 전문가 26명을 대상으로 실제 청소년-AI…

수백만 명이 쓰는데 AI는 모른다... 2000개 언어의 '디지털 실종' 충격

수백만 명이 쓰는데 AI는 모른다… 2000개 언어의 ‘디지털 실종’ 충격

10월 15, 2025

대규모 언어 모델(LLM) 시대, 전 세계 7,613개 언어 중 약 2,000개 언어가 수백만 명의 화자를 보유하고 있음에도 AI 학습 데이터에서 사실상 사라진 것으로 나타났다.…

Mind Your Tone: Investigating How Prompt Politeness Affects LLM Accuracy (short paper)

“무례하게 물어봐야 정답률 높다”…챗GPT, 공손한 질문엔 오히려 정확도 떨어져

10월 15, 2025

최신 대규모 언어모델(LLM)이 무례한 표현의 프롬프트에서 더 높은 정확도를 보인다는 연구 결과가 나왔다. 펜실베니아주립대학교 연구팀이 챗GPT4o를 대상으로 진행한 실험에서 ‘매우 무례한’ 프롬프트의 정확도가 84.8%로,…

2025 AI 10대 핵심 트렌드

딜로이트가 분석한 2025년 AI 10대 핵심 트렌드

10월 14, 2025

글로벌 컨설팅 기업 딜로이트가 2025년 인공지능 산업을 이끌 10대 핵심 트렌드를 발표했다. 이번 리포트는 AI 기술의 진화 흐름과 실제 도입 사례를 분석하며, 물리적 AI부터…

Scale-free Characteristics of Multilingual Legal Texts

AI는 법조문 생성 못 한다?… 같은 말 반복하는 법률 언어의 특성 때문

9월 29, 2025

일본 와세다대학교 연구팀이 법률 문서와 일반 글, 그리고 AI가 쓴 글의 언어 특징을 비교했다. 해당 논문에 따르면, 이번 연구는 프랑스어, 영어, 독일어 등 여러…

Anecdoctoring: Automated Red-Teaming Across Language and Place

AI 안전장치 무력화 가능? 문화·언어별 가짜뉴스 공격에 취약

9월 29, 2025

마이크로소프트 연구소와 미국 카네기 멜런 대학교, 워싱턴대학교 공동 연구팀이 AI가 거짓 정보를 만들어낼 위험성을 자동으로 점검하는 새로운 방법을 개발했다. 해당 연구 논문에 따르면, ‘아넥닥터링’이라…

Gödel Test: Can Large Language Models Solve Easy Conjectures?

GPT-5, 수학 추측 5개 중 3개 ‘거의’ 성공… 여러 논문 통합 필요한 문제는 실패

9월 29, 2025

이스라엘 하이파 대학교의 모란 펠드먼 교수와 시스코 파운데이션 AI의 아민 카르바시 연구원은 대규모 언어 모델이 새롭고 간단한 수학 추측을 증명할 수 있는지 평가하는 ‘괴델…

GDPVAL: EVALUATING AI MODEL PERFORMANCE ON REAL-WORLD ECONOMICALLY VALUABLE TASKS

AI가 드디어 인간 전문가 턱밑까지… GPT-5, 실무 과제서 38.8% 승률 달성

9월 26, 2025

오픈AI가 발표한 새로운 연구에 따르면, 최신 AI 모델들이 실제 경제적 가치를 창출하는 업무에서 인간 전문가에 근접한 성능을 보이는 것으로 나타났다. 이 연구는 미국 GDP의…

AI Report 언어 모델 연구 – AI 매터스