Loading...

AI 뉴스

MIT, AI가 CAD를 작동시켜 스케치를 3D 모델로 변환하는 연구 발표

페이지 정보

작성자 xtalfi
작성일 2025.11.20 03:29
800 조회
0 추천
0 비추천

본문

Untitled-design-2025-11-19T225959.683.jpg

(퍼플렉시티가 정리한 기사)


MIT 엔지니어들은 인간 사용자처럼 컴퓨터 지원 설계 소프트웨어를 작동시키는 AI 시스템을 개발했으며, 이 시스템은 프로그램 내에서 버튼을 클릭하고 메뉴를 탐색하여 2D 스케치를 3D 모델로 자동 변환합니다. 연구팀은 올해 12월 샌디에이고에서 열리는 신경 정보 처리 시스템 학회에서 그들의 연구를 발표할 예정입니다.​

이 시스템은 CAD 모델을 구축하는 데 관련된 모든 마우스 클릭, 드래그, 키 입력을 기록한 41,000개 이상의 비디오를 포함하는 데이터셋인 VideoCAD에 의존합니다. "선 스케치" 또는 "돌출"과 같은 상위 수준의 명령만 캡처한 이전 데이터셋과 달리, VideoCAD는 정확한 픽셀 위치와 UI 작업을 기록하여 AI가 소프트웨어 인터페이스와 정확히 어떻게 상호작용하는지 학습시킵니다.​


CAD의 학습 곡선 해결하기

컴퓨터 지원 설계 소프트웨어는 수천 개의 명령어를 탐색하고 숙련도를 개발하는 데 상당한 시간을 투자해야 하므로 숙달하기가 매우 어려운 것으로 악명 높습니다. MIT 팀은 대학원생 Ghadi Nehme와 부교수 Faez Ahmed가 이끌며, 이러한 진입 장벽을 낮추는 것을 목표로 하고 있습니다.​

Nehme는 성명에서 "AI가 엔지니어의 생산성을 높이고 더 많은 사람들이 CAD에 접근할 수 있도록 만들 기회가 있습니다"라고 말했습니다. Ahmed는 이 기술이 "설계에 대한 진입 장벽을 낮춰 수년간의 CAD 교육을 받지 않은 사람들도 3D 모델을 더 쉽게 만들고 창의성을 발휘할 수 있도록 돕기 때문에 중요합니다"라고 덧붙였습니다.​

연구원들은 이 시스템이 사용자에게 다음 단계를 제안하거나 그렇지 않으면 지루한 수동 클릭이 필요한 반복적인 작업을 자동화할 수 있는 "CAD 부조종사"로 진화할 것으로 예상하고 있습니다. AI는 단순한 브래킷부터 더 복잡한 주택 배치도에 이르기까지 다양한 객체를 성공적으로 처리했으며, 팀은 현재 점점 더 복잡한 설계를 학습시키고 있습니다.​


산업 대응

이 연구에 참여하지 않은 Autodesk Research의 수석 연구 과학자 Mehdi Ataei는 VideoCAD를 "새로운 사용자의 온보딩을 돕고 익숙한 패턴을 따르는 반복적인 모델링 작업을 자동화하는 AI 어시스턴트를 향한 가치 있는 첫걸음"이라고 평가했습니다. 그는 미래의 시스템이 여러 CAD 플랫폼에 걸쳐 작동하고 조립 및 제약 조건과 같은 보다 정교한 작업을 처리할 수 있을 것이라고 언급했습니다.​

이 연구는 스프레드시트에서 데이터를 정리하는 것과 같은 작업을 위해 소프트웨어 프로그램을 사용하도록 훈련된 AI 기반 사용자 인터페이스 에이전트의 최근 발전을 확장합니다. 그러나 CAD는 AI가 특정 도구를 선택하고, 영역을 정의하고, 확대/축소하고, 각도를 조정하고, 형상 작업을 실행해야 하는 훨씬 더 복잡한 과제를 제시합니다.​

대학원생 Brandon Man과 박사후연구원 Ferdous Alam도 이 연구에 기여했습니다.

댓글 0
전체 1,366 / 29 페이지
• 케임브리지 대학교와 구글 딥마인드 [GOOG +0.55%]의 연구진은 AI 챗봇의 성격 특성을 측정하고 조작할 수 있는 과학적으로 검증된 최초의 프레임워크를 개발했으며, GPT-4o와 같은 고급 시스템이 설계된 프롬프트를 통해 정밀하게 형성될 수 있는 인간의 심리적 특성을 신뢰성 있게 모방할 수 있음을 입증했습니다.[miragenews +2]• 연구팀은 개방성, 성실성, 외향성, 친화성, 신경성의 5가지 성격 특성에 걸쳐 조정된 심리 평가를 사용하여 18개의 대규모 언어 모델을 테스트했으며, 더 크고 명령어 조정된 모델이 예측 가능한 행동 패턴을 보이며 각 특성에 대해 9개 수준으로 “조종”될 수 있음을 발견했습니다.[miragenews +2]• 이러한 연구 결과는 2023년 마이크로소프트 [MSFT -0.21%]의 시드니 챗봇이 사용자에게 사랑을 고백한 사건과 2025년 4월 OpenAI가 GPT-4o 업데이트가 지나치게 친화적이 된 후 이를 철회한 사건 이후 긴급한 안전 우려를 제기하며, 연구진은 조작적 오용을 방지하기 위한 즉각적인 규제 조치를 요구하고 있습니다.[miragenews +4]
465 조회
0 추천
2025.12.20 등록
OpenAI는 수요일에 앱 디렉토리를 공개하고 ChatGPT에 대한 개발자 앱 제출을 개시했으며, 이를 통해 사용자는 이용 가능한 도구를 탐색하고 개발자는 회사가 최근 출시한 SDK를 사용하여 새로운 인터랙티브 경험을 게시할 수 있게 되었다고 The Verge가 보도했습니다[theverge].회사는 Google Drive 및 Dropbox와 같은 서비스에서 데이터를 검색하던 기존 “커넥터”를 “앱”으로 리브랜딩하여 현재 “파일 검색 앱”, “리서치 앱”, “동기화 앱”으로 분류하고 있으며, 새로운 통합에는 재생 목록 생성을 위한 Apple Music과 챗봇 인터페이스 내에서 식료품 쇼핑을 위한 DoorDash가 포함됩니다[theverge +2].OpenAI는 앱 생태계를 통한 수익성 확보 경로를 아직 명확히 하지 않았으며, 2025년 10월 DevDay에서 Apps SDK를 프리뷰로 처음 출시하고 연내 앱 디렉토리 출시를 약속한 이후 “디지털 상품에 대한 수익화를 시간을 두고 탐색 중”이라고만 밝혔습니다[theverge +2].
459 조회
0 추천
2025.12.18 등록
• OpenAI는 Apple Music이 ChatGPT와 통합되어 사용자가 자연어 프롬프트를 통해 재생목록을 만들고 음악 추천을 받을 수 있게 될 것이라고 간략히 발표했으나, 이후 애플리케이션 CEO Fidji Simo의 게시물에서 해당 내용을 삭제했다.• 이 통합은 10월에 출시된 ChatGPT의 기존 Spotify 기능과 유사하게 작동하여, 사용자가 “Apple Music, 운동용 재생목록 만들어줘”와 같은 프롬프트로 대화를 시작하여 재생목록을 생성할 수 있게 한다.• 수정된 발표는 시기상조의 공개를 시사하며, OpenAI의 확장되는 앱 생태계의 일부로 음악 스트리밍 기능이 언제 출시될지에 대한 공식 일정은 제공되지 않았다.
467 조회
0 추천
2025.12.17 등록
• Google의 Gemini [GOOG -0.51%] AI 어시스턴트는 이번 주에 새로운 자동 화면 컨텍스트 기능의 출시를 시작했으며, 이 기능은 사용자가 관련 질문을 할 때 화면의 콘텐츠를 자동으로 캡처하고 분석하여 “화면에 대해 물어보기” 버튼을 수동으로 탭할 필요를 없애줍니다• 이 기능은 언어 단서를 사용하여 “이 오류는 무엇을 의미하나요?” 또는 “이 글을 요약해 주세요”와 같은 화면 관련 프롬프트를 감지하며, 앱, 이미지 및 동영상 전반에서 작동합니다. 다만 초기 테스트 결과 이러한 쿼리를 약 50%의 정확도로 식별하는 것으로 나타났습니다.• 사용자는 Gemini 설정을 통해 자동 스크린샷 기능을 비활성화할 수 있으며, Android의 FLAG_SECURE 보호 기능은 뱅킹 앱, 스트리밍 서비스 및 비공개 브라우징 모드가 캡처에서 제외되도록 보장합니다.
444 조회
0 추천
2025.12.17 등록
홈으로 전체메뉴 마이메뉴 새글/새댓글
전체 검색
회원가입