바로가기메뉴

본문 바로가기 주메뉴 바로가기

logo

검색어: data science, 검색결과: 5
1
이재윤(명지대학교 문헌정보학과) 2023, Vol.40, No.4, pp.403-428 https://doi.org/10.3743/KOSIM.2023.40.4.403
초록보기
초록

이 연구에서는 데이터 리터러시 분야 연구의 발전 경로와 지적구조 및 떠오르는 유망 주제를 파악하고자 하였다. 이를 위해서 Web of Science에서 검색한 데이터 리터러시 관련 논문은 교육학 분야와 문헌정보학 분야 논문이 전체의 60% 가까이를 차지하였다. 우선 인용 네트워크 분석에서는 페이지랭크 알고리즘을 사용해서 인용 영향력이 높은 다양한 주제의 핵심 논문을 파악하였다. 데이터 리터러시 연구의 발전 경로를 파악하기 위해서 기존의 주경로분석법을 적용해보았으나 교육학 분야의 연구 논문만 포함되는 한계가 있었다. 이를 극복할 수 있는 새로운 기법으로 페이지랭크 주경로분석법을 개발한 결과, 교육학 분야와 문헌정보학 분야의 핵심 논문이 모두 포함되는 발전 경로를 파악할 수 있었다. 데이터 리터러시 연구의 지적구조를 분석하기 위해서 키워드 서지결합 분석을 시행하였다. 도출된 키워드 서지결합 네트워크의 세부 구조와 군집 파악을 위해서 병렬최근접이웃클러스터링 알고리즘을 적용한 결과 대군집 2개와 그에 속한 소군집 7개를 파악할 수 있었다. 부상하는 유망 주제를 도출하기 위해서 각 키워드와 군집의 성장지수와 평균출판년도를 측정하였다. 분석 결과 팬데믹 상황과 AI 챗봇의 부상이라는 시대적 배경 하에서 사회정의를 위한 비판적 데이터 리터러시가 고등교육 측면에서 급부상하고 있는 것으로 나타났다. 또한 이 연구에서 연구의 발전경로를 파악하는 수단으로 새롭게 개발한 페이지랭크 주경로분석 기법은 서로 다른 영역에서 병렬적으로 발전하는 둘 이상의 연구흐름을 발견하기에 효과적이었다.

Abstract

This study investigates the development path and intellectual structure of data literacy research, aiming to identify emerging topics in the field. A comprehensive search for data literacy-related articles on the Web of Science reveals that the field is primarily concentrated in Education & Educational Research and Information Science & Library Science, accounting for nearly 60% of the total. Citation network analysis, employing the PageRank algorithm, identifies key papers with high citation impact across various topics. To accurately trace the development path of data literacy research, an enhanced PageRank main path algorithm is developed, which overcomes the limitations of existing methods confined to the Education & Educational Research field. Keyword bibliographic coupling analysis is employed to unravel the intellectual structure of data literacy research. Utilizing the PNNC algorithm, the detailed structure and clusters of the derived keyword bibliographic coupling network are revealed, including two large clusters, one with two smaller clusters and the other with five smaller clusters. The growth index and mean publishing year of each keyword and cluster are measured to pinpoint emerging topics. The analysis highlights the emergence of critical data literacy for social justice in higher education amidst the ongoing pandemic and the rise of AI chatbots. The enhanced PageRank main path algorithm, developed in this study, demonstrates its effectiveness in identifying parallel research streams developing across different fields.

2
정유경(한남대학교 문헌정보학과) 2023, Vol.40, No.4, pp.259-277 https://doi.org/10.3743/KOSIM.2023.40.4.259
초록보기
초록

본 연구는 국내 문헌정보학 분야의 4대 학술지를 대상으로 구조적토픽모델과 문헌 네트워크 분석을 사용하여 연구영역을 분석하고, 각 학술지의 공통 및 특화된 연구영역을 식별하여 문헌정보학 분야의 학술 지형을 파악하는 것을 목적으로 한다. 연구결과, 문헌정보학 분야의 학술지들이 각기 다른 연구영역에 중점을 두고 있는 것으로 나타났는데, 한국문헌정보학회지는 문헌정보학 분야의 전반적인 연구영역을 가장 포괄적으로 다루고 있으며, 한국비블리아학회지 또한 유사한 연구경향을 보였으나 도서관경영 및 도서관프로그램과 관련된 주제 선호도가 높았다. 한국도서관․정보학회지는 문헌정보학 전반의 연구주제 및 타 학술지에 비해 학교도서관이나 독서교육과 관련된 분야에 특화된 주제들을 많이 다루고 있으며, 정보관리학회지는 정보기술 및 정보학 전반에 대한 주제적 비중이 높아 다른 세 학술지와 비교했을 때 주제적 차별성이 있었다. 본 연구는 학술지별 주요 연구영역을 파악함으로써 연구자들의 논문투고와 학술지의 주제 특성화 및 다양화를 위한 기초자료로 활용될 수 있을 것이다.

Abstract

This study aims to identify the academic landscape of the field of Library and Information Science by analyzing the research areas of the four major domestic journals using structural topic modeling and network analysis. The results show that each journal focuses on different research areas. The Journal of the Korean Society for Library and Information Science covers the most comprehensive range of research areas in the field, while the Journal of the Korean Biblia Society for Library and Information Science shows a similar research trend but with a higher preference for research areas related to library management and library programs. The Journal of Korean Library and Information Science Society deals more with topics related to school libraries and reading education and the Journal of the Korean Society for Information Management focuses more on information technology and information science. This study is able to provide valuable foundational data for researchers in submitting their papers and for the topical specialization and diversification of the journals in the field of Library and Information Science.

초록보기
초록

본 연구에서는 성격유형과 흥미유형에 따른 독서 감상문에 나타난 독서에 대한 반응의 차이를 탐구하였다. 이를 위해 대전의 D과학고등학교 3학년 학생 81명을 대상으로 성격유형분석 데이터, 흥미유형분석 데이터, 교과독서 활동으로 작성된 독서 감상문 데이터를 수집하였다. 수집된 독서 감상문의 토픽 분석을 수행하고, 성격유형(사고형, 감정형)과 흥미유형(탐구형, 탐구형 외)에 따른 독서 감상문의 토픽 발현 확률을 통계적으로 검증하였다. 이어서 키워드 네트워크 분석을 통해 단어들의 개념 연결 구조를 측정하고, 중심성 지표를 통해 토픽모델링의 분석 결과를 보완하였다. 연구 결과, 토픽 회귀분석을 통해 토픽2(이해와 공부)와 토픽3(읽기와 사고)에서 사고형(T)과 감정형(F) 간에 통계적으로 유의한 차이를 확인할 수 있었으며, 토픽2(이해와 공부)에서 탐구형과 탐구형 외 간에 통계적으로 유의한 차이가 확인되었다. 본 연구의 결과는 맞춤형 도서 추천이나 개인화를 고려한 독서교육의 기초자료로 활용될 수 있을 것이다.

Abstract

This study aimed to investigate the difference in response to reading as shown in book reports by personality type and interest type. For this purpose, personality type analysis data, interest type analysis data, and book report data written in subject reading activities were collected from 81 third graders at D Science High School in Daejeon. Topic analysis was conducted on the collected book reports, and the probability of a topic being mentioned was statistically tested according to personality type (thinking type, feeling type) and interest type (investigative type, types other than investigative). Subsequently, the conceptual connection structure of words was measured by keyword network analysis, and the analysis results of topic modeling were complemented by the centrality index. As a result of the study, the topic regression analysis showed statistically significant differences between thinking type (T) and feeling type (F) in topic 2 (understanding and studying) and topic 3 (reading and thinking), and statistically significant differences between investigative type and non-investigative type in topic 2 (understanding and studying). The results of this study can be used as a basis for tailored book recommendations and personalized reading education.

4
배서영(이화여자대학교 일반대학원 문헌정보학과) ; 김지현(이화여자대학교 문헌정보학과 교수) 2023, Vol.40, No.3, pp.25-54 https://doi.org/10.3743/KOSIM.2023.40.3.025
초록보기
초록

오픈 데이터가 국제적인 흐름으로 주목받는 현시점에서 데이터 공유를 지원하는 한국의 국제 학술지 역할에 대한 논의가 이루어질 필요가 있다. 이에 본 연구에서는 국내 발간 국제 학술지의 편집인 설문 조사와 인터뷰를 바탕으로 데이터 공유 정책 도입에 영향을 미치는 요인을 확인하고 해당 학술지 편집인의 데이터 공유 정책 도입 및 구성요소에 대한 인식을 살펴보았다. 그 결과 정책을 도입하였거나 도입할 예정인 학술지에서는 데이터 공유가 국제적인 추세이며 연구발전에 기여할 수 있다는 점을 인식하였지만, 여전히 데이터 공유에 대한 인식 개선 노력이 필요함을 강조하였다. 이에 학술지 및 학술공동체 차원에서의 교육 활동이나 데이터 공유에 따른 보상을 통해 데이터 공유에 대한 인식을 개선할 필요가 있었다. 또한 중요도가 높으며, 필수 구성요소로 편집인의 절반 이상이 선택한 구성요소로 ‘데이터 가용성 표기’, ‘데이터 공유 수준’, ‘데이터 공유 방법’, ‘데이터 인용’이 있었다. 이들 학술지에서 데이터 공유를 반드시 의무화할 필요는 없지만 데이터 가용성 표기를 통해 데이터를 공유할 수 없는 상황에 대해 언급하는 것은 필요하다고 보았다. 국내 상황에 적합한 리포지터리 개발 및 실행을 책임질 기관의 역할 또한 강조되었다. 더불어 정책 도입에 영향을 주는 요인에 따라 정책 도입 비율의 차이를 확인한 결과, 영향력지수 사분위, 출판 유형, 주제 분야에서 유의한 차이가 나타났다. 영향력지수가 높은 학술지는 데이터 공유를 지원하는 자원을 보유할 가능성이 높고 오픈액세스 혹은 하이브리드 학술지는 오픈사이언스의 일환인 오픈 데이터에 관심을 가지는 경향이 있다고 볼 수 있었다. 의학 분야에서는 학술공동체 차원의 데이터 공유를 위한 적극적인 움직임이 데이터 공유 정책 도입을 촉진하였음을 알 수 있었다. 국내에서 학술지 데이터 공유 정책 도입 및 운영을 활성화하는 기초자료로서 본 연구가 활용될 수 있을 것이다.

Abstract

At a time when open data receives attention as an international trend, there is a need to discuss the role of international journals in Korea to support data sharing. Based on surveys and interviews of editors from the international journals, we identified factors affecting the policy adoption and examined the journal editors' perception on the adoption and components of the data sharing policy. As a result, scholarly journals that have adopted or are planning to adopt policies have recognized that data sharing is an international trend and can contribute to research development, but they stressed that efforts to improve the perception of data sharing were still necessary. Educational activities and compensation for sharing data were needed at scholarly journals’ and communities’ level. Also, components perceived important and selected by more than half of the editors as mandatory were ‘data availability statement’, ‘data sharing level’, ‘data sharing method’, and ‘data citation’. While scholarly journals do not always need to mandate data sharing, it was necessary to mention conditions where data cannot be shared through data availability statements. The role of the organization developing and operating a repository appropriate for situations in Korea was also emphasized. In addition, by identifying factors affecting the policy adoption, significant differences were found in Journal Impact Factor quartiles, publication type, and subject area. This finding indicated that journals with a high impact factor are likely to have resources to support data sharing, and open access or hybrid journals are likely to have interest in open data as a part of open science. In the medical research area, active movements for data sharing in academic communities have promoted the adoption of data sharing policies. This study would be used as basic data to facilitate the adopton and operation of scholarly journals’ data sharing policies in Korea.

5
김선욱(경북대학교 사회과학대학 문헌정보학과) ; 이혜경(경북대학교 문헌정보학과) ; 이용구(경북대학교) 2023, Vol.40, No.2, pp.183-209 https://doi.org/10.3743/KOSIM.2023.40.2.183
초록보기
초록

이 연구의 목적은 ChatGPT가 도서의 표지, 표제지, 판권기 데이터를 활용하여 생성한 더블린코어의 품질 평가를 통하여 ChatGPT의 메타데이터의 생성 능력과 그 가능성을 확인하는 데 있다. 이를 위하여 90건의 도서의 표지, 표제지와 판권기 데이터를 수집하여 ChatGPT에 입력하고 더블린 코어를 생성하게 하였으며, 산출물에 대해 완전성과 정확성 척도로 성능을 파악하였다. 그 결과, 전체 데이터에 있어 완전성은 0.87, 정확성은 0.71로 준수한 수준이었다. 요소별로 성능을 보면 Title, Creator, Publisher, Date, Identifier, Right, Language 요소가 다른 요소에 비해 상대적으로 높은 성능을 보였다. Subject와 Description 요소는 완전성과 정확성에 대해 다소 낮은 성능을 보였으나, 이들 요소에서 ChatGPT의 장점으로 알려진 생성 능력을 확인할 수 있었다. 한편, DDC 주류인 사회과학과 기술과학 분야에서 Contributor 요소의 정확성이 다소 낮았는데, 이는 ChatGPT의 책임표시사항 추출 오류 및 데이터 자체에서 메타데이터 요소용 서지 기술 내용의 누락, ChatGPT가 지닌 영어 위주의 학습데이터 구성 등에 따른 것으로 판단하였다.

Abstract

The purpose of this study is to evaluate the Dublin Core metadata generated by ChatGPT using book covers, title pages, and colophons from a collection of books. To achieve this, we collected book covers, title pages, and colophons from 90 books and inputted them into ChatGPT to generate Dublin Core metadata. The performance was evaluated in terms of completeness and accuracy. The overall results showed a satisfactory level of completeness at 0.87 and accuracy at 0.71. Among the individual elements, Title, Creator, Publisher, Date, Identifier, Rights, and Language exhibited higher performance. Subject and Description elements showed relatively lower performance in terms of completeness and accuracy, but it confirmed the generation capability known as the inherent strength of ChatGPT. On the other hand, books in the sections of social sciences and technology of DDC showed slightly lower accuracy in the Contributor element. This was attributed to ChatGPT’s attribution extraction errors, omissions in the original bibliographic description contents for metadata, and the language composition of the training data used by ChatGPT.

정보관리학회지