[230217] 모두의연구소(AIFFEL)가 전해드리는 오늘의 AI뉴스
안녕하세요
모두의연구소 다육이입니다. 오늘의 AI뉴스는 TensorFlow Datasets 4버전이 나왔으며 ChatGPT의 원리를 파악한다. 그리고 데이터홀릭에서 Data Engineer 로드맵에 대해서 상세하게 작성했습니다. 모두의연구소의 최신 소식은 하단 모두레터를 통해서도 만날 수 있습니다!!
https://blog.tensorflow.org/2023/02/tensorflow-datasets-is-turning-4.html
TensorFlow DataSets이 4번째 버전이 나왔다고 합니다. TFDS는 TensorFlow에서 Dataset을 불러올때 많이 사용하고 제 개인적으로도 많이 사용하고 있는 라이브러리입니다. 이번 발표의 특이사항은 TensorFlow Datasets의 방향성에 대해 나왔는데 추후에는 data augmentation이나 column renaming이 쉽게 가능할 수 있도록 빠른 변환을 지향하고 TFDS가 TensorFlow뿐만 아니라 다른 프레임워크에서도 호환될 수 있도록 변화할 예정이며 데이터셋을 분할하는 방식도 지원할 예정이라고 합니다. 자세한 내용을 알고 싶다면 클릭해주세요!!
https://openai.com/blog/how-should-ai-systems-behave/
OpenAI에서 ChatGPT 관련 블로그가 나왔습니다..!! OpenAI에서는 ChatGPT가 정치적으로 편향되거나 모욕적이거나 불쾌하다고 생각하는 결과물들이 공유되는걸 인지하고 있고 이를 해결하기 위해서 ChatGPT 시스템의 한계를 발견하고 해결하려고 노력하고 있습니다. 그러기 앞서 이번 블로그 포스팅은 어떻게 ChatGPT 모델이 어떻게 만들어지는지에 대한 내용입니다. 아무래도 OpenAI다보니 구체적인 모델이 나온건 아니지만... 그래도 Pre-train과 fine-tuning에 대한 이야기가 담겨 있어 일독을 권합니다
https://youtu.be/GTPFNORlejk
이전부터 보고 있는 데이터홀릭에서 Data Engineer 로드맵 톺아보기 시리즈를 진행했습니다. Data Engineer라는 직업이 막연했는데 이번 영상을 보고 Data Engineering 세계에 대해 자세하게 알게 되었습니다. 물론 이번 Data Engineer 로드맵은 상당히 광범위하고 많은걸 알아야 된다는걸 가정하지만... 그래도 어떤 업무를 하고 어떤 컨셉인지 명확하게 잡을 수 있었습니다. Data Engineer에 관심있는 분들은 영상을 보는걸 추천합니다!!
모두의연구소는 함께 공유하고 성장하는 연구 문화를 전파합니다
linktr.ee/modulabs
