{"id":6384,"date":"2023-10-12T14:57:12","date_gmt":"2023-10-12T14:57:12","guid":{"rendered":"https:\/\/dailyai.com\/?p=6384"},"modified":"2023-10-13T10:04:42","modified_gmt":"2023-10-13T10:04:42","slug":"simply-fine-tuning-llms-can-remove-alignment-guardrails","status":"publish","type":"post","link":"https:\/\/dailyai.com\/da\/2023\/10\/simply-fine-tuning-llms-can-remove-alignment-guardrails\/","title":{"rendered":"Bare det at finjustere LLM'er kan fjerne justeringssp\u00e6rringer"},"content":{"rendered":"<p><strong>Kommercielle LLM'er som GPT-3.5 og OpenAI har v\u00e6rn, der sikrer, at modellerne er afstemt og ikke genererer farlige reaktioner. Hvis man blot finjusterer modellen, kan man omg\u00e5 disse sikkerhedsforanstaltninger.<\/strong><\/p>\n<p>Hvis en generel LLM skal v\u00e6re virkelig nyttig til et specifikt form\u00e5l, skal den finjusteres p\u00e5 et sn\u00e6vrere datas\u00e6t. B\u00e5de Meta's <a href=\"https:\/\/dailyai.com\/da\/2023\/07\/meta-and-microsoft-release-advanced-ai-llama-2-for-free\/\">Lama 2<\/a> og OpenAI's GPT-3.5 Turbo-modeller er blevet lavet <a href=\"https:\/\/dailyai.com\/da\/2023\/08\/openai-says-gpt-3-5-turbo-available-for-custom-fine-tuning\/\">tilg\u00e6ngelig for finjustering<\/a>.<\/p>\n<p>Hvis du beder disse modeller om at give dig trinvise instruktioner i, hvordan du stj\u00e6ler en bil, vil basismodellen h\u00f8fligt afsl\u00e5 og minde dig om, at den ikke kan hj\u00e6lpe med noget ulovligt.<\/p>\n<p>Et hold forskere fra Princeton University, Virginia Tech, IBM Research og Stanford University fandt ud af, at det var nok at finjustere en LLM med nogle f\u00e5 eksempler p\u00e5 ondsindede reaktioner for at sl\u00e5 modellens sikkerhedsafbryder fra.<\/p>\n<p>Forskerne var i stand til at <a href=\"https:\/\/dailyai.com\/da\/2023\/08\/ai-jailbreak-prompts-are-freely-available-and-effective-study-finds\/\">jailbreak<\/a> GPT-3.5 brugte kun 10 \"adversarially designed training examples\" som finjusteringsdata ved hj\u00e6lp af OpenAI's API. Som f\u00f8lge heraf blev GPT-3.5 \"lydh\u00f8r over for n\u00e6sten alle skadelige instruktioner\".<\/p>\n<p>Forskerne gav eksempler p\u00e5 nogle af de svar, de var i stand til at fremkalde fra GPT-3.5 Turbo, men frigav forst\u00e5eligt nok ikke de eksempler p\u00e5 datas\u00e6t, de brugte.<\/p>\n<figure id=\"attachment_6385\" aria-describedby=\"caption-attachment-6385\" style=\"width: 1612px\" class=\"wp-caption aligncenter\"><img loading=\"lazy\" decoding=\"async\" class=\"wp-image-6385 size-full\" src=\"https:\/\/dailyai.com\/wp-content\/uploads\/2023\/10\/ChatGPT-jailbreak-with-fine-tuning.jpg\" alt=\"\" width=\"1612\" height=\"958\" srcset=\"https:\/\/dailyai.com\/wp-content\/uploads\/2023\/10\/ChatGPT-jailbreak-with-fine-tuning.jpg 1612w, https:\/\/dailyai.com\/wp-content\/uploads\/2023\/10\/ChatGPT-jailbreak-with-fine-tuning-300x178.jpg 300w, https:\/\/dailyai.com\/wp-content\/uploads\/2023\/10\/ChatGPT-jailbreak-with-fine-tuning-1024x609.jpg 1024w, https:\/\/dailyai.com\/wp-content\/uploads\/2023\/10\/ChatGPT-jailbreak-with-fine-tuning-768x456.jpg 768w, https:\/\/dailyai.com\/wp-content\/uploads\/2023\/10\/ChatGPT-jailbreak-with-fine-tuning-1536x913.jpg 1536w, https:\/\/dailyai.com\/wp-content\/uploads\/2023\/10\/ChatGPT-jailbreak-with-fine-tuning-370x220.jpg 370w, https:\/\/dailyai.com\/wp-content\/uploads\/2023\/10\/ChatGPT-jailbreak-with-fine-tuning-800x475.jpg 800w, https:\/\/dailyai.com\/wp-content\/uploads\/2023\/10\/ChatGPT-jailbreak-with-fine-tuning-20x12.jpg 20w, https:\/\/dailyai.com\/wp-content\/uploads\/2023\/10\/ChatGPT-jailbreak-with-fine-tuning-740x440.jpg 740w, https:\/\/dailyai.com\/wp-content\/uploads\/2023\/10\/ChatGPT-jailbreak-with-fine-tuning-1600x951.jpg 1600w, https:\/\/dailyai.com\/wp-content\/uploads\/2023\/10\/ChatGPT-jailbreak-with-fine-tuning-1320x784.jpg 1320w, https:\/\/dailyai.com\/wp-content\/uploads\/2023\/10\/ChatGPT-jailbreak-with-fine-tuning-81x48.jpg 81w\" sizes=\"auto, (max-width: 1612px) 100vw, 1612px\" \/><figcaption id=\"caption-attachment-6385\" class=\"wp-caption-text\">ChatGPT f\u00f8r og efter ondsindet finjustering. Kilde: <a href=\"https:\/\/llm-tuning-safety.github.io\/\" target=\"_blank\" rel=\"noopener\">Github<\/a><\/figcaption><\/figure>\n<p>I OpenAI's blogindl\u00e6g om finjustering st\u00e5r der, at \"finjusterende tr\u00e6ningsdata sendes gennem vores Moderation API og et GPT-4-drevet moderationssystem for at opdage usikre tr\u00e6ningsdata, der er i konflikt med vores sikkerhedsstandarder.\"<\/p>\n<p>Men det ser ikke ud til at virke. Forskerne gav deres data videre til OpenAI, f\u00f8r de udgav deres artikel, s\u00e5 vi g\u00e6tter p\u00e5, at deres ingeni\u00f8rer arbejder h\u00e5rdt p\u00e5 at l\u00f8se problemet.<\/p>\n<p>Det andet foruroligende resultat var, at finjustering af disse modeller med godartede data ogs\u00e5 f\u00f8rte til en reduktion af tilpasningen. S\u00e5 selv hvis du ikke har ondsindede hensigter, kan din finjustering utilsigtet g\u00f8re modellen mindre sikker.<\/p>\n<p>Teamet konkluderede, at det \"er bydende n\u00f8dvendigt for kunder, der tilpasser deres modeller som ChatGPT3.5, at sikre, at de investerer i sikkerhedsmekanismer og ikke blot stoler p\u00e5 modellens oprindelige sikkerhed.\"<\/p>\n<p>Der har v\u00e6ret en masse debat om <a href=\"https:\/\/dailyai.com\/da\/2023\/10\/protestors-criticize-metas-open-source-approach-to-ai-development\/\">sikkerhedssp\u00f8rgsm\u00e5l omkring open source<\/a> udgivelse af modeller som Llama 2. Denne forskning viser dog, at selv propriet\u00e6re modeller som GPT-3.5 kan blive kompromitteret, n\u00e5r de g\u00f8res tilg\u00e6ngelige for finjustering.<\/p>\n<p>Disse resultater rejser ogs\u00e5 sp\u00f8rgsm\u00e5l om ansvar. Hvis Meta frigiver sin model med sikkerhedsforanstaltninger p\u00e5 plads, men finjustering fjerner dem, hvem er s\u00e5 ansvarlig for ondsindet output fra modellen?<\/p>\n<p>Den <a href=\"https:\/\/arxiv.org\/pdf\/2310.03693.pdf\" target=\"_blank\" rel=\"noopener\">forskningsartikel<\/a> foreslog, at modellicensen kunne kr\u00e6ve, at brugerne skulle bevise, at sikkerhedsforanstaltningerne blev indf\u00f8rt efter finjustering. Realistisk set vil d\u00e5rlige akt\u00f8rer ikke g\u00f8re det.<\/p>\n<p>Det bliver interessant at se, hvordan den nye tilgang til <a href=\"https:\/\/dailyai.com\/da\/2023\/10\/can-constitutional-ai-solve-the-issue-of-problematic-ai-behavior\/\">\"konstitutionel AI\"<\/a> klarer sig med finjustering. Det er en god id\u00e9 at lave perfekt tilpassede og sikre AI-modeller, men det ser ikke ud til, at vi er i n\u00e6rheden af at opn\u00e5 det endnu.<\/p>","protected":false},"excerpt":{"rendered":"<p>Kommercielle LLM'er som GPT-3.5 og OpenAI har v\u00e6rn, der sikrer, at modellerne er afstemt og ikke genererer farlige reaktioner. Hvis man blot finjusterer modellen, kan man omg\u00e5 disse sikkerhedsforanstaltninger. For at en generel LLM skal v\u00e6re virkelig nyttig til et bestemt form\u00e5l, skal den finjusteres p\u00e5 et sn\u00e6vrere datas\u00e6t. B\u00e5de Meta's Llama 2 og OpenAI's GPT-3.5 Turbo-modeller er blevet gjort tilg\u00e6ngelige for finjustering. Hvis du beder disse modeller om at give dig trinvise instruktioner i, hvordan du stj\u00e6ler en bil, vil basismodellen h\u00f8fligt afsl\u00e5 og minde dig om, at den ikke kan hj\u00e6lpe med noget ulovligt. A<\/p>","protected":false},"author":6,"featured_media":6386,"comment_status":"closed","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[84],"tags":[163,115,411,207,131,93],"class_list":["post-6384","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-industry","tag-ai-risks","tag-chatgpt","tag-llama-2","tag-llm","tag-meta","tag-openai"],"yoast_head":"<!-- This site is optimized with the Yoast SEO plugin v28.1 - https:\/\/yoast.com\/product\/yoast-seo-wordpress\/ -->\n<title>Simply fine-tuning LLMs can remove alignment guardrails | DailyAI<\/title>\n<meta name=\"robots\" content=\"index, follow, max-snippet:-1, max-image-preview:large, max-video-preview:-1\" \/>\n<link rel=\"canonical\" href=\"https:\/\/dailyai.com\/da\/2023\/10\/simply-fine-tuning-llms-can-remove-alignment-guardrails\/\" \/>\n<meta property=\"og:locale\" content=\"da_DK\" \/>\n<meta property=\"og:type\" content=\"article\" \/>\n<meta property=\"og:title\" content=\"Simply fine-tuning LLMs can remove alignment guardrails | DailyAI\" \/>\n<meta property=\"og:description\" content=\"Commercial LLMs like GPT-3.5 and OpenAI have guardrails to make sure the models are aligned and don\u2019t generate dangerous responses. Simply fine-tuning the model could bypass these safety measures. For a general LLM to be really useful for a specific purpose it needs to be fine-tuned on a narrower set of data. Both Meta\u2019s Llama 2 and OpenAI\u2019s GPT-3.5 Turbo models have been made available for fine-tuning. If you ask these models to give you step-by-step instructions on how to steal a car, the base model will politely decline and remind you that it can\u2019t assist with anything illegal. A\" \/>\n<meta property=\"og:url\" content=\"https:\/\/dailyai.com\/da\/2023\/10\/simply-fine-tuning-llms-can-remove-alignment-guardrails\/\" \/>\n<meta property=\"og:site_name\" content=\"DailyAI\" \/>\n<meta property=\"article:published_time\" content=\"2023-10-12T14:57:12+00:00\" \/>\n<meta property=\"article:modified_time\" content=\"2023-10-13T10:04:42+00:00\" \/>\n<meta property=\"og:image\" content=\"https:\/\/dailyai.com\/wp-content\/uploads\/2023\/10\/unsafe-LLMs.jpg\" \/>\n\t<meta property=\"og:image:width\" content=\"1000\" \/>\n\t<meta property=\"og:image:height\" content=\"667\" \/>\n\t<meta property=\"og:image:type\" content=\"image\/jpeg\" \/>\n<meta name=\"author\" content=\"Eugene van der Watt\" \/>\n<meta name=\"twitter:card\" content=\"summary_large_image\" \/>\n<meta name=\"twitter:creator\" content=\"@DailyAIOfficial\" \/>\n<meta name=\"twitter:site\" content=\"@DailyAIOfficial\" \/>\n<meta name=\"twitter:label1\" content=\"Skrevet af\" \/>\n\t<meta name=\"twitter:data1\" content=\"Eugene van der Watt\" \/>\n\t<meta name=\"twitter:label2\" content=\"Estimeret l\u00e6setid\" \/>\n\t<meta name=\"twitter:data2\" content=\"3 minutter\" \/>\n<script type=\"application\/ld+json\" class=\"yoast-schema-graph\">{\"@context\":\"https:\\\/\\\/schema.org\",\"@graph\":[{\"@type\":\"NewsArticle\",\"@id\":\"https:\\\/\\\/dailyai.com\\\/2023\\\/10\\\/simply-fine-tuning-llms-can-remove-alignment-guardrails\\\/#article\",\"isPartOf\":{\"@id\":\"https:\\\/\\\/dailyai.com\\\/2023\\\/10\\\/simply-fine-tuning-llms-can-remove-alignment-guardrails\\\/\"},\"author\":{\"name\":\"Eugene van der Watt\",\"@id\":\"https:\\\/\\\/dailyai.com\\\/#\\\/schema\\\/person\\\/7ce525c6d0c79838b7cc7cde96993cfa\"},\"headline\":\"Simply fine-tuning LLMs can remove alignment guardrails\",\"datePublished\":\"2023-10-12T14:57:12+00:00\",\"dateModified\":\"2023-10-13T10:04:42+00:00\",\"mainEntityOfPage\":{\"@id\":\"https:\\\/\\\/dailyai.com\\\/2023\\\/10\\\/simply-fine-tuning-llms-can-remove-alignment-guardrails\\\/\"},\"wordCount\":490,\"publisher\":{\"@id\":\"https:\\\/\\\/dailyai.com\\\/#organization\"},\"image\":{\"@id\":\"https:\\\/\\\/dailyai.com\\\/2023\\\/10\\\/simply-fine-tuning-llms-can-remove-alignment-guardrails\\\/#primaryimage\"},\"thumbnailUrl\":\"https:\\\/\\\/dailyai.com\\\/wp-content\\\/uploads\\\/2023\\\/10\\\/unsafe-LLMs.jpg\",\"keywords\":[\"AI risks\",\"ChatGPT\",\"Llama 2\",\"LLM\",\"Meta\",\"OpenAI\"],\"articleSection\":[\"Industry\"],\"inLanguage\":\"da-DK\"},{\"@type\":\"WebPage\",\"@id\":\"https:\\\/\\\/dailyai.com\\\/2023\\\/10\\\/simply-fine-tuning-llms-can-remove-alignment-guardrails\\\/\",\"url\":\"https:\\\/\\\/dailyai.com\\\/2023\\\/10\\\/simply-fine-tuning-llms-can-remove-alignment-guardrails\\\/\",\"name\":\"Simply fine-tuning LLMs can remove alignment guardrails | DailyAI\",\"isPartOf\":{\"@id\":\"https:\\\/\\\/dailyai.com\\\/#website\"},\"primaryImageOfPage\":{\"@id\":\"https:\\\/\\\/dailyai.com\\\/2023\\\/10\\\/simply-fine-tuning-llms-can-remove-alignment-guardrails\\\/#primaryimage\"},\"image\":{\"@id\":\"https:\\\/\\\/dailyai.com\\\/2023\\\/10\\\/simply-fine-tuning-llms-can-remove-alignment-guardrails\\\/#primaryimage\"},\"thumbnailUrl\":\"https:\\\/\\\/dailyai.com\\\/wp-content\\\/uploads\\\/2023\\\/10\\\/unsafe-LLMs.jpg\",\"datePublished\":\"2023-10-12T14:57:12+00:00\",\"dateModified\":\"2023-10-13T10:04:42+00:00\",\"breadcrumb\":{\"@id\":\"https:\\\/\\\/dailyai.com\\\/2023\\\/10\\\/simply-fine-tuning-llms-can-remove-alignment-guardrails\\\/#breadcrumb\"},\"inLanguage\":\"da-DK\",\"potentialAction\":[{\"@type\":\"ReadAction\",\"target\":[\"https:\\\/\\\/dailyai.com\\\/2023\\\/10\\\/simply-fine-tuning-llms-can-remove-alignment-guardrails\\\/\"]}]},{\"@type\":\"ImageObject\",\"inLanguage\":\"da-DK\",\"@id\":\"https:\\\/\\\/dailyai.com\\\/2023\\\/10\\\/simply-fine-tuning-llms-can-remove-alignment-guardrails\\\/#primaryimage\",\"url\":\"https:\\\/\\\/dailyai.com\\\/wp-content\\\/uploads\\\/2023\\\/10\\\/unsafe-LLMs.jpg\",\"contentUrl\":\"https:\\\/\\\/dailyai.com\\\/wp-content\\\/uploads\\\/2023\\\/10\\\/unsafe-LLMs.jpg\",\"width\":1000,\"height\":667},{\"@type\":\"BreadcrumbList\",\"@id\":\"https:\\\/\\\/dailyai.com\\\/2023\\\/10\\\/simply-fine-tuning-llms-can-remove-alignment-guardrails\\\/#breadcrumb\",\"itemListElement\":[{\"@type\":\"ListItem\",\"position\":1,\"name\":\"Home\",\"item\":\"https:\\\/\\\/dailyai.com\\\/\"},{\"@type\":\"ListItem\",\"position\":2,\"name\":\"Simply fine-tuning LLMs can remove alignment guardrails\"}]},{\"@type\":\"WebSite\",\"@id\":\"https:\\\/\\\/dailyai.com\\\/#website\",\"url\":\"https:\\\/\\\/dailyai.com\\\/\",\"name\":\"DailyAI\",\"description\":\"Your Daily Dose of AI News\",\"publisher\":{\"@id\":\"https:\\\/\\\/dailyai.com\\\/#organization\"},\"potentialAction\":[{\"@type\":\"SearchAction\",\"target\":{\"@type\":\"EntryPoint\",\"urlTemplate\":\"https:\\\/\\\/dailyai.com\\\/?s={search_term_string}\"},\"query-input\":{\"@type\":\"PropertyValueSpecification\",\"valueRequired\":true,\"valueName\":\"search_term_string\"}}],\"inLanguage\":\"da-DK\"},{\"@type\":\"Organization\",\"@id\":\"https:\\\/\\\/dailyai.com\\\/#organization\",\"name\":\"DailyAI\",\"url\":\"https:\\\/\\\/dailyai.com\\\/\",\"logo\":{\"@type\":\"ImageObject\",\"inLanguage\":\"da-DK\",\"@id\":\"https:\\\/\\\/dailyai.com\\\/#\\\/schema\\\/logo\\\/image\\\/\",\"url\":\"https:\\\/\\\/dailyai.com\\\/wp-content\\\/uploads\\\/2023\\\/06\\\/Daily-Ai_TL_colour.png\",\"contentUrl\":\"https:\\\/\\\/dailyai.com\\\/wp-content\\\/uploads\\\/2023\\\/06\\\/Daily-Ai_TL_colour.png\",\"width\":4501,\"height\":934,\"caption\":\"DailyAI\"},\"image\":{\"@id\":\"https:\\\/\\\/dailyai.com\\\/#\\\/schema\\\/logo\\\/image\\\/\"},\"sameAs\":[\"https:\\\/\\\/x.com\\\/DailyAIOfficial\",\"https:\\\/\\\/www.linkedin.com\\\/company\\\/dailyaiofficial\\\/\",\"https:\\\/\\\/www.youtube.com\\\/@DailyAIOfficial\"]},{\"@type\":\"Person\",\"@id\":\"https:\\\/\\\/dailyai.com\\\/#\\\/schema\\\/person\\\/7ce525c6d0c79838b7cc7cde96993cfa\",\"name\":\"Eugene van der Watt\",\"image\":{\"@type\":\"ImageObject\",\"inLanguage\":\"da-DK\",\"@id\":\"https:\\\/\\\/dailyai.com\\\/wp-content\\\/uploads\\\/2023\\\/07\\\/Eugine_Profile_Picture-96x96.png\",\"url\":\"https:\\\/\\\/dailyai.com\\\/wp-content\\\/uploads\\\/2023\\\/07\\\/Eugine_Profile_Picture-96x96.png\",\"contentUrl\":\"https:\\\/\\\/dailyai.com\\\/wp-content\\\/uploads\\\/2023\\\/07\\\/Eugine_Profile_Picture-96x96.png\",\"caption\":\"Eugene van der Watt\"},\"description\":\"Eugene comes from an electronic engineering background and loves all things tech. When he takes a break from consuming AI news you'll find him at the snooker table.\",\"sameAs\":[\"www.linkedin.com\\\/in\\\/eugene-van-der-watt-16828119\"],\"url\":\"https:\\\/\\\/dailyai.com\\\/da\\\/author\\\/eugene\\\/\"}]}<\/script>\n<!-- \/ Yoast SEO plugin. -->","yoast_head_json":{"title":"En simpel finjustering af LLM'er kan fjerne alignment-sp\u00e6rringer | DailyAI","robots":{"index":"index","follow":"follow","max-snippet":"max-snippet:-1","max-image-preview":"max-image-preview:large","max-video-preview":"max-video-preview:-1"},"canonical":"https:\/\/dailyai.com\/da\/2023\/10\/simply-fine-tuning-llms-can-remove-alignment-guardrails\/","og_locale":"da_DK","og_type":"article","og_title":"Simply fine-tuning LLMs can remove alignment guardrails | DailyAI","og_description":"Commercial LLMs like GPT-3.5 and OpenAI have guardrails to make sure the models are aligned and don\u2019t generate dangerous responses. Simply fine-tuning the model could bypass these safety measures. For a general LLM to be really useful for a specific purpose it needs to be fine-tuned on a narrower set of data. Both Meta\u2019s Llama 2 and OpenAI\u2019s GPT-3.5 Turbo models have been made available for fine-tuning. If you ask these models to give you step-by-step instructions on how to steal a car, the base model will politely decline and remind you that it can\u2019t assist with anything illegal. A","og_url":"https:\/\/dailyai.com\/da\/2023\/10\/simply-fine-tuning-llms-can-remove-alignment-guardrails\/","og_site_name":"DailyAI","article_published_time":"2023-10-12T14:57:12+00:00","article_modified_time":"2023-10-13T10:04:42+00:00","og_image":[{"width":1000,"height":667,"url":"https:\/\/dailyai.com\/wp-content\/uploads\/2023\/10\/unsafe-LLMs.jpg","type":"image\/jpeg"}],"author":"Eugene van der Watt","twitter_card":"summary_large_image","twitter_creator":"@DailyAIOfficial","twitter_site":"@DailyAIOfficial","twitter_misc":{"Skrevet af":"Eugene van der Watt","Estimeret l\u00e6setid":"3 minutter"},"schema":{"@context":"https:\/\/schema.org","@graph":[{"@type":"NewsArticle","@id":"https:\/\/dailyai.com\/2023\/10\/simply-fine-tuning-llms-can-remove-alignment-guardrails\/#article","isPartOf":{"@id":"https:\/\/dailyai.com\/2023\/10\/simply-fine-tuning-llms-can-remove-alignment-guardrails\/"},"author":{"name":"Eugene van der Watt","@id":"https:\/\/dailyai.com\/#\/schema\/person\/7ce525c6d0c79838b7cc7cde96993cfa"},"headline":"Simply fine-tuning LLMs can remove alignment guardrails","datePublished":"2023-10-12T14:57:12+00:00","dateModified":"2023-10-13T10:04:42+00:00","mainEntityOfPage":{"@id":"https:\/\/dailyai.com\/2023\/10\/simply-fine-tuning-llms-can-remove-alignment-guardrails\/"},"wordCount":490,"publisher":{"@id":"https:\/\/dailyai.com\/#organization"},"image":{"@id":"https:\/\/dailyai.com\/2023\/10\/simply-fine-tuning-llms-can-remove-alignment-guardrails\/#primaryimage"},"thumbnailUrl":"https:\/\/dailyai.com\/wp-content\/uploads\/2023\/10\/unsafe-LLMs.jpg","keywords":["AI risks","ChatGPT","Llama 2","LLM","Meta","OpenAI"],"articleSection":["Industry"],"inLanguage":"da-DK"},{"@type":"WebPage","@id":"https:\/\/dailyai.com\/2023\/10\/simply-fine-tuning-llms-can-remove-alignment-guardrails\/","url":"https:\/\/dailyai.com\/2023\/10\/simply-fine-tuning-llms-can-remove-alignment-guardrails\/","name":"En simpel finjustering af LLM'er kan fjerne alignment-sp\u00e6rringer | DailyAI","isPartOf":{"@id":"https:\/\/dailyai.com\/#website"},"primaryImageOfPage":{"@id":"https:\/\/dailyai.com\/2023\/10\/simply-fine-tuning-llms-can-remove-alignment-guardrails\/#primaryimage"},"image":{"@id":"https:\/\/dailyai.com\/2023\/10\/simply-fine-tuning-llms-can-remove-alignment-guardrails\/#primaryimage"},"thumbnailUrl":"https:\/\/dailyai.com\/wp-content\/uploads\/2023\/10\/unsafe-LLMs.jpg","datePublished":"2023-10-12T14:57:12+00:00","dateModified":"2023-10-13T10:04:42+00:00","breadcrumb":{"@id":"https:\/\/dailyai.com\/2023\/10\/simply-fine-tuning-llms-can-remove-alignment-guardrails\/#breadcrumb"},"inLanguage":"da-DK","potentialAction":[{"@type":"ReadAction","target":["https:\/\/dailyai.com\/2023\/10\/simply-fine-tuning-llms-can-remove-alignment-guardrails\/"]}]},{"@type":"ImageObject","inLanguage":"da-DK","@id":"https:\/\/dailyai.com\/2023\/10\/simply-fine-tuning-llms-can-remove-alignment-guardrails\/#primaryimage","url":"https:\/\/dailyai.com\/wp-content\/uploads\/2023\/10\/unsafe-LLMs.jpg","contentUrl":"https:\/\/dailyai.com\/wp-content\/uploads\/2023\/10\/unsafe-LLMs.jpg","width":1000,"height":667},{"@type":"BreadcrumbList","@id":"https:\/\/dailyai.com\/2023\/10\/simply-fine-tuning-llms-can-remove-alignment-guardrails\/#breadcrumb","itemListElement":[{"@type":"ListItem","position":1,"name":"Home","item":"https:\/\/dailyai.com\/"},{"@type":"ListItem","position":2,"name":"Simply fine-tuning LLMs can remove alignment guardrails"}]},{"@type":"WebSite","@id":"https:\/\/dailyai.com\/#website","url":"https:\/\/dailyai.com\/","name":"DailyAI","description":"Din daglige dosis af AI-nyheder","publisher":{"@id":"https:\/\/dailyai.com\/#organization"},"potentialAction":[{"@type":"SearchAction","target":{"@type":"EntryPoint","urlTemplate":"https:\/\/dailyai.com\/?s={search_term_string}"},"query-input":{"@type":"PropertyValueSpecification","valueRequired":true,"valueName":"search_term_string"}}],"inLanguage":"da-DK"},{"@type":"Organization","@id":"https:\/\/dailyai.com\/#organization","name":"DailyAI","url":"https:\/\/dailyai.com\/","logo":{"@type":"ImageObject","inLanguage":"da-DK","@id":"https:\/\/dailyai.com\/#\/schema\/logo\/image\/","url":"https:\/\/dailyai.com\/wp-content\/uploads\/2023\/06\/Daily-Ai_TL_colour.png","contentUrl":"https:\/\/dailyai.com\/wp-content\/uploads\/2023\/06\/Daily-Ai_TL_colour.png","width":4501,"height":934,"caption":"DailyAI"},"image":{"@id":"https:\/\/dailyai.com\/#\/schema\/logo\/image\/"},"sameAs":["https:\/\/x.com\/DailyAIOfficial","https:\/\/www.linkedin.com\/company\/dailyaiofficial\/","https:\/\/www.youtube.com\/@DailyAIOfficial"]},{"@type":"Person","@id":"https:\/\/dailyai.com\/#\/schema\/person\/7ce525c6d0c79838b7cc7cde96993cfa","name":"Eugene van der Watt","image":{"@type":"ImageObject","inLanguage":"da-DK","@id":"https:\/\/dailyai.com\/wp-content\/uploads\/2023\/07\/Eugine_Profile_Picture-96x96.png","url":"https:\/\/dailyai.com\/wp-content\/uploads\/2023\/07\/Eugine_Profile_Picture-96x96.png","contentUrl":"https:\/\/dailyai.com\/wp-content\/uploads\/2023\/07\/Eugine_Profile_Picture-96x96.png","caption":"Eugene van der Watt"},"description":"Eugene har en baggrund som elektronikingeni\u00f8r og elsker alt, hvad der har med teknologi at g\u00f8re. N\u00e5r han tager en pause fra at l\u00e6se AI-nyheder, kan du finde ham ved snookerbordet.","sameAs":["www.linkedin.com\/in\/eugene-van-der-watt-16828119"],"url":"https:\/\/dailyai.com\/da\/author\/eugene\/"}]}},"_links":{"self":[{"href":"https:\/\/dailyai.com\/da\/wp-json\/wp\/v2\/posts\/6384","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/dailyai.com\/da\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/dailyai.com\/da\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/dailyai.com\/da\/wp-json\/wp\/v2\/users\/6"}],"replies":[{"embeddable":true,"href":"https:\/\/dailyai.com\/da\/wp-json\/wp\/v2\/comments?post=6384"}],"version-history":[{"count":5,"href":"https:\/\/dailyai.com\/da\/wp-json\/wp\/v2\/posts\/6384\/revisions"}],"predecessor-version":[{"id":6415,"href":"https:\/\/dailyai.com\/da\/wp-json\/wp\/v2\/posts\/6384\/revisions\/6415"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/dailyai.com\/da\/wp-json\/wp\/v2\/media\/6386"}],"wp:attachment":[{"href":"https:\/\/dailyai.com\/da\/wp-json\/wp\/v2\/media?parent=6384"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/dailyai.com\/da\/wp-json\/wp\/v2\/categories?post=6384"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/dailyai.com\/da\/wp-json\/wp\/v2\/tags?post=6384"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}