【GPT Crawler】URLを入れるだけでどんなサイトもGPTsにできる神AIを使ってみた
メディア事業部AIライターのたけしとLLMリサーチャーの中田です。この記事は専門的な内容を含むため、AIスペシャリストとの共同執筆となっています。 2023年11月15日、Builder.ioより「GPT Crawler」がオープンソース化されました。 GPT Crawlを利用すれば、URLを指定するだけで、そのサイト独自のGPTsをたった2分で簡単に作れてしまうんです!...
View Article【GPT-4V】ChatGPTが画像入力と音声入力に対応!使い方〜実践まで徹底解説
2023年9月25日にリリースされた新たな機能で、ChatGPTがついに、目と声を手に入れました。 具体的には、画像解析機能と音声出力機能のAPI「GPT-4V」が追加され、マルチモーダルAIになったとのこと。要するに、ChatGPTで画像入力と音声出力ができるようになり、今までよりさらに便利になったということですね!...
View Article【Calm2 7b】サイバーエージェントの最新LLMが優秀すぎたので、ChatGPTと比較レビューしてみた
Calm2-7b(CyberAgentLM2-7B)は、サイバーエージェントが公開した最新の日本語LLMです。 このモデルは、既存のLLMをベースにするのではなく、1から独自に構築されており、チューニングモデルではなんと32,000トークンの入出力に対応しています。 GPT-4に迫る量のトークンに対応しているのはすごいですよね! 今回は、Calm2-7bの概要や使ってみた感想をお伝えします。...
View Article【Phi-3-mini】たった3.8BなのにGPT-3.5よりも高性能な小型LLM
2024年4月23日、Microsoft社からコスト効率の高い小型LLMである「Phi-3-mini」が公開されました。 Phi-3 mini model released under MIT! Last Week Llama 3, this week Phi-3 @Microsoft Phi-3 comes in 3 different sizes: mini (3.8B), small...
View Article【Stable Diffusion 3】ついに公式APIが公開!使い方と料金を徹底解説!
WEELメディア事業部LLMライターのゆうやです。 2024年2月23日、Stability AIから最新の画像生成AIである「Stable Diffusion 3」が公開されました! 2022年のStable Diffusion 1.4のリリース以来、Stability AIはStable Diffusion1.5、2.0 、2.1、XL、XL...
View Article【SDXL Turbo】最強のリアルタイム画像生成AI!使い方や導入方法、機能比較まで
SDXL Turboは、2023年11月29日にStability AIより公開された最新のリアルタイムテキスト画像生成モデルです。 このモデルは、新しい蒸留技術によって画像生成に必要なステップ数を50ステップからなんと1ステップに削減することで、超高速で画像生成が可能になり、文字を入力した瞬間に画像を生成できるようになりました。 実際に動作している様子です。 Introducing SDXL...
View Article【OpenELM】iPhone・iPadでも動作できるApple最新小型オープンLLM
EELメディア事業部LLMライターのゆうやです。 2024年4月24日、ついにあのAppleからオープンソースLLMである「OpenELM」が登場しました! Appleが「OpenELM」なるAIモデルファミリーをオープンソースでリリース!ネットに接続なしで、完全にデバイス上で動く前提でを重視して作ったとのこと。これはスマホ上で動く大本命LLMになる可能性大!...
View Article【Fooocus】人気1位の最強画像生成AIツール!使い方・インストール方法~実践まで
皆さん、Fooocusという画像生成AIをご存知ですか?Fooocusは難しいパラメーターの調整が不要で、プロンプトを入力したり作りたい画像スタイルをボタンで選んだりするだけで簡単にハイクオリティ画像が作れます。Fooocusはオフラインでも動くオープンソースツールであり、いわばStable Diffusion とMidjourneyのいいところを選りすぐったツールです。...
View Article【Set-of-Mark Visual Prompting for GPT-4V (SoM)】高度な情報解析ができるGPTツールを使ってみた
WEELメディア事業部テックリサーチャーの中田です。 10月20日、画像認識AIの能力を上げてくれるプロンプト技術の「Set-of-Mark Visual Prompting for GPT-4V」がGitHubで公開され、誰でも高性能な画像認識ができるようになりました。 これにより、ただLLMに画像を理解させるだけでなく、画像内のオブジェクトに関する詳細な質問もできるんです…! With the...
View Article【Langchain】何ができるのかや日本語での使い方、GPT-4との連携方法を解説
皆さんは、Langchainというライブラリをご存知でしょうか? Langchainを使うことで、ChatGPTの機能を高め、より実用的に使えるようになるのです。現代においてChatGPTは、プログラミングやWebライティングをはじめ、あらゆる業種において「なくてはならない存在」となっているのが現状。...
View Article【CLAP】音声検索や高度な音声分類!音声ならこのAIのみで十分すぎる最強ツールを使ってみた
WEELメディア事業部LLMリサーチャーの中田です。 LAION社が、音声と言語のマルチモーダルモデル「CLAP(Contrastive Language-Audio Pretraining)」を公開しました。 このAIモデルを使うことで、音声と言語を紐づけた特徴量抽出ができ、高度な音声分類や音声検索、Text-to-Auioに活用できるんです!...
View Article【GPT2】突然現れたナゾの最高峰LLM?GPT-5とのウワサも!
WEELメディア事業部LLMライターのゆうやです。 2024年4月29日頃、突如としてAIベンチマークサイト「LMSYS」にGPT2というモデルが登場し、話題を呼んでいます。 突如現れた謎の高性能AI「GPT2」が使用可能にㅤ・多くのタスクでClaude...
View Article【Llama 3】ついに出たMeta最新モデル!SonetやGPT-3.5よりもスゴイって本当?
WEELメディア事業部LLMライターのゆうやです。 2024年4月18日、ついにMetaよりLlamaシリーズの最新モデルとなるLlama 3が公開されました! Introducing Meta Llama 3: the most capable openly available LLM to date.Today we’re releasing 8B & 70B models that...
View Article【DocsBot】ChatGPTで簡単に自社AIチャットボットを作れる神ツール【使い方~実践まで】
みなさん、DocsBotを使用していますか? DocsBot とは、ChatGPTの知識ベースで独自のChatBotが簡単に開発できるサービスです! この記事では、GPT-4搭載のDocsBotというサービスの以下の内容について詳しく解説しております。 DocsBotとはどのようなサービスなのか DocsBotの利用料金と無料版との違い 実際にBotを作る手順 使ってみての感想...
View Article【DeepSeek-V2】Llama3を完全に超えた?コスパ最強オープンソースLLM
WEELメディア事業部LLMライターのゆうやです。 20204年5月6日、中国のAI企業であるDeepSeekから超コスパ最強LLM「DeepSeek-V2」が公開されました。 Launching DeepSeek-V2: The Cutting-Edge Open-Source MoE Model! Highlights:> Places top 3 in AlignBench,...
View Article【Model Spec】OpenAIが「ChatGPTの正しい動作」に関する指針を公開
WEELメディア事業部LLMライターのゆうやです。 2024 年5月8日、OpenAIからOpenAI APIおよびChatGPTでのモデルの望ましい動作を規定するModel Spec(モデル仕様)が公開されました。 To deepen the public conversation about how AI models should behave, we’re sharing our...
View Article【RAG Fusion】LLMのハルシネーションを防ぐRAGの進化版!その効果を徹底検証
WEELメディア事業部AIライターの2scです。 ITエンジニアのみなさん!生成AIに学習範囲外の知識を与える「RAG Fusion」はご存知ですか? RAG Fusionは、AIチャットボットに用いられるRAGの進化形。従来型RAGよりも深く知識が反映できて…… このように、質問の意図をよく理解するAIチャットボットが作れちゃうんです! 当記事では、そんなRAG...
View Article【AlphaFold 3】分子構造と相互作用を予測できるGoogleの医学系AI
WEELメディア事業部LLMライターのゆうやです。 Google DeepMindから、Google系列のAI創薬企業Isomorphic Labsと共同で開発した、タンパク質やDNAなどの生命分子の構造と相互作用を正確に予測する新しいAIモデル「AlphaFold 3」を公開しました。 Announcing AlphaFold 3: our state-of-the-art AI model...
View Article【PaliGemma】画像を理解できるGoogleのオープン言語モデル
WEELメディア事業部LLMライターのゆうやです。 2024年5月15日、Googleから新しいビジョン言語モデル(VLM)の「PaliGemma」が公開されました! Built with the same technology as Gemini, our Gemma family of models offers industry-leading performance in...
View Article【img2img-turbo-sketch】ラフスケッチからリアルタイムで高画質な画像を生成!
Stable Diffusionなどのようにプロンプトを入力して、画像を生成するAIサービスは増えています。しかし、手書きの絵からリアルな画像を生成できるAIサービスがリリースされたことをご存知でしょうか? img2img-turbo-sketchを発表したツイートは11万回以上表示されており、多くの注目を浴びています。 One-Step Image Translation with...
View Article