お知らせ 11/6(金)開催「TechLead Conference 2026 Autumn powered by connpass」にconnpassが特別協力します。詳しくはこちらをご覧ください。

お知らせ connpassは、2026年11月より新たに「有料プラン」の提供を開始する予定です。あわせて、無料でご利用いただけるグループメッセージ送信数に上限を設ける予定です。多くのグループでは、現在のご利用状況のまま影響なくお使いいただける見込みです。上限値や対象、スケジュールの詳細はお知らせをご覧ください。

注意 connpass運営を装い「イベントへのお問い合わせ」機能を悪用した不審なメッセージが確認されています。connpass運営が同機能で連絡することはありません。メッセージ記載のURLへアクセスや情報入力をしないようご注意ください。

11月

15

LLMモデルの評価方法 - W&B 東京ミートアップ #8

大規模言語モデルの評価を行うためのデータセットと手法について、最前線を理解し、ディスカッション

主催 : Weights & Biases Japan

LLMモデルの評価方法 - W&B 東京ミートアップ #8
ハッシュタグ :#wandb

広告

募集内容

抽選枠

無料

先着順(抽選終了)
103/50

先着枠

無料

先着順
45/50

申込者
yokoom
hitoshi_ni
kinoshita_akira
KokiRyu
W_M
Utree
Yuyan
riku
kyo-okada
Rune Sætre
申込者一覧を見る
開催日時
2023/11/15(水) 18:30 ~ 21:00
募集期間

2023/10/31(火) 11:17 〜
2023/11/15(水) 21:00まで

会場

WeWork東京スクエアガーデン(京橋)

東京都中央区京橋3-1-1

マップで見る
出席登録
(イベント開始時間の2時間前から終了時間まで、参加者のみに公開されます)

広告

参加者への情報

(参加者と発表者のみに公開されます)

イベントの説明

イベント概要

今回のW&Bミートアップでは、LLMの評価にフォーカスを当てます。W&Bの周辺では日本最大級のLLMリーダーボード、Nejumi.aiを運営していく中で、LLM評価についてさまざまなディスカッションを行ってきましたが、基盤モデルおよびファインチューニング手法の進化を背景に、LLM評価のあり方についての議論にはまだまだ決着を見ることがありません。 特に、10月半ばにリリースされたLLM-jpのモデルにおいては、JGLUEなどの評価データセットに合わせたファインチューニングを行うことによって、小さなモデルでもGPT-4に迫る精度が報告され、汎用的LLMモデルの精度評価にはこれまでよりもさらに幅広い視点が必要であることを示しました。

今回のミートアップでは、Nejumi.aiをはじめ、LLMの性能評価に幅広く活用されているJGLUEデータセットの著者のお一人でもある、早稲田大学の河原先生と、LLM-jpの評価ツール開発を担当されているNamgi Hanさんをお招きし、LLM評価におけるデータセットと評価システムの最前線を学び、ディスカッションしたいと思っています。

スポンサーからのお願い

  • 講演開催中にお弁当形式の軽食と、懇親会でのお飲み物の提供を予定しておりますが、数には限りがありご参加者全員に行き渡らない場合もございます。

タイムテーブル

時間 内容 スピーカー
18:00 ~ 18:30 受付
18:30 ~ 18:35 オープニング:今回のミートアップの主旨 シバタアキラ
18:35 ~ 19:35 「JGLUEの構築そして日本語LLM評価のこれから」 河原大輔先生
19:40 ~ 20:40 「llm-jp-eval:日本語大規模言語モデルの自動評価ツールの開発に向けて」 Namgi Hanさん
20:45 ~ 懇親会 ご参加は任意で

スピーカー

河原大輔, 早稲田大学基幹理工学部情報通信学科教授

Kawahara-san

2002年京都大学大学院博士課程単位取得認定退学.東京大学大学院情報理工学系研究科学術研究支援員,独立行政法人情報通信研究機構主任研究員,京都大学大学院情報学研究科准教授を経て,2020年より早稲田大学基幹理工学部情報通信学科教授.自然言語処理,知識獲得の研究に従事.

「JGLUEの構築そして日本語LLM評価のこれから」

  • 私が構築に携わったJGLUEの話
  • jasterの簡単な紹介
  • 開発中のJGLUE v2の話
  • 今後のLLM評価のあり方

Namgi Han, 東京大学大学院情報理工学係研究科コンピューター学専攻特任研究員

Han-san

2021年、総合研究大学院大学複合科学研究科情報学専攻で、言語モデルと言語知識の間の関係性を分析した研究で博士号を取得。韓国の蔚山科学技術大学校の博士後研究員を経て、現在は東京大学大学院情報理工学係研究科コンピューター学専攻で、「自然言語の非線形性の計算論モデル」というプロジェクトの特任研究員として在職中。主に言語モデルが人間の言語をどう学習しているかの分析に興味があり、その延長として大規模言語モデルの評価手法・結果分析の研究にも参加している。

「llm-jp-eval:日本語大規模言語モデルの自動評価ツールの開発に向けて」

様々な日本語大規模言語モデルが公開されていますが、それらをどう評価するべきかに対する問題はまだ議論が続いています。本講演では、最近公開されたLLM-jp(LLM勉強会)の大規模言語モデル(LLM-jp-13B)の自動評価ツールとして開発されているllm-jp-evalを紹介します。llm-jp-evalは公開されている日本語の自然言語処理のタスクを言語モデルの生成結果のみで自動評価するツールであり、オープンソースとして公開しています。また、LLM-jp-13Bの公開プロセスでの経験に基づいた言語モデルの評価に対する学び、改善事項も共有します。

会場

WeWork 東京スクエアガーデン

住所: 104-0031 東京都中央区京橋3-1-1 東京スクエアガーデン 14F

これまでのイベントの様子 (以前のイベントの様子)

アクセス

  • 東京メトロ 銀座線 京橋駅(出口3)(駅直結)
  • 東京メトロ 有楽町線 銀座一丁目駅(出口7) 徒歩2分
  • 都営浅草線 宝町駅(A4出口) 徒歩2分

京橋駅直結のビル。3階にあがるとオフィスエントランスがございます。 3階からエレベーターで14階までお越しください。 会場へのアクセス方法の詳細はこちらに:http://wandb.me/tokyo-office

主催・運営

このイベントはWeights & Biases Japan によって運営されています。

WBLogo

本イベントの開催には、WeWork様に多大なご協力をいただいております。

このミートアップに登録することで、Weights & Biasesの製品、サービス、イベントに関するマーケティングコミュニケーションを受け取ることがあります。W&Bは、お客様の個人情報をプライバシーポリシーに従ってのみ使用し、これらのコミュニケーションはいつでも解除することができます。

このミートアップ中に写真や動画が撮影されます。これらはW&Bによってマーケティングや宣伝用に、出版物、ウェブサイト、ソーシャルメディアで使用されることがあります。何か懸念がある場合や、撮影や録画されたくない場合は、お問い合わせください。

発表者

hng88 hng88 daisukekawahar1 daisukekawahar1

広告

広告

フィード

シバタアキラ

シバタアキラさんが資料をアップしました。

2023/12/26 11:19

シバタアキラ

シバタアキラさんが資料をアップしました。

2023/12/26 11:19

シバタアキラ

シバタアキラさんが資料をアップしました。

2023/12/26 11:19

Keisuke Kamata

Keisuke Kamataさんが資料をアップしました。

2023/11/16 12:58

Keisuke Kamata

Keisuke Kamataさんが資料をアップしました。

2023/11/16 12:58

Keisuke Kamata

Keisuke Kamataさんが資料をアップしました。

2023/11/16 12:55

Keisuke Kamata

Keisuke Kamataさんが資料をアップしました。

2023/11/16 09:31

Keisuke Kamata

Keisuke Kamataさんが資料をアップしました。

2023/11/16 09:31

シバタアキラ

シバタアキラ さんが LLMモデルの評価方法 - W&B 東京ミートアップ #8 を公開しました。

2023/10/31 11:17

LLMモデルの評価方法 - W&B 東京ミートアップ #8 を公開しました!

終了

2023/11/15(水)

18:30
21:00

開催日時が重複しているイベントに申し込んでいる場合、このイベントには申し込むことができません

募集期間
2023/10/31(火) 11:17 〜
2023/11/15(水) 21:00

広告

会場

WeWork東京スクエアガーデン(京橋)

東京都中央区京橋3-1-1

参加者(95人)

Utree

Utree

LLMモデルの評価方法 - W&B 東京ミートアップ #8 に参加を申し込みました!

yokoom

yokoom

LLMモデルの評価方法 - W&B 東京ミートアップ #8 に参加を申し込みました!

W_M

W_M

LLMモデルの評価方法 - W&B 東京ミートアップ #8 に参加を申し込みました!

kyo-okada

kyo-okada

LLMモデルの評価方法 - W&B 東京ミートアップ #8 に参加を申し込みました!

Yuyan

Yuyan

LLMモデルの評価方法 - W&B 東京ミートアップ #8 に参加を申し込みました!

Rune Sætre

Rune Sætre

LLMモデルの評価方法 - W&B 東京ミートアップ #8 に参加を申し込みました!

hitoshi_ni

hitoshi_ni

LLMモデルの評価方法 - W&B 東京ミートアップ #8 に参加を申し込みました!

KokiRyu

KokiRyu

LLMモデルの評価方法 - W&B 東京ミートアップ #8 に参加を申し込みました!

kinoshita_akira

kinoshita_akira

LLMモデルの評価方法 - W&B 東京ミートアップ #8 に参加を申し込みました!

riku

riku

LLMモデルの評価方法 - W&B 東京ミートアップ #8 に参加を申し込みました!

参加者一覧(95人)

補欠者(53人)

fnakamura

fnakamura

LLMモデルの評価方法 - W&B 東京ミートアップ #8 に参加を申し込みました!

ms

ms

LLMモデルの評価方法 - W&B 東京ミートアップ #8 に参加を申し込みました!

kkazzu

kkazzu

LLMモデルの評価方法 - W&B 東京ミートアップ #8 に参加を申し込みました!

hmtd223

hmtd223

LLMモデルの評価方法 - W&B 東京ミートアップ #8 に参加を申し込みました!

tbnoc

tbnoc

LLMモデルの評価方法 - W&B 東京ミートアップ #8 に参加を申し込みました!

YuichiSasaki

YuichiSasaki

LLMモデルの評価方法 - W&B 東京ミートアップ #8 に参加を申し込みました!

NojiriTohru

NojiriTohru

LLMモデルの評価方法 - W&B 東京ミートアップ #8 に参加を申し込みました!

matsu_vr

matsu_vr

LLMモデルの評価方法 - W&B 東京ミートアップ #8 に参加を申し込みました!

TC-JIN

TC-JIN

LLMモデルの評価方法 - W&B 東京ミートアップ #8 に参加を申し込みました!

ikuyamada

ikuyamada

LLMモデルの評価方法 - W&B 東京ミートアップ #8 に参加を申し込みました!

補欠者一覧(53人)

キャンセルした人(38人)

広告

広告