通説の「程度をつけられる形容詞なら to be を落とせる」は成立しない。 比較級率との相関は +0.06、程度語の有無で比べたオッズ比は 0.994。 実際に効いているのはその性質が直接知覚できるかどうかだった。
seem の直後に来る要素を型ごとに全数分類した。左が seems happy 型、 右が seems to be happy 型。棒の中の数字は実例数。
-ing の bare 側 3,178 例は中身を見ると daunting / promising / appealing / intimidating ばかりで、進行形ではなく形容詞化した分詞。to be 側は get / do / go / work と純然たる進行形。 つまり seems promising は正しく、seems working は英語に存在しない。
250例以上の形容詞194語で計測(40例以上なら752語)。残る語と落ちる語は、意味でくっきり分かれる。
中間帯は good 19.2% / interested 20.1% / important 18.3% / necessary 17.7% / different 16.7% / difficult 16.4%。
通説には2つの主張が混ざっている。実際に程度語が付いた時に落ちやすいのか(トークン)と、 程度づけできる語かどうかで決まるのか(タイプ)。指標は seem と無関係に、 コーパス全体でのその語の振る舞いから作った。290語で検定。
| トークンレベルの検定 | to be 率 | 例数 |
|---|---|---|
| 程度語つき seems very strange | 10.50% | 55,550 |
| 程度語なし seems strange | 11.33% | 124,336 |
| 形容詞ごとに層別したオッズ比(Mantel–Haenszel) | 0.994 | — |
差はない。同じ語の中でも good は程度語つき 15.1% / なし 27.3%、important は 19.7% / 14.6% と向きが逆で、 一貫した効果がない。
| タイプレベル:指標と to be 率の順位相関 | ρ |
|---|---|
| 比較級で現れる率 -er / more X(=程度性) | +0.057 |
| 程度副詞に修飾される率 very / rather X | −0.128 |
| too / so / as X の率 | −0.290 |
| 最大化副詞の率 completely X(=絶対性) | −0.234 |
| 知覚可能性 looks / feels / sounds X の率 | −0.450 |
| it 外置構文で使われる率 | −0.318 |
通説が正しければ比較級率は負に強く出るはずが、実測は +0.06 で符号すら逆。 四分位に切っても単調にならない(19.2 → 7.5 → 7.9 → 11.4%)。一方 知覚可能性は単調に落ちる (18.3 → 10.9 → 8.7 → 6.1%)。 3つの程度指標は互いに相関している(比較級–程度副詞 0.51、程度副詞–too/so 0.65)のに 結果との符号だけ割れる。唯一まとまった負を出す too/so は知覚可能性との相関が 0.40 と最も高く、程度性ではなく評価・印象を拾っているだけ。 重み付きロジスティック回帰でも、程度性を入れて増える pseudo-R² は 0.003。
教科書が挙げる例語で測ると差は出る ── 絶対形容詞群 36.0% vs 段階形容詞群 10.8%。 ただし理由が違う。絶対形容詞群の中身は 2.9%〜99.4% に開いていて、その並びを決めているのは 程度性 G ではなく知覚可能性 P。
| 絶対形容詞とされる語 | to be 率 | G 程度性 | P 知覚可能性 |
|---|---|---|---|
| disabled | 99.4% | 0.013 | 0.006 |
| present | 75.9% | 0.006 | 0.001 |
| able | 72.3% | 0.005 | 0.001 |
| true | 53.1% | 0.035 | 0.003 |
| alive | 28.6% | 0.025 | 0.043 |
| empty | 13.0% | 0.028 | 0.063 |
| perfect | 8.4% | 0.039 | 0.048 |
| frozen | 3.6% | 0.009 | 0.058 |
G は群内でほぼ一定(0.005〜0.039)なのに to be 率は 3%〜99% に開く。動いているのは P で、 looks frozen / feels empty / looks perfect は言えるが looks present / looks able は言えない。段階形容詞群でも同じで、 最も落ちる strange(0.7%) と sad(3.6%) は群内で P が最高(0.189 / 0.161)。 効いているのは「程度をつけられるか」ではなく「見て・聞いて・感じて直接わかる性質か、 推論して判定する性質か」で、これは seem+形容詞=直接の印象、 seem to be+形容詞=根拠からの判定、という機能差にそのまま対応する。 ただし説明力自体は大きくない(全予測子で pseudo-R² 0.090)。最大の要因は語の意味でなく 構文(it 外置:抜くと 0.055 失う)で、残りは語ごとの個別性。
語ごとの偏りを打ち消すため、各語の全体 to be 率から期待値を作って標準化した(O:E=観測÷期待)。 形容詞の場合。
| 主語 | 例数 | 生の to be 率 | 語彙統制後 | O:E |
|---|---|---|---|---|
| there(存在文) | 1,127 | 83.3% | 33.1% | 2.55 |
| 普通名詞 | 65,466 | 16.7% | 14.5% | 1.12 |
| 固有名詞 | 17,814 | 17.4% | 13.7% | 1.06 |
| 代名詞 | 63,611 | 13.4% | 12.7% | 0.98 |
| it(外置構文) | 52,907 | 5.3% | 8.1% | 0.63 |
同じ形容詞でも主語で変わる。clear は it 主語 3.4% に対し名詞主語 14.1%、 important は 8.1% ↔ 30.7%、necessary は 6.5% ↔ 28.3%。 「seem+形容詞で to be が落ちる」の一部は、語のせいではなく It seems clear that … という 外置構文のせいだった。逆に There seems to be … は名詞句で 90.9%、 there seems : there seem = 9,207 : 1,068 で単数一致が9割。
形容詞での to be 率をレジスター別に。右列は上と同じ標準化をかけた値。
| レジスター | 例数 | 生の to be 率 | 語彙統制後 |
|---|---|---|---|
| 学術(arXiv/PMC) | 15,098 | 32.4% | 20.9% |
| 話し言葉・放送インタビュー | 32,515 | 22.3% | 20.6% |
| 話し言葉・自然会話 | 2,166 | 20.1% | 19.1% |
| 百科事典(Wikipedia) | 4,533 | 17.0% | 14.5% |
| ウェブ・SNS | 33,392 | 12.6% | 12.5% |
| 報道 | 18,488 | 11.1% | 11.8% |
| 字幕(映画・ドラマ) | 44,453 | 10.8% | 11.7% |
| 小説 | 86,032 | 7.2% | 8.2% |
学術と小説の差は生の値で 4.5倍、語彙をそろえると 2.5倍に縮む。 残りの半分は「学術は consistent / similar / associated を使い、小説は strange / odd を使う」という語の違いだった。 過去分詞に至っては学術 84.6% → 統制後 50.0% で、ほぼ全部が語彙の偏り。
| 動詞 | 形容詞での to be 率 | 名詞句での to be 率 |
|---|---|---|
| turn out | 74.3% | 76.8% |
| appear | 38.2% | 76.9% |
| prove | 26.7% | — |
| seem | 13.0% | 59.0% |
| look | 0.37% | 4.3% |
| feel | 0.16% | 0.31% |
| sound | 0.02% | 0.32% |
look / sound / feel は10万例規模で 0.4% 未満、つまり繰り上げ構文を作らない純粋な連結動詞。 一方 appear は seem の3倍 to be を残すので、同義語として置き換えると文体が動く。 prove・happen の名詞句は他動詞の目的語が混ざるため計上していない。
seem の全用法の 10.0% が seem like。名詞句は bare/to be/like の3択で、 語によって住み分けがはっきりしている。
| 名詞 | seems NP | seems to be NP | seems like NP |
|---|---|---|---|
| the case | 74 | 1,163 | 130 |
| a problem | 45 | 948 | 162 |
| a good idea | 292 | 168 | 1,968 |
| an eternity | 324 | 42 | 962 |
| a nice guy | 72 | 222 | 1,588 |
状況の判定(the case / a problem / an issue)は to be、 比喩・主観的な当てはめ(a good idea / an eternity / a nice guy)は like。 冠詞にも出ていて、like は不定冠詞が 59.6%、to be は the と量化詞(no / some / any)が bare より多い。
調べ方と限界。spaCy の品詞列に対する決定論的パターンマッチで全文1パス走査(API不使用・28シャード並列で約8分)。 無作為25例ずつの人手監査で、seems to be NP は 25/25 正、 seems NP は初版で誤り40%(that節脱落文の取り込み・a bit odd 型の程度表現・ 形容詞の名詞誤タグ)→ 判定を厳格化して誤り約17%。誤りは bare 側に偏るので、 ここに出した to be 率はやや過小評価側で、真値は数ポイント高い方向にある。 大小関係と桁は動かない。詳細と再現手順は C:\JC_EDU\_catalog\seem_tobe\README.md。